Сегодня 09 мая 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Сбер» запустил нейросеть Kandinsky 2.1 — она генерирует изображения по описанию на русском и других языках

Разработчики из «Сбера» представили новую версию нейросети Kandinsky, которая является отечественным аналогом популярного алгоритма Midjourney. Генеративная модель Kandinsky 2.1 может использоваться для создания высококачественных изображений на основе текстового описания, дорисовки картинок и др. Нейросеть доступна всем желающим

 Источник изображений: sberbank.com

Источник изображений: sberbank.com

«Новая генеративная модель "Сбера" — Kandinsky 2.1 — способна всего за несколько секунд создавать высококачественные изображения по текстовому описанию на естественном языке. Она также может смешивать несколько рисунков, изменять их по текстовому описанию, генерировать изображения, похожие на заданное, дорисовывать недостающие части картинки и формировать изображения в режиме бесконечного полотна (inpainting/outpainting). Модель понимает запросы на 101 языке (включая русский и английский) и умеет рисовать в различных стилях», — сказано в сообщении «Сбера».

Разработкой и обучением алгоритма занимались специалисты Sber AI совместно с учёными из Института искусственного интеллекта AIRI, задействовав для этого объединённый датасет Sber AI и SberDevices. Модель Kandinsky 2.1 является усовершенствованной версией предыдущей версии алгоритма, которая была дополнительно обучена на 170 млн пар «текст — изображение» высокого разрешения. В дополнение к этому алгоритм дополнительно обучался на отдельном датасете из двух миллионов пар качественных изображений. Этот датасет состоял из изображений с описаниями в сложных для нейросетей областях, таких как тексты и лица людей.

Представленный алгоритм усовершенствован за счёт новой модели автоэнкодера, используемой в том числе в качестве декодера векторных представлений изображений. За счёт этого удалось кардинально улучшить генерацию изображений в высоком разрешении. Модель Kandinsky 2.1 содержит 3,3 млрд параметров, что значительно больше по сравнению с 2 млрд параметров модели Kandinsky 2.0. Алгоритм использует закодированное текстовое описание и специальное представление изображения моделью CLIP. Он способен визуализировать любой контент и может применяться в разных отраслях.

Пользователи могут оценить возможности Kandinsky 2.1 на промо-странице, а также воспользовавшись командой «Запусти художника» на устройствах Sber, в мобильном приложении «Салют» и на платформе ML Space. Ещё нейросеть доступна через бота в Telegram. Правда, при попытке воспользоваться ею, через несколько минут появилось сообщение: «Произошла ошибка при работе модели:( Попробуй, пожалуйста, еще раз».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Microsoft лишила игроков новой Dishonored и Hi-Fi Rush 2, закрыв Arkane Austin и Tango Gameworks 35 мин.
Google придумала, как легко имитировать на iPhone функцию Circle to Search 6 ч.
США захотели ограничить доступ России и Китая к GPT-4 и другим мощным моделям ИИ 11 ч.
Глава разработки Kingdom Come: Deliverance 2 рассказал, как игра работает на его ПК с Ryzen 9 7950X3D и RTX 4080 Super 11 ч.
Новая Perfect Dark не выйдет из тени в ближайшее время — игра до сих пор «в очень плохом состоянии» 12 ч.
Stack Overflow передаст свой контент для обучения ChatGPT, хотят того пользователи или нет 15 ч.
Безопасный мессенджер Signal заподозрили в работе на правительство США 16 ч.
Готический шутер Trench Tales в эстетике Первой и Второй мировых войн от художника Prey появился на Kickstarter 16 ч.
Скандальная криптобиржа FTX вернёт средства почти всем клиентам — даже с процентами 16 ч.
Путин поручил поставить на контроль образ России в видеоиграх 19 ч.
Внутри смартфона Huawei Pura 70 Pro нашли больше китайский компонентов — и даже флеш-память с контроллером HiSilicon 2 ч.
Следствие подозревает Tesla в обмане инвесторов, манипуляциях с ценными бумагами и подлоге данных о FSD 2 ч.
Прогноз Arm разочаровал инвесторов, акции компании подешевели почти на 10 % 3 ч.
SK hynix представила флеш-память Zoned UFS (ZUFS) 4.0, оптимизированную для работы ИИ на мобильных устройствах 5 ч.
Пациент с имплантом Neuralink начал обыгрывать здоровых людей в Mario Kart и Civilization VI силой мысли 5 ч.
Huawei представила 14-дюймовый ноутбук MateBook 14 2024 с Intel Meteor Lake и сенсорным OLED-экраном 6 ч.
AMD отбирает долю рынка у Intel благодаря спросу на процессоры EPYC и Ryzen 6 ч.
Возобновляемые источники заняли треть в мировой выработке электроэнергии — закат эры ископаемого топлива всё ближе 8 ч.
Космический аппарат TESS возобновил поиск экзопланет после серии сбоев 10 ч.
Новая статья: ИИтоги апреля 2024 г.: парад моделей — и не только 11 ч.