реклама
Теги → генератор изображений

«Сбер» научил нейросеть Kandinsky генерировать стикеры и фотореалистичные изображения и портреты

«Сбер» представил новую версию своей нейросети для генерации изображений по текстовому описанию — Kandinsky 2.2, которая позволит создавать фотореалистичные изображения с более высоким разрешением и изменять соотношение сторон при генерации, а также обеспечит значительный прирост качества при создании портретов.

 Генерация Kandinsky 2.2           Источник изображений: «Сбер»

Генерация Kandinsky 2.2. Источник изображений: «Сбер»

Для дообучения Kandinsky 2.2 использовался набор данных из 1,5 млрд пар «текст — изображение», что на 300 млн больше, чем для предыдущей версии — Kandinsky 2.1, вышедшей в апреле этого года и набравшей всего за 6 дней 2 млн пользователей.

Новую версию модели научили создавать стикеры, из которых можно собирать полноценные стикерпаки в Telegram. Также благодаря внедрению специального структурного блока управляемых изменений ControlNetона она получила способность изменять по текстовому описанию отдельные объекты или элементы на изображениях, сохраняя при этом композицию исходной иллюстрации.

 Генерация Kandinsky 2.2

Генерация Kandinsky 2.2

Согласно пресс-релизу, Kandinsky 2.2 понимает запросы на русском и английском языках, обладает способностью рисовать более чем в 20 стилях, смешивать несколько рисунков, стилизовать изображение по текстовому описанию, генерировать изображения, похожие на заданные, а также дорисовывать недостающие части картинки (inpainting) и создавать картины в режиме бесконечного полотна (outpainting).

 Стикерпак от Kandinsky 2.2

Стикерпак от Kandinsky 2.2

«Нейросеть уже не просто пытается подражать творчеству человека, а способна создавать новые художественные смыслы и интерпретации», — сообщил первый зампред правления Сбербанка Александр Ведяхин, добавив, что, как и предыдущая версия, Kandinsky 2.2 находится в открытом доступе, и протестировать её можно совершенно бесплатно.

Сообщается, что ознакомиться с возможностями Kandinsky 2.2 можно на промостранице модели, на платформе FusionBrain.AI, в Telegram-боте и боте соцсети «ВКонтакте», а также при помощи команды «Запусти художника» на умных устройствах Sber, в мобильном приложении Салют. Модель доступна на платформе ML Space в хабе предобученных моделей и датасетов DataHub.

Разработкой и обучением нейросети занимались исследователи Sber AI при партнёрской поддержке учёных из Института искусственного интеллекта AIRI на объединённом датасете Sber AI и компании SberDevices.

ИИ-генератор изображений Microsoft Designer вышел в открытый доступ

Основанный на алгоритмах искусственного интеллекта генератор изображений Microsoft Designer стал общедоступной платформой, испробовать которую может любой желающий — достаточно войти в свой аккаунт системы Microsoft.

 Источник изображения: designer.microsoft.com

Источник изображения: designer.microsoft.com

Работа с Microsoft Designer начинается либо с загрузки собственного изображения, либо с генерации картинки по описанию. Есть также возможность создать слайд с заданным текстом в соответствии с набором шаблонов. Поддерживаются функции редактирования: перед получением окончательного результата можно внести в макет некоторые правки, например, изменить размер или начертание текста. При изменении размера картинки макет подстраивается под новый формат.

Microsoft Designer создан с расчётом на экспорт в социальные сети: шаблоны оптимизированы для выгрузки в Instagram и Facebook — всего около 20 платформ. Нейросеть может помочь в создании описания загруженного пользователем изображения, подобрать хештеги для него или произвести публикацию прямо из Designer.

Генерируемые ИИ изображения сегодня являются своеобразным «Диким Западом» с позиции авторского права — оно признается только в той части работы, которую совершает человек. Любопытно, что Microsoft разделяет эту позицию, заявляя, что не претендует ни на авторство контента, загружаемого пользователями, ни на авторство генерируемых изображений. Корпорация не ограничивает пользователей в коммерциализации этих изображений и, вместе с тем, возлагает на них всю ответственность за принимаемые ими решения по продаже таких картинок.

Microsoft планирует добавить Designer в браузер Edge наряду с инструментом Image Creator. При просмотре лент Twitter или Facebook в Edge и создании публикаций Designer может предложить дополнить их своими изображениями, чтобы оживить её. Кроме того, в планах Microsoft — новые функции редактирования изображений с ИИ. К примеру, можно будет убрать с головы человека корону или заменить её бейсболкой. Появится также функция смены фона, аналогичная той, что уже есть в Adobe Photoshop. Наконец, Microsoft Designer будет работать по freemium-модели: некоторые возможности станут доступными только для подписчиков Microsoft 365.

2 млн пользователей за 6 дней: нейросеть «Сбера» Kandinsky 2.1 оказалась среди самых быстрорастущих сервисов мира

Стало известно, что бесплатная генеративная модель Kandinsky 2.1, презентация которой состоялась ранее в этом месяце, стала одним из самых быстрорастущих сервисов искусственного интеллекта в мире. Она способна генерировать красочные картинки по текстовому описанию пользователя, а также поддерживает возможность создания работ в разных стилях.

Результат работы алгоритма Kandinsky 2.1 по запросу

Результат работы алгоритма Kandinsky 2.1 по запросу «современный художник за работой»

Разработчики сообщили, что алгоритму Kandinsky 2.1 потребовалось всего четыре дня, чтобы достичь отметки в 1 млн уникальных пользователей. Любопытно, что это на один день быстрее результата чат-бота ChatGPT компании Open AI. Согласно имеющимся данным, с момента запуска алгоритма было сгенерировано свыше 10 млн изображений, а число уникальных пользователей достигло 2 млн человек. Также отмечается, что на прошлой неделе алгоритм Kandinsky 2.1 попал в топ-5 трендов мировых репозиториев по версии сервиса GitHub.

Напомним, алгоритм Kandinsky 2.1 может генерировать изображения по их текстовому описанию на естественном языке. Модель поддерживает обработку запросов на 101 языке и готова открыть для пользователей новые творческие возможности, включая смешивание нескольких рисунков, дорисовку изображений, создание картин в режиме бесконечного полотна и др. Разработкой и обучением алгоритма занимались специалисты Sber AI совместно с учёными из Института искусственного интеллекта AIRI на объединённом дата-сете Sber AI и компании SberDevices. Kandinsky 2.1 содержит 3,3 млрд параметров вместо 2 млрд параметров в предыдущей версии алгоритма.

window-new
Soft
Hard
Тренды 🔥
Самые полные издания Borderlands 3 и Diablo III добавят в Game Pass, а лучшая игра 2024 года по версии 3DNews подписку скоро покинет 11 ч.
«Эпический» сериал Netflix по Assassin’s Creed впервые за несколько лет подал признаки жизни 12 ч.
Спустя 10 лет после релиза Enter the Gungeon получит «крупнокалиберный сиквел» — первый трейлер и подробности Enter the Gungeon 2 14 ч.
Роскомнадзор порекомендовал отказаться от использования решения Cloudflare, нарушающего законы РФ 14 ч.
«Наш контент бесплатный, а инфраструктура — нет»: ИИ-боты разоряют «Википедию» 15 ч.
Nintendo поднимет цены на игры раньше Take-Two с GTA VI — Mario Kart World для Switch 2 будет стоить $80 в «цифре» и $90 в рознице 15 ч.
Роскомнадзор наделил себя правом собирать IP-адреса россиян 16 ч.
«Торт не был ложью!»: Nintendo подтвердила релиз Hollow Knight: Silksong в 2025 году и показала 5 секунд геймплея 16 ч.
Adobe придумала монтаж без пересъёмок: Premiere Pro 25.2 получил ИИ, который добавит ролику недостающие кадры 16 ч.
FromSoftware анонсировала мультиплеерный боевик The Duskbloods, который выглядит как смесь Elden Ring и Bloodborne — это эксклюзив Nintendo Switch 2 17 ч.
Названа дата запуска первой партии интернет-спутников Amazon Project Kuiper — они полетят на ракете с российскими двигателями 17 мин.
Samsung резко нарастила поставки чипов в Китай, пока этому не мешают санкции 21 мин.
Western Digital выпустила HDD серии Purple Pro ёмкостью 26 Тбайт для систем видеонаблюдения 56 мин.
Китай увеличил закупки ИИ-чипов Nvidia в четыре раза — до $16 млрд за первый квартал 3 ч.
Акции Tesla отыграли потери на слухах об уходе Илона Маска из правительства США 4 ч.
ASML увеличит количество обслуживающего персонала в Японии в пять раз 6 ч.
Новая статья: Обзор SSD-накопителя Dahua C970 Plus: «Китай» в хорошем смысле 11 ч.
От трамповских пошлин на алюминий взлетят цены на видеокарты и ПК-корпуса 12 ч.
Microsoft запустила продажи первого в мире облачного ПК Windows 365 Link за $350 13 ч.
MediaTek представила процессор Kompanio Ultra для хромбуков будущего с ИИ — он очень похож на Dimensity 9400 14 ч.