реклама
Новости Software

Meta✴ анонсировала производительный ИИ-генератор изображений CM3Leon с поддержкой точных команд редактирования

За минувшие два года основанные на алгоритмах искусственного интеллекта генераторы изображений стали почти повседневным явлением, и на первый взгляд в работе они не так сильно отличаются друг от друга. Но в Meta утверждают, что разработанная инженерами компании новая модель CM3Leon является прорывом.

 Источник изображений: ***

Источник изображений: Meta

Отличием модели Meta CM3Leon, как заявляют разработчики, является высокая производительность при преобразовании текста в изображение. Кроме того, это одна из первых моделей, обеспечивающих обратную операцию — создание подписей к изображениям. Большинство современных генераторов изображений, включая OpenAI DALL-E, Google Imagen и Stable Diffusion при создании картинок используют диффузию — процесс постепенного удаления шума из первоначального изображения по мере приближения к поставленной цели. Результат получается убедительным, но данный алгоритм требует значительных вычислительных ресурсов, что делает работу таких систем дорогостоящей, а сами модели — медленными, и в реальном времени они функционировать попросту не могут.

 Редактирование исходного изображения: заменить девушку на бородатого мужчину, добавить очки, увеличить возраст, раскрасить лицо

Редактирование исходного изображения: заменить девушку на бородатого мужчину, добавить очки, увеличить возраст, раскрасить лицо

Модель CM3Leon действует принципиально иначе — в её основе лежит алгоритм-трансформер, предусматривающий оценку релевантности исходных данных, будь то текст или изображение. Примечательно, что и в OpenAI первоначально строили генераторы изображений на основе моделей-трансформеров, но на смену Image GPT пришли диффузионные алгоритмы. При обучении CM3Leon использовались 2 млн изображений, лицензированных у Shutterstock — самая мощная версия модели имеет 7 млрд параметров — в два раза больше, чем у OpenAI DALL-E 2. Наконец, здесь использован механизм дообучения SFT (Supervised Fine-Tuning), обычно свойственный генераторам текста. В результате увеличилась производительность модели при генерации изображений и составлении описаний к готовым картинкам, а система получила возможность редактировать изображения по текстовым командам, например, «изменить цвет неба на ярко-синий».

 Генерация интерьера с объектами, для которых указываются точные координаты

Генерация интерьера с объектами, для которых указываются точные координаты

В результате Meta CM3Leon воспринимает в качестве исходных данных весьма конкретные команды — вплоть до того, в какой области изображения в пикселях должен находиться тот или иной предмет. Для сравнения, DALL-E такие нюансы игнорирует и зачастую даже отказывается помещать на изображение объекты, непосредственно указанные в инструкции.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
В деле об отделении Instagram и WhatsApp от Meta появилась веская улика — компрометирующее письмо Цукерберга от 2012 года 32 мин.
ИИ-модели Gemini позволили анализировать снимки в «Google Фото», но пока не у всех пользователей 34 мин.
«Абсолютно завораживающий опыт»: эксперт Digital Foundry протестировал Cyberpunk 2077 на Nintendo Switch 2 2 ч.
К Apple подали ещё два иска за невыполненные обещания по ИИ-функциям Apple Intelligence 3 ч.
Apple будет анализировать переписки пользователей на iPhone, iPad и Mac для улучшения своего ИИ 3 ч.
Правительство РФ определилось, как будет изымать криптовалюту при уголовных делах 4 ч.
Контур.Толк представил новый ИИ-инструмент — резюме встречи 5 ч.
Broadcom вернула бесплатную версию VMware ESXi 8, но никому об этом не сказала 14 ч.
Meta начнёт обучать нейросети на данных пользователей из ЕС 15 ч.
Эпическое создание, новые квесты и механики: бесплатный аддон Stargazer для боевика Eternal Strands от студии экс-режиссёра Dragon Age готов к выходу 15 ч.
Тайвань впервые обвинил капитана китайского судна в умышленном повреждении подводных кабелей 19 мин.
Крупнейший завод по сборке iPhone возобновил набор сотрудников, несмотря на неопределённость с пошлинами 30 мин.
Apple впервые стала крупнейшим в мире производителем смартфонов в первом квартале 31 мин.
Российским производителям электроники прекратят выдавать субсидии 3 ч.
Власти США начали расследование цепочек импорта чипов — это грозит новыми пошлинами 3 ч.
Ученые создали растягивающуюся литиевую батарею — её безопасно сгибать, резать и прокалывать 3 ч.
HUAWEI FreeArc: вероятно, самые удобные TWS-наушники 4 ч.
Google Maps со встроенным ИИ для электросетей: Google и PJM ускорят развитие энергетики в США 4 ч.
Южная Корея усилила меры по поддержке национальной полупроводниковой отрасли 5 ч.
Несчастье помогло: в прошлом квартале Apple стала лидером по росту поставок смартфонов 7 ч.
Включить темный режим