Сегодня 06 мая 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Meta✴ представила открытую ИИ-модель ImageBind, способную обрабатывать шесть типов данных

Meta объявила о разработке модели искусственного интеллекта с открытым кодом, которая способна обрабатывать шесть потоков данных: текст, звук, статическое и динамическое изображение (видео), температуру, информацию о глубине сцены, а также информацию о движении.

 Источник изображения: ***

Источник изображения: Meta

ИИ-модель ImageBind пока представляет собой исследовательский проект, о возможном практическом применении которого пока не говорится ничего, но этот проект указывает на перспективы генеративных систем. Стоит также отметить, что Meta упорно продолжает делиться своими разработками с общественностью, тогда как её конкуренты масштаба OpenAI и Google становятся всё более закрытыми.

Ключевая концепция исследования — объединение данных различных типов в многомерный индекс. Это своеобразное развитие идеи генеративных ИИ, которые сегодня доступны потребителю. К примеру, генераторы изображений вроде DALL-E, Stable Diffusion и Midjourney обучаются на сопоставлении текста и изображения, то есть двух типов данных: нейросеть ищет закономерности в визуальных данных, которые связываются с описаниями изображений. Это в итоге позволяет системам генерировать картинки по произвольным описаниям. Схожим образом работают генераторы аудио и видео.

Проект ImageBind — попытка поместить в единое пространство сразу шесть типов данных: визуальные, в том числе неподвижные картинки и видео; тепловые, то есть информацию от инфракрасных сенсоров; текст; звук; данные о глубине; данные о движении от инерциального измерительного блока (IMU) — такие используются в смартфонах и смарт-часах. Разработчики платформы пытаются обучить её работать с этими данными так же, как с текстом или изображениями. Обученная таким образом будущая система виртуальной реальности сможет генерировать целостные окружения: так, если попросить её сымитировать морское путешествие, она поместит пользователя на корабль с шумом волн на заднем плане, дополнив его раскачивающейся палубой и океанским бризом.

В перспективе инженеры Meta предполагают и далее расширять потоки сенсорных данных, добавив «осязание, речь, обоняние и сигналы функциональной МРТ мозга». Машины же, в свою очередь, получат возможность самообучаться в реальном времени на информации в различных формах.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Утечка раскрыла первые подробности PvP-мультиплеера Warhammer 40,000: Space Marine 2 14 мин.
YouTube протестирует на платных подписчиках перемотку видео сразу на самое интересное место 2 ч.
В AlmaLinux сформировано подразделение по НРС и ИИ 3 ч.
Сооснователь Twitter Джек Дорси покинул совет директоров децентрализованной соцсети Bluesky 3 ч.
Обзорный трейлер пошаговой ролевой игры SteamWorld Heist II: бои, прокачка, мультиклассы и кое-что ещё 14 ч.
Не бывать дешёвым мейнфреймам: IBM подала второй иск к LzLabs, предлагающей доступную облачную альтернативу её «железу» 15 ч.
TikTok удалил сотни видео с запрещёнными материалами по требованию «Роскомнадзора» с начала 2023 года 22 ч.
Симулятор выживания Serum про сыворотку, гонку со временем и отравленный лес выйдет в раннем доступе 23 мая 22 ч.
В Instagram появились «секретные» Stories — для их просмотра нужно написать автору 23 ч.
IBM избежала выплаты $1,6 мрд в пользу BMC 24 ч.
XFX выпустила Radeon RX 7900 XTX Phoenix Nirvana с огромным кулером, фазовым переходом и магнитными вентиляторами 12 мин.
Средства от продажи Yandex могут направить на поддержку российской электронной промышленности 60 мин.
Huawei начала теснить Apple на рынке планшетов, нарастив продажи на 70 % в первом квартале 2 ч.
TrendForce: развитие ИИ стимулирует рост спроса на корпоративные QLC SSD 2 ч.
Россияне закупились игровой электроникой к майским праздникам 3 ч.
Apple ускорила разработку «устройств сверхвысокого класса» — складного iPhone и MacBook с гибким экраном 3 ч.
Низкопрофильный одноплатный компьютер Banana Pi BPI-M5 Pro для AIoT-устройств получил чип Rockchip RK3576 3 ч.
Nvidia сталкивает поставщиков памяти HBM, чтобы добиться от них снижения цен 5 ч.
Tesla готовит почву для легализации FSD в Европе и Великобритании 7 ч.
Апрельская выручка Foxconn выросла на 19 % до рекордных $15,8 млрд 9 ч.