реклама
Новости Software

Meta✴ представила SeamlessM4T — универсальную ИИ-модель для перевода текста и речи почти на 100 языков, включая русский

Сегодня Meta представила SeamlessM4T, первую универсальную мультимодальную и многоязычную модель перевода с использованием ИИ, которая позволяет пользователям общаться, не замечая языковых барьеров. SeamlessM4T на данный момент доступна исследователям и разработчикам под соответствующей лицензией. Также опубликованы метаданные SeamlessAlign, крупнейшего открытого набора данных для мультимодального перевода, включающего 270 000 часов изученной речи.

 Источник изображения: ***

Источник изображения: Meta

Создание универсального языкового переводчика, подобного вымышленной «Вавилонской рыбке» из романов Дугласа Адамса «Автостопом по Галактике», является непростой задачей, а существующие системы преобразования речи в речь и речи в текст охватывают лишь небольшую часть языков мира. SeamlessM4T основана на достижениях исследователей всего мира за многие годы в стремлении создать универсальный переводчик. По сравнению с подходами, использующими отдельные модели, единый системный подход SeamlessM4T уменьшает количество ошибок и задержек, повышая эффективность и качество процесса перевода.

 Прикольный гаджет!  / Источник изображения: Фильм «Автостопом по Галактике»

Прикольный гаджет! / Источник изображения: Фильм «Автостопом по Галактике»

В прошлом году разработчики Meta выпустили No Language Left Behind (NLLB), модель машинного перевода текста в текст, которая поддерживает 200 языков и с тех пор интегрирована в Википедию в качестве одного из поставщиков услуг перевода. Ранее они продемонстрировали универсальный переводчик речи, который стал первой системой прямого преобразования речи в речь для южноминьского языка (диалект китайского). Ещё один языковой проект Meta — Massively Multilingual Speech, система по распознаванию, идентификации и синтезу речи на более чем 1100 языках.

SeamlessM4T опирается на результаты всех этих проектов, обеспечивая многоязычный и мультимодальный перевод на основе единой модели, построенной на широком спектре устных источников данных с самыми современными результатами. SeamlessM4T поддерживает:

  • Распознавание речи почти на 100 языках;
  • Преобразование речи в текст почти для 100 языков ввода и вывода;
  • Преобразование речи в речь, поддержка почти 100 языков ввода и 36 (включая английский и русский) языков вывода;
  • Текстовый перевод почти на 100 языков;
  • Преобразование текста в речь, поддержка почти 100 языков ввода и 35 (включая английский и русский) языков вывода.

SeamlessM4T — очередной шаг в усилиях исследователей по созданию технологии на базе ИИ, которая поможет соединять людей, говорящих на разных языках. Узнать больше о SeamlessM4T можно в блоге Meta AI.

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Новая статья: The First Berserker: Khazan — дёшево, но по-хорошему сердито. Рецензия 21 ч.
Новая статья: Gamesblender № 721: новый шанс для Deus Ex, Switch 2 и цены, скандальное ИИ-демо Quake II 22 ч.
Marathon вышла из тени — дата выхода, много геймплея и короткометражка от оскароносного режиссёра 23 ч.
Объём экспорта российского ПО в 2024 году рухнул в полтора раза, но это не точно 12-04 15:07
Двухлетняя модель GPT-4 скоро исчезнет из ChatGPT, уступив место более свежей GPT-4o 12-04 05:39
ChatGPT обошёл Instagram и TikTok, став самым скачиваемым приложением в мире 12-04 05:34
Новая статья: inZOI — прощайте, симы. Предварительный обзор 12-04 00:03
Студия выходцев из Blizzard показала Causal Loop — вдохновлённую Portal и «Интерстеллар» головоломку, где нужно перезаписывать реальность 11-04 23:20
SaaS в России продолжает расти, однако не все направления показывают положительную динамику 11-04 22:33
В Ирландии проверят законность обучения ИИ-модели Grok на постах европейцев в X 11-04 22:10
Объём телеком-рынка в России в 2024 году превысил 2,1 трлн руб., а трафик вырос со 151,52 Эбайт до 188,53 Эбайт 6 ч.
Biostar представила индустриальный компьютер MX-X7433RE на базе Intel Amston Lake 6 ч.
Nvidia впервые обошла Samsung и стала крупнейшим поставщиком полупроводниковой продукции 13 ч.
Евросоюз пытается перейти от повышенных пошлин к минимально допустимому уровню цен при импорте китайских электромобилей 14 ч.
Каждый пятый iPhone теперь производится в Индии 15 ч.
Три месяца до Марса: британцы придумали космический буксир на термоядерной тяге 24 ч.
Подорожание iPhone, видеокарт и прочей электроники отменяется — Трамп вывел их из-под действия повышенных пошлин 12-04 19:51
В 2024 госзакупки ИИ-оборудования увеличились на 150 % до 2,4 млрд рублей 12-04 16:20
Разработчик оптических чипов-коммутаторов на основе кремниевой фотоники nEye Systems получил на развитие $58 млн 12-04 15:28
Asus представила бюджетную плату X870 MAX Gaming WiFi7 для Ryzen 9000 12-04 14:11
Включить темный режим