реклама
Новости Hardware

«Больше, чем у кого-либо»: Цукерберг похвастался системой с более чем 100 тыс. Nvidia H100 — на ней обучается Llama 4

Среди американских IT-гигантов зародилась новая забава — соревнование, у кого больше кластеры и твёрже уверенность в превосходстве своих мощностей для обучения больших языковых моделей ИИ. Лишь недавно глава компании Tesla Илон Маск (Elon Musk) хвастался завершением сборки суперкомпьютера xAI Colossus со 100 тыс. ускорителей Nvidia H100 для обучения ИИ, как об использовании более 100 тыс. таких же ИИ-ускорителей сообщил глава Meta Марк Цукерберг (Mark Zuckerberg).

 Источник изображения: CNET/YouTube

Источник изображения: CNET/YouTube

Глава Meta отметил, что упомянутая система используется для обучения большой языковой модели нового поколения Llama 4. Эта LLM обучается «на кластере, в котором используется больше 100 000 графических ИИ-процессоров H100, и это больше, чем что-либо, что я видел в отчётах о том, что делают другие», — заявил Цукерберг. Он не поделился деталями о том, что именно уже умеет делать Llama 4. Однако, как пишет издание Wired со ссылкой на заявление главы Meta, их ИИ-модель обрела «новые модальности», «стала сильнее в рассуждениях» и «значительно быстрее».

Этим комментарием Цукерберг явно хотел уколоть Маска, который ранее заявлял, что в составе его суперкластера xAI Colossus для обучения ИИ-модели Grok используются 100 тыс. ускорителей Nvidia H100. Позже Маск заявил, что количество ускорителей в xAI Colossus в перспективе будет увеличено втрое. Meta также ранее заявила, что планирует получить до конца текущего года ИИ-ускорители, эквивалентные более чем полумиллиону H100. Таким образом, у компании Цукерберга уже имеется значительное количество оборудования для обучения своих ИИ-моделей, и будет ещё больше.

Meta использует уникальный подход к распространению своих моделей Llama — она предоставляет их полностью бесплатно, позволяя другим исследователям, компаниям и организациям создавать на их базе новые продукты. Это отличает её от тех же GPT-4o от OpenAI и Gemini от Google, доступных только через API. Однако Meta всё же накладывает некоторые ограничения на лицензию Llama, например, на коммерческое использование. Кроме того, компания не сообщает, как именно обучаются её модели. В остальном модели Llama имеют природу «открытого исходного кода».

С учётом заявленного количества используемых ускорителей для обучения ИИ-моделей возникает вопрос — сколько электричества всё это требует? Один специализированный ускоритель может съедать до 3,7 МВт·ч энергии в год. Это означает, что 100 тыс. таких ускорителей будут потреблять как минимум 370 ГВт·ч электроэнергии — как отмечается, достаточно для того, чтобы обеспечить энергией свыше 34 млн среднестатистических американских домохозяйств. Каким образом компании добывают всю эту энергию? По признанию самого Цукерберга, со временем сфера ИИ столкнётся с ограничением доступных энергетических мощностей.

Компания Илона Маска, например, использует несколько огромных мобильных генераторов для питания суперкластера из 100 тыс. ускорителей, расположенных в здании площадью более 7000 м2 в Мемфисе, штат Теннесси. Та же Google может не достичь своих целевых показателей по выбросам углерода, поскольку с 2019 года увеличила выбросы парниковых газов своими дата-центрами на 48 %. На этом фоне бывший генеральный директор Google даже предложил США отказаться от поставленных климатических целей, позволив компаниям, занимающимся ИИ, работать на полную мощность, а затем использовать разработанные технологии ИИ для решения климатического кризиса.

Meta увильнула от ответа на вопрос о том, как компании удалось запитать такой гигантский вычислительный кластер. Необходимость в обеспечении растущего объёма используемой энергии для ИИ вынудила те же технологические гиганты Amazon, Oracle, Microsoft и Google обратиться к атомной энергетике. Одни инвестируют в разработку малых ядерных реакторов, другие подписали контракты на перезапуск старых атомных электростанций для обеспечения растущих энергетических потребностей.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Apple выпустила новые беты iOS 18.2 и других ОС с поддержкой Genmoji, Image Playground и интеграцией ChatGPT 8 ч.
Биткоин перемахнул за $88 000 — за неделю он прибавил в цене $20 тысяч 8 ч.
Blizzard оживит классическую Overwatch, но лишь на время и внутри Overwatch 2 — анонсирован временный режим Overwatch: Classic 10 ч.
Разработчики Black Mesa анонсировали кооперативный шутер про корпоративную войну — трейлер и детали Rogue Point 10 ч.
Apple упростила поиск потерянных гаджетов и багажа, добавив в «Локатор» ссылки и заручившись поддержкой авиакомпаний 11 ч.
Приключение зовёт: Bethesda показала 14 минут геймплея Indiana Jones and the Great Circle от создателей Wolfenstein 13 ч.
Приложение ИИ-чат-бота Google Gemini появится на iPhone с эксклюзивными функциями 13 ч.
Календарь релизов 11 – 17 ноября: Lego Horizon Adventures, The Rise of the Golden Idol и Mindcop 13 ч.
Издатель PUBG подтвердил, что Inzoi получит перевод на русский язык — это симулятор жизни с фотореалистичной графикой 15 ч.
X откроет доступ к ИИ-чат-боту Grok для бесплатных пользователей 15 ч.
Европейские чипмейкеры выразили озабоченность тенденцией к обособлению национальных производств 2 ч.
Власти Японии решили вложить в национальную полупроводниковую промышленность $65 млрд до 2030 года 4 ч.
Valve представила лимитированную Steam Deck OLED в белом цвете за $679 4 ч.
OnePlus выпустила компактный магнитный повербанк на 5000 мА·ч с поддержкой проводной и беспроводной зарядки 4 ч.
Caviar выпустила коллекцию эксклюзивных iPhone 16 Pro и iPhone 16 Pro Max в честь Стива Джобса, Илона Маска и Дональда Трампа 4 ч.
Новая статья: Обзор складного смартфона Xiaomi MIX Flip: первая раскладушка Xiaomi 9 ч.
General Galactic применит на Земле технологию, созданную для добычи метана на Марсе 10 ч.
SpaceX повторила рекорд повторного использования ракет — первая ступень Falcon 9 выполнила 23-й полёт 12 ч.
Pizza Hut превратила PlayStation 5 в подогреватель пиццы — теперь любой желающий может сделать так же 13 ч.
Дефицит Ryzen 7 9800X3D может затянуться — крупный немецкий ретейлер ожидает новых поставок только в конце декабря 14 ч.