реклама
Теги → компьютерная игра

GPT-4 освоил Red Dead Redemption 2, но его подводит машинное зрение

Группа исследователей из Китая и Сингапура научила ИИ на базе OpenAI GPT-4V играть в Red Dead Redemption 2 (RDR2). В своей статье они рассказали о концепции общего компьютерного контроля (General Computer Control, GCC) для ИИ, и о мультимодальном агенте CRADLE — интерфейсе между GPT-4V и RDR2. По их мнению, основные проблемы у игрового ИИ-агента возникли при использовании машинного зрения.

 Источник изображения: Rockstar

Источник изображения: Rockstar

Исследователи поставили своей целью заставить ИИ, работающий на базе OpenAI GPT-4V, взаимодействовать с компьютером, воспринимая визуальные и звуковые сигналы, как это делает среднестатистический человек-пользователь ПК. Проект даёт представление о том, насколько далеко продвинулись разработчики ИИ в движении в сторону создания общего (сильного) искусственного интеллекта (AGI).

Исследователи выбрали RDR2, так как она имеет «сложную систему управления черным ящиком, которая воплощает в себе самые требовательные компьютерные задачи и позволяет нам оценить границы производительности нашей платформы в таких виртуальных средах». Кроме того, такие элементы пользовательского интерфейса, как диалоги, уникальные значки, внутриигровые подсказки и инструкции, гарантируют, что никакие базовые знания не воспринимаются как нечто само собой разумеющееся, что отлично подходит для обучения ИИ. Исследователи утверждают, что управление игрой с помощью мыши и клавиатуры обеспечивает лучшую тренировку для GCC.

 Как устроен CRADLE / Источник изображения: arxiv.org

Как устроен CRADLE / Источник изображения: arxiv.org

Исследователи стремились продемонстрировать способность ИИ изучать игру с нуля (без доступа к какому-либо внутреннему состоянию игры или API), то есть как это делает человек. ИИ-агент «проходил» игру, перемещаясь по миру и выполняя задания, следуя основной сюжетной линии RDR2. В целом, CRADLE добился заметного успеха в RDR2. Он смог «последовательно выполнять все задачи основной сюжетной линии», за исключением миссии с ураганной перестрелкой, заданий, которые требуют исследования сложного внутреннего мира, и многоэтапных миссий с открытым финалом.

 Как CRADLE выполняет buhjdst задания / Источник изображения: arxiv.org

Как CRADLE выполняет игровые задания / Источник изображения: arxiv.org

Исследователи считают, что причиной некоторых повторяющихся трудностей, с которыми сталкивался CRADLE, является GPT4-V. По их мнению, «возможности пространственно-визуального распознавания GPT-4V недостаточны для точного детального контроля». GPT4-V не справился с концепциями, специфичными для предметной области, такими как уникальные значки в игре, с пониманием мини-карт, а также с общими препятствиями в игровой среде.

 Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Производительность CRADLE в разных типах миссий / Источник изображения: arxiv.org

Хотя опубликованная статья посвящена взаимодействию ИИ с RDR2, авторы утверждают, что предназначение системы CRADLE в рамках GCC гораздо шире: «для поддержки более широкого спектра игр, таких как игры-симуляторы и стратегии, а также различных программных приложений».

window-new
Soft
Hard
Тренды 🔥
Razer запустила платформу PC Remote Play для потоковой передачи игр с ПК на мобильные устройства 7 мин.
Футбольный экшен Rematch от создателей Sifu готов к выходу на поле — дата релиза, предзаказ в российском Steam и анонс открытой «беты» 20 мин.
OpenAI стала тратить меньше времени на тесты безопасности ИИ-моделей 28 мин.
Российские учёные совершили прорыв в оптимизации ИИ-моделей — теперь их можно использовать без мощных серверов 55 мин.
ИИ-стартап выдавал филиппинцев за ИИ — теперь основатель компании ответит за это в суде 57 мин.
В России хотят запретить ИИ с «неприемлемым уровнем риска» 59 мин.
Экспорт российской ИТ-продукции падает четвёртый год подряд, но разработчики считают иначе 3 ч.
Похоже, сериал Tomb Raider от Amazon «мёртв» — в проект вложили «десятки миллионов долларов», а не готов даже сценарий 3 ч.
World of Goo 2 выйдет в Steam с меню настроек и новыми уровнями для самых хардкорных игроков — трейлер и дата релиза 3 ч.
«До чего же круто это выглядит»: взрывной геймплейный трейлер Into the Fire от создателей The Invincible впечатлил игроков 3 ч.
Учёные превратили бактерии в гиперспектральные датчики для оценки здоровья растений из космоса 2 мин.
Электрический пикап за $25 000, который помогает создавать Джефф Безос, показался на шпионском фото 2 ч.
Китай поднял пошлины на американские товары до 125 % и пообещал на этом остановиться 3 ч.
NERPA представила универсальные высокопроизводительные серверы NORD D5720 3 ч.
Tesla остановила приём заказов на дорогие модели в Китае и Японии, а в США её электромобили хлынули на вторичный рынок 4 ч.
NTT представила ИИ-чип для обработки видео на периферии 4 ч.
Нейтрино экспериментально ограничили по массе — неуловимая частица близка к раскрытию секретов Вселенной 4 ч.
Samsung опровергла слухи о прекращении выпуска чипов для китайских компаний 6 ч.
Конец «зелёной повестки»: Трамп поддержал угольный сектор в США ради удовлетворения спроса ИИ ЦОД на энергию 6 ч.
Tesla начала предлагать заднеприводный пикап Cybertruck, но он оказался дороже обещанного 7 ч.