Модель GPT-6 Astra от OpenAI впервые полностью прошла компьютерную игру Portal без участия человека. Разработчик под псевдонимом cozyblaze опубликовал в X запись о том, что агент достиг финальных титров, самостоятельно преодолев все уровни. На прохождение ушло около 23 часов 43 минут, сообщается в посте.
Для управления игрой использовался протокол MCP (Model Context Protocol) и модифицированный инструмент SourcePauseTool, который приостанавливает игру, пока модель обдумывает следующее действие. Во время каждой паузы агент получает скриншоты, данные о позиции игрока и угле камеры, выбирает нужные команды, после чего игра продолжается. Видео, опубликованное разработчиком, смонтировано без пауз, чтобы зрители могли видеть непрерывный процесс.
Расходы на токены составили минимум $570 по прейскуранту Astra, однако cozyblaze использовал подписку Codex за $200, что существенно снизило фактические затраты. Код и документация проекта выложены на GitHub, так что любой желающий может воспроизвести эксперимент.
Прохождение заняло 23 часа 43 минуты, затраты на токены — минимум $570 по прейскуранту Astra.
Cozyblaze напоминает, что ещё в 2016 году OpenAI поставила цель создать единого агента, способного решать множество разных игр. Текущий результат — лишь частичное приближение к этой задаче, но он демонстрирует прогресс в области ИИ-агентов. «GPT-6 Astra — худшая модель, которая у нас когда-либо будет», — иронично заметил разработчик, подчёркивая, что впереди ожидаются более совершенные системы.
Эксперимент важен не только как демонстрация возможностей GPT-6 Astra, но и как шаг к созданию универсальных агентов, способных действовать в сложных интерактивных средах. Подобные задачи требуют от модели не только понимания текста, но и планирования, пространственного мышления и адаптации к неожиданным ситуациям. Пока что остаются ограничения: модель работает медленно, требует значительных вычислительных ресурсов и не всегда находит оптимальные решения. Тем не менее, автономное прохождение полноценной игры — заметная веха на пути к более широкому применению ИИ в задачах, требующих последовательных действий.



