Введение
Новая флагманская модель OpenAI GPT-6 Astra, представленная 3 сентября 2026 года, совершила то, что ещё недавно казалось уделом исключительно человека, — полностью автономно прошла культовую 3D-головоломку Portal от Valve. Эксперимент провёл независимый энтузиаст под ником cozyblaze, подключивший модель к игре через специальный агент. Результат впечатляет: ИИ не просто «прочитал» прохождение, а самостоятельно анализировал скриншоты, планировал действия и решал пространственные загадки — правда, на это ушло почти 24 часа реального времени и более $570.
Детали: цифры и факты
Эксперимент стал возможен благодаря связке нескольких инструментов. cozyblaze подключил GPT-6 Astra к игре через Model Context Protocol (MCP) и модифицированную версию SourcePauseTool, которая передавала команды в движок. Модель получала скриншоты происходящего на экране, координаты персонажа и направление его взгляда, после чего выбирала следующее действие — ходьбу, прыжок, приседание, взаимодействие с объектами или выстрел портальной пушки.
Ключевая особенность эксперимента — игра ставилась на паузу на время «размышлений» модели. Поэтому опубликованное видео длится около двух часов, но реальный процесс занял значительно больше. Вот ключевые цифры:
- Игровое время прохождения: 1 час 53 минуты 37 секунд (без учёта пауз на анализ).
- Реальное время: примерно 23 часа 38–43 минуты, с учётом ожидания, перебоев с доступом к сервису и технических сбоев.
- Вызовы инструментов: 3336 обращений к инструментам (по другим данным — 6925 операций в журнале сессии).
- Обработанные токены: около 432–434,8 млн (включая данные из кэша).
- Стоимость API: $571,18. При этом автор оплачивал запросы не отдельно, а через подписку Codex Pro за $200 в месяц.
- Уровень рассуждений: использовался максимальный режим модели.
Для сравнения: у реальных людей на прохождение основного сюжета Portal уходит в среднем около трёх часов, по данным HowLongToBeat. Примечательно, что поиск в интернете во время эксперимента был отключён — Astra не могла подсмотреть гайд. Единственное вмешательство человека после старта — просьба оставить финальные титры на экране.
Исходный код контроллера, конфигурацию запуска и журнал сессии cozyblaze опубликовал на GitHub, а записи прохождения частично выложил на YouTube.
Анализ
Этот эксперимент — важная веха в развитии «агентных» ИИ, способных не просто генерировать текст, а действовать в сложной, физически смоделированной среде. Portal построена вокруг пространственных головоломок: нужно понимать устройство комнат, расположение порталов и перемещение между поверхностями. То, что Astra справилась с этим, анализируя лишь скриншоты и координаты, говорит о серьёзном прогрессе в пространственном мышлении языковых моделей.
Впрочем, стоит оговориться. Portal — игра 2007 года, хорошо документированная и широко представленная в обучающих данных. Модель вполне могла «знать» механику отдельных испытательных камер заранее. Кроме того, автор подстроил окружение: изменил настройки скольжения персонажа для более точных движений, а игра ставилась на паузу во время размышлений — это превращало процесс в пошаговую стратегию, а не в реальный геймплей в реальном времени.
На фоне конкурентов OpenAI выглядит уверенно: Anthropic делает ставку на «компьютерное использование» и агентный код, Google Gemini — на мультимодальные инструменты в браузерах, а DeepSeek сосредоточен на рассуждениях и бенчмарках. Именно в пространственном мышлении внутри физической среды GPT-6 Astra пока в своей лиге.
Мнение
Честно говоря, результат одновременно впечатляет и заставляет улыбнуться. С одной стороны, видеть, как общая ИИ-модель часами методично разбирается с портальными головоломками, — это маленькое чудо. С другой — $571 и почти сутки на игру, которую человек проходит за три часа, выглядят как очень дорогой и неторопливый способ поиграть. Как справедливо заметили комментаторы, за эти деньги можно было просто нанять человека.
Но суть не в экономической эффективности. Важно другое: модель удерживала долгосрочную цель на протяжении тысяч шагов, адаптировалась к ошибкам и довела дело до финальных титров. Это шаг к тому «универсальному игровому агенту», о котором OpenAI намекает уже около десяти лет. И то, что cozyblaze планирует повторить эксперимент на Portal 2, — отличная новость: сиквел сложнее и менее заезжен в обучающих данных, так что это станет более честной проверкой.
Итог
GPT-6 Astra прошла Portal автономно — это яркая демонстрация возможностей новой флагманской модели OpenAI в области пространственного мышления и долгосрочного планирования. Однако эксперимент показал и ограничения: почти сутки реального времени, $571 на токены, паузы на размышления и подстройка окружения под модель. Настоящей проверкой станут менее известные игры и более «живой» геймплей без пауз. Пока же можно сказать: ИИ научился проходить Portal — но делает это медленно, дорого и очень вдумчиво.
FAQ
Почему прохождение заняло почти сутки, если видео длится два часа?
Игра ставилась на паузу каждый раз, когда модель анализировала скриншоты и планировала следующее действие. С учётом этих «размышлений», ожидания и технических перебоев реальное время составило около 23 часов 40 минут, тогда как чистое игровое время — менее двух часов.
Знала ли модель Portal заранее?
Поиск в интернете был отключён, но Portal — хорошо документированная игра 2007 года, широко представленная в обучающих данных. Поэтому нельзя исключать, что Astra была знакома с механикой и отдельными испытательными камерами. Более честной проверкой станет эксперимент с Portal 2, который планирует автор.
Сколько это стоило и кто оплатил эксперимент?
Расходы на токены API составили $571,18. Автор эксперимента cozyblaze оплачивал запросы через подписку Codex Pro за $200 в месяц, а не отдельно за каждый запрос.
