Модель искусственного интеллекта GPT-6 Astra прошла игру «Portal» от Valve в одиночном режиме за 24 часа

Энтузиаст в области искусственного интеллекта под ником CozyBlaze недавно запустил новую флагманскую модель OpenAI — GPT-6 Astra — в игре Portal от Valve. Модель ИИ прошла полную версию 3D-головоломки, а не упрощённую текстовую версию, без пошагового руководства или заранее запрограммированной помощи. Для выполнения задачи использовались только сама модель, модифицированный инструмент SourcePauseTool и протокол Model Context Protocol, обрабатывающий фактические нажатия кнопок.
Однако всякий раз, когда Astra нуждалась в времени на обдумывание, игра зависала и возобновлялась, как только агентный ИИ вычислял следующую последовательность ходов для выполнения в режиме реального времени. Это довольно изобретательный способ преодолеть разрыв между скоростью рассуждений большого языкового модели (LLM) и физикой кадров игрового движка. Именно поэтому готовое видео, сокращённое до примерно двух часов в демонстрационных целях, на самом деле отражает около 24 часов исходного несжатого игрового процесса.
Стоимость игрового процесса GPT-6 Astra Portal
Астра прошла всю игру, выполнив около 3 300 вызовов инструментов, при этом стоимость API составила менее 600 долларов, хотя CozyBlaze отмечает, что этот проход фактически был оплачен за счёт подписки на Codex Pro стоимостью 200 долларов в месяц.
Сам CozyBlaze не придаёт большого значения этому достижению, удерживаясь от соблазна назвать его тестом производительности, как это делают многие другие, подвергающие ИИ нестандартным испытаниям. Однако наблюдение за тем, как универсальный агент ИИ исследует незнакомую 3D-среду и самостоятельно решает пространственные головоломки от начала до конца, выглядит как реальный шаг в направлении создания того самого универсального игрового агента, о котором OpenAI говорит уже около десяти лет.
Что касается конкурентов, то модели Claude от Anthropic в большей степени сосредоточены на использовании компьютера и задачах агентского программирования, а не конкретно на игровых средах, в то время как агенты Gemini от Google ориентированы на мультимодальное использование инструментов в браузерах и приложениях. Китайский агент DeepSeek достиг высоких результатов в тестах на эффективное логическое мышление и программирование, а не в открытых задачах, таких как ориентация в 3D-игровом мире, поэтому на данный момент новейшая модель искусственного интеллекта GPT-6 Astra от OpenAI не имеет себе равных в плане пространственного мышления в физически моделируемой среде, подобной головоломке Portal от Valve.






