Claude Opus 5 создает играбельную FPS-игру с простым трехабзацным промптом

Key Takeaways
  • Claude Opus 5 создал полностью играбельную игру в жанре шутера от первого лица по трехабзацному промпту 25 июля.
  • Игра работает на Three.js и WebGL2, а кодовая база содержит примерно 55 000 строк кода в 11 подсистемах.
  • Несколько разработчиков воссоздали результаты, используя идентичные или модифицированные промпты, при этом James Altucher и Leon Lin собрали играбельные версии прямо в браузере.

ИИ-инвестор и бывший CEO HyperWrite Мэтт Шумер опубликовал видео полностью играбельного шутера от первого лица, созданного целиком моделью Claude Opus 5 всего через два дня после выхода модели. Игра была собрана, используя промпт из трёх абзацев, опубликованный на GitHub. Шумер заявил, что проект был «сделан с первого же раза» без внешних ассетов, но из-за качества и простоты промпта возникло немедленное скептическое отношение. Шумер опубликовал полный промпт и кодовую базу после того, как критики предположили скрытое ручное программирование — это побудило нескольких разработчиков повторить результаты тем же методом, который Шумер называет Gauntlet Loop.

Claude Opus 5 Builds First-Person Shooter With Three-Paragraph Prompt

Мэтт Шумер 25 июля написал, что Claude Opus 5 построил шутер от первого лица с промптом, который занимает три коротких абзаца. Промпт, полностью опубликованный на GitHub, предписывал Opus 5 собрать шутер на уровне недавних игр Call of Duty, развернуть подагентов для отдельных задач и прогонять каждую часть через отдельного критика, пока она не совпадёт с реальными кадрами Call of Duty в слепых попарных сравнениях. Готовая сборка работает на Three.js и WebGL2, при этом примерно 55 000 строк кода в 11 подсистемах. Каждая текстура, меш, анимация и звук генерируются внутри браузера во время загрузки — без скачивания моделей или внешних файлов. Шумер не указал рендерер, не перечислил игровые системы и не задавал требования уровня AAA. Промпт говорил подагентам быть «полностью в восторге» и оставлял реальные определения критику, которого Opus 5 создал для себя. Опубликованный Шумером лог критика показывает, что оценки росли с 3,59 из 10 до чуть выше 5, при этом реальный Call of Duty выигрывал каждый раунд, который был залогирован.

Developers Replicate Results With Identical and Modified Prompts

Джеймс Альтучер, бывший менеджер хедж-фонда и подкастер, прогнал идентичный промпт и сообщил, что потратил более десяти часов и примерно 1,3 млн токенов на Opus 5. Его сборка Operation Blackout доступна бесплатно в браузере. Разработчик Prompt Silo отправил тот же запрос в Sol 5.6 Ultra от OpenAI — верхний уровень трёхмодельного семейства GPT-5.6, которое OpenAI сделала общедоступным 9 июля. Разработчик Леон Лин провёл реверс-инжиниринг подробного промпта, уходящего в 20 секций, с указанием элементов от физики ragdoll до каскадных карт теней, и подал его в Cursor, используя обычный Opus 5 при высоких усилиях, без подагентов и без ultracode. Его результат Dust Corridor тоже играет прямо в браузере. Ни одна из последующих сборок не проходила слепой тест, который Шумер проводил на своём проекте. Лог критика Шумера показывает, что реальный Call of Duty выигрывал каждый раунд, который он залогировал.

Gauntlet Loop Method Reverses Traditional Prompt Engineering Approach

Шумер называет свой подход Gauntlet Loop: дать агенту реальную, проверяемую планку вместо туманных инструкций, позволить ему разбить работу на маленькие части и направлять каждую часть через критика, который никогда не видит reasoning строителя. В этом цикле задействованы две фичи Claude Code. Подагенты запускаются в изолированных контекстных окнах со своими инструкциями и доступом к инструментам, поэтому критик, оценивающий модель оружия, не наследует оправдания разработчика. Ultracode — это настройка Claude Code, которая подталкивает модель к максимальному усилию в reasoning и позволяет ей писать собственный план оркестрации, распределяя работу сразу по 16 агентам, с ограничением до 1 000 на один запуск. Встроенная в Anthropic возможность /loop, рассчитанная на повторяющиеся циклы исправить—проверить—отладить, не дала запуску остановиться, когда игра выглядела достаточно прилично. Шумер не задавал число раундов и позволил критику часами продолжать называть новые пробелы, прежде чем закрыть сессию.

Researchers Raise Data Contamination Concerns

Three.js поставляется со своими официальными настройками камеры с pointer-lock в качестве примера, а базовый шаблон — управление мышью, движение WASD, raycasting для стрельбы — за более чем десятилетие был зафоркнут и превращён в учебные материалы на GitHub, в gist и на dev-форумах. Модель, обученная на публичных репозиториях, вероятно, уже видела сотни, если не тысячи, почти идентичных шутеров, прежде чем прочитать промпт Шумера. Исследователи, изучающие модели, генерирующие код, называют эту проблему data contamination — когда модель хорошо справляется с задачей в основном потому, что похожие примеры уже были в её обучающих данных, а не потому, что она додумалась до чего-то нового. Ни в одном из опубликованных шутеров от первого лица не было проверки на data contamination. В репозитории Шумера есть код, сгенерированный моделью, но это делает «сделанный с первого же раза AAA-игровой проект» признаком того, что агентоспособная работа может происходить внутри одного из самых подробно документированных жанров в программировании, а не доказательством того, что ИИ, не имеющий предшествующих работ, заранее способного «подключиться» к опыту, всё равно сумел создать шутер.

FAQ

Что именно содержал промпт Matt Shumer для Claude Opus 5? Промпт состоял из трёх коротких абзацев, опубликованных на GitHub. Он предписывал Opus 5 собрать шутер на уровне недавних игр Call of Duty, развернуть подагентов для отдельных задач и прогонять каждую часть через отдельного критика до совпадения с реальными кадрами Call of Duty в слепых попарных сравнениях. Шумер никогда не указывал рендерер, не перечислял игровые системы и не задавал требования уровня AAA. Как другие разработчики повторили результаты сборки игры на Claude Opus 5? Джеймс Альтучер прогнал идентичный промпт и потратил более десяти часов и примерно 1,3 млн токенов на Opus 5, чтобы собрать Operation Blackout. Разработчик Prompt Silo использовал Sol 5.6 Ultra от OpenAI с тем же промптом. Разработчик Леон Лин сделал реверс-инжиниринг подробного промпта на 20 секций и подал его в Cursor, используя обычный Opus 5 без подагентов и без ultracode, в результате чего получился Dust Corridor.

Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев