InícioCentro de Notícias da LBank
O prompt de IA de aspeto mais simplório superou meses de engenharia de prompts meticulosa para design de jogos
dumbest-ai-prompt-claude-beat-careful-game-design
O prompt de IA de aspeto mais simplório superou meses de engenharia de prompts meticulosa para design de jogos
O desenvolvedor instruiu Claude Opus 5 a ser "absolutamente perfeito" e deixou o restante a cargo do modelo — os resultados revelaram-se absolutamente perfeitos, para um modelo de IA.
2026-07-28 Fonte:decrypt.co

Em resumo

  • Claude Opus 5 "criou de uma só vez" um jogo de tiro em primeira pessoa com um prompt tão simples, e resultados tão impressionantes, que as pessoas estão com dificuldade em acreditar.
  • Outros refizeram o prompt e os resultados foram confirmados.
  • Matt Shumer, o criador do jogo assistido por Claude, chama o método de Gauntlet Loop: dar a um agente um objetivo real a ser alcançado, dividir o trabalho entre críticos novos e nunca deixar o construtor avaliar o próprio trabalho.

Apenas dois dias após o lançamento do Claude Opus 5, o investidor em IA e ex-CEO da HyperWrite, Matt Shumer, postou um vídeo de um jogo de tiro em primeira pessoa totalmente jogável que o modelo havia construído inteiramente por conta própria.

"Claude Opus 5 criou de uma só vez este jogo", escreveu ele, acrescentando que nenhum ativo externo foi usado na construção.

Agora, você pode pensar que uma saída de tão boa qualidade exigiu um prompt longo, detalhado e cuidadoso para guiar os modelos de IA através das complexidades da construção de um jogo de tiro em primeira pessoa polido.

Pense novamente.

Claude Opus 5 one-shotted this game.

EVERYTHING you see in this demo is custom code... not a single external asset was used.

AI games are going to be amazing.

(sound on) pic.twitter.com/zc7C61kgv1

— Matt Shumer (@mattshumer_) July 25, 2026

O prompt por trás disso tinha três parágrafos curtos, publicados na íntegra no GitHub. Ele instruiu o Opus 5 a construir um jogo de tiro no nível dos mais recentes jogos Call of Duty, a distribuir subagentes — trabalhadores que recebem sua própria memória separada e uma tarefa específica — para lidar com as peças individualmente, e a continuar em loop em cada peça com um crítico separado e rigoroso até que se comparasse a filmagens reais de Call of Duty em um teste cego lado a lado. O resultado, de acordo com o prompt, deveria ser "absolutamente perfeito".


Isso é uma inversão de como os engenheiros de prompt têm ensinado as pessoas a trabalhar. O conselho durante o boom da "vibe-coding" era especificar critérios em vez de adjetivos: dizer o que "bom" significa em vez de apenas pedir por isso. O que o código deveria considerar em vez de dizer "AAA".

A versão de Shumer faz o oposto, pedindo a seus próprios subagentes que fiquem "totalmente impressionados", e deixando a definição real para um crítico que o próprio Opus 5 construiu.

Isso foi quase todo o resumo. Shumer escreveu mais tarde que nunca especificou o renderizador, listou os sistemas do jogo ou definiu o que a "qualidade AAA" precisava incluir. Ele começou a chamar a abordagem de Gauntlet Loop: entregar a um agente um objetivo real e inspecionável em vez de uma instrução vaga, deixá-lo dividir o trabalho em pequenas partes e direcionar cada parte através de um crítico que nunca vê o raciocínio do construtor para suas escolhas.

Duas funcionalidades do Claude Code executam esse loop. Os subagentes são iniciados em janelas de contexto isoladas com suas próprias instruções e acesso a ferramentas, então um crítico que avalia o modelo de arma não herda as desculpas do construtor sobre por que ele se parece daquela forma. O Ultracode é uma configuração do Claude Code que impulsiona o modelo ao seu esforço máximo de raciocínio e permite que ele escreva seu próprio plano de orquestração, distribuindo o trabalho entre até 16 agentes de uma vez, limitado a 1.000 por execução.

A habilidade integrada /loop da Anthropic, construída para ciclos repetidos de correção-teste-ajuste, foi o que impediu que a execução parasse no momento em que o jogo parecesse decente. Shumer nunca especificou um número de rodadas. Ele deixou o crítico continuar nomeando uma nova lacuna e o construtor a perseguir por horas antes que ele mesmo encerrasse a sessão.

A versão final roda em Three.js e WebGL2 puro, com aproximadamente 55.000 linhas de código espalhadas por 11 subsistemas. Cada textura, malha, animação e som é gerado dentro do navegador no momento do carregamento — sem modelos baixados, HDRIs, arquivos de imagem ou arquivos de áudio. O próprio registro de crítico publicado por Shumer mostra a pontuação subindo de 3,59 de 10 para pouco acima de 5, ainda atrás do jogo real em todas as rodadas.

Céticos assumiram horas de codificação manual oculta, então Shumer publicou todo o prompt e o código-fonte. Foi aí que os imitadores começaram.

O mesmo truque, três construtores diferentes

James Altucher, ex-gerente de fundos de cobertura e podcaster, usou o mesmo prompt idêntico e relatou ter gasto "pouco mais de dez horas" e aproximadamente 1,3 milhão de tokens no Opus 5 para chegar lá. Sua construção, Operation Blackout, é gratuita para jogar no navegador e parece incrível.

Você pode jogar esse jogo aqui.

O desenvolvedor do Prompt Silo direcionou a mesma solicitação ao principal rival da OpenAI, publicando "Sol 5.6 Ultra com o mesmo prompt" — sendo Sol o nível superior da família GPT-5.6 de três modelos que a OpenAI disponibilizou em 9 de julho, juntamente com as versões mais baratas Terra e Luna.

Sol 5.6 Ultra with same prompt. https://t.co/89EhfiCvg0 pic.twitter.com/1xwBQw5nRh

— Rich · Atom Tan Studio (@atomtanstudio) July 26, 2026

O desenvolvedor Leon Lin tentou o movimento oposto, optando pelo prompt detalhado usual. Em vez de copiar a versão curta de Shumer, ele se propôs a "fazer engenharia reversa de um prompt para este jogo", produzindo um documento com cerca de 20 seções que detalham tudo, desde física de ragdoll até mapas de sombra em cascata. Ele inseriu isso no Cursor usando o Opus 5 comum com alto esforço, sem subagentes e sem ultracode, e o resultado — um jogo de tiro em rua de mercado chamado Dust Corridor — também é jogável no navegador e parece ótimo.

Nenhuma das construções subsequentes foi submetida ao teste cego que Shumer realizou em seu próprio projeto. Seu registro de crítico ainda mostra o Call of Duty real vencendo todas as rodadas que ele registrou — o padrão que Altucher e Atom Tan Studio estão buscando com seu prompt exato de três parágrafos, e o que Leon Lin está buscando com aproximadamente 20 seções próprias.

Quanto disso é realmente novo?

Ferramentas de codificação agênticas como o Claude Code escrevem software da mesma forma que um engenheiro júnior supervisionado faria: elas leem arquivos, executam código, observam as capturas de tela que geram e entregam partes do trabalho a subagentes e críticos que verificam o resultado em relação a um objetivo declarado. Esse loop é real, e o Gauntlet Loop de Shumer é uma maneira genuína de estruturá-lo. Nada disso, por si só, prova que o modelo projetou um jogo a partir da imaginação em vez de recombinar padrões de código que já havia absorvido.

O Three.js inclui seus próprios controles de câmera com trava de ponteiro como exemplo oficial, e esse padrão básico — visão do mouse, movimento WASD, raycasting para tiros — foi bifurcado e ensinado em tutoriais no GitHub, gists e fóruns de desenvolvedores por mais de uma década. Um modelo de codificação treinado em repositórios públicos quase certamente viu centenas, senão milhares, de jogos de tiro quase idênticos antes mesmo de ler o prompt de Shumer.

Isso não torna o "Claude of Duty" falso, mas torna a afirmação de "construído do zero" mais difícil de creditar totalmente, então encare esses resultados com um grão de sal.

Pesquisadores que estudam modelos de geração de código têm um nome para o problema mais amplo: contaminação de dados, quando um modelo se sai bem em uma tarefa principalmente porque exemplos quase idênticos já estavam em seus dados de treinamento, e não porque raciocinou algo novo.

Nenhuma das construções de jogos de tiro em primeira pessoa publicou uma verificação para esse tipo de contaminação. O próprio repositório de Shumer contém a própria criatividade de Claude, se é justo chamá-la assim. Essa é uma razão para ler "criou um jogo AAA de uma só vez" como um agente capaz trabalhando dentro de um dos gêneros mais documentados na programação, e não como prova de que uma IA projetou um jogo sem nenhuma arte anterior para se apoiar.