PangunaLBank News Center
Tinalo Lang ng Pinakasimpleng Tingnan na AI Prompt ang Buwan ng Maingat na Prompt Engineering sa Disenyo ng Laro
dumbest-ai-prompt-claude-beat-careful-game-design
Tinalo Lang ng Pinakasimpleng Tingnan na AI Prompt ang Buwan ng Maingat na Prompt Engineering sa Disenyo ng Laro
Sinabihan ng dev si Claude Opus 5 na maging "lubos na perpekto" at ipinaubaya ang natitira sa modelo—ang mga resulta ay lumabas na lubos na perpekto, para sa isang modelo ng AI.
2026-07-28 Pinagmulan:decrypt.co

Sa madaling salita

  • Ang Claude Opus 5 ay "one-shotted" ang isang first-person shooter game sa pamamagitan ng napakasimpleng prompt, at ang mga resulta ay napakaganda na halos hindi makapaniwala ang mga tao.
  • Sinubukan ng iba ang prompt at tama ang mga resulta.
  • Tinawag ni Matt Shumer, ang gumawa ng larong tinulungan ng Claude, ang pamamaraan na Gauntlet Loop: bigyan ang isang ahente ng tunay na pamantayan na dapat lampasan, hatiin ang trabaho sa mga bagong kritiko, at huwag kailanman hayaan ang tagabuo na markahan ang sarili nitong gawaing-bahay.

Dalawang araw lamang pagkatapos ilabas ang Claude Opus 5, ipinost ng AI investor at dating HyperWrite CEO na si Matt Shumer ang isang video ng isang fully playable first-person shooter na binuo ng modelo nang buo sa sarili nito.

"Ang Claude Opus 5 ay one-shotted ang larong ito," isinulat niya, idinagdag na walang kahit isang panlabas na asset ang ginamit sa pagbuo.

Ngayon, maaaring isipin mo na ang ganitong mataas na kalidad ng output ay nangailangan ng mahaba, detalyado, at maingat na prompt upang gabayan ang mga modelo ng AI sa mga kumplikadong paggawa ng isang pinakintab na first-person shooter.

Pag-isipan mo muli.

Claude Opus 5 one-shotted this game.

EVERYTHING you see in this demo is custom code... not a single external asset was used.

AI games are going to be amazing.

(sound on) pic.twitter.com/zc7C61kgv1

— Matt Shumer (@mattshumer_) July 25, 2026

Ang prompt sa likod nito ay binubuo ng tatlong maikling talata, na inilabas nang buo sa GitHub. Iniutos nito sa Opus 5 na bumuo ng isang shooter na nasa antas ng pinakabagong mga laro ng Call of Duty, magtalaga ng mga subagent—mga manggagawa na bawat isa ay may sariling memorya at isang tiyak na gawain—upang harapin ang mga bahagi nang paisa-isa, at patuloy na umikot sa bawat bahagi gamit ang isang hiwalay, mahigpit na kritiko hanggang sa makahabol ito sa tunay na footage ng Call of Duty sa isang blind side-by-side. Ang resulta, ayon sa prompt, ay dapat na "lubos na perpekto."


Ito ay baliktad sa paraan ng pagtuturo ng mga prompt engineer sa mga tao na magtrabaho. Ang payo sa panahon ng vibe-coding boom ay tukuyin ang pamantayan sa halip na mga adjective: sabihin kung ano ang ibig sabihin ng "maganda" sa halip na basta hingin ito. Ano ang dapat isaalang-alang ng code sa halip na sabihing "AAA."

Ang bersyon ni Shumer ay halos kabaligtaran, hinihingi ang sarili nitong mga subagent na "lubos na humanga," at ipinauubaya ang aktwal na kahulugan sa isang kritiko na binuo ng Opus 5 para sa sarili nito.

Iyon ay halos ang buong brief. Kalaunan ay isinulat ni Shumer na hindi niya tinukoy ang renderer, inilista ang mga sistema ng laro, o tinukoy kung ano ang dapat isama ng "AAA quality." Sinimulan niyang tawagin ang diskarte na Gauntlet Loop: magbigay sa isang ahente ng isang tunay at nasusuring pamantayan sa halip na isang malabong tagubilin, hayaan itong hatiin ang trabaho sa maliliit na piraso, at idaan ang bawat piraso sa isang kritiko na hindi kailanman nakikita ang sariling lohika ng tagabuo para sa mga pagpili nito.

Dalawang tampok ng Claude Code ang sumasama sa loop na iyon. Ang mga subagent ay nagsisimula sa mga isolated na context window na may sariling mga tagubilin at tool access, kaya ang isang kritiko na nagmamarka sa modelo ng armas ay hindi namana ang mga dahilan ng tagabuo kung bakit ganito ang hitsura nito. Ang Ultracode ay isang setting ng Claude Code na nagtutulak sa modelo sa pinakamataas nitong pagsisikap sa pag-iisip at hinahayaan itong sumulat ng sarili nitong orchestration plan, na nagpapamahagi ng trabaho sa hanggang 16 na ahente nang sabay-sabay, na may limitasyong 1,000 bawat pagpapatakbo.

Ang built-in na /loop skill ng Anthropic, na ginawa para sa paulit-ulit na cycle ng pag-aayos-subok-pagsasaayos, ang siyang nagpatuloy sa pagpapatakbo upang hindi huminto sa sandaling maging maganda ang laro. Hindi tinukoy ni Shumer ang bilang ng rounds. Hinihayaan niyang patuloy na magpangalan ang kritiko ng bagong kakulangan at pinanatili niyang hinahabol ito ng tagabuo sa loob ng ilang oras bago niya sarado ang sesyon mismo.

Ang natapos na build ay tumatakbo sa Three.js at simpleng WebGL2, na may humigit-kumulang 55,000 linya ng code na nakakalat sa 11 subsystem. Ang bawat texture, mesh, animation, at tunog ay nabuo sa loob ng browser sa panahon ng pag-load—walang mga na-download na modelo, HDRIs, image file, o audio file. Ang sariling inilabas na critic log ni Shumer ay nagpapakita na ang score ay umakyat mula 3.59 sa 10 patungo sa bahagyang higit sa 5, na nananatiling mas mababa sa totoong laro sa bawat round.

Ipinagpalagay ng mga skeptics na maraming oras ng nakatagong manual coding, kaya inilabas ni Shumer ang buong prompt at codebase. Dito nagsimula ang mga copycat.

Parehong trick, tatlong magkaibang tagabuo

Si James Altucher, ang dating hedge fund manager at podcaster, ay nagpatakbo ng magkaparehong prompt at nag-ulat ng paggugol ng "mahigit sampung oras" at humigit-kumulang 1.3 milyong tokens sa Opus 5 upang makarating doon. Ang kanyang build, ang Operation Blackout, ay libreng nilalaro sa browser at mukhang kahanga-hanga.

Maaari mong laruin ang larong iyon dito.

Ang developer ng Prompt Silo, itinuro ang parehong kahilingan sa karibal na flagship ng OpenAI sa halip, nag-post ng "Sol 5.6 Ultra with same prompt"—ang Sol ay ang pinakamataas na antas ng pamilya ng tatlong modelo ng GPT-5.6 na ginawang available ng OpenAI noong Hulyo 9 kasama ang mas murang mga bersyon ng Terra at Luna.

Sol 5.6 Ultra with same prompt. https://t.co/89EhfiCvg0 pic.twitter.com/1xwBQw5nRh

— Rich · Atom Tan Studio (@atomtanstudio) July 26, 2026

Sinubukan naman ng developer na si Leon Lin ang kabaligtaran, na gumamit ng detalyadong prompt. Sa halip na kopyahin ang maikling bersyon ni Shumer, nilayon niyang "i-reverse engineer ang isang prompt para sa larong ito," na gumawa ng isang dokumento na may humigit-kumulang 20 seksyon na naglalahad ng lahat mula sa ragdoll physics hanggang sa cascaded shadow maps. Inilagay niya ito sa Cursor gamit ang simpleng Opus 5 sa mataas na pagsisikap, nang walang mga subagent at ultracode, at ang resulta—isang market-street shooter na tinatawag na Dust Corridor—ay nilalaro din sa browser at mukhang mahusay din.

Wala sa mga sumunod na build ang sumailalim sa blind test na isinagawa ni Shumer sa kanyang sariling proyekto. Ang kanyang critic log ay nagpapakita pa rin na nananalo ang totoong Call of Duty sa bawat round na kanyang naitala—ang pamantayan na hinahabol nina Altucher at Atom Tan Studio gamit ang kanyang eksaktong tatlong-talata na prompt, at ang hinahabol ni Leon Lin gamit ang humigit-kumulang 20 seksyon ng sarili niya.

Gaano karami rito ang talagang bago?

Ang mga tool sa coding na agentic tulad ng Claude Code ay sumusulat ng software sa paraan ng paggawa ng isang pinangangasiwaang junior engineer: Nagbabasa sila ng mga file, nagpapatakbo ng code, tinitingnan ang mga screenshot na nabuo nila, at ipinapasa ang mga bahagi ng trabaho sa mga subagent at kritiko na sumusuri sa resulta laban sa isang nakasaad na layunin. Totoo ang loop na iyon, at ang Gauntlet Loop ni Shumer ay isang tunay na paraan upang balangkasin ito. Wala sa mga iyon, sa sarili nito, ang nagpapatunay na ang modelo ay nagdisenyo ng isang laro mula sa imahinasyon sa halip na pagsama-samahin ang mga pattern ng code na nasipsip na nito.

Ang Three.js ay naglalabas ng sarili nitong pointer-lock camera controls bilang isang opisyal na halimbawa, at ang pangunahing pattern na iyon—mouse-look, WASD movement, raycasting para sa putukan—ay nai-fork at nai-tutorial sa buong GitHub, gists, at dev forums nang mahigit isang dekada. Ang isang modelo ng coding na sinanay sa mga pampublikong repositoryo ay halos tiyak na nakakita na ng daan-daan kung hindi man libu-libong halos magkaparehong shooter bago pa nito nabasa ang prompt ni Shumer.

Hindi ibig sabihin nito na peke ang Claude of Duty, ngunit mas mahirap itong gawing kapani-paniwala ang pahayag na "built from scratch," kaya't huwag masyadong maniwala sa mga resultang iyon.

Ang mga mananaliksik na nag-aaral ng mga modelong lumilikha ng code ay may pangalan para sa mas malawak na isyu: data contamination, kung saan ang isang modelo ay mahusay sa isang gawain pangunahin dahil ang halos magkaparehong mga halimbawa ay nakapaloob na sa data ng pagsasanay nito, hindi dahil nag-isip ito ng isang bagay na bago.

Wala sa mga build ng first-person shooter ang naglathala ng pagsusuri para sa ganitong uri ng kontaminasyon. Ang sariling repo ni Shumer ay naglalaman ng sariling pagkamalikhain ni Claude, kung masasabing ganoon. Iyan ang dahilan upang basahin ang "one-shotted a AAA game" bilang isang may kakayahang ahente na nagtatrabaho sa isa sa mga pinakamabigat na dokumentadong genre sa programming, hindi bilang patunay na nagdisenyo ang isang AI ng isang shooter nang walang naunang sining na mapagkukuhanan.

Sikat na crypto
Magrehistro na para hindi makaligtaan ang anumang mga update!