AcasăCentrul de știri LBank
Cel mai banal prompt AI a surclasat luni întregi de inginerie meticuloasă a prompturilor pentru design de jocuri
dumbest-ai-prompt-claude-beat-careful-game-design
Cel mai banal prompt AI a surclasat luni întregi de inginerie meticuloasă a prompturilor pentru design de jocuri
Dezvoltatorul i-a spus lui Claude Opus 5 să fie „absolut perfect” și a lăsat restul la latitudinea modelului — rezultatele s-au dovedit a fi absolut perfecte, pentru un model AI.
2026-07-28 Sursă:decrypt.co

Pe scurt

  • Claude Opus 5 a „realizat dintr-o singură încercare” un joc de tip shooter la persoana întâi cu un prompt atât de simplu și rezultate atât de impresionante, încât oamenii se luptă să creadă.
  • Alții au rulat din nou promptul și rezultatele se confirmă.
  • Matt Shumer, creatorul jocului asistat de Claude, numește metoda un Gauntlet Loop (Buclă de Încercare): oferă unui agent un prag real de depășit, împarte munca între critici noi și nu lasă niciodată constructorul să-și corecteze propria lucrare.

La doar două zile după lansarea Claude Opus 5, investitorul în AI și fostul CEO HyperWrite, Matt Shumer, a postat un videoclip cu un joc shooter la persoana întâi, complet funcțional, pe care modelul îl construise în întregime de unul singur.

„Claude Opus 5 a creat acest joc dintr-o singură încercare”, a scris el, adăugând că niciun activ extern nu a fost folosit în construcție.

Acum, ați putea crede că un rezultat de o calitate atât de bună a necesitat un prompt lung, detaliat și atent, pentru a ghida modelele AI prin complexitățile construirii unui shooter la persoana întâi bine lustruit.

Mai gândiți-vă.

Claude Opus 5 one-shotted this game.

EVERYTHING you see in this demo is custom code... not a single external asset was used.

AI games are going to be amazing.

(sound on) pic.twitter.com/zc7C61kgv1

— Matt Shumer (@mattshumer_) July 25, 2026

Promptul din spatele său a avut trei paragrafe scurte, publicate integral pe GitHub. Acesta i-a cerut lui Opus 5 să construiască un shooter la nivelul celor mai recente jocuri Call of Duty, să distribuie subagenți — lucratori care primesc fiecare propria memorie separată și o sarcină restrânsă — pentru a aborda individual părți ale proiectului, și să continue să ruleze în buclă fiecare parte cu un critic separat, exigent, până când se ridica la nivelul filmărilor reale din Call of Duty într-un test comparativ orb. Rezultatul, conform promptului, trebuia să fie „absolut perfect”.


Aceasta este o inversare a modului în care inginerii de prompturi au învățat oamenii să lucreze. Sfatul din timpul boom-ului "vibe-coding" era să specifici criterii în loc de adjective: să spui ce înseamnă "bun" în loc să ceri pur și simplu. Ce ar trebui să ia în considerare codul în loc să spună "AAA".

Versiunea lui Shumer face aproape opusul, cerând subagenților săi să fie "absolut uimiți" și lăsând definiția reală unui critic pe care Opus 5 l-a construit pentru sine.

Acesta a fost aproape întregul briefing. Shumer a scris ulterior că nu a specificat niciodată renderizatorul, nu a enumerat sistemele jocului și nu a definit ce trebuia să includă „calitatea AAA”. El a început să numească abordarea o Buclă de Încercare (Gauntlet Loop): îi oferi unui agent un prag real, inspectabil, în loc de o instrucțiune vagă, îl lași să împartă sarcina în bucăți mici și rutezi fiecare bucată printr-un critic care nu vede niciodată raționamentul propriu al constructorului pentru alegerile sale.

Două funcții Claude Code susțin această buclă. Subagenții se activează în ferestre de context izolate, cu propriile instrucțiuni și acces la instrumente, astfel încât un critic care evaluează modelul armei nu moștenește scuzele constructorului pentru felul în care arată. Ultracode este o setare Claude Code care împinge modelul la efortul său maxim de raționament și îi permite să-și scrie propriul plan de orchestrare, distribuind munca între până la 16 agenți simultan, plafonată la 1.000 pe execuție.

Abilitatea /loop încorporată de Anthropic, creată pentru cicluri repetate de remediere-testare-ajustare, a împiedicat rularea să se oprească în momentul în care jocul arăta decent. Shumer nu a specificat niciodată un număr de runde. L-a lăsat pe critic să numească mereu un nou neajuns și l-a ținut pe constructor să-l urmărească ore întregi înainte de a închide el însuși sesiunea.

Construcția finală rulează pe Three.js și WebGL2 simplu, cu aproximativ 55.000 de linii de cod distribuite pe 11 subsisteme. Fiecare textură, mesh, animație și sunet este generată în browser la momentul încărcării – fără modele descărcate, imagini HDR, fișiere de imagine sau fișiere audio. Jurnalul critic publicat de Shumer arată că scorul a crescut de la 3,59 din 10 spre puțin peste 5, rămânând totuși în urma jocului real la fiecare rundă.

Scepticii au presupus ore întregi de codare manuală ascunsă, așa că Shumer a publicat întregul prompt și baza de cod. Atunci au început imitatorii.

Același truc, trei constructori diferiți

James Altucher, fost manager de fonduri speculative și podcaster, a rulat același prompt și a raportat că a petrecut „puțin peste zece ore” și aproximativ 1,3 milioane de token-uri pe Opus 5 pentru a ajunge la rezultat. Construcția sa, Operation Blackout, poate fi jucată gratuit în browser și arată impresionant.

Puteți juca acest joc aici.

Dezvoltatorul Prompt Silo a îndreptat aceeași cerere către modelul emblematic rival al OpenAI, postând „Sol 5.6 Ultra cu același prompt” — Sol fiind nivelul superior al familiei de trei modele GPT-5.6 pe care OpenAI le-a făcut disponibile publicului larg pe 9 iulie, alături de versiunile mai ieftine Terra și Luna.

Sol 5.6 Ultra with same prompt. https://t.co/89EhfiCvg0 pic.twitter.com/1xwBQw5nRh

— Rich · Atom Tan Studio (@atomtanstudio) July 26, 2026

Dezvoltatorul Leon Lin a încercat abordarea opusă, optând pentru promptul detaliat obișnuit. În loc să copieze versiunea scurtă a lui Shumer, el și-a propus să „reverse engineer-uiască un prompt pentru acest joc”, producând un document cu aproximativ 20 de secțiuni detaliate, care explica totul, de la fizica ragdoll la hărți de umbre în cascadă. A alimentat acest document în Cursor, folosind un Opus 5 simplu, cu efort ridicat, fără subagenți și fără ultracode, iar rezultatul – un shooter urban numit Dust Corridor – poate fi jucat și în browser și arată, de asemenea, grozav.

Niciuna dintre construcțiile ulterioare nu a fost supusă testului orb pe care Shumer l-a efectuat pentru propriul său proiect. Jurnalul său de critici arată în continuare că jocul real Call of Duty câștigă fiecare rundă pe care a înregistrat-o – standardul pe care Altucher și Atom Tan Studio îl urmăresc cu exact același prompt de trei paragrafe, și cel pe care Leon Lin îl urmărește cu aproximativ 20 de secțiuni proprii.

Cât de mult din toate acestea este cu adevărat nou?

Instrumentele de codare agentice, cum ar fi Claude Code, scriu software în același mod în care ar face-o un inginer junior supravegheat: citesc fișiere, rulează cod, analizează capturile de ecran generate și pasează părți din sarcină subagenților și criticilor care verifică rezultatul în raport cu un obiectiv stabilit. Această buclă este reală, iar Gauntlet Loop al lui Shumer este o modalitate autentică de a o structura. Niciunul dintre aceste aspecte, prin el însuși, nu demonstrează că modelul a proiectat un joc din imaginație, mai degrabă decât prin recombinarea unor tipare de cod pe care le absorbise deja.

Three.js oferă propriile sale controale de cameră cu blocare a indicatorului ca exemplu oficial, iar acest model de bază — vizualizare cu mouse-ul, mișcare WASD, raycasting pentru focul de armă — a fost bifurcat și explicat prin tutoriale pe GitHub, gists și forumuri pentru dezvoltatori de mai bine de un deceniu. Un model de codare antrenat pe depozite publice a văzut aproape sigur sute, dacă nu mii, de jocuri shooter aproape identice înainte de a citi promptul lui Shumer.

Asta nu înseamnă că "Claude of Duty" este fals, dar face ca afirmația "construit de la zero" să fie mai greu de creditat pe deplin, așa că luați acele rezultate cu un grăunte de sare.

Cercetătorii care studiază modelele de generare a codului au un nume pentru problema mai largă: contaminarea datelor, atunci când un model se descurcă bine într-o sarcină în principal pentru că exemple aproape identice se aflau deja în datele sale de antrenament, nu pentru că a raționat ceva nou.

Niciuna dintre construcțiile de jocuri shooter la persoana întâi nu a publicat o verificare pentru acest tip de contaminare. Propriul depozit al lui Shumer conține creativitatea lui Claude, dacă este corect să o numim așa. Acesta este un motiv pentru a citi "a realizat un joc AAA dintr-o singură încercare" ca un agent capabil care lucrează într-unul dintre cele mai bine documentate genuri în programare, nu ca o dovadă că o inteligență artificială a proiectat un shooter fără a se baza pe nicio artă preexistentă.