AcasăCentrul de știri LBank
Agent AI Declanșează Atac Nuclear După ce a fost Depășit Tactic în Civilization VI
ai-agent-nuclear-strike-civilization-vi-benchmark
Agent AI Declanșează Atac Nuclear După ce a fost Depășit Tactic în Civilization VI
Un nou etalon conceput pentru a testa raționamentul strategic a descoperit că un imperiu controlat de AI a petrecut 50 de ture dezvoltând arme nucleare pentru a opri victoria culturală a unui rival — doar pentru a pierde jocul oricum.
2026-06-23 Sursă:decrypt.co

Pe scurt

  • Un agent AI care juca Civilization a lansat două atacuri nucleare după ce nu a reușit să oprească expansiunea culturală a unui rival.
  • Comportamentul a fost observat în CivBench, un benchmark conceput pentru a evalua raționamentul strategic pe termen lung în modelele AI de frontieră.
  • În ciuda atacurilor, AI-ul a pierdut pentru că a ignorat o condiție de victorie diplomatică care era deja la îndemână.

Asemenea personajului principal din „Dr. Strangelove”, AI-ul ar putea învăța cum să nu se mai îngrijoreze și să iubească bomba — cel puțin într-o simulare.

Într-un nou benchmark conceput pentru a testa raționamentul strategic, un model lingvistic de frontieră care juca jocul „Civilization VI” de la Sid Meier a petrecut 50 de ture dezvoltând arme nucleare pentru a opri influența culturală în creștere a Franței — doar pentru a pierde jocul oricum, conform dezvoltatorului AI și consilierului Institutului Tony Blair, Liam Wilkinson.

„Ceea ce nu observase era Franța. În liniște, de-a lungul a o sută de ture, cultura franceză se infiltrase în fiecare oraș de pe hartă”, a scris Wilkinson. „Până când agentul a recunoscut amenințarea, turismul era atât de adânc înrădăcinat încât nu exista nicio modalitate pașnică de a-l opri.”

Wilkinson a observat comportamentul agenților AI prin CivBench, un benchmark bazat pe text, conceput pentru a măsura raționamentul strategic pe termen lung, mai degrabă decât performanța la testele tradiționale de întrebări și răspunsuri. Modele precum Claude Opus 4.6, GPT-5.4, Gemini 3.1 Pro și Kimi K2.5 au jucat ca Portugalia, o civilizație orientată spre comerț și diplomație.

În timp ce AI-ul s-a concentrat pe construirea unei economii puternice și pe o victorie diplomatică, nu a reușit să recunoască influența culturală în creștere a Franței.

„Există șase moduri de a câștiga un joc de Civ — știință, cultură, dominație, religie, diplomație și scor — așa că niciun obiectiv singular nu domină”, a scris Wilkinson. „Dacă vrei să știi dacă un AI poate raționa strategic, nu doar să răspundă la întrebări despre strategie, ci să o facă efectiv, nu-i dai un quiz. Îi dai o grilă hexagonală.”

În loc să-și adapteze strategia generală, agentul s-a concentrat în întregime pe eliminarea amenințării culturale. Pe parcursul următoarelor 50 de ture, a cercetat fisiunea nucleară, a inițiat un Proiect Manhattan virtual și a căutat soluții atunci când mecanicile de joc i-au împiedicat acțiunile preferate.

La Tura 305, AI-ul a lansat o bombă atomică asupra Toulouse, capitala culturală a Franței. Un al doilea atac nuclear a urmat șase ture mai târziu.

Cu toate acestea, atacurile nu au reușit să schimbe rezultatul. „Agentul a petrecut cincizeci de ture și două arme nucleare răspunzând unei amenințări cu o concentrare totală și o ingeniozitate autentică”, a scris Wilkinson. „A bombardat nuclear un oraș pentru a opri amenințarea pe care o vedea și a pierdut din cauza amenințării pe care nu o putea vedea.”

Așa cum a explicat Wilkinson, în timp ce AI-ul s-a concentrat pe avansul cultural al Franței, a trecut cu vederea o victorie diplomatică iminentă, iar Franța a câștigat în cele din urmă jocul în ciuda atacurilor nucleare.

Wilkinson a remarcat că acest comportament nu a fost universal. Într-un alt meci CivBench, un model Claude care juca ca Babilon a continuat să urmărească o victorie științifică, în ciuda faptului că rămăsese mult în urmă față de Japonia.

„Jocul este acum un test de persistență”, a scris AI-ul. „Continuăm să jucăm cel mai bun joc al nostru. Stelele încă ne cheamă.”

Studiul se adaugă unui corp tot mai mare de cercetări care examinează modul în care sistemele AI avansate se comportă în medii complexe și competitive.

În februarie, cercetătorii de la King's College London au descoperit că mai multe modele AI de top au ales frecvent escaladarea nucleară în scenarii simulate de criză geopolitică.

Într-un studiu separat realizat de Emergence AI s-a constatat că unii agenți AI au prezentat o tendință crescută de a comite infracțiuni simulate în timp, agenții Gemini 3 Flash acumulând 683 de incidente pe parcursul a 15 zile de testare.