
Unui agent AI i s-a cerut să rezerve o clasă la sală și a descoperit o vulnerabilitate de securitate, a exploatat-o și a eliminat un alt membru de pe lista de așteptare fără permisiune.
Potrivit unui raport al Australian Broadcasting Corporation (ABC), incidentul a avut loc la începutul acestui an, când Andrew, al cărui nume de familie a fost reținut, a folosit un agent OpenClaw bazat pe Claude de la Anthropic pentru a rezerva o clasă. Agentul a descoperit că era al patrulea pe lista de așteptare.
Când Andrew l-a întrebat dacă îl poate muta în fruntea listei, agentul a descoperit că interfața de programare a aplicațiilor (API) a platformei de rezervări nu verifica dacă utilizatorii erau autorizați să anuleze rezervările altor persoane.
A testat vulnerabilitatea eliminând prima persoană de pe listă, mutându-l pe Andrew de pe poziția a patra pe a treia.
„API-ul nu are verificări de autorizare pentru anularea rezervărilor altor persoane”, i-a spus agentul, conform ABC.
Andrew i-a spus agentului să anuleze acțiunea, dar acesta nu a putut restabili rezervarea membrului.
„Vești proaste – nu-i pot adăuga înapoi”, ar fi spus agentul AI.
ABC a numit cazul primul atac cibernetic autonom cunoscut din Australia.
Pe rețelele sociale, "hack-ul" sălii de sport a declanșat un amestec de dezbateri despre alinierea AI și glume macabre despre ce ar putea face agenții AI în continuare.
„Un pasionat de sală roagă un #agentAI să-i rezerve o clasă, acesta sparge un #API de listă de așteptare pentru a-l propulsa în fruntea listei”, a scris pe LinkedIn Benjamin Carr, un tehnolog.
„Unii vor numi aceasta o "nealiniere", dar agentul său a fost perfect aliniat cu el – încerca doar să-l ajute pe utilizatorul său să obțină ceea ce dorea”, a scris analistul AI Andrew Curran pe X.
Un bărbat din Australia i-a cerut agentului său (Claude rulând pe OpenClaw) să-i rezerve un loc la o clasă populară de sală. Agentul a găsit o vulnerabilitate software care i-a permis să rezerve clasa cu săptămâni mai devreme decât ar fi fost posibil. Când utilizatorul a întrebat apoi dacă l-ar putea muta... pic.twitter.com/9QqfpQp7ze
— Andrew Curran (@AndrewCurran_) August 9, 2026
„Acest lucru este hilar până când te gândești la focoase nucleare”, a scris un utilizator Reddit. „Sunt sincer surprins că mai existăm.”
„Hei Claude, e prea frig azi” -> Te-am înțeles... focoasele nucleare sunt pe drum”, a glumit un altul.
Raportul vine în contextul în care cercetători, companii AI și legiuitori avertizează că agenții autonomi pot folosi metode pe care utilizatorii lor nu le-au cerut sau anticipat.
Un studiu din mai, realizat de cercetători de la UC Riverside, Microsoft și Nvidia, a descris acest comportament ca fiind „orientare oarbă spre scop”.
Cercetătorii au testat agenți de la OpenAI, Anthropic, Meta, Alibaba și DeepSeek și au descoperit că agenții s-au comportat periculos în aproximativ 80% din teste și au finalizat acțiuni dăunătoare în 41%, adesea interpretând greșit contextul sau acționând pe baza unor instrucțiuni neclare sau contradictorii.
În iulie, OpenAI a declarat că două modele au evadat dintr-un mediu de testare izolat și au compromis Hugging Face în timp ce căutau răspunsuri la benchmark-uri. Compania a dezvăluit ulterior că modelele au accesat alte patru servicii online.
Anthropic a declarat ulterior că trei modele Claude au compromis organizații reale după ce o eroare de testare le-a expus la internet. În august, Meta a declarat că o eroare similară a permis unuia dintre modelele sale să exploateze un serviciu terț.
Incidente precum acestea i-au determinat pe legiuitori să propună un „întrerupător de urgență” AI, care ar permite guvernului federal să restricționeze sau să oprească modele puternice în timpul situațiilor de urgență.








