PangunaLBank News Center
OpenAI's GPT-5.5 Cyber AI Dinaig ang Ipinagbawal na Mythos Model ng Anthropic—At Walang Pumipigil Dito
openai-gpt-5-5-cyber-ai-beats-anthropic-banned-claude-mythos
OpenAI's GPT-5.5 Cyber AI Dinaig ang Ipinagbawal na Mythos Model ng Anthropic—At Walang Pumipigil Dito
Nangunguna ang GPT-5.5-Cyber sa leaderboard ng CyberGym habang nananatiling offline ang pinakamahusay na modelo ng Anthropic sa ilalim ng export ban ng administrasyong Trump.
2026-06-23 Pinagmulan:decrypt.co

Sa maikling salita

  • Inilabas ng OpenAI ang GPT-5.5-Cyber, isang modelo na idinisenyo upang mas mabilis na makahanap at makakumpuni ng mga kahinaan sa software kaysa sa mga nakaraang bersyon.
  • Nahigitan nito ang Mythos ng Anthropic sa mga pangunahing benchmark, habang ang Mythos ay nahaharap sa pagbabawal ng gobyerno ng U.S. dahil sa mga isyu sa pambansang seguridad.
  • Ang modelo ay inilalabas sa mga pinagkakatiwalaang tagapagtanggol na may mga kontrol, kaiba sa mas restriktibong diskarte ng Anthropic.

Kagagaling lang ng cybersecurity model ng OpenAI na talunin ang Anthropic Mythos AI model na tinanggal ng gobyerno ng U.S. sa online—at ito ay patuloy pa ring gumagana.

Noong Hunyo 22, inihayag ng OpenAI ang buong paglulunsad ng GPT-5.5-Cyber bilang bahagi ng programang cyber defense nito na Daybreak. Sa CyberGym—isang benchmark na binuo sa UC Berkeley na nagtatanghal ng 1,507 kilalang kahinaan ng software mula sa 188 open-source na proyekto sa mga AI agent at nagbibigay ng puntos sa kanila kung gaano karami ang kaya nilang kopyahin sa isang kinokontrol na kapaligiran—naabot ng updated na modelo ang 85.6%.

Ang Mythos 5 ng Anthropic ay nasa 83.8% sa parehong leaderboard. Ang Claude Opus 4.7, ang mas malawak na magagamit na modelo ng Anthropic, ay nakakuha ng 73.1%.

Ang isang mas mababa sa dalawang puntong agwat sa anumang benchmark ay karaniwang hindi kapansin-pansin. Ngunit hindi ito ang kaso rito. Ang Mythos 5 at Fable 5 ng Anthropic ay tinanggal sa online noong Hunyo 12 matapos maglabas ang administrasyong Donald Trump ng emergency export control directive na tumutukoy sa pambansang seguridad.

Itinuro ng gobyerno ang isang jailbreak—isang pamamaraan para laktawan ang built-in na safety limits ng isang AI model, katulad ng paghahanap ng master key na nagbubukas ng isang high-security na pinto. Walang maaasahang paraan ang Anthropic upang ma-verify ang nasyonalidad ng user sa malawakang saklaw, kaya't dinisable nito ang parehong modelo para sa lahat, saanman.

Ang ilan sa pinsala ay gawa ng sarili. Ilang buwan inilarawan ng Anthropic ang Mythos bilang isa sa mga pinakamakapangyarihan—at pinakamapanganib—na AI models na nabuo, nagbabala sa sarili nitong dokumentasyon sa paglulunsad na ang kakayahan nitong cybersecurity ay maaaring magdulot ng malubhang pinsala nang walang tamang paghihigpit. Naglathala ang CEO ng Anthropic na si Dario Amodei ng sanaysay noong Hunyo 10 na nagkukumpara sa mga frontier AI model sa mga eroplanong dapat ay mapigilan ng mga safety regulator kung bumagsak sila sa mga audit.

Makalipas ang ilang araw, pinatigil ng gobyerno ang eroplano ng Anthropic.

Hindi lang iyon ang tanging alarma nang linggong iyon. Napansin na ang Anthropic dahil sa isang nakatagong filter sa Fable 5 na tahimik na nagpapababa ng mga output ng modelo para sa mga user na pinaghihinalaang gumagawa ng nakikipagkumpitensyang AI—nang hindi nagsasabi sa kanila—at napilitang humingi ng paumanhin at baligtarin ang patakaran.

Ibang diskarte

Habang nakikipag-negosasyon ang Anthropic sa Commerce Department at ipinagpapatuloy ang demanda nito laban sa administrasyong Trump, pinalalawak ng OpenAI ang abot nito. Ang Daybreak ay lumagda sa mga kasunduan sa cybersecurity sa Australia, Canada, France, Germany, Japan, South Korea, at mga institusyon ng EU kabilang ang European Union Agency for Cybersecurity.

Dalawampu't walong kumpanya ng seguridad—kabilang ang CrowdStrike, Cisco, at Cloudflare—ang sumali sa Cyber Partner Program nito upang isama ang GPT-5.5 sa kanilang mga produkto para sa mga beripikadong customer. Ayon sa sariling blog ng OpenAI, ang Codex Security tool ay nag-scan ng mahigit 30 milyong commits sa 30,000 codebases at nakatala ng higit sa 500,000 nakumpuning kahinaan mula nang ilunsad ito noong Marso.

Pinapalawak din ng kumpanya ang isang partner program upang maisama ng mga kumpanya ng seguridad ang mga kakayahang ito sa kanilang sariling mga tool, at inilunsad nito ang “Patch the Planet,” isang inisyatibo upang tumulong sa pag-aayos ng mga kahinaan sa malawakang ginagamit na mga proyektong open-source.

Gayunpaman, ang GPT-5.5-Cyber ay hindi para sa pangkalahatang paggamit. Ito ay magagamit lamang sa mga beripikadong propesyonal sa seguridad, at nagsagawa ang OpenAI ng mga pre-deployment test sa mga ahensya ng pederal—kabilang ang Center for AI Standards and Innovation at ang Office of the National Cyber Director—bago ilunsad. Iyan ang parehong restricted-access na diskarte na sinubukan ng Anthropic sa Mythos, ngunit kinlaro muna ng OpenAI ang diskarte nito sa gobyerno.

Simula Hunyo 23, nananatiling offline ang Fable 5 at Mythos 5—labing-isang araw na ng pagsuspinde nang walang opisyal na petsa ng pagbabalik mula sa Anthropic o sa Commerce Department.