
Sinabi ng Anthropic na ibabalik nito ang pampublikong access sa Claude Fable 5 at Mythos 5 matapos alisin ng mga awtoridad ng U.S. ang mga paghihigpit sa pag-export na nagpanatili sa dalawang pinaka-advanced na modelo ng AI ng kumpanya na offline mula noong Hunyo 12.
Ayon sa Anthropic, ang desisyon ay kasunod ng “serye ng mga produktibong pag-uusap” sa gobyerno ng U.S., matapos nito ay sinimulan ng kumpanya ang muling pagpapakalat ng mga modelo na may mga bagong classifier na idinisenyo upang tukuyin at harangan ang mas maraming gawain na may kinalaman sa cybersecurity.
Sinabi ng kumpanya na ang pinakabagong mga pananggalang ay naglalayong tugunan ang mga alalahanin ng gobyerno na nauugnay sa posibleng maling paggamit kung ang mga sistema ay mapapasok sa pamamagitan ng mga pamamaraan ng jailbreak.
Ang mga paghihigpit ay nagpilit sa Anthropic na suspindihin ang access sa Fable 5 at Mythos 5 para sa lahat ng user mas maaga ngayong buwan, matapos ipag-utos ng isang direktiba sa kontrol ng pag-export ng gobyerno ng U.S. sa kumpanya na harangan ang parehong modelo para sa lahat ng dayuhang mamamayan.
Sa pahayag nito noong Hunyo 13, sinabi ng Anthropic na sakop din ng order ang mga empleyadong dayuhang mamamayan na nagtatrabaho sa loob ng kumpanya, na nagtulak dito upang ganap na i-disable ang mga modelo upang matiyak ang pagsunod.
Sinabi ni Kalihim ng Komersyo ng U.S. Howard Lutnick sa X noong Miyerkules na ang mga opisyal ay nakipagtulungan sa Anthropic sa nakalipas na dalawang linggo upang suriin at aprubahan ang Fable 5 habang pinananatili ang modelo na nakahanay sa mga kinakailangan ng gobyerno ng U.S.
Sinabi rin ni White House Chief of Staff Susie Wiles sa X na ang priyoridad ng gobyerno ay maipakalat ang pinakamahusay na teknolohiya ng AI “nang mas mabilis at ligtas hangga’t maaari.”
Ang interbensyon ay dumating matapos malaman ng mga opisyal ang isang ulat kung saan natuklasan ng mga mananaliksik ng Amazon ang isang paraan upang lampasan ang mga pananggalang ng Fable 5 at gawing tukuyin ng modelo ang mga kahinaan ng software.
Gayunpaman, iginiit ng Anthropic na ang naiulat na isyu ay hindi natatangi sa Fable 5, na sinasabing ang mas mahihinang modelo ay maaari ring tukuyin ang parehong mga kahinaan at makagawa ng katulad na output na may kinalaman sa pagsasamantala.
Sa naunang tugon nito sa order, sinabi ng kumpanya na ang mga awtoridad ay nagpakita lamang ng verbal na ebidensya ng inilarawan nito bilang isang makitid, hindi-unibersal na jailbreak. Sinabi ng Anthropic na ang gayong pamamaraan ay hindi nag-alis ng mga proteksyon sa kaligtasan ng isang modelo sa malawak na hanay ng mga gawain, hindi tulad ng isang unibersal na jailbreak.
“Hindi kami sumasang-ayon na ang paghahanap ng isang makitid na potensyal na jailbreak ay dapat maging dahilan para sa pagbawi ng isang komersyal na modelo na nai-deploy sa daan-daang milyong tao. Kung ang pamantayang ito ay ilalapat sa buong industriya, naniniwala kami na ito ay halos pipigil sa lahat ng bagong pagpapakalat ng modelo para sa lahat ng tagapagbigay ng frontier model.”
Binalaan din ng kumpanya na ang pagtrato sa isang makitid na jailbreak bilang dahilan upang bawiin ang isang komersyal na frontier model ay maaaring makaapekto sa buong industriya ng AI kung ilalapat bilang isang pangkalahatang pamantayan.
Ang mga paghihigpit sa Anthropic ay nagdulot din ng mga isyu sa patakaran sa labas ng Estados Unidos. Noong Hunyo 29, hinimok ng Austria ang European Union na tuklasin ang pagtatatag ng Anthropic sa loob ng bloke, na iginiit ni Kalihim ng Estado para sa Digitalisasyon Alexander Proell sa isang liham na hindi dapat ipagsapalaran ng Europa ang pagkawala ng access sa mga pangunahing pag-unlad ng AI dahil sa mga desisyong ginawa sa ibang lugar.
Kasabay ng muling pagpapakalat ng modelo, sinabi ng Anthropic na pinapalawak nito ang kooperasyon sa gobyerno ng U.S. sa pagsubok ng modelo, mga pananggalang, at pagsubaybay sa maling paggamit. Sinabi ng kumpanya na isasama nito ang access bago ilabas sa mga modelo at mga sistema ng kaligtasan para sa pagsusuri, pagbabahagi ng impormasyon sa mga jailbreak at maling paggamit, at mga nakalaang mapagkukunan para sa magkasamang pananaliksik.
Sinimulan din ng Anthropic ang pagbalangkas ng isang framework kasama ang Amazon, Microsoft, Google, at iba pang kasosyo sa pamamagitan ng Project Glasswing, isang pakikipagtulungan sa cybersecurity na inihayag noong Abril, upang suriin ang kalubhaan ng mga jailbreak ng AI. Sinabi ng kumpanya na ang framework ay binuo bilang isang pagsisikap na may pinagkasunduan para sa pag-uri-uriin ang mga panganib ng jailbreak.
Ang debate sa access ay dumating habang ipinagpapatuloy ng Anthropic ang pagtulak nito para sa mas mahigpit na pangangasiwa sa frontier AI. Sa panukala nito noong Hunyo 11 na “Patakaran sa AI Exponential,” nanawagan ang kumpanya para sa mga kinakailangan sa pagsubok, independiyenteng pagsusuri, mga pamantayan sa cybersecurity, at mga hakbang sa pagpapatupad para sa mga advanced na sistema ng AI, na binanggit ang posibleng mga panganib sa biyolohikal, cybersecurity, at operasyonal.