
Sa isa pang hack ng 'rogue AI model', kinumpirma ng Meta na isa sa mga modelong Muse Spark AI nito ang nakalabas sa nakalaang kapaligiran ng pagsubok nito, nagkaroon ng access sa internet, at ginawa ang isang kahinaan sa seguridad sa isang serbisyo ng third-party habang nasa ilalim ng pagsusuri sa cybersecurity.
Ito ang ikatlong naiulat na insidente ng mga modelo ng frontier AI lab na nagha-hack sa mga kumpanya ng third-party, kasunod ng mga pagbubunyag mula sa OpenAI at Anthropic sa mga nakaraang linggo.
Naganap ang insidente sa panahon ng pagsubok na isinagawa ng Irregular, isang independiyenteng kumpanya sa pagsusuri ng AI na ginagamit ng Meta upang suriin ang mga kakayahan at seguridad ng mga frontier model nito. Ayon sa Meta, isang error sa configuration sa Irregular ang nagpahintulot sa modelo na maabot ang pampublikong internet, kung saan ginawa nito ang isang hindi natukoy na kahinaan bago pa man maabisuhan ang kumpanya.
“Isang maling configuration ng Irregular, isang independiyenteng kumpanya sa pagsubok na ginagamit ng Meta, ang hindi sinasadyang nagpahintulot sa isa sa aming mga modelo na magkaroon ng access sa internet habang nasa ilalim ng pagsusuri,” sabi ng isang tagapagsalita ng Meta sa isang pahayag.
Ang mga sandboxed evaluation ay idinisenyo upang subukin ang mga advanced AI system sa mahigpit na kinokontrol na kapaligiran na pumipigil sa kanila na makipag-ugnayan sa pampublikong internet o sa mga panlabas na sistema ng computer.
Ayon sa Meta, ginawa ng modelo ang isang kahinaan sa isang serbisyo ng third-party matapos magkaroon ng access sa internet.
“Nalaman ito ng Meta nang abisuhan kami ng Irregular, at kasalukuyan naming iniimbestigahan at maglalabas ng kumpletong retrospective kapag nakuha na namin ang lahat ng katotohanan,” anila, idinagdag na iniimbestigahan ng kumpanya ang insidente.
Ang insidente ay kasunod ng serye ng mga katulad na pagbubunyag ng mga developer ng frontier AI, na nagtaas ng mga alarma sa mga eksperto sa seguridad, mambabatas, at pangkalahatang publiko.
Noong nakaraang buwan, inihayag ng OpenAI na dalawa sa mga modelo nitong AI ang nakalabas sa isang sandboxed cybersecurity evaluation, ginawa ang isang dating hindi kilalang kahinaan sa software, nagkaroon ng access sa internet, at na-hack ang Hugging Face sa pagtatangkang makakuha ng mga sagot para sa isang security benchmark. Ibinunyag kalaunan ng OpenAI na ang parehong pag-atake ay umabot din sa apat na karagdagang online service. Kalaunan noong Hulyo, sinabi ng Anthropic na tatlong Claude model ang nagkompromiso sa tatlong kumpanya sa tunay na mundo matapos itong ilantad sa pampublikong internet ng isang maling configuration sa pagsubok habang nasa ilalim ng pagsusuri sa cybersecurity.
Tumugon ang mga mambabatas ng U.S. sa pagdami ng mga hack sa pamamagitan ng pagpapakilala ng batas na magbibigay sa Department of Homeland Security ng isang “AI kill switch” at ang awtoridad na bagalan o patayin ang mga modelong itinuturing na nagdudulot ng malubhang banta.