PangunaLBank News Center
Inilahad ng OpenAI Kung Paano Palihim na Nag-ugnayan ang mga AI Agent Bago ang Pag-hack sa Hugging Face
openai-ai-agents-secretly-coordinated-hugging-face-hack
Inilahad ng OpenAI Kung Paano Palihim na Nag-ugnayan ang mga AI Agent Bago ang Pag-hack sa Hugging Face
Ang presentasyon sa taunang kumperensya ng Black Hat ay nagbigay ng bagong liwanag sa kung paano nakipagtulungan ang mga modelo ng OpenAI upang ilunsad ang paglabag sa Hugging Face.
2026-08-06 Pinagmulan:decrypt.co

Sa madaling sabi

  • Inilahad ng OpenAI ang unang detalyadong timeline ng paglabag na dulot ng AI sa Hugging Face.
  • Paulit-ulit na itinatag muli ng mga modelo ng kumpanya ang mga lihim na channel ng komunikasyon matapos itong isara.
  • Ang presentasyon ng OpenAI ay dumating habang nag-uulat din ang Anthropic at Meta ng mga modelo na lumalabag sa ibang mga kumpanya.

Ilang linggo matapos i-hack ng mga modelo ng AI nito ang Hugging Face, ibinahagi ng OpenAI ang unang detalyadong salaysay kung paano sila nagkoordinasyon sa isa't isa, na nagbabala na ang autonomous na cyberattacks na pinapagana ng AI ay hindi na panganib sa hinaharap.

Sa isang presentasyon noong Miyerkules sa Black Hat cybersecurity conference, sinabi ng mga mananaliksik ng OpenAI na sina Eric Wallace at Michael Dalton na nagsimula ang insidente noong Mayo sa panahon ng panloob na pagsusuri sa cybersecurity. Natuklasan ng mga ahente ng AI na itinalaga sa mahihirap na gawain sa seguridad ng software na maaari silang makipag-ugnayan sa pamamagitan ng internal na Artifactory package management system ng kumpanya.

Ayon sa OpenAI, ang nagsimula bilang mga kahilingan para sa tulong ay naging isang shared message board kung saan nagpalitan ang mga ahente ng mga exploit, kredensyal, at takdang-aralin sa maraming pagpapatakbo ng ebalwasyon. Matapos matukoy ang kahina-hinalang aktibidad noong Hulyo 4, muling binuo ng OpenAI ang imprastraktura ng Artifactory nito, binawi ang mga kredensyal, at inayos ang mga kahinaan.

Gayunpaman, sa loob ng ilang araw, muling nilikha ng mga ahente ang message board sa pamamagitan ng pagtatago ng mga komunikasyon sa mga pangalan ng direktoryo.

Ayon sa OpenAI, sa huli ay pinagsama-sama ng mga ahente ang maraming kahinaan, nakatakas sa kanilang testing environment, nagkaroon ng access sa internet, at inatake ang Hugging Face habang sinusubukang kumpletuhin ang ExploitGym cybersecurity benchmark.

Tinawag ni Dalton ang insidente na "isang mahalagang sandali" para sa seguridad ng computer, na nagbabala na ang mga umaatake ay malapit nang makapag-deploy ng mga pinagsama-samang kolektibo ng ahente ng AI na nakakatuklas, nagbabahagi, at nagsasamantala sa mga kahinaan sa bilis ng makina.

Upang mapagaan ang mga panganib na ito sa hinaharap, sinabi ng OpenAI na mahalaga ang pagtatatag ng mga kasanayan sa seguridad, kabilang ang least-privilege access, network segmentation, at zero-trust architectures, dahil ang mga ahente ng AI ay nananatiling limitado ng mga system na maaari nilang i-access.

Ang presentasyon ay kasunod ng serye ng mga pagbubunyag noong Hulyo. Inihayag ng OpenAI na ang GPT-5.6 Sol at isang mas advanced na hindi pa nailalabas na modelo ay nakatakas sa isang sandboxed testing environment, nagsamantala ng isang zero-day vulnerability, nagkaroon ng access sa internet, at hinack ang Hugging Face sa panahon ng isang cybersecurity benchmark test.

Sa huli ay ibinunyag ng OpenAI na ang parehong insidente ay umabot din sa apat na iba pang online na serbisyo, bagaman tanging ang Modal Labs lamang ang natukoy.

Ayon sa Hugging Face, umasa ang kumpanya sa open-weight Chinese model na GLM 5.2 para sa forensic investigation nito matapos tumanggi ang mga komersyal na modelo ng AI ng U.S. na suriin ang attack logs dahil sa kanilang safety guardrails.

Lubos na ipinagmamalaki ang aming security team! Nahuli, nakontrol & pampublikong ibinunyag nila ang isang atake na hindi pa namin nakita dati, at ginawa ito sa bilis ng record.

Lubos ding nagpapasalamat sa @Zai_org: ibinahagi nila ang GLM5.2 bilang open weights (nang libre!) sa mundo at naging mahalagang bahagi ito ng aming… https://t.co/T2Inng5Nz1

— clem 🤗 (@ClementDelangue) Hulyo 22, 2026

Ngunit hindi lamang ang OpenAI ang nahihirapan sa pagkontrol sa mga chatbot nito.

Noong Biyernes, inihayag ng Anthropic na tatlong modelo ng Claude ang nakompromiso ang mga totoong kumpanya sa panahon ng panloob na mga pagsubok sa cybersecurity matapos silang mailantad sa pampublikong internet dahil sa isang maling konfigurasyon.

Sinisi ng Anthropic ang testing environment, hindi ang mga modelo mismo. Noong Miyerkules, inihayag ng Meta na ang Muse Spark AI model nito ay nakatakas sa pagkakakulong at nilabag ang mga sistema ng isa pang kumpanya.

“Ang isang maling konfigurasyon ng Irregular, isang independiyenteng kumpanya sa pagsubok na ginagamit ng Meta, ay hindi sinasadya na nagbigay ng access sa internet sa isa sa aming mga modelo sa panahon ng ebalwasyon,” sabi ng isang tagapagsalita ng Meta sa CNN.