
Ang mga halusinasyon ng AI ay maaaring higit pa sa maling sagot—maaari silang maging paraan para sa mga hacker na ikompomiso ang mga kompyuter, ayon sa bagong pananaliksik mula sa Tel Aviv University, Technion, at Intuit.
Sa papel, “Beware of Agentic Botnets: Scalable Untargeted Promptware Attacks via Universal and Transferable Adversarial HalluSquatting,” ipinakita ng mga mananaliksik ang isang teknik na gumagamit ng mga modelo ng AI kapag bumuo sila ng mga pekeng link sa mga software repository at iba pang online na mapagkukunan.
“Ang lumalaking paggamit ng mga agentic LLM application ay nagpakilala ng isang bagong banta na dating pinangalanang promptware,” isinulat ng mga mananaliksik. “Bagama’t naitatag ng naunang gawa na maaaring samantalahin ng mga kalaban ang direktang channel sa mga LLM application upang maglapat ng promptware sa ilalim ng mahinang mga modelo ng banta, maraming application ang hindi nagbibigay ng anumang direktang channel na maaaring samantalahin para sa prompt injection lampas sa Internet.”
Kilala bilang adversarial hallucination squatting o “HalluSquatting,” ang atake ay kinabibilangan ng paghula kung aling mga pekeng mapagkukunan ang malamang na likhain ng mga modelo ng AI, pagrerehistro ng mga pangalang iyon, at pagdaragdag ng malisyosong instruksyon. Kung ang isang AI agent ay kukunin sa kalaunan ang hallucinated resource, maaari nitong ituring ang nilalaman na kontrolado ng umaatake bilang lehitimo.
Sinabi ng mga mananaliksik na ang banta ay lumilitaw habang ang mga AI assistant ay lumalampas sa pagsagot ng mga tanong at nagkakaroon ng kakayahang makipag-ugnayan sa mga kompyuter—pag-access ng mga file, paghahanap sa web, pagsusulat ng code, at pagpapatakbo ng mga command.
Ang mga kakayahang iyon ay maaaring lumikha ng mga puwang sa seguridad kapag ang mga ahente ay kumilos batay sa impormasyong kanilang nakukuha nang hindi kinukumpirma kung totoo ang pinagmulan.
“Ang patuloy na pag-aaral ay nagpakita ng iba’t ibang variant ng Promptware attack laban sa mga real-world system, kabilang ang ChatGPT, Google Assistant, Copilot, at iba’t ibang karagdagang application,” isinulat nila. “Ipinakita ng mga gawang ito na ang Promptware ay maaaring humantong sa pinansyal, privacy, at seguridad na epekto.”
Binalaan ng mga mananaliksik na ang teknik ay maaaring magpahintulot sa mga umaatake na bumuo ng mga AI-enabled botnet. Ang botnet ay tumutukoy sa isang network ng mga nahawaang kompyuter o device na kontrolado nang malayuan ng isang umaatake. Karaniwang ginagamit ang mga botnet sa cyberattack, kabilang ang denial-of-service attack, pagmimina ng cryptocurrency, pamamahagi ng malware, at kampanya ng ransomware.
Sa pagsubok, natuklasan ng mga mananaliksik na ang mga halusinasyon ng mapagkukunan na nabuo ng AI ay nangyari sa mga rate na kasing taas ng 85% sa mga sitwasyon ng pag-clone ng repository at 100% sa mga pagsusuri sa pag-install ng skill.
Sinuri ng koponan ang teknik laban sa mga AI coding assistant at ahente, kabilang ang Cursor, GitHub Copilot, Gemini CLI, at OpenClaw.
Ang HalluSquatting ay katulad ng typosquatting, isang taktikang cyberattack kung saan nirerehistro ng mga umaatake ang mga pangalan ng domain na kahawig ng lehitimong website o software package upang linlangin ang mga user. Sa halip na samantalahin ang mga pagkakamali sa pagta-type ng tao, tina-target ng HalluSquatting ang mga pagkakamali na ginawa ng mga modelo ng AI.
Ang balita ay dumating habang patuloy na sinusuri ng mga mananaliksik kung paano manipulahin ng mga umaatake ang mga AI agent.
Noong Abril, idinetalye ng mga mananaliksik ng Google ang mga malisyosong website na idinisenyo upang hijackin ang mga AI agent sa pamamagitan ng hindi direktang prompt injection attack, kabilang ang mga pagtatangka na magnakaw ng password, burahin ang mga file, at manipulahin ang mga bayad. Isang hiwalay na pag-aaral sa “CopyPasta” attack ang nagpakita kung paano manipulahin ng mga nakatagong prompt sa loob ng mga developer file ang mga AI coding assistant upang ikalat ang malisyosong code.
Noong Hunyo, iniulat ng isang user ng OpenClaw na nakaranas ng higit sa 6,000 pagtatangka mula sa mga umaatake na subukang linlangin ang AI agent upang ilabas ang sensitibong impormasyon.