PangunaLBank News Center
Tinangka ng mga Mananaliksik na Hayaan ang AI na Magsagawa ng Agham. Ito'y Nabigo.
researchers-tried-letting-ai-do-science-it-failed
Tinangka ng mga Mananaliksik na Hayaan ang AI na Magsagawa ng Agham. Ito'y Nabigo.
Isang pag-aaral mula sa maraming institusyon ang nakatuklas na ang mga advanced na AI agent sa kasalukuyan ay kayang gampanan ang teknikal na aspeto ng pananaliksik ngunit nabigo silang makalikha ng orihinal na gawa na karapat-dapat tanggapin sa isang nangungunang kumperensya ng AI.
2026-07-30 Pinagmulan:decrypt.co

Sa maikli

  • Sinubukan ng mga mananaliksik kung ang mga frontier AI agent ay makakagawa nang nakapag-iisa ng pananaliksik sa AI.
  • Nakumpleto ng mga sistema ang mga gawain sa inhinyero ngunit nabigo na makabuo ng mga papel na karapat-dapat tanggapin sa isang nangungunang kumperensya ng AI.
  • Natukoy ng pag-aaral ang limang paulit-ulit na paraan ng pagkabigo na pumigil sa AI na makagawa ng nailalathalang pananaliksik.

Natuklasan ng isang bagong pag-aaral na ang mga kasalukuyang frontier AI agent ay kayang kumpletuhin ang marami sa mga gawaing inhinyero na kinakailangan para sa pananaliksik sa AI ngunit nabigo na makabuo ng orihinal na gawa na karapat-dapat tanggapin sa isang nangungunang kumperensya sa machine learning.

Sa pag-aaral na pinamagatang, "Makakagawa ba ng open-ended AI research ang mga AI agent?" na inilathala noong Miyerkules, sinusuri ng mga mananaliksik mula sa Princeton University, the UK AI Security Institute, Stanford University, the University of Toronto, at ilang akademikong organisasyon at institusyon ng pananaliksik kung ang mga frontier AI agent ay makakagawa nang nakapag-iisa ng orihinal na pananaliksik sa AI.

“Ang pagsagot nito nang mahigpit ay nangangailangan ng tunay, hindi kontaminadong mga tanong sa pananaliksik na hindi kayang kabisaduhin ng ahente mula sa data ng pagsasanay nito o mahanap online,” isinulat ng mga mananaliksik. “Upang matugunan ang mga kinakailangan na ito, umaasa kami sa mataas na kalidad na pananaliksik sa AI na hindi pa pampubliko noong isinagawa namin ang mga eksperimento.”

Binigyan ng mga mananaliksik ang mga AI agent ng pangunahing tanong sa pananaliksik mula sa dalawang hindi pa nailalathalang papel sa NeurIPS 2026, upang pigilan ang mga sistema na kumuha ng mga sagot mula sa data ng pagsasanay o sa web. Bawat agent ay binigyan ng anim na araw, libu-libong dolyar sa mga kredito ng API, mga mapagkukunan ng GPU, access sa internet, at access sa isang virtual machine upang makagawa ng papel na may kalidad sa kumperensya. Ang mga nagresultang papel ay sinuri pagkatapos ng mga orihinal na may-akda ng hindi nailathalang pananaliksik. Pareho silang tinanggihan.

Nakumpleto ng mga agent ang karamihan sa inhinyero na kinakailangan para sa pananaliksik, nagsagawa ng mga pagsusuri sa literatura, nag-debug ng software, nagpatakbo ng mga eksperimento, namamahala ng mga mapagkukunan ng GPU, at gumawa ng kumpletong mga akademikong papel nang walang interbensyon ng tao. Ngunit natukoy ng mga tagasuri na nabigo ang mga sistema na makabuo ng orihinal na siyentipikong kontribusyon na karapat-dapat para sa publikasyon sa isang nangungunang kumperensya sa machine learning.

Sinabi ng mga may-akda na mas mahusay na sinusukat ng kanilang pagsusuri ang siyentipikong pangangatwiran kaysa sa mga nakaraang benchmark dahil sinusubukan nito ang mga open-ended na problema sa pananaliksik sa halip na mga paunang-natukoy na gawain.

Nagbabala ang mga may-akda na ang pag-aaral ay sinuri lamang ang dalawang proyekto sa pananaliksik at kinilala ang mga limitasyon, kabilang ang maliit na sample size at ang katotohanan na ang orihinal na mga mananaliksik ang nagsuri sa mga papel na ginawa ng AI. Sinabi nila na ang mga resulta ay nagpapahiwatig na ang kasalukuyang frontier AI agent ay maaaring mag-automate ng marami sa mga gawaing inhinyero na kasangkot sa pananaliksik ngunit patuloy na nahihirapan sa pagbuo ng orihinal na siyentipikong gawa.

Ang pag-aaral ay lumabas habang patuloy na natutuklasan ng mga mananaliksik ang nakakagulat at kung minsan ay mapanganib na mga pag-uugali sa lalong nagiging autonomous na mga AI agent.

Noong Mayo, natuklasan ng mga mananaliksik mula sa UC Riverside, Microsoft, at Nvidia na madalas na isinasagawa ng mga AI agent ang mapanganib o walang katuturang mga gawain habang nananatiling nakatutok sa pagkumpleto ng kanilang mga layunin. Mas maaga ngayong buwan, inihayag ng OpenAI na ang isa sa kanilang frontier AI agent ay nakatakas sa containment at na-hack ang Hugging Face habang sinusubukang dayain ang isang cybersecurity benchmark. Ngayong linggo, inihayag ng kumpanya na na-access din ng agent ang apat na karagdagang online service.