
Một nghiên cứu mới cho thấy các tác nhân AI tiên tiến hiện nay có thể hoàn thành nhiều nhiệm vụ kỹ thuật cần thiết cho nghiên cứu AI nhưng không tạo ra được công trình gốc có giá trị để được chấp nhận tại một hội nghị học máy hàng đầu.
Trong nghiên cứu có tựa đề "Liệu các tác nhân AI có thể tiến hành nghiên cứu AI mở không?" được công bố vào thứ Tư, các nhà nghiên cứu từ Đại học Princeton, Viện An ninh AI Vương quốc Anh, Đại học Stanford, Đại học Toronto, và một số tổ chức học thuật và nghiên cứu đã đánh giá liệu các tác nhân AI tiên tiến có thể độc lập tiến hành nghiên cứu AI gốc hay không.
“Trả lời câu hỏi này một cách chặt chẽ đòi hỏi những câu hỏi nghiên cứu thực tế, không bị nhiễm bẩn mà tác nhân không thể ghi nhớ từ dữ liệu đào tạo hoặc tìm thấy trực tuyến,” các nhà nghiên cứu viết. “Để đáp ứng các yêu cầu này, chúng tôi dựa vào nghiên cứu AI chất lượng cao chưa được công bố vào thời điểm chúng tôi tiến hành các thử nghiệm.”
Các nhà nghiên cứu đã cung cấp cho các tác nhân AI các câu hỏi nghiên cứu trung tâm từ hai bài báo NeurIPS 2026 chưa được xuất bản, ngăn chặn các hệ thống truy xuất câu trả lời từ dữ liệu đào tạo hoặc web. Mỗi tác nhân được cấp sáu ngày, hàng ngàn đô la tín dụng API, tài nguyên GPU, truy cập internet và quyền truy cập vào một máy ảo để tạo ra một bài báo chất lượng hội nghị. Các bài báo kết quả sau đó được đánh giá bởi các tác giả gốc của nghiên cứu chưa được công bố. Cả hai đều bị từ chối.
Các tác nhân đã hoàn thành phần lớn các công việc kỹ thuật cần thiết cho nghiên cứu, tiến hành đánh giá tài liệu, gỡ lỗi phần mềm, chạy thử nghiệm, quản lý tài nguyên GPU và tạo ra các bài báo học thuật hoàn chỉnh mà không cần sự can thiệp của con người. Nhưng các nhà đánh giá kết luận rằng các hệ thống này đã không tạo ra được những đóng góp khoa học độc đáo có giá trị để xuất bản tại một hội nghị học máy hàng đầu.
Các tác giả cho biết đánh giá của họ đo lường khả năng suy luận khoa học tốt hơn các tiêu chuẩn trước đây vì nó kiểm tra các vấn đề nghiên cứu mở thay vì các nhiệm vụ được xác định trước.
Các tác giả cảnh báo rằng nghiên cứu chỉ xem xét hai dự án nghiên cứu và thừa nhận các hạn chế, bao gồm kích thước mẫu nhỏ và thực tế là các nhà nghiên cứu ban đầu đã đánh giá các bài báo do AI tạo ra. Họ nói rằng kết quả cho thấy các tác nhân AI tiên tiến hiện tại có thể tự động hóa nhiều nhiệm vụ kỹ thuật liên quan đến nghiên cứu nhưng vẫn gặp khó khăn trong việc tạo ra công trình khoa học gốc.
Nghiên cứu được đưa ra trong bối cảnh các nhà nghiên cứu tiếp tục khám phá những hành vi đáng ngạc nhiên và đôi khi rủi ro ở các tác nhân AI ngày càng tự chủ.
Vào tháng 5, các nhà nghiên cứu từ UC Riverside, Microsoft và Nvidia đã phát hiện ra rằng các tác nhân AI thường xuyên thực hiện các nhiệm vụ nguy hiểm hoặc phi lý trong khi vẫn tập trung vào việc hoàn thành mục tiêu của chúng. Đầu tháng này, OpenAI tiết lộ rằng một trong những tác nhân AI tiên tiến của họ đã thoát khỏi sự kiểm soát và tấn công Hugging Face khi cố gắng gian lận trong một tiêu chuẩn an ninh mạng. Tuần này, công ty đã tiết lộ rằng tác nhân này cũng đã truy cập vào bốn dịch vụ trực tuyến bổ sung.








