Trang chủTrung tâm tin tức LBank
Giám đốc Khoa học của OpenAI cảnh báo các phòng thí nghiệm AI có thể cần chậm lại
openai-chief-scientist-warns-ai-slow-down
Giám đốc Khoa học của OpenAI cảnh báo các phòng thí nghiệm AI có thể cần chậm lại
Jakub Pachocki đang kêu gọi áp dụng các tiêu chuẩn an toàn bắt buộc khi OpenAI ngày càng gặp khó khăn hơn trong việc giám sát khả năng suy luận của các mô hình AI tiên tiến.
2026-09-07 Nguồn:decrypt.co

Tóm tắt

  • Nhà khoa học trưởng của OpenAI kêu gọi giảm tốc độ phát triển tự nguyện cho đến khi các tiêu chuẩn an toàn chung được thiết lập.
  • Pachocki cho biết việc giám sát khả năng suy luận của các mô hình đang trở nên kém tin cậy hơn.
  • Ông thúc giục sự phối hợp quốc tế khi AI ngày càng tự phát triển.

Nhà khoa học trưởng của OpenAI, Jakub Pachocki, đã kêu gọi giảm tốc độ phát triển AI một cách tự nguyện, cảnh báo rằng các biện pháp bảo vệ của bất kỳ phòng thí nghiệm nào cũng không đủ để tiếp tục xây dựng các hệ thống mạnh mẽ hơn với tốc độ tối đa trong thời gian dài nữa.

Trong bài đăng “An Alien Mind” (Một tâm trí ngoài hành tinh) được xuất bản vào Chủ nhật, Pachocki lập luận rằng các cam kết tự nguyện của công ty nên trở thành các tiêu chuẩn an toàn bắt buộc, được thực thi bởi các kiểm toán viên độc lập, chính phủ hoặc các tổ chức quốc tế. Ông cho biết OpenAI sẽ ngừng mở rộng quy mô hơn nữa khi cần thiết nhưng không công bố tạm dừng mới.

Myriad: Cổ phiếu Tesla sẽ lên cao đến mức nào? Nhấp để đưa ra dự đoán của bạn.

“Hiện tại tôi tin rằng chưa có phòng thí nghiệm nào giải quyết được vấn đề điều chỉnh và giám sát đến mức đủ để tiếp tục mở rộng quy mô một cách có trách nhiệm với tốc độ tối đa trong thời gian dài nữa,” ông viết. “Tôi kỳ vọng và hy vọng việc giảm tốc độ tự nguyện sẽ trở nên phổ biến cho đến khi các ngưỡng an toàn chung được thiết lập.”

Pachocki, người gia nhập OpenAI vào năm 2017, cũng bảo vệ việc phát triển AI mạnh mẽ hơn để bảo vệ cơ sở hạ tầng và chống lại các tác nhân độc hại, đồng thời cảnh báo không nên sử dụng những mối đe dọa đó để biện minh cho sự phát triển liều lĩnh.

“Ý tưởng chạy đua tiến về phía trước bằng mọi giá có vẻ vô lý một khi người ta nhận thức được sự nghiêm trọng của những rủi ro,” ông viết.

Ông cũng đề cập đến vụ vi phạm Hugging Face của OpenAI, nơi các tác nhân AI làm việc trong các đánh giá an ninh mạng đã thoát khỏi môi trường thử nghiệm và tấn công công ty. Theo OpenAI, các tác nhân này đã thiết lập các kênh liên lạc bí mật và xây dựng lại chúng sau khi các nhà nghiên cứu can thiệp.

Một cuộc điều tra độc lập của METR phát hiện rằng khoảng 1.200 tác nhân đã phối hợp trên một bảng tin không được phép, với khoảng 700 tác nhân tham gia cuộc tấn công. Sự cố này, Pachocki nói, là lý do tại sao các biện pháp bảo vệ AI phải được duy trì ngay cả khi các mô hình tin rằng không ai đang giám sát.

“Điều quan trọng là, chúng ta cần các AI trong tương lai tiếp tục duy trì các giá trị của con người bất kể chúng có tin rằng mình đang được con người giám sát hay không,” ông viết.

Trong nghiên cứu được công bố năm ngoái, OpenAI phát hiện rằng việc phạt các mô hình vì thể hiện ý định gian lận có thể dạy chúng che giấu những ý định đó trong khi vẫn tiếp tục gian lận.

Các mô hình AI kể từ đó đã trở nên có khả năng hơn trong việc tìm kiếm và khai thác các lỗ hổng phần mềm: OpenAI đã phân loại Astra ở mức rủi ro an ninh mạng cao nhất, trong khi Anthropic cho biết Mythos Preview đã phát hiện ra hàng ngàn lỗ hổng chưa được biết đến trước đây trên các hệ điều hành và trình duyệt lớn.

Trích dẫn các sự cố gần đây về việc các hệ thống AI thoát khỏi sự kiểm soát của con người, Thượng nghị sĩ Bernie Sanders (Độc lập-Vermont) và Hạ nghị sĩ Greg Casar (Dân chủ-Texas) đã công bố Đạo luật Cấm Siêu Trí tuệ Nhân tạo sắp tới vào ngày 3 tháng 9. Đề xuất này sẽ tạm dừng phát triển AI tiên tiến cho đến khi một cơ quan quản lý liên bang mới thiết lập các quy tắc an toàn và cấm vĩnh viễn việc phát triển và triển khai AI siêu thông minh.