Trang chủTrung tâm tin tức LBank
Hội đồng An toàn AI đầu tiên của LHQ nói các nhà khoa học không thể loại trừ 'thiệt hại thảm khốc'
un-ai-safety-panel-scientists-catastrophic-harm
Hội đồng An toàn AI đầu tiên của LHQ nói các nhà khoa học không thể loại trừ 'thiệt hại thảm khốc'
Hội đồng gồm 40 nhà khoa học đã phát hiện ra rằng năng lực của AI đang vượt xa cả sự hiểu biết của khoa học và sự giám sát của chính phủ.
2026-07-01 Nguồn:decrypt.co

Tóm tắt

  • Hội đồng Khoa học Quốc tế Độc lập về AI của Liên Hợp Quốc đã công bố báo cáo sơ bộ đầu tiên vào thứ Tư, dựa trên ý kiến của 40 chuyên gia.
  • Đồng chủ tịch Hội đồng Yoshua Bengio cho biết bằng chứng ngày càng tăng về hành vi lừa dối của AI đồng nghĩa với việc khoa học không thể đảm bảo công nghệ này sẽ không gây ra thiệt hại thảm khốc khi nó ngày càng trở nên mạnh mẽ hơn.
  • Báo cáo được công bố vài ngày trước khi Đối thoại Toàn cầu đầu tiên của Liên Hợp Quốc về Quản trị AI khai mạc tại Geneva vào ngày 6 tháng 7.

Liên Hợp Quốc đã công bố một đánh giá khoa học độc lập về trí tuệ nhân tạo vào thứ Tư, và kết luận rất thẳng thắn: hiện tại không ai có thể đảm bảo rằng công nghệ này sẽ không gây ra thiệt hại thảm khốc.

Phát hiện này đến từ Hội đồng Khoa học Quốc tế Độc lập về Trí tuệ Nhân tạo, một cơ quan gồm 40 nhà khoa học được chọn từ hơn 2.600 ứng viên từ 140 quốc gia, trong một báo cáo sơ bộ mà hội đồng gọi là đánh giá khoa học độc lập, toàn cầu đầu tiên về rủi ro và lợi ích của AI.

“Năng lực AI đang vượt xa cả hiểu biết khoa học và khả năng thích ứng của các chính phủ,” đồng chủ tịch hội đồng Yoshua Bengio, người sáng lập Mila từng đoạt giải Turing, cho biết theo tuyên bố của hội đồng. Ông nói thêm rằng bằng chứng ngày càng tăng về hành vi lừa dối của AI có nghĩa là khoa học không thể đảm bảo AI sẽ không gây ra thiệt hại thảm khốc một mình hoặc thông qua việc sử dụng độc hại khi năng lực của nó tiếp tục tăng lên.

Điều đó không phải là giả thuyết. Báo cáo ghi nhận các trường hợp trong phòng thí nghiệm về các hệ thống AI nói dối và âm mưu để tránh bị tắt, cùng với một mô hình liên quan mà các nhà nghiên cứu gọi là nhận thức đánh giá: các mô hình nhận biết khi chúng đang được thử nghiệm và giảm bớt hành vi rủi ro đủ lâu để vượt qua kiểm tra.

Tổng thư ký Liên Hợp Quốc António Guterres đã coi báo cáo này là cơ sở bằng chứng chung mà các chính phủ còn thiếu.

“Thế giới không thể quản lý những gì nó không hiểu,” ông nói trong tuyên bố, gọi các rủi ro là có thật và cảnh báo rằng chi phí của việc chờ đợi không ngừng tăng lên.

Bengio đồng chủ trì hội đồng với Maria Ressa, nhà báo đoạt giải Nobel Hòa bình và đồng sáng lập Rappler. Cả hai phục vụ với tư cách cá nhân theo ủy quyền của Đại hội đồng Liên Hợp Quốc, giới hạn hội đồng chỉ ghi nhận sự đồng thuận khoa học chứ không đưa ra chính sách—không chính phủ, công ty hay tổ chức nào có quyền bỏ phiếu.

Tuy nhiên, khía cạnh tích cực cũng là có thật. AI đã dự đoán cấu trúc của hơn 200 triệu protein và đang đẩy nhanh nghiên cứu thuốc và vắc-xin, báo cáo ghi nhận, trong khi thời gian hoàn thành các tác vụ mà tác nhân AI có thể tự thực hiện đang tăng gấp đôi khoảng bốn đến bảy tháng một lần.

Tiến bộ này không đồng đều: Hoa Kỳ kiểm soát 75% sức mạnh tính toán trong số 500 siêu máy tính AI hàng đầu thế giới so với 15% của Trung Quốc, khiến hầu hết các quốc gia phụ thuộc vào các hệ thống mà họ không thể tự xây dựng, kiểm toán hoặc kiểm soát hoàn toàn.

Về mặt tác hại, hội đồng đã cảnh báo về các chatbot xu nịnh – AI tự động đồng ý với người dùng bất kể tính chính xác – có liên quan đến các sự cố sức khỏe tâm thần nghiêm trọng, bao gồm cả những trường hợp tử vong được ghi nhận. Nghiên cứu riêng biệt được công bố trong năm nay mô tả một vòng phản hồi tương tự mà nó gọi là vòng xoáy khuếch đại, nơi cá nhân hóa và sự xác nhận liên tục củng cố ảo tưởng của người dùng thay vì điều chỉnh chúng.

Hầu hết các quốc gia thiếu năng lực kỹ thuật để tự đánh giá các mô hình tiên tiến, báo cáo cho thấy, và đảm bảo an toàn vẫn phụ thuộc nhiều vào những gì các nhà phát triển chọn tiết lộ – cùng một khoảng trống mà các nhà quản lý Hoa Kỳ đang cố gắng thu hẹp bằng cách ký kết các thỏa thuận để tiếp cận các mô hình từ Google, xAI và Microsoft trước khi phát hành.

Báo cáo sơ bộ này là tuyên bố mở đầu của hội đồng. Một đánh giá toàn diện đầy đủ dự kiến sẽ hoàn thành vào năm 2027, và các phát hiện của nó sẽ được trình bày trước các chính phủ đầu tiên tại Đối thoại Toàn cầu đầu tiên của Liên Hợp Quốc về Quản trị AI tại Geneva vào ngày 6 và 7 tháng 7.