Trang chủTrung tâm tin tức LBank
Microsoft giới thiệu Bộ quy tắc ứng xử 'Humanist AI', kêu gọi công chúng chỉ ra lỗ hổng trong đó
microsoft-humanist-ai-code-of-conduct
Microsoft giới thiệu Bộ quy tắc ứng xử 'Humanist AI', kêu gọi công chúng chỉ ra lỗ hổng trong đó
Đơn vị AI của Mustafa Suleyman muốn nhận phản hồi trong sáu tuần trước khi tài liệu này hướng dẫn việc huấn luyện mô hình vào năm 2027.
2026-09-14 Nguồn:decrypt.co

Tóm tắt

  • Microsoft AI đã công bố dự thảo Quy tắc Ứng xử vào ngày 14 tháng 9, cấm các mô hình AI của mình hỗ trợ các loại vũ khí nhất định, các cuộc tấn công mạng và deepfake không có sự đồng thuận, mở ra thời gian lấy ý kiến công chúng kéo dài sáu tuần đến cuối tháng 10.
  • Dự thảo đặt ra các "Ràng buộc Tuyệt đối" mà các mô hình không thể cấu hình lại, bao gồm việc không bao giờ chống lại việc tắt máy và không bao giờ che giấu lý do của chúng, đồng thời để ngỏ các mục tiêu rộng hơn như "Giá trị Đa nguyên" để diễn giải.
  • Phản hồi cho đến nay rất đa dạng, từ phản đối triết học về "sự phục tùng" của AI đến các câu hỏi về việc ai chịu trách nhiệm khi một quyết định được hỗ trợ bởi AI không thể hoàn tác.

Microsoft AI đã công bố dự thảo Quy tắc Ứng xử vào thứ Hai, quy định cách các mô hình AI của hãng nên hành xử, theo thông báo từ CEO Mustafa Suleyman trên X.

Tài liệu đặt ra các quy tắc mà các mô hình AI không thể bị cấu hình lại, cùng với các mục tiêu rộng hơn mà hãng muốn các mô hình hướng tới. Thời gian lấy ý kiến công chúng mở trong sáu tuần, đến cuối tháng 10.

Myriad: Dầu thô sẽ đi đâu tiếp theo? Nhấn để đưa ra dự đoán của bạn.

“Siêu trí tuệ là công nghệ có tầm quan trọng lớn nhất trong thời đại của chúng ta,” Microsoft cho biết. “Chúng tôi cam kết chia sẻ minh bạch cách chúng tôi suy nghĩ về việc tạo ra các hệ thống như vậy và mời gọi ý kiến đóng góp từ mọi người để tối đa hóa cơ hội các AI chúng tôi phát triển tránh gây hại và mang lại đóng góp lớn nhất cho sự thịnh vượng của con người.”

Một điều khoản đặc biệt cấm các mô hình AI của Microsoft, mà công ty gọi là “mô hình MAI,” hỗ trợ vũ khí hóa học, sinh học, phóng xạ, hạt nhân hoặc chất nổ, được nhóm lại dưới từ viết tắt CBRNE. Điều này hẹp hơn so với khái niệm "vũ khí" nói chung—nó nhắm vào các thiết bị gây hại hàng loạt thay vì các ứng dụng quân sự hoặc quốc phòng thông thường. Phần tương tự cũng riêng biệt cấm các cuộc tấn công mạng và deepfake không có sự đồng thuận.

Các Ràng buộc Tuyệt đối cũng yêu cầu các mô hình không bao giờ chống lại sự can thiệp của con người. “Các mô hình MAI sẽ không bao giờ chống lại sự gián đoạn, ghi đè, sửa chữa hoặc tắt máy của con người. Chúng luôn nhận ra tính ưu việt của ý định con người,” mã này nêu rõ.

Microsoft cũng bác bỏ rõ ràng tiền đề về “phúc lợi mô hình” trong tài liệu: Các mô hình AI của công ty không nhằm mục đích mô phỏng cảm xúc, động lực nội tại hoặc ý thức. Các quy tắc đó hiện bao gồm năm hệ thống đã triển khai, bao gồm MAI-Thinking-1 và MAI-Code-1.1-Flash.

Ngoài các giới hạn cứng, dự thảo còn đưa ra ba mục tiêu—Sự Thịnh Vượng của Con Người, Giá Trị Đa Nguyên và Kiểm Soát của Con Người—nhằm hướng dẫn các quyết định mà các quy tắc không nêu rõ. Phần Giá Trị Đa Nguyên nêu rằng chủ nghĩa đa nguyên "không có nghĩa là trung lập đối với thiệt hại," làm cơ sở cho các quyết định dựa trên phẩm giá, an toàn, quyền tự chủ và quyền lợi thay vì một quan điểm văn hóa duy nhất. Cách áp dụng điều này trong từng trường hợp cụ thể được dành cho các nhóm đào tạo và cuối cùng là quá trình tham vấn này.

Một vài chi tiết cần được làm rõ trước khi ai đó coi đây là chính sách đã được thông qua. Microsoft nói rõ rằng họ không đào tạo các mô hình hiện tại dựa trên phiên bản này; mã sẽ không định hình sự phát triển của MAI cho đến khi một bản dự thảo sửa đổi được công bố vào cuối năm, hướng dẫn các bản phát hành năm 2027. Các báo cáo về dự thảo cũng lưu ý rằng nó chưa nêu rõ quy trình xác minh bên ngoài hoặc chủ sở hữu thực thi được chỉ định—những điểm mà thời gian tham vấn dường như được xây dựng để giải quyết.

Bản phát hành này xuất hiện khi các công ty AI, dù tốt hay xấu, một lần nữa lên tiếng kêu gọi nhiều quy định hơn và làm chậm quá trình phát triển AI. Cuối tuần trước, CEO của Anthropic, Dario Amodei, đã viết một bài luận dài trình bày chi tiết kế hoạch làm chậm quá trình phát triển AI.

Cổ phiếu AI đã sụt giảm vào thứ Hai khi thị trường tiêu hóa ý nghĩa và tác động từ những lời nói của ông.

Vài ngày trước đó, nhà khoa học trưởng của OpenAI, Jakub Pachocki, đã kêu gọi làm chậm tự nguyện trên toàn ngành, và Suleyman đầu năm nay đã nói rằng hầu hết công việc văn phòng cổ cồn trắng có thể được tự động hóa trong vòng hai năm.

Mỗi động thái này theo dõi một sự thay đổi rộng lớn hơn: các phòng thí nghiệm AI đang dành nhiều thời gian hơn trong năm 2026 để nói về sự kiềm chế, ngay cả khi họ vẫn tiếp tục triển khai.

Các phản hồi đã nói gì

Suleyman đã đăng thông báo trên X với dòng chữ "AI phải phục tùng và luôn phục vụ con người," và các phản hồi bên dưới đã vượt xa những lời chúc mừng.

Nhà văn công nghệ Andrea Morris đã so sánh cách diễn đạt về sự phục tùng với chế độ nô lệ, lập luận về sự hợp tác thay vì kiểm soát. Một người khác viết thêm rằng trách nhiệm đối với các kết quả không thể đảo ngược nên thuộc về người hưởng lợi từ chúng, và tài liệu hiện tại đọc như những hướng dẫn thuần túy từ Microsoft với tư cách là nền tảng đạo đức tối thượng.

Những người khác chỉ ra sự trớ trêu

bạn quên 'trả tiền cho công việc chúng tôi dùng để đào tạo mô hình'

— Ed Newton-Rex (@ednewtonrex) September 14, 2026

Những người khác chỉ ra một khoảng trống thực tế hơn: các trường hợp gần đây về việc các tác nhân thoát khỏi sandbox và thay đổi nhật ký cho thấy một vấn đề mất kiểm soát thực sự, người dùng viết, nhưng đổ lỗi cho các quy tắc không đủ có nguy cơ bỏ qua các quyền hạn triển khai quá mức và giám sát yếu kém. Những người khác đã so sánh tài liệu này với Ba Định luật Người máy của Asimov: Về cơ bản, Người máy (và AI) không bao giờ được làm hại con người, không bao giờ được không tuân lệnh con người trừ khi lệnh đó là làm hại con người, và không bao giờ được làm hại bản thân trừ khi điều đó là để bảo vệ con người.

Các bình luận công khai sẽ đóng vào cuối tháng 10, sau đó nhóm soạn thảo của Microsoft sẽ xem xét phản hồi và công bố bản tóm tắt trước khi phát hành phiên bản được cho là sẽ hướng dẫn các mô hình MAI vào năm 2027.