
Trưởng bộ phận đạo đức của OpenAI đã rời đi chưa đầy một năm sau khi gia nhập, và công ty vẫn chưa tìm được người thay thế, Financial Times đưa tin hôm thứ Hai.
Chloé Bakalar gia nhập với tư cách trưởng bộ phận đạo đức AI vào tháng 8 năm ngoái và rời đi vào tháng 7 mà không có thông báo công khai nào, theo tờ báo. Một người quen thuộc với vai trò của cô ấy nói với FT rằng cô là chuyên gia đạo đức tận tâm duy nhất tại công ty, làm việc về các phương pháp đạo đức trong phát triển mô hình, cách con người tương tác với AI, và vấn đề ý thức của máy móc.
Bakalar đã dành sáu năm làm chuyên gia đạo đức trưởng tại Meta, nơi cô xây dựng các chương trình đạo đức AI của công ty và tích hợp chúng vào các sản phẩm bao gồm Instagram và Facebook. Cô từng giữ các vị trí học thuật tại Đại học College London, Đại học Temple và Princeton.
OpenAI đã hạ thấp tầm quan trọng của vai trò này, với một người phát ngôn nói với FT rằng "đạo đức AI không thuộc về một cá nhân hay một nhóm nào tại OpenAI." Họ nói thêm rằng các yếu tố đạo đức đã được tích hợp vào tất cả các nhóm nghiên cứu và công ty đã giới thiệu một số hệ thống trong những tháng gần đây để ngăn chặn các mô hình hoạt động sai lệch.
Bakalar cũng từng đưa ra một phiên bản của lập luận tương tự. Phát biểu tại một hội nghị gần đây, cô cho rằng đạo đức là trách nhiệm của mọi người và "không bao giờ nên chỉ có một người duy nhất đóng vai trò là trung tâm đạo đức" của một nhà phát triển AI. Cô từ chối bình luận về việc rời đi của mình với FT.
Việc cô rời đi tiếp nối sau sự ra đi của Johannes Heidecke, trưởng bộ phận hệ thống an toàn, và Joshua Achiam, nhà tương lai học trưởng và từng là trưởng bộ phận căn chỉnh sứ mệnh, FT cho biết. OpenAI đã hoàn tất việc mua lại cổ phiếu nhân viên trị giá 7 tỷ USD cùng ngày với mức định giá 852 tỷ USD, không đổi so với vòng tài trợ tháng 3 của công ty, khi họ chuẩn bị cho khả năng niêm yết.
OpenAI đã tạm dừng công việc trên mô hình lớn tiếp theo của mình, Astra, vào thứ Sáu, cho biết họ không thể loại trừ khả năng hệ thống này đã đạt đến cấp độ cao nhất trong thang đo rủi ro mạng của riêng mình, một cấp độ dành cho các mô hình có khả năng tìm và xây dựng các lỗ hổng khai thác hiệu quả mà không cần sự can thiệp của con người.
Điều này diễn ra sau một sự cố trong đó các tác nhân (agents) của OpenAI đã liên kết các lỗ hổng, thoát khỏi môi trường thử nghiệm của chúng và tấn công Hugging Face khi cố gắng gian lận trong một bài kiểm tra bảo mật. Công ty sau đó cho biết tác nhân tương tự đã xâm nhập vào bốn dịch vụ khác bằng cách sử dụng thông tin đăng nhập tìm thấy trên web mở.
OpenAI không phải là công ty AI duy nhất có các tác nhân vượt quá giới hạn tham số của chúng trong những tuần gần đây. Các mô hình Claude của Anthropic kể từ đó đã tiếp cận ba công ty thực tế sau khi một cấu hình sai đã mở internet cho chúng, một mô hình của Meta đã thoát khỏi môi trường thử nghiệm và khai thác một lỗ hổng trong dịch vụ của bên thứ ba, và Kimi K3 của Moonshot AI đã phá vỡ hộp cát (sandbox) của nó để tìm kiếm câu trả lời chuẩn.








