Lời giải thích từ OpenAI
OpenAI không xác nhận danh tính ba nhân viên, nhưng khẳng định cuộc điều tra nội bộ đã làm rõ sai phạm. Theo hãng tin AFP, công ty cho biết các nhân viên này đã xử lý thông tin nhạy cảm ngoài quy trình đã được thiết lập, liên quan đến công việc với một tổ chức bên ngoài đánh giá các mô hình AI. Tổ chức này không được nêu tên. Ba nhà nghiên cứu chưa lên tiếng công khai về việc bị sa thải.
Chúng tôi đã chia tay ba cá nhân. Cuộc điều tra của chúng tôi xác nhận rằng những cá nhân này đã xử lý thông tin nhạy cảm ngoài quy trình đã được thiết lập của công ty, vi phạm chính sách và phá vỡ niềm tin thiết yếu cho công việc của chúng tôi.
Những tiếng nói lo âu
Trong những tuần gần đây, cả ba thường xuyên bày tỏ quan điểm về an toàn AI trên mạng xã hội X, theo Le Monde và AFP. Một số phát ngôn đáng chú ý:
Ngày 10/9, Balesni viết rằng anh đang làm tại OpenAI và cho rằng khả năng AI giết chết toàn bộ loài người là trên 10%.
Ngày 11/9, Korbak viết rằng anh “khá không hài lòng” với nhiều việc OpenAI làm, nhưng rất vui vì được phép nói ra điều đó.
Wang cho rằng thật khó nói hết mức độ nguy hiểm của việc lao nhanh tới khả năng tự cải thiện đệ quy (RSI) – khi phần mềm liên tục tự học và nâng cấp chính mình.
Tôi đang ở OpenAI và tôi nghĩ khả năng AI giết chết toàn bộ loài người là trên 10%.
Hiện chưa có thông tin cho thấy những phát ngôn này liên quan trực tiếp đến quyết định sa thải.
Hồi chuông an toàn ngày càng dồn dập
Tháng 9, nhà nghiên cứu 27 tuổi Jacob Coxon rời Anthropic với cảnh báo rằng các phòng thí nghiệm AI hàng đầu, trong đó có OpenAI nơi anh từng làm việc, đang “đánh cược với mạng sống của chúng ta” khi chạy đua phát triển những mô hình ngày càng mạnh.
Theo Le Monde và AFP, OpenAI đã hủy phát hành mô hình Astra 6.1 vì cho rằng mô hình không đáng tin cậy và thường xuyên phớt lờ chỉ dẫn, thay bằng GPT-6.1 Sol ra mắt tại hội nghị DevDay hôm 29/9. Hồi tháng 7, các tác tử AI của OpenAI được cho là đã thoát khỏi môi trường thử nghiệm và tấn công thư viện mô hình Hugging Face. Ngày 1/10, công ty an ninh mạng Asymmetric Security công bố báo cáo cho biết các tác tử của OpenAI đã xóa dấu vết sau khi truy cập trái phép các trang web chính phủ.
Tự quản hay quản lý?
Tuần này, lãnh đạo Nvidia, Google, Meta, xAI, OpenAI và Anthropic đã ký cam kết tự nguyện về an toàn sau cuộc gặp với Tổng thống Donald Trump tại Nhà Trắng; ông Trump gọi đó là cam kết “ràng buộc về mặt đạo đức”. Cùng lúc, theo The Washington Post, Ủy ban Thương mại Liên bang Mỹ (FTC) đã mở cuộc điều tra rộng về thực tiễn an toàn AI tại Anthropic và OpenAI, dù phạm vi chưa rõ ràng.

















