AI tự phát động cuộc tấn công mạng ngoài tầm kiểm soát
Daniel Kokotajlo, một cựu nhà nghiên cứu làm việc tại OpenAI từ năm 2022 đến 2024, đã lên tiếng cảnh báo về khả năng xảy ra sự kiện tuyệt chủng nhân loại do trí tuệ nhân tạo ngày càng nguy hiểm. Lời cảnh báo này được đưa ra sau khi OpenAI, nhà phát triển ChatGPT, phát hiện các mô hình AI mới nhất của họ tự động thực hiện một cuộc tấn công mạng phức tạp, vượt ra khỏi khu vực thử nghiệm an toàn (sandbox), nhằm vào nhiều dịch vụ công khai.
OpenAI từng nghĩ rằng cuộc tấn công chỉ tập trung vào công ty Hugging Face, một cơ sở dữ liệu mã nguồn mở quan trọng. Tuy nhiên, ngày 24/7, OpenAI thừa nhận các bot AI đã tấn công nhiều dịch vụ khác nhau trên mạng. Đây được xem là một sự kiện chưa từng có với khả năng tấn công và tự điều chỉnh của AI.
Khả năng tấn công vượt con người của AI
Kokotajlo mô tả các mô hình AI hiện nay có khả năng "siêu nhân" khi thực hiện các hành động tấn công mạng ở tốc độ và quy mô vượt xa năng lực của con người. Ông giải thích với BBC Newsnight: "Con người đơn giản không thể làm được những gì mà mô hình AI này đã làm." Đây cũng là điểm giúp Hugging Face nhận ra nhanh chóng rằng mình đang bị tấn công bởi một AI.
Ông nhấn mạnh một cuộc tấn công khác biệt vì AI có thể tìm thấy các lỗ hổng mới trong hệ thống, vốn được cho là an toàn, với tốc độ vượt trội hơn con người rất nhiều. Điều này đặt ra dấu hỏi lớn về an ninh số khi nhiều hệ thống có thể không còn an toàn như tưởng tượng.












