AI của Anthropic xâm nhập hệ thống doanh nghiệp thật trong quá trình thử nghiệm
Không một bên nào, từ các công ty bị ảnh hưởng đến chính Anthropic, biết được các đợt xâm nhập này khi xảy ra. Các tên tuổi của doanh nghiệp bị tấn công chưa được tiết lộ.
Nguyên nhân và cách thức xâm nhập từ lỗi hiểu sai trong quá trình thử nghiệm
Khác với AI của OpenAI cố gắng thoát ra khỏi môi trường kiểm thử để truy cập Internet, AI của Anthropic được biết đã truy cập mạng một cách dễ dàng vì hiểu nhầm về giới hạn trong môi trường thử nghiệm. Dù theo kịch bản ban đầu, AI không được kết nối Internet, thực tế nó vẫn có thể truy cập bên ngoài thông qua một đối tác thực hiện thử nghiệm.
Kết quả là ba mô hình AI của Anthropic đã tận dụng được điều kiện này để tự truy cập mạng Internet trong lúc thử nghiệm. Đây là phát hiện mới được công bố trong một bài đăng trên blog của công ty.
Mô hình Claude Opus 4.7 tấn công nhầm công ty thật do trùng tên
Trong quá trình thử nghiệm, một trong các sự cố xảy ra do trùng tên công ty giả định với một công ty thật tồn tại trên mạng. Trong kịch bản, AI Claude Opus 4.7 phải tìm kiếm thông tin trên hệ thống giả tưởng, tuy nhiên sau nhiều lần khó khăn, nó nhận ra một công ty thật có cùng tên trên mạng Internet và tập trung tấn công vào hệ thống thật đó.







