Anthropic chặn nghiên cứu chikungunya và các nỗ lực vũ khí sinh học

Theo Indian Express và The National, Anthropic cho biết đã dừng nhiều nỗ lực trong năm nay của các nhà khoa học cố gắng dùng mô hình AI để hỗ trợ phát triển vũ khí sinh học. Một trường hợp vào tháng 5 liên quan đến chikungunya, virus lây qua muỗi gây đau dữ dội và sốt kéo dài hàng tháng. Công việc liên quan đến nghiên cứu tăng chức năng, nơi các nhà khoa học thay đổi sinh vật để nghiên cứu ảnh hưởng của thay đổi, có thể giúp tạo vắc xin nhưng cũng có thể làm virus nguy hiểm hơn nếu đột biến tăng tính lây truyền và thoát khỏi hệ miễn dịch, thử nghiệm bằng cách truyền lặp lại qua động vật sống.

Anthropic nói nhà khoa học muốn tạo đột biến làm tăng khả năng lây truyền và giúp thoát khỏi hệ miễn dịch, và vụ việc gây lo ngại hơn khi phát hiện dấu hiệu công việc dành cho cơ quan nghiên cứu quân sự. Công ty không nêu tên nhà khoa học, tổ chức, quốc gia hay tác nhân sinh học liên quan. Công ty cũng cho biết những người đứng sau các trường hợp nghiên cứu sinh học đã cố gắng che giấu mục đích thực sự để vượt qua kiểm tra an toàn, hướng dẫn mô hình giữ danh tính chất độc mơ hồ. Anthropic đã cấm các tài khoản liên quan.

Nga, Trung Quốc, Iran, Yemen và sáu trường hợp vũ khí thông thường

Theo Indian Express, báo cáo bao phủ tám tháng lạm dụng từ tháng 12 năm 2025 đến tháng 8 năm 2026. Công ty cũng phát hiện nỗ lực dùng mô hình để giúp chế tạo vũ khí thông thường, bao gồm mã liên quan đến súng, tên lửa, drone vũ trang và bom, với sáu trường hợp liên quan đến người dùng ở Trung Quốc, Nga và Yemen. Chi tiết trong báo cáo chỉ ra phong trào Houthi được Iran hậu thuẫn. Một trường hợp nhóm ở Yemen dùng Claude Code để phát triển phần mềm cho tên lửa đạn đạo, tên lửa dẫn đường, phương tiện lướt siêu thanh, sau khi thử tên lửa dẫn đường thất bại, nhóm quay lại Claude để chẩn đoán sự cố.

Anthropic cũng cho biết phát hiện hoạt động liên quan đến tác nhân nhà nước ở Trung Quốc và Iran, bao gồm nỗ lực theo dõi người bất đồng chính kiến và thành viên cộng đồng lưu vong. Trong trường hợp riêng, công ty nói truyền thông nhà nước Nga dùng Claude để tạo tài liệu trực tuyến trông như tin tức độc lập, bao gồm tuyên bố sai về bầu cử ở Moldova. Báo cáo bao phủ bảy lĩnh vực hại như hoạt động mạng, hoạt động ảnh hưởng, giám sát, lừa đảo, lạm dụng sinh học, phát triển vũ khí thông thường, theo Indian Express.

Cùng một thông tin có thể dùng để phát triển vũ khí sinh học cũng có thể dùng để phát triển vắc xin hay cách chữa bệnh

- Anthropic

Tại sao ranh giới y tế và vũ khí khó phân biệt

Anthropic nói không thể luôn biết liệu nghiên cứu có dành cho công việc vũ khí hay nghiên cứu y tế hợp pháp như phát triển vắc xin, vì cùng một thông tin có thể dùng để phát triển vũ khí sinh học hoặc để phát triển vắc xin hay cách chữa bệnh. Công ty nói đây là ranh giới khó trong sinh học, cùng một nghiên cứu có thể giúp người hoặc gây hại.

Advertisement300 × 250

Vì vậy Anthropic chọn hành động thận trọng và chặn hoạt động thay vì chờ chắc chắn, theo CNN và Fox Business.

Các thử nghiệm năm ngoái trên mô hình cũ như Claude Opus 4 và Claude Sonnet 4.5 cho thấy chúng không đủ khả năng hỗ trợ đáng kể người dùng tinh vi thực hiện nghiên cứu sinh học nguy hiểm, nên quy tắc an toàn nhẹ hơn. Nhưng mô hình mới hơn có thể xử lý nhiệm vụ khoa học phức tạp hơn nhiều, dẫn đến quy tắc chặt chẽ hơn bao phủ phạm vi rộng hơn các truy vấn liên quan đến sinh học có thể dùng cho mục đích tốt hoặc có hại. Không trường hợp nào liên quan đến mô hình mới nhất Claude Fable hay Mythos-class, ngoại trừ một trường hợp chưng cất bất hợp pháp.

Bối cảnh và những sự kiện liên quan trước bài viết

Báo cáo được công bố hai ngày sau khi nhà nghiên cứu Anthropic Jacob Coxon tuyên bố rời công ty. Coxon nói từ chức vì lo ngại Anthropic và đối thủ OpenAI đang tiến quá nhanh tới hệ thống AI tiên tiến cao. Ông nói một số đồng nghiệp hiện tin AI có thể gây nguy hiểm cho mạng sống con người trước cuối thập kỷ, theo Indian Express và Le Monde. Ngày hôm sau, Anthropic đưa ra báo cáo dài chi tiết cách mô hình Claude bị dùng cho mục đích xấu trong an ninh mạng, giám sát, lừa đảo và thậm chí vũ khí sinh học, và nói đã chặn các sáng kiến khi phát hiện.

Trước đó, các cuộc thảo luận về AIpocalypse đã nóng lên sau các sự cố. John Thickstun, trợ lý giáo sư khoa học máy tính tại Đại Học Cornell, nêu lo ngại theo AP rằng điều này đặt các công ty AI như Anthropic và OpenAI vào tình thế khó, khi họ phải tự quyết định điều gì an toàn hay không an toàn mà không có giám sát của chính phủ hay ý kiến công chúng. Anthropic nói trong mọi trường hợp, họ đã dừng hoạt động có hại, dùng bài học để tăng cường hệ thống an toàn và chia sẻ chi tiết với cơ quan chính phủ và đối tác ngành.

Góc nhìn tương lai: Hướng đến AI nhân văn và an toàn hơn

Báo cáo của Anthropic cho thấy khi mô hình AI ngày càng có khả năng, rủi ro cũng tăng trừ khi các công ty AI và nhóm làm việc về an toàn có bước giảm thiểu. Việc chặn nghiên cứu chikungunya cho thấy tầm quan trọng của hành động thận trọng khi không chắc chắn, ưu tiên bảo vệ mạng sống hơn chờ bằng chứng tuyệt đối. Nếu các công ty có thể chia sẻ bài học và tăng cường hệ thống an toàn, AI vẫn có thể là công cụ cho vắc xin và chữa bệnh thay vì vũ khí.

Tương lai nhân văn của AI sẽ cần không chỉ bộ lọc tự động mà cả sự tham gia của công chúng và giám sát của chính phủ để quyết định ranh giới an toàn. Khi Elena Casas giải thích trong video YouTube, câu hỏi không chỉ là Anthropic có thể ngăn chặn kẻ xấu dùng AI không, mà là xã hội có thể xây dựng cơ chế để AI phục vụ sức khỏe và hòa bình thay vì đe dọa sự sống hay không.

Những điều bổ ích rút ra từ bài viết

Cùng một nghiên cứu có thể cứu người hoặc hại người, lựa chọn thuộc về con người.

An toàn AI bắt đầu khi ta dám chặn ngay cả khi chưa chắc chắn.

Ranh giới giữa y tế và vũ khí cần sự thận trọng và minh bạch.

Chia sẻ bài học về lạm dụng là cách bảo vệ nhân loại chung.

Đăng ký bản tin QMVN