Con số 90% cần được hiểu đúng
Nghiên cứu Large-scale online deanonymization with LLMs của Simon Lermen, Daniel Paleka, Joshua Swanson, Michael Aerni, Nicholas Carlini và Florian Tramèr được trình bày tại USENIX Security 2026. Nhóm sử dụng dữ liệu có danh tính đã biết để đánh giá, thay vì tùy tiện truy tìm người ẩn danh thật. Họ chọn 338 tài khoản Hacker News từng công khai liên kết LinkedIn, loại bỏ dấu hiệu nhận dạng trực tiếp rồi kiểm tra khả năng tìm lại danh tính.
Theo The Wall Street Journal, hệ thống dự đoán 252 tài khoản và đúng khoảng 90%. Bản nghiên cứu ghi nhận 226 trường hợp đúng, 25 trường hợp sai và 86 lần không trả lời. Hai thước đo này không thể thay thế nhau, bởi hệ thống có thể bỏ qua những trường hợp khó.
Các tác giả lưu ý dữ liệu thử nghiệm vốn có liên kết danh tính công khai, nên có thể dễ nhận diện hơn tài khoản thực sự được giữ bí mật. Kết quả phụ thuộc vào lượng thông tin, phạm vi tìm kiếm và tập hợp ứng viên. Nghiên cứu chứng minh nguy cơ thực tế, không đưa ra xác suất áp dụng đồng đều cho mọi người.
Tôi không nghĩ ẩn danh đã chết.

















