Một đơn kiện mới tại Manhattan
Ngày 8/10, USA Today Co và một số ấn phẩm báo chí do tập đoàn sở hữu nộp đơn lên Tòa án Quận Liên bang khu vực Nam New York. Theo tường thuật của Reuters, bên nguyên đơn cho rằng OpenAI đã sử dụng khối lượng lớn tác phẩm báo chí của họ để xây dựng và huấn luyện mô hình ngôn ngữ. Phạm vi được cáo buộc lên đến hàng trăm nghìn bài viết và tài liệu khác.
Điểm đáng chú ý không chỉ là con số bồi thường hơn 250 triệu USD. USA Today còn đề nghị tòa áp dụng biện pháp ngăn chặn đối với hành vi mà họ cáo buộc tiếp tục xâm phạm. Đây là hai loại yêu cầu khác nhau: bồi thường hướng tới thiệt hại đã xảy ra, còn lệnh cấm có thể tác động đến hoạt động sử dụng dữ liệu trong tương lai. Chưa có phán quyết xác nhận thiệt hại hoặc trách nhiệm của bị đơn.
Ranh giới giữa học từ dữ liệu và sao chép
Theo luật bản quyền Mỹ, việc một tác phẩm được công khai trên internet không mặc nhiên đồng nghĩa người khác có thể sao chép không giới hạn. Các nhà xuất bản cho rằng việc khai thác bài báo mà không có giấy phép làm suy giảm quyền kiểm soát và giá trị thương mại của hoạt động báo chí, nhất là khi chatbot ngày càng có thể trả lời trực tiếp những câu hỏi mà độc giả trước đây phải tìm đến trang tin.
Ở hướng ngược lại, các công ty AI trong nhiều vụ kiện đã viện dẫn học thuyết “fair use”, thường gọi là sử dụng hợp lý: hệ thống chuyển tài liệu thành mô hình học các mẫu ngôn ngữ thay vì đơn thuần cung cấp bản sao của từng tác phẩm. Đánh giá pháp lý tùy thuộc mục đích, bản chất tài liệu, lượng sử dụng và tác động đến thị trường của tác phẩm gốc. Không thể kết luận cả ngành công nghiệp AI hợp pháp hay bất hợp pháp chỉ từ việc khởi kiện.
Lợi ích báo chí và công nghệ đều đang được thử thách
Báo chí chuyên nghiệp phải chi phí cho phóng viên, xác minh thông tin, luật sư và biên tập. Khi nguồn thu từ độc giả hoặc quảng cáo suy yếu, tranh chấp tiền bản quyền có thể trở thành vấn đề tồn tại lâu dài của các tòa soạn. Một cơ chế cấp phép minh bạch có thể mở thêm nguồn thu, nhưng đồng thời đặt ra câu hỏi liệu doanh nghiệp nhỏ và tổ chức nghiên cứu có đủ khả năng tiếp cận dữ liệu hay không.
Với nhà phát triển mô hình, bất định pháp lý có thể làm gia tăng chi phí lưu trữ, cấp phép, kiểm toán dữ liệu và phòng ngừa rủi ro. Những hợp đồng tự nguyện giữa nhà xuất bản và công ty công nghệ là một lựa chọn thương mại, song không tự động giải quyết mọi trường hợp dữ liệu đã được dùng trong quá khứ. Người sử dụng cuối cùng cũng có lợi ích trong việc nhận thông tin đáng tin cậy và biết khi nào câu trả lời dựa trên nguồn báo chí.
Phán quyết sau này có thể định hình chuẩn mực
Vụ kiện cần trải qua các giai đoạn tranh tụng, trao đổi tài liệu và đánh giá chứng cứ trước khi tòa đưa ra kết luận hoặc các bên thỏa thuận. Một yếu tố then chốt sẽ là cách nguyên đơn chứng minh hành vi sao chép, mối liên hệ với từng tác phẩm và thiệt hại có thể tính toán. Bị đơn có cơ hội bác bỏ các cáo buộc và trình bày các biện hộ phù hợp.
Những tranh chấp đang diễn ra, bao gồm vụ The New York Times kiện OpenAI và Microsoft, cho thấy câu hỏi chưa có lời đáp đơn giản. Kết quả của từng vụ kiện có thể khác nhau theo chứng cứ, sản phẩm và yêu cầu cụ thể. Đối với công chúng, điều quan trọng nhất không chỉ là ai thắng kiện mà còn là hệ sinh thái thông tin có duy trì được báo chí chất lượng trong khi công nghệ AI tiếp tục đổi mới hay không.















