Xuất hiện đặc trưng trong văn phong AI hiện đại

Nếu Julius Caesar ra mắt năm nay, nhiều người có thể nghi ngờ William Shakespeare đã sử dụng công nghệ AI để viết kịch bản. Những câu nổi tiếng trong vở kịch như “The fault, dear Brutus, is not in our stars, but in ourselves” hay “Not that I loved Caesar less, but that I loved Rome more” đều chứa một cách diễn đạt ngày càng phổ biến trong văn bản do AI tạo ra: cấu trúc “Không phải X mà là Y”.

Advertisement300 × 250

Câu này đồng thời nói lên điều mà chủ thể không phải và điều mà chủ thể thực sự là, tạo nên phong cách viết đặc trưng, dễ nhận biết của các chatbot hiện đại như ChatGPT, Claude hay Gemini.

Cấu trúc này có nhiều biến thể, một số bổ sung, mở rộng nghĩa cho phần Y so với X như báo cáo thường niên của Citizens Financial Group về sự phát triển của bộ phận ngân hàng tư nhân: “Không chỉ là thành công của ngân hàng tư nhân mà còn là thành công của toàn doanh nghiệp”. Biến thể khác thì thay thế phần X bằng Y như Michael Flynn, cố vấn của Donald Trump, viết: “Mục tiêu không phải là người mà là sự thật”. Trong văn học, kiểu câu này xuất hiện trong sách kinh dị Shy Girl với câu “Không có túi, không có vật dụng, không có áo giáp, chỉ có tôi”, góp phần khiến nhiều nghi ngờ sách do AI viết.

Phổ biến trong giao tiếp doanh nghiệp và nghiên cứu AI

Đây không phải hiện tượng đơn lẻ mà có thể đo đếm được. Theo Barron’s, tần suất xuất hiện câu cấu trúc này trong các văn bản doanh nghiệp đã tăng hơn gấp bốn lần từ năm 2023 đến năm 2025. Công ty Pangram, sở hữu công cụ phát hiện văn bản AI, cho biết tỷ lệ câu “Không phải X mà là Y” xuất hiện trong văn bản do AI tạo ra cao gấp ba lần so với văn bản do con người viết. Elyas Masrour, kỹ sư sáng lập Pangram, xác nhận rằng tất cả các chatbot lớn như ChatGPT, Claude và Gemini đều sử dụng cấu trúc này với mức độ khác nhau.

Nguyên nhân và thách thức khi tìm cách khắc phục

Nguyên nhân gây ra sự phổ biến khó chịu này vẫn chưa được xác định rõ ràng. Một giả thuyết đơn giản cho rằng AI được đào tạo trên lượng lớn văn bản con người, trong đó cấu trúc “Không phải X mà là Y” vốn có từ trước như trong câu nói nổi tiếng của huấn luyện viên bóng đá Vince Lombardi hay quảng cáo thương hiệu pizza DiGiorno. Tuy nhiên, quá trình học hỏi còn bao gồm sự đánh giá, hướng dẫn từ người kiểm duyệt giúp chatbot hạn chế phản hồi không phù hợp, trong đó câu này có thể được đánh giá cao vì tạo cảm giác sâu sắc và logic.

Thuyết khác giải thích rằng vì chatbot hoạt động dựa trên dự đoán từ ngữ tiếp theo để tạo ra câu trả lời, nên cấu trúc “Không phải X mà là Y” là lối mòn an toàn và dễ vận dụng trong việc diễn đạt. Khi bắt đầu một câu với phần khẳng định, việc đầu tiên nói điều không phải (X) rồi mới nêu điều đúng (Y) vừa hợp lý vừa phổ biến trong dữ liệu huấn luyện. Điều này khiến các chatbot dễ dàng sản sinh cách diễn đạt lặp lại này một cách liên tục.

Tác động và tương lai của văn phong AI

Việc loại bỏ hoàn toàn cấu trúc này khỏi các nền tảng AI là rất khó khi chính văn bản do AI tạo ra lại trở thành một phần dữ liệu huấn luyện cho các mô hình kế tiếp, tạo ra vòng luẩn quẩn “ngôn ngữ AI ăn thịt chính mình”. Việc sử dụng AI trong quá trình đánh giá sau đào tạo cũng có thể làm tăng nguy cơ “sụp đổ mô hình”, khi thuật toán ngày càng thiên lệch về các biểu hiện đặc trưng đã có sẵn.

Dù vậy, những dấu hiệu như câu “Không phải X mà là Y” lại giúp phân biệt văn bản AI với văn bản do con người tạo ra. Tuy nhiên, nghiên cứu gần đây tại Đức cho thấy thói quen nói và viết sử dụng cấu trúc đặc trưng AI đang dần lan sang ngôn ngữ giao tiếp của con người, khiến giới chuyên gia nhận định chúng ta có thể sớm đối diện với một thực tế văn phong giao tiếp pha trộn giữa nhân tạo và tự nhiên.

Phải chăng, lỗi không nằm ở chatbot, mà thực chất chính là ở chính chúng ta trong cách tiếp nhận và ứng xử với công nghệ?

Key takeaways from this article

Cấu trúc câu “Không phải X mà là Y” là gì?
Đây là câu cấu trúc gọi là negative parallelism, dùng để nhấn mạnh một điều không phải đồng thời chỉ ra điều chính xác hơn.
Tại sao AI thường sử dụng cấu trúc “Không phải X mà là Y”?
AI dùng cấu trúc này do được đào tạo trên cùng dữ liệu văn bản có nhiều câu kiểu này và vì nó tạo cảm giác luận lý sâu sắc.
Cấu trúc này có xuất hiện trong văn bản của các chatbot lớn không?
Có, các chatbot như ChatGPT, Claude, và Gemini đều sử dụng phổ biến câu loại này.
Việc lặp lại cấu trúc này có ảnh hưởng gì đến văn phong AI?
Nó làm văn phong AI trở nên lặp lại và dễ nhận biết, nhưng cũng giúp phân biệt được văn bản do AI tạo ra.

Đăng ký bản tin QMVN