Từ Lhasa đến Hohhot: lời hứa tăng tốc
Hôm thứ Hai (5/10), một hội thảo tại Hohhot, thủ phủ khu tự trị Nội Mông ở miền bắc Trung Quốc, đã quy tụ đại diện các viện nghiên cứu, trường đại học và doanh nghiệp để bàn về tương lai của DeepZang. Theo cổng thông tin nhà nước Chinanews.com, các đại biểu tập trung vào hai hướng: nâng cao chất lượng công nghệ AI tiếng Tạng và mở rộng ứng dụng của mô hình sang phiên dịch đồng thời đa ngôn ngữ. Việc chọn Nội Mông làm nơi gặp gỡ cũng mang một hàm ý riêng: bài toán của tiếng Tạng không đơn độc, mà là bài toán chung của nhiều ngôn ngữ thiểu số tại Trung Quốc.
Phát biểu tại hội thảo, Tenzin Norbu, người sáng lập công ty Choknor và cha đẻ của DeepZang, cam kết sẽ liên tục hoàn thiện công nghệ và đưa chúng vào đời sống. Ông nhấn mạnh vai trò của đổi mới công nghệ trong việc “thúc đẩy giao lưu và hòa hợp giữa các dân tộc”, đồng thời hỗ trợ chuyển đổi số tại các vùng dân tộc thiểu số. Theo ông, AI cho các ngôn ngữ thiểu số khác cũng vướng cảnh khan hiếm dữ liệu, nên hợp tác xuyên vùng, xuyên ngôn ngữ là con đường tất yếu.
*“Sự ra đời của DeepZang có nghĩa là các ngôn ngữ dân tộc thiểu số giờ đây đã có tiếng nói riêng trong thời đại AI.” — Tenzin Norbu*
Bảy mươi triệu câu văn và ba phương ngữ
DeepZang được ra mắt ngày 15/3 tại Lhasa, sau hơn bốn năm phát triển. Theo Tân Hoa xã, mô hình đã tích lũy gần 70 triệu cặp câu song ngữ Tạng – Hán được chuẩn hóa và hơn 30.500 giờ dữ liệu giọng nói, bao trùm ba phương ngữ chính của tiếng Tạng. Đây cũng là mô hình tiếng Tạng đầu tiên hoàn tất thủ tục đăng ký quốc gia dành cho thuật toán AI tạo sinh tại Trung Quốc. Hiện nền tảng cung cấp các chức năng:
- Trò chuyện thông minh bằng tiếng Tạng, tiếng Trung và tiếng Anh.
- Dịch thuật theo thời gian thực giữa ba ngôn ngữ.
- Chuyển giọng nói thành văn bản, kể cả cho người không quen gõ chữ Tạng.
Đằng sau những con số là một thách thức lâu năm. Tiếng Tạng thuộc nhóm “ngôn ngữ ít tài nguyên”: cấu trúc chữ viết đặc thù, các phương ngữ khác biệt đến mức người vùng này đôi khi khó hiểu người vùng khác, còn kho văn bản số lại khan hiếm. Ông Dorje Migyur, phụ trách sản phẩm của DeepZang, cho biết việc huấn luyện trên dữ liệu giọng nói từ mọi vùng phương ngữ giúp mô hình bắc cầu giao tiếp giữa những người nói tiếng Tạng. Công ty cũng đã ký thỏa thuận hợp tác với các đơn vị khu vực của China Mobile và tập đoàn bảo hiểm PICC.
Cuộc tranh luận về danh hiệu “đầu tiên”
Truyền thông nhà nước Trung Quốc, trong đó có China Daily và Global Times, gọi DeepZang là mô hình ngôn ngữ lớn tiếng Tạng “đầu tiên trên thế giới”. Tuy vậy, khoảng ba năm trước đó, Monlam Tibetan IT Research Centre – một tổ chức phi lợi nhuận ở Dharamsala, Ấn Độ – đã giới thiệu Monlam AI, tích hợp dịch máy, nhận dạng ký tự quang học và công nghệ giọng nói cho cả tiếng Tạng cổ điển lẫn khẩu ngữ.
Trang tin Phayul của cộng đồng lưu vong dẫn ý kiến các nhà quan sát cho rằng tuyên bố “đầu tiên” phản ánh một câu chuyện mang màu sắc chính trị hơn là một cột mốc kỹ thuật.
Ngay cái tên cũng mang dấu ấn ấy. Chữ “Zang” trong DeepZang bắt nguồn từ “Xizang”, cách gọi Tây Tạng theo phiên âm tiếng Phổ thông mà từ năm 2023 Bắc Kinh thúc đẩy dùng thay cho “Tibet” trong các văn bản tiếng Anh. Hai mô hình, hai trung tâm – Lhasa và Dharamsala – vì thế trở thành hai cách kể khác nhau về cùng một ngôn ngữ.
Khi dữ liệu trở thành tiếng nói
Theo South China Morning Post, Tây Tạng vẫn là ưu tiên hàng đầu của Bắc Kinh trong công tác dân tộc và tôn giáo, và Trung Quốc đã đầu tư mạnh cho ngành Tạng học trong nước nhằm giành lại quyền dẫn dắt diễn ngôn quốc tế. DeepZang được xem là một phần của nỗ lực định hình lại câu chuyện toàn cầu về Tây Tạng bằng dữ liệu và công nghệ của chính mình. Tháng 3 vừa qua, Trung Quốc còn thông qua Luật Thúc đẩy Đoàn kết và Tiến bộ Dân tộc, có hiệu lực từ tháng 7; giới phê bình cho rằng luật này đặt nền móng pháp lý cho quá trình đồng hóa các nhóm thiểu số, trong khi Bắc Kinh bác bỏ mọi cáo buộc vi phạm nhân quyền.
Một số nhà phân tích phương Tây, dựa trên báo cáo tháng 12/2025 của Australian Strategic Policy Institute (ASPI) về việc Trung Quốc dùng AI để kiểm duyệt và giám sát, lưu ý rằng mọi mô hình AI tạo sinh đăng ký tại Trung Quốc đều phải tuân theo các quy định về nội dung của nhà nước. Lãnh đạo doanh nghiệp phát triển DeepZang từng nói muốn mang đến cho người dùng toàn cầu một nền tảng “chân thực” để tìm hiểu văn hóa, lịch sử và chính trị Tây Tạng, ngăn chặn sự lan truyền của “những tư tưởng bị bóp méo”. Với người ủng hộ, đó là bảo vệ di sản; với người hoài nghi, đó là kiểm soát câu chuyện.
Giữa kỳ vọng và giới hạn
Ở góc độ đời sống, lợi ích là có thật. Sonam Yontan, nghiên cứu sinh tiến sĩ tại Đại học Xizang, nói với China Daily rằng mô hình giúp anh xử lý tài liệu và tìm nguồn nhanh hơn nhiều. Với người chăn nuôi trên cao nguyên hay người cao tuổi không quen bàn phím, chỉ cần cất lời là có thể dùng AI. Dù vậy, không phải ai cũng hoàn toàn hài lòng.
*“Khả năng tiếng Tạng của DeepZang rõ ràng là mạnh, nhưng tốc độ phản hồi có vẻ chậm hơn một số sản phẩm phổ biến như ChatGPT hay Doubao.” — Nie Chang*
Theo kế hoạch, DeepZang sẽ được đưa vào dịch vụ công, giáo dục, y tế và quản trị địa phương, đồng thời góp phần “số hóa việc trao truyền văn hóa truyền thống Tây Tạng”. Câu hỏi lớn nhất có lẽ không nằm ở thuật toán mà ở chính sách bao quanh nó: năm 2023, các chuyên gia nhân quyền Liên Hợp Quốc từng bày tỏ lo ngại về hệ thống trường nội trú mà họ cho là khiến khoảng một triệu trẻ em Tây Tạng xa rời tiếng mẹ đẻ. Một cỗ máy biết nói tiếng Tạng chỉ thực sự có ý nghĩa khi những đứa trẻ vẫn còn được nói tiếng Tạng.

















