Description
Bài tham luận tiếp cận vấn đề từ hai trụ cột lý luận cốt lõi: Chủ quyền dữ liệu ngôn ngữ (Indigenous Data Sovereignty) và Trách nhiệm xã hội (Social Responsibility). Thông qua việc phân tích thực trạng thiên lệch nguồn (Source Bias), hiện tượng "Tây hóa" ngữ nghĩa và cuộc khủng hoảng khuyết thiếu dữ liệu chuỗi của các ngôn ngữ DTTS, bài viết làm rõ các nghĩa vụ đạo đức của nhà khoa học, chuyên gia công nghệ và cơ quan quản lý. Từ đó, tác giả đề xuất hệ giải pháp chiến lược liên ngành nhằm đưa ngôn ngữ dân tộc tích hợp an toàn, bình đẳng và hiệu quả vào môi trường AI tạo sinh, bao gồm: Xây dựng kho ngữ liệu số hóa chuẩn hóa và mở tuân thủ bộ nguyên tắc CARE và quy trình FPIC; Ứng dụng các mô hình ngôn ngữ quy mô nhỏ (SLMs) kết hợp kĩ thuật Truy xuất tăng cường ngữ cảnh; Hoàn thiện hành lang pháp lý bảo hộ chủ quyền dữ liệu và bản quyền tri thức bản địa trên không gian số.
Thông tin các tác giả
Phạm Thị Xuân Nga: TS, đang công tác tại Chi nhánh Viện Khoa học xã hội vùng Trung Bộ và Tây Nguyên, 1A Nguyễn Văn Linh, phường Tân An, tỉnh Đắk Lắk, email: xuanngapham1982@gmail.com
Từ khóa
AI tạo sinh, Chủ quyền dữ liệu ngôn ngữ, Ngôn ngữ dân tộc thiểu số, Trách nhiệm xã hội, Đạo đức AI, Bảo tồn văn hóa.