OpenAI bắt đầu thử nghiệm công nghệ watermark vô hình mang tên textGrain nhằm nhận diện văn bản do AI tạo ra để đáp ứng quy định của EU. Đây là bước tiến về minh bạch nội dung nhưng vẫn tồn tại nhiều hạn chế kỹ thuật trong việc phát hiện văn bản đã qua chỉnh sửa.

Trong bối cảnh trí tuệ nhân tạo (AI) bùng nổ, việc phân biệt giữa nội dung do con người sáng tạo và văn bản do máy tính tạo ra trở thành thách thức lớn. OpenAI vừa chính thức triển khai thử nghiệm công nghệ watermark vô hình (dấu ấn bản quyền ẩn) mang tên textGrain cho người dùng ChatGPT và Codex tại Liên minh châu Âu (EU). Khác với các loại nhãn dán thông thường, textGrain được nhúng trực tiếp vào quy luật thống kê khi mô hình lựa chọn từ ngữ, khiến mắt thường hoàn toàn không thể nhận diện được bất kỳ biểu ngữ hay dấu vết nào.
Động thái này xuất phát từ yêu cầu khắt khe của Đạo luật Trí tuệ nhân tạo (EU AI Act), đòi hỏi các nhà phát triển công nghệ phải đảm bảo sự minh bạch trong nội dung số. Việc áp dụng các dấu ấn ẩn giúp các tổ chức có cơ sở để kiểm soát và truy xuất nguồn gốc nội dung do AI tạo ra. Bên cạnh OpenAI, các tập đoàn công nghệ lớn khác như Google DeepMind (với công nghệ SynthID) và Anthropic (cho mô hình Claude) cũng đã và đang tích cực triển khai các giải pháp tương tự để thiết lập tiêu chuẩn an toàn cho thị trường.
Dựa trên các thử nghiệm ban đầu, khả năng phát hiện của textGrain phụ thuộc rất nhiều vào độ dài của văn bản:
Tuy nhiên, hiệu suất này giảm mạnh khi văn bản bị can thiệp bởi con người. Nếu người dùng thay thế 10% từ ngữ bằng các từ đồng nghĩa, khả năng nhận diện giảm xuống còn 66%. Khi mức độ chỉnh sửa đạt 25%, công cụ chỉ còn khả năng phát hiện khoảng 17%. Điều này cho thấy textGrain vẫn còn nhiều lỗ hổng trước các phương pháp chỉnh sửa văn bản đơn giản.
OpenAI đã đưa ra thông điệp rõ ràng: textGrain không phải là bằng chứng tuyệt đối để khẳng định quyền tác giả hay độ chính xác của nội dung. Công nghệ này không thể xác minh ai là người thực sự tạo ra văn bản hay đánh giá mức độ can thiệp của con người. Do đó, các giáo viên, nhà tuyển dụng và nhà xuất bản cần lưu ý:
Tóm lại, textGrain là một bước tiến quan trọng trong việc tăng cường trách nhiệm giải trình của AI, nhưng nó chỉ đóng vai trò như một "nhân chứng" hỗ trợ thay vì là một bằng chứng quyết định trong việc định danh nội dung số.
CÔNG TY TNHH THƯƠNG MẠI DỊCH VỤ HỢP THÀNH THỊNH
Showroom: 406/55 Cộng Hòa, Phường Tân Bình, Thành phố Hồ Chí Minh, Việt Nam.
Giấy CN đăng ký kinh doanh và mã số thuế: 0310583337 do sở Kế hoạch & Đầu tư thành phố Hồ Chí Minh cấp.

Trong bối cảnh trí tuệ nhân tạo (AI) bùng nổ, việc phân biệt giữa nội dung do con người sáng tạo và văn bản do máy tính tạo ra trở thành thách thức lớn. OpenAI vừa chính thức triển khai thử nghiệm công nghệ watermark vô hình (dấu ấn bản quyền ẩn) mang tên textGrain cho người dùng ChatGPT và Codex tại Liên minh châu Âu (EU). Khác với các loại nhãn dán thông thường, textGrain được nhúng trực tiếp vào quy luật thống kê khi mô hình lựa chọn từ ngữ, khiến mắt thường hoàn toàn không thể nhận diện được bất kỳ biểu ngữ hay dấu vết nào.
Động thái này xuất phát từ yêu cầu khắt khe của Đạo luật Trí tuệ nhân tạo (EU AI Act), đòi hỏi các nhà phát triển công nghệ phải đảm bảo sự minh bạch trong nội dung số. Việc áp dụng các dấu ấn ẩn giúp các tổ chức có cơ sở để kiểm soát và truy xuất nguồn gốc nội dung do AI tạo ra. Bên cạnh OpenAI, các tập đoàn công nghệ lớn khác như Google DeepMind (với công nghệ SynthID) và Anthropic (cho mô hình Claude) cũng đã và đang tích cực triển khai các giải pháp tương tự để thiết lập tiêu chuẩn an toàn cho thị trường.
Dựa trên các thử nghiệm ban đầu, khả năng phát hiện của textGrain phụ thuộc rất nhiều vào độ dài của văn bản:
Tuy nhiên, hiệu suất này giảm mạnh khi văn bản bị can thiệp bởi con người. Nếu người dùng thay thế 10% từ ngữ bằng các từ đồng nghĩa, khả năng nhận diện giảm xuống còn 66%. Khi mức độ chỉnh sửa đạt 25%, công cụ chỉ còn khả năng phát hiện khoảng 17%. Điều này cho thấy textGrain vẫn còn nhiều lỗ hổng trước các phương pháp chỉnh sửa văn bản đơn giản.
OpenAI đã đưa ra thông điệp rõ ràng: textGrain không phải là bằng chứng tuyệt đối để khẳng định quyền tác giả hay độ chính xác của nội dung. Công nghệ này không thể xác minh ai là người thực sự tạo ra văn bản hay đánh giá mức độ can thiệp của con người. Do đó, các giáo viên, nhà tuyển dụng và nhà xuất bản cần lưu ý:
Tóm lại, textGrain là một bước tiến quan trọng trong việc tăng cường trách nhiệm giải trình của AI, nhưng nó chỉ đóng vai trò như một "nhân chứng" hỗ trợ thay vì là một bằng chứng quyết định trong việc định danh nội dung số.