OpenAI sắp gắn watermark cho văn bản ChatGPT
OpenAI chuẩn bị áp dụng công nghệ nhận diện mới với văn bản AI trong bối cảnh EU siết quy định minh bạch nội dung.
OpenAI sẽ bắt đầu bổ sung watermark vô hình vào văn bản được tạo bởi ChatGPT và Codex tại Liên minh châu Âu (EU) nhằm tuân thủ Đạo luật AI của EU. Các quy định về tính minh bạch trong Đạo luật AI của EU có hiệu lực từ ngày 2/8, yêu cầu các công ty AI đánh dấu nội dung do AI tạo ra theo cách để những hệ thống khác có thể nhận diện.
OpenAI cho biết watermark sẽ được triển khai trong những tuần tới đối với người dùng ChatGPT và Codex đủ điều kiện trên tất cả các gói dịch vụ tại EU. Trong khi đó, các nhà phát triển sử dụng API của OpenAI ở bất kỳ đâu trên thế giới có thể bật tính năng này cho một số mô hình được lựa chọn từ hôm nay. Tính năng hiện được tắt theo mặc định và OpenAI chưa có kế hoạch thiết lập watermark văn bản thành tiêu chuẩn mặc định trên toàn cầu ngay khi ra mắt.

OpenAI chuẩn bị áp dụng công nghệ nhận diện mới với văn bản AI trong bối cảnh EU siết quy định minh bạch nội dung.
Watermark không xuất hiện dưới dạng một ký hiệu cụ thể. Thay vào đó, công nghệ này tác động tinh tế đến cách mô hình lựa chọn từ ngữ, tạo ra một mẫu mà người đọc không thể nhìn thấy nhưng hệ thống phát hiện có thể nhận diện.
Do dấu hiệu được tích hợp trực tiếp vào các từ trong văn bản, watermark vẫn được giữ lại khi nội dung được sao chép và dán. OpenAI cho biết phương thức này không xác định danh tính người dùng. Công ty cũng không nhận thấy sự thay đổi đáng kể về hiệu suất của các mô hình khi bật watermark.
Cùng với thông báo, OpenAI công bố báo cáo kỹ thuật về phương pháp có tên textGrain. Báo cáo được thực hiện với sự tham gia của các nhà nghiên cứu đến từ Đại học Pennsylvania và Đại học Yale, trong đó trình bày cách sử dụng một khóa bí mật để sắp xếp các dự đoán về từ tiếp theo nhằm hoàn thành câu.
Khi hàng trăm điều chỉnh như vậy được kết hợp, hệ thống phát hiện có thể xác định văn bản do AI tạo ra dựa trên chính nội dung và khóa bí mật.
Tuy nhiên, công nghệ này không hoàn toàn chống lại được việc chỉnh sửa. Các thử nghiệm của OpenAI cho thấy watermark có thể bị suy yếu khi văn bản được thay đổi. Trong một thử nghiệm, việc thay thế 10% số từ bằng từ đồng nghĩa khiến tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%.
OpenAI cũng cho biết những đoạn văn ngắn, câu trả lời toán học và văn bản được dịch là những dạng nội dung khó phát hiện hơn.
"Những hạn chế này góp phần vào quyết định của chúng tôi về việc ban đầu chỉ cung cấp quyền truy cập vào hệ thống phát hiện cho các nhà nghiên cứu được phê duyệt và các tổ chức chuyên môn, những bên có thể giúp chúng tôi đánh giá độ tin cậy và cách sử dụng có trách nhiệm", công ty cho biết.
OpenAI đồng thời lưu ý rằng việc không phát hiện được watermark không chứng minh văn bản do con người viết. Nội dung có thể quá ngắn, đã bị chỉnh sửa quá nhiều hoặc được tạo bởi hệ thống AI của một công ty khác.
"Watermark có thể cho thấy một hệ thống của OpenAI đã tạo ra hoặc xử lý một phần của đoạn văn, nhưng không cho biết mức độ phán đoán, chỉnh sửa hay sáng tạo của con người đã được đưa vào đó", công ty cho biết.
Động thái của OpenAI được đưa ra hai tháng sau khi Anthropic thông báo kế hoạch gắn watermark cho văn bản do Claude tạo ra trên phạm vi toàn cầu. Quyết định này từng vấp phải phản ứng từ một bộ phận người dùng Claude, những người cho rằng họ mới là bên cung cấp "hướng dẫn, bối cảnh, quyết định", trong khi Claude chỉ đóng vai trò công cụ.



