OpenAI sẽ bắt đầu thêm hình mờ vô hình vào văn bản do ChatGPT và Codex ở Liên minh Châu Âu tạo ra để tuân thủ Đạo luật AI của EU, công ty cho biết hôm thứ Hai trong một bài đăng trên blog.
Các quy tắc minh bạch của Đạo luật AI của EU, có hiệu lực từ ngày 2 tháng 8, yêu cầu các công ty AI phải đánh dấu nội dung do AI tạo ra theo cách mà các hệ thống khác có thể xác định.
OpenAI cho biết hình mờ sẽ được tung ra trong vài tuần tới cho người dùng ChatGPT và Codex đủ điều kiện trên tất cả các gói, nhưng chỉ ở EU. Các nhà phát triển sử dụng API của OpenAI ở mọi nơi trên thế giới có thể bật API này cho một số kiểu máy được chọn bắt đầu từ hôm nay; nó bị tắt theo mặc định. OpenAI cho biết họ không đặt hình mờ văn bản thành mặc định toàn cầu khi ra mắt.
Hình mờ không phải là một biểu tượng thực tế mà hoạt động bằng cách định hình một cách tinh tế các lựa chọn từ của mô hình, để lại một mẫu mà người đọc không thể nhìn thấy nhưng máy dò có thể nhận ra. Bởi vì nó tồn tại trong chính các từ nên nó sẽ di chuyển cùng với văn bản khi được sao chép và dán. OpenAI cho biết hình mờ không nhận dạng được người dùng và họ không thấy có thay đổi đáng kể nào về hiệu suất của mô hình khi bật.
OpenAI cũng đã xuất bản một báo cáo kỹ thuật cho phương pháp của mình, được gọi là textGrain, cùng với thông báo. Được đồng sáng tác với các nhà nghiên cứu từ Đại học Pennsylvania và Yale, nó trình bày một ví dụ về cách sử dụng khóa bí mật để sắp xếp các dự đoán từ tiếp theo để hoàn thành câu. Cộng hàng trăm cú huých này lại với nhau và trình phát hiện có thể phát hiện nội dung do AI tạo ra chỉ bằng văn bản và khóa.
Hình mờ có thể được loại bỏ bằng cách chỉnh sửa? Các thử nghiệm của OpenAI cho thấy có. Trong một thử nghiệm, việc thay thế 10% từ bằng từ đồng nghĩa đã làm giảm khả năng phát hiện từ khoảng 92% xuống 66%. Công ty cũng cho biết những đoạn văn ngắn, câu trả lời toán và văn bản dịch khó bị phát hiện hơn.

Công ty cho biết: “Những hạn chế này góp phần khiến chúng tôi quyết định chỉ cung cấp quyền truy cập máy dò ban đầu cho các nhà nghiên cứu và tổ chức chuyên gia đã được phê duyệt, những người có thể giúp chúng tôi đánh giá độ tin cậy và cách sử dụng có trách nhiệm”.
OpenAI cũng cảnh báo rằng hình mờ bị thiếu “không chứng minh được quyền tác giả của con người”. Văn bản có thể quá ngắn hoặc được chỉnh sửa quá nhiều hoặc có thể đến từ AI của công ty khác.
Công ty cho biết: “(Hình mờ) có thể chỉ ra rằng hệ thống OpenAI đã tạo hoặc xử lý một phần của một đoạn văn, chứ không phải mức độ phán xét, chỉnh sửa hoặc sáng tạo của con người trong đó”.
Thông báo này được đưa ra hai tháng sau khi Anthropic cho biết họ sẽ tạo hình mờ cho văn bản do Claude tạo ra, một động thái được áp dụng trên toàn thế giới. Quyết định đó đã thu hút phản ứng dữ dội từ một số người dùng Claude, những người cho rằng họ đã cung cấp “hướng dẫn, bối cảnh, quyết định” trong khi Claude chỉ là “công cụ”.
OpenAI trước đây đã xây dựng hình mờ văn bản nhưng chưa phát hành nó, một phần do lo ngại rằng người dùng sẽ chuyển sang các đối thủ không có hình mờ, The Wall Street Journal đưa tin vào năm 2024.
Anthropic, Google, Meta, Microsoft và OpenAI là một trong những công ty đã cam kết tuân theo quy tắc thực hành của EU về nội dung do AI tạo ra.
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.