Công nghệ

ChatGPT gắn hình mờ vô hình vào văn bản tại EU, công cụ OpenAI từng cất kỹ năm 2024

Adrian Kessler
Thêm chúng tôi trên Google

OpenAI đã dành nhiều thời gian công khai giải thích vì sao họ sẽ không gắn dấu chìm vào những câu chữ do ChatGPT tạo ra. Vậy mà giờ đây, công ty vẫn quyết định làm điều đó. Không phải vì công nghệ khiến họ đổi ý. Mà vì một đạo luật có thời hạn tuân thủ và mức phạt đi kèm.

Công ty cho biết văn bản ChatGPT và Codex tạo ra cho người dùng tại Liên minh châu Âu sẽ mang một chữ ký thống kê vô hình, được triển khai dần trong vài tuần tới trên tất cả các gói dịch vụ. Ở những nơi khác, dấu này cũng tồn tại nhưng chỉ dưới dạng một công tắc trong API dành cho nhà phát triển, và mặc định công tắc đang tắt. Ranh giới OpenAI vạch ra trùng với đường biên của khu vực pháp lý có thể phạt công ty.

Dấu chìm của ChatGPT hoạt động như thế nào?

Phương pháp này, có tên textGrain, không để lại dấu hiệu nào nhìn thấy được trên đầu ra. Khi có nhiều từ tiếp theo đều phù hợp với câu ở mức tương đương, một khóa bí mật sẽ nghiêng lựa chọn về phía một từ nhất định. Một lần điều chỉnh thì chẳng nói lên điều gì. Nhưng hàng trăm lần như vậy trong một đoạn văn sẽ tạo thành một mẫu mà công cụ dò tìm nắm giữ khóa có thể kiểm tra; vì tín hiệu nằm ngay trong các từ, nó vẫn tồn tại sau khi sao chép và dán. OpenAI thực hiện báo cáo kỹ thuật cùng các nhà nghiên cứu từ Đại học Pennsylvania và Đại học Yale. Báo cáo cho biết chất lượng không bị ảnh hưởng đáng kể: trên Artificial Analysis Intelligence Index, đầu ra có dấu đạt 49,76 điểm, so với 49,57 điểm khi không có dấu.

Công cụ OpenAI đã có từ trước

Không điều gì trong số này là mới với OpenAI. Mùa hè năm 2024, Wall Street Journal đưa tin công ty đã có một công cụ đánh dấu chìm văn bản hoạt động được, được các tài liệu nội bộ đánh giá hiệu quả 99,9%, nhưng vẫn chưa đưa vào sử dụng. OpenAI đáp lại rằng họ đang thực hiện “một cách tiếp cận có cân nhắc”. Những lý do họ đưa ra thuộc cả khía cạnh kỹ thuật lẫn xã hội: phương pháp này “dễ dàng bị các đối tượng xấu né tránh” bằng cách dịch hoặc diễn đạt lại thông qua một mô hình khác, đồng thời có thể khiến AI bị kỳ thị như một công cụ hỗ trợ viết dành cho những người không phải bản ngữ tiếng Anh. Khi đưa tin về thông báo trong tuần này, TechCrunch nhắc lại một lý do thứ ba từ thời điểm đó: lo ngại người dùng sẽ chuyển sang các đối thủ không gắn dấu chìm.

Đặt đợt triển khai mới bên cạnh những thông tin này, có thể thấy OpenAI thực sự đã xử lý được nỗi lo nào. Theo chính số liệu của công ty, vấn đề né tránh vẫn còn nguyên. Còn nỗi lo về thương mại thì đã được khoanh lại trong một thị trường duy nhất.

Số liệu của OpenAI, không phải của những người chỉ trích

Trong điều kiện thuận lợi, với tỷ lệ dương tính giả 1%, công cụ dò tìm nhận diện được khoảng 80% đoạn văn có dấu chìm dài 200 token và khoảng 95% đoạn dài 400 token. Nếu thay 10% số từ bằng từ đồng nghĩa, tỷ lệ phát hiện giảm từ 92% xuống 66%. Thay một phần tư số từ thì tỷ lệ này tụt còn 17%. Những câu trả lời ngắn, phép toán và văn bản đã dịch đều rất khó bị phát hiện. Chính OpenAI cảnh báo rằng hiệu quả cao trong điều kiện lý tưởng “không đảm bảo khả năng phát hiện đáng tin cậy trong quá trình sử dụng hằng ngày”, đồng thời việc không tìm thấy dấu chìm không chứng minh văn bản do con người viết. Công ty cũng cho biết dấu này không xác định được người dùng.

Điều đó khiến textGrain trở thành một tín hiệu hữu ích để phát hiện kiểu sao chép-dán qua loa, nhưng lại yếu trước bất kỳ ai sẵn sàng dành một phút chỉnh sửa. Trong một khối gồm nhiều ngôn ngữ được đọc và viết song song, hạn chế khi phát hiện văn bản đã dịch không phải chuyện có thể xem nhẹ.

Vì sao là EU, và vì sao là lúc này?

Động lực pháp lý nằm ở Điều 50 của AI Act, với các quy định về minh bạch có hiệu lực từ ngày 2 tháng 8. Điều khoản này yêu cầu nhà cung cấp các hệ thống tạo sinh phải đánh dấu văn bản, âm thanh, hình ảnh và video tổng hợp theo cách máy móc có thể đọc được, đồng thời cung cấp cơ chế phát hiện. Những hệ thống đã có mặt trên thị trường trước ngày đó, trong đó có ChatGPT, có thời hạn đến ngày 2 tháng 12 để tuân thủ. Theo phân tích của hãng luật Cooley, vi phạm có thể bị phạt tới 15 triệu euro hoặc 3% doanh thu toàn cầu hằng năm, tùy theo mức nào cao hơn.

Hai chi tiết cho thấy đợt triển khai bám sát nghĩa vụ pháp lý đến mức nào, thay vì xuất phát từ một nguyên tắc chung. Chi tiết thứ nhất là công cụ dò tìm. Luật yêu cầu có cơ chế phát hiện; OpenAI đã xây dựng một công cụ như vậy nhưng chỉ cấp cho các nhà nghiên cứu được phê duyệt và những tổ chức chuyên môn, vốn phải nộp đơn xin quyền truy cập. Theo The Decoder đưa tin, công ty cho biết sẽ mở rộng quyền truy cập “khi chúng tôi tin rằng kết quả có thể được diễn giải một cách có trách nhiệm”, nhưng chưa đưa ra mốc thời gian. Hiện tại, một giáo viên hay biên tập viên ở Lisbon hoặc Warsaw không thể kiểm tra đoạn văn đáng ngờ mà họ đang có.

Chi tiết thứ hai là phạm vi áp dụng. Anthropic bắt đầu gắn dấu chìm cho văn bản của Claude hồi tháng 8, áp dụng dấu này trên toàn cầu bất kể người dùng truy cập mô hình bằng cách nào, và vấp phải phản ứng dữ dội từ một số người dùng. OpenAI chọn hướng ngược lại: bật mặc định ở nơi cơ quan quản lý có thể phạt, để nhà phát triển tự chọn bật ở những nơi khác, và không áp dụng mặc định trên toàn cầu ngay từ đầu. Nếu nỗi lo trước đây về việc người dùng chuyển sang các đối thủ không đánh dấu đã biến mất, hẳn sẽ chẳng có nhiều lý do để vạch ranh giới như vậy.

Tiếp theo sẽ là gì?

OpenAI cho biết sẽ phát hành textGrain dưới dạng mã nguồn mở và khẳng định phương pháp này ngang bằng hoặc tốt hơn những cách tiếp cận như SynthID của Google. Khi mã nguồn được công khai, cả hai tuyên bố đều có thể được kiểm chứng. Câu hỏi dành cho Brussels hẹp hơn: liệu một dấu chìm dễ phai đi sau vài chỉnh sửa nhẹ, lại được kiểm tra bằng một công cụ mà hầu như không ai có thể sử dụng, có đáp ứng quy định được đặt ra để các hệ thống khác nhận diện văn bản do AI tạo hay không.

Sau ngày 2 tháng 12, những người dùng ChatGPT duy nhất có câu chữ mặc định mang chữ ký của OpenAI sẽ là những người sống tại nơi cơ quan quản lý có thể gửi hóa đơn phạt.

Thẻ: , , , ,

Thêm chúng tôi trên Google

Thảo luận

Có 0 bình luận.