Từ nay, ai dùng AI viết bài cũng khó mà giấu: ChatGPT sắp gắn "vân tay vô hình" vào từng câu chữ

Admin

06/10/2026 17:00

OpenAI sắp gắn dấu hiệu vô hình vào văn bản do ChatGPT và Codex tạo ra tại châu Âu. Đó không phải ký tự ẩn hay mã chèn thêm mà nằm ngay trong cách chọn từ, nên xóa dấu gạch dài hay sửa một hai câu khó đủ để xóa dấu vết. Nhưng công nghệ này cũng có giới hạn rõ ràng, và đó mới là điều người viết cần biết.

Theo TechCrunch, OpenAI đang chuẩn bị triển khai công nghệ đánh dấu vô hình đối với nội dung do ChatGPT và Codex tạo ra tại Liên minh châu Âu (EU), nhằm đáp ứng yêu cầu minh bạch của Đạo luật AI của EU. Luật này yêu cầu nhà cung cấp AI tạo sinh phải khiến nội dung do AI tạo ra có thể được nhận diện bằng phương thức máy đọc được. OpenAI cho biết sẽ áp dụng trong những tuần tới, với các tài khoản đủ điều kiện trên các gói dịch vụ.

Dấu hiệu nằm trong cách chọn từ, không phải ký tự ẩn

Công nghệ có tên textGrain không chèn ký tự bí mật, khoảng trắng đặc biệt hay đoạn mã vào văn bản. Thay vào đó, hệ thống điều chỉnh cách mô hình chọn từ giữa những phương án có ý nghĩa tương đương. Khi áp dụng xuyên suốt một đoạn văn, các lựa chọn này tạo ra một tín hiệu thống kê mà công cụ chuyên dụng của OpenAI có thể nhận diện. Người đọc, kể cả khi sao chép hay chỉnh sửa thông thường, gần như không nhận ra.

"Giấu đuôi" kiểu quen thuộc sẽ còn hiệu quả không?

Ai làm nghề viết đều biết hiện trạng này: bài dùng AI được đăng tràn lan, và nhiều người "giấu đuôi" bằng những mẹo nhỏ. Họ viết lại một hai câu cho đỡ cứng, hoặc thay dấu gạch dài (—) mà ChatGPT hay dùng bằng dấu gạch ngang (-) để bớt lộ "chất máy".

Những mẹo đó xử lý dấu hiệu ở bề mặt: văn phong và ký tự. textGrain nằm ở tầng khác. Vì không chèn ký tự, việc thay dấu gạch dài không đụng đến tín hiệu thống kê, và tín hiệu này trải đều trên cả đoạn nên sửa một hai câu khó làm nó biến mất. Đây là suy luận từ cách công nghệ vận hành, chưa phải kết quả OpenAI kiểm chứng riêng cho từng mẹo.

Số liệu OpenAI công bố cũng cho thấy ngưỡng để xóa thật sự khá cao. Với đoạn văn 400 token, thay 10% số từ bằng từ đồng nghĩa khiến tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%. Thay 25% số từ, tỷ lệ chỉ còn 17%. Nói cách khác, muốn "giấu" hiệu quả, người viết phải viết lại gần như cả đoạn. Đến lúc đó, phần AI chỉ còn là bản nháp, và bài viết cơ bản là của người viết.

OpenAI thừa nhận textGrain chưa phải máy dò AI hoàn hảo. Hệ thống nhận diện được khoảng 80% watermark trong đoạn văn 200 token, và khoảng 95% với đoạn 400 token. Khả năng phát hiện thấp hơn đáng kể với nội dung như toán học, nơi mô hình có ít cách diễn đạt khác nhau.

Cần hiểu đúng giới hạn: watermark không phải bằng chứng tuyệt đối rằng con người không tham gia viết. Nó không cho biết ai dùng ChatGPT, không xác định quyền sở hữu văn bản, không đo mức đóng góp của con người và không chứng minh nội dung chính xác. Ngược lại, văn bản không có watermark cũng không có nghĩa chắc chắn do người viết. Biên tập, dịch hoặc viết lại đều có thể làm tín hiệu suy yếu.

Phạm vi áp dụng và ai kiểm tra được

Hiện tại, OpenAI chưa biến watermark thành mặc định trên toàn cầu. Với khách hàng API, từ ngày 5/10, khách hàng trên toàn thế giới có thể chủ động bật watermark cho một số mô hình được hỗ trợ, và tính năng vẫn tắt theo mặc định.

Công cụ phát hiện hiện chỉ mở cho các nhà nghiên cứu và tổ chức chuyên môn được phê duyệt. OpenAI cho biết công cụ chỉ xác định văn bản có tín hiệu watermark hay không, không tiết lộ danh tính người dùng hay nội dung cuộc trò chuyện. Công ty cũng dự định phát hành textGrain dưới dạng mã nguồn mở để cộng đồng tiếp tục nghiên cứu.

Nguồn ảnh: TechCrunch

Cuộc chơi AI đang chuyển từ câu hỏi "máy viết giống người đến đâu" sang câu hỏi khó hơn: làm sao biết một đoạn văn do máy tạo ra. Với hàng tỷ nội dung sinh ra mỗi ngày, khả năng truy xuất nguồn gốc có thể thành một lớp hạ tầng của Internet, nhất là trong giáo dục, truyền thông, doanh nghiệp và các lĩnh vực cần tính xác thực.

Với người làm nội dung, bài học thực tế là mẹo "giấu đuôi" ngày càng ít giá trị. Một watermark có thể không bắt được mọi bài, nhưng xu hướng đã rõ: nguồn gốc văn bản sẽ ngày càng được kiểm tra. Cách an toàn nhất là dùng AI như công cụ hỗ trợ, tự chịu trách nhiệm về nội dung, và viết lại bằng chính góc nhìn, dẫn chứng của mình thay vì chỉ "sửa cho giống người".

*Nguồn: TechCrunch

Vũ Hoàng

Bạn đang đọc bài viết "Từ nay, ai dùng AI viết bài cũng khó mà giấu: ChatGPT sắp gắn "vân tay vô hình" vào từng câu chữ" tại chuyên mục Công nghệ - Xe. Mọi bài vở cộng tác xin gửi về địa chỉ email ([email protected]).