
OpenAI gắn watermark vô hình: sửa 25% từ, tỷ lệ phát hiện còn 17%
OpenAI công bố watermark textGrain cho văn bản AI. Tín hiệu hữu ích cho provenance nhưng suy yếu mạnh sau chỉnh sửa và không chứng minh ai là tác giả.
OpenAI bắt đầu cho khách hàng API toàn cầu bật watermark văn bản trên một số model và sẽ triển khai dấu vô hình cho đầu ra ChatGPT, Codex đủ điều kiện tại Liên minh châu Âu trong vài tuần tới. Công nghệ mang tên textGrain tạo một tín hiệu thống kê qua cách model chọn từ; nó không chèn ký tự ẩn và không hiện ra khi người đọc sao chép văn bản.
Công bố ngày 5/10/2026 nhằm đáp ứng yêu cầu minh bạch của EU AI Act. Nhưng OpenAI đồng thời đưa ra giới hạn quan trọng: văn bản ngắn khó phát hiện hơn, chỉnh sửa có thể làm tín hiệu suy yếu mạnh, và một kết quả phát hiện không chứng minh ai là tác giả hay nội dung có đúng hay không.
textGrain hoạt động như thế nào?
Thay vì thêm khoảng trắng, ký hiệu hoặc metadata, textGrain điều chỉnh nhẹ xác suất chọn từ hoặc mảnh từ khi model sinh nội dung. Qua một đoạn đủ dài, các lựa chọn tạo thành mẫu thống kê để bộ dò tìm kiếm. OpenAI nói phương pháp này đạt kết quả tương đương hoặc tốt hơn các cách hãng đã thử, trong đó có SynthID cho văn bản.
API toàn cầu để watermark ở chế độ tự chọn. Trong EU, OpenAI dự kiến áp dụng cho đầu ra ChatGPT và Codex đủ điều kiện trên các gói trong vài tuần tới. Bộ dò không mở công khai ở giai đoạn đầu; chỉ nhà nghiên cứu và tổ chức chuyên môn được phê duyệt mới có thể đăng ký truy cập.
80%, 95%, 66% và 17% thực sự nói gì?
Ở ngưỡng dương tính giả mục tiêu 1%, OpenAI cho biết bộ dò nhận ra watermark trong khoảng 80% đoạn 200 token và khoảng 95% đoạn 400 token đối với nội dung như tâm lý học. Nội dung toán học có tỷ lệ thấp hơn đáng kể vì model có ít lựa chọn từ ngữ hơn.
Trong một phép thử khác với đoạn 400 token, tỷ lệ phát hiện ban đầu khoảng 92%. Khi thay 10% số từ bằng từ đồng nghĩa, tỷ lệ còn 66%. Khi thay 25%, tỷ lệ giảm xuống 17%.
Các con số không mâu thuẫn vì chúng đến từ những điều kiện thử khác nhau. Chúng cũng không có nghĩa cứ sửa 25% từ là mọi văn bản sẽ “thoát” phát hiện. OpenAI chưa công bố đủ mọi cấu hình, ngôn ngữ và kiểu biên tập để suy rộng như vậy.
Nhận định của Học viện AI: textGrain là tín hiệu provenance — nguồn gốc và quá trình tạo — chứ không phải máy phát hiện gian lận. Nếu trường học, nhà tuyển dụng hoặc tòa soạn dùng một kết quả duy nhất để kết luận người viết vi phạm, nguy cơ xử lý nhầm là có thật.
Watermark không chứng minh năm điều
- Không đo mức đóng góp của con người. Nó không phân biệt một đoạn được AI viết toàn bộ với một đoạn được con người biên tập sâu.
- Không xác định người dùng. Tín hiệu không gắn với tài khoản, prompt hay cuộc trò chuyện cụ thể.
- Không quyết định quyền sở hữu. Nó không cho biết ai có bản quyền hoặc việc sử dụng có hợp pháp hay không.
- Không kiểm chứng sự thật. Văn bản có watermark vẫn có thể sai; văn bản không watermark vẫn có thể do AI tạo.
- Không chứng minh tác giả là con người khi không phát hiện. Đoạn quá ngắn, đã chỉnh sửa, đã dịch, dùng model khác hoặc được tạo trước rollout đều có thể không để lại tín hiệu đủ mạnh.
Đây là lý do OpenAI chưa mở bộ dò cho công chúng. Bài nghiên cứu “Watermarks Without Verification” công bố tháng 9/2026 cũng chỉ ra khoảng trống lớn hơn: khi hệ thống triển khai và công cụ dò không thể được kiểm định độc lập, cả phản đối lẫn đảm bảo của nhà cung cấp đều khó xác minh đầy đủ.
Watermark có làm model yếu đi?
OpenAI nói không thấy khác biệt hiệu năng có ý nghĩa trên bộ benchmark Astra. Ví dụ, DeepSWE v1.1 giảm từ 72,80% xuống 71,68%, trong khi Terminal-Bench 4.0 tăng từ 53,90% lên 56,06%. Các dao động trái chiều này được hãng xem là nhiễu giữa các lần đánh giá, không phải bằng chứng watermark cải thiện hay làm model suy giảm.
Với doanh nghiệp đang cân nhắc chi phí model, bài GPT-6 Sol và Luna giảm 50% giá API cho thấy hiệu quả không thể chỉ đọc từ một con số benchmark. Cần đo cả độ đúng, độ trễ, chi phí kiểm tra và rủi ro quy trình.
Doanh nghiệp và trường học nên dùng tín hiệu này ra sao?
- Dùng nhiều lớp bằng chứng. Kết hợp watermark với lịch sử phiên bản, trích dẫn nguồn, log tạo nội dung và phỏng vấn người viết.
- Không tự động kỷ luật. Một kết quả bộ dò phải mở đầu cho rà soát, không phải phán quyết cuối.
- Yêu cầu disclosure theo mức rủi ro. Văn bản marketing nội bộ có thể chỉ cần ghi công cụ; hồ sơ pháp lý, y tế hoặc đánh giá học tập cần quy trình chặt hơn.
- Lưu prompt và nguồn khi cần kiểm toán. Với AI Agent, có thể áp dụng logic kiểm soát quyền trong bài ChatGPT Dots: kiểm tra quyền ứng dụng qua 4 lớp.
- Giữ người chịu trách nhiệm cuối. Watermark không thay thế biên tập, kiểm chứng fact hay phê duyệt.
Rủi ro của AI không chỉ nằm ở nguồn gốc văn bản. Bài OpenAI công bố 6 ca AI tự ý hành động cho thấy khi model có quyền dùng công cụ, doanh nghiệp còn phải quản lý secret, egress và hành động ngoài dự kiến.
Điều chưa biết vào ngày công bố
OpenAI chưa mở công khai detector, chưa công bố đầy đủ độ chính xác trên tiếng Việt và chưa cho biết mọi kiểu đầu ra nào sẽ được coi là “đủ điều kiện” trong ChatGPT và Codex tại EU. Hãng nói sẽ cập nhật báo cáo kỹ thuật, làm việc với cloud partner và dự định mở nguồn textGrain.
Vì vậy, tổ chức Việt Nam không nên mua hay xây quy trình kỷ luật dựa trên một lời hứa rằng watermark sẽ nhận diện chắc chắn nội dung AI. Cách bền vững hơn là thiết kế provenance ngay từ workflow: ai giao việc, model nào được dùng, nguồn nào được tham chiếu, con người sửa gì và ai phê duyệt.
CTA: Nếu doanh nghiệp cần xây quy trình dùng AI có log, phân quyền và kiểm duyệt theo mức rủi ro, hãy đặt lịch tư vấn 15 phút với Học viện AI.
Nguồn và provenance
- OpenAI — Our approach to EU text provenance rules, 05/10/2026.
- OpenAI Help Center — Provenance signals in OpenAI-generated content, cập nhật 05/10/2026.
- The Verge — OpenAI is adding text watermarking in ChatGPT and Codex, 05/10/2026.
- Nemecek, Chaudhary & Ayday — Watermarks Without Verification, 09/09/2026.
- Cover: Học viện AI/ChatGPT Personal tạo ngày 06/10/2026, không dùng logo hoặc tài sản bên thứ ba.
- Visual inline: Học viện AI biên tập từ tỷ lệ phát hiện do OpenAI công bố ngày 05/10/2026.
2 công cụ AI miễn phí dành cho bạn
Có thể bạn cần
Tài nguyên & công cụ liên quan từ Học viện AI


