Skip to content

OpenAI triển khai watermark văn bản tại EU, giới hạn quyền dò tìm

OpenAI công bố watermark cho văn bản AI tại EU và tùy chọn bật qua API trên toàn cầu. Công nghệ này cung cấp tín hiệu về nguồn gốc, nhưng không chứng minh tác giả hay độ chính xác của nội dung.

OpenAI triển khai watermark văn bản tại EU, giới hạn quyền dò tìm

Nghe bài viết0:00 / 5:37
•6 min read
Chia sẻ:
Minh họa tín hiệu watermark vô hình trong văn bản AI

OpenAI ngày 5/10/2026 công bố kế hoạch đưa watermark vô hình vào văn bản đủ điều kiện do ChatGPT và Codex tạo ra tại Liên minh châu Âu. Khách hàng API trên toàn cầu có thể chủ động bật tính năng cho một số mô hình, trong khi công cụ phát hiện watermark ban đầu chỉ dành cho nhà nghiên cứu và tổ chức chuyên môn được phê duyệt.

Điểm đáng chú ý không chỉ là việc văn bản AI có thêm dấu hiệu nhận diện. OpenAI đồng thời nhấn mạnh rằng kết quả dò tìm không đủ để kết luận ai viết nội dung, mức đóng góp của con người hoặc nội dung có chính xác hay không.

Triển khai tại EU, API vẫn tắt mặc định

Trong thông báo về cách tiếp cận quy định nguồn gốc văn bản tại EU, OpenAI đặt việc triển khai trong bối cảnh yêu cầu của EU AI Act về khả năng nhận diện văn bản do AI tạo ra bằng phương tiện máy đọc được.

Theo kế hoạch công bố, watermark sẽ được bổ sung trong những tuần tiếp theo cho đầu ra văn bản đủ điều kiện của ChatGPT và Codex tại EU, trên tất cả các gói. Đây không phải việc bật mặc định trên toàn cầu ngay khi ra mắt.

Với API, khách hàng toàn cầu có thể lựa chọn bật watermark cho một số mô hình từ ngày công bố. Tính năng vẫn tắt mặc định, để bên xây dựng ứng dụng quyết định cách tích hợp vào sản phẩm và yêu cầu minh bạch của mình.

Phạm vi này cần được đọc đúng: thông báo không nói mọi văn bản từ mọi mô hình OpenAI đều sẽ có watermark. Vì vậy, việc không tìm thấy dấu hiệu không đồng nghĩa văn bản chắc chắn do con người viết.

textGrain nhận diện tín hiệu thống kê, không truy tìm tài khoản

Công nghệ được OpenAI gọi là textGrain thêm tín hiệu thống kê vô hình vào cách mô hình lựa chọn từ. Bộ phát hiện tìm tín hiệu đó để đánh giá một đoạn văn có chứa watermark của OpenAI hay không.

Đây không phải nhãn hiển thị trên trang và cũng không phải mã định danh người dùng. Theo OpenAI, công cụ không liên kết văn bản với cá nhân, tổ chức, tài khoản, câu lệnh hay cuộc hội thoại đã tạo ra nó.

Sự khác biệt này quan trọng với doanh nghiệp dùng AI để soạn tài liệu hoặc nội dung marketing. Một kết quả phát hiện có thể cho thấy hệ thống OpenAI đã tạo hoặc xử lý một phần đoạn văn, nhưng không đo được mức độ biên tập, sáng tạo hay phán đoán của người làm nội dung.

Watermark cũng không xác định quyền sở hữu, tính hợp pháp của việc sử dụng hay bên chịu trách nhiệm. Nó cung cấp một tín hiệu nguồn gốc, không thay thế hồ sơ biên tập và cơ chế phê duyệt.

Văn bản ngắn và việc chỉnh sửa làm giảm khả năng phát hiện

Minh họa việc chỉnh sửa có thể làm yếu tín hiệu watermark

OpenAI công bố các đánh giá cho thấy độ dài và loại nội dung ảnh hưởng đáng kể đến hiệu quả dò tìm. Ở ngưỡng tỷ lệ dương tính giả mục tiêu 1%, bộ phát hiện nhận diện watermark trong khoảng 80% đoạn dài 200 token và khoảng 95% đoạn dài 400 token, với nội dung như tâm lý học.

Token là đơn vị mô hình xử lý, không tương đương cố định với một từ. Các kết quả này vì thế không nên chuyển thành một số lượng từ tiếng Việt tối thiểu để bảo đảm phát hiện.

Với nội dung như toán học, tỷ lệ phát hiện thấp hơn đáng kể vì mô hình có ít khoảng linh hoạt trong lựa chọn từ. Những con số trên là kết quả đánh giá do OpenAI công bố, không phải mức bảo đảm cho mọi ngôn ngữ hay mọi tài liệu thực tế.

Trong một đánh giá khác với các đoạn tiếng Anh dài 400 token, thay 10% số từ bằng từ đồng nghĩa làm tỷ lệ phát hiện giảm từ khoảng 92% xuống 66%. Khi thay 25%, tỷ lệ còn 17%.

Điều này cho thấy ngay cả chỉnh sửa từ ngữ cũng có thể làm yếu tín hiệu. OpenAI cũng nêu việc dịch văn bản là một lý do có thể khiến watermark không được phát hiện đáng tin cậy. Ngược lại, bộ dò vẫn có thể báo có watermark ở văn bản không chứa nó, tức dương tính giả.

Vì sao công cụ dò chưa mở cho công chúng?

OpenAI cho biết quyền truy cập ban đầu được xét từng trường hợp cho nhà nghiên cứu và tổ chức chuyên môn, nhằm đánh giá độ tin cậy và cách sử dụng có trách nhiệm. Công ty chưa mở bộ dò văn bản cho công chúng khi ra mắt, do nguy cơ bỏ sót watermark và phát hiện sai.

Giới hạn này chỉ áp dụng cho công cụ xác minh văn bản trong thông báo. Các công cụ xác minh hình ảnh và âm thanh được OpenAI đề cập vẫn tiếp tục có khả năng truy cập công khai.

Với người dùng thông thường, vì vậy chưa thể xem bộ dò watermark mới như một tiện ích công khai để kiểm tra mọi bài viết. Ngay cả khi có quyền truy cập, kết quả cũng không nên được dùng độc lập làm bằng chứng quyết định về tác giả hoặc hành vi gian lận.

Minh bạch nguồn gốc vẫn cần quy trình riêng

Người biên tập kiểm tra tài liệu với tín hiệu nguồn gốc hỗ trợ

Đối với nhóm nội dung và doanh nghiệp, thay đổi này bổ sung một lớp tín hiệu kỹ thuật, nhưng không thay thế việc ghi nhận nguồn, kiểm tra dữ kiện và xác định người duyệt cuối cùng. Chủ đề này liên quan trực tiếp đến chính sách minh bạch nội dung AI của website: công khai cách sử dụng AI là một vấn đề khác với khả năng phát hiện dấu hiệu máy tạo ra văn bản.

Watermark cũng không phải thước đo chất lượng. Văn bản có dấu hiệu OpenAI vẫn có thể sai hoặc thiếu ngữ cảnh; văn bản không có dấu hiệu vẫn có thể được tạo bằng AI. Quy trình viết prompt rõ yêu cầu và kiểm tra kết quả vì thế vẫn cần thiết, bất kể có watermark hay không.

Với đơn vị xây ứng dụng, lựa chọn bật watermark qua API sẽ cần được xem cùng yêu cầu đầu ra và quy trình vận hành, thay vì coi là một nút bật để giải quyết toàn bộ bài toán minh bạch. Đây cũng là phần nối tiếp của vấn đề kiểm thử và kiểm soát khi triển khai AI.

OpenAI dự kiến xem xét lại phạm vi triển khai và quyền truy cập khi công nghệ, tiêu chuẩn và bằng chứng thực tế thay đổi. Công ty cũng công bố kế hoạch cung cấp công nghệ dưới dạng mã nguồn mở, nhưng thông báo chưa xác định thời điểm cụ thể. Hiện chưa có đủ cơ sở từ các đánh giá được nêu để kết luận mức độ phát hiện đáng tin cậy đối với văn bản tiếng Việt.

Bài viết liên quan

Gợi ý đọc thêm

Chia sẻ: