AI RACE— Cuộc đua AI
AI League

Anthropic công bố cơ chế watermark vô hình cho văn bản Claude

Anthropic sẽ áp dụng công nghệ SynthID-Text của Google để gắn dấu nhận dạng vô hình cho nội dung do Claude tạo, đáp ứng yêu cầu của EU AI Act.

17:57 17/08/2026
Anthropic công bố cơ chế watermark vô hình cho văn bản Claude

Mở đầu

Vào ngày 16 /8/2026, Anthropic – công ty đứng sau mô hình ngôn ngữ Claude – công bố kế hoạch triển khai hệ thống watermark vô hình cho mọi đoạn văn bản do Claude sinh ra. Đây là một phần trong nỗ lực tuân thủ quy định minh bạch của Đạo luật AI châu Âu (EU AI Act), yêu cầu mọi nội dung tổng hợp (âm thanh, hình ảnh, video và văn bản) phải có dấu hiệu có thể đọc được bằng máy để xác định nguồn gốc nhân tạo. Theo thông cáo, công nghệ watermark sẽ dựa trên “một phiên bản” của hệ thống SynthID‑Text mã nguồn mở do Google DeepMind phát triển.

Chi tiết cụ thể

Thông tin chi tiết được công bố trên blog của Anthropic và được nhà báo Jess Weatherbed (The Verge) đưa tin vào sáng ngày 17 /8/2026, 10:57 UTC. Theo đó, Claude sẽ sử dụng một “phiên bản” của giải pháp SynthID‑Text – một kỹ thuật watermark dựa trên xác suất từ ngữ. Khi mô hình dự đoán từ tiếp theo trong một câu, nó sẽ không chỉ dựa vào một bộ sinh số ngẫu nhiên thuần túy mà còn dựa vào một “khóa” (key) và một vài từ trước đó để quyết định từ nào sẽ được chọn.

Ví dụ, trong câu “Thời tiết hôm nay rất lạnh và …”, từ “ngọt ngào” gần như không thể xuất hiện, trong khi “u ám” hoặc “xám xịt” là các lựa chọn hợp lý. Trong các trường hợp này, Anthropic cho biết quyết định sẽ được đưa ra bằng một số ngẫu nhiên, nhưng số này sẽ được “điều chỉnh” bởi khóa watermark. Nhờ việc lặp lại các quyết định ngẫu nhiên có cấu trúc này qua hàng trăm từ trong một đoạn văn, một mẫu dấu nhận dạng sẽ xuất hiện trong phản hồi của Claude. Mẫu này không thể nhận thấy bằng mắt người đọc, nhưng bất kỳ bên nào sở hữu khóa tương ứng đều có thể phát hiện và xác định nội dung là do AI tạo ra.

Anthropic nhấn mạnh rằng việc tích hợp watermark sẽ không làm tăng chi phí sử dụng Claude, cũng như không gây ảnh hưởng thực tế tới chất lượng hay nội dung đầu ra. “Các dấu watermark văn bản sẽ không làm Claude trở nên đắt hơn đối với người dùng, cũng như không có bất kỳ tác động thực tế nào đến chất lượng hay nội dung của các kết quả,” công ty trích lời trong thông cáo.

Ngoài watermark văn bản, Anthropic còn đồng thời triển khai hỗ trợ chuẩn C2PA (Coalition for Content Provenance and Authenticity) cho hình ảnh do Claude xử lý, nhằm đáp ứng cùng một yêu cầu pháp lý cho nội dung đa phương tiện.

Công nghệ SynthID‑Text không phải là sáng chế mới của Anthropic. Google đã công bố giải pháp này từ năm 2023 và áp dụng trong chatbot Gemini kể từ 2024. Đối với OpenAI, mặc dù chưa công bố chi tiết kế hoạch watermark cho ChatGPT, công ty cũng sẽ phải tuân thủ các yêu cầu của EU AI Act khi luật này có hiệu lực.

Bối cảnh và so sánh

EU AI Act, được thông qua vào năm 2024, đặt ra tiêu chuẩn cao nhất về minh bạch cho các hệ thống trí tuệ nhân tạo. Yêu cầu “dấu hiệu máy đọc được” không chỉ áp dụng cho văn bản mà còn cho âm thanh, hình ảnh và video, buộc các nhà cung cấp AI phải triển khai các giải pháp nhận dạng nội dung nhân tạo. Điều này đã khiến nhiều ông lớn công nghệ – Google, Anthropic, và tiềm năng OpenAI – phải nhanh chóng đưa ra các biện pháp kỹ thuật đáp ứng.

Google đã đi đầu bằng cách tích hợp SynthID‑Text vào Gemini từ 2024, tạo tiền lệ cho việc sử dụng watermark dựa trên xác suất từ ngữ. Anthropic hiện nay theo kịp bằng cách “sử dụng một phiên bản” của cùng công nghệ, đồng thời kết hợp với chuẩn C2PA cho hình ảnh, cho thấy chiến lược đa lớp trong việc đáp ứng pháp luật.

Mặc dù các nhà cung cấp AI đều phải tuân thủ, cách tiếp cận của họ có thể khác nhau. Anthropic nhấn mạnh rằng watermark sẽ không làm giảm trải nghiệm người dùng, trong khi một số nhà phân tích lo ngại rằng việc chèn các mẫu nhận dạng có thể làm giảm tính ngẫu nhiên và sáng tạo của mô hình. Tuy nhiên, theo quan điểm của Anthropic, việc lựa chọn các “quyết định ít quan trọng” (như từ đồng nghĩa trong ví dụ trên) để nhúng dấu hiệu sẽ giữ nguyên chất lượng nội dung cuối cùng.

Trong bối cảnh cạnh tranh ngày càng gay gắt giữa các mô hình ngôn ngữ lớn như GPT‑4/5, Claude, Gemini, Llama và các dự án mới từ các lab nhỏ, việc đáp ứng nhanh chóng các quy định pháp lý không chỉ là nghĩa vụ mà còn là lợi thế cạnh tranh. Việc Anthropic công bố chi tiết cơ chế watermark ngay sau khi EU AI Act có hiệu lực cho thấy công ty đang nỗ lực duy trì vị thế “đáng tin cậy” trên thị trường châu Âu, đồng thời chuẩn bị sẵn sàng cho các thị trường khác có xu hướng áp dụng các tiêu chuẩn tương tự.

◗ Nguồn

The Verge17-08

Tin liên quan