List of Best

Anthropic thêm watermark vô hình vào văn bản Claude để đáp ứng quy định của EU AI Act

Mục lục
Official announcement image: Anthropic Adds Invisible Watermarks to Claude Text to Meet EU AI Act Rules
Source asset: \2.

Anthropic đang bổ sung một watermark vô hình vào tất cả văn bản được tạo bởi các mô hình Claude trong tương lai. Nếu đội ngũ của bạn sử dụng AI cho xuất bản, giáo dục hoặc lưu trữ hồ sơ theo quy định, thay đổi này sẽ ảnh hưởng đến cách bạn theo dõi và chứng minh việc sử dụng AI theo European Union AI Act.

Vào ngày 14 tháng 8 năm 2026, công ty đã công bố một tài liệu hướng dẫn kỹ thuật trong Anthropic — How Claude’s text watermark works. Anthropic đang triển khai tính năng này trên toàn thế giới vì hiện tại chưa thể dễ dàng giới hạn theo từng khu vực.

Cách thức hoạt động của mẫu ẩn

Anthropic xây dựng hệ thống của mình dựa trên phương pháp SynthID-Text của Google DeepMind. Tín hiệu này hoàn toàn vô hình. Nó không thêm ký tự đặc biệt, token bổ sung hay bất kỳ thẻ hiển thị nào vào kết quả đầu ra của bạn.

Thay vào đó, mô hình điều chỉnh nhẹ thuật toán tính toán khi chọn từ trong trường hợp có nhiều lựa chọn mang ý nghĩa tương đương nhau. Một công cụ kiểm tra sẽ sử dụng khóa bí mật để quét các lựa chọn tinh tế này. Sau đó, nó tính toán xác suất Claude đã tham gia vào việc viết văn bản.

Dưới đây là những điểm đáng chú ý:
Không phát sinh chi phí. Anthropic cho biết việc gắn watermark không làm tăng thêm token và sẽ không làm tăng giá dịch vụ.
Không chứa dữ liệu cá nhân. Watermark không chứa bất kỳ thông tin nào về tài khoản người dùng, tổ chức hay các cuộc trò chuyện.
Sắp có Detection API. Anthropic dự kiến sẽ sớm ra mắt một API phát hiện, dù các thông tin chi tiết cuối cùng vẫn đang được hoàn thiện.

Những gì nhà cung cấp tuyên bố — và những gì chưa ai xác minh

Anthropic cho biết các thử nghiệm nội bộ cho thấy chất lượng bài viết không thực sự bị suy giảm, đồng thời dẫn chứng một nghiên cứu độc lập về SynthID-Text. Hãy lưu ý: các tuyên bố này đến trực tiếp từ các thử nghiệm nội bộ của Anthropic và nghiên cứu được trích dẫn. Chưa có ai bên ngoài công ty kiểm tra lại trên mọi mô hình Claude, ngôn ngữ hoặc thiết lập temperature.

Những trường hợp khả năng phát hiện bị suy giảm

Kết quả kiểm tra dương tính chỉ có nghĩa là Claude có khả năng đã tham gia vào một thời điểm nào đó. Nó không thể chứng minh quyền tác giả của con người. Nó cũng không thể phân biệt Claude với một AI khác, hoặc cho biết Claude đã trực tiếp soạn thảo hay chỉ chỉnh sửa văn bản.

Khả năng phát hiện sẽ yếu đi rõ rệt trong các trường hợp:
– Đoạn văn bản ngắn
– Tác vụ lập trình
– Văn bản thông tin sự thật nghiêm ngặt với rất ít từ ngữ thay thế
– Hiệu đính nhẹ và viết lại toàn bộ

Ngoài ra, watermark văn bản hoàn toàn tách biệt với siêu dữ liệu C2PA của Anthropic dành cho các tệp hình ảnh.

Bạn nên làm gì tiếp theo

Đừng chỉ dựa vào điểm số đơn thuần. Đừng bao giờ coi watermark này là bằng chứng duy nhất cho hành vi đạo văn hoặc vi phạm chính sách.

Khi Anthropic phát hành API phát hiện, hãy thử nghiệm nó trên chính quy trình làm việc của bạn. Hãy tạo các mẫu văn bản dài bằng Claude, chỉnh sửa, dịch chúng và xem tín hiệu bị mất ở đâu. Cho đến lúc đó, hãy lưu giữ hồ sơ nội bộ rõ ràng về các prompt, tệp nguồn và nội dung do con người duyệt.

← Tất cả tin tức