Các mô hình Claude mới nhất của Anthropic chèn một dấu chìm (watermark) vô hình vào mọi văn bản được tạo ra. Thay đổi này, được công bố trong tài liệu cập nhật vào ngày 2 tháng 8, sẽ chèn một tín hiệu thống kê trực tiếp vào cách lựa chọn từ ngữ và cấu trúc câu—chứ không phải là một thẻ hiển thị hay trường siêu dữ liệu (metadata).

Dấu chìm này là gì

Dấu chìm là một mô hình tinh vi được đan xen vào chính ngôn ngữ. Bằng cách điều hướng mô hình hướng tới các từ đồng nghĩa, cách đặt dấu câu hoặc nhịp điệu câu nhất định, Anthropic tạo ra một "dấu vân tay" có thể tồn tại qua các thao tác sao chép-dán thông thường và chỉnh sửa nhẹ. Chỉ có việc viết lại hoàn toàn, dịch đi dịch lại nhiều lần, hoặc trộn lẫn với một lượng lớn nội dung do con người viết mới có thể xóa sạch tín hiệu này.

Vì dấu chìm nằm bên trong văn bản, nó sẽ đi kèm với nội dung bất kể nó được chuyển đi đâu—thông qua giao diện web Claude.ai, API, Claude Code, và thậm chí cả các triển khai trên AWS hoặc Google Cloud dựa trên các mô hình của Anthropic.

Cách nó tồn tại qua các chỉnh sửa

Các quy trình làm việc thông thường có sự tham gia của con người (human-in-the-loop)—như soát lỗi, điều chỉnh tông giọng, hoặc thay thế một vài từ bằng từ đồng nghĩa—không xóa được dấu chìm. Tài liệu của Anthropic cho biết những thay đổi nhỏ đó "không loại bỏ được tín hiệu", nghĩa là kết quả đầu ra vẫn có thể được nhận diện là do Claude tạo ra ngay cả sau khi người kiểm duyệt đã chỉnh sửa.

Các hình thức biến đổi mạnh mẽ hơn có thể phá vỡ mô hình này:

  • Viết lại các câu từ đầu
  • Dịch văn bản sang ngôn ngữ khác rồi dịch ngược lại nhiều lần
  • Chèn các đoạn văn dài do con người viết

Những hành động này gây tốn thời gian hoặc công sức và có thể làm giảm chất lượng hoặc ý định của nội dung gốc.

Tác động đến quy trình làm việc của nhà phát triển

Các nhà phát triển vốn dựa vào Claude để soạn thảo dàn ý, chú thích mã nguồn (code comments) hoặc nội dung tiếp thị hiện đang phải đối mặt với một rào cản tuân thủ mới. Đạo luật AI của EU (EU AI Act), vốn yêu cầu tính minh bạch đối với nội dung do AI tạo ra, đã tạo ra bối cảnh pháp lý cho bước đi này của Anthropic, biến dấu chìm thành một biện pháp bảo vệ mang tính quy định.

Ba chiến lược ứng phó đã xuất hiện:

  1. Chuỗi dịch thuật – Chạy kết quả đầu ra của Claude qua nhiều lần dịch ngôn ngữ khác nhau để làm xáo trộn dấu chìm. Phương pháp này tốn thời gian và có thể gây ra lỗi dịch thuật.
  2. Gõ lại thủ công – Gõ lại văn bản bằng tay để loại bỏ mô hình ẩn. Cách này hiệu quả nhưng không thể áp dụng cho khối lượng lớn.
  3. Viết lại hoàn toàn – Sử dụng Claude để lấy ý tưởng hoặc cấu trúc, sau đó tự mình viết lại từng câu. Cách này vừa giữ được sự sáng tạo vừa đảm bảo văn bản cuối cùng không có dấu chìm, và các nhà phát triển coi đây là cách tiếp cận thực tế nhất bất chấp khối lượng công việc viết lách tăng thêm.

Mỗi phương pháp đều phải đánh đổi giữa tốc độ, chi phí và độ trung thực so với kết quả đầu ra gốc của mô hình.

Dương tính giả và tình thế tiến thoái lưỡng nan trong việc phát hiện

Một mối lo ngại kéo dài là bản chất thống kê của dấu chìm có thể trùng lặp với cách viết thực sự của con người. Claude học từ các văn bản có sẵn công khai, vì vậy các dấu vân tay phong cách của nó đôi khi bắt chước phong cách của các tác giả là con người. Do đó, các công cụ phát hiện gắn cờ dấu chìm có thể phân loại sai các tài liệu do con người viết thành do AI tạo ra—một trường hợp dương tính giả có thể dẫn đến các đợt kiểm tra tuân thủ không mong muốn.

Anthropic đang phát triển công cụ phát hiện của riêng mình, nhưng nó vẫn chưa được phát hành. Nếu không có một công cụ xác thực, các nhà phát triển không thể kiểm tra xem quy trình làm việc đã chọn có loại bỏ thành công dấu chìm hay không, hoặc liệu nội dung của họ có bị gắn cờ sai hay không.

Những điều cần theo dõi tiếp theo

  • Việc phát hành công cụ phát hiện của Anthropic – Khi công cụ này có sẵn, các đội ngũ có thể đối chiếu quy trình làm việc của họ với một tiêu chuẩn chính thức.

Bài học rút ra

Dấu chìm vô hình của Anthropic buộc một sự chuyển dịch từ "tạo ra và xuất bản" sang "tạo ra và kiểm soát kỹ lưỡng". Các nhà phát triển phải quyết định xem nên đầu tư vào các quy trình dịch thuật, gõ lại thủ công hay viết lại hoàn toàn để tránh các cảnh báo về quyền tác giả AI, đồng thời phải đối mặt với rủi ro dương tính giả có thể gắn nhãn nhầm công việc của con người là do máy tạo ra.