HighTech

Anthropic và câu chuyện dấu chìm báo hiệu văn bản do AI tạo ra

16/08/2026 07:27 GMT+7 Google News

Công ty công nghệ Anthropic mới đây đã đăng một bài viết trên blog nhằm giải đáp các câu hỏi cơ bản về cách gắn dấu nhận diện kỹ thuật số chìm (watermark) vào văn bản do chatbot Claude tạo ra. Ví dụ như cơ chế gắn hình mờ thực sự hoạt động ra sao? Liệu nó có thể bị loại bỏ khi chỉnh sửa văn bản không? Và điều này ảnh hưởng thế nào đến mã nguồn?

Người dùng Claude đã tranh luận sôi nổi về động thái này kể từ khi Anthropic thông báo vào đầu tuần về việc sẽ triển khai việc gắn dấu chìm để tuân thủ Bộ quy tắc Minh bạch thuộc Đạo luật AI của Liên minh châu Âu (EU). Đạo luật này yêu cầu các công ty AI phải sử dụng hệ thống cho phép nhận diện nội dung do AI tạo ra. Tờ Business Insider đưa tin rằng hàng chục người dùng trên mạng xã hội X cho hay đã hủy gói đăng ký Claude vì lý do này.

Bài viết mới của Anthropic bắt đầu bằng phần tổng quan về khái niệm gắn dấu chìm, giải thích rằng khi đưa ra các "lựa chọn ít quan trọng" - chẳng hạn như chọn giữa từ "overcast" (u ám) và "grey" (xám xịt) để mô tả thời tiết - Claude có thể tạo ra một mô hình trong câu trả lời mà người đọc không thể phát hiện ra, nhưng lại có thể nhận diện được bởi bất kỳ ai sở hữu khóa giải mã tương ứng.

Anthropic và câu chuyện dấu chìm báo hiệu văn bản do AI tạo ra - Ảnh 1.

Công ty trí tuệ nhân tạo (AI) Anthropic. Ảnh tư liệu: AFP

Theo Anthropic, việc gắn dấu chìm không ảnh hưởng đến chất lượng nội dung đầu ra của Claude. Đối với người đọc, một câu trả lời có gắn dấu chìm hoàn toàn không khác biệt so với câu trả lời không có dấu chìm.

Cụ thể hơn, Anthropic cho biết sẽ sử dụng phương pháp SynthID-Text do trung tâm nghiên cứu trí tuệ nhân tạo Google DeepMind đề xuất vào năm 2024, đồng thời có kế hoạch phát hành một giao diện lập trình ứng dụng (API) để phát hiện dấu chìm. Anthropic cũng lưu ý rằng việc gắn dấu chìm khác biệt hoàn toàn so với các phương pháp phát hiện AI của những công ty như Pangram — vốn tìm kiếm các "dấu hiệu đặc trưng" trong văn bản (như cấu trúc câu "cái này không phải là X, mà là Y") để nhận biết việc sử dụng AI. Theo Anthropic, việc nhận diện các mô hình ngôn ngữ kiểu đó về cơ bản khác hẳn với việc kiểm tra sự hiện diện của dấu chìm.

Liệu ai đó có thể viết lại văn bản để che đi dấu chìm không? Anthropic cho biết điều này là có thể, nhưng việc chỉnh sửa nhẹ có lẽ sẽ không loại bỏ hoàn toàn dấu chìm trong khi việc viết lại toàn bộ nội dung và thay thế từng từ một thì sẽ loại bỏ được nó. Theo Anthropic, tất nhiên, trong trường hợp sau, có thể tranh luận liệu văn bản đó còn được coi là do AI tạo ra hay không.

Về việc liệu có thể phát hiện dấu chìm trong văn bản chỉ được Claude hiệu đính hoặc chỉnh sửa hay không, Anthropic cho biết điều này phụ thuộc vào độ dài của văn bản và mức độ chỉnh sửa của Claude. Nếu văn bản chỉ được chỉnh sửa sơ qua, gần như toàn bộ từ ngữ vẫn do tác giả là con người viết và gần như không còn chỗ nào (hoặc rất ít chỗ) để gắn dấu chìm vào.

Trong khi đó, mã nguồn sẽ ít chứa dấu chìm hơn so với các loại văn bản khác, bởi vì mô hình cần tạo ra mã nguồn hoạt động được và không có sự tự do lựa chọn giữa nhiều phương án có giá trị tương đương nhau.

Tuy vậy, Anthropic cho rằng tại những vị trí cho phép lựa chọn tùy ý giữa các từ hoặc thuật ngữ cụ thể trong mã nguồn - chẳng hạn như phần chú thích - thì dấu chìm vẫn có thể được áp dụng. Nhưng về bản chất, nó sẽ không ảnh hưởng đáng kể đến mã nguồn thực tế được tạo ra.

Anthropic cũng cho biết Claude sẽ không phải là chatbot AI duy nhất tạo ra văn bản có gắn dấu chìm vì các nhà phát triển mô hình lớn khác cũng đã ký vào Bộ Quy tắc Thực hành tương tự và sẽ triển khai các dấu chìm của riêng họ.

Anh Quân (Theo TechCrunch)

Cùng chuyên mục

Có thể bạn quan tâm

Đọc thêm