thethaovanhoa.vn

Dấu vết vô hình của AI

Hương Thủy (Tổng hợp) 31/08/2026 08:05 GMT+7

Đã qua rồi cái thời người dùng có thể thoải mái sử dụng trí tuệ nhân tạo (AI) để viết báo cáo, soạn email hay hiệu đính văn bản mà không ai hay biết.

Đã qua rồi cái thời người dùng có thể thoải mái sử dụng trí tuệ nhân tạo (AI) để viết báo cáo, soạn email hay hiệu đính văn bản mà không ai hay biết. 

Kể từ tháng 8/2026, Anthropic – công ty đứng sau mô hình ngôn ngữ Claude – chính thức gắn watermark, một dấu kỹ thuật số vô hình lên mọi sản phẩm đầu ra của hệ thống trên phạm vi toàn cầu.

Động thái của Anthropic không chỉ đơn thuần là một bản cập nhật phần mềm mà đang tạo ra những rung chấn thực sự. Nó buộc các doanh nghiệp lẫn người dùng phổ thông phải định hình lại cách họ quản trị rủi ro khi sử dụng AI trong công việc.

Cách AI đánh dấu sản phẩm

Để đánh dấu văn bản, Anthropic không chèn các ký tự ẩn thô sơ. Thay vào đó, họ can thiệp thẳng vào cách AI chọn từ. Các mô hình ngôn ngữ lớn tạo văn bản theo từng từ một, mỗi bước chọn một từ trong danh sách gồm nhiều khả năng hợp lý. Với câu "Thời tiết hôm nay lạnh và…", từ tiếp theo có thể là "âm u" hoặc "xám xịt" – hai lựa chọn tương đương về nghĩa và việc từ nào được chọn là ngẫu nhiên.

Watermark can thiệp đúng vào điểm này: thay vì dùng bộ sinh số ngẫu nhiên, mô hình dùng một khóa mật, kết hợp vài từ đứng trước để chọn. Kết quả đọc lên vẫn tự nhiên, nhưng ai nắm khóa đều tính được xác suất đoạn văn do Claude viết.

Động lực đằng sau là quy định pháp lý. Tháng 7/2026, Anthropic cùng khoảng 190 bên ký kết khác đã tham gia Bộ quy tắc ứng xử của Liên minh châu Âu (EU) về minh bạch nội dung do AI tạo ra. Từ ngày 2/8, các nhà cung cấp mô hình AI tiên tiến phải bảo đảm đầu ra có thể phát hiện được, nếu không sẽ đối mặt mức phạt tới 15 triệu euro (khoảng 17 triệu USD) hoặc 3% doanh thu toàn cầu hằng năm.

Theo Anthropic, watermark chỉ bám vào những từ do mô hình tự quyết. Càng ít khoảng trống cho lựa chọn, dấu vết càng mờ. Do đó, mức độ ảnh hưởng giữa các ngành nghề sẽ rất khác nhau.

Dấu vết vô hình của AI - Ảnh 1.

Công ty trí tuệ nhân tạo (AI) Anthropic. Ảnh tư liệu: AFP

Với ngành dịch vụ tài chính, đây là khu vực đối mặt với rủi ro pháp lý cao nhất. Trong một báo cáo mới đây, hãng luật K&L Gates cho hay các định chế tài chính hiện đang thường xuyên dùng AI để tạo lập những tài liệu công bố rộng rãi như triển vọng kinh tế vĩ mô, bình luận thị trường hay báo cáo môi trường, xã hội và quản trị (ESG). Giờ đây, với sự hiện diện của watermark, các ngân hàng và quỹ đầu tư sẽ buộc phải tự xác định xem nghĩa vụ công bố theo luật của EU có được kích hoạt hay không.

Với ngành báo chí - xuất bản, trái với lo ngại ban đầu, các chuyên gia từ quỹ đầu tư Value Add VC khẳng định watermark không ảnh hưởng chiến lược Tối ưu hóa công cụ tìm kiếm (SEO). Thuật toán của Google không sở hữu "khóa mật" của Anthropic nên không thể trừng phạt các bài viết chứa watermark AI, chúng chỉ đánh tụt hạng các nội dung rác kém chất lượng.

Hơn nữa, ngành báo chí có một cơ chế miễn trừ đặc quyền. Hãng luật K&L Gates lưu ý các quy định AI của EU sẽ không áp dụng nếu văn bản đã qua rà soát của con người và có biên tập viên chịu trách nhiệm xuất bản. Sự can thiệp sâu của biên tập viên thực chất cũng sẽ phá vỡ và xóa bỏ tín hiệu nhận diện của watermark. Điều này đồng nghĩa các tòa soạn chỉ cần chuẩn hóa quy trình kiểm duyệt, đề cao vai trò rà soát của con người là đủ để duy trì tính độc bản và được miễn trừ nghĩa vụ công bố.

Phản ứng từ người dùng

Anthropic khẳng định watermark không thêm ký tự ẩn và không truy ngược được về người dùng. Thế nhưng, lời giải thích kỹ thuật không làm dịu đi những bất bình của cộng đồng sử dụng Claude.

Làn sóng phản đối mạnh mẽ nhất đến từ những người sử dụng Claude như một công cụ biên tập. Điển hình như ông Erick Erickson, một nhà báo đã bức xúc chia sẻ trên nền tảng mạng xã hội X rằng ông chỉ dùng Claude để sửa lỗi ngữ pháp, nhưng giờ đây toàn bộ chất xám của ông sẽ bị gắn là do AI tạo ra. Điều này có thể hủy hoại uy tín nghề nghiệp với những cáo buộc đạo văn sai lệch.

Dấu vết vô hình của AI - Ảnh 2.

Công ty trí tuệ nhân tạo (AI) Anthropic. Ảnh tư liệu: AFP

Giới lập trình viên cũng phản đối quyết định của Anthropic khi tính chính xác là yêu cầu tuyệt đối trong lĩnh vực lập trình. Việc có watermark ẩn trong mã code bị e ngại sẽ làm suy giảm hiệu suất hoặc gây ra những lỗi hệ thống (bug) không đáng có trong chuỗi cung ứng phần mềm.

Tuy nhiên, ở góc độ kỹ thuật, kỹ sư phần mềm Sean Goedecke lại cho rằng phản ứng này đang thái quá. Ông lập luận rằng ngay cả khi không có watermark, các văn bản AI vốn dĩ đã luôn tự bộc lộ nguồn gốc thông qua các văn phong đặc trưng.

Tuy nhiên, nhìn rộng ra, xu hướng gắn dấu nhận diện gần như không thể đảo ngược. Từ tháng 5/2026, OpenAI đã tham gia liên minh C2PA và hợp tác với Google gắn dấu SynthID vào ảnh do mô hình của hãng tạo ra. Những động thái này minh chứng cho việc các hành lang pháp lý như Đạo luật AI của EU đang hoạt động hiệu quả, buộc các tập đoàn công nghệ lớn phải đặt tính minh bạch và trách nhiệm giải trình làm trọng tâm trong chu kỳ phát triển sản phẩm.

Dù vậy, công nghệ hiện vẫn chưa đủ tin cậy để tách bạch nội dung do AI tạo và do người viết. Nghiên cứu "Watermark under Fire" công bố tại hội nghị chuyên về ngôn ngữ và AI EMNLP 2025 cho thấy chỉ một lượt viết lại bằng mô hình mạnh đã kéo tỷ lệ phát hiện của mọi phương pháp thử nghiệm xuống dưới 0,3.

Anthropic đến nay cũng chưa phát hành công cụ phát hiện, nên chưa bên thứ ba nào kiểm chứng được. Các chuyên trang công nghệ Ars Technica và Futurism đã lên tiếng cảnh báo về rủi ro tiềm tàng: một khi Anthropic bắt đầu công khai cách thức hoạt động của các công cụ phát hiện và quét watermark, những tác nhân độc hại hoàn toàn có thể xây dựng các phần mềm chuyên dụng để đảo ngược và xóa sổ vĩnh viễn các tín hiệu nhận diện này trên văn bản.

Cách đây không lâu, việc dùng AI đến đâu vẫn còn là chuyện nội bộ của mỗi tổ chức. Giờ đây, khả năng chứng minh phần đóng góp của con người đang dần trở thành một điều kiện để đảm bảo uy tín trong một thế giới ngày càng nhiều nội dung do AI tạo ra.

Bản quyền © Báo điện tử Thể thao & Văn hóa - TTXVN