Anthropic thêm watermark vô hình cho nội dung Claude

Anthropic vừa triển khai watermark vô hình trên toàn bộ nội dung do Claude tạo ra, bao gồm cả văn bản lẫn hình ảnh. Người dùng không thể tắt tính năng này, gây tranh cãi lớn trên mạng xã hội khi nhiều người lo ngại việc dùng AI cho công việc và học tập sẽ bị phát hiện.

Động thái diễn ra ngày 11-12 tháng 8, được cho là nhằm tuân thủ Bộ Quy tắc Minh bạch của Đạo luật AI châu Âu (EU AI Act). Theo đó, mọi nội dung tạo ra bởi mô hình AI phải được gắn nhãn rõ ràng.

Biểu tượng ứng dụng Claude của Anthropic hiển thị trên màn hình điện thoại

Watermark hoạt động thế nào?

Theo thông tin từ Anthropic, watermark là dấu hiệu ở cấp độ mô hình, được nhúng trực tiếp vào văn bản và hình ảnh do Claude sinh ra. Điểm đặc biệt là dấu hiệu này vẫn sống sót khi người dùng sao chép nội dung và dán vào nơi khác, giúp nhà phát triển hoặc công cụ phát hiện xác định nguồn gốc AI của văn bản.

Chính sách áp dụng cho tất cả mô hình và sản phẩm Claude trên toàn thế giới, từ Claude Code cho lập trình viên đến ứng dụng web thông thường.

Phản ứng của người dùng

Cộng đồng người dùng phản ứng gay gắt trên X (Twitter) và Reddit. Nhiều người gọi đây là động thái gây khó khăn cho người dùng hợp pháp khi làm việc trong môi trường khắt khe như văn phòng, trường học, nơi việc sử dụng AI có thể bị xem là gian lận hoặc thiếu chuyên nghiệp.

Một số chuyên gia nhận định đây là dấu chấm hết cho “kỷ nguyên văn bản AI không thể chứng minh” khi các công cụ ngày càng buộc phải minh bạch về nguồn gốc nội dung.

Mô hình 3D chữ AI trên nền mạng lưới thần kinh minh họa trí tuệ nhân tạo

Vì sao Anthropic làm điều này?

Động thái của Anthropic đến từ yêu cầu pháp lý. EU AI Act yêu cầu các nhà cung cấp mô hình AI nền tảng phải đảm bảo nội dung tổng hợp được nhận diện được. Bằng cách chủ động triển khai watermark toàn cầu, Anthropic vừa tuân thủ quy định vừa thể hiện cam kết minh bạch.

Một số người cho rằng đây còn là chiến lược định vị thương hiệu: giữa cuộc đua AI khốc liệt, minh bạch trở thành điểm khác biệt của Anthropic so với OpenAI và các đối thủ khác.

Chi tiết kỹ thuật watermark

Khác với watermark truyền thống hiển thị logo hay chữ chìm trên ảnh, watermark của Anthropic hoạt động ở cấp độ mô hình. Kỹ thuật này nhúng tín hiệu ngẫu nhiên nhưng có kiểm soát vào quá trình sinh token của mô hình ngôn ngữ, tạo ra dấu hiệu thống kê mà mắt thường không thấy được nhưng thuật toán phát hiện có thể nhận ra. Với hình ảnh, kỹ thuật tương tự có thể áp dụng qua phương pháp nhúng tín hiệu trong pixel.

Ưu điểm lớn nhất của cách tiếp cận này là watermark không bị phá vỡ khi người dùng định dạng lại văn bản, thay đổi font chữ hay dán sang ứng dụng khác. Nhược điểm là chi phí tính toán tăng nhẹ và việc đảm bảo chất lượng văn bản sinh ra không bị suy giảm vẫn là thách thức.

So sánh với các hãng AI khác

OpenAI từng giới thiệu công cụ phát hiện văn bản AI nhưng đã gỡ bỏ vì độ chính xác không đạt yêu cầu. Google nghiên cứu kỹ thuật watermark SynthID cho hình ảnh và văn bản do AI tạo. Meta cũng thử nghiệm gắn nhãn nội dung AI trên các nền tảng mạng xã hội. Tuy nhiên, Anthropic là hãng đầu tiên triển khai watermark vô hình ở cấp độ mô hình cho toàn bộ sản phẩm của mình trên phạm vi toàn cầu, không cho phép người dùng tắt.

Ảnh hưởng đến người dùng Việt Nam

Người dùng Việt Nam dùng Claude cho công việc viết lách, dịch thuật, lập trình cũng sẽ bị ảnh hưởng. Nếu bạn đang dùng Claude để viết nội dung cho khách hàng hoặc bài tập học thuật, watermark vô hình có thể khiến nội dung bị phát hiện là do AI tạo ra khi kiểm tra bằng công cụ phát hiện.

Điều quan trọng là watermark vẫn còn rất mới và hiệu quả phát hiện phụ thuộc vào công cụ kiểm tra. Hiện chưa có thông tin chính thức về việc watermark có thể bị làm giả hay bỏ qua bằng kỹ thuật xử lý hậu kỳ.

Góc nhìn tương lai

Xu hướng watermark AI gần như chắc chắn sẽ lan rộng khi các quốc gia khác học theo EU. OpenAI, Google và Meta đều đã nghiên cứu kỹ thuật đánh dấu nội dung AI. Trong tương lai gần, việc xác định nguồn gốc nội dung sẽ trở thành tiêu chuẩn, thay đổi cách chúng ta đánh giá thông tin trên mạng.

Đối với người dùng thông thường, lời khuyên là minh bạch khi sử dụng AI trong công việc, đồng thời theo dõi sát các thay đổi chính sách để tránh rủi ro không đáng có.

Laptop hiển thị trình soạn thảo code tại bàn làm việc hiện đại

Tham khảo thêm:

Tôi là một lập trình viên IOS. Code chính là IOS nhưng thỉnnh thoảng vẫn đá sang Android hoặc web. Mặc dù không quá thông thạo nhưng tôi sẽ chia sẻ những kiến thức mà mình đã tìm hiểu, áp dụng qua.

Bài viết liên quan

Gemini đạt 1 tỷ người dùng: kỷ lục tăng trưởng của Google

Google Gemini vừa cán mốc lịch sử: ứng dụng trợ lý AI của Google đã vượt qua 1 tỷ người dùng hoạt động hàng tháng, trở thành sản phẩm tăng…

Xem thêm

Apple Intelligence là gì? Trợ lý AI tích hợp sâu iOS

Apple Intelligence là bộ tính năng trí tuệ nhân tạo do Apple phát triển, được tích hợp sâu vào hệ điều hành iOS, iPadOS và macOS. Khác với trợ lý…

Xem thêm

Xe taxi tự lái Tesla Robotaxi mở rộng thần tốc: 7 thành phố, 2,4 triệu dặm nhưng vẫn kém xa Waymo

Dịch vụ taxi tự lái Tesla Robotaxi đang mở rộng nhanh chóng trên khắp nước Mỹ, khi Tesla công bố đã phủ sóng 7 khu vực đô thị lớn chỉ…

Xem thêm
0 0 đánh giá
Article Rating
Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất