Anthropic thêm watermark vô hình cho nội dung Claude

Anthropic vừa triển khai watermark vô hình trên toàn bộ nội dung do Claude tạo ra, bao gồm cả văn bản lẫn hình ảnh. Người dùng không thể tắt tính năng này, gây tranh cãi lớn trên mạng xã hội khi nhiều người lo ngại việc dùng AI cho công việc và học tập sẽ bị phát hiện.

Động thái diễn ra ngày 11-12 tháng 8, được cho là nhằm tuân thủ Bộ Quy tắc Minh bạch của Đạo luật AI châu Âu (EU AI Act). Theo đó, mọi nội dung tạo ra bởi mô hình AI phải được gắn nhãn rõ ràng.

Biểu tượng ứng dụng Claude của Anthropic hiển thị trên màn hình điện thoại

Watermark hoạt động thế nào?

Theo thông tin từ Anthropic, watermark là dấu hiệu ở cấp độ mô hình, được nhúng trực tiếp vào văn bản và hình ảnh do Claude sinh ra. Điểm đặc biệt là dấu hiệu này vẫn sống sót khi người dùng sao chép nội dung và dán vào nơi khác, giúp nhà phát triển hoặc công cụ phát hiện xác định nguồn gốc AI của văn bản.

Chính sách áp dụng cho tất cả mô hình và sản phẩm Claude trên toàn thế giới, từ Claude Code cho lập trình viên đến ứng dụng web thông thường.

Phản ứng của người dùng

Cộng đồng người dùng phản ứng gay gắt trên X (Twitter) và Reddit. Nhiều người gọi đây là động thái gây khó khăn cho người dùng hợp pháp khi làm việc trong môi trường khắt khe như văn phòng, trường học, nơi việc sử dụng AI có thể bị xem là gian lận hoặc thiếu chuyên nghiệp.

Một số chuyên gia nhận định đây là dấu chấm hết cho “kỷ nguyên văn bản AI không thể chứng minh” khi các công cụ ngày càng buộc phải minh bạch về nguồn gốc nội dung.

Mô hình 3D chữ AI trên nền mạng lưới thần kinh minh họa trí tuệ nhân tạo

Vì sao Anthropic làm điều này?

Động thái của Anthropic đến từ yêu cầu pháp lý. EU AI Act yêu cầu các nhà cung cấp mô hình AI nền tảng phải đảm bảo nội dung tổng hợp được nhận diện được. Bằng cách chủ động triển khai watermark toàn cầu, Anthropic vừa tuân thủ quy định vừa thể hiện cam kết minh bạch.

Một số người cho rằng đây còn là chiến lược định vị thương hiệu: giữa cuộc đua AI khốc liệt, minh bạch trở thành điểm khác biệt của Anthropic so với OpenAI và các đối thủ khác.

Chi tiết kỹ thuật watermark

Khác với watermark truyền thống hiển thị logo hay chữ chìm trên ảnh, watermark của Anthropic hoạt động ở cấp độ mô hình. Kỹ thuật này nhúng tín hiệu ngẫu nhiên nhưng có kiểm soát vào quá trình sinh token của mô hình ngôn ngữ, tạo ra dấu hiệu thống kê mà mắt thường không thấy được nhưng thuật toán phát hiện có thể nhận ra. Với hình ảnh, kỹ thuật tương tự có thể áp dụng qua phương pháp nhúng tín hiệu trong pixel.

Ưu điểm lớn nhất của cách tiếp cận này là watermark không bị phá vỡ khi người dùng định dạng lại văn bản, thay đổi font chữ hay dán sang ứng dụng khác. Nhược điểm là chi phí tính toán tăng nhẹ và việc đảm bảo chất lượng văn bản sinh ra không bị suy giảm vẫn là thách thức.

So sánh với các hãng AI khác

OpenAI từng giới thiệu công cụ phát hiện văn bản AI nhưng đã gỡ bỏ vì độ chính xác không đạt yêu cầu. Google nghiên cứu kỹ thuật watermark SynthID cho hình ảnh và văn bản do AI tạo. Meta cũng thử nghiệm gắn nhãn nội dung AI trên các nền tảng mạng xã hội. Tuy nhiên, Anthropic là hãng đầu tiên triển khai watermark vô hình ở cấp độ mô hình cho toàn bộ sản phẩm của mình trên phạm vi toàn cầu, không cho phép người dùng tắt.

Ảnh hưởng đến người dùng Việt Nam

Người dùng Việt Nam dùng Claude cho công việc viết lách, dịch thuật, lập trình cũng sẽ bị ảnh hưởng. Nếu bạn đang dùng Claude để viết nội dung cho khách hàng hoặc bài tập học thuật, watermark vô hình có thể khiến nội dung bị phát hiện là do AI tạo ra khi kiểm tra bằng công cụ phát hiện.

Điều quan trọng là watermark vẫn còn rất mới và hiệu quả phát hiện phụ thuộc vào công cụ kiểm tra. Hiện chưa có thông tin chính thức về việc watermark có thể bị làm giả hay bỏ qua bằng kỹ thuật xử lý hậu kỳ.

Góc nhìn tương lai

Xu hướng watermark AI gần như chắc chắn sẽ lan rộng khi các quốc gia khác học theo EU. OpenAI, Google và Meta đều đã nghiên cứu kỹ thuật đánh dấu nội dung AI. Trong tương lai gần, việc xác định nguồn gốc nội dung sẽ trở thành tiêu chuẩn, thay đổi cách chúng ta đánh giá thông tin trên mạng.

Đối với người dùng thông thường, lời khuyên là minh bạch khi sử dụng AI trong công việc, đồng thời theo dõi sát các thay đổi chính sách để tránh rủi ro không đáng có.

Laptop hiển thị trình soạn thảo code tại bàn làm việc hiện đại

Tham khảo thêm:

Tôi là một lập trình viên IOS. Code chính là IOS nhưng thỉnnh thoảng vẫn đá sang Android hoặc web. Mặc dù không quá thông thạo nhưng tôi sẽ chia sẻ những kiến thức mà mình đã tìm hiểu, áp dụng qua.

Bài viết liên quan

Signal Protocol: Giao thức mã hóa end-to-end bảo mật nhất hiện nay

Signal Protocol là giao thức mã hóa end-to-end (E2EE) được sử dụng phổ biến nhất thế giới hiện nay. Phát triển bởi Trevor Perrin và Moxie Marlinspike vào năm 2013,…

Xem thêm

Claude 3.5 Sonnet ra mắt Computer Use – AI điều khiển máy tính như người

Anthropic Claude 3.5 Sonnet ra mắt tính năng Computer Use Claude 3.5 Sonnet của Anthropic đã chính thức ra mắt với tính năng Computer Use mạnh mẽ, cho phép mô…

Xem thêm

EU AI Act: Quy định pháp lý trí tuệ nhân tạo tại châu Âu

AI Act của Liên EU là gì? AI Act (chính thức là Đề nghị quy định của Hợp đồng Châu Âu về trí tuệ nhân tạo) là khung pháp lý…

Xem thêm
0 0 đánh giá
Article Rating
Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất