Ngọc Yến✔
Writer
Anthropic đang triển khai watermark cho văn bản do một số mô hình Claude tạo ra nhằm đáp ứng yêu cầu minh bạch của Đạo luật AI của EU. Điều đáng chú ý là đây không phải một dấu hiệu nhìn thấy trên văn bản mà là watermark ẩn được tạo ngay trong quá trình Claude lựa chọn từ.
Cụ thể Claude vẫn tạo câu chữ bình thường nhưng hệ thống sẽ điều chỉnh xác suất lựa chọn một số từ dựa trên “chìa khóa” bí mật. Những lựa chọn này tạo thành một mẫu thống kê mà công cụ kiểm tra có thể dùng để xác định khả năng văn bản được tạo bởi Claude.
Vì vậy nếu mục tiêu là tránh watermark, việc tìm một công cụ đơn giản để “xóa watermark Claude” có thể không phải giải pháp hiệu quả. Các công cụ thay từ, đảo câu hay “người hóa” văn bản chỉ tác động lên phần đầu ra, trong khi watermark được hình thành từ chính quá trình sinh văn bản.

Cách thực tế hơn là không sử dụng nguyên văn nội dung Claude tạo ra. Có thể dùng Claude để tìm ý tưởng, nghiên cứu, xây dựng cấu trúc hoặc tạo bản nháp, sau đó con người tự viết lại, bổ sung quan điểm, thay đổi cách lập luận và diễn đạt theo văn phong của mình. Khi đó, sản phẩm cuối cùng không còn đơn thuần là đầu ra nguyên bản của Claude.
Điều này cũng cho thấy một vấn đề lớn hơn: người dùng không nên mặc định rằng AI là một công cụ hoàn toàn phục vụ theo ý mình. Claude là sản phẩm của Anthropic và có thể thay đổi mô hình, chính sách hoặc cách xử lý nội dung bất cứ lúc nào. Vì vậy, cách tốt nhất để giữ quyền kiểm soát nội dung không phải là chạy theo các công cụ “phá watermark”, mà là giữ con người trong quá trình tạo ra sản phẩm cuối cùng.
Cụ thể Claude vẫn tạo câu chữ bình thường nhưng hệ thống sẽ điều chỉnh xác suất lựa chọn một số từ dựa trên “chìa khóa” bí mật. Những lựa chọn này tạo thành một mẫu thống kê mà công cụ kiểm tra có thể dùng để xác định khả năng văn bản được tạo bởi Claude.
Vì vậy nếu mục tiêu là tránh watermark, việc tìm một công cụ đơn giản để “xóa watermark Claude” có thể không phải giải pháp hiệu quả. Các công cụ thay từ, đảo câu hay “người hóa” văn bản chỉ tác động lên phần đầu ra, trong khi watermark được hình thành từ chính quá trình sinh văn bản.

Cách thực tế hơn là không sử dụng nguyên văn nội dung Claude tạo ra. Có thể dùng Claude để tìm ý tưởng, nghiên cứu, xây dựng cấu trúc hoặc tạo bản nháp, sau đó con người tự viết lại, bổ sung quan điểm, thay đổi cách lập luận và diễn đạt theo văn phong của mình. Khi đó, sản phẩm cuối cùng không còn đơn thuần là đầu ra nguyên bản của Claude.
Điều này cũng cho thấy một vấn đề lớn hơn: người dùng không nên mặc định rằng AI là một công cụ hoàn toàn phục vụ theo ý mình. Claude là sản phẩm của Anthropic và có thể thay đổi mô hình, chính sách hoặc cách xử lý nội dung bất cứ lúc nào. Vì vậy, cách tốt nhất để giữ quyền kiểm soát nội dung không phải là chạy theo các công cụ “phá watermark”, mà là giữ con người trong quá trình tạo ra sản phẩm cuối cùng.