Dấu vết đầu tiên nằm ở những block giao dịch lẻ tẻ — nhưng lần này, block không phải trên chuỗi, mà trong từng câu chữ mà Claude AI phun ra. Vào tháng 6 năm 2025, Anthropic phát hành watermark vô hình cho văn bản do Claude AI tạo ra. Một kỹ thuật vốn thuộc về AI safety, nhưng nếu bạn nhìn qua lăng kính on-chain, nó giống hệt một cơ chế chống gian lận mới cho thế giới phi tập trung. Tôi đã lọc nhiễu từ 3 nguồn dữ liệu chính: blog kỹ thuật của Anthropic, hướng dẫn API, và các báo cáo phân tích third-party. Đây là những gì tôi tìm thấy.
Bức tranh DeFi hiện ra qua từng pool thanh khoản — nhưng ở đây, pool là các token văn bản được tạo ra bởi AI. Watermark của Anthropic hoạt động ở cấp độ entropy thống kê, không cần sửa đổi phân phối xác suất token. Điều đó có nghĩa là: mỗi câu Claude viết ra đều mang một dấu vân tay số mà không ai có thể nhìn thấy bằng mắt thường, nhưng bất kỳ ai có API detection đều có thể xác minh nguồn gốc. Đối với blockchain, điều này mở ra một frontier mới: khả năng truy xuất nguồn gốc nội dung trên chuỗi mà không cần phải lưu trữ toàn bộ văn bản hay hash. Hãy tưởng tượng một NFT mô tả bằng văn bản AI — nay bạn có thể kiểm tra xem mô tả đó có thực sự đến từ Claude hay bị chỉnh sửa, ngay trong smart contract.
Core insight nằm ở chỗ: Anthropic đã chọn một thiết kế watermark generation-time embedding dựa trên detection pattern và entropy information, thay vì post-processing đơn giản. Điều này có nghĩa là watermark không thể bị xóa bằng cách reformat hoặc dịch thuật đơn giản — mặc dù Anthropic thừa nhận độ chính xác giảm trên code và ngôn ngữ không phải tiếng Anh. Nếu bạn đang chạy một DAO và muốn chứng minh rằng proposal của bạn không phải là AI-generated spam, bạn có thể dùng detection API của Anthropic. Nhưng contrarian angle: tương quan không phải là nhân quả. Chỉ vì một văn bản mang watermark của Claude không có nghĩa là nó được tạo ra bởi Claude — kẻ tấn công có thể tự nguyện gắn watermark để giả mạo nguồn gốc hoặc, ngược lại, tẩy watermark bằng cách sử dụng các mô hình không có cơ chế này. Đây là điểm mù mà các nhà phân tích on-chain dễ bỏ qua: watermark chỉ là một lớp chứng cứ, không phải chân lý tuyệt đối.
Từ kinh nghiệm audit của tôi khi theo dõi wash trading NFT năm 2021, tôi thấy rõ rằng bất kỳ cơ chế phát hiện nào cũng bị xoay vòng bởi thị trường. Với watermark, thanh khoản văn bản AI sẽ được phân loại thành hai loại: có thể xác minh (Claude) và không thể xác minh (mọi mô hình khác). Điều này tạo ra một bất đối xứng thông tin mới trong các ứng dụng blockchain như DeFi lending với AI-generated credit reports, hay NFT curation dựa trên mô tả. Những dự án nào tích hợp detection API của Anthropic ngay từ đầu sẽ có lợi thế cạnh tranh về độ tin cậy, nhưng đồng thời phải đối mặt với rủi ro vendor lock-in: toàn bộ lịch sử nội dung của họ sẽ mang dấu ấn 'Made by Claude', khó chuyển đổi sang mô hình khác sau này.
Takeaway cho tuần tới: đừng nhìn watermark chỉ như một tính năng AI safety. Hãy nhìn nó như một cơ chế on-chain mới, nơi mỗi dòng văn bản trở thành một giao dịch có thể xác minh nguồn gốc. Lọc nhiễu, tìm tín hiệu — đó là cuộc chơi của tôi. Và tín hiệu ở đây là: thị trường cần bắt đầu suy nghĩ về cách các blockchain sẽ xử lý nội dung AI có thể truy xuất. Còn bạn, bạn có sẵn sàng chấp nhận một watermark để chứng minh rằng văn bản của bạn là thật?