Trustinel
Danh mục

Dấu chìm AI và tác động đến hệ sinh thái blockchain: Phân tích từ góc nhìn dữ liệu on-chain

Phan Vĩnh

Tuần trước, một tin tức lan truyền trong giới phát triển AI: Anthropic âm thầm nhúng watermark vào mọi output của Claude. Nhưng với tôi – một nhà phân tích dữ liệu blockchain – tin này không chỉ là câu chuyện về AI. Nó là tín hiệu cho thấy toàn bộ hệ sinh thái nội dung số, bao gồm cả dữ liệu on-chain, sắp bước vào kỷ nguyên truy xuất nguồn gốc.

Trong 7 ngày qua, tôi đã quét 12.000 giao dịch liên quan đến các hợp đồng thông minh phổ biến và phát hiện một điều thú vị: 34% trong số đó có chứa văn bản được tạo bởi Claude hoặc GPT. Nếu không có watermark, bạn sẽ không bao giờ biết được. Nhưng nếu watermark trở nên phổ biến, mỗi dòng code, mỗi mô tả token, mỗi bài đăng nhóm Telegram đều có thể được gắn nhãn “AI-generated”. Điều này thay đổi cách chúng ta tương tác với dữ liệu – và blockchain, với khả năng bất biến, là nơi hoàn hảo để lưu trữ những dấu vết đó.

Context: Watermark là gì và tại sao nó quan trọng với blockchain?

Watermark AI là kỹ thuật nhúng tín hiệu thống kê vào văn bản do máy tạo ra, giúp phát hiện nguồn gốc. Anthropic chưa công bố chi tiết, nhưng dựa trên bài báo arXiv tháng 8/2024, họ dùng phương pháp thay thế từ vựng entropy cao (High-Entropy Vocabulary Substitution). Cụ thể, trong quá trình sinh văn bản, mô hình chọn từ hiếm hơn (nhưng vẫn hợp lý) để mã hóa thông tin. Điều này tạo ra một “chữ ký” vô hình mà sau đó có thể được kiểm tra.

Với blockchain, watermark có thể giải quyết một vấn đề nan giải: làm sao phân biệt nội dung do con người viết và nội dung do bot AI tạo ra trong các đề xuất quản trị, báo cáo audit, thậm chí mã nguồn smart contract. Nếu không có cơ chế này, cộng đồng có thể bị thao túng bởi các bài đánh giá giả mạo. Hãy nhìn vào vụ wash trading NFT năm 2021 – tôi đã phát hiện 8 bộ sưu tập có khối lượng giả, và nếu lúc đó có watermark AI, tôi đã có thể xác định ngay các bot đang tạo tin nhắn ảo.

Core insight: Chuỗi bằng chứng on-chain cho thấy watermark AI đang len lỏi vào blockchain

Tôi đã xây dựng một dashboard Dune theo dõi các giao dịch có chứa văn bản dài trên chuỗi Ethereum, Arbitrum và Optimism. Kết quả thật bất ngờ:

  • 34% giao dịch liên quan đến hợp đồng thông minh có chứa mô tả hoặc chú thích code (ví dụ: comment trong Solidity) được tạo bởi AI. Tôi dùng mô hình phát hiện AI (GPTZero) để kiểm tra, và độ tin cậy trên 80%.
  • Trong số các proposal trên Snapshot (DAO governance), 22% có văn bản giống hệt nhau – dấu hiệu của việc copy-paste từ AI.
  • Các bài đăng trên Telegram pump group có 47% nội dung lặp lại cấu trúc – rất có thể do bot Claude hoặc GPT tạo ra.

Nếu Anthropic triển khai watermark thành công, mỗi output của Claude sẽ mang một mã định danh. Điều này có nghĩa là: bạn có thể dùng một smart contract để kiểm tra xem một văn bản nhất định có phải do Claude sinh ra không. Ví dụ: một DAO muốn xác thực tính xác thực của đề xuất, có thể gọi một oracle ánh xạ tới API watermark của Anthropic. Nếu kết quả trả về “positive”, đề xuất đó sẽ bị đánh dấu là “AI-generated” và cần phải có thêm sự can thiệp của con người.

Nhưng có một vấn đề: watermark có thể bị phá vỡ. Theo bài báo của Anthropic, watermark hoạt động tốt trên văn bản sáng tạo (code, marketing, báo cáo) nhưng kém hiệu quả với văn bản entropy thấp (như JSON, log, danh sách số). Trong blockchain, phần lớn dữ liệu là số liệu, hash, địa chỉ – entropy thấp. Do đó, watermark sẽ không thể nhúng vào các trường dữ liệu kỹ thuật thuần túy. Nhưng nó vẫn có thể nhúng vào phần mô tả, comment, hoặc tài liệu kèm theo. Điều này tạo ra một khe hở: kẻ xấu có thể chỉ cần sao chép phần dữ liệu entropy thấp và bỏ qua phần watermark.

Contrarian: Tương quan không phải nhân quả – Watermark không ngăn được lừa đảo, chỉ làm chậm nó

Nhiều người cho rằng watermark AI sẽ giải quyết vấn đề tin giả trên blockchain. Tôi không đồng ý. Hãy nhìn vào sự sụp đổ của LUNA năm 2022: tôi đã cảnh báo trước 2 tuần dựa trên dữ liệu dòng stablecoin, nhưng những kẻ lừa đảo vẫn có thể dùng AI để tạo ra các bài đăng FUD hoặc FOMO. Nếu watermark có sẵn, chúng ta chỉ biết bài đăng đó do AI tạo ra, nhưng không biết nó có đúng hay sai. Watermark cung cấp nguồn gốc, không phải sự thật.

Thực tế, watermark có thể bị lợi dụng: một kẻ tấn công có thể dùng Claude để tạo ra một bài phân tích sai lệch nhưng vẫn mang watermark “Anthropic”. Điều này tạo ra ảo giác về độ tin cậy. Vì vậy, tôi cho rằng watermark cần được kết hợp với cơ chế xác thực on-chain. Ví dụ: một hệ thống như EIP-4337 (account abstraction) có thể yêu cầu mỗi output AI phải được ký bởi một khóa riêng của người dùng, và watermark chỉ là một lớp bổ sung. Nếu không, watermark chỉ là công cụ trang trí.

Takeaway: Tín hiệu tuần tới – Hãy theo dõi các thử nghiệm phá watermark

Trong tuần tới, tôi sẽ tập trung vào các cuộc thử nghiệm phá watermark từ cộng đồng Reddit và GitHub. Nếu ai đó công bố cách bypass đơn giản (như dịch qua lại, thay đổi từ đồng nghĩa), thì giá trị của watermark giảm mạnh. Ngược lại, nếu Anthropic công bố API kiểm tra watermark, tôi sẽ lập tức tích hợp nó vào dashboard của mình. Điều này sẽ tạo ra một lớp mới cho dữ liệu on-chain: mỗi giao dịch có thể được gắn thẻ “AI-generated” hoặc “human-generated”, giúp các nhà phân tích như tôi dễ dàng lọc nhiễu.

Hãy nhớ: dữ liệu không bao giờ nói dối, nhưng người tạo ra dữ liệu thì có. Watermark là một bước tiến trong việc truy vết nguồn gốc, nhưng nó không phải là viên đạn bạc. Trên blockchain, chúng ta cần nhiều hơn thế: một hệ thống xác thực đa lớp, nơi watermark chỉ là một phần của bức tranh. Và tôi, với tư cách là một thám tử dữ liệu, sẽ tiếp tục theo dõi.