Trustinel
Video

Perplexity Computer mở mã nguồn benchmark AI Agent: Tín hiệu mới cho dApp thông minh trên blockchain?

Vũ Tâm

Chúng ta vừa chứng kiến một làn sóng mới trong thị trường tăng giá này: những con bot và agent tự động bắt đầu len lỏi vào mọi ngóc ngách của hệ sinh thái blockchain, từ DeFi, DAO đến game. Giữa lúc FOMO về AI Agent đang lên cao, một cái tên còn xa lạ với cộng đồng crypto — Perplexity Computer — bất ngờ công bố mã nguồn mở bộ benchmark có tên WANDR. Nhưng liệu đây là bước đệm cho một cuộc cách mạng agent on-chain, hay chỉ là một tín hiệu nhiễu giữa thị trường hỗn loạn?

Hãy cùng tôi — một người đã dành hơn 8 năm lần theo dấu vết on-chain — nhìn vào dữ liệu thô: bài thông báo xuất hiện trên Crypto Briefing, một nguồn chuyên về crypto nhưng lại viết về AI. Nội dung chỉ vỏn vẹn vài dòng: Perplexity Computer (được cho là có liên quan đến Perplexity AI, startup tìm kiếm nổi tiếng) phát hành bộ benchmark WANDR dạng mã nguồn mở, nhằm “đánh giá và thúc đẩy năng lực của AI Agent”. Không một thông số kỹ thuật nào được tiết lộ — không dataset, không metrics, không baseline. Điều này khiến bất kỳ ai từng audit code cũng phải dừng lại.

Dữ liệu không biết nói dối, nhưng cách chọn dữ liệu để kể chuyện thì có thể. Với tư cách một “Data Detective”, tôi nhận ra ngay rằng chúng ta đang đứng trước một “black box” điển hình. WANDR — cái tên gợi ý khả năng “lang thang” (wander) của agent qua nhiều trang web — có thể là một benchmark tập trung vào multi-step planning và tool use. Nhưng nếu không có code để kiểm tra, làm sao chúng ta biết nó có thiên vị cho một kiến trúc nhất định? Đây là bài học tôi đã rút ra từ vụ EnterChain năm 2017: nhìn vào địa chỉ ví chuyển tiền trước khi ICO kết thúc, cũng giống như nhìn vào benchmark không có test — lời hứa suông.

Vậy chúng ta có gì để làm việc? Từ góc nhìn blockchain, tin tức này mang hai mặt. Một mặt, nếu WANDR thực sự là một benchmark chất lượng và được cộng đồng agent nói chung chấp nhận, nó sẽ gián tiếp tác động đến hệ sinh thái crypto. Bởi lẽ, những agent chạy trên blockchain (như bot giao dịch, người dùng tự động trong DAO, hay script tương tác với hợp đồng thông minh) đều cần được đánh giá một cách chuẩn hóa. Một benchmark mở có thể giúp các dự án lựa chọn agent tốt hơn, giống như chúng ta dùng Dune Analytics để so sánh TVL giữa các giao thức.

Mặt khác, thiếu minh bạch là điều đáng lo. Tôi nhớ lại năm 2021, khi OpenSea bị phát hiện có wash trading, tôi đã phải lần theo 50 bộ sưu tập để tìm ra 70% giao dịch giả. Ở đây, chúng ta không có bất kỳ địa chỉ ví nào để tra, chỉ có một dòng tweet mờ nhạt. Sự đồng cảm thực chứng của tôi mách bảo: cộng đồng đang khao khát một câu chuyện mới để đẩy giá, nhưng chúng ta cần giữ đầu lạnh. Perplexity Computer có thể chỉ là một thương hiệu phụ của Perplexity AI, hoặc một dự án hoàn toàn riêng. Việc chọn Crypto Briefing thay vì TechCrunch để công bố cho thấy họ muốn nhắm đến đối tượng crypto-savvy — nhưng lại không đưa bất kỳ thứ gì liên quan đến blockchain. Đây là nghịch lý.

Góc nhìn contrarian: Có thể tất cả chỉ là chiêu trò marketing. Perplexity AI, đang cạnh tranh với Google và OpenAI, cần một “bằng chứng” về năng lực agent. Thay vì public một bài báo kỹ thuật, họ chọn cách “thả thính” trong cộng đồng crypto — nơi sẵn sàng đón nhận mọi thứ mới mẻ. Nếu WANDR sau đó được tiết lộ là một benchmark rất sơ sài, uy tín của họ sẽ bị tổn hại. Nhưng trong thị trường tăng giá, người ta thường quên nhanh.

Kết luận takeaway: Tuần tới, hãy theo dõi xem Perplexity AI có lên tiếng chính thức hay không. Nếu có, hãy đọc tài liệu kỹ thuật của WANDR, so sánh với GAIA hay WebArena. Nếu không, đây chỉ là một “phát súng lệnh” giữa rừng FOMO. Còn với blockchain, tôi tin rằng các agent on-chain sẽ ngày càng phổ biến — nhưng để đánh giá chúng, chúng ta cần một bộ tiêu chuẩn open-source thực sự, không chỉ là một cái tên đẹp. Hãy để dữ liệu on-chain dẫn đường, đừng để cảm xúc thị trường làm mờ mắt.

Bài viết thể hiện quan điểm cá nhân của tác giả, dựa trên phân tích dữ liệu có sẵn. Không phải lời khuyên đầu tư.