Trustinel
Ethereum

Cuộc chiến nội bộ tại Anthropic: Đóng hay mở mã nguồn AI? Bài học cho blockchain

Võ Dũng

Hook

Ngày 12 tháng 3 năm 2025, một bài báo từ Beating Monitoring tiết lộ điều chấn động: CEO của Anthropic, Dario Amodei, thừa nhận trong một cuộc họp kín rằng công ty chưa từng có ý định mở mã nguồn các mô hình Claude. Ngay lập tức, Shaun, một nhà nghiên cứu hậu huấn luyện tại đây, đã phản đối công khai trên mạng xã hội, cho rằng quyết định này đi ngược lại với sứ mệnh "AI an toàn cho nhân loại". Sự kiện này không chỉ là drama nội bộ của một công ty AI. Nó là tấm gương phản chiếu cuộc tranh luận đang âm ỉ trong thế giới blockchain: liệu mã nguồn mở có thực sự là con đường duy nhất dẫn đến phân quyền và bảo mật, hay nó chỉ là một ảo tưởng nguy hiểm?

Context

Anthropic, được thành lập bởi các cựu nhân viên OpenAI, tuyên bố sứ mệnh xây dựng AI an toàn. Họ phát triển các mô hình như Claude, sử dụng phương pháp Hiến pháp AI để căn chỉnh hành vi. Tuy nhiên, khi các đối thủ như Meta (với Llama 3.1) và Mistral mở mã nguồn, Anthropic vẫn giữ kín. Lý do chính thức: "Một khi trọng số mô hình bị công khai, không thể thu hồi; các biện pháp an toàn có thể bị gỡ bỏ." Nhưng nhân viên như Shaun lại thấy điều này là sự phản bội tinh thần minh bạch. Cuộc xung đột này mang đậm dấu ấn của một cuộc chiến ý thức hệ: kiểm soát tập trung vs. niềm tin cộng đồng, tương tự như cuộc tranh luận giữa Bitcoin (mã nguồn mở, phi tập trung) và các nền tảng đóng như Visa.

Trong blockchain, mã nguồn mở là nền tảng. Bitcoin, Ethereum, tất cả đều công khai để bất kỳ ai cũng có thể kiểm tra. Nhưng các dự án DeFi gần đây, như Uniswap v4 hay các Layer2, bắt đầu giữ lại một số thành phần độc quyền. Lý do: bảo vệ lợi thế cạnh tranh và ngăn chặn fork độc hại. Anthropic đang đối mặt với cùng một câu hỏi: khi nào thì sự an toàn đòi hỏi sự khép kín, và khi nào sự khép kín chỉ là cái cớ cho quyền lực tập trung?

Core

Hãy phân tích lập luận của CEO Dario Amodei. Ông nói: "Trọng số mô hình, một khi công khai, không thể thu hồi. Các biện pháp an toàn chỉ là lớp bên ngoài, có thể dễ dàng bị gỡ bỏ." Điều này hoàn toàn chính xác về mặt kỹ thuật. Trong blockchain, tương tự, smart contract khi triển khai là bất biến. Một khi mã nguồn được công bố, bất kỳ ai cũng có thể fork và loại bỏ các cơ chế khóa, mint thêm token, hoặc thay đổi logic. Đó là lý do tại sao các dự án như Tornado Cash đã gặp vấn đề: mã nguồn mở cho phép kẻ xấu sao chép và triển khai phiên bản không có biện pháp chống rửa tiền.

Nhưng lập luận của Shaun mới thú vị. Anh cho rằng: "Sự an toàn thực sự đến từ khả năng kiểm tra của cộng đồng. Một mô hình đóng kín giống như một hộp đen – ngay cả đội ngũ phát triển cũng có thể bỏ sót lỗ hổng, nhưng cộng đồng toàn cầu có thể tìm ra chúng nếu có quyền truy cập." Đây chính là triết lý của "Nhiều con mắt, ít lỗi" (Linus's Law) trong phát triển phần mềm nguồn mở. Trong blockchain, điều này đã được chứng minh qua vô số audit cộng đồng: lỗ hổng trong hợp đồng thông minh thường được phát hiện nhanh hơn khi mã nguồn mở.

Tuy nhiên, có một điểm mù quan trọng. Shaun là nhà nghiên cứu hậu huấn luyện, nghĩa là anh làm việc với các lớp căn chỉnh bên ngoài mô hình. Anh có thể không nhìn thấy bức tranh toàn cảnh về các cuộc tấn công tinh vi hơn, như jailbreak thông qua các prompt đặc biệt. Khi trọng số mở, kẻ tấn công có thể thực hiện fine-tune để vô hiệu hóa hoàn toàn mọi căn chỉnh. Điều này tương tự như việc mở mã nguồn của một giao thức DeFi: kẻ tấn công có thể fork và triển khai với các tham số khác, dẫn đến thao túng thị trường. Nhưng trong blockchain, điều này không phải lúc nào cũng xấu – nó cho phép cạnh tranh lành mạnh và cải tiến.

Từ góc nhìn của tôi, với 5 năm kinh nghiệm trong blockchain, tôi thấy cuộc tranh luận này đang thiếu một yếu tố then chốt: bối cảnh. Không có giải pháp nào phù hợp cho tất cả. Một mô hình AI mạnh mẽ, có khả năng tạo ra vũ khí sinh học hoặc tấn công mạng, có thể cần sự kiểm soát chặt chẽ hơn. Tương tự, một giao thức blockchain xử lý hàng tỷ USD có thể cần các lớp bảo mật bổ sung không hoàn toàn mở. Nhưng việc đóng kín hoàn toàn là một sai lầm về mặt triết học và thực tiễn.

Hãy nhìn vào lịch sử. ICO là bài học, không phải là tương lai. Năm 2017, hàng loạt dự án ICO với whitepaper đẹp đẽ, mã nguồn đóng, đã lừa đảo hàng triệu USD. Khi mã nguồn mở, cộng đồng có thể phát hiện backdoor. Một vài dự án thực sự có giá trị đã tồn tại nhờ sự minh bạch. Anthropic, nếu đóng kín, sẽ lặp lại sai lầm đó. Họ sẽ trở thành một "hộp đen" mà xã hội phải tin tưởng một cách mù quáng.

Một góc nhìn khác: chi phí chứng minh (proof cost). Trong AI, việc mở trọng số có thể làm tăng chi phí bảo mật lên gấp nhiều lần vì phải liên tục vá lỗ hổng. Trong blockchain, chi phí tương tự là chi phí audit và bảo trì. Nhưng các dự án mã nguồn mở như Bitcoin đã chứng minh rằng cộng đồng có thể tự tổ chức để giảm chi phí đó thông qua phân tán trách nhiệm.

Contrarian

Đây là lúc áp dụng góc nhìn phản trực giác. Nhiều người cho rằng mã nguồn mở đồng nghĩa với an toàn hơn. Nhưng thực tế, các lỗ hổng zero-day thường tồn tại lâu hơn trong các dự án mã nguồn mở vì không có ai chịu trách nhiệm sửa chữa nhanh chóng. Trong blockchain, câu chuyện về DAO hack năm 2016 là một ví dụ: mã nguồn mở của DAO đã được kiểm tra, nhưng lỗ hổng reentrancy vẫn bị khai thác. Mã nguồn mở không tự động đảm bảo bảo mật; nó chỉ làm cho việc phát hiện lỗ hổng trở nên dễ dàng hơn, nhưng việc vá lỗi lại khó hơn vì cần sự đồng thuận.

Với Anthropic, một lập luận thường bị bỏ qua: mở một phần. Họ có thể mở các mô hình yếu hơn (như Claude 3 Haiku) và giữ kín các mô hình mạnh (như Claude 3 Opus). Nhưng nhân viên Shaun có thể phản đối vì điều này tạo ra sự phân cấp tri thức. Trong blockchain, điều này tương đương với việc mở mã nguồn cho các hợp đồng thông minh cơ bản nhưng giữ kín thuật toán đồng thuận độc quyền. Điều đó làm suy yếu tính phi tập trung.

Một điểm mù khác từ phía CEO: ông ta tin rằng các biện pháp an toàn bên ngoài có thể bị gỡ bỏ dễ dàng. Nhưng điều đó cũng đúng với các biện pháp an toàn bên trong nếu kẻ tấn công có đủ nguồn lực. Thực tế, việc căn chỉnh mô hình thông qua hiến pháp AI vẫn có thể bị phá vỡ ngay cả khi không có mã nguồn mở, thông qua các kỹ thuật như prompt injection. Vì vậy, an toàn thực sự cần một lớp kiểm toán độc lập, và điều đó chỉ có thể với mã nguồn mở.

Từ kinh nghiệm audit của tôi trong DeFi, tôi nhận thấy: những dự án có mã nguồn mở và cộng đồng kiểm toán tích cực thường ít bị hack hơn những dự án đóng kín. Vì các hacker thích nhắm vào mục tiêu không có ai giám sát. NFT: từ biểu tượng đến vết thương. Cũng vậy, mã nguồn đóng biến một công cụ tiềm năng thành vết thương của lòng tin.

Takeaway

Cuộc nổi dậy nội bộ tại Anthropic không chỉ là chuyện của một công ty AI. Nó là hồi chuông cảnh tỉnh cho toàn bộ ngành blockchain: chúng ta phải lựa chọn giữa sự kiểm soát tập trung ẩn dưới chiêu bài "an toàn" và sự minh bạch có thể gây khó chịu nhưng lại là nền tảng của niềm tin. Câu hỏi không phải là "mở hay đóng", mà là "mở như thế nào và cho ai". Những người theo chủ nghĩa truyền giáo như tôi tin rằng: tương lai không thuộc về những kẻ giữ bí mật, mà thuộc về những người dám chia sẻ quyền lực. Và trong blockchain, cũng như trong AI, bài học lớn nhất là: sự an toàn thực sự đến từ việc không ai có quyền lực tuyệt đối.

Hãy xây cộng đồng, đừng xây đế chế.