Tôi đang kiểm tra log của một node Ethereum trên testnet Sepolia thì thấy một giao dịch bất thường: một hợp đồng thông minh gọi đến một oracle lạ, trả về một hash mà tôi nhận ra ngay – đó là mã hash của một mô hình AI nổi tiếng của Meta, Llama 3. Tôi không tin vào mắt mình. Làm sao một mô hình AI, vốn được cho là an toàn sau tường lửa của Meta, lại có thể xuất hiện trên blockchain? Tôi lập tức kiểm tra lại nguồn gốc của giao dịch. Địa chỉ hợp đồng là một cái tên ẩn danh, không có lịch sử. Giao dịch này không phải là một cuộc tấn công – nó là một bằng chứng: mô hình AI của Meta đã bị rò rỉ, và blockchain đang trở thành kênh phân phối mới cho các mô hình bị đánh cắp. Đây không phải là lần đầu tiên tôi thấy một 'dấu chân trong code' như thế này. Từ ICO đến NFT, mỗi lần thị trường nóng lên, đều để lại dấu chân trong code. Và lần này, AI cũng không ngoại lệ.
Bối cảnh: Sự kiện rò rỉ mô hình AI của Meta đã được báo cáo rộng rãi, nhưng hầu hết các bài báo đều thiếu chi tiết kỹ thuật. Họ nói về 'breach', 'leak', nhưng không ai nói rõ rò rỉ cái gì, ở đâu, và như thế nào. Là một Core Protocol Developer, tôi đã từng audit hàng chục smart contract, và tôi biết rằng thông tin kỹ thuật mới là thứ quyết định mức độ nghiêm trọng. Meta, với chiến lược open-source Llama, đã từng gặp sự cố tương tự vào năm 2023 khi Llama 1 bị rò rỉ qua Hugging Face. Lần đó, cộng đồng đã nhanh chóng tạo ra các biến thể 'uncensored', loại bỏ các lớp bảo vệ. Nhưng lần này, có một điểm khác biệt: mô hình rò rỉ không chỉ là weight file, mà còn có cả checkpoint và training data – theo những gì tôi thấy trên blockchain. Điều này mở ra một bề mặt tấn công hoàn toàn mới. Và blockchain, với tính chất bất biến và minh bạch, đang trở thành công cụ để phát tán các mô hình này một cách không thể kiểm soát.
Phân tích kỹ thuật: Hãy nhìn vào dòng code. Tôi đã phân tích hợp đồng thông minh trên testnet. Nó sử dụng một cơ chế lưu trữ phân tán – IPFS – để lưu trữ các chunk của mô hình. Mỗi giao dịch chứa một hash CID, và hợp đồng có một hàm assemble để ghép chúng lại. Điều này có nghĩa là bất kỳ ai cũng có thể tải xuống mô hình đầy đủ chỉ bằng cách gọi vài giao dịch. Chi phí? Khoảng 0.1 ETH trên testnet – tương đương vài đô la. So với việc training một mô hình Llama 3 70B tốn hàng triệu đô la, thì đây là một vụ trộm cắp với chi phí gần như bằng không. Từ góc nhìn bảo mật, đây là một thảm họa. Khi mô hình rời khỏi tay Meta, tất cả các lớp bảo vệ alignment (RLHF, DPO) đều trở nên vô dụng. Kẻ tấn công có thể fine-tune mô hình để tạo ra deepfake, mã độc, hoặc thậm chí tấn công mạng. Tôi đã thấy điều này xảy ra với Llama 1 vào năm 2023. Nhưng lần này, sự hiện diện của blockchain khiến việc truy vết trở nên khó khăn hơn, vì giao dịch có thể được tạo ra từ bất kỳ đâu, và không có cơ quan trung tâm nào có thể xóa bỏ dữ liệu.
Tôi đã từng thử nghiệm AMM trên testnet năm 2020, và tôi biết rằng việc chạy một mô hình trên blockchain là hoàn toàn khả thi. Tuy nhiên, điều tôi thấy ở đây còn nguy hiểm hơn: không chỉ là mô hình, mà còn là toàn bộ hệ sinh thái xung quanh. Hợp đồng thông minh này có một hàm donate để nhận ETH, gợi ý rằng người tạo ra đang kiếm tiền từ việc phân phối mô hình. Đây là một mô hình kinh doanh mới: bán các mô hình AI bị đánh cắp thông qua blockchain. Từ ICO đến NFT, rồi đến AI: mỗi lần hype mới, đều để lại dấu chân trong code. Và lần này, dấu chân đó là một vết máu.

Contrarian Angle: Trong khi mọi người đang hoảng sợ về việc mô hình bị rò rỉ, tôi thấy một cơ hội nghịch lý: sự kiện này có thể thúc đẩy sự phát triển của các giải pháp bảo mật phi tập trung. Các công ty như Meta sẽ phải đối mặt với áp lực phải bảo vệ mô hình của mình tốt hơn, nhưng các giải pháp tập trung hiện tại (firewall, access control) đã thất bại. Điều này mở ra cánh cửa cho các công nghệ như confidential computing, TEE, và đặc biệt là zk-proofs. Tôi đã từng nghiên cứu về cầu nối cross-chain sử dụng AI vào năm 2026, và tôi thấy rằng zk-proofs có thể được dùng để chứng minh rằng một mô hình đã được training đúng cách mà không cần tiết lộ weight. Nhưng đó là tương lai. Còn hiện tại, sự kiện này cho thấy một điểm mù trong bảo mật AI: các mô hình không chỉ bị đánh cắp qua hacker, mà còn qua chính hệ thống phân phối open-source. Meta muốn open-source để xây dựng hệ sinh thái, nhưng chính sự mở đó lại tạo ra lỗ hổng. Đây là một bài toán khó: làm sao để vừa mở, vừa an toàn? Tôi tin rằng blockchain, với tính chất minh bạch, có thể là một phần của giải pháp – nhưng nếu không được quản lý đúng cách, nó cũng có thể là vũ khí.

Takeaway: Sự kiện rò rỉ mô hình AI của Meta, khi được nhìn qua lăng kính blockchain, không chỉ là một vụ vi phạm bảo mật, mà là một bước ngoặt trong cách chúng ta nghĩ về tài sản kỹ thuật số. Mô hình AI bây giờ cũng giống như một smart contract: một khi được deploy lên blockchain, nó là bất biến và không thể thu hồi. Câu hỏi đặt ra là: Liệu chúng ta có sẵn sàng để đối mặt với một thế giới nơi các mô hình AI độc hại có thể được giao dịch tự do trên các sàn DEX? Nếu câu trả lời là không, thì chúng ta cần bắt đầu xây dựng các giao thức quản lý danh tính và phân quyền cho AI ngay từ bây giờ. Từ ICO đến NFT, mỗi lần đều để lại dấu chân trong code. Và lần này, dấu chân đó đang dẫn đến một vực thẳm.