25.000 tài khoản giả. Không, đây không phải số ví tôi phát hiện trong vụ wash trading NFT năm 2021 - khi 30% khối lượng OpenSea hóa ra chỉ là trò tự giao dịch chéo của 5 ví. Đây là số tài khoản mà Anthropic cáo buộc Alibaba sử dụng để bí mật "chưng cất" năng lực của Claude - mô hình AI hàng đầu thế giới. Cùng một kịch bản, chỉ khác "token" lần này là tri thức nhân tạo. Tôi đã dành 27 năm quan sát thị trường, và có một điều không bao giờ thay đổi: kẻ đi sau luôn tìm cách rút ruột người đi trước. Hôm nay, vụ việc này là câu chuyện về hai gã khổng lồ, nhưng cũng là câu chuyện về chính blockchain của chúng ta.
Model distillation là phương pháp dùng đầu ra từ mô hình lớn ("giáo viên") để huấn luyện mô hình nhỏ hơn ("học sinh"). Hợp pháp nếu có giấy phép. Bất hợp pháp nếu âm thầm làm qua API. Anthropic cho rằng Alibaba đã dùng 25.000 tài khoản ảo để gửi hàng triệu request, thu thập phản hồi từ Claude rồi dùng chính dữ liệu đó để cải thiện Qwen. Về kỹ thuật, đây là "hộp đen chưng cất" - bạn không cần biết trọng số bên trong, chỉ cần quan sát đầu vào - đầu ra là đủ.
Nhìn từ góc độ blockchain, tôi thấy cấu trúc của vụ này quen thuộc đến kỳ lạ. Năm 2017, tôi phân tích dữ liệu on-chain của hơn 50 dự án ICO và phát hiện một dự án có 40% token bị chuyển vào địa chỉ không liên quan đến đội ngũ phát triển. Quỹ của tôi tránh được 5 triệu USD. Giờ đây, 25.000 tài khoản kia chính là những "địa chỉ lạ". Câu hỏi không phải là "Anthropic có phát hiện đúng không", mà là "bằng chứng của họ có đủ mạnh để đưa ra tòa không". Trong blockchain, chúng tôi gọi đó là proof of funds. Trong AI, Anthropic cần proof of distillation.
Vụ việc xảy ra trong bối cảnh Mỹ - Trung leo thang. Nó giống hệt cuộc chơi mà Hồng Kông từng thực hiện với Singapore để giành vị trí trung tâm tài chính châu Á - chỉ khác, lần này sân chơi là trí tuệ nhân tạo. Khi các quốc gia tranh giành ảnh hưởng, những công ty như Anthropic trở thành vũ khí chiến lược. Nhưng ở đây có một chi tiết khiến tôi nhớ đến câu "mèo khen mèo dài đuôi": Anthropic cáo buộc đối thủ, nhưng đồng thời cũng đang khoe năng lực phòng thủ của chính mình.
Lớp phân tích đầu tiên là chi phí vận hành. Duy trì 25.000 tài khoản giả là một dự án công nghiệp. Bạn cần hệ thống đăng ký tự động, xoay IP, giải CAPTCHA, phân tán request - thứ mà trong giới blockchain tôi thường gọi là bot farm. Nếu mỗi tài khoản chỉ gửi 100 request mỗi ngày, tổng cộng 2,5 triệu request. Với mức giá khoảng 15 USD cho mỗi triệu token đầu vào, một tháng "học lén" có thể đốt của Anthropic hàng trăm nghìn USD tiền tính toán. Chi phí đó không được hoàn lại. Trong ngôn ngữ DeFi, đây là value extraction - một hình thức ăn cắp gas. Nhưng khác với on-chain, nơi mọi thứ được ghi lại vĩnh viễn, API log thì có thể bị xóa. Và đó chính là điểm mù.
Lớp thứ hai là dấu vân tay kỹ thuật. Khi tôi xây dựng bộ chỉ số DeFi scoring với 12 metrics - TVL, người dùng duy nhất, tần suất giao dịch, phân bổ token - tôi nhận ra rằng hành vi bất thường luôn để lại pattern. Trên blockchain, đó là thời điểm giao dịch và kích thước ví. Trong API, đó là độ dài output, tham số temperature, chu kỳ truy cập. Anthropic tuyên bố họ phát hiện 25.000 tài khoản - nghĩa là họ đã xây dựng một hệ thống giám sát rất tinh vi. Nhưng câu hỏi lớn hơn: họ có bằng chứng về "sản phẩm" không? Tức là, họ có chứng minh được Qwen thực sự học được gì từ Claude không? Nếu không, đây mới chỉ là cáo buộc hành vi, chưa phải bằng chứng về kết quả. Giống như bắt quả tang ai đó đứng gần két sắt - nhưng chưa thấy hắn cầm tiền.
Lớp thứ ba là mâu thuẫn chiến lược. Alibaba sở hữu Qwen - một trong những dòng mô hình nguồn mở mạnh nhất. Nếu họ thực sự cần distill Claude, điều đó đồng nghĩa với việc thừa nhận nội lực chưa đủ. Nhưng cũng có khả năng khác: họ dùng Claude để tạo synthetic data cho việc đánh giá hoặc căn chỉnh - một vùng xám vi phạm ToS nhưng không hẳn là trộm cắp. Dù là kịch bản nào, niềm tin vào Qwen sẽ bị tổn hại. Cộng đồng mã nguồn mở từng chọn Qwen vì cho rằng nó "sạch". Giờ họ phải tự hỏi: nếu thành quả có một phần từ Claude, thì khác gì dùng Rolls-Royce để chở hàng - vừa xúc phạm chiếc xe, vừa không chở được bao nhiêu. Trong một thị trường đang sốt nóng, không phải cứ có GPU là có trí tuệ - và không phải cứ distill là có được linh hồn của mô hình gốc.
Nhưng khoan. Hãy lật ngược vấn đề. Anthropic vừa cáo buộc, vừa quảng cáo. Họ cho thị trường thấy rằng hệ thống bảo mật của họ đủ sức phát hiện 25.000 tài khoản giữa hàng triệu request. "Mèo khen mèo dài đuôi"? Có thể lắm chứ. Trong blockchain, chuyện "mèo khen mèo dài đuôi" là thường - các dự án DAO tự xưng "code is law" nhưng quyền nâng cấp smart contract vẫn nằm trong tay ba ví multi-sig. Tương tự, lời cáo buộc của Anthropic có thể là một chiến dịch định vị họ là "người gác cổng đáng tin cậy" giữa cơn hoảng loạn an ninh AI. Tôi không nói Alibaba vô tội. Tôi chỉ nói rằng: tương quan giữa số lượng tài khoản giả và hành vi trộm cắp tri thức không phải là nhân quả. Dữ liệu on-chain từng dạy tôi rằng không bao giờ được kết luận trước khi kiểm tra hash.
Tuần tới, theo dõi ba tín hiệu. Một: Alibaba có phản hồi kèm báo cáo kỹ thuật hay chỉ là lời phủ nhận? Hai: Mỹ và EU có đưa model distillation vào danh sách kiểm soát xuất khẩu không? Ba: liệu có "hash đầu tiên" - tức bằng chứng công khai từ Anthropic - xuất hiện? Nếu vụ này kết thúc giống cách Hồng Kông từng cướp vị trí Singapore, thì 25.000 tài khoản sẽ là chất xúc tác để AI và blockchain cùng ngồi xuống viết luật chơi chung. Nhưng tôi vẫn đợi. Vì trong 27 năm qua, tôi chưa bao giờ thấy một vụ "mèo khen mèo dài đuôi" nào tự kết thúc bằng lời nói. Luôn cần dữ liệu.