Anthropic cho biết đã trở thành mục tiêu của các cuộc tấn công “distillation” quy mô công nghiệp, khi ba công ty AI Trung Quốc bị cáo buộc tạo 24.000 tài khoản giả và hơn 16 triệu lượt tương tác với Claude để huấn luyện mô hình của riêng họ.
16 triệu lượt truy vấn Claude từ 24.000 tài khoản
Trong một bài đăng blog, Anthropic cáo buộc DeepSeek, Moonshot AI và MiniMax đã sử dụng kỹ thuật “distillation” — tức huấn luyện một mô hình yếu hơn dựa trên đầu ra của mô hình mạnh hơn — để khai thác trái phép dữ liệu từ mô hình Claude.
Theo Anthropic, ba công ty này đã tạo khoảng 24.000 tài khoản gian lận, thực hiện tổng cộng hơn 16 triệu lượt trao đổi với Claude nhằm thu thập dữ liệu huấn luyện.
Distillation: hợp pháp nhưng có thể bị lạm dụng
Anthropic thừa nhận distillation là một phương pháp huấn luyện hợp pháp và phổ biến trong ngành AI, khi các phòng thí nghiệm thường sử dụng nó để tạo phiên bản nhỏ hơn, chi phí thấp hơn từ mô hình chủ lực.
Tuy nhiên, công ty nhấn mạnh rằng kỹ thuật này cũng có thể bị lạm dụng:
Các đối thủ có thể tận dụng nó để nhanh chóng sao chép năng lực cốt lõi của mô hình tiên phong với chi phí và thời gian thấp hơn nhiều so với tự phát triển.
Theo Anthropic, các chiến dịch này tập trung vào những năng lực nổi bật nhất của Claude như:
- Lý luận theo tác vụ (agentic reasoning)
- Sử dụng công cụ và viết mã
- Phân tích dữ liệu
- Chấm điểm theo tiêu chí (rubric-based grading)
- Thị giác máy tính
Cách Anthropic phát hiện các chiến dịch
Anthropic cho biết đã xác định các hành vi này thông qua:
- Phân tích tương quan địa chỉ IP
- Siêu dữ liệu yêu cầu (request metadata)
- Dấu hiệu hạ tầng kỹ thuật
- Thông tin đối chiếu từ các đối tác trong ngành
Cả DeepSeek, Moonshot và MiniMax đều là các công ty AI có trụ sở tại Trung Quốc, với định giá nhiều tỷ USD. Trong đó, DeepSeek được biết đến rộng rãi hơn trên thị trường quốc tế.
Lo ngại rủi ro địa chính trị
Ngoài vấn đề sở hữu trí tuệ, Anthropic cho rằng các chiến dịch distillation từ đối thủ nước ngoài còn tiềm ẩn rủi ro địa chính trị.
Công ty cảnh báo rằng nếu các phòng thí nghiệm nước ngoài sao chép được năng lực của mô hình AI Mỹ, những năng lực đó có thể được tích hợp vào:
- Hệ thống quân sự
- Hoạt động tình báo
- Chiến dịch tấn công mạng
- Chiến dịch thông tin sai lệch
- Hệ thống giám sát diện rộng
Anthropic cho rằng điều này có thể giúp các chính phủ độc đoán triển khai AI tiên tiến cho mục đích tấn công.
Kế hoạch ứng phó và lời kêu gọi hợp tác
Trước tình hình trên, Anthropic cho biết sẽ:
- Nâng cấp hệ thống phát hiện lưu lượng truy cập bất thường
- Siết chặt kiểm soát truy cập
- Chia sẻ thông tin tình báo mối đe dọa với ngành
Công ty cũng kêu gọi sự phối hợp giữa doanh nghiệp AI, nhà cung cấp hạ tầng đám mây và các nhà hoạch định chính sách tại Mỹ.
Anthropic nhấn mạnh rằng không một công ty nào có thể tự mình xử lý các cuộc tấn công distillation ở quy mô này và cần có phản ứng phối hợp toàn ngành.
Cuộc chiến bảo vệ mô hình AI bước sang giai đoạn mới
Những cáo buộc của Anthropic cho thấy cạnh tranh trong lĩnh vực AI không chỉ dừng ở đổi mới công nghệ mà còn mở rộng sang bảo vệ mô hình và dữ liệu huấn luyện. Khi distillation trở thành công cụ chiến lược trong cuộc đua AI toàn cầu, vấn đề bảo mật, sở hữu trí tuệ và địa chính trị nhiều khả năng sẽ tiếp tục là tâm điểm trong thời gian tới.






