MXH mygo - Anthropic cáo buộc bảy công ty AI Trung Quốc sử dụng dữ liệu của Claude để huấn luyện mô hình.
Dẫn nguồn tin từ MetaEra, Anthropic đã cáo buộc bảy công ty AI của Trung Quốc sử dụng dữ liệu của Claude để huấn luyện mô hình. Các công ty này—bao gồm Alibaba, Moonshot AI, DeepSeek, Zhipu AI, Xiaomi, SenseTime và MiniMax—bị cáo buộc đã vượt qua các rào cản kỹ thuật để thu thập dữ liệu người dùng. Theo báo cáo, Alibaba đã ghi nhận 151 triệu lượt tương tác trong vòng ba tháng, trong khi Moonshot AI sử dụng 23 triệu lượt để chuyển tiếp yêu cầu tới Claude. Những cáo buộc này hiện vẫn chưa được kiểm chứng. Các tin tức về AI và tiền mã hóa vẫn liên tục đề cập đến những căng thẳng xoay quanh vấn đề sử dụng dữ liệu. Trong khi đó, dữ liệu lạm phát vẫn là tâm điểm chú ý của các nhà đầu tư đang theo dõi các xu hướng kinh tế vĩ mô.

Báo cáo mới nhất của Anthropic tiết lộ rằng trong vài tháng qua, họ đã phát hiện và chặn các hoạt động chưng cất (distillation) mô hình Claude bắt nguồn từ bảy công ty AI của Trung Quốc: Alibaba, Moonshot AI, DeepSeek, Zhipu AI, Xiaomi, SenseTime và MiniMax. Mặc dù chưng cất là một phương pháp huấn luyện phổ biến, nhưng các cáo buộc của Anthropic tập trung vào hành vi lách luật trên quy mô lớn, thu thập dữ liệu đầu ra của Claude và dữ liệu người dùng.
1. Alibaba: Quy mô lớn nhất. Anthropic ghi nhận hơn 151 triệu lượt tương tác từ tháng 5 đến tháng 7, với đỉnh điểm gần 3 triệu lượt mỗi ngày; mục đích chính là trích xuất toàn bộ quy trình suy luận của các phiên bản Opus 4.6 và 4.7 để huấn luyện các mô hình Qwen 3.5, 3.6 và 3.7.
2. Moonshot AI (The Dark Side of the Moon): Chuyển tiếp trực tiếp các truy vấn của người dùng Kimi sang Claude. Gần 300.000 yêu cầu từ người dùng thực đã được gửi tới Claude trong vòng 10 ngày, trong đó một số chứa mã nguồn nội bộ doanh nghiệp và thông tin xác thực hợp lệ; tổng số lượt tương tác liên quan vượt quá 23 triệu trong khoảng thời gian từ tháng 5 đến tháng 7.
3. DeepSeek: Cũng bí mật chuyển tiếp yêu cầu của người dùng sang Claude; cụ thể là xác định những người dùng sử dụng các công cụ như Claude Code và OpenCode, sau đó chọn lọc và chuyển tiếp một số yêu cầu tới mô hình Opus. Ghi nhận hơn 12,1 triệu lượt trong 14 ngày.
4. Zhipu: Trích xuất và làm sạch quy trình suy luận của Claude, đồng thời huấn luyện khả năng an ninh mạng của mình bằng các mô hình của Mỹ. Anthropic cho biết ban đầu Zhipu cố gắng chưng cất mô hình Fable nhưng chuyển hướng sang Opus 4.6 và một mô hình của công ty Mỹ khác sau khi nhận thấy cơ chế phòng thủ của Fable quá mạnh; họ đã thực hiện hơn 3,4 triệu lượt tương tác trong 17 ngày.
5. Xiaomi: Đưa các cuộc hội thoại thực tế và nhật ký lập trình do người dùng MiMo tạo ra vào lại Claude để tạo dữ liệu cho quá trình SFT (tinh chỉnh có giám sát) và học tăng cường. Ghi nhận hơn 400.000 yêu cầu trong 20 ngày; Anthropic thậm chí nghi ngờ rằng giai đoạn dùng thử miễn phí của MiMo-V2-Pro có thể đã được tận dụng để thu hút thêm các nhà phát triển nước ngoài tạo ra dữ liệu huấn luyện.
6. SenseTime: Mua lại nhật ký trò chuyện của người dùng với Claude trực tiếp từ các nhà cung cấp dữ liệu bên thứ ba. Dữ liệu này bắt nguồn từ các tác nhân (agent) và dịch vụ trung gian; một số người dùng không hề hay biết rằng các cuộc trò chuyện của họ đang bị lưu trữ và bán lại.
7. MiniMax: Bị cáo buộc vận hành một dịch vụ trung gian cung cấp mô hình thông qua một công ty không có mối liên hệ rõ ràng nào; dịch vụ này chỉ cung cấp các mô hình của Anthropic và OpenAI chứ không bao gồm các mô hình do chính MiniMax phát triển. Anthropic cho rằng dịch vụ này có thể được thiết kế nhằm thu thập dữ liệu tương tác của người dùng với các mô hình của Hoa Kỳ để phục vụ mục đích huấn luyện.
Tất cả các thông tin nêu trên đều là kết quả điều tra, nhận định và cáo buộc từ phía Anthropic; chưa có thông tin nào trong số đó được xác minh độc lập.
Trích đẫn KuCoin Flash https://www.kucoin.com/news/flash/anthropic-accuses-7-chinese-ai-firms-of-using-claude-data-for-model-training