Bảy công ty trong nước đã lén lút chưng cất AI, bị Anthropic chỉ trích!
Tác giả: Người đóng góp chính của Biteye Denise
Anthropic một lần nữa đã đưa các công ty AI của Trung Quốc vào báo cáo tình báo về mối đe dọa.
Vào ngày 10 tháng 9, nhà phát triển Claude là Anthropic đã phát hành báo cáo mới nhất, chỉ đích danh bảy công ty: Alibaba, Mặt trăng tối, DeepSeek, Trí Đồ, Xiaomi, Thương Thịnh và MiniMax, cáo buộc họ thực hiện các hoạt động chưng cất mô hình không được phép.
Trong số đó, một hoạt động quy mô lớn nhất liên quan đến Alibaba: Anthropic cho biết, từ tháng 5 đến tháng 7 năm nay, họ đã quan sát thấy hơn 151 triệu tương tác có thể quy cho Alibaba, được sử dụng để trích xuất khả năng suy luận của Claude.
Một phần khác của cáo buộc liên quan trực tiếp đến người dùng: Anthropic cho biết, Mặt trăng tối và DeepSeek đã chuyển một số yêu cầu của người dùng cho Claude, sau đó trả lời của Claude lại được gửi về cho người dùng; còn có công ty bị cáo buộc đã sử dụng cuộc trò chuyện của người dùng để tạo dữ liệu huấn luyện.
Tất nhiên, đây đều là kết luận điều tra được công bố bởi Anthropic.
01 Trước tiên hãy xem báo cáo này nói gì
Toàn bộ báo cáo bao phủ các hoạt động lạm dụng AI mà Anthropic cho biết đã phát hiện và ngăn chặn từ tháng 12 năm 2025 đến tháng 8 năm 2026, liên quan đến các vấn đề như tấn công mạng, giám sát, ảnh hưởng dư luận, lừa đảo, lạm dụng trong lĩnh vực sinh học, phát triển vũ khí thông thường và chưng cất.
Một quan sát chính trong báo cáo là, ngày càng nhiều kẻ tấn công để AI thực hiện và phối hợp các nhiệm vụ trực tiếp.
Ví dụ, tự động thúc đẩy xâm nhập mạng, hoặc vận hành một lượng lớn tài khoản kết bạn giả.
Liên quan trực tiếp đến mô hình nội địa là chương chưng cất cuối cùng. Bảy công ty bị cáo buộc có hành vi như sau:

Những con số này đều là thống kê của Anthropic, thời gian quan sát khác nhau, không thể trực tiếp coi là bảng xếp hạng mức sử dụng trong cùng một thời kỳ.
02 Tại sao "chưng cất" lại bị thêm hai chữ "bất hợp pháp"?
Có thể hiểu chưng cất là để một mô hình học theo một mô hình khác: trước tiên để "mô hình thầy" có khả năng mạnh hơn tạo ra câu trả lời hoặc quá trình giải bài, sau đó dùng những tài liệu này để huấn luyện "mô hình học sinh", giúp nó học cách xử lý tương tự.

Chưng cất bản thân là một phương pháp huấn luyện phổ biến. Anthropic trong báo cáo này cũng đã thừa nhận điều này một cách rõ ràng.
Cái mà họ gọi là "chưng cất bất hợp pháp", cụ thể chỉ các hoạt động trích xuất khả năng không được phép, bí mật thực hiện, đạt quy mô công nghiệp. Theo mô tả trong báo cáo, các hoạt động liên quan có thể thông qua các "trạm trung chuyển" đại lý, tài khoản giả mạo hoặc chứng từ bị đánh cắp để vượt qua các hạn chế truy cập, sau đó thu thập hàng loạt đầu ra của mô hình.
Trọng tâm của cuộc tranh chấp này là quá trình suy luận của mô hình. Câu trả lời cuối cùng cho biết cho học sinh "câu hỏi này chọn gì", quá trình suy luận còn có thể cung cấp tài liệu huấn luyện về "cách phân tích và hoàn thành nhiệm vụ". Anthropic cho biết, các hoạt động liên quan chủ yếu nhắm vào khả năng lập trình, gọi công cụ, phân tích dữ liệu và các nhiệm vụ quy trình dài.
Do đó, để đánh giá tranh chấp cần xem dữ liệu đến từ đâu, truy cập có được phép hay không, có vượt qua hạn chế hay không, và người dùng có được thông báo hay không. Chỉ dựa vào "sử dụng công nghệ chưng cất", không thể xác định hành vi cụ thể của một công ty có vi phạm pháp luật hay không.
03 Tại sao dữ liệu người dùng cũng bị cuốn vào?
Theo báo cáo, một số người dùng của Mặt trăng tối và DeepSeek nghĩ rằng yêu cầu của họ đã được chuyển cho mô hình mà họ chọn, nhưng thực tế lại được chuyển tiếp cho Claude.
Nếu cáo buộc này đúng, người dùng cần phải truy vấn: thông tin của họ đã qua những nhà cung cấp dịch vụ nào, và có bị sử dụng cho huấn luyện mô hình hay không?
Tuy nhiên, văn bản gốc có những mức độ xác định khác nhau về việc người dùng có được thông báo hay không.

Ví dụ, phần về Mặt trăng tối viết rằng, Anthropic không biết công ty này có thông báo cho khách hàng hay không.
Anthropic cũng đã đưa ra những lo ngại về mặt an toàn: việc trích xuất khả năng của mô hình, không nhất thiết sẽ sao chép các hạn chế an toàn của mô hình gốc. Đây là một trong những lý do mà họ đưa chưng cất vào báo cáo mối đe dọa.
Các biện pháp ứng phó mà họ tiết lộ bao gồm phát hiện hành vi trích xuất bất thường, cấm tài khoản liên quan, thay thế nội dung suy luận đầy đủ bằng tóm tắt, và tăng cường xác thực danh tính.
04 Các công ty bị chỉ đích danh và ngành nghề phản ứng ra sao?
Tính đến thời điểm xác minh tài liệu vào ngày 11 tháng 9 năm 2026, vẫn chưa tìm thấy phản hồi chính thức có thể xác minh từ bảy công ty đối với báo cáo tháng 9 này.
Ngành nghề trước đó đã có những thảo luận công khai. Những phát biểu dưới đây đều trước báo cáo tháng 9, thuộc bối cảnh tranh chấp.
Vào ngày 24 tháng 7, Microsoft đã phát hành một bức thư công khai được ký bởi Hugging Face, Meta, Mistral, Nvidia và các công ty khác.
Trong thư khẳng định, các nhà hoạch định chính sách nên phân biệt giữa công nghệ phát triển mô hình bình thường và xâm phạm không đúng cách: chưng cất là phương pháp cải tiến mô hình được sử dụng rộng rãi; các vấn đề phát sinh từ việc trích xuất giá trị của mô hình đóng nguồn bất hợp pháp nên được xử lý thông qua các quy định pháp lý và thương mại có mục tiêu, không nên mở rộng thành các hạn chế cứng nhắc đối với công nghệ.
Cũng có sự khác biệt về mặt kỹ thuật.
Vào ngày 23 tháng 7, TechCrunch trong cuộc thảo luận về tranh chấp chưng cất của Kimi K3 đã trích dẫn quan điểm của nhà nghiên cứu AI Nathan Lambert: khi các mô hình ngày càng gần với ranh giới, trọng tâm huấn luyện chuyển sang học tăng cường, chỉ dựa vào chưng cất điều chỉnh giám sát rất khó để giải thích toàn bộ sự nâng cao khả năng.
Nhà nghiên cứu của Laude Institute, đồng sáng lập Snorkel AI Braden Hancock cũng cho rằng, dư luận Mỹ đã đánh giá thấp sức mạnh công nghệ của các đội ngũ Trung Quốc.
Những quan điểm này thảo luận về tác dụng kỹ thuật của chưng cất và ranh giới quản lý, nhưng không kiểm tra từng cáo buộc trong báo cáo tháng 9. Tiếp theo vẫn cần chú ý xem các công ty bị chỉ đích danh có phản hồi về tài khoản và nguồn dữ liệu cụ thể hay không, yêu cầu của người dùng có bị chuyển tiếp hay không, và dữ liệu huấn luyện liên quan được cấp phép như thế nào.
05 Viết ở cuối
Chưng cất bản thân không phải là tội lỗi nguyên thủy, việc tham khảo công nghệ hợp lý và việc trích xuất khả năng quy mô lớn không được phép cũng không thể bị nhầm lẫn.
Hiện tại, những gì bên ngoài thấy vẫn chủ yếu là kết luận điều tra một chiều của Anthropic, các công ty bị chỉ đích danh vẫn chưa công khai phản hồi các chi tiết quan trọng. Cách 151 triệu tương tác được quy cho, yêu cầu của người dùng có được phép chuyển tiếp hay không, những cuộc trò chuyện nào được sử dụng cho huấn luyện, đều cần thêm bằng chứng và giải thích từ các công ty liên quan.
Đối với người dùng bình thường, cuộc tranh chấp này không xa lạ. Khi chúng ta đưa mã, tài liệu thương mại thậm chí là cuộc trò chuyện riêng tư cho một AI, thì thông tin được xử lý có thể không chỉ là mô hình hiển thị trên trang.
Các công ty AI đang tranh giành khả năng của mô hình thế hệ tiếp theo, nhưng bị cuốn vào đó có thể là dữ liệu của mỗi người.
Khi một cuộc trò chuyện được chuyển tiếp, lưu trữ thậm chí được sử dụng cho huấn luyện mà người dùng không hay biết, có lẽ chúng ta cần đặt lại câu hỏi: trước ô nhập liệu của AI, chúng ta thực sự là người dùng sản phẩm, hay là nguyên liệu để huấn luyện sản phẩm?
Bài viết nổi bật












