Báo cáo mới nhất từ Anthropic cáo buộc 7 tập đoàn công nghệ Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép ở quy mô công nghiệp từ mô hình Claude. Các thủ đoạn bao gồm sử dụng tài khoản giả, máy chủ proxy và kỹ thuật thao túng suy luận nhằm đánh cắp tri thức từ mô hình phương Tây.

Trong báo cáo tình báo an ninh mới nhất, Anthropic đã đưa ra những cáo buộc nghiêm trọng về việc các doanh nghiệp công nghệ lớn tại Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép (unauthorized model distillation). Khác với kỹ thuật chưng cất mô hình hợp pháp trong nghiên cứu, hành vi này được định nghĩa là hoạt động quy mô công nghiệp nhằm trích xuất khả năng suy luận của các mô hình tiên tiến như Claude mà không có sự cho phép.
Kẻ tấn công thường sử dụng các phương thức gian lận như tạo danh tính giả, sử dụng thẻ tín dụng đánh cắp hoặc các khóa API bất hợp pháp. Mục tiêu cuối cùng là thu thập dữ liệu suy luận (chain-of-thought) của mô hình để huấn luyện cho các mô hình đối thủ, từ đó rút ngắn khoảng cách công nghệ mà không cần đầu tư nguồn lực tự nghiên cứu.

Theo phân tích của các chuyên gia tại Anthropic, quy trình này không chỉ dừng lại ở việc hỏi đáp thông thường mà còn sử dụng các kỹ thuật phức tạp:
Báo cáo của Anthropic đã chỉ ra danh sách 7 thực thể liên quan đến các chiến dịch quy mô lớn, với tổng số lượt tương tác lên tới gần 200 triệu lần trong thời gian ngắn:
Việc trí tuệ nhân tạo bị khai thác theo cách này đặt ra thách thức lớn về an ninh mạng và quyền sở hữu trí tuệ. Khi các mô hình suy luận mạnh mẽ bị "hút máu" dữ liệu, nó không chỉ đe dọa đến lợi thế cạnh tranh của các đơn vị phát triển gốc mà còn tiềm ẩn nguy cơ rò rỉ thông tin nhạy cảm của người dùng cuối.
Mặc dù phía Bộ Thương mại Trung Quốc đã phản bác các cáo buộc này và cho rằng chưng cất là công nghệ trung lập, nhưng quy mô "công nghiệp" mà Anthropic đưa ra cho thấy một bức tranh hoàn toàn khác. Đây là hồi chuông cảnh báo cho các công ty AI trong việc tăng cường cơ chế phát hiện tài khoản bất thường, bảo vệ dữ liệu huấn luyện và đảm bảo tính toàn vẹn của mô hình trước các cuộc tấn công tinh vi từ đối thủ.
CÔNG TY TNHH THƯƠNG MẠI DỊCH VỤ HỢP THÀNH THỊNH
Showroom: 406/55 Cộng Hòa, Phường Tân Bình, Thành phố Hồ Chí Minh, Việt Nam.
Giấy CN đăng ký kinh doanh và mã số thuế: 0310583337 do sở Kế hoạch & Đầu tư thành phố Hồ Chí Minh cấp.

Trong báo cáo tình báo an ninh mới nhất, Anthropic đã đưa ra những cáo buộc nghiêm trọng về việc các doanh nghiệp công nghệ lớn tại Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép (unauthorized model distillation). Khác với kỹ thuật chưng cất mô hình hợp pháp trong nghiên cứu, hành vi này được định nghĩa là hoạt động quy mô công nghiệp nhằm trích xuất khả năng suy luận của các mô hình tiên tiến như Claude mà không có sự cho phép.
Kẻ tấn công thường sử dụng các phương thức gian lận như tạo danh tính giả, sử dụng thẻ tín dụng đánh cắp hoặc các khóa API bất hợp pháp. Mục tiêu cuối cùng là thu thập dữ liệu suy luận (chain-of-thought) của mô hình để huấn luyện cho các mô hình đối thủ, từ đó rút ngắn khoảng cách công nghệ mà không cần đầu tư nguồn lực tự nghiên cứu.

Theo phân tích của các chuyên gia tại Anthropic, quy trình này không chỉ dừng lại ở việc hỏi đáp thông thường mà còn sử dụng các kỹ thuật phức tạp:
Báo cáo của Anthropic đã chỉ ra danh sách 7 thực thể liên quan đến các chiến dịch quy mô lớn, với tổng số lượt tương tác lên tới gần 200 triệu lần trong thời gian ngắn:
Việc trí tuệ nhân tạo bị khai thác theo cách này đặt ra thách thức lớn về an ninh mạng và quyền sở hữu trí tuệ. Khi các mô hình suy luận mạnh mẽ bị "hút máu" dữ liệu, nó không chỉ đe dọa đến lợi thế cạnh tranh của các đơn vị phát triển gốc mà còn tiềm ẩn nguy cơ rò rỉ thông tin nhạy cảm của người dùng cuối.
Mặc dù phía Bộ Thương mại Trung Quốc đã phản bác các cáo buộc này và cho rằng chưng cất là công nghệ trung lập, nhưng quy mô "công nghiệp" mà Anthropic đưa ra cho thấy một bức tranh hoàn toàn khác. Đây là hồi chuông cảnh báo cho các công ty AI trong việc tăng cường cơ chế phát hiện tài khoản bất thường, bảo vệ dữ liệu huấn luyện và đảm bảo tính toàn vẹn của mô hình trước các cuộc tấn công tinh vi từ đối thủ.