Anthropic vừa đưa ra cáo buộc các công ty công nghệ Trung Quốc như Alibaba, Moonshot AI và DeepSeek đã sử dụng trái phép dữ liệu đầu ra từ mô hình Claude để huấn luyện hệ thống AI riêng. Hành vi này được thực hiện thông qua kỹ thuật chưng cất mô hình quy mô lớn nhằm đánh cắp khả năng suy luận logic từ công nghệ của Anthropic.

Trong bối cảnh cạnh tranh khốc liệt của ngành công nghiệp trí tuệ nhân tạo, việc bảo vệ sở hữu trí tuệ đang trở thành ưu tiên hàng đầu. Mới đây, Anthropic đã chính thức cáo buộc các phòng thí nghiệm AI lớn tại Trung Quốc, bao gồm Alibaba, Moonshot AI và DeepSeek, về việc khai thác trái phép dữ liệu đầu ra từ mô hình Claude để cải thiện khả năng cho các mô hình của riêng họ.
Theo báo cáo, các đơn vị này đã áp dụng kỹ thuật gọi là chưng cất mô hình (model distillation). Đây là quá trình sử dụng phản hồi từ một mô hình AI mạnh (như Claude) để tạo ra tập dữ liệu huấn luyện cho một mô hình khác. Điều này giúp các mô hình nhỏ hơn nhanh chóng học được khả năng suy luận logic, lập trình và phân tích dữ liệu mà không cần tốn chi phí phát triển từ đầu.
Anthropic ghi nhận gần 200 triệu lượt trao đổi nghi vấn, cho thấy mức độ tinh vi của các chiến dịch này. Những kẻ thực hiện đã tìm cách vượt qua các biện pháp bảo mật để ép buộc mô hình tiết lộ các chuỗi suy luận chi tiết – vốn là tài sản trí tuệ cốt lõi của Anthropic.

Các hành vi này không đơn thuần là thử nghiệm nhỏ lẻ mà được tổ chức bài bản với quy mô công nghiệp:
Thông thường, Claude được thiết kế để giữ kín quy trình suy luận nội bộ nhằm đảm bảo an toàn và tính độc quyền. Tuy nhiên, các kỹ thuật tấn công hiện nay đã đánh lừa mô hình để làm lộ các dấu vết suy luận. Hành vi này không chỉ vi phạm điều khoản dịch vụ mà còn đặt ra câu hỏi lớn về đạo đức trong việc sử dụng dữ liệu huấn luyện từ các công ty tiên phong.
Việc kiểm soát cách đầu ra của các mô hình AI tiên tiến được sử dụng đang trở thành mặt trận mới trong cuộc đua công nghệ toàn cầu. Anthropic nhấn mạnh rằng, mặc dù việc học hỏi từ các mô hình khác là xu hướng phổ biến, nhưng việc tự động hóa thu thập quy mô lớn và vượt qua rào cản bảo mật là hành vi không thể chấp nhận.
Sự việc này là lời cảnh tỉnh cho cộng đồng công nghệ về tầm quan trọng của việc xây dựng các cơ chế phòng thủ mạnh mẽ hơn. Đối với người dùng và doanh nghiệp, việc lựa chọn các nền tảng AI có cam kết minh bạch và bảo mật cao như Claude không chỉ giúp đảm bảo hiệu suất công việc mà còn góp phần vào sự phát triển lành mạnh của hệ sinh thái AI toàn cầu.
CÔNG TY TNHH THƯƠNG MẠI DỊCH VỤ HỢP THÀNH THỊNH
Showroom: 406/55 Cộng Hòa, Phường Tân Bình, Thành phố Hồ Chí Minh, Việt Nam.
Giấy CN đăng ký kinh doanh và mã số thuế: 0310583337 do sở Kế hoạch & Đầu tư thành phố Hồ Chí Minh cấp.

Trong bối cảnh cạnh tranh khốc liệt của ngành công nghiệp trí tuệ nhân tạo, việc bảo vệ sở hữu trí tuệ đang trở thành ưu tiên hàng đầu. Mới đây, Anthropic đã chính thức cáo buộc các phòng thí nghiệm AI lớn tại Trung Quốc, bao gồm Alibaba, Moonshot AI và DeepSeek, về việc khai thác trái phép dữ liệu đầu ra từ mô hình Claude để cải thiện khả năng cho các mô hình của riêng họ.
Theo báo cáo, các đơn vị này đã áp dụng kỹ thuật gọi là chưng cất mô hình (model distillation). Đây là quá trình sử dụng phản hồi từ một mô hình AI mạnh (như Claude) để tạo ra tập dữ liệu huấn luyện cho một mô hình khác. Điều này giúp các mô hình nhỏ hơn nhanh chóng học được khả năng suy luận logic, lập trình và phân tích dữ liệu mà không cần tốn chi phí phát triển từ đầu.
Anthropic ghi nhận gần 200 triệu lượt trao đổi nghi vấn, cho thấy mức độ tinh vi của các chiến dịch này. Những kẻ thực hiện đã tìm cách vượt qua các biện pháp bảo mật để ép buộc mô hình tiết lộ các chuỗi suy luận chi tiết – vốn là tài sản trí tuệ cốt lõi của Anthropic.

Các hành vi này không đơn thuần là thử nghiệm nhỏ lẻ mà được tổ chức bài bản với quy mô công nghiệp:
Thông thường, Claude được thiết kế để giữ kín quy trình suy luận nội bộ nhằm đảm bảo an toàn và tính độc quyền. Tuy nhiên, các kỹ thuật tấn công hiện nay đã đánh lừa mô hình để làm lộ các dấu vết suy luận. Hành vi này không chỉ vi phạm điều khoản dịch vụ mà còn đặt ra câu hỏi lớn về đạo đức trong việc sử dụng dữ liệu huấn luyện từ các công ty tiên phong.
Việc kiểm soát cách đầu ra của các mô hình AI tiên tiến được sử dụng đang trở thành mặt trận mới trong cuộc đua công nghệ toàn cầu. Anthropic nhấn mạnh rằng, mặc dù việc học hỏi từ các mô hình khác là xu hướng phổ biến, nhưng việc tự động hóa thu thập quy mô lớn và vượt qua rào cản bảo mật là hành vi không thể chấp nhận.
Sự việc này là lời cảnh tỉnh cho cộng đồng công nghệ về tầm quan trọng của việc xây dựng các cơ chế phòng thủ mạnh mẽ hơn. Đối với người dùng và doanh nghiệp, việc lựa chọn các nền tảng AI có cam kết minh bạch và bảo mật cao như Claude không chỉ giúp đảm bảo hiệu suất công việc mà còn góp phần vào sự phát triển lành mạnh của hệ sinh thái AI toàn cầu.