• Công ty TNHH Thương Mại Dịch Vụ Hợp Thành Thịnh

Tin tức

Anthropic cảnh báo 7 công ty AI Trung Quốc chưng cất dữ liệu trái phép

  • Thứ bảy, 18:35 Ngày 12/09/2026 .
  • Báo cáo mới nhất từ Anthropic cáo buộc 7 tập đoàn công nghệ Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép ở quy mô công nghiệp từ mô hình Claude. Các thủ đoạn bao gồm sử dụng tài khoản giả, máy chủ proxy và kỹ thuật thao túng suy luận nhằm đánh cắp tri thức từ mô hình phương Tây.

    Cuộc chiến bảo mật: Chưng cất dữ liệu là gì?

    Trong báo cáo tình báo an ninh mới nhất, Anthropic đã đưa ra những cáo buộc nghiêm trọng về việc các doanh nghiệp công nghệ lớn tại Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép (unauthorized model distillation). Khác với kỹ thuật chưng cất mô hình hợp pháp trong nghiên cứu, hành vi này được định nghĩa là hoạt động quy mô công nghiệp nhằm trích xuất khả năng suy luận của các mô hình tiên tiến như Claude mà không có sự cho phép.

    Kẻ tấn công thường sử dụng các phương thức gian lận như tạo danh tính giả, sử dụng thẻ tín dụng đánh cắp hoặc các khóa API bất hợp pháp. Mục tiêu cuối cùng là thu thập dữ liệu suy luận (chain-of-thought) của mô hình để huấn luyện cho các mô hình đối thủ, từ đó rút ngắn khoảng cách công nghệ mà không cần đầu tư nguồn lực tự nghiên cứu.

    Các thủ đoạn tinh vi trong quy trình chưng cất trái phép

    Theo phân tích của các chuyên gia tại Anthropic, quy trình này không chỉ dừng lại ở việc hỏi đáp thông thường mà còn sử dụng các kỹ thuật phức tạp:

    • Sử dụng trung gian: Chuyển tiếp yêu cầu của người dùng từ mô hình nội địa sang Claude thông qua hệ thống proxy, khiến hệ thống không thể nhận diện nguồn gốc thực sự.
    • Thao túng suy luận: Chèn các yêu cầu đặc biệt (prompt injection) để ép mô hình xuất ra "chữ ký suy nghĩ" hoặc dịch nội dung suy luận sang ngôn ngữ khác, nhằm làm lộ logic xử lý nội bộ.
    • Phát lại dữ liệu: Tự động hóa hàng chục nghìn lượt truy vấn để tìm ra điểm khai thác hiệu quả nhất, sau đó đóng gói kết quả thành bộ dữ liệu huấn luyện (SFT) cho các mô hình như Qwen hay GLM.

    Điểm tên các doanh nghiệp bị cáo buộc

    Báo cáo của Anthropic đã chỉ ra danh sách 7 thực thể liên quan đến các chiến dịch quy mô lớn, với tổng số lượt tương tác lên tới gần 200 triệu lần trong thời gian ngắn:

    • Alibaba (Tongyi Lab): Ghi nhận chiến dịch lớn nhất với hơn 151 triệu lượt trao đổi, sử dụng 3.500 tài khoản gian lận để huấn luyện các dòng mô hình Qwen.
    • Moonshot AI (Kimi): Sử dụng mạng lưới hơn 5.000 tài khoản để chuyển tiếp yêu cầu của người dùng, "giả mạo" kết quả của Claude thành sản phẩm của mình.
    • DeepSeek: Bị cáo buộc xây dựng pipeline trích xuất suy luận, trong đó có cả việc xử lý các dữ liệu nhạy cảm của doanh nghiệp.
    • Zhipu AI: Tận dụng Claude để làm sạch, chấm điểm và lọc dữ liệu huấn luyện cho dòng mô hình GLM.
    • Xiaomi, SenseTime và MiniMax: Các đơn vị này bị cáo buộc sử dụng nhiều hình thức từ tái dựng môi trường lập trình, mua dữ liệu hội thoại từ bên thứ ba đến sử dụng công ty bình phong để che đậy hành vi thu thập dữ liệu.

    Góc nhìn chuyên gia và hệ lụy an ninh

    Việc trí tuệ nhân tạo bị khai thác theo cách này đặt ra thách thức lớn về an ninh mạng và quyền sở hữu trí tuệ. Khi các mô hình suy luận mạnh mẽ bị "hút máu" dữ liệu, nó không chỉ đe dọa đến lợi thế cạnh tranh của các đơn vị phát triển gốc mà còn tiềm ẩn nguy cơ rò rỉ thông tin nhạy cảm của người dùng cuối.

    Mặc dù phía Bộ Thương mại Trung Quốc đã phản bác các cáo buộc này và cho rằng chưng cất là công nghệ trung lập, nhưng quy mô "công nghiệp" mà Anthropic đưa ra cho thấy một bức tranh hoàn toàn khác. Đây là hồi chuông cảnh báo cho các công ty AI trong việc tăng cường cơ chế phát hiện tài khoản bất thường, bảo vệ dữ liệu huấn luyện và đảm bảo tính toàn vẹn của mô hình trước các cuộc tấn công tinh vi từ đối thủ.

    Sản phẩm đang khuyến mãi

    Thiết bị ghi hình HDMI To USB TYPE-C AVermedia BU110

    Thiết bị ghi hình HDMI To USB TYPE-C AVermedia BU110

    3,300,000 đ 3,700,000 đ

    ID: NY-BU110
    THIẾT BỊ GHI HÌNH SDI - AVERMEDIA BU111

    THIẾT BỊ GHI HÌNH SDI - AVERMEDIA BU111

    5,700,000 đ 6,300,000 đ

    ID: BU111
    TỦ SẠC THÔNG MINH AVER E32C

    TỦ SẠC THÔNG MINH AVER E32C

    51,500,000 đ 55,000,000 đ

    ID: NY_AVER E32C
    Mainboard ASUS WS X299 PRO

    Mainboard ASUS WS X299 PRO

    10,499,000 đ 11,023,950 đ

    ID: MAAS0208
    TV Box FPT Play Box+ T550

    TV Box FPT Play Box+ T550

    1,500,000 đ 1,690,000 đ

    ID: NY-T550
    Laptop HP Pavilion 15-cb540TX (4BN72PA)

    Laptop HP Pavilion 15-cb540TX (4BN72PA)

    20,690,000 đ 22,190,000 đ

    ID: 15-cb540TX
    ATEM MINI

    ATEM MINI

    7,844,000 đ 8,715,000 đ

    ID: NY-ATEM MINI
    Bàn phím + Chuột Logitech MK200

    Bàn phím + Chuột Logitech MK200

    329,000 đ 450,000 đ

    ID: MK200
    Máy Quay GoPro HERO 7 Black (CHDHX-701-RW)

    Máy Quay GoPro HERO 7 Black (CHDHX-701-RW)

    9,890,000 đ 11,890,000 đ

    ID: NY-CHDHX-701-RW
    Robot hút bụi lau nhà Xiaomi Dreame D9 Pro

    Robot hút bụi lau nhà Xiaomi Dreame D9 Pro

    6,990,000 đ 8,450,000 đ

    ID: NY-DreameD9
    Apple Mac Mini MGNT3SA/A - Apple M1/ 8GB/ 512GB

    Apple Mac Mini MGNT3SA/A - Apple M1/ 8GB/ 512GB

    21,690,000 đ 24,990,000 đ

    ID: PCAP0025
    zalo

    Thông số kĩ thuật

    Chi tiết sản phẩm

    Cuộc chiến bảo mật: Chưng cất dữ liệu là gì?

    Trong báo cáo tình báo an ninh mới nhất, Anthropic đã đưa ra những cáo buộc nghiêm trọng về việc các doanh nghiệp công nghệ lớn tại Trung Quốc thực hiện hành vi chưng cất dữ liệu trái phép (unauthorized model distillation). Khác với kỹ thuật chưng cất mô hình hợp pháp trong nghiên cứu, hành vi này được định nghĩa là hoạt động quy mô công nghiệp nhằm trích xuất khả năng suy luận của các mô hình tiên tiến như Claude mà không có sự cho phép.

    Kẻ tấn công thường sử dụng các phương thức gian lận như tạo danh tính giả, sử dụng thẻ tín dụng đánh cắp hoặc các khóa API bất hợp pháp. Mục tiêu cuối cùng là thu thập dữ liệu suy luận (chain-of-thought) của mô hình để huấn luyện cho các mô hình đối thủ, từ đó rút ngắn khoảng cách công nghệ mà không cần đầu tư nguồn lực tự nghiên cứu.

    Các thủ đoạn tinh vi trong quy trình chưng cất trái phép

    Theo phân tích của các chuyên gia tại Anthropic, quy trình này không chỉ dừng lại ở việc hỏi đáp thông thường mà còn sử dụng các kỹ thuật phức tạp:

    • Sử dụng trung gian: Chuyển tiếp yêu cầu của người dùng từ mô hình nội địa sang Claude thông qua hệ thống proxy, khiến hệ thống không thể nhận diện nguồn gốc thực sự.
    • Thao túng suy luận: Chèn các yêu cầu đặc biệt (prompt injection) để ép mô hình xuất ra "chữ ký suy nghĩ" hoặc dịch nội dung suy luận sang ngôn ngữ khác, nhằm làm lộ logic xử lý nội bộ.
    • Phát lại dữ liệu: Tự động hóa hàng chục nghìn lượt truy vấn để tìm ra điểm khai thác hiệu quả nhất, sau đó đóng gói kết quả thành bộ dữ liệu huấn luyện (SFT) cho các mô hình như Qwen hay GLM.

    Điểm tên các doanh nghiệp bị cáo buộc

    Báo cáo của Anthropic đã chỉ ra danh sách 7 thực thể liên quan đến các chiến dịch quy mô lớn, với tổng số lượt tương tác lên tới gần 200 triệu lần trong thời gian ngắn:

    • Alibaba (Tongyi Lab): Ghi nhận chiến dịch lớn nhất với hơn 151 triệu lượt trao đổi, sử dụng 3.500 tài khoản gian lận để huấn luyện các dòng mô hình Qwen.
    • Moonshot AI (Kimi): Sử dụng mạng lưới hơn 5.000 tài khoản để chuyển tiếp yêu cầu của người dùng, "giả mạo" kết quả của Claude thành sản phẩm của mình.
    • DeepSeek: Bị cáo buộc xây dựng pipeline trích xuất suy luận, trong đó có cả việc xử lý các dữ liệu nhạy cảm của doanh nghiệp.
    • Zhipu AI: Tận dụng Claude để làm sạch, chấm điểm và lọc dữ liệu huấn luyện cho dòng mô hình GLM.
    • Xiaomi, SenseTime và MiniMax: Các đơn vị này bị cáo buộc sử dụng nhiều hình thức từ tái dựng môi trường lập trình, mua dữ liệu hội thoại từ bên thứ ba đến sử dụng công ty bình phong để che đậy hành vi thu thập dữ liệu.

    Góc nhìn chuyên gia và hệ lụy an ninh

    Việc trí tuệ nhân tạo bị khai thác theo cách này đặt ra thách thức lớn về an ninh mạng và quyền sở hữu trí tuệ. Khi các mô hình suy luận mạnh mẽ bị "hút máu" dữ liệu, nó không chỉ đe dọa đến lợi thế cạnh tranh của các đơn vị phát triển gốc mà còn tiềm ẩn nguy cơ rò rỉ thông tin nhạy cảm của người dùng cuối.

    Mặc dù phía Bộ Thương mại Trung Quốc đã phản bác các cáo buộc này và cho rằng chưng cất là công nghệ trung lập, nhưng quy mô "công nghiệp" mà Anthropic đưa ra cho thấy một bức tranh hoàn toàn khác. Đây là hồi chuông cảnh báo cho các công ty AI trong việc tăng cường cơ chế phát hiện tài khoản bất thường, bảo vệ dữ liệu huấn luyện và đảm bảo tính toàn vẹn của mô hình trước các cuộc tấn công tinh vi từ đối thủ.