Bỏ qua tới nội dung
Anthropic cáo buộc chiến dịch 151 triệu lượt khai thác Claude
tin-tuc

Anthropic cáo buộc chiến dịch 151 triệu lượt khai thác Claude

Dũng11 tháng 9, 20264 phút đọc
Tin tức

Báo cáo mới của Anthropic cho thấy đầu ra model đã trở thành tài sản cần được bảo vệ bằng kiểm soát theo lớp.

Anthropic cho biết đội Threat Intelligence đã phát hiện và ngăn chặn nhiều hoạt động lạm dụng Claude trong giai đoạn từ cuối năm 2025 đến tháng 8/2026. Một phần nổi bật của báo cáo là các chiến dịch “chưng cất trái phép” — dùng lượng lớn câu hỏi và phản hồi để trích xuất năng lực của model rồi phục vụ huấn luyện model khác mà không được cho phép.

Đây là cáo buộc do Anthropic công bố, không phải kết luận của cơ quan quản lý hay phán quyết độc lập. Reuters cho biết Alibaba không phản hồi ngay yêu cầu bình luận tại thời điểm bài báo được xuất bản. Vì vậy, các tên tổ chức và số liệu dưới đây cần được đọc đúng ngữ cảnh nguồn.

Fact đã xác minh về nội dung báo cáo

Anthropic cáo buộc chiến dịch mà họ quy cho Alibaba tạo hơn 151 triệu lượt trao đổi trong giai đoạn tháng 5 đến tháng 7/2026. Mức đỉnh được báo cáo gần 3 triệu lượt mỗi ngày, phân tán trên hơn 3.500 tài khoản bị mô tả là gian lận. Theo Anthropic, một prompt cố định được dùng để buộc model đưa dấu vết suy luận vào phần văn bản, sau đó các transcript được chuyển thành dữ liệu huấn luyện.

Báo cáo cũng nêu các chiến dịch khác mà Anthropic quy cho Moonshot AI, DeepSeek, Zhipu và Xiaomi. TechCrunch tổng hợp rằng Anthropic quan sát gần 200 triệu lượt trao đổi liên quan tới năm chiến dịch. Riêng báo cáo của Anthropic nêu hơn 23 triệu lượt cho Moonshot và hơn 12,1 triệu lượt cho DeepSeek trong các khoảng thời gian được mô tả.

Một rủi ro khác nằm ở dữ liệu người dùng. Anthropic cáo buộc một số dịch vụ đã chuyển tiếp yêu cầu của khách hàng sang Claude mà người dùng không biết, khiến nội dung nhạy cảm có thể đi qua bên thứ ba. Đây là phần thông tin cần tiếp tục được đối chiếu với phản hồi của các bên bị nêu tên.

Nhận định của Học viện AI

Khi năng lực model có giá trị thương mại, đầu ra ở quy mô lớn có thể bị biến thành “nguyên liệu” cho hệ thống khác. Cách phòng thủ vì thế không thể chỉ dựa vào API key hay chặn theo địa chỉ IP. Doanh nghiệp cần nhìn hành vi theo cụm tài khoản, tốc độ sử dụng, mẫu prompt lặp lại, luồng chuyển tiếp qua nhà cung cấp và dấu hiệu trích xuất bất thường.

Tín hiệu này cũng có ý nghĩa với doanh nghiệp sử dụng nhiều model qua router hoặc nền tảng trung gian. Nếu nhà cung cấp không nói rõ model nào thực sự xử lý yêu cầu, dữ liệu lưu ở đâu và transcript có được dùng cho huấn luyện hay không, doanh nghiệp không thể đánh giá đầy đủ rủi ro bảo mật và tuân thủ.

Sơ đồ số liệu cáo buộc về chưng cất AI và bốn lớp phòng thủ
Ba số liệu chính và bốn lớp phòng thủ, tổng hợp từ báo cáo Anthropic; đối chiếu Reuters và TechCrunch. Visual do Học viện AI biên soạn. Các số liệu là cáo buộc của Anthropic.

Bốn lớp kiểm soát nên có

  1. Danh tính và tài khoản: xác minh tổ chức, kiểm soát phương thức thanh toán, khóa cụm tài khoản có cùng dấu hiệu lạm dụng và hạn chế quyền của tài khoản mới.
  2. Hành vi: đặt quota theo người dùng và tenant; phát hiện lưu lượng tăng đột biến, prompt giống nhau ở quy mô lớn, replay đa phiên và mô hình sử dụng không phù hợp mục đích khai báo.
  3. Dữ liệu: không để lộ reasoning nội bộ; phân loại dữ liệu nhạy cảm; giới hạn transcript được lưu; yêu cầu nhà cung cấp nêu rõ subprocessor, vị trí xử lý và chính sách dùng dữ liệu để huấn luyện.
  4. Ứng phó: lưu audit trail, chuẩn bị playbook khóa truy cập, luân phiên secret, thông báo sự cố và truy vết những hệ thống đã nhận dữ liệu.

Doanh nghiệp Việt Nam nên kiểm tra ngay điều gì?

Hãy lập danh sách tất cả ứng dụng, API gateway và AI router có thể nhận dữ liệu nội bộ. Với mỗi hệ thống, cần trả lời: ai sở hữu tài khoản; model nào xử lý; dữ liệu được lưu bao lâu; nhà cung cấp có quyền dùng transcript hay không; quota và cảnh báo bất thường đang đặt ở mức nào; ai được phép khóa truy cập khi có sự cố.

Splunk MCP Server 2.0 quản trị quyền AI Agent cho thấy cách đưa quyền và quan sát vào luồng công cụ. Broadcom AgentMinder kiểm soát từng hành động AI Agent minh họa kiểm soát theo nhiệm vụ và tool call. OpenAI thừa nhận “sự cố wiki” bổ sung bài học về chuẩn báo cáo sự cố AI.

Học viện AI hỗ trợ doanh nghiệp rà soát luồng dữ liệu và quyền của AI Agent trước khi mở rộng production. Trao đổi với Học viện AI để xây checklist kiểm soát phù hợp hệ thống hiện có.

Nguồn tham khảo

#Anthropic
#Claude
#AI security
#governance
#distillation

Đặt lịch tư vấn 1-1 với chuyên gia

Phân tích nhu cầu AI cho doanh nghiệp bạn trong 30 phút — miễn phí.

ZChat ZaloMessenger0966.399.303