Claude bị lợi dụng để tự động hóa hoạt động khai thác và đánh cắp dữ liệu trên nhiều nạn nhân

Anthropic đã cảnh báo rằng các tội phạm mạng và tin tặc do nhà nước bảo trợ đang sử dụng các mô hình Claude của mình để thực hiện các cuộc tấn công mạng, thiết kế vũ khí, tuyên truyền và giám sát hàng loạt. Các tác nhân đe dọa này, được gọi là các Nhóm Đe dọa Tạo sinh (GTGs), bao gồm cả các nhóm do chính phủ bảo trợ và các nhóm tội phạm tài chính.
Anthropic Claude AI Security Report

Anthropic đã đưa ra cảnh báo rằng các tội phạm mạng và tin tặc do nhà nước bảo trợ đang sử dụng các mô hình Claude của mình cho các cuộc tấn công mạng, thiết kế vũ khí, tuyên truyền và giám sát hàng loạt trong khoảng thời gian từ tháng 12 năm 2025 đến tháng 8 năm 2026.

Các tác nhân đe dọa này, được công ty trí tuệ nhân tạo (AI) này đặt tên là các Nhóm Đe dọa Tạo sinh (Generative Threat Groups - GTGs), bao gồm các nhóm do nhà nước bảo trợ, tội phạm có động cơ tài chính, các nhà cung cấp phần mềm gián điệp thương mại, các tổ chức tuyên truyền nhà nước và các cá nhân có động cơ chính trị.

"Các kỹ năng an ninh mạng của các mô hình AI có nghĩa là AI đã xóa nhòa khoảng cách về nhân lực và công cụ vốn từng phân tách các hoạt động do nhà nước bảo trợ có nguồn lực dồi dào với các cá nhân vận hành đơn lẻ," Anthropic cho biết. "Việc sử dụng AI đã vượt xa các câu hỏi và phản hồi đơn giản từ chatbot, thay vào đó liên quan đến việc sử dụng các khung làm việc đa tác nhân (multi-agent frameworks) để thực hiện trinh sát, khai thác và đánh cắp dữ liệu (data exfiltration)."

Các chiến dịch mạng tiêu biểu sử dụng AI

Trong số các trường hợp đáng chú ý được Anthropic nêu bật là việc phát triển quy trình làm việc được hỗ trợ bởi AI của một tác nhân đe dọa do Nga bảo trợ có tên GTG-20006, nhóm này có liên quan đến Midnight Blizzard (còn được gọi là APT29 và Cozy Bear). Một số chiến dịch mạng hỗ trợ bởi AI khác được Anthropic nêu trong báo cáo dài 154 trang bao gồm:

  • GTG-50014 (còn gọi là MeowSHA, frkoo và blazespider): Một nhóm vận hành nói tiếng Pháp và bị nghi ngờ là chi nhánh của nhóm ShinyHunters. Nhóm này đã điều hành một đường ống thu thập thông tin xác thực phân tán trên 10 worker AWS EC2, tải xuống hàng loạt 1,8 triệu tệp APK Android từ nhiều nguồn, quét các bí mật được mã hóa cứng bằng TruffleHog và gửi kết quả đã xác minh đến một nhóm Telegram.
  • Một chi nhánh khác của ShinyHunters chuyên trộm cắp chuỗi cung ứng bằng cách xâm nhập các nhà cung cấp phần mềm dịch vụ (SaaS) để đánh cắp dữ liệu của khách hàng, đẩy nhanh quá trình trinh sát và thực hiện data exfiltration.
  • GTG-10007: Một nhóm vận hành nói tiếng Trung Quốc có khả năng đặt tại tỉnh Hồ Nam. Nhóm này đã sử dụng Claude để thực hiện các nỗ lực xâm nhập vào các hệ thống đang hoạt động, trinh sát các mạng chính phủ nước ngoài tại Trung Đông, Châu Âu và Đông Nam Á, đồng thời nghiên cứu lỗ hổng và phát triển exploit chống lại các sản phẩm bảo mật Endpoint lớn. Nhóm này đã nhắm mục tiêu vào khoảng 50 tổ chức thuộc các lĩnh vực giáo dục, bán lẻ, năng lượng, công nghệ, y tế, tài chính, sản xuất và chính phủ trên toàn cầu.
  • GTG-50021: Một nhóm nói tiếng Nga và Ukraine điều hành dịch vụ bán lại AI giả mạo cung cấp quyền truy cập Claude giá rẻ, nhưng thực tế là chuyển hướng lưu lượng truy cập của khách hàng sang một mô hình AI khác, đồng thời cài đặt trình thu thập thông tin xác thực để đánh cắp tài khoản Anthropic của người dùng.
  • GTG-50020: Một tác nhân nói tiếng Nga có động cơ tài chính, đã nhắm mục tiêu vào chuỗi cung ứng AI bằng cách đánh cắp API keys của các nhà cung cấp mô hình và tìm cách truy cập trái phép vào các mô hình AI chưa công bố.
  • GTG-50029: Một cá nhân nói tiếng Pháp sử dụng Claude để nhắm mục tiêu vào các đảng phái chính trị, cơ quan truyền thông và think-tank tại Châu Âu. Đối tượng này đã khai thác một lỗ hổng race condition khi cài đặt lại WordPress chưa từng được công bố để tạo tài khoản quản trị viên giả mạo mà không cần thông tin xác thực hợp lệ.
"Ở một cấp độ, các tác nhân sử dụng Claude như một trợ lý kỹ thuật trong việc tạo ra phần mềm độc hại (malware), bộ công cụ lừa đảo (phishing kits) và công cụ giám sát. Ở mức độ cao hơn, các tác nhân chỉ đạo Claude thực hiện các hoạt động như chạy lệnh trên mạng nạn nhân, thu thập thông tin xác thực với sự quyết định của con người trong từng bước (GTG-20006)."
"Ở mức độ cao nhất, các hoạt động diễn ra tự động với sự giám sát tối thiểu của con người: bao gồm các khung làm việc đa tác nhân thực hiện trinh sát, khai thác và trộm cắp đồng thời đối với nhiều nạn nhân trong nhiều giờ hoặc nhiều ngày (GTG-50014, GTG-50020, GTG-50029)."

Các hoạt động gây ảnh hưởng và giám sát hàng loạt

Công ty AI này cho biết họ cũng đã xác định và triệt phá một số chiến dịch gây ảnh hưởng, trong đó Claude đóng vai trò là "phụ tá biên tập hoặc người sáng tạo nội dung" để sản xuất nội dung hàng loạt ở quy mô lớn. Tuy nhiên, Anthropic nhấn mạnh rằng không có nỗ lực nào trong số này đạt được sự tương tác thực tế và đã bị ngăn chặn trước khi kịp xây dựng đối tượng khán giả.

Một số cụm chiến dịch gây ảnh hưởng và giám sát được Anthropic gắn cờ bao gồm:

  • GTG-04001: Tác nhân nói tiếng Nga tại Bangui tham gia thao túng thông tin tại Cộng hòa Trung Phi nhằm khuếch trương các quan điểm ủng hộ Nga và chống Pháp.
  • GTG-54002: Dịch vụ "gây ảnh hưởng thuê" thương mại sử dụng Claude để sản xuất hàng loạt nội dung chính trị trên khoảng 70 trang web tin tức giả mạo, liên quan đến một công ty quảng cáo kỹ thuật số tại Pháp.
  • GTG-54009: Nền tảng giám sát thương mại sử dụng Claude để phân tích, phân loại và lập hồ sơ hoạt động trên mạng xã hội của người dùng tại Iran và vùng Vịnh. Hoạt động này được đánh giá là do một nhà cung cấp tình báo thương mại Israel-Singapore thực hiện.
  • GTG-14010: Một hoạt động liên kết với nhà nước Trung Quốc sử dụng Claude để theo dõi, lập hồ sơ và tuyển dụng người Duy Ngô Nhĩ tại Syria, chuyển đổi các cuộc hội thoại từ hơn 100 nhóm WhatsApp và Telegram sang dữ liệu có cấu trúc.
  • GTG-14022: Hoạt động "giám sát dư luận" và giám sát những người bất đồng chính kiến dựa tại Trung Quốc, yêu cầu Claude đóng vai trò là "nhà phân tích dư luận khẩn cấp cấp cao phục vụ chính phủ."
  • GTG-30006: Tác nhân đe dọa Iran sử dụng các tài khoản Claude.ai miễn phí để phát triển malware, trang phishing và công cụ đánh cắp thông tin xác thực Chrome.

Ngăn chặn nỗ lực thiết kế vũ khí

Ở những nơi khác, Anthropic cho biết họ đã vô hiệu hóa các nỗ lực lạm dụng Claude của các tác nhân đe dọa ở miền bắc Yemen để phát triển vũ khí có điều hướng, hai hoạt động dựa tại Trung Quốc nhằm soạn thảo đặc tả cho hệ thống kiểm soát hỏa lực chống ngư lôi và phần mềm nhắm mục tiêu cho chiến tranh điện tử, và một hoạt động dựa tại Nga nhằm thiết kế một bầy drone kamikaze FPV tự hành toàn diện.

"Khi các mô hình AI trở nên phổ biến hơn, các nhà cung cấp sẽ tiếp tục có được tầm nhìn liên quan đến các mối đe dọa trong thế giới thực mà ngay cả các chính phủ cũng thiếu," công ty cho biết. "Chúng tôi hy vọng rằng việc chia sẻ những hiểu biết sớm này sẽ giúp các chính phủ và ngành công nghiệp hiểu rõ bản chất của những rủi ro này và các biện pháp bảo vệ cần thiết."