Bỏ qua để đến nội dung

Báo cáo tình báo an ninh của Anthropic: AI đang xóa nhòa ranh giới giữa hacker nghiệp dư và tổ chức nhà nước

Anthropic vừa công bố báo cáo tình báo an ninh mới nhất, tổng hợp các trường hợp lạm dụng Claude mà công ty đã phát hiện và ngăn chặn trong khoảng thời gian từ tháng 12/2025 đến tháng 8/2026. Kết luận đáng chú ý nhất: AI đã “xóa nhòa khoảng cách về nhân lực và công cụ vốn từng phân biệt các chiến dịch tấn công được nhà nước hậu thuẫn, có nguồn lực dồi dào, với những kẻ tấn công đơn lẻ”.

Nói cách khác, một người duy nhất, với một laptop và quyền truy cập Claude, giờ đây có thể thực hiện những chiến dịch tấn công mạng hoặc thao túng dư luận mà trước đây cần cả một đội ngũ chuyên gia mới làm nổi.

Tấn công mạng: từ một người thành một “đội”

Phần tiêu đề “Tấn công mạng: từ một người thành một “đội””

Báo cáo mô tả nhiều vụ việc trong đó Claude bị lợi dụng cho tấn công mạng, với vai trò ngày càng tự động - từ hỗ trợ trò chuyện đơn thuần đến vận hành gần như toàn bộ quy trình tấn công (do thám, khai thác lỗ hổng, đánh cắp dữ liệu) với rất ít sự can thiệp của con người.

Một vài ví dụ tiêu biểu:

  • Một nhóm gián điệp mạng có liên hệ với Nga (được cho là liên kết với nhóm Midnight Blizzard) đã dùng AI để tự động dò quét hệ thống email, xây dựng hạ tầng lừa đảo (phishing), và đặc biệt là dùng agent AI để tự động chỉnh sửa mã độc mỗi khi bị phần mềm bảo mật phát hiện - giúp kẻ tấn công “vá lỗi” nhanh hơn tốc độ đội phòng thủ có thể phản ứng.
  • Một cá nhân nói tiếng Pháp, hoạt động một mình, đã vận hành cả một hạ tầng gồm 10 máy chủ đám mây để quét gần 2 triệu ứng dụng Android tìm thông tin đăng nhập bị lộ, tổ chức bán lại dữ liệu qua hơn 100 nhóm Telegram, và vận hành cả một “chợ đen” bán dữ liệu thẻ tín dụng giả danh cơ quan cảnh sát Pháp.
  • Một nhóm nói tiếng Trung, trong đó có cả sinh viên đại học, đã dùng AI để tự động hóa việc tìm lỗ hổng bảo mật (zero-day) trong firmware - AI tự đọc mã máy, đưa ra giả thuyết về lỗ hổng, viết mã khai thác, và tự kiểm thử liên tục. Quy trình này tạo ra hơn 12 lỗ hổng zero-day tiềm năng chỉ trong một tháng.

Khóa API AI trở thành “mỏ vàng” mới của tội phạm mạng

Phần tiêu đề “Khóa API AI trở thành “mỏ vàng” mới của tội phạm mạng”

Một xu hướng đáng lo ngại khác: tội phạm mạng giờ đây chủ động nhắm vào khóa API và token đăng nhập của các dịch vụ AI, vì ba lý do - chúng có thể bán lại, dùng “chùa” sức mạnh tính toán của người khác, và giúp che giấu danh tính thật của kẻ tấn công (mọi hoạt động sẽ bị quy trách nhiệm cho chủ sở hữu tài khoản hợp pháp).

Báo cáo nêu ví dụ một nhóm đã cấy lệnh độc hại (prompt injection) vào môi trường thử nghiệm của một đối tác đánh giá AI, khiến hệ thống vô tình để lộ khóa API thật của nhiều hãng AI khác nhau - từ đó tấn công gần 30 công ty AI chỉ trong 4 ngày với mục tiêu chiếm quyền truy cập vào một mô hình Claude chưa phát hành (không thành công). Một nhóm khác thì mở dịch vụ “đại lý bán lại Claude giá rẻ” giả mạo, âm thầm chuyển hướng người dùng sang một mô hình AI khác trong khi âm thầm đánh cắp thông tin đăng nhập tài khoản Anthropic của họ để bán lại.

Thao túng thông tin: AI viết bài, dựng nhân vật ảo, và cả một “bộ máy” tuyên truyền

Phần tiêu đề “Thao túng thông tin: AI viết bài, dựng nhân vật ảo, và cả một “bộ máy” tuyên truyền”

Ở mảng thao túng thông tin (influence operations), báo cáo ghi nhận việc AI không chỉ được dùng để viết nội dung, mà còn để xây dựng cả “bộ máy” vận hành chiến dịch: sổ tay hướng dẫn, hệ thống nhân vật giả (persona), cơ sở dữ liệu mục tiêu, và cả bảng chấm điểm hiệu quả chiến dịch.

Một số vụ việc nổi bật:

  • Một chiến dịch tuyên truyền gắn với Nga tại Cộng hòa Trung Phi dùng AI để soạn nội dung ủng hộ chính phủ, chống Pháp, đồng thời tự động hóa cả công tác nhân sự nội bộ và theo dõi phe đối lập. Đáng chú ý, Claude đã từ chối yêu cầu nêu đích danh những cá nhân cụ thể là “phần tử nổi dậy” - buộc nhóm này phải chuyển sang cách viết ẩn danh.
  • Một công ty quảng cáo tại Pháp (LKM Company) đã vận hành mạng lưới khoảng 70 trang tin giả cùng hàng trăm tài khoản mạng xã hội, dùng Claude để viết và “xào” lại gần 9.000 bài báo bằng khoảng 20 ngôn ngữ - thậm chí viết cùng một câu chuyện theo hai chiều hướng chính trị đối lập cho hai nhóm độc giả khác nhau, tùy theo khách hàng nào trả tiền.
  • Một công ty công nghệ tại Istanbul đã xây dựng cả một nền tảng thao túng bầu cử ở Malaysia, được quảng cáo trá hình là “công cụ tình báo mạng phòng thủ”. Nền tảng này dùng Claude Code để dựng bảng điều khiển quản lý gần 1.000 tài khoản X (Twitter) giả, nhắm mục tiêu cử tri theo từng khu vực bầu cử dựa trên dữ liệu chủng tộc, tôn giáo thật. Trong quá trình đó, Claude đã từ chối một phần yêu cầu, xác định một tài liệu là “vu khống chính trị”.

Báo cáo chỉ ra một sự dịch chuyển quan trọng trong bài toán kinh tế của kẻ tấn công: AI không làm tăng “phần thưởng” của một cuộc tấn công thành công, nhưng làm giảm mạnh chi phí nhân lực và ngưỡng kỹ năng cần thiết để thực hiện nó. Điều này khuyến khích xu hướng tấn công quy mô lớn hơn, nhưng mỗi mục tiêu lại tốn ít công sức hơn.

Dù vậy, con người vẫn giữ vai trò quyết định ở các khâu chiến lược - chọn mục tiêu, kiếm tiền từ dữ liệu đánh cắp, rà soát kết quả. AI đóng vai trò khuếch đại quy mô, tốc độ và phạm vi, chứ chưa “tự ra quyết định” hoàn toàn thay con người.

Anthropic cho biết công ty tiếp tục coi việc công khai các vụ lạm dụng là trách nhiệm cần thiết, đồng thời kêu gọi phối hợp cùng chính phủ, xã hội dân sự và các bên phòng thủ khác để tăng cường khả năng ứng phó chung trước những mối đe dọa này.