Anthropic báo cáo trí tuệ nhân tạo bị lạm dụng trong nhiều chiến dịch toàn cầu
Ngày 10/9, Công ty nghiên cứu và phát triển trí tuệ nhân tạo (AI) Anthropic vừa chính thức công khai báo cáo an ninh mạng diện rộng, vạch trần hàng loạt chiến dịch lạm dụng AI tinh vi bị triệt phá từ tháng 12/2025 đến tháng 8/2026.

Ảnh chụp màn hình: Anthropic.
Công bố của Anthropic cho thấy một sự thay đổi bản chất đáng quan ngại: trí tuệ nhân tạo không còn dừng lại ở vai trò công cụ hỗ trợ thụ động, mà đã trở thành bộ máy điều phối tự động, thu hẹp khoảng cách tài nguyên và công nghệ giữa các hacker cá nhân với những tổ chức gián điệp do nhà nước tài trợ.
Sự phát triển của các mô hình ngôn ngữ lớn đã làm thay đổi căn bản bài toán kinh tế trong chiến tranh mạng. Trước đây, các chiến dịch xâm nhập quy mô lớn đòi hỏi đội ngũ chuyên gia trình độ cao cùng ngân sách khổng lồ.
Tuy nhiên, việc tích hợp các tác nhận AI tự hành đã cho phép một cá nhân duy nhất vận hành các đợt tấn công đa mục tiêu chỉ trong thời gian từ hai đến ba giờ.
Theo báo cáo của Anthropic, dựa trên chuỗi quy trình tự động, AI có thể hỗ trợ người có động cơ không chuẩn mực thực hiện trọn vẹn từ khâu dò quét lỗ hổng, phát triển mã độc, duy trì quyền truy cập cho đến trích xuất dữ liệu hàng loạt.
Yếu tố phân biệt giữa người sử dụng trí tuệ nhân tạo giờ đây không còn nằm ở trình độ kỹ thuật hay quy mô tổ chức mà chủ yếu nằm ở mục đích sử dụng.
Trong mảng tác động dư luận, sự xuất hiện của mô hình thương mại hóa sức ảnh hưởng đã biến AI thành những tòa soạn tin giả tự động. Báo cáo ghi nhận nhiều công ty quảng cáo thương mại và tổ chức chính trị đã sử dụng mô hình AI để vận hành mạng lưới hàng nghìn tài khoản mạng xã hội cùng hàng chục trang báo giả mạo.
Công cụ AI bị lạm dụng để tự động sản xuất bài viết đa ngôn ngữ, tinh chỉnh giọng văn theo từng tệp người tiếp cận thông tin mạng và chủ động xóa bỏ dấu vết nhận diện văn bản máy tính.
Một số nhóm có động cơ không chính đáng thậm chí đã can thiệp vào diễn biến bầu cử và thao túng tâm lý cử tri cả trong nước và người dùng mạng xã hội đang theo dõi sự kiện thời sự trên thế giới.
Bên cạnh mặt trận thông tin, AI cũng đang bị tích hợp sâu vào bộ máy giám sát diện rộng và các hoạt động quân sự của một số quốc gia. Các cơ quan an ninh và nhà cung cấp phần mềm gián điệp đã dùng AI để phân tích khối lượng khổng lồ dữ liệu mạng xã hội, lập hồ sơ tâm lý và theo dõi vị trí của các nhóm đối tượng bất đồng chính kiến.
Đồng thời, báo cáo của Anthropic cũng cảnh báo việc kẻ xấu cố tình chia nhỏ quy trình làm việc qua nhiều phiên trò chuyện nhằm lách rào cản an toàn của AI, đẩy nhanh tiến độ nghiên cứu phần mềm điều khiển vũ khí thông thường và thử nghiệm sinh học có tính chất lưỡng dụng.
Một điểm nóng khác được Anthropic làm rõ là hành vi “học lỏm” hoặc “sao chép” mô hình AI trái phép, nơi các phòng thí nghiệm đối thủ âm thầm trích xuất chuỗi suy luận của các mô hình AI tiên tiến.
Một số phòng thí nghiệm đối thủ không muốn tốn tiền nghiên cứu nên đã tạo hàng nghìn tài khoản ảo, liên tục đặt câu hỏi khó rồi bắt công cụ Claude của Anthropic trình bày chi tiết từng bước suy luận. Sau đó, họ lấy toàn bộ lời giải chi tiết đó về để “dạy” cho AI riêng của họ thông minh lên một cách nhanh chóng mà không tốn tiền đầu tư.
Bản báo cáo còn làm sáng tỏ một thực trạng người dùng bị lừa sử dụng AI trung gian mà không hay biết dữ liệu của mình bị “chuyển tiếp” sang một công cụ khác.
Nhiều tệp tài liệu mật như báo cáo tài chính chưa công bố hoặc mật khẩu hệ thống của công ty được người dùng tin tưởng sử dụng ứng dụng AI của một công ty nào đó để xử lý, nhưng lại bị chuyển tiếp sang cho Claude trả lời hộ, rồi lấy câu trả lời của Claude đưa lại cho người hỏi.
Bản báo cáo của Anthropic vừa công bố là lời khẳng định của công ty công nghệ này về việc minh bạch hóa các mẫu hình trí tuệ nhân tạo, để các nhà phát triển và chính phủ cùng xây dựng rào cản phòng thủ tập thể vững chắc trong kỷ nguyên AI tự chủ.


