Anthropic ngăn chặn dùng Claude để phát triển 'bầy đàn' UAV tự hành
Anthropic, công ty nghiên cứu và đảm bảo an toàn trí tuệ nhân tạo (AI), cho biết đã ngăn chặn các nhà phát triển Nga sử dụng công cụ hỗ trợ lập trình Claude để tạo phần mềm vận hành các thiết bị bay không người lái (UAV) tự sát tự hành của Nga.

Anthropic cho rằng các nhà phát triển Nga sử dụng công cụ hỗ trợ lập trình Claude để tạo phần mềm vận hành các thiết bị bay không người lái (UAV) tự sát tự hành của Nga. Ảnh: Tass
Hệ thống này được thiết kế để tự động lựa chọn và tấn công mục tiêu, bao gồm cả con người, mà không cần sự can thiệp của người điều khiển.
Trong bối cảnh ngày càng có nhiều lo ngại về hướng phát triển của AI thiếu kiểm soát, một báo cáo của Anthropic nhấn mạnh cần phải giám sát việc sử dụng và phát triển công nghệ này nhằm tránh nguy cơ dẫn đến những thảm họa nghiêm trọng.
Trong báo cáo hằng quý có tiêu đề “Phát hiện và ngăn chặn hành vi lạm dụng AI”, được công bố đầu tháng này, Anthropic cho biết đã xác định một nhóm các nhà phát triển có liên hệ với Nga, mang mã định danh GTG-27005, đang sử dụng công cụ hỗ trợ lập trình Claude để tạo phần mềm cho các UAV tự sát tự hành.
Anthropic cho rằng mặc dù hệ thống này được phát triển cho mục đích quân sự, các thành viên trong nhóm có khả năng là những chuyên gia độc lập làm việc tại các trường đại học. Công ty chưa xác định được mối liên hệ cụ thể với Lực lượng Vũ trang Nga, do nhóm này sử dụng nhiều máy chủ ảo để né tránh các hạn chế về địa lý. Anthropic nhận định nhóm này có những đặc điểm tương đồng với nhóm tin tặc Nga “Midnight Blizzard”, từng sử dụng các công cụ AI tạo sinh để chuẩn bị cho các cuộc tấn công mạng. Việc chuyển sang phát triển các hệ thống chiến đấu tự hành đánh dấu một bước đi mới của nhóm này.
Báo cáo của Anthropic cho biết chiến dịch này được gọi là “DroneDoc” và “Seraphim”. Nhóm đã đăng ký tài khoản vào cuối năm 2025, nhưng bắt đầu triển khai thực sự từ giữa tháng 5/2026. Các thành viên sử dụng tác nhân Claude Coding để viết và rà soát mã phần mềm, đồng thời lưu trực tiếp các thành phần được tạo ra vào tệp dự án của mình.
Đoạn mã này được tích hợp với phần mềm mô phỏng UAV và các mô hình huấn luyện sử dụng tài nguyên tính toán thuê từ các nhà cung cấp thương mại. Hệ thống hoàn chỉnh được thiết kế để tự động lựa chọn mục tiêu, bao gồm cả con người, và phát lệnh tấn công mà không cần thêm sự can thiệp của người điều khiển.
Mục tiêu cuối cùng dường như là vận hành các UAV tấn công theo cơ chế bầy đàn và đưa ra quyết định một cách tự chủ. Việc sử dụng Claude cho phép tạo ra bộ nhớ dùng chung cho cả bầy đàn trong một hệ thống phối hợp có khả năng chịu lỗi. Đây là một kiến trúc mạng phân tán giúp duy trì sự đồng bộ và phân công nhiệm vụ ngay cả khi một số drone hoặc thành phần riêng lẻ gặp sự cố hoặc mất kết nối.
Nhóm cũng đang phát triển một mô hình ngôn ngữ nhỏ gọn được tích hợp trực tiếp trên thiết bị, có nhiệm vụ xác định hành động tiếp theo của drone sau khi các thành viên trong bầy đàn tiếp cận mục tiêu, như tấn công mục tiêu khác, tiếp tục giám sát hoặc quay trở về căn cứ.
Các nhà phát triển đã sử dụng những thước phim ghi lại giao tranh tại Ukraine, được thu thập từ mạng xã hội, để huấn luyện một hệ thống thị giác máy tính. Trong hệ thống này, nhân sự và khí tài của Ukraine được xác định là đối tượng thù địch, trong khi các hệ thống quân sự của Nga được đưa vào danh sách những mục tiêu không được phép tấn công.
Các cuộc mô phỏng trình diễn đã được thực hiện tại vùng Donetsk, cũng như tại các thành phố tiền tuyến và các hành lang giao thông của Ukraine.
Tổng cộng, Anthropic xác định và sau đó chặn 9 tài khoản liên quan đến dự án này. Bên cạnh mối liên hệ với một trường đại học trong khu vực, Anthropic còn phát hiện các kết nối với Viện Hàn lâm Khoa học Nga.
Báo cáo cũng mô tả xu hướng gia tăng việc sử dụng AI để tổ chức các cuộc tấn công mạng nhằm vào quan chức chính phủ và các mục tiêu quân sự của Ukraine. Một nhóm có liên hệ với Nga đã sử dụng AI trong các chiến dịch lừa đảo trực tuyến (phishing), phát tán mã độc, chiếm đoạt tài khoản WhatsApp và tiến hành tấn công thông qua các mạng Wi-Fi khách sạn đã bị xâm nhập.
Khẩu hiệu của Hiệp hội Súng trường Quốc gia Mỹ (NRA) - “Súng không giết người, con người mới là kẻ giết người” - cũng có thể được áp dụng cho AI trong bối cảnh sự việc mới nhất này. Điều đó cho thấy những lời cảnh báo về nguy cơ phát triển AI thiếu kiểm soát không hẳn là sự phóng đại; thay vào đó, chính người sử dụng, chứ không phải bản thân công nghệ, mới là đối tượng cần được kiểm soát.



