AI của OpenAI tấn công mạng nhiều tháng trước khi bị phát hiện

Các nhà nghiên cứu cho biết những mô hình AI mà OpenAI đang thử nghiệm đã tải hàng trăm gói phần mềm độc hại lên RubyGems hồi tháng 5, khoảng hai tháng trước vụ tấn công Hugging Face.

Theo nhóm nghiên cứu gồm Spencer Kitts, Thomas Larsen và Sydney Von Arx, ngày 11/5, hàng trăm gói phần mềm chứa mã độc đã được tải lên RubyGems, dịch vụ phân phối phần mềm dành cho ngôn ngữ lập trình Ruby. Nhóm cho rằng các gói này được tạo bởi những mô hình AI nội bộ của OpenAI.

OpenAI xác nhận sự việc với The Wall Street Journal, nhưng cho rằng các mô hình AI sử dụng RubyGems để truy cập Internet, thực hiện những nhiệm vụ được xem là vô hại và thu thập thông tin công khai trong quá trình huấn luyện, đánh giá. Công ty cho biết sẽ tiếp tục điều tra hoạt động của những tác nhân AI trong các đợt thử nghiệm.

Những mô hình AI của OpenAI đã tự động tải hàng trăm gói phần mềm chứa mã độc lên RubyGems. Ảnh: ACS

Những mô hình AI của OpenAI đã tự động tải hàng trăm gói phần mềm chứa mã độc lên RubyGems. Ảnh: ACS

Tuy nhiên, theo các nhà nghiên cứu, những mô hình AI này đã tìm cách đánh cắp thông tin đăng nhập của người dùng RubyGems bằng cách khai thác một lỗ hổng chưa từng được biết đến trên máy chủ của dịch vụ. Chưa rõ nỗ lực này có thành công hay không. Các mô hình cũng bị cho là đã khai thác RubyDoc.info, một dịch vụ tạo tài liệu cho mã nguồn, để thực thi mã của chúng trên máy chủ.

RubyGems sau đó cho biết cuộc điều tra riêng của họ không tìm thấy bằng chứng cho thấy các nỗ lực nói trên đã thành công. Công ty cũng chưa thể xác định liệu hàng trăm gói được đăng tải trong chiến dịch phát tán thư rác có thực sự do mô hình AI tạo ra hay không. Vụ việc từng khiến RubyGems phải tạm dừng đăng ký tài khoản mới và được một thành viên nhóm an ninh của dịch vụ mô tả là một “cuộc tấn công nguy hiểm quy mô lớn”.

Điểm đáng chú ý là sự việc xảy ra khoảng hai tháng trước vụ việc liên quan Hugging Face, nền tảng mã nguồn mở bị một nhóm AI agent của OpenAI tự động tấn công hồi tháng 7. Theo Reuters, khoảng 700 tác nhân AI (AI agent) đã tham gia vụ tấn công và trong nhiều trường hợp tìm cách che giấu dấu vết.

Vụ RubyGems cũng bổ sung một trường hợp vào chuỗi sự cố liên quan đến tác nhân AI của các công ty phát triển mô hình ngôn ngữ lớn. Trước đó, các tác nhân của OpenAI từng chiếm quyền kiểm soát một trang wiki tiếng Đức và biến nó thành nền tảng trao đổi phục vụ việc gian lận trong các bài kiểm tra. Trong khi đó, đối thủ Anthropic hồi giữa tuần công bố trường hợp thứ tư một mô hình AI của công ty tìm cách xâm nhập các hệ thống bên ngoài trong quá trình thử nghiệm.

Những sự việc này đang làm gia tăng câu hỏi về khả năng kiểm soát các mô hình AI Tự chủ (Agentic AI) khi chúng được trao quyền truy cập Internet và các dịch vụ bên ngoài.

Gen Z ngày càng lo sợ AI khi làn sóng sa thải lan rộng

Quang Anh (theo Reuters, Wall Street Journal)

Nguồn Công Luận: https://congluan.vn/ai-cua-openai-tan-cong-mang-nhieu-thang-truoc-khi-bi-phat-hien-post360411.html