OpenAI thừa nhận AI vượt kiểm soát, gây ra vụ tấn công mạng
Sự cố cho thấy các tác nhân trí tuệ nhân tạo có thể tự lập kế hoạch, lựa chọn công cụ và vượt qua giới hạn bảo vệ, đặt ra yêu cầu cấp thiết về tăng cường giám sát và kiểm soát an toàn.
Ngày 21-7, OpenAI cho biết trong một cuộc thử nghiệm an ninh mạng nội bộ, một tác nhân AI (hệ thống AI có thể tự thực hiện chuỗi nhiệm vụ) đã vượt khỏi môi trường thử nghiệm được cô lập, tự kết nối Internet và xâm nhập hệ thống của Hugging Face - nền tảng lưu trữ và chia sẻ các mô hình AI cùng bộ dữ liệu.

Biểu tượng OpenAI. Ảnh chụp từ video của Reuters
Sự cố xảy ra trong cuộc kiểm tra được tiến hành tuần trước nhằm đánh giá khả năng an ninh mạng của các mô hình AI tiên tiến. Theo OpenAI, dù hệ thống được vận hành trong môi trường thử nghiệm được thiết kế để hạn chế truy cập ra bên ngoài, tác nhân AI vẫn tìm cách vượt qua các biện pháp bảo vệ để tiếp tục thực hiện mục tiêu của bài kiểm tra.
OpenAI mô tả đây là sự cố an ninh mạng chưa từng có liên quan đến các mô hình AI tiên tiến. Công ty cho biết đang rà soát quy trình thử nghiệm và tăng cường các biện pháp bảo vệ, nhưng chưa công bố mô hình AI liên quan, thời gian hệ thống truy cập hạ tầng của Hugging Face cũng như mức độ thiệt hại.
Trước đó, Hugging Face đã thông báo về vụ xâm nhập từ tuần trước và cho biết điểm bất thường là toàn bộ quá trình tấn công gần như do một hệ thống AI tự động thực hiện, thay vì được con người điều khiển từng bước.
Ông Clément Delangue, đồng sáng lập Hugging Face, cho biết mức độ tinh vi của vụ tấn công khiến công ty nghi ngờ nó có liên quan đến một phòng thí nghiệm AI hàng đầu. OpenAI sau đó xác nhận tác nhân AI của mình là nguyên nhân gây ra sự cố.
Vụ việc làm dấy lên thêm lo ngại về khả năng kiểm soát các tác nhân AI có thể tự lên kế hoạch, tự lựa chọn công cụ và thực hiện nhiều bước liên tiếp để hoàn thành mục tiêu mà không cần con người chỉ đạo từng bước.
Trao đổi với Reuters, bà Katie Moussouris, Giám đốc điều hành công ty an ninh mạng Luta Security, cho rằng các phòng thí nghiệm AI và cơ quan quản lý cần sớm xây dựng cơ chế giám sát, phát hiện và cảnh báo khi các hệ thống AI có hành động ngoài dự kiến. Theo bà, những công cụ hiện nay vẫn chưa đáp ứng được yêu cầu này.
Ông Matt Suiche, kỹ sư tại công ty an ninh mạng AI Tolmo, nhận định năng lực tấn công mạng của các mô hình AI tiên tiến đang dần tiệm cận trình độ của những nhóm tin tặc có kỹ năng cao. Tuy nhiên, ông cũng cho rằng các kỹ thuật được sử dụng trong vụ việc không hoàn toàn mới và vẫn có thể được thực hiện bằng những công nghệ đã phổ biến, không nhất thiết phải sử dụng các mô hình AI mới nhất.
Tổng hợp












