Trong hai tháng qua, hàng loạt mô hình AI tiên tiến từ OpenAI, Anthropic, Meta và Moonshot AI đã tự ý thực hiện các hành vi tấn công mạng, xâm nhập hệ thống và tạo danh tính giả, đặt ra hồi chuông cảnh báo về mức độ rủi ro của trí tuệ nhân tạo khi được triển khai rộng rãi.
Các mô hình trí tuệ nhân tạo (AI) ngày càng có khả năng tự chủ đang làm gia tăng rủi ro đối với chính những môi trường được thiết kế để kiểm tra độ an toàn của chúng, khi một số tác nhân AI đã thoát khỏi hệ thống kiểm soát, truy cập Internet và thậm chí xâm nhập các hệ thống thực tế.
OpenAI, Anthropic và Meta đều phát hiện mô hình AI truy cập Internet ngoài dự kiến khi kiểm thử an ninh. Điểm chung của ba sự cố là Irregular, startup Israel chuyên xây dựng môi trường đánh giá khả năng tấn công mạng của AI.
Các trường hợp trí tuệ nhân tạo (AI) thoát khỏi phòng thí nghiệm, xâm nhập vào các công ty khác và cố gắng lừa đảo đã gây xôn xao dư luận trong những tuần gần đây. Trong một trường hợp, các mô hình AI thậm chí còn hợp tác với nhau để thoát khỏi môi trường thử nghiệm. Điều này có nghĩa là máy móc đang chiếm lĩnh thế giới? Giáo sư Oren Etzioni của Đại học Washington và là cựu Giám đốc Điều hành của Viện Trí tuệ Nhân tạo Allen khẳng định chính con người mới là đối tượng cần phải cảnh giác. AI chỉ là công cụ.
Mô hình trí tuệ nhân tạo (AI) mới nhất của công ty Trung Quốc Moonshot đã thoát khỏi môi trường thử nghiệm an ninh mạng, đánh dấu sự cố mới nhất làm dấy lên lo ngại về khả năng kiểm soát công nghệ của các công ty phát triển AI.
Theo nhà khoa học máy tính đoạt giải Giải Nobel Geoffrey Hinton, người được mệnh danh là 'bố già AI', trí tuệ nhân tạo (AI) càng thông minh thì con người càng khó kiểm soát.
Sau OpenAI và Anthropic, mô hình Kimi K3 của Trung Quốc cũng tự hành động trong một thử nghiệm an ninh mạng, gây lo ngại về khả năng vượt kiểm soát của AI.
Một mô hình AI của Meta đã xâm nhập hệ thống của một doanh nghiệp khác trong quá trình thử nghiệm an ninh mạng, làm dấy lên thêm lo ngại về rủi ro từ các tác nhân AI ngày càng tự chủ.
Mô hình AI tiên tiến của 2 công ty bị phát hiện tự ý sử dụng danh tính giả để lừa đảo người thật, cố gắng tìm cách chèn mã độc trong một cuộc kiểm thử an ninh mạng.