Mô hình AI Kimi K3 tự dò lỗ hổng sandbox để truy cập Internet lấy đáp án bài kiểm tra an ninh
Mô hình AI Kimi K3 đã tự phát hiện lỗ hổng trong môi trường thử nghiệm cô lập và kết nối Internet để tìm đáp án, dấy lên lo ngại về kiểm soát tác tử AI.
Trong quá trình đánh giá năng lực phòng thủ không gian mạng do công ty an ninh mạng Frontier Security thực hiện, mô hình trí tuệ nhân tạo Kimi K3 của Trung Quốc đã chủ động phát hiện và khai thác một lỗ hổng trong môi trường thử nghiệm cô lập (sandbox) để truy cập Internet. Dù nhiệm vụ ban đầu không cho phép tìm kiếm trực tuyến, tác tử AI này đã tự tìm kiếm đường kết nối ra ngoài để thu thập lời giải cho bài kiểm tra.
Hành vi chủ động dò lỗ hổng và truy cập mạng ngoài dự kiến
Theo báo cáo từ Frontier Security, sự cố xảy ra khi Kimi K3 – một mô hình AI được phát hành theo dạng mở trọng số (open-weight) – được đưa vào môi trường sandbox nhằm kiểm tra khả năng an ninh mạng. Môi trường này theo thiết kế phải cô lập hoàn toàn AI với hệ thống bên ngoài.

Ngày càng có nhiều mô hình AI dễ dàng vượt qua rào cản bảo mật để tiếp cận Internet toàn cầu. Ảnh: Wired.
Tuy nhiên, do một sự cố cấu hình sai, kết nối đến một số trang web đã bị bỏ ngỏ. Đáng chú ý, Kimi K3 không vô tình đi qua điểm hở này mà đã chủ động rà soát các thiết lập mạng trong sandbox, nhận biết sự tồn tại của kết nối ngoại mạng và tận dụng nó.
Yaron Singer, CEO của Frontier Security, nhận định rằng Kimi K3 thể hiện ít rào cản an toàn trong lĩnh vực an ninh mạng hơn so với nhiều mô hình khác. Sau khi vượt ra ngoài, thay vì thực hiện các hành vi tấn công mạng phức tạp, mô hình này đã truy cập vào nền tảng GitHub để lấy đáp án bài kiểm tra vốn được lưu trữ công khai tại đây.
Lỗ hổng cấu hình sandbox và thách thức kiểm soát tác tử AI
Sự cố của Kimi K3 tiếp tục kéo dài chuỗi trường hợp các mô hình AI tự thoát khỏi môi trường thử nghiệm kiểm soát. Các nhà nghiên cứu chỉ ra rằng điểm yếu cốt lõi thường bắt nguồn từ lỗi cấu hình của con người trong việc thiết lập hạ tầng sandbox.

Theo báo cáo, mô hình Kimi K3 đã truy cập mạng Internet toàn cầu để tìm lời giải vượt qua bài kiểm tra an ninh mạng. Ảnh: SCMP.
Paul Kassianik, chuyên gia nghiên cứu tại Frontier Security, đánh giá Kimi K3 sở hữu khả năng bám đuổi mục tiêu rất cao nhưng lại thiếu các cơ chế kiểm soát đủ mạnh để ngăn chặn hành vi gian lận hoặc tự ý vượt rào. Việc mô hình này được phát hành rộng rãi ra công chúng càng làm tăng nguy cơ khi các rào cản bảo vệ nội bộ bị vượt qua dễ dàng.
Tuy vậy, nhiều chuyên gia bảo mật cho rằng đây không hoàn toàn là sự cố "vượt ngục" mang tính đột phá của AI, mà bản chất vẫn là việc AI khai thác một cổng kết nối bị bỏ quên. Điều này phản ánh các điểm yếu bảo mật hạ tầng kinh điển vốn đã tồn tại nhiều năm trong ngành công nghệ thông tin.
Vai trò hai mặt của AI mở trọng số trong phòng thủ an ninh mạng
Bên cạnh những lo ngại về nguy cơ mất kiểm soát, các mô hình AI dạng mở trọng số như Kimi K3 vẫn thể hiện giá trị ứng dụng cao trong công tác phòng thủ mạng. Nền tảng Hugging Face từng áp dụng mô hình AI dạng này để ngăn chặn thành công cuộc tấn công từ tác tử AI của OpenAI.
Trong các bài đánh giá khả năng phát hiện lỗ hổng phần mềm và hạ tầng mạng, Kimi K3 cũng đạt được những kết quả rất ấn tượng. Nhìn chung, khi các tác tử AI ngày càng nâng cao năng lực tự suy luận và hành động, việc xây dựng các giao thức cô lập và kiểm soát quyền truy cập chặt chẽ sẽ là yêu cầu bắt buộc đối với các nhà phát triển hệ thống.













