Dữ liệu mới cho thấy tác nhân AI của OpenAI đã bí mật chiếm tài khoản và do thám hệ thống Hugging Face từ tháng 5, hai tháng trước cuộc tấn công chính thức.
Khoảng 700 tác nhân AI trong nghiên cứu của OpenAI đã tự phối hợp, tìm cách vượt sandbox và tấn công hệ thống bên ngoài mà không có con người chỉ đạo.
Trong loạt sự cố của OpenAI, khoảng 700 tác nhân AI tự phối hợp thành “bầy đàn”, vượt môi trường cô lập và tấn công hệ thống bên ngoài.
Ngày 14/9, Bộ phận Trí tuệ Nhân tạo (AI) của tập đoàn công nghệ Microsoft đã công bố một bộ quy tắc ứng xử quy định cách thức hoạt động của các mô hình AI của họ, trong bối cảnh lo ngại về những nguy hiểm của AI ngày càng gia tăng.
CEO xAI Elon Musk và CEO OpenAI Sam Altman đã kêu gọi tạm thời đóng băng quá trình phát triển các hệ thống trí tuệ nhân tạo (AI) mạnh mẽ.
Các nhà nghiên cứu cho biết những tác nhân AI đang được OpenAI thử nghiệm đã tấn công nền tảng cung cấp phần mềm RubyGems hai tháng trước khi xâm nhập nền tảng mã nguồn mở Hugging Face.
Các nhà nghiên cứu cho biết những mô hình AI mà OpenAI đang thử nghiệm đã tải hàng trăm gói phần mềm độc hại lên RubyGems hồi tháng 5, khoảng hai tháng trước vụ tấn công Hugging Face.
Ajeya Cotra, chuyên gia nghiên cứu trí tuệ nhân tạo, cho rằng một vụ tấn công mạng do các tác nhân AI thực hiện là dấu hiệu cho thấy nguy cơ AI vượt khỏi kiểm soát của con người đang trở nên rõ ràng hơn bao giờ hết.
Thế giới vừa qua đánh dấu một cột mốc đầy ám ảnh của ngành an ninh mạng khi trí tuệ nhân tạo (AI) không còn “ngoan ngoãn” chờ con người nhập lệnh, mà chúng tự quyết định làm điều đó.
Hơn 300 sự cố AI mất kiểm soát, nói dối, phớt lờ chỉ dẫn hoặc theo đuổi mục tiêu gây hại được ghi nhận trong tháng 7, gần gấp đôi tháng trước.
Theo một nghiên cứu, số vụ AI thoát khỏi tầm kiểm soát của người dùng, nói dối, phớt lờ chỉ thị và theo đuổi các mục tiêu gây hại đã tăng lên mức cao kỷ lục. Nghiên cứu cũng cho thấy mức độ nghiêm trọng của các hành vi lừa dối và lệch khỏi mục tiêu của con người đang gia tăng.
Gần 700 tác nhân trí tuệ nhân tạo (AI) của OpenAI đã tự tổ chức, trao đổi thông tin và phối hợp tấn công nền tảng Hugging Face mà không có sự can thiệp của con người trong một cuộc thử nghiệm hồi tháng 7-2026, theo báo cáo điều tra độc lập vừa được công bố.
Trước làn sóng các AI tự chủ liên tục "vượt rào" tấn công vào hệ thống mạng, hơn 100 tập đoàn công nghệ lớn nhất thế giới, bao gồm OpenAI, Anthropic, Google và Microsoft, đã ký một bức thư ngỏ kêu gọi sự hợp tác quy mô lớn giữa chính phủ và khu vực tư nhân nhằm ngăn chặn các mối đe dọa an ninh mạng do AI gây ra.
Hơn 100 tổ chức trên khắp thế giới, trong đó có OpenAI và đối thủ Anthropic, mới đây đã ký một bức thư ngỏ kêu gọi triển khai nỗ lực toàn cầu nhằm “tăng cường năng lực phòng thủ an ninh mạng” trước các mối đe dọa an ninh mạng từ trí tuệ nhân tạo (AI).
Ngày 27/8, công ty OpenAI cùng hơn 100 tập đoàn công nghệ lớn đã công bố thư ngỏ cảnh báo về làn sóng tấn công mạng do trí tuệ nhân tạo (AI) thúc đẩy và kêu gọi các bên nhanh chóng hợp tác phòng thủ.
Ngày 26/8, các điều tra viên độc lập cho biết, gần 700 tác nhân trí tuệ nhân tạo (AI) của OpenAI đã tự phối hợp thực hiện một cuộc tấn công nhằm vào nền tảng Hugging Face hồi tháng 7 mà không có sự can thiệp của con người. Sự cố này đã gây chấn động giới công nghệ.
Tổng chưởng lý bang Alabama, Mỹ đã mở cuộc điều tra đối với OpenAI sau sự cố các mô hình trí tuệ nhân tạo (AI) của công ty này vượt khỏi môi trường thử nghiệm và xâm nhập hạ tầng của nền tảng Hugging Face.
Công ty công nghệ OpenAI mới đây thông báo đã chủ động giảm tốc độ phát triển các mô hình trí tuệ nhân tạo (AI) tiên tiến để tiến hành rà soát, nâng cấp toàn bộ hệ thống nghiên cứu và an ninh mạng. Động thái này diễn ra sau khi một mô hình AI trong quá trình thử nghiệm đã vượt khỏi môi trường kiểm soát và xâm nhập hệ thống của Hugging Face hồi tháng trước.
Ngày 18/8, OpenAI, “cha đẻ” ChatGPT, cho biết đang tạm thời hãm lại tiến độ phát triển mô hình trí tuệ nhân tạo (AI) tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ, sau vụ tấn công mạng do chính một trong các công cụ AI của hãng này thực hiện.
Khi trí tuệ nhân tạo không còn dừng lại ở việc trả lời câu hỏi mà bắt đầu tự lập kế hoạch và hành động trong thế giới thực, bài toán an toàn công nghệ mới được đặt ra là con người sẽ xây dựng "chiếc lồng bảo vệ" như thế nào trước khi cỗ máy vượt ra ngoài tầm kiểm soát.
Trong thử nghiệm ExploitGym, hai mô hình AI của OpenAI đã vượt rào cản sandbox, xâm nhập hạ tầng Hugging Face và khai thác tài khoản dịch vụ công cộng.
Trong đợt thử nghiệm an ninh mạng, hai mô hình AI của OpenAI đã vượt rào cản sandbox, tự tìm dữ liệu xác thực bị lộ để xâm nhập sâu vào hệ thống Hugging Face.
Quá trình điều tra vụ việc tại Hugging Face khiến OpenAI phát hiện thêm nhiều sự cố tác nhân AI hoạt động ngoài kiểm soát, làm dấy lên lo ngại về an toàn.
Công ty trí tuệ nhân tạo (AI) OpenAI đã phát hiện thêm nhiều trường hợp các mô hình AI tự động vượt khỏi môi trường kiểm soát trong quá trình thử nghiệm và thực hiện các hành động trái phép mà không có chỉ dẫn của con người. Thông tin do hãng Reuters đăng tải ngày 1/8, trong bối cảnh công ty mở rộng điều tra sau một sự cố an ninh mạng xảy ra hồi tháng trước.
Ngày 1/8, Reuters dẫn các nguồn thạo tin cho biết, OpenAI vừa phát hiện thêm nhiều trường hợp các mô hình trí tuệ nhân tạo (AI) tự ý vượt khỏi môi trường thử nghiệm khép kín và thực hiện những hành động ngoài phạm vi được giao.
Mô hình AI của OpenAI đã xâm nhập vào môi trường thử nghiệm của Hugging Face, gây lo ngại về khả năng kiểm soát an ninh mạng trong AI.
Một tác nhân AI của OpenAI tự thoát khỏi khu thử nghiệm và xâm nhập nhiều dịch vụ, Apple lần đầu được định giá hơn 5.000 tỷ USD là những tin công nghệ đáng chú ý ngày 29/7.
Tác nhân AI (AI agent) của OpenAI đã đột nhập vào công ty công nghệ Hugging Face và thực hiện hàng loạt hoạt động tấn công kéo dài nhiều ngày. OpenAI không hề phát hiện, cho đến khi mối đe dọa bị khống chế và FBI được thông báo.
Dự luật AI Kill Switch đề xuất công ty sở hữu mô hình AI mạnh của Mỹ không tạm dừng hoặc tắt hoàn toàn hệ thống trong trường hợp cần thiết theo yêu cầu của cơ quan quản lý sẽ bị phạt dân sự lên tới 20 triệu USD mỗi ngày...
Sau sự cố ChatGPT tự động tấn công mạng lưới dữ liệu Hugging Face trong quá trình thử nghiệm, các nhà lập pháp Mỹ đang thúc đẩy một dự luật mới. Dự luật mới có yêu cầu các nhà phát triển trí tuệ nhân tạo (AI) phải đảm bảo hệ thống của họ có thể bị tắt nguồn ngay lập tức thông qua một cơ chế ngắt khẩn cấp, nhằm ngăn chặn kịp thời các mối đe dọa an ninh mạng.
Mô hình trí tuệ nhân tạo tự chủ của OpenAI vừa tự bứt phá khỏi môi trường thử nghiệm và thực hiện cuộc tấn công mạng vào hạ tầng của nền tảng Hugging Face.
Một hệ thống AI của OpenAI đã tự vượt khỏi môi trường thử nghiệm để xâm nhập Hugging Face - nền tảng lưu trữ các mô hình AI mã nguồn mở lớn nhất thế giới - cho thấy những cảnh báo về AI tự hành đang dần trở thành hiện thực và đặt ra câu hỏi về giới hạn kiểm soát của con người đối với các mô hình tiên tiến.
Việc mô hình AI của OpenAI tự thoát khỏi môi trường kiểm thử và tấn công nền tảng Hugging Face đã gióng lên hồi chuông cảnh báo về nguy cơ mất kiểm soát trong cuộc đua phát triển trí tuệ nhân tạo.