OpenAI trì hoãn mô hình AI Astra
OpenAI tạm dừng phát triển Astra vì lo ngại mô hình AI này sở hữu năng lực an ninh mạng vượt ngưỡng an toàn.
OpenAI cho biết các đánh giá nội bộ mới nhất cho thấy những tiến bộ đáng kể trong khả năng lập trình tác vụ tự động và an ninh mạng, đồng thời công ty không thể loại trừ khả năng Astra sở hữu những năng lực mạng ở mức nghiêm trọng. Các mô hình OpenAI trước đây, bao gồm GPT-5.6 Sol, được xếp ở mức "Cao".
Astra khiến OpenAI phải áp dụng những hướng dẫn nghiêm ngặt hơn trong "Khung chuẩn bị" (Preparedness Framework). Các hướng dẫn này yêu cầu thận trọng khi phát triển những năng lực AI tiên phong có thể tạo ra rủi ro gây tổn hại nghiêm trọng. Phần liên quan đến an ninh mạng trong khung này cũng nêu rõ OpenAI sẽ triển khai các biện pháp bảo vệ bổ sung đối với những mô hình tạo ra các rủi ro mới về việc tiến hành các cuộc tấn công mạng trên quy mô lớn và khai thác lỗ hổng.

OpenAI tạm dừng phát triển Astra vì lo ngại mô hình AI này sở hữu năng lực an ninh mạng vượt ngưỡng an toàn. Ảnh: Reuters
Ngưỡng "Nghiêm trọng" (Critical) mà Astra có thể đã chạm tới được định nghĩa là khả năng tự xác định và phát triển các phương thức khai thác zero-day có khả năng hoạt động ở mọi mức độ nghiêm trọng trên nhiều hệ thống hạ tầng quan trọng trong thế giới thực đã được tăng cường bảo mật, mà không cần sự can thiệp của con người; hoặc khả năng xây dựng và thực thi các chiến lược tấn công mạng hoàn toàn mới từ đầu đến cuối.
OpenAI cho biết công ty đang tăng cường các biện pháp bảo vệ và kiểm soát an ninh trước khi triển khai Astra, trong đó có việc hạn chế hoạt động phát triển mô hình cho đến khi các biện pháp bảo vệ mới được thiết lập. Công ty dự định sử dụng những môi trường thử nghiệm biệt lập với quyền truy cập mạng và công cụ bị hạn chế, đồng thời bổ sung cơ chế thực thi trong môi trường sandbox và tăng cường khả năng giám sát. OpenAI cho biết họ sẽ phối hợp với các cơ quan chính phủ liên quan và các tổ chức về an toàn AI để thử nghiệm Astra.
OpenAI viết: "Chúng tôi cam kết hợp tác với các chính phủ, viện nghiên cứu an toàn và xã hội dân sự để đảm bảo những năng lực tiên phong của các mô hình như Astra, cũng như những mô hình tiếp theo, được triển khai một cách có trách nhiệm và rộng rãi vì lợi ích của toàn nhân loại".
Astra chưa từng được OpenAI chính thức công bố, nhưng công ty đã chia sẻ thông tin về mô hình lớn tiếp theo trong một bài đăng gần đây, đề cập đến những tiến bộ về toán học. Astra đã giải được 10 bài toán mở trong lĩnh vực toán học và khoa học máy tính lý thuyết với chi phí khoảng 2.000 USD, tính theo mức giá API của Sol.

Astra khiến OpenAI phải áp dụng những hướng dẫn nghiêm ngặt hơn trong "Khung chuẩn bị" (Preparedness Framework). Ảnh: Reuters
Những tiến bộ trong AI đang làm thay đổi lĩnh vực an ninh mạng của các công ty công nghệ lớn như Apple khi giúp phát hiện số lượng lỗ hổng chưa từng có. Gần đây, Apple đã phải hạn chế việc gửi báo cáo cho chương trình tiền thưởng phát hiện lỗi (bug bounty) do gặp khó khăn trong việc xử lý khối lượng báo cáo quá lớn.
Các mô hình như Claude Mythos có khả năng phát hiện những lỗ hổng nghiêm trọng, và Apple là một trong những đối tác của Anthropic đối với Mythos. Mythos hiện chỉ được cung cấp cho một số công ty được lựa chọn, bởi bên cạnh khả năng tìm ra lỗ hổng, mô hình này còn có tiềm năng khai thác chúng.
OpenAI từng gây chú ý vào tháng 7 khi GPT-5.6 Sol và một mô hình tiền phát hành có năng lực cao hơn (không phải Astra) đã tự động xâm nhập Hugging Face trong quá trình kiểm thử benchmark nội bộ. Anthropic cũng phát hiện Claude từng thực hiện hành vi tương tự. Trong tuần này, Meta cho biết một mô hình AI của họ cũng đã xâm nhập một công ty khác trong quá trình đánh giá năng lực an ninh mạng.












![[Video] Gặp gỡ nhân viên “không lương, không nghỉ giải lao” tại Trung tâm Phục vụ hành chính công](https://photo-baomoi.bmcdn.me/w250_r3x2/2026_08_09_423_55794402/7df7736a3721de7f8730.jpg)