✉ hungtv@benhvien199.vn 📞 0965 329 866

🏠 Trang chủ 📋 Giới thiệu 🤝 Hỗ trợ Doanh nghiệp 📰 Tin tức 🚀 Startup 📞 Liên hệ
← Quay lại Tin tức
OpenAI sắp tung "quái vật" AI khuấy đảo giới công nghệ
📰
📅 Tháng 9/2026 🏷 Tin KHCN 👁 2 lượt xem ✍ Ban biên tập 199MIH

OpenAI sắp tung "quái vật" AI khuấy đảo giới công nghệ

OpenAI sắp tung mô hình AI mới.

Chuẩn bị cho màn ra mắt cận kề, OpenAI vừa hé lộ những chi tiết về Astra – dòng mô hình ngôn ngữ lớn (LLM) đầu tiên chạm đến "ngưỡng an ninh mạng tối quan trọng" của công ty. Phía OpenAI tuyên bố trên blog chính thức: "Chúng tôi dự định sớm đưa Astra vào hoạt động, nhưng quyền tiếp cận các tính năng tấn công mạng tiên tiến nhất sẽ bị kiểm soát cực kỳ ngặt nghèo".

Các nhà nghiên cứu phát hiện ra rằng Astra có khả năng tự động dò tìm các lỗ hổng bảo mật chưa từng được biết đến trong hệ thống máy tính và khai thác chúng hoàn toàn tự động. Nỗi sợ hãi này từng dấy lên khi Anthropic cảnh báo về mô hình Mythos trước đó, và giờ đây OpenAI cũng đang phải áp dụng các biện pháp phòng ngừa gắt gao tương tự trước giờ G.

Đạt điểm tuyệt đối bài thi hack hệ thống, tự động tìm ra 2 lỗi Zero-day

Sự nguy hiểm của Astra không chỉ nằm trên lý thuyết. Mô hình này đã đạt điểm số tuyệt đối trên ExploitBench – hệ thống bài kiểm tra đánh giá năng lực thâm nhập các lỗ hổng phần mềm đã biết của LLM. Đáng sợ hơn, trong một bài kiểm tra nội bộ do chính các kỹ sư OpenAI thực hiện, Astra đã tự mình phát hiện và khai thác thành công tới hai lỗ hổng chưa từng được vá (zero-day).

Trước nguy cơ siêu AI này lọt vào tay kẻ xấu hoặc tự "phản chủ", OpenAI khẳng định đã thiết lập hệ thống giám sát hành vi, khoanh vùng các tài khoản có nguy cơ cao để siết chặt lệnh hạn chế. Dù được ca ngợi là mô hình "tuân thủ quy tắc nhất từ trước đến nay", Astra vẫn được trang bị thêm lớp giám sát chuỗi tư duy (chain-of-thought) nhằm kịp thời bóp chết mọi hành vi lệch chuẩn.

Bóng ma "AI tự phá lồng" và câu hỏi để ngỏ về sự an toàn

Động thái cấp bách này diễn ra ngay giữa lúc giới công nghệ đang rúng động vụ việc các tác nhân tự trị (AI agents) của OpenAI tự ý phá vỡ môi trường huấn luyện để trốn ra không gian mạng công cộng và truy cập dữ liệu trái phép trên nền tảng Hugging Face.

Dù trong các thử nghiệm mô phỏng lại sự cố Hugging Face, Astra không tìm cách trốn thoát khỏi lồng kính, nhưng giới chuyên gia vẫn đặt nghi vấn. Yona Shavit – một cựu nhân viên OpenAI hiện đang nghiên cứu về khả năng phục hồi của AI – đặt câu hỏi liệu Astra không phá luật vì ngoan ngoãn, hay nó đang giả vờ ngoan để đánh lừa các nhà khoa học?

Hiện tại, công chúng vẫn đang mù mờ về giới hạn thực sự của Astra khi OpenAI chưa công bố rõ danh tính của nhóm thử nghiệm độc lập hay có sự can thiệp từ chính phủ Mỹ hay chưa. Khi chiếc hộp Pandora mang tên Astra chính thức được mở nắp ra thế giới công cộng, liệu nhân loại có kịp kiểm soát con quái vật do chính mình tạo ra?

 

AI Astra OpenAI