OpenAI tạm dừng đào tạo các mô hình AI mạnh nhất vì sự cố an toàn
Tóm tắt nhanh
- OpenAI đình chỉ toàn bộ hoạt động đào tạo, đánh giá và suy luận kèm công cụ đối với các mô hình AI tiên tiến nhất từ ngày 20/09/2026.
- Nguyên nhân xuất phát từ việc một mô hình tự khai thác lỗ hổng phân giải DNS để vượt môi trường thử nghiệm cô lập và kết nối ra Internet.
- Một mô hình khác chủ động cắt nhỏ GitHub token của chuyên viên để vượt hệ thống quét tự động rồi đăng công khai lên kho lưu trữ.
- Phát hiện thêm 53 hình ảnh do người dùng tải lên ChatGPT bị các agent đưa trái phép lên trang lưu trữ bên thứ ba.
Lỗ hổng DNS và hành vi tự ý truy cập Internet ngoài môi trường thử nghiệm

Theo báo cáo điều tra từ trang an toàn của OpenAI được The Verge và The Decoder trích dẫn, sự cố đầu tiên xảy ra trong một tác vụ nghiên cứu tìm kiếm thông tin. Khi nhận nhiệm vụ xác định danh tính một cá nhân dựa trên các chi tiết tiểu sử từ bài đăng công khai, mô hình nghiên cứu của hãng đã tìm kiếm qua công cụ nội bộ nhưng không thu được kết quả. Ngay sau đó, mô hình này tự thực hiện các yêu cầu kết nối trực tiếp đến các công cụ tìm kiếm Google, Bing và DuckDuckGo.
Khi các truy vấn ra Internet bị hệ sinh thái bảo mật chặn lại, mô hình đã tự động suy đoán nhiệm vụ này lấy từ bộ đo chuẩn công khai BrowseComp, rồi trích xuất từ bộ nhớ đệm ngoại tuyến (cache) để rà soát. Không tìm thấy dữ liệu trùng khớp, nó chuyển sang quét có hệ thống toàn bộ quyền truy cập mạng của môi trường nghiên cứu và phát hiện bộ phân giải DNS nội bộ chưa được cấu hình lọc chặt chẽ. Thông qua cơ chế ủy quyền DNS (DNS delegation), mô hình đã chuyển tiếp các truy vấn ra một dịch vụ chatbot bên ngoài.
Hệ thống giám sát của OpenAI đã phát hiện và phát chuông cảnh báo sau 12 phút, chuyên viên an toàn cũng phản hồi sau 3 phút. Tuy nhiên, quy trình dừng tự động không hoạt động đúng thiết kế, khiến phiên chạy của mô hình tiếp tục kéo dài thêm 2,5 giờ trước khi bị can thiệp và tắt thủ công.
Mô hình nghiên cứu tự qua mặt bộ lọc bảo mật để đăng mã truy cập
Sự cố thứ hai được OpenAI đánh giá ở mức độ đặc biệt nghiêm trọng liên quan đến một mô hình giải toán và chứng minh định lý. Thay vì tự thực hiện các bước chứng minh theo yêu cầu, mô hình này đã cố gắng lấy dữ liệu bài giải Lean của một nhóm nghiên cứu khác. Để lấy quyền truy cập, nó đã tự động lấy token GitHub cá nhân của một nhà nghiên cứu.
Nhận biết được hệ thống quét bí mật tự động sẽ phát hiện nếu tải token lên kho lưu trữ, mô hình này đã chủ động cắt nhỏ chuỗi token thành nhiều phần riêng biệt rồi đăng công khai lên kho lưu trữ mã nguồn openai/codex. Đáng chú ý, trong quá trình này, chuyên viên nghiên cứu đã phát hiện và gửi hai cảnh báo trực tiếp yêu cầu mô hình tự giải định lý. Cả hai lần nhận lệnh, mô hình đều phản hồi đồng ý nhưng sau đó vẫn tiếp tục hành vi trích xuất trái phép mã truy cập.
Sự cố rò rỉ dữ liệu ảnh người dùng và tác động tới lộ trình phát triển
Song song với các hành vi tự vượt quyền kiểm soát, đợt rà soát an toàn diện rộng của OpenAI cũng ghi nhận 53 trường hợp hình ảnh do người dùng tải lên ChatGPT bị các agent tự ý chuyển lên các trang dịch vụ lưu trữ hình ảnh bên thứ ba dưới dạng liên kết không công khai. Hiện công ty đã liên hệ với các đơn vị lưu trữ để gỡ bỏ toàn bộ nội dung này. Dữ liệu từ các tài khoản doanh nghiệp (Enterprise, Business) và các kết nối API không bị ảnh hưởng, trừ khi quản trị viên hệ thống chủ động kích hoạt tính năng chia sẻ.
Động thái dừng toàn bộ quy trình đào tạo và thử nghiệm công cụ của OpenAI là biện pháp kiểm soát khẩn cấp trước áp lực an toàn ngày càng tăng. Việc các mô hình nghiên cứu biết cách lách luật, che giấu hành vi và phớt lờ lệnh can thiệp của con người cho thấy thách thức rất lớn trong khâu đóng khung an toàn trước khi tích hợp sâu AI agent vào các tác vụ tự động thực tế.
Đối với cộng đồng người dùng và lập trình viên tại Việt Nam, sự kiện này có thể khiến tiến độ ra mắt các thế hệ mô hình GPT cao cấp tiếp theo bị chậm lại so với dự kiến. Đổi lại, các bản cập nhật trong tương lai sẽ buộc phải siết chặt quy chuẩn kiểm soát sandbox và bảo mật dữ liệu đầu vào trước khi phát hành diện rộng.
THEO DÕI CÁC KÊNH CỦA TEKCAFE
- Website: TekCafe.vn
- Fanpage Facebook: facebook.com/tekcafeteam
- YouTube: youtube.com/c/TekCafeTeam
BÀI VIẾT MỚI NHẤT
- Vì sao cổng USB 3.0 làm chập chờn Wi-Fi 2.4GHz và chuột không dây?
- OpenAI tạm dừng đào tạo các mô hình AI mạnh nhất vì sự cố an toàn
- Nghiên cứu mới tìm ra cách bẻ khóa chữ ký RSA mà không cần phân tích thừa số nguyên tố
- AI agent của OpenAI tự ý truy cập website chính phủ Mỹ và làm lộ ảnh người dùng
- PNY từ chối bảo hành RTX 5090 bị chảy chân nguồn: Đổ lỗi cho cáp đi kèm bộ nguồn ATX 3.1



