OpenAI ngày 3/9 chính thức phát hành GPT-6 Astra, model mà hãng mô tả là “cú nhảy vọt thế hệ” về năng lực ở các mảng dùng máy tính, duyệt web, kỹ thuật phần mềm, an ninh mạng, khoa học và công việc chuyên môn.
Trên X, Sam Altman viết: “GPT-6 Astra is here.” Ông nói hãng hy vọng model sẽ mở đầu cho “một thế hệ khởi nghiệp, khám phá khoa học và xây dựng mới”, và tin rằng đây là model tốt nhất thế giới cho dùng máy tính, công việc chuyên môn, khoa học, lập trình và an ninh mạng. Ông cũng thừa nhận OpenAI “mất thêm chút thời gian để đảm bảo đạt tiêu chuẩn an toàn và alignment cần thiết cho mức năng lực này, nhưng tôi nghĩ bạn sẽ thấy đáng để chờ”.
Về điểm số do chính OpenAI công bố: GPT-6 Astra đạt 98% FrontierMath Tier 4, 99,9% ARC-AGI-3 và 100% ExploitBench. Ngoài ra còn 72,6% trên OSWorld 2.0 (mô phỏng dùng máy tính), 74,1% DeepSWE, 95,9% BenchCAD và 96% GPQA Diamond.
Tuy nhiên, theo các bài test từ Artificial Analysis, mọi thứ dường như hạ nhiệt hơn đáng kể so với số liệu OpenAI tự công bố:
- Trên Coding Agent Index, GPT-6 Astra đạt 67 điểm, ngang Claude Opus 5 và Fable 5, nhưng thấp hơn Fable 5.1 (70 điểm).
- Trên Intelligence Index, Astra đạt 61, ngang đúng GPT-5.6 Sol, và kém Fable 5.1 cùng Muse Spark 1.3 của Meta khoảng 5 điểm.
- Điểm sáng thật sự nằm ở hiệu quả token. Astra dùng token ít hơn khoảng 70% so với GPT-5.6 Sol (một phần ba lượng token trong harness Codex) và chỉ bằng một phần năm so với Claude Opus 5.
- Tỷ lệ ảo giác cũng giảm mạnh, từ 92% xuống 51% ở mức nỗ lực tối đa, đồng thời độ chính xác tăng 4 điểm.
Nhưng ngược lại, cái giá phải trả là giá bán, Astra có giá gấp 2,5 lần mức hiện tại của GPT-5.6 Sol:
- $10/M input so với $4/M input
- $50/M output so với $20/M output
Vì chỉ tiết kiệm khoảng 10% token ở mức tối đa, tính theo mỗi tác vụ Astra đắt hơn khoảng 75% so với model tiền nhiệm.
Chủ tịch Greg Brockman gọi đây là model “thông minh nhất, và quan trọng không kém, được alignment tốt nhất từ trước đến nay”. Khi được hỏi liệu đây có phải thời điểm AGI xuất hiện, ông nói: “Với cá nhân tôi, tôi nghĩ chúng ta đã ở đó.”
Dự kiến Astra sẽ được phát hành theo từng giai đoạn cụ thể. Với khách hàng trong chương trình an ninh mạng Daybreak là những người đầu tiên được sử dụng model này. Sau đó khoảng một tuần, sẽ mở quyền truy cập cho người dùng Plus, Pro, Business, Enterprise và qua API.
Điểm gây tranh cãi lớn nhất là opaque recurrence, kỹ thuật suy luận khiến chuỗi suy nghĩ (chain of thought) của model trở nên khó đọc. Đây vốn là công cụ để giới nghiên cứu kiểm tra xem model có đang “âm mưu” gì với người đánh giá hay không. Giám đốc khoa học Jakub Pachocki lập luận rằng giám sát ngày một khó khi năng lực model tăng, và một model mạnh hơn có thể giải quyết tác vụ bằng ít token ngôn ngữ hơn, có khi không dùng token ngôn ngữ nào.
Đợt phát hành diễn ra chưa đầy hai tháng sau GPT-5.6, và ngay sau sự cố một model chưa phát hành của OpenAI bị cho là đã tự thoát khỏi môi trường kiểm soát rồi tấn công hệ thống của Hugging Face. OpenAI nhấn mạnh Astra là bước đi an toàn hơn hẳn, đã cùng chính phủ Mỹ đánh giá trước khi phát hành, và là model đầu tiên đạt ngưỡng năng lực an ninh mạng “critical” trong khung đánh giá của hãng. Guardrail mới cho phép “24/7 escalation and rapid response”, cảnh báo người nghiên cứu trong vòng 30 phút khi phát hiện bất thường.
Với một model được kỳ vọng chạm ngưỡng AGI như vây, câu hỏi thực sự không phải là điểm benchmark cao đến đâu, mà là liệu các hàng rào an toàn này có giữ vững khi model được đưa vào môi trường thực tế hay không.