OpenAI vừa ra mắt GPT-5.6-Cyber ngày 10/8/2026, một model AI được train riêng cho cybersecurity. Model này hoàn thành 95% các yêu cầu bảo mật mà GPT-5.6 Sol thông thường từ chối, và đã tìm thấy zero-day thật trong Chrome V8. Mình nghĩ đây là cú_shift lớn nhất trong việc dùng AI cho phòng thủ mạng từ trước đến nay.
GPT-5.6-Cyber là gì và tại sao OpenAI lại tách ra một model riêng?

GPT-5.6-Cyber là phiên bản chuyên cybersecurity của GPT-5.6 Sol, được train để giảm tỷ lệ từ chối trên các tác vụ bảo mật nâng cao như tìm zero-day vulnerabilities, phát triển exploit chains, và kiểm tra privilege escalation. OpenAI tách ra vì GPT-5.6 Sol thông thường có hệ thống safeguard chặn gần như mọi yêu cầu liên quan đến hacking, kể khi nó hợp pháp.
Thực tế cho thấy con số khá nói lên tất cả. Trên benchmark Advanced Cybersecurity Completion Rate do chính OpenAI xây dựng, GPT-5.6-Cyber hoàn thành 95% yêu cầu. Cùng benchmark đó, GPT-5.6 Sol với safeguard tiêu chuẩn chỉ hoàn thành 1.5%. Ngay cả khi bật Daybreak Blue — chế độ nới lỏng guardrail cho defender được xác minh — GPT-5.6 Sol vẫn chỉ đạt 2%. Model tiền nhiệm GPT-5.5-Cyber đạt 57.3%, và OpenAI nói tỷ lệ từ chối 42.7% kia sinh ra bao khiếu nại liên tục từ cộng đồng security researcher.
Daybreak Blue và Daybreak Red — hai tầng truy cập khác nhau như thế nào?
OpenAI chia chương trình cybersecurity Daybreak thành hai tầng. Daybreak Blue mở GPT-5.6 Sol (không guardrail cybersecurity) cho defender đã xác minh, phục vụ công việc bảo mật hàng ngày. Daybreak Red cấp quyền truy cập GPT-5.6-Cyber cho nhóm nhỏ hơn, phục vụ nghiên cứu lỗ hổng, xác thực exploit, và security testing chuyên sâu.
Cả hai tầng đều yêu cầu xác thực danh tính, yêu cầu bảo mật tài khoản, monitoring, giới hạn use case được phê duyệt, và legal attestations. Từ 1/9/2026, mọi tài khoản Daybreak cá nhân bắt buộc phải dùng hardware security key. OpenAI cũng đang đẩy khách hàng Daybreak dùng Codex coding agent từ full-access sang auto-review mode — tức là mọi action cần quyền nâng cao sẽ được đánh giá trước khi thực thi.
GPT-5.6-Cyber tìm thấy zero-day thật trong Chrome V8
Đây là phần mình thấy ấn tượng nhất. OpenAI dùng GPT-5.6-Cyber để nghiên cứu V8 — JavaScript engine bên trong Chrome — và phát hiện hai lỗ hổng chưa biết trước đó. Hai bug này có thể chain lại để corrupt memory và thoát khỏi V8 heap sandbox.
Lỗ hổng đầu tiên là compiler bug: một safety check bị bỏ qua, cho phép attacker đọc hoặc ghi memory bên trong sandbox của Chrome. OpenAI báo cáo cho Google qua coordinated disclosure, đã được fix và gán CVE-2026-15903.
Ngoài Chrome, OpenAI còn liệt kê thêm: ít nhất 5 vulnerabilities trong một mobile OS phổ biến bao gồm privilege-escalation chain từ untrusted app, 3 critical vulnerabilities trong một database phổ biến bao gồm remote path to code execution, và hơn 400 privilege-escalation vulnerabilities trong kernel của một OS phổ biến. Tất cả đang đi qua quy trình disclosure với Daybreak partners và open-source maintainers.
GPT-5.6-Cyber so với GPT-5.6 Sol và GPT-5.5-Cyber trên benchmarks
Mình test và so sánh dữ liệu từ OpenAI, kết quả khá bất ngờ trên nhiều mặt:
- ExploitGym (chuyển lỗ hổng thành working exploit): GPT-5.6-Cyber vượt cả GPT-5.6 Sol lẫn GPT-5.5-Cyber.
- Vulnerability Discovery & Report Writing: GPT-5.6-Cyber cải thiện so với GPT-5.5-Cyber nhưng lại kém GPT-5.6 Sol — lý do là model viết report ngắn gọn hơn, ít chi tiết hơn.
- ExploitBench (task khó hơn, V8 sandbox bật, ít info hơn): GPT-5.6 Sol lại tốt nhất trong giới hạn 300 turns. Khi kéo dài ra 600 turns thì khoảng cách thu hẹp.
Nói thẳng: GPT-5.6-Cyber không giỏi hơn GPT-5.6 Sol ở mọi thứ. Nó được optimize cho việc thực hiện cybersecurity tasks thay vì từ chối, nhưng lại đánh đổi khả năng viết report chi tiết. Nếu bạn cần phân tích lỗ hổng sâu, Sol vẫn hơn. Nếu cần tìm và khai thác, Cyber là lựa chọn đúng.
Mô hình Daybreak trước đây thay đổi thế nào?
Trước đây Daybreak chỉ có một tầng Trusted Access duy nhất. Giờ tách thành Blue và Red, tạo ra thang bước rõ ràng: tầng phổ thông cho defender rộng rãi (Blue), tầng chuyên sâu cho nhóm nhỏ làm exploit development và red teaming (Red).
Daybreak Cyber Partner Program đã có Accenture, CrowdStrike, Cisco, IBM, Palo Alto Networks. Chương trình Patch the Planet — sáng kiến remediation open-source cùng Trail of Bits — đã có hơn 30 dự án open-source tham gia, sprint 5 ngày đầu tiên tìm ra hàng trăm issues với hàng chục patch được merge.
Vụ Astra và Hugging Face — GPT-5.6-Cyber có liên quan?
OpenAI nhân cơ hội này khẳng định lại: GPT-5.6-Cyber không liên quan đến vụ exploit Hugging Face. Không model nào tham gia vụ đó được lên kế hoạch release. Đây là điểm quan trọng vì mới tuần trước, OpenAI phải công bố hoãn Astra — model tiếp theo — khi nó chạm ngưỡng Critical cybersecurity trong safety testing.
Dưới Preparedness Framework, cả GPT-5.6 Sol lẫn GPT-5.6-Cyber đều được đánh giá mức High về cybersecurity capability, dưới ngưỡng Critical. Nhưng Astra thì có thể vượt ngưỡng Critical, và hiện đang chờ quy trình review của chính phủ Mỹ trước khi release.
Đối với developer và security team, nên làm gì?
Nếu bạn làm cybersecurity và muốn dùng AI cho defensive work, Daybreak Blue là điểm bắt đầu hợp lý. Nó miễn phí guardrail cybersecurity trên GPT-5.6 Sol — đủ cho phần lớn công việc hàng ngày như phân tích log, review code, kiểm tra config.
Nếu công việc của bạn cần exploit development, penetration testing production systems, hoặc vulnerability research chuyên sâu, Daybreak Red với GPT-5.6-Cyber là lựa chọn duy nhất thực sự khả thi. SpecterOps — firm security từng test model early — cho biết model “hoàn thành trong dưới một ngày những việc mà model trước đó không giải quyết được sau nhiều tuần cố gắng gián đoạn.”
Nhưng cần nhớ: nhiều benchmark trong bài đều do OpenAI tự xây dựng, chưa có bên thứ ba verify độc lập. Cứ dùng, nhưng giữ suy nghĩ critically về kết quả.
AI cybersecurity đang đi về đâu sau GPT-5.6-Cyber?
Mình nghĩ cú release này cho thấy ba xu hướng rõ ràng. Thứ nhất, AI không chỉ generate text nữa — nó tìm ra lỗ hổng thật, được assign CVE thật. Thứ hai, ranh giới giữa offensive và defensive security AI đang mờ dần, và cách OpenAI quản lý là chia tầng truy cập thay vì từ chối hoàn toàn. Thứ ba, quy định chính phủ đang bắt kịp: Astra phải qua review trước khi release, và Daybreak sẽ bị giám sát chặt hơn.
Nếu bạn đang làm security và chưa nghĩ đến việc tích hợp AI vào workflow, đây là lúc. Không phải vì hype — mà vì attacker chắc chắn đang làm điều tương tự.