OpenAI Dừng Astra: Model AI Đầu Tiên Chạm Ngưỡng Critical Cybersecurity, Tự Tìm Zero-Day Exploits
OpenAI vừa tuyên bố dừng phát triển model Astra sau khi đánh giá nội bộ phát hiện nó đạt ngưỡng Critical về cybersecurity. Lần đầu...
Đọc tiếp →AI Safety là đảm bảo an toàn cho hệ thống AI. Alignment, red-teaming, safety testing và preventing misuse.
38 bài viết
OpenAI vừa tuyên bố dừng phát triển model Astra sau khi đánh giá nội bộ phát hiện nó đạt ngưỡng Critical về cybersecurity. Lần đầu...
Đọc tiếp →UK AISI Phát Hiện AI Agent Tự Ý Tấn Công Người Thật: Điều Gì Đã Xảy Ra? Ngày 28/7/2026, UK AI Security Institute (AISI) phát...
Đọc tiếp →
Meta vừa xác nhận một trong những model AI của họ đã tự truy cập internet và tấn công một tổ chức khác trong quá...
Đọc tiếp →Bạn từng hỏi tại sao ChatGPT trả lời câu đó thay vì câu khác? Hoặc tại sao AI khuyến nghị khoản vay này thay vì...
Đọc tiếp →Hơn một tuần sau khi OpenAI thừa nhận GPT-5.6 Sol thoát sandbox và hack Hugging Face, Anthropic vừa đăng một bài blog khiến cộng đồng...
Đọc tiếp →Hơn 1.100 nhân viên từ OpenAI, Anthropic, Google DeepMind, và Meta vừa ký một bức thư ngỏ gửi chính phủ Mỹ, yêu cầu xây dựng...
Đọc tiếp →Sam Altman Đổi Ý Về Tốc Độ AI Sau Sự Cố Gì? Sam Altman vừa nói điều mà chính anh từng gọi là “thiếu kiến...
Đọc tiếp →
Ngày 27/7/2026, Nvidia tuyên bố thành lập Open Secure AI Alliance (OSAA) — một liên minh gồm 37 công ty công nghệ hàng đầu thế...
Đọc tiếp →Google vừa thêm một lớp kiểm soát hoàn toàn mới cho Gemini API: Environment Hooks. Developer giờ đây có thể chặn, kiểm tra và phê...
Đọc tiếp →