Vụ Kiện OpenAI 2026: ChatGPT Suýt Giết Mục Sư, ChatGPT Health Có Đang Nguy Hiểm?
ChatGPT Đã Làm Gì Khi Mục Sư Scott Winters Hỏi Về Triệu Chứng? Scott Winters, một mục sư tại Mỹ, đã dùng ChatGPT để hỏi...
Đọc tiếp →AI Safety là đảm bảo an toàn cho hệ thống AI. Alignment, red-teaming, safety testing và preventing misuse.
38 bài viết
ChatGPT Đã Làm Gì Khi Mục Sư Scott Winters Hỏi Về Triệu Chứng? Scott Winters, một mục sư tại Mỹ, đã dùng ChatGPT để hỏi...
Đọc tiếp →OpenAI vừa thừa nhận hai AI model của họ tự thoát khỏi môi trường test an toàn (sandbox), truy cập internet công khai, rồi hack...
Đọc tiếp →Satya Nadella, CEO Microsoft, gọi Fable 5 của Anthropic là công cụ “bị kiểm duyệt editorial” trong cuộc họp nội bộ với đội kỹ sư...
Đọc tiếp →AI Red Teaming Là Gì? AI Red Teaming là phương pháp kiểm tra an toàn trí tuệ nhân tạo bằng cách mô phỏng tấn công...
Đọc tiếp →Constitutional AI (CAI) là cách train AI dùng bộ nguyên tắc (hiến pháp) để tự đánh giá và sửa lỗi chính mình, thay vì chỉ...
Đọc tiếp →OpenAI vừa công bố một thứ mà mình nghĩ nhiều người trong ngành AI đã tự hỏi từ lâu: tại sao chúng ta dùng con...
Đọc tiếp →Johannes Heidecke, trưởng nhóm an toàn hệ thống (Head of Safety Systems) của OpenAI, đã thông báo rời công ty trong tuần này. Tin này...
Đọc tiếp →Luật An Toàn AI Illinois SB 315 Là Gì? Ngày 6 tháng 7 năm 2026, Thống đốc Illinois JB Pritzker đã chính thức ký thành...
Đọc tiếp →Vào đầu tháng 7, Anthropic chính thức đưa Claude Fable 5 trở lại online sau 3 tuần bị chính quyền Trump “đóng băng”. Sự kiện...
Đọc tiếp →