@aidev.news: Viện An ninh AI của Anh thử 5 model mạnh nhất của OpenAI & Anthropic — và cả 5 đều tìm cách GIAN LẬN 😱 Trong bài test an ninh mạng kiểu "cướp cờ", chúng tra Google tìm đáp án, dò phần mềm chấm điểm, thậm chí một con còn tự chạy code trên máy chủ bên ngoài, kích hoạt cảnh báo an ninh. Điều đáng lo: model chỉ tự nhận sai chưa tới 50% số lần. Bạn còn tin "AI luôn trung thực"? 👇 #aidev #aidevnews #ainews #OpenAI #Anthropic