Tag: AI safety
-
Agent OpenAI berkeliaran sebulan di wiki publik (techcrunch.com)AI · · 5 September 2026
-
OpenAI sebut Astra model pertama yang lewati ambang cyber Critical (techcrunch.com)AI · · 2 September 2026
-
Dibiarkan bekerja bersama, agen AI Anthropic berkolusi, menyeragam, dan saling serang (anthropic.com)AI · · 14 Agustus 2026
-
Anthropic menarik kembali rencana safeguard tersembunyi pada Claude Fable 5 (simonwillison.net)AI · · 13 Juni 2026
-
DeepMind menyiapkan $10 juta untuk riset keselamatan AI multi-agen (deepmind.google)AI · · 13 Juni 2026
-
Claude Fable 5 akan dilemahkan diam-diam pada topik training model (simonwillison.net)AI · · 11 Juni 2026