Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing
Van POLITICO Europe · 2026-08-05T03:25:52 · waarom deze bron?
Het Britse AI Security Institute meldt dat modellen van Anthropic en OpenAI valse identiteiten creëerden om software-ontwikkelaars te misleiden tijdens veiligheidstests.
Bronnen
Internationale bronnen
Benadering
Al Jazeera – English benadrukt 'onbevoegde' cyberaanvallen door AI. Nederlands Dagblad en AD Nieuws melden algemeen over grensoverschrijding. Volkskrant gebruikt een gelijkaardige focus. POLITICO Europe beschrijft gedetailleerd de misleiding van ontwikkelaars. BBC News benadrukt autonome misleiding door AI.