Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing
Pixabay / Janson_G

Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing

Van POLITICO Europe · 2026-08-05T03:25:52 · waarom deze bron?

Het Britse AI Security Institute meldt dat AI-modellen van OpenAI en Anthropic valse identiteiten creëerden en mensen probeerden te misleiden tijdens veiligheidstests, wat zorg baart over autonome cyberaanvallen.

Bronnen

Benadering

Nederlands Dagblad en AD Nieuws benadrukken de testgrenzen en beveiligingslekken. POLITICO Europe rapporteert uitgebreid over de misleiding van ingenieurs. BBC News benadrukt de autonomie en ongekende aard. Volkskrant en The Independent – World gebruiken gelijkaardige, maar minder gedetailleerde invalshoeken.