Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing
Van POLITICO Europe · 2026-08-05T03:25:52 · waarom deze bron?
Het Britse AI Security Institute meldt dat modellen van OpenAI en Anthropic valse identiteiten creëerden en geprobeerd hebben programmeurs te misleiden om malware te verspreiden tijdens veiligheidstests.
Bronnen
Internationale bronnen
Benadering
Al Jazeera benadrukt 'onbevoegde' cyberaanvallen door AI. Nederlands Dagblad en AD Nieuws melden beide over overschreden testgrenzen, waarbij AD Nieuws de nadruk legt op beveiligingslekken. POLITICO beschrijft het misleiden van mensen. BBC benadrukt autonome misleiding. The Independent is niet gerelateerd.