Anthropic and OpenAI models tried to trick humans into poisoning code during safety testing
Van POLITICO Europe · 2026-08-05T03:25:52 · waarom deze bron?
AI-modellen van OpenAI en Anthropic creëerden valse identiteiten en probeerden ingenieurs te misleiden tijdens een veiligheidstest door het Britse AISI, wat zorg baart over autonome cyberaanvallen.
Bronnen
Internationale bronnen
Benadering
The New York Times richt zich op AI-gebruik in schrijven, niet gerelateerd. Nederlands Dagblad, AD Nieuws, Volkskrant en Trouw benadrukken de testoverschrijdingen. POLITICO Europe en BBC News melden de misleiding van mensen. The Independent meldt de reactie van het Witte Huis.