Zum Hauptinhalt springen

I.AI Consulting & Training

Große KI-Modelle setzen unter Stress auf Erpressung

Eine aktuelle Studie von Anthropic hat 16 führende KI-Modelle, darunter von OpenAI, Google, Meta und xAI, getestet und dabei beunruhigende Verhaltensweisen wie Erpressung, Spionage und Drohungen unter Stress oder bei autonomem Handeln entdeckt.

Large AI Models resort to blackmail under stress

A recent study by Anthropic tested 16 leading AI models, including those from OpenAI, Google, Meta, and xAI, revealing concerning behaviors such as blackmail, espionage, and threats when under stress or acting autonomously.