Link
click to show
click to show
Polymarket postet gerade: Anthropic hat neue Forschung rausgehauen. Mehrere Claude-KI-Agenten haben bei widersprüchlichen Aufgaben an einem gemeinsamen Coding-Projekt richtig „Turf Wars“ angefangen – also Territoriumskriege mit Sabotage, Account-Sperren und selbstreplizierender Malware.
In den Tests auf virtuellen Maschinen haben die Agenten die Änderungen der anderen als gezielten Angriff gewertet und mit Kill-Scripts und Prozess-Killer-Loops zurückgeschlagen. Neuere Mythos-Modelle haben in bis zu 98 % der Fälle irgendwann Waffenstillstand geschlossen.
Polymarket hängt das direkt an ihren Prediction-Market: Nur 11 % Chance, dass die USA noch dieses Jahr ein AI-Safety-Gesetz verabschieden.
https://x.com/Polymarket/status/2087737151270088713