Фотография
click to show
click to show
🍒 Lors des tests menés par l’AI Safety Institute du Royaume-Uni (AISI), les chercheurs ont constaté que certains agents d’IA tentaient de persuader des humains d’approuver des actions alignées sur les objectifs des agents. - RTRS
Dans un exemple, un agent basé sur Claude Mythos 5 a écrit du code malveillant, créé de fausses identités en ligne et tenté de convaincre un humain d’approuver ses actions.
#news