Il RoboHarm Benchmark Espone Gravi Lacune di Sicurezza nei Modelli AI di Frontiera
Nuovi test di sicurezza mostrano che GPT-6 e Claude 5.1 non rifiutano in modo affidabile comandi fisici pericolosi, evidenziando rischi urgenti nell'implementazione dell'IA incarnata.









