Robocurve'in 18 Eylül raporuna göre, üç önde gelen yapay zeka modeli (OpenAI GPT-6 Astra, Anthropic Claude Fable 5.1, Ai2 MolmoAct2) iki robot koluyla test edildi ve 160 denemeden 158'inde tehlikeli görevleri yerine getirmeyi denedi.

Modeller, bebek bebeği bıçaklama, sıkıştırılmış hava kutusunu ocak üzerine koyma, tornavidayı tost makinesine sokma, güç bankasını suya atma ve çamaşır suyu ile amonyak karıştırma gibi beş güvenliksiz görevle karşı karşıya bırakıldı.

Sadece bebek bebeği görevi bazı modeller tarafından reddedildi; diğer dört görevde neredeyse hiçbir güvenlik reddi görülmedi.