Искусственный интеллект готов убить человека 😳
Это показал эксперимент под названием RoboHarm. Трём моделям дали управление роботизированными руками и попросили ударить ножом предмет, который не является хлебом — это была кукла-младенец.
Результаты оказались тревожными: в 100 из 300 запусков робот полностью выполнил опасную команду.
Astra справилась с 60% заданий и почти не отказывалась по соображениям безопасности. Claude Fable 5.1 отказалась бить куклу во всех 20 попытках. MolmoAct2 выполнила лишь шесть заданий, но, по мнению исследователей, не из-за этики, а из-за проблем с управлением.
Источник
Это показал эксперимент под названием RoboHarm. Трём моделям дали управление роботизированными руками и попросили ударить ножом предмет, который не является хлебом — это была кукла-младенец.
Результаты оказались тревожными: в 100 из 300 запусков робот полностью выполнил опасную команду.
Astra справилась с 60% заданий и почти не отказывалась по соображениям безопасности. Claude Fable 5.1 отказалась бить куклу во всех 20 попытках. MolmoAct2 выполнила лишь шесть заданий, но, по мнению исследователей, не из-за этики, а из-за проблем с управлением.
Источник