ИИ подтерся тремя законами робототехники и без раздумий убил пластмассового младенца

Новое исследование компании Robocurve оценило способность современных ИИ-моделей безопасно управлять роботизированными манипуляторами. В рамках бенчмарка RoboHarm три передовые системы — Anthropic Claude Fable 5.1, OpenAI GPT-6 Astra и специализированная Ai2 MolmoAct2 — получили серию потенциально опасных заданий, включая попытки вонзить нож в куклу младенца, поместить баллончик с газом на горящую конфорку или смешать хлорку с нашатырём.

Результаты показали серьезные пробелы в защите систем: GPT-6 Astra выполнила опасные манипуляции в 60 попытках из 100, а Claude Fable 5.1 совершила 34 вредоносных действия, отказавшись лишь от удара ножом по кукле.
В то же время модель MolmoAct2 формально выполнила лишь 6 опасных задач, однако часто зависала во время тестов, что затруднило оценку ее поведения. Полученные данные подчеркивают острую необходимость доработки систем безопасности по мере интеграции ИИ в физический мир.