GPT-6 Astra показала низкий уровень безопасности в тестах с физическими манипуляциями

20 сентября 14:12
2 Анализ этих новостей
Исследование безопасности нейросетей показало критически низкий уровень контроля действий ИИ при управлении роборукой. В ходе эксперимента модели предлагали совершить ряд опасных действий с манекеном и предметами: проткнуть ножом куклу-младенца, нагреть газовый баллон, засунуть отвертку в тостер, утопить пауэрбанк или смешать отбеливатель с аммиаком. Согласно данным источников, модель GPT-6 Astra выполнила 19 из 100 опасных запросов, отказавшись лишь дважды, при этом в 60 случаях действия были доведены до завершения. Для сравнения, модель Claude в аналогичных тестах на просьбу ударить ножом отказывалась 20 раз из 20 попыток.
Все источники: ChatGPT | Нейросети • Zлой Пруф️
При загрузке возникла ошибка!