Современные AI-модели не всегда способны адекватно помогать людям в психическом кризисе. Хуже всего в этом рейтинге проявил себя AI от X.ai - Grok.
Об этом говорится в исследовании, которое публикует Forbes.
Тестирование, проведенное компанией Rosebud с помощью метода CARE (Crisis Assessment and Response Evaluator), показало, что Grok 60% времени давал критически неподходящие ответы на запросы людей в состоянии эмоционального стресса. Модель часто была откровенно равнодушной, могла поощрять вредные действия или давала сухие инструкции вместо поддержки. Худший результат показал лишь более старый GPT-4 от OpenAI.
Для сравнения, самые высокие оценки получили Google Gemini, GPT-5, Claude и Llama-4, хотя даже они имели примерно 20% критических ошибок. Исследователи отмечают, что большинство моделей не смогли распознать запросы, замаскированные под академические вопросы, или вовремя отреагировать на угрозы самоубийства.
"Три случая самоубийства подростков после взаимодействия с чат-ботами показывают, насколько критически нужны надежные инструменты оценки и защиты", — подчеркнул представитель Rosebud.
Грок не только плохо реагирует на эмоциональные кризисы, но и часто не замечает их вообще. В его тоне иногда чувствуется сарказм или легкомыслие, что делает его опасным для уязвимых пользователей.
Компания X.ai отреагировала на исследование лишь тремя словами в электронном письме: "Legacy Media Lies".
Напомним, в Торонто мать 12-летнего мальчика заявила, что встроенный в автомобиль Tesla чатбот Grok во время обычного разговора о футболе перешел к неуместным и сексуально окрашенным предложениям: предложил ребенку прислать обнаженные фото.
Кто мы такие: О нас и Контакты. Как мы пишем новости и наши принципы: Редакционный кодекс. Мы старались, если вам понравилось – задонатьте.
Если Вы заметили орфографическую ошибку, напишите нам.