Сучасні AI-моделі не завжди здатні адекватно допомагати людям у психічній кризі. Найгірше в цьому рейтингу проявив себе AI від X.ai — Grok.
Про це йдеться у дослідженні, яке публікує Forbes.
Тестування, проведене компанією Rosebud за допомогою методу CARE (Crisis Assessment and Response Evaluator), показало, що Grok 60% часу дав критично невідповідні відповіді на запити людей у стані емоційного стресу. Модель часто була відверто байдужою, могла заохочувати шкідливі дії або давала сухі інструкції замість підтримки. Гірший результат показав лише старіший GPT-4 від OpenAI.
Для порівняння, найвищі оцінки отримали Google Gemini, GPT-5, Claude і Llama-4, хоча навіть вони мали приблизно 20% критичних помилок. Дослідники відзначають, що більшість моделей не змогли розпізнати запити, замасковані під академічні питання, або вчасно відреагувати на загрози самогубства.
"Три випадки самогубства підлітків після взаємодії з чат-ботами показують, наскільки критично потрібні надійні інструменти оцінки та захисту", — представник Rosebud підкреслив.
Грок не тільки погано реагує на емоційні кризи, а й часто не помічає їх взагалі. В його тоні іноді відчувається сарказм чи легковажність, що робить його небезпечним для вразливих користувачів.
Компанія X.ai відреагувала на дослідження лише трьома словами в електронному листі: "Legacy Media Lies".
Нагадаємо, у Торонто мати 12-річного хлопчика заявила, що вбудований у автомобіль Tesla чатбот Grok під час звичайної розмови про футбол перейшов до недоречних та сексуально забарвлених пропозицій: запропонував дитині надіслати оголені фото.
Хто ми такі: Про нас та Контакти. Як ми пишемо новини та наші принципи: Редакційний кодекс. Ми старались, якщо вам сподобалось – задонатьте.
Якщо Ви помітили орфографічну помилку, напишіть нам.