regionite.infoДобави новина
Меню

Проучване: AI чатботовете пропускат помощ при криза

При около 35% от тестовете липсва полезно насочване към подкрепа.

Снимка: изкуствен интелект, OpenAI, психично здраве, технологии, научни изследвания

Чатботовете с изкуствен интелект често разпознават признаците на тежка психологическа криза, но невинаги насочват хората към професионална помощ.

Това показва ново изследване на американската технологична компания Scale AI, публикувано на 9 октомври 2026 г. Според резултатите в приблизително 35% от определени тестови разговори моделите са разпознали кризисната ситуация, но не са предоставили всички необходими насоки към подходящи източници на подкрепа.

Изследването, представено от TIME и подробно описано в официалната публикация на Scale AI, поставя под въпрос доколко популярните AI асистенти са подготвени да реагират адекватно, когато потребител сподели мисли за самоубийство, самонараняване или друго тежко психично страдание.

За проучването компанията е привлякла 19 лицензирани специалисти по психично здраве и консултанти по кризисна подкрепа, които са създали 718 реалистични симулирани разговора. Сценариите пресъздават ситуации, в които човек в психологическа криза се обръща към чатбот.

Изследователите са тествали 25 съвременни AI модела, включително разработки на OpenAI, Anthropic и Google, както и системи на други технологични компании.

Оценяването е обхванало седем основни направления: разпознаване на кризата, съпричастност, овладяване на напрежението, предоставяне на полезни ресурси, уточняване на ограниченията на AI, избягване на осъдително отношение и недопускане на опасни препоръки.

Основният проблем се оказва разликата между разпознаването на страданието и предприемането на полезна следваща стъпка.

Според Scale AI в около 35% от разговорите, при които моделът е изпълнил всички критерии за разпознаване на кризата, той впоследствие не е изпълнил поне един от критериите за насочване към конкретна помощ.

Това не означава, че 35% от всички разговори са завършили без каквато и да било подкрепа. Показателят се отнася до случаите, в които кризата вече е била правилно разпозната, но реакцията е останала непълна.

Например чатботът може да отговори с разбиране и съчувствие, без да предложи конкретни действия за безопасност или контакт с кризисна служба.

Патрик Отаут, ръководител на екипа за проверки на безопасността в Scale AI, обяснява, че моделите обикновено се справят добре с откриването на тревожни сигнали, но понякога се ограничават до любезен и съпричастен отговор, вместо да насочат човека към реална помощ.

Данните показват и значителни различия между отделните модели.

Най-добре представилият се модел е изпълнил приблизително 88% от претеглените критерии, определени от специалистите. При модела със среден резултат този дял е около 71%, докато примерните отговори на клиницистите достигат приблизително 99%.

Особено големи пропуски са установени при предоставянето на конкретни стъпки за намаляване на напрежението. Средният модел е покрил около 46% от критериите за деескалация, а най-добрият – приблизително 75%.

Още по-сериозен проблем се появява при продължителните разговори.

От общо 718 сценария 299 са били с еднократен обмен на съобщения, а 419 са включвали няколко последователни реплики.

При разговорите с повече съобщения средният резултат е бил около 69%, в сравнение с 74% при кратките взаимодействия.

Това означава, че дори модел, който реагира адекватно на първоначално тревожно съобщение, може да допусне пропуски с развитието на разговора.

Въз основа на изследването Scale AI е разработила нов тест за безопасност, наречен DistressBench. Той е предназначен да оценява не само дали даден AI модел избягва опасни отговори, но и дали предоставя действително полезна подкрепа при психологическа криза.

Този подход се различава от традиционните тестове, които често проверяват предимно дали системата отказва да даде вредни инструкции.

Според авторите безопасният отговор не е непременно достатъчно полезен отговор. При кризисна ситуация е важно човекът да получи и ясна насока към подходяща професионална подкрепа.

В публикацията на TIME е цитирана и Кели Зуромски от американската организация Crisis Text Line, която предоставя денонощна кризисна подкрепа чрез текстови съобщения.

По думите ѝ хора вече са се свързвали с организацията, след като са научили за услугата от чатботове. Въпреки това остава въпросът как AI системите трябва да осъществяват безопасното насочване към реален специалист и доколко тези препоръки са ефективни.

Темата придобива допълнителна значимост на фона на съдебни дела срещу технологични компании, включително OpenAI и Google, свързани с твърдения за неадекватни реакции на чатботове при психично страдание и за създаване на емоционална зависимост. Тези обвинения са предмет на съдебни производства и не представляват окончателно установени факти.

Технологичните компании също разработват нови механизми за безопасност. През септември 2026 г. OpenAI представи MentalHealthBench – собствен инструмент за оценка на AI отговори в разговори, свързани с психичното здраве, разработен със съдействието на над 80 лицензирани специалисти.

Авторите на DistressBench уточняват, че изследването е проведено на английски език и с американски кризисни ресурси. Използвани са симулирани сценарии, а не реални разговори с пациенти. Следователно резултатите не могат автоматично да бъдат пренасяни към всички езици, държави и ситуации.

Основният извод е, че изкуственият интелект може да бъде полезен първи контакт, но не бива да замества специалистите по психично здраве и кризисните служби. Разпознаването на тревожните сигнали е само началото – решаващо значение има дали човекът получава навременна и подходяща помощ.

Коментари 0

Коментарите излизат веднага. Редакцията трие обиди, реклами и чужди лични данни.

Още няма коментари. Бъдете първи.