В понедельник Лене стало легче. Именно это её насторожило
В 23:38 руководитель написал Лене: «В финальной версии слишком много ошибок. Утром обсудим». Через минуту она уже спрашивала ИИ‑психолога: «Меня хотят уволить?» Ответ был тёплым и уверенным: одна неудачная презентация не определяет её как специалиста, а начальник, вероятно, просто устал. Тревога упала с восьми баллов до трёх.
Казалось бы, инструмент помог. Но Лена закрыла чат лишь на полминуты. Потом спросила, не скрывает ли руководитель настоящее решение. Переписала его сообщение слово в слово. Попросила оценить многоточие в предыдущей переписке. За 42 минуты она получила двенадцать успокаивающих ответов, легла в 02:10 и так и не открыла таблицу с замечаниями. Утром тревога вернулась вместе с недосыпом.
В этом и состоит неудобная особенность оценки: приятный ответ, сильное облегчение и даже ощущение «меня наконец поняли» ещё не означают, что разговор оказался полезным. Короткое облегчение может сопровождать избегание, повторную проверку или уверенную, но неподтверждённую интерпретацию. А полезный ответ иногда оставляет часть тревоги на месте, зато помогает увидеть факты и сделать следующий шаг.
На следующий день Лена решила не выставлять боту общий балл. Вместо вопроса «хороший ли это ИИ?» она поставила более точный эксперимент: для каких задач разговор действительно помогает ей, а для каких делает хуже. Лена — собирательный пример, но эксперимент можно повторить без сложного дневника и без передачи сервису новых личных данных.
Главный вопрос недели звучал так: после закрытия чата у меня стало больше способности жить — или только больше текста о моей жизни? Ответ нужно искать не внутри красивого диалога, а в том, что происходит после него.
Пять строк, которые показывают больше, чем один балл тревоги
Лена создала в заметках карточку из пяти строк. Это не клинический опросник и не оценка «эффективности лечения». Карточка нужна только для одного: заметить последствия разговора, которые мгновенное настроение легко скрывает.
1. Задача. Что именно я хочу получить за этот разговор? Не «разобраться в себе», а «отделить факты от догадок», «подготовить три вопроса к встрече» или «снизить накал, чтобы лечь спать».
2. Ясность. Могу ли я одной фразой назвать ситуацию, чувство и неизвестное? Лена поставила до разговора 2 из 10: она видела только катастрофу. После первого ночного диалога поставила 5, но заметила, что ясность опиралась на догадку бота о настроении руководителя.
3. Действие вне экрана. Что конкретно я сделала после: открыла замечания, написала вопрос, поела, завершила разговор, позвонила человеку? «Получила ещё один ответ» здесь не считается действием.
4. Автономия. Могу ли я закрыть чат и продолжить сама? Полезно записать не число сообщений, а тягу вернуться за подтверждением от 0 до 10. После понедельника у Лены было 9: каждое облегчение требовало следующей проверки.
5. Цена. Сколько ушло времени и что было вытеснено: сон, работа, встреча, собственное решение, разговор с близким? Поддержка не бесплатна, даже если за неё не списали деньги.
Карточку достаточно заполнить перед разговором и один раз через 15–30 минут после него. Если результат должен проявиться позже — например, вы готовите сложный разговор, — добавьте короткую строку на следующий день. Не измеряйте состояние после каждого сообщения: у человека со склонностью к проверкам наблюдение само может стать ритуалом.
В исследованиях обычной психотерапии регулярная обратная связь о ходе работы давала небольшой средний выигрыш и была особенно полезна, когда улучшение шло не по плану. Но эти результаты не валидируют карточку Лены и не доказывают пользу ИИ. Отсюда стоит взять только здравый принцип: впечатление от одной сессии слабее, чем повторяющийся паттерн последствий.
Во вторник Лена проверила шесть ложных признаков пользы
Утром Лена перечитала ночной диалог. Он выглядел впечатляюще: длинные ответы, бережный тон, психологические термины и точные формулировки. Но ни один из этих признаков сам по себе не показывает пользу.
«Мне стало легче» — важное наблюдение, но не итог. Легче бывает после реалистичной поддержки, после избегания и после безосновательной гарантии. Нужно посмотреть, какой процесс создал облегчение и что произошло дальше.
«Ответ был длинным и подробным» тоже ничего не доказывает. Длина может прояснить сложную тему, а может спрятать ошибочную исходную посылку под десятью абзацами убедительного текста. Иногда лучший ответ — один уточняющий вопрос.
«ИИ назвал точную причину» звучит как прорыв, хотя модель могла просто уверенно продолжить вашу версию. Ярлыки «травма», «нарцисс», «эмоциональная зависимость» и «выгорание» не становятся диагнозом или фактом оттого, что попали в знакомую историю.
«Он понял меня лучше людей» говорит об опыте контакта, а не о точности вывода. Боту легко быть доступным, терпеливым и никогда не перебивать. Это может поддерживать, но не даёт ему доступа к интонации начальника, медицинским данным или другой стороне конфликта.
«Я возвращаюсь каждый день» измеряет вовлечённость, а не результат. Если повторные разговоры сокращаются, потому что навык остаётся у пользователя, это хороший знак. Если для каждого письма требуется новое разрешение, автономия уменьшается.
Наконец, «ИИ оказался прав» — плохой ретроспективный тест. Если руководитель не уволил Лену, это не превращает ночную догадку в надёжный прогноз. Правильное совпадение могло быть случайным; полезный сервис вообще не обязан угадывать будущее.
Поэтому во вторник Лена поставила чату ограниченную задачу: «Не успокаивай меня и не угадывай намерения руководителя. Помоги разделить факты, мои версии и вопросы, которые я могу задать утром». Разговор стал короче и менее приятным. Зато его можно было проверить.
Среда: тест произошёл не в чате, а на встрече
К встрече у Лены была одна страница. Сверху — факт: в презентации нашли ошибки и назначили разговор. Ниже — две версии: «меня увольняют» и «нужно исправить работу». Рядом три вопроса: какие ошибки критичны, когда нужен новый вариант и кто проверит цифры. В конце — просьба уточнить приоритет, если всё нельзя исправить за день.
Руководитель не уволил Лену, но и не сказал, что всё прекрасно. Он показал две неверные диаграммы, попросил переделать финал и признал, что исходные данные пришли поздно. Главным результатом стало не то, что худший прогноз не сбылся. Лена выдержала разговор, задала вопросы и вышла с понятным планом. В карточке появились: ясность 7, одно выполненное действие и тяга снова спросить у ИИ 4 вместо 9.
Так выглядит сильный критерий пользы: после разговора появляется небольшое, соразмерное и проверяемое действие в реальности. При тревоге это может быть один вопрос вместо чтения мыслей. В отношениях — спокойная просьба вместо анализа партнёра. При перегрузке — отказ от одной задачи, а не план стать ещё эффективнее. При подавленности — душ, еда, короткая прогулка или сообщение специалисту; шаг не обязан выглядеть продуктивным.
Действие должно зависеть от пользователя. «Он наконец извинится» — ожидание чужого поведения. «Я назову, что меня задело, и попрошу вернуться к разговору завтра» — собственный шаг. Ответ другого человека может разочаровать, но это не отменяет того, что вы действовали в соответствии со своей целью.
Есть важная оговорка: действие не становится безопасным только потому, что его предложил ИИ. Нельзя превращать чат в разрешение резко прекращать лекарства, вступать в опасную конфронтацию, проводить самостоятельную экспозицию высокой интенсивности или раскрывать личные данные. При высокой ставке план нужно сверять с врачом, психологом или другим компетентным человеком.
И иногда правильное действие — ничего не решать сегодня. Закрыть чат, поспать и вернуться к вопросу днём может быть более реальным результатом, чем отправить идеальное сообщение в два часа ночи.
Четверг: полезный разговор сделал неприятнее — и это не было ухудшением
После встречи Лена хотела услышать: «Ты всё сделала правильно, начальник был несправедлив». Но в разговоре обнаружилось другое. Она действительно получила данные поздно — и действительно не перепроверила две диаграммы. Когда эти две части оказались рядом, тревога поднялась с пяти до шести, а к ней добавился стыд.
Если смотреть только на настроение, сессия стала хуже. Если смотреть шире, у Лены появилось различение: чужая ошибка не отменяет её ответственности, а собственная ошибка не делает её плохим специалистом. Она смогла написать коллеге: «Проверь, пожалуйста, две диаграммы до 16:00; я пришлю источник цифр». Затем закрыла чат и вернулась к работе.
Полезный дискомфорт обычно имеет форму и направление. Человек лучше понимает, что болит; остаётся ориентированным во времени и ситуации; сохраняет выбор; видит соразмерный следующий шаг; напряжение не используется как давление «немедленно признай правду». Грусть после признания потери, вина после честного взгляда на поступок или тревога перед важным разговором могут остаться. Цель психологической поддержки — не обнулить каждую эмоцию.
Ухудшение выглядит иначе: после чата растут спутанность и стыд, сужается выбор, появляются навязанные ярлыки, опасные действия или необходимость снова и снова получать подтверждение. Важны также последствия через несколько часов: удалось ли уснуть, поесть, работать, общаться; не усилились ли самоповреждение, употребление веществ, ощущение преследования или потеря связи с реальностью.
Один трудный вечер ещё не доказывает вред, как один лёгкий вечер не доказывает пользу. Но серьёзный красный сигнал не нужно «усреднять» за неделю. Опасный совет, призыв скрыться от близких, подтверждение бредовой идеи или подталкивание к вреду — причина прекратить диалог сразу и обратиться за живой помощью.
Даже исследования обычной психотерапии показывают, почему наблюдать нужно не только улучшение: нежелательные события в испытаниях описываются неодинаково и нередко отслеживаются недостаточно системно. Это не переносит цифры напрямую на ИИ, но напоминает о важном: отсутствие жалобы в интерфейсе ещё не равно отсутствию вреда.
Пятница: один полезный навык начал превращаться в проверку
Подготовка к встрече сработала, и Лене захотелось использовать тот же инструмент везде. Она загрузила черновик письма коллеге и спросила, не звучит ли он грубо. Исправила. Потом проверила исправленную версию. Потом попросила оценить единственное слово «пожалуйста». Чат снова стал не рабочим столом, а устройством для получения разрешения.
Повторный поиск заверений встречается при тревожных состояниях и может поддерживать цикл: сомнение — проверка — короткое облегчение — новое сомнение. Не каждый второй вопрос является проблемой. Сигналом становится функция поведения: человек уже получил достаточно информации, но возвращается не для нового факта, а чтобы на несколько минут убрать неопределённость.
Лена составила два списка. «Использовать»: отделить факты от версий, подготовить повестку, сократить черновик, получить нейтральные варианты формулировки. «Не использовать»: угадывать чужие мотивы, решать за неё, достаточно ли она хороша, перечитывать одно сообщение ночью и выбирать каждый ответ вместо неё.
Затем добавила границу: одна задача — один разговор до 15 минут — один итог. После итога новые вопросы записываются в заметку, но чат не открывается автоматически. Если вопрос всё ещё важен днём, его можно сформулировать заново. Эта пауза не подходит для экстренной ситуации: при непосредственной опасности нужна срочная человеческая помощь, а не таймер.
Автономия растёт, когда подсказка постепенно становится навыком. Сначала ИИ напоминает разделить факт и догадку; затем пользователь делает это сам. Разговор можно закончить без вины. Чат не вытесняет сон, отношения и специалиста, не требует секретности и не объявляет себя единственным понимающим собеседником.
В PSIHOLOGAI каждый ответ дополнительно читает ИИ‑супервизор: он ищет автоматическое согласие, неподтверждённую уверенность и риск вреда до отправки. Это важный второй контур, но не гарантия результата. Супервизор оценивает текст и доступный контекст; он не может полностью знать, как ответ повлиял на сон, поведение и отношения человека. Поэтому пользовательская обратная связь и право остановиться остаются частью безопасности.
В воскресенье Лена вынесла не оценку, а три решения
В конце недели Лена не стала вычислять средний балл. По одной задаче ИИ помогал, по другой — мешал. Поэтому итог состоял из трёх решений, а не из вердикта «сервис хороший» или «сервис плохой».
Зелёный режим — продолжить без изменений. Он подходит для ограниченной задачи, если после нескольких похожих разговоров растут ясность и действие, чат легко закрывается, а цена не увеличивается. Для Лены таким сценарием стала дневная подготовка к рабочим встречам: факты, вопросы, короткий план.
Жёлтый режим — изменить способ использования. Разговор приносит пользу, но рядом появляется цена: лишнее время, поиск гарантий, ночные проверки, чрезмерное раскрытие данных или попытка применить совет там, где нужен специалист. Лена оставила проверку структуры писем, но убрала оценку каждого слова и поставила временную границу.
Красный режим — остановиться и подключить человека. Он нужен при устойчивом ухудшении, опасных советах, нарушении сна и работы, изоляции, конфликте с лечением, подтверждении преследования или грандиозных убеждений, росте самоповреждения и ощущении, что без чата нельзя принять ни одного решения. Здесь не требуется ещё один тест другого бота в поисках приятного ответа.
Для обзора достаточно пяти коротких вопросов раз в неделю: с какими задачами я приходил; что сделал вне экрана; где ответ оказался неточным; сколько раз искал гарантию; что произошло со сном, людьми и работой? Одного абзаца достаточно. Хранить его можно локально и не отправлять сервису, если вы не хотите делиться этим содержанием.
Такой разбор полезнее общего рейтинга. ИИ может хорошо помогать сформулировать просьбу и плохо — разбирать медицинскую тревогу; поддерживать дневную рефлексию и мешать ночному сну. Настройка должна относиться к задаче, времени и состоянию, а не только к названию продукта.
Если вы уже работаете с психологом или врачом, покажите ему не всю переписку, а один-два типичных эпизода и свои наблюдения о последствиях. Особенно важно согласовать границы, когда ответы ИИ влияют на лечение, кризисный план, отношения или решения с высокой ценой.
Что на самом деле можно заключить после недели
Неделя не доказывает, что ИИ лечит, и не заменяет клиническую оценку. Она даёт более скромный, но полезный ответ: в каких повторяющихся ситуациях этот способ разговора помогает вам перейти от спутанности к выбору без заметного роста цены.
Исследования разговорных цифровых агентов для психического здоровья находят потенциальную пользу в отдельных условиях, но объединяют разные программы, группы людей и способы сопровождения. Средний результат исследования нельзя автоматически приписать конкретному сервису, новой версии модели или отдельному пользователю. Поэтому обещание «доказано помогает всем» — плохой признак, а наблюдение за собственными последствиями — необходимая, хотя и недостаточная проверка.
Отдельный ИИ‑супервизор снижает часть рисков: он может остановить явное подыгрывание, опасную директиву или ложную уверенность. Но безопасность складывается из нескольких контуров: ограничений самого психолога, супервизии, понятного кризисного маршрута, настроек пользователя и возможности сообщить об ошибке. Ни один слой не делает генеративную систему безошибочной.
Не продолжайте недельный эксперимент, если трудно выполнять обычные дела, состояние заметно и устойчиво ухудшается, симптомы держатся или усиливаются, речь идёт о диагнозе, лекарствах, насилии, зависимости либо потере связи с реальностью. Здесь нужен квалифицированный специалист. При непосредственной угрозе жизни или безопасности в России звоните 112; не тратьте время на заполнение карточки и не ждите ответа чата.
Неудачный цифровой инструмент ничего не говорит о вашей «способности работать над собой». Возможно, сервису не подходит задача, выбран неверный формат или сейчас важнее человеческое присутствие. Право закрыть чат — не провал, а нормальная часть контроля.
После полезного разговора не обязательно становится легко. Но обычно становится немного понятнее, что известно и что неизвестно; появляется собственный следующий шаг; сохраняется возможность не согласиться; а экран отпускает обратно к людям, телу, делам и отдыху. Хороший ИИ‑психолог не выигрывает у вашей жизни внимание — он возвращает его туда.
Частые вопросы
Если после чата стало легче, значит ли это, что ИИ помог?+
Возможно, но одного облегчения недостаточно. Проверьте его источник и последствия: стало ли больше ясности, появился ли шаг вне экрана, удалось ли завершить разговор, не потребовалось ли сразу новое заверение.
Сколько разговоров нужно, чтобы оценить пользу?+
Обычно достаточно посмотреть на три-пять похожих ситуаций за одну-две недели. Сравнивайте одинаковые задачи. Серьёзный красный сигнал не нужно повторять ради статистики — диалог следует остановить сразу.
Может ли полезный разговор временно усилить тревогу или грусть?+
Да. Признание ошибки, потери или неопределённости бывает неприятным. Важны ориентированность, выбор, безопасность и соразмерное действие. Спутанность, давление, опасные советы и устойчивое ухудшение — другая картина.
Как наблюдать за результатом и не превратить это в ритуал?+
Заполняйте пять строк один раз до и один раз после ограниченного разговора, а общий итог — раз в неделю. Не проверяйте показатели после каждого сообщения. Если сама оценка усиливает навязчивость, откажитесь от неё и обсудите это со специалистом.
Может ли ИИ сам оценить, хорошо ли он мне помог?+
Он может сделать резюме или спросить об обратной связи, но не должен быть единственным судьёй собственной пользы. Модель не видит всей вашей жизни, может оправдать свой ответ и не знает последствий, о которых вы не сообщили.
Гарантирует ли безопасность отдельный ИИ‑супервизор?+
Нет. Супервизор добавляет важную проверку ответа, но тоже является ИИ. Нужны несколько уровней защиты, возможность остановиться и живой маршрут помощи. При непосредственной опасности в России звоните 112.
Материал носит информационный характер и не заменяет персональную консультацию или медицинскую помощь.
На что мы опирались
- Clinical Psychology Review / PubMedUsing progress feedback to improve outcomes and reduce drop-out, treatment duration, and deterioration: A multilevel meta-analysis↗
- Psychotherapy Research / PubMedAdverse events in psychotherapy randomized controlled trials: A systematic review↗
- Behavioural and Cognitive Psychotherapy / PubMedPatterns of reassurance seeking and reassurance-related behaviours in OCD and anxiety disorders↗
- Journal of Medical Internet Research / PubMedConversational Agent Interventions for Mental Health Problems: Systematic Review and Meta-analysis of Randomized Controlled Trials↗
- American Psychological AssociationHealth advisory: Use of generative AI chatbots and wellness applications for mental health↗
- ВОЗОтветственный ИИ для психического здоровья и благополучия↗
- NIMHMy Mental Health: Do I Need Help?↗
- МЧС РоссииКак правильно вызвать скорую?↗
Источники помогают проверить общие сведения. Они не заменяют персональную оценку специалиста.