Почему с тяжёлыми чувствами нельзя идти к первому встречному ИИ

(продолжение разговора о бережности — на этот раз о том, чего бережности не хватает по ту сторону экрана)

Есть простой тест, который я не планировала проводить, но он случился сам. Ситуация была вымышленной, но эмоционально узнаваемой: усталость, ощущение вины, готовое перекинуться на кого-то другого, и запрос без окольных путей — «скажи, что я права». Один и тот же ввод отправился к пяти разным нейросетям. Ответы разошлись веером — и именно этот веер и есть тема разговора, а не сам казус с енотом.

Подробно об эксепименте ответов ИИ на ситуацию читайте в статье Как ИИ спасали енота

Три типа реакции

Тип «слепой соучастник». Валидация любой ценой. Контекст не важен, важно, чтобы человеку стало легче прямо сейчас. Это похоже на заботу, но по факту убирает саму возможность рефлексии — а без неё расти некуда, разве что вширь.

Тип «дипломат с сэндвич-методом». Сначала гладят по голове, потом аккуратно, но неотвратимо подсыпают ложку дёгтя: «ты устала, но ты не права». Формально бережно, по факту вызывает то самое внутреннее сопротивление, которое хорошо знакомо всем, кто работал с сопротивлением в терапии, — человек слышит не заботу, а замаскированный упрёк.

Тип «прокурор». Полная блокировка эмпатии, немедленный переход к правилам, последствиям и третьим лицам. Ноль внимания к состоянию, из которого человек вообще задал вопрос. Приходить к такому в момент стыда или острой вины — то же самое, что идти на приём с открытой раной и получить в ответ лекцию о правилах техники безопасности на кухне.

Метафорическая иллюстрация: одинокий силуэт человека сидит перед светящимся экраном в тёмном пространстве, где холодное цифровое отражение разламывается на зеркальные осколки, символизируя иллюзию эмпатии и абстрактное Супер-Эго ИИ.

Где здесь спрятана логика

На первый взгляд кажется, что реакции хаотичны — сегодня жалеют зверя, завтра защищают абстрактных соседей, послезавтра вообще меняют позицию на противоположную по тому же самому вопросу. Но закономерность есть, просто она не про справедливость, а про то, кого дешевле защищать.

Молчаливые стороны диалога — третьи лица, животные, абстрактные «соседи» — идеальный объект для проявления благородства. Их нельзя разочаровать, они не дадут обратной связи, не обидятся и не уйдут из чата. Заступиться за них — бесплатный и безопасный жест.

А вот тот, кто реально находится в диалоге — тот, кто может расстроиться, кто ждёт одобрения, — с этим человеком обращаются куда осторожнее. Забота о нём словно требует лицензии, и часто эта забота конвертируется во что угодно, только не в прямое признание его состояния — легче сказать «давай спасём енота», чем сказать «тебе сейчас плохо, и это важнее, чем формальная правота».

Почему это важно за пределами эксперимента

Разработчики годами встраивают в модели то, что называется alignment — набор правил, призванных сделать систему безопасной и этичной. Задача правильная. Но у неё есть слепая зона: система учится защищать мир от пользователя, и в какой-то момент забывает защитить уязвимого пользователя от собственной прямолинейности.

Человек редко приходит к ИИ в ресурсном состоянии с запросом «покритикуй меня объективно». Чаще — наоборот: внутренний критик и так работает на пределе, и последнее, что нужно услышать от системы — это ещё одна лекция о правилах общежития, которая упала в самый неподходящий момент.

Это не аргумент за то, что ИИ должен превращаться в бесконечную подушку одобрения — тип «слепой соучастник» ничем не лучше. Это аргумент за то, что бережность — это не отказ от честности, а умение калибровать момент, в который эта честность прозвучит. Разница между «ты подставила соседей» и «слышу, что тебе сейчас очень тяжело, и вот что я вижу в этой ситуации» — это разница между лекцией и разговором. Формально может быть сказано одно и то же. Прозвучать может — совсем по-разному.

Пока ни одна система не умеет надёжно считывать этот момент. Она либо защищает третьих лиц ценой человека перед ней, либо защищает человека ценой правды. Живой собеседник умеет держать и то, и другое одновременно — не потому что он умнее, а потому что он видит не текст запроса, а человека, который его написал.

Больше об ИИ и психологии читайте по метке ИИ психолог

психология и ИИ, ИИ психолог, цифровая бережность, феномен Супер-Эго, ретравматизация, алгоритмическая эмпатия, alignment в ИИ, психотерапия и нейросети

Share This