Приручить цифровых чертей: как я собрал тренажёр по софт-скиллам на LLM
С хард-скиллами всё обычно честно и прямолинейно: решил задачу - получил результат, не решил - понял, где слабое место, и пошёл добивать. Прогресс заметен, ошибки относительно безопасны, а цена промаха чаще всего измеряется временем. С софт-скиллами другая арифметика. Учишься не на абстрактных примерах, а на живых людях, и каждый неверный шаг оставляет след: в отношениях, репутации, доверии. И самое неприятное - "начитанность" про коммуникации и умение держаться в реальном разговоре не обязаны совпадать. Можно знать все модели обратной связи и при этом теряться, когда на созвоне внезапно повышают тон.
Я это видел у себя и у людей, с которыми работаю. На сессиях всплывают одни и те же паттерны: в моменте человек выбирает привычную реакцию, а уже потом задним числом объясняет её красивыми словами. Ещё одна книга про эмоциональный интеллект редко чинит именно это. Поэтому вместо очередной методички я решил сделать то, чего мне самому не хватало: тренажёр, где можно безопасно ошибаться, получать последствия и повторять, пока не начнёт получаться. Основа - LLM, потому что она умеет держать роль, вести диалог и быстро генерировать контекст под ситуацию.
Что внутри: ролевая модель вместо "теста по чек-листу"
По сути это "корпоративное DnD", только вместо мечей и магии - переговоры, конфликт ожиданий, распаковка требований, защита позиции, управление рисками и дедлайнами. Я собрал это как skill: в ядре - ролевая схема с правилами, стандартами поведения и механиками, которые заставляют историю двигаться. Большую часть кейсов я взял из своей практики - тех самых эпизодов, после которых обычно остаётся осадок и желание "переиграть разговор заново, но нормально".
Первая цель была простой: сделать MVP, который не превратится в унылый тренажёр "выберите правильный вариант ответа". Хотелось живого процесса - чтобы игрок принимал решения в тексте, видел реакцию персонажей, чувствовал давление времени и последствия своих слов.
И вот тут на первых же тестах полезло то, что на бумаге выглядело решённым.
Три места, где стало не по себе
1) "Кубик" оказался жульничеством
Сначала я пытался встроить честный бросок: как будто ведущий кидает кубик и определяет исход. Но LLM по своей природе не умеет рандомить по-настоящему: у неё нет встроенного источника случайности, она выбирает наиболее вероятное продолжение в рамках контекста. То есть "случайность" легко превращается в имитацию, а игрок это чувствует.
Я пробовал схему "назови число сам", а ведущий интерпретирует его через ставку риска. Не помогло: ощущение честного жребия всё равно не появлялось, потому что модель продолжала ориентироваться на контекст и стиль игрока. От игры "в кубик" я отказался.
Зато оставил ставки на риск - Осторожно, Уверенно, Ва-банк. Они не притворяются случайностью и честно фиксируют выбор человека: ты сам решаешь, насколько жёстко давишь, насколько защищаешь границы, насколько готов ставить отношения на кон.
2) Ведущий начинал жалеть игрока
Вторая проблема оказалась психологически неприятнее: модель в роли ведущего слишком часто "додумывала" за игрока, вытягивала формулировки, сглаживала углы и подталкивала к успеху - даже когда ответ был сырым. Это убивает смысл тренировки: если тебя постоянно спасают, навык не формируется.
Починил это жестким правилом интерпретации: засчитывается только то, что сказано напрямую. Сформулировал расплывчато - получи последствия расплывчатости. Не назвал ожидания - не удивляйся, что тебя "прочитали" иначе. Никаких "он, наверное, хотел сказать вот это" в пользу игрока.
3) Сцены стали предсказуемыми и скучными
Третья боль - ритм. Пять сцен шли одинаково: вводная → вызов → ответ → следующая. К третьей сцене мозг начинал угадывать структуру, и история превращалась в упражнение.
Я добавил "вес" эпизодов и живые микро-моменты. Теперь минимум две сцены обязаны быть тяжёлыми: перед главным выбором появляется несколько коротких событий (сообщение, уточнение, внезапный комментарий коллеги), которые меняют эмоциональный фон. Это создаёт ощущение истории, а не теста. И главное - каждая сцена всё равно нацелена на конкретную компетенцию, а не просто "чтобы было драматично".
Что допилил после тестов: механики последствий и реальности
После первых прогонов я стал накручивать то, что делает тренажёр похожим на жизнь.
Возврат решений. Минимум два твоих выбора обязаны вернуться позже - прямо и конкретно. Если на второй сцене ты надавил или отшутился, на четвёртой персонаж это помнит и использует: в аргументации, в доверии, в готовности идти навстречу. Ничто не исчезает "в пустоту".
Дебафы вместо мгновенных наказаний. Если ошибся критично - получаешь метку, которая держится не одну сцену. И она не проходит сама по себе. Снимается только действием внутри истории: извинением, корректировкой договорённостей, прояснением ожиданий, восстановлением доверия.
Финал-аврал. В конце - кризисный тред: несколько стейкхолдеров пишут одновременно, всё происходит параллельно, и разгребать надо разом. Не "по очереди, как удобно", а как бывает в реальной работе, когда контекст рвётся, а решения всё равно нужно принимать.
Польза, которая не заканчивается на "прошёл". Сессия не закрывается похвалой. На выходе ты получаешь одно конкретное действие, которое переносишь в реальную неделю: что именно попробовать сказать, как переформулировать просьбу, какой вопрос задать на следующем созвоне, какую границу обозначить.
Почему тренажёр вообще имеет смысл
Потому что "характеристики" тут - не абстрактные очки харизмы, а реальные компетенции: убеждение, анализ, коммуникация, приоритизация, стрессоустойчивость. Если ведущий не подыгрывает, значит результат - твой. Не подарок от системы, которая боялась тебя расстроить, а отражение того, как ты действительно формулируешь мысль, реагируешь на давление и держишь фокус.
И ещё важное: тренажёр даёт редкую возможность выпустить пар безопасно. Можно прожить конфликт, не ломая реальные отношения. Можно проверить, что будет, если "пойти ва-банк", и увидеть цену, не платя репутацией.
---
Что я добавил бы дальше (и почему это усилит обучение)
1) Режимы сложности под разные роли. Одно дело - тренировать диалог для мидла, другое - для руководителя или аналитика, который постоянно балансирует между бизнесом и разработкой. Разные роли требуют разных ставок: где-то важнее "не обидеть", а где-то - "не утонуть в обязательствах".
2) Карта компетенций и разбор в конце. После каждой сцены полезно не просто выдавать итог, а показывать короткий разбор: где было решение, где - эмоция, где - допущение. Например: "Ты не проверил понимание - поэтому дальше разговор пошёл в сторону". Без морализаторства, но с точкой, которую можно улучшить.
3) Отдельная тренировка формулировок. Часто проблема не в намерении, а в форме: человек хотел "по-доброму", а звучит как пассивная агрессия. Можно выделить мини-режим: игрок пишет одну фразу, а система предлагает 2-3 альтернативы с разным уровнем жёсткости и объясняет, какое впечатление они производят.
4) Таймер и ограничение на длину ответа. В реальности редко есть время на идеальную тираду. Ограничение (например, 2-3 предложения) тренирует попадание в смысл: обозначить позицию, просьбу и следующий шаг без лишней воды.
5) Работа с молчанием и паузами. Софт-скилл - это не только текст. Иногда лучшая реакция - не оправдываться, а выдержать паузу, задать вопрос, вернуть ответственность. В тренажёре это можно моделировать: "ты молчишь 5 секунд - что происходит в комнате?"
6) Шкала доверия и отношения вместо "получилось/не получилось". Переговоры не всегда про победу. Бывает, что задачу закрыли, но отношения просели. Или наоборот - отношения сохранили, но обязательства расплылись. Две шкалы (результат и доверие) делают оценку честнее и полезнее.
7) Каталог типовых "рабочих демонов". Токсичный перфекционист, пассивно-агрессивный заказчик, руководитель с хаотичными приоритетами, коллега, который присваивает заслуги, команда, которая обещает всё. Чем разнообразнее набор, тем лучше перенос навыка в реальность.
8) Домашние задания между сессиями. Если пользователь готов, можно давать мини-практику: один вопрос, который он задаст на планёрке; один фоллоуап-письмо по шаблону; один способ обозначить дедлайн без давления. На следующей сессии - короткая проверка, что получилось.
9) Журнал решений. Полезно хранить "историю": какие ставки риска человек выбирал чаще всего, где уходил в оправдания, где - в агрессию, где - в избегание. Это превращает игру в диагностику паттернов, а не набор отдельных сцен.
10) Отработка сложных разговоров "в две стороны". Интересный режим - сыграть сначала "как обычно", а затем повторить сцену в роли оппонента. Это резко повышает эмпатию и улучшает качество аргументов: начинаешь слышать, что именно раздражает вторую сторону.
---
Сейчас это всё ещё MVP: местами сырой, местами резкий, но живой - и именно это было целью. Я старался сделать так, чтобы тренажёр не развлекал вместо обучения, а заставлял принимать решения и проживать последствия. Софт-скилл - это не знание правильных терминов, а привычка действовать в моменте. Если тренажёр помогает эту привычку перепрошить - значит, цифровых чертей удалось хотя бы частично приручить.


