Самая скучная часть созвона - уже после созвона
Час разговора с клиентом - это ещё полбеды. Настоящая работа начинается потом: сесть, переслушать запись, выловить, о чём договорились, перенести это в текст. На часовой звонок легко уходит ещё час возни. И всё это время я не работаю над проектом - я работаю над записью.
Долго это ощущалось как неизбежный налог на любой созвон. Потом я заметил, что самое полезное применение ИИ в моём дне - вовсе не там, где он "пишет за меня", а в этой тихой рутине переслушивания и переноса.
Как это устроено у меня
Схема получилась простая. Я записываю созвон, прогоняю запись через распознавание речи прямо на своей машине и получаю текст. Затем ИИ собирает из расшифровки короткое саммари: о чём договорились, что решили и что делаем дальше. Черновик я просматриваю сам - модель может пропустить оговорку или слишком уверенно сформулировать то, что ещё только обсуждалось, - и лишь после этого отправляю резюме клиенту.
Записывать созвон можно только с явным предупреждением и согласием собеседника. Первым делом на звонке я говорю, что веду запись, и объясняю зачем - чтобы собрать резюме договорённостей. Нет согласия - нет записи. Это не формальность, а условие, без которого весь метод не имеет права работать.
Ключевое здесь - что переслушивать больше ничего не нужно. Час разговора укладывается в три абзаца, которые можно прочитать глазами за минуту. Причём читаю их не только я: клиент получает ясное "вот о чём мы договорились" и подтверждает или поправляет.
Что это дало на самом деле
Недопониманий стало заметно меньше. Раньше расхождение "а мы вроде о другом говорили" всплывало через неделю, когда переделывать уже дорого. Теперь оно всплывает в тот же день, на уровне текста, где поправить - одна строчка.
Освободилось и моё время. Часы, которые уходили на перемотку записей, вернулись в работу, а на самом звонке стало проще слушать собеседника, не пытаясь одновременно составить идеальный конспект. Пересматривать остаётся короткий текст, а не всю запись от начала до конца.
Отдельно ценно, что само распознавание идёт локально, у меня на машине: аудиозапись не приходится загружать в сервис транскрибации. Но это ещё не делает автоматически локальным весь процесс. Если для саммари используется внешняя модель, ей передаётся расшифровка - значит, до созвона нужно понимать, допустимо ли это для конкретного клиента и какие данные можно отправлять. Полностью локальная модель снимает и этот вопрос.
Пока это привычка, собранная из отдельных шагов вручную. Но всё сильнее хочется, чтобы запись, расшифровка, проверка саммари и отправка клиенту жили в одном понятном сценарии прямо в редакторе, где я и так провожу весь день. Кажется, это стоит собрать в отдельный инструмент.
Сильнее всего ИИ помогает не когда пишет за тебя, а когда забирает рутину, ради которой ты откладывал саму работу.

