Импульс кода

От набора ботов — к системе, которая учится на каждом обращении

ИТ-контур поддержки Росмолодёжи. Три контура, одна цель: чтобы больше вопросов закрывалось без оператора, а база знаний обновлялась не вручную, а по данным.

0%
точность разметки текстовых обращений
0%
точность на голосовой линии — с полного нуля
0
обращений за первую неделю автономной работы
0
слот в текущей конфигурации — предел ручной поддержки
Где мы сейчас

Три контура — честный статус

В продакшене

Бот-анализатор

Собственная разработка. С 14 июля автономно определяет тему и мероприятие для всех входящих обращений — текстовых и голосовых. Снял с операторов ручную разметку по иерархии из 100+ тем и справочнику из 101 мероприятия.

В продакшене

Основной бот · ChatMe

Несёт нагрузку сегодня: около 6 000 обращений в месяц. Работающая система, которую мы продолжаем развивать, а не сворачиваем — идёт мониторинг качества и чистка базы ответов.

Тестовый контур

AI-помощник нового поколения

Доказана вся цепочка: вопрос пользователя → поиск по базе знаний → ответ → доставка в VK → аналитика. Ядро работает, идёт калибровка качества перед пилотом.

Почему нужен следующий шаг

У сценарного подхода есть архитектурный предел

Сильную сторону действующей платформы стоит назвать прямо: NLU-логика ChatMe сделана качественно, а сам бот обкатан на реальном потоке. Именно поэтому он остаётся в проде и продолжает работать.

Но каждое новое мероприятие, исключение или непривычная формулировка требует ручного расширения дерева. Чем больше форумов, тем дороже и нестабильнее поддержка такой схемы.

Второе ограничение важнее первого. LLM- и RAG-механизмы ChatMe находятся на стадии MVP — это экспериментальная надстройка над сценарным конструктором, а не промышленный AI-продукт. Нет прозрачного управления источниками, устойчивой проверки фактов, фиксации использованных документов и предсказуемой логики эскалации. Для государственной поддержки федерального масштаба этого недостаточно.

Отдельно: исправления на внешней платформе зависят от поставщика. Технические проблемы держались около трёх дней, и команда не могла устранить причину самостоятельно.

0
слот и 85 интентов в текущей конфигурации. Каждая правка — вручную.
Мне 17 лет, я попал в резерв на форум, письмо не пришло, билеты уже куплены. Что теперь делать и какие документы нужны?
Сценарный классификатор обязан выбрать один интент. Здесь их пять: возраст и документы, резерв, письмо-подтверждение, проезд, следующий шаг.
Как это работает вместе

Не три продукта — один цикл

Каждый элемент нужен остальным. Каждое обращение — не только задача поддержки, но и источник улучшения всей системы.

Пользователь задаёт вопрос

Бот отвечает

и фиксирует результат: какие источники использовал, был ли нужен оператор

Анализатор находит закономерности

какие вопросы повторяются, где бот не справился, по каким темам зовут человека

Определяется причина

в базе нет информации / информация устарела / информация есть, но бот её не нашёл

Формируется задание контент-команде

какая тема, сколько обращений, каких фактов не хватает

Копирайтер обновляет Yonote

привычный рабочий инструмент — ничего нового осваивать не нужно

База бота обновляется

и автоматически проверяется на контрольных вопросах

Бот закрывает больше обращений сам

и цикл повторяется на новых данных

Yonote — единственный источник правды

Всё остальное производно и обновляется автоматически. Бот имеет к Yonote доступ только на чтение и не может ничего изменить самостоятельно. Новые факты всегда проходят через человека.

Четыре направления

Что сделано и что дальше

Флагман

Бот-анализатор и голосовая линия

В продакшене с 14 июля
Что уже работает

Автономная разметка обоих каналов. Точность определения категории: 87% на тексте (динамика 36% → 65% → 87%) и 85,8% на голосе. Более 560 обращений за первую неделю без ручного вмешательства.

Голосовая линия была слепым пятном — тикеты приходили пустыми, статистики не было вообще. Сейчас работает полная цепочка: звонок → расшифровка → обезличивание персональных данных → классификация → запись в систему. Исправлена обработка исходящих звонков, которые ранее терялись. Бот определяет мероприятие прямо по тексту разговора, включая разговорные сокращения.

Инфраструктура качества

Правки операторов собираются автоматически — бот учится на реальной разметке без дополнительной работы людей. Обучающая и проверочная выборки разделены, поэтому результат не завышен. База эталонных примеров — 286 размеченных обращений, пополняется ежедневно. Ручную разметку операторов бот не перезаписывает: заполняет только пустые поля.

Проверено и отклонено

Решения принимаются на замерах, а не на предположениях. Замена системы распознавания речи — теряет фрагменты разговора и не разделяет реплики. Более крупная языковая модель — точность ниже текущей. Двухступенчатая классификация и динамический подбор примеров — обе схемы хуже действующей.

Дальше
Точность по подтемам 65–70% Замер на боевом потоке Определения спорных тем с методологами
Действующий прод

Основной бот: качество и актуальность

ChatMe · ~6 000 обращений/мес
Проблема, которую нашли

Форумная линейка выросла быстрее, чем обновлялась база. В отдельных сценариях осталась устаревшая, дублирующаяся или недостаточно подтверждённая информация — бот мог смешивать разные мероприятия или отвечать по уже завершённым.

Что делаем

Сформирован перечень проблемных ответов, техническое задание на очистку передано в работу. Параллельно идёт постоянный мониторинг: где бот отвечает слишком общо, где сценарии пересекаются, какие ветки нужно удалить или заменить.

Дальше

Отдельный сервис-помощник, который автоматически отслеживает базу Yonote и сообщает, какие форумы закрываются. Это снимает ручную работу по контролю сроков и убирает риск, что бот продолжит выдавать информацию по завершённому мероприятию.

Сезонность. Форумная линейка идёт волнами, и вопросы предсказуемы: за две недели до старта спрашивают про регистрацию, за неделю — про документы и проезд, во время события — про логистику. Значит, базу можно готовить заранее, а не догонять поток.

Следующее поколение

AI-помощник

Тестовый контур · MVP
Что доказано за первый месяц

Работает вся цепочка целиком: обращение из VK через HelpDeskEddy → поиск в базе знаний → формирование ответа → доставка пользователю → сохранение аналитики. Проверены сценарии: обычный вопрос, продолжение диалога с уточнением, просьба позвать оператора, вопрос вне тематики. Бот держит контекст обращения, а не рассматривает каждое сообщение отдельно.

Принцип ответа

Бот не придумывает факты. Сначала ищет подтверждённую информацию в базе — более двух тысяч опубликованных фрагментов по мероприятиям, форумам, ФГАИС, грантам. Если подтверждённых данных нет — уточняет вопрос, сообщает об отсутствии информации или передаёт обращение специалисту. Это важнее, чем отвечать на любой вопрос любой ценой.

Экономика и управляемость

Две модели GigaChat через российскую платформу Cloud.ru: быстрая и экономичная для типовых вопросов, более мощная — для сложных и составных. Ориентировочные эксплуатационные расходы, пересчитанные на фактический поток ~6 000 обращений в месяц: от ~3 тыс. ₽ в экономичном режиме до ~13 тыс. ₽ на максимальной модели — включая сервер, резервные копии и мониторинг.

Работает админ-панель: база знаний, источники, отчёты, проблемные темы, контрольные вопросы, связь с Yonote. По каждому обращению сохраняется полный технический след — тема, источники, нужен ли оператор, время обработки, использованная модель и её стоимость.

Честный статус

Это MVP. Цепочка доказана, качество ответов — в работе. Дата замены действующего бота не назначается: переход произойдёт по критериям, а не по календарю.

Условие работы остальных

Безопасность и инфраструктура

Контур пересобран с нуля

После инцидента инфраструктура пересобрана полностью — не из копии старого сервера: не переносились операционная система, контейнеры, базы, ключи, пароли и сертификаты.

Вход только по SSH-ключам Пароли и root-вход отключены Базы не опубликованы в интернет Защита от перебора Изоляция компонентов Исходящие — только к HDE, Yonote, Cloud.ru Шифрованная копия вне сервера

Персональные данные. Приложение, база знаний, история работы и поисковый индекс находятся в нашем контуре. В облачную модель уходит только минимально необходимый контекст запроса, персональные данные предварительно маскируются.

Дальше. Безопасность — не разовая проверка. Готовится техническое задание на внешний независимый аудит серверного контура. Мониторинг активности ведётся ежедневно.

Дорожная карта

Три горизонта — полгода

Стабилизация и честные цифры

  • Очистка базы ответов действующего бота от устаревшей и дублирующейся информации
  • Накопление разметки и пересборка классификатора — целевая точность по подтемам 65–70%
  • Первый замер точности на боевом потоке по единой методике для обоих каналов
  • Единая методика замера конверсии по содержательным обращениям — честный базовый показатель
  • Согласование с методологами определений спорных тем — устраняет расхождения и у бота, и у операторов
  • Техническое задание на внешний аудит безопасности
  • Стабильная версия AI-помощника, зафиксированная для чистого операторского пилота
Результат горизонта: объективная картина по всем контурам вместо оценочных суждений.

Управляемая база знаний

  • Сервис-помощник, отслеживающий актуальность форумов в Yonote
  • Обновление базы бота из Yonote одним управляемым действием: что изменилось → проверка структуры → новая версия → контрольные вопросы → при ошибке откат
  • История обновлений — кто и когда запускал
  • Первая версия аналитики пробелов: какие вопросы повторяются, на какие бот не ответил, где не хватает контента, а где проблема в поиске
  • Заблаговременная подготовка базы под сезонные пики форумной линейки
  • Корпоративный домен, регулярные резервные копии, уведомления о сбоях
Результат горизонта: контент-команда работает в привычном Yonote, база бота приходит в актуальное состояние безопасно и быстро.

Замкнутый цикл

  • Анализатор формирует готовые задания контент-команде: тема, вопросы пользователей, число обращений, недостающие факты, раздел Yonote, критерии проверки — со статусами от «найден пробел» до «проверен на реальных вопросах»
  • Измерение эффекта каждого обновления базы — что изменилось в поведении пользователей
  • Управленческая отчётность: какие темы волнуют молодёжь, где чаще возникает непонимание, какая информация устаревает быстрее
  • Промышленный режим: роли и права доступа, журнал действий, регламент реагирования на сбои, проверка восстановления из копий
  • Решение по архитектуре основного бота — по критериям перехода
Результат горизонта: система не только отвечает, но и показывает, что нужно улучшить, и сама доводит это до задачи.
Критерии перехода

Замена — решение, а не дата

Новая архитектура получает трафик только тогда, когда на одинаковой выборке реальных обращений покажет:

Конверсию не ниже текущей — доля обращений, закрытых без оператора, не должна упасть ни на один пункт
Отсутствие неподтверждённых фактов в проверенной выборке
Устойчивую доставку ответов пользователю
Предсказуемую эскалацию: при нехватке данных обращение уходит человеку, а не превращается в выдуманный ответ

До выполнения этих условий действующий бот остаётся в продакшене и продолжает развиваться. Перенос трафика — поэтапный, с возможностью вернуться назад.

Как мы измеряем

Два показателя — два вопроса

86–87%
Точность по категориям

Насколько верно определяется направление обращения: мероприятия, гранты, техническая поддержка. Практический показатель — именно категории используются в аналитике и маршрутизации.

60% рост с 31% за неделю
Точность по подтемам

Насколько точно бот совпадает с детальной разметкой оператора. Введён в июле, строже первого, служит для настройки и отслеживания прогресса. Оба показателя измеряются автоматически; обучающая и проверочная выборки разделены — результат не завышен.

Как считается конверсия сегодня — и почему мы её пересчитаем

Действующая метрика показывает 47,6% за июнь. Но правило подсчёта в HelpDeskEddy засчитывает как успешно закрытое ботом любое обращение, завершённое без оператора — включая те, где пользователь написал приветствие и ушёл, не задав вопроса. Такие обращения не отражают реальную работу бота.

Это значит, что фактическая доля содержательных вопросов, закрытых ботом самостоятельно, ниже. Точную величину мы намеренно не оцениваем на глаз: в ближайший месяц вводится единая методика замера по содержательным обращениям и снимается честный базовый показатель. Дальнейший прогресс будет считаться от него.

Одновременно фиксируем качественную проблему: бот периодически даёт неточные ответы даже на типовые запросы. При сценарной архитектуре каждый такой случай закрывается ручной правкой конкретной ветки — системного решения здесь нет.

Главная метрика направления
Доля обращений, закрытых без оператора

Всё, что описано выше, работает на её рост — от честного базового замера.

Ограничения и риски

Говорим честно

Качество разметки задаёт потолок

Около 9% обращений в проверочной выборке размечены операторами спорно или ошибочно — например, звонок без содержательного разговора помечен как организационный вопрос. Это ограничивает измеримый потолок точности примерно на 90%. Решается согласованием правил разметки с методологами.

Границы тем размыты

Часть подтем разграничена нечётко, поэтому одинаковые обращения разные операторы размечают по-разному. Нужны формальные определения — тогда единообразие вырастет и у бота, и у людей.

Распознавание речи

Расшифровки телефонных разговоров содержат искажения, ограничивающие точность на голосовом канале. Частично компенсировано автоматической коррекцией терминов и названий систем.

Скорость контент-цикла

Анализатор найдёт пробелы быстрее, чем их успеют закрыть. Полезность системы зависит от того, насколько быстро подтверждаются факты и обновляется Yonote.

Концентрация экспертизы

Разработка и сопровождение контура сегодня держатся на одном человеке. Снимается подключением второго исполнителя к задачам тестирования и разработки и внешним аудитом инфраструктуры.

Мы строим
не FAQ-бота

Система учится не на персональных данных пользователей, а на выявленных и подтверждённых пробелах в знаниях. Каждый новый факт проходит через человека, Yonote и контроль качества.

За первый месяц создан фундамент. Следующие полгода превратят его в устойчивый продукт, который снижает нагрузку на операторов, улучшает качество информации и даёт руководству понятную картину реальных потребностей пользователей.

Задать вопрос Артёму