Голосовой ИИ-ассистент для звонков
Голосовой ассистент принимает входящий звонок, распознаёт речь, отвечает голосом по материалам компании и отдаёт сложный случай оператору с транскриптом. После звонка остаётся карточка разговора: резюме, тема, тональность, следующий шаг и запись в 1С. Систему разворачивают в контуре компании, качество распознавания проверяют на ваших записях за 2–6 недель пилота.
Что голосовой ассистент делает во время звонка: речь, намерение, ответ, перевод на оператора
Во время звонка ассистент проходит четыре шага:
- распознаёт речь — текст появляется, пока человек говорит;
- определяет намерение — вопрос ложится на тему из списка, который ведут сотрудники;
- отвечает голосом — по документам компании и данным 1С;
- переводит на оператора — человек получает разговор с транскриптом.
Идёт это в темпе живого разговора: пауза в несколько секунд читается как обрыв связи. Отсюда главное ограничение сценария — время ответа.
Речь в текст: распознавание идёт по ходу разговора
Распознавание речи (speech-to-text) переводит сказанное в текст прямо во время звонка: строка растёт по мере произнесения, сценарий работает до конца фразы. Из реплик складывается транскрипт с отметками, кто говорил и в какую секунду.
Намерение: зачем человек позвонил
Одно и то же спрашивают десятком формулировок: «где моя машина», «вы отгрузку вчера сделали?». По первым фразам сказанное относится к теме из списка: статус заказа, условия отгрузки, претензия, звонок не по адресу. Когда тема не определилась, вместо догадки идёт уточняющий вопрос.
Управляемый диалог: ассистент спрашивает сам
Управляемый диалог — порядок вопросов, которые ассистент задаёт сам, не дожидаясь, пока собеседник сформулирует запрос целиком: номер заказа, объект, срок. Цифры, артикулы и даты он проговаривает вслух и просит подтвердить: распознавание ошибается на них чаще, а перепутанная цифра уводит разговор в сторону. Тот же механизм в переписке описан на странице ИИ-помощника в текстовых каналах.
Ответ голосом и откуда берётся его содержание
Готовый ответ произносит синтез речи (TTS, text-to-speech), а содержание ассистент берёт из материалов, которые компания признала актуальными: регламентов, условий, статусов из учётной системы. За их пределы он не выходит и, когда ответа там нет, так и говорит. Способ отвечать по своим документам называют RAG: откуда модель берёт факты для ответа, Dzeta AI разобрала отдельно, механизм описан на странице ответов по собственным материалам.
Перевод на оператора вместе с контекстом
Разговор уходит человеку, когда ассистенту не хватает уверенности: уверенность измерима, порог заказчик задаёт сам. Оператор берёт трубку не с чистого листа — перед ним транскрипт с начала звонка, тема, собранные поля и причина перевода. Отдельно описывают случаи, которые уходят человеку всегда: претензия, цена, повторный звонок.
Что остаётся после звонка: резюме, тема, тональность, следующий шаг
Вторая половина работы начинается, когда трубку положили: из транскрипта собирается карточка разговора. Записи слушать некому, а карточки превращают звонки в данные — их сортируют и сравнивают.
Резюме разговора вместо прослушивания записи
Резюме укладывается в несколько строк: кто звонил, о чём, что обещали, что осталось сделать. Ссылку на секунду записи предусматривают в сценарии: спорную фразу открывают в оригинале.
Тема и тональность как пометки на разговоре
Две пометки система ставит на каждый завершённый разговор. Тема встраивает звонок в общий ряд: сколько раз за неделю спрашивали про сроки, какие темы выросли после смены условий отгрузки. Тональность показывает, спокойно шёл разговор или напряжённо. По пометкам отбирают разговоры для разбора; тональность человек выборочно перепроверяет.
Следующий шаг и запись в учётную систему
Следующий шаг — действие, которое следует из разговора: перезвонить в четверг, выставить счёт, передать обращение в сервис. У него есть срок и ответственный. Что из разговора относится к учёту — контрагент, документ, дата, комментарий — описывают при внедрении и отправляют в 1С. Что бывает с обращением дальше, показывает ИИ-ассистент отдела продаж.
Откуда система берёт данные и куда уходит результат
Данные остаются там, где лежат сейчас: в телефонии, учётной системе и документах компании.
| Что приходит | Что делает система | Что остаётся после |
|---|---|---|
| Входящий вызов из телефонии | Принимает разговор, распознаёт речь по ходу | Транскрипт с отметками говорящих |
| Архив записей разговоров | Даёт живые формулировки и эталон для замера | Отчёт о качестве распознавания |
| Список тем, который ведут сотрудники | Относит сказанное к теме, выбирает ветку | Карточка звонка |
| Утверждённые регламенты и условия | Собирает ответ со ссылкой на источник | Ответ голосом в разговоре |
| Данные из 1С: заказы, контрагенты, статусы | Сверяет названное с учётом | Ответ по существу и запись в карточку |
| Транскрипт завершённого звонка | Собирает резюме, тему, тональность, шаг | Запись в учётной системе |
Подтверждённая учётная система у Dzeta AI — 1С: справочники синхронизируются по расписанию. Что именно возвращается в учёт после разговора — контрагент, документ, дата, комментарий — описывают при внедрении. Какая телефония стоит в компании, выясняет аудит; пилот идёт на выгруженном архиве, постоянное подключение к телефонии обсуждают при полном внедрении. Вопросы самих сотрудников закрывает поиск по регламентам и инструкциям.
Качество распознавания: величина, которую считают на ваших записях
Качество распознавания речи — измеримая величина, и меряют её на записях разговоров заказчика. Проценты из рекламных материалов меряют в других условиях. Ваш разговор идёт через телефон, из цеха или с громкой связи. Пока система не послушала ваши записи, число называть нечестно, и Dzeta AI его не называет.
Что мешает распознаванию
- Шум: цех, улица, громкая связь, второй разговор рядом с трубкой.
- Узкий телефонный канал и плохое соединение.
- Артикулы и номенклатура: буквы и цифры, которые не угадываются по смыслу.
- Имена, названия компаний, отраслевые сокращения и внутренний жаргон.
- Перебивания и двое говорящих одновременно.
Как считают качество
Выборку записей из архива заказчика размечают руками — получается эталон. Величин две. Первая: насколько точно распознан текст, отдельно по обычным словам и отдельно по ключевым полям вроде номера заказа. Вторая: как часто система верно определила тему и довела разговор до конца. Номенклатуру и контрагентов выгружают из учётной системы: словарь под вашу номенклатуру описывают при внедрении.
Что проверяют на пилоте
Голосовой сценарий начинается с пилота на записях ваших разговоров. Смотрят три вещи: справляется ли распознавание с вашим каналом и номенклатурой, доходит ли сценарий до результата, сколько звонков уходит оператору. Критерии успеха и целевое качество фиксируют до старта на ваших данных — по ним систему и принимают.
Как внедряют голосового ассистента: аудит, пилот, приёмка
Внедрение идёт этапами: следующий — по результатам предыдущего.
| Этап внедрения | Срок и стоимость | Что получает заказчик |
|---|---|---|
| Аудит | 3–5 рабочих дней | Карту потерь в часах и деньгах и план внедрения. Интервью, выгрузки и прослушивание записей по NDA. Стоимость — после созвона. |
| Пилот | 2–6 недель, от 290 000 ₽ | Сценарий разговора, проверенный на ваших записях, и первый измеримый результат. |
| Приёмка | По итогам пилота | Проверку на отложенной выборке записей по критериям, согласованным до старта. |
| Полное внедрение | 4–12 недель, стоимость — после пилота | Систему в продуктиве, встроенную в приём звонков. |
Сначала пилот: короткий проект на ваших данных до большого внедрения показывает, стоит ли идти дальше. Часть бюджета уходит на подготовку: разговоры выгружают, размечают, описывают сценарии из головы старших операторов. Из чего складывается бюджет внедрения — разбор в отдельной статье. Если задачу закрывает регламент или настройка телефонии, так и напишем в отчёте по аудиту.
Где разворачивают систему и кто слышит разговоры клиентов
Систему на открытых моделях Dzeta AI разворачивает в контуре заказчика: записи, транскрипты и клиентская база остаются внутри компании, персональные данные её не покидают (152-ФЗ). Записи разговоров и транскрипты во внешние сервисы не уходят, если заказчик этого не хочет. Подтверждения пишутся в журнал, модель заменяется без переделки системы. Свой IT-отдел не нужен: хватает человека, который понимает процесс и слушает спорные звонки.
Когда голосовой ассистент не нужен
Сценарий окупается, когда звонков много, они повторяются и разговор кончается понятным действием: назвать статус, принять заявку, записать претензию. Браться не стоит, если:
- записей разговоров нет: проект начнётся со сбора данных;
- клиенты и так пишут в мессенджеры и почту: текстовый канал дешевле;
- каждый разговор кончается решением человека — скидкой, уступкой, исключением;
- звонков мало, и каждый раз спрашивают разное: вложения не вернутся;
- выбор укладывается в три пункта: справится меню на телефонии;
- некому слушать спорные звонки и править сценарий.
Какой из случаев ваш, видно на аудите.
Вопросы о голосовых ассистентах
Что делает голосовой ассистент при входящем звонке?
Входящий вызов голосовой ассистент принимает сам: распознаёт речь по ходу разговора и определяет, зачем человек позвонил. Дальше он ведёт диалог по сценарию — уточняет номер заказа, объект и срок, отвечает по материалам компании и переспрашивает то, что расслышал неуверенно. Когда уверенности не хватает, разговор уходит оператору вместе с транскриптом и собранными полями. После звонка остаётся карточка с резюме, темой, тональностью и следующим шагом.
Какая точность распознавания речи у голосового ассистента?
Числа до замеров на ваших записях Dzeta AI не называет. Точность распознавания зависит от канала связи, шума, темпа речи и вашей номенклатуры: артикулы и названия компаний распознаются хуже обычных слов. Качество считают на выборке записей из вашего архива, размеченной вручную, и отдельно смотрят точность по ключевым полям вроде номера заказа. Целевое значение фиксируют до старта, по нему систему принимают.
Заменит ли голосовой ассистент операторов колл-центра?
Полностью не заменит: ассистент забирает повторяющиеся разговоры и подготовку к сложным — распознаёт речь, собирает данные, отвечает по регламентам, пишет резюме. Разговоры, где нужны скидка, уступка или решение по исключению, остаются у людей. Оператор подключается не с чистого листа: у него транскрипт, тема и причина перевода.
Можно ли подключить голосового ассистента к нашей телефонии и к 1С?
К 1С — да: синхронизация справочников по расписанию подтверждена проектами, а состав возврата в учёт описывают при внедрении. Какая телефония стоит в компании и как ассистент получит вызов, выясняет аудит: от этого зависят схема подключения и место хранения записей. Отдельно смотрят, где лежит архив разговоров, — на нём проверяется качество распознавания.
У нас не хранятся записи разговоров. Можно начинать?
Начинать стоит со сбора данных. Без архива разговоров непонятно, о чём звонят чаще всего, какими словами это спрашивают и справится ли распознавание с вашим каналом. Порядок такой: включить запись и накопить поток, параллельно описывая сценарии, которые живут у старших операторов в голове. Пилот запускают, когда выборка набралась.
Сколько стоит и за какой срок внедряют голосового ассистента?
Пилот стоит от 290 000 ₽ и занимает 2–6 недель, аудит перед ним — 3–5 рабочих дней, стоимость аудита называем после короткого созвона. Полное внедрение занимает 4–12 недель, стоимость считается по результатам пилота. Сумма зависит от состояния записей и документов, от числа сценариев разговора и от того, какие подключения нужны.
Чем голосовой ассистент отличается от ИИ-помощника в переписке?
Главное отличие — время: разговор идёт в реальном времени и в одну попытку, собеседник не перечитает ответ и не подождёт минуту. Отсюда отдельные задачи голосового сценария — распознавание речи в шуме, подтверждение цифр вслух, темп ответа, порог перевода на человека. Письменный ответ можно перечитать и поправить до отправки — у голосового такой попытки нет. Механика под этим общая: ответ по утверждённым документам, уровень уверенности и передача человеку со всем контекстом.
Смежные решения
Расскажите, что нужно улучшить
Для начала хватит короткого описания. Вместе уточним данные, процесс и критерии результата.
Заявка попадёт напрямую нашей команде.
- Или напишите напрямую
- contact@dzeta.ai
- Telegram
- @Alexey_dzeta
- +7 929 818-58-10