Виртуальный голосовой ассистент для бизнеса + онлайн чат (SaaS сервис)

общение робота с посетителем любого сайта голосом - https://evatalk.ru

О проекте

Онлайн сервис evatalk.ru, распространяемый по модели SaaS (ежемесячная подписка), позволяет создавать онлайн чаты с голосовыми ассистентами, которые понимают вашу речь и отвечают голосом. Решение выполнено с использованием голосовых технологий Яндекс SpeechKit.

ЗАДАЧА Перед нашей командой стояла цель создать SaaS-сервис, который позволил бы любому бизнесу внедрить на свой сайт интеллектуального голосового ассистента и онлайн-чат. Ключевое требование — робот должен не просто распознавать текстовые запросы, но и понимать живую речь посетителя, а также отвечать синтезированным голосом. Всё взаимодействие должно происходить в реальном времени, без участия живого оператора. [twins_start][twins_end] На старте проект ориентировался на сферу услуг: салоны красоты, стоматологии, фитнес-клубы, агентства недвижимости. Основной бизнес-задачей стала автоматизация

ЗАДАЧА

Перед нашей командой стояла цель создать SaaS-сервис, который позволил бы любому бизнесу внедрить на свой сайт интеллектуального голосового ассистента и онлайн-чат. Ключевое требование — робот должен не просто распознавать текстовые запросы, но и понимать живую речь посетителя, а также отвечать синтезированным голосом. Всё взаимодействие должно происходить в реальном времени, без участия живого оператора.

разработка онлайн чата разработка онлайн чата на react

На старте проект ориентировался на сферу услуг: салоны красоты, стоматологии, фитнес-клубы, агентства недвижимости. Основной бизнес-задачей стала автоматизация записи клиентов, информирование о ценах и услугах, а также круглосуточная поддержка посетителей сайта. Важно было обеспечить одинаково качественный опыт как на десктопах, так и на мобильных устройствах, где работа с микрофоном и динамиками накладывает дополнительные технические ограничения.

РЕШЕНИЕ

В качестве технологической основы голосового взаимодействия мы выбрали платформу Яндекс SpeechKit, которая к тому моменту уже зарекомендовала себя благодаря голосовому помощнику Алиса. SpeechKit позволил решить сразу две задачи: распознавание речи (STT) и синтез ответов (TTS) с поддержкой естественных интонаций. Это дало возможность ассистенту не просто «читать» текст, а общаться с посетителем в комфортном темпе и с правильными паузами.

Параллельно с голосовым ядром мы разработали полноценный виджет онлайн-чата, встраиваемый на любой сайт через JavaScript-код. Виджет поддерживает одновременно текстовый и голосовой ввод — пользователь может переключаться между режимами в процессе диалога. Для бизнес-логики была спроектирована облачная платформа, которая хранит сценарии ответов, интегрируется с календарями сотрудников и CRM-системами, управляет слотами записи и считает ключевые метрики.

Функциональные возможности EVA вышли далеко за рамки простого вопросно-ответного режима:

  • Ассистент может рассказать о ценах, услугах и акциях.
  • Сообщить о местоположении бизнеса, графике работы, деталях оказания услуг.
  • Круглосуточно отвечает на вопросы без задержек.
  • Записывает на приём к мастеру в салон красоты, к стоматологу, к тренеру в фитнес-центр.
  • Организует просмотр объектов недвижимости, бронирует время риелтора.
  • Отслеживает графики работы персонала как отдельных сотрудников, так и целых отделений.
  • Фиксирует запись в сетке расписания в режиме онлайн, исключая наложения.
  • Рассчитывает объём проданных услуг, средний чек и загрузку специалистов.

РЕАЛИЗАЦИЯ

Разработка проекта велась более полугода итеративно: сначала был запущен MVP с базовым голосовым диалогом и записью, затем функционал расширялся по мере обратной связи от первых клиентов. Архитектуру сервиса мы построили на микросервисном подходе, чтобы независимо масштабировать компоненты распознавания речи, диалогового движка и интеграционных адаптеров.

разработка онлайн чата с голосовым управлением

Технологический стек

  • Фронтенд: React-приложение виджета чата, адаптированное под все виды экранов. Для работы с аудио в браузере использовали Web Audio API с собственной прослойкой, решающей проблемы совместимости.
  • Бэкенд: микросервисы на Node.js и Python, работающие в Docker-контейнерах. Обмен сообщениями организован через RabbitMQ для асинхронной обработки голосовых потоков.
  • База данных: PostgreSQL для хранения клиентских настроек, сценариев и истории диалогов; Redis для кеширования временных слотов и сессий.
  • Голосовой движок: Яндекс SpeechKit в потоковом режиме; для повышения точности мы добавили предварительное шумоподавление на стороне клиента и контекстное моделирование на основе NLU-модуля собственной разработки.
  • Интеграции: REST API для синхронизации с популярными CRM, Google Календарём и AmoCRM; webhook-уведомления для подтверждения записей.

Одной из главных сложностей стала адаптация под мобильные платформы. В браузерах на iOS и Android существуют ограничения на автовоспроизведение звука и доступ к микрофону без явного жеста пользователя. Мы реализовали умную систему активации: виджет сначала инициирует текстовое приглашение, а после первого касания экрана активирует аудиоканал. Дополнительно настроили многопоточную передачу аудиопотока, чтобы минимизировать задержку между фразой пользователя и ответом ассистента. Для экономии трафика в мобильных сетях внедрили адаптивный битрейт и сжатие.

Другая нетривиальная задача — управление сценариями диалогов с учётом специфики разных бизнесов. Мы сделали гибкий конструктор на стороне административной панели: владелец бизнеса может задавать ветки диалогов, указывать ключевые фразы, настраивать сценарии подбора времени и интеграцию с личным календарём. Все изменения применяются мгновенно, без перевыпуска виджета.

Значительные усилия были направлены на отказоустойчивость. SpeechKit работает по подписке, и любые сбои на стороне внешнего сервиса не должны блокировать чат. Мы реализовали graceful degradation: при недоступности голосового канала виджет автоматически переключается в текстовый режим, полностью сохраняя функциональность записи и ответов.

РЕЗУЛЬТАТ

Сервис evatalk.ru был запущен и стал доступен по модели ежемесячной подписки. Уже первые внедрения показали впечатляющие бизнес-показатели. Голосовой ассистент EVA взял на себя до 70% типовых обращений от посетителей сайтов, разгрузив администраторов и позволив им сосредоточиться на сложных клиентах.

Для салонов красоты и стоматологий конверсия в запись выросла в среднем на 23%, поскольку посетители могли записаться на приём в несколько касаний, не дожидаясь ответа оператора и не звоня по телефону. В недвижимости автоматическое бронирование просмотров сократило время реакции на лид с нескольких часов до 1–2 минут, что напрямую повлияло на скорость закрытия сделок.

Для нас как студии этот проект стал уникальным сплавом нескольких сложных направлений: бизнес-логика уровня CRM-системы, разработка веб-приложения с голосовым управлением, интеграция с речевыми технологиями и решение нетривиальных задач юзабилити в мобильной среде. Мы приобрели компетенции в области речевых интерфейсов, которые впоследствии неоднократно применяли в других проектах, а SaaS-модель evatalk.ru доказала свою востребованность — сервис продолжает развиваться и наращивать базу подписчиков.

• Реализовано под задачи бизнеса • Учтены интеграции и нагрузка • Поддержан запуск и развитие