Speech Recognition · Streaming

ProSTT

Речь — в текст
в реальном времени

Распознавание речи в потоке с шумоподавлением, диаризацией и поддержкой отраслевой лексики. Готов к внедрению в контакт-центрах и в контуре безопасности.

В Единый реестр российского ПО включено только ПО «УКП» (запись № 22189). ProSTT поставляется отдельно и в реестр не входит. ПО «УКП» и тарифы →

Отраслевая лексика В контуре заказчика
prostt · live · 16 kHz
stream
канал A · оператор−18 dB
канал B · клиент−22 dB
офис · фон снят диаризация
OP

— Здравствуйте, ваш заказ 10 437 подтверждаете?

CL

— Да, подтверждаю доставку завтра.

OP

— Спасибо, оформляю...

0.4с
латенси
4.8%
WER
96%+
точность
отрасл. лексика диаризация on-prem
Что делает ProSTT

От звука до текста
с ролями и тегами

Принимает поток звонка, очищает от шума, разделяет голоса, распознаёт речь и отдаёт текст — в реальном времени и с метаданными.

01

Принимает

Аудио-поток или файл: звонок, запись с совещания, голосовая записка

02

Очищает

Шумоподавление, эхо, колл-центровые артефакты — без потери полезной речи

03

Разделяет

Диаризация говорящих — кто сказал какую реплику, отдельно оператор и клиент

04

Распознаёт

Транскрипт с метаданными, отраслевой лексикой и уровнями уверенности

Поток · латенси <0.5 с· Контур заказчика· Отраслевая лексика
Для чего ProSTT

Контакт-центр,
контроль и аналитика

Онлайн-транскрипт звонка для оператора, контроль качества обслуживания, постобработка архивов, распознавание команд в голосовых интерфейсах.

Поток в реальном времени

Транскрипт прямо во время разговора — для суфлёра оператору и голосовых интерфейсов.

Отраслевая лексика

Термины, названия товаров, имена контрагентов — дообучаем под ваш словарь.

Диаризация

Разделение реплик оператора и клиента, расстановка реплик по ролям — из коробки.

Пилот на ваших записях

Пришлите 100 звонков — вернём транскрипты и отчёт по точности

Оценим WER на ваших реальных разговорах с учётом отраслевой лексики.

Отправить пилотный пакет
Почему ProSTT

Четыре причины
не использовать «общий» STT

<0.5с

латенси

Распознавание в потоке — подходит для живого суфлёра оператора и голосовых ассистентов.

96%+

точность

На отраслевой речи после дообучения под словарь заказчика — по данным пилотов.

Роли

диаризация

Разделение реплик по говорящим — отдельно оператор и клиент, без перепутывания каналов.

On-prem

контур

Работает внутри периметра, записи и транскрипты не передаются во внешнее облако.

Под вашу отрасль

Дообучаем под
вашу лексику и каналы

Типовой STT плохо распознаёт отраслевые термины и названия товаров. Мы дообучаем ProSTT на словаре заказчика и проверяем качество на его реальных записях.

Ваша лексика

Бренды, товары, термины, сокращения — дообучаем распознаватель под реальные разговоры вашего контакт-центра.

Ваши каналы

Телефония, мобильное приложение, веб-каналы, голосовые ассистенты — подключаем к существующим источникам звука.

Ваша аналитика

Транскрипты уходят в ваши системы речевой аналитики, QM, CRM — в нужных форматах и полях.

Пилот за 2–3 недели· В закрытом контуре
Готово к внедрению

Транскрибируем
ваши разговоры

Опишите каналы, объём и целевую аналитику — за 1 рабочий день вернёмся с архитектурой, сроками и оценкой. Пилот за 2–3 недели в закрытом контуре.

Обсудить проект