Навигация

MOD-STT-WHISPER — Распознавание речи (Whisper)

Лицензия: Платный

Распознавание речи движком Whisper внутри вашего контура — аудио наружу не уходит. Запрос на расшифровку ставится в очередь и сразу возвращает идентификатор задания: очередь разбирает воркер, задание проходит стадии queued → running → succeeded/failed/canceled, прогресс и итог можно опрашивать или слушать событиями. Задание можно отменить и перезапустить, а очередь — очистить.

Результат — не только сплошной текст: сегменты с таймкодами, уверенность распознавания, определённый язык и обезличенная диаризация (SPK_1, SPK_2 — без привязки к именам). Из сегментов собираются субтитры SRT/VTT. Поведение движка настраивается профилями (язык, подсказки-хотворды, VAD, шумоподавление, температура, таймстемпы слов), а модели ставятся и назначаются по умолчанию отдельными инструментами.

Аудио модуль получает по ссылке на сущность модуля-источника — например, запись разговора из MOD-TEL. Удаление аудио и результатов — явные операции с подтверждением, так что срок хранения записей контролируете вы.

Возможности

  • Очередь заданий расшифровки с немедленной выдачей идентификатора
  • Стадии задания, прогресс, отмена и перезапуск
  • Сегменты с таймкодами, уверенность, определение языка
  • Обезличенная диаризация говорящих (SPK_1, SPK_2, …)
  • Сборка субтитров SRT/VTT из сегментов
  • Профили распознавания: язык, хотворды, VAD, шумоподавление, таймстемпы слов
  • Управление моделями: установка, список, модель по умолчанию, удаление
  • Приём аудио по ссылке на сущность модуля-источника (например, запись звонка)
  • Удаление аудио и результатов с подтверждением, очистка очереди
  • Метрики распознавания и события заданий

Основные MCP-инструменты

ИнструментНазначение
stt-whisper__stt.transcribeПоставить аудио в очередь распознавания
stt-whisper__stt.get_jobСтатус и прогресс задания
stt-whisper__stt.get_resultТекст, сегменты и говорящие
stt-whisper__stt.list_jobsСписок заданий
stt-whisper__stt.cancel_jobОтменить задание
stt-whisper__stt.retry_jobПерезапустить задание
stt-whisper__stt.build_subtitlesСобрать субтитры SRT/VTT
stt-whisper__stt.profile.upsertСоздать или изменить профиль распознавания
stt-whisper__stt.profile.listСписок профилей
stt-whisper__stt.model.installУстановить модель
stt-whisper__stt.model.listСписок моделей
stt-whisper__stt.model.set_defaultНазначить модель по умолчанию
stt-whisper__stt.job.delete_audioУдалить аудио задания (с подтверждением)
stt-whisper__stt.job.deleteУдалить задание и результат (с подтверждением)
stt-whisper__stt.queue.purgeОчистить очередь (с подтверждением)
stt-whisper__stt_metricsМетрики распознавания

Связанные модули

  • MOD-TEL — записи звонков, отправляемые на расшифровку
  • MOD-CALL-COACHING — оценка разговоров по транскриптам
  • MOD-MEETINGS-VIDEO — расшифровка записей встреч
  • MOD-TTS-SILERO — обратная задача: текст в речь
Открыть чат-бот