MOD-STT-WHISPER — Распознавание речи (Whisper)
Лицензия: Платный
Распознавание речи движком Whisper внутри вашего контура — аудио наружу не уходит. Запрос на расшифровку ставится в очередь и сразу возвращает идентификатор задания: очередь разбирает воркер, задание проходит стадии queued → running → succeeded/failed/canceled, прогресс и итог можно опрашивать или слушать событиями. Задание можно отменить и перезапустить, а очередь — очистить.
Результат — не только сплошной текст: сегменты с таймкодами, уверенность распознавания, определённый язык и обезличенная диаризация (SPK_1, SPK_2 — без привязки к именам). Из сегментов собираются субтитры SRT/VTT. Поведение движка настраивается профилями (язык, подсказки-хотворды, VAD, шумоподавление, температура, таймстемпы слов), а модели ставятся и назначаются по умолчанию отдельными инструментами.
Аудио модуль получает по ссылке на сущность модуля-источника — например, запись разговора из MOD-TEL. Удаление аудио и результатов — явные операции с подтверждением, так что срок хранения записей контролируете вы.
Возможности
- Очередь заданий расшифровки с немедленной выдачей идентификатора
- Стадии задания, прогресс, отмена и перезапуск
- Сегменты с таймкодами, уверенность, определение языка
- Обезличенная диаризация говорящих (SPK_1, SPK_2, …)
- Сборка субтитров SRT/VTT из сегментов
- Профили распознавания: язык, хотворды, VAD, шумоподавление, таймстемпы слов
- Управление моделями: установка, список, модель по умолчанию, удаление
- Приём аудио по ссылке на сущность модуля-источника (например, запись звонка)
- Удаление аудио и результатов с подтверждением, очистка очереди
- Метрики распознавания и события заданий
Основные MCP-инструменты
| Инструмент | Назначение |
|---|---|
stt-whisper__stt.transcribe | Поставить аудио в очередь распознавания |
stt-whisper__stt.get_job | Статус и прогресс задания |
stt-whisper__stt.get_result | Текст, сегменты и говорящие |
stt-whisper__stt.list_jobs | Список заданий |
stt-whisper__stt.cancel_job | Отменить задание |
stt-whisper__stt.retry_job | Перезапустить задание |
stt-whisper__stt.build_subtitles | Собрать субтитры SRT/VTT |
stt-whisper__stt.profile.upsert | Создать или изменить профиль распознавания |
stt-whisper__stt.profile.list | Список профилей |
stt-whisper__stt.model.install | Установить модель |
stt-whisper__stt.model.list | Список моделей |
stt-whisper__stt.model.set_default | Назначить модель по умолчанию |
stt-whisper__stt.job.delete_audio | Удалить аудио задания (с подтверждением) |
stt-whisper__stt.job.delete | Удалить задание и результат (с подтверждением) |
stt-whisper__stt.queue.purge | Очистить очередь (с подтверждением) |
stt-whisper__stt_metrics | Метрики распознавания |
Связанные модули
- MOD-TEL — записи звонков, отправляемые на расшифровку
- MOD-CALL-COACHING — оценка разговоров по транскриптам
- MOD-MEETINGS-VIDEO — расшифровка записей встреч
- MOD-TTS-SILERO — обратная задача: текст в речь