Расшифровка файлов через Zoom Scribe
Справочник по Zoom AI Services Scribe: расшифровка загруженных аудио и видео, пакетные задания и конвейер расшифровок.
СкиллAnthropic (партнёр: Zoom)ClaudeMITНужен терминалПроверка не требуетсяСлужебный: его вызывают другие скиллы
- Что делает
- Справочник по Zoom AI Services Scribe: расшифровка загруженных аудио и видео, пакетные задания и конвейер расшифровок.
- Когда брать
- Когда нужно превратить загруженные или хранимые записи в текст, по одному файлу или пакетами.
- Когда не брать
- Если нужна расшифровка живой встречи в реальном времени (для этого есть rtms).
- Пример запроса
- Настрой расшифровку записей наших звонков из хранилища S3 с сохранением текстов в базу.
- Нужно подключить
- терминал
Входит в плагин zoom-plugin. В Cowork и Claude Code можно поставить плагин целиком.
Как включить
- Скачайте архив и распакуйте его.
- Положите папку
scribeв~/.claude/skills/. - Откройте Claude Code и опишите задачу своими словами: Claude подхватит скилл по описанию.
Текст
---
name: scribe
description: "Справочный скилл по Zoom AI Services Scribe. Используй после выбора процесса расшифровки при работе с загруженными или хранимыми медиафайлами, JWT-авторизацией платформы Build, расшифровкой в быстром режиме, пакетными заданиями и проектировании конвейера расшифровок."
user-invocable: false
triggers:
- "scribe"
- "ai services scribe"
- "zoom scribe"
- "transcribe audio file"
- "transcribe video file"
- "batch transcription"
- "fast mode transcription"
- "build platform jwt"
---
Zoom AI Services Scribe
Справочный материал по Zoom AI Services Scribe, охватывающий:
- синхронную расшифровку одного файла (
POST /aiservices/scribe/transcribe) - асинхронные пакетные задания (
/aiservices/scribe/jobs*) - псевдопотоковую передачу с микрофона браузера через повторные загрузки коротких файлов
- обновления статуса пакетных заданий через вебхуки
- создание JWT платформы Build и работу с учётными данными
Официальная документация:
- https://developers.zoom.us/docs/ai-services/
- https://developers.zoom.us/docs/ai-services/scribe/
- https://developers.zoom.us/docs/api/ai-services/
- https://developers.zoom.us/api-hub/ai-services/methods/endpoints.json
- Пример для быстрого старта: https://github.com/zoom/scribe-quickstart/
Ограничитель маршрутизации
- Если пользователю нужно превратить загруженные или хранимые медиафайлы в текст, направляй сначала сюда.
- Если пользователю нужны медиа живой встречи без загрузки файлов и пакетных заданий, направляй в [../rtms/SKILL.md](../rtms/SKILL.md).
- Если пользователю нужен перечень Zoom REST API для путей AI Services, соединяй с [../rest-api/SKILL.md](../rest-api/SKILL.md).
- Если пользователю нужны шаблоны проверки подписи вебхуков или общее усиление приёмника на HMAC, при желании соединяй с [../webhooks/SKILL.md](../webhooks/SKILL.md).
Быстрые ссылки
- [concepts/auth-and-processing-modes.md](concepts/auth-and-processing-modes.md)
- [scenarios/high-level-scenarios.md](scenarios/high-level-scenarios.md)
- [examples/fast-mode-node.md](examples/fast-mode-node.md)
- [examples/batch-webhook-pipeline.md](examples/batch-webhook-pipeline.md)
- [references/api-reference.md](references/api-reference.md)
- [references/environment-variables.md](references/environment-variables.md)
- [references/samples-validation.md](references/samples-validation.md)
- [references/versioning-and-drift.md](references/versioning-and-drift.md)
- [troubleshooting/common-drift-and-breaks.md](troubleshooting/common-drift-and-breaks.md)
- [RUNBOOK.md](RUNBOOK.md)
Основной рабочий процесс
- Получи учётные данные платформы Build и сформируй JWT с алгоритмом HS256.
- Выбери быстрый режим для одного короткого файла или пакетный режим для хранимых архивов и больших наборов.
- Отправь запрос на расшифровку.
- Для пакетных заданий опрашивай статус задания и файлов или получай уведомления через вебхуки.
- Сохрани JSON с расшифровкой и обработай его дальше.
Ограничитель для быстрого режима в размещённых сервисах
- Формальные ограничения API быстрого режима —
100 MBи2 часа, но в размещённых браузерных сценариях тайм-аут всё равно может наступить до того, как вернётся ответ от вышестоящего сервиса. - Наблюдения по текущему развёрнутому примеру:
- MP4 около 17,2 МБ обработан примерно за
26 с - MP4 около 38,6 МБ обработан за
26–37 с - MP4 около 59,2 МБ обработан за
32–34 сна бэкенде - часть браузерных запросов с файлом около 59,2 МБ всё равно показала на фронтенде
504, хотя позже в журналах бэкенда был200 - Считай
504на фронтенде вместе с200на бэкенде гонкой тайм-аутов браузера и граничного узла, а не автоматическим сбоем расшифровки. - Для размещённых интерфейсов вместо удержания браузера открытым до полного ответа вышестоящего сервиса лучше использовать асинхронную обёртку «запрос + опрос» для быстрого режима.
- Для крупных или менее предсказуемых медиафайлов лучше выбирать пакетный режим, даже если файл ещё укладывается в формальное ограничение быстрого режима по размеру.
Шаблон для микрофона в браузере
scribeне предоставляет документированного API потоковой передачи в реальном времени.- Если нужен сценарий с микрофоном в браузере, используй псевдопотоковую передачу:
- записывай звук с микрофона короткими фрагментами
- загружай каждый фрагмент через асинхронную обёртку быстрого режима
- опрашивай готовность
- добавляй расшифровки фрагментов по порядку
- Рекомендуемые стартовые параметры:
- размер фрагмента:
5 секунд - допустимый диапазон:
5–10 секунд - одновременных запросов с фрагментами:
2–3 - Это практичный шаблон интерфейса для постепенного обновления расшифровки, а не замена
rtms. - Считай это запасным демонстрационным шаблоном, а не предпочтительной архитектурой для продакшена.
- Он добавляет издержки на повторные загрузки, расхождения на границах фрагментов, разнообразие кодеков и контейнеров в браузерах и сложность «сшивания» расшифровок.
- Если пользователь просит настоящий приём живого потока, непрерывные медиа с низкой задержкой или серверную отправку медиа, направляй в [../rtms/SKILL.md](../rtms/SKILL.md).
Поверхность конечных точек
| Режим | Метод | Путь | Назначение |
|---|---|---|---|
| Быстрый | POST | /aiservices/scribe/transcribe | Синхронная расшифровка одного файла |
| Пакетный | POST | /aiservices/scribe/jobs | Отправка асинхронного пакетного задания |
| Пакетный | GET | /aiservices/scribe/jobs | Список заданий |
| Пакетный | GET | /aiservices/scribe/jobs/{jobId} | Сводка и состояние задания |
| Пакетный | DELETE | /aiservices/scribe/jobs/{jobId} | Отмена задания в очереди или в обработке |
| Пакетный | GET | /aiservices/scribe/jobs/{jobId}/files | Результаты по каждому файлу |
Сценарии верхнего уровня
- Расшифровка клипа по запросу после того, как пользователь загрузил одну запись.
- Пакетная расшифровка архивов звонков, хранящихся в S3.
- Конвейер ETL на вебхуках, который записывает расшифровки в вашу базу данных или поисковый индекс.
- Повторная расшифровка записей, управляемых Zoom, после их экспорта в собственное хранилище.
- Автономные процессы проверки соответствия требованиям или контроля качества, которым нужны временные метки, разделение каналов и подсказки о говорящих.
Связки с другими скиллами
- Сохранённые записи Zoom -> [../rest-api/SKILL.md](../rest-api/SKILL.md) +
scribe - Усиление проверки вебхуков -> [../webhooks/SKILL.md](../webhooks/SKILL.md)
- Расшифровка и медиа живой встречи в реальном времени -> [../rtms/SKILL.md](../rtms/SKILL.md)
- Маршрутизация между продуктами -> [../general/SKILL.md](../general/SKILL.md)
Эксплуатация
- [RUNBOOK.md](RUNBOOK.md) — пятиминутный чек-лист предварительной проверки и отладки.
Перевод: iiuniversitet. Оригинал: https://github.com/anthropics/knowledge-work-plugins/tree/main/partner-built/zoom-plugin/skills/scribe, лицензия MIT. Изменения: перевод на русский язык.
Оригинал на английском
---
name: scribe
description: "Reference skill for Zoom AI Services Scribe. Use after routing to a transcription workflow when handling uploaded or stored media, Build-platform JWT auth, fast mode transcription, batch jobs, or transcript pipeline design."
user-invocable: false
triggers:
- "scribe"
- "ai services scribe"
- "zoom scribe"
- "transcribe audio file"
- "transcribe video file"
- "batch transcription"
- "fast mode transcription"
- "build platform jwt"
---
# Zoom AI Services Scribe
Background reference for Zoom AI Services Scribe across:
- synchronous single-file transcription (`POST /aiservices/scribe/transcribe`)
- asynchronous batch jobs (`/aiservices/scribe/jobs*`)
- browser microphone pseudo-streaming via repeated short file uploads
- webhook-driven batch status updates
- Build-platform JWT generation and credential handling
Official docs:
- https://developers.zoom.us/docs/ai-services/
- https://developers.zoom.us/docs/ai-services/scribe/
- https://developers.zoom.us/docs/api/ai-services/
- https://developers.zoom.us/api-hub/ai-services/methods/endpoints.json
- Quickstart sample: https://github.com/zoom/scribe-quickstart/
## Routing Guardrail
- If the user needs **uploaded or stored media transcribed into text**, route here first.
- If the user needs **live meeting media** without file-based upload/batch jobs, route to [../rtms/SKILL.md](../rtms/SKILL.md).
- If the user needs **Zoom REST API inventory** for AI Services paths, chain [../rest-api/SKILL.md](../rest-api/SKILL.md).
- If the user needs webhook signature patterns or generic HMAC receiver hardening, optionally chain [../webhooks/SKILL.md](../webhooks/SKILL.md).
## Quick Links
1. [concepts/auth-and-processing-modes.md](concepts/auth-and-processing-modes.md)
2. [scenarios/high-level-scenarios.md](scenarios/high-level-scenarios.md)
3. [examples/fast-mode-node.md](examples/fast-mode-node.md)
4. [examples/batch-webhook-pipeline.md](examples/batch-webhook-pipeline.md)
5. [references/api-reference.md](references/api-reference.md)
6. [references/environment-variables.md](references/environment-variables.md)
7. [references/samples-validation.md](references/samples-validation.md)
8. [references/versioning-and-drift.md](references/versioning-and-drift.md)
9. [troubleshooting/common-drift-and-breaks.md](troubleshooting/common-drift-and-breaks.md)
10. [RUNBOOK.md](RUNBOOK.md)
## Core Workflow
1. Get Build-platform credentials and generate an HS256 JWT.
2. Choose **fast mode** for one short file or **batch mode** for stored archives / large sets.
3. Submit the transcription request.
4. For batch jobs, poll job/file status or receive webhook notifications.
5. Persist and post-process transcript JSON.
## Hosted Fast-Mode Guardrail
- The formal fast-mode API limits are `100 MB` and `2 hours`, but hosted browser flows can still time out before the upstream response returns.
- Current deployed-sample observations:
- ~17.2 MB MP4 completed in about `26s`
- ~38.6 MB MP4 completed in about `26-37s`
- ~59.2 MB MP4 completed in about `32-34s` on the backend
- some ~59.2 MB browser requests still surfaced as frontend `504` while backend logs later showed `200`
- Treat frontend `504` plus backend `200` as a browser/edge timeout race, not an automatic transcription failure.
- For hosted UIs, prefer an async request/polling wrapper for fast mode instead of holding the browser open for the full upstream response.
- For larger or less predictable media, prefer batch mode even when the file is still within the formal fast-mode size limit.
## Browser Microphone Pattern
- `scribe` does not expose a documented real-time streaming API surface.
- If you want a browser microphone experience, use pseudo-streaming:
1. capture microphone audio in short chunks
2. upload each chunk through the async fast-mode wrapper
3. poll for completion
4. append chunk transcripts in sequence
- Recommended starting cadence:
- chunk size: `5 seconds`
- acceptable range: `5-10 seconds`
- in-flight chunk requests: `2-3`
- This is a practical UI pattern for incremental transcript updates, not a substitute for `rtms`.
- Treat this as a fallback demo pattern, not the preferred production architecture.
- It adds repeated upload overhead, chunk-boundary drift, browser codec/container variability, and transcript stitching complexity.
- If the user asks for actual live stream ingestion, low-latency continuous media, or server-push media transport, route to [../rtms/SKILL.md](../rtms/SKILL.md) instead.
## Endpoint Surface
| Mode | Method | Path | Use |
|------|--------|------|-----|
| Fast | `POST` | `/aiservices/scribe/transcribe` | Synchronous transcription for one file |
| Batch | `POST` | `/aiservices/scribe/jobs` | Submit asynchronous batch job |
| Batch | `GET` | `/aiservices/scribe/jobs` | List jobs |
| Batch | `GET` | `/aiservices/scribe/jobs/{jobId}` | Inspect job summary/state |
| Batch | `DELETE` | `/aiservices/scribe/jobs/{jobId}` | Cancel queued/processing job |
| Batch | `GET` | `/aiservices/scribe/jobs/{jobId}/files` | Inspect per-file results |
## High-Level Scenarios
- On-demand clip transcription after a user uploads one recording.
- Batch transcription of stored S3 call archives.
- Webhook-driven ETL pipeline that writes transcripts to your database/search index.
- Re-transcription of Zoom-managed recordings after exporting them to your own storage.
- Offline compliance or QA workflows that need timestamps, channel separation, and speaker hints.
## Chaining
- Stored Zoom recordings -> [../rest-api/SKILL.md](../rest-api/SKILL.md) + `scribe`
- Webhook verification hardening -> [../webhooks/SKILL.md](../webhooks/SKILL.md)
- Real-time live transcript/media -> [../rtms/SKILL.md](../rtms/SKILL.md)
- Cross-product routing -> [../general/SKILL.md](../general/SKILL.md)
## Operations
- [RUNBOOK.md](RUNBOOK.md) - 5-minute preflight and debugging checklist.
Источник: anthropics/knowledge-work-plugins / zoom-plugin / scribe ↗. Ссылка проверена 2026-10-10.