home/categories/media/benchflow-ai-skillsbench-tasks-speaker-diarization-subtitles-environment-skills-automatic-speech-recognition-skill-md

mediacontent-media

automatic-speech-recognition-asr

Name: automatic-speech-recognition-asr
Author: benchflow-ai

Transcribe audio segments to text using Whisper models. Use larger models (small, base, medium, large-v3) for better accuracy, or faster-whisper for optimized performance. Always align transcription timestamps with diarization segments for accurate speaker-labeled subtitles.

Ver código-fonte media

maintainer

benchflow-ai

Atualizado 1/23/2026

Estrelas

946

Forks

244

quick start

Installation and usage

Instalação

$ install --globalskills.sh

Uso

Depois de instalar, você pode usar esta skill executando o seguinte comando no terminal:

skills use automatic-speech-recognition-asr