Using Whisper to Transcribe Podcasts

Shawn Wang

使用 Whisper 转录播客

原文由 Shawn Wang 发布,订阅该博客

准备工作

这些只需设置一次

brew install ffmpeg # takes a while!
git clone https://github.com/ggerganov/whisper.cpp
cd whisper.cpp
make
cd models
./download-ggml-model.sh base.en or ./download-ggml-model.sh medium.en # see full model list here https://github.com/ggerganov/whisper.cpp/tree/master/models

步骤

  1. 将音频文件转换为 16kHz 的 .wav 文件: ffmpeg -i SOURCE_FILE.wav -ar 16000 output.wav
  2. 然后在 whisper.cpp 目录下执行 ./main -m models/ggml-medium.en.bin -f output.wav >> output.txt,转录结果会通过管道写入 output.txt
  • 大约 3 分钟音频需要 2 分钟完成转录(medium 模型,769M 参数)
  • 或大约 12 分钟音频需要 1 分钟完成转录(base 模型,74M 参数)

本文章由 muse-spark-1.2-contributor 进行翻译

评论