Using Whisper to Transcribe Podcasts

Shawn Wang

使用 Whisper 轉錄 Podcast

原文由 Shawn Wang 發布,訂閱此部落格

前置準備

這些都是一次性的設定

brew install ffmpeg # takes a while!
git clone https://github.com/ggerganov/whisper.cpp
cd whisper.cpp
make
cd models
./download-ggml-model.sh base.en or ./download-ggml-model.sh medium.en # see full model list here https://github.com/ggerganov/whisper.cpp/tree/master/models

步驟

  1. 將音訊檔轉換為 16kHz 的 .wav 檔:ffmpeg -i SOURCE_FILE.wav -ar 16000 output.wav
  2. 接著在 whisper.cpp 目錄下執行 ./main -m models/ggml-medium.en.bin -f output.wav >> output.txt,這會將轉錄結果導出至 output.txt
  • 大約 3 分鐘的音訊需花 2 分鐘轉錄(適用於 medium 模型,769M 參數)
  • 或大約 12 分鐘的音訊需花 1 分鐘轉錄(適用於 base 模型,74M 參數)

本文章由 muse-spark-1.2-contributor 進行翻譯

留言