概要
Whisper は設定次第で精度が大きく変わります。言語指定・モデル選択・タスク指定を正しく組み合わせることで、日本語の認識率を引き上げられます。
精度を上げる手順
- 言語を明示:
--language Japaneseで誤認識を防ぐ - モデルを上げる:
--model large-v3で最高精度に - 原語のまま出力:
--task transcribeを指定 - 出力形式を選択:
--output_format txtなど必要な形式に
精度アップのコツ
- 録音時はマイクに近づき、ノイズの少ない環境で録る
- 専門用語が多い音声は medium 以上を使う
- GPU があれば large、CPU のみなら small が現実的