ガイド / 設定 / モデル設定・ダウンロード管理

モデル設定・ダウンロード管理

ローカル文字起こしの心臓部が「モデル」です。ここで、モデルのダウンロード・削除や、クラウドの音声認識プロバイダの登録を行います。

最終更新: 2026-08-01

ローカルモデルのダウンロードと削除

モデルの選び方(容量と精度)

モデルは「最速 → 高速 → 中間 → 高精度 → 最高精度」の順に並んでいます。上へ行くほど速く、下へ行くほど正確です。大きいモデルほど高精度ですが、容量と処理負荷が増えます。迷ったら「おすすめ」が付いたモデルで十分です。

アプリでの表示容量の目安特徴
最速(Tiny)約32MB動作確認や短いメモ向き
高速(Base)約60MB音声入力、簡単な会話
中間(Small)約190MB速度を維持しつつ一定の精度
高精度(Large v3 Turbo)約574MB「おすすめ」表示あり。通常利用・会議・動画
最高精度(Large v3)約1.08GB専門用語・逐語録など精度最優先
初回のダウンロード後、そのモデルの準備(最適化)に時間がかかることがあります。故障ではありません。詳しくは 文字起こしできない/終わらないとき へ。

クラウドの音声認識プロバイダ

同じ設定 → モデル の下部で、クラウド文字起こし用のプロバイダ(Groq / OpenAI)を登録できます。手順は クラウド利用のセットアップ をご覧ください。

← 前へ文字起こし設定