ガイド / 設定 / モデル設定・ダウンロード管理
ローカル文字起こしの心臓部が「モデル」です。ここで、モデルのダウンロード・削除や、クラウドの音声認識プロバイダの登録を行います。
最終更新: 2026-08-01
モデルは「最速 → 高速 → 中間 → 高精度 → 最高精度」の順に並んでいます。上へ行くほど速く、下へ行くほど正確です。大きいモデルほど高精度ですが、容量と処理負荷が増えます。迷ったら「おすすめ」が付いたモデルで十分です。
| アプリでの表示 | 容量の目安 | 特徴 |
|---|---|---|
| 最速(Tiny) | 約32MB | 動作確認や短いメモ向き |
| 高速(Base) | 約60MB | 音声入力、簡単な会話 |
| 中間(Small) | 約190MB | 速度を維持しつつ一定の精度 |
| 高精度(Large v3 Turbo) | 約574MB | 「おすすめ」表示あり。通常利用・会議・動画 |
| 最高精度(Large v3) | 約1.08GB | 専門用語・逐語録など精度最優先 |
同じ設定 → モデル の下部で、クラウド文字起こし用のプロバイダ(Groq / OpenAI)を登録できます。手順は クラウド利用のセットアップ をご覧ください。