モデルと プロバイダー
OpenWhisprは複数の音声テキスト変換エンジンとAIプロバイダーに対応しています。プライバシー重視ですべてをローカル実行することも、速度重視でクラウドAPIを使うことも、両方を組み合わせることもできます。
🖥️ローカル文字起こしモデル
音声テキスト変換をすべてお使いのマシン上で実行します。インターネット接続は不要で、データがデバイスの外に出ることはありません。
OpenAI Whisper
whisper.cpp経由 · 99言語以上 · GGML形式
| モデル | サイズ | 速度 | 品質 |
|---|---|---|---|
Tiny | 75 MB | 最速 | 基本 |
Baseおすすめ | 142 MB | 高速 | 良好 |
Small | 466 MB | 中速 | 優良 |
Medium | 1.5 GB | 低速 | 高 |
Large v3 | 3 GB | 最も低速 | 最高 |
Turbo | 1.6 GB | 高速 | 良好 |
NVIDIA Parakeet
sherpa-onnx経由 · 25言語 · ONNX INT8
25言語の多言語サポートを備えた、英語で最先端の精度。効率的なローカル推論のためにINT8量子化されています。
Parakeet対応言語:英語、ブルガリア語、クロアチア語、チェコ語、デンマーク語、オランダ語、エストニア語、フィンランド語、フランス語、ドイツ語、ギリシャ語、ハンガリー語、イタリア語、ラトビア語、リトアニア語、マルタ語、ポーランド語、ポルトガル語、ルーマニア語、ロシア語、スロバキア語、スロベニア語、スペイン語、スウェーデン語、ウクライナ語。
☁️クラウド文字起こしプロバイダー
ご自身のAPIキーを使って、クラウドパワーの文字起こしを利用できます。BYOK(自分のキーを持ち込む方式)なら、コントロールはお客様の手の中にあります。
OpenAI
高速で正確な文字起こし
OpenAIで最も正確な文字起こし
オリジナルのWhisper APIエンドポイント
カスタムエンドポイント
Ollama、セルフホストのWhisperサーバー、LocalAI、またはOpenAI互換の /audio/transcriptions エンドポイントを持つあらゆるサービスを接続できます。
✨OpenWhispr Cloud
設定不要の文字起こしとAI処理。APIキーは必要ありません。サインインするだけですぐに使えます。
マネージド型の文字起こし
最速のプロバイダーへ自動でルーティングします
AIによるテキスト整形を標準搭載
書式の整形、句読点の付与、フィラーの除去
無料プランあり
Proにアップグレードすれば無制限に利用可能
🧠AIによるテキスト処理
文字起こしの後、OpenWhisprはテキストを整えることができます。文法の修正、フィラー(つなぎ言葉)の除去、出力の書式整形を行います。クラウドまたはローカルのAIモデルからお選びいただけます。
クラウドプロバイダー(BYOK)
OpenAI
GPT-5.2, GPT-5 Mini, GPT-5 Nano, GPT-4.1, GPT-4.1 Mini, GPT-4.1 Nano
Anthropic
Claude Opus 4.5, Claude Sonnet 4.5, Claude Haiku 4.5
Gemini 3 Pro, Gemini 3 Flash, Gemini 2.5 Flash Lite
Groq
Qwen3 32B, GPT-OSS 120B, GPT-OSS 20B, LLaMA 3.3 70B, LLaMA 3.1 8B, Mixtral 8x7B
ローカルモデル(llama.cpp経由)
Qwen
Qwen3 8B0.6B、1.7B、4B、8B、32Bの各バリアント
Mistral
Mistral 7B InstructQ4およびQ5量子化
Meta LLaMA
LLaMA 3.2 3B1B、3B、8Bの各バリアント
OpenAI OSS
GPT-OSS 20Bオープンソースのフラッグシップ
ローカル推論モデルは、GGUF量子化を用いてllama.cpp経由で実行されます。すべての処理はお使いのマシン上で完結します。
⚙️全体がどう連携するか
1. 話す
ホットキーを押しながら、どんなアプリにでも自然に話しかけます
2. モデルが文字起こし
Whisper、Parakeet、またはクラウドプロバイダーが音声をテキストに変換します
3. AIが整える
オプションのAI処理が文法を修正し、フィラーを除去し、テキストを整形します