模型与 提供商
OpenWhispr 支持多种语音转文字引擎和 AI 提供商。为了隐私可全部本地运行,为了速度可使用云端 API,也可两者混用。
🖥️本地转录模型
完全在您的本机上运行语音转文字。无需联网,数据不离开您的设备。
OpenAI Whisper
通过 whisper.cpp · 99+ 种语言 · GGML 格式
| 模型 | 大小 | 速度 | 质量 |
|---|---|---|---|
Tiny | 75 MB | 最快 | 基础 |
Base推荐 | 142 MB | 快速 | 良好 |
Small | 466 MB | 中等 | 更佳 |
Medium | 1.5 GB | 较慢 | 高 |
Large v3 | 3 GB | 最慢 | 最佳 |
Turbo | 1.6 GB | 快速 | 良好 |
NVIDIA Parakeet
通过 sherpa-onnx · 25 种语言 · ONNX INT8
顶尖的英语准确度,并支持 25 种语言的多语言识别。采用 INT8 量化,实现高效的本地推理。
Parakeet 支持的语言:英语、保加利亚语、克罗地亚语、捷克语、丹麦语、荷兰语、爱沙尼亚语、芬兰语、法语、德语、希腊语、匈牙利语、意大利语、拉脱维亚语、立陶宛语、马耳他语、波兰语、葡萄牙语、罗马尼亚语、俄语、斯洛伐克语、斯洛文尼亚语、西班牙语、瑞典语、乌克兰语。
☁️云端转录提供商
使用您自己的 API 密钥实现云端驱动的转录。自带密钥让一切尽在您的掌控。
OpenAI
快速、准确的转录
OpenAI 最准确的转录
原始的 Whisper API 端点
自定义端点
连接 Ollama、自托管的 Whisper 服务器、LocalAI,或任何提供兼容 OpenAI /audio/transcriptions 端点的服务。
✨OpenWhispr Cloud
零配置的转录和 AI 处理。无需 API 密钥——登录即用。
托管转录
我们自动路由至最快的提供商
内置 AI 文本清理
格式整理、标点修正及去除口头语
提供免费方案
升级至 Pro 即可无限使用
🧠AI 文本处理
转录完成后,OpenWhispr 可以清理您的文本——修正语法、去除口头语并整理输出格式。可从云端或本地 AI 模型中选择。
云端提供商(BYOK)
OpenAI
GPT-5.2, GPT-5 Mini, GPT-5 Nano, GPT-4.1, GPT-4.1 Mini, GPT-4.1 Nano
Anthropic
Claude Opus 4.5, Claude Sonnet 4.5, Claude Haiku 4.5
Gemini 3 Pro, Gemini 3 Flash, Gemini 2.5 Flash Lite
Groq
Qwen3 32B, GPT-OSS 120B, GPT-OSS 20B, LLaMA 3.3 70B, LLaMA 3.1 8B, Mixtral 8x7B
本地模型(通过 llama.cpp)
Qwen
Qwen3 8B0.6B、1.7B、4B、8B、32B 各版本
Mistral
Mistral 7B InstructQ4 和 Q5 量化版本
Meta LLaMA
LLaMA 3.2 3B1B、3B、8B 各版本
OpenAI OSS
GPT-OSS 20B开源旗舰
本地推理模型通过 llama.cpp 运行,并采用 GGUF 量化。所有处理都留在您的本机上。
⚙️各部分如何协同工作
1. 您开口说话
按住热键,对着任意应用自然地说话
2. 模型转录
Whisper、Parakeet 或某个云端提供商将语音转换为文字
3. AI 清理
可选的 AI 处理会修正语法、去除口头语并整理文本格式