模型与 提供商

OpenWhispr 支持多种语音转文字引擎和 AI 提供商。为了隐私可全部本地运行,为了速度可使用云端 API,也可两者混用。

🖥️本地转录模型

完全在您的本机上运行语音转文字。无需联网,数据不离开您的设备。

OpenAI Whisper

通过 whisper.cpp · 99+ 种语言 · GGML 格式

模型大小速度质量
Tiny
75 MB最快基础
Base推荐
142 MB快速良好
Small
466 MB中等更佳
Medium
1.5 GB较慢
Large v3
3 GB最慢最佳
Turbo
1.6 GB快速良好

NVIDIA Parakeet

通过 sherpa-onnx · 25 种语言 · ONNX INT8

Parakeet TDT 0.6B v3推荐顶尖英语表现

顶尖的英语准确度,并支持 25 种语言的多语言识别。采用 INT8 量化,实现高效的本地推理。

680 MB 快速 25 种语言 100% 本地

Parakeet 支持的语言:英语、保加利亚语、克罗地亚语、捷克语、丹麦语、荷兰语、爱沙尼亚语、芬兰语、法语、德语、希腊语、匈牙利语、意大利语、拉脱维亚语、立陶宛语、马耳他语、波兰语、葡萄牙语、罗马尼亚语、俄语、斯洛伐克语、斯洛文尼亚语、西班牙语、瑞典语、乌克兰语。

☁️云端转录提供商

使用您自己的 API 密钥实现云端驱动的转录。自带密钥让一切尽在您的掌控。

OpenAI

GPT-4o Mini Transcribe

快速、准确的转录

极快
GPT-4o Transcribe

OpenAI 最准确的转录

标准
Whisper

原始的 Whisper API 端点

标准
获取 API 密钥

Groq

最快
Whisper Large v3 Turbo

216 倍实时速度——目前最快的云端转录

超快
获取 API 密钥

Mistral

Voxtral Mini

来自 Mistral AI 的多语言转录

快速
获取 API 密钥

自定义端点

任何兼容 OpenAI 的 API

连接 Ollama、自托管的 Whisper 服务器、LocalAI,或任何提供兼容 OpenAI /audio/transcriptions 端点的服务。

OpenWhispr Cloud

零配置的转录和 AI 处理。无需 API 密钥——登录即用。

托管转录

我们自动路由至最快的提供商

内置 AI 文本清理

格式整理、标点修正及去除口头语

提供免费方案

升级至 Pro 即可无限使用

🧠AI 文本处理

转录完成后,OpenWhispr 可以清理您的文本——修正语法、去除口头语并整理输出格式。可从云端或本地 AI 模型中选择。

云端提供商(BYOK)

OpenAI

GPT-5.2, GPT-5 Mini, GPT-5 Nano, GPT-4.1, GPT-4.1 Mini, GPT-4.1 Nano

Anthropic

Claude Opus 4.5, Claude Sonnet 4.5, Claude Haiku 4.5

Google

Gemini 3 Pro, Gemini 3 Flash, Gemini 2.5 Flash Lite

Groq

Qwen3 32B, GPT-OSS 120B, GPT-OSS 20B, LLaMA 3.3 70B, LLaMA 3.1 8B, Mixtral 8x7B

本地模型(通过 llama.cpp)

Qwen

Qwen3 8B

0.6B、1.7B、4B、8B、32B 各版本

Mistral

Mistral 7B Instruct

Q4 和 Q5 量化版本

Meta LLaMA

LLaMA 3.2 3B

1B、3B、8B 各版本

OpenAI OSS

GPT-OSS 20B

开源旗舰

本地推理模型通过 llama.cpp 运行,并采用 GGUF 量化。所有处理都留在您的本机上。

⚙️各部分如何协同工作

1. 您开口说话

按住热键,对着任意应用自然地说话

2. 模型转录

Whisper、Parakeet 或某个云端提供商将语音转换为文字

3. AI 清理

可选的 AI 处理会修正语法、去除口头语并整理文本格式

免费试用每一个模型

下载 OpenWhispr,选择最适合您的模型。本地模型完全免费。云端提供商则使用您自己的 API 密钥。