供应商索引
这里汇总 OpenTypeless 当前的 STT 与 LLM 配置指南。先按任务选择语音识别或文本润色供应商,再进入对应页面核对密钥、端点、模型和测试步骤。
STT 语音识别供应商
Deepgram Nova-3
托管式流式识别路线;使用前核对当前语言、区域、价格与数据条款。
/docs/stt-deepgram
AssemblyAI
WebSocket 流式识别并提供分段格式;当前中文页未审校时会打开英文配置指南。
/docs/stt-assemblyai
OpenAI Whisper
录音结束后通过 HTTP 上传音频并返回 Whisper 转写结果。
/docs/stt-openai-whisper
Groq Whisper
OpenAI 兼容的 Whisper 接口;需要分别核对模型、文件限制与当前价格。
/docs/stt-groq-whisper
Zhipu GLM-ASR
智谱 GLM ASR 接口;按当前文档配置鉴权、模型和请求格式。
/docs/stt-glm-asr
SiliconFlow STT
通过 SiliconFlow 音频接口调用 SenseVoiceSmall 路线。
/docs/stt-siliconflow
Aliyun Qwen3-ASR
通过 DashScope WebSocket 使用实时语音识别;需开通相应服务权限。
/docs/stt-aliyun-qwen3-asr
Volcengine Doubao ASR
通过火山引擎 OpenSpeech 大模型接口进行流式识别。
/docs/stt-volcengine-doubao
LLM 文本润色供应商
OpenAI
通过 /v1/chat/completions 调用;模型可用性与价格以当前官方文档为准。
/docs/llm-openai
DeepSeek
通过兼容接口调用 deepseek-chat 等模型;先运行连接测试。
/docs/llm-deepseek
Claude (via OpenRouter)
OpenTypeless 当前通过 OpenRouter 提供 Claude 路线,需同时核对两方条款。
/docs/llm-claude
Gemini
使用 Google 提供的 OpenAI 兼容接口访问 Gemini 模型。
/docs/llm-gemini
Groq
通过 Groq 的 OpenAI 兼容接口进行文本润色;当前中文页未审校时会打开英文指南。
/docs/llm-groq
Zhipu
调用智谱 GLM 对话补全接口,填写当前支持的模型名称。
/docs/llm-zhipu
Moonshot (Kimi)
通过 Moonshot 的 OpenAI 兼容接口调用 Kimi 模型。
/docs/llm-moonshot
Qwen (DashScope)
通过阿里云 DashScope 的 OpenAI 兼容模式调用通义千问。
/docs/llm-qwen
SiliconFlow
通过 SiliconFlow 的 OpenAI 兼容对话补全接口进行润色。
/docs/llm-siliconflow
Ollama (Local)
连接本机或自托管的 Ollama 兼容端点;需要自行检查模型、主机与网络边界。
/docs/llm-ollama
OpenRouter
用一个兼容端点访问多个模型;应核对具体模型供应方、路由和数据条款。
/docs/llm-openrouter
首次配置的建议顺序
- 先选一个容易获取密钥并适合目标语言的 STT 供应商。
- 再选一个满足成本、数据处理和输出质量要求的 LLM 供应商。
- 分别完成 STT 与 LLM 连接测试,再调整高级选项。
- 基线流程稳定后,用同一组代表性语音与文本比较其他供应商,避免同时改变多个变量。