接入AI模型最关键的三件事:API Key、Base URL和模型名称。语音转文字模型中转站的接入同样遵循这一逻辑,无论你使用Whisper、SenseVoice还是其他语音识别模型,只要选对聚合平台,就能用一套配置搞定所有调用。本文将以完整步骤演示语音转文字模型中转站怎么接入,并推荐一款更适合国内开发者的中转平台——千聚AI中转站。
一、什么是语音转文字模型中转站
语音转文字模型中转站是一个聚合了多种语音识别模型API的平台,开发者只需要对接一个入口,就能灵活切换底层模型,避免在多厂商之间重复申请、配置和计费。千聚AI中转站正是这类平台,它提供统一的OpenAI兼容接口,让原本复杂的语音识别模型调用变得像调用普通聊天模型一样简单。
二、准备工作:注册账号与获取API Key
开始接入前,你需要拥有一个千聚平台账号。访问千聚AI中转站官网完成注册。注册后进入控制台,在API Key管理页面创建一个Key,并复制保存。这一步是所有后续调用的凭证基础。
- 注册账号:仅需邮箱或手机号,快速完成
- 创建API Key:建议为每个应用单独创建,方便管理
- 记录Key值:配置代码时需用到
三、配置Base URL
语音转文字模型中转站的核心优势之一就是统一Base URL。千聚提供的接口地址遵循OpenAI格式,你只需将原来指向openai.com的地址替换为千聚的专属地址即可。通用格式如下:
Base URL: https://api.token88.cc/v1
在代码中将api_base设置为该地址,后续所有模型调用都会自动路由到千聚平台,无需多次修改。
四、选择语音模型并配置模型名称
千聚平台聚合了多款语音转文字模型,包括OpenAI Whisper系列及国内主流语音识别模型。你可以在官网模型列表中找到当前可用的所有语音模型及其调用名称。例如:
whisper-1— 通用语音识别whisper-large-v3— 更高准确性sensevoice-small— 实时场景优化
具体模型名称和价格请以官网最新信息为准。配置时只需将模型名字符串填入API调用参数即可。
五、调用API完成语音转文字
以下示例使用Python语言,演示如何通过千聚的中转接口完成一段音频的语音识别。请将YOUR_API_KEY替换为第二步获取的密钥。
import openai
openai.api_base = "https://api.token88.cc/v1"
openai.api_key = "YOUR_API_KEY"
audio_file = open("speech.mp3", "rb")
response = openai.Audio.transcribe(
model="whisper-1",
file=audio_file,
language="zh"
)
print(response["text"])
如果你使用Node.js、curl或其他语言,同样只需要修改Base URL和API Key,模型名称保持不变,即可快速集成。
六、管理Token与余额
千聚采用按量计费模式,你可以在控制台实时查看Token消耗和余额,随时充值。购买Token后,所有模型调用统一扣费,免去多平台多头结算的麻烦。余额低于阈值时还能收到告警,避免服务中断。
七、为什么选择千聚作为语音转文字模型中转站
- 统一接口:兼容OpenAI调用方式,学习成本低,现有代码改动最小
- 多模型聚合:覆盖主流语音识别模型,方便对比和切换
- 国内访问友好:无需科学上网,延迟更可控
- 企业级管理:支持子账户、用量统计、预算控制等团队功能
立刻开始接入
无论你是在开发语音助手、会议转写还是客服质检系统,语音转文字模型中转站的接入方式都可以帮你节省大量对接时间。现在访问千聚AI中转站官网注册账号,获取API Key,参照本文步骤即可完成第一次调用。官网还提供了详细的API文档以及更多模型列表,帮助你快速选型。
Codex 一键安装包: https://token88.cc/codex-qianju
特别推荐:支持 Windows 和 MacOS一键安装,里面还有一键配置 Codex 令牌 API key 的工具,安装codex之后,用一键配置API key 的工具马上就能用,哪怕你没有海外手机也能正常使用,同时token费用比官网还便宜90%多~