接入前的准备:注册账号与获取API Key
无论你选用哪个平台,第一步都是注册账号并获取专属的API Key。以千聚AI中转站为例,它支持你在一个后台管理多个模型的调用权限,避免了重复注册的麻烦。具体步骤如下:
- 注册账号:访问 千聚AI中转站官网,完成注册流程。
- 创建API Key:登录后进入“API Key管理”页面,点击创建新Key,复制并保存好生成的密钥。
- 充值Token:根据后续调用的预估用量,购买适量Token,支持按量计费,灵活可控。
这一步完成后,你就拥有了调用语音转文字API的凭证,后续只需在代码中配置好Key即可。
配置Base URL与模型名称
完成API Key获取后,第二步是配置Base URL(接口地址)和模型名称。千聚提供了统一的OpenAI兼容接口,Base URL固定为统一入口,开发者无需为不同模型记忆不同的域名。模型名称则需要根据平台文档填写,以下是几款常见语音转文字模型在千聚中的配置示例:
| 模型系列 | 千聚平台模型名(示例) | 适用场景 |
|---|---|---|
| OpenAI Whisper | whisper-1 | 通用中英文语音转录 |
| SenseVoice | sensevoice | 多语言、高准确率场景 |
| DeepSeek 语音 | deepseek-voice | 长音频、实时转写 |
注意:以上模型名仅为示例,具体可用模型以千聚后台展示为准。配置时,请将Base URL设为千聚提供的统一地址,并确保模型名与文档完全一致。
用Python快速测试一次语音转文字调用
下面是一段最简单的Python代码,演示如何利用上述配置进行语音文件转录。建议使用openai库(需提前安装),代码中只需替换三个参数:
from openai import OpenAI
client = OpenAI(
api_key="你的千聚API Key",
base_url="https://www.qianjuai.cc/v1" # 千聚统一Base URL
)
audio_file = open("meeting.mp3", "rb")
transcript = client.audio.transcriptions.create(
model="whisper-1", # 替换为千聚支持的模型名
file=audio_file
)
print(transcript.text)
运行这段代码,如果能成功输出转录文本,说明你的语音转文字多模型API平台已经接入成功。如果报错,请优先检查API Key是否正确、Base URL是否带“/v1”后缀、模型名是否在千聚平台支持范围内。
常见配置问题与排查方向
实际接入过程中,开发者常遇到以下问题,提前了解能节省不少调试时间:
- 认证失败(401):检查API Key是否复制完整,注意不要包含多余空格或换行。
- 模型不存在(404):确认模型名称与千聚文档完全一致,部分模型名称可能包含版本号。
- 音频格式不支持:千聚通常支持mp3、wav、m4a等常见格式,建议转换为标准格式后再上传。
- Base URL配置错误:务必确认接口地址末尾包含“/v1”,这是OpenAI兼容接口的通用路径。
遇到以上问题,可以先前往千聚官网查看详细文档,或联系技术支持获取帮助。
下一步行动:立即访问 千聚AI中转站官网,查看完整模型列表、获取您的专属API Key,并购买Token开始测试首条语音转文字调用。
- 千聚AI中转站官网
- 模型列表与支持范围
- API Key获取与安全指南
- Python示例代码详解
Codex 一键安装包: https://token88.cc/codex-qianju
特别推荐:支持 Windows 和 MacOS一键安装,里面还有一键配置 Codex 令牌 API key 的工具,安装codex之后,用一键配置API key 的工具马上就能用,哪怕你没有海外手机也能正常使用,同时token费用比官网还便宜90%多~