第一步:注册千聚并获取API Key
要开始接入,你首先需要一个账号和有效的API Key。访问千聚AI中转站官网,完成注册后登录控制台。在“API Key管理”页面可以生成新的密钥,请复制并妥善保存。API Key是你调用所有模型的通行凭证,后续在代码中直接填入即可。
第二步:确认Base URL与模型名
千聚统一使用OpenAI兼容接口格式,因此Base URL固定为官方提供的网关地址。在代码中,你需要将Base URL设置为千聚的API端点(例如 https://api.token88.cc/v1),模型名则根据你想要使用的语音转文字模型来填写。常见的语音转文字模型标识符包括:
- whisper-1:OpenAI Whisper 通用语音转文字模型
- gpt-4o-transcribe:GPT-4o 内置的语音转录模型
- sensvoice-small:适合中文场景的轻量级ASR模型
具体支持的模型列表请以千聚官网实时展示为准。你可以在控制台的“模型列表”页面直接复制模型名称,避免手动拼写错误。
第三步:编写代码完成一次调用
以下是一个最简单的Python调用示例,使用OpenAI官方库对接千聚,完成语音文件转文字:
from openai import OpenAI
client = OpenAI(
api_key="你的千聚API Key",
base_url="https://api.token88.cc/v1"
)
audio_file = open("meeting.mp3", "rb")
transcript = client.audio.transcriptions.create(
model="whisper-1",
file=audio_file,
response_format="text"
)
print(transcript)
请将 api_key 替换为你在千聚生成的密钥,base_url 保持不变,model 参数根据需求选择对应的语音转文字模型即可。执行成功后,你将看到音频内容被转录为文本输出。
常见配置问题排查
| 问题 | 可能原因 | 解决方法 |
|---|---|---|
| 401 认证失败 | API Key无效或未填写 | 登录千聚重新生成并复制API Key |
| 404 模型不存在 | 模型名拼写错误或未开通 | 到千聚控制台确认完整模型名称 |
| 请求超时 | 音频文件过大或网络不稳定 | 压缩音频或检查本地网络环境 |
为什么选择千聚进行语音转文字接入
千聚聚合了多个主流语音转文字模型,你只需使用一套API Key和同一个Base URL即可切换不同模型。对于日常开发而言,这种统一管理方式能有效减少多平台切换带来的配置负担。无论是会议纪要转录、语音搜索还是实时字幕场景,千聚都提供了相对便捷的兼容接口。
如果你想查看完整的语音转文字模型列表并获取最新接入信息,可以立即访问立即访问千聚,进入控制台体验一键配置。
现在就去配置你的语音转文字模型吧。注册、获取Key、复制Base URL、填入模型名——整套流程只需几分钟即可完成一次真实调用。