Skip to main content

直接答案

音频转录和语音生成是不同任务,模型和端点也可能不同。先在模型目录确认当前账户可见的 transcription、speech、audio 或 realtime 模型,再按模型专题或控制台指定的端点测试。本页不再把 whisper-1、TTS 或某个端点统一写成已验证生产可用。 本页最后核对日期为 2026 年 9 月 2 日

常见任务入口

转录最小请求

只有在控制台明确模型使用 transcription 端点时:

验收项目

  • 实际支持的音频格式、采样率、声道、大小和时长;
  • 语言识别、时间戳、分段和输出格式;
  • 音频 MIME 与文件内容一致;
  • 超长、损坏、静音和不支持格式的错误;
  • 同一文件重试是否重复计费;
  • usage、计费单位和调用日志。
模型出现在目录中不代表所有音频端点都可用;官方上游支持也不代表网关当前分组已经接入。生产前必须用目标 API Key 和真实音频样本验收。

相关文档