直接答案
音频转录和语音生成是不同任务,模型和端点也可能不同。先在模型目录确认当前账户可见的 transcription、speech、audio 或 realtime 模型,再按模型专题或控制台指定的端点测试。本页不再把whisper-1、TTS 或某个端点统一写成已验证生产可用。
本页最后核对日期为 2026 年 9 月 2 日。
常见任务入口
转录最小请求
只有在控制台明确模型使用 transcription 端点时:验收项目
- 实际支持的音频格式、采样率、声道、大小和时长;
- 语言识别、时间戳、分段和输出格式;
- 音频 MIME 与文件内容一致;
- 超长、损坏、静音和不支持格式的错误;
- 同一文件重试是否重复计费;
- usage、计费单位和调用日志。