Skip to main content
POST
语音转文字
把音频文件转写为文字。

请求

参数

响应

response_format: "json":
response_format: "verbose_json":
srt / vtt 返回字幕文本(可直接保存为 .srt / .vtt)。

Python

长音频策略

  • Whisper 单文件 25MB 上限,长音频请提前 切片(推荐 5-10 分钟一段)。
  • 使用 prompt 传入上一段尾部文本以保持语境连贯。
  • 工具如 ffmpeg -i input.mp3 -f segment -segment_time 600 part_%03d.mp3 可快速切片。

计费

音频时长(秒) 计费,具体倍率以控制台为准。