以稳定朗读为起点
课程和长文配音需要持续保持语句关系与声线。平台指南建议在更关注长文本稳定性的任务中比较 S1;制作时仍应按章节拆分、校听专有名词和数字,避免把型号定位当作每次输出都无误的保证。
在选型前明确型号、输入输出与调用方式。
能力描述结合公开模型资料与本平台文档;实际参数、输出和计费规则以对应 API 和定价栏目为准。
了解 s1 适合解决的声音任务。
课程和长文配音需要持续保持语句关系与声线。平台指南建议在更关注长文本稳定性的任务中比较 S1;制作时仍应按章节拆分、校听专有名词和数字,避免把型号定位当作每次输出都无误的保证。
通过 reference_id 复用保存的声音,让同一系列的开场、正文和补充内容沿用统一声线。音色引用与模型型号分别设置,适合有固定播音员或品牌声音的内容项目。
可选择 MP3 交付,或使用 WAV 容器进入混音与剪辑流程。prosody 控制语速和音量,便于先生成短样、确定节奏,再按相同设置安排后续章节。
从具体内容和交付方式出发选择。
把教学稿按主题拆成段落,预先处理缩写、公式和专业名称。使用相同声音与语速生成各节内容,校听后配合字幕和画面完成课程制作。
以章节为单位保存文稿、模型和音色信息。发现发音或停顿问题时,仅重做需要修订的段落,减少整篇返工并保持编辑节奏。
将产品教程、操作说明和帮助文案转换为统一声线。对新增或修改的文本保留版本记录,方便在产品更新后重新制作对应提示。
结合文稿、音色与制作成本进行比较。
如果任务更关注章节连贯与可重复编辑,可以从 S1 开始试听。表达性较强的短内容可同时比较 S2 Pro;升级型号并不代替对实际文稿的评估。
平台默认型号为 s2-pro,使用 S1 必须设置 model 请求头。保存型号、音色、格式和文稿版本,有助于复现一批内容的制作设置。
先试听,再扩展到正式内容。
明确朗读目的,校对文稿,选择保存音色或准备参考录音与逐字稿。
显式指定 s1,用代表性段落确认发音、节奏和输出格式。
保存设置和任务编号,在完成后取得音频链接,再安排播放、剪辑或内容交付。
了解合成方式与交付范围。
解答使用 s1 时的常见疑问。
平台指南将 S1 推荐为偏重长文本稳定性的选择,适合先关注清晰朗读的内容。实际表现与文稿、声音参考和生成设置相关,应先用代表性段落试听。
通过 HTTP 请求头 model 指定 s1。不指定时默认 s2-pro;音色 reference_id 属于声音选择,与合成型号分别设置。
固定角色或系列内容可用 reference_id 复用声音;单次项目可以用 references 提供录音与逐字稿。两者互斥,一次性克隆只接受一个参考样本。
prosody.speed=1.0 表示原速,volume 使用 dB,0 表示不改变音量。可选择 mp3、wav 或 pcm;后两者都使用 WAV 容器,MP3 码率可选 64、128 或 192。
设置 callback_url 后先保存 task_id 和 started_at,等待完成回调,也可按任务编号查询。取得 audio_url 才表示可以进入播放或编辑环节。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。
You pay$13,584for 142,800 credits · $0.0951 / credits
You're billed in credits. Pick a top-up tier to see its per-credit rate — the larger the top-up, the cheaper each credit.
Your API key is pre-filled in the snippet — copy and run it in your terminal or IDE.
This is only a basic call example. See the full docs for more parameters and advanced usage.
