面向生产的语音升级
官方将 S2.1 Pro 定位为推荐生产型号,并说明其相对 S2 Pro 的质量、延迟和吞吐改善。选型时应在自己的文稿和声音样本上检查这些变化,不能把官方方向性描述转换为固定延迟或并发承诺。
在选型前明确型号、输入输出与调用方式。
能力描述结合公开模型资料与本平台文档;实际参数、输出和计费规则以对应 API 和定价栏目为准。
了解 s2.1-pro 适合解决的声音任务。
官方将 S2.1 Pro 定位为推荐生产型号,并说明其相对 S2 Pro 的质量、延迟和吞吐改善。选型时应在自己的文稿和声音样本上检查这些变化,不能把官方方向性描述转换为固定延迟或并发承诺。
可通过 reference_id 使用已有声音,也可在一次请求中提供参考录音与准确逐字稿。沿用声音素材有助于比较新旧型号,但生成结果仍需要检查语气、发音与角色一致性。
使用文本与格式设置提交合成,完成后取得 audio_url。长稿可以配置 callback_url,先保存任务编号,再接收完成结果;应用无需把一个等待中的任务展示为已交付音频。
从具体内容和交付方式出发选择。
对经常更新的知识内容、商品讲解或产品教程,先选取代表性文稿评估,再逐步迁移制作流程。保存模型与音色信息,便于出现表达差异时定位设置。
将导航、讲解和帮助文本转为可播放音频,关注真实用户听到的清晰度与等待体验。此入口交付音频链接,实时对话应用需另行设计播放与缓冲。
用相同音色和文本比较 S2 Pro 与 S2.1 Pro,检查专有名词、长句、停顿和后期处理量。通过小批次试听决定迁移范围,避免直接批量替换已有成片。
结合文稿、音色与制作成本进行比较。
本入口仍默认 s2-pro,使用 S2.1 Pro 应设置 model: s2.1-pro。不要仅依据“推荐生产型号”的官方定位就假定一次未指定型号的请求已经使用了它。
官方资料没有为本页面提供可承诺的固定改善百分比。比较音质、任务等待、校听和修订成本,再决定是否替换现有流程;长篇稳定朗读也可保留 S1 作为候选。
先试听,再扩展到正式内容。
明确朗读目的,校对文稿,选择保存音色或准备参考录音与逐字稿。
显式指定 s2.1-pro,用代表性段落确认发音、节奏和输出格式。
保存设置和任务编号,在完成后取得音频链接,再安排播放、剪辑或内容交付。
了解合成方式与交付范围。
解答使用 s2.1-pro 时的常见疑问。
官方说明 S2.1 Pro 改善质量、延迟与吞吐,并将其列为推荐生产模型。这里不承诺具体改善幅度;应以自己的文稿、声音与实际调用结果做迁移评估。
通过 HTTP 请求头 model 指定 s2.1-pro。不指定时默认 s2-pro;音色 reference_id 属于声音选择,与合成型号分别设置。
固定角色或系列内容可用 reference_id 复用声音;单次项目可以用 references 提供录音与逐字稿。两者互斥,一次性克隆只接受一个参考样本。
prosody.speed=1.0 表示原速,volume 使用 dB,0 表示不改变音量。可选择 mp3、wav 或 pcm;后两者都使用 WAV 容器,MP3 码率可选 64、128 或 192。
设置 callback_url 后先保存 task_id 和 started_at,等待完成回调,也可按任务编号查询。取得 audio_url 才表示可以进入播放或编辑环节。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。
Pricing
$10.49· per 1M bytes
You pay$13,584for 142,800 credits · $0.0951 / credits46% OFF
You're billed in credits. Pick a top-up tier to see its per-credit rate — the larger the top-up, the cheaper each credit.
This is only a basic call example. See the full docs for more parameters and advanced usage.
View Docs