# 07 26种音色、试听与音频合成 听文视频工作台 · 产品说明与指南 · 1.0.2 应用默认音色是云健,已有安全偏好会恢复上次所选音色。点击“更换音色”展开列表,点选后立即播放随APK提供的样音,选中音色显示在摘要区域。仅在点选试听时播放;恢复偏好不自动播放。音色名称与描述是当前产品提供的选择信息,不表示针对每段文案的音质保证。 序号 | 音色名称 | 产品描述 | 服务音色ID | 1 | 云健(默认) | 男 · 充满激情 | zh-CN-YunjianNeural | 2 | 云希 | 男 · 沉稳大气 | zh-CN-YunxiNeural | 3 | 云扬 | 男 · 成熟稳重 | zh-CN-YunyangNeural | 4 | 云霞 | 男 · 温和清晰 | zh-CN-YunxiaNeural | 5 | 晓晓 | 女 · 温暖自然 | zh-CN-XiaoxiaoNeural | 6 | 小艺 | 女 · 温柔感性 | zh-CN-XiaoyiNeural | 7 | 小北 | 女 · 东北口音 | zh-CN-liaoning-XiaobeiNeural | 8 | 小妮 | 女 · 陕西口音 | zh-CN-shaanxi-XiaoniNeural | 9 | Hiu Gaai | 女 · 香港粤语 | zh-HK-HiuGaaiNeural | 10 | Hiu Maan | 女 · 香港粤语 | zh-HK-HiuMaanNeural | 11 | Wan Lung | 男 · 香港粤语 | zh-HK-WanLungNeural | 12 | Hsiao Chen | 女 · 台湾国语 | zh-TW-HsiaoChenNeural | 13 | Hsiao Yu | 女 · 台湾国语 | zh-TW-HsiaoYuNeural | 14 | Yun Jhe | 男 · 台湾国语 | zh-TW-YunJheNeural | 15 | 弗洛里安 | 男 · 德国多语言 | de-DE-FlorianMultilingualNeural | 16 | 塞拉菲娜 | 女 · 德国多语言 | de-DE-SeraphinaMultilingualNeural | 17 | 威廉 | 男 · 澳大利亚多语言 | en-AU-WilliamMultilingualNeural | 18 | 安德鲁 | 男 · 美国多语言 | en-US-AndrewMultilingualNeural | 19 | 艾娃 | 女 · 美国多语言 | en-US-AvaMultilingualNeural | 20 | 布莱恩 | 男 · 美国多语言 | en-US-BrianMultilingualNeural | 21 | 艾玛 | 女 · 美国多语言 | en-US-EmmaMultilingualNeural | 22 | 雷米 | 男 · 法国多语言 | fr-FR-RemyMultilingualNeural | 23 | 薇薇安 | 女 · 法国多语言 | fr-FR-VivienneMultilingualNeural | 24 | 朱塞佩 | 男 · 意大利多语言 | it-IT-GiuseppeMultilingualNeural | 25 | 贤洙 | 男 · 韩国多语言 | ko-KR-HyunsuMultilingualNeural | 26 | 塔莉塔 | 女 · 巴西多语言 | pt-BR-ThalitaMultilingualNeural | 多语言音色可以根据服务对输入语言的支持生成语音,具体发音应以实际试听和成品为准;应用没有独立语言翻译入口,也不会把文案翻译为音色名称对应的语言。 ## 音频处理过程与进度 - 创建任务时固定正文和所选音色。 - 正文按段落和2000字符上限拆分;过长段落按长度继续切分。 - 按顺序逐段联网获取MP3数据。每段先写入临时文件,只有收到非空且可探测的音频才保存为完成分段。 - 网络中断或超时,每段最多自动重试2次,即首次请求加最多2次重试;两次退避等待分别为1.5秒和3秒。 - 每段成功后更新“已完成段数/总段数”。所有片段就绪后合并并验证,生成最终audio.mp3。 任务页百分比首先反映完成分段数量,不是按声波字节或精确时间比例计算的预测进度;合并和验证阶段可显示不定百分比。网络等待时会提示本次等待秒数和已接收数据量。通知栏展示处理阶段汇总,不承担任务页的详细百分比展示。 ## 失败、重试与保存 若某一段失败,可检查网络后点“重试音频”。已经成功落盘的分段会复用,不必从头请求全部文案。取消会保留已完成素材,未完成临时片段不会被当成成功音频。MP3达到“完成/可试听”状态后可以单独保存或分享;即使尚未确认视频,也能交付配音。 本版本没有向用户开放语速、音量、音调、SSML编辑、声音克隆或自定义音色训练控件;界面中的“26音色”是固定列表,不能据此推断支持本机大模型语音生成。 --- 招商合作微信:wzqy2019。添加备注:听文合作。 原网页:https://tingwen-creator-studio-102.pages.dev/guide/product-07