应用默认音色是云健,已有安全偏好会恢复上次所选音色。点击“更换音色”展开列表,点选后立即播放随APK提供的样音,选中音色显示在摘要区域。仅在点选试听时播放;恢复偏好不自动播放。音色名称与描述是当前产品提供的选择信息,不表示针对每段文案的音质保证。
| 序号 | 音色名称 | 产品描述 | 服务音色ID |
|---|---|---|---|
| 1 | 云健(默认) | 男 · 充满激情 | zh-CN-YunjianNeural |
| 2 | 云希 | 男 · 沉稳大气 | zh-CN-YunxiNeural |
| 3 | 云扬 | 男 · 成熟稳重 | zh-CN-YunyangNeural |
| 4 | 云霞 | 男 · 温和清晰 | zh-CN-YunxiaNeural |
| 5 | 晓晓 | 女 · 温暖自然 | zh-CN-XiaoxiaoNeural |
| 6 | 小艺 | 女 · 温柔感性 | zh-CN-XiaoyiNeural |
| 7 | 小北 | 女 · 东北口音 | zh-CN-liaoning-XiaobeiNeural |
| 8 | 小妮 | 女 · 陕西口音 | zh-CN-shaanxi-XiaoniNeural |
| 9 | Hiu Gaai | 女 · 香港粤语 | zh-HK-HiuGaaiNeural |
| 10 | Hiu Maan | 女 · 香港粤语 | zh-HK-HiuMaanNeural |
| 11 | Wan Lung | 男 · 香港粤语 | zh-HK-WanLungNeural |
| 12 | Hsiao Chen | 女 · 台湾国语 | zh-TW-HsiaoChenNeural |
| 13 | Hsiao Yu | 女 · 台湾国语 | zh-TW-HsiaoYuNeural |
| 14 | Yun Jhe | 男 · 台湾国语 | zh-TW-YunJheNeural |
| 15 | 弗洛里安 | 男 · 德国多语言 | de-DE-FlorianMultilingualNeural |
| 16 | 塞拉菲娜 | 女 · 德国多语言 | de-DE-SeraphinaMultilingualNeural |
| 17 | 威廉 | 男 · 澳大利亚多语言 | en-AU-WilliamMultilingualNeural |
| 18 | 安德鲁 | 男 · 美国多语言 | en-US-AndrewMultilingualNeural |
| 19 | 艾娃 | 女 · 美国多语言 | en-US-AvaMultilingualNeural |
| 20 | 布莱恩 | 男 · 美国多语言 | en-US-BrianMultilingualNeural |
| 21 | 艾玛 | 女 · 美国多语言 | en-US-EmmaMultilingualNeural |
| 22 | 雷米 | 男 · 法国多语言 | fr-FR-RemyMultilingualNeural |
| 23 | 薇薇安 | 女 · 法国多语言 | fr-FR-VivienneMultilingualNeural |
| 24 | 朱塞佩 | 男 · 意大利多语言 | it-IT-GiuseppeMultilingualNeural |
| 25 | 贤洙 | 男 · 韩国多语言 | ko-KR-HyunsuMultilingualNeural |
| 26 | 塔莉塔 | 女 · 巴西多语言 | pt-BR-ThalitaMultilingualNeural |
多语言音色可以根据服务对输入语言的支持生成语音,具体发音应以实际试听和成品为准;应用没有独立语言翻译入口,也不会把文案翻译为音色名称对应的语言。
音频处理过程与进度
- 创建任务时固定正文和所选音色。
- 正文按段落和2000字符上限拆分;过长段落按长度继续切分。
- 按顺序逐段联网获取MP3数据。每段先写入临时文件,只有收到非空且可探测的音频才保存为完成分段。
- 网络中断或超时,每段最多自动重试2次,即首次请求加最多2次重试;两次退避等待分别为1.5秒和3秒。
- 每段成功后更新“已完成段数/总段数”。所有片段就绪后合并并验证,生成最终
audio.mp3。
任务页百分比首先反映完成分段数量,不是按声波字节或精确时间比例计算的预测进度;合并和验证阶段可显示不定百分比。网络等待时会提示本次等待秒数和已接收数据量。通知栏展示处理阶段汇总,不承担任务页的详细百分比展示。
失败、重试与保存
若某一段失败,可检查网络后点“重试音频”。已经成功落盘的分段会复用,不必从头请求全部文案。取消会保留已完成素材,未完成临时片段不会被当成成功音频。MP3达到“完成/可试听”状态后可以单独保存或分享;即使尚未确认视频,也能交付配音。
本版本没有向用户开放语速、音量、音调、SSML编辑、声音克隆或自定义音色训练控件;界面中的“26音色”是固定列表,不能据此推断支持本机大模型语音生成。