Edge-TTS 多角色音频生成器是一款基于 Microsoft Edge TTS 技术的音频生成工具,专为教育领域设计,尤其适用于生成外语听力题音频文件。该工具支持多角色语音合成,可根据文本中的标记自动切换不同角色的语音,实现逼真的对话效果。
主要功能
- 多角色语音合成:支持最多 4 个不同角色(A、B、C、D)的语音切换
- 智能文本标记:使用简单的标记语法控制角色切换、停顿和蜂鸣声
- 多种音频格式:支持生成 WAV、MP3、OGG、FLAC 等多种音频格式
- 实时试听:支持试听选中文本或全部文本,实时预览生成效果
- 自定义语音参数:每个角色可独立设置语音类型、语速、音调等参数
- 蜂鸣声支持:可插入蜂鸣声作为题目间的分隔符
- 文本文件操作:支持打开和保存文本文件,方便批量处理
技术特点
- 基于 Edge TTS:使用 Microsoft Edge 浏览器的 TTS 引擎,语音质量高
- 多线程处理:使用工作线程处理音频生成,界面响应流畅
- 直观的用户界面:采用 PyQt6 构建的现代化界面,操作简单直观
- 设置自动保存:自动保存用户的语音设置,下次启动时恢复
- 支持多种语言:可生成不同语言的语音,适合多语种听力题
文本标记说明
| 标记 | 功能 | 示例 |
|---|---|---|
| [A]、[B]、[C]、[D] | 切换角色 | [A]你好,我是角色A。[B]我是角色B。 |
| [数字] | 停顿指定毫秒数 | [A]你好。[1000][B]你好。 |
| [R] | 添加蜂鸣声 | [A]问题1。[R][A]问题2。 |
系统要求
- Windows 7 及以上操作系统
- Python 3.8 及以上(仅从源码运行时需要)
- 网络连接(使用 Edge TTS 服务时需要)
- 至少 2GB 内存,300MB 以上磁盘空间
版本历史
v1.0.0.2(2026-06-10)
- 修复:空文本片段不再弹出警告对话框,静默跳过
- 修复:停止按钮现在可以真正中断音频生成过程
- 修复:输出文件默认路径改为用户音乐目录
- 修复:Edge TTS 服务器 50x 错误现在会立即停止生成并提示用户
v1.0.0.1(2026-03-23)
- 升级版本号至 1.0.0.1;添加网络连接检测功能
- 对可执行文件和安装包进行数字签名,提高安全性和可信度
- 优化安装包生成流程,确保版本号正确显示
© 2026 泰州姜堰钟毓信息技术有限公司。本软件仅供教育和个人使用,未经许可不得用于商业用途。
