本地 TTS 语音合成
When to Use
当用户需要将文字内容朗读出来或生成音频文件时使用此技能。适用于文档朗读、信息播报、无障碍辅助等场景。完全本地运行,无需联网。
Prerequisites
- Python 3.8+
- 安装依赖:
pip install pyttsx3 - Windows 系统自带 SAPI5 语音引擎(无需额外安装)
Steps
- 接收用户提供的文字内容和输出路径
- 初始化 pyttsx3 TTS 引擎(自动检测系统语音引擎)
- 设置语速、音量等参数(可选)
- 将文字合成为语音,输出为 WAV 音频文件
- 返回生成的音频文件路径
Example
python main.py --mode tts --text "AI PC 本地智能文档助手已就绪" --output ./output.wav
Note
- macOS 使用 NSSpeechSynthesizer,Linux 使用 eSpeak
- 生成的 WAV 文件可用系统播放器直接播放
Scan to join WeChat group