Back to skills
extension
Category: Content & MediaNo API key required

text_to_speech

本地 TTS 语音合成 — 使用 pyttsx3 将文字转换为语音朗读,支持输出 WAV 音频文件,无需联网,完全本地运行

personAuthor: yuppiezhubgithub

本地 TTS 语音合成

When to Use

当用户需要将文字内容朗读出来或生成音频文件时使用此技能。适用于文档朗读、信息播报、无障碍辅助等场景。完全本地运行,无需联网。

Prerequisites

  • Python 3.8+
  • 安装依赖:pip install pyttsx3
  • Windows 系统自带 SAPI5 语音引擎(无需额外安装)

Steps

  1. 接收用户提供的文字内容和输出路径
  2. 初始化 pyttsx3 TTS 引擎(自动检测系统语音引擎)
  3. 设置语速、音量等参数(可选)
  4. 将文字合成为语音,输出为 WAV 音频文件
  5. 返回生成的音频文件路径

Example

python main.py --mode tts --text "AI PC 本地智能文档助手已就绪" --output ./output.wav

Note

  • macOS 使用 NSSpeechSynthesizer,Linux 使用 eSpeak
  • 生成的 WAV 文件可用系统播放器直接播放