dsh-voice:DSH 的 TTS 与 STT 插件
dsh-voice 是一款基于 DSH 框架的语音处理插件,旨在为智能体提供简化的 TTS(文字转语音)和 STT(语音转文字)工具能力。该插件采用 MIT 许可证,要求 Node.js 版本在 22 及以上,运行时无需依赖内部模块,通过原生 WebSocket 实现通信。 其核心功能包含三个工具:`voice_tts` 支持将文本免费合成为 MP3 文件,支持自定义音色、语速等参数,零配置即可使用;`voice_stt` 用于音频转文字,支持 OpenAI 兼容接口,需配置 ASR 密钥(建议通过环境变量管理);`voice_list` 则用于查询可用音色列表。 插件通过 `dsh plug
阅读全文用 dsh-voice 给 DeepSeek Harness 补上口述输入和语音朗读
dsh-voice 是 Jesse-njx 维护的 DeepSeek Harness 工具插件,用 transcribe 把口述或音频文件变成用户消息,用 speak 在后台朗读且不阻塞回合,并用 /voice 按会话开关自动读回复。音频默认落在 ~/.dsh/voice/,会话日志只保存引用和转写。许可证 MIT,版本 0.1.0。安装以目录页命令 dsh plugin add github:Jesse-njx/dsh-voice 为准。默认走离线后端,openai 与 edge-tts 不会被自动选中;v0.1 不做实时对讲或唤醒词。
阅读全文使用PaddlePaddle轻松实现语音合成
本文介绍了使用PaddlePaddle进行语音合成的实现方法,包括简单的代码示例、GUI界面操作以及Flask Web接口。首先通过简单程序实现了文本到语音的基本功能,利用声学模型和声码器模型完成合成过程,并将结果保存为音频文件;其次介绍了`gui.py`界面程序用于简化用户操作体验;最后展示了使用`server.py`提供的Flask Web服务,能够供Android应用或小程序调用以实现远程语
阅读全文