dsh-voice:DSH 的 TTS 與 STT 插件

dsh-voice 是一款基於 DSH 框架的語音處理插件,旨在爲智能體提供簡化的 TTS(文字轉語音)和 STT(語音轉文字)工具能力。該插件採用 MIT 許可證,要求 Node.js 版本在 22 及以上,運行時無需依賴內部模塊,通過原生 WebSocket 實現通信。 其核心功能包含三個工具:`voice_tts` 支持將文本免費合成爲 MP3 文件,支持自定義音色、語速等參數,零配置即可使用;`voice_stt` 用於音頻轉文字,支持 OpenAI 兼容接口,需配置 ASR 密鑰(建議通過環境變量管理);`voice_list` 則用於查詢可用音色列表。 插件通過 `dsh plug

閱讀全文
用 dsh-voice 給 DeepSeek Harness 補上口述輸入和語音朗讀

dsh-voice 是 Jesse-njx 維護的 DeepSeek Harness 工具插件,用 transcribe 把口述或音頻文件變成用戶消息,用 speak 在後臺朗讀且不阻塞回合,並用 /voice 按會話開關自動讀回覆。音頻默認落在 ~/.dsh/voice/,會話日誌只保存引用和轉寫。許可證 MIT,版本 0.1.0。安裝以目錄頁命令 dsh plugin add github:Jesse-njx/dsh-voice 爲準。默認走離線後端,openai 與 edge-tts 不會被自動選中;v0.1 不做即時對講或喚醒詞。

閱讀全文
輕鬆快速搭建一個本地的語音合成服務

本文介紹了一種快速搭建本地語音合成服務的方法,使用VITS模型結構。首先需要安裝PyTorch環境和相關依賴庫。啓動服務時只需運行`server.py`程序。此外,還提供了Android應用源碼,並需修改服務器地址以連接到你的本地服務。文章末尾提示掃碼加入知識星球獲取完整源碼。整個過程簡單高效,無需聯網即可運行。

閱讀全文
使用PaddlePaddle輕鬆實現語音合成

本文介紹了使用PaddlePaddle進行語音合成的實現方法,包括簡單的代碼示例、GUI界面操作以及Flask Web接口。首先通過簡單程序實現了文本到語音的基本功能,利用聲學模型和聲碼器模型完成合成過程,並將結果保存爲音頻文件;其次介紹了`gui.py`界面程序用於簡化用戶操作體驗;最後展示了使用`server.py`提供的Flask Web服務,能夠供Android應用或小程序調用以實現遠程語

閱讀全文