dsh-chatvoice:給 dsh web 增加語音輸入與回覆朗讀
dsh-chatvoice 是一款由 FuzzySoul 維護的 DSH 插件,旨在優化 DeepSeek Harness (dSH) web 界面的交互體驗,實現“語音輸入 + AI 回覆朗讀”閉環。該插件基於瀏覽器原生 Web Speech API,具備零配置、零成本、免 API key 的特點,無網絡請求或子進程。 核心功能包括:通過麥克風進行語音輸入,識別結果即時追加至輸入框,支持中途打字修改;支持對助手回覆一鍵朗讀或開啓自動朗讀,並可隨時打斷;提供設置頁以配置識別語言、音色及語速,中文場景默認使用 Edge 內置的自然音色。插件具備完善的錯誤提示機制,能針對權限拒絕、瀏覽器不支持等情
閱讀全文dsh-voice:語音輸入轉用戶消息,回覆可朗讀
DSH 插件 `dsh-voice` 旨在通過語音交互提升終端智能體效率,實現語音轉文字、文字轉語音及離開式朗讀。該插件遵循“本地優先”理念,音頻文件默認存儲於本機,不自動錄音或上傳雲端,除非用戶顯式配置 OpenAI 或 Edge-TTS 等雲端後端。其核心功能包括:`transcribe` 支持從文件轉寫或麥克風即時錄製,結果以語音卡片形式插入會話;`speak` 在後臺合成並播放文本,適合長任務狀態播報;`/voice` 命令用於切換會話級自動朗讀回覆(默認關閉)。插件兼容 Node.js >=20,支持 Whisper-local、macOS、Say 等本地後端,並可與 `dsh-cr
閱讀全文