dsh-dictate:把語音輸入接入 DSH Composer
dsh-dictate 是面向 DeepSeek Harness (DSH) Composer 的上下文感知語音輸入插件,旨在通過語音輸入長提示詞或代碼說明,轉寫結果保留在輸入框供用戶審閱修改,不啓動雙向語音會話。 該插件默認使用 Chrome 或 Edge 的 Web Speech API 進行瀏覽器識別,錄音時顯示即時轉寫;在 Apple Silicon Mac 和 Windows x64 平臺上,可選用本地 SenseVoice 模型進行增強轉寫,需下載約 253 MB 模型文件。其核心優勢包括上下文感知(參考最近 6 條對話優化用詞)、中英混合識別優化以及嚴格的發送控制(默認不自動發送
閱讀全文dsh-better-input:爲 DeepSeek Harness 增加語音輸入、AI 潤色與文件轉 Markdown
dsh-better-input 是面向 DeepSeek Harness (DSH) Web UI 的輸入增強插件,由 DIAG5 維護,採用 MIT 許可證。該插件旨在優化長提示詞、本地文檔及口述內容的輸入路徑,主要功能包括: 1. **語音輸入**:基於 Web Speech API 本地識別,無需 API Key,即時流式轉寫,支持自定義錄音時長。 2. **AI 潤色與優化**:複用 DSH 已配置模型,自動清理語音識別錯誤、去口頭禪,並對提示詞進行精準化優化,支持原文對比與撤銷。 3. **提示詞模板**:模板存儲在本地,輸入 `/` 即可快速插入,確保數據隱私。 4. **文件處
閱讀全文DSH Web 語音輸入插件:anweat/dsh-voice-webspeech
`anweat/dsh-voice-webspeech` 是一款面向 DSH Web GUI 的瀏覽器語音輸入插件,採用 MIT 許可。該插件利用瀏覽器內置 Web Speech API 實現“按住說話、鬆手轉文字”功能,將語音即時轉換爲文字並寫入輸入框,支持後續編輯或配置爲鬆手自動發送。其核心優勢在於零服務端、零 API Key、零模型下載及零 Python 依賴,音頻僅由瀏覽器處理,不經過 DSH 服務端、不落盤且無遙測,確保隱私安全。插件支持中、英、日、韓等多種 BCP-47 語言,偏好設置保存在瀏覽器本地。 環境要求方面,需 DSH 版本 `>=0.1.0-rc.3 <0.2.0`、N
閱讀全文dsh-audio-copilot:爲 DeepSeek Harness 增加聊天框語音輸入
dsh-audio-copilot 是 ai-yucheng 維護的 DSH 語音輸入插件,基於 DSH 0.1.0-rc.7,採用 MIT 許可證。該插件允許用戶在聊天框點擊麥克風按鈕說話,通過多引擎 ASR 轉寫後自動將文本填入輸入框。支持 zhipu、local、gemini 和 openai 四種引擎:zhipu 擅長中文多方言及外語,按量計費;local 使用 faster-whisper 離線轉寫,需下載約 460MB-1.5GB 模型;gemini 免費檔有限流及自動重試機制;openai 作爲可選引擎。前置條件包括 DSH Desktop、Node.js ≥ 20 及 PATH
閱讀全文dsh-voice-kit:爲 DeepSeek Harness Web GUI 增加語音輸入與回覆朗讀
`dsh-voice-kit` 是一個面向 DeepSeek Harness Web GUI 的 MIT 許可證語音插件,旨在增強交互體驗,主要解決語音輸入和回覆朗讀兩個需求。該插件支持通過麥克風進行語音錄入,轉錄結果會追加至草稿;同時支持系統、微軟神經及雲端神經(如 SiliconFlow CosyVoice2)三類朗讀引擎,能自動清理 Markdown 並分塊流式播放長文本。用戶在設置中可配置引擎、語速、音調及識別語言,密鑰狀態僅顯示保存狀態而不泄露數值。安裝需執行 `dsh plugin add dsh-voice-kit`,隨後重啓 DSH Desktop 並刷新 GUI。該插件要求
閱讀全文dsh-smart-input:DeepSeek Harness 的語音輸入與提示詞優化插件
dsh-smart-input 是由 v-quest123456 維護、採用 MIT 許可證的 DeepSeek Harness(DSH)Web 客戶端插件,旨在解決提示詞手寫不完整及語音轉文字缺乏反饋的問題。其核心功能包括語音輸入和提示詞優化。語音輸入支持瀏覽器 Web Speech API、本地 Whisper ONOX 及在線 Whisper API,具備即時流式轉寫、智能標點、中英日多語言支持及連續對話模式,快捷鍵爲 Ctrl/Cmd + Shift + V。提示詞優化提供自動、簡潔化、結構化等六種策略,支持上下文感知(注入工作區文件信息)、前後對比及一鍵採納,快捷鍵爲 Ctrl/Cm
閱讀全文dsh-plugin-voice-input:DSH Web 輸入框裏的本地語音轉草稿
`dsh-plugin-voice-input` 是一款由 tangbut1 開發的 DeepSeek Harness Web 語音輸入插件,採用 MIT 協議開源。該插件旨在解決 Web 輸入框中長句或中英夾雜內容輸入不便的問題,通過在輸入框旁增加“按住說話”麥克風按鈕,實現本機離線語音識別。用戶按住按鈕錄音,鬆開後系統利用 `sherpa-onnx-node` 和 `SenseVoice-SSmall INT8` 模型在本地迴環地址(127.0.0.1:18765)進行離線識別,支持中、英、日、韓、粵等多語言自動檢測。識別結果通過 DSH 官方 slot 和事件追加到當前草稿,不自動發送,
閱讀全文voco-input-sh:DeepSeek Harness 的 VocoType 語音輸入插件
voco-input-sh 是一個 DSH web 插件,旨在將 VocoType 的本地離線語音識別集成到聊天輸入框中,減少對外部工具的依賴。該插件基於 MIT 許可,版本 0.2.0,主要功能包括在輸入框旁提供麥克風按鈕,啓動 VocoType 進行語音識別,並將結果自動插入草稿區,同時具備智能去重功能。它支持 Paraformer 中文識別、VAD 及標點預測,能自動檢測、啓動甚至靜默安裝 VocoType(需下載約 25MB 安裝包及 1.6GB 模型)。 安裝需在 DSH profile 目錄使用 pnpm 添加本地包,並在 `cordis.patch.yml` 中配置掛載,隨後重啓
閱讀全文dsh-stt-input:爲 DSH Web GUI 增加語音輸入
`dsh-stt-input` 是 DeepSeek Harness (DSH) Web GUI 的語音輸入插件,旨在解決在 DSH 中通過語音快速輸入長提示詞的需求。該插件允許用戶點擊麥克風按鈕錄音,停止後將識別文字直接填入輸入框。它提供兩種識別引擎:一是基於 Web Speech API 的瀏覽器本地識別,支持 Chrome/Edge 零配置使用並即時顯示中間結果;二是基於 MediaRecorder 和 OpenAI 兼容接口的 API 識別,支持 OpenAI、Groq 或自定義服務及多種 Whisper 模型。插件支持配置服務預設、API 密鑰、語言及寫入方式(追加或替換)。API
閱讀全文dsh-mic-input:DSH Web UI 的瀏覽器麥克風輸入插件
`dsh-mic-input` 是由 QT-Chen 維護的 DSH Web UI 語音輸入插件,採用 MIT 許可證。它完全在瀏覽器端運行,無需服務端、API key 或模型下載,利用 Web Speech API 實現麥克風聽寫。核心功能包括:在輸入框工具行添加麥克風按鈕以開始即時聽寫;通過草稿重建與去重機制避免文本重複;支持最多 6 次的靜默續聽以維持會話;提供智能標點(自動補全、保留、去除)及中文、英文或跟隨系統的語言選擇;並支持可選的自動發送消息。用戶可從 GitHub 或 npm 安裝,要求 Node.js 版本不低於 20.0.0。安裝後重啓 DSH Web 或刷新頁面即可生效。
閱讀全文dsh-voice-input-web:爲 DeepSeek Harness Web 輸入框增加語音轉寫
dsh-voice-input-web 是面向 DeepSeek Harness Web UI 的客戶端插件,旨在通過瀏覽器 Web Speech API 實現語音轉文字,無需 API 密鑰或服務端改動。該插件在聊天輸入框工具行添加麥克風按鈕,用戶點擊即可開始或停止聆聽,識別中的即時結果會顯示在浮層中,最終文本自動追加至輸入框草稿。支持中文、英文及自動語言切換,並可選開啓自動發送功能。安裝方式分爲在線與離線兩種,在線僅需執行 `dsh plugin --profile web add dsh-voice-input-web` 命令並重啓服務;離線安裝則需手動放置包文件並配置 patch 文件。
閱讀全文@zhangbo-cn/dsh-client-ui-voice-input:給 DeepSeek Harness Web 增加 composer 語音輸入與回覆朗讀
`@zhangbo-cn/dsh-client-ui-voice-input` 是一款由 Zhangbo-cn 維護的 MIT 許可插件,用於增強 DeepSeek Harness Web UI 的語音交互。該插件在 composer 區域添加 mic 按鈕,基於瀏覽器 Web Speech API 實現語音轉文本,無需 API key。核心功能包括:點按麥克風開始監聽,即時將識別結果逐字寫入草稿;按住麥克風說話並鬆開後自動發送消息;在滿足條件時,通過宿主 Edge TTS 或瀏覽器 `speechSynthesis` 朗讀助手回覆。插件支持靜默重啓識別以維持監聽,並可選配置自動發送。安裝只需
閱讀全文dsh-ears:DeepSeek Harness 的開源語音輸入插件
`dsh-ears` 是 DeepSeek Harness (DSH) 的開源語音輸入插件(v0.2.1,MIT 協議),旨在通過語音識別和可選潤色功能優化 Web UI 中的文本輸入體驗。該插件支持多種識別後端,包括 Web Speech、本地 Whisper、Groq、Deepgram、阿里雲百鍊、騰訊雲、小米 MiMo、硅基流動及自定義 OpenAI 兼容接口。其核心工作流是將語音轉寫爲可編輯草稿,默認開啓潤色功能以優化文本,但不會自動發送消息,確保用戶擁有最終控制權。安裝需 DSH 版本 0.1.0-rc.6 至 0.1.1-rc.2 及 Node.js ^22.19.0 或 >=24
閱讀全文用 dsh-voice 給 DeepSeek Harness 補上口述輸入和語音朗讀
dsh-voice 是 Jesse-njx 維護的 DeepSeek Harness 工具插件,用 transcribe 把口述或音頻文件變成用戶消息,用 speak 在後臺朗讀且不阻塞回合,並用 /voice 按會話開關自動讀回覆。音頻默認落在 ~/.dsh/voice/,會話日誌只保存引用和轉寫。許可證 MIT,版本 0.1.0。安裝以目錄頁命令 dsh plugin add github:Jesse-njx/dsh-voice 爲準。默認走離線後端,openai 與 edge-tts 不會被自動選中;v0.1 不做即時對講或喚醒詞。
閱讀全文