dsh-mic-input:DSH Web UI 的浏览器麦克风输入插件
`dsh-mic-input` 是由 QT-Chen 维护的 DSH Web UI 语音输入插件,采用 MIT 许可证。它完全在浏览器端运行,无需服务端、API key 或模型下载,利用 Web Speech API 实现麦克风听写。核心功能包括:在输入框工具行添加麦克风按钮以开始实时听写;通过草稿重建与去重机制避免文本重复;支持最多 6 次的静默续听以维持会话;提供智能标点(自动补全、保留、去除)及中文、英文或跟随系统的语言选择;并支持可选的自动发送消息。用户可从 GitHub 或 npm 安装,要求 Node.js 版本不低于 20.0.0。安装后重启 DSH Web 或刷新页面即可生效。
阅读全文dsh-voice-input-web:为 DeepSeek Harness Web 输入框增加语音转写
dsh-voice-input-web 是面向 DeepSeek Harness Web UI 的客户端插件,旨在通过浏览器 Web Speech API 实现语音转文字,无需 API 密钥或服务端改动。该插件在聊天输入框工具行添加麦克风按钮,用户点击即可开始或停止聆听,识别中的实时结果会显示在浮层中,最终文本自动追加至输入框草稿。支持中文、英文及自动语言切换,并可选开启自动发送功能。安装方式分为在线与离线两种,在线仅需执行 `dsh plugin --profile web add dsh-voice-input-web` 命令并重启服务;离线安装则需手动放置包文件并配置 patch 文件。
阅读全文@zhangbo-cn/dsh-client-ui-voice-input:给 DeepSeek Harness Web 增加 composer 语音输入与回复朗读
`@zhangbo-cn/dsh-client-ui-voice-input` 是一款由 Zhangbo-cn 维护的 MIT 许可插件,用于增强 DeepSeek Harness Web UI 的语音交互。该插件在 composer 区域添加 mic 按钮,基于浏览器 Web Speech API 实现语音转文本,无需 API key。核心功能包括:点按麦克风开始监听,实时将识别结果逐字写入草稿;按住麦克风说话并松开后自动发送消息;在满足条件时,通过宿主 Edge TTS 或浏览器 `speechSynthesis` 朗读助手回复。插件支持静默重启识别以维持监听,并可选配置自动发送。安装只需
阅读全文dsh-ears:DeepSeek Harness 的开源语音输入插件
`dsh-ears` 是 DeepSeek Harness (DSH) 的开源语音输入插件(v0.2.1,MIT 协议),旨在通过语音识别和可选润色功能优化 Web UI 中的文本输入体验。该插件支持多种识别后端,包括 Web Speech、本地 Whisper、Groq、Deepgram、阿里云百炼、腾讯云、小米 MiMo、硅基流动及自定义 OpenAI 兼容接口。其核心工作流是将语音转写为可编辑草稿,默认开启润色功能以优化文本,但不会自动发送消息,确保用户拥有最终控制权。安装需 DSH 版本 0.1.0-rc.6 至 0.1.1-rc.2 及 Node.js ^22.19.0 或 >=24
阅读全文用 dsh-voice 给 DeepSeek Harness 补上口述输入和语音朗读
dsh-voice 是 Jesse-njx 维护的 DeepSeek Harness 工具插件,用 transcribe 把口述或音频文件变成用户消息,用 speak 在后台朗读且不阻塞回合,并用 /voice 按会话开关自动读回复。音频默认落在 ~/.dsh/voice/,会话日志只保存引用和转写。许可证 MIT,版本 0.1.0。安装以目录页命令 dsh plugin add github:Jesse-njx/dsh-voice 为准。默认走离线后端,openai 与 edge-tts 不会被自动选中;v0.1 不做实时对讲或唤醒词。
阅读全文