前言¶
在 DSH 的插件体系中,客户端能力可以通过插件扩展到 Web UI。dsh-voice-input-web 就是这样一个插件:它给 DeepSeek Harness Web UI 的聊天输入框工具行增加一个麦克风按钮,让浏览器 Web Speech API 将语音实时转成文字,并追加到输入框草稿中。
它不需要 API 密钥,也不要求服务端改动。下面介绍它的功能、安装方式、配置项和使用限制。
这是什么¶
dsh-voice-input-web 是面向 Web 平台的 DeepSeek Harness 客户端插件。它的目标是把语音输入接入聊天输入框:
- 在聊天输入框工具行添加麦克风按钮
- 点击按钮开始或停止聆听
- 使用浏览器 Web Speech API 实时转写语音
- 将识别完成的最终文本追加到输入框草稿
已核实资料中的 npm 包名、插件 id 和 localStorage key 统一使用 dsh-voice-input-web。许可证为 MIT。仓库地址:
https://github.com/CrazyGummies/dsh-voice-input
已核实资料未给出星标数,本文不写具体星标数据。
核心功能¶
麦克风按钮¶
插件会在 DeepSeek Harness Web GUI 聊天输入框工具行添加麦克风按钮。点击按钮可以开始或停止聆听。
实时转写浮层¶
聆听过程中,浮层会实时显示转写中间结果。
最终文本进入草稿¶
识别完成后的最终文本会自动追加到输入框草稿中。之后仍可按输入框原有方式编辑和发送。
识别语言¶
插件支持一键切换识别语言:
- 中文:
zh-CN - English:
en-US - 自动:
auto
可选自动发送¶
如果设置 dsh-voice-input-web.autoSend 为 "1",一段语音识别完成后会自动发送。
实现方式¶
插件被描述为零依赖、零密钥、无服务端改动。识别通过浏览器 Web Speech API 完成;语音识别需要联网,由浏览器调用系统语音服务。
安装与启用¶
在线安装¶
先安装插件:
dsh plugin --profile web add dsh-voice-input-web
安装后重启 web profile,并刷新浏览器页面:
dsh --profile web
经过上面的步骤,麦克风按钮会出现在输入框工具行。
离线安装¶
离线安装按下面三步做:
- 将包放入 web profile 的 node_modules 目录:
~/.dsh/profiles/web/node_modules/dsh-voice-input-web/
- 在
~/.dsh/profiles/web/cordis.patch.yml追加:
- insert:
- id: dsh-voice-input-web
name: 'dsh-voice-input-web'
- 重启 web profile,并刷新浏览器页面:
dsh --profile web
离线安装时,插件 id、包目录名和 localStorage key 都使用 dsh-voice-input-web。已核实资料提到,dsh-voice-input 在 npm 上已被同名 SenseVoice 方案占用,因此注意不要混淆包名。
典型用法¶
切换识别语言¶
在浏览器 localStorage 中写入语言配置:
localStorage.setItem('dsh-voice-input-web.lang', 'zh-CN');
也可以改为:
localStorage.setItem('dsh-voice-input-web.lang', 'en-US');
或:
localStorage.setItem('dsh-voice-input-web.lang', 'auto');
自动发送¶
开启自动发送:
localStorage.setItem('dsh-voice-input-web.autoSend', '1');
关闭自动发送:
localStorage.setItem('dsh-voice-input-web.autoSend', '0');
适用场景与注意¶
这个插件适合在支持 Web Speech API 的浏览器中使用,例如 Chrome / Edge,或其他支持 webkitSpeechRecognition 的浏览器。Firefox 不支持 Web Speech API,会显示提示。
使用前需要确认:
- 页面在
localhost/127.0.0.1或 HTTPS 下访问 - 浏览器可调用系统语音服务
- 语音识别需要联网
- 插件是客户端插件,以当前 dsh 进程权限运行;安装前应检查源码与许可证
已核实资料给出的许可证为 MIT。
结尾¶
dsh-voice-input-web 的价值在于:在 DeepSeek Harness Web UI 的输入框中增加一个低配置的语音入口,把浏览器 Web Speech API 的转写结果直接并入聊天草稿。它适合需要快速输入、且浏览器环境支持 Web Speech API 的场景。
已核实资料未提供目录页 URL,因此本文不列出目录页链接。GitHub 仓库:
https://github.com/CrazyGummies/dsh-voice-input