前言¶
DSH 以插件方式扩展 Web UI。如果希望在 DSH Web UI 中不用服务端、不用 API key、不下载模型,只在浏览器里完成麦克风听写,可以使用 dsh-mic-input。
它是一个面向 DSH Web GUI 输入框的语音输入插件:把浏览器内置的 Web Speech API 识别结果实时填入输入框,让你继续编辑或提交消息。
这是什么¶
dsh-mic-input 由 QT-Chen 维护,许可证为 MIT。它解决的是 DSH Web UI 输入场景中的语音输入问题:在输入框工具行增加麦克风按钮,点击后开始听写,识别文本进入输入框。
插件运行在浏览器端,没有服务端组件,没有 API key,也没有模型下载。
核心功能¶
麦克风按钮与实时听写¶
安装后,DSH Web GUI 输入框工具行会增加一个麦克风按钮。
点击按钮开始听写;识别文本会实时填入输入框。
草稿重建与去重¶
插件会基于录音开始时输入框中已有的文本重建草稿,并对 interim echo 做去重,避免重复文字。
静默续听¶
如果浏览器在短暂停止后自动结束听写,插件会尝试静默续听并保留会话,最多支持 6 次。
标点与语言¶
智能标点默认开启,支持三种模式:自动补全、保留原样、去除。
语言选择包括:
- 跟随系统
- 中文
zh-CN - English
en-US
自动发送与设置行¶
插件支持可选的自动发送:听写结束后自动提交消息。
相关设置位于:
设置 → 通用 → 语音输入
权限拒绝或网络错误会显示在按钮 tooltip 中,提示为双语。
安装与启用¶
先安装插件。从 GitHub 安装:
dsh plugin --profile web add github:QT-Chen/dsh-mic-input
或从 npm 安装:
dsh plugin --profile web add dsh-mic-input
安装后重启 dsh web,或刷新页面。插件要求 Node >=20.0.0;react >=18.2.0 是可选的 peerDependency。
从 GitHub 源码安装时,pnpm ≥ 10 可能要求允许构建一次(allowBuilds);npm 安装没有这一步。
典型用法¶
1、安装后进入 DSH Web UI,点击输入框右侧的麦克风按钮。
2、首次使用时,允许浏览器麦克风权限。127.0.0.1 / localhost 属于 secure context,因此可以使用麦克风。
3、点击按钮开始录音;再次点击按钮停止并保留转写内容。只有启用自动发送时,才会在听写结束后自动提交。
4、如果识别出现乱码,检查语言设置,使其与你说话的语言一致。
5、识别质量受浏览器内置引擎限制,Microsoft Edge(Microsoft Azure speech service)和 Google Chrome(Google/Chrome speech service)可能明显不同。
适用场景与注意¶
适合在本地浏览器中使用 DSH Web UI、希望用语音输入消息的人。
插件没有服务端组件、没有 API key、没有模型下载;音频交给浏览器语音服务处理,只有结果文本进入 DSH。插件不写入磁盘,无存储。
使用前后建议:
- 安装前检查源码与 MIT 许可证;插件以当前
dsh进程权限运行。 - 首次使用时确认浏览器麦克风权限。
- 如果识别质量不理想,先检查语言设置是否与实际说话语言一致。
- 如果从 GitHub 源码安装,注意
pnpm ≥ 10可能出现一次构建批准;npm 安装无此步骤。
相关链接¶
- GitHub:https://github.com/QT-Chen/dsh-mic-input
- 目录页(插件线索地址,未在本次已抓取资料中复核):https://www.skillhub.cn/plugins/QT-Chen/dsh-mic-input
社区目录是独立站点,不等同于 DeepSeek 官方应用商店。