前言¶
DSH 的插件方式可以让 Web GUI 获得额外能力。dsh-voice-kit 是一个面向 DeepSeek Harness Web GUI 的语音插件,主要解决两个具体问题:输入阶段可以用麦克风录入语音,阅读阶段可以把助手回复朗读出来。
这是什么¶
- 插件名:
dsh-voice-kit - 维护者:
aaaadrop - 定位:Voice input and read-aloud for the DeepSeek Harness web GUI
- 许可证:MIT
核心功能¶
语音输入¶
在 composer / 输入区使用麦克风按钮。文档说明它使用 host-side transcription;转录结果会追加到草稿,而不是覆盖已有内容。按 Esc 可以取消。
回复朗读¶
朗读支持三类引擎:
- System voices
- Microsoft neural voices
- Cloud neural voices
Cloud neural voices 支持 SiliconFlow CosyVoice2,也支持任意 OpenAI-compatible audio/speech。朗读前会去掉 Markdown 和 emoji;长回复按句子边界分块流式播放。
设置项¶
Settings → Voice → Read aloud 中提供:
- 语音引擎
- one-tap cloud preset
- voice
- rate
- pitch
- recognition language
- engine reachability probe
- key status
其中 key status 只展示 saved 或 not set,不会显示 key 值。
安装与启用¶
文档给出的安装命令:
dsh plugin add dsh-voice-kit
启用步骤:
1、安装插件。
2、重启 DSH Desktop。
3、刷新 Web GUI。
文档材料还提到:
- 版本
0.4.0被描述为已发布到 npm pnpm typecheck通过- 239 个单元测试通过
peerDependencies 至少包含:
@deepseek-ai/cordis ^4.0.1- 多个
@deepseek-ai/dsh-*包,版本为^0.1.0-rc.6 React ^18.2.0
典型用法¶
先测试朗读¶
打开:
Settings → Voice → Read aloud
先选择引擎,再按 Play test:
- System voice:文档说明 always work,适合作为离线可用选项
- Microsoft neural:需要 proxy / Edge reachability
- Cloud neural:需要 key;可选择
SiliconFlow CosyVoice2等 OpenAI-compatible audio/speech
配置语音输入¶
先做语音输入配置。Cloud TTS 和 recognition 共用同一个 credential;如果语音输入已配置好,云端朗读可以复用同一 credential。
用麦克风录入¶
打开 composer 中的麦克风按钮,开始说话。再次按下该按钮,或按 Esc 停止。转录文本会追加到草稿。
适用场景与注意¶
适合:
- 在 DSH Web GUI 中减少键盘输入
- 想听长助手回复
- 希望同时配置语音输入与朗读
注意:
- 引擎要求不同:System voices always work;Microsoft neural 需要 proxy / Edge reachability;Cloud neural 需要 key。
- key status 只显示
saved / not set。 - 插件以当前 DSH 进程权限运行;安装前建议检查源码、依赖与许可证。
- 插件本体为 MIT 许可证;内置
shared/tsdown.client.ts改编自 official DSH build tooling(MIT)和 dsh-web-uilibExternal选项(Apache-2.0)。 - 社区目录属于独立站点,与 DeepSeek / 幻方没有官方从属关系,不应视为官方应用商店。
链接¶
- GitHub:
https://github.com/aaaadrop/dsh-voice-kit - 插件线索中的目录页:
https://www.skillhub.cn/plugins/aaaadrop/dsh-voice-kit(未在本轮已核实材料中独立验证,访问前请自行确认)