dsh-voice:DeepSeek Harness 的语音输入与朗读插件

dsh-voice 是面向 DSH Web 客户端的语音插件,旨在扩展 DeepSeek 聊天接口的语音交互能力。该插件在输入端将语音转换为文字,在输出端将文字朗读出来,并支持音频文件的转写与合成。主要功能包括:Web UI 提供麦克风按钮实现语音输入,以及助手回复的朗读按钮(基于浏览器 speechSynthesis);提供 voice_transcribe 工具通过 Whisper 兼容端点转写音频附件,以及 voice_speak 工具通过 OpenAI 兼容端点合成语音文件。该插件无需额外 API key 或新模型,支持配置 Whisper、Kokoro 等后端。安装方式为本地路径添加

阅读全文