dsh-llm-vision-bridge:在 DSH web GUI 中为 DeepSeek 文本模型接入图片理解

dsh-llm-vision-bridge 是一款基于 MIT 许可的 DSH 插件,旨在解决文本模型无法直接处理图片的问题。该插件在 DSH 的 `LlmAdapter` 中注册 `deepseek-vision` 提供商,当请求包含图片时,自动将图片路由至已配置的视觉模型(如 pi-ai 或本地 llama.cpp)生成文本描述,随后由 DeepSeek 文本模型基于描述继续对话;若无图片,则直接透传至后备提供商以零开销运行。核心特性包括 LRU 缓存以避免重复描述、对 503/429 及超时错误的自动重试,以及可配置的失败策略(占位符或报错)。 安装后需重启 Web 服务,并在设置中配置

阅读全文