dsh-llm-vision-bridge:在 DSH web GUI 中爲 DeepSeek 文本模型接入圖片理解

dsh-llm-vision-bridge 是一款基於 MIT 許可的 DSH 插件,旨在解決文本模型無法直接處理圖片的問題。該插件在 DSH 的 `LlmAdapter` 中註冊 `deepseek-vision` 提供商,當請求包含圖片時,自動將圖片路由至已配置的視覺模型(如 pi-ai 或本地 llama.cpp)生成文本描述,隨後由 DeepSeek 文本模型基於描述繼續對話;若無圖片,則直接透傳至後備提供商以零開銷運行。核心特性包括 LRU 緩存以避免重複描述、對 503/429 及超時錯誤的自動重試,以及可配置的失敗策略(佔位符或報錯)。 安裝後需重啓 Web 服務,並在設置中配置

閱讀全文