dsh-vision-fallback:在 text-only 主模型裏保留聊天圖片
dsh-vision-fallback 是 DSH 的一款 MIT 許可插件,由 1HelloMan1 維護。它旨在解決主模型僅支持文本(text-only)但聊天框包含圖片的落差,通過插件化方式在請求層自動將圖片交給固定的視覺模型處理,轉換爲隱藏文本上下文返回給主模型,同時保留 UI 中的原圖。該插件兼容 DSH 0.1.2-alpha.3 至 0.1.2-alpha.5 版本,要求 Node 環境不低於 22.13.0。 其核心功能包括:自動處理 MCP/ACP 持久化附件及 PTC 嵌套圖片並保持順序;支持通過 Web 設置頁或 settings.yaml 配置視覺模型、Base URL
閱讀全文dsh-vision-skill:讓 DSH 純文本模型也能識圖、OCR、定位目標
dsh-vision-skill 是 DSH 生態下的標準識圖插件,由 DDDFXYqiming 開發並採用 MIT 授權。該插件旨在彌補純文本模型無法直接處理圖片的缺陷,通過註冊原生 `vision` runtime skill,讓文本模型能夠調用本地工具實現圖片識別、OCR、目標定位及主色分析等功能。 其核心工具包括:`vision_analyze`(支持通用、代碼、證據等6種模式)、`vision_ocr`(保留排版的文字提取)、`vision_ground`(返回座標的目標定位)、`vision_detect`(枚舉按鈕等元素)、`vision_dominant_colors`(本地算
閱讀全文dsh-vision-bridge:給 DeepSeek V4 / V4-Flash 的圖片消息加一層描述橋接
dsh-vision-bridge 是 DSH 的一個第三方圖片處理插件,旨在解決 DeepSeek V4 / V4-Flash 等純文本模型無法原生處理圖片上下文的問題。該插件通過調用 OpenAI 兼容的視覺語言模型(VLM),將用戶輸入的圖片自動轉換爲文字描述,再交由 DeepSeek 處理,從而在不改變原有文本流程的前提下實現圖片理解。 核心功能包括:自動識別並轉換圖片內容、動態聲明模型支持圖片輸入、請求前攔截並替換圖片塊、原生支持圖片的模型直接放行、基於 attachmentId 緩存描述以重複發送不重複計費、識別失敗時優雅降級且不中斷對話。安裝需前置 dsh CLI 與 pnpm,
閱讀全文