DeepSeek VisionPlus:文本走 DeepSeek,圖片自動路由到免費視覺模型池

前言

用 DeepSeek Harness(DSH)時有一個繞不開的限制:DeepSeek 官方模型是純文本模型,本身不能看圖。消息裏出現截圖、圖表或界面照片,要麼人工把內容轉述成文字,要麼把整段對話切到別的多模態模型,上下文就斷了。

DeepSeek VisionPlus 走的是另一條路:文本請求繼續由 DeepSeek 官方 API 處理,消息中出現圖片時自動路由到免費視覺模型池,理解結果回到同一對話。DSH 的理念是一切皆插件,這個能力就是以插件形態實現的。下面介紹它的功能、安裝和日常用法。

這是什麼

DeepSeek VisionPlus(npm 包名 dsh-visionplus,版本 1.0.0)是面向 DeepSeek Harness 的視覺插件,由 qq247505 維護,MIT 許可證。一句話定位:文本走 DeepSeek 官方 API,圖片自動路由到免費視覺模型池。

它是零補丁插件:不修改 Harness 源碼,源碼運行、桌面端、npm 任一安裝方式,裝上即完整形態。

核心功能

自動視覺路由

消息中出現圖片——選圖、粘貼,或模型自主調用 read_image——自動交給視覺池處理;無圖請求仍走 DeepSeek,推理等級(Off/High/Max)原樣保留。

設置卡片

設置 → 橋接視覺 是一個獨立欄目。在這裏可以添加視覺模型、配置密鑰、編輯模型目錄(模型 ID、名稱、上下文窗口、最大輸出,支持 K/M 單位),保存即時生效。

輸入框圖片按鈕

選中視覺變體後,輸入框出現圖片按鈕,支持選圖、多選、拖拽即發。

一鍵測試

DeepSeek 與每個視覺模型都有測試按鈕。流程是先校驗參數(密鑰、地址、模型 ID、官方上限),再按官方對接方式發起真實請求,結果以氣泡提示,3 秒消失。

免費額度保護

免費視覺模型頻率有限,插件做了三層保護:

1、視覺池順序輪換 + 限頻(最小間隔、每分鐘上限、失敗冷卻);
2、單個模型失敗自動換下一個;
3、全部失敗時如實拋回,由 DeepSeek 自行決策本輪怎麼處理。

狀態行、緩存與視覺記憶

對話裏會顯示「正在調用 xx 處理圖片…」「成功」或失敗原因。

另外兩項和長會話相關的能力:

  • 內容哈希緩存:同圖 + 同問題 + 同模型自動複用上次結果,不重複調用視覺接口,LRU 上限 64;
  • 視覺記憶:視覺結果以帶標記的對話行留存,會話壓縮(compaction)後自動補回最近 4 條,長線任務不丟視覺上下文。

自主看圖引導

選中視覺變體的會話會自動獲得看圖引導:模型主動調用 read_image、一次讀 1-2 張、失敗單獨重試。切回 DeepSeek 原生模型即自動移除,不影響其他會話。

安裝與啓用

要求:已安裝官方 DeepSeek Harness(桌面端或命令行運行均可)、pnpm,Node >= 20。

dsh plugin --profile web add github:qq247505/DeepSeek-VisionPlus

裝好後按下面的步驟配置:

1、重啓 Harness,打開 設置 → 橋接視覺 卡片;
2、DeepSeek 塊填入 DEEPSEEK_API_KEY(API 地址默認官方 https://api.deepseek.com),點「測試」驗證;
3、點「+ 智譜(GLM)」或「+ Qwen(千問)」添加視覺模型,填入對應密鑰(GLM_API_KEY / SILICONFLOW_API_KEY),各點「測試」驗證;
4、保存後,在對話頁模型選擇器選擇 DeepSeek-V4-Pro 視覺(或 Flash 視覺);
5、輸入框點圖片按鈕發圖,或讓模型自主 read_image,視覺任務自動路由。

預置了三個視覺模型,規格如下:

視覺模型 模型 上下文 最大輸出
智譜 GLM glm-4.1v-thinking-flash 64K 16K
智譜 GLM glm-4.6v-flash 128K 32K
SiliconFlow Qwen/Qwen3-VL-8B-Instruct 64K 16K

實現細節

幾點值得留意的設計:

  • 設置存儲在插件自有命名空間,通過插件自掛接口 /api/visionPlus.settings 讀寫,不借用 llm-pi-ai;
  • 內部視覺線路不會出現在模型選擇器,用戶只能選到對外暴露的視覺變體;
  • 會話級模型切換接管 agentDefaultModel.saveSelection,切換隻影響當前會話,不污染全局默認;
  • 以上全部是插件運行時能力,沒有對 Harness 源碼打補丁。

常見問題

  • 測試報 401:檢查密鑰是否填寫正確;
  • 測試報 404:檢查 API 地址與模型 ID;
  • 視覺請求 429:免費模型頻率有限,插件自帶限頻,稍後重試;
  • 想再加視覺模型:點「+ 自定義模型」,按對方官方文檔填寫。

適用場景與注意

適合的場景:日常以 DeepSeek 官方模型爲主力,偶爾需要看截圖、圖表、界面,不想爲此切換整個對話模型;長會話希望視覺上下文在壓縮後不丟;想保持 DSH 環境乾淨、不願改源碼的。

注意兩點:

1、免費視覺模型頻率有限,重度看圖需求要接受輪換和限頻的存在,遇 429 稍後重試;
2、插件以當前 dsh 進程的權限運行,安裝任何第三方插件前建議先查看倉庫源碼與許可證(本項目爲 MIT)。

卸載

dsh plugin --profile web remove dsh-visionplus

零補丁插件,卸載即乾淨,無需回退任何宿主改動。

小結

DeepSeek VisionPlus 解決的問題很具體:讓純文本的 DeepSeek 在 DSH 裏能看圖,同時不改變原有的文本鏈路和推理設置。裝一個插件、填幾個密鑰就能用,卸載也不留痕跡。如果你在用 DSH,可以試一試。

  • GitHub 倉庫:https://github.com/qq247505/DeepSeek-VisionPlus
  • 社區目錄收錄頁:https://www.skillhub.cn/plugins/qq247505/DeepSeek-VisionPlus

社區目錄爲獨立站點,與 DeepSeek、幻方無官方從屬關係;插件信息以 GitHub 倉庫爲準。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜