dsh-vision:讓文本模型在 DSH 中處理帶圖請求

dsh-vision 是一個 DSH 插件,旨在解決 DeepSeek V4 Flash/Pro 等文本模型無法直接處理圖片的問題。當請求包含圖片且目標模型不支持視覺輸入時,該插件自動調用視覺模型或系統 OCR 對圖片進行描述,並將 provider 調用中的圖片塊替換爲文本描述,確保模型能繼續處理上下文。會話日誌和 UI 界面仍保留原始圖片。 插件提供 Auto 和指定模型兩種模式。Auto 模式按順序嘗試已聲明視覺能力的模型,失敗則回退至系統 OCR(macOS 用 Vision,Windows 用 Media.Ocr,其他平臺需 Tesseract)。指定模式僅使用配置模型,失敗不重試。

閱讀全文
dsh-image-reader:爲 DeepSeek Harness 智能體提供 read_image 圖片讀取工具

`dsh-image-reader` 是一個 MIT 許可證的 DeepSeek Harness 插件,旨在爲僅支持文本的智能體提供圖片讀取能力。該插件通過暴露 `read_image` 工具,允許智能體利用任意 OpenAI-compatible vision endpoint 解析工作區內的截圖、圖表或照片,並基於圖像內容回答問題。 核心特性包括:支持傳入圖片路徑及可選查詢問題;配置靈活,涵蓋 `baseUrl`、`model`、超時時間及允許目錄等;安全機制完善,API key 從環境變量動態讀取,路徑經 `realpath` 解析以阻止符號鏈接繞過,且上傳前進行大小與擴展名檢查。 使用

閱讀全文
dsh-xiapan-media:給 DeepSeek Harness 增加視覺、作圖和視頻生成

`dsh-xiapan-media` 是一個面向 DeepSeek Harness (DSH) 的客戶端插件,旨在通過對接蝦盤雲服務,將視覺理解、圖片生成和視頻生成能力集成至現有文本會話中。該插件由 `dongsheng123132` 維護,採用 MIT 許可,要求 Node.js >=22.19.0。 核心功能包括:利用 `xiapan-vision` 路由實現圖片理解與 OCR,支持直接粘貼圖片並由後端轉譯爲文本;通過 `gpt-image-2` 模型進行圖片生成與修改;以及調用 Seedance 服務生成 5-15 秒的視頻。插件支持通過 `cordis.patch.yml` 獨立安裝或

閱讀全文