dsh-tool-visual-primitives:为 DSH 纯文本模型补充视觉能力

# 前言 用 DeepSeek Harness(DSH)搭智能体时常会撞上同一个限制:手头的文本模型没有原生图片输入能力,界面截图、数据图表贴进对话,模型读不了。没有插件时,只能先在上游用视觉模型读图,再把描述手动贴回对话,链路断在中间。 DSH 的理念是「一切皆插件」,这类缺口适合交给插件补齐。下面介绍的 dsh-tool-visual-primitives 就是这样一个插件:把图片交给外部视觉模型分析,返回带空间定位信息的纯文本视觉证据,再交回原对话模型继续推理。被增强的模型不需要原生图片输入能力。 # 这是什么 dsh-tool-visual-pr

閱讀全文
dsh-vision-helper:DeepSeek Harness 的持久化視覺插件

dsh-vision-helper 是爲 DSH 打造的零依賴持久化視覺插件,旨在低侵入地集成圖片分析能力。它註冊 `vision_analyze` 工具,支持本地路徑或 data: URI 輸入,通過配置的多模態模型返回分析文字。插件允許自定義 provider、model、溫度、最大輸出 tokens 及圖片邊長,配置即時生效無需重啓,並在 Web 端提供專屬設置界面。其核心優勢包括無額外依賴、全局可用、持久化存儲以及自動處理不可見字符和去重等健壯性機制。安裝支持 npm、GitHub 或手動複製,需在 llm-pi-ai 中預先配置好模型路由或兼容端點。用戶可通過 Web 設置頁或 JS

閱讀全文