dsh-tool-visual-primitives:为 DSH 纯文本模型补充视觉能力
# 前言 用 DeepSeek Harness(DSH)搭智能体时常会撞上同一个限制:手头的文本模型没有原生图片输入能力,界面截图、数据图表贴进对话,模型读不了。没有插件时,只能先在上游用视觉模型读图,再把描述手动贴回对话,链路断在中间。 DSH 的理念是「一切皆插件」,这类缺口适合交给插件补齐。下面介绍的 dsh-tool-visual-primitives 就是这样一个插件:把图片交给外部视觉模型分析,返回带空间定位信息的纯文本视觉证据,再交回原对话模型继续推理。被增强的模型不需要原生图片输入能力。 # 这是什么 dsh-tool-visual-pr
阅读全文