dsh-tool-visual-primitives:爲 DSH 純文本模型補充視覺能力
# 前言 用 DeepSeek Harness(DSH)搭智能體時常會撞上同一個限制:手頭的文本模型沒有原生圖片輸入能力,界面截圖、數據圖表貼進對話,模型讀不了。沒有插件時,只能先在上游用視覺模型讀圖,再把描述手動貼回對話,鏈路斷在中間。 DSH 的理念是「一切皆插件」,這類缺口適合交給插件補齊。下面介紹的 dsh-tool-visual-primitives 就是這樣一個插件:把圖片交給外部視覺模型分析,返回帶空間定位信息的純文本視覺證據,再交回原對話模型繼續推理。被增強的模型不需要原生圖片輸入能力。 # 這是什麼 dsh-tool-visual-pr
閱讀全文