dsh-tool-vision-read:讓純文本 agent 也能「看見」圖片的 DSH 插件

# 前言 做智能體開發常碰到這樣一個缺口:主 agent 用的模型路由沒有聲明 image 輸入,是個純文本模型。用戶丟過來一個圖片路徑讓它描述,它做不到——要麼手動換到有視覺能力的會話,要麼自己看一眼圖再轉述給它。DeepSeek Harness(下稱 DSH)的理念是「一切皆插件」,這種單點能力缺口正適合用一個小插件補上。下面介紹 Mappedinfo 維護的 dsh-tool-vision-read,它註冊一個 `vision_read` 工具,把讀圖這一步路由給專用視覺模型,純文本 agent 調用一次就能拿到圖片的文字描述。 # 這是什麼 ds

閱讀全文