前言¶
在 DSH(DeepSeek Harness)生态里,插件化是常见做法:把工具、技能和文档拆成可安装的 bundle。数据类任务中,常见痛点不是“能不能让模型看数据”,而是如何把 CSV、粘贴表格、SQL 查询结果或 DuckDB 数据稳定地整理成可复用的报告。
duyanta123/dsh-data-insight 提供的是一个数据洞察技能插件:把原始数据变成「业务结论 + 指标数据 + 图表」的结构化 Markdown 分析报告。
DSH 社区目录是独立站点,与 DeepSeek / 幻方无官方从属关系;这里介绍的是插件本身的能力与使用边界。
这是什么¶
- 插件名:
duyanta123/dsh-data-insight - 维护者:
duyanta123 - 类型:DSH 数据洞察技能插件
- 许可证:MIT
- 实现方式:纯指令型技能插件,零依赖、零构建;计算由宿主已提供的文件 / Shell 工具驱动的 LLM 完成。
核心功能¶
数据源¶
支持四种数据源:
- CSV 文件
- 粘贴表格文本
- SQL 查询结果
- DuckDB 直连数据库(可选)
五阶段流水线¶
执行流程为:
输入受理 → 数据探查 → 指标计算 → 图表呈现 → 报告产出
指标与图表¶
指标能力包括:
- 汇总统计
- 同环比(基准期规则写死)
- TopN
- 异常值(Z-score / IQR)
图表呈现有三通道:
- Markdown 表格 + 数字
- Mermaid
- ASCII 条形图
安装与启用¶
在目标 profile 中执行:
dsh plugin --profile web add dsh-data-insight
重启 profile 后,data-insight-runbook 出现在技能列表即可用。
该插件声明了可选 peerDependency:
@deepseek-ai/dsh-skill-filesystem
安装前应检查源码与 MIT 许可证。插件会以当前 dsh 进程权限运行,涉及本地文件、Shell 工具或 DuckDB 时,需要确认这些工具与数据源在预期权限范围内。
典型用法¶
会话触发¶
在会话中可以说:
- 「分析这份 CSV 出报告」
- 「看看这个数据」
- 「帮我算一下指标」
同时附上数据源:文件路径、粘贴表格或 DuckDB 连接。模型会加载 data-insight-runbook,并按五阶段执行。
先做 CSV 探查¶
如果要先检查样例数据,可以运行:
node scripts/csv-profile.mjs examples/sample-sales.csv
这一步会输出 examples/sample-sales.csv 的探查报告,内容覆盖 schema、缺失、分布、异常。
DuckDB 可选直连¶
DuckDB 直连为可选能力。如需使用,先安装 DuckDB 单文件 CLI,并加入 PATH。
无库文件查询(CSV/Parquet)示例:
duckdb -csv -c "SELECT * FROM read_csv_auto('data.csv') LIMIT 100"
连接库文件 / 远程库时,需要遵守以下红线:
- 连接库一律使用
-readonly,写语句会被拦截 - 连接串走环境变量
DATA_INSIGHT_DB_URL - 查询默认
LIMIT 5000 - 无库文件查询(CSV/Parquet)不要加
-readonly;-readonly仅用于库文件 / 远程库
适用场景与注意¶
适合:需要在 DSH 会话中把原始数据整理成 Markdown 报告的场景,尤其是 CSV、粘贴表格、SQL 查询结果或 DuckDB 数据。
注意:
- CSV 中文乱码时,优先 UTF-8(带 BOM 也能正确处理);GBK 编码文件先用
iconv -f GBK -t UTF-8转码再探查。 - Mermaid 图在本地 Markdown 预览不渲染时,可用 Typora 等本地渲染编辑器打开,或参考
docs/chart-spec.md换用 Markdown 表格 / ASCII 条形图通道。 - DuckDB 为可选依赖;不连接数据库时,不需要安装 DuckDB。
结尾¶
回顾一下:duyanta123/dsh-data-insight 把“原始数据到 Markdown 报告”的步骤收敛成 DSH 技能流程,输入、探查、指标、图表、报告都在同一会话中完成。
项目地址:GitHub。如果通过 DSH 社区目录检索,可搜索插件名 dsh-data-insight。