dsh-scrape-webpage:网页抓取与统计分析插件

`dsh-scrape-webpage` 是 DeepSeek Harness 生态中一款 Host-only、零依赖的 MIT 许可插件,旨在自动化网页内容抓取与轻量分析。该插件支持 HTTP/HTTPS 协议,能提取标题、描述、正文、H1-H6 结构及链接(上限 100 条),并输出字符数、阅读时长、语言倾向及 Top30 高频关键词等统计信息。 其核心优势在于集成图片下载与识图扩展功能。插件可下载最多 6 张页面内容图片至本地,并通过 `scrape.imageAnalyzer` 服务接口支持接入独立识图插件,实现图片视觉分析结果附加输出。在安全方面,默认在沙箱内运行,若 HTTPS 受

阅读全文
用 firecrawl-build:把网页搜索、抓取和浏览器交互写进应用代码

firecrawl-build 是 Firecrawl 官方的应用集成入口 Skill,位于 firecrawl/skills 仓库。它面向产品、Agent 或工作流在代码里获取网页数据的场景,先问清要拿什么、怎么拿,再把需求路由到 /scrape、/search 或 /interact,而不是把「当前会话帮我搜一页」和「把 Firecrawl 写进后端」混在一起。本文按 SKILL.md、仓库 README 与官方文档核对安装命令、环境变量、SDK、子技能分工、冒烟测试以及和 CLI / Workflow 技能的边界。

阅读全文
firecrawl-cli:让 AI Agent 用 CLI 抓取、搜索、爬取与映射网页

firecrawl-cli 是 Firecrawl 官方 Agent Skill(目录 skills/firecrawl-cli,frontmatter 名为 firecrawl)。它让 Cursor、Claude Code、Codex 等助手用 firecrawl CLI 搜索、抓取、映射、爬取和交互网页,结果以 Markdown/JSON 写入 .firecrawl/。本文依据官方 SKILL.md 与 CLI 文档,说明安装鉴权、search→scrape→map→crawl→interact 路径,以及 credits 与无 Key 限流等注意点。

阅读全文