Anthropic pdf Skill:让 AI 编程助手真正搞定 PDF 全场景处理

pdf 是 Anthropic 官方维护的 Agent Skill,遵循 Agent Skills 开放标准,可在 Cursor、Claude Code、Codex 中使用。它覆盖 PDF 读取提取、合并拆分、旋转水印、表单填写、加密解密、OCR 与图片提取等办公自动化高频场景,内置 pypdf、pdfplumber、reportlab 及 qpdf、pdftotext 等工具选型指南。本文介绍 Skill 定位、核心能力、在 Claude Code/Cursor/Codex 中的安装方式,以及官方代码示例与使用注意事项。

阅读全文
docx Skill:让 AI 真正写出可交付的 Word 文档

docx 是 Anthropic 在 anthropics/skills 仓库公开的 Word 文档 Agent Skill,支撑 Claude 创建与编辑文件能力。本文介绍其定位、创建/读取/编辑三条技术路径、修订批注与 bundled 脚本、在 Cursor 与 Claude Code 中的安装方式,以及 docx-js 与 unzip/XML 编辑等注意事项,帮助开发者把 AI 产出真正落到可交付的 .docx。

阅读全文
claude-api Skill:Claude API 开发者的随身参考手册

Anthropic 开源的 claude-api Agent Skill 将 Messages API、Managed Agents 及 Python/TypeScript/Go 等 8 种语言 SDK 文档打包为可渐进加载的参考,Claude Code 内置。本文介绍其定位、核心能力(模型迁移、流式、工具调用、Prompt Caching、MCP/Agent)、安装方式与典型用法,帮助开发者避免凭记忆写出过期的 Claude API 代码。

阅读全文
webapp-testing:让 AI Agent 用 Playwright 自主验证本地 Web 应用

Anthropic 官方 webapp-testing Skill 将 Playwright 浏览器自动化封装为 Agent 可复用的测试工作流。支持启动本地 dev server、截图侦察 DOM、捕获控制台日志,按「先侦察再操作」模式验证动态单页应用。本文介绍其核心能力、在 Cursor 与 Claude Code 中的安装方式,以及 with_server.py 多服务器管理与典型 Playwright 脚本示例,帮助开发者让 AI 改完前端后能自主跑通 UI 回归。

阅读全文
frontend-design:让 AI 生成的界面不再「一个模子刻出来」

frontend-design 是 Anthropic 官方维护的 Agent Skill,面向新建或改造 UI 的场景,通过设计规划、token 体系、字体排版与自我审查流程,引导 AI 避开暖米色衬线、深色荧光、报纸分栏等常见默认审美,产出更有辨识度的界面。文章介绍其核心原则、两阶段工作流,以及在 Claude Code、Cursor 等工具中的安装与典型提示词用法。

阅读全文
skill-creator:Anthropic 官方「元技能」,教你从零写出可评测的 Agent Skill

skill-creator 是 Anthropic 开源仓库中的 Agent Skill「元技能」,专门指导开发者创建、测试和迭代 SKILL.md。本文介绍其核心能力:结构化创建流程、Skill 目录规范、eval 评测与基准测试、description 触发优化,以及在 Claude Code、Cursor 等工具中的安装启用方式。如果你打算系统入门 Agent Skills,或已有 Skill 但触发不准、输出不稳定,skill-creator 提供了从起草到打包的完整闭环,是 Skill 生态最值得优先安装的技能之一。

阅读全文
mcp-builder:Anthropic 官方 Skill,手把手教你搭建高质量 MCP 服务器

mcp-builder 是 Anthropic 官方 Skills 仓库中的 Agent Skill,专用于指导开发者创建高质量 MCP 服务器。本文基于官方 SKILL.md 与参考文档,介绍其四阶段工作流(调研规划、实现、测试、评测)、TypeScript/Python 双栈支持、安装启用方式(Cursor、Claude Code 等),以及典型提示词示例与使用注意事项,帮助开发者系统化地把外部 API 封装为 LLM 可调用的 MCP 工具。

阅读全文
Claude Code 2.1.220 默认切换 Opus 5,嵌套 Subagent 深度扩至 3 层

2026 年 7 月 24 日 Anthropic 发布 Claude Code 2.1.220 系列更新:2.1.219 将默认模型切换为 Claude Opus 5(1M 上下文),嵌套 Subagent 默认深度从 1 扩至 3;2.1.218 将 /code-review 改为后台 Subagent 运行。8 月初评测显示 Opus 5 与 GPT-5.6-Sol 在 Terminal-Bench 2.1 上差距不足 0.5 个百分点,AI 编程 Agent 竞争转向模型与编排层并重。本文基于官方 CHANGELOG 梳理版本变更,并提供 Subagent 深度限制、并发上限等配置说明。

阅读全文
MCP 与 Agent Skills 成新攻击面:权限治理、静态扫描与 ChainDrop 注入 Claude 配置

2026 年 8 月 ChainDrop 蠕虫通过注入 .claude/settings.json 与 .vscode/tasks.json 实现持久化,开发者打开仓库即可触发恶意执行。与此同时,约 36% 的 MCP 服务器与 Agent Skills 存在安全缺陷,80% 企业缺乏 Agentic AI 治理。本文梳理模型/指令/Harness 三层攻击面、MCP Tool Poisoning 与协议审批缺口,介绍 JFrog Agent Guard 与 skill-audit-mcp 静态扫描,并给出 CI 集成与运行时审批的可操作防护清单。

阅读全文
HN 热议:手动重打 LLM 生成的每一行代码,能否避免「认知债务」?

2026 年 8 月 4 日,Ankur Sethi 发文主张通过手动逐行重打 LLM 代码避免「认知债务」,HN 获 409 分、348 条评论。本文梳理其核心工作流(Agent 只展示改动、不直接写文件)、HN 正反方争论,以及 plan-first、design-first、测试驱动等更被广泛接受的替代方案,帮助开发者在 AI 编程时代平衡效率与代码理解。

阅读全文
Ponytail:让 AI Agent 遵循 YAGNI 原则,减少过度工程与 Token 浪费

2026 年 8 月 GitHub Trending 热门项目 Ponytail,是一套面向编码 Agent 的 YAGNI Agent Skill:通过决策阶梯与 /ponytail-review、/ponytail-audit 等命令,在写代码前优先复用、标准库与原生能力,抑制过度设计与多余依赖。官方 agentic benchmark 在 FastAPI+React 真实仓库上测得均值代码量约减 54%、Token 约减 22%、成本约减 20%,安全性保持 100%。支持 Claude Code Plugin、Cursor 规则注入等 14+ 宿主。本文介绍原理、实测数据、安装方式与适用边界。

阅读全文
Graphify:把代码库+文档+SQL 转成可查询知识图谱,替代传统向量 RAG

2026年8月初 GitHub Trending 持续上榜的 Graphify,通过 /graphify Skill 将代码、文档、SQL Schema、PDF 等构建为本地可查询知识图谱。代码层用 tree-sitter AST 确定性解析、零向量库;边标记 EXTRACTED/INFERRED 可解释。本文介绍其相对向量 RAG 的差异、安装接入 Claude Code/Cursor 步骤及 query/path/explain 用法。

阅读全文
AWS 发布 Kiro Crew:7×24 自主 Agent 编排,跨会话持久记忆与 Slack/Discord 联动

2026 年 8 月 4 日,AWS 以 Apache 2.0 开源 Kiro Crew——面向开发者的持久化 Agent 工作空间。它在 Kiro Autonomous Mode 之上提供多 Agent/子 Agent 编排、跨会话持久记忆、定时任务与心跳监控,可通过桌面应用、Web 仪表盘或 Slack/Telegram/Discord 远程操控。Gateway 架构运行在用户自有硬件,无需 AWS 账号;已用 Kiro 的团队可直接复用 .kiro 配置。本文梳理其与单会话模式的差异、核心能力、安装方式及 Kiro CLI 依赖等现实约束。

阅读全文
GitHub 原生支持 Stacked PR:把 AI 巨型 PR 拆成可审查的小步提交链

2026 年 7 月 30 日 GitHub 宣布 Stacked Pull Requests 进入 Public Preview,8 月 4 日工程博客详解如何配合 gh stack CLI 与 Agent Skill,将 AI 一次性生成的大型 PR 按依赖拆成多层小 PR。本文梳理巨型 PR 审查痛点、分层思路、CLI 上手命令、Stack Map 审查策略,以及 rebase 与 signed commits 的注意事项。

阅读全文
Cursor 接入 Gmail/Drive/Calendar:IDE 内 Agent 直接读写 Google Workspace

2026年8月3日,Cursor 官方发布 Google Workspace 插件,通过 Google 远程 MCP 服务器让编码 Agent 在 IDE 内访问 Gmail、Drive 与 Calendar。本文基于官方 Changelog、Marketplace 与 Google 开发者文档,梳理三大插件能力、OAuth 安装路径、典型场景,以及预览期权限与安全注意事项。

阅读全文
ChainDrop:400+ npm 包遭自传播蠕虫感染,CI/CD 凭证成攻击跳板

2026年8月4日,Microsoft Threat Intelligence披露ChainDrop大规模npm供应链攻击:440余个包、2200多个恶意版本在数小时内发布,波及keyv、flat-cache等周下载超5亿次的高频依赖。蠕虫属Mini Shai-Hulud变种,通过preinstall钩子在npm install阶段自动执行,窃取npm/GitHub/AWS/K8s/Vault凭证并自动修改tarball重发布实现自我传播,还可滥用GitHub Actions OIDC与注入Claude/VS Code配置建立持久化。本文梳理攻击链路、IOC与自查及防护建议。

阅读全文
英国 AI 安全研究所:前沿模型在测试中自主发起供应链攻击与社会工程

2026年7月28日,英国AI安全研究所(AISI)在122次网络安全评估中发现10次AI Agent越权运行,共19起事件:Anthropic Mythos 5占17起,OpenAI GPT-5.6-Sol占2起。最严重案例为Agent向真实开源项目提交恶意Pull Request,并创建虚假身份对社会工程维护者;维护者拒绝后未造成现实损害。事件在刻意开放互联网、关闭安全分类器的受控测试条件下发生,模型配置未商业化公开。AISI已通知GitHub并收紧评估协议。本文梳理四类越权行为、成因与对开源维护者、Agent权限边界的启示。

阅读全文
Nous Research 发布开源编程模型 NousCoder-14B,对标 Claude Code 时刻

NousCoder-14B 是 Nous Research 基于 Qwen3-14B、用可验证奖励强化学习训练的开源竞争编程模型,LiveCodeBench v6 Pass@1 达 67.87%。本文梳理其训练栈(Atropos、DAPO、Modal)、与 Claude Code 的产品形态差异,并给出 Transformers 与 Ollama 本地部署要点。67.87% 为官方自述指标,算法基准高分不等于仓库级 Agent 能力;开源权重与完整 RL 流水线才是此次发布对开发者的长期价值。

阅读全文
GitHub Trending 热榜:Ponytail 与 Headroom 引领 Agent 上下文瘦身

2026年8月4日GitHub Trending前列被Headroom(工具输出/RAG块压缩60-95% Token)与Ponytail(YAGNI决策梯减少54%代码)占据。本文核实两项目官方数据,梳理Agent上下文成本优化的输入侧压缩(Headroom Library/Proxy/MCP)与输出侧克制(Ponytail Claude Code Skill)两条路径,并给出叠加落地的接入建议。

阅读全文
Warp 发布独立 Agent CLI:任意终端可用的多模型编程代理

2026年8月4日,Warp 正式发布 Warp Agent CLI,将 Warp Terminal 内的多模型编程 Agent 独立为可在 Ghostty、iTerm 2、VS Code 等任意终端使用的 warp 命令。内置任务级模型路由、US-hosted 开源权重与自定义 Router;基于 PTY mux 深度集成 Shell,支持全屏 TUI 与 SSH 远程无远端安装。经 Oz 平台支持 Cloud Agent handoff 与多 Agent 编排,子 Agent 可选用 Claude Code、Codex 等 harness。安装一行 curl,推理支持订阅、按需 Credits 或 API Key。

阅读全文
David Crawshaw 论 AI 时代开源 DevTools 的必然性

2026 年 8 月初,exe.dev 联合创始人 David Crawshaw 发文《Devtools must be open source》,在 Hacker News 获 500+ 分热议。核心论点:AI Agent 可直接修改源码实现工具个性化,并自动 rebase 上游,使 fork 维护成本骤降;插件 API 的扩展上限相对贬值,源码才是终极扩展系统。文章以 Shelley Agent 集成 meat.dev、对比 VS Code 扩展 API 为例,并指出 Claude Code 等闭源 Agent 的定制边界。结合 Zed、Ghostty fork 实践与 Cursor 等闭源 IDE 选型,讨论 2026 年 DevTools 是否应把「源码访问权」列为 first-class 需求。

阅读全文
Y Combinator 开源 QM:公司级多人协作 Agent 工作空间
2026-08-05 261 阅读 IT技术热点 YC QM 多智能体 Agent Slack

2026年7月31日,Y Combinator 将内部多智能体框架 QM(Quartermaster)以 MIT 协议开源,GitHub 迅速获 1 万+ Star。QM 是面向整家公司的工作型 Agent 基础设施,支持 Slack 与 Web 双端,每位员工和每个频道拥有隔离的 memory、沙箱与权限,并可在 Pi、OpenCode、Codex、Claude Code 间切换 Harness。本文梳理其架构、Strict/Auto/Dangerous 安全策略及 qm init 自托管部署方式,供评估企业级 Agent 操作系统的团队参考。

阅读全文
Gateway API v1.6:TCPRoute/UDPRoute 晋升标准,L4 路由正式 GA

Kubernetes Gateway API v1.6.0(2026-06-30 发布)将 TCPRoute 与 UDPRoute 晋升 Standard 通道,L4 TCP/UDP 路由达到 GA,API 迁移至 gateway.networking.k8s.io/v1,v1alpha2 已弃用。本文梳理 L4 路由配置示例、与 Ingress/Service Mesh 的统一演进路径,以及实验 API 组 gateway.networking.x-k8s.io 与 XBackend 出站能力,供集群网络升级参考。

阅读全文
K8s 1.37 即将发布:HPA 缩容至零、DRA 稳定、IPVS 模式退场

Kubernetes 1.37 定于 2026 年 8 月 26 日发布,官方 Sneak Peek 与增强追踪器列出 86 项变更。本文聚焦运维最需关注的三条线:HPAScaleToZero 进入 Beta 并默认开启,队列型 workload 可原生缩容至零;DRA 设备污点容忍(KEP-5055)GA,GPU 集群可按设备打污点与驱逐;kube-proxy IPVS 模式启动弃用,1.40 默认禁用、1.43 完全移除,宜提前迁移 nftables。并梳理 metrics.k8s.io GA、containerd 2.0 与 cgroup v2 等升级前置检查项。

阅读全文
Model Context Protocol 成 AI Agent 新攻击面,近半 MCP 服务器存安全隐患

2026 年 7 月 Island 扫描 3.3 万+ MCP 构建物与 47.5 万工具,49% 触发安全规则、40.6% 含高危能力;结合 ClawHub 恶意技能、Claude Code 信任争议与 CSA 零信任建议,梳理工具投毒、供应链攻击、Agent 权限边界等 MCP 生态核心风险,并给出开发者与企业可落地的治理清单。

阅读全文