Y Combinator 开源 QM:从个人 Agent 到全公司级多人协作 Harness

前言

2026 年 7 月 31 日,Y Combinator 在 X 上宣布开源 QM(Multiplayer Agent Harness)——这是 YC 内部已运行数月的多 Agent 协作框架,仓库位于 github.com/yc-software/qm,采用 MIT 许可,官网为 qm.ycombinator.com。消息发出后,QM 首日即冲上 Hacker News 榜首,获得 500+ 点讨论。

若你最近关注过 OpenClawHermes Agent 这类开源 Agent Harness,QM 的定位并不相同:它不是「更强的个人助手」,而是把 Agent 当作公司级基础设施——每位员工、每个 Slack 频道/项目房间,都能拥有隔离的内存、文件、权限与沙箱,并在 Slack 与 Web 上以同一身份协作。

YC 官方表示,QM 已用于会计、法务、活动与工程团队,包括 QM 自身开发;同时强调项目仍属早期实验,「有 bug,但对我们已经相当有用」。下文基于官方 README、部署文档与公开讨论,梳理 QM 是什么、架构如何、与现有 Harness 的差异,以及团队如何上手。

QM 是什么

官方 README 的第一段就把边界说清楚了:

Most agents are designed like personal assistants. QM is designed for startups.

翻译过来:多数 Agent 像个人助理;QM 面向创业公司/组织。 每位员工有独立的 Agent 工作区,互不干扰;同时可以在 Slack 频道、群聊与共享项目里,与 Agent 和人类同事一起协作。

QM 不是聊天机器人外壳,而是一套 Multiplayer Agent Harness(多人 Agent 运行时),核心能力包括:

  1. 个人与共享作用域(Personal and shared scopes) — 员工可定制「自己的 Agent」,也能在频道/项目里协同使用。
  2. Slack + Web 双端 — 同一身份与配置在 Slack 与 Web UI 间切换。
  3. 组织级管控 — 管理员配置安全策略、可用 Harness 与模型。
  4. 可发布内部 Web App — 为特定人群快速搭建内部小应用。
  5. 共享 Skills — 按作用域授权,支持从 Git 仓库导入 Skill Pack。
  6. 后台任务 — Cron 与 Watch 在无人值守时持续运行。

每个「人」和每个「房间」都拥有独立的作用域资源:内存、文件、Keychain 视图、权限、Cron、Web App、持久沙箱。这与「全公司共用一个 Bot 账号」的模式截然不同。

架构一览

QM 采用 云优先、可自托管 的设计。官方架构图(简化理解)如下:

  • Headless Core:TypeScript + Node.js + Fastify,负责 API、身份、策略与调度。
  • Agent Loop:可接入 Pi、OpenCode、Codex、Claude Code 等多种 Harness,驱动同一核心,避免厂商锁定。
  • Postgres:持久化会话、内存、队列等状态。
  • Per-scope Sandbox:每个作用域有独立沙箱;Agent 通过固定工具面中的 execute 在沙箱内执行命令,已安装工具可持久保留。
  • 插件层:Slack(Bolt)、Web UI(Vite + Lit)、Admin、Portal 等,经 HTTP API 挂接 Core。

官方强调:Core 本身是通用的;组织特有的配置、自定义工具/Skills、沙箱镜像与基础设施,都放在 deployment directory(部署目录)中,由 qm CLI 校验并部署。各底层实现(Harness、Session Store、Sandbox、Memory)均通过接口抽象,生产环境可在单一 wiring 文件中替换。

技术栈对熟悉 Node/TypeScript 的团队比较友好;对运维的要求主要是:Postgres + 自有云账号(官方 CLI 支持 Fly.io 或 AWS 等目标)。

与 OpenClaw、Hermes 的定位差异

2026 年 Agent Harness 赛道已明显分化。OpenClaw 与 Hermes 在社区里常被并列讨论,但二者重心仍是个人或小团队

维度 QM(YC) OpenClaw / Hermes(典型)
首要用户 整家公司 / 组织 个人开发者或小团队
协作模型 每人独立作用域 + 共享频道/项目 多通道路由、个人记忆、自改进循环
界面 Slack + Web(同一身份) 消息平台、CLI、自托管 VPS 等
组织管控 安全策略、Harness/模型白名单为一等公民 需自行拼装或较弱
许可 MIT 多为 MIT 等开源许可

OpenClaw 更偏「多通道编排与控制平面」——把 Agent 接到 Slack、WhatsApp 等已有触点;Hermes Agent(Nous Research)强调持久记忆与任务后自写 Skill 的闭环。二者在「一个人、一台机器、一条消息链路」上已很成熟。

QM 补的是另一块空白:当 Agent 从「我的助手」变成「我们公司的操作系统」时,需要身份隔离、房间级权限、组织策略与可审计的沙箱。 YC 在发布公告中也把 QM 与 Hermes、OpenClaw 并列,称其在可定制性上类似,但面向整家公司

HN 讨论中,有开发者指出「多人 Agent 最难的往往不是 Agent Loop,而是 scoping(作用域划分)」——QM 的 per-person scopes + shared rooms,正是对此的一种工程化回答。

能做什么:YC 给出的场景

README 列举的典型用法包括:

  • 统一检索内部笔记、邮件、文档、数据库与 Web
  • 从「公司大脑」连接器拉取信息
  • 搭建内部 App 并定向发布、保持数据更新
  • 学习写作风格后排程处理收件箱(打标签、草拟回复)
  • 在现有代码仓库跑测试、开 PR、盯 CI、查日志
  • 在共享频道跟踪项目并自动跟进

这些场景的共同点是:跨人、跨频道、需长期状态——恰好是个人 Harness 扩展时最容易踩坑的地方。

部署入门

QM 不要求先 clone 源码。官方推荐在组织拥有的部署仓库中初始化:

npm exec --yes --package=@yc-software/qm@latest -- \
  qm init . --org <slug> --target <fly-or-aws>
npm install

qm init 会生成部署 Skill,引导完成基础设施、Web 登录、连接器凭证、可选 Slack 接入、部署与线上验证。每次部署运行在操作者自己的云账号中;初始化不会自动启用 CI,上游仓库也没有生产部署 Workflow。细节见仓库内 deployment.mddocs/getting-started.md

若团队希望私有 fork 整仓(工程师与 Coding Agent 同读 Core 与定制层),官方文档提供了 gh repo create + bare clone mirror 的流程,并特别提醒:不要用 GitHub 的 Fork 按钮——公开仓 Fork 无法变私有,且对象网络与上游共享;应使用 plain clone 建立独立私有仓库,再通过 upstream 远程合并上游。

YC 在 LinkedIn 公告里还给了一个「懒人部署」提示:可以对任意 Coding Agent 说「deploy https://github.com/yc-software/qm」(去掉方括号),由 Agent 协助走完流程——这与 QM「Harness 无关、Agent 驱动部署」的设计一致。

安全与权限模型

QM 的安全思路贴近本地 Coding Agent(OpenCode、Codex、Claude Code):Agent 以所服务用户的身份行动,使用其凭证与权限,行为可审计。组织选定一种 Security Posture,子作用域只能更严、不能更松:

策略 行为
Strict 除两个无副作用的回合结束工具外,每次 Harness 工具调用都需人工批准
Auto(默认) 分类器在工具结果进入模型前筛查带来源标记的外部数据;部署可接自有筛查代理
Dangerous 无内容筛查、工具调用间无暂停

无论哪种策略,预声明命令策略(如对递归删除、破坏性 SQL 的硬拒绝)始终生效。完整威胁模型见 SECURITY.md

对准备上生产的团队,建议在 PoC 阶段就明确:哪些作用域允许写仓库、哪些只读、哪些频道可触发 Cron/Webhook——QM 提供了机制,但边界仍需组织自己定义。

贡献方式:一个值得注意的细节

QM 的贡献指南与多数开源项目不同:官方 CONTRIBUTING.md 写明,贡献以人类撰写的文本为主(.txt / .md 放在 adrs/),对齐后由维护方实现,而非直接提 PR 改 Core。漏洞需私下报告。这反映出 YC 对 Core 一致性与私有部署层边界的严格控制。

冷静看待:早期实验,而非成品 SaaS

务必读一遍 YC 原话:QM 是 experimentearly and has bugs。GitHub 上 star 数在开源后迅速上涨(公开页面显示数千级),社区热情高,但不等于生产就绪。

第三方评测也指出:README 更像产品叙事,沙箱隔离的具体 enforcement、四人 Harness 并存时的分工策略、小团队运维负担等,仍需在实际部署中验证。YC 员工在 X 上的「小团队输出像军队」属于愿景表述,不宜当作可复现的量化承诺。

对创始团队更务实的路径或许是:

  1. 选 1–2 个只读或低风险场景(如内部文档问答、CI 状态播报)做 PoC;
  2. Auto 策略下试运行,观察审批与筛查成本;
  3. 再逐步开放共享频道与写操作型 Skills。

小结

QM 把 2026 年 Agent 竞争从「谁的模型更强」推向「谁的组织能跑起来」:MIT 开源、Harness 可插拔、Slack/Web 原生、每人每房间独立沙箱与状态。它与 OpenClaw/Hermes 并非简单替代,而是覆盖公司级 Multiplayer 这一层。

若你已在用 Claude Code 或 Codex 做个人自动化,QM 提供的是把同一类能力升格为组织基础设施的参考实现——而且来自 YC 自身后台的真实使用。仓库、文档与 HN 讨论链接如下,建议先读 README 与 SECURITY.md 再决定是否 fork:

Agent Harness 的下一战场,很可能就在「个人」与「组织」之间——QM 是 YC 押注后者的一次开源下注。

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜