前言¶
2026 年 7 月 31 日,Y Combinator 在 X 上宣布开源 QM(Multiplayer Agent Harness)——这是 YC 内部已运行数月的多 Agent 协作框架,仓库位于 github.com/yc-software/qm,采用 MIT 许可,官网为 qm.ycombinator.com。消息发出后,QM 首日即冲上 Hacker News 榜首,获得 500+ 点讨论。
若你最近关注过 OpenClaw、Hermes Agent 这类开源 Agent Harness,QM 的定位并不相同:它不是「更强的个人助手」,而是把 Agent 当作公司级基础设施——每位员工、每个 Slack 频道/项目房间,都能拥有隔离的内存、文件、权限与沙箱,并在 Slack 与 Web 上以同一身份协作。
YC 官方表示,QM 已用于会计、法务、活动与工程团队,包括 QM 自身开发;同时强调项目仍属早期实验,「有 bug,但对我们已经相当有用」。下文基于官方 README、部署文档与公开讨论,梳理 QM 是什么、架构如何、与现有 Harness 的差异,以及团队如何上手。
QM 是什么¶
官方 README 的第一段就把边界说清楚了:
Most agents are designed like personal assistants. QM is designed for startups.
翻译过来:多数 Agent 像个人助理;QM 面向创业公司/组织。 每位员工有独立的 Agent 工作区,互不干扰;同时可以在 Slack 频道、群聊与共享项目里,与 Agent 和人类同事一起协作。
QM 不是聊天机器人外壳,而是一套 Multiplayer Agent Harness(多人 Agent 运行时),核心能力包括:
- 个人与共享作用域(Personal and shared scopes) — 员工可定制「自己的 Agent」,也能在频道/项目里协同使用。
- Slack + Web 双端 — 同一身份与配置在 Slack 与 Web UI 间切换。
- 组织级管控 — 管理员配置安全策略、可用 Harness 与模型。
- 可发布内部 Web App — 为特定人群快速搭建内部小应用。
- 共享 Skills — 按作用域授权,支持从 Git 仓库导入 Skill Pack。
- 后台任务 — Cron 与 Watch 在无人值守时持续运行。
每个「人」和每个「房间」都拥有独立的作用域资源:内存、文件、Keychain 视图、权限、Cron、Web App、持久沙箱。这与「全公司共用一个 Bot 账号」的模式截然不同。
架构一览¶
QM 采用 云优先、可自托管 的设计。官方架构图(简化理解)如下:
- Headless Core:TypeScript + Node.js + Fastify,负责 API、身份、策略与调度。
- Agent Loop:可接入 Pi、OpenCode、Codex、Claude Code 等多种 Harness,驱动同一核心,避免厂商锁定。
- Postgres:持久化会话、内存、队列等状态。
- Per-scope Sandbox:每个作用域有独立沙箱;Agent 通过固定工具面中的
execute在沙箱内执行命令,已安装工具可持久保留。 - 插件层:Slack(Bolt)、Web UI(Vite + Lit)、Admin、Portal 等,经 HTTP API 挂接 Core。
官方强调:Core 本身是通用的;组织特有的配置、自定义工具/Skills、沙箱镜像与基础设施,都放在 deployment directory(部署目录)中,由 qm CLI 校验并部署。各底层实现(Harness、Session Store、Sandbox、Memory)均通过接口抽象,生产环境可在单一 wiring 文件中替换。
技术栈对熟悉 Node/TypeScript 的团队比较友好;对运维的要求主要是:Postgres + 自有云账号(官方 CLI 支持 Fly.io 或 AWS 等目标)。
与 OpenClaw、Hermes 的定位差异¶
2026 年 Agent Harness 赛道已明显分化。OpenClaw 与 Hermes 在社区里常被并列讨论,但二者重心仍是个人或小团队:
| 维度 | QM(YC) | OpenClaw / Hermes(典型) |
|---|---|---|
| 首要用户 | 整家公司 / 组织 | 个人开发者或小团队 |
| 协作模型 | 每人独立作用域 + 共享频道/项目 | 多通道路由、个人记忆、自改进循环 |
| 界面 | Slack + Web(同一身份) | 消息平台、CLI、自托管 VPS 等 |
| 组织管控 | 安全策略、Harness/模型白名单为一等公民 | 需自行拼装或较弱 |
| 许可 | MIT | 多为 MIT 等开源许可 |
OpenClaw 更偏「多通道编排与控制平面」——把 Agent 接到 Slack、WhatsApp 等已有触点;Hermes Agent(Nous Research)强调持久记忆与任务后自写 Skill 的闭环。二者在「一个人、一台机器、一条消息链路」上已很成熟。
QM 补的是另一块空白:当 Agent 从「我的助手」变成「我们公司的操作系统」时,需要身份隔离、房间级权限、组织策略与可审计的沙箱。 YC 在发布公告中也把 QM 与 Hermes、OpenClaw 并列,称其在可定制性上类似,但面向整家公司。
HN 讨论中,有开发者指出「多人 Agent 最难的往往不是 Agent Loop,而是 scoping(作用域划分)」——QM 的 per-person scopes + shared rooms,正是对此的一种工程化回答。
能做什么:YC 给出的场景¶
README 列举的典型用法包括:
- 统一检索内部笔记、邮件、文档、数据库与 Web
- 从「公司大脑」连接器拉取信息
- 搭建内部 App 并定向发布、保持数据更新
- 学习写作风格后排程处理收件箱(打标签、草拟回复)
- 在现有代码仓库跑测试、开 PR、盯 CI、查日志
- 在共享频道跟踪项目并自动跟进
这些场景的共同点是:跨人、跨频道、需长期状态——恰好是个人 Harness 扩展时最容易踩坑的地方。
部署入门¶
QM 不要求先 clone 源码。官方推荐在组织拥有的部署仓库中初始化:
npm exec --yes --package=@yc-software/qm@latest -- \
qm init . --org <slug> --target <fly-or-aws>
npm install
qm init 会生成部署 Skill,引导完成基础设施、Web 登录、连接器凭证、可选 Slack 接入、部署与线上验证。每次部署运行在操作者自己的云账号中;初始化不会自动启用 CI,上游仓库也没有生产部署 Workflow。细节见仓库内 deployment.md 与 docs/getting-started.md。
若团队希望私有 fork 整仓(工程师与 Coding Agent 同读 Core 与定制层),官方文档提供了 gh repo create + bare clone mirror 的流程,并特别提醒:不要用 GitHub 的 Fork 按钮——公开仓 Fork 无法变私有,且对象网络与上游共享;应使用 plain clone 建立独立私有仓库,再通过 upstream 远程合并上游。
YC 在 LinkedIn 公告里还给了一个「懒人部署」提示:可以对任意 Coding Agent 说「deploy https://github.com/yc-software/qm」(去掉方括号),由 Agent 协助走完流程——这与 QM「Harness 无关、Agent 驱动部署」的设计一致。
安全与权限模型¶
QM 的安全思路贴近本地 Coding Agent(OpenCode、Codex、Claude Code):Agent 以所服务用户的身份行动,使用其凭证与权限,行为可审计。组织选定一种 Security Posture,子作用域只能更严、不能更松:
| 策略 | 行为 |
|---|---|
| Strict | 除两个无副作用的回合结束工具外,每次 Harness 工具调用都需人工批准 |
| Auto(默认) | 分类器在工具结果进入模型前筛查带来源标记的外部数据;部署可接自有筛查代理 |
| Dangerous | 无内容筛查、工具调用间无暂停 |
无论哪种策略,预声明命令策略(如对递归删除、破坏性 SQL 的硬拒绝)始终生效。完整威胁模型见 SECURITY.md。
对准备上生产的团队,建议在 PoC 阶段就明确:哪些作用域允许写仓库、哪些只读、哪些频道可触发 Cron/Webhook——QM 提供了机制,但边界仍需组织自己定义。
贡献方式:一个值得注意的细节¶
QM 的贡献指南与多数开源项目不同:官方 CONTRIBUTING.md 写明,贡献以人类撰写的文本为主(.txt / .md 放在 adrs/),对齐后由维护方实现,而非直接提 PR 改 Core。漏洞需私下报告。这反映出 YC 对 Core 一致性与私有部署层边界的严格控制。
冷静看待:早期实验,而非成品 SaaS¶
务必读一遍 YC 原话:QM 是 experiment,early and has bugs。GitHub 上 star 数在开源后迅速上涨(公开页面显示数千级),社区热情高,但不等于生产就绪。
第三方评测也指出:README 更像产品叙事,沙箱隔离的具体 enforcement、四人 Harness 并存时的分工策略、小团队运维负担等,仍需在实际部署中验证。YC 员工在 X 上的「小团队输出像军队」属于愿景表述,不宜当作可复现的量化承诺。
对创始团队更务实的路径或许是:
- 选 1–2 个只读或低风险场景(如内部文档问答、CI 状态播报)做 PoC;
- 在 Auto 策略下试运行,观察审批与筛查成本;
- 再逐步开放共享频道与写操作型 Skills。
小结¶
QM 把 2026 年 Agent 竞争从「谁的模型更强」推向「谁的组织能跑起来」:MIT 开源、Harness 可插拔、Slack/Web 原生、每人每房间独立沙箱与状态。它与 OpenClaw/Hermes 并非简单替代,而是覆盖公司级 Multiplayer 这一层。
若你已在用 Claude Code 或 Codex 做个人自动化,QM 提供的是把同一类能力升格为组织基础设施的参考实现——而且来自 YC 自身后台的真实使用。仓库、文档与 HN 讨论链接如下,建议先读 README 与 SECURITY.md 再决定是否 fork:
Agent Harness 的下一战场,很可能就在「个人」与「组织」之间——QM 是 YC 押注后者的一次开源下注。