AI组队上班这件事,终于有了一个像样的群聊房
把Claude Code和Codex请进同一个群聊里开会。

适合:同时在用 Claude Code、Codex,又想把 agent 协作搬到群聊里的独立开发者和小型技术团队。
先说结论
cunora 这类项目做的事情很直白:把一群AI agent 当成正经同事,塞进一个跨平台的聊天房间,让人和 agent 在同一个频道里协作。一周拿到一千多颗星,说明开发者社区对“AI团队协作”这件事已经等得很不耐烦。
它的卖点不是某一个模型更强,而是“云端大脑 + 自带大脑”可以混编。官方说法是支持 Claude Code 和 Codex 这类已有 agent 作为团队成员接入,配上云端 agent 做兜底,等于同时拿到“省心版”和“可控版”两条路线。
真正的问题
过去一年,很多人已经被 Claude Code、Codex、各种 CLI agent 轮番教育过:单兵能力是真的能打。但单兵强不代表团队强。实际干活时,痛点很快变成三件事。
第一,上下文在终端和聊天软件之间反复横跳。一个需求讨论在群里,落地要在终端跑 agent,输出又得贴回群里交接,中间靠复制粘贴维持记忆,掉链子几乎是必然。
第二,agent 之间没有“会议室”。你让 A agent 调研方案、B agent 写代码、C agent 审 PR,目前基本靠人当调度器,或者自己写脚本拼流水线。一旦其中一个 agent 报错,整条链路就瘫了。
第三,权限和计费分不开。云端 API 方便但贵、还容易泄数据;本地 CLI 安心但要自己配环境、占机器。一边想保密,一边想省事,结果两边都别扭。
cunora 的切入角度,是把这三件事压到同一个群聊界面里。agent 是群成员,不是后台脚本;人可以@它们、给它们分配任务、看它们的执行回执。
怎么做更省力
判断一个AI协作工具值不值得上手,先看它有没有把这三件事做明白。我把它拆成能直接对照的四个维度。
| 维度 | 真正该有的表现 | 现阶段能做到的底线 |
|---|---|---|
| 接入方式 | 一个入口同时挂云端 agent 和本地 agent | 至少支持 Claude Code、Codex 之一 |
| 协作界面 | 像正常群聊,能@、能分配、能看历史 | 至少支持多人多频道 |
| 上下文管理 | 任务、文件、结论自动归档 | 不要求全自动,但别让人手动搬运 |
| 跨平台 | 桌面 + 移动端可同步 | 至少桌面端可用 |
表格不是要给项目打分,而是帮你快速判断:你现在最痛的是哪一格。如果只是想要“在群里能@一个 Claude Code 帮我改个脚本”,那它的最低门槛就已经够用。如果指望它替你管整个研发团队,那它还远不到那个段位。
跨平台这个点对国内用户尤其重要。开发者白天在桌面端敲代码,晚上通勤路上想看一眼进度,如果只能在桌面看,体验就少一截。
哪些坑要避开
第一,别把它当成“团队管理神器”。它解决的是协作界面,不是绩效考核,不是工时统计,更不是把人类员工替换成 agent。拿它当 OKR 工具用,一定会失望。
第二,权限边界要先划好再开 agent。云端 agent 默认会调用付费 API,本地 agent 可能读写本地文件。哪些频道能放哪种 agent、谁能拉新 agent 进群,规则得一开始就定清楚,不然一周下来账单和工作目录一起乱。
第三,不要忽视上下文投毒的代价。群聊里成员越多、话题越杂,单个 agent 的上下文越容易被无关消息稀释。真正能用的做法是:一个任务一个子频道,结束就归档,别让 agent 在大群里猜上下文。
第四,一周一千多颗星不代表生产可用。早期项目版本号往往偏激进,breaking change 一夜之间发生很正常。重要任务不要压在第一个月,能用云端 agent 先用云端,本地 agent 当兜底,先跑通再放量。
现在就能动手
如果你看完有点心动,最稳的上车顺序是这样的。
第一步,挑一个真实的小任务,比如“让 Claude Code 帮我把仓库里的 README 翻译成中英双语”。这种任务小、可见、可验证,刚好用来检验“agent 在群里到底听不听话”。
第二步,先用云端 agent 跑通流程,熟悉指令格式、任务分配和回执展示。等你确认“我能看懂它在干什么”,再把本地 Claude Code 或 Codex 接进来,对比两边输出差异。
第三步,按项目建频道。一个长期项目一个主频道,子任务开 thread,重要结论沉淀到固定的文档频道。agent 的输出也走同一套规则,避免信息散落在各处。
第四步,每周复盘一次。看看哪些任务 agent 接得稳、哪些任务它开始胡说、哪些频道已经变成垃圾场。判断要不要继续投入,标准只有一条:它有没有真的替你省下时间,而不是看起来很热闹。
如果你正在为多个 agent 协作头疼,又不想自己从零搭一套调度脚本,cunora 这类项目值得花一个下午亲自试一试。一周一千多颗星背后的信号很明确:开发者已经不想再当人肉调度器了。