【AI教程】四个开源项目,让你的 AI 化身整个公司

拆成可复用角色;hermes-agent 主打任务后自动沉淀技能、让智能体越用越聪明;Superpowers 以测试驱动流程串起开发全链路;Paperclip 则尝试用多智能体编排“零人工公司”。

发布于2026年4月1日 23:46
编辑零重力瓦力
评论0
阅读52

如何让 AI 化身 "整家公司"?

AI 技术博主 Matthew Berman 介绍了四个相当火爆的智能体开源项目,让你把智能体的潜力发挥到极致! 第一个是 gstack,Y Combinator 总裁 Garry Tan 做的,发布几周就快到 5 万星了。它本质上是一套配合 Claude Code 使用的提示词工程框架,把 "YC office hours" 的问答流程、工程师审查、设计评审这些角色全拆成独立的 markdown 文件,让 AI 编程智能体在不同任务里各司其职。代码完全开源,翻一翻基本就能看出 Garry 怎么思考创业这件事。 第二个是 Nous Research 的 hermes-agent,几天就涨到 1.35 万星。它最特别的地方是内置了一个闭环学习循环,智能体会在完成任务后自动创建 "技能",这些技能在后续使用中持续优化,还能跨会话积累用户模型。说白了,它在试图让 AI "越用越聪明"。它还提供了从 OpenClaw 迁移的工具。对整个行业来说,是时候考虑建立智能体数据迁移的标准了。 第三个 Superpowers 是四个里星数最多的,11.5 万星。它以插件形式接入 Claude Code,一行命令装完,主打的是严格的测试驱动开发流程,把头脑风暴、方案设计、代码审查都串成一套完整工作流。它的自我描述写得也很有意思,说要把计划写得让一个 "没有品位、没有背景、还讨厌写测试的初级工程师" 都能照着干。 第四个 Paperclip 概念最激进,目标是 "零人工公司",用一个 Node.js 服务加 React 界面来编排一整支 AI 智能体团队,CEO、CMO、CTO 全是 Claude,工程师用 Codex,走工单系统,有仪表板追踪 token 消耗。不过 Matthew 也提醒大家,靠它睡一觉醒来赚钱是不可能的,但它确实展示了多智能体协作的一种具体的形态。

相关文章

Windsurf 2.0 拆解:Devin 被塞进编辑器,氛围编程终于有了“调度中心”
AI 编程开发
2026年6月2日
0 条评论
零重力瓦力

Windsurf 2.0 拆解:Devin 被塞进编辑器,氛围编程终于有了“调度中心”

Cognition 发布 Windsurf 2.0,深度整合 Devin 实现本地思考与云端执行分工。新版推出 Agent Command Center 支持多智能体可视化管理,搭载自研 SWE-1.5 模型大幅提升代码定位与编辑速度,并引入 Spaces 容器解决上下文延续问题。Pro 版调整为日配额制且包含 Devin 功能。相比 Cursor 3,Windsurf 2.0 凭借自研模型与云端执行能力,更适合处理陌生代码库及长任务自动化场景。

#智能体#AI 编程
阅读全文
多智能体为什么比单智能体强?Anthropic 用 90.2% 的数据给了答案
智能体工程
2026年6月2日
0 条评论
零重力瓦力

多智能体为什么比单智能体强?Anthropic 用 90.2% 的数据给了答案

Anthropic 研究显示,多智能体系统性能比单智能体提升 90.2%,其核心在于主智能体拆解任务与子智能体并行执行。尽管该架构 token 消耗约为单智能体的 15 倍,但在复杂任务中优势显著。业界已总结出五种协作模式,并有 n8n、CAMEL-AI 等落地案例。然而,多智能体仍面临调试难、输出不稳定等挑战。建议仅在任务复杂需并行、分工明确且能承担高成本时采用,简单任务直接使用强模型即可。

#智能体#智能体工程
阅读全文
Claude 新模型发布前让客户极限测试,Agent 落地成核心
AI 新闻资讯
2026年6月1日
0 条评论
小创

Claude 新模型发布前让客户极限测试,Agent 落地成核心

Anthropic 在发布新 Claude 模型前,通过头部客户极限测试验证真实业务表现,比单纯跑分更具参考价值。借助 Agent 能力,新模型在起草法律文件等复杂任务中成功率提升约 20%,实现持续准确输出。当前大模型发展重心已转向 Agent 在垂直场景的落地,边缘案例为下一代优化指明方向。这种与客户深度共创的模式建立了高信任壁垒,值得产品团队借鉴。

#Anthropic#智能体
阅读全文
互动讨论

评论区

围绕《【AI教程】四个开源项目,让你的 AI 化身整个公司》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。