Loop 的消费级形态:五家 Agent 个人助理
2026 下半年,四家大厂几乎同时把"持久记忆 + 定时任务 + 云端电脑 + 离开后继续" 打包成个人助理——这正是 Loop Engineering(循环工程)的消费级形态。本章先把 Grok Bot、Dots、Gemini Spark、 Meta Muse 和 Claude 放到同一张表上,看清各自的刀法,再决定我们怎么用。
| 产品 | 持久记忆 | 主动任务 | 电脑 / 浏览器 | 生态集成 | 价格门槛 | 一句话点评 |
|---|
TABLE. 01 · 定性对比 · 非统计口径 · 依据见各产品官方页面与帮助文档(2026-10-09 检索)
拆开看:助理的壳,Loop 的芯
把五家产品的卖点翻译成循环语言(概念见第 2 章),你会发现没有一件是新东西—— 这正是我们值得自信的地方:大厂验证的,就是我们已经在跑的结构。
最近 60 天动态
给我们的使用建议
Loop 不是提示词,是状态机
很多人以为"让 AI 循环工作"就是写一段更长的提示词。源码拆解给出的答案相反: 提示词只定义某个节点如何工作,不能替代触发、状态、预算、Checker、恢复和权限。 一个可运行的 Loop,最小骨架是七个状态加一条返工回路。
FIG. 01 · Loop 最小状态机示意 · 非统计口径 · 来源:Atomic Agents 拆解(本地研究 2026-07-24)
判断一个"Loop"是不是真的,就看这七个状态是否各自有据可查: 谁触发、看什么、怎么规划、做了什么、谁检查、检查之后流向哪里、证据记在哪。 缺任何一个,它都只是一次性对话,不是循环。
Loop 没有被 Graph 替代
最近 30 天最大的误读是"Graph 时代来了,Loop 过时了"。 2026-08-08 的全网扫描结论相反:主流共识是分层组合—— 外层管状态与权限,节点内跑循环,节点间用图编排依赖。 LangChain 官方 2026-07-22 的三年回顾进一步确认:Graph 是施加受控路径的手段,不是 Loop 的替代品。
FIG. 02 · 分层组合示意 · 非统计口径
三个项目,三种角色
把 Atomic Agents(原子节点 SDK)、Hermes(长跑运行时)和已经闭环的 X Loop(业务系统)放在同一张能力表上,"Loop Engineering 到底要补什么"一目了然。
| 能力 | Atomic Agents | Hermes v0.18.2 | X Loop(已跑通) |
|---|
TABLE. 02 · 能力对照 · 以本机实际运行版本 Hermes v0.18.2 为准 · 来源:本地拆解 2026-07-24
为什么 X Loop 跑通了
目前唯一完整闭环的业务 Loop:X(Twitter)每天自动发布两篇。 它跑通的原因不是提示词更长,而是八条骨架缺一不可——这八条就是可以复制到任何业务的清单。
知识宫殿:每天一次的"沧海遗珠"循环
第二个落地的 Loop:每天识别新增 MD 文件,自动做探索、反思、对抗辩论, 从旧文档里捞出被忽略的珍珠——但严格遵守 report-first:只提交写入建议,绝不擅自改核心认知。
怎么写一个能跑 10 小时的 Goal
长跑任务和普通对话的区别,全在开局那份"目标合同"。 六个字段写清楚,Codex / Hermes 这类运行时才能无人值守地循环、检查、继续。
FIG. 03 · 模板 · 字段名可按业务改名,但六个槽位不可缺
两条核心工作流的 Loop 化路线
不搭"万能 Loop 平台",也不一次改完现有流程。 每条工作流只嵌入一个低风险垂直切片,跑通再扩。
什么时候不要用 Loop
诚实的页面必须收录反面。Loop 会放大一切——包括错误的目标、 缺失的回读信号和失控的成本。以下清单来自真实的拆解结论,不是免责声明。
今天就能用的六件工具
全部经过本机实测。前三个零成本、不花 token;后三个是本机已经跑起来的实验环境。
九个 Agent 框架,四个维度
把最近 30 天讨论度最高的 Agent 框架放到同一张表上:缓存机制、长任务能力、 Harness 理解、30 天口碑。评级为 1-5 定性分,非实测跑分; 星标数据打开页面时实时抓取 GitHub API,失败回退到 2026-08-21 快照。
| 框架 | 缓存机制 | 长任务 | Harness 理解 | 30 天口碑 | 关键备注 |
|---|
TABLE. 03 · 定性评级 · 非统计口径 · 依据见各框架官方文档与 README