8 月 30 日,OpenClaw 发布了 2.0 版本(v2026.8.1)。这次更新的体量在开源项目里不常见:933 位贡献者参与,其中 569 位是首次提交,七周内合入超过 16,000 个 PR,接近项目历史上全部合并量的一半——而在此之前,它的更新节奏大约是两天一次。有媒体的标题概括为:一次想简化安装的尝试,最终重塑了整个产品。
我们自己就在维护一套 agent 基础设施,公众号的投草稿管线、GEOFlow 的多容器服务都属于这一类。所以 8 月 31 日晚上,我们把 2.0 装到一台 Mac 上,从零做了一次完整实测。这篇只写实测中看到的东西。
安装与迁移:从双击到可用,大约两分钟
从 GitHub 下载的 DMG 安装包 531MB,直连 11 秒下完。拖进「应用程序」、双击启动之后,剩下的步骤全部是它自己完成的:公证校验没有弹出任何警告,内嵌命令行工具自动安装,后台网关自动启动并监听本机端口,主窗口随后打开。从双击图标到它能开口对话,计时大约两分钟,全程没有碰过终端。
这台机器在四月份装过老版本的 OpenClaw,2.0 启动后自动完成了旧配置的迁移。模型接入的方式值得单独说:整个过程没有要求填写任何 API key,它直接复用了本机 Claude Code 的登录态,会话窗口角落的标识写着「Claude Opus 5 (Claude CLI)」。对已经装过 Claude Code 的用户来说,这台机器上的一切都是现成的。
第一次对话:它先问了一个问题
主窗口打开后,它说的第一句话不是欢迎词,而是一个问题:你希望怎么称呼我?
这是 2.0 的新流程,每个 agent 要先有名字。我们给它起名「小虾米」,配了一个虾的 emoji。接下来的半小时里,它自己完成了几件事:把名字和「安静、小巧,但反应快」的性格描述写进身份文件,然后尝试执行一条同步命令,把身份信息推送到各个渠道。
这条命令失败了,返回「未登录」。这里有一个容易混淆的地方:模型本身一直在正常工作,能对话、能调用工具,但 OpenClaw 的账号登录是另一套体系,两件事互不影响。小虾米没有在原地反复尝试,它把当前状态整理成三段汇报:已完成的事项、被阻塞的事项、登录之后要继续做的事项,然后停下来等人处理。
这半小时里,2.0 的两个产品化设计已经能看出来了。一个是进度卡:它每读一个文件、每执行一次命令,对话里都有实时记录,最后汇总成一行「Used 7 tools」。另一个是结构化的状态汇报:异常不散落在聊天记录里,而是被整理成一份清单。这两点听起来朴素,但它们是 agent 能不能向人交代工作的分界。

一次真实任务:25 秒,以及两条我们自己没发现的异常
光看自我介绍说明不了问题,我们给了它一个真实任务。我们自己写过一个公众号运营工具,能把最近两周的粉丝和阅读数据从服务器拉取成表格。在一个新会话里,我们把命令原样交给小虾米:执行它,然后用三句话告诉我们,粉丝净增多少、阅读中位数多少、有没有异常。
25 秒后,它跑完了。
三句总结按约定交齐:粉丝净增 27;阅读中位数约 30,头部三篇文章(阅读量 1004、491、326)拉高了均值,整体呈典型的长尾分布。在此之外,它主动报了两条异常。第一,8 月 24 日粉丝单日增加了 201,它判断更像批量导入或后台补录,不是自然增长;第二,文章列表里有两条标题为纯数字的条目,阅读量几乎为零,疑似同步时混入的脏数据。
第一条异常的判断方向是对的。那天我们投了搜一搜推广,新增的就是那批用户,它手边没有投放记录,给出了一个保守但成立的猜测。第二条是真正的收获:那两条纯数字标题确实是同步时混入的脏数据,我们自己一直没有发现。一个安装不到二十分钟的工具,反过来给我们自己的系统做了一次体检。

16,000 个 PR 花在了哪里
16,000 个 PR 不可能逐个讲,实测中能直接摸到的主要是三块。
记忆系统。设置页里 Memory 分四个标签,其中一页叫 Dreams。这不是修辞:系统状态写着「Memory is awake」,下面是一排睡眠计划,每天凌晨 3 点运行一次 Light phase,把白天的短期笔记整理出来,候选内容搬进长期记忆。这就是 2.0 的「做梦」机制:你休息,它整理记忆,并且留下一本 Dream Diary。安装当晚的凌晨 3 点,小虾米做了第一次梦,日记的具体内容,我们看完之后另写一篇拆解。

凭据安全。Secrets 页的设计是二选一:凭据要么是 write-only,写入之后任何角色都读不出来,包括 agent 自己;要么被明确标记为「agent 可读」。2.0 还增加了一个机制:agent 需要密码时,弹出的是掩码输入框,密码不进入聊天记录,也不进入模型上下文。密码进入上下文是 AI 助手事故里最经典的一种,这个机制就是冲着它来的。
插件与模型生态。插件页显示 59 个已安装、40 个启用、0 个问题;渠道插件里有一个叫 A2A 的,是 agent 与 agent 之间通信的协议。官方更新记录里还有一行值得单独说:模型目录新增 Qwen3.8 Max、GLM-5.3 和 DeepSeek V4。上个月我们整理过那波 42 天 8 连发的国产模型发布潮,发布会上的模型,当月就进入了 agent 网关的模型菜单。从发布到可用,间隔已经按周计算了。

已知问题与边界
实测中踩到一个真实的坑:这台机器上 homebrew 安装的旧版命令行还留在 PATH 里,遮蔽了 2.0 的新命令行;旧版去读 2.0 写的配置文件会直接报错,报错内容是「Your config is valid, your assumptions are not.」(你的配置没问题,你的假设有问题)。解决办法不难,但老用户升级时会撞一下。
2.0 有两个破坏性变更:OpenProse 插件被移除,OpenAI 的路由从 codex/* 迁移到 openai/*。新装用户不受影响,但写过老插件、或者存了大量旧会话的用户,升级前应该先备份,官方更新文档的第一行也是这个建议。
没有测到的部分需要明说:浏览器扩展配对、多设备接力、云 worker、团队角色、Slack 和 Telegram 渠道接入,这次都没有覆盖。它们超出一台 Mac 的边界,写出来也只是复述文档,不是实测。
是否值得安装
如果机器上已经有 Claude Code 或 Codex 的登录态,2.0 的边际成本是两分钟和一个 DMG,装完之后得到的,是一个能执行命令、能读写文件、有记忆作息、遇到阻塞会写清单的常驻助手。pi 那类工具的工程哲学——状态放在文件里、不过度指挥模型——在 OpenClaw 2.0 里被做成了产品默认值:身份是文件,记忆有作息,进度对人可见。
当然,2.0 刚发布一天,记忆整理的实际质量、渠道接入的稳定性,都需要更长时间的使用来验证。我们计划让它先跑一段时间。那本凌晨三点写出来的 Dream Diary 里记了什么,下次拆开给大家看。


