每一个 Agent 产品都在同一个星期上了手机。这不能是巧合。
6月30日,Cursor 发布 iOS 原生应用。同一天,OpenClaw 的 iOS 和 Android 应用一同上线。7月7日,Claude Cowork 向网页和移动端扩展。
密集到反常。但如果把这三件事拆开看,它们指向的不是同一个功能,而是同一个趋势:Agent 产品正在集体穿越一道分水岭。
流行的叙事会说,"AI 助手变得更好用了,手机上也能用了"。这是把一次产业结构级的变化,翻译成了客户端版本号更新。真正发生的事情是:Agent 正在从"需要人类全程监督的同步工具",变成"可以在无人值守状态下独立工作的数字员工"。而手机,就是人类管理这些员工的控制台。
一、手机不是第二个聊天窗口
先看 Claude Cowork。
Cowork 最初是 Anthropic 在 2026 年 4 月推出的桌面功能,定位是"面向非程序员的 Claude Code":用户可以扔给 Claude 一堆文件、资料和任务,让它制定计划并持续执行。和 Claude Code 一样,它寄生于用户的本地电脑。电脑关机,任务停止。
7 月 7 日的更新,改写了这个前提。Cowork 的会话和文件被保存到 Claude 的账户中,执行环境从用户电脑迁移到了远程基础设施。现在,即使用户合上电脑,任务也能继续运行。定时任务不再要求任何设备保持在线。
Anthropic 在官方介绍中给出的场景很平淡:用户可以在办公桌前向 Claude 交代任务,离开电脑后在手机上继续查看;如果 Claude 遇到需要人类判断的问题,通知会发送到手机,用户决策后 Agent 继续工作。邮件发送、文件交付等最终动作,仍然需要用户审查和批准。
但平淡的描述背后,隐藏着一个被绝大多数人低估的变化。
Cowork 的移动端最重要的功能不是输入框。是任务队列、运行状态、推送通知、结果预览、批准按钮和继续指令。换句话说,手机不再是一个让用户"向 Claude 提问"的入口——它变成了一个让用户"查看 Claude 在做什么"的管理后台。
同一周,Cursor 的 iOS 应用也在走同样的逻辑。用户可以在手机上选择代码仓库、启动云端 Agent,然后退出应用。Agent 在独立虚拟机中运行,可以安装依赖、运行测试并持续迭代。完成后,锁屏实时活动和推送通知告知开发者。开发者可以在手机上查看代码差异、运行日志、截图和演示结果,继续下达指令,甚至直接合并 Pull Request。
Cursor 将这种工作方式描述为"异步":Agent 在后台长时间工作,人类负责明确目标、检查结果和决定是否合并。
OpenClaw 则走了第三条路。它的手机应用本身不承载 Agent,而是一个"伴随节点":用户仍需在桌面端运行 Gateway,手机通过配对实现对话、语音控制、任务状态查看、操作批准,以及摄像头、屏幕、位置等设备能力的调用。
三种产品在手机上要做的事情,有本质的不同。
Claude Cowork 和 Cursor 选择将执行环境托管到云端——用户把自己的工作基础设施交给了产品方。OpenClaw 选择本地优先——手机是控制面板,Gateway 在用户自己的硬件上运行。前者降低部署门槛,后者保留数据控制权。
这不仅仅是架构差异。它意味着三家公司对"信任"这件事的理解截然不同。Claude Cowork 信任平台来管理执行,Cursor 信任沙箱来隔离风险,OpenClaw 信任用户来控制基础设施。
二、Agent 进化的三个阶段
把时间轴拉长,Agent 产品从诞生到今天,经历了三个清晰的阶段。理解这三个阶段,比争论"哪家产品更好"有用得多。
阶段一:聊天机器人。 用户提出问题,模型立即回答。交互是同步的——一个往返就是一个任务。AI 的价值完全取决于模型能否给出更好的答案。此时的手机是纯聊天通道,用户体验约等于微信里的一个 AI 好友。
阶段二:工作环境 Agent。 以 Claude Code、Cursor 为代表——Agent 开始读取代码仓库、编辑文件、运行命令和调用工具。AI 不再只是提供建议,而是直接参与执行。但它的生命周期绑定在用户设备上:电脑关机,任务终止。移动体验?基本不存在。
阶段三:异步员工。 这才是我们现在站的位置。任务被提交到远程执行环境,Agent 可以在无人值守的状态下持续工作几十分钟甚至数小时。人类退出实时交互闭环,只在关键节点出现——审批、纠偏、验收。手机不再承载 AI 对话,而是承载管理职能。
阶段三之所以重要,不是因为技术上有多了不起,而是因为它改变了"人与 AI 的关系"这个底层结构。
关系变了,行为就会变。
一位 X 用户说得精准:"一旦你不再需要全程盯着它,就会开始把过去根本不会启动的任务也排进队列。任务范围的膨胀是双向的:Agent 能做的事情变多了,人交给它的事情也会越来越多。"
Anthropic 自己的数据印证了这一点。Cowork 超过 90% 的使用场景并非软件开发,业务运营和内容创作两类任务合计占据约一半用量。核心用户正在从程序员扩展到财务、运营、销售、咨询和内容工作者。这些用户不会写代码,也不需要写代码——他们只需要把工作流描述清楚。
三、三种信任模型,三个方向
我们把三种产品的移动策略放在同一个框架下对比,会发现一条清晰的逻辑线:产品以何种方式托管执行环境,决定了它能做什么、不能做什么、用户要承受什么风险。
Claude Cowork 的模型:托管信任。 用户把文件上传到 Claude 的远程环境,Agent 在 Anthropic 管理的基础设施上运行。用户的操作成本极低——打开浏览器或手机就行。代价是用户必须接受 Anthropic 管理他们的工作数据。这适合不需要严格数据合规的场景,或者是"只想把事情办完"的普通工作者。
Cursor 的模型:沙箱信任。 代码在独立虚拟机中执行,环境随用随建,任务结束即销毁。开发者可以在手机上审批,但代码和数据相对隔离。这是面向专业开发者的妥协:既享受异步 Agent 的交付效率,又保留了一定程度的代码可控性。
OpenClaw 的模型:自托管信任。 Agent 运行在用户自己的 Gateway 上,手机只是配对控制节点。缺点显而易见——部署成本高,用户需要自己维护基础设施。但好处是:不出网关,不碰云端,用户对 Agent 的权限边界、工具调用和数据流向有完全的可见性和控制力。
这三种模型没有优劣之分——它们对应的是不同的用户群、不同的信任偏好、不同的风险承受能力。
但值得注意的一个趋势:产品方正在通过"云端执行"压低用户的使用门槛,让 Agent 触达到那些不会管理服务器、不理解部署概念的普通工作者。Cowork 的统计已经证明,90% 的使用不是写代码。这扇门一旦打开,Agent 的用户群将不再是开发者,而是每一个办公室工作者。
四、四根尚未立起的柱子
阶段三已经到来,但 Agent 产品离"可靠的生产工具"还有四根柱子需要立起来。
第一根:持久运行能力。 Agent 必须在用户离线后维持任务状态,并能在网络中断、工具报错、上下文溢出后恢复工作。这不是简单的后台保活,而是涉及状态持久化、错误恢复和长上下文管理的系统工程。
第二根:权限与审批机制。 发送邮件、合并代码、支付账单等操作不可逆。产品需要区分哪些步骤可以自动完成,哪些必须等待人工确认。Claude Cowork 的"审批后发送邮件"是一个开始,但在复杂的业务流中,审批节点本身就是一门学问。
第三根:可观察性。 用户需要知道 Agent 读了什么文件、调了什么 API、做了哪些修改,以及为何停在了某个步骤。没有可观察性的 Agent 是黑箱。你不敢把真正的业务交给一个黑箱。
第四根:成本可预测性。 始终在线的 Agent 会让 token 计费变得无法预测。Reddit 上已经有用户指出,基于 token 的计费模型无法适应异步工作模式。企业需要一个固定的套餐、预算限制和分级定价方案,而不是一个"随便用,月底买单"的模型。
这四根柱子,比模型能力更紧迫。模型可以迭代,但基础设施不是一天建成的。
五、所以你现在可以做什么
如果你是一个管理者: 不要再问"AI 能替掉多少人"。开始问"我的团队里有哪些持续几个小时、重复出现、依赖多条信息源的例行工作"。这些工作是 Cowork 的天选场景。把这类工作抽象成 Agent 的工作流,然后让人来做剩下的。
如果你是一个独立开发者: Cursor 的移动端给了你一个"不坐在电脑前也能推进项目"的能力。但警惕 Slopfix 现象——Agent 生成的代码如果没有人 review 和重构,六个月后的维护成本会吃掉你所有节省下来的时间。
如果你是一个对数据有控制需求的技术负责人: OpenClaw 的模型是目前唯一一条"本地执行、手机控制"的路径。这意味着你可以在保持数据主权的同时获得 Agent 的异步能力。付出的代价是部署和维护 Gateway。
如果你是 Agent 产品的构建者: 移动端不是锦上添花。它是阶段三的入场券。如果你的 Agent 不能在用户离线后继续工作,不能在手机上被管理,它很快会被用户归类为"聊天机器人",而不是"数字员工"。
参考来源:
- Anthropic 官方博客: Claude Cowork on web and mobile
- Cursor 官方: iOS 应用公测版
- OpenClaw 官方: 移动端 iOS/Android 发布
- Anthropic Cowork 使用数据统计 (2026年5月)
- Reddit r/ClaudeAI 用户讨论
- 36氪报道《Claude、Cursor、OpenClaw集体上手机》
