OpenClaw v2026.7.1 全面拆解:Control UI 大改、GPT-5.6 接入与三端 App 重构
OpenClaw v2026.7.1 是一个体量很大的版本,3063 个贡献、532 位贡献者、2018 个公开 PR。但数字不能说明问题,真正值得注意的是 Control UI 的整体重写、三端官方 App 的离线体验补全、GPT-5.6 和腾讯 Hy3 等新模型的接入路径,以及几个长期存在的稳定性痛点终于被修掉了。
我按功能模块逐个拆,重点放在”改了什么、为什么改、实际用起来什么感觉”上。
Control UI 到底改了什么,凭什么说是一次”大改”?
答案是:整个交互模型从”单会话聊天页面”变成了”带多面板的浏览器工作区”。
旧版 Control UI 的核心问题是,你同时做几件事的时候得靠浏览器标签页来回切。会话列表、用量统计、定时任务、文件管理各自是独立的页面,上下文割裂。v2026.7.1 把这些收拢到了一个统一的侧边栏里,会话可以并排显示在可调整大小的面板中,刷新后布局还在。
多面板会话这个功能值得单独说。你可以把一个会话直接拖到当前面板里替换,或者拖到任意一侧创建分屏,拖拽过程中有预览提示告诉你它会落在哪个位置。在高分辨率桌面显示器上特别实用——左边放一个正在跑长任务的会话,右边开一个新会话做别的事,不用来回切标签。窄屏手机竖屏下它会退化为堆叠模式,但当前活跃面板仍然可用。
会话管理也补全了。侧边栏支持置顶、自定义分组、批量操作(重命名、归档、移动、删除)、已读/未读状态同步、转录分叉。你可以按渠道、Agent 类型、日期来组织大量会话,分组设置在刷新后不会丢失。会话列表行可以展开查看标签、调参控制和检查点历史,不用横向滚动。
新增的 Tasks 页面能查看当前正在跑的和最近完成的后台任务,打开对应会话、刷新详情、取消排队或运行中的任务(如果你有权限)。以前要知道后台在干什么,得去不同地方翻。
Usage 页面重做了。最近的预估花费、日均值、各供应商/模型/Agent/渠道的占比可以直接对比,不需要反复刷新或悬浮查看。它还能显示供应商上报的计划、配额、重置时间、余额、支出和预算,覆盖 OpenRouter 和 Venice。配了 Anthropic 或 OpenAI 管理凭证的话,还能看到日消费、token 数、请求数、热门模型和计费类别。7 天、30 天、90 天的图表现在会显示零活动的日期,而不是把时间轴压缩到只有活跃的那几天——看成本趋势时,空白日同样有意义,这个细节我之前没意识到有多重要,直到有一次排查某天为什么没有流量。
输入框在移动端和桌面端都重新设计了。附件、供应商和模型选择、语音、运行状态、消息操作在各个屏幕尺寸下保持可用且不拥挤。推理强度滑块从”快到慢”改成了更直观的”快到聪明”。引用回复右键就能做,不需要手动复制粘贴格式化。桌面端可以选 Enter 是发送还是换行,选了之后 Command+Enter 或 Ctrl+Enter 作为发送快捷键,偏好按 Gateway 保存。
工具密集的对话现在用可展开的紧凑行显示,输入、输出、预览、错误都在一行里,点开看详情。匹配的调用和结果合并成同一行,去掉了重复标签。图片类工具结果直接内嵌在对话中,不再只用文字提及。对话中的文件路径可以点击,打开带语法高亮的预览并跳转到引用行。GitHub issue 或 PR 链接悬浮时会预览状态、标题、作者和改动大小,不用离开对话。
几个我踩过的坑也被填了:临时 Gateway 断连不再把已认证的页面踢回登录屏,而是保持上下文并自动重连;断连提示从全宽横幅改成了紧凑的”重试”按钮,不会把页面内容挤下去;非致命的内部工具失败不再在助手已经给出正常回答后用红色错误横幅霸占整个对话流。
摘要:Control UI 从单会话聊天页变成了支持多面板、实时任务监控、精细用量分析的浏览器工作区,会话管理能力大幅提升。
从安装到第一条消息,新手上手体验变了吗?
变了,而且是结构性变化。以前新手最容易卡在”配好了但第一句话发不出去”这个阶段,现在引导流程把这个环节彻底重做了。
全新 CLI 安装会进入引导式设置,已配置的安装直接打开 TUI,重复运行保留已有选择,最终落在一个可用的终端聊天里。Mac 用户现在打开 App 后不碰 Terminal、不用 Homebrew、不需要管理员权限、不用额外审批 App 自己的节点,就能到达一个可用的本地 Agent。引导过程会在保存凭证前验证 AI 连接,认证失败时提供恢复步骤或手动 API Key 路径。它现在展示 Gateway 支持的完整文本推理供应商目录,不再只给 Anthropic、OpenAI 和 Google 三个选项,并且会在保存前测试凭证,还能检测 Claude Code、Codex、Gemini CLI 等选项。
Android 新用户会经过设置码或 QR 码输入、Gateway 配对、节点审批、权限确认、恢复步骤等一整套流程,完成后才结束引导。
中断恢复这块我之前吃过亏——认证到一半网络断了,回来发现得从头来。现在认证或渠道设置中断后,之前的选项会保留。没有可用模型的用户会被引导去配凭证和选模型,而不是被丢进一个不能用的聊天界面。
对现有安装的保护也到位了。Doctor 和更新命令拒绝替换不可读的 openclaw.json,保护现有的 Gateway、Agent、渠道和插件设置。openclaw doctor --fix 在多个退役模型名合并为一个当前模型时,会保留别名、参数、流式选择、运行时设置等调优,并准确报告合并冲突。扩展稳定版更新保留选择的发布渠道。容器升级在报告就绪前完成迁移和插件修复。不安全的运行时会在打开 OpenClaw 状态数据库前被阻止,避免数据损坏。
管理员和所有者现在可以通过 Telegram 私聊、Web UI、Discord 或 Slack 命令续期过期的 Codex 或 OpenAI 登录,不需要 SSH。这个在多团队协作场景下很方便——不是每个人都有服务器访问权限,但可能需要处理登录过期的问题。
摘要:引导流程从”配置完扔进聊天”变成了”验证通了再放开”,中断恢复和现有配置保护也补上了。
iOS、Android、macOS 三个官方 App 值得更新吗?
值得。核心理由就一个:断网时不再是白板了。
三个平台现在都会在 Gateway 不可用时显示最近缓存的会话和转录记录,可以继续阅读。iOS 和 iPadOS 打开就显示上次已知的对话,Android 也一样。Mac 端恢复最近会话后即使断连也保持可浏览状态。
iOS 和 Android 可以在断连时排队文本消息,这些消息在 App 重启后保留,重连后按顺序发送,有明确的重试和删除控制。Mac 端也为正确的 Gateway 身份排队离线发送。
滚动位置保持听起来是个小改动,但实际使用中,长对话里消息不断涌进来把你刚看到的位置冲掉,是非常烦人的事。现在 iOS 和 Android 聊天在新消息和工具活动到达时保持读者的滚动位置,并提供清晰的方式回到最新回复。
Apple Watch 用户可以口述消息并听到 OpenClaw 的最终回复,有独立的静默发送、取消和停止控制。如果你有在通勤或手上占着东西时快速查东西的需求,这个功能比想象中有用。
Mac App 的变化最大。现在提供了完整的会话侧边栏、真正的新会话创建、斜杠命令补全、上下文和成本可见性、消息复制、转录导出、紧凑或清空历史操作。这基本上让 Mac App 从一个”终端包装器”变成了有自己完整 UI 的客户端。
三个客户端在 Gateway 恢复后会刷新同一个对话,不会出现各端看到不同状态的情况。移动端的消息队列在 App 重启后存活。
摘要:三端 App 补上了离线阅读和离线排队的短板,macOS App 有了完整的原生聊天界面,Apple Watch 获得了基本的对话能力。
GPT-5.6、腾讯 Hy3、Meta Muse Spark 1.1 怎么接入?
每个模型有自己独立的接入路径,但共同点是都在 OpenClaw 的供应商路由体系里,保留各自的认证、模型限制、推理控制、工具行为、图片支持和用量报告。
有 GPT-5.6 预览访问权限的组织可以通过支持的 OpenAI 和 Codex 路由选择 Sol、Terra 或 Luna 三个变体,带有预期的上下文元数据、文本和图片输入、推理级别和缓存写入计费。新的 OpenAI API Key 和 ChatGPT/Codex 设置会选择预期的 GPT-5.6 默认值,不会替换显式的模型选择。支持的 Ultra 选择在 OpenClaw 和原生 Codex 之间保持一致。Codex 监督会将原生 Codex 子 Agent 记录为任务,并把结果返回给父会话。
腾讯混元 Hy3 通过 TokenHub 或 TokenPlan 有完整的设置路径,包括一等认证选择、CLI 引导、模型发现和配置验证。已有的 TokenHub 配置保留对 hy3-preview 的访问,同时有稳定的 hy3 模型。
Meta Model API 用 MODEL_API_KEY 或引导认证选择配置,选 meta-model-api/muse-spark-1.1,支持流式传输、工具调用、图片输入和推理努力控制。
Claude Sonnet 5 可以通过直接 Anthropic、Claude CLI、支持的 Vertex 区域、Bedrock 推理配置文件和 Bedrock Mantle 选择,带有文档记录的上下文、输出、图片、思考和定价行为。Claude Mythos 5 可以通过支持的 Anthropic 系列路由选择,有它要求的上下文、输出、自适应思考、缓存和回放行为。
其他供应商方面,Copilot 会话可以显式使用自定义 OpenAI、Azure OpenAI、Ollama 兼容或 Anthropic 供应商,在连接或凭证设置变化时干净重启。配对的计算机可以在本地 Ollama 模型上运行短任务,有单独的开关控制是否禁用节点推理。ClawRouter 通过单个 CLAWROUTER_API_KEY 暴露其被授权的模型,并报告用量和预算。可以用 openclaw promos claim <slug> 认领活跃的促销模型,不会替换已有默认值。LongCat-2.0 通过官方 LongCat 插件安装。Gemini latest 别名现在可以在两个支持的 Google 传输上继续工具调用对话。
摘要:GPT-5.6 三变体、腾讯 Hy3、Meta Muse Spark 1.1 各有独立接入路径,Claude 系列覆盖面扩大,Copilot 和 ClawRouter 的供应商选择也更灵活了。
Codex 和外部编码 Agent 的协作流程有什么实质变化?
安全模型变了。外部工具不再需要进程级凭证或冒充其他会话的权限,而是获得临时的、可撤销的会话级访问。
openclaw attach 启动 Claude Code,给它对主会话或选定会话的临时访问权限,凭证不出现在命令行参数里,会话结束时撤销授权。这意味着你可以在一个 OpenClaw 会话里调用 Claude Code 做代码修改,而不需要把 Claude Code 的凭证散布到整个进程环境。之前不敢在共享机器上用类似功能,就是因为凭证暴露面太大。
Codex 应用服务器 Agent 可以再次列出允许的 Agent、生成 OpenClaw 或连接的子 Agent、在委托工作期间让出控制权,恢复的心跳不会碰到不兼容的工具定义。从 OpenClaw 线程的 Codex 原生委托再次创建原生任务记录。不支持的自定义 Codex 应用服务器版本会在启动时以清晰的最低版本错误失败,而不是静默出问题——后者更危险,因为你以为在跑实际什么都没做。
Copilot 会话可以使用显式选择的自定义供应商,在模型、端点、凭证、请求头或 token 限制变化时干净重启。
会话持久化也有改进。重要会话可以置顶、重命名、归档、恢复,并作为持续工作被监控。活跃的 /goal 在后续轮次中继续引导,并在压缩、队列和中断后存活,直到目标被暂停、完成、阻塞或受限。以前跑长任务时,上下文压缩后目标就丢了,得重新设,这个体验很差。
摘要:openclaw attach 把 Claude Code 的访问权限收窄到会话级,Codex 委托链恢复了可靠性,长期会话和目标不再因压缩或中断而丢失。
Telegram、Slack、Discord、Signal、WhatsApp、Apple Messages 各修了什么?
每个渠道的改动点不同,共同方向是消息不丢、进度可见、恢复更干净。
Telegram
照片相册现在会把每张成功下载的图片按顺序传给模型,而不是只传一张加上一堆不可用的文件引用,失败的条目被省略。实时进度视图在推理、评论、格式化和工具活动期间保持可读和稳定,完成后留下简洁的完成摘要而不是消失。网络握手不稳定时,最终回复或 Bot 发送失败的情况减少了,同时没有增加重复消息的风险。
Slack
回复附着在根线程的会话历史上,不再积累单独的、几乎为空的子会话——这个问题之前导致会话列表被大量空壳线程污染。当 Slack 接受了回复但确认丢失时,OpenClaw 可以验证已有帖子并避免发送重复。长对话减少了到达 Agent 前的不必要等待。
Discord
完成的部分流式回复作为新消息到达,可以在用户离开频道后触发正常未读提示。回复、cron 报告和其他出站消息在短暂 Gateway 重连期间不太可能消失,不会重放 Discord 已接受的块或媒体。Bot 在反复会话恢复拒绝后可以原地恢复,减少长时间中断和完整的 Gateway 重启。
Signal
自动回复现在引用触发它的消息,群组和繁忙对话中的回复更容易跟踪。用户可以给常用联系人和群组分配稳定名称如 signal:me 或 signal:ops,不用重复使用原始电话号码、UUID 或 ID。
登出或被替换的账户保持停止状态直到重新连接,不再进入重复重启循环消耗资源。短暂重连期间收到的合格消息到达 OpenClaw 进行自动回复,而不是被标记为已读然后静默跳过。并发的回复、媒体、反应和排队消息每个账户一次一个地发送,减少干扰和不可预测的投递顺序。完成的回复在另一条消息中途到达时继续投递,不会突然沉默。
Apple Messages
从远程 iMessage Mac 桥接到独立 Gateway 主机的照片通过可读的本地路径到达 Codex 对话,而不是一个只有 Mac 能识别的文件名。AppleScript-only 和 SSH iMessage 设置在线程不可用时也能传递回复。直接 iMessage 聊天在慢轮次被接受后立即显示输入状态,不等待已读回执。普通句子文本不再因为以 user:、system: 或 assistant: 结尾而被误识别为内部角色标记——这个 bug 挺离谱的,意味着如果你正好写了类似”请以 assistant: 开头回复我”这样的话,整段文本会被吞掉。
摘要:六个渠道的共同改进方向是消息投递可靠性和进度可见性,WhatsApp 的重启循环和 Apple Messages 的角色标记误识别是两个比较具体的痛点修复。
Gateway 反复崩溃终于有救了?
有救。以前一个受监督的 Gateway 如果在启动时反复失败,会无限重启,操作者被锁在重启循环里,连排查的机会都没有。现在,反复崩溃的 Gateway 留下一个稳定的控制进程供检查和修复,自动的渠道和供应商重启暂停,直到底层问题被修复。
这看起来是个小改动,但如果你在凌晨三点被告警叫起来,发现 Gateway 在无限重启、SSH 进不去、日志在循环写,你就会明白这个”停止重启”的行为有多重要。它给你留出了一个操作窗口,能去看日志、改配置、回滚版本,而不是眼睁睁看着它一遍遍起来又倒下。
摘要:Gateway 崩溃循环从”无限重启”变成了”停下等你修”,这是运维层面最实质的改进之一。
定时任务、远程浏览器、工作区终端有什么新东西?
三个独立功能,放在一起说是因为都跟自动化工作流有关。
定时任务现在可以在外部命令完成或监控的条件变化时才唤醒,而不是每次轮询都完整启动 Agent。重新应用相同的声明就地更新预期的任务,保留身份和历史,不会创建重复调度。具体来说,一个 cron 任务可以监控构建、部署、脚本或其他命令,在完成时用退出码和最近输出恢复发起的工作流。另一个场景是监控外部条件,只在状态变化时运行真正的负载,避免在未变化的轮询上完整唤醒 Agent。这对资源消耗和成本都有直接影响——你不想每次轮询都花一次完整的 Agent 调用费用。
远程浏览器方面,操作者可以把捆绑的 Chrome 扩展与远程 Gateway 配对,只共享选定的已登录标签页,诊断 Windows 和 WSL2 连接详情,通过从 OpenClaw 组中移除标签页来撤销访问。Agent 可以等待延迟的下载并将完成的文件保存到受保护的位置。”只共享选定标签页”这个设计很关键——你不想让 Agent 看到你所有已登录的页面。
受保护的工作区终端现在在 Web、iOS 和 Android 上可用,不再局限于桌面浏览器。
摘要:定时任务从”定时全量唤醒”进化到”条件触发唤醒”,远程浏览器配对支持选择性标签共享,终端能力覆盖到了移动端。
实用摘要 / 操作清单
-
升级后先检查 Control UI 侧边栏,确认会话分组、置顶、多面板拖拽正常工作 -
配置 Usage 页面的供应商凭证,用 Anthropic 或 OpenAI 管理凭证可以拉取细粒度计费数据 -
断开网络后打开 iOS/Android/macOS App,确认缓存会话可见、消息可以排队 -
接入新模型:GPT-5.6 走 OpenAI/Codex 路由,Hy3 走 TokenHub/TokenPlan,Muse Spark 1.1 用 MODEL_API_KEY -
在终端运行 openclaw attach让 Claude Code 接入当前会话,完成后确认凭证已撤销 -
如果有定时任务,重新应用声明后确认没有创建重复任务 -
手动制造一个启动失败条件,验证 Gateway 是否停在可检查状态而不是无限重启 -
三个平台都更新官方 App,尤其是 macOS 的原生聊天窗口
一页速览
| 模块 | 核心变化 |
|---|---|
| Control UI | 多面板会话、实时任务页、重做用量视图、侧边栏会话管理 |
| 引导流程 | 验证后才放开聊天、中断恢复、现有配置保护 |
| iOS/Android/macOS | 离线缓存、离线排队、滚动保持、Mac 原生聊天窗口、Apple Watch |
| 模型 | GPT-5.6(Sol/Terra/Luna)、腾讯 Hy3、Meta Muse Spark 1.1、Claude Sonnet 5/Mythos 5 |
| Codex 协作 | openclaw attach 会话级访问、Codex 子 Agent 委托恢复、Copilot 供应商灵活选择 |
| Telegram | 相册全量传图、稳定进度视图、减少网络失败丢消息 |
| Slack | 线程历史一致性、去重、减少长对话等待 |
| Discord | 未读提示修复、重连不丢消息、原地恢复 |
| Signal | 引用回复、友好别名 |
| 停止重启循环、重连不丢消息、顺序发送 | |
| Apple Messages | 远程 Mac 图片路径修复、输入状态显示、角色标记误识别修复 |
| Gateway 稳定 | 崩溃循环停止重启 |
| 自动化 | 条件触发 cron、远程浏览器选择性配对、移动端终端 |
FAQ
Q: 升级后现有的 openclaw.json 会被覆盖吗?
不会。Doctor 和更新命令拒绝替换不可读的配置文件,会保留现有设置。
Q: 多面板会话在手机上能用吗?
能用,退化为堆叠模式,当前活跃面板仍然可用。
Q: GPT-5.6 的 Sol、Terra、Luna 怎么选?
取决于你的组织获得的预览访问权限和使用场景,在 OpenClaw 内通过 OpenAI 和 Codex 路由选择即可。
Q: 离线排队的消息在重连后一定会发出去吗?
会按顺序尝试发送,失败的有重试和删除控制,前提是最终能重连上 Gateway。
Q: openclaw attach 需要什么前提条件?
Claude Code 已安装且 OpenClaw Gateway 正在运行,不需要进程级凭证。
Q: WhatsApp 的重启循环在什么场景下出现?
账户登出或被替换时旧版本会不断尝试重启,v2026.7.1 让它保持停止直到手动重连。
Q: Usage 页面的 Anthropic/OpenAI 计费数据需要额外配置吗?
需要配好管理凭证,之后 Usage 页面才能拉取日消费、token 数等数据。
Q: 条件触发 cron 和传统 cron 冲突吗?
不冲突,条件触发是新增的可选声明方式,传统定时 cron 照常工作。

