文 | 科技新知 ,作者丨思思,编辑丨九黎
2026 年作为智能体从 「对话 AI」 向 「行动 AI」 全面跃迁的元年,人工智能行业旧有的竞争格局也由此发生重组改变。Agent 不再只是一个概念,而是作为生产力出现的背后,是国内外玩家齐下阵,布局通用、垂直、工具各领域,最终形成了一个完整产业生态。
其中,最值得关注的,除了有关媒体所指出的北美、中国、欧洲三方全球 Agent 产业竞争版图,还有就是桌面端 AI 原生办公智能体的 「涌现」。如果说,国外用开源项目初步定义了桌面办公 Agent 的框架标准,那么国内如今就正在把 「桌面端」 当作竞争的核心场域和领先突破口,进一步地深化和拓展。
海外抢注——OpenClaw 与 Hermes 开源卡位
桌面办公 Agent 的 「第一枪」,不是大厂打响的,是开源社区打响的。
今年上半年,以 OpenClaw 和 Hermes 为代表的海外开源桌面智能体项目快速崛起,它们的核心思路是:不依附任何协同办公平台,直接接管操作系统层面的任务调度——文件管理、跨应用数据流转、本地流程自动化。它们从第一天就定义为 「桌面上的 AI 同事」,而非 「聊天框里的 AI 助手」。
据清华北航联合报告 《2026 智能体工具大全》 系统梳理,「龙虾 Claw」 系列已成为跨厂商轻量化智能体的通用形态,覆盖本地部署、云端调用与行业定制多个版本,被定位为个人与中小企业落地的首选载体。
因此可以说,它们先于商业产品定义了 「桌面办公智能体」 的技术标准与交互范式。当 MCP(模型上下文协议) 成为打通大模型与外部软件的通用标准后,OpenClaw 与 Hermes 所构建的开源工具链,实际上为后续所有商业产品铺设了底层接口。
换言之,海外开源玩家做的是 「修路」,商业玩家是在 「路上跑车」。谁先修完路,谁就掌握了生态话语权。
国内突围——WorkBuddy 与 Kimi Work 两条路径
海外定义了形态,国内则把形态变成了能落地的产品。
腾讯 WorkBuddy 与月之暗面 Kimi Work 是当前最具代表性的两个产品化样本,但是路径截然不同。
WorkBuddy 的前身可以说是 CodeBuddy,负责人汪晟杰从提出想法到带着几名同事用一个周末做出初代版本再到上线内测,中间只隔了 2 个月左右。就是诞生如此迅速的一个产品,却成为了国内用户规模最大的办公智能体应用。第三方统计,WorkBuddy 日活突破了 1300 万。
对此,腾讯方面规划的发展方向是加速打造 「生态整合型」应用。有媒体报道,腾讯已将 QClaw 产品中心相关业务和部分团队调整至 WorkBuddy 所在部门,WorkBuddy 甚至成为了内部 AI 应用中战略优先级最高的产品之一。然而布局还在加快,官方宣称 WorkBuddy 兼容 OpenClaw 的技能体系、内置超 20 种 Skills 技能包与 MCP 协议,并支持混元、DeepSeek、GLM、Kimi 等大模型。继打通腾讯系生态后,7 月 25 日,它上架鸿蒙电脑应用市场,成为鸿蒙平台首个桌面办公智能体;7 月 30 日,V5.3.5 全新版本联合腾讯文档推出 「人机双写」。
数据证实,成效斐然。据易观发布 《2026 年二季度中国办公智能体平台市场洞察》 报告统计,6 月国内主流桌面端办公智能体产品访问量中,WorkBuddy 以 2097 万次居首,超过第二名 TRAE IDE(1279 万) 与第三名 QoderWork(788 万) 之和。

图源/「易观分析」,2026-07-22
月之暗面则靠着从编程到办公的迁移,成为了 「模型能力驱动型」的典范。Kimi Work 于 6 月 3 日上线,官方帮助中心明确其目前处于 Beta 测试阶段并保持高频迭代,已陆续新增文件预览、草稿自动保存、目标模式、插件中心等功能。依托 Kimi K2.6 模型的长程任务执行能力,支持 13 小时连续编码、300 个子 Agent 并行协作,以及 4000 余次自主工具调用。客户端分为 「Work」 和 「Chat」 两种模式,以 Kimi Code 为内核,能够在 「Agent」 与 「Agent 集群」 两种执行模式之间切换,满足日常办公通用需求。
要知道,就在刚刚过去的 7 月,月之暗面凭借着新一代大模型 Kimi K3 登顶国际 AI 代码工具评测榜单 Arena,赚足了风头,同时也极大地证明了其模型实力。毕竟 Kimi K3 的参数规模达到了 2.8 万亿,是目前全球参数规模最大的开源模型。

图源/「凤凰网财经」,2026-07-21
Kimi Work 以长上下文处理能力切入桌面办公场景,主打 「一个对话框调度全部桌面工作流」。其差异化在于底层模型的推理深度与多模态理解能力,试图以模型代差弥补生态短板。
整体来看,两条路线的分野很清晰:前者抢入口宽度,后者挖场景深度。一个靠用户基数与生态粘性,一个靠模型能力与体验锐度。国内桌面办公 Agent 的 「产品化突围」,本质上或许就是这两种能力的竞速。
转型信号——阿里 QwenWork 与字节 Trae Work 竞相争锋
与 「从零定义形态」 的创业项目不同,协同办公巨头走的是 「转型」 路线——把既有平台升级为 Agent 平台。
8 月 3 日,阿里旗下 「千问办公」(QwenWork) 开启公测,将 QoderWork、悟空、MuleRun 三款产品整合为统一平台。官网称其是业界首批将桌面智能体、云端智能体与企业协作智能体融于一体的平台之一,致力于为个人及企业打造高效的办公生产力解决方案。此外,QwenWork 还将深度融入钉钉生态系统,不止是独立的网页及桌面智能体平台,未来还将推出独立移动客户端 (App) 及国际版本,实现多端协同,覆盖更广泛的办公应用场景。

字节跳动则在 7 月 30 日启动面向 AI 业务的组织调整 ,相关媒体报道,飞书产品团队与豆包产品团队将整合,成立新的豆包产品团队;飞书 GTM 团队与火山引擎团队整合,成立新的 ToB GTM 组织 「创造力服务平台」。几乎同期,新版飞书 aily 官宣,带来主动工作、团队共享智能体和多智能体协同等全新能力。据媒体报道,在此之前字节也将 TRAE Solo 升级为 TRAE Work,定位从开发者工具转而推向更广的专业人群。
无论是阿里的钉钉、还是字节的飞书,其发展的底层逻辑一致:协同办公入口,必须长出 Agent 能力。
谁将领跑——从 「框架混战」 到 「场景落地」
牌桌可能已经坐满,但领跑者尚未诞生。
有媒体指出,2025 年的 Agent 框架混战已基本结束,产业注意力正式转向 「怎么落地」。同样的趋势也被其他研究报告表明:行业下一阶段竞争将聚焦场景落地能力与跨系统协同效率。
这也意味着,当前行业面临的核心瓶颈并非技术,而是价值兑现。艾媒咨询 《2026 年中国 AI 办公智能体产业发展白皮书》 显示,AI 办公智能体的使用场景集中于自动生成 PPT(51.8%)、表格数据分析 (38.2%)、批量文件整理 (37.1%)。但这些功能,免费工具可以基本覆盖。

图源/「艾媒网」,2026-07-20
毕马威 《2026 全球科技报告》 的数据更为冷峻:88% 的企业已试点 Agentic AI,但仅 24% 在多种应用场景中实现了投资回报。更大的问题在于 AI 生成内容的质量稳定性——应该没有企业敢让 AI 独立完成一份关键文件的书写。
当市场竞争的锚点已然转向 「谁的场景落地更深、商业兑现更快」,决定胜负的硬指标也随之变成了——谁能先跨过从 「辅助作业」 到 「独立交付」 的门槛。
2026 年,桌面办公 Agent 的战争不是 「谁的模型更聪明」,而是 「谁先让企业把其划为固定预算支出」。毋庸置疑的是,凭借垂直赛道的纵深,中国 Agent 正从 「跟用」 走向 「引领」。但是这场比赛,才刚刚开始。















