企业选 AI 办公智能体,判断标准换了一轮。上一轮问「能不能用」,这一轮问的是怎么计价、谁来交付、权限救不救得回来。据 QuestMobile 2026 年 7 月数据,国内 AI 效率办公赛道月活已达 1.02 亿。

赛道格局:六家挤在同一张桌子上

动作集中在近几周:9 月 15 日字节发布「豆包工作伙伴」,9 月 2 日 WorkBuddy 上线开放平台,首批超百家生态伙伴接入。9 月 4 日阿里千问办公交出首月成绩单,注册用户破 3000 万、过半为企业用户。9 月 9 日京东发布 JD JoyWork,一周内华为小艺 Work 开启内测。

需求侧已不需要被说服。据 IDC 数据,2025 年中国企业级 AI 智能体市场规模约 212 亿元,2026 年预计增至 449 亿元,2029 年有望突破 3320 亿元;办公 AI 助手在中国白领中的使用率达 57.27%。

厂商办公智能体月活近期动作
腾讯WorkBuddy 658.2 万 / QClaw 225.9 万9 月 2 日上线开放平台
字节TRAE Work 190.4 万9 月 15 日发布「豆包工作伙伴」
阿里QoderWork 23 万千问办公 9 月 4 日交首月成绩单
京东9 月 9 日发布 JD JoyWork
华为小艺 Work 开启内测

计费换挡:从「座位钱」到「用量钱」

WorkBuddy 采用免费额度加积分订阅,免费版每月 500 积分,包月 70 到 999 元。据王智远观察,老牌软件的收费模式正从「座位钱」向「动作钱」「结果钱」迁移,金山办公 WPS 365 在订阅外增加 AI 用量计费,半年收进四个多亿、同比涨了六成。该文所引案例中,用友把某集团财务外包后,三年团队从 550 人减到 240 人、AI 替代率 56%。付费用户在 token 消耗、任务量、月活跃天数上分别是免费用户的 6.2 倍、5.2 倍、3.0 倍——计费模式的迁移直接决定三年总成本曲线的形状。

效果边界:赢过人类,不等于更便宜

ApprenticeBench 把 Agent 放进一家模拟建筑公司,处理 100 张应付账款账单。Fable 5.1 通过率 72%、GPT-6 Astra 68%,高于参与测试的人类(51%)。另一组数字更该被看见:Fable 5.1 每张账单平均成本 18.23 美元,人类 7.21 美元,差约 2.5 倍;它还发出 1032 条消息,比人类多出一倍。通过率赢、单位成本输,这个组合在真实业务量下会被放大。

上下文决定成败

同一评测里的一组对照:只给操作手册时,模型通过 11 张;给它六个月的账单历史,31 张;再加主管反馈,35 张;两者同时给,43 张。差异不在模型能力,在喂进去的上下文——模型之外的权限、历史数据与反馈机制,才决定落地效果。奇摩在评估阶段会先确认客户的历史数据与审批流能不能接进来,接不上就先把试点范围收窄。

落地暗线:权限与审计

腾讯方面介绍,智能体侧建了三层纵深防御:安全沙箱划定资源与敏感路径的边界、逐项授权并全程留痕、第三方技能上线前走「预检—分析—跟踪—处置—审计」五步(厂商口径)。生态越开放,权限治理越不能后置——奇摩的交付团队把权限清单与操作留痕能力写进验收项,而不是留到上线后再补。

下一步:四条可执行的选型动作

1. 算三年总成本——不只看订阅价,把用量计费按业务量估一遍; 2. 问清权限模型——哪些动作自动执行、哪些必须人工确认、能否回溯; 3. 确认上下文接入能力——能不能接企业自己的历史数据与审批流; 4. 定交付方——产品能力之外,谁做实施、谁承担后续迭代。

按当前节奏,订阅叠加用量的混合计费会成为企业 AI 办公的主流计价方式。产品能力终会趋同,差别会落在交付侧——这是奇摩作为 WorkBuddy 授权代理商在华南承接评估与实施时的基本立场。需要结合业务量测算三年总成本的企业,可参考 AI 办公解决方案预约咨询