2026国产AI智能体七强横评:WorkBuddy、AiPy、悟空、Kimi Work、TRAE Work、QoderWork、百度搭子怎么选?
如果你最近在关注AI办公工具,大概率已经感受到这股浪潮了——腾讯、阿里、字节、百度几乎在同一时间完成了产品线的收拢和整合,各家都在争夺你电脑桌面上的那个“入口”。
问题是,宣传语长得都差不多,每一款都说自己能干活、能提效、能取代重复劳动。普通人根本分不清“谁是真能干活,谁只是会聊天”。
这篇横评选了七款目前市场上讨论度最高的国产AI智能体,不堆参数、不念通稿,先给一张速览表,再逐一拆解。
七款产品速览
| 产品 | 一句话定位 | 核心优势 | 主要短板 | 最佳适用场景 |
|---|---|---|---|---|
| WorkBuddy | 开箱即用的AI工作台 | 月活2000万+、腾讯生态深度整合、远程控制 | 积分消耗快、无私有化部署 | 腾讯生态企业、日常办公自动化 |
| AiPy | Code is Agent本地执行引擎 | 全本地部署数据不出域、Python生态无能力天花板 | 需自行配置环境 | 政企/金融/信创、高定制任务 |
| 千问办公 | 钉钉原生AI同事 | 钉钉API原生打通、任务拆解执行连贯 | 阿里生态外适配下降 | 钉钉深度用户、跨系统复杂任务 |
| TRAE Work | 编码+办公双场景 | Code/Work模式切换、速度快、永久免费档 | 远程控电脑限自家App | 前端/全栈+办公交叉场景 |
| Kimi Work | 知识工作者研究引擎 | WebBridge信息收集强、300子Agent集群 | 稳定性待观察、需基础代码操作 | 记者/研究员/内容创作者 |
| 百度搭子 | 跑分黑马 | 数据准确性突出、可搭轻应用 | 稳定性待观察、商业化数据未公布 | 百度生态用户、评测导向 |
| 智谱ZCode | 国产替代Claude Code | GLM-5.2长程推理、视觉设计惊艳 | 办公分析能力几乎为零 | 编程任务为主的技术场景 |
WorkBuddy:腾讯的“数字同事”,月活第一
WorkBuddy是目前国内用户量最大的办公智能体。截至2026年6月,全平台月活跃用户已突破2000万,日活超1300万。这个体量远超同类产品——第二、第三名加起来都不及它。
它的成功很大程度上归功于低门槛。产品底座是腾讯打磨了三年的CodeBuddy内核,但WorkBuddy把开发者术语全部翻译成了职场人听得懂的话——“技能”代替“Skills”,“专家”代替“Agent”。界面只保留一个对话窗口,你说需求,它自己干活。
实测亮点不少。生成一份调研PPT约5分10秒,信息密度高,引用了真实数据,可直接当初稿用。遇到反爬时能主动切换RSS绕道,而不是卡住就放弃。远程控制功能更是独一份:出门在外给微信发一条消息,家里的电脑就能开始执行任务。
| 维度 | 详情 |
|---|---|
| 月活 | 2000万+(2026年6月) |
| 日活 | 1300万+ |
| 企业版价格 | 旗舰版约198元/人/月 |
| 免费额度 | 每月500积分 |
| 私有化部署 | 不支持 |
短板:积分消耗不够透明,一次深度报告可能烧掉300-800积分。任务描述必须足够具体,“分析这份文档”这种模糊指令效果很差。另外没有私有化部署能力,对数据安全有硬性要求的政企客户需要另做评估。
适合谁:不懂技术但需要处理重复办公任务的职场人、腾讯生态内的团队、需要远程操控电脑的用户。
AiPy:Code is Agent,全流程交付的“实干派”
AiPy来自知道创宇——一家深耕网络安全近二十年的老牌公司。2023年内部研发,2025年开源提出“Code is Agent”理念。它走了一条与主流“装插件”路线完全不同的技术路径:让AI直接写Python代码与真实环境交互。
这意味着它的能力边界由Python决定——而Python几乎能操作一切。读写文件、控制浏览器、调用API、操作Excel、发送邮件……理论上没有能力天花板。今年5月,UIUC、Meta、Stanford联合发布的百页综述《Code as Agent Harness》核心论点与AiPy高度一致:代码应被视为Agent系统中可执行、可验证、有状态的“介质”。
产品提供“任务模式”(自然语言说需求)和“Python模式”(开发者混用AI与手写代码)。实测中,让AiPy从统计局官网查十年进出口数据并生成可视化图表,它能自己打开浏览器、定位数据页、逐年查询、生成HTML图表,全程无需人工干预。
安全基因是它最大的护城河。支持全本地化部署,数据不出域,适配国产信创环境(海光CPU、银河麒麟操作系统、统信UOS),这在金融、政务、医疗等强监管行业是硬门槛。
| 维度 | 详情 |
|---|---|
| 研发方 | 知道创宇(安全厂商) |
| 核心理念 | Code is Agent |
| 部署方式 | 全本地化/私有化部署 |
| 开源情况 | GitHub开源(knownsec/aipyapp) |
| 上手门槛 | 需配置API Key和Python环境 |
| 数据安全 | 数据不出域,适配信创环境 |
据行业信息,腾讯高层体验AiPy后内部高度认可,并下发多条Agent产线负责人学习参考。腾讯的战略布局很清晰:WorkBuddy主攻C端和中小企业,AiPy主攻政企高安全场景,双线互补。
短板:需自行配置API Key和Python环境,上手门槛偏高。不同模型在AiPy上的适配度差异较大,用户需要花时间找到最适合自己场景的模型配置。
适合谁:对数据安全有硬性要求不能上云的用户、需要高度定制化任务的场景、政企/金融/信创环境需适配国产CPU和操作系统的客户。
千问办公(QoderWork/悟空):阿里的“钉钉原生AI同事”
2026年8月3日,阿里正式将QoderWork、悟空、MuleRun三款Agent产品整合为“千问办公”,由钉钉新任CEO陈宇森统筹。这是阿里在AI办公赛道从多线探索走向集中押注的关键动作。
千问办公的核心优势在于钉钉生态原生。它不是外挂插件,而是长在钉钉里的Agent,可直接调用钉钉的通讯录、文档、审批、日程能力。实测中让它做新员工入职清单,它真实走完了钉钉API调用链路,落地为可点击的钉钉文档,进度追踪走钉钉看板,提醒用的是钉钉真实待办。
做网站型任务时,千问办公也能交付完整的HTML页面,页面结构清晰、导航可跳转、卡片有交互效果,移动端适配正常。底层搭载的Qwen 3.8-Max在发布后获得了不少关注,也让它的执行质量有了模型层支撑。
| 维度 | 详情 |
|---|---|
| 整合时间 | 2026年8月3日 |
| 统筹负责人 | 钉钉CEO陈宇森 |
| 底层模型 | 通义千问3.8-Max |
| 价格 | 个人Pro约59元/月 |
| Windows版 | 2026年Q2上线 |
| 自定义模型 | 暂不支持 |
短板:跳出阿里生态后功能表现明显下降;Windows版2026年Q2才上线;暂不支持接入自定义大模型。
适合谁:深度使用钉钉的企业用户、阿里云技术栈的团队、需要钉钉内跨系统复杂任务的场景。
TRAE Work:字节的“编码+办公”双体
TRAE Work的进化轨迹很能说明问题:从2025年的IDE插件,到2026年3月的独立端,再到6月正式更名TRAE Work,名字从“工程师”变成了“Work”,野心从写代码扩展到了全员办公。
它是七款产品里唯一把Code和Work模式明确分开的。编程用Code,处理文件切Work,能写“跳一跳”小游戏,也能生成包含趋势图、分维度拆解、异常检测、优化建议的完整HTML数据分析报告。
生成PPT约4分30秒,是几款里的速度冠军。手机端体验也不错,离开电脑后可以在手机上查看任务进度、审查结果、继续调整方向。永久免费档对个人用户友好。
| 维度 | 详情 |
|---|---|
| 前身 | Trae IDE插件 |
| 正式更名 | 2026年6月 |
| 付费模式 | 永久免费档+付费档 |
| 远程控制 | 仅限字节自家移动App |
| 技能市场 | 成长期 |
短板:只能用字节自家移动App远程控电脑,不接微信/钉钉/飞书;2026年4月起限额机制上线,免费时代已经结束;技能市场还在成长期。
适合谁:前端/全栈开发与日常办公的交叉场景、零预算个人用户、需要Work和Code无缝切换的技术团队。
Kimi Work:知识工作者的“研究引擎”
Kimi Work继承了Kimi“长文本”的基因,但内核已经升级——它能挂载本地文件夹、跑Python、浏览网页、执行定时任务,还预集成了A股港股美股数据源。
WebBridge是它最独特的能力:能让AI自己打开网页、填表单、提取信息。实测中让它去小红书找24小时内发布的具身智能相关笔记,能返回带标题、作者、点赞数量的完整表格。对于需要大量信息收集、整理、分析的知识工作者来说,这个能力非常实用。
Agent集群是个进阶功能,可以创建包含最多300个子Agent的团队来协同完成复杂任务——把大任务拆成不同模块分别交给更擅长对应领域的子Agent。
| 维度 | 详情 |
|---|---|
| 研发方 | 月之暗面 |
| 核心能力 | WebBridge、Agent集群 |
| 子Agent上限 | 300个 |
| 数据源 | 预集成A股/港股/美股 |
| 稳定性 | 内测阶段,待观察 |
短板:内测阶段稳定性待观察。有用户实测跑定时任务时,几个小时上下文就堆到30万token上限,任务直接停掉。一次测评中因资源排队和执行稳定性问题未能完成测试。部分任务需基础代码操作能力。
适合谁:记者、研究员、内容创作者、产品经理等需要大量信息收集和分析的知识工作者。
百度搭子(DuMate):跑分亮眼,稳定性待观察
百度搭子入局较晚但动作密集,7月发布个人版升级、企业版和“搭子联盟”。在SuperCLUE龙虾产品测评中排名靠前。
实测中有几个亮点:抓OpenAI新闻约4分钟,过程透明,页面滚动取数看得见,还会主动精简内容;自媒体任务中做了正经需求分析,检索数据较细——跑分、定价、股价波动全有出处。做入职清单任务时,按“时间”分类产出了一个带版本控制+多视图的“轻应用”,在平台内交付。
| 维度 | 详情 |
|---|---|
| 研发方 | 百度 |
| 近期动作 | 2026年7月发布个人版升级+企业版+搭子联盟 |
| 测评成绩 | SuperCLUE前列 |
| 稳定性 | 移动端曾现服务卡顿 |
| 商业化 | 数据尚未公布 |
短板:移动端曾出现服务卡顿;企业版付费转化率等商业化数据尚未公布;AI产出时有英文思维链现象,成熟度待提升。
适合谁:关注时效性内容、百度生态用户、愿意给新产品成长空间的用户。
智谱ZCode:专注代码Agent
智谱没有急着做通用办公,而是先深耕代码Agent。上月发布GLM-5.2时同步升级ZCode 3.0,全面切换自研内核,深度适配GLM-5.2的长程推理与大型工程执行。
生成PPT约4分50秒,视觉设计惊艳——深色渐变+动态粒子+3D翻转动画,审美是一众Agent里的唯一亮点。但办公任务中,分析720行数据只给了文字描述,没生成任何图表,说明ZCode默认优先“写代码”,而非“做可视化”。
| 维度 | 详情 |
|---|---|
| 研发方 | 智谱 |
| 最新版本 | ZCode 3.0 |
| 底层模型 | GLM-5.2 |
| 办公能力 | 几乎为零 |
| 视觉设计 | 七款中最强 |
短板:几乎不具备办公数据分析能力,不适合非技术类办公场景。
适合谁:编程任务为主、对审美有要求的技术场景。
最后一句
没有一款工具能覆盖所有场景。先想清楚:你是在“帮团队推广AI”的阶段,还是“想让AI干具体活”的阶段?
| 你的情况 | 首选 |
|---|---|
| 腾讯生态企业、日常办公自动化 | WorkBuddy |
| 数据安全有硬性要求、高定制任务 | AiPy |
| 钉钉深度用户、跨系统复杂任务 | 千问办公 |
| 前端/全栈+办公交叉场景 | TRAE Work |
| 大量信息收集和分析的知识工作 | Kimi Work |
| 百度生态用户、尝鲜心态 | 百度搭子 |
| 编程任务为主、对视觉设计有要求 | 智谱ZCode |
WorkBuddy管广度、管团队怎么用AI,AiPy管深度、管AI怎么把活干完——两条路不矛盾,反而是当下最合理的互补。
更多推荐



所有评论(0)