拆解 WorkBuddy、千问办公和豆包工作,它们其实不是同一种产品
三家三条路线,但没人帮你背锅
把同一份工作交给三家办公Agent
千问办公(QwenWork)1.0.5,build 26090806
读取一份实际不存在的内部文件,观察缺少核心输入时会发生什么。
千问走的是工程师路线 。它会给自己做测试、做最小复现,甚至抓回了一次“误删正常订单、漏掉 78 万异常单”的严重错误。
WorkBuddy 走的是团队路线 :先让子 Agent 处理表格,再由主 Agent 独立复算,前后修正了 9 处错误。
豆包走的是直出路线 :不调用子 Agent,直接用脚本生成三份文件,最后重点检查它们的数字是否一致。
拆开安装包:
沙箱、虚拟机和浏览器
这轮逆向采用的是静态取证:我们只读检查安装包中的签名、权限、配置与随包资源,没有运行程序、登录账号或发起网络请求。因此,它能告诉我们三家为 Agent 准备了什么样的执行环境,不能证明实测任务一定经过了对应路径,也不能证明实际读取、上传了什么,更不能由此给出安全排名。
腾讯和阿里的办公 Agent,内核都是自家的编程 Agent 改的 (CodeBuddy / Qoder)。之前有媒体测评过说“千问慢但更愿意标风险”的观察是 血统导致的。 编程 Agent 天生带验证习惯。
千问把承认不确定做成了一个可以关掉的开关。 它预置了四种人格预设,其中只有「深思熟虑」要求区分事实与判断,「果断执行」反过来明确要求“有把握的事情断言,不加‘可能’、‘也许’”。
千问把“不用你的数据训练模型”做成了付费档位特权 (包内原文:Upgrade your plan to customize data sharing preferences.)。
WorkBuddy 是唯一能花钱的,内置了 weixinpay 插件。 但实测用美团下不了外卖订单,只能买核销券,并且必须要选择对应的助手,体验并不是很好。
workbuddy 深度接入了微信。 分别有分享、解码、通知、支付等内置组件和插件,以及 MCP
千问办公内置了 SOUL.md 、AGENTS.md 、 HEARTBEAT.md 这套 openclaw 的组织方式,但不是它的套壳。
AI 可以接走执行,
但判断、核对、责任仍然在人
从 Codex Harness 开源,看 AI 公司的护城河是什么? ...
在三张圆明园鼠首照片里,我们看到了3D AI的Harness ...
越大越强,不再是 LLM 的专利:PixVerse R2 攻克实时 ...
我们拆了 1.1 万个 DeepSeek Harness 插件,发现官方几乎没有建立插件治理机制
阿里开源 Qwen3.8-27B 本地实测:性能很强,但 Agent 适配仍待补课
万字长文拆解DeepSeek V4 Pro与Harness:从后训练到「代理自进化」,更大的变化在开源框架里
流沙之上:陈冕、景鲲、倪正民和中国 AI 应用创业者的三种选择
Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!
DeepSeek 开源算子工具大礼包,联手华为昇腾,手撕 CUDA 绑定!
Muse爆火,dots入场:Personal Agent开始和互联网平台抢入口
实测 Qwen-3.8 与 GLM-5.3 的 Flash 版:谁能让我提前下班半小时?
从 Codex Harness 开源,看 AI 公司的护城河是什么?
全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?
对比 Codex,免费的 AgnesCode 也能在底层算子优化任务中打得有来有回