# 百度搭子重新定义 Agent「托付半径」

- 作者：李超凡
- 发布时间：2026-07-10 17:39
- 分类：产品、软件
- 原文：https://www.ifanr.com/1671618

![](https://s3.ifanr.com/wp-content/uploads/2026/07/titu.png)

今年以来，我发现身边的人办公方式，肉眼可见地变了。

做运营的朋友不再手动拉四个平台的报表，编辑同事早上不刷信息源了，热点清单自己送上门。还有同行的行政，自己捣鼓出一套从开发票到报销的 AI 工作流。

他们用的产品不一样，做的却是同一件事：把越来越多的活丢给 AI，人只管验收。

这背后是 2026 年 Agent 产品的爆发，「中国版 Codex」扎堆上线，大厂小厂都在做。它们的形态也越来越像：桌面端，看得见屏幕，操作软件，跨应用干活……

demo 里个个都是六边形战士，热闹是热闹，但最终都要回答那个更扎心的问题：你敢把多少活，彻底交给它？这也是衡量一个 Agent 上限最重要的标准。

带着这个标准去看这些 Agent 产品，大概能过滤掉九成的发布会话术。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/1.jpeg)

今天 APPSO 去了百度在成都举办的 AI DAY「干活吧！搭子」专场，百度搭子一口气抛出三个发布，个人版大升级，企业版正式登场，围绕企业应用，百度还拉起了一个生态联盟。用百度集团执行副总裁、百度智能云事业群总裁沈抖的话说：

> 未来 90% 的工作，都可能有智能体深度参与、协助完成，百度搭子要做的，就是深入办公场景真干活、真办事儿

说到百度搭子，APPSO 在发布之初就拿它当办公搭子用了整整一周，从整理文件到热点监控、做 PPT，那会儿就冒出过「交给它我还挺放心」的苗头。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/2-5.png)

它当时也谈不上完美，但后面迭代快得吓人，过去三个多月，基本是日均更新 1 个版本。在智能体评测基准 PinchBench 上，甚至把 Anthropic 和 OpenAI 摁在身后。

百度表示，这个搭子上线以来，日均提问量涨了 20 倍，数百万人已经在拿它处理办公、创作、找信息，它也是这波通用智能体里增速最快的一个。

这次，我发现百度搭子发布的三个产品更新——个人版升级、企业版、搭子联盟，其实是对 Agent 「敢不敢交付」这个问题的系统回答。

### 托付半径：一个人，一家公司，一个行业

如果你在尝试用 Agent 来处理真实的办公需求，很快就会面临一个问题：你到底信任 Agent 到什么份上？

自己用得爽，是一回事。敢在部门里推，则是另一回事。敢用到给重要客户的交付里，又是完全不同的量级。每往前一步，需要考虑的因素就越多，容错率也就越低。

这种对 Agent 的信任程度，APPSO 想用一个新的词来形容——**托付半径**。

一个 Agent 的价值，别看它的 demo和参数，得看用户愿意把托付的半径画多大。百度搭子这次的发布，说穿了就是在把这个半径一圈一圈往外画。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/titu.png)

**第一圈：先让一个人离不开**

托付始于能力，连活都干不利索，就谈不上托付了。

虽然 Agent 产品很热闹，可是大多数人试用一周，可能就退回到聊天框来使用 AI 了。这不完全是因为 Agent 不会干活，还有我们不敢把部分工作也托付出去，或者还不了解Agent 的能力边界，缺少和同事那点「你懂我」的默契。

百度搭子这次个人版升级，几乎每一项都在围绕这个点。

智能路由让它接到任务先判断走哪条路，调本地技能、开浏览器还是走搜索，每个节点挑最短路径，不再一条道走到黑，这能让平均任务耗时降低 20%，Token利用率提升 25%。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/3-4.png)

全端记忆让 PC 和手机共用一个脑子，你在电脑上教过它的报告格式、纠正过的措辞偏好，换到手机上不用再讲一遍，在电脑上没处理完的任务，随时可以在手机端继续追问、修改或下载结果。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/4-4.png)  
Browser Use 从 VNC 模式换成直接操作，以前它操控浏览器像隔着手套按触屏，先截屏再分析再点击，现在直接上手，像人一样进入网页、点击、跳转、检索和整理信息，从勉强能用变成真正好用。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/5-4.png)

再加上百度攒了二十几年的家底：搜索、百科、秒哒、伐谋，这次又有了一镜和灵医，现在都蒸馏成独家 skill 开放了。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/6-2.png)

不整虚的，我们接着把它放到日常的办公场景看看用起来怎么样。

先拿一个让打工人十分痛苦的表格整理来考考它，我在电脑里保存了一个极其混乱的生产计划单 Excel，合并单元格跨好几行，单位名称不统一，日期格式五花八门，还有夹杂着大量无效数据。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/7-3.png)

我直接跟它说：将我电脑里非结构化的生产计划单Excel表格清洗为规范、可直接用于统计分析的标准数据表。

上个厕所的工夫，它很快就找到了这份表格进行处理，并整理出一份清晰的数据表，异常行在 Excel 中还用红色底色（日期异常）和黄色底色（有备注）标记，方便我直接筛选排查。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/8-2.png)

除了新的表格，它还贴心地给我整理了一个清洗日志，303 条记录，759 处变更，我都不敢想自己手动要做多久。

现在我都不需要打开 Excel，也没动过鼠标。

一些做老师的老同学经常跟我说，AI 这么强，有没有能帮我做一个教学课件的。这次依然不放过做 PPT 这个职场刚需场景。

我给了百度搭子一个很简短的指令：给生成一份关于《桃花源记》的完整教学课件，根据课文生成合适的插图，适用于初中 40 分钟课堂。

它先问了我一些问题了解需求，比如PPT风格，课件内容侧重点，一一让我确认。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/9-2.png) ![](https://s3.ifanr.com/wp-content/uploads/2026/07/10-1.png)

接着它就调用教育相关的Skill，自己撰写教学大纲，梳理设计规范，同时对应的skill 生图把完整的课件PPT 给我，还贴心地给每页配演讲者笔记，包含时间提示、过渡语、互动建议等。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/11-2.png)

这个完成度已经基本可用了，生成的图片质量很符合《桃花源记》的意境，排版跟课件内容的配合也很自然。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/12-2.png) ![](https://s3.ifanr.com/wp-content/uploads/2026/07/13-3.png)

而且 PPT 所有细节都可以编辑，可以根据自己的需求随意编辑调整。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/14-3.png)  
此外我还发现了一个适合 APPSO 这些内容创作者的功能，百度搭子这次推出了一个自媒体专业套件，把选题规划、热点洞察、图文创作、短视频脚本、分镜口播、内容发布和运营复盘这些环节，直接封装成 skill 打包在一起。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/15-3.png)

这样一来原本要开多个对话的内容工作流，就可以放在一个对话里。

我试着让它分析一个 B 站上数据表现不佳的的视频，它除了会根据竞品分析我的封面和内容存在的问题，也会给出具体的优化建议。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/16-3.png)

更难得的是，它的解决方案也没停留在建议，会直接跟按照建议以及我的需求反馈，直接把优化版做出来给我参考。  
![](https://s3.ifanr.com/wp-content/uploads/2026/07/17.png) ![](https://s3.ifanr.com/wp-content/uploads/2026/07/18-1.png)

之前我曾经用百度搭子做过一个 AI 热点监控系统，现在结合自媒体套件里的热点竞品雷达，我给它提了进一步的需求，不只要监控热点判断优先级和同行内容，还要给出符合 APPSO 调性的选题角度，发送到飞书或微信给我。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/19-1.png)

我发现它给出的不少热点和选题角度，都跟我们的要求比较接近，有部分选题甚至都可以直接操作了，得益于全端记忆的功能，让它更懂我了。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/20-1.png) ![](https://s3.ifanr.com/wp-content/uploads/2026/07/21-3.png)  
选题大纲都有了，我可以直接用自媒体套件直接让它把文章也写出来，它会先细化文章大纲供我确认，我提出修改意见或者补充观点，直到满意它才继续成稿，完稿后它还能帮你接着制作封面，以及根据根据不同平台风格改写。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/22-3.png)

这就是撒手托付的手感。不是它帮你做了某一步，是把整个工作流走完，给出一个能用的成果。过程中几乎不需要插手，当然前提是你知道自己要什么。

当交付的成本越来越低，**判断力才是这个时代最后的手艺活，把判断之外的一切都托付给 AI** 。

**第二圈：再让一家公司敢放手**

一个人敢撒手，靠的是一次次用出来的手感。可这事一进公司就不同了：你自己乐意冒的险，老板未必肯替你兜着。信任到了组织这一层，就不再是一种感觉，是一套要签字画押的制度。

百度智能云副总裁殷大伟前段时间在中关村论坛上说过一句大实话：能用，但不敢用。员工偷偷在用，IT 部门装作没看见，法务在祈祷别出事。

个人交出去的是几个小时，交砸了重来就是；企业交出去的是数据、合规和责任，个人容忍试错，企业不容忍失控。

这也是为什么此前 MIT 报告里提到，95% 企业 AI 试点项目失败，最大的瓶颈是组织，而非模型的能力。

百度搭子企业版给出的解决方案，不再是把个人版复制几十份发下去，反而设计了一套冲着「失控」去的系统。

积分、技能、成果在组织内共享流转，一个员工沉淀的数据处理流程，一键共享给全组，不用每人从零配置。交付物、技能、知识库、记忆四层沉淀，AI 每被用一次，组织就多攒一分可复用的资产，用得越久越懂这家公司。

这是把一次性的提效，变成了复利。

APPSO 还留意到，百度是首次给出了企业级 Skill 接入标准。此前企业要接 AI 能力，每个系统、每个服务商单独对接，接口不统一，安全标准不一，现在这个门槛进一步下降了。还有四层安全体系，可以做到 AI 每一次执行、每一次数据访问全程留痕。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/23.jpeg)

百度搭子企业版的产品逻辑，也反映出 Agent 应用一个没完全满足的巨大需求：企业敢用 AI 的底线，从来不是指望 AI 从不出错，而是万一出了问题，知道去哪追溯。

**第三圈：让百度不在场的地方也能托付**

体验搞得定一个人，制度搞得定一家公司，但却不可能有一个万能 Agent ，可以一次性改造不同行业沉淀多年的工作流。百度的手再长，也摸不到每个行业的门道。

这时候就得找帮手了，这次百度官宣的搭子联盟，首批 11 家伙伴有创维这样的家电厂，有中国联通这样的运营商，有做 SaaS 出海的香港智域，剩下的散布在东南北各区。这些行业 know-how，可以大大补齐 Agent 的短板。

这个玩法，就是搭子出去找搭子，搭子搭搭子，一路搭进各行各业。百度搭子出能力底座，伙伴出行业门道，信任由离用户最近的那个搭子来背。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/26.jpg)

这个搭子联盟，核心不在百度自己能覆盖多少行业，在托付可以不依赖百度亲自到场。

每一行的「敢交付」都需要一个懂行的中间人，联盟干的就是把中间人批量生产出来。Google 花十年把 TPU 焊进自家云，微软上了 Agent 365，其实都是殊途同归：智能体落地要的是端到端，不是散装。

这样看来，把托付半径从一个人，到一家公司，再扩大到一个行业，百度搭子想要合上三个圆环，这也是它在一众桌面办公 Agent 里最大的不同。

不过百度也不会是这个方向唯一的玩家，看完百度这场发布会，你也可能发现了，**「交付」正在成为 Agent 下半场的赛点，或者更直白地说，谁能稳定帮助人类完成 90% 以上的工作。**

### Agent 的赛点是交付，边界是人

前段时间的百度 Create 2026 大会上，李彦宏抛出了一个新概念：DAA，Daily Active Agents，日活智能体数。

> 别数有多少人在用 AI，数有多少智能体每天真在替人干活、并且交付了结果。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/24-3.png)

当时看起来有点要拆黄仁勋的台，那会老黄还大谈 Token 经济。中国的日均调用量从 2024 年初的 1000 亿冲到今年 3 月的 140 万亿。

全行业围着 Token 消耗量开香槟，卖铲子的人说，看铲子消耗量就知道金矿的繁荣程度。挖矿的人说，你倒是看看我挖出了多少金子。

现在回头看，百度搭子就是奔着这个新的度量衡来迭代的。

不过怎么算一个 Agent「交付了成果」，至今是道难题，李彦宏自己都承认这是「非共识」。百度做应用，只有按产出记账，应用层的价值才浮得出来，屁股决定脑袋，这根弦也得绷着。

度量衡或许可以有不同的话术，但整个 Agent 产品的趋势已经不可逆：参数会被追平，跑分会被刷新，形态会被抄走，最后能留下来的，是它能不能稳稳交付你要的结果。

而这半年 AI 产品不同的支流，恰好都不约而同涌向这个方向。

Codex 一开始是对抗 Claude Code 的编程工具，如今长成周活 500 万的桌面 Agent，用户里非工程师占了多数。在 OpenAI 内部，市场、传播、财务、法务几乎全员在用，视频剪辑师发现 Codex 不会剪片子，但它发现剪辑师用 Premiere，就给 Premiere 写了个扩展，然后通过扩展去操作剪辑。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/25-2.png)

大多数知识工作和写代码本就同构：文件是上下文，浏览器是信息入口，Office 文档是交付物，定时任务是工作流。代码从来不是终点，只是 Agent 最先攻下的第一块地方，真正的腹地在办公桌上。

Codex 产品负责人 Andrew 在最近的访谈中提出一个观点：别被你的流程绑死，跟你唯一能交付的结果结婚，然后该改流程就改流程。你最擅长的要还是「Figma 自动布局」，那 AI 迟早比你熟练。

**工具会变，模型会变，流程会过时，唯一不贬值的，是你交付独特结果的能力。**

这话当然是对人说的，可对象换成 Agent，也完全适用。

去年我们还在讨论 Agent 能做什么，现在的胜负手则是「托付」。 Agent 上半场在面试，现在就进入试用期了，面试看你的答题技巧，试用期当然看你解决问题的能力，以及搞砸过几次活。

![](https://s3.ifanr.com/wp-content/uploads/2026/07/27-2.png)

未来大量的工作场景会是，人类保留判断，执行批量外包。人类活动里，只有那些必须亲身在场的体验外包不出去，剩下的九成，理论上都在 Agent 的射程之内。

谁能更可靠地把这九成的活接过去，谁就是 Agent 决赛圈选手。

把话说回来，百度搭子把托付半径从个人画到行业，在这个赛道上抢先了一步，但竞争依然激烈。 90% 的工作是成千上万个具体任务，可能每提升一个百分点都得脱一层皮。

Agent 时代，产品要跑出来光靠流量已经不够，是靠一次一次把活干完攒出来的信任。最后你手里攥着的那点交不出去的东西，才是你之所以是你的地方。

把活尽管交给硅基生物，把人，留下来。
