百度搭子把任务从电脑接到手机:跨端上下文和浏览器执行进入同一条链
百度搭子最近一次更新,解决的是 Agent 产品里一个很现实的问题:任务还没做完,人先离开电脑了。百度智能云的介绍称,电脑和手机现在可以接力,交接的不只是聊天记录,还包括任务上下文、执行进度和长期记忆;桌面端新增内嵌浏览器,手机端则可以让云端浏览器继续执行网页任务。
使用场景很具体。用户可以在电脑上发起竞品调研,出门后在手机查看进度、补充要求,回到工位再继续修改和下载报告。浏览器可以连续打开多个网站,搜索产品信息、整理评价、比较价格和功能,再汇总成表格或文档。遇到登录、授权、提交等关键动作时,用户可以接手确认,而不是把所有权限一次性交给 Agent。
这套设计把「跨端」和「浏览器执行」放在了一起。只做跨端同步,Agent 只是把对话搬到另一块屏幕;只做浏览器自动化,任务又容易卡在登录、验证码和人工授权。百度搭子试图把任务上下文、网页执行和人类接管串成一条流程:任务可以继续跑,但关键节点仍留给人。
官方文章还给出了一组产品指标:平均任务耗时降低 20%,Token 利用率提升 25%,首 Token 耗时降低 50%;简单任务执行完成度达到 100%,复杂任务高交付率达到 94%,积分消耗最高降低 75%。这些数字目前应当当作厂商口径,不是独立基准。它们没有说明样本量、任务分布和对照组,不能直接拿来与其他 Agent 做横向排名。
更值得看的,是产品背后的路由逻辑。百度搭子称会按任务难度、响应速度、数据安全和执行成本,自动决定采用什么模型、云端还是本地、是否进入沙箱。Skill 也不再要求用户先记住工具名称,系统根据目标组合搜索研究、办公协作等能力。对用户来说,入口从「选模型、选工具」变成「说清楚目标」;对工程团队来说,复杂度则转移到了路由、权限和失败恢复。
风险同样存在。浏览器 Agent 可能接触登录态、内部文件和可提交表单;跨端同步的长期记忆也意味着更大的数据边界。官方介绍提到关键步骤可由用户确认,但没有公开完整的权限模型、审计日志和异常恢复细节。真正进入企业场景前,仍要回答:哪些页面能访问、哪些动作必须二次确认、任务中断后如何清除凭据。
这条更新对 AI coding 的启发很直接。一个成熟的编码 Agent 也不应只在终端里生成代码,它需要跨设备查看任务、在浏览器里查文档和提交工单、把长任务交给后台继续跑,再把关键动作交还给人。百度搭子把这套「持续任务」体验先放进了办公和网页场景,接下来要看它能否用稳定的权限与审计,把产品宣传里的连续性变成可依赖的工作流。
原文:
- 百度智能云公众号:https://mp.weixin.qq.com/s/HRySK1LU53clPe2I_M-Fug
- 百度搭子产品入口:https://dazi.baidu.com/
🌟 智谱 GLM-5 已上线
我正在智谱大模型开放平台 BigModel.cn 上打造 AI 应用,智谱新一代旗舰模型 GLM-5 已上线,在推理、代码、智能体综合能力达到开源模型 SOTA 水平。
🎁 领取 2000万 Tokens