阿宝、小微和豆包:不同AI智能体的“同意”保险与尺度
2 小时前 / 阅读约11分钟
来源:36kr
2026年,中国消费级智能体进入新阶段,支付宝、微信、豆包二代构成最值得观察的三条路线,分别采用“双轨”和“一键切换”、小微把“许可”前置、用“声明”改造系统级权限等授权方式,为智能体画出了相对具体的护栏和边界。

2026年,中国消费级智能体正式进入了一个新的阶段。

一方面,技术已经足够成熟,理论上只要用户一句话,智能体就能够跨App进行操作,替代用户订购产品、支付定金、使用社交媒体、发送邮件等;另一方面,这种互操作性需要广泛的权限,智能体每多跨一个App,就多一层“谁同意”的问题。智能体若要有长足发展,除了技术突破,还需要赢得用户的同意和信任、整个App生态的放开和支持。

为此,智能体需要打破终端操作系统在前20年来构建起来的安全边界。

2025年12月,字节跳动与中兴联合发布的首款预览版豆包手机,一石激起千层浪。之后,其他科技公司纷纷尝试将AI与自身生态系统融合,包括支付宝、微信都开始用AI智能体改造原有的超级应用。而2026年9月14日努比亚正式发售了配备豆包AI助手的NaviX Ultra智能手机,并同步发布行业标准——屏幕自动化执行协议(SAEP)。

至此,支付宝、微信、豆包二代构成了2026年国内手机智能体最值得观察的三条路线。他们用产品设计来回应“跨App需要什么样的权限”这个problem,试图建立行业标准,而这些标准以既趋同又分歧的方式出现。

一、支付宝:“双轨”和“一键切换”提效

支付宝的核心价值在于“办事”。为了快速打通服务闭环,支付宝2026年6月推出的阿宝采用了“整体切换”模式,其对“办事效率”的追求和优先级都大于微信所强调的“授权”。

从开发者的角度,支付宝采用了“双轨制”。对于支付宝来说,其生态中百万小程序不可能一夜改造完成,因此它将接入AI做成了类似于“默认”的模式——将所有服务纳入了智能体调用范围:部分走在前面的商家将其服务封装成MCP/Skill,阿宝通过接口能够获得明确的“能调用什么、返回什么、哪一步需要确认”的授权范围;而对于未接入MCP的商家,当用户在AI版提出需求并授权之后,阿宝用GUI读屏来理解界面、模拟点击,跑完小程序的全流程。

而在用户侧,支付宝可以整体一键切换AI版,在阿宝的“工作环境中”,用户是默认统一授权调用所有小程序服务——读取账单、订单、民生缴费记录。用户如果想要限制阿宝的工作岗位,必须手动进入设置当中,逐一关闭相应的授权。这换来了更快的AI体验——用户不用研究复杂设置,说句话就能办事。但代价是,大多数普通用户不会主动进入设置关闭权限,相当于在不那么知情的状态下就开放了自己的消费数据。

当然,对于支付、资金、医保等敏感操作方面,阿宝选择退守,需要用户的单独同意和确认。从法律来看,这对应着“敏感信息处理+资金指令”的双重谨慎。

综上,阿宝对“授权”的理解是:用户的指令,有时优先于商家的预设同意。当用户希望阿宝调用某个尚未改造的小程序时,阿宝通过GUI读屏技术优先响应用户需求,而非等待商家先开放接口。在这里,商家的授权不是用户指令的前提,而是被纳入用户指令的范围之内——用户说“帮我办这件事”,阿宝就去办,商家的小程序是在这个指令下被动配合,而不是反过来先等商家点头。

而对于未主动授权改造的商家,没有选择“不被AI读屏”的权利,除非主动去后台声明或改造接口。短期内这换来了用户体验的提升,但长期看是否会激化平台与商家的矛盾,还有待观察。

二、微信:小微把“许可”前置

与支付宝更多定位于“办事”不同,作为强社交属性的微信来说,看它的智能体,不能只看它“会做什么”,更要看它“不做什么”。

同在6月,小微上线前后,微信的节奏非常清晰:先让开发者选择是否“接入”,再让用户授选择是否“授权”,最后,主动将支付、发朋友圈、群发消息这类高风险行为留给用户自己操作和确认。

6月8日,微信先发布《关于开发者接入微信AI生态的指引》,给小程序开发者两种接入方式:“自动模式”由平台从现有页面提炼能力,“开发模式”由开发者自己把服务封装成可被小微调用的能力。美团、京东、携程、得物等头部平台随后接入。

这一步的关键不在于“小微能调用谁”,而是“开发者先决定开放什么”;第三方App不是被默认拖进智能体的调用范围,而是自行决定是否启用、哪些页面可被调用、哪些数据不外出。它的法律价值不在“多一道手续”,而是大大减少了摩擦,并且把责任边界更加清晰化。

而在用户侧,小微表现出更加谨慎。6月17日推出的“AI专属卡”,相当于给小微设立了一个独立小钱包,额度、场景都需要用户自行设定。小微可以自行推荐商品、生成订单,但扣款、输密码、生物识别都必须回到用户本人。6月20日小微叠加了更多社交功能,多个实测提到:小微可以帮写文案,但会“拒绝”发朋友圈、群发消息。这不是技术达不到,而是产品主动选择“退出”替人“表达”

值得注意的是,小微默认关闭所有跨场景数据调用。用户若想使用小微调度小程序,必须主动授权。

从整体看,微信对小微行动范围的界定,可看作一个三层嵌套结构:开发者同意是第一道闸;用户同意是第二道闸;而小微主动“不做”的那部分是第三道,也是最关键的一道。前两道的重叠决定其“能做什么”,第三道闸决定“绝对不做什么”。小微的实际边界是开发者许可和用户授权交集再减去微信主动放弃的那个部分,这套“减法”一定程度上尊重了熟人关系的关键价值依托——“真人主体”。

从产品形态看,至少在当下阶段,微信决意用“辅助但不代劳”来夯实用户对微信乃至对小微的信任;从法律风险管理来看,这也避免把“用户意思表示”委托给智能体后产生侵权或合同效力的争议。从商业角度看,微信已表示正在与五家主流手机厂商合作推出 A2A助手能力,并采用双重授权来保障安全和隐私,但这在商业领域能否迎来应用大爆发,还有待观察。

三、豆包二代SAEP:用“声明”改造系统级权限

豆包的特殊性在于其所处的“位置”。微信和支付宝的智能体都住在各自的超级App中,能调用的主要是自有生态或已对接的第三方。而努比亚手机中的豆包助手是存在于更底层的操作系统层面,而且用户购买豆包手机并开启操作手机,很大程度上就是为其跨App功能买单。因此理论上它可面向全机所有App进行意图理解、页面识别和执行操作,其范围大大超过微信和支付宝的生态圈。

但基于一代所引发的巨大争议,豆包二代没有选择微信的“默认不调用”模式,也没有走支付宝的“默认调用”模式,而是走了一条中间道路:用屏幕自动化执行协议(SAEP)和30天公示,主动收窄了代操作范围,且将应用内AI操作的“否决权”(而非主动的决策权)交还给第三方开发者,这相对第一代而言已是进步。

从技术来说,豆包走的也是“双轨制”,已改造App使用MCP、跨Agent协利用A2A,没有接口的App再使用GUI的屏幕识别、模拟点击来实现。但与支付宝不同,豆包的GUI对象不只是自身生态中合作方,而是全机第三方,所以更需要“被操作方”的许可,而不仅仅是用户的一句话。

由此,SAEP中给第三方在3个层面上7个具体的选择:第三方可以在整个应用、指定的页面、指定的业务意图三个层面上进行授权/限制,具体的操作包括全局禁用、特定页面禁用、禁止截图/模拟输入、禁止内容修改、限制内容发布、限制删除、限制领取权益等。

在9月14日开始的30天公示期之内,豆包只会为三类应用开放端到端任务执行:原生系统应用、字节跳动自有应用以及通过协议明确同意集成的第三方App,目前已接入曹操出行、地图、汽水音乐、飞书等服务;其余App“默认不操作”;公示期满之后,对未回复、未接入、未明确拒绝的第三方,按照风险层级逐步放开,而对于“明确拒绝”的永不操作。

可以看到,关于“同意”的方式,微信把“同意”的权利交给开发者,被动等待其许可;豆包把“拒绝”的权利交给开发者,主动预设了智能体调用可行——两种权利的起点,决定了智能体能动范畴的根本差异,还可能导致一种信息差:同样是“不回应”,前者对开发者是信息对称的安全区,后者却可能落入信息不对称、权益不确定的灰色地带。

总体而言,豆包的SAEP把“开发者可拒”制度化。相较于一代的“默认”,二代把智能体操作App从AI/手机厂商单方技术能力,变成App开发者可参与决策的系统规则。

豆包的SAEP已经在现有条件下实现较为细致的授权,因此不能将其简单地说成“对方不拒绝=全权同意”,而是可以看作是“有期限的、有风险分级的柔性选择退出机制”

但这里仍存在一个微妙的张力:SAEP本身的法律性质和具体效力到底是什么?法律上,沉默能否被视为同意,并不是确定的。《民法典》第140条第2款规定,沉默只有在法律规定、当事人约定或者符合交易习惯时,方可视为意思表示。SAEP的“未反对逐步开放”若要站得住脚,关键在于:公示是否充分、拒绝是否零成本,以及这种自动化对被操作方究竟是增益还是减损。当既有界面被接管、入口被改变、流量和数据流向被重新分配时,以“未反对”来推定同意,确实需要格外慎重。这不是一个技术问题,而是一个商业伦理和平台权力边界是否能在行业内达成共识的问题。

30天公示期过后,这一张力或许会随着豆包能力边界的扩展而逐渐浮出水面。

四、结论

放眼全球,我们正处在一个由技术优势决定的系统性竞争环境中,我们无法回避技术优势所带来的诱惑,或对其“免疫”;但我们也必须了解,如果AI技术进步速度超过我们应对其自主风险的速度,赢得竞争优势也将毫无意义。2026年9月,美国几家前沿AI公司先后表态提出“放缓”论调,其核心焦虑正在于:安全对齐和护栏研究跟不上AI能力的释放

支付宝、微信和豆包,在本文的分析当中,正是在技术能力已经突飞猛进的条件下,各自为智能体装上了一副具有各自特点的“保险”。他们都没有选择让智能体“全力冲刺”,而是用不同的“授权”方式,给智能体画出了一个相对具体的护栏和边界。微信选择了相对慢但也最稳健的推进方式,它给第三方和用户充分的授权选择,还主动放弃“代表人类表达”,把社交发布、群聊表态这些最具人情味的动作留给人类;而豆包则选择从激进的技术能力表达,退回到第三方保留拒绝和限权的权利,SAEP尝试用一种相对精细且创新的设计。他们都在原则上同意:AI不能跑出缰绳,但对缰绳的尺度理解存在差异。

或许,在这个技术飞跃的时代里,踩好油门是人类探索和突破边界的动力源泉,而适度刹车同样是具有长远眼光的考量和难能可贵的品格。

【免责声明】本文撰写所需的信息采集自合法公开的渠道,我们无法对信息的真实性、完整性和准确性提供任何形式的保证。本文仅为分享、交流信息之目的,不构成对任何企业、组织和个人的决策依据。