Agent手机走向量产,先向 App 低头
激进派突进遭遇App“封杀令”
2025年底,豆包与中兴合作推出的努比亚M153手机,凭借AI Agent一键下单、自动操作App的能力,被视为手机智能化的里程碑。然而,发售次日即遭遇微信强制下线,随后淘宝、美团等主流应用纷纷屏蔽来自该设备的登录,导致其核心卖点“跨应用自动操作”迅速塌缩。业内人士指出,这本质是商业博弈:Agent一旦成为用户操作的中枢,将直接削弱App的广告曝光、活跃度与交易佣金,触及互联网平台的核心利益。OPPO的“AI一键记账”功能也曾因微信单方面移除而夭折,说明手机厂商的激进尝试已触发了App的防御性反击。
三重门槛:合规、成本与杀手级场景
证券时报援引专家李锦堤的观点指出,AI手机真正量产需迈过“三个关口”。首先是合规关:工信部需出台“终端Agent权限白名单”标准,明确哪些应用可被AI调用,以消除App封禁的不确定性。其次是成本关:NPU芯片、大模型授权与内存溢价的叠加,必须控制在整机成本增幅8%以内,否则渠道无法接受。最后是价值关:必须跑出日活跃用户数超30万的“杀手级”场景,让消费者换机理由从“拍照更好”变为“办事更快”。目前,激进派如中兴(全球份额约3%)因边际风险低,敢于用系统权限换增量;而华为、vivo等头部厂商因出货量超4000万部,系统改动成本高昂,只能将AI作为“功能”而非“底座”,形成“小艇调头”与“巨轮转向”的分化。

隐私暗礁:无障碍权限成“侵入式AI”捷径
AI Agent为实现跨应用操作,普遍依赖系统级无障碍权限,这等同于获得读取屏幕画面、模拟点击与输入的能力。财联社调查发现,部分AI Agent已经出现滥用该权限的行为,甚至被黑灰产利用来自动采集验证码、抢票购物。专家指出,这种“侵入式AI”突破了传统App的沙箱隔离机制,用户的聊天记录、支付页面、验证码、银行余额全部暴露给一个“看不见的助手”。即便厂商承诺数据不上云、不留存,用户仍难以信任数据在本地与云端之间的实际流动路径。北京师范大学研究显示,现有GUI Agent仅能13.3%的概率准确识别出屏幕中的隐私信息,离合格的数据保护相距甚远。
技术路径之争:GUI Agent与原生接口的短板
行业正探索两种技术范式:一种是“GUI Agent”,让AI像人一样看懂并操作屏幕,无需应用开放接口,但面对多步骤、多分支的复杂任务稳定性急剧下降,且一个界面广告弹窗就足以中断执行。另一种是“原生接口”或“App Intents”,由应用主动开放能力供AI调用,但需要App厂商配合。OPPO ColorOS研发负责人姜昱辰表示,将采取差异化策略:针对社交、支付等高频场景优先构建智能体间的直接通信协议,低频长尾需求则保留GUI作为补充。然而,中国信通院牵头发布的《端云协同智能体交互双重授权安全指引》明确,智能体必须同时获得用户与应用的双重授权,这直接动摇了GUI Agent绕过应用许可的合法性。合规与责任界定成为技术之外的最大分水岭。
工程化缺口:从学术指标到真实体验的鸿沟
学术界与产业界的关注点存在显著错位。OPPO研究院与上海交大联合论文指出,当前技术评估过度强调任务成功率,忽视了意图理解准确性、持续自我演化能力及整体交互体验。真实场景中,多轮对话需要用户反复补充信息才能指明需求,而学术研究中往往只关注单任务记忆。此外,基准测试几乎不存在不可预测的干扰,但在实际使用中,突如其来的弹窗、网络延迟、App更新都可能让Agent执行失败。面壁智能首席科学家刘知远更指出,云端依赖存在三个根本矛盾:隐私数据持续上传的安全风险、网络延迟造成的交互流畅度天花板、以及海量用户高频调用带来的算力经济成本。唯有解决这些工程与合规问题,AI Agent手机才能从“Demo”走向“现金流”。