标题:给美国号码发条iMessage,AI就能替你操作手机?Airtap敲碎App入口逻辑
摘要:Airtap推出iMessage新功能,用户无需安装任何App,仅通过iMessage发送指令,AI Agent即可在美国的云手机上完成TikTok刷视频、星巴克点单等操作。该技术采用三层架构:大脑理解意图、AutoPilot视觉操控、云手机24小时在线,但支付仍需手动授权。
当AI Agent开始跨过信息处理的边界,直接侵入交易环节,App的传统入口逻辑正在被动摇。
Airtap最新推出的iMessage功能,让用户无需下载任何第三方应用,只需给一个美国号码发送iMessage消息,其云手机上的AI Agent就能通过视觉模拟点击,替用户完成从内容消费到生活服务的操作。一位国内用户在实测中,仅凭一条iMessage,就让远在美国的AI Agent成功注册TikTok账号,刷完10条热门视频并返回总结。
该系统的技术架构分为三层:“大脑”负责理解用户指令并拆解为操作步骤,“AutoPilot”通过视觉识别屏幕内容并模拟点击,“云手机”则提供24小时在线的运行环境。这种设计让用户无需配置运行环境或安装对应App,只需一个iMessage号码和一个明确的指令。
目前,Airtap已能完成包括TikTok刷视频、星巴克点单在内的多项任务。这意味着Agent不再局限于信息检索、文档处理等“软”环节,而是开始直接介入交易、操作等“硬”场景。但值得注意的是,当涉及支付等敏感操作时,Airtap仍要求用户手动完成授权,这也是当前所有Agent厂商共同的信任与授权难题。
从产品逻辑角度看,Airtap这一尝试的背后,是一种更深层的入口迁移。传统App的产品逻辑是用户主动下载、搜索、点击,而Agent的介入则把这一流程变成了“指令—执行—交付”。在这个过程中,不安装App即可使用服务,从根本上模糊了应用商店的边界,也正在敲碎原有的产品入口逻辑。
对于产品经理和创业者而言,Airtap的路径值得密切关注。它验证了一个趋势:未来的应用生态将不再是用户一个一个去下载、打开、操作,而是通过一个统一的AI接口,以指令驱动的方式完成所有任务。但信任问题仍然是横亘在所有Agent面前的核心障碍:用户如何确保AI代理真正按照自己的意图操作?当出现错误或损失时,责任如何归属?
从“看懂你”到“替你做事”,AI Agent正处在从信息助手到行动助手的临界点。Airtap的这次尝试,或许不是最终答案,但它提供了一种值得研究的范式:用视觉模拟代替API接入,用云手机代替本地运行,用iMessage代替App页面。这不是技术的简单堆叠,而是一次产品逻辑的重新定义。