多元AI操控新玩法:AI浏览器成过渡,Agent带用户体验全场景智能操作

多元AI操控新玩法:AI浏览器成过渡,Agent带用户体验全场景智能操作

OpenAI 推出的首款 AI 浏览器,大概率也是最后一款,下周起就要正式下线了。

今年 7 月 9 日,ChatGPT 的更新日志里多了一行不起眼的说明:「Atlas 将于 8 月 9 日停止运行。」没有盛大的发布会,也没有煽情的告别视频,这种低调的退场方式,倒和它当初悄无声息上线时如出一辙。

这款基于 Chromium 内核打造、仅面向 macOS 用户的浏览器,去年 10 月才刚刚亮相。它将 ChatGPT 深度整合进了地址栏与侧边栏,付费订阅者甚至能开启 AI 智能体模式,让 AI 代为执行购物、订餐或处理邮件等任务。

OpenAI 曾对 Atlas 寄予厚望,试图将浏览网页本身转化为一场对话体验。遗憾的是,它没能撑过自己的第一个生日。

图|ChatGPT Atlas

回顾过去一年,AI 浏览器曾是科技圈最炙手可热的新战场。Perplexity 推出了 Comet,Opera 发布了 Neon,The Browser Company 则放弃了已积累大量用户的 Arc,转而开发 AI 原生浏览器 Dia。行业共识很明确:

既然浏览器是互联网时代的入口,那么 AI 时代的入口,理应是一个更聪明的浏览器。

但现实推进的速度远超预期。不到一年时间,首批入局的玩家便开始撤退,随之暴露的问题也愈发清晰:

AI 浏览器真的走不通吗?或者说,从一开始,人类就不需要所谓的「AI 浏览器」?

AI 需要嵌入浏览器,但不必成为浏览器本身

在过去一年中,AI 浏览器开发商在「如何降低用户迁移门槛」这一问题上可谓绞尽脑汁。

他们深知多年积累的数据与设置对用户而言有多重要。因此,从 Arc 到 Dia,从 Opera Neon 到 ChatGPT Atlas,这些产品都提供了不同程度的数据迁移支持。无论是书签、历史记录、插件,还是密码和 Cookie,都能实现完整转移。

但当「怎么换」不再是障碍,另一个问题反而凸显出来——为什么要换?

对于绝大多数用户而言,现有浏览器已经足够成熟。Chrome、Safari 和 Edge 完美覆盖了打开网页、保存密码、同步账号及使用插件等基本需求。用户缺的不是一个新浏览器,而是一个足以打破现状的理由。

过去几年,不少产品都在尝试寻找这个理由。

图|Arc

The Browser Company 旗下的 Arc 曾试图从交互层面破局。它重构了浏览器布局,将标签页移至侧边,引入 Spaces 以管理不同场景,还通过 Boosts 允许用户自定义网页体验。对于重度使用者来说,这些改动确实带来了新鲜感。

而 Atlas 则将 ChatGPT 融入地址栏和侧边栏,让用户能通过对话直接总结网页、整理信息,甚至调用 Agent 完成操作。

图|ChatGPT Atlas

尽管路径不同,两者的结局却殊途同归——虽然提升了浏览器的功能上限,却未能创造出足够强劲的新需求。

Arc 解决的是「如何让使用更舒适」,AI 浏览器解决的是「如何赋予 AI 能力」。但对多数用户而言,这些改进尚不足以让他们抛弃熟悉的 Chrome。

若仅需搜索或浏览网页,传统浏览器已足够完善;若希望 AI 协助完成任务,直接打开 ChatGPT、Claude 等助手,路径反而更加直接高效。

因此,AI 进入浏览器并非毫无价值。它能减少重复劳动,优化操作流程,让浏览体验更为顺畅。但就目前来看,这更像是锦上添花,而非雪中送炭。

浏览器多了个 AI 助手,确实变聪明了;但它还没聪明到让用户觉得,有必要换个浏览器。

AI 正在绕过浏览器这个「中间商」

AI 浏览器诞生之初,有一个合乎逻辑的设想:浏览器是互联网入口,AI 是理解与执行任务的新能力,二者结合后,浏览器便有望成为 AI 时代的全新工作台。

这一逻辑在早期并无瑕疵。当 AI 主要承担搜索、总结及阅读网页的任务时,浏览器确实是天然载体。用户打开页面,AI 在一旁提炼信息、整理内容,这与过去浏览器插件的发展轨迹并无二致。

图|OpenAI

尴尬之处在于,AI 浏览器还没来得及确立新入口的地位,AI Agent 已经开始重塑人们使用电脑和互联网的方式。

以往,用户需先打开浏览器获取信息,再通过网页完成操作。网页上的按钮、菜单和布局,都是围绕人类习惯设计的。

但 AI 并不完全遵循人类的使用逻辑。对 AI 而言,网页仅是获取信息的一种途径,而非唯一渠道。相较于模拟人类的点击与浏览,直接调用数据、服务和工具往往效率更高。

这也正是 MCP、API 以及各种 Agent 工具链备受关注的缘由。它们提供了一种不同于网页浏览的信息获取范式:AI 无需先打开页面再搜寻答案,而是可以直接访问数据、调用能力并完成任务。

如今,用户只需将一个链接交给 ChatGPT 或 Claude,即可让模型读取内容并整理结果;未来更多工作,也将通过 Agent 直接调用各类软件和服务来完成。

浏览器曾是互联网的入口,但对于 AI 来说,它正逐渐沦为众多工具之一。

随着 Agent 能力持续增强,AI 开始从「理解网页」迈向「操控环境」。Anthropic 的 Claude Computer Use、OpenAI 的电脑操作能力,都在尝试让 AI 直接控制用户电脑:打开软件、填写表单、处理文件,不再局限于单一浏览器窗口内。

图|ChatGPT Computer Use

从这个视角看,AI 浏览器更像是一个过渡性的产物。

它试图让 AI 定居于浏览器之中,而 Agent 正在推动 AI 渗透至整个电脑系统。

最终胜出的,往往是模型能力最强的那家公司

回望这一轮 AI 浏览器竞争,结果颇具讽刺意味:最想争夺下一代入口的公司,未必真正握有入口。

过去一年,OpenAI、Perplexity 和 The Browser Company 都试图重新定义浏览器。凭借更强的 AI 能力或激进的产品理念,它们希望让浏览器从一个单纯的网页窗口,转变为可直接完成任务的智能入口。

但最终占据优势的,反而可能是早已拥有浏览器入口的公司——Google。

图|Google

过去一年,Google 在 AI 模型竞争中的压力并未减轻。Gemini 3.5 Pro 原本被寄予厚望,被视为 Google 追赶 OpenAI 和 Anthropic 的关键一步,但这款旗舰模型迟迟未正式面世。

据此前了解,Google 曾计划于 6 月推出 Gemini 3.5 Pro,随后因延期,原因之一是模型在代码能力等关键指标上未达到内部预期。

讽刺的是,当外界热议 Google 的模型是否追上对手时,它手中握着其他 AI 巨头梦寐以求的东西:Chrome。

OpenAI 可以打造更强大的模型,Perplexity 可以构建更智能的搜索,The Browser Company 可以重构浏览体验,但它们都面临同一个难题:为什么用户要离开 Chrome?

某种程度上,AI 浏览器厂商折腾许久,试图重新创造一个 AI 时代的入口,最后可能还不如 Google 随手将 Gemini 植入 Chrome。

图|Google

至少在浏览器领域,Google 证明了一个现实:

在 AI 时代,模型能力固然重要,但入口同样关键。

浏览器不会消失,AI 也不会彻底脱离浏览器。只是「AI 浏览器」这一独立品类,可能等不到成为下一代入口的那一天。

它来得很快,退潮得也快。

享年约 1 岁。