重视隐私的 AI——在你的设备上运行,不在云端

大多数 AI 工具会把你的文字上传到服务器,在那边跑模型,再把答案传回来。Web Highlights 反过来做:模型就装在你的电脑里,在你的浏览器中运行。你的高亮内容、页面和问题永远不会离开你的设备。

你的设备你的页面Gemini Nano没有云端,没有服务器你的内容永远不会离开你的设备

每个 AI 功能都是这样工作的

AI 摘要

你正在读的页面被交给浏览器里的模型,摘要就在那里直接生成。不用上传任何东西——文字本来就已经在你的屏幕上了。

AI 聊天

就任何页面或 PDF 提问。对话发生在你和你机器上的模型之间——不是和某个数据中心里的 API 对话。

AI 记忆卡片

记忆卡片是在设备上根据你的高亮内容起草的。你的学习资料——往往是最私密的内容——始终属于你。

设备端 AI 是怎么运作的

  1. 1

    浏览器下载模型——只需一次

    Chrome 自带一个叫 Gemini Nano 的小型语言模型(Microsoft Edge 用的是 Phi-3)。你第一次用 AI 功能时,浏览器会下载它——大约 3 到 4 GB,只需一次。

  2. 2

    模型就在你的浏览器里运行

    从那以后,每一份摘要、每一句聊天回答、每一张记忆卡片,都是由你自己的 CPU 或 GPU 计算出来的。根本没有 Web Highlights 的 AI 服务器——就算我们想看你的内容,也做不到。

  3. 3

    什么都不会上传

    没有账号,没有 API 密钥,不按次收费,不留提示词日志。你可以自己验证:在生成摘要的时候打开浏览器开发者工具的网络标签页——没有任何请求把你的页面发去任何地方。

  4. 4

    离线也能用

    因为模型就在你的设备上,模型下载完之后,AI 功能不用联网也能继续用。

老实说清楚

设备端 AI 是一种取舍:你换来了隐私,但规则由浏览器来定。具体来说:

  • 你需要在桌面操作系统上使用Chrome 138 及以上版本,或 Microsoft Edge——Windows、macOS 或 Linux。移动端浏览器和 ChromeOS 还没有这个模型。
  • 你的电脑需要一块显存超过4 GB的显卡。最近几年的大多数机器都能达到;非常老旧或非常轻薄的可能不行。
  • 一次性下载模型大约需要 3 到 4 GB。Chrome 只有在检测到大约 22 GB 的空闲磁盘空间时才会开始下载——这是它想要的磁盘余量,不是模型本身的大小。
  • 浏览器只在安全(https://)页面上开放内置 AI。在普通的 http:// 页面上,AI 功能会暂停——不是你的浏览器出问题,是页面挡住了。
  • 装在你笔记本上的小模型,不是 GPT 那种量级。用来做摘要、聊聊某个页面、生成记忆卡片,它完全够用——我们用它就是为了做这些事。

有什么不正常?看看 Chrome AI 排障指南

常见问题

我的数据会离开设备吗?
AI 不会。页面内容、你的高亮和你的提示词都由浏览器里的模型处理。真正会同步的(如果你创建了账号)是你保存的高亮和书签——这是普通的同步功能,和 AI 无关,我们在隐私政策里有说明。
Web Highlights 用的是哪个 AI 模型?
Chrome 内置的 Gemini Nano。在 Microsoft Edge 上,内置模型是 Phi-3。用的是你浏览器自带的模型——我们自己的服务器上不跑任何模型。
哪些浏览器支持?
Chrome 138 及以上版本,以及较新的 Microsoft Edge,在桌面系统上(Windows、macOS 13+、Linux)。移动端浏览器还没有设备端模型——那边的 AI 按钮会先隐藏起来,等支持了再显示。
为什么我得先下载一个模型?
这次下载本身就是隐私功能:不是把你的文字发给一个已经有模型的服务器,而是让模型来找你。大约 3 到 4 GB,只需一次,浏览器会自己处理好。
离线能用吗?
能。模型下载完之后,摘要、聊天和生成记忆卡片都不需要联网。
为什么 AI 在 http:// 页面上不能用?
浏览器只在安全(https)页面上开放内置 AI——这是我们没法绕过的平台规则。用 https 打开页面,或者在 Web Highlights 面板里打开你的高亮,AI 功能就能恢复正常。
免费吗?
免费方案每天有一定的 AI 操作额度(比如每天生成一套记忆卡片);付费方案会提高这些上限。因为模型跑在你自己的设备上,不会有任何按 token 计费的隐藏成本。