前言:在chrome://on-device-internals页面,我发现Chrome早已内置4GB的Gemini Nano端侧AI模型,离线运行、数据不上传。本文详解Manifest Criteria体检标准、按需下载的专家模型与本地诈骗检测,并给出第二个用户资料模型Loading的排查方法,教你激活这个免费大模型。
我翻了翻Chrome的硬盘用户资料目录,发现里面住了一个大模型
前两天晚上,我在折腾Chrome的设置,鬼使神差地在地址栏敲进去一个页面,chrome://on-device-internals。
本来只是想看看有没有什么好玩的隐藏开关,结果页面一加载出来,我就愣住了。
Broker State,Ready。
一个4GB的模型,正安安静静躺在我硬盘的角落里。

很多朋友可能不知道这页面是干嘛的。简单讲,这是Chrome给自家端侧AI留的一个诊断后台。Google这几年一直在干一件事,把Gemini Nano,一个正经的小参数量大语言模型,直接内置进浏览器。它不在云端,不在什么数据中心,就在你电脑的 User Data\OptGuideOnDeviceModel 这个文件夹里,weights.bin,4072 MiB,一个文件。
我盯着这个路径看了半天,有种在自家床底下翻出一件不知道谁放的乐器的感觉。
然后我干了一件每个好奇的人都会干的事,把这页从头到尾扒了一遍。
先看的是 Manifest Criteria 这块,也就是Chrome判断你这台机器配不配跑本地AI的体检报告。显存,要求3000 MiB,实测16231 MiB。磁盘,要求20GB,可用117GB。Feature flag,true。企业策略,true。用户设置,true。
全绿。
我看到那个显存数字的时候第一反应是???要求3GB,我有16GB,Chrome你这是在卡学历吗。后来去翻了文档才知道,Chrome在决定给你下哪个模型之前,会先在你的GPU上跑一个代表性的shader做基准测试,跑得好就给你下大的4B参数版本,跑不动就下2B的小杯,再不行退回CPU推理。相当于先考试再分班,还挺讲道理的。
顺便说一句,Chrome给我的性能评级是Medium,属于它一贯的保守打分。崩溃记录0/3,稳得一批。

接着往下翻,Assets这一栏,才是真正有意思的地方。
nano_v3_gpu_component,Ready,100%。这是主模型,Gemini Nano v3,已经装好了,跑在GPU上,标注是 fastest inference。
但它下面还排着一串没装的家伙。proofreader_small_expert_model_component,Not Installed。summarizer_small_expert_model_component,Not Installed。speech_recognition,Not Installed。还有一个 gemma4_component,版本号2026.8.7,也是Not Installed。
一开始我以为是我这边出了什么问题,后来想明白了,这是Chrome的策略,按需下载。主模型常驻,专家模型等你第一次真正用到那个功能,它才开始下。就像你搬进新家,床和冰箱是配好的,跑步机得等你哪天真的决定减肥了它才会出现。
gemma4那个Pending Usage,我愿称之为期货。
再往下是Use Cases,就是这个模型具体能干什么。prompt_api,Available。summarizer_api,Available。writing_assistance_api,Available。还有一个让我多看了两眼的,scam_detection,诈骗检测,Available。
你想想看这个功能。诈骗检测在本地跑,你收到的那条可疑短信、那个钓鱼链接,不需要上传给任何人,模型就在你设备上默默看一眼,觉得不对就提醒你。对一个不太懂技术的长辈来说,这可能是比任何反诈APP都安静、都体面的保护。

好,铺垫完了,说实验。
我照着官方文档,在控制台里敲了几行代码。先问一句 await LanguageModel.availability(),返回available。然后LanguageModel.create()建一个会话,丢一个问题进去。
模型开始吐字了。流式的,一个词一个词往外蹦,就在我屏幕上,就在我显卡里。
官方文档里有句话,我盯着看了好几秒。使用该模型时,系统不会向Google或任何第三方发送数据。不需要网络,不需要API key,不需要信用卡,不需要注册任何账号。
2026年了,一个白嫖的、离线的、不上传任何东西的LLM,就藏在每个人每天都要打开的浏览器里。而大部分人,包括用了很多年Chrome的我,压根不知道它在。
这才是这件事最赛博朋克的地方。不是模型多强,4GB的Nano跟云端那些巨兽比就是个玩具。是它出现的方式,一声不吭的,就住进来了。
不过真正让我折腾到半夜的,是后面这个事。
我在这台电脑上开了两个Chrome用户资料。第一个资料里,一切正常,模型随叫随到。切到第二个资料,打开同样的测试页面,Device performance class,Loading…,模型目录,空的。
我第一反应是,完了,不会每个资料都要重新下4GB吧。
去翻了文档和Chromium的源码讨论才发现,不是。模型文件存在User Data这个全局目录下,所有用户资料共享,硬盘里永远只有一份。但每个资料对模型的初始化状态、访问权限,是各自独立的。
房子只有一套,钥匙一人一把。第二个资料的问题,是它那把钥匙还没被激活。
排查思路其实不复杂。先去第二个资料的chrome://on-device-internals看体检报告,重点盯三项,Enabled by feature flag、Enabled by enterprise policy、Enabled by user setting,看哪个是false。如果是user setting亮红灯,多半是账号本身的问题,受管理的Workspace账号、教育账号、未成年账号,云端策略会直接把本地模型禁掉,这个你本地怎么折腾都没用。
如果三项全true但还是Loading,去chrome://components里找到Optimization Guide On Device Model,点一下检查更新。哪怕它提示没有更新,这个动作也会强制当前资料去重新认领硬盘上那份模型。然后重启Chrome,一般就好了。
我最后就是这么弄好的。第二个资料里,那个Loading…终于变成了具体的数字。

说到这个,我想起一个挺久远的事。
2008年Chrome刚发布的时候,Google出了本漫画书来讲他们的浏览器理念,里面有个观点,浏览器应该像操作系统一样,成为一切应用运行的地基。那会儿大家聊的是Web OS,聊网页应用怎么取代桌面软件。
十几年过去,事情朝着另一个方向走了。不是网页应用去抢操作系统的活,是浏览器自己,在没人注意的时候,长出了一个本地智能层。上一次有人往系统里硬缝一个浏览器,是1995年的Windows 95,微软为这事被反垄断锤了很多年。这一次Google把一个LLM缝进浏览器,几乎没激起任何水花,因为它不是塞给你的,它是等你自己发现的。
我一直觉得,真正的技术平权不是发布会上的PPT,是这种东西。不需要你懂英文,不需要你翻教程,不需要你有一张4090,你只要打开一个你已经用了十年的软件,它就在那了。
那晚关页面之前,我又看了一眼那个4GB的weights.bin。
它还在那躺着,不吵不闹,等某一天你随便打开的一个网页,需要它帮个忙。
/ 注意,本项目仅在 SyncMein 的500人小群分享。
/ 谢谢你看完了我的文章,我们下次再见吧。
/ 作者:明察
/ 投稿或爆料,请联系邮箱:mingcha@gqmg.com
关键词:Chrome端侧AI, Gemini Nano本地模型, chrome://on-device-internals, LanguageModel API, 多用户资料模型加载














暂无评论内容