把日常 Chrome 借给 AI 用:这个小工具替它做完 5 件我懒得做的事
我自己写了一个跑在 macOS 上的小工具,让 AI 能直接操作我日常的 Chrome——抓登录后的小红书评论、点 BOSS 直聘打招呼、过验证码、填表格、同时让两三个 AI 各干各的。面向没用过编程的人,讲它能做什么、不能做什么。
前阵子我想看某款新茶饮的真实口碑。正文全是软广,真正有用的在评论区——但小红书一篇笔记下面动辄几百条评论,折叠的二级回复(也就是"楼中楼",每条评论下面别人再回复的子回复)一层套一层。
手工展开。我打开一篇笔记试了试,光"展开 247 条回复"那一个按钮就点了快 20 次,滚到眼花,最后没翻到一半人就废了。
于是我开了我自己写的一个小工具,让 AI 接手这件事。我坐在旁边没动,AI 在浏览器里替我把笔记全部打开,把评论区一节一节地滚到底,把折叠的楼中楼一条一条展开,最后把整棵树拉成一份 JSON 给我。整件事我从头到尾只动了两次鼠标,一次开工具,一次按"开始"。
这件事,普通搜索工具干不了,搜出来全是软广。Playwright 那类无头浏览器也干不了,一登录就被风控弹回来。我用的那个小工具能做,是因为它直接借用了我日常在用的 Chrome——连登录态都一并借了。
这个工具,我把它叫 Agent Browser Bridge。它就一个目的——让本地的 AI 助手能像你一样,正常地打开、点击、输入、截图、读网页。
下面拆开讲它能做什么,以及它做不了什么。
1. 替 AI 借走你的真实 Chrome
这件事是它和别家工具最不一样的地方。
市面上的浏览器自动化工具大多自己开一个"无头浏览器"——一个没有界面的、藏在后台的浏览器副本。这种浏览器带着明显的机器指纹,访问小红书、知乎、BOSS 直聘、公众号后台、银行官网这些站点时,几乎一进去就被验证码、滑块、强制扫码登录挡在门外。
Agent Browser Bridge 不这样。它的做法是在你电脑上跑一个本地的"小服务",专门在 AI 和你的 Chrome 之间传话。它不会另开一个浏览器副本,更不会去伪造指纹。AI 看到的是你日常的 Chrome 标签页——你小红书的登录态、你的企业微信扫码、你的网银 U 盾,全都还在。
这就是为什么上面那个"AI 自动展开小红书评论区"的事,普通工具干不了,但它能干。
2. 让 AI 干你日常在浏览器里能干的几乎所有事
我自己日常在浏览器里会做的事,无非是这几样:搜资料、点开网页、读页面文字、填一张表、点提交、截一张图、滚动找信息。这个工具把这几样打包成几个动作,AI 想用的时候直接喊一声就行——
- 查资料 / 查证:让 AI 自己打开某个网页读里面的内容,代替你慢慢翻。
- 站内搜索 / 整理结果:比如在小红书里搜"新茶饮 避坑",让 AI 把符合条件的笔记抓下来按你给的格式整理。
- 抓登录后才能看的内容:公众号后台的文章列表、企业微信里的客户对话、自己网银的账单,这些登录墙后面的内容。
- 填表 / 提交 / 点击:在 BOSS 直聘上跟候选人打招呼、在豆瓣上点"已读"、在邮箱里归档、给老板的周报系统提交下一周。
- 截图 / 滚动 / 读图:把一整页截下来发给 AI 看,或者滚到底再读一次。
我自己的使用频率是这么排的:第一是"抓登录后的内容",第二是"在某个网站里跑批量操作"(比如把 30 条笔记依次展开评论区),第三是"截图后让 AI 帮我看图"。
3. 你随时看得到 AI 在动
把浏览器借给 AI 这件事,听起来吓人。所以这个工具从第一天就死磕一件事,任何时候,AI 动你的浏览器,你都看得到,也拦得住。
具体表现在四个地方。
-
Chrome 标签上的红点。AI 一旦接管某个标签页,那个标签页的标题会立刻被改成"● Agent 接管中 | 原标题",扩展工具栏图标上也会亮起一个蓝色 "ON" 徽标。你人在别的软件里工作时,抬头看一眼标签栏就知道是不是有 AI 在动。
-
页面里的"幽灵光标"。AI 点击哪个按钮,那一个点上就会浮出一个动画光标,留下一圈波纹,你就知道它刚才在动哪里、动了什么。
-
页面右上角的"停止 Agent"按钮。AI 正在做事的时候,你随时点它一下,AI 立刻被踢开。这是我最依赖的功能,因为它意味着我不用因为"怕它乱点"就提心吊胆。
-
运行 12 秒不动就放手。AI 操作中途歇一歇、想一下,超过 12 秒没有新的动作,"接管中"的提示会自动切到"已放开",原标题也会恢复。
我自己的习惯是 AI 做事前先看它打算做什么。它会告诉我"我要打开 XX 标签、点 XX 按钮"。它做的时候我不盯屏幕,AI 通常比你快;它做完我去翻它给的报告。如果中间觉得它跑偏了,鼠标甩到右上角,点一下"停止"。
4. 几个 AI 一起干活不打架
这条是给"一次开好几个 AI"的人准备的。我自己日常就是这么跑的,所以值得讲一下——没有这条规则,多个 AI 一起跑就会乱套。
Agent Browser Bridge 允许多个本地 AI 助手同时连进来。规则很直白——
- 不同的标签页可以并行。你让 AI A 帮你抓小红书,同时让 AI B 帮你刷 BOSS,互不干扰。
- 同一个标签页上,每个 AI 要"先认领再用"。AI A 认领了某个标签,AI B 想动那一个就会收到"这个标签有人用"的提示,得排队。
- 同一标签页上的多个动作会按顺序排队,不会因为同时下两个命令导致页面状态错乱。
- 每个 AI 都有"占用到期"时间。AI 中途崩了或者忘了主动释放,它占用的标签页过 120 秒自动释放,不会卡死。
我自己日常开 2 到 3 个 AI 一起跑——一个抓数据,一个读研报,一个帮我处理待办。Chrome 标签上会显示类似"豆包 #101 接管中""豆包 #102 接管中"的字样区分,同一个 AI 助手开多了也能认得清。
5. 敏感信息自动盖住,AI 看不到
浏览器里有很多不能直接喂给 AI 的东西——登录页的密码、支付页的银行卡号、短信验证码。
Agent Browser Bridge 在"读页面"这一步会自动把这些字段打码成 [value redacted],再返回给 AI。AI 看到的页面长这样:
手机号:[value redacted] 验证码:[value redacted] 同意协议 ☑
判断标准写在代码里,靠两条:一是输入框类型是密码或隐藏字段,二是输入框的 autocomplete 属性命中了 current-password、cc-number(银行卡号)、cc-csc(卡背面三位数)、one-time-code(短信验证码)这类值。所以登录页密码、支付页卡号、短信验证码这三类是默认就盖住的。
不过要说清楚它的边界:现在只认这两条规则,手机号、身份证号这类字段暂时不在其中。页面上有些输入框没写 autocomplete 属性,那这条判断就会漏掉——所以我自己的做法是,涉及填真实手机号的页面,先自己看一眼 AI 拿回来的页面快照,确认那一行是不是真的被盖住了。
这一条不是为了 AI,是为了我自己。AI 拿不到我的密码,我自己就放心把浏览器整个借出去。
它做不到的几件事
不想把它吹得太神,先把边界列清楚。
- 目前只支持 macOS + Google Chrome。Windows、Linux、Safari、Edge 都没适配。
- 不替你登录。遇到登录墙、扫码、验证码、2FA,AI 都会停下来等你手动操作。这是写死在规则里的——它不会替你去输入你的密码。
- 不能装到别人电脑上去用。它是装在你本机的小工具,连你电脑里那份真实的 Chrome 一起工作。
- 不是浏览器插件商店里的"成品"。它现在还是 GitHub 上的开源项目,需要你按文档自己装一下,过程大致是 10 分钟左右:装扩展、装一个本地的服务、配一下通道,三步。我没把它打包成 .crx 推商店,因为它一旦脱离你本机,安全性就难讲了。
项目主页在 GitHub:zqcccc/chrome-agent-bridge。仓库里有完整的安装步骤、AI Agent 的接入说明,还有一份给 AI 助手看的"使用手册"(里面讲它能做什么、不能做什么、遇到什么情况要停下来交还给人)。
它不是给你用的,是给你的 AI 用的
最后想给"没用过编程"的读者说清楚一件事。
这个工具不是你下载下来、双击图标就能用的客户端。它的操作界面,是命令行:
node agent/cli.mjs tabs
node agent/cli.mjs open https://example.com
node agent/cli.mjs click "button[type=submit]"它面向的用户是会用 AI 助手的人——你日常用的那个 AI 工具、本地跑的那个 Agent、或者你自己写的小脚本。它能替 AI 装上"操作浏览器"这一只手。
至于你自己——
- 你想让 AI 帮你抓登录后的小红书评论?把这件事告诉你的 AI 助手,让它来用。
- 你想让 AI 帮你每天上午 10 点去 BOSS 打个招呼?让 AI 助手自己来用。
- 你不想跟命令行打交道?你不需要懂——你只需要让懂 AI 的人用上它。
我自己是那种"既懂 AI 又天天要写点代码"的人,所以这个工具正好长在我的需求上。它不会变成一个面向普通人的"傻瓜版",但它会让你日常用的那个 AI 助手突然多出一双手,干很多之前只能你自己干的事。
这套东西是 2026 年 9 月 9 日到 9 月 12 日这四天里一点点加上去的,目前版本 0.3.2。技术本身不复杂,复杂的是另外三件事:哪些事 AI 能做、哪些必须停下来交还给人,用户随时能喊停,敏感信息永远不过 AI 这条线。
这三条没有一条是写完就完的。