阅界资讯

BrowserAct,给AI Agent配一个真实浏览器,从安装到实战

阅阅界编辑部2阅读7分钟

推荐《BrowserAct,给AI Agent配一个真实浏览器,从安装到实战》:作者把经验掰开揉碎讲得很细。下面按要点重新组织一遍,方便你快速抓住重点、用起来。

大家好,我是狂师。 事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。 页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。 Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。 Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。 BrowserAct 补的就是这块,今天这篇聊一聊,它是什么、能干什么、怎么装、怎么用。 BrowserAct 是什么 一句话概括, 它是一款给 AI Agent 用的浏览器自动化 CLI,带全套反封锁能力 。 开源仓库在 GitHub, browser-act/skills ,MIT 协议、Python 写的。 今年 2 月才开源,半年时间 Star 冲到 5.6K,目前还在持续更新。

大家好,我是狂师。 事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。 页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。 Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。 Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。 BrowserAct 补的就是这块,今天这篇聊一聊,它是什么、能干什么、怎么装、怎么用。 BrowserAct 是什么 一句话概括, 它是一款给 AI Agent 用的浏览器自动化 CLI,带全套反封锁能力 。 开源仓库在 GitHub, browser-act/skills ,MIT 协议、Python 写的。 今年 2 月才开源,半年时间 Star 冲到 5.6K,目前还在持续更新。它有两种用法, 云端和本地 ,官网上那张对比图说得很清楚。

大家好,我是狂师。 事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。 页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。 Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。 Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。 BrowserAct 补的就是这块,今天这篇聊一聊,它是什么、能干什么、怎么装、怎么用。 BrowserAct 是什么 一句话概括, 它是一款给 AI Agent 用的浏览器自动化 CLI,带全套反封锁能力 。 开源仓库在 GitHub, browser-act/skills ,MIT 协议、Python 写的。 今年 2 月才开源,半年时间 Star 冲到 5.6K,目前还在持续更新。它有两种用法, 云端和本地 ,官网上那张对比图说得很清楚。 云端模式 ,去官网输入框里写一句你要什么数据,比如「抓 京东官网 无线耳机销量前 20,要价格、评分、库存和链接」,它自己建爬虫、自己验证、自己跑,产出结构化表格,还能定时重复执行。

大家好,我是狂师。 事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。 页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。 Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。 Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。 BrowserAct 补的就是这块,今天这篇聊一聊,它是什么、能干什么、怎么装、怎么用。 BrowserAct 是什么 一句话概括, 它是一款给 AI Agent 用的浏览器自动化 CLI,带全套反封锁能力 。 开源仓库在 GitHub, browser-act/skills ,MIT 协议、Python 写的。 今年 2 月才开源,半年时间 Star 冲到 5.6K,目前还在持续更新。它有两种用法, 云端和本地 ,官网上那张对比图说得很清楚。 云端模式 ,去官网输入框里写一句你要什么数据,比如「抓 京东官网 无线耳机销量前 20,要价格、评分、库存和链接」,它自己建爬虫、自己验证、自己跑,产出结构化表格,还能定时重复执行。 本地模式 ,装两个 Agent Skill 进你的 Claude Code、Cursor 或者 Codex,Agent 就能直接指挥一个真浏览器干活,读你登录后的页面、填表单、点按钮、截图、抓请求。

大家好,我是狂师。 事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。 页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。 Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。 Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。 BrowserAct 补的就是这块,今天这篇聊一聊,它是什么、能干什么、怎么装、怎么用。 BrowserAct 是什么 一句话概括, 它是一款给 AI Agent 用的浏览器自动化 CLI,带全套反封锁能力 。 开源仓库在 GitHub, browser-act/skills ,MIT 协议、Python 写的。 今年 2 月才开源,半年时间 Star 冲到 5.6K,目前还在持续更新。它有两种用法, 云端和本地 ,官网上那张对比图说得很清楚。 云端模式 ,去官网输入框里写一句你要什么数据,比如「抓 京东官网 无线耳机销量前 20,要价格、评分、库存和链接」,它自己建爬虫、自己验证、自己跑,产出结构化表格,还能定时重复执行。 本地模式 ,装两个 Agent Skill 进你的 Claude Code、Cursor 或者 Codex,Agent 就能直接指挥一个真浏览器干活,读你登录后的页面、填表单、点按钮、截图、抓请求。 两个 Skill 分工明确。

行动建议:收藏这篇,下次碰到同类问题先翻出来对照做一遍。好经验的价值,在于用起来。你最近被这类问题卡过吗? 来源|博客园《BrowserAct,给AI Agent配一个真实浏览器,从安装到实战》,https://www.cnblogs.com/jinjiangongzuoshi/p/22991224.html

程序员技术场技术后端

评论(0)

暂无评论,来抢第一条。