你有没有想过一个浏览器能有多小? chrome 大家都装过吧,三百多 mb, 打开就要占几百兆内存。但有个叫 obscure 的 项目,用 rest 写了个无头浏览器,只有七十兆 内存,占用才三十兆,加载速度快六倍。更关键的是,它还能帮你躲过各种反爬检测这玩意儿是怎么做到的?今天就来聊聊这个为 ai agent 而生的浏览器引擎。 先说说无头浏览器是啥?你可能用过 chrome、 firefox, 这都是有界面的浏览器,能点击,能看视频。 无头浏览器呢,就是把界面去掉,只留下执行能力。就像把 windows 换成 linux 服务器,没有桌面,全靠命令行操作,这有啥用?第一个,自动化测试,你不用每回都点点点,写个脚本让它自己跑就行。 第二个,网页爬虫,很多网站的内容是 javascript 动态加载的,普通爬虫抓不到,但无头浏览器能渲染出来。第三个, ai agent, 让 ai 像人一样操作网页,填表单,点按钮、翻页。 但问题来了,现有的无头浏览器有点重,那 headless chrome 有 啥问题?第一,体积大, 三百多 mb, 装完还要配环境。第二,内存狠,一个实力就要占二百多 mb 内存,如果你要同时跑几十个机器直接吃不消。第三,启动慢,冷启动要两秒,对于 a i a 诊来说,这太慢了。 但最致命的问题是容易被识别。 hellos chrome 有 很多指纹特征,比如 navigator webdriver 会返回 true, 直接告诉网站我是机器人。 还有 gpu canvas, 指纹都不真实,行为模式也不像真人。结果呢?反爬系统一眼就能认出你。爬虫翻车, ai agent 也容易被封号。这就是为什么需要一个更轻更隐蔽的方案。 这就轮到主角 obscura 登场了,它是一个用 rust 从零撸的无头浏览器引擎。 注意,是从零撸的,不是套壳 chrome, 它自己实现了 h t t p 客户端 d o m 解析器、 css 选择器引擎,只有 v 八引擎是内嵌 chrome 的, 还支持 chrome devtools protocol, 所以 可以直接接 poplite 和 playrite, 你 原来的代码不用改。 最关键的是,它是一个单文件,七十兆,装完就能跑,不需要 chrome, 不 需要 note js, 啥依赖都没有。 apache 二点零开元,完全免费。这就是它的定位,一个为自动化规模设计,而不是给你刷网页的浏览器 来看,硬核对比差距有多大?内存 obscura 只要三十兆, chrome 要二百多 mb, 差了将近七倍。 二进置文件 obscura 七十兆, chrome 三百多 mb, 也差了四倍多。加载速度, obscura 八十五毫秒, chrome 要五百毫秒左右,快了六倍。这意味着啥? 如果你要同时跑一百个浏览器时,利用 chrome, 你 得准备二十 g 内存,用 obscura 只要三 g。 这对于大规模爬虫和 ai agent 部署来说,是质的飞跃。而且 obscure 启动是及时的,不像 chrome, 能启动要两秒,这个效率差距实打实的。 那凭啥这么快?我用各类笔说清楚, chrome 就 像一辆豪华大巴,啥功能都有,空调、座椅、娱乐系统,但太重了,光启动就要半天,你只想运货,他却给你配了司机和导游。 三百兆的二进制,很多功能你根本用不上。 obscure 呢,就像一辆送货皮卡,只保留核心引擎,车厢轮子 轻便灵活,说走就走,没有花里胡哨的装饰,他的定位很明确,为自动化规模设计,不是给你浏览网页用的。这就是为什么他能把体积压到七十兆,内存只要三十兆, 但最香的还是它的内置反指纹能力。 headless chrome 为什么容易被识别?第一, navigator webdriver 会返回 true, 直接告诉网站我是机器人。第二, gpu canvas audio 指纹都是假的,反爬系统一眼就看出来。 第三,点击轨迹时间间隔都不真人。 obscura 的 stealth 模式专门解决这些问题, 每次绘画的 gpu 屏幕 canvas 指纹都随机画,不暴露机器特征。 navigator web driver 设成 undefined, 和真实 chrome 一 模一样,还内置了追踪器,屏蔽拦截三千五百二十个域名广告脚本分析脚本都不加载,这意味着啥? 你的爬虫和 ai agent 能像真人一样访问网站,不容易被识别了。那怎么用?三行命令搞定?第一步,下载安装,从 github releases 拉下来解压直接跑,启 动的时候加上 stealth 参数,就开启了反检测模式。第二步, popeteer 接入你原来的代码,不用改,只要把连接方式从启动 chrome 改成连接 obscure 就 行。 第三步, playwrite 也一样,用 connect over cdp 接上就行。这就是它的优势,无缝兼容现有工具链。你可以把 obscurity 当成更轻更快的 prune 来用,不用改代码,不用学新东西,换底层就行。 那适合啥场景?第一个, ai agent 自动化,让 ai 像人一样操作网页,填表单,点按钮、翻页。 用 obscura 的 好处是不用装 chrome, 节省资源,反指纹能力,不容易被封号。第二个,大规模网页爬取, 你要并行抓取成千上万个页面。 obscura 的 内存占用低,能跑更多,实力加载快,效率翻倍, stealth 模式还能躲过反爬。第三个,自动化测试, c i c d 流水线集成,启动快,不用等,资源占用少,单文件部署环境简单,但要注意不适合格式化测试或手工浏览。 obscura 是 无头浏览器,没有界面,你要截图看效果。手工点按钮测试还是用 chrome 吧, 它的定位是干活,不是看活,当然也有局限性别神话,它第一生态还在建设, popeteer 和 playrite 积累了几年,遇到问题能搜到答案, obscura 才出来不久,参考资料相对少。 第二, v 八版本同步问题,它依赖特定版本的 v 八,和官方 chrome 的 gs 引擎可能有差异,极端兼容性问题,需要对照测试。第三, styles 不是 万能的反检测效果取决于目标网站的强度,不保证对所有网站都有效。 第四,不适合桌面浏览,没有界面可是画测试用不了,手工操作还是要 chrome。 所以 说工具的价值取决于场景,选对了事半功倍,选错了白折腾。 总结一下 obscura 带来了啥,第一,极致清亮,七十兆单文件,三十兆内存,不用装 chrome, 不 用配环境下载就能跑。 第二,速度飞快,加载快六倍,启动即时大规模并行,不再卡资源。第三,隐蔽能力强,内置反指纹和追踪屏蔽,爬虫和 agent 不 易翻车。一句话总结, 用 ras 把浏览器去肥增瘦,只保留自动化需要的能力,把体积和内存压到极致,还加了反指纹,让 ai agent 和爬虫能跑得更轻、更快、更隐蔽, 这就是 obscura 的 价值。如果你再用 puppeteer 或 playwright, 不 妨试试把底层换成 obscura 看看效果。下期想看啥,评论区告诉我。
粉丝48获赞595

兄弟们今天给大家带来的是刚推出的磁力搜索工具,简直就是资源搜索和下载的神器,内置几十条优质高速节点,支持聚合搜索资源实时更新,不管是热门的视频,好听的音乐,经典的书籍, 还是精美的图片,只要你能想到,在这里都能搜到,操作特别简单。所以我们输入想要搜索的关键词,点击搜索就可以看见各种链接,基本上想要的都能搜索出来。找到需要的之后,我们直接点击右键下载资源即可, 而且下载速度快到飞起,完全不用漫长的等待。获取方式,首先下载安装包,打开浏览器,输入下载网址搜索框,输入关键词,找到对应文件进行下载,这里提供了两种下载方式,就非常方便。

这不是给人类看的浏览器,而是 ai 的 隐形异眼。基于 rust 重装引擎,内存占用警卫 chrome 的 五分之一,原生绕过 club flare, 让 ai 完美伪装成真实用户。 p 协议现有脚本,零成本无缝迁移,二零二六自动化工匠的底层利器 obscura。

呃,今天讲解一下这个 obs 最新权限如何使用下载啊兄弟们,首先打开我们的浏览器,复制我给你们的这个这个链接, 然后去下载 啊,这里要我们要手动保留啊,手动保留,手动保留一下,然后会打开,打开之后我就不给你们演示了啊,打开之后最小化,然后找到我们的这个权限助手, 输入我们自己的卡密啊,然后点登录,记住这里啊,这里不要打开互动工具啊,不要打开互动工具,因为后台占用 电脑配置不行,会卡动卡卡顿啊。直播要勾选第一个优化内存,然后启动 obs, 然后点开我们的左上角,一般正常的伴侣他是没有 obs 直播的,然后我们勾选,因为我们现在使用软件了,所以有 obs 直播勾选软件哦。复制我们的推流码, obs 打开, 然后复制,刚才复制了我们推流码,点设置,然后左上角选择自定义啊,设置 ctrl 加 v 复制过来,这个也是一样,复制到下面的推流码, ctrl 加 v, 然后应用, 然后这里啊,这里怎么开,怎么开直播啊? obs 点开播啊,伴侣会跟着启动啊兄弟们,然后直接两个隐藏掉就行,这是我们开播教程。然后怎么关播呢?就是 obs 停止直播。 ok, 这这回已经停止了,然后这回伴侣会显示推流已断开,然后停止直播, ok, 这就是我们的下载和启动教程,关播开播教程。

你们到底是老钱还是捞钱?除了误导消费者之外,好像也没别的本事了。你们是当那些把一件两万的短袖买到断货的有钱人傻?还是当那些给你们付钱的客户傻? 这里是 obscure, 如果要我一个开鞋厂的服装内行人来瑞平当今的老前锋平地,那可以说就一句话,绝大多数人都在把郊区的房子吹出超核心地段的感觉, 一个个都在二九九的国王的礼物。你们是当那些把一件两万的短袖买到断货的有钱人傻?还是当那些给你们付钱的客户傻?除了误导消费者之外,好像也没别的本事了。国王的礼物,国王的礼 物!这个纱线根本定不到,哪怕是比国王的礼物最等的纱线,一公斤都是三千两百八十块打底。一件普通短袖,克重少出一百五到一百八十个差不多。换算下来,一件纱线的成本是一百八乘以三点二八,等于五百九十块, 将近六百。这还是次国王的礼物,一等的沙线,而且还只是单沙线成本,其他工艺辅料、包装运营运费我都没算呢。而且你们也是真法盲来的吗?连 r 标都不认识吗?是受法律保护的呀!而且也只有 l p 本生产的十二微米及以下的羊毛沙线才能叫做国王的礼物。你们到底是老钱还是捞钱?等你们客户真开支明白了,第一个回头干的就是你们。

呃,我昨天发布了关于 cologne 加 deepsea 微四的使用视频,从评论区看下来,感觉大家对 deepsea 微四目前来说还是挺满意的。呃,我也觉得挺不错的,但是我使用下来的时候发现 cc 配上微四啊,它的一个联网搜索能力可能比较差 啊,可能大家对网页搜索要求比较高的话,它内置那个 web search 就 不太够用,所以我们今天的话就给我们的 cloud code 装上我们的 web access 插件,然后这个插件呢,它能让我们的 c c 获得一个联网策略,加上 c d p 浏览操作,加上站点积累啊,经验积累的这个能力。 呃,相当于是他会直接操控你的浏览器去进行网页上面的信息的读取啊,而不是直接去调用 a p i 去调爬虫去爬它东西,因为现在毕竟大公司,他们的那些反爬都是有还是做的挺好的, 用 c d p 浏览器操作的话,能避免一部分的这个呃,爬虫的一些做不到的地方, 但是啊,也有风险的,这个东西如果你是要登录账号才能去,就是实现这个网页上功能的,就是读学啊之类的,你就必须得把你账号登上去,但是如果你把你账号登上去,再用这个 c d b 操作,有概率会封号,所以说大家建议去用小号,但是目前的几个, 比如说 b 站啊,我用下来的话是问题不大的,小红书问题也不大,但是你不能经常爬,不能每天去爬是吧,这样的话很容易被封的,但是如果你们换小号起就无所谓了。 然后这都是前话,我们讲下怎么安装吧,安装方式他提供了四种,然后我们选择第二种方式让 id 自动安装,就是把这段话复制下来, 然后打开你的这个 cloud code, 把这句话复制给他,然后他就会开始帮你安装这个东西。安装的时候他会一直问你要呃 yes, 或者说之后这个东西我都是默认允许你的,然后或者是 no, 然后大家选的时候尽量都去选第一个,不要选第二个,因为你选第二个的时候,相当于是你默认了他这些权限以后,他在这上面安装各种各样东西啊,比如说用 node 安装或 mpm 安装的话, 或者用 get 去读取东西的时候,你把权限都默认给他了,要是别人投毒的话,你很容易榨干。所以说大家建议还是去选第一个 yes 安装,然后每一步你都自己翻译自己看一遍他是安装了什么东西 啊?这个一步步操作下来,然后我们的这个 web 设置就呃 webx 就 安装好了,但是只安装这个是不够的,它后面有一个前置配置,就是要打开你的 c d p 模式,这个时候你得需要有个谷歌浏览器,谷歌浏览器的话大家去网上自己下一下就好了,你能按可拉扣的,你谷歌浏览器基本上也能按下来。 然后我们在谷歌这个网址里面打开这个,把这张网址复制进去打开,然后它会有一个这个选项,把它勾起来, 然后他上面说了可能会重启浏览器,但是我目前过了之后,他没有使用浏览器,但是你可以把它插掉,插掉,然后重新打开就好了, 这个时候你的前条件就已经全部完成了,然后你就可以让你的,你就可以把你的这个卡拉 ok 的 给他关了,就是给他退出,然后我们重启他,重启他,然后确保你这个浏览器打开啊,这个时候你的功能就已经安装完善了,你就可以正常使用了。然后我们怎么看他有没有安装好呢?你输入这个斜杠, 嗯, s k i l s 这边我们就可以看到我们的 web access 已经处于打开的状态,然后我们 e s a 退出,然后这个时候呢,如果你是第一次使用这个 web access 的 话,你需要打一个 web 斜杠, web a c c e s s 然后空格,然后你再告诉他帮我去 查询和 b 站呃,播放量最高的视频啊,这样子他才会去调用这个 web access。 如果你不输这个前缀的话,他是不会调用这个 web access 的, 他直接去用他内置的 web search, 因为他觉得这个 web search 也能完成,就没必要去调用这个 skill 啊。然后我们要怎么做呢?才能让他每一次都去主动的去调用这个 webex 的 skill 呢?然后不管你重启了之后再重新打开也是一样能用的,我们需要告诉呃,你给他说一句话就行。 呃,就是你告诉他你可以以后搜索网页的时候都直接调用 webex skill 吗?然后把它当做这个记忆记录下来,每次我重新打开的时候你也能记住,这样子的话他就会一记录,然后每次联网操作的时候,他都会先调用 webex skill, 然后重新打开对话也能生效 啊,这样子的话问题就不大。之后他如果使用的时候,他都会直接去先优先调用这个呃 skill 去完成, 然后你看我这边是已经调用完了,大家从 b 站今日排行榜给我调取了一个数据,按播放量排序前五把这边排下来,然后他的以后他上面也写了,就是以后所有的联网搜索都会先走 webexes skill, 这样的话你的功能就完善了。然后我们这边实际演示一下它这个是怎么一个运行的方式啊?我们把这段话复制下来,在与忽然间我们就不搜播放量了,我们搜热度最高的吧,热度最高的视频, 然后你把这段话复制给他的时候,他就开始思考,然后开始使用,然后如果你是第一次装上这个 skill, 第一次使用的话,你还需要它,到时候这个谷浏览器这边会弹出一个 呃权限的设置,就是它会让你允许还是拒绝,你点允许之后你就可以看到你的谷歌正在受到这个自动测试软件的控制,然后我们这边看到它已经在调用我们这个点可多 skill 里面的这个技能了,然后我们点 yes, 然后这边可以看到我们的 note 它这边是已经安装好了,然后谷歌也是打开的,然后都是 ok 的, 然后我们这边点击 yes, 然后这边它会告诉你。温馨提示,就是部分站点的浏览器自动化操作比较比较严格,然后存在账号分镜的一个风险啊,这个我刚开始已经跟大家讲过了,呃,看你们自己怎么用吧。然后我们继续点 yes, 然后可以看到我们这边,我们这 bilibili 就 已经打开了啊,然后你这个网页打开就不用管,它已经给你自动点到排行榜里面了,然后它就会查看这个排行榜里的东西,然后我们继续点 yes, 然后稍微等待一会儿,然后我们这边它应该是已经把东西爬出来了,显示 success 成功,然后它会自动把那个 bilibili 给退出去, 然后这边它就把这个热度最高给你拍出来了,视频是这个,然后 up 主是谁?播放量,弹幕互动量 啊,然后这样的话它的一个操作,操作就完成了。然后还有一个问题,就是大家在使用 qq 扣子的时候,因为我们的这个 double v, 呃, double six v 四嘛,它是它的一个外接的大模型,不是它原厂大模型,所以说 qq 它有点机子一样,它基本上是给所有外接大模型都直接射,射死是两百 kb 的 上下。 呃,上下文,然后我们怎么改呢?把它改成 e m 上下文,让我们这个 dp dp 四的能力能最大化呢?就是大家可能配的时候用 c c switch 嘛,如果没有的话,我们可以看一下,在这边搜索 c c s w i t c h c c h, 然后我们找到这个心最多的啊,大家不要找错了,找心最多的五十七点三颗哦,五十七点三 k, 找到它,然后我们点这里有个 c c c h v 三点一,四点一点进来,然后这边的话我们往下滑, 然后大家就按照自己的一个电脑的系统环境,然后去进行一个下载就好了。 windows 的 话下这个就行了, linux 的 话这边都可以啊,我没有下载过。然后 macos 的 话下这个就行,然后等你下载好的时候,你打开 dsp 微四哦,打开这个 c switch, 然后我们就可以配置这个 dsp 微四模型,然后我们先 点击这个出去界面,进来时候点这个,然后我们点加号,然后加号的话是里面你要自己选有这个 dsp, 然后我们这里把你的 a p i 填好,然后这里都填好,这里都填好,然后最主要是这块地方啊,这块地方就是决定我们能不能打开 em 长的上下文,然后给大家看下我这边是怎么配置的。你的主模型要写成这样子, dsp v 四 pro, 然后有个中括号,中间加个 em, 这样的话你才能默认打开你的这个 em 长的上下文, 然后你的所有的这些模型啊,你全部都写的是 deepsea v 四 pro 就 好了,因为现在确实挺便宜的,你点一键设置就好了,一键设置,然后它所有都会改这个,然后确定没有问题了之后,然后你点一下保存啊,就好了, 咳咳,然后这边成功了之后啊,你的这个 deepsea v 四在 color code 里面就有了一个长 e m 上下文,对,这样的话就不用被这个 color code 给限制了。好,今天就到这里吧。

哈喽,今天给大家分享一个微软出品的这个浏览器自动化的一个程序啊,这个程序的话感觉还是挺厉害的,它相当于是实时的启动一个浏览器,然后包括了谷歌的 chrome, 还有火狐,还有个 webkit 啊, 然后这些浏览器的话,你都是可以直接在后台运行,然后让他帮你打开操作的。为什么要说他厉害呢?因为他跟之前的那种爬虫框架不一样啊,他是真实的去模拟 你在浏览器内的一个操作,然后去读取浏览器这个页面上面的所有数据,然后去决定下一步的这个动作啊,就是结合 ai 的 话,你随便打开一个网站,就比如说一些电商平台的,你直接打开了,打开以后你直接让你的 a 键,比如说你是 你说帮我安装这个 play word, 然后你现在进入这个电商网站,帮我查询某些衣服或者饰品或者什么东西的一个销量,包括它的一个价格,帮我把前十的列表都给我列出去,列出来也就输入这么一个简单的指令,然后你过一会你再回来看你的文件夹里面, 他就把这些内容都给你列出来了,有些需要验证的情况,可能需要需要你手动的去帮他过一下验证,其他的他基本上都能帮你完成,特别厉害了啊, 然后这个能帮你做什么事?那真的是太多了,就比如说你想写一个程序的时候,对吧?你现在有些后端数据读不到, 你把它跑一下子,你然后让 ai 帮你找这个网页当中,比如说这个价格搜索这个标签到底是在哪?然后如果我用后端去调用的话,应该使用什么数据,它全部都能帮你跑出来。 然后你如果是想要采集某些网站的一些热点啊,对吧?你还是同样的,你第一次跑的时候,你用 ai 加上这个 play white 帮你把整个流程跑通,整个流程跑通以后,然后你把它写成一个固定化的程序,后期就不需要用 ai, 用你的 token 你 就可以完整的把这个东西给跑通。 我也十指也是接触了比较多的一个项目者,对吧?他搞这些东西的时候,他不去选大众化的市场,不去搞什么 ai 漫剧啊,不去搞什么 ai 小 说啊,去做什么中转站呢?他就 利用这一些工具加上 ai 的 一个优势,帮别人定制化一些行业的热点新闻,或者是其他的一些商业上需要的一些数量比较多的时候,不方便人去找的时候,帮别人定制化这种工具也做到了一些成绩啊。 然后十字这一边的话,目前也是接触到了一些筹融资的渠道,就是如果你有更好的 ai 项目的话,你可以联系十字,十字这边可以给你提供渠道去对接,好吧?然后感谢您的观看,我们下期再见,拜拜。

给 code codex 这类 coding agent 装浏览器技能已经狂揽三千新标。你可以让它去网页上点按钮填表截图抓数据, 简单,页面用 fetch 和 search, 真要交互的再开浏览器跑稳定了还能用 fpx 部署到云端。以前你让 ai 写脚本控制浏览器,现在是让 ai 自己进浏览器干活。 如果你的流程卡在登录表单网页抓取 q a 测试,赶紧蹲一下,别只让 ai 看代码,给他一台浏览器。

大家好,今天再给大家分享一个好用的工具叫 browser honeys, 它是目前 ai 操控浏览器最省 token 的 一种方式,它非常的简洁,只有五百九十二行的 python 代码,然后上线三周已经突破了一万的 star, 呃, token 是 比以前的方式能省很多的 呃,目前我们 ai 操控浏览器一共有五条路径,一个是呃 cloud in chrome, 就是 我们平时用的比较多的一个 cloud 的 插件。然后第二个是 computer use, 就是 相当于你把 cloud 交给了呃的电脑,交给了 cloud, 让它去控制这个整整个电脑,但这种方式非常消耗托管,因为它需要截屏确定位置在哪 啊?第三种是 zenium, 这种是传统的方式我就不说了啊。第四个是 pre write mcp, 这是目前像那个 brother u, 呃,那个 use 啊,用的这个框架, 然后 brothers use 他 们现在开发出的 brother hannis, 这个是 c d p 直连的啊,为 ai 造的工具,这个是我们今天要重点介绍的,就前四个呢,它有各自的局限性。然后第五个就是专门给 ai 量身定做的啊,下面我给大家拆解一下。就是它的呃,架构呢,是 quad code 的 呃, 通过 c i 命令行,然后把这个命令发给了 d m, 然后 d m 再通过 c d p 的 web socket, 然后再到你的框,就就非常的简单简洁。它一共就四个核心文件,目前迭代了几个版本,它的命令的代码还是小于九百行的 啊,非常的非常的少,非常的简洁动,不像那些几万行的比起来还是简洁很多的。而且它是直接附用你的 cookies, 还有登录状态,所以能直接操控你的浏览器 啊,他本身还设计了一个叫自愈架构的,他有个 agent helps 啊,他开箱呢,就是你刚装完是空白的,你的 agent 通过各种各样的浏览器执行之后,碰到了一些问题他会解决,解决完之后他就会记录进去,相当于是一个自我迭代跟循环的。 然后仓库本身呢,就是你下下来之后,他已经有了几十个网站的这个操作的经验,就是你的 agent 用的时候就能直接去读取这些经验, 然后这样你一直用下去,它就有一个啊, feedback, feedback, loop, 然后正反馈的循环啊,就形成一个经验的,就是操作浏览器的一个经验的自动沉淀,因为每个网站的它的这个操作的方式可能有些细微的差别, 你怎么怎么去决策用不用这个软件呢?是,首先要看是这么判断的,首先要看你这个网站有没有专用的 m c p。 呃,你像 github, notion, slake 这些是有直接专用的 m c m c p 的, 就相当于它有 ipad 接口,你就根本就不要碰浏览器,你就去找他们接就好了, 通过那 mini 上去接就好了,这个就浏览器根本就用不着。那如果说你要开浏览器,那传统的现在用的可能多一点的就是 playwrite 的 mcp 啊。然后现在我建议你们大家都转成这个 bardeen, 因为它真的很省头,肯啊,非常的好用。 呃,反正大部分场景下 broderhanys 是 性价比最高的路线。呃,然后我我通过这个方式啊,我封装了一个技能,它这个技能的用处是什么呢?就是我们平时用这个追美版 a p i 不是 很贵吗?然后我用这个浏览器的技能接了呃追美版的订阅版, 就是它通过控制浏览器,然后打开 jimmy 订阅版的 jimmy, 然后输入这个提示词,然后就会自动把这个图片生成了,然后下载到呃项目的文件夹里,就这一套下来,你升图片相当于你就可以把额度用呃 jimmy 的 额度用满,就不用花这个 api 的 投肯了, 从投肯的消耗相比的话,大概比 content 柚子能省很多省省个八八倍左右。 呃,我的分享就到这里,然后我接下来会放一下我用这个呃 opus 四点六,然后控制我命令它,然后去生成图片,它自动调取我的技能 去呃生成那张图片并保存下来的过程。大家有兴趣可以接着往下看一看啊,欢迎大家关注今天我的介绍,先到这里,谢谢大家。

让 ar 直接接管你的 chrome, 分享一个 github 十一十一 kstar 的 热门项目,自从 chrome 推出了那个 mcp 的 这个支持 mcp 以后,这个项目项目是做了什么呢?就是说它接管它,通过 mcp 的 这个协议连接那个 chrome, 然后它可以操作你的网页的所有的元素到某位置,坐标,还有画布。那这个怎么用呢?说你用这个它这个 mcp 服务吧,你本机启动这个服务, 然后通过它来与可重复进行连接。你本地要装现在所有的 ai 那 种桌面端,比如说是 cloud code x, 还有其他的只要是大模型的客户端都可以。 然后具体的操作流程就是说你用模型发一句话,比如说用在那个 excel 里边帮我画当前网页的所有信息,总结成画一个流程图, 它会请求做 m c p 服务,然后再连接 chrome, 它就可以获取 chrome 网页的所有信息,直接就可以操纵网页的盗版元素,直接画这个东西。但有人会问,可能这个跟那个 cloud 电脑操作有什么区别? cloud 那 个电脑版的,它操作电脑是它直接模拟人的鼠标的剪辑操作, 这很慢的。你想你如果用 collab 桌面板去控制你的电脑,然后在浏览器里,在那个 excel 里画一个流程图,这些过程是很慢很卡的。但是如果直接可以获取当前网页的所有 dom 信息,能直接操纵 dom 信息,速度是非常快的。 让大家向我做了一个说明,它支持很多功能,因为你可以发挥一下想象空间。如果你的模型可以操作了你的 kol 网页的所有的 dom 元素,位置坐标,这些信息 就可以很多有脑洞的一些想法去做,因为他自己举了一些你支持的一些例子,比如说你看他这个,我觉得这个最大的优势就是说你就是画画,我觉得是做的最重要的,比如说你要是做自媒体做什么的,你比如说他这个例子说 总结网页内内容,用那个 s k two 照画图,能给你演示一下,还是很强的,完全就是操,直接操纵画布,不是模仿鼠标的人的这种操作去画, 而是直接操纵这个盗墓元素,直接在画布上直接操作他的网页元素来画。二,他还可以支持,比如说你一张图片让模型去理解这张图片,然后在那个 excel 里面去去模仿张图片去画。比如说你在网上看到一张流程图,别人画的这种架构图很好, 你可以直接把这张架构图片发给 ar, 然后让 ar 去理解这张图片内容,去模仿一张相似的,这很强。但是有人会觉得这个可不可以作为那个自媒体的运营去发那个小红书或者抖音这种东西, 我觉得这个还是不太好的,它比那个你要拷到电脑操作,控制电脑那种行为就是更危险一点,因为那个控制电脑的那种操作,它是模仿人的这种鼠标点滴。如果你用 cp 这种方式去发起它,相当直接去请求那个 pos, 请求这个相当就是一个机械性的操作,还是挺危险的。