做视频附件上传,谁没分过几个 g 的 文件,传半天断了还得重传一分钟。讲三步,优化成功率直接拉满。一是封面上传,把大文件切成一百 kb 的 小分片,挨个传不怕断。二是断点续传,用 reds 记已上传的分片,断了之后只传没完成的不用重传成分。 三是后端自动合并所有封面,传完后端直接合并成原文件。这里边分片大小有讲究,太小了请求次数太多,太大了又容易失败。我们测下来, emb 到 emb 是 个甜点区间,合并文件时最好用一步,别堵塞用户操作。 这种文件处理的优化经验是提升产品体验的关键。我把自己做过的十多个包含此类难题的独家真实项目原码和试题思路都打包好了,粉丝群找老樊拿回去就能写尽解密。 我做视频上传,用这个方法, e g b 文件上传成功率从百分之六十升到百分之九十九,避坑点分片一定要加胶原码,防止分片损坏,文件废了。你做过大文件上传吗?评论区说说。
粉丝1986获赞1.4万

别折腾了,就在大家还熬着通宵搞 opencll 本地部署的时候, open i 发布的 gpt 五点四走了另一条路,不靠外部框架,直接在模型层把会思考和能操作合在一起。计算机操控, 这次不是说说而已。 gpt 五点四可以通过读取屏幕截图,直接模拟鼠标点击和键盘输入,还能跨应用切换。 你说一句,把邮件附件整理成 excel 上传到公司系统,它自己开软件找按钮、录数据,不需要你提前配置任何集成。在 os word verify 的 桌面操作机准测试中, gpt 五点四的成功率是百分之七十五, 人类机准是百分之七十二点四,而 gpt 五点二还停留在百分之四十七点三之前。大家普遍认为 ai 操作电脑仍处于 demo 阶段, 这次算是真正迈过了一个门槛,办公能力有实际提升。不只是跑分好看, open ai 用 gdp 报基准跑了四十四个职业类别, gpt 五点四在百分之八十三的项目上达到或超过行业专业水平, gpt 五点二的这个数字是百分之七十点九。在模拟同行初级分析师的 excel 建模任务上, gpt 五点四得分百分之八十七点五, gpt 五点二是百分之六十八点四。不过跑分领先是跑分领先。 marco apex agents 榜单显示,目前最好的模型在长流程专业任务中仍只有约百分之二十五的一次性完成率,距离完全接管复杂工作还有距离,理性看待比较好 效率和成本,这次是实打实省下来的。新增的 to search 功能改成按需加载工具定义,在内部测试中, token 消耗减少了百分之四十七,对频繁调用 api 的 用户是直接影响账单的改进 api 版本支持最高一百万 token, 上下文超过二十七点二万 token 后计费翻倍。用之前先算一下成本。 准确率方面,单条声明出错概率比 gpt 五点二降低百分之三十三,整体出错率降低百分之十八。编程和推理整合更紧密了。 gpt 五点四把 gpt 五三 codex 的 编程能力引入主线模型,可以边写网页应用边实时调试。 chad gpt 新增的 思维预览也挺实用,复杂任务先列思路框架,你觉得方向不对可以直接进入调整,省去反复修改的麻烦。 chat gpt 的 plus、 team 和 pro 用户今天起可以直接用 gpt 五点四 thinking 版本,开发者可通过 api 调用, 输入单价从一美元七十五美分涨到二美元五十美分,输出从十四美元涨到十五美元。 但 token 效率提升后,实际总花费不一定变多。 open claw 证明了大家需要能干活的 ai。 gpt 五点四给出的是另一个答案,原生集成开箱即用,用币源换稳定性。两条路没有高低之分,只是面向不同的人。 那么你是准备直接给奥特曼交保护费,还是继续在本地折腾开源呢?欢迎在评论区聊聊。

你如果只把 codex 当成一个会写代码的 c o i, 那 它再强也只是个工具。真正拉开差距的,不是今天多会调一个命令,而是你能不能把它改造成一个会持续修正自己的系统。 这套东西不是某个特定产品的专属能力,本质上是一种工程架构, codex 也完全可以接住。所以今天这期我不先聊功能清单,而是先带你搭一套四层自动化系统,再讲它怎么落在 codex 里。 默认状态下的 codex 很 强,但他天然还是一轮一轮的帮你做事,不会自动把经验沉淀成稳定行为。 你纠正一次,他当下会改,可如果规则没被写下来,没被验证、没被复盘,下次换个任务还是可能重新犯一遍。所以问题从来不只是模型够不够聪明,而是你的项目有没有一套能让他持续收敛的方法。层 自进化系统要解决的就是把零散的纠正经验和约束,变成下一次还能自动生效的工程资产。 如果把自进化系统拆开看,最稳的方式不是堆功能,而是先搭四层,认知、核心路径、规则、 sub agent、 分 工、记忆、循环。 第一层负责定义这套系统到底要变成什么,第二层负责让不同路径各守边界,第三层负责角色协助,第四层负责把经验沉淀下来。你可以把它理解成一台能学习的工程机器,上层管方向,中层管约束,执行,层管协助,底层管长期记忆。 只有四层一起成立, codex 才会从一个临场执行器,变成一个越用越稳的工作系统。 第一层叫认知核心作用是把这套系统的方向写清楚,让 codex 每次进入项目时都先知道自己在服务什么目标。 这层最直接的落点就是 agent 点。 md 里面不只是放命令清单,而是放原则、边界、完成标准,以及遇到复杂任务时的思考顺序。 如果你不先把认知核心写出来,后面的 rules、 sub agent 和 memory 都会变成漂浮在空中的局部补丁。所以第一层不是技巧,而是系统宪法,它先决定 codex 以后会长成什么样。 第二层是路径作用域规则,它解决的问题是不同目录、不同任务、不同风险等级,应该触发不同的约束,而不是一把尺子量所有场景。在 codex 里,这层可以落到 rules、 hooks、 skills 这些能力上,让某些规范指在某些路径生效,避免上下文又厚又乱。 比如安全规则只在认证和接口层激活,性能规则只在数据库热路径激活,复盘流程则通过 hook 在 关键时刻自动提醒。路径规则的意义是让 codex 不是 背一整本规则书,而是在对的地方拿到对的约束。 第三层是专用 sub agent 的 分工,自动化系统如果一直只让一个主智能体兼顾所有角色,最后很容易变成记忆和职责都混在一起。更稳的做法是把规划、验证、审查、采集这些角色拆给不同的 sub agent, 让每个角色只在自己的边界内积累经验。 这样做的好处不是看起来高级,而是上下文干净,职责更清楚。后面要升级某个角色时,也不用把整套系统一起重做。 sabotage 分 工的本质是把进化拆成多个可维护的小系统,而不是堆在一个总入口里硬记忆。 第四层是记忆与进化循环,它真正回答的是你纠正 codex 一 次之后,这条经验到底怎么活到下一次。如果纠正观察已学规则和演化日制只是随口说说,那它们不会形成系统,只有被写进文件,被定期复盘,才会开始真正积累。 所以这层不神秘,就是把 corrections, observations, learn, rules, evolution log 这几位信息组织成闭环。 自净化的关键不在于会不会自动学习,而在于你有没有把学习结果保存成下次还能继续用的结构。讲到这里,你会发现四层架构并不是悬空的, codex 已经有足够多的原生能力能把这套方法一层层接住。 认知核心落到 agent, 路径规则落到 rules、 hooks、 skills, 角色分工落到 sub agent, 工具边界和外部能力则落到 m c p。 真正要你自己补的,是第四层,记忆循环,把纠正记录、观察记录、以学规则和演化日制这套方法层建起来。所以这套事不是照搬某个产品,而是把 collex 已有能力和你自己补的记忆层拼成一套完整系统。 如果你是第一次搭这种系统,别一上来就做满配,先做一个最小目录结构,把四层都落进去就够了。一个能跑的起点其实很简单,跟目录放 agents 点, md, 下面分 rules, skills, memory, 再留一个 sub agent 目录,专门放角色。 这样做的好处是,你不用先把所有能力都塞满,也能先让 codex 从一套有边界、有记忆、有复盘的结构里工作。对新手来说,先把目录搭对比,先研究一堆高级命令更重要,因为后者很快就会忘,前者会直接影响每天的写作方式。 不是每个人都需要给 codex 上这套自进化系统,关键看你是不是已经进入了重复纠错和长期写作阶段。 如果你现在只是偶尔写点小脚本,那默认状态已经够用。但如果你已经开始长期跑项目,多人协助反复复盘,这套方法就很值钱。 它最大的收益不是让今天更炫,而是让下个月的 codex 比今天更稳,少犯你已经纠正过的那些低级错误。所以值不值得搭,看的是你要不要让经验开始复利,而不是看你今天想不想试一个新玩法。 总结一句, codex 要不要变成自动化系统,不取决于某个神秘开关,而取决于你愿不愿意把四层结构真正搭起来。 当认知、核心路径、规则、 subagent 分 工和记忆循环都落下去之后, codex 才会真正开始越用越稳。所以别急着找捷径,先把这四层写出来,你会发现,真正会进化的从来不是 cli 本身,而是你的工程系统。

好,大家好,我是小刘。呃,今天我们来看一下那个 codex 这一次最新的更新哦,那我讲一下我自己使用 codex 的 一些技巧,希望能够对你有所启发。那首先呢,我觉得 codex 当中所有功能当中最好用的一个功能就是这个自动化,没有之一。真的,这个基本上它能帮你完成所有的事情。比如说像我们家每天呃,基本上每周吧就要换一桶蒸馏水,这个时候我就可以跟那个呃帮我创建一个自动化任务。 然后呢,这个时候呢就直接艾特 composer 柚子,他会自动在微信列表找到送水的小王,跟他说家里没水,让他送水过来,晚上我看了消息之后给他转钱,这时候呢,他会自动去运行。注意这里呢,你要选择最低的模型,因为这个任务他很简单,并不需要使用很复杂的模型, 所以就是说,呃,你可以测试一下。那没问题呢,他会自动在你的微信列表里面找到小王,跟他发这个消息,甚至你还可以每天早上让他给你老婆发消息,或者给你老公发消息,非常简单。 这里记得开启这个防止休眠的开关。那尤其他最近更新了一个挺有意思的功能,叫做,嗯,就是这个浏览器使用,也就说你可以完成京东的打卡,淘宝的打卡,还有一些其他的操作。那这里呢,你可以给他始终而允许,然后这样的话,他在电脑上去审批一些文件的时候,你甚至可以给他 呃做任何你能够想不到的事情,比如说登录学校官网去帮我刷课,刷网课他都可以做到,真的很神奇一个点,这是我觉得最好用的 一个功能,自动化,那绝经、打卡送水都是一些小例子,大家可以以此发挥,对吧?比如说每天给谁谁谁发消息,那都可以让他去做到。那我们来看一下这一次更新的一些我觉得不错的功能嘛,就是首先比如说我让他帮我搜索这个最火的博主,你看他手里到这个列表,然后 排了排序了一下,就这一个,就这一个命令,哦,我用五点五模型,然后他跑完之后,你猜用了多少? 他用了接近百分之二十,因为我刚又多问了一个问题,我用完的时候还是百分之八十三,你看就问了这一个问题,他是百分之八十三啊,对吧?非常的恐怖,这个五点五模型消耗了一个速度,而且我还是 plus, 这个 plus, 这个这个 啊角色,你看他消耗这么多,也就说你一个 plus 用户每五小时你只能大概问啊五六个这样的问题,所以就是我觉得还是用 token 比较节省的话,是五点四比较好一点,对吧? 这里呢再给大家分享两个插件,我用的比较多的就是这个 codex history, 然后同步的这么一个工具。这个开始工具呢,主要就是可以帮助你把你的这个账号之间隔离的这种数据呢,给它全部都放在一个账号上来, 非常的 nice。 因为大家发现没有,就我们在使用 codex 的 时候,你的这个记录啊,老是消失,哎,突然突然就不见了,尤其是你换了多个账号之后,之前的记录更是找不到了,但是这些记录呢, 一直没有消失,全部都存在你本地的这种数据库里面,就是个 circle net, 就是 codex 存存入数据的地方,就这玩意它需要你自己手动去把它给它同步到一个地方,就可以使用这个工具,它可以帮你把这个账号 全部放到一个上面去。那 windows 的 话是可以使用这一个开美项目,还有个 mac, mac 的 话使用这个开美项目就隔离一下吧,大家可以自行看一下,那两个项目都是一样的,你看还是基于它听,嗯, 公开的,它补充了 mac 的 这个版本,相当于这两个工具,可以帮助你解决这种数据不统一的问题。那非常简单,使用起来,你直接把它下到本地,然后你你你安装个图形界面,创建快捷方式,你执行一下就好了,非常非常简单。你其实不知道怎么操作,你就复制它一下,然后你新建一个选项,好吧?新建一个选项,你直接问他,对吧?你直接问他啊,请你帮我就是,哎,把这个插件安装到本地并帮我启动,就这么简单一件事,好吧。 然后就是这个插件,这里这一次又加了几个小的功能,就是这个,我给大家按一下艾特符号,看到没有?支持 word 文档读取,还有表格读取,还有 ppt 读取,之前还是不支持的,他可能依赖一些外部第三方的 skills, 但是那样读取并不是很好,但是他出了这个官方的 skills 就 不一样了,你读取出来的结果一定是非常的 nice 的, 非常的匹配的。就你有任何的 word 文档, ppt, 你 都可以教给他,或者论文之类的, 非常适合做学术研究啊,就是我觉得,呃,这几个比较好的,但这次它去掉了就只有两 两个核心,一个自定义。那系统第一个讲起这个默认,很多人没搞懂什么叫默认啊?就是说 codex 在 沙河中自动运行这个命令的时候,他会默认的去向你进行询问,哎,他觉得这个权限风险哎,蛮高的。那就向你去询问,他可以什么 问题都问你一下,就是跟你进行交互,这个自动审查,他会在沙箱中自动运行这个命令。啥意思啊?就是我运行这个命令的时候,我会在一个虚拟的环境中运行一遍,哎,我觉得他有风险,我再给你询问,哎,可能是问的不怎么明白。自定义 就说你把你所有这个权限,你全部打开这个设置,这个设置,你点设置,这边有一个叫做啊这个权限的这个配置,你看这个这个用户配置,这玩意你得打开,你看他会对每一个每一个项目你使用什么模型,对吧?啊?使用了这个什么什么啊? 比如说,哎,我对某一个插件是否允许它开启 compile use, 你 看开启现在开启状态对不对?我可以把它关掉,飞个马插件,你看就你把这个配置可以把它找成一个文件,你可以发给你的朋友,让你的朋友用到这个文件,但是注意一定要把这个路径给他改成一样的啊, 对吧?这是一个好点,就用户配置嘛,对吧?我们说了啊,这个不同权限,其他的我之前都讲过,那就没什么好说的,个性化这里我觉得这个有点啰嗦,所以我用了这样一个自定义指定,我觉得挺好用的。 然后,呃,还有一个点就是我建议大家不要什么都开这个记忆,这个记忆很容易造成某种,如果说你是做某一类的需求,那你可以把它开起来,不然就会造成噪音啊,这个噪音就是会干扰你那个那个啥,你可以自己去把你的记忆进行处理一下,我觉得挺好用的。对, 还有就是那就刚我们说的这个浏览器这里,浏览器这里呢?这个我们刚说,对吧?你可以选择屏蔽一些网址,就你屏蔽的这个网址呢?就他在 open source 运行的时候不会给你打开啊,当然非常的 nice。 好, 那我们再来看一下,就是,呃,这个五点五模型真的非常的消耗,消耗头坑 plus 用户一天只能够五到六次,对吧?所以呢真的适合这个,这个 真的不太适合,就是用来做打卡之类的相关的东西。好吧,好了,呃,那以上就是本期视频的全部流呢,我是小刘,我们下期再见。

明明服务器贷款很充足,很一月的大文件没法下载速度就死活上不去,你的文件传输为什么这么慢?其实拖后腿的根本不是网速,而是系统底层在做大量无用的数据复制。今天只有三分钟,带你搞懂后端高变化必用的神迹零拷贝。传统方案最大的性能黑洞就是这极其昂贵的四次拷贝和四次上下文切换 操作系统最上层是用户态,咱们写的业务代码,我们的内存都在这儿,往下有一道严格的安全边界线,每次跨越它,系统都要强行打断,当前工作开销极大。包括边界就是权限极高的内核态。 当用户下载文件时,数据先从硬盘被读进内核的读取缓冲区,这是第一次数据复制,复制页就是最坑的一部, cpu 得亲自下场把数据从内核复制到用户态,然后再原封不动的复制回内核的后几次缓冲区。 这两次全靠 cpu 存火力执行,白白浪费算力,最后数据才进入网卡发出去。作为这套流程,你觉得高倍法打过来是硬把型扛不住,还是 cpu 先累死?显然 cpu 会被这种无意的复制直接脱空。动不动的痛点,咱们看看怎么把这道边界砸开。 第一招叫 mmap 内存映射,这个首先思路就是打破边界,让内核缓冲区和用户缓冲区也就共享同一块物理内存。 有了这块共享内存,数据流向就变了,用户代码可以直接在这个内存里修改数据,这在需要对数据做加密压缩在发送的场景下非常实在。虽然省的一次复制,但数据要发到网卡,依然需要 cpu 把它弄到套接处缓冲区,而且四周上下文切换一次没少, 这种半层面的优化还不够极致,咱们直接上大招,终极形态来了,两次拷贝,零次 cpu 拷贝,这就是 sendmail 配合硬件底层的威力。在这个模式下,数据流转压根就不去,用户太溜达了, 彻底绕开最上层,因为不来回折腾了,上下文切换直接砍版降到了两次,所有活都在内核太闭环。数据先通过底层硬件,从磁盘到内核缓冲区,接下来是神奈治比,是拷贝描述符, 系统不再复制沉重的数据本身,而是传一张写着数据位置和长度的提货单。最后王卡拿着这张提货单,直接去缓冲区,把真实数据拉走, 数据完美绕过了中间的层层羁绊,一路绿灯。这时候 c p u 在 干嘛?完全闲着可以去处理真正的业务逻辑,如果让你写个静态文件下载服务,直接用这套方案,是不是能把机器性能榨干? 没错,原理通了,咱们看看大厂是怎么抄作业的。而消息队列一哥卡布卡来说,他就把这两招玩出了花。最需要频繁查找的所有文件,卡布卡原本 mac 硬核的内存查起来飞快,而对于海量的消息体文件, 因为不需要修改,直接用 sendfile 拷贝怼到网口发走。再看网络框架 lady 那 系统底层,它完美封钻了。刚才说的 sendfile, 更觉得是应用层操作,它通过直接内存绕开接纳垃圾回收的折磨,又通过逻辑合并,实现了内存层面的拷贝。 看完了满分作业,是不是觉得无脑用 sendfile 就 行了,即使遇到某种极端情况,知道会变成灾难。前面说的 sendfile 极其依赖操作系统的页缓存,要是你拿它传几个 g 的 超大视频文件,我们就开始了。 一超大文件会瞬间把有限的缓存词撑爆,把别人高频访问的热点数据全部挤走。第二,大文件传一次很少立马再传,忘记缓存纯属浪费空间,最后就会导致其他业务疯狂触发缺页中断, 字盘读取直接卡死。面对这种大文件场景,破局思路就四个字,直接读写。首先动作就是彻底绕开页缓存数据从词盘出来根本不见缓存词, 也就是用 evio 配合直接 i o 的 寄宿站。结合刚才的对比,你觉得做海量小图片风发是用这种绕开缓存的方案还是常规的 send file? 其实小文件极度依赖缓存,用 send file 才是王道,大文件才需要绕开。

codex 是 我过去几个月用的最多的 ai 工具之一,我用它做研究、写文档、做 ppt、 考选择题、 vip coding、 网页整理笔记。今天这个视频,想开启一个 codex 系列,做一个 codex 新手完全指南,第一期就用三分钟的时间讲清楚基础 codex 是 什么,它能用来做什么,下载安装到哪里,打开以后界面怎么看,以及项目聊天文件这几个概念到底怎么理解。很多人一听 codex, 第一反应是这是一个写代码的工具。这个理解没错,但只理解了一半。 现在的 codex 更像一个 ai agent 工作台,它把 coding、 写作浏览器、文件、 computer use 这些能力放到了同一个界面里, 所以你可以把它当成一个能干活的工作空间。你可以直接给他一个项目文件夹,让他围着真实文件持续工作。比如让他读一个项目结构,生成一份功能表格,改一个网页,整理一份文档,分析一段长视频、逐字稿,或者同时开几个任务并行处理。这也是 codex 和普通聊天工具最大的差别。 普通聊天工具更像一个对话框, codex 更像一个可以管理项目聊天和文件的工作台。如果你是第一次用,第一步就是先下载 codex app。 你 可以搜索 codex app, 找到 openai 官方的桌面端下载安装到电脑上,装好以后打开它,第一眼看起来其实很像叉 gpt, 中间是输入框,你可以直接和它对话。左边是侧边栏, 用来管理项目和聊天,但它和叉 g p d 不 一样的地方就在于左边这些结构。新手第一期只需要先搞懂三个东西,项目、聊天文件。先说项目,项目可以理解成一个工作区,你要让 codex 围着哪个文件夹干活,就先创建一个项目。比如你可以建一个文件夹, codex 项目, codex 后面生成的文件表格、文档、代码都会跟着这个项目走,所以项目的意义就是让你的 ai 工作不要散。第二个是聊天,聊天就是一个具体任务,比如你在同一个项目里,可以开一个聊天问,帮我整理 codex app 的 功能,再开另一个聊天问,帮我看看大家对 codex app 的 评价。这两个聊天可以属于同一个项目, 但它们处理的是不同任务。更重要的是,这些聊天可以同时跑,一个在做研究,一个在整理表格,一个在改文档,这就是 codex 很 重要的一个能力,多任务并行,你不用一直等一个 ai 聊天结束, 再开始下一个任务。第三个是文件, codex 的 重点也不只是回复它,还会生成文件。比如你让它整理功能列表,它可以生成一个 spreadsheet, 你 让它写总结,它可以生成 markdown, 你 让它改项目里的代码文件。所以用 codex 的 时候,你要养成一个习惯, 每次任务结束,都让它告诉你它生成了哪些文件,改了哪些文件,文件放在哪里,下一步应该怎么检查。举个最简单的入门流程,让 codex 搜索并整理一个主题。比如请帮我整理 codex 桌面端的核心功能,并做成一份表格,它会开始搜索、整理、生成结果。这 就是 codex app 很 值得理解的一点,它是围绕真实文件工作的,这时候 codex 已经超出了写代码工具的范畴,它变成了一个可以帮你管理工作流的 ai 工作台。 所以第一期你先记住这几个点就够了。 codex 是 open ai 的 ai agent 工作台,它可以写代码,也可以做研究文档表格设计网页和内容整理。先学会创建项目,在项目里开聊天,再看它生成和修改的文件。这三个概念理解了后面再学 plugin skills, automation, computer use 就 会顺很多。

好的,我们今天给大家带来的是 codex 的 完整教程,那 codex 呢?是 openai 的 一款编程工具,很多人看到编程就已经被劝退了啊,但是不用担心,我们今天这个视频呢就会教给你,因为我自己其实也不会写代码,但它却是我近期使用最多的 ai 产品,甚至让我觉得自己变得厉害了很多。 首先我们来讲一下它跟一般的 ai 产品有什么区别,那它最核心的区别呢?就是能够控制你的电脑去完成很多的任务,这里面有一些关键原因我没有办法在视频里面说,我就放在评论区了,你们可以看一下和其他工具主要的区别是其他工具更像是助手,它会告诉你去怎么做,但你实际还是要你自己做, 但 codex 他 知道怎么做,他告诉你他会怎么做,然后他就自己把它给做掉。那所以今天这个视频呢,我们会分成四个部分,首先我们会讲一下这个工具在哪里去使用。第二呢,我们去讲整个产品的界面跟功能都有哪些,哪些是需要重点需要知道的。然后是我们作为 没有技术背景同学,该怎么样去跟 codex 沟通跟交流。最后就是整个场景,我会带大家一起去尝试做几个场景,如果看完这个视频你真的去尝试去做了,那我的这个视频目标就达成了。首先我们先说一下去哪里使用,如果你已经是下载 gbt 的 用户的话,我们就来到下载 gbt, 然后在它的左侧去点击 codex, 进入到这个页面之后,我们选择中间的版本,或者你也可以直接谷歌搜索 codex, 在 第一个网站里去点击这个页面,进入后下载到对应你电脑的版本。 在一开始呢,他可能会需要你去创建一个文件夹,那这边呢,我们直接在桌面上创建一个以你名字的文件夹就可以了。好的,然后我们来讲一下它的界面和它的功能,从大体上来看,其实它的整个产品界面跟我们一般用的 ai 工具还是很像的。 在左侧是往期的聊天历史跟部分的功能,右侧是 ai 沟通的工作界面。那什么是项目跟现成呢? projects and thread, 那 这是两个基础的变身概念,你可以把项目理解成是一个大的文件夹,现成理解成一次次的对话, 就跟一般的 ai 产品一样,就每一次我们聊天的内容,就好比是一个新的县城啊,那假设以做网站为例,那这个时候呢,我们就开了一个新的项目,这个项目就叫做网站。那在这个网站的文件夹里,它的县城可能是什么?可能就是 像首页啊,产品页,关于我们这些不同的页面,我们把它分开来,它就是不同的县城。你只需要理解说不同的项目,你要建新的文件夹,在那个文件夹里面去针对性的做不同的任务。在右侧底部 这边就是跟 ai 沟通的地方啊,这边可以上传照片文件,选择对应的模型,我们这边默认去选择 gbt。 五点四推理的强度的话,就按照中来执行。那特别复杂的项目,比如说 app 啊,或者说一些后端的产品,你可以在 啊网上选,但也要注意,就你的 token 的 消耗也会对应的提高下方的本地,它代表的是它会在 你的电脑上运行啊,然后就是权限,那我这边是建议全部打开,这样他就可以完整的去操控你的电脑。那在这个县城里面右下角会显示背景信息的窗口,也就是上下文的记忆,就你可以把它理解为每一个窗口 他能记住多少你聊过的东西,那如果这边显示了百分之三十六的记忆,那剩下的百分之六十四 就是他还能记住的部分,那当你持续在这个窗口去聊天,他会把这些记忆进行压缩,所以你还能继续聊,只不过记忆不会像之前的一样准确, 所以还是建议大家不同的任务开启不同的县城去处理。我们这边不会具体去讲 skills 跟自动化很多篇代码部分的,大家可以先不用看,它并不会影响你的正常使用。在讲完了大致的功能跟界面之后呢,我们再来说一下使用 codex, 尤其是非技术同学你需要注意的点。 呃,首先就是 codex, 它更多是用来执行的,它不是用来聊天的。其次就是在这个产品当中,你给的信息越清楚,它的执行会越准确。最后就是尽量去在它执行完之后去问一下它,你到底改了什么这种方式呢?就可以来判断 它的一个逻辑,然后可以更好的去让它工作。那在使用 codex 的 时候呢,你会经常看到这种指令叫 run 什么什么什么? 它是什么意思?它就是一个简单的终端指令,它指的是 codex 正在用你的电脑进行操作,完成他想要的任务。 终端是什么呢?你可以把它理解为是一个代码在跟你电脑沟通的一种方式,那平时我们用电脑其实都是用图形交互,就比如说我在用鼠标啊,在滑,在点击,但其实在电脑之间,它是可以用代码的形式更快的沟通,但只不过我们不会,那现在就相当于 你可以用大白话去跟 codex 沟通,而 codex 直接通过代码语言和你的电脑进行交互。那最后呢,我们再来看几个实际的案例,大家手把手的一起来操作一下。首先在开始之前呢,我们先确认一下你已经创建了一个文件夹 啊,然后打开一个新的县城啊,在这个文件夹的框的下方呢,我们去把这个权限给全部打开,将模型切换到五点四,我们的第一个场景就是让 codex 去全面的检查一下你电脑的性能啊,看看有什么地方可以优化的。 直接在对话框里输入,帮我全面检查电脑的性能,看一下有没有什么优化的地方。你在自己做这个案例的时候,重点可以关注一下 codex 是 怎么执行的,并且一步步的分析你电脑性能, 然后呢,你让他去进一步的帮你完成这个操作。第二个场景呢,就是我们让 codex 直接去帮我们整理一下桌面啊,因为现在的桌面全是各种视频啊,图片还有文件夹,那我希望他可以把视频归类到一起,然后图片也归类,我们就直接在对话框输入, 帮我整理桌面,因为现在太乱了啊,把不同的文件进行归类。最后一个场景就是如果我们看了上一期的教程,就是我们谷歌 stitch, 你 可以看一下这是做讲怎么做网站跟做交互的,那我们现在呢就直接让 codex 把这个页面给做出来 啊,直接先来到 stitch 的 这个页面,然后把我们这个首页的代码给复制,然后回到 codex, 把代码粘贴给他,让他把这个前端的页面给直接做出来, 然后这边就是它生成的一个前端页面,是完全根据我们的设计稿来做的。然后还有一种做法呢,就是你可以再一次的把 stitch 里面的设计文件去导入到 figma, 然后在 figma 里面做最后的调整,之后再导出 把这个链接给到 codex, 就 codex 可能会更加的喜欢用这种方式,直接用 figma 的 链接啊,做出来的效果也是一样的。那今天呢,我们就完整的过了一下整个 codex 的 使用方式,那不出意外他们会在近期做一次更加大的更新, 到那个时候呢,我会再去补充一次教程。还没有关注同学记得点赞关注。还有就是大家有什么好的反馈跟需求也可以跟我提,我是瑞哥,那我们下一期再见,拜拜。

今天给大家讲一下,为什么这个 code 在 别人手上就很好用,到你手上就不好用了?首先我们这个需要调整的,就这样,我们会给他一个全局的项目文档,我们执行任务用来 的一些规范,然后的话它会在项目里边,它会有项目文档、 项目记忆,然后还有项目执行的流程,每个项目就算每次切换别的平台的 a p i 也可以无缝的 衔接我们的任务流程这边都有执行到哪一步需要避坑什么的,还是挺好用的。

很多人用 codex 最大的问题不是不会写提示词,而是场景一变,整个人就乱了。做代码审查一套方式,写杂活又一套方式,改 bug 再一套方式,每次都手动切模型切权限切,审批效率特别低。 我现在基本不这么干了,直接把不同任务做成不同 profile。 比如一个是 deep review, 专门高推理加严格审批,一个是 quick, 专门干杂活和快速修改,启动的时候一键切换,整个工作流马上进入对应状态。你看这一屏,任务一变 profile, 一 切模型全线审批一起变。 重点来了,高手不是每次都重新配置,而是提前把场景固化成规则。以前你是自己适应工具,现在你是让工具自动适应场景。不是你不会切任务,而是你没有把常用工作流先沉淀下来。

现在如果说让我给大家去推荐一个 agent 去体验,那我现在首推的肯定是这个 codex, 它们现在官方的薄课上也更新了非常多好用的功能,也就是说把自己的实力进行了一个很大程度上的提升。本身我推荐它的原因第一点就是它比 color code 要好,上手非常多,这好上手其实包含非常多种元素。首先就是网络问题, color code 它的网络要求要比这 codex 要高很多,就我现在日常处理来说,好多情况我的呃 color code 都不是很稳定,我到现在我都不是很经常用它, 用这个 codex 去处理问题,一直都很稳定,没有出现过一些什么问题。而且 colocode 那 面不是现在还要更什么身份验证吗?好像要更新这一部分,其实这个就对我们去使用来说就非常非常不友好。 然后包括我之前比如说我在做这个 figma 的 设计的时候,我去连这些 figma 的 插件用 codex 的 体感也是非常好的, 包括去创作一些视频的项目,装一些 skill, 它的执行流程都是非常丝滑的。这个其实有一个很大的原因就是你在这个 codex 里边去装插件的时候,它这个插件其实是一整套系统,它不是一个单单的 skill 或者是单单的一个 m c p, 它是把这个 skill 跟 m c p 组合起来,还有对应的这个 app 的 这个应用权限,就是一堆东西给你揉到一起给你装起来,所以你用起来就会非常的丝滑,你不用考虑说我有哪个功能没有装,我有哪个权限没有装这些问题,它直接给你打包好的,你用起来就很方便很方便,基本上主流的插件它都有。 然后并且他这个更新文档里边,他还说明了要即将发布九十多款额外的插件,所以说他这个插件结合起来的技能就会非常非常多。然后还有出了一个我非常期待的一个功能,就是他可以在我们的这个电脑上 去用光标操作我们的应用,这个其实在那个虾里边是吧?包括在其他软件里面其实都 比较常见的。但是他这个有一个非常好的一个地方,就是呃操作这些软件的时候,他是不影响你目前电脑上的这个光标的,也就是说他不会抢占你的这个光标,这个我感觉是一个很方便的一个点,因为之前他抢占光标的时候,我基本上电脑什么也不能干,就只能看着他干活。但是现在你基本上可以同时开多个智能机去执行, 它也不会强占你的光标,所以我感觉这个是非常好用的。然后还有一点就是它支持它的一个应用内的一个浏览器的展示,在这个视频里边看,就是我们可以直接在这个打开内置浏览器里边,然后进行评论,然后进行这个标记,然后识别,让这个 codex 去控制浏览器,或者是用 codex 去开发 这个跟那个 tree 的 这个 solo 模式里边的那个浏览器,我觉得应该是有一点相像的,那个的体感我觉得就非常好,如果说他把这个搬过来的话,我觉得效果应该会非常好。然后还有就是加上这个图片模型的这个迭代,能够帮助我们 在产品中生产一些前端的设计,一些视觉相关的一些开发。所以朝着这个更新的方向来说的话,我觉得这个编码的这个 i d e 的 这个产品的它更像是想要往这个 你电脑本地的一个 agent, 一个智能体去包装,用了这么长时间的这个 ai 相关的产品,我觉得这个 open ai 它们做产品这个底蕴还是在的。所以我现在等这个功能去上线了之后,我会实际的去体验一下,然后再给大家去做详细的分享。

这个是重大更新啊,你看我让他打开我的微信,给我的朋友大宝贝发送一个表情包,那我们先看一下他怎么操作啊?他看他怎么会被搜索啊?你看他已经已经在运行了,然后他已经找到,已经找到大宝贝了,然后他文字框已经输入好了,你看我们,我手在这边啊,全部没有操作,我们看他怎么做,看到没有,他的鼠标已经在动了, 然后我我的表情是让他说大宝贝喜欢尿尿,你看一下他,虽然现在还是有点慢,但我觉得随着这个后面的更新肯定会越来越快啊,看他最终的执行的任务位置能怎么样啊?这次的更新也是更新很多东西,甚至是把什么插件啊,自动化。 一会我给大家看一下他自己打了大,大宝贝喜欢尿尿,那现在就差一个表情包,看他能不能这时候能不能完成这个任务啊。现在基本上哦,开始他开始,你再再选表情包了,看他会配一个什么样的表情包,大家看一下, 看到没有?他这边已经在这,已在微信中点击,已已查看微信啊,这次他收购了欧本可乐,还是很牛逼的,但是,哎,但是,还是他有点慢啊,只是说现在还是有点慢,微信这边不配,我给他表一个更骚气的表,保证一到位啊。你看他,他现在正在哦,发了一个,看到没有?他把表情包配上去了。

新项目第一天,百分之九十的人都是直接 call dx, 启动就开干,第一周爽的飞起,第二周开始踩坑,第三周你会发现大半时间都在给 ai 擦屁股。 今天给你一个五步出场清单。第一步最关键,少做,后面全是坑,十五分钟走完一遍,后面三个月都省心。第一步,写 a j s d i m d, 这一步就是百分之九十的人跳过或者随便写两行就过去的那一步, 必写四块项目结构,加每个目录职责、技术栈和代码规范,明确地禁止事项测试和构建命令写,多花十分钟,后面每次提问都省三分钟,一天就回本。第二步, pay codex ignore, 把不要让 ai 碰的文件列出来。烟味 note modules disk build secrets, 目录数据库备份日制文件。这一步是防御性的,即使 ai 乱搜也碰不到敏感文件。第三步,选审批模式新项目前两天建议 suggest 模式走一遍,摸清楚项目边界,摸熟了切 auto edit, 千万别一上来就 fall out, 你 对项目不熟的时候 ai 也不熟,两面都瞎干最容易出事。第四步,设 token 预算 configer, tmr 里可以设单次任务的 token 上限,一个中型功能开发十万 token 一 般够用,超过说明你该让 ai 干超纲的活,应该拆任务 预算,不是限制能力,是强迫你把任务拆小。第五步,接必要的 mcp 项目,要查数据库就接 db mcp, 要读文档就接文件系统 mcp, 要查 api 就 接对应服务的 mcp, 不 需要的别接, 接越多上下文越杂。这五步我现在每开新项目必走,十五分钟搞定,对比不配就开干的做法,前一周生产率差不多,两周之后拉开差距,一个月之后代码质量完全两个档次。 一个原则,新项目的技术债百分之八十是第一天种下的,多花十五分钟出使花是对未来三个月的自己负责。这个 complex 系列到这里先告一段落,下一个系列讲 cloud code 的 实战技巧,想看的评论区留言。

hello, 大家好,今天给大家讲解一下我是如何使用 codex 来驱动 objects 来完成一系列由 ai 驱动的 ce 仿真的。首先我们去 openai 的 官网去下载 codex 这个 agent 桌面单软件。 codex 是 由 openai 推出的一个以编程为主的桌面单应用程序,我们下载完成之后,安装了之后,你可以登录你的账号,这边 codex 它是免费账号,也是有一定的使用额度的, 但是这个额度不多,建议大家还是充一个 plus 会员。下载完成之后,你可以在这边新开一个对话,然后把我这个 呃 qs mcp 的 链接粘到这个对话里面,让它安装一下这个 mcp 插件。这边安装完成之后,我们可以在设置这边看到这边有个 mcp 服务器, 然后这边的话有一个 opcode server, 这个服务器安装完成之后,你的 codex 就 能够和 opcodex 完成一个联通了。至于这个仿真的界面,它是我们完成的另一个项目, 你可以在 task two cae 这个网站下面把链接复制一下,然后交给 codex 让它安装一下。 安装完成之后,我们就可以使用 codex 联合 opcode 来完成一系列仿真了,但在这个过程中,你肯定要把你的 opcode 啊,我们打开 opcode 之后,我们可以在这边的中端窗口下输入 mcp, 然后下划线,然后 looper, 然后过号点击回车,然后这边的话 appux 就 已经开启了一个 m c p。 我 们在 codex 里面,然后我这边新开一个窗口,我们这边的话问他你是否可以和 appux 联通, 他这边是思考了二十四秒之后返回的信息是可以当天可以和 appx 连通了,如果你测试到这一步的话,那说明你已经成功的打通了 codex 和和 opuse, 然后你就可以使用一系列的提示词来对它进行一个仿真。比方说我这边做的一个仿真,仿真专家做一个仿真学分析,要尽可能的贴近真实工况, 不要简化去做。如果是比方说这种动理学仿真的,你就让他要尽可能的贴近真实功放设定播放的帧率也要高,让仿真动画看起来更流畅。我需要在这个 codex 浏览器里面看到最后的仿真的结果。 在这边有一个界面,这边是模型树,我目前是只做了这个项目的,打开预览的一个模型树,后边的话,这个我可能会再完善一下,把这边的零件材料装配,然后分析部都能够去操作和二次编辑, 目前能够你编辑的在这个可编辑窗口,比方说可以编辑一下模型的一些尺寸,比方说我们把这个模型的尺寸圆孔半径改为二十四,在这边点击重新计算,然后这边的话它就在驱动 appui 完成一个重新的计算。 你也可以改,比方说板长板宽,然后其他的一些弹性模量或者是材料属性可以看到它这边就完成了一个模型的重新计算,然后重新进行了一个就是模态分析。我们先在这里讲一下这个 codex 驱动 ios 进行一个由 ai 驱动的 ce 仿真的流程是怎么样的。首先我们在这里的对话框里发一下你的想要仿真的一个提示词,你可以完全照抄这个,当然你想改一下也是可以的, 然后把提示发给这个 codex 之后, codex 就 会去写一系列的脚本,比方说这个模型建立的脚本也是由 codex 的 python 码完成的,当然一些比方说这个像简单的一些模型,它是可以去建立的,当像这个 洗刀模型它就建立的效果不是很好了。这个洗刀模型是由我在 soodeworks 里面去建立的一个模型,把它转化为 str 格式之后,告诉了 codex 在 哪里, 他就可以把他建立的模型和我提供给他的模型进行一个装配。呃,包括后面的像材料定义装配这个分析布载合了的定义,边界条件的定义,以到我们的网格化划分,都是由 codex 来完成的。 到后面的一些结果的后处理也是由 codex 来完成。 codex 完成之后,它会把一系列的脚本发给发送给我们的 opqs, 来完成最后的一些结果的分析,然后到仿真的一些模型的一些计算,它会发送给我们来完成一系列的仿真计算到结果的后处理, 然后完成之后它会创建一个网址,就是这样一个网址,然后我们点击一下就可以在浏览器里面去 看到 oq 所有的仿真结果。目前的一些仿真的话,其实它只能够进行一些简单的动力学或者是心理学仿真心理学效果目前是最好的,动力学的话,其实效果没有那么好, 大家可以当做一个参考。然后我这边再补充一点,就是如何把这个 mcp 给停掉,因为这个 mcp 运行的话,你的 oq 界面是不能进行任何一个点击操作的,就是它是一个主色运行的状态, 然后大家如果想停掉这个 mcp, 呃,然后在 app 里面查看结果的话,可以点击这边的 stop 按钮,然后就可以停掉这个 mcp 服务了,然后就去进行其他的一些操作。 你如果你有问题的话,可以在这个 github 上去提问,或者说你有好的想法可以在这边跟我说一下,我看一下能不能来实现一下。这就是本期的视频内容,大家如果有什么疑问可以向我提问,谢谢大家。

就是 codex 真的 是太好用了,因为我平常会用 opc 点来记录我的一些个人的内容, 然后我一般都会画一张呃画板,上面用一个清晰的结构来放我每个文件夹的内容,但是我有写日报的这个习惯, 所以呢,我每次就会点开这个呃我的日报的文件夹,然后进入到我的日报内容当中,然后再从这个里面去完成我的日报,然后我一般会新建一个这样子的内容,比如说进来之后我会去完成我所有的内容,完成之后呢,然后我需要使用 我会进入到这个里面之后呢,然后我创建一个日报的链接,然后会口述我的内容全部都放在里面, 然后传统的是我需要把它放在嗯这木乃三里面去帮我整理一遍,之后变成一个结构化的内容,之后再放回到日报内容里面。 但是呢,我想了想,与其都这样,我不如直接用 codex 去帮我做这件事,所以我就给到他一个我的口述日报的内容,然后让他帮我整理 到这个奥布 c 店里面,然后并且放到指定对应的日报内容的这个马拉岛文件当中,然后并且以当天的日期去命名,然后是补习小组给了他之后不到两分钟的时间他就帮我把这个技能优化完了, 现在的话呢,就是他已经创建好了这个技能,以后呢,我只需要给他说你帮我整理今天的日报,然后他就会把我所有口述的内容转换成一个结构化的呃模式结构化的内容,然后再帮我整理到 opc 店里面, 然后放在对应的日期的链接里面就变得非常的简单。

好,大家好,我是小刘。呃,今天我们一起来聊一下在 codex 中上下文管理的一些技巧,那这里呢,我会讲我平时在使用 codex 当中,我是怎样进行上下文管理的。那我们先说一下背景, 什么上下文管理呢?就是我们知道我们在一次对话的过程当中,它的绘画窗口是有限的,可以看到这里是共二百五十八 k, 那 已经使用了三十二 k, 当这个上下文满的时候呢,扣代码,它会自动的压缩这个背景,这样呢我们的这个整个上下文会失真。什么是压缩背景呢?比如说猫和老鼠四个字,那就是我们绘画的主要内容,他会把它压缩一下变成猫老鼠,你看是不是压缩了,对不对? 但这样就会产生一个通病,就是产生 ai 幻觉,那也就是我们的功能开发会越用越不好用,你会发现你跟他说一个点,他就是不明白,然后呢会导致我们很崩溃。 那我们来看一下这个网友是怎么解决的,然后我再讲我自己的方案,他的方案就非常的简洁易懂,就我们都知道每一次对话呢,它会产生一个绘画的 id, 那 我们这次绘画它是存储到我们本地内存当中或者数据当中,这时候我们可以选择复制这绘画 id, 那 这个绘画 id 呢?本身上是一堆的这种字母,就我们扣带子可以根据这个字母找到我们当前上下我们所有对话, 他拿到绘画呢,可能是压缩库的,可能是不准确的,所以呢他就遇到了这个情况,他就把他哎复制到一个新的窗口当中,比如说新对话,这时候你看跟他说对吧?请你帮我进行这个功能继续开发是不是?那这个时候是不是就拿到了我们的青山崖纹?这个也可以,只是说开发的时候,那他需要去浪费更多的图层,因为他需要加载数据库,加一个内存,对吧? 好,首先我先说一下我的方案,就是这里呢,我会回顾一个上下文的文档,进行定期的总结。举个例子,比如说像这个绘画呢,他都满了,那我就跟他说,请你帮我根据当前这一次的绘画呢进行总结出一个 markdown 文件,这个 markdown 文件呢是包含了这一次的一些所有的关键信息,那你可以看我思路这样的,请你帮助我, 请你总结当前项目的关键决策已经完成的部分和代办事项,便于我下次听话加的一定要加这句话,如果说你不加这句话,他给你的可能就是一个总结性的文档,如果说你加这句话的话,他会按照 call 代词能够处理的绘画格式给你一个哎,一个合理的 bug 档,所以就相当于固定的一个格式给他。那如果说,哎,我这时候跟他说这句话对不对? 尽量用五点五模型,用最好的模型实现的效果可能是最好的。然后你比如说用五点五超高你发送一下,那这时候呢,他就会根据你当前的这个项目进行总结一个 bug 大 文件,那收下一次开启的时候呢,你就可以把这个 bug 大 文件哎给他 就是丢进去,然后这个时候呢,他就可以直接的进行上一次上下文的复用,而且呢失真不会失的很严重,那最起码会比直接使用 codex 压缩的方式会好一点,那这是我的第一种方法。第二个呢,就是使用这 codex 内置的压缩功能呢,这个我刚刚说过了,对吧?我们 正常来说 codex 也会进行自动压缩,但是它会进行四帧,但是进阶技巧就是我们可以直接让 codex 呢,每次都生成这个 prompt, 就是 给它设定一个这个啊, ajax, ajax, markdown, 这种,对吧?让它自动生成,而不是让我们手动去指定它。 那这里呢,再分享一下我自己的这个 codex 技巧,因为有小伙伴他会问我说,你视频当中平时使用 codex, 那 我先说我怎么使用呢?首先我不会把一个项目 丢到一个上下绘画里面,一个上下文绘画里面我会把它拆成多个小的功能,在每一个小的功能对应一个绘画,这样呢,我这个绘画可以赞成很大,并且呢它总结出一个 markdown 文件,再把这个 markdown 文件丢给一个新的绘画,这样呢,我们就基于这个功能在进行优化,不会去影响整个的大局。啊,能懂我意思吧? 那第三种就是我们可以使用外部的持久化工具,那这个外部持久化工具有很多,比如像我们之前说的 context 上来说,就是把原先我们的 markdown 给它缔造了外部的这种 社区部里面去,你可以这么去理解,然后通过一些更好的方式去把它读取到这个 collect。 那 每一个开源项目都有自己的方式,大家可以自行研究,因为篇幅有限,所以我这里呢就讲这几种,好吧。 然后呢?呃,这种方式呢?其实我还是建议大家使用 bit 进行管理起来,因为当我们用 bit 进行管理起来之后,我们整个上下文呢,能够更加有链路的去回溯,就是每一个版本都有对应的回溯, 我们能够很清晰的看到,对吧?这是我们整个流程,你可以看到通过这样的方式,那就是像上下文的这个管理,好吧,这呢是。呃,好了,那以上就是本期视频的全部了呢,我是小刘,我们下期再见。

glass app 发布了重磅更新,更新好几个功能都非常有助于我们进行自动化测试,比如 app 测试,网页测试,然后也更新了一些非编程环境下的一些场景,那我们来看一下更新的详细内容。 那第一个就是这 computer use 这个电脑控制的功能,那这个功能是干什么?就是 class 可以 控制我们电脑里面的软件,去访问们里面的 app, 去操控,去截图,那这个就是我说的。第一个就是它可以有助于我们进行一个 app 的 测试。当你升级到最新版本之后,在这个设置里面, 然后有一个电脑使用,然后这边会出现一个 computer use 这个安装的这个按钮,你点击安装便捷授权之后,那么你就可以来使用它这个功能来控制电脑,那目前的话,它这个控制电脑的话仅限于这个 mac 电脑, windows 暂时不支持。 那现在我开发了一款这样的 app 啊,然后让他去操控我们的 app 来进行一个测试。那如果在你的这个场景里面,你要用到这个控制电脑的功能,那你就使用这个艾特符号,然后的话他这边就会出现啊,安装完之后就会出现这个让你选择, 那接下来就输入你的这个你要他控制电脑要做的事情,那么在输入的时候尽量把这个范围缩小,就是你要达到一个测试什么,测试的场景是什么, 就不要太因为这个操作的流程也是很消费这个 token。 那 这边的话我让他测试一下我首页这个商品列表,点进去之后看商品详情,那么你也可以写的更多,越多越好,他就会去理解你的意图,去操作这样的一个路径。 那我们这边发送,那么在这边的话,你可以把这个窗口拉小,比如说在迷你窗口打开,那么他会出现这样一个迷你窗口,这两个是同步的,这样的话你这样可以去打开这个窗口去做别的事情。 启动之后可以看到一些标示符,说明他已经在启动我们这个模拟器了。然后的话,这个过程是我体验下来是有点慢啊,然后他会点击我们的要求哦,已经向下滚动了,然后找到这个商品列表之后,会有一个像鼠标一样的箭头哦,点过去了, ok, 他 这边的点击已经完成了。然后这两个问题是标题啊,没有完整显示,那么你就可以继续测试了。 如果你说连接的后端的话,它这边也是能测试到这整个的这个显示数据是否正确,所以就非常依赖于我们去怎么去写这个测试的这个链路啊?你可以根据自己的这个产品呢, ai 生成这样的 computer use 的 测试链路来方便你进行测试。 很多时候它是可以进行截图,比如说看在我这个例子里面,它是会去截图去发现问题,然后去修复的。但是这个 computer user 这个功能,我觉得它还有一个就是类似于像 opencloud 这样,你可以去操控,比如说你 mac 那 个里面的其他应用, 当然去打开去操作,去回,比如说打开微信去回复,这样自动去回复,这样信息就有点类似于这样子。它目前很多功能啊, 更新的方向有点像整合 koork 啊,或者说 opencloud 这样整合到它这个这个 kois app 里面去,不仅也是编程这个场景,那么在使用的时候一定要把这两个权限给它打开, 然后的话在用的时候通过 app 去唤醒去使用啊,如果你说要测试这个 mac 的 app, 或者说测试安卓的也可以,只要是使用 mac 电脑都可以去啊测试,然后写好测试流程, 那么你也可以当 openclaw 一 样使用去控制电脑啊,做你想做的事情,但是呢有风险啊,因为你这个软件被它控制了,它是能看到你软件里面的这些界面上的信息的,如果涉及到比如说跟钱有关账号有关的,还是尽量不要用。第二个就是内置的浏览器啊, 也就是说你可以在 class app 里面去打开这样内置浏览器去进行调试,它这个打开的方式非常奇怪,需要你通过这个快捷键去打开它没有像样的入口说我能看到的浏览器在哪里,所以这个是非常让我很吐槽的一个点啊,我们可以来试一下, 那么 mac 电脑的话是用用 command c f 加 b, 那 么这个 windows 的 话是用用这个 ctrl c f 加 b, 然后的话输入这样的网址,就是比如说现在启动这个东西, 然后我输入这样的网址,在这边输入这个网址, 那我就打开了,打开之后呢就是首先是呃, 你可以去进行一个截图啊,点一下,那么这个截图就会在这边就会出现复制就可以了,就直接就让他去修改,因为他本身就是是可以识别图片的。那还有一个就是重,最重要的是这个评论模式,点这个加号, 然后他就你就可以选择这样元素,比如说现在我要去改变这个,比如说改变这一块东西点添加,那么他这边就会收集到这边去,那么你也可以可以继续改,比如说把这里字体, 然后你就可以收集到很多,比如这个页面的所有的调整,你收集完之后,那么你就点击发送,那么他就会去修改你这两个刚刚提的意见, 那这个也是相当于是很精细化的去调整页面,然后这边的话是呃有截图,然后有你的文字,它是通过这个截图的方式看到图片里有什么,然后在你的描述是只有这两个,那这个功能其实之前是有,但是没有现在这么好用, 那么你要关闭的话,你再点击第三个,就是不需要任何文件夹都可以启动这个 cs app 了。你说我们,比如说 我们现在打开一个新进聊天,那么那么这里是不需要选,以前我们是要选择一个文件夹,那这边是不需要, 就是不需要任何的文件夹,那么可以做什么呢?你就可以做很多啊,跟大家的一些,比如说你想研究一个什么东西,类似于像那种 openclaw, 或者说其他的这种 a 型的产品一样,就不再是 是有一个文件夹需要去编程,需要去产生文件,你可以去进行研究,可以去对话,可以去答疑,就是把它的这个 chat 给放到这里面去了,就聊天的那个模式放到这里面了。 所以这是为什么?我说这些有些根线啊,它其实偏向于非编程的场景呢?包括这个 computer use 其实也是很多应用的场景,可能都不是在编程这个环节啊,还有这个这个聊天的这个切入 后面可能会更新更多这样的类,类似于 cooke 这种办公的这个场景的这个揭露。所以但是我对这个是比较 疑惑的,就是我觉得应该是专注于做编程工具,而不是把什么东西都塞到这里面去,应该分不同的产品,这样的话也会更好一些。然后这边还更新了很多这样插件啊, 就是 class app 的 插件是非常有意思的,就是它的这个插件呢,你可以认为是连接很多能力,不像我们理解的这种 clock 的 这种插件是会有很多工作流。那么除了这个之外呢,还有增加了一个叫摘药的这个功能呢,就是你能看到它改了哪些东西呢?最终的一个产物。 那么其实之前一直吐槽就是我们要打开一些文件啊,都要跳转到其他的这个编辑器里面去,那现在终于可以在这边能看东西了。 然后的话,还有一个就是我觉得非常有用的功能,就是说你可以在这里面看到你使用了哪些插件和技能,比如说 我在设计这个这个 ios 的 时候,用到了它的 design skill 和这个 swift skill, 然后还用到这 computer user 这个功能。这个好处就是你在这一次的 build 当中,你就能看到你的技能的利用率,大概就是这个 真实的情况下用了哪些技能,你可以看一下,如果说这个技能没有被用到,那你就要去看一下你的技能的描述,你的这个事件的触发是不是有问题?所以总的来看,我觉得这个更新可能是代表了一个这样方向上的一个整合吧。 然后这个 computer user 这个功能还是挺有用的,就是可以去做很多这种自动化测试的事情,还有一些内容的更新,包括一些软件开发商体验啊,聊天软件开发商体验流程,还 get 的 一些操作,这里就不再细讲了,大家可以去下载最新版本来体验一下,我觉得是非常不错,非常顺畅。