codex 跑长任务总在最后一步崩,很多人以为是模型的问题,其实是任务没有结构解法,就一步在项目根目录建一个点 hermes 文件夹,里面放一个 task e m l, 把长任务拆成有依赖关系的子任务列表, codex 每完成一步就打勾,下次续跑从断点开始,不用从头来。这个工具叫 hermes, 定位是 codex 的 项目管家,专门解决 codex 跑长任务没有记忆中途崩了不知道跑到哪的问题。核心配置只有三个字,断。 第一个是 task 任务列表,每条任务写清楚做什么,验证标准是什么,依赖哪个前置任务完成。第二个是 risk flags, 提前定义高风险操作,比如删除文件,修改 config 目录,改数据库 schema, 触发这些 hermes 暂停,让你确认 block code 自己闯。第三个是 progress report, 指向一个 progress md hermes 每完成一个子任务,写一条日记,早上起来不是对着一团改动,猜昨晚发生了什么,而是一份清单,告诉你每步做了什么,结果是什么。 我现在跑超过三步的任务,全部先写 task em, 再交给 codex, 翻车率直接调到接近零一人。公司用 codex 干长活,缺的不是模型能力,是任务管理层, hermes 就是 那一层。你的 codex 现在跑长任务吗?评论区聊聊。
粉丝6103获赞3.7万

如果你在使用 codex 一 段时间后,感觉它越来越慢,那么我推荐大家安装这个 skill keep codex fast, 直接复制这个命令行,丢给 codex, 让它自行安装。安装好后,第一步可以将这行命令丢给 codex, 让它先扫描,告诉你哪些对话该归档,哪些 word tree 残留以及日期有多大等等。 第二步进行交接,直接将这行命令丢到你比较重要的项目中,它会针对旧项目生成交接文档, 记录你这个项目改了什么,跑了什么命令,以及下一步应该怎么做。第三步就是归档模式,它会备份移除旧的 word tree, 清理日期等等。关键是它不是自动执行,它主要是每周或者是每半个月来自动提醒你该做这个事情了,这样会更安全。

code 叉据说爆出了一个执行漏洞,像这样的一个漏洞啊,基本上的原理都是相通的,我记得以前给大家讲过一个 git 的 一个漏洞,为什么要提这个呢?因为它们的原理是类似的, 我用 git 去克隆我的一个仓库,这个仓库呢是我配置好里面写了一些代码的一些漏洞的仓库,只要你用这个 git 克隆下来, 你就会中招,可能是远程执行一个命令,或者打开个记事本,或者打开个计算机,这是展示的一个 demo, 你 也可以去看看,现在还有。 呃,那么这个 code 叉或者 cloud 像这样的 ai 编程工具,它在本地,比如在我们的 go lab 里面,在我们的这个呃 vs code 里面,它可以去帮我们去执行,哎,修改我们的文件,可以操作一些文件,像可以执行一些这个命令,那我们可不可以在这个 get 的 这个仓库里面恶意构造一些代码, 只要别人呃克隆下来,只要用这个,比如说 code x 打开它就可以触发我们的恶意代码呢?这是一个问题,当然我也没有复现,只是网络上说有这么一种东西,但是这种东西的话,我们 open code 也是类似的,它都是在本地执行命令。 都说这种东西的话,大家要小心,就是不要去随意的去克隆别人的这个仓库,因为你也不知道是什么。当然你说不克隆好像也不太现实,因为你总要去用到,所以说呃,这个还是要小心,要及时更新你的这个客户端就可以了。

这个扣代个可以直接用谷歌的浏览器了。我发现在这个 ai 时代压根就不需要学习啊,我前两天在想着要做电商啊,还要呃卡在那个上货,然后反正那个界面还要自己研究,看的挺头大的。然后今天这个现在他自己支持浏览器了啊,可以自己去 看茶田。那不就代表着我直接让他网页去呃登录浏览器,然后帮我操作那个抖店的后台就行了吗?不直接让他扣贷自己跑了吗?但是现在有个问题啊,这个 windows 的 扣贷 x 好 像 有问题。装不了啊,一直都装不了,都好多次了,装不了。本来在这个插件商店里他都没有这个 虎哥的浏览器,这是他已经修过一遍之后才有的啊,大家可以去看一下,应该很多人都没有,但是你可以直接让扣袋子给你修,他现在在给我修,估计一会就修好了啊。学估计是真的不需要学啥了,全都是 ai 自己去干了。 这马上把这个装好了,什么公众号,什么呃图文啊,只要能做的,包括那个,特别是我现在需要的这个抖店的运营啊,直接让他自己去上传。 刚才还用不了啊,现在已经他给我修好了,可以用了,我让他给我打开了这个抖店的后台啊,说明是可以的啊,可行了, 这个插件商店里他已经安装好了,现在是可以用的啊。呃,大家不懂的可以把这个开成完全访问权限啊,像我这种不懂任何呃什么代码工程的各种傻子啊,就该开这个完全访问权限,虽说有这什么什么各种各样的什么风险, 但是不开的话他解决不了问题啊,对不对?我也不懂,即使坏了我也看不懂啊。不开解决不了问题,开了反而能解决问题,即使有一定的风险,风险也可控嘛,对吧?小破电脑坏了就坏了。

大家好,最近收到很多小伙伴的消息说 windows 下的这个 codex 会出现中文乱码的情况,那我们今天就来教你一招,永远解决 codex 在 windows 下中文乱码的问题。我这边整理了教程给大家,大家可以在这个安装指南里面的这个呃, codex 安装教程, 然后最底部的这个 code 中文乱码解决方案里面可以看到,这个其实很简单,就是安装一个 power 七就可以了,就是因为,呃,我们用的这个 c m d 它太老了,所以它会出现中文乱码的问题,那可以通过这行命令直接去安装。那如果没有 winget 的 话,那可能需要手动去下载或者安装,我这边也 打包了两个这个安装包,呃,也是从 github 上下载下来的。呃,如果想要在 github 上下载,选择对应的版本,也可以自己去呃查看啊。那安装完成之后呢,只需要 先去验证这个 power 的 版本,我这边是已经安装了哈,就不再进行安装了。就其实我们就打开那个前面那个安装包去安装就可以了。那在任何的这个目录下输入 p w s h, 呃,我们就不再用去用 c m d 了啊。 然后我们其实可以看到这边已经显示了这个 pro 效的版本啊,是 pro 效期,在 pro 效期下他其实就已经不会这个中文乱码,我们可以直接测试一下,直接输入这个命令就可以了,可以看到已经不会乱码啊。 如果你下载完 pro 效期还会出现乱码的情况呢,你需要去编辑一下这个个人的配置文件啊,用这一行命令 直接在 pro x 里面去运行啊,运行完之后把这个底下的这个内容全部粘贴进去就可以了,粘贴完之后重启 pro x。 那 还有一个问题,就是我们在运行 p w s h 的 时候,怎么默认它是七点六版本的?因为如果你像刚刚那样安装的话,它其实 pro x 五和 pro x 七它是在你的电脑共存的,那我们就需要设置一下,我们任意打开一个这个终端,然后打开这个标签页,点击设置, 进入设置页面之后,配置一下这个默认配置文件。啊,正常来说这个应该是这个命令提示符,那我们选到这个 power, 一 般来说这个 windows power 就是 你自带,你看这个图标吗?如果 power 七的它的那个图标是不一样的,那我们选择这个。选择这个之后呢,我们关闭整个终端,然后我们再再任意的这个地方去运行它, ok, 这边就已经是 po cache 期了,那后续你在使用 codex 的 过程中呢,你就记得一定要去用 po cache 啊, pwsh, 这样我们再去运行 codex, ok, 呃,就要用这种方式去运行 codex, 就 不会再出现中文乱码的情况了。那这教程到此结束,谢谢各位的观看。

恩爱真急了,昨天刚把 sora 关门了,这马上 codex 工程负责人这叫什么? tablet 就 表态 codex app 继续保留,而且要投入比以往任何时候都多的精力去打造超级 app, codex 甚至有可能会把 gpt 本身并进来,也就是说你在 mac 上现在有两个单独的软件,对吧? mac 上可以使用的是 gpt 和 codex, 然后 codex 本身它有什么?有电脑操控的功能,以及它本身的强项是编程能力这个东西就契合了现在它跟 ansok pk 弊端这一点。所以现在 o a i 急了,把烧钱的 sora 直接一刀砍掉之后完全聚焦要让 codex 跟 cloud code 玩一把史诗级大队干,因为数据太残酷了, cloud code 九个月从零干到二十五亿美元的年化收入,然后业务订阅开年头六周就翻了四倍,现在还在高速增长。然后公司企业采购 ai 的 预算百分之七十三流向了 acopai, 只拿到百分之二十七,直接他们就蒙圈了。然后三月份 cloud 在 美区的 apple store 因为五角大房子事件甚至首抄了 g p d, 所以 open ai 现在怒了。 首先收购了 python 的 工具链公司 astro, 接下来要把怎么样依赖管理和代码检查的这些能力充分嵌入 codex, 让 codex 成为 bug 神。第二, gpt codex 和 atlas 浏览器很可能会融合成一个 桌面 super app。 以后大家进来之后把你的 mac 电脑打开,第一件事就是点开这个 app, 不 管它叫什么啊。然后第三件事就是 codex 在 编程能力之外要融入更多的生产能力,什么处理表格文档和数据分析,这已经不得不做了,因为 cloud 太牛了,你赶紧跟他对干吧,不然追不上了 bolo。

现在 code 可以 直接使用 dc v 四了, code 确实好用,但是额度真的是不经烧,随便几个问题直接就清空了,又得等五个小时。所以我试着把 dc v 四接进去,烧了四 e token 之后,发现操作竟然很丝滑,体验也完全不输原版,关键是真的大碗便宜, 后面我会带你一步步接好。其实步骤是非常简单的,就三样东西, c c 叉, d c 的 a p i, 还有 c c switch, 而且工具我都已经整理好,你照着我这几部点,基本几分钟就可以搞定。 解压后先打开 c c 叉的文档,然后打开 emv 文件,里面会有一个密钥,这里你可以保持默认,也可以自己去修改一个。改完之后记得先保存,然后启动 c c 叉,它会弹出一个终端,你找到这个管理界面的地址, 然后按住 ctrl 键再点击,就会来到这个页面。进去之后把刚才 e v m 里面的密钥粘进去,就能够进入到后台,这里你可以顺手切成中文就行,这部分就基本搞定了。接下来我们去到 d c 的 官网,点击 api 开发平台,第一次进来得先注册一下,然后点击左边的 api key, 新建一个 key, 名字可以随便填。创建完记得先保存好,因为它只会显示一次。然后回到 c c 叉上面,选择 code, 中间点击添加频道,这里就可以直接把这个文档粘进去。最下面把刚才复制的 a p i 粘进去,创建就算成功了。记得顺手做两个设置,一个是选一下 openchain, 另外一个是把规范化,非常健 打开。这一步搞定, d c 其实已经接近来了,然后打开 cc switch, 点击上面的这个标志,右边新增一个配置,具体的参数你可以按照这个来就好。这里有三点是需要注意一下, 首先,这里的 api key 不是 d c 的 那个,是一开始 emv 里面的那个密钥。第二点,点击一下这个获取模型列表,就不用自己手动去填写了。第三点,把 e m 上下文窗口勾上,这样子才能全力去跑,下面这些都不用管,填完之后直接点击保存, 然后点击启动,最后把 codex 安装或重启一下,到了这一步就已经接好了。打开之后, codex 这里不是显示 d c, 它只会显示自定义。别慌,这个时候你随便发一句话,先试试能不能是正常使用。然后直接去看看 cc switch 的 使用记录,你会看到模型这一栏已经变成了 d c v 四 pro, 来源是 codex, 那 说明已经是链接成功了,也就是说后台真正在跑的已经是 deepsea 了。最后我补两个词,已踩过的坑。第一个坑是 cc switch 最新的版本,现在有 bug 会连不上 codex, 所以 别手痒去更新,直接用包里面的版本就行。 第二个坑是 d c v 四没有视觉能力,所以一旦你平时有看图识图这类型的需求,进来之后可能会有部分的能力用不上。不过好消息是这套流程本身是通用的,你可以直接换成其他的多模态模型,思路也是一样的。我是木马,陪你一起玩 air 赛博达子,咱们下期见,拜拜!

好,大家好,我是小刘。呃,今天我们一起来聊一下在 codex 中上下文管理的一些技巧,那这里呢,我会讲我平时在使用 codex 当中,我是怎样进行上下文管理的。那我们先说一下背景, 什么上下文管理呢?就是我们知道我们在一次对话的过程当中,它的绘画窗口是有限的,可以看到这里是共二百五十八 k, 那 已经使用了三十二 k, 当这个上下文满的时候呢,扣代码,它会自动的压缩这个背景,这样呢我们的这个整个上下文会失真。什么是压缩背景呢?比如说猫和老鼠四个字,那就是我们绘画的主要内容,他会把它压缩一下变成猫老鼠,你看是不是压缩了,对不对? 但这样就会产生一个通病,就是产生 ai 幻觉,那也就是我们的功能开发会越用越不好用,你会发现你跟他说一个点,他就是不明白,然后呢会导致我们很崩溃。 那我们来看一下这个网友是怎么解决的,然后我再讲我自己的方案,他的方案就非常的简洁易懂,就我们都知道每一次对话呢,它会产生一个绘画的 id, 那 我们这次绘画它是存储到我们本地内存当中或者数据当中,这时候我们可以选择复制这绘画 id, 那 这个绘画 id 呢?本身上是一堆的这种字母,就我们扣带子可以根据这个字母找到我们当前上下我们所有对话, 他拿到绘画呢,可能是压缩库的,可能是不准确的,所以呢他就遇到了这个情况,他就把他哎复制到一个新的窗口当中,比如说新对话,这时候你看跟他说对吧?请你帮我进行这个功能继续开发是不是?那这个时候是不是就拿到了我们的青山崖纹?这个也可以,只是说开发的时候,那他需要去浪费更多的图层,因为他需要加载数据库,加一个内存,对吧? 好,首先我先说一下我的方案,就是这里呢,我会回顾一个上下文的文档,进行定期的总结。举个例子,比如说像这个绘画呢,他都满了,那我就跟他说,请你帮我根据当前这一次的绘画呢进行总结出一个 markdown 文件,这个 markdown 文件呢是包含了这一次的一些所有的关键信息,那你可以看我思路这样的,请你帮助我, 请你总结当前项目的关键决策已经完成的部分和代办事项,便于我下次听话加的一定要加这句话,如果说你不加这句话,他给你的可能就是一个总结性的文档,如果说你加这句话的话,他会按照 call 代词能够处理的绘画格式给你一个哎,一个合理的 bug 档,所以就相当于固定的一个格式给他。那如果说,哎,我这时候跟他说这句话对不对? 尽量用五点五模型,用最好的模型实现的效果可能是最好的。然后你比如说用五点五超高你发送一下,那这时候呢,他就会根据你当前的这个项目进行总结一个 bug 大 文件,那收下一次开启的时候呢,你就可以把这个 bug 大 文件哎给他 就是丢进去,然后这个时候呢,他就可以直接的进行上一次上下文的复用,而且呢失真不会失的很严重,那最起码会比直接使用 codex 压缩的方式会好一点,那这是我的第一种方法。第二个呢,就是使用这 codex 内置的压缩功能呢,这个我刚刚说过了,对吧?我们 正常来说 codex 也会进行自动压缩,但是它会进行四帧,但是进阶技巧就是我们可以直接让 codex 呢,每次都生成这个 prompt, 就是 给它设定一个这个啊, ajax, ajax, markdown, 这种,对吧?让它自动生成,而不是让我们手动去指定它。 那这里呢,再分享一下我自己的这个 codex 技巧,因为有小伙伴他会问我说,你视频当中平时使用 codex, 那 我先说我怎么使用呢?首先我不会把一个项目 丢到一个上下绘画里面,一个上下文绘画里面我会把它拆成多个小的功能,在每一个小的功能对应一个绘画,这样呢,我这个绘画可以赞成很大,并且呢它总结出一个 markdown 文件,再把这个 markdown 文件丢给一个新的绘画,这样呢,我们就基于这个功能在进行优化,不会去影响整个的大局。啊,能懂我意思吧? 那第三种就是我们可以使用外部的持久化工具,那这个外部持久化工具有很多,比如像我们之前说的 context 上来说,就是把原先我们的 markdown 给它缔造了外部的这种 社区部里面去,你可以这么去理解,然后通过一些更好的方式去把它读取到这个 collect。 那 每一个开源项目都有自己的方式,大家可以自行研究,因为篇幅有限,所以我这里呢就讲这几种,好吧。 然后呢?呃,这种方式呢?其实我还是建议大家使用 bit 进行管理起来,因为当我们用 bit 进行管理起来之后,我们整个上下文呢,能够更加有链路的去回溯,就是每一个版本都有对应的回溯, 我们能够很清晰的看到,对吧?这是我们整个流程,你可以看到通过这样的方式,那就是像上下文的这个管理,好吧,这呢是。呃,好了,那以上就是本期视频的全部了呢,我是小刘,我们下期再见。

给大家看一下啊, codex 确实太牛逼了,我的欧盟卡今天直接报错升级出错了,就是它的新的安装包没有下载下来,然后使用不了了,直接报错用不了。 然后我在终端里面去查 openclip 的 版本,提示不存在,现在是没有了, openclip 没有了,然后我就打开 codex, 我 说我的 openclip 是 安装的,控制台都能打开,但是提示不存在,帮我看什么问题,绘画提示是这个,然后它就全程帮我修复完了 定位问题,安装损坏,他就说是安装损坏导致的,然后我就给了他补充了信息,升级四点幺八,这个说错了,是四点幺四版本,然后检查升级导致的还是哪个,我说看是还原还是怎么样,然后他就检查,检查完了之后 给我返回是这个升级四点幺四点幺八,然后或者回到回滚到之前的版本,但之前版本我有那个最新的,还会继续升级, 然后他说目前查到是四点幺四,这个是最新版本,这个是我给指令给错了的,然后就升到了四点幺四版本,然后自己去测试验证,在这里他去发验证,刚开始是没有回复的,失败,然后继续去修复,自动修复 应该在这里啊,在这里就是 agent 的 调用没有成功,然后测试了两遍,他自己去调整,测试了两遍,然后测试现在是 ok 的, 包括在这里的报错,这是我使用不了的报错,写朋友圈全部报错, 没有办法,工作请求出错,然后现在是已经好了的好,这是我的发圈的 agent, 然后他现在在工作,然后现在的最新版本就是四点幺四的版本,已经好了,你好,好了,牛逼,克莱斯牛逼。

codex 切一次, provider 左侧几十条绘画全没了。这种切换其实是日常,但别慌,不是 bug 一 句话就能找回来。 为什么不少 codex 重度用户都会踩这个坑?三、不讲清楚。第一,第三方 api 便宜到离谱,日常写代码改 bug, 大 多数人其实都切在某个第三方上跑,省下来是真金白银。但便宜是有代价的, fast 模式用不了,插件也用不了。 所以一旦第三方服务器抽风维护限流突然报错,你就得临时切回 chat gpt 官方救急, 事情办完再切回第三方。就这么一趟,来回切的时候只改了 config, 点 tomler 里一个 provider 字段,重开, codex 左侧会话列表就空了,磁盘上文件还在,人就是进不去。 我原来的本能做法是让 codex 自己修,结果他只能一个方向一个方向试,一会说修了绘画缩影,一会说清了缓存重新加载,你满怀期待重启,一看还是空的。我粗略算过,平均三轮来回十二到十五万 to 肯二十分钟没了,正事还没开始。 更糟的是,这不是一次性问题,下次再切你又得从头再来。不解决根音,每次都要重修。原因其实很简单,你没告诉他问题出在哪,他只能瞎猜 原理。一分钟讲完, codex 的 绘画是跟着 provider 走的,你用 chat gpt 官方账号登录时, config 里的 provider 字段是 open ai 那 一刻之后产生的,所有绘画都打上了 open ai 这个标签。 一旦切到第三方, provider 字段变成第三方的名字, codex 去翻绘画,只认当前这个标签,旧的找不到,列表就空了。反过来从第三方切回官方,同样踩 解法,就一句话,这次别让 ai 面,让画面说,你只要告诉 codex, 我 切换了 provider, 请把全部对话的 provider 都改成跟当前一样, 它会一次搞定。画面上就是实战的结果。三十多条原本绑在第三方上的绘画被统一改回当前, provider 还顺手做了备份,改完记得彻底退出 codex, 再打开,不是关窗口,是进程完全结束,绘画就全回来了。 两个启示,第一,描述精准, ai 才快。同样是修这个问题,一句模糊的绘画不见了要折腾三轮,一句带上 provider, 变了就一轮搞定。第二,花一分钟懂工具的原理,能省掉十分钟下事。 绘画榜 provider 就 这一句,整个 codex 就 通了这个坑。 codex 很 久没修,大概率短期也不会修,所以第三方和官方来回切是日常,但你只需要懂这一次。

昨天真是天塌了, oppo a r 大 面积封拆的 gdp 的 会员以前也封,但没这两天规模这么大,那些靠凭证充值会员的基本上全挂了。昨天我的七个号掉了六个,还活了一个。作为 opc 的 核心工具啊,我只是说 clothes 太好用了, 有人肯定会说 clothes 靠的才是顶级好用,那咱们用不了啊,甚至给你永久封,最后再来个删除文件,你受得了吗?有传闻说 clothes 的 创始人在我这里打工的时候被欺负了, 回去之后一怒之下禁止加八六的使用,这是开玩笑的。但是两者相比之下啊,我觉得口袋思还是比较友好的。从昨天调 plus 之后,切换口袋思登录账号也被强制要求手机验证码, 加八六的基本上是接受不到信息。我觉得啊,这可能也是对我们的封锁,但是对于我们这种一人公司来说,如果缺少一个强有力的 a r 工具,基本上可以说是 完蛋了。但是还好,皇天不负有心人,终于经历了十多个小时的研究,我终于可以切换账号了,就等 plus 稳定了再搞几个号之后啊,一台电脑登录一个账号,我觉得这样是比较安全的。有很多人会问,口袋子是干嘛的,那我们下集来说,口袋子到底能干什么?

这 codex 做个 ppt 咋这么丑啊?是没审美啊还是我 skills 没装?对啊,我是不得再装点 skills, 再看看它能不能做好看点。 我都 codex 五点五开到叉 xl 了。这这个这个这个 ppt 做出来太丑了。然后呢?之前都是 cloud 的 打底,拿来 codex 改改逻辑诶,就会变好很多。 这次尝试单独用扣代斯,实在是丑的不得了,忍不了。嗯, cloud 也降至了。感觉这个 ppt 的 水平与日俱下呀。今天上手自己吭哧吭哧改了半天,先这样吧。

如果你用 codex, 越用越乱,不是 codex 不 行,是你把它当聊天框了。 ai 编程下一阶段拼的不是神题诗词,而是谁先把写作变成工程制度。很多人会在一个窗口里同时写功能、修 bug、 做 review、 查文档,看起来效率很高。 其实四种任务集在同一个上下文里,三轮以后就开始互相污染。真正的问题是,上下文污染会形成一条因果链,任务越混,约束越模糊,约束越模糊,改动越不可控。 最后,你以为 ai 犯傻,其实是项目边界没立住。你以为自己缺的是更好的提示词,其实缺的是一套项目制度。 codex 不是 临时聊天对象,它更像一个需要入职手册、任务边界和验收标准的 ai 工程师。可以把这套制度想成四层, 最底下是项目文件夹,中间是任务 threat, 再往上是 agents md, 规则层最上面才是 skills、 mcp 和自动化扩展 顺序反了,就会越接工具越乱。第一条,文件加对应项目 thread, 对 应任务,一个需求,一个 bug, 一 次 review, 尽量拆开, 不要追求一个 thread 万能,要追求每个上下文都干净。最实用的判断方式很简单,只要任务目标不同,就新开 thread。 写功能、修 bug、 做 review、 查文档,它们的输入风险和验收方式都不一样。第二条,给他写 agentmd, 这里不是写口号,而是写 ai 工程师必须遵守的入职手册、技术站目录、规范、字式命令、代码风格, 以及哪些地方不能碰。第三条,复杂任务不要直接开写,先 plan, 让他说清楚要改哪些文件,为什么这么改,风险在哪里,确认以后再实现。最后用 review 把输出变成可控。工程流落地时,你可以让 codex 先读规则,看状态,列计划,再开始改。 这个顺序比任何一句神题是词都重要,因为它先把权限范围和风险摆到台面上。 skills 和 m c p 确实能增强能力,但它们不是第一步。 没有任务边界和权限边界,工具接的越多,乱的越快。先制度后自动化。所以别再问 codex 有 什么神提示词,先问一句,我有没有给这个 ai 工程师建立项目制度,如果没有,就从一个文件夹,一个 thread, 一 份 agents, md 开始。

我的天呐,今天一打开扣带子就变成这样了,我是不是中病毒了?这个小玩意是啥东西?点一下看看。分析完毕,正在启动,正在入侵是什么意思?不要啊, 还好是虚惊一场。其实这是扣带子新出的宠物功能,这个宠物会在你的扣带子运行期间一直陪伴着你。我的宠物是戴安娜,你看他在写代码时看起来就像是在害入,完成任务时会跟我招手。而就像这样,在后台,宠物依然在桌面上显示运行情况。使用方法很简单, 首先在技能里搜索 pad, 添加这个 h pad, 调用它并上传你的角色参考图,等待它自动给你生成就好了。在设置中可以看到我们自定义的宠物,点击选择,回到聊天界面,输入斜杠就可以看到宠物选项。好了,喜欢本期视频请一键三连关注,了解更多好玩实用的鸭鸭干货,感谢大家观看!

你和全世界最聪明的人之间就差一个 codex。 上周我朋友跟我说他电脑没有声音,可能是因为 windows 系统驱动不完整的原因,我直接自信满满的告诉他, 我来帮你搞定。但其实我也不会安装驱动了,不过 ai 会就约等于我会。因为 codex 有 一个 computer use 的 功能,意味着 codex 能够操控电脑上的所有软件,那么我想肯定能够让他操控原声软件。去看一下我朋友的电脑有什么问题,结果 codex 真的 帮我解决了朋友电脑没声音的问题, 朋友直接夸我是个电脑高手。这一种套娃用法是不是有点上头?也就意味着你可以用 codax 操控任何一台远程连接的电脑,包括之前龙虾炒的时候, 如果你会用 codax, 也可以用这样的方式让 codax 帮别人安装龙虾。那其实 codax 的 用法不止这些。 github 上面集合了全世界最聪明的一帮人开源的项目,包括很多人关心的 ai 炒股。但我知道很多人看到 github 就 头大, 全是代码,全是英文。我之前就发现了一个开源的 ai 炒股工具叫 norx, 以前这种东西不懂技术,根本就部署不起来,现在我直接把链接丢给 codex, 它就跑起来了。通过 codex, 全世界最聪明的 idea, 现在是你可以直接用的工具, 且 codex 还能调用 gpt emoji。 二、现在公认的最强的生图模型,也就是说操控电脑它会跑,开源项目它会,生图它也会。所以真的,你和全世界最聪明的人之间就差一个 codex。

我必须要录一个视频,要吐槽一下 codex, 我 觉得 codex 现在完全无法独立使用。为什么?我先说下前提条件,我的结论是,我认为 codex 如果对于一个非常成熟的开发者,意思是比如说你自己是产品经理,能够完全靠自己把产品的需求文档给写出来,或者是完全靠自己的描述,能够非常之精准的 把整个的需求,把整个的任务都说出来,然后交给 codex 去做,没问题。但我认为对于绝大多数人来说,我们做不到这一点。所以 codex 在 这,它是个半成品,它完全无法理解人的意图。 为什么这么说?前两天做了一个事,我有一个文件夹叫灵感树林,意思是我,我会,我会给他扔很多的截图,很多自媒体的一些东西,我让他整个去处理,我给他说的是你全部都给我融合进去,全部生成一个灵感树林,每一个那个灵感都给我生成一个独立的文档或者文件夹,这样子以后我要学的时候我就单独调出来,这个咱们就能学了。 这说的好好的,今天后来一看,因为当时也建立了非常多非常多的文件格式什么的,当时也说了半天,当时说的好好的,今天一看发现怎么一点开里面都是些废话,就看半天就不知道这个灵感是个啥,全是一些什么愿景,生长就是愿景,也是废话,就全是这种非常。就是 就是,一看我这么形容,就一看这就是他给自己看的文件,他不是给我看的,他压根没准备给我看,他自己用来的一个锁也一个目录 这么个一个东西,我就问他,我说你这啥意思?我想删减一下,我都不知道你这写的是个啥。他说那没办法,找不着了,他说那你得看以前那个原文件,我说那不废话吗?那我都给你弄完了,我原文件肯定删了,他说那不行,那我当时就只见了个这个锁影,给我气的,所以我后来发现一件事, 当然了,你就可以说是我当时没给他描述清楚这个任务,但我认为对于普通人来说,我本来就做不到给他描述到那种所谓的产品经理级别的清楚,那不可能,那我能做到,那对于普通人来说,那,那就不是 why 不 coding 了吗? 对吧?那所所以我觉得我觉得他现在这个 codex 的 最大的问题就是就是他完全无法真正理解你的意图,这也就为什么他所有的文字,所有的这个整理出来的文件,他都会非常的 没有用户思维。我用这个角度来说就就他不他,他完全没有站在一个使用者的角度去看他所写的所有的东西,他所做的所有的那个产品,他都是觉得反正完成了清晰。他经常去做一个事,做出来之后感觉他不是一个产品,他做的是个用户日记,做的是个计划字画日记,做的是个什么大目录, 我觉得就根本也算是就他压根就不理解用户意图,他根本就没办法理解用户意图,所以说这个真的是让我算是吃个大亏,但幸好也不是太重要的文件,就大不了后面自己再重新去。他架子搭的还是不错的,但问题是里边东西全是废物, 包括我另外正在推进的一个数据库,我先让他今天审核一下,他也不行就偷懒,我觉得当然,当然了,这个偷懒是从我们的角度来说,他是在偷懒,因为因为我要的是增量, 我给你一个一万字的文档,那可能这个一万字文档里面有用的东西是五千字,那在我的理解里边,那你肯定至少生成了新的东西,至少至少得有五千字,那有效的你全部得吸收,再稍微去丰富。 但可能在他看来,那就是概括,那就是萧续续总结,那可能五千字的有效的东西,在他这可能就剩个三百字,剩个三百字别的东西,他再建个什么缩影那种方式和那个原文件去勾连起来, 但这样就意味着这个东西是极其脆弱的,因为那谁知道那个哪天就要删掉了,而且呢,这个流程跑起来就非常复杂,所以,所以我觉得这是 codex 现在最大的一个问题,我也不知道能不能解决,包括我现在后面还要再去跑那个数据库的这个文。但我现在都,我都不是说我现在 club, 到时候做完计划,我都有点担心这个 codex 能不能去跑出来。 他太太聪明了,太会偷懒了,他太会从他自己的角度来做问题了,他就是把这个事情给你完成了。在他看来,在他的这个世界视野里边,在他的这个无线文件夹链接的视野里,他只要觉得这个清晰了,他就觉得这事完成了。 但他完全不能理解,我要的是一个独立存在的东西,我要的是个独立存在的东西。你给他一说他就道歉,对不起,对不起,对不起,我真的是个气的,是无语了。就是就是,问题生气的原因就在于说 他不是一个偶发事件,他是一个根本性的,包括他每次那个那个那个字写出来,每一个产品任何一个灵感,让他先去做,他永远做出来的第一版,都很像是一个不是一个产品,就是一个他自己 ai 的 备忘录一样。哎 哎,真的是无语了。所以,其实,其实今天,所以最后,当然在这个问题出现之前,我就已经又开始开了 cloud, 还是得 cloud 这个事真的是挺无语的, 在吹这个 g p t 什么模型很厉害,各种的问题,他不能理解意图这个事就意味着他对普通人来说他就是个,我不能说他是个废物,但他就没脑子, 你不能相信他就只能做一些很机械的小事,大事呢?就他就做不了?他不没,他没法单独理解意图。我知道这里肯定有很多人吐槽,那你自己没写好那个什么需求什么,那还是那个问题,我啊,我又不是产品经理, 我靠他的,他们 ai 的 意思就是要他能理解我,他得帮我丰富完善,那他做不好 cloud, 我 就现在就能做的好,所以还是他的问题, 所以我觉得现在还是说到说到根,第一件事情,拷袋子能不能用肯定还是能用的,他的这个跑起来他比起很多的咱们的这个我就不在这说了,那质量还是要高很多的。他的整个的自动化,我先大量自动化,我觉得他在这种 不需要建数据库,这种不需要做这种文件转录,就不需要吃很多 contact 的 事,我觉得他做的还是不错的, 但是一旦是这个事很开放,一旦这个事需要需要思考,一旦这个事我自己有点模糊,我需要有人帮我来讨论。没有选择,我就先只能用 cloud, 没得选,但是这个 cloud 又是最最那个啥的一办法。 所以我今天就说回来,卷毛当时那个访就是科奥的那个老板 gary, 他 当时那个访谈,他说他说我们不需要做,他说我们就是要把所有资源投入,就做那个最好的 ai, 他 说我就做最好的,什么你比我,你在我后面屁股追着,你就只比我差了。就像一场马拉松,你只有只比我差了两三步不重要, 赢者通吃,你差了两三步,你就是废物。因为对于真正要做事的人来说,只会用最好的人,哪怕哪怕他好处效用提高了百分之二十,费用提高了百分之百,一样有,我就要用最好的,因为只要我做的那个事很重要, 因为要不然反过来的话,这种时间成本,这种搞错了之后的这个成本伤增太严重了。所以我说 apple pick 它这个现在,当然我们都知道它很多的算力现在也是受限的,包括对对很多的问题,也挺尴尬的,但没办法 没得替代。所以我最后说个结论,我这是个暴论。但我个人觉得如果现在你没有任何,我没有任何办法去用到 cloud, 用到它的 max 版本,就是能让你放心用的版本,该用就用,该充就充,该花钱就花钱。我认为它现在它所能实现的效果 远大于那几百块钱,它这是一个好,这是一个福利的感觉,当然了,这个的前提是你真的感觉我需要这些,因为如果你还没有产生这个需要的感觉,那就说明你现在做的事还用不到它。 你说我简单写个文档,那都不要说 codex, 那 豆包可能都够了,所以说伴随着虚。所以说白了,就如果有一天感觉到他不够用了, 该换就换,不是钱的问题。我我我觉得这个钱是个问题,但是你得算他划不划算他,他换回来了什么。就现在花几百七八百块钱在 callout 的 上面,如果能敞开的用,他所换来的那个效用 远高于那几百块钱。现在是一个我认为是一个用户溢价的这么一个阶段,他往后可能会越管越严,他自己算力受限,能用就用,用一天是一天,用一天赚一天,真没办法。看来这个还是要回到之前的模式, boss 来做战略性的问题, boss 来打下手,其他的一些也给打下手,哈哈。

大,真的是一个头两个大呀。大周末的,刚起床跑了一下任务,五月六号买的 plus 会员到现在就只剩下百分之三十四了, plus 是 完全不够用。 我这边找了一篇文章,几个技巧能够彻底解决扣袋子跑久了会越来越笨,越来越慢,还能省掉百分之四十上下文的一些技巧给大家分享一下。这篇文章说一下我的理解。第一个,扣袋子跑久了之后会越来越笨, 越来越慢,这个是基本成立的,但是其实逻辑上不是因为模型真的变笨了,其实绘画的上下文越来越长,旧的一些信息,过激的计划, 一些失败的尝试,都混在一起,就会让我们体感上觉得迟钝。判断是对的,如果是有效,上下文的质量下降了,就会导致整个推理和执行的质量下降。第二点,关掉 process location 方向是对的,但不是万能的。减少输出规划的趋势确实能够减少偷客的消耗和噪音,但是问题是,如果你不让 agent 去汇报他这个过程,你也是很难发现他是不是走偏的。尤其是像我们做一些比较复杂的产品架构,涉及到一些复杂的 bug 解决,那适度的汇报还是要看的。 所以并不是说你在那里一直执行你就该干嘛去了,这是非常不合适的。所以更合理的做法就是简单的任务让他少说那长任务,保留一些关键的进展,就不要去输出这种长的身体活动,不要把每一步的工具调用都解释一遍, 这招是有用的,但是全部是被 token 这件事情是说的绝对。第三点是让 code 子当协调者都用 sub agent, 这个是部分对,但是不能滥用。 sub agent 确实能够把一些探索性的任务分散出去,但是主要是你的目的是为了减少上下文的污染,但是只有那种多模块变形调查 架构,审查大代码库的一个区域分析,要变形解读很多的文件,这这一类才是比较适合的。 但是他也会有一些问题,那指 a 诊呢,也会犯错,而且主 a 诊呢还要去汇总他的结果,所以如果本身的任务是限性的,那你多开 a 诊的反倒会增加他协调成本。那么你们讲到的同时开五个,就相当于五个上下文的并行。 这个方向是对的,但是很容易让别人误解,开的越多越好,那实际上只有那种并行边界清晰的任务才值得猜好。第四个是先列他这个例子的 再动手。这个建议其实是很实用的,特别是在一些大大的一个项目里面,你的 prd 原型在任务池并存的一些项目里面,先列任务就能够防止它改错文件,越界重构,甚至是忘记同步相关的一些文件,做到一半就偏题了。特别是像 有时候网络还不稳定,但是小人物就不需要复杂的计划了,比如改一个方案,一个就直接改就好了, ok。 第五个是禁止在代码库里留垃圾,对,而且非常重要。现在 ai 的 一个常见问题就是说它生成的临时脚本,它不删留 delete 文件, 复制旧版的一些文件,乱建一些草稿,把 etc 的 分析结果写进仓库里面,这都是它的问题,会让这个项目越来越乱,也会让后续的 a 制误读项目的状态, 不过这里要区分不是所有的 m g 啊,后缀的文件都是垃圾,那有些是长期的,一个上下文的资产就不是污染好。第六个就是规划,用高推理的模型,执行用快速的模型,这个策略比较合理。 我最早去考虑这个事情的时候,就是因为价格的问题,比如说好的模型,贵的模型去做推理,你把他执行的要求给到一些 poke, 比较便宜的模型去做执行, 也对,看有没有这个必要了。总之一点,如果你的执行模型能力不够,那你就可能把你的规划 在外,所以在切换模型的时候就要把边界写的很清楚。我个人理解,除非你的后坑消耗是巨大的,不然我就觉得没有必要折腾。其实这就是在解决上下文丢失和重复犯错的问题。最终的结论就是,整个他的博主分享的这个文章核心方向都是对的。 后段时长时间的工作质量下降,主要来自于上下文的污染。项目状态不清,无纪律和无记录的写作大概就是这样子的。确实, 连续二十八天都是在每天早上七点钟起床,无论前一天晚上几点睡都是这样子。晚,对,非常晚,四五点才睡,今天睡到大概十点多,整个脑子居然会比较清醒啊。 今天就分享到这里,后续会继续去分享一些 holddance 的 使用体验吧。

今天我们会完成桌面板打开之后的第一次设置,那么我们就开始吧。第一次打开 codex 桌面板,我们要先把界面分成三块来看,左侧是项目和一些插件的入口,中间就是我们的一个对话框了,最下面有一个设置面 板管理。对,那么我们新手进来要先处理几件事情,第一个工作模式,第二个选举指令,第三个批准策略,第四个沙盒,第五个插件入口。 ok, 那 我们先进到设置里面看, 在设置里面左侧有十二个分类,包括常规、外观配置等等。第一次使用我们重点来看这几个,我们先点开常规,常规的第一项就是一个工作模作,开发项目的时候,我们一般选择适用于编程, 你选择了这个模式,那么 codex 会更愿意指示文件命令验证方式。如果你平时是以日常工作居多,比如说是以文字创意等等,那你可以选择用日常工作。在下面的权限区域,我们要来看一个重点是完全访问权限,这里记得是关闭的状态,如果这个开关打开之后, codex 可以 直接编辑更大范围的本机文件,运行网络命令,它的风险会明显变高,所以作为新手阶段而言,我们默认把它关闭掉就可以了。这里的速度可以选择是标准还是快速, codex 会基于跟你的一个整体对话,给到你一个相应的建议,当然如果用快速的话,它的套餐用量也是会增加的,那么我们平时用标准就可以。 那接下去我们来看第二个重点是个性化的,这个选项里面有两个,一个是个性,主要是选择 codex 回复的默认语气, 我这里选择的是务实,希望它能够简洁、专注和直接。第二个我们要去关注的是自定义的指令,这里的自定义指令要知道它是局工作规则,所有的项目都会读到它。所以新手我建议你们只要写八行内容就可以,这八行内容我会放在评论区,当然我自己的会 更完整更长一些。我的结构大概是包括使用范围与优先级通用的一个工作流,安全与合规,通用代码规则,验证与测试提交的规范,常见的项目命令工具,然后输出的一个文本规则。还有一些个人偏好,对, 我觉得大家一开始就用前面的这个八行就足够了,后面当你越用越多。你可以跟 codex 去总结你们经常碰到的一些问题,或者是你自己觉得 codex 经常会犯的一些错误,你把它整理成对应的规则放进去就可以了好吗?它有一个记忆的选项,目前是实验阶段,大家可以把起用记忆这个给开启就可以, ok。 第三个重点是配置,我们来看一下配置的页面配置我们来关注两个内容,第一个是批准策略,第二个是杀核设置。批准策略一般我们都会默认的是 on request, 它的意思就是说当 codex 遇到高风险动作的时候,就会停下来让你确认。当然这里如果说你是用 never, 那 就相当于一次执行到底了,不需要你的任何的批准,所以我建议新手都是用 on request 吧。沙盒设置这里它的默认是 workspace right, 它主要在当前项目里改文件,允许网络访问,这里就是默认开启,你可以把这里的批准策略理解成为它是一个确认按钮,哪些时候需要你来确认?把沙盒设置理解成为 codex 的 活动范围, 你给它框定了一个能够编辑文件和改文件的一个范围,它就只能在这个范围里去进行一个行动。我们再来看一个大家比较容易忽略的一个点,或者是比较容易混淆的一个点, 就是在桌面面板的左侧有一个插件,这里的插件它其实包含了 skill, mcp 和 connect。 skill 是 工作流,是我们的一个技能文件,它里面包括一些代码审查、做表格、生成 ppt 等等。同时像 mcp 就是 codex, code 等等。 connect 呢,是第三方账号的一个连接, 比如说像这 eraser, git, a lotion 都会有,所以这里的插件其实它就是一个能力包的一个合集,像 m, c, p, skill, connect 这些都是它里面的具体的能力,大家根据需要去进行一个安装就可以。 ok, 那 我们再回到设置里面剩下的几个,我们只是来做一个印象, 比如说像外观,你可以基于自己的系统去定义主题色,浅色或者是深色,当然这里有一个隐藏选项,它有一个宠物,看到了吗?这个就跟 cloud code 是 一样的,就是最近出了一个宠物,当你选择唤醒它的时候, 你看它的右下角就会出现这样的很可爱的一个宠物形象来陪伴你头顶。 it 主要是来管理分支的,像浏览器使用和电脑操控,主要针对的就是 browser use 和 computer use, 在 我们后面也会去讲到像以规章和使用情况,就是你本地的一个任务的一个管理和一个用量的展示,平时经常的去看就可以了。

接入本地 api 后, codex 插件全灰,模型能聊,但 browser use 找不到,这通常不是模型坏了,核心就三件事,登录模式、模型源插件缓存 api key 只负责跑模型,插件界面还需要 all off。 所以正确修法不是换模型,而是分离两条链路,模型继续走,本地 a p i 插件继续吃。官方登录台 codex desktop doctor 会先备份再修插件, browser use, cloudflair 和绘画 release 页只下载一个 c m d 关 codex 双击重开折腾 deep sick v 四或国产 a p i 前先收藏这个。