这些 codex 做的苹果风格动画,插进视频或者 ppt 中会瞬间显得高级很多,这期你看完,你也会做这样的动画。先给不了解的朋友们说一句, codex 是 open ai 开发的 ai 智能体,做 ppt、 剪辑视频、做动画都能搞定, 只要你有 g p d 账号,你就能免费使用它。核心就是一套三段式提示词,第一段你想要什么样的内容,比如悬浮的 app 图标。第二段,动画效果和时长。第三段,预留一个设置面板,这个很关键,后期想改细节,直接在面板中就能搞定,不用再重新生成。 发出去之后, codex 会自动渲染,每一步都会和你的提示词进行校准,动画生成好了直接导入下载就能使用。如果你想改细节的话,点开链接,进入设置面板右下角点击渲染界面,看着很复杂,其实你只需要关注三个地方。 视频选项中, codex 选择 prores, 代表高质量无压缩,方便后期剪辑。 from range 选择你需要的时长, 像素格式选择透明背景,不需要透明的你就选其他的,剩下的全部默认就行了。调完再渲染一次,新的视频就出来了。这是 ai 信息差的第八期,下一期我将带你用 codex 复刻,更炸裂的剪辑效果不见不散哦!
粉丝9.0万获赞59.6万

如果你想更好地使用 codex, 第一步不是多写指令,而是把它当做一个会读代码、会动手,也需要上下文的协助。工程师给 codex 的 任务最好包含四件事,目标、成功、标准、约束以及你希望他不要碰的边界。 不要只说修一下,而是说修复登录后跳转错误,通过现有测试,不重构健全模块。第二步,给足上下文, 指出相关文件、附件步骤、报错信息、设计稿、接口文档,或者你已经试过但失败的方法。上下文越清楚, codex 越少猜。第三步,让他先侦查 复杂任务,可以要求他先阅读代码,列出计划、标出风险,再开始改,这样你能在真正写代码之前就纠正方向。 第四步,小步快跑,把大需求拆成可验证的小任务,先修一个 bug, 再补测试,再优化界面。每一步都让 codex 解释改动并看一眼 diff。 第五步,建立验证闭环, 让 codex 运行测试 linked 类型检查前端任务,还要打开页面或截图检查,没有验证的完成,通常只是代码写完了。 第六步,管理安全边界,不要把密钥、私人数据或生产凭证直接贴近提示, 涉及删除文件、改数据库发布。提交代码时,让 codex 先说明影响再执行。 更高阶的用法是把 codex 当做持续协作者,维护 agents、 md 记录项目、命令风格、测试方式和禁区。把 issue、 日制和期望结果写清楚,让他在每次结束时留下可附用的下一步。一句话总结好提示,不是命令更长, 而是上下文更准,边界更清、反馈更快。你给 codex 一个清晰的工作现场,它就能交付更可靠的工程结果。


大,真的是一个头两个大呀。大周末的,刚起床跑了一下任务,五月六号买的 plus 会员到现在就只剩下百分之三十四了, plus 是 完全不够用。 我这边找了一篇文章,几个技巧能够彻底解决扣袋子跑久了会越来越笨,越来越慢,还能省掉百分之四十上下文的一些技巧给大家分享一下。这篇文章说一下我的理解。第一个,扣袋子跑久了之后会越来越笨, 越来越慢,这个是基本成立的,但是其实逻辑上不是因为模型真的变笨了,其实绘画的上下文越来越长,旧的一些信息,过激的计划, 一些失败的尝试,都混在一起,就会让我们体感上觉得迟钝。判断是对的,如果是有效,上下文的质量下降了,就会导致整个推理和执行的质量下降。第二点,关掉 process location 方向是对的,但不是万能的。减少输出规划的趋势确实能够减少偷客的消耗和噪音,但是问题是,如果你不让 agent 去汇报他这个过程,你也是很难发现他是不是走偏的。尤其是像我们做一些比较复杂的产品架构,涉及到一些复杂的 bug 解决,那适度的汇报还是要看的。 所以并不是说你在那里一直执行你就该干嘛去了,这是非常不合适的。所以更合理的做法就是简单的任务让他少说那长任务,保留一些关键的进展,就不要去输出这种长的身体活动,不要把每一步的工具调用都解释一遍, 这招是有用的,但是全部是被 token 这件事情是说的绝对。第三点是让 code 子当协调者都用 sub agent, 这个是部分对,但是不能滥用。 sub agent 确实能够把一些探索性的任务分散出去,但是主要是你的目的是为了减少上下文的污染,但是只有那种多模块变形调查 架构,审查大代码库的一个区域分析,要变形解读很多的文件,这这一类才是比较适合的。 但是他也会有一些问题,那指 a 诊呢,也会犯错,而且主 a 诊呢还要去汇总他的结果,所以如果本身的任务是限性的,那你多开 a 诊的反倒会增加他协调成本。那么你们讲到的同时开五个,就相当于五个上下文的并行。 这个方向是对的,但是很容易让别人误解,开的越多越好,那实际上只有那种并行边界清晰的任务才值得猜好。第四个是先列他这个例子的 再动手。这个建议其实是很实用的,特别是在一些大大的一个项目里面,你的 prd 原型在任务池并存的一些项目里面,先列任务就能够防止它改错文件,越界重构,甚至是忘记同步相关的一些文件,做到一半就偏题了。特别是像 有时候网络还不稳定,但是小人物就不需要复杂的计划了,比如改一个方案,一个就直接改就好了, ok。 第五个是禁止在代码库里留垃圾,对,而且非常重要。现在 ai 的 一个常见问题就是说它生成的临时脚本,它不删留 delete 文件, 复制旧版的一些文件,乱建一些草稿,把 etc 的 分析结果写进仓库里面,这都是它的问题,会让这个项目越来越乱,也会让后续的 a 制误读项目的状态, 不过这里要区分不是所有的 m g 啊,后缀的文件都是垃圾,那有些是长期的,一个上下文的资产就不是污染好。第六个就是规划,用高推理的模型,执行用快速的模型,这个策略比较合理。 我最早去考虑这个事情的时候,就是因为价格的问题,比如说好的模型,贵的模型去做推理,你把他执行的要求给到一些 poke, 比较便宜的模型去做执行, 也对,看有没有这个必要了。总之一点,如果你的执行模型能力不够,那你就可能把你的规划 在外,所以在切换模型的时候就要把边界写的很清楚。我个人理解,除非你的后坑消耗是巨大的,不然我就觉得没有必要折腾。其实这就是在解决上下文丢失和重复犯错的问题。最终的结论就是,整个他的博主分享的这个文章核心方向都是对的。 后段时长时间的工作质量下降,主要来自于上下文的污染。项目状态不清,无纪律和无记录的写作大概就是这样子的。确实, 连续二十八天都是在每天早上七点钟起床,无论前一天晚上几点睡都是这样子。晚,对,非常晚,四五点才睡,今天睡到大概十点多,整个脑子居然会比较清醒啊。 今天就分享到这里,后续会继续去分享一些 holddance 的 使用体验吧。

经常用 cloud code 或者 codex 这类 coding agent 的 朋友,应该都会挺关心 token 消耗和上下文管理这两件事情,但我发现哪怕用了一段时间的人,对于让 agent 做什么事情会消耗 token 这件事认知偏差还是挺大的。所以今天这条视频就给大家讲清楚两个事情,第一个是 token 和上下文 context 到底是什么意思。 第二个也是最重要的,让 agent 做什么事情是会消耗 token 的, 而哪些其实根本就不消耗,也不占用上下文。刚好 cloud code 的 官方其实做了这样一个特别直观的交互式的界面,把你从打开 cloud code 跟它进行多轮对话的整个过程中,它的 上下文是如何累积的,然后每条指令它消耗多少 token 全都非常清晰地画了出来。下面我们就顺着这个界面把这件事情讲明 来。首先就是在我们输入第一条消息之前, agent 它的上下文里面其实就已经被装进去一堆东西了,这里就包括系统的提示词,这个是 histogram 官方写的用来约束 cloud code 行为的一些固定指令。然后是 memory 文件,是之前你看 cloud code 的 绘画里面 agent 自动记下来的一些 笔记和记忆。然后第三个就是环境信息,包括当前的目录、操作系统 get 状态这些,还有 m c p, 还有就是我们非常熟悉的 skill, 还有 cloud 点 m d 这些 map down 文件, 这些都是固定成本,只要你打开一个 cloud 的 绘画,哪怕你一个字都还没有说,这些出土化的上下文就已经加载好了。那从我们发送第一条消息开始,托管是怎么一步步消耗的?这件事情我们站在 agent 的 工作流程的角度来看,就会特别的清楚,你 输入一个任务, agent 会首先理解你的指令,你的提示词本身就成了上下文的一部分,然后他会,然后他会触发绿的命令去读上下文的一些文件,读完他可能会做一些思考,思考完之后可能又会调用一些工具去读一些新的文件,或者跑一些命令去拿输出, 然后再基于得到的结果继续去做思考,这样进行反复多轮,最终他判断任务完成的差不多了,需要你的介入了,就会给你输出一条摘药返回给 给你。把这个流程总结一下,其实 agent 在 你输入完之后干活的其实就这四件事情,第一个就是去读你项目里面的一些文件,第二个去跑一些命令 或者执行一些工具来拿到一些对应的输出,第三个是进行一些思考和推理,第四步就是把摘要总结输出给你,这四件事情产生的所有的内容都会消耗 token, 然后进入到 agent 的 上下文里面。 那么讲到这里有两个事情是我觉得新手比较容易去误解或者搞混的点,这里需要重点去讲一下。首先第一个点就是跑命令本身是不消耗 token 的, 举个例子,你让 agent 把一条两个小时的音频转成文字,或者让他跑爬虫去抓取各个社交媒体上的数据,只要你有现成的脚本或者写好的 skill 让他去执行。这个执行过程中用的是你电脑的算力, agent 本身并没有去参与,所以这个过程哪怕很复杂,跑了一两个小时才跑出一个结果,也不消耗任何的 token。 只有当这个脚本命令执行完之后, agent 真正开始要去读这份结果文件,比如说你让他翻译这份文字稿,或者是基于爬虫的数据去提取观点等等,他必须读完这个原始内容才能开始干活,这个时候才会真正地去消耗 toker。 单纯的脚本执行过程中,无论跑了多久,他都是零 toker 消耗的。 toker 消耗只发生在 a 件的, 去读你的执行日制或者结果,这是我觉得新手最容易搞错的地方。那第二个点就是说,我们去在任务过程中去挤起用子代理的一个情况下,也就是 sub agent 子代理他执行的过程中,我们可以看到他本身是会消耗各种 token 的, 但他消耗的 token 是 累积在子代理自己独立的上下文里面的,不会污染到我们这个主体制。等子代理只是读到这样一份招标文件是消耗 token 的, 所 所以此代理是一种隔离消耗的方式,你让他干一堆需要读大量内容的活,但是主代理的上下文并不会因此受到污染。总结来看,我觉得官方的这个交互式页面真的非常的直观,浅显易懂。如果你对于 cloud code 的 上下文机制还不是特 特别清楚,我非常强烈建议大家去这个页面玩一下,你能够非常清晰的看到 agent 的 上下文是怎么加载的,然后 token 是 在哪些环节去消耗的。有了这个直观感受之后,以后你跟 agent 的 对话,让他干活的时候,就能比较准确的判断哪些事情真的会在消耗你的 token, 而哪些事情看起来可能很复杂,但因为只是脚本 或者命令在跑,其实根本不会消耗多少 token。 ok, 这期视频就讲到这里,如果大家觉得有帮助的话,帮我点个赞,我们下期再见!

你的 codex 压缩上下文的时候是不是经常卡死?教你一招,用五点三来压缩,然后再切回五点五, ok。

啊,出一个 codex 如何进入 deepsea v 四 pro 的 最简单的教程啊?首先首先是在这个网上下载啊,下载自己电脑对应的版本就可以了,把这个下载下来之后,有一个这个,这个装上就可以了,然后需要第二个工具, 第二个就是需要下载一个这个 cc switch, 这个下载之后呢,还需要先把它下载下来啊,还需要另外一个东西,还有另外一个东西,主播写了一个中转的一个一个工具,因为这里面是不能 codex, 是 不能直接用, 不能直接接入 deepstack 的, 然后需要写一个中转的服务,然后在这写了个中转的服务,大家能看到这个地址吧? 这地址要说呢,这是 get 它的一个地址啊,然后就可以把这个把它克隆下来,克隆下来直接 n p m initial, 然后再 n p m 是 大,然后就运行起来了,运行起来之后,然后再回到这个 c c c 位区里边, c c c 位区里边,第一个是客户的,这个先不用管,然后进入这个,第二个,这个这个拆的 g p t 这个, 然后进去这个里边呢?然后点一定要先选中这个,然后再点这个加号,再点这个加号,你主播已经添加了,然后和这是一样的,然后这个里边这个自定义的名字啊,这个这个贴什么都可以,这都不贴,不贴这个屁,随便贴一个这个,这个没有什么用啊,然后然后就这这个地址,这这个地址 就是刚才刚才 github 上边这个项目,这个项目的里面运行起来的地址啊,就贴这个,因为它运行起来就是这个,就是个端口啊,就贴这个,然后这模型名字我们就写的这个 vise pro。 好, 下面把这个勾上, 然后然后这里边有一个内幕啊,往下滑,这有个内幕,内幕这个地方,这个地方的名字是可以自定义的啊,它显示的是在这显示出来的,你希望他让他显示 dsp 和 vga pro, 那 你就把它改一下,如果你这显示成 d s, 那 这个地方就会显示 d s, 那这就好了,把这个弄过去之后,然后点这儿让它启动,让它启动,这样就好了,这个这个它就把它可以关掉,它就常驻在后台就可以了。然后这个时候我们可以看一下啊,这手机这个,然后这儿我问他,你是什么模型, 对吧?他说他是 tiffany 版本,是 vsco 版本,是 vsco, 对 吧? 然后是什么什么什么他可以干什么,对吧?这个就是完全大好,大家可以点点关注啊,到主页加咱们的技术交流的粉丝群在里边,可以有什么问题啊?可以提出来,然后咱们可以一起交流讨论。

好,大家好,我是小刘。呃,今天我们一起来聊一下在 codex 中上下文管理的一些技巧,那这里呢,我会讲我平时在使用 codex 当中,我是怎样进行上下文管理的。那我们先说一下背景, 什么上下文管理呢?就是我们知道我们在一次对话的过程当中,它的绘画窗口是有限的,可以看到这里是共二百五十八 k, 那 已经使用了三十二 k, 当这个上下文满的时候呢,扣代码,它会自动的压缩这个背景,这样呢我们的这个整个上下文会失真。什么是压缩背景呢?比如说猫和老鼠四个字,那就是我们绘画的主要内容,他会把它压缩一下变成猫老鼠,你看是不是压缩了,对不对? 但这样就会产生一个通病,就是产生 ai 幻觉,那也就是我们的功能开发会越用越不好用,你会发现你跟他说一个点,他就是不明白,然后呢会导致我们很崩溃。 那我们来看一下这个网友是怎么解决的,然后我再讲我自己的方案,他的方案就非常的简洁易懂,就我们都知道每一次对话呢,它会产生一个绘画的 id, 那 我们这次绘画它是存储到我们本地内存当中或者数据当中,这时候我们可以选择复制这绘画 id, 那 这个绘画 id 呢?本身上是一堆的这种字母,就我们扣带子可以根据这个字母找到我们当前上下我们所有对话, 他拿到绘画呢,可能是压缩库的,可能是不准确的,所以呢他就遇到了这个情况,他就把他哎复制到一个新的窗口当中,比如说新对话,这时候你看跟他说对吧?请你帮我进行这个功能继续开发是不是?那这个时候是不是就拿到了我们的青山崖纹?这个也可以,只是说开发的时候,那他需要去浪费更多的图层,因为他需要加载数据库,加一个内存,对吧? 好,首先我先说一下我的方案,就是这里呢,我会回顾一个上下文的文档,进行定期的总结。举个例子,比如说像这个绘画呢,他都满了,那我就跟他说,请你帮我根据当前这一次的绘画呢进行总结出一个 markdown 文件,这个 markdown 文件呢是包含了这一次的一些所有的关键信息,那你可以看我思路这样的,请你帮助我, 请你总结当前项目的关键决策已经完成的部分和代办事项,便于我下次听话加的一定要加这句话,如果说你不加这句话,他给你的可能就是一个总结性的文档,如果说你加这句话的话,他会按照 call 代词能够处理的绘画格式给你一个哎,一个合理的 bug 档,所以就相当于固定的一个格式给他。那如果说,哎,我这时候跟他说这句话对不对? 尽量用五点五模型,用最好的模型实现的效果可能是最好的。然后你比如说用五点五超高你发送一下,那这时候呢,他就会根据你当前的这个项目进行总结一个 bug 大 文件,那收下一次开启的时候呢,你就可以把这个 bug 大 文件哎给他 就是丢进去,然后这个时候呢,他就可以直接的进行上一次上下文的复用,而且呢失真不会失的很严重,那最起码会比直接使用 codex 压缩的方式会好一点,那这是我的第一种方法。第二个呢,就是使用这 codex 内置的压缩功能呢,这个我刚刚说过了,对吧?我们 正常来说 codex 也会进行自动压缩,但是它会进行四帧,但是进阶技巧就是我们可以直接让 codex 呢,每次都生成这个 prompt, 就是 给它设定一个这个啊, ajax, ajax, markdown, 这种,对吧?让它自动生成,而不是让我们手动去指定它。 那这里呢,再分享一下我自己的这个 codex 技巧,因为有小伙伴他会问我说,你视频当中平时使用 codex, 那 我先说我怎么使用呢?首先我不会把一个项目 丢到一个上下绘画里面,一个上下文绘画里面我会把它拆成多个小的功能,在每一个小的功能对应一个绘画,这样呢,我这个绘画可以赞成很大,并且呢它总结出一个 markdown 文件,再把这个 markdown 文件丢给一个新的绘画,这样呢,我们就基于这个功能在进行优化,不会去影响整个的大局。啊,能懂我意思吧? 那第三种就是我们可以使用外部的持久化工具,那这个外部持久化工具有很多,比如像我们之前说的 context 上来说,就是把原先我们的 markdown 给它缔造了外部的这种 社区部里面去,你可以这么去理解,然后通过一些更好的方式去把它读取到这个 collect。 那 每一个开源项目都有自己的方式,大家可以自行研究,因为篇幅有限,所以我这里呢就讲这几种,好吧。 然后呢?呃,这种方式呢?其实我还是建议大家使用 bit 进行管理起来,因为当我们用 bit 进行管理起来之后,我们整个上下文呢,能够更加有链路的去回溯,就是每一个版本都有对应的回溯, 我们能够很清晰的看到,对吧?这是我们整个流程,你可以看到通过这样的方式,那就是像上下文的这个管理,好吧,这呢是。呃,好了,那以上就是本期视频的全部了呢,我是小刘,我们下期再见。

现在 code 可以 直接使用 dc v 四了, code 确实好用,但是额度真的是不经烧,随便几个问题直接就清空了,又得等五个小时。所以我试着把 dc v 四接进去,烧了四 e token 之后,发现操作竟然很丝滑,体验也完全不输原版,关键是真的大碗便宜, 后面我会带你一步步接好。其实步骤是非常简单的,就三样东西, c c 叉, d c 的 a p i, 还有 c c switch, 而且工具我都已经整理好,你照着我这几部点,基本几分钟就可以搞定。 解压后先打开 c c 叉的文档,然后打开 emv 文件,里面会有一个密钥,这里你可以保持默认,也可以自己去修改一个。改完之后记得先保存,然后启动 c c 叉,它会弹出一个终端,你找到这个管理界面的地址, 然后按住 ctrl 键再点击,就会来到这个页面。进去之后把刚才 e v m 里面的密钥粘进去,就能够进入到后台,这里你可以顺手切成中文就行,这部分就基本搞定了。接下来我们去到 d c 的 官网,点击 api 开发平台,第一次进来得先注册一下,然后点击左边的 api key, 新建一个 key, 名字可以随便填。创建完记得先保存好,因为它只会显示一次。然后回到 c c 叉上面,选择 code, 中间点击添加频道,这里就可以直接把这个文档粘进去。最下面把刚才复制的 a p i 粘进去,创建就算成功了。记得顺手做两个设置,一个是选一下 openchain, 另外一个是把规范化,非常健 打开。这一步搞定, d c 其实已经接近来了,然后打开 cc switch, 点击上面的这个标志,右边新增一个配置,具体的参数你可以按照这个来就好。这里有三点是需要注意一下, 首先,这里的 api key 不是 d c 的 那个,是一开始 emv 里面的那个密钥。第二点,点击一下这个获取模型列表,就不用自己手动去填写了。第三点,把 e m 上下文窗口勾上,这样子才能全力去跑,下面这些都不用管,填完之后直接点击保存, 然后点击启动,最后把 codex 安装或重启一下,到了这一步就已经接好了。打开之后, codex 这里不是显示 d c, 它只会显示自定义。别慌,这个时候你随便发一句话,先试试能不能是正常使用。然后直接去看看 cc switch 的 使用记录,你会看到模型这一栏已经变成了 d c v 四 pro, 来源是 codex, 那 说明已经是链接成功了,也就是说后台真正在跑的已经是 deepsea 了。最后我补两个词,已踩过的坑。第一个坑是 cc switch 最新的版本,现在有 bug 会连不上 codex, 所以 别手痒去更新,直接用包里面的版本就行。 第二个坑是 d c v 四没有视觉能力,所以一旦你平时有看图识图这类型的需求,进来之后可能会有部分的能力用不上。不过好消息是这套流程本身是通用的,你可以直接换成其他的多模态模型,思路也是一样的。我是木马,陪你一起玩 air 赛博达子,咱们下期见,拜拜!

好,我们一起来看一下 codex 呢,在五月八号进行了一次最近的更新,增加了一个昆姆扩展的插件,那这一次呢,我们一起来看一下这个插件和相比于其他的方式去操控昆姆有什么区别?好,我们直接点击这个电脑操控这里呢,大家可以看到这个会有存在一个 啊昆姆插件这么一个选项,就是我们点击管理可以看到增加了非常多的配置,比如说像权限历史记录下载上传,那这里呢提供了非常丰富的这种权限控制。嗯,我们可以通过 安装这个插件和 codex 呢进行建立关联,这时候可以看到我们的这个 codex 呢就连接上了当前这个浏览器,那出现了这一个绿色的图标,就说明我们的 codex 呢已经可以完全的托管这个浏览器了。那我觉得这是 codex 呢像全自动操控浏览器迈出的一步哦, 我就挺有趣的,所以今天给大家做一个分享。那如果你把这个开关打开之后呢,接下来呢我们就可以直接去操控了,但是你会发现一个小细节,就是如果你是在国内的环境下,你就直接点击这边去打开呃,安装插件的界面,你会发现这个商品并不能够安装,所以大家呃可以通过我提供的这么一个压缩包去进行补充这个 啊插件,好吧,呃,我们来往来看啊,首先我们来看一个很容易被大家混淆的东西就是,嗯,目前 codex 本身来说是有浏览器,那他操控浏览器和我们的这个插件有什么区别呢?比如说我们在这个 codex 中使用软件到一般是这边新建一个窗口,在侧边会有一个浏览器的选项,那其实这也是我们的第一步,就是我们的这个呃, in app browser, 这是我们的一种内置浏览器,它本身来说是用来调试的,用来开发的,所以和我们 这个插件更新是没有任何关系的,所以大家不要搞混了。那第二种呢?叫做 browse user, 这个是用来操控类似浏览器的,这是相当于前面的这个 in app browse 呢,又往前走了一步,比如说我们在这个设置这边呢,哎,去又往前走一步,这有一个,这个什么有一个啊? browse user, 它可以让呃我们 的 codex 呢去操控这个类似浏览器,去完成一些操作。好,那也就是第三种呢,就是我们刚刚现在讲这种叫 chrome browser, 它可以帮助我们进入真实浏览器状态,去操控我们整个浏览器。 那有小伙伴说了,那其实我的这个 pry white mcp 也可以操控浏览器,或者说我这种外置这个 computer user 也可以操控浏览器,那和这个有什么区别吗?而且区别很全面,对吧?呃,区别的话,呃 computer user 呢?它本身来说它并不是浏览器的插件,对吧?它是一个操控电脑的 g y 能力的 这种插件,比如说它可以通过你屏幕去操控你调出那些图形应用,就比如说我们现在常见的这种,呃剪辑应用,对吧?微信,对吧?它都可以操控,但是你如果单独的话去操控这个浏览器的话,显得并不那么智能,所以 codex 提供了一个新的能力,就是这个 codex com, 那 我们可以通过这个 codex com 去完整的操控我们整个浏览器。举个例子,比如说我现在想让他看到我们整个这个浏览器上有多少个标签页页,对吧?我们就问他,我说,哎,现在当前浏览器上有哪一些 这个标签页?比如说你看是吧?他可以告诉我们现在到底有哪些标签页,我又让他在第一个标签页输入 a, 第二个标签页输入 b, 也可以,我再让他把某一个标签页固定也可以,就能够做到很多之前做不到的一些事情 啊,分的更加的细了。那如果说你细心的话,你会发现,呃,这个插件它其实包含了很多细节的功能,比如说他通过这个插件和 codex 进行关联之后呢,就可以直接在 codex 里面去操控浏览器的所有权限,比如说审批,对吧? 比如说历史记录,你可以让他看到你今天到底有哪一些详细的记录,包括你上传哪些文件都可以使用它,比如说你允许上传哪些,允许下载哪些,都进行了完美的这种配置啊,对吧?非常的清晰。好,那接下来在最后我们想跟大家聊一下,就是为什么要使用这个呃,这个酷路亚 插件呢,对吧?为什么不直接使用 pro white 的 能力呢?其实很清晰啊, pro white 的 本身更像是一个外部的这种工具,而这个呃 这个 com 插件呢,是一个内置能力,如果说你使用这个的话,你会发现其实很多东西它都需要一步一步的去哎,去跟他讲,去分析,那它通过这些 m、 c、 p 的 能力去一个一个去提供。那如果浏览器更新了呢?它并不啊 同步更新,但如果是 codex 呢?它就同步更新的,它更像是一个完整的产品,对吧?也是 codex 官方提供的真实浏览器的一个执行通道。 而 pro y m c p 呢?它只是一套通用的浏览器自动化引擎,对吧?所以呢,你可以相当于它是一个小缩放。而这个,呃, codex 捆绑插件呢?还是更像是一个完整的企业级的真实软件的一个执行通道?它也可以通过现成去控制,并且呢,能够降低了很多我们调试的成本, 比如说我可以让它去帮助我去做一些自动化的事情,对吧?是吧?非常的方便。好了,那以上就是这几个的区别,我是小刘,那我们下期再见。
![第111期丽姐的AI悄悄话-上集:Codex使用技巧第一弹,小白新手必看!
[技巧1 - 自动压缩会话]
[技巧2 - @键快速调用插件]
[技巧3 - Markdown渲染+注释]
[技巧4 - 海量插件即插即用]
#codex #AI #agent #编程入门 #软件分享](https://p3-pc-sign.douyinpic.com/image-cut-tos-priv/172629e0568ee588746ae17ca65686e1~tplv-dy-resize-origshort-autoq-75:330.jpeg?lk3s=138a59ce&x-expires=2103962400&x-signature=6mUcDpyRkRUWIzJsDGJDH257wFI%3D&from=327834062&s=PackSourceEnum_AWEME_DETAIL&se=false&sc=cover&biz_tag=pcweb_cover&l=20260905183555F1AE9E36F11B0B98428D)
你有没有遇到过这种崩溃 ai 对 话,越聊越长,上下文爆了,要手动清理! ai 干活时突然想问一个问题,一,插嘴任务直接重置 在 codex 呢?这八个技巧让你的效率翻倍!欢迎来到新手村,今天给你分享 codex 的 八个使用技巧,学完从小白变老手! 技巧一,自动压缩绘画什么意思呢?就是 ai 会自动整理上下文,把废话删掉,保留住精华,不用你去手动清理, 再也不用担心对话太长一出,也不用重新开绘画,用的越久越感觉这货是真懂我呀!技巧二,艾特键快速调用插件 想用插件别翻菜单了,直接敲 at 键,弹出一个插件列表,想用哪个 at 哪个,秒掉出来。不用记命令,不用查文档,手指头一敲,插件就位,这才是真正的一触即发。 技巧三, markdown 渲染加注式敲代码写文档的看过来, codex 原声支持 markdown 渲染,写出来的东西格式漂漂亮亮,阅读体验拉满 还不够?它还有两个小技能,第一个就是它可以一键还原原始 markdown, 想看原码随时切换。第二个就是给某段内容添加一个注视,精准标记问题所在,再也不用密密麻麻的文字里面大海捞针, 还可以精准地给这个 markdown 进行一个注视,然后在对话里面去让 codex 去帮你去修改,非常的便捷,更加的精准化的定位我们的问题。 第四个技巧就是海量插件,即插即用。 codex 呢?它默认支持很多插件,开箱即用,不用你折腾配置,不用你找安装包,点开就用 翻译插件、画图插件、数据分析插件等等,别人还在装环境,你已经开始开工了。好了,这一期就到这,下期我教你进阶技巧多现成自动化的骚操作,觉得有用的话点点关注点点赞,我们下期再见啦!

codex 是 openai 推出的 ai 编程伙伴,可以帮助我们开发功能、修复 bug、 重构代码、做代码审核等。 openai 官方也提到, codex 可以 处理从功能开发到代码 review, 发布相关的工程任务。 但对孩子说,我们不用一上来就讲那么复杂,我们可以把它想象成一个把想法变成作品的 ai 助手。比如说我想做一个数学错题的讲解器,我不会直接说 帮我写代码,这样太空了,我会说,请帮我做一个适合三年级小学生使用的数学错题讲解网页功能包括,学生可以输入一道数学错题 e i 页面,提示学生先分析题目条件, 在引导学生写出题解之后,再举一反三。应用风格要可爱清楚,适合孩子,这就叫任务拆解。这我也给大家进行干货总结。给 codex 写提示词有一个万能的公式,角色加目标加用户,加功能,加风格加输出形 式。比如说角色是,你是一个 ai 编程助手,目标是帮我做一个教学错题分布讲解, 生成类似体,风格是卡通,也要简洁,适合孩子。初初就是做成网页。在 ai 时代,孩子真正要学的不是复制答案,而是把自己的想法讲清楚,因为你讲的越清楚, ai 做出来的作品就越接近你想要的样子。

大家中午好,我想了想,我还是要跟大家录一下,因为最近 codex 跟 anthropic 的 cloud code 真的 太火了,昨天晚上 openai 也发布了 codex, 现在已经可以直接支持谷歌的 chrome 以及 windows, 就是 chrome 在 macos 和 windows 情况下,呃,可以直接调用 codex 的。 我快速录一个视频,教一下大家怎么把这个功能激活。首先呢, 我们要打开最新版本的 codex, 如果不是最新版本的,可以在这里去检查 update, 就是 要确保更新到最新版本的 codex。 更新完之后,打开这个插件 plug ins, 打开这个插件, plug ins, chrome 的 这个选项就会出现了,点击这个 chrome 点击吧,因为刚才我已经点击了啊,可以直接点打开, 打开它会直接跳到你默认浏览器的这个 codex 的 激活界面啊,如果你默认的是 chrome, 就 会正常蹦到这个 chrome 的 界面 crom 蹦到之后直接点击艾特 crom 就 ok 了啊,因为我认为接下来会很精彩的。其实 cloud 大家能看到我的 cloud 已经支持了,就当我点开这个 cloud 的 时候, cloud 的 无论他调用自己大模型也好,还是还是 cloud code 也好,他可以直接操纵我的 crom。 那 现在呢,就是我把 code 也加入到 crom 之后, open up code 也可以直接调用我的 crom 吧。因为今天我想录这个视频的原因就是我认为接下来整个电商的搜索逻辑都会因为世界头部的几个大模型公司会带来天翻地覆的变化。 比如我现在自己日常的使用已经不用去打字了,我调用的是 tapis 会比较多,所以现在目前,哦,现在才五月份,我觉得其实 ai 的 风向已经调了好几次了。比如年初的 open code 火了一阵子, openclaw 就是 龙虾。 那其实我认为到现在为止了, open opencloud 的 风风口或者说营销热度已经完全消退了。那接下来就是 webcoding。 那 目前最主流的就是 codex 和 android 的 cloud code。 就是 cloud 的 code 啊。好吧,今天就跟大家快速录一下。我估计可能很多伙伴不知道怎么在 codex 里面去添加 chrome, 在 chrome 里面去激活 codex。 好 吧,那今天先这样,拜拜。

让库德斯呢控制我的电脑,全程呢?让他自己给我做设计,我们看看效果会怎么样?这里话呢,我是先让库德斯干嘛呢?就是参考我这个产品, 这里话丢了一个,那个就是手机, vivo 手机产品,然后呢给了他两组参考,对吧?每个文件夹里面呢生成五张图,对应五张图啊,一共十张图,我给他什么参考呢?哎。一个什么呢?一个是呃,这种什么雪地啊?嗯,之类的。这种雪地啊,一个参考。 那另外一个怎么参考呢?另外一个是花卉的参考,就是完全让他按照着参考来。按参考来干嘛呢?就是让他是根据这个参考呢去提供那个就相当于给大家群群版,然后呢给大家个产品卖点,试一下创意呢?他自己想,然后呢?吭哧吭哧吭哧,然后自己想了,对吧? 然后自己控制我电脑,再然后呢?哎,他就能去开始打开我的这个串起屁。那第一个的话呢?什么呢?他是丢了两张这个参考图,那跟这个产品呢?哎,申请一个是雪地的吧,对吧?不要放其他 logo 什么的,但是,哎,这第一张雪地的效果还可以啊。 第二个呢就是这个,呃,延时的。第三个呢是在冰块里面的。第四个的话呢就是应该是他模仿的脚印,你看变成手机印了,印在里面,我们这样看, 还有是这衣服呢,这个是我没想到的衣服,这个都不知道他怎么跟这个长相结合在一起啊?饱满可以,对吧? 那好,再后面的话呢,就是那个啊,就是花卉的,就是因为我给两组嘛,另外组花卉的,他就是跟花期结合的,一个两个,对吧?这两个很重复嘛?这个人家说不要太重复了,因为这个是像是万里生长一样的, 这个应该跟那个时间去好像有点关系啊,然后这些花卉的 啊,还有这个,这个对吧?那我又让他干什么事呢?又让他那个挂这里,自己去打开我的编辑室,然后自己的话呢?就参考那个,呃,创意图啊,吭哧吭哧,再生成个海报 题词是他自己写的,然后自己那个我让他不要重复哈,创意不要重复,对吧?啊?这一张的话每张都是他自己写的题词,然后自己那个生成海报,生成完了再接着下一张,对,就就这样挂了,挂了一个晚上哈, 没有好创业的时候呢,你就可以让它扩展自己呢去做,对吧?那这前提干嘛呢?就是你在要在设置里面哈,打开什么?打开你的电脑控制电脑控制这个打开来,然后呢把这个安装一下就可以了,点个授权他可以控制电脑了。

曾经我对 cloud code 的 终端爱不释手,但现在我只能说一句, codex 真香啊,真香! 大家好,我是布鲁。随着 codex 近期频繁的更新,我自己的工作站也已经全面的切换过来了。今天就来分享一下我自己的完整使用经验,怎么用 codex 打造一套不打断心流的生产力闭环。 本期视频我把它分成了七个章节,每一张都是我自己实际在用的技巧,希望能对你有所帮助。那我们话不多说,直接开始 第一张,先来介绍一下我的工作站是怎么布局的。左上方是 codex 的 对话框,下方是 terminal 终端。 你可能会问,已经有 codex 的, 为什么还要开一个 terminal 跑 c c? 因为我发现对于一些需要探索、需要设计的任务, c c 的 表现要更出色一些。所以我的习惯是用 c c 来做方案设计,配合 planning with files 这个 skill, 把设计思路直接落成文件, 然后再让 codex 读这份计划,接手后续的具体实施。这样一来, cloud code 负责想, codex 负责做,两者可以各司其职。 右上方这个区域我用来做任务完成后的查看和审阅,比如代码的 review, 文件的浏览,还有浏览器都在这里。虽然现在浏览器还不支持多标签页,但对于日常的任务来说完全够用。这边我就分享一个实际的案例, 我让 c c 参考了最近很火的这篇卡巴西提出的知识库的文章,让他借鉴里面的思路,出一份设计稿和完整的实施计划。目的呢是做一套前端的页面,方便我日常的维护文档使用。 接着 c c 就 会调用 planning with file 这个技能啊,将所有的计划落成文档,然后我就会回到 colex 这边,让 colex 去阅读当前项目内的这份计划文件,然后基于这份计划文件让他进行开发。开发完结果之后,我会在这边 内置的浏览器里面去进行结果的 review, 包括代码的一个审查,整个过程从设计到开发再到 review, 全都在这一个工作站里面完成,不需要切换任何的窗口,这就是我前面所说的,心流不会被打破。 第二章,批注功能。这个功能是我觉得 codex 真正强大的原因之一,也是最能体现沉浸式开发的地方。 以前我们改代码的方式是找到文件定位到哪一行,描述问题,让 ai 修改,整个过程中你的注意力是在代码上的,但现在 codex 的 批注功能让这件事情变了,你可以直接在文件上进行批注,告诉他哪里怎么改,需要怎么改。 更厉害的是,现在这个批注功能不止限于代码文件,你可以直接在前端页面上进行批注,看到哪个按钮位置不对,哪块布局不满意,直接在页面上标出来, codex 就 能理解你的意图,并帮你进行调整。这件事的意义在于,正好对应了 webcodd 的 核心理念, 开发者的重心不在于怎么写,而在于写出来的东西对不对。批注功能把这个理念落地了。 第三章,上下文管理 codex 项目里可以同时开多个县城,每个县城对应一个任务,互相独立,不干扰。对比 cloud code 需要开多个对话窗口, codex 把所有县城都收在了一个项目下,管理起来会清晰很多, 然后是项目的记忆核心就是 a 键的点 md, 这个文件你可以类比为 cloud md, 把项目的背景、开发规范都写进去, ai 每次进来都会读取,不用反复的交代。 还有一点, codex 的 上下文管理非常省心,它会自动帮你压缩上下文,它也没有提供像 cloud code 中 compact 的 那样的命令,这种事情让 ai 自己处理就好了,你专注于任务本身就行。 第四张,自动化这块是我觉得 codex 比其他 agent 做得更好的地方,几个原因,第一,用起来非常的方便,直接在 gui 里面新建自动化任务,还内置了很多模板可以选择, 大到项目管理技术、眼镜,小到个人的生活习惯,都可以交给它来定期的处理。第二,自动化可以调用 codex 自身的能力,比如插件、 skill、 mcp、 浏览器操作、电脑操作等全都能用进来,这就是为什么我说 codex 在 逐步形成自己的生态。 第三,我们可以根据不同的场景来灵活的选择模型和推理强度,简单的任务用轻量模型,复杂的任务上强推理,这样的话头肯可以用的更加的合理。第四,稳定性,我实测下来, codex 相较于其他的 agent, 定时任务的准确性已经能达到生产级别,相当的靠谱。 第五张插件和技能, codex 有 相当丰富的官方插件和 skill 生态。先说说两者的区别, skill 就是 纯文档,本质是给一份 ai 的 说明书,告诉他在特定场景下应该怎么做事。比如说我前面提到的 planning with files, 就是 一个 skill 插件的概念会更大一些,你可以把它理解为 codex 打补丁,里面可以包含 skill, 也可以带上 mcp 配置,甚至集成其他的 app。 一个插件装下去, codex 就 多一套能力。 另外, codex 在 插件和 skill 的 管理体验上面要比 cloud code 的 友好太多了。 cloud codex 需要改配置文件,而在 codex 里直接在界面上点击安装,或者自己创建,整个过程非常的直观。 第六章浏览器和电脑操作 codex 可以 直接操控浏览器,你可以让它自动填表,抓取数据,验证 ui 效果。 比如我需要批量收集一些网页上的信息,直接告诉 codex 去哪个页面拿什么数据,它就能自己打开浏览器去完成操作,整个过程中都不需要你的介入。除了浏览器, codex 还能直接操作你的电脑文件的整理,应用的打开都可以交给它来处理,相当于有一个助手在帮你操作桌面。 不过这里要说明一点,随着 ai 自动化越来越普及,现在已经有不少软件开始加强安全控制,对自动化操作做了限制,所以实际能操作的范围会因软件而异,遇到限制情况也很正常,大家用的时候留意一下。 第七章通用功能这些功能不是 codex 独有的,很多 agent 都支持,但作为一个完整的工作站,这些基础能力 codex 当然也不会缺少。先说 play mode, 在 执行一个比较复杂的任务之前,先让 codex 把完整的计划列出来,你过一遍觉得方向对了再让他动手, 这个习惯能帮你省掉很多返工的时间,大任务尤其推荐开 play mode。 再说 m c p, 也就是模型上下文协议,通过 m c p 可以 把各种外部的工具和服务接进来,让 q d x 能力边界大幅扩展,无论是连接数据库,调用第三方的 api, 还是接入自己家的服务,配置好之后, q d x 就 能可以直接调用。 另外还有一点, q d x 相较于 logot code 的, 有一个非常关键但很容易被忽视的小功能,语音识别。目前我的任务几乎都是语音发起的,连打字都很少了。 ok 以上就是我在使用扣袋子过程中总结的一些技巧,如果对你有帮助的话,希望能得到你的点赞和关注。 最后我想说一句, ai 发展太快了,各家 a 键的功能越来越趋同,但工具再多,适合自己的才是最好的。有时候做做加法,找到真正需要的,做做减法,去掉用不上的,慢慢摸索出一套自己的工作范式才是最重要的。我是布鲁,我们就下一期再见。

这是一期地毯式 codex 教程,如果你还在焦虑谁谁谁又用 codex 做出了什么无敌的应用或者自动化给自己干活了,那你务必看完本期教程,带你最全面的了解 codex 是 什么,它能干什么,并跟我一起实操完成。从 codex 下载 安装到个人网站、文档制作视频动效,自制工具等等等等,全面了解 codex 这个目前为止最强大最全面的个人 a 政策。 codex 的 界面现在我们来到了 codex 的 主界面,这个对话框你肯定很熟悉,对吧?但是你可以看到左边的这个边栏,就可以看到很多不一样的地方。 首先是上半部分,点击这里你可以快速创建一个新的对话框,快速完成一段与 codex 的 对话。这个搜索你可以同时使用 command g 来调出,快速搜索,你与它进行或者对话等等。现在你可以看到技能和插件这两个板块,这里可以说是 codex 的 一大精髓所在。再过来说, codex 是 一个集合了 chatbot, d e 浏览器,自动化工具等等等等的一个大一统的工作台,所以你可以给他安装插件, skill 以及创建自动化任务。这里的插件市场可以让你来随时扩展更多的功能。比方说这里的 computer use 和 browse use 在 我们后半部分的教程中就会用到这两个功能。 再往下看,可以看到项目和对话两个分栏。在项目中你可以点击添加新项目来将你创建好的文件夹给添加进来。在你创建好的文件夹右侧点击开始对话,你就可以创建出一个新的对话框,那么之后你们对话所有产出或者修改的文件,就会在这个文件夹中进行。 正常情况下, ai 如果直接操作电脑,风险会非常高。所以 codex 使用的是沙盒的逻辑,它相当于给 ai 开了一个单独的隔离小型开发环境,它可以在里面读代码,改代码,运行命令,执行测试,但默认是不能随便控制系统的。 在对话这里,你可以选择默认权限、自动审查、完全访问权限三种权限类型,让 codex 来执行还是非常安全的。再往下看,还有一个对话栏, 常用来进行一些临时产生的问题,当我用完,我就会点击右侧的这个归档按钮,把它给归档,那你也可以在设置你归档对话里面去给他找回来。 回到对话框,你可以在对话框中输入任意的问题,或者要执行的操作,比如帮我整理桌面上的这个文件夹里的发票,并统计这些发票总金额是多少,然后统计在一张 excel 表格中,你看很快他就跑完了。 现在我们来使用 codex 制作一个个人网站,首先在桌面上新建一个我网站的文件夹,然后回到 codex, 进入文件夹,点击这个加号,打开计划模式,这样 codex 就 会根据你给的需求,先开始计划他接下来要做些什么,等他计划完成了,他会给你一份详细的执行方案, 然后点击执行,这样就可以去干别的事情。一杯茶的功夫,你就可以等待你的网站。你可以点击右上角调出一个终端, 把它给你的命令复制一下,回车运行,你就可以在 codex 里面预览这个网站的效果,我们点击展开面板。哎,对了,你看 codex 还自带一个浏览器,你可以在 codex 里面直接查看以及批注,这样你就不用回去再想想怎么描述我是要修改什么地方。 文档与 ppt, 那 除了做网页,我现在更高频的用途是用它来做文档。比如说平时很多人会写策划案,汇报 ppt 视频脚本,以前是用 gpt 生成文字,再到 word, 再复制到 ppt 里面,最终再自己排版。但是 codex 现在已经把这些东西都串起来了。比如说我现在告诉他 使用 html ppt 这个 skill 帮我制作一个宠物账号的商业方案,要求包含市场分析、账号定位、内容模型、变现方式,以及未来三个月的执行计划,并生成一个科技感高级风格的网页 ppt。 然后你看到他就会开始创建文件,生成文案,设计页面,制作动画,自动排版。最后给你一个直接可以演示的网址。尤其是你看像我一样要录制这种口播视频的,我这样的 ppt 就是 用 qq 词直接帮我生成的,他做出来东西天然就很适合录屏。 这个时候顺便介绍一下 qq 词另一个非常好用的功能,分叉非常适合这种,你做到一半突然想要尝试一个新的风格, 或者要尝试两种内容的时候,点一下分叉按钮,这个时候不用重开一个新绘画,重新解释项目背景,他会直接分叉当前的上下文。你可以在分叉县城里面大胆做实验,如果效果不好,直接回到原来的主线就可以了。如果效果更好,就可以沿着这个分叉继续来进行开发视频动效。 说到做视频, codex 最近还上线了一个非常强的插件,由黑正推出的 hyperframes, 你 只需要输入一句话的描述,就可以自动生成带动效排版转场。三 d 视觉的高级动效视频,可以说是完全填补了原来视频模型不适合生成精确的带文字、带数据的动效视频的孔雀。 比如说,你可以直接说帮我根据这个养猪场的年报生成一段科技企业的汇报视频,他就会直接调用前端库来生成一段带数据、带图标的动效视频。 skill 与自动化任务普通的 ai 只能回答问题,但是通过 skill, 你 可以把你工作多年的经验或者流程打包交给 codex 自动去跑。比如说你完全可以使用 at skill creator 来描述你的需求,每天自动抓取某个平台的热门视频, 分析标题,提取高赞评论并整理成 excel, 最后生成第二天的选择题。我自己做了一个急梦,排队的 skill, 如果你有批量使用 cds 的 需求,使用我这个 skill, 它就会在晚上帮你批量提交视频生成的任务,自动检查生成出来的视频并保存到本地。 类似这样的 skill 还有非常多,这个部分就留给你们自己去探索。 computer news 这个是我觉得最近 q 版有这个功能,目前只有 mac 版有这个功能, 它运行起来的时候,它就会像一个真人一样看屏幕,移动鼠标,点击按钮,输入文字,打开软件,切换窗口,使用第三方 app。 以前很多的自动化必须要通过写脚本,调接口,配 sdk, 研究文档。但是现在即使某个软件没有开放 a p i, 很多事情扣代码,直接看着屏幕自己就去操作了,你懂这种方式有多震撼吗?最后的总结 可以看到, codex 提供的内容已经非常非常多了,我这里要下一个爆论就是这一类 agent, 他 绝对不会仅限于编程开发等等, 你已经不能简单的给他定义成工具了,但是你也别太焦虑,拥抱 ai, 先从每天自己最烦最重复最浪费时间的小事开始。 比如说整理文档,改革式做表格,生成封面,做网页,写脚本,做汇报,批量修改内容。当这些事情真正开始被 ai 接管的时候,你自己的潜力或许才刚刚被开发出来。