最近还是会有很多人来问我, cloud code 和 codex 到底哪一个更好用?这个问题其实挺有意思,因为我身边很多朋友,不管是做业务的还是做开发的,他们自己用下来第一反应基本上都会觉得 cloud code 更稳一点,或者说更全面一点。 但你再看最近网上那些声音,又会发现,花 codex 的人啊越来越多了,甚至有人会说,现在 codex 已经好用到过超过 cold 扣的了。 所以作为一直在使用 cloud max 和 codex pro 会员的用户啊,我就想结合自己这一年左右的使用感受,聊一下我眼里的 codecode 和 codex 到底有什么区别。首先,我先抛出我的结论,这两个工具并没有说谁完全碾压谁,那么更像是两种性格完全不同的助手。 cosco 的更像是一个非常全能的管家,你把一件事情交给他,他会考虑的非常周全,很多你说出来的东西,他会做很多你没考虑到的, 但他认为你可能需要的东西,他也会顺手帮你补上。所以你在用 cc 的时候,经常会有一种感觉,他不只是在帮你执行,他还在帮你兜底。你想到了第一层,他会帮你想到第二层甚至第三层, 尤其是那种你自己都还没想明白的任务。比如说有一些需求,一开始是模糊的,做成什么样子,过程到底怎么实现,你其实都还没有什么概念。这时候你需要的是会主动追问,自己判断,再反过来给你提供更多信息的助手,这样就能把一个杂乱的需求一点点捋顺,变成一个思路清晰的出行。 但 codex 啊,就不太一样, codex 有时候确实会理解错你的意思,尤其是当你的方向给的不够明确的时候,他很容易跑偏。但反过来说,只要你给的方向准了, codex 深度钓鱼能力啊,是非常强的,他在一些垂直任务上的完成度啊,会给你很明显的惊喜。所以 codex 更擅长的是那种已经明确需求和 实现方式的任务,最典型的就是产品把 p、 r d 写的明明白白,你照着把它变成能跑代码就行。所以我觉得如果把这两个工具类比成团队里的两类人,我觉得 coldcode 更像是一个可以立的别人的角色,他能够看全局,拆任务,能够补逻辑,也能把不同模块之间的关系啊串联起来。 那 codex 更像是一个研究型的同事,你让他去统筹全局带方向,他可能不是最强的,但你告诉他往这一个点,往这一个方向去研究,他就能够做的非常深。 还有一点非常真实的感受,在我的公司里面,做业务的、做管理的,大部分人都会选择 coldcode, 但是做开发、做算法、搞科研的,基本上都是 codex。 然后我再给大家举两个我自己很典型的例子,第一个就是我之前做一个偏垂直行业的方案设计,这个东西很难用一句 prompt 讲清楚,因为里面有大量的材料,包括这 这个行业过去沉淀下来的一些方法论,还有我自己多年积累的一些经验,还有很多散落在不同文件夹,不同文件里面的资料。我当时就想把这些东西整理出来,打包成一个 skill, 然后我分别让 colorcode 和 codex 啊,用他们各自的 skill created 去做这件事情,最后出来的结果让我非常意外,两个工具的差距啊,非常明显, 因为这类任务本质上不是一个执行题,而是一个探索题,你自己脑子里面可能只有一个大概的小蓝图,知道最终想要什么,但结果怎么排,材料怎么归类,哪些东西啊该放进去,其实你自己也没有完全想清楚, 那这个时候 cc 的优势啊就出来了,他会帮你拉结构,帮你补逻辑,帮你去判断哪些内容应该放进来,哪些应该单独的处理,甚至有一些你自己还没想到的地方,他就会帮你先搭一个版本,他不一定每一次都是完美的,但他能够带着你往前走。另一个就是,我平时都会用 remotion 去做一些动画视频 这类任务啊,其实不只是写代码,因为代码写完之后,到最后画面长什么样,动画有没有跑起来,视觉是不是符合预期,这才是关键。那克拉克扣的做这类事情的时候,他经常是生成完以后就默认这个结果是对的,那实际上有时候经常会出现错位或者重叠的情况,我需要手动让他较量一遍才能修正。 但扣带词给我的感官就很不一样了。他做完以后啊,会有一个很明显的动作,就是他会回头看结果,比如说他会截图去验证页面是不是涨对了,动画是不是正常,最后的产物跟一开始的目标是不是一致。 这个动作其实非常关键,因为它背后代表的是两种完全不同的 ag 的哲学。 cold cold 先生在说,我生成出来的东西啊,就是我认为正确的东西。 codex 先生在说,我先做出来,但是我还得回头验证一下,这到底是不是用户想要的。那说到这,还有一个挺有意思的变化。看过往期视频的粉丝啊,肯定知道我是无脑 吹 cc 的,因为确实在过去很长的一段时间里面, ai cody agent 的这个领域, coco 的存在确实是太强了,不管是体验还是完成复杂工程任务的能力,他都是明显的领钱。 最近几个月啊,我对 codex 看法变了,他真的在开始变好用,而且不是那种参数表上看起来变强了,是你实际在用时啊,会很明显的感觉到他的变认真了,他会更在意最后产物跟原始目标是否一致。 那说了这么多,最后这两个工具到底更适合谁来用呢?我这边就用程序员来举例,给大家一个比较实际的建议。 如果你是比较资深程序员,或者说已经到了架构师这个阶段,我会更推荐你用 colorcode。 因为到了这个阶段,你关心的往往不是某一段代码能不能写出来,而是系统之间的价格关系,模块和模块之间怎么串,边界怎么划分。 codecode 在这方面很适合你,因为他会帮你把点和点之间的关系串联起来, 他不只是盯着一个函数看,而是更愿意从整个项目、整个系统的角度去想问题。这种全局的能力,对资深开发或者价格式来说是非常重要的。但如果你现在还是刚毕业的或者初级开发,我反而会更推荐你多使用 codex, 因为 codex 啊,在具体实现代码规范,结果胶原这些地方给我的感觉非常扎实。 他会逼着你关注一些很工程化的东西,这些对刚入行的开发来说特别重要,你一开始就会被这种工具带着走,会更容易养成好的工程习惯。所以现在这个 aia 这个阶段,我们不能只问谁更强,更重要的问题是,你是什么类型的用户,你手上的任务是什么?因为每个工具背后都是一套不同的产品哲学, 你只有真的上手用过,才会知道他们更适合什么,也才会知道在自己的工作流里面,哪个工具应该放在什么位置。 ok, 那本期就是关于这两个工具啊,我自己在使用方面的心得,希望能得到你的一键三连加关注,我是布鲁,你的 ai 好搭子,我们下期视频再见!
粉丝4.5万获赞24.6万

今天我们来讲讲大名鼎鼎的 codex, 相信大家都已经听说过这个软件了,这是 open nai 的 核心产品,对标 osarpic 的 cloud code。 codex 能做的事情非常多,它不仅能够帮你编辑代码、排查 bug、 执行测试,还能管理 gate、 操作浏览器,甚至能直接控制电脑完成各种任务,非常强大。不过功能越多,越容易让人抓不住重点,所以这期视频我会带大家系统性地过一遍。 codex 最核心的功能,帮大家建立起一套完整的使用思路。 整个视频一共分为三个部分,第一部分是基础篇,主要带大家快速上手 codex, 并讲解一些核心配置和使用过程中容易踩坑的地方。 第二部分是进阶篇,重点介绍版本控制、绘画管理,以及如何更高效的组织和推进开发任务。第三部分是扩展篇,我们会看看如何通过 plugin、 skill、 automation 和 mobile 等功能进一步扩展 codex 的 能力边界。 所有的功能点和对应的时间戳我都打到目录上了,大家可以按需跳转。好话不多说,我们现在开始。 首先我们要做的是把 codex 安装到电脑上面,我们可以打开这个页面,点击这里面的下载按钮,就可以下载 codex 了。下载好了之后,我们来打开它。安装过程呢,跟其他的普通软件一样,比如我用的是 micros, 那 直接把 codex 拖入到 applications 文件夹里面就可以完成安装了。 安装好了之后,我们来打开 codex。 打开 codex 之后呢,它首先会提示我们登录,它一共给了我们两个选项。 第一个呢是使用叉 gbt 账号登录,这需要你订阅叉 gbt 的 套餐。叉 gbt 呢,它提供了多种套餐,其中最常用的是我屏幕上面显示的这几个,主要是包括免费版 go 套餐、 plus 套餐和 pro 套餐。 你看屏幕上面的这几个套餐,从左到右价格越来越高,当然整体能用的 codax 额度也是越来越大的。 从目前来看,免费版和购套餐的 codax 额度应该差不多,但到了 plus 套餐,额度就会有着明显的上升, pro 套餐自然就更多了。 值得一提的是,即使你用的是免费版,系统也会给你一定的 codex 额度,只不过这个额度少的可怜,只能勉强够你施个水。所以如果你想真正上手体验一下它的能力,我建议你先订阅 plus 这个 plan, 它是二十美元一个月,可用量呢比较适中。 除了订阅套餐之外, openni 还提供了另外一个选项来使用 codex, 那 就是直接接入 api, 对 应的就是这里的 signing another way, 点击之后,它会提示你输入 openian 的 api key。 一 般来说,用 api 没有订阅套餐划算,而且呢,获取这个 api key 的 门槛也有点高,一般需要一张海外的信用卡,所以我建议大家还是订阅套餐来使用 codex。 具体的登录过程呢,我这里就不显示了,大家可以在这里选择适合自己的方式登录。登录好了之后,大家首先看到的就会是这样的一个界面, codex 首先会询问我们是干什么工作的,这里大家就按照实际情况来选就可以了。然后 codex 会提示把 cloud code 和 cloud co work 相关的配置都导到 codex 这里,我们先跳过,然后 codex 提示我们要不要试用 codex 手机版,我们点击这个 set up later, 待会儿呢,我会给大家演示这个功能,所以现在先不着急,现在呢,我们就算是正式的来到了 codex 操作界面,可以开始使用它了,我们来随便跟它打个招呼,看看能否正常使用, 可以看出 codex 已经可以正常使用了。下面我带大家做一个代办软件,并且在做这个代办软件的过程中为大家讲解 codex 的 各个功能点。首先我们要新建一个目录来存放我们的软件代码,让我们打开访答,在这里创建一个新的文件夹,就叫做马克笔记吧。 然后回到 codex 这里,点击 work in the project, 再点击 use an existing folder, 在弹出的对话框里面选择我们刚刚创建好的文件夹,然后再点击 open, 然后呢,你就会发现 codex 把项目目录改成马克笔记了, 这就代表 codex 后面会把代码放到这个文件夹里面。此时我们准备工作就已经是做完了,可以开始提需求了,比如说我们的需求就是使用 html 写一个笔记软件,软件界面分为左右两部分,左边是笔记列表,右边是笔记的内容, 最后我们提醒他注意做好测试,然后回车提交,这个时候呢, codex 就 会开始工作了,可以看出他在疯狂的给我们写代码,当然实际使用是没这么快的,因为为了节省大家时间,这里我做了加速,后面的问答流程呢,也都做了不同程度的加速处理,这个呢,大家知道就好了。 好, codex 暂停了,他提出他想要构建一个本地服务器来验证 html 笔记的效果。这里呢有三个选项,第一个选项是 yes, 这个呢很好理解,其实就是把这个本地服务器启动开就可以了,不过以后如果 codex 提出类似的请求,我们还得再授权一次。 第二个选项呢,是代表我们不仅同意,而且对于这种启动本地服务器的代码,以后呢也就直接执行就好了,不需要再经过我们授权了。第三个选项可以理解为不同意,它其实不是一个按钮,而是一个输入框, 我们点一下就能看出来了。在这里我们可以告诉 codex 自己希望的处理方式,比如只让它检查代码,不要启动本地服务器之类的。当然,如果你不同意,而且你懒得告诉 codex 原因的话,也可以直接点击这里面的 skip 按钮啊,这算是 codex 做了弱化的第四选项了。 好,所有的可选项我们都说完了,在这个地方我们就选择第一项 yes 就 好了。然后呢, codex 就 询问我们能不能访问这个新创建的本地服务器,这个地方呢,我们也同意, 呃,现在 codex 已经彻底完成它的工作了,可以看出这里面最重要的文件呢,就是这个 index html, 我 们可以点击来预览它的效果。 这个呢就是 codex 写的笔记软件了,看起来中规中矩,各种基本功能呢,在这里面都能找到。当然有些人可能觉得这个预览区太小了,想要放大一点,这当然是可以做到的,让我们来点击这个按钮, 这样左边的区域就被收起来了,可预览的空间就更大了,不过下面的这块区域看着也是有点碍事,能不能隐藏它呢?其实也是可以的,我们可以点击这里面的三个点, 然后选择其中的 hide composer 就 好了,你看这样呢就好多了。那假如说这个时候呢,你看着界面里面的这两条笔记,觉得非常碍事,你想把它们去掉, 呃,这个呢,其实也是很简单的,我们就继续追问就好了。既然要追问,我们就必须要把左侧栏再次显示出来,这个呢其实很简单,我们再点一下这个按钮,左侧栏就显示出来了。 然后呢,我们就可以在输入框里面输入我们的问题,把左上角的两条笔记去掉,这个呢肯定是可以的。 呃,不过我这里想给大家演示另外一个方法,另外一个更加准确,更加方便的方法,我们可以点击这个图标,它叫做 annotation, 然后我们就可以直接选中两条笔记这个区域,选中后,输入我们对这个区域的修改意见,很简单,我们的意见就是两个字,去掉, 然后我们提交请求。好,可以看出请求已经成功提交上去了,可以看到他一共是发了两块内容,一个呢是对应的截图,另外一个呢就是我们具体的要求了。 接到了这个请求之后, codex 就 开始工作了,他应该呢就会把这块区域给去掉,让我们稍微等待一下。 好, codex 已经完成了,我们再次打开这个阅览区,看一下效果, 可以看出之前的这块区域呢,确实是没有了, codex 已经帮我们解决问题了,看起来 entity 这个功能还是非常方便的, 那这个时候我们可以再随便点点这个笔记软件,看看有没有其他我们需要修复的问题。这里好像确实有个 bug, 我 点击这个加号按钮的时候,下面呢是要增加一个新的笔记的,但实际上点了之后并没有任何的 bug 呀。让我们跟 codex 说一下这个问题, 我们需要告诉 codex, 点击添加按钮之后,笔记列表区域没有任何的反应。呃,请排查下原因,我确定之后再进行修改 好。 codex 已经排查完了,按照我们的要求,他没有直接去改代码,而是先给出了诊断结果。他猜测呢,这个问题大概率是因为当前页面的 local storage, 也就是本地存储被禁用了。 没错,就是这个原因。说白了,就是 codex 的 右侧预览区有一些安全限制,导致某些功能无法正常使用。如果我们到独立的浏览器里面用一用,问题立马就消失了,不信我们试一试。 你看这个时候再点击添加按钮是不是就完全正常了?既然用户是在真实的浏览器里用我们的软件,而不是在 codex 的 预览区里用,那这根本就不算是个问题,自然也不需要修。 我不知道这算是 codex 的 一个 bug 还是一个 feature, 我 相信 openai 是 把它当成 feature 来做的,不过实际用下来确实有点像 bug。 如果你做的也是外部应用,那一定要额外留意这一点,别被预览区给骗了。既然弄清楚了原因,为了避免再受限制,我们后续就在独立的浏览器页面里面进行测试了。 到这里,这个最基本的笔记软件就算是成功跑通了。现在我想回头聊聊刚才遇到的一个细节,就是 codex 提出的那个请求。 呃,有些同学可能会想,如果我把任务交给 codex 之后去忙别的了,没注意到他在等我授权,那 codex 岂不会一直卡在那里等我回来一看啥也没干,白白浪费了大量时间。 那这有没有办法让他自己做决定,别总是来问我呢,毕竟谁也不想一直盯着他干活,那也太累了吧。没错,一直盯着看呢,确实是非常的麻烦。其实 codex 早就替我们想到了解决办法,就在输入框的下面,大家看这里面呢,一共是有三个全线选项。 第一种就是我们刚才用的 default permissions, 在 这种模式下,如果 codex 需要修改项目目录之外的文件,或者是需要执行一些带有安全风险的命令,它就会老老实实地弹出提醒,只有当你点头同意了,它才会继续接着往下干。 这种模式的优点呢是绝对安全,一切尽在掌握,但缺点也非常明显,就是根本离不开人,你得随时给他授权。 第二种呢是 auto review, 也就是自动审查。这个模式呢很聪明,它引入了一个专门负责安全审查的 agent, 当 codex 准备执行操作的时候,这个 agent 会首先替你把关,安全的直接放行,危险的直接拒绝,只有在极少数连 agent 也拿不定主意的情况下,才会弹窗让你来做决定。 第三种呢是 full access, 顾名思义,这个呢就是放飞自我模式,全部自动同意, codex 想干嘛就干嘛,完全不需要你插手。 这个模式确实是最省心的,但也伴随着风险,万一它误删了什么重要数据,你是拦也拦不住的。虽然 gpt 模型总体上还是非常靠谱的,基本上不太会乱来,但是作为一个负责任的 up 主,我还是要提醒大家,这个模式呢,没有任何的安全,交易开启前一定要三思啊。 所以综合看下来,在这三个模式里面, auto review 是 在效率和安全之间平衡的最好的。为了避免后面频繁弹窗,要我们点同意,接下来的演示呢,我们就统一的切换到 auto review 模式。 既然聊到了这里的权限配置,我们不妨顺便看一下输入框旁边还有哪一些配置。首先大家留意这里面显示的五点五 medium, 这代表我们当前使用的是 gbt 五点五模型,思考深度呢为 medium, 也就是中等。 我们点开它可以看到思考深度呢是可以自由调节的,分为 low、 medium high 和 extra high 四个级别。思考深度越高, codex 花费的时间也就越长,消耗的 token 呢也就越多,但通常给出来的代码质量也会更好一些。 除了调整思考深度,我们还可以在这里面切换模型下来。列表里面除了 gpt 五点五,还有 gpt 五点四等等一系列的模型,大家可以根据具体的任务难度来灵活选择。 最后啊,这里面还能设置模型的输出速度,目前是 standard, 也就是标准的速度。旁边呢还有一个 fast 选项,开启 fast 模式之后生成的速度呢会提升到原来的一点五倍,不过代价呢是 token 的 消耗量也会相应的增加,具体增加多少取决于你用的模型, 比如说在 gbt 五点五这个模型下开启 fast 模式的话, toc 的 消耗量就直接是标准模式的两倍了啊。如果你财大气粗, toc 管用,那你完全可以开启这个快速模式,这样 codex 干活就更快了。 输入框的配置我们就先研究到这里,现在我们的第一版笔记软件已经跑通了,实现了最基本的功能,不过为了防止后面新加功能的时候把代码搞乱,我们最好先用 get 把当前的版本保存一下,这样的话就算是后面出了什么叉子,也能够随时回滚到这个可用版本。心里有个底, 在 codex 里面调用终端非常的方便,我们不需要去点什么菜单,直接按下快捷键, command 加 j, 大家看右侧的终端面板就直接弹出来了。在这里面我们依次输入几条常规的 get 命令, 首先是要执行 get in it, 点把当前的项目目录出示,化为一个 get 仓库。然后呢我们要执行的是 get id, 点把相关的文件呢都添加到暂存区里面。最后呢再执行 get commit 提交我们的第一次修改 好这三步敲完之后,我们的代码就有了一个安全的备份版本,接下来我们就可以放心大胆地继续迭代我们的产品了。 终端用完之后,为了不挡着视线,我们只需要再次按下同样的快捷键, command 加 j 就 能够把它直接关掉。你看用快捷键来开关终端,双手完全不需要离开键盘,整个过程呢非常的丝滑,也是非常的方便。 那现在我们用 codex 做了一个基本可用的笔记软件,而且还用 get 提交了这个可用版本,下面呢,我们就来继续迭代这个笔记软件,让它变得更强大,更美观。 假设这个时候你看了看这个笔记软件,觉得它的色彩设计不是很好,这里面有很多的绿色元素,你不太喜欢绿色,你想试试蓝色怎么样?那这个时候该怎么处理呢?很简单,你就直接在这里面追问就好了,比如我们可以这么提要求, 不过我们先不发送这个请求了吧。啊?为什么呢?你仔细看看啊,我们上一个消息里面还让 codex 排查问题来着, 但说实话,这其实并不是一个问题,只是 codex 的 浏览区有些限制而已。如果我们继续追问的话,这个排查过程不仅会占用模型的上下文,而且可能还会对 codex 后续执行产生一些影响, 他没准会继续尝试修复这个问题,把原来没有问题的页面修出问题来。虽然这种情况发生的概率应该也不会很大,但是能规避的话就尽量规避吧,毕竟这个消息其实一点用也没有。 所以我们该怎么办呢?有一个办法,那就是直接修改上一个消息就可以了,你看这里面有一个编辑按钮,我们点一下就可以直接修改这个消息了,我们来试试 提交。你看原来的请求被替换成了我们的这个,这样的话,原来排查问题的那个消息呢,就消失了,既然消失了,它就不会再占用模型的上下文了,也不会对 codex 后续执行产生任何影响, 所以很多情况下,这个功能还是很实用的。不过要注意的是, codex 只支持编辑最后一条消息,至于更靠前的那消息,它实际上是不支持我们编辑的。 前面的那些消息呢,都是没有编辑按钮的,如果你要编辑更靠近的消息,可以考虑使用 fork 功能来间接实现这个功能。我们后面会讲到,暂时你不必过于关心好。 codex 已经完成任务了,我们来看看效果。 呃,还可以吧。下面呢,我们把这一部分的改动也加入到 get 里面。之前我们是用命令行来操作 get, 这种操作方式准确通用,不过其实 codex 也内置了一些 get 操作的功能来供我们使用。比如我们可以先点击这个图标, 这里面呢就有一个叫做 environments 的 区域,它呢就跟 get 的 使用密切相关。我们可以点击这里面的 changes 按钮,然后再在这个选择框里面选择 on stage 的 选项。这里显示的就是所有还没有提交到暂存区的代码了, 这基本上也就是 codex 刚才所做的改动。如果你觉得哪一行有问题,可以点击旁边的加号,输入你的要求。输入完要求之后,你可以点击这里面的 comment 按钮,让 codex 做出相应的改动。不过这里我们就不做任何修改了, codex 的 任务已经完成的很好了,所以我们取消这个注示, 直接使用 git commit 提交这次改动。那具体该怎么做呢?很简单,直接点击这里面的 commit 按钮,输入 commit 的 message 就 可以了。我们的 commit message 就是 将整体色调改为蓝色,然后呢,再点击 continue, 此时 codex 就 会提交当前所有没有提交的改动了。 好,执行成功了,我们来验证下。先按一下 command 加 j 来到终端,然后再执行 git log, 查询 git 的 commit 记录。 你看,我们的 commit 确实是生效了,确认好了之后,我们按 q 退出 get log, 然后呢,再按 command 加 j 来隐藏终端,到这里,这个需求就算是彻底完成了。那假设这个时候你感觉蓝色这个主题也不怎么好看了,越看越不顺眼,要不再换一个吧。 没问题,我们直接提交需求,将整体色调改为紫色。改完之后呢,再做一次 get commit。 对, 这次我们不自己操作 get 了,有点麻烦,直接让 codex 操作得了。提交之后, codex 就 开始干活了,我们稍微等待一下, 改好了,我们来看看最后的效果。不错,确实改成紫色了,不过怎么说呢,啊,你觉得还是不顺眼啊,你在想,算了,我要不还是改成一开始的那个绿色吧。那这当然是可以的, 照例啊,你可以直接在输入框里面输入,你的要求就是改回来的紫色。这个呢,肯定是行的,只不过这样的话,模型还得再跑一遍,有点浪费 token, 所以 我们就不用这个方法了。 其实我们原来就是绿色,所以用 get 把代码回滚到绿色的那个版本就可以了。只不过这种做法其实也是有点缺陷的, 代码确实是回滚了,但绘画内容还是停留在紫色这里。如果我们希望在当前这个绘画继续问的话, codex 可能会以为目前所用的色调是紫色,从而对后续的任务执行效果产生负面影响。 那我们能不能把绘画和代码同时回滚呢?我们就想回滚到改蓝色之前的那个版本,也就是这个版本,如果有回滚功能的话,那应该是在这个消息旁边有一些相对应的标识吧,我们找找。 哎,还真的有一个图标有点像,不过它不叫回滚,它叫做 fork。 fork 的 意思就是基于当前的这个绘画,再复制一个新的出来,这个新绘画就只到目前所选的这个消息为止,后面的消息全都不保留, 这个呢就非常符合我们的要求了,我们其实就希望绘画到当前的这个消息为止,那既然绘画变了,代码是不是也会自动回滚呢?没准也是可以的,我们来试试。 我们首先点击这个 fork 图标,这里弹出两个选项供我们选择,一个是 fork into local, 另外一个呢是 fork into new work tree。 这两个选项的最大区别在于新绘画的代码存放地址不同。 第一个选项会继续使用当前目录作为新绘画代码存放地址,第二个选项会创建一个新的目录来存放心绘画的代码。你可能现在听的还是有点懵啊,没关系,我来演示一下你就知道了。在演示之前,我们先把左侧栏打开,这样你就会看得更清楚一些。 好,左侧栏打开了,我们来重新点击一下这个 fork 图标,然后选择第一项 fork into local。 可以看出 codex 确实给我们创建了一个新的绘画,并且还在这里标识好了,这个绘画呢,就是从别的绘画那里复制出来的。下面我们来看看代码是否也会滚了, 这个很简单,我们不必看代码,我们直接看最终的效果就行了。让我们来看看页面的颜色有没有改变,可以看出页面的颜色仍然是紫色,所以呢,代码根本就没有回滚。没错,这呢就是 fork into local 这个选项的特点,它只会处理绘画内容,根本就不会对代码做任何修改。 不过还好,我们使用了 git, 我 们可以用 git 来回滚代码。我们先按快捷键 command j, 打开终端,然后执行命令 git log 确定我们想把代码回滚到哪个 commit 上,应该就是这个了。然后呢,我们复制这个 commit 的 哈希值, 最后执行这个命令。这样呢,就可以把代码回滚到绘画对应的那个版本了。让我们回到浏览器这里刷新一下页面, 没错,确实是一开始的绿色版本了,当然绿的也不是很明显啊,只有那么几个模块是绿的。我对这个色调的表述呢,稍微有点问题,但无论怎么样,肯定是回滚成功了,相信大家都能看得出来,这个呢就是 fork into local 了,我们配合着 git, 才能把绘画和代码都回滚到之前的那个状态。 那刚才还有一个选项叫做 fork into new work tree, 那 个选项是用来干什么的呢?我们不妨来试试。让我们回到之前的绘画里, 点击这个 fork 图标,然后再选择 fork into new work tree。 注意看, codex 依然给我们创建了一个新的绘画,而且跟 fork into local 很 像。这个新的绘画呢,也标识出来了,它就是从别的绘画里面复制过来的。 一切看起来似乎都跟那个 fork into local 差不多啊,那到底什么发生变化了呢?答案就是我们当前的这个绘画所对应的项目目录发生了变化,不信我们来打开终端,输入 pwd, 这个命令就是用来显示当前位置的,可以看出我们的当前位置呢,就是这个了,我一开始 fork 出来的那个绘画可不是在这个目录里面操作的,不信的话,我们回到一开始 fork 出来的那个绘画里,同样打开终端, 运行下 pwd, 你 看它俩的项目目录地址是不同的,我把这两个地址打在屏幕上,这样大家就可以看得更清楚一些。 这个呢,就是 fork into new worktree 的 一个特性,它会给 fork 出来的新绘画创建一个对应的新目录,这样新老绘画所处理的代码不是一份,彼此之间互不影响,非常适合在两个绘画分别处理两个不同的功能点,最后做完了再合并到一起就好了。那为什么叫做 worktree 呢? 是因为它是使用 gitworktree 来实现的,这个呢,是 git 的 一个特性。这个要展开讲的话呢,又得讲好几分钟。我们本期是来讲 codex 的, 不是来讲 git 的, 所以呢, gitworktree 在 此就跳过了,感兴趣的同学可以自己查下。 另外值得一提的是, fork into new worktree 同样不会回滚代码,它只是把当前项目目录里面的所有代码复制到一个新的目录里,仅此而已。 好,这个就是 fork 的 两种形式了。总结一下,这两个选项都会复制绘画到所选消息为止,也都不会帮你回滚代码, 它们唯一的区别仅仅是代码的位置, local 呢,是继续沿用原目录,而 new work tree 呢,则是开辟了一个全新的隔离目录。主要呢,就是这个区别了。所以呢,无论是哪一种 fork 形式,都不会更改代码。实际上 codex 在 界面里面也有显示, 我们可以回到一开始的那个绘画。然后呢,再点击一下这里面的 fork 图标。注意到这段话了吗? 其实它想表达的意思就是 fork 只负责对话,不回归代码。对,它说的有点绕,但其实就是这个意思。 好, fork 功能我们终于讲完了,我们目前只需要第一个 fork into local 的 这个绘画,另外一个 fork into work tree 我 们暂时不需要。那我们能把这个绘画删掉吗?能, 不过准确来说啊,我们可以把这个绘画规章,规章和删除稍微还是有些区别的,你可以把规章理解为暂时隐藏起来了,而删除呢,那就是删完就没了。我们来试一下, 我们直接点击绘画旁边的这个图标,然后再点击 confirm, 这个绘画就被规范了。你看这个绘画是不是没了。但跟删除不同的是,我们还可以找回这个绘画。 我们先按 command 加逗号,打开设置面板,再点击里面的 archives chats, 在 这里我们就可以看到所有被规章的绘画了。我们可以解除对应绘画的规章状态,也可以彻底删除对应的绘画。所以你看,删除和规章还是稍稍有些区别的。 那规章这个功能我们就讲到这里,从之前的操作过程中我们可以看出, get 真的 还是挺重要的。那既然这么重要,我们能不能让 codex 每次写完代码的时候都能自动提交一次 get commit 呢,这样的话就不用麻烦我们每次都操作一遍了。 这当然是可以的,其中一个方法就是我们可以直接在输入框里面告诉 codex, 每次完成代码修改之后,都需要提交一次 get commit, 然后提交这个请求就行了。这样在后续的操作里面, codex 肯定就会按照我们所说的,每写完一次代码都提交一次 get commit。 不 过这个方法有个很大的缺陷,那就是它只会在当前的绘画中生效,如果我们创建出一个新绘画的话,那 codex 就 会彻底忘掉这个事情, 所以我们需要一个能够跨绘画的解决方案,即使是在一个新绘画里, codex 也能帮我们做 get commit 这个事情,这能做到吗?当然是可以的,这个呢就是 agent 点 m d 这个文件发挥作用的地方了。 agent 点 m d 简单来说呢,就是一个放在项目根目录里面的配置文件,每当 codex 开始一个新绘画的时候,它都会自动读取这个文件,把里面内容当成对自己的指令来执行, 所以我们只需要在这个文件里面写上这个 git commit 的 要求,那无论我们开多少个新会话, codex 都会记住这件事情的。我们先把原来的这个请求删掉,我们不需要它了,然后我们点击这里使用 vs code 打开这个项目目录, 在根目录下创建一个新的文件,就叫做 agent 后台,然后在这个文件里面写,每次完成代码修改后,都需要提交一次 git commit, 这样 agent dmd 就 创建好了,让我们把 vs code 关掉,现在让我们来验证一下 agent dmd 是 否真的会生效。我们首先创建一个新的绘画, 然后提交需求,往左下角增加一个主题切换选项,支持用户在浅色模式和深色模式之间切换。回车提交,让 codex 开始工作。 好, codex 已经完成了,我们来看看效果。 你看,左下角确实是出现了一个主题切换按钮,我们点击对应的主题,就可以在浅色和深色两种模式之间切换,看起来非常完美。那我们现在最关心的是, codex 有 没有帮我们做 get commit 操作呢?我们按一下 command 加 g, 打开终端执行 get log 来看看。 你看,这里面确实是多了一个新的 commit message 呢,就是 codex 自己写的,这说明 agent 点 m d 确实生效了。即使是在一个全新的绘画里面, codex 也遵从了我们的要求,在完成了代码修改之后,自动提交了一次 git commit。 这个呢就是 agent d m d 的 基本用法了,当然他能做的事情远不止这一件,比如你可以在里面规定代码风格、命名规范、技术占要求,甚至是你的项目背景介绍等等。 codex 每次启动新会话的时候都会去读取这些文件,这样他对你的项目就会有非常好的理解,给出的结果呢也会更加准确。 可以说, agents dmd 写得越好, codex 就 会用起来越顺手。不过需要注意的是, codex 只会提交当前需求所对应的代码改动。我们一开始创建的 agents dmd 不 属于当前需求的范畴,所以呢,刚才 codex 并没有把它提交为一个 git commit, 我 们点击这个 changes, 再选择 on stage, 就 可以发现 agents d m d 的 内容呢?还没有提交上去。没事儿,我们这就提交。我们先来点一下这个 commit 按钮,然后在里面输入对应的 commit message, 再点击 continue, 这样这个改动就会被提交到 get 上面了。好,一切顺利,让我们新开一个绘画,继续迭代这个笔记软件。 现在这个软件本质上就是一个 html 文件,只能在浏览器里打开,不够方便。我们想把它改造成一个真正的桌面客户端,让用户可以直接双击图标打开,就像打开 vs code codex 一 样。 那要做桌面客户端的话, electron 是 非常主流的一个选择,我们可以顺便呢也引入 react 和 type script, 把项目结构整理一下,方便后续继续迭代。那我们就直接把需求发给 codex, 把这个网页应用改成桌面客户端,进入站使用 electron 加上 react, 再加上 type script。 注意做好测试,确保所有的核心功能运转正常 啊。不过要注意这可是一个大工程,所以呢,我们最好先让 codex 做一个规划,我们确认规划没有问题之后,再让它动工。为了实现这一点,我们可以点击这里面的加号,然后选择 plan mode, 这样 codex 就 进入了计划模式,从这个图标也可以看出这一点。 在这个模式下, codex 会先做计划,再写代码,让我们来提交试试。可以看出 codex 开始工作了,让我们稍微等待一会。 好,他现在要问我们几个问题,我们来做一下选择。首先是数据要放在哪里,我们就放到文件里面吧, 然后交付到可开发运行的程度就可以了。这之后呢, codex 就 会继续开始干活了。好,可以看出 codex 开始给我们写这个计划了, 我们再稍微等待一会,它还在这个转写的过程中。 好,写完了,我们来看一下,这个计划本身还是比较完善的。呃,包括各种测试方案呐,架构设计啊,都是写的比较详细的。然后 codex 问我们是不是要按照这个计划去实现代码。 呃,他一共是给了我们两个选项,第一个选项呢就是直接同意啊,开始实现这个计划就好了。第二个选项呢是如果你对这个计划不满意的话,你可以提出你的要求,在这个文本框里面告诉 codex 应该如何做修改,然后 codex 会根据这个修改呢,再出一份新的计划。 呃,这里面呢,我们就不对计划再做一些其他修改了,我们就直接同意好了,让 codex 就 按照这个计划给我们来写代码。 好,现在 codex 开始干活了,我们需要稍微等待一下,在等待的过程中呢,我们可以跟 codex 随便去聊点东西,我们可以在输入框 side 打开 side chat 啊,在这里面呢,我们就可以随便问 codex 点别的问题,这些问题呢不会去影响左侧 codex 的 任务执行。比如说我们可以问一下,你觉得这个笔记软件还需要什么基本功能呢?提交 好 codex 呢,给了我们一些可行的方案。你看在 side chat 的 过程中, codex 左侧的任务执行一点也没有被干扰到。对,这个呢就是 side chat 的 一个非常重要的特点了,它就是允许用户在 codex 执行任务的过程中问一些比较轻量级的问题, codex 在 回答这些轻量级问题的过程中不会影响到左侧主任务的执行。那这个就是 sign chat 这个功能的特性了。这个呢,我们就先讲到这里,这个架构改造的工作量还是挺大的, codex 依然没有完成,让我们再耐心等待一会儿。 好,看起来 codex 已经完成任务了,它提示我们使用 npm runtime 这个命令就可以启动这个 electron 应用啊,让我们来试一下。首先按 command 加 j 打开终端,然后执行命令 npm runtime 回车, 这样的话这个 electron 应用就启动开了,不过看起来好像是有点问题,基本上是一个白屏的状态。呃,我们打开控制台看一下有没有什么报错 啊,确实有报错,这个呢,我们需要让 codex 帮我们来修一下啊,让我们来回到 codex 这里, 先把这个进程关掉,然后呢再把终端关掉,然后我们提出我们的诉求,启动后白屏控制台报错了。看来你之前的测试不够彻底啊,请你修复并确保在修复之后测试好再交付给我。 codex 说,我说的对,哼。呃,让我们等 codex 把这个错误修复之后再试一次。 呃,看起来 codex 已经修复好了,我们来看一下它修复后的效果是怎么样的。呃,同样,我们打开终端,然后执行这个命令 啊,这次呢,看起来没问题了,添加笔记呢也是可以的,我们呢也可以在这里面随便输入的标题内容都可以啊,主题切换也是没有问题的。 那看起来已经很完美了,各项功能都运转正常。让我们再回到 codex 这边。 呃,我们先按一下 ctrl 加 c, 关掉这个进程,然后呢,再把终端收起。好,那改成了 electron 架构,我们就继续来提新的需求。我们的新需求是为这个笔记应用增加 markdown 支持,具体来说,需要在编辑器右上角提供两个模式切换按钮。 那假设这个时候我想换行,怎么做呢?直接按回车肯定是不行的,按回车就提交了,正确的做法是按 shift 加回车。你看这样呢,就可以回车了。我们继续输入任务内容, 首先是编辑模式,显示所有文本内容,并对其中的 markdown 语法进行高亮显示。然后还有一个是预览模式,它用于显示 markdown 的 渲染结果。现在再回车。 好,可以看到 codex 开始工作了,在它工作的间隙,我们再创建一个新的绘画,让它再处理另外一个关系不大的任务。 我们的新任务就是给这个笔记项目生成一个 logo, svg 格式。可以看出这两个绘画都在工作中了。假设这个时候你突然想到了我们的笔记软件有深浅两种模式,这个 logo 需要在任意一个模式下都清晰可见。我们最好提醒一下 codex, 以免它忘了, 好让我们发送请求。不过这个请求似乎没有发出去,它似乎卡在这里了。没错,在默认情况下,只有当上一个请求完成后, codex 才会继续处理下一个请求。 不过到那个时候就有点晚了吧,毕竟 logo 都生成好了。我们能不能现在就把这个信息发送给 codex, 让它在生成 logo 前就注意到这一点呢? 没问题,注意到这里的 steer 按钮了吗?点一下,我们的请求就会立即发送给 codex, 这样我们的目标就达到了。那 codex 现在还在运行中,我们稍稍等待一会儿。 好,可以看出 logo 已经生成完毕了。我们切回到原来的那个绘画,看看它的进度怎么样了,它还在运行中,所以我们可能还需要再稍微等那么一会儿。 好,这两个任务呢都完成了,我们来直接打开软件,看看最终效果。首先是要打开终端,然后呢,我们运行 n p m start, 打开这个 electron 应用。呃,看起来好像是有点问题啊。 logo 没有被成功地加载起来, 那我们需要跟 codex 说一下这个事情,让我们先关掉这个 electron 应用。 然后呢,我们关掉这个 electron 进程,先看看这个 logo 在 不在 啊?这个 logo 确实是在 public 文件夹里面的,那应该不是文件不存在导致的。那是不是这个 svg 文件的格式有问题呢?我们来到访达来验证一下。 打开这个 public 文件夹,看来这个 svg 文件的格式也是没有问题的,毕竟访达都正常渲染出来了。 那大概率是 electron 加载这个 svg 文件的方法有问题。让我们来让 codex 修一下。首先按 command 加 g, 我 们唤起这个绘画列表,然后选择生成 logo 的 那个绘画, 然后在这里面我们输入具体的问题, logo 没有显示出来。提交好,提交之后呢, codex 就 开始给我们排查原因了,我们再稍微等一会儿。 修复完毕,我们再次启动这个软件看看效果。 首先打开终端,运行 npm start 好, 这次看起来 logo 是 成功的显示出来了,我们还可以随便点一点其他的功能,看看整体是否运转正常。 那 markdown 呢?我们可以随便输入几个 markdown 的 关键词,看一看它的高亮显示是否正常。看起来似乎并没有什么太大问题,各种格式呢,都可以非常正常地显示出来, 可以看出预览也是没有问题的。那这次需求就到这里了,我们再次回到 codex 这里,继续迭代它。 前面我们讲的呢,都是 codex 的 基本能力,下面我们来讲讲 plugging。 你 可以把 plugging 想象成一个 codex 的 外挂,它会给 codex 相应的能力,帮助 codex 去做更多的事情。这么说呢,可能比较抽象,我们可以来实战一下。呃,我们首先可以打开侧边栏, 然后点击里面的 plugins, 在 这里我们就能够看到所有可用的 plugin 了,其中有能控制电脑的,有用于操作 chromed, 还有用于编辑 excel 的 啊,还有一些是用来制作 ppt 的。 如果 plugin 的 旁边打了勾,那代表这个 plugin 已经被安装好了。如果 plugin 没有安装的话,旁边会是一个加号,我们点击这个加号就可以正常安装了。我们来随便点几个 plug in, 看看它内部到底有什么。 比如我们可以点一下这个叫做 gmail 的 plug in, 可以 看到这个 plug in 内部有三个组成部分,其中一个是 app, 两个是 skill。 这个 app 呢,是用来把 codex 和 gmail 连接起来的, 它里面提供了很多的工具,当然 codex 没有叫它是工具, codex 叫它是 action, 但其实本质上啊,这里面就是一个一个的工具,跟 mcp 的 工具呢差不多。 比如 apply labels to emails 就是 用来给邮件打标签的 archive emails 就是 用来归档邮件的。这个 app 一 共是提供了二十四个这样的工具,除了 app 之外,这个 plugin 还提供了两个 skill, 呃,你基本上是可以把 skill 当成是给大模型看的一个说明文档, 比如说是这个 gmail skill, 它就写明了怎么总结邮件内容,怎么赚,写回复,以及什么时候该调用哪一些工具啊等等。 而这个叫做 inbox treeash 的 skill 呢,则是告诉大模型如何给邮件归类的,比如说哪一些邮件比较紧急,哪一些邮件需要回复等等。如果你对 skill 比较感兴趣,可以看一下我的这个视频,把 skill 的 使用方法和运行原理一次讲明白。 gmail 的 这个 app 所包含的内容呢,就只有这三个了,我们如果选择安装 gmail 这个插件,那其实就是选择安装了这三个组件。等到用户想要 codex 操作 gmail 的 时候, gpt 模型便会找到这三个组件,并用它们提供的能力和说明来完成。用户的要求 大致就是这个样子的。我们来看一个具体的例子,比如说是 presentations, 这个 plugging 呢,是用来写 ppt 的, 它只有一个组件,那就是这个叫做 presentations 的 skill。 这个 skill 详细说明了该怎么做才能做出一个高质量的 ppt。 下面呢,我们就尝试用这个叫做 presentations 的 plugging 来完成我们的需求,让我们来新建一个绘画,然后输入我们的要求,给这个笔记软件做一个 ppt, 介绍它的产品设计和技术架构。 提交之后, codex 就 会找到我们前面所说的那个叫做 presentations 的 plug in, 并使用那个 plug in 提供的能力来做 ppt。 当然,如果你担心 codex 找不到这个 plug in, 或者说是找错了的话,你可以明确要求 codex 使用这个叫做 presentations 的 plug in, 这只需要在任务的最前面输入一个 at 符号,然后敲入 presentations 回车,这样 codex 就 一定会使用 presentations 这个 plug in 来做 ppt 了。 不过不加也没关系, codex 会自动找到这个 plug in 的, 所以呢,我们暂时就把它给去掉吧。好,提交,可以看出 codex 开始工作了,我们稍微等待一会儿, codex 写好了,我们打开看看。 中规中矩吧,其中其实还有不少可以改进的地方,不过这已经是一个不错的起点了,我们可以在这个基础上做一些其他的改进。 这个叫做 presentations 的 plug in 并不能算上经验。下面呢,我给大家介绍 open ai 所提供的两个用来镇店的 plug in, 一个呢是叫做 computer use, 用来控制电脑。另一个呢是叫做 chrome, 用来操作 chrome 浏览器啊,我们先来试一试 chrome 这个插件, 让我们来到这个插件管理的地方,然后呢,点击 chrome 旁边的这个加号来安装这个插件, 点击 install 好, 安装好了。然后呢, codex 提示我们需要在 chrome 上面也安装对应的扩展也行。好,那我们就按照它的指示来安装这个扩展。 那一切准备就绪之后,我们就来尝试用用这个 chrome 插件,我们可以直接点击旁边的这个按钮,这样的话, codex 就 可以给我们出实化一个使用当前插件的这么一个请求。呃,我们可以把后面的这个部分给去掉,换成我们具体的请求, 那就是打开 product hunt 首页,然后再找出今天最热门的三个新发布的产品,总结它们各自的特点,并附上对应的访问链接好提交。 呃,为了让大家看得更清楚,让我来把 codex 缩小一点,把 chrome 浏览器放出来,这样的话呢,大家就可以更清楚地看到 codex 到底是如何干活的了。 可以看到 codex 创建了一个标签组,这个标签组呢,专门用于解决我们的问题,然后它在这个标签组里面访问了 product hunt 的 首页,今天最热门的三个新发布的产品就在这里了,相信 codex 也看到了。 可以看到,现在 codex 开始打开另外一个标签页了,这个呢,看起来是第一个产品 brew 的 一个相关网站,然后呢,它又打开了一个。 呃,接下来呢,我们就不管了, codex 估计还会查看更多的网页,我们就在这里稍微等待一会,相信他等会就可以查询全部的产品页面,然后给我们一个比较有效的反馈,让我们稍微等待一下。 好, codex 给我们总结了,这个呢,基本上也就是我们想要的结果了,这个呢,就是 chrome 这个插件的相关使用方法了,让我们把这个 codex 再次最大化。 然后下面呢,我们就来看一看 computer use 这个插件的使用方法,它是用来操作电脑的,同样,我们点击这个加号,然后进行安装, 安装成功,让我们来使用一下。跟 chrome 的 使用方法类似,我们也可以点击 computer use 旁边的这个小图标,这样直接就能开启一个相关的 computer use 绘画。我们先把后面这段文本删掉,因为它跟我们真实的请求没有什么关系。 然后呢,我们再稍微改一下这个请求所对应的目录,我们现在呢是放在马克笔记这个地方,但实际上我们要打的这个请求呢,跟这个项目其实没什么太大关系,所以呢,我们就选择 don't work in the project, 也就是说,这就是我们随便提出来的一个请求,不会去绑定某个具体的项目目录。之后,我们就可以正式输入自己的请求了,那就是请打开我电脑自带的日历应用,帮我新建一个五月二十八日十点的日程标题,叫做讨论马克笔记的后续设计。 没错,就是这样,我们让 codex 操作一下日历这个应用,然后同之前一样,我们把 codex 缩小,把日历这个软件漏出来。这样呢,大家就可以更清楚地看到 codex 是 怎么操作我们这个日历软件的。 好, codex 首先询问我们能不能使用日历这个应用,我们同意, 可以看出 codex 开始行动了,这个呢就是 codex 的 鼠标,它跟我们所使用的鼠标呢,根本是两套,彼此之间互不影响啊。然后 codex 呢就开始操作这个鼠标,去完成我们的需求, 它还需要我们确认一下是不是真的要创建这个日程,这个有点啰嗦,那当然是确认了,我们给它回复一下, 好,看起来 codex 已经完成了我们的要求了,我们来看一下, 看起来这个日程的标题和时间段都是满足我们要求的,那就没问题了,我们再把 codex 最大化。 这个呢,基本上就是 computer use 这个插件的使用方法了。值得一提的是, codex 使用独立的虚拟鼠标,与你的鼠标互不干扰。刚才把日历软件提到前台只是为了掩饰,实际上你完全可以让它在后台默默干活,自己该干嘛干嘛,上网看视频都可以,完全不会耽误。 好, computer use 讲完了,我们接下来就来看看 skill 是 如何使用的。想要浏览 skill, 我 们就必须要先打开 plugins, 然后再点击这里面的 skills, 就 可以看到可用的 skill 列表了。 其实我们之前用 plugin 的 时候已经间接的用过 skill 了,因为无论是 presentations, computer use 还是 chrome, 这几个 plugin 的 核心组建呢,都是 skill, 你 在这个 skill 标签下面都能找到。 当我们安装对应的 plugging 的 时候呢,我们都会把相关的 skill 一 块儿安装好,所以我们在这里都能找到这些 skill。 不 过有一个王牌级的 skill 是 单独列在 skill 这个标签下面的,它并没有一个对应的 plugging。 这个 skill 呢,就是 mhgen, 它是用来生成图片的, 相信大家对 g p t 的 生图能力早有耳闻,不仅美观,而且非常的真实。下面呢,我们就来使用这个 skill 来创建一个图片。我们在马克笔记这个项目下新建一个绘画,然后输入我们的要求,给这个笔记软件生成一个宣传海报图片,注意要使用我给你的真实的软件截图。 然后呢,我们需要给 codex 相应的软件截图,我们先按 command 加 j 打开终端, 然后执行 npm start 命令来打开我们的笔记软件, 然后我们回到 codex 这里,点击加号,再找到其中的 attach electron 这个选项,这里面的 electron 其实就是我们的马克笔记软件了, 我们的这个笔记软件就是用 electron 做的,所以呢,在 codex 里面看来,这个笔记软件就叫做 electron, 我 们来直接点击这个选项,点击之后呢, codex 询问我们是否要启用这个功能,我们点击 enable, 然后我们的马克笔记截图就到了聊天框里面了,这样 codex 在 做海报的时候就可以根据真实的软件截图来做了,是不是很方便呢?点一下按钮就可以把截图放进来了, 不过这个还不是最方便的, codex 还提供了一个快捷键,按一下就能够把截图传过来。我来给大家演示一下,我们之前给 codex 的是浅色模式的截图,我现在在给 codex 传一张深色模式的,我们回到马克笔记这里,调到深色模式, 然后重点来了,左右 command 键同时按下,这样深色模式的马克笔记截图也传给 codex 了,这个确实更加方便了吧。好,现在 codex 有 了浅色和深色两种模式的截图,我们可以让它开始做海报了。提交, 首先我们可以注意到 codex 会使用 image 这个我们之前提到的技能来做这张宣传海报,然后我们就再等等,看它能画出什么样子来。 画完了,我觉得还行吧,确实是基于我们的截图来做的,不知道你觉得怎么样呢? 除了使用 codex 给我们安装的 skill 外,我们也可以创建自己的 skill。 让我们按 command 加 n 新建一个绘画,然后输入我们的任务,写一个代码审核 skill, 专门给当前的项目使用。这个 skill 应该包含如下的规则。好,我们提交 可以看到这个 skill 已经做好了,它的名字就叫做 marknotes code review。 下面让我们按一下 command 加 n 新建一个绘画,试试这个 skill 的 效果。首先我们 at 这个 skill, 然后提出我们的请求,检查当前项目的代码是否有问题。好,可以了, 结果出来了,还可以,我们还可以让 codex 根据审查的结果来修改代码。这里呢,我就不再继续演示了, 我们的笔记软件每天都在迭代,每天都有代码更新,所以我们最好能每天定时检查一下代码,看看有没有什么问题。这种场景就很适合起一个定时任务来处理。 codex 也提供了这样的功能,让我们来点击这里面的三个点, 再点击 add automation。 呃,也就是添加一个定时任务。这里呢是定时任务的标题, codex 已经帮我们填好了。这里呢,填写发起定时任务的时候,我们需要发给 codex 的 要求,我们的要求呢就是检查当前项目的代码是否有问题。 然后下面呢是执行环境,一共是有三个选项,分别是 local, worktree 和 chat。 local 呢是在某个项目目录里面运行这个定时任务 worktree 是 基于某个项目目录创建一个新的 worktree, 这个定时任务就在这个新的 worktree 里面运行。 worktree 的 概念我们之前讲过,它是 get 的 一个概念,如果你还是一知半解的话,可以先不管,我们这里不用这个选项。 chat 呢是执行环境,不跟任何项目目录绑定,我们之前用 chrome plugin 搜索网络的时候,实际上是用过 chat 环境的, 这里最适合我们的是 local, 毕竟我们的定时任务就是要扫描马克笔记的项目代码,所以一定是要跟某个项目目录绑定起来的。让我们选择 local, 然后在这里面选择马克笔记,然后这边呢是运行频率,我们选择 daily, 具体的时间呢,我们就维持在九点钟,意思就是我们这个定时任务在每天九点钟的时候启动, 下面呢我们选择模型 g b t 五点五,推理强度呢,我们就维持目前的 medium 就 好了。然后我们点击 save, 再打开左边栏, 我们就可以看到 automations, 这里面多了一个一。点击之后就可以发现我们创建的定时任务了,它会每天十点开始运行,每次运行的时候都会创建一个新的绘画,我们可以点击这个按钮试运行这个定时任务, 可以看到一个绘画创建出来了,就是用来运行这个定时任务的,我们来打开看一下, 好,可以看到这个定时任务已经完成了,后面每天跑的也都是这个样子了,那这个就是定时任务了。最后我想给大家讲讲 codex 的 一个特别有用的功能,那就是 codex mobile, 具体来说就是我们可以在手机上操纵 codex 来给我们完成任务,让我们来点击这里面的 codex mobile, 再点击 allow 允许手机操纵这台电脑, 然后再点击弹,点击完弹了之后, codex 应该会给你显示出一个二维码来。 呃,如果你像我这样没有显示出二维码的话,可以点击这里的手机图标,这样二维码就出来了。随后我们需要打开手机摄像头扫描这个二维码。然后呢,我们就会被引导到叉 g b t 的 codex 页面。在这里我们就能向电脑端的 codex 发送指令了, 比如我们想让它操作一下日历。你还记不记得我们之前在日历上创建了一个日程标题,就叫做讨论马克笔记的后续设计。现在我们在手机上再发送一个指令,让它把这个日程去掉,我们点击聊天。 然后呢,我们再点击这里,呃,在里面找出 computer use 这个选项。 随后呢,我们需要输入我们的请求,我们的请求就是把日历中五月二十八号呃,讨论马克笔记的日程删掉, 写完之后先不要忙着提交,你看,我们现在在马克笔记这个项目目录下,但我们的请求其实跟这个项目的代码没什么关系,我们就想操作一下日历软件,所以我们需要再点一下这个设置按钮,然后选择不使用项目。好,这样呢就万事俱备了。我们提交请求, codex 首先询问我们是否同意使用 calendar 这个软件,我们批准。然后 codex 再次询问我们是否要真的删除掉这个日程,我们确认, 随后 codex 就 开始操纵电脑了,我来给大家看看电脑上是个什么样子,你看日历上面多了一个鼠标,它正在操纵电脑删除这个日程。 好,删除成功了。这样呢,我们就做到了用手机来操纵电脑了,是不是很方便呢? 这样大家在外面也可以使用 codex 来做各种各样的事情了。好到这里本期视频就结束了,我是马克,用最通俗的语言讲最硬核的技术,我们下期再见。拜拜。

作为一个 codex 和 cloudco 同时都在使用,并且每个月至少花二十美元订阅费用的使用者来说,今天就想和大家聊一聊这两个工具到底该怎么选择。因为最近很多朋友问我到底是 codex 还是 cloudco 更好用, 那这个时候我往往都不会直接给答案,而是建议大家在条件允许的情况下都使用,看看因为好坏是因人而异的,哪个工具更好用,更多看你的需求是什么。 所以今天就和大家分享一下我平时是如何使用这两个工具的。希望这一期的内容分享完之后,可以让大家更加直观的感受到这两个工具的区别,从而选择到更加适合自己的工具。 首先 codex 它就是一个桌面端的 app, 从官网下载下来之后双击就能使用,跟装一个新的 app 是 差不多的,那 ploco 起步它就是一个命令行,对完全不懂代码的人来说,门槛其实还是挺高的, 但是我依然安装它的原因就是我把它当成一个很厉害的工程师,平时我会用它来帮我解决本地配置安装,还有环境检查等等一些技术性的问题。同时它也有自己的桌面板叫做 club, 但是相对来说工程位确实还是比较重一些。 如果你看到命令行三个字就觉得头大,那我建议你直接选择 codex。 当然想要用 cloudco 的 同学也可以回看我之前推荐的这期教程,它有分享如何在 vsco 里面使用 cloudco, 同时是接通国内大母型的用法,那相对命令行的使用来说,它的界面对于普通用户来说会更加友好。 那接着我们往下就是哪个工具到底适合哪一类人。首先 codex, 它的整套设计明显是给那些设计师,营销人还有内容创作者来用的。它默认你是不会写代码的,而是用这个工具帮你干活。那 clark co 它就不一样,它会默认你是独立开发者, 独立产品人。工具箱里面塞满了各种 skill, m, c, p 还有 sub agent 这些偏工程的东西。如果你愿意学,这个工具的天花板会更高。但如果你只是想轻量地使用 codex, 相对来说大部分的功能你都不用,看文档就知道怎么用了。那接下来什么场景决定了你应该使用哪个工具。 如果你想要做 ppt, 海报、出图或者短视频, codex 基本可以一步到位。因为它内置了 imagegen, hyperframes 这些插件, 加上 presentation 这些 plugin, 你 用一句话说清楚你的需求之后,调用这些插件就会出来你想要的东西。那反之你写代码,搭一些比较长的工作流,做一个真正的产品, 那 cloud code 的 长上下文以及重构能力还有 sub address 能力相对来说就会更加扎实一点。说到这,如果你日常的工作当中需要做一些圆形图或者 p 图之类的 cloud 还有一个非常好用的功能,就是这个 cloud design 打开之后就会有三个入口,做圆形图,做 ppt 或者做其他的内容。一句话描述你想要的东西,它就会直接给你出一版能用的稿子。它还能根据品牌库里面的配色,字体组建风格,自动去做一些对齐。重点是它的额度是跟 call pro 套餐里面共享的, 有了这个功能之后,当我需要做一些图的时候,我就完全不用排队去等设计师的时间了,直接通过这个工具帮我一键生成。当然 codas 还有一些比较厉害的功能是 cloud 没有的,就是 codas 的 这个 computer use 功能,以及它的 codas mobile, 它能让你在下班的路上掏出手机直接说一句,帮我把日程整理一下, 电脑就会自己在家干活。而 clolo 当然也行,就像我之前给大家分享的在飞书里面如何使用 clolo 的 教程,当然这个也是需要配置的,但是相对普通人来说没有那么友好,门槛会相对高一些。所以最后总结一下,如果你是做自媒体广告营销还有设计的,直接用 clolo。 如果你是独立开发者,想要搭一些比较长任务的工作流,咱们就直接用 clolo。 如果你两个都想要,那咱们就针对这两个工具去做分工, 当然你需要一些比较谨慎的数据的时候,也可以让它们做交叉验证。最后关于这期内容,如果你还有其他疑问,也欢迎评论区留言,同时后续我也会出更多关于 cloud code、 desk、 skill 等相关内容的教程,记得持续关注哦。

对比 codex 和 cloud code 的 这三个 agent 的 区别,从本质上来说,它们都有桌面端, ai agent 都可以读写你的文件,甚至控制你的电脑完成各种操作。 但三者之间还是有不少差异。首先是开源, hermes 完全开源,而 codex 和 cloud code 都属于各自公司的闭源产品。 再说模型支持,目前 codex 和 clockcode 都更倾向于使用自家模型,如果想要更换其他模型,通常需要额外配置一些工具,比如 cc、 switch。 而且不少朋友实际体验下来会发现,切到 deep sec 之后,整体效果有时候会出现比较明显的下降。 hermes 就 没有这个问题,模型上可以随意切换,不用被模型生态绑定,也不用为了换模型重新折腾一遍。 接下来,记忆体系是 hermes 的 特色, code 和 clock code 目前主要还是依靠手动 md 记忆文件加上自动记忆,需要的时候会以上下文的方式把这些内容注入进去。 而 hermes 增加了,当它解决完一个复杂问题之后,会自学习记住你的操作习惯和偏好,自己创建 skill 技能来提升效率, 下次遇到类似任务直接调用,会慢慢学会你是怎么做事的。而也正是因为有长期记忆的存在, hermes 还有一个非常有意思的概念, profile。 你 可以把它理解成多个独立的 ai 智能体,每个 profile 都有自己的记忆技能、人格和上下文。我们可以创建多个 profile, 它们彼此完全隔离。对于长期使用 agent 的 人来说, profile 真的 是一个非常实用的设计。 当然,在使用体验上, hermes 还是桌面端新人,刚发布时一直不少问题,所以从发布到现在也在快速迭代。 hermes 桌面版本质上其实就是终端 c l i 版本套了一层图形界面,两者共享一个后端。 而 clockcode 在 这里给我的感觉还是更偏向专业开发者。 codex 则属于完成度非常高的,有 computer use, 浏览器操控等等都已经做得相当成熟。而 hermes 目前 computer use 只在 mac 上有官方支持。 所以我的结论很简单,如果你已经在稳定使用 codex 或 clock code, 不 建议第一时间切过来。但如果你是第一次接触 ai agent, 或者想找一个门槛低成本也不高的方案,那么 hermes 桌面版确实是一个不错的选择。 很多时候一个月会员的钱就够你用 deep 跑很久了,而且不用担心账号被封或者订阅限制的问题。

你们一定一定一定要想办法去用上 codex 跟 cloud code, 我 觉得这个真的是普通人能够用最小的一个成本去接触到目前全球最前沿的一个 ai agent, 就是 大家现在是不是还停留在说,哎,我们大模型有一些啊, cloud 啊,或者说 gbt 啊这些,或者说可能有的同学还在用豆包啊, deepsafe 啊这些大模型阶段,那实际上目前最前沿的一些 ai 落地,你会发现它的 ai agent 跟大模型又相差的非常的大,就是你们没有踏出这一步,你们完全就没有感受到啊。 呃,为什么我觉得说 codex 是 我们普通人最低成本去用上最前沿的东西,反而不是 cloud code, 主要的原因的话是 cloud code, 其实如果你要用上,你会去遇到各种封号啊,用 ip 啊这种形式,对吧?对于你的一个使用的门槛会还是相对比较高的,但是 codex 它不一样,为什么我解释非常解释的 简单的跟大家讲这个事呢?就是它的量大管饱,什么叫量大?就是 token 啊,它的量大,然后呢它又便宜,它不像 codex 一 样,比如说你啊,一个月你去买一个 plus 或者二 max 的, 你用八百多块钱一个月,对吧?你 gpt, 你 不用 gpt, 你 目前你可以在一些公开的一些地方,你可能大概一百八,对吧?你可以买到,你可以用的非常的舒 服。一旦你去下载了一些 code, 一个 codex, 你 会发现你的整体工作流程会完全不一样啊。我们拿产品经理举例, ai 产品经理, ai 运营或者 ai 卷方案举例,呃,拿最基础的一个流程就是调研,对吧?你调研也好,或者说你去做啊,设计,写日常的文档也好,实际上你很大的工作都在写,对吧?那你写你, 你写,你不管用 ai 智能写也好,或者说大模型写也好,都可以,但是 ai 智能它可以去搜搜索你本地所有的一些能力,对吧?你的一些文档沉淀去给它,通过通过充足的上下文,你去给它写出更好的一个文档,同时的话也可以去调用一些 他自己,去调用一些你自己以及沉淀的一些 skill, 对 吧?你去自己只要你能够把一个流程给 s o p 给沉淀下来了,后续沉淀成 skill 之后,你无后续,你只要无限的跟他说,哎,你帮我调用这个 skill 啊,那可能是比如说给你画一个图,写一个 p r d 啊这些,你只要说这句话,它就无限的非常轻松的给你产出符合你要求的这么一个文档出来。 所以说对于你整体的工作的提效是大家没有办法想象中的那么高效的。我已经要求我们公司的人或者说我自己的学员,你们必须要不就用 kol 的 kol, 要不就用 kol css, 你 们必须使用你。 如果说 ai 时代你没有去用这种最前沿的一些 ai 的 agent, 实际上你会发现,哎,你的认知还是在自己的一亩三分地里面啊,那 我没有要营造一些任何的焦虑,我真的希望大家能够用上这些 ai 政策,然后去改变自己的整体的工作方式,因为我们目前我们公司的工作方式就已经变成了 ai, 想 ai 做,对吧?人每天做的什么?跟 ai 对 话, ai 去人去审核,剩下的所有事情都是 ai 做,那你一想你的工作效率提升的会极度的快啊。所以说,哎,我们 这个是真的是我觉得最低成本最快的去提升我自己的一个工作效率也好,或者说我的认知 ai 认知也好,去提升我的 ai science 也好啊,这个产品就叫做 codex, 大家可以去他的官网去下载,非常简单,没有任何的门槛啊。

如果你用 ai 写过代码,你一定会好奇说不同的模型配上不同的 agent 工具,到底能差别多大呢?怎么样组合才是最好的 coding agent? 我 之前做过一期派 agent 的 教学,而国内其实讲派的人不是特别多。那评论区问的最多的问题呢,就是说视频里面派能做的 cloud code 和 codex 不是 也都能做吗?那有什么区别呢?当时啊,其实我不能给出很具体的回答,只有一种定性的感觉,因为我没做过这种量化的具体的,有数据的测试。那现在有人替我测了 data breaks, 每 美国做企业数据和 ai 服务的头部大厂,在自家几百万行的真实代码库上,把主流的模型和 agent 的 工具挨个跑了一遍,正好回答了这个问题。我们直接来看这张信息量最大的图, 横轴呢,是每个任务具体花多少钱?纵轴呢,是任务的通过率,就是成功率。那这个点啊,肯定是越靠近左上角越好, 代表它又便宜又能干。然后这里每个点是什么意思呢?每个点其实啊,都代表这样一个组合,你看啊,就是一个模型加上某种他的思考的强度,加上一种 agent 工具。比如说这个点,大家看其实就代表说用 pad agent 这个工具接上 opps 四点八的模型,推理强度呢,开到 x high 这个级别, 然后它所带来的这个最终的结果。这条红色的虚线啊,大家看到其实代表的就是说性价比,天花板,意思呢,就是我同样花这么多钱,能买到的最高分是多少? 这条线上大家数一数,一共有七个点,然后其中四个都是派,然后另外三个呢,分别是 codex 啊,然后 cloud code。 说实话呢,派能占到四个,连我这个派的支持者,日常的使用者都超出了我的预期,原因呢,我们后面再来分析。然后全场的最高分其实也在这条线上,大家看到是 high, 接上 off 四点八,然后开到 x high 这个档位,它的任务通过率成功率啊,是百分之九十。这次测试呢,包括了 gbt 五点五,五点四系列,然后 off 四点八, sony 系列,还有开源的这个 gim 五点二,没有包含最新的 gbt 五点六和 vivo 五。那这个跑分到底可不可信啊?然后到底测的是什么样的能力呢? suplex 自己是这样说的,那市面上公开的测试标准,比如说这个 sweet bench, 然后 terminal bench 这些题目呢?因为是公开的,所以答案就会慢慢的泄露出来,然后被这些这个大公司抓进去作为训练数据。 各家的模型呢,都会对这些题目啊做针对性的测试,相当于我们考试的时候去作弊刷分嘛。而且还不光是这个刷分的问题,公开的测试题啊,其实跟他们日常平时写的代码需求其实是不太一样的, 就说一个是真的实干,一个其实是在考试做题。所以他们的做法就是啊,直接拿自家工程师直接合并过的 pr 当做考题代码库呢,几百万行, 有十几种不同的语言,像 scale 啊, go 啊, rust 啊,呃, type script 等等,从每天几千次的合并代码里面去挑选高质量的这种 pr, 然后原来 pr 里面这个测试用力啊,可以当做这种评分的标准。所以这套题啊,有两个特点,一个呢,就是说 模型,他没有见过这些题目。第二个呢,就是他评分相对来说有客观的标准。然后我们来看这个图,按照这个 跑分的这个维度啊,图上的点大概可以分成三层,第一层呢,就是八十二分到九十分这一层,比如说像 up 四点八, g m 五点二, g p t 五点五,旗舰模型啊,基本上都在这一层,但虽然在同一层啊,它的价格差距却很大, g p t。 五点五呢,比 up 四点八要便宜二点二倍。 开源的 g r m 五点二,质量跟 opus 打平,成本呢,却只有一点二八美金,而对应的 opus 的 其实是一点九四美金。在 abrax 的 整体评价时啊, g r m。 能处理最难的任务,可以作为日常主力的编程模型来使用。还有一个细节啊,我们来看就是横轴用的是每个任务的平均花费,不是模型百万 token 的 单价 是为什么呢?因为每个模型的 token 效率其实不一样,单价便宜不代表说最后总的花销便宜。比如说 sony 五的单价,其实比 office 要便宜不少,但反而每个任务的花销却更高,因为 sony 五啊,干活喜欢废话很多,多 多读多想,消耗的总投款是 opus 的 一点九倍,最后分数还比 opus 低了六个点。模型对比完了之后呢,我们再来看第三张图,就是同一个模型啊,同样的思考强度,如果我接触不同的 agent, 差距能有多大?上面三个呢,是 opus 四点八分别接上派和它原声的 cloud code。 下面呢,就是 g p t 五点五分别接上派跟它原声的 codex, 我 们看到它这红色圆圈呢,其实代表派,然后这个空心的圆圈呢,就代表说官方的 call code 或者 codex 的 工具。这上面整体看来,每一行每一组啊,红点其实都在黑点的左边,然后从价格上来看呢,便宜一点,二倍到两倍不等。 那看完价格,如果我们来看它具体的跑分都差不多的,都在三个点以内,只有这一组可能有点例外, 是这个八十二分对上八十九分,对应呢是 up 四点八开到最高的这个 max 档,然后派会落后大概七个点。作者说这有可能是噪声,也有可能是上下文变长以后,模型开始变糊涂了。顺便说一句啊,这不仅是 data breaks 的 它的这个测试,另外一个独 立测评开发者呢,叫做 massive slam, 它也做出了类似的这种测评的结果。然后整体的评价呢,也是派能做出效果差不多的这种结果,但会更快 更便宜。那么问题就来了,就是派只是一个独立开发者的个人那种开源项目,它凭什么效果上会跟大名鼎鼎的 cloud code 和 codex 打 平呢?然后价格还便宜一半? dota bricks 啊,这个文章里面其实没有解释太多,它只是笼统地说,派管理上下文会更有效,然后工具集会更精简, 每一轮给模型的上下文会比这些其他的工具要少三倍左右。这个呢,也跟我上一期做的派教学视频发现是一致的,当时我看了一眼这个系统提示词啊, clark cold 发一句 hello, 你 好,这两万起的这种 token 就 消耗掉了,派呢,却不到一千五百的 token, 但如果起点只是差这两万的 token 啊, 面每一轮的这个循环,其实都会命中之前的缓存,最后不可能实际结果会差出三倍的这个差距。所以啊,我的推断是呢,派在干活的过程当中,管理上下文的方式也会比 cloud code 和 codex 会更神。 当然呢,你也不能说这个很长的提示词只有缺点没有优点。从另一方面来看呢, curl code 里面多数那两万提示词啊,不是白给的。如果你的提示词写的比较差,比较模糊,比较简短,那派呢,会表现的比较差一点,有更完整的系统提示词的这些 curl code code 工具啊,反而能去帮你兜底, 理解到你到底想要什么,帮你做出一个相对来说比较完整的项目。那最后来跟大家总结一下这次的测试结论。第一呢,就是 g b t, 五点五, up 四点八, g l m 五点二,都是第一梯队的旗舰模型,并且开源的 g l m 啊,成本更低。第二点呢,就是 token 的 单价不能实际反映最后消耗的金额。 token 的 效率其实也很重要,比如说 token 的 单价呢,是另外的一半,但你要花费的 token 的 总数量是另外的十倍,那你最后的消耗的金额不就是另外的五倍吗?对, 然后第三点啊, token 的 工具也很重要,也就是 harness, 同一个模型换成派,分数差不多的情况下,成本却能差两倍左右。 所以啊,我自己是非常的关注以及长期在使用派任何这个项目。说到派呢,最后也跟大家打一个小广告,是我跟我的合伙人啊,写的一个派的一个开源项目 web ui 叫做派 web, 就 上期教学里面使用的那个界面,比派的命令行键面对小白来说更容易上手和高效。那个链接就放在这里了,在这里呢,非常真诚的感谢一下使用派外的朋友。这个项目现在已经有一千三百多个 star 了,而陆续还有很多朋友在不断的提 pr, 然后为这个项目去增加不少的功能, 我呢会一直更新下去。然后有些朋友也一直在问,说之前去年的三十个 ai 项目为什么不做下去了?其实大家看到我一直都有在做, 只是在 ai 的 时代,你得用一种更加 ai native 的 方式去做自己的项目。最后还有个意外之喜啊,就是之前我一些数据比较好的视频啊,经常会被网上有些朋友洗稿,但这期呢,因为用了完全自己开发的这个演示的项目,竟然逃过了被人洗稿的这个魔掌。好了,今天视频到这里,我是对中黑心李超,我们下次见。

到底是谁在说 codex 和 cloud code 是 同一水平的呀?我这周不是 cloud code 二十倍的额度不够用嘛?然后我又开了个 codex 的 五倍的额度,然后这周深度体验下来,就感觉太难用了, 很卡顿。你知道吗?这卡顿的感觉让我找到了当初用字节的脆的感觉。然后我今天深度搓了一下午,动不动就要我来问我两句,然后改的也很别扭,我实在受不了了,就把这个功能再迁移回 cloud 的 进行开发,就感觉非常顺畅, 就和便秘了一周突然通了的感觉一样,太爽了。那些说 codex 和 cc 差不多水平的高低,是收了点营销费吧?兄弟们,千万别被奥特曼给骗了,奥特曼这人坏得很。

codex 和 cloud code 新手到底选哪个?那先说结论,如果你是专业程序员,两个都可以试试。但如果你和我一样不是专业做编程的,只是想用 ai 处理一些日常的工作任务,做 ppt, 做视频,做资料整理或者做自媒体内容,那我会更推荐你使用 codex, 因为我自己两个都有长期使用 codex, 我是 pro 版本,每天的 talk 还算够用。 那 cloud code 也是 pro, 但我明显就用的少很多。一般只有两种情况,我会去使用 cloud code。 第一就是 codex 这边的任务太多,暂时处理不过来。 第二就是 codex 某个任务异常的,我想换一个工具试一下啊。我主力使用 codex 的 原因不是我觉得 cloud 的 不强,它当然强,尤其是偏代码,偏工程 偏程序员的场景里,它是很有优势的。但问题是我不是程序员啊。我打开一个工具,第一感受到的不是它的代码能力有多强,而是我能不能看懂这个界面,我知不知道下一步该点哪里。 那我能不能把自己的工作任务交给他,以及他做完后能不能更加自然的给我继续反馈?在这一点上, codex 更符合我的使用习惯。他给我的感觉更像是一个 ai 工作台,我可以开个任务,告诉他我要什么,然后看他一步步的处理文件,生成内容,修改结果。 比如做一条视频,他可以帮我整理脚本,插画面,生成字幕,设计封面,就会再导出文件。这些都不是纯代码任务,但对我来说, codex 就 更容易落地。那 cloud 给我的感觉更像是一个很强的程序员助手。 如果你本来就习惯了项目代码终端文件目录,那你会觉得他更顺。但如果你只是一个普通的小白,第一次打开这种偏编程类的界面,可能会有一点心理压力,不是不能用,而是说没那么快的进入状态。再说大模型本身,我不会说哪个模型绝对更强,因为这个要看任务。 有些文本理解复杂,推理代码场景。 cloud 确实很厉害,但对我来说,真正重要的不是模型排行榜,而是这个工作能不能嵌进我的工作流。所以我的建议很简单,如果你是程序员,或者你主要做代码项目,那就 cloud 的 code 是 你的首选。 但如果你是小白,想用 ai 做一些具体的工作任务,那我建议你从 codex 先开始,而且 codex 目前来说也相对更加稳定一些。

现在绝对是普通人学习 ai 最好的时候,因为以前还有大批做装的部署和配置的 agent, 现在已经被各大厂商做成了下载就能够用的软件。可问题是 agent 那 么多普通人到底该怎么选择自己的第一款入门工具呢?这期视频我会综合评估市面上主流的几款 agent, 看看它们分别适合什么样的人,以及哪一款最适合入门。 首先是腾讯推出的功能足够的全面,打开首页就可以看到它主要分为日常办公、代码开发、创意设计的三个方向。 所以从整体的功能来看, word 八底他能做的事情其实非常多,不管你是想处理成办公创作内容,还是想搭建网站,基本上都能找到对应的路口。我觉得他最突出的就是在他左上角这个专家技能连接器, 你可以把它理解成 word 八底,提前把不同领域常用的专业能力、工作流程打包好了。比如我们可以介绍一个内容创作团队,里面有创意总监、文案策划、素材等不同专家把需求告诉他们,就相当于直接叫来了一整支的专业团队帮你一起干活, 不需要从零研究复杂的工作流,只需要找到对应的专家或者技能,就可以直接开始完成任务了。目前官方已经提供超过一百个领域的专家。按照腾讯公布的口径,欧克巴蒂目前也是国内日活用户规模领先的效率型 agent, 所以 我觉得它可能不是开放能力最强的一款。 它确实非常适合普通人认识 agent, 看到自己到底有哪些使用的场景,不过实际体验下来,它最大的优势也是它最明显的问题就是东西实在太多了, 比如我想要做内容,点开以后会出现很多专家和技能,我反而不知道该选哪一个。并且就我深度体验下来,其实很多专家和 skill 是 有重复的, 这样反而就让人更难选择了。所以如果你还不知道 agent 能够帮自己做什么,想要先探索办公内容或者简单开发,那么 oakbody 很 适合作为你的第一站。接下来就是字节的 tree, 现在 tree 主要分有两个方向,一个是面向开发者的 tree ide 和以及更偏普通用户的 tree。 walk q i d e 是 我最早接触的 ai 编程工具,但它界面依旧很偏,程序员这里有项目文件、代码终端还有运行的信息都会直接展示出来。 我本身就是零代码入门的,第一次看到这些内容的时候,其实我很头疼,很多东西看不懂,也不知道自己需不需要管。而吹 word 更接近普通人的综合工作台,可以处理办公内容创作、资料整理以及应用开发,而且它也加入了插件以及技能市场。 但实际对比下来,他目前展示出来的专家技能以及呈现的场景还是没有 walkabout 那 样的丰富。而且我觉得吹 id 以及吹 walk 分 成了两个路口, 好像增加了新人选择的成本,不过只想完成任务,吹 walkabout 也是能用的,但是目前呢,和 walkabout 相比,他没有特别明显的优势,但对于完全零基础的普通人来说,我是不会把吹放在第一推荐的 好,那么接下来我们就把 zcode 以及 kimi code 放在一起讲, zcode 主要是适配自家的 g r m 模型,而 kimi code 就 可以原生使用最新的 kimi k 三模型。这两个模型呢,都是国产的第一梯队,并且在全球也取得了非常不错的成绩, 而且不用针对海外的账号以及网络,在国内就可以直接使用。所以如果你更看重模型能力以及原生的适配, 他们都很适合作为你的主力。但问题也很明显,想要长期使用的话,你首先得购买对应的 call 订婚套餐。像 kimi k 三发布之后很快就暂停了新的订阅,至少我到现在是没有抢到的。另外他们目前内置的插件与 skill 还是比较少的,很多能力都还需要自己配置。所以如果你追求国产最强的模型,你可以选择它们, 但你更在乎完整的生态以及开箱即用的体验,他们目前可能还不是最优的选择。接下来就是老生常谈的 cloud code, 大家都做的很强,但真正的问题是你能不能稳定的用上。受地区和服务的限制,国内用户往往还需要解决账号、网络和支付以及环境配置的问题。 如果这些门槛你都能够解决的话, cloud code 依然是最值得优先考虑的选择之一。但叉 r 也是这些问题让它很难成为新人的第一款 agent。 而且前段时间很流行给 cloud code 结合 deepsega 等国产模型,从而降低模型的费用。 但我个人并不推荐新人这样使用 color code 的, 原本的工具以及工作流程主要还是围绕着 color code 的 模型进行适配,更换模型以后,最终的效果更多取决于底层模型的本身,这样子还可能会增加兼容、工具调用以及配置的问题,看下来省了模型的费用,但实际上又增加了很多折腾的成本。 所以如果你有一定的开发经验,也能够解决账号、网络、支付和环境的问题。 cloud code 绝对是非常值得研究的,但对于零代码的新人来说,我并不建议把它作为自己的第一款 agent。 接下来就是 codex 现在已经改名为 chat gpt 了, 它是我目前使用过最多的一款 agent, 也是在能够解决账号问题和网络问题之后,我最推荐普通人长期使用的一款。原因主要有三个,首先第一是模型的是自家的 gpt 五点六系列的模型, 他的能力已经是处于全球第一梯队,对于普通用户来说,不管是打网站、做应用还是做复杂的项目,他都已经非常非常够用了。第二是性价比,在全球第一梯队的模型里面, callix 的 价格相对更实惠一些,即便你是最低档的 plus 用户,用它来做日常的项目额度也是非常够用的。 最后就是它的插件生态,它不只是简单的这样几个功能,而是让 codex 直接连接专业的应用,在应用内部就完成任务,并且把结果直接保存到对应的项目里面。比如这里我直接调用 figma 设计网页,最后它生成的不是一张普通的图片,而是一套保存在 figma 里面可以继续编辑的网页设计稿。 当然, codex 的 门槛也很现实,账号、网络以及项目环境对零代码的新人来说,前期多少需要折腾一下, 所以最后我的建议非常简单,如果能够解决这些问题的话,那么优先考虑 codex 或者是 cloud code 解决不了的话就从 openbody 开始,但也不要把太多的时间浪费在反复挑选工具上, 因为真正决定你能不能学会 agent 的 不是你有没有选到最强的那一款,而是你有没有用到它。完成第一个真实的任务,工具还会不断更新,但 ai 解决问题的能力才是普通人真正应该掌握的东西。

我同时用 codex 和 cloud code, 在 我看来 codex 就 像一个老实又聪明的人,就是你跟他呃,你让他做什么事情,他会老老实实地去做。那有时候 c c 吧就会展现出所谓的智慧。就让你觉得说,哇这个东西好像是真的有智慧的。反正各有千秋,我现在两个都会用吧。

我在写代码这件事上,我绝对不会用 codex 或者刻牢 code 这类不带编辑功能的工具的。首先我一点也不否认,就 codex 和刻牢 codex 它是一个很强大的工具,很多的现在 a 阵工具的工都是由他们发明而来的, 但是我为什么不用呢?原因有两点,我是被逼着换了三次工作方式才解决的。首先第一点就是我写代码它肯定要能跑,对吧?就在能跑这件事上,其实你用 codex 和刻牢 code 这些就很反人类,明明你点一个按钮或者双击打开一个文件就能干的事, 你现在就变成了你要把指令告诉 agent, 然后 agent 在 帮你调度,甚至有时候他要帮你再写段代码。然后第二点是我如果有时候我要去看代码,然后正常我们看代码,我可以直接从文件里跳转,然后你用了扣袋子或 call 了扣的这种东西, 你就不得不每次,然后你去找那个对应的文件,然后你只能打开那文件,你才能看到代码是什么。为了解决这些不爽,我经历了三个阶段,第一个阶段就是我开着扣带子或可乐扣的同时,我再开一个 redder, 然后为了让他我这边改完,我另一边我去运行。但是依然会存在一个问题,就是你要来回的切换, 就这个来回阶段,其实这个体验也不是很很舒服,然后我就来到了第二个阶段。然后第二阶段是正好发现 reddit 里我可以去装一些 a 阵的插件,然后我就几乎把呃我能用到的那些插件我全用了一遍,但是无一例外,每一个的使用体验跟他们原声 app 的 使用体验差了太多了, 所以这个我也放弃了。然后第三个阶段我是切换到了一个带 id 工具的, app 的 使用体验差了太多了,所以这个我也放弃了。然后第三个阶段我是切换到了一个带 id 工具的上,就是 carter 上面, 然后在这上面可以说满足了我所有要求,我可以很轻松的打开我的工程,我也可以从某个文件里直接跳转到别的文件里看代码,同时又不会丧失 a 类能力和一些 a 类使用体验,然后我还能用到我常用的那些模型,当然它其实类似的产品还有很多, 像 code body tree 这个我早期我都是我用过的,然后体验都很好,但是为什么没有用的原因就是因为我目前有一些工作还是需要依赖于 cloud, 然后这 cloud 只有在 cloud 上可以用,然后当然除了显大小之外,还会做一些别的事情,然后这个时候我依然还会切到,比如像 code x 和 cloud code 上面去完成。 然后这个视频我其实并不想去用工具比一个高低或者怎么样,只是觉得我们在不同场景下,其实还是要选择一个合适的东西来用,毕竟合适才是最重要的嘛。那屏幕前你不知道你平常又是怎么用呢?咱们可以评论区一起讨论一下。

你是不是只会一句一句跟豆包对话,效率非常慢,有时候还特别笨?如果是,那你可能已经落后了。 真正能帮你把活干完的是像口袋纸和刻好的扣一样的工具,它能直接操控你的电脑,自动帮你完成。那今天我用一分钟的大白话告诉你,他们是什么,有哪些能力,以及如何使用他们名称统称是叫 a 卷, 中文名叫代理,那和豆包有什么区别呢?你和豆包的对话是,你说一句话,他回复你一句话,其他他叫你做什么,你只能去自己去操作。 而如果是口袋子,你可以告诉他,我要做一个 ppt, 还有获取你本地的字库,在联网查询行业资料,最后再总结生成并自动把文件保存在你的桌面上。再举一个例子,如果你的文件里有一百个 word 文档,某天突然发现文件名全部错了, 想要批量修改文件名,你只需要一句话,告诉 code, 请你按照某某格式帮我修改文件内的所有文档名称,只需要几分钟就全部搞定。所以你应该能明显的感觉到, a 选择不是简单的对话,它是能操控你的电脑,自动执行,你能遇到百分之九十常有的电脑操作。 那从豆包的一个点到口袋子,将一条线逐步串联起我们的工作流程,有了它是能极大提高我们的使用体验。那如何才能使用上呢?首先我们得先了解下这个产品的形态, 像扣对扣的口袋子叉,本质上是一个框架,你可以把它想象成是一辆小汽车的车架,没有发动机、变速箱、轮胎,只有那一整块的铁件, 想要开动这辆车是根本不可能的。同理,如果你只下载一个 codex, 一 样也是运行不起来的,你要给它配上发动机才能点火启动。 而发动机对应的就是我们所说的大模型,有豆包、 kimi、 keepicy, 你 要配置上才能正常使用。那你可能会想,既然是一个小车车架,那里面的发动机是不可以由我们自己来定,你是想装大众的,还是想装别克,还是想装丰田的? 那确实这些都可以,我们只需要安装一个工具叫 cc switch, 就 可以随意切换口袋子叉或者高尔夫扣子里面的任意一个大模型。除此之外,发动机有了,小车能走了。 但你觉得每次借车给朋友开完后,都需要自己再去调节座椅就特别麻烦。如果希望有一个记忆座椅,就可以再去调节座椅就特别麻烦。如果希望有一个这样的功能,它叫 skill, 只需要调用一下,系统会自动执行所有脚本操作,你不需要自己手动输入,就可以直接附用自己或他人的经验。那还有,你某天开着车,突然发现仪表盘出现一个故障灯,你开着去维修店, 老板拿出一个仪器往车里面一擦,他是不是就能看到具体的故障信息,报出参数了?那同样在 a 卷里面有一个叫 m c p 协议的东西,可以把它想象为修车那个仪器, 他可以获取外部系统的各种数据。比方说我在一个绘画软件里面画好一个微信小程序, 我想要让口袋斯帮我把它一比一的去还原出来,那你就可以通过 m c p 去获取这个小程序的分辨率、颜色、字号等信息,这样做出来就非常精准。 好吧,总结一下,刚刚说到这三个是我们在 a 卷的中里面最常见且最高频的操作,一是切换模型,二是调用 cd, 三是 mcp 协议。你只需要知道这三个工作原理,在后续的使用过程中基本上是没有障碍。 那下节我还是会用大白话方式跟大家分享如何进行安装以及使用,那欢迎大家点赞、收藏、留言,我加快准备。

如果你学 codex 是 为了赚钱,那这条视频比你看一百个教程还有用。 让我先问你个问题, codex 用了两个月了吧,环境也搭好了, plus 也开了,钱也花了,时间也搭进去了。然后呢?变现了吗?老板主动找你了吗?肯定没有。 问题不在 codex, 你 一直在研究 ai 能干什么,却从来没有研究过老板需要什么。你每天都在和 ai 对 话,却从来没有和客户对话。 你每天都在优化你的能力,却没有验证过一个需求。所以你越学越厉害,离赚钱就越来越远。所以你要先找到需求, 然后用 ai 去解决需求。就是为什么同样都是使用 callix, 有 人一个月接几万块钱的项目,有人连第一个客户都没有?你一直在屋里研究,却从来没有打开门, 别闭门造车了,下楼去见人,去聊需求,去看看别人到底愿意为什么付钱。

这是一期我真诚的希望所有刚入门 codex 的 小白能够认认真真看完的一期视频,这也是大白在刚入门 codex 的 时候踩过最惨烈的一个坑。 如果你的 codex 的 左侧已经有十几个不同主题的对话都放在了同一个项目文件夹里,那可能是你并不了解新建对话和新建项目的区别。如果你上下文爆了还不新建对话,你可能需要的是让新对话也能完整接上现有任务的操作方法,这个关乎 codex 工作效率和 偷看燃烧的关键小点可能之前并没有人特别详细的告诉你,那么这期视频我会彻底给你讲清楚这个所有小白都应该重点了解的词汇、文件和管理。 请你相信,看完这期视频,我会把不同情况对应的解决方案一次性的讲清楚,希望可以真正的帮助到大家。好记性不如烂笔头,详细的图文步骤已经全部都帮大家整理好,大家需要自己话不多说,我们直接开始。首先,在所有事情开始之前,你只需要清楚这两个概念, 项目文件夹和对话。这个项目文件夹其实就是你的员工,他们每一个人都给你独立汇报工作, 但是呢,他们之间互不认识,但是呢,都归你管理。项目念家就是公司,每一个对话就是一个独立的员工,你是一个拥有多家公司的大老板,你的目的就是让他们最高效率的为你工作。在种下这两个概念以后,我们切入到具体的问题, 请各位老板记住自己的身份,我们之后的例子全部都由此展开。概念清楚以后,我们来进入到具体的问题,你的 codex 的 项目很混乱,到底是什么样的乱?我们分为两种乱,第一种,你没有分项目文件,一个项目文件夹之下,十几个对话都是不同的主题。 也就是说你开了一家叫大杂会的公司,都办一大堆的业务,并且你所有的员工都在一个大厅办公。第二种,你已经分了项目文件,但是一个单独的对话,你跟他聊的太长,说的太多了,他已经出现了明显变慢,而且记忆混杂的情况。也就是说,你把公司所有的业务 全部都交给了一个老员工进行处理,他已经快要累到隔壁了。这两个问题的解法完全不同。我们先来说第一种,你没有分项目文件之你的大杂会公司如 如何抢救?这里先说最常见的错误做法,你直接在项目文件夹中开了一个新的对话,让他来整理之前所有混乱的对话。注意,我们之前提到过一个概念,你的员工之间互不认识, 如果你让他来树立你之前所有的对话,那么他就需要把你从创业之初开始,你和每一个员工的业务和对话全部都梳理一遍,再去给你进行分类。如果你的对话很少的话,你可以这样做, 是在你有十几个对话的前提之下,这将会是一场对时间和托克的一笔大消耗。而正确的解法呢,也是大白强烈推荐的,直接去对应的对话中提取你想要的业务,放到新的文件夹里。我们要做的呢,就是先新建一个项目文件夹,也就是先给你的新公司选一个地址,然后呢,直接把你想要的这个部门的员工带到你的新公司。 请你把这段话发给你原来的对话,请把这个项目文件中有关于什么什么什么的文件内容都提取出来,迁移到什么什么项目文件夹中,防止受到无关项目文件的干扰, 这样呢,你就能高效的提炼出来你最想要做的业务,去开你的新公司啦。如果你有十几个混乱的对话,但你每一个都想要继续去跑去完善,那么大白强烈建议你单独留出来一个下午的时间,把这些都分好,因为这是真正会对你的效率有巨大提升和帮助的事情。并且呢,请记得 在迁移完这个项目文件夹之后,在新的项目文件夹之内写一个记忆文件,不要着急,这个记忆文件会在视频的后面详细的去讲解这个记忆文件包括 项目的内容,进度以及关键的节点,以便于我在新的项目文件夹中开新的对话,也能够接上目前项目的进度。第二种,一个单独的对话聊得太长了,你唯一的老员工要累嗝屁了,该怎么解决? 常规的结法呢,是有压缩和开心对话,但是大白真的不建议大家去压缩对话,因为他会无差别的,你压缩你这个对话中所有的信息,那么你就很有可能会丢掉一些比较关键的节点,如果真的没得选的话,应急也是可以的。开新的对话呢,也就是招新的员工, 这是大白最推荐的,但这里呢,也分为两种情况,第一种情况就是你这个对话中聊的全部都是同一个项目,只是你跟他说的有点太多了,也就是俗称的上下文爆了。第二种呢, 读成周扒皮,就是你在这一个对话中,让他给你办了好多种不同的事情,并且这些事情全部都混杂在一起了,我们先来解决。第一种,只是单纯的一个话题,聊太多了,上下文爆了的情况,这种我们只需要去开新的对话,完成工作的交接即可。请你把这段话发给他,帮我总结这个项目的记忆文件, 包含这个项目的进度内容、关键节点,以便于我在新的对话中直接接上项目的进度。现实的工作交接呢,我们需要把我们自己的工作信息放在一个工作的文件夹内,以便于下一个员工可以快速的入手。而 codex 给你的这个点 m d 的 电子文件就是你的电子员工 交接的文件夹,但是我更愿意把它给解释为 u 盘,因为它所站的位置非常的小。而这一步呢,就会有很多小白会有一些疑问,那是不是我每一次去招新的员工的时候,我都需要让上一个员工去总结我们的记忆文件,为员工进行交接?其实并不需要。记忆文件呢,相当于公司的电子版的公告,它出来的那一刻 就已经实时更新上去了,所以你并不需要在每一次招人的时候,都把这个记忆文件发给你的下一位员工,我们来解决。第二种,周扒皮事件, 你在同一个对话里跟他安排了很多不一样主题的事情,我们要先来清楚一个概念,为什么不建议在同一个对话里给他安排很多件事情让他做。大家都知道,如果我们来做事的时候只有一个主线,我们的效率就会很高, 我们不用去忧心别的事情。但如果你同时让你的赛博员工去掏鸟蛋,去挖煤矿,去华尔街卖鸡蛋,他是不是就会产生路费?即使是他会瞬移,是不是也需要时间和能量?所以不是不能做,而是涉及到一个效率和大家偷看燃烧的问题。 清楚了为什么以后,请把屏幕上的这段话发给他。请你把这个项目文件中有关于叉叉叉的文件内容都提取出来,迁移到叉叉叉项目文件,防止受到无关项目的干扰。要记得在迁移完之后,他去写一个记忆文件,这个记忆文件仍然包括项目的内容、进度以及关键节点。 所以在这里我要给所有小白推荐一个最省力的做法,这也是这期视频大白全篇最有价值的内容。你只需要把这一步做好,以后再也不用担心你的上下文会爆掉的问题。 那就是在每一次新建项目文件夹时,给你的第一个对话直接发送屏幕上的这个指令。请你先创建一个记忆文件。这个记忆文件的第一条记忆的规则是,当执行完一个对话任务时, 识别对这个项目有用的关键信,并记录到记忆文件当中,以便于在后续执行任务当中防止上下文的遗忘。或者在该项目文件中开启了新的对话以后, 也能够通过自动提取记忆文件来获得这个项目的最新的进展。还有关键的信息,请注意,这个指令是需要在你每一个新建的文件夹当中的第一个对话输入一字即可,它就能实时跟踪,自动更新。 ok, 到这里恭喜大家已经攻克了 codex 入门时期非常重要的一个卡点,所有的小白呢,也可以把你在使用 codex 过程中的疑问打在评论区, 也非常欢迎我们的技术大佬们在评论区讨论和回答一下我们小白的问题,感谢大家!我是大白,专门把复杂的 ai 工作流拆解成纯小白也能真正跑通的版本。关注我,下期再见!

一定要想方设法用上 codex, 如果你还没有听过 codex 或者是 cloud code, 那 么恭喜你,这段视频呢,有可能会改变你的财富。什么是 codex 呢?官方定义是一个编程助手, 但它不仅仅是一个编程啊,黄仁勋就是英伟达的老总,世界首富,他已经让他所有的员工都用上了 codex 或者是 cloud code, 它是代表着当前最先进的生产力。 codex 呢,应该是对咱们普通人门槛最低,成本最低,来使用世界上最顶级的大模型和智能体了。 cloud code 呢,对普通人来说呢,还搞不定一些注册和网络的问题,动不动就封号也比较贵。那 codex 呢?本身是不存在这种问题的,如果你不知道怎样使用呢?那么你第一步呢,就只需要注册下载,然后搞定网络问题,你就直接问他, 你对我有什么作用?然后你把你的所有工作,所有的生活告诉他,问他你能帮助我什么?比如说你是上班族,每天的工作是什么?比如说你去打开邮箱,下载邮件,处理数据上传等等。把你的流程详细描述给他,你就直接问他,我这种工作你能帮我做什么? 你能帮我优化什么样的流程,提供什么样的效率就可以了。如果你是在校学生啊,或者是二十来岁,那么 codex 呢,就可能成为改变你人生的一个工具。就如同你在食堂打菜,突然开了一个新的窗口,那你要做的就是马上切过去,直接排在队伍的前面。我是楚宁, ai 路上一路同行。

对比一下 codex、 cloud code, harness 这三个 agent 到底有什么区别?先说一下它们的共同点,首先它们都是有手有脚的 ai 工具,只不过有的可以做更精细的活,有的就只能达到搬砖的效果。其次,它们都是桌面端的 ai agent, 都可以读写你的电脑文件,甚至操作你的电脑去完成各种各样的骚操作。然后重点来了,我们对比一下它们之间的区别。先说是否开源, powers 完全开源,而 codex 和 cloud code 都属于各自公司的产品, 是不对外开源的。再说模型支持,目前 codex、 cloud code 都更倾向于使用自家的模型, 其实说白了就是专为自家的模型设计而研发的。如果想要外接其他的模型,那么就必须要去接入一些开源的工具来实现,比如 codex 加加 cc, switch 之类的。当我们用这两个 agent 实现国产大模型对接的时候,又会发现 整体效果是大打折扣的。这里面呢,就是两个原因,一方面国产大模型确实比不上这两个世界顶尖级的, 另外一方面呢,就是外接国产大模型的这些开源工具。在国产大模型和这两个 agent 之间的路由转换 其实并没有很顺畅,翻译的不是那么准确。 harmis 呢,就不存在这个问题,模型上是随意切换, 它就类似于 opencll, 什么模型都能接,不被生态所绑定,不用为了更换模型去折腾很多的配置。最后再说一下它们之间的记忆体系, max 和 cloud code 目前主要还是依靠 md 的 记忆文件,然后再加上自己本身的自动记忆,需要的时候会以上下文的方式,然后把这些东西全部都注入进去。而 harvis 呢,在这方面就比较优秀了,当他解决完一个比较复杂的问题之后,他会自己学习并记住你的操作习惯 和偏好,自己创建技能来提升效率。当下次再遇到类似的任务,就可以直接调用,慢慢去学习你的做事风格,你的思维逻辑。也正因为如此啊, harmes 还有一个非常有意思的概念, portfolio, 你 可以把它理解成多个独立的 ai 智能体, 每个 portfolio 都有自己的记技能,上下文之类的,而且我们还可以创建多个 portfolio, 并且让它们之间彼此完全隔离。 对长期使用 aint 的 人来说, profile 真的 是一个非常非常好用的设计。当然在使用体验上啊, harman s 还是一个桌面端的新人啊,跟 codex、 color code 比起来,使用效果还是稍微有一些勉强的。 而 codex 呢,已经是属于完成度非常高的 aint, 特别是有了 computer user 之后,真的是如鱼得水,各方面的能力都很强。 color code 更倾向于专业的开发者,很多人去使用 color code 其实真的很难去发挥出它的真正优势。 那么最后总结一下这三个 agent, 我 觉得其实可以给它们分成三个级别,体验级、完整级和专业级。也就是说, harmony 相当于体验级, codex 相当于完整级,而 cloud code 就 相当于专业级了。那么这样一划分,这三个 agent 到底该怎么选的问题其实就迎刃而解了。看最后这张图。

这是一期让你能用上 codex 并且彻底入门的保姆级教程,没有废话,全是干货,我们直接开始。首先怎么能用上 codex 和它的官方模型,这一段不太能说,所以我整理成了文档,你先去看,照着做,有问题再来问我, 做完了以后再看后面的这段,非常之详细的上手指南。 ok, 如果看到这里,我默认你已经安装并且搞定了 codex 的 前期准备工作。接下来我们将一步一步从认识 codex, 熟悉他的界面,了解基本功能和丰富的插件生态,如何设置自动化任务。最后手把手带你完成这样一个地表最强智能体, let's go! 什么是 codex? 一 句话总结,它是 open ai 出品,并且喊出 almost, 啥都能干的智能体。你暂时不需要理解的太深,只需要记住一点,你电脑里的事它基本都能给你干, 总而言之,它真的是非常的强大。接下来我们打开它,欢迎来到 codex 熟悉的 chat gpt, 风格简洁,克制专业。首先介绍一下这个界面,我们可以看到两个区域,分别是左边的导航和项目区,上下分别是导航按钮和历史对话。 codex 会按不同的项目文件夹的格式,显示我们在这个项目里面的对话记录。 我们打开一个对话,看一下中间的对话区就是和 codex 交互的地方。点击右边这个侧边栏会显示一些辅助功能,比如审查代码,打开终端执行命令,访问 codex 内置浏览器,打开当前项目的文件目录,打开侧边聊天。 了解完 codex 以后,我们从对话框开始了解 codex 的 基本功能 codex 的 对话框分为两个类型,一种是临时对话,一种是项目对话。当对话框下面显示进入项目工作时,现在的这个对话就是 codex 的 临时对话。跟刚刚的侧边聊天是一个性质, 我们问他你是谁发送,他说他是 codex 基于 gpt 五的编程助手,同时左边的对话栏就显示了我们当前的对话。 但是临时对话顾名思义是一些临时性的问题和讨论,比如问些概念,写提示词、查询信息等,这种临时的任务聊完就结束了。当你新打开一个聊天框的时候,他就完全不知道你在之前的聊天框聊了些什么。 但项目对话不一样,项目对话更像是一个专门的工作文件夹,你做一个网页,写一套视频脚本,研究一个课题,相关的聊天文件规则需求都可以放在这个项目里,他会记住你之前定过的需求,改过的文件,踩过的坑, 以及接下来要继续做些什么。点击进入项目工作,你可以看到下面会列出来我们的历史项目文件夹。如果你是刚开始选择添加新项目,这里有两个选项,一个是新建空白项目,一个是选择现有文件夹。我们新建一个空白的项目,起个名字最好是英文。 细心的你发现左侧的项目下面出现了我们刚刚新建的 codex test, 以后所有基于这个项目的对话记录都会保存到这个目录里面,我们试一下。你好, 他回答了以后,文件夹下面就出现了我们这次的聊天,并且我们可以在项目右边点击新建对话按钮,重新新建多个绘画窗口,在同一个项目里面做不同的事情。另外我们注意到对话框下面的标签也变了, codex test 是 我们的当前目录旁边的这个本地模式,我们点一下可以看到它显示的是三种启动模式,它们是用来指定 codex 在 哪里干活。本地模式的意思是 codex 只对当前文件夹里面的文件进行操作,对原始文件进行修改 工作。树,意思是给 codex 复制一个项目副本,让它在副本里折腾,不污染你的原始文件,如果没做好,直接可以删掉关联。 codex web, 意思是当前本地项目和网页版 codex 的 云端环境连接起来,如果你使用网页版 codex, 可以 深入地研究一下。 接下来我们了解 codex 的 三种权限模式。请求批准下面的解释已经说得非常清楚,编辑外部文件和使用互联网时始终询问,意思就是但凡他要访问当前项目文件夹以外的文件,或者需要联网的时候,都会问你同不同意 替我审批,意思是仅对 codex 检测到的风险操作,请求你批准完全访问,意思是可不受限地访问互联网和你电脑的任何文件。关于这三个权限的选择,我看到很多博主推荐小白刚上手的时候建议选择替我审批, 说完全访问有风险,他会删文件啊什么的。但是我在使用的过程中一直是给他完全访问的权限,因为我觉得反正我选择了替我审批。他在征求我意见的时候,我也是一直 yes yes yes, 为什么不给完全访问的权限呢? 说完了权限,我们继续了解一下 codex 的 模型和档位的选择。在对话框的右下角可以选择推理强度低、中高、超高四个档位, 对应模型思考的深度。简单任务建议开中就可以了,稍微复杂的任务可以开高或者超高。下面是模型的选择和推理速度,可以用五点五,谁会选择五点四呢? 推理速度这块有标准和快速两个模式,高档位和快速模式除了推理能力更强,速度更快以外,还伴随着更多 token 的 消耗,所以我们选择超高和快速。 旁边这个小圆圈,我们把鼠标放上去,他会显示出当前上下文的占用量。建议上下文达到百分之五十以上的时候,在对话框输入杠压缩来压缩一下上下文,避免模型出现幻觉,推理速度变慢、智商降低等这些情况。 旁边的这个小话筒是听写模式,我觉得特别的好用,我现在已经很少跟它打字交流了。最后我们看一下左下角的加号是干什么的?点击加号 files and folders 是 给 codex 喂资料,可以是文件、图片、文件夹。 计划模式是让 codex 接到任务的时候,先分析提问规划再实现,减少需求,没清楚就干活导致的返工 目标是开启目标模式,就是当我们给 codex 一个目标以后,它会持续往这个方向去实现,直到达成为止。 这个特别适合执行一些长城任务,免去了我们一直授权的麻烦。关于这个模式,官方的建议是,在复杂任务中开启这个模式之前,可以先使用计划模式,把目标想清楚,再用目标模式让 codex 持续执行。 下面的插件,就是 codex 敢喊出几乎啥都能干的核心底气丰富的插件生态。什么是插件呢?它其实就是你给 codex 装上的工具,就跟我们的手机装 app 是 一个道理,你装上微信可以跟别人聊天,装上抖音才可以刷到我这条视频。 这里显示的是已经安装的部分插件,点一下就可以在对话中指定 codex 要用这个插件做下面给他布置的任务,也可以艾特插件名称来使用。聪明的你是不是在左边的侧边栏也看到了一个插件按钮, 进去以后可以看到官方集成的将近两百个插件,分别包含了商业、办公、设计、编程、学术、金融等等 你需要的它这里基本都有。点击添加插件安装完成后,在对话框里面艾特这个插件就可以直接调用了。接下来我们试一下看装上插件的 codex 到底有多厉害。 众所周知, remotion 做动画效果很厉害,比如我们看到一个动效,想要复刻一下,无论是下载还是录屏,把视频发给 codex, 然后艾特 remotion 复刻这个视频。因为我们的提示词过于简单,所以打开计划模式,把握一下它设计的方向。 可以看到他非常的聪明,用抽真的方式来预览了一下视频的内容,然后他问我们本次复刻优先哪种,结果给出了三个选项,并且每个选项后面的感叹号,我们把鼠标移动上去,会显示这个选项的意思。 我觉得这一点真的非常的人性化,我们选这个可编辑复刻提交,然后他输出了一个这个任务的方案,问我们是不是要按照这个方案实施,选择实施 ok, 十分钟以后他做完了,打开看一下效果, 不服不行,几乎已经很还原了。有一个瑕疵是没有渲染真实的 logo, 我 们让他把卡片内容继续替换成真实 ai 工具的 logo, 从他的思考过程可以看到,他是联网搜索和下载了相关的 logo。 又过了十分钟,执行结束了,我们打开看一下, 可以说已经非常的接近了,并且如果你想要实现这样的效果,只需要跟他说输出为透明通道,就可以剪辑到你的视频里面了。这么酷炫的效果,此处是不是应该有掌声 给你点鼓掌?所以像这一类的动效视频 remotion 这个插件确实有两把刷子,地图、动画、 数据可识化,概念演示也都不在话下。那么关于插件我们就不做过多的演示了,它们的强大之处需要大家在使用过程中才能感受得到。插件说完以后就不得不提到经常被小白搞混的另一个概念, skills, 也就是点开插件市场以后,这里的技能,它们两个有什么区别呢?插件刚刚我们演示过了,它是工具, codex 拿来就可以用, skills 是 流程,是说明让 codex 照着做。文档中我整理了一些,比如帮你找 skill 的 skill, 约束 ai 写代码的 skill, 讨论方案的 skill, 审查结果的 skill 等等。我个人认为小白可以无脑安装的 skills, 并且我也附上了命令和这个 skill 的 用途,复制以后丢给 codex 让它帮你安装就可以了。安装以后怎么使用呢?根据 skill 的 类型, codex 会自动触发,或者需要我们手动调用, 在对话框中输入 dollar scale 的 名字,就可以调用它了。比如在对话框输入 dollar 小 黑, codex 会自动匹配到这个叫小黑配图的 scale, 然后输入你想要做的事情。比如我们让它来解释一下插件和技能的区别。 这个 skill 是 不是挺可爱的?除了很厉害的插件和 skills 以外,还有一个非常实用的功能,自动化任务,我们点击在对话中创建。比如我们让每天早上八点收集整理前一天 ai 圈的热点官方新闻,发送到我的 gmail 邮箱。 ok, 设置好了,我们打开看一下,可以看到当前状态是活跃,下次运行的时间是明天八点。 codex 刚说他没有测试,我们测试一下,看任务能不能跑通,别搞了半天,第二天啥都没收到。他跑完了,我也确实收到了一封邮件,内容是前一天的 ai 热点新闻,并且他还给我们标注了来源、发布日期、摘要,以及这条新闻为什么重要。 ai 干活的细致程度你就学了。在了解了基本功能以后,我们接下来一起完成这个中国美食地图的网页。 整个过程会涉及环境准备给 ai 立规矩。 get 的 简单使用需求澄清、计划模式的使用、前端页面的调整、任务的引导和纠篇、上下文管理并行任务。最后一句话,部署上线,真的是干货满满。 首先是环境准备,你要记住,所有从零到一的项目都是从一个空的文件夹开始的,新建一个文件夹,给它起个名字,最好是英文,因为在代码的世界里,中文路径有可能会引起兼容性问题。 新建好以后,我们回到 codex, 点击对话框下面的,进入项目工作,添加新项目,使用现有文件夹,选择刚刚新建的这个 delicious china。 在正式开始干活之前,有一个非常重要的步骤一定要做,那就是给 ai 立规矩。我们需要给 ai 一个在这个项目中必须遵守的规则,更好地约束它,防止它跑偏走远,这就是 agent。 点 md 文件, 我们可以手动创建,也可以让 ai 帮我们来写,但作为新手来说,你不知道该怎么写。这样告诉他,这是一个基于舌尖上的中国节目的中国美食地图网页项目 采访,我关于这个项目必须遵守的规则形成 agency。 点 md 文件,他列出了十个问题,并且说了不确定的地方写默认,我们先全部默认。好的,他写好了,我们看一下他给自己立了些什么规矩, 交流方式、数据规则,资料来源,交互方式、开发纪律验证要求。好家伙,严于律己,佩服佩服。提到项目规则,那么还有一个规则的约束层级要比项目级的还要高,它就是管理局的规则。 我们打开设置个人资料个性化这里的自定义指令,注意看它下面的注示,是为此主机上的所有任务向 codex 提供额外说明和上下文, 这就是局的 action。 点 md 文件,你可以把你的语言篇号、代码、纪律验证标准等等一些你希望他在任何项目都贯彻的规矩写到这里。切记, ai 不是 干不好活,往往是他太会干了,所以我们需要用这两个规则文件去约束他,规矩立完以后告诉他做一个中国美食地图的网页,他开始疯狂的写代码了。干完了我们看一下 这是什么玩意,虽然可以点击,也显示了一些基本的信息,但是和我们想象中的完全不是一回事。那为什么会出现这种情况呢?是因为我们的需求过于模糊了, ai 不知道我们想要实现什么样的效果,只能按照它的意思给你一个最基础的版本, 所以它这次写的代码我们不要了,点对话框里的这个撤销按钮,可以撤销这些代码,哎,它提示我们撤销时需要使用 get 代码仓库。 这里就又出现了一个非常重要的知识点, get。 get 原本是程序员用来管理代码版本的工具,它的原理大概是这样的,稍微有点复杂,但是不要害怕,我们作为新手不需要理解它的原理,只需要会四个技能,就足以让我们对项目版本的管理游刃有余了。 第一呢,是项目刚开始的时候就让 codex 出场 get 仓库,并提交一个干净的版本。第二,每完成一个阶段性的任务,都让 codex 提交,并且备注清楚这一个版本的信息。第三,让 codex 帮我们查看历史版本。第四,让 codex 回退到某一个历史版本, 有没有发现全是让 codex 帮我们完成的,我们只需要知道要这么做,然后动动嘴就可以了。现在我们让 codex 删除项目里除了 agent 点 md 文件以外刚刚生成的所有文件,并出使化这个项目的 get 提交,当前只有 agent 点 md 的 版本,版本信息为出使化它执行完了,我们看一下文件夹是不是删干净了, 确实干净了,然后查一下 get 历史版本, ok, 已经提交成功了。那么这样版本管理工具 get 我 们就搞定了, 现在又回到了最初的起点了。回顾一下我们刚刚做这个网页的过程,我们给了它一个提示词,但是它给我们一坨屎。我们刚刚也分析了原因,是因为需求没说清楚。 那这个需求要怎么才能详细一点呢?做过产品的朋友们肯定知道,在任何产品开发之前,都要经历一个非常重要的步骤,写产品需求文档。那小白又不懂了,啥是需求文档啊?举个例子,你在装修房子的时候,会给装修公司说,帮我装修一个房子要好看一点吗? 不会,你是不是最起码告诉他,我这个房子两百平?现代简约风,客厅做投影,不要吊顶,厨房开放式,预算十二个 w 两个月做完,先做水电和硬装,软装,后续再定甚至更细节的一些需求呢? 这些你就可以理解为需求文档。所以在面对 ai 的 时候,也需要把想要实现的效果尽可能详细地描述出来, 比如我这里想要实现的效果首页是什么样,用户点击后是什么效果等等,你能想到的全部写下来,剩下的交给 ai 就 好了。让他按照我们的需求整理一个规范的 p r d。 好 的,他按照我们的需求已经整理好了,我们检查一下,如果没有问题的话,我们就可以进入到开发阶段了,打开计划模式,然后让他按照需求文档开始干活,这就叫先规划再执行。 他在计划过程中会征求我们的意见,按照自己的想法选择就可以了。比如这里他会让我们选择一下页面的风格,如果有其他的想法也可以不选。在下面的输入框这里重新描述你的需求,我这里选择他给我们推荐的方案。 最后他整理了完整的开发计划,如果觉得没问题就继续实施。第一版出炉,我们用 codex 内置浏览器打开看一下 这个页面怎么这么窄,没关系,点右上角这个放大图标,页面就完整了。第一版整体的感觉还是非常接近我们选择的方案,鼠标悬浮这种板块高亮的效果也做的很有感觉。再看看省份对应的美食是怎么展示的,选陕西 哦,它提示我陕西内容代补充。再看一下四川,哎,有几个卡片在这里了,并且鼠标拖动的滚动效果也是有的,卡片也是可以正常点击并且展示美食信息。至于内容,第一版没有做,需要继续迭代。 在初步验收以后,我觉得有几个地方的样式需要改一下,但是我们给 ai 描述修改意见的时候可能说不清楚。别担心, codex 有 个功能非常强大, 点右上角的这个小加号,然后在页面上点你想要修改的部分,然后输入修改的要求。我们对这个元素的要求很简单,删掉发送这里,不想要点一下删掉,再点这个页面缩放按钮,就又重新可以看到对话的界面了。 可以看到 codex 已经在执行我们刚刚的修改意见了,这里还显示另一个删除的意见,但是它当前是一个排队的状态,如果想要让它先执行这个操作,可以点这里的引导,让它优先执行 等等。在执行过程中,我们看到了这样一段话,上下文已自动压缩,这也是 codex 比较好的一个功能,它会根据上下文占用的情况自动执行压缩命令,但是一定不要在一个聊天里无限压缩,因为到最后你会发现 codex 干活会非常的慢,非常笨, 别问我为啥知道,反正我就是知道。在执行页面修改的时候,为了不耽误时间,我们也可以新开一个对话,让他执行和当前操作不冲突的一些任务,这就是并行任务。 因为刚刚的美食卡片太少了,所以我们让他联网搜索舌尖上的中国介绍过的所有美食,按照项目需要的字段信息整理成表格。打开侧边栏,可以看到有两个任务同时在跑了好的前端页面修改的任务先跑完了,我们检查一下 刚刚的两个删除操作都做完了,但是又有几个地方需要调整一下,我们继续按刚才的方式优化一下。 另一边的数据也整理完了,让他继续把整理好的美食数据同步到页面上。数据同步好了以后,我们再看一下每个美食卡片是不是有了,但是没照片啊?别担心, codex 内置的 image 根这个 skill 是 来做图片生成用的,它调用的是强大的 image 二点零这个神通模型, 我们让它来生成对应的美食图片。经过多轮的页面修改和功能完善以后,最终 codex 给我们交付了这样一个网页。 哎呀,太高大上了,哥们也是跟上了潮流了,这不得把网页链接发给朋友嘚瑟一下,给他看看我的第一个 web coding 产品。 这又是为什么呢?因为现在这个网页目前还只是你电脑上的一个本地文件,只能在本地才能看,如果要让其他人可以看到的话,需要把本地代码都部署到云端去。 我们让 codex 帮忙搞一下,打开计划模式,看看他准备怎么弄。他依然是征求我们的意见,我们当然是 yes, yes 啦!最后他给出了计划,我们直接执行,在执行过程中,他会提示我们授权,按照提示操作点点点就可以了。好的,已经部署上线。打开 域名,这里已经跟刚刚的一串数字不一样了,看看功能是不是正常。 ok, 大 功告成了,这下再发给好兄弟, 是不是满满的成就感。视频最后总结一下,通过这期视频,你学到了什么?我们认识了 codex, 了解了它的界面和基本功能,用 remote 插件复刻了炫酷的动效,创建了一个每天推送 ai 新闻的自动化任务。 在最后从零到一搭建美食地图网站的过程中,又学到了怎么给 codex 立规矩,怎么把需求说清楚,怎么用 get 来管理项目版本,怎么最省心的方式调整页面问题,以及对执行过程进行引导和纠篇。最后用一句话把网站部署上线。 你就说,哥们,叭叭了这么久,你如果都看到这儿了,给个三连不过分吧!我是浩哥,我们下期见!

大家好,今天这条不比较哪个工具更强,只看一个很实用的问题,权限、 mcp、 记忆配置到底有什么不同?很多配置问题看起来都像工具不听话, 但原因可能完全不一样,有时候是权限没开,有时候是 mcp 没连上,有时候是项目规则文件根本没被读到。所以这条用双窗口来讲, 左边放一个工具,右边放另一个工具。我们按三组看,全线 m c p 记忆和规则文件。 先看版本和帮助信息,这里不是为了背参数,而是提醒大家录制不要只照旧程念命令,命令行版本会变,参数名和帮助文字也可能变化,正式录制前以当前机器实际输出为准。 如果终端里出现本机用户名、项目路径或者终端历史里的 key 和 token, 要处理好。 先看权限。一个工具里重点看沙盒和审批方式。简单说,沙盒决定它能在什么范围里执行和写入审批方式,决定什么时候需要问你另一个工具里不是同一套名字,它主要看权限模式,再看允许工具、禁止工具以及项目或用户的设置文件。 所以这里不要只说两个工具都给权限,一个看执行范围,一个看权限模式和工具。白名单、黑名单、 危险模式只在帮助里识别,不建议录制时真实打开。接下来打开脱敏适意配置。一边可以展示适意配置, 说明真实入口通常会涉及局备制,但录制不要打开真实配置。另一边打开项目设置,适意文件设置是 gsm 思路,而且有用户、项目、局部这些范围。权限规则里常见的是允许询问和拒绝,这里要强调一句字,断,不要互相复制。 一个工具的 t o m o 配置不等于另一个工具的 g s o n 设置能表达类似目的,不代表写法能通用。然后看 m c p, 两边都能管理 m c p, 但命令细节不完全一样,可能都有列表查看、添加、删除这类动作,但参数、配置、来源、项目选择和调试方式不一样。如果录到 m c p 地址,请求投递牌或环境变量值,一律不要公开展示。 正式演示建议用假地址。不要连真实公司服务。如果 m c p 连不上,不要先管模型,先看服务有没有出现在列表里,认证方式有没有配对,环境变量有没有生效,工具权限有没有被拦。最后看记忆和规则文件。 一边常见的是项目指导文件,用来写项目怎么跑测试,哪些目录不要动,提交前要看什么。另一边是项目规则文件,还可能涉及本地规则和初步流程,这两个文件不要当成同一个入口。你可以写类似的项目约定,但要按各自工具的读取方式放 项目规则里,也不要写密钥、个人账号、内部服务器地址。如果配置不生效,不要一句话说工具坏了。先分三类,如果是权限弹窗、命令不能执行,文件不能写,优先看权限配置。 如果是外部工具连不上 m c p 服务,不出现工具调用报认证错误,优先看 m c p 命令、服务列表、地址、请求头和环境变量。 如果是工具老失望项目约定没按规则跑测试改了不该改的目录,就看规则文件的位置和内容可以记三句话,控执行范围看权限,接外部工具看 m c p。 长期项目约定看规则文件。 团队录制的时候,我建议先录权限,再录 m c p, 最后录规则文件,观众会更容易理解,每一层管的东西不一样,不是谁替代谁。 录这种配置视频最容易漏的是令牌请求头个人设置项目路径和内部规则。真实配置不要直接上镜,要么用示意文件,要么复制一份脱敏版再录。总结一下, 两个工具可以解决相似问题,但配置入口不一样,权限 m c p, 记忆分开看命令,按当前版本确认 真实密钥和公司配置不要出现在画面里。如果你想按步骤先跑通,可以倒扣点 jim u x y g 点 com 看教程和脚本,先把层级分清楚,再让 ai 帮忙,会稳很多。