姐妹们,你一定要把握住,现在在谈论和使用 codex 量子的男人,你自己也可以去研究沉浸式的体验,想方设法的让这些 ai 软件帮你完成任何的事情。现在在用他们的男人啊,那绝对是眼界也好还是执行力也好,远超一些普通人的 普通人。还在谈论喝酒吃饭打麻将打台球的时候,他们已经在用他们的时间精力在做跟新时代连接的事情了,他们的思维是非常超前的,做事 也肯定高效,更重要的是对新时代事物的探索欲,这一点是非常重要的,因为人一旦拥有了这些探索欲,他才会进步,那么骨子里一定藏着极强的进取心和认知高度。这样的男人我们一定要关注一下好不好?
粉丝6267获赞6.2万

我用 codex 给朋友做了个情侣专属网站,只属于他们两个人, 能发动态,能写私信,还有纪念日提醒和点点滴滴相册。最关键的是, codex 直接帮我连上了阿里云,一键部署生成域名链接发给他,点开就能看 怎么做的。我全程没写代码,直告诉 codex 我 想要什么,它就能帮我生成页面和功能,觉得不好看的再打字条,它一会儿就改好了,跟聊天一样简单。想知道怎么做,点个关注。

那今天给大家说一下怎么用这个 codex 对 接到我们的微信上面去啊?其实是非常简单的,因为它这里有一个开源的 项目叫 codex bridge, 这是一个开源的项目,然后把这个项目放到我们这个 codex 里面去就可以了,然后提示词是这么说的,帮我把这个项目对接到我的微信上, 然后对接好之后,你给我一个二维码,我用微信扫一下这个二维码,就可以跟你进行聊天,然后再把这个开源的项目把这个网站发给他, 就是这样的一个提示词,然后等到你看这里,我我用的是十一分钟啊,十二分钟都不够,他就帮我对接好了,然后中途他会给你一个呃二维码,然后你扫一下这个二维码就可以了。 然后对接了之后,我们打开微信,你看我这里已经对接好了,这是一个呃 qds 对 接微信的一个功能,已经对接好的了,然后我们这里进来看一下,然后我发信息给他测试一下, 然后我问他你是谁?他这里会对方正在输入中,然后看他怎么回答, 你看他已经回复我了,他说我是 code s 是 吧? 非常方便。以后就是出门在外的话,就不用对着这个电脑端的这个 code s 了, 直接用微信跟他聊,跟他让他部署任务就可以了,非常方便的。这就是呃 code s 对 接这个微信的一个功能,是非常简单的, 大家可以按照我这个提示词去部署到你的 code 里面去就可以了。 nice。

你可以不去学其他 ai, 但一定要想办法学会 codex。 codex 可能是目前普通人最值得学习的 agent, 这期视频我会手把手带你从入门到实操,全流程了解 codex 是 什么,它能干什么, 并且跟我一起实操,从安装到操作的使用,个人的网站搭建、文档制作、视频制作、自动化的工具开发以及办公和编程场景的真实使用。如果你是在校学生或者是白领工作者,看完这期视频,有可能会改变你对 ai agent 的 认知。 就连英伟达的老总黄仁勋,世界首富,他都已经让他的员工用上扣贷了。这期的含金量可谓是看完这期视频,你就能够真正上手你自己的 ai 员工扣贷。我也把这一期的文字课件整理成文档。好了,话不多说,点好收藏、关注、赞,我们现在出发! go! go! go! 那首先你要明白 codex 它到底是什么?很多人第一次接触 codex, 就 会以为它是另一个拆开 gpt, 其实不是普通聊天应用呢,它更像一个机器,你问个问题,它给你答案,它能教你写代码,做表格,写报告,但最后动手的还是你自己。而 codex 它就不一样了,它属于 agent, 也就是智能体,除了能够思考,还能直接帮你把任务完成。 举个例子你就明白了,假设你要给家里做一次彻底的大扫除,第一个人呢,就是拆个 t p t, 你 把客厅、厨房、卧室的照片都发给他了,他会告诉你先擦窗户,哎,最后再拖地。厨房的油污呢,要用某某某清洁剂,分析的是头头是道,那说完就结束了,最后留下干活的还是你自己, 而第二个人呢,就扣袋子,你只需要给他说一句,帮我把家里大扫除一遍,他呢,就会自己动手帮你擦窗户,拖地、洗窗帘、清洁油污, 干完了还得把结果拿给你验收一遍。甚至还能同时安排专业的扫地机器人、洗地机、擦窗户机器人一起工作,客厅、卧室、卫生间同时处理,它们之间呢,还互不影响。这就是 agent 和传统聊天 ai 机器人的最大区别, 一个给建议,一个从给建议到事情一起给你做完。而放到工作里也是一样的。传统 ai 呢,只会告诉你下一步我应该怎么做,而扣 test, 它就会帮你创建文档,整理资料、运行程序到操作浏览器, 一步步的把结果给你执行出来。 ok, 我 们在使用 koata 前唯一要准备的就是一个叉七 ppt 账号。没有同学也不要慌张, koata 现在已经可以完美的接入国产模型了,快,而且还便宜。后面呢,我也会单独注一期如何把国产模型 deepsea 接入到里面。 这一次咱们主要讲讲 koata 从安装到实操的主要步骤。如果你是重度用户或者是公司来说的话,可以考虑一下 pro, 它的额度呢,会高很多,需求没有那么高的话, plus 就 够了。我现在就是 基本每天我自己使用是够了的,大概每五小时可以发三十到一百五十条给扣贷,正常使用的话,一天肯定是够了的,免费的也行,只是额度呢,会少一点。那我们安装好扣贷之后,登录你的 g p p 账号,有个同学下载之后呢,发现是英文界面,莫慌,我们改语言就好了,设置语言呢,在左下角的设置里选择设置,然后再默认的 常规选项里面这里有一个语言,那我们在这里选择中文,这个时候他就会变成我们自己人了,如果你打开直接就是中文,那就恭喜你直接可以跳过这个步骤了。那进来之后呢,大家可以看到这个对话框和侧边栏还是蛮眼熟的,那左侧栏从上到下分成这几个部分,那最上面是四个功能按键, 第一个叫新对话,给扣带斯布置新任务的。第二个叫搜索,用来在你历史对话里来搜索关键词的。第三个叫插件和技能,用来给扣带斯加装备的。 第四个叫自动化,这个真是我们懒人的福音了,为什么会这么说呢?视频的后面我会详细给你讲讲,而这中间会有两个特别重要的列表,一个是项目,一个呢就是这个对话了,这两个东西可不一样,对话相当于你在给 ai 对 话,和你在网页端和 ai 聊天差不多,适合一些比较琐碎的工作, 帮我查资料或者是回答一些我的问题。项目呢是一个比较强大的东西,每个项目呢都对应着你电脑上的一个文件夹,你在这个项目里做的所有事情,生成代码、文件、 ppt 都会保存在你这个文件夹里,不会丢失。而每个项目下面又可以有很多对话,一个对话呢去处理一件事情,你可以理解为项目就是一个大的文件夹, 而对话呢就是这个文件夹里一个个的工作现场。最下面是设置按钮,点进去呢就能管理我们各种的配置,那右侧这一大片区域就是和扣代码的主要工作地方了, 下方呢就是输入框,你可以在里面直接输入中文,告诉他你想做什么,而这里的功能和旁边权限呢,如何使用,我们在后续的实操案例里也会慢慢的给大家讲解透彻,这样呢会更好理解一些。那么下面我们就用扣袋子来创建第一个项目, 首先看左上角,然后我们点击这里,他就创建了一个新的对话,你也可以在项目里去创建对话,项目就相当于大文件夹嘛,里面呢就可以放很多你给他不同内容的对话,当需要处理复杂内容的时候,我们就可以先去创建项目,在创建项目中再去创建对话,这个时候下面的这些对话呢,就相当于我们项目的一个个的工作现场。 创建好之后,我们在右侧工具的输入框里面直接输入中文,告诉他我们到底想要什么,此时需要注意,我们在输入框下方,这里显示的就是我们当前使用的 ai 模型和思考强度了,目前 g b d 五点五呢,算是比较强的模型了,所以他默认的呢也是这个模型,那选好模型之后,我们可以直接看思考强度,这里也有显示为 一中高和超高这四档,而这个参数呢就决定了 ai 在 回答你问题前想多久,想多深。一般处理日常任务的时候中档就可以了,如果你处理比较复杂任务可以调高一档。除了思考强度和模型之外呢,这里还有速度,有两个档位的选项, 标准和快速,而我们处理日常任务的时候,使用标准模式就可以了,赶时间的时候呢,我们可以直接切到快速。在旁边就是一个麦克风的图标了, 嫌打字麻烦,你就可以用语音去输入需求,这样呢也会方便很多。输入框的左侧呢会有一个加号按钮,点开之后可以上传本地的个人文件夹。 那还有一个就是计划模式的选项,开启后呢,扣在此只会给我们讨论方案,不会直接更改任何文件。当我们确定方案之后,他呢才会去动工。 加号旁边呢显示的就是你当前的权限模式,这里呢会有三个模式,默认权限,自动审查,还有完全访问权限。打比方,你用扣袋子到你家里来做家政清洁,在默认权限下呢,他只会在你指定的房间里面去打扫,如果涉及到其他的房间区域,他呢就会来询问你了。那在自动审查下,他呢就会有自己判断,哎,这个东西我可不可以做? 如果他判断为危险,他呢就会来询问你,如果他判断为不危险,他呢就会自己去操作。我个人觉得这个模式下呢会比较省心一点。而完全访问呢,就是扣代斯把你家当成他家了,此时在你的电脑上,他几乎什么都可以干。而在这个模式下呢,扣代斯在做什么,他呢就不会再来询问你了, 可能会搞一些你不想要的操作。所以如果你是新手的话,不建议你一上来就开这个权限,保持默认和自动审查模式。等你非常熟悉扣贷行为了,并且你的项目有 get 备份的情况下,再去考虑放权的问题,接下来我们看一下输入框的左下方, 这里的按钮是选择扣贷死干活的场景的。总共呢会有三个模式,本地、工作处,还有云端。那首选呢,就是这个本地模式。 这个呢,也是比较简单直接的模式, co ds 呢,它就会在你的电脑上的文件夹去直接修改,那它改了什么呢?你也能在这个文件夹里面去马上看到。这个模式下呢,就比较适合小手术,比如给我改个样式,整理个文件,加几行代码等等, 如果它改坏了的话,你需要手动撤回。所以用本地模式钱最好,养成随时备份的好习惯。而这个工作数模式呢,是 co ds 一个比较核心的功能。什么叫工作数呢?假设你有三个员工, 同时让他们去修改一个总结报告,他们三个人同时在一份 word 里面去打字,瞬间就乱套了,他们之间呢,还会互相的去覆盖内容。而工作数模式就像你给每个人单独的去分配一份任务,最后再自动合并成一份完美的中稿。 云端模式,它会把你的任务发到 open ai 的 服务器上,哪怕你已经关了电脑任务呢,它也会在云端自己跑起来。最后我输出结果了,它会放在那里等我们来验收。但你要使用云端模式,你就要连接一下,给它仓库关联扣在 smart, 所以 配置呢,会复杂一点,大多数情况下呢,它不会用到这个模式,我们初次体验的新手呢,就不用管了,知道有什么概念就可以了, 平时使用本地模式和工作数模式就足够了。这里插个小提醒,如果你的扣带子把代码改坏了,这个时候你正好用的是工作数模式,不用担心,这个模式下它具备独立副本,直接扔掉就行。如果你用的是本地模式,那就需要在叉一面板里面去点击全部撤销,或者在终端里面去输入 get checkout, 它呢就能回档了。 所以说让扣代词去改什么东西之前,我们先要提交,这样即使它改成什么样,我们都可以给它退回来。那下面第二个功能搜索,就是帮你在扣代词所有的历史对话里面快速的找到之前的对话信息。假设你要找到之前的项目和对话,但是你这段时间操作项目和对话太多了, 那我们就可以点击这里,然后通过搜索关键词,它呢就可以搜索出项目和对话,甚至还有文本记录,这个搜索功能可谓是真的方便。 介绍完了新对话搜索,那我们就来聊聊右侧的这个扣带斯聊天框,我先给大家演示一下聊天框具体能让扣带斯干什么, 你想装一个 node js 或者是其他的 a 帧的,以及做其他项目一些必备的工具都不再像过去的时代那么麻烦繁琐了。现在呢,有了扣带斯,我们直接截图扔给他就可以了,怒声一顿火锅钱。而且呢,我们在使用过程中遇到任何问题,我们都可以去问扣带斯, 什么瞎死了,马挂了,升级又翻车了,都可以让科特斯直接帮你修,是不是很方便?现在呢,我就直接在输入框里给科特斯说,帮我安装一个可牢扣的,好给他发过去,他现在开始来检查运行环境, 不去执行了,以前呢需要看各种的教程资料,现在呢,都不需要我们来操作,真省心啊。包括我们有任何想法,不管是让他去执行项目或者查资料问问题,我们都可以直接和他对话。扣贷 s 呢,他的回答也会非常清晰,一步步的来引导你把你的想法执行和展示出来。 ok, 我 们现在已经基本上掌握了功能区的前两项, 现在开始进入扣贷 s 核心,也是最有意思的部分,插件和技能。点击左上角的插件按钮之后,进去之后会有两个页面,插件和技能 这两个概念会有很多人搞混,其实区分他们还是很简单的,那插件呢?大多数是让 a 智能跟外部平台工具服务器连接的作用,装上插件之后,你的 ai 智能体就有了操作软件或者是服务器的功能。那 skyo 它的底层逻辑是我们在使用抠袋子过程中来回复用的方法是流程和工具的组合, 用于做某些具体任务的时候抠袋子的行动指南。那咱们又如何能调用这些插件和技能呢?别担心,咱们不需要提前去部署一些复杂的依赖 抠代码,它会根据你的任务自主来判断用不用调用这个插件或者是技能。但如果你就想点名用这个插件的话,那我们就可以在输入框里输入 at, 然后呢它就会弹出这样的一个插件列表,选择你想用的,到时候手动触发就可以了。 那我们接下来点开左边的这个插件栏,这里呢已经默认帮我们打开了好几个内置的插件了,比如说操作浏览器的,还是给它表格的 ppt 这些,有需要其他插件的话,那我们也可以点击这里的加号来进行安装。那重点呢是这两个插件,这两个功能呢,分别是操作你的浏览器,操作你电脑上的软件或者是网站, 相当于我们雇了一个手替。好,那接下来我给大家操作一下,我是如何用插件来做一个有声音有动效的高质量视频的。那首先呢,我们先安装插件,然后在这里直接搜索 app friends, 那 我这里是已经安装好了,然后再继续搜索一个 remote, 哎,这里也已经安装好了,那我安装好之后,我就返回到这个对话框中,然后我们在这里调用第二个插件。扣带子呢,它也会调用一米尺二来生成图片,那我让它生成几个人类进化史的图片,再使用 have friends, 然后生成对应的视频。那我们再用 remotion 生成一个动效,以及再用一个音频插件生成一段舒缓的音乐,然后呢我们就可以开始生成了。那我大概是等了有个音频插件生成一段舒缓的音乐,然后呢我们就可以开始生成了。那我看一下效果怎么样, 效果是不是还可以?如果我们不满意的话,我们还可以跟 ai 持续的对话来完善我们的细节,每一帧,每一个画面呢,都可以自定义的。我这里呢是让它自己生成了几张图片,也没有给它更多的指令了。 这里我只是做了一个简单眼上,虽然效果不是那么的惊艳。如果你有自己的一个素材或者是内容的一个阴鬼,我们都可以告诉 ai, 让它直接对接上去, 是不是很简单?这只是一个指令,给到 ai 生成的一个视频效果,当你有更好的想法或者是详细的思路,那你做出来视频肯定会更好,包括你自己喜欢的一些专场特效,我们呢都可以告诉 ai, 它呢也可以来实现。如果你想生成 excel 表格,那用的呢就是这个插件,那接下来输入框里我们就发送这一段指令, 然后我就可以得到一份详细完整的 excel 文件了。看这效果真是相当不错了。原来我做一个这样的文件,又是查资料又是核对信息的,估计几个小时也是做不出来这样的一个效果。另外,我还想生成一个 word 文档的话,那输入框里面我发送这段指令, 那生成完成之后呢,我就可以直接在 code 里面点击文件名,然后我们打开预览一下,这个效果相当 ok 啊。那如果我不满意的话,我还可以在预览键的下方这里输入框里继续让它更改好插件。说完了,我们再聊聊 skill。 举个例子,生成一张图片的流程呢,是要先确定好画面的描述风格,再去调用生图模型去输出图片,把这一套流程的注意事项打包写成一个 macdunk 文档,它呢就是一个 skill。 那 在此之前呢,还需要在你项目里的根木下去创建一个文件,叫 agents 点 md, 那为什么我们要创建这么一个文档呢?主要是因为我们在一个项目里新开一个对话的时候, codex 呢,它是没有其他窗口记的很多注意事项,我们在其他对话窗口里面呢说过一遍,但是返回到这个对话窗口里,它是不记得的,所以我们还是要再说一遍。但如果你想做的项目比较复杂,需要开很多个窗口定型的去执行任务, 那就会很麻烦。所以我们新建这个文档呢,就是来解决这个问题的,你把规则写到这个文档里,他呢就不会再忘了。就像我们给新来的同事一份入职手册一样,我们这个部门的规矩,第一条是什么,第二条是什么,一次性的全给他写清楚, 以后他的做事呢就会按照这个手册来,这样 codex 在 每次起送的时候呢,他呢就会按照这个手册来干活了,把里面写的规则当做工作手册来执行,那么这就是一个长期记忆的 skill, 这是 skill 里面具体怎么写的话,我们之前呢也有详细聊过,感兴趣的同学可以去复习一下。 codex 最后一个功能呢,就是自动化了, 可以说是扣代数自动化,定时做任务,假如你每天都需要执行整理数据或者写报告,那就一定会用到他这个能力了。自动化有个非常简单的用法,就直接在对话框里用自然语言告诉他,给我设置一个自动化的任务,比如每天九点帮我去搜集今天的热门话题或者是数据, 然后给我生成一份报告,再用表格的方式再返给我,那他呢就会帮我去创建这么个自动化的任务,那对于我来说,这个功能确实能省去我每天反复的工作了。 ok, 我 们再来看左上角的自动化,这里 他呢已经帮我设定好了这么个任务,在这里呢,我们可以随时让他更改自动化的任务时间,那改成早上十点去执行,那在这里改成什么时间都可以哈,看我们每个人的需求就可以了。 除此之外,还有个创建自动化的任务方式,那我们鼠标移动到共同区,然后这个自动化里这里有一些官方的参考案例。我们选择新建一个自动化之后呢,我们就可以用题旨词写好这些自动化到底是要做什么的,可以在这里选择什么时间执行这个自动化任务, 然后在这边选择模型和思考的强度,最后点击创建就 ok 了。在这个地方呢,你还可以看到你创建的所有自动化的任务列表,点击对应的任务呢,就可以进入到这个任务的详情页了。左边是这个自动化的详细描述,那右边呢就是各种的参数, 比如状态,下一次的运行时间,运行的环境,或者是具体在哪个项目文件夹里面去运行的,你也可以在右上角去选择暂停或是删除这个自动化的任务。如果你是初次使用这个功能的话, 我建议你在输入之前呢,提前自己试一遍,确定好这是我们想要的一个效果,那我们再去创业一个自动化的任务,不然到时候跑出来效果不符合我们的标准,这不纯纯浪费额度吗?说到使用额度,有的同学就要问了,你做了这么多案例,你到底消耗了多少额度? 又怎么查看我剩了多少额度可以用呢?这个呢有两个方法可以查看,一个呢是左下角设置,我们点开之后有一个剩余额度,那我们就可以看到五小时内我们还剩下多少,本周内又还剩多少, 这里呢还会有一个刷新时间的提醒。那另一种方式呢,我们就可以直接在对话框里输入斜杠,然后找到这个状态,然后打开之后,它呢就会在这里持续显示我们一个上下文的余量,同样有五小时和一周的限额。说实话这个扣贷四的额度呢,还是很大方的,二十刀的一个额度,我认为是可以满足我们大多数人日常工作的高频使用的, 但有的时候我们用着用着它就会提示已达到使用上限。不要慌,刚才也提到了 gpt 账号每五小时它是滚动刷新的,意思就是五小时前你发的信息,它呢就会过期,就会腾出来额度,所以不用着急,等几个小时呢,它的额度就会出来了,如果你觉得还是不够用的话,可以升级到 pro 版本。那我们还有什么方式可以进一步的节省我们宝贵的额度呢? 当然有,就是在我们的上下文上下功夫。那怎么去查看我们的上下文呢?在这里我们就能看到了这个小圈圈就代表我们现在这个对话框里里面所有的操作,一共使用 gpt 五点五多少上下文的窗口。 如果我们把鼠标悬上去之后,他呢还会有一个更详细的信息,当上下文快满的时候,扣袋子呢,他就会自动帮我们去压缩上下文。 其实当我们一个任务高于段落之后,不用等到他自动的压缩上下文,我们可以通过斜杠然后压缩这个命令去手动的压缩上下文, 这样呢就可以让模型专注到我们的新任务上,而且还省一点额度。看到这里的同学,那么恭喜你,你已经学会了如何使用扣贷。接下来我们直接上实战做一个网页的开发商,听起来是不是很难很复杂?那是在以前,我们现在有扣贷,那我们就可以直接在对话框里输入我想做一个 宠物猫咪的主页,然后我们把这个加号点开,点开我们的计划模式,因为做网站他还是会复杂一点的。那点开这个模式之后呢,他会帮我们出一个比较详细计划,我们确认之后他呢才会开始执行。所以打开这个计划模式呢,就比较适合我们做一些比较复杂,或者是连我们自己都没有想清楚的任务,这样呢我们就可以跟 ai 讨论出一个计划来。 ok, 因为我们提示词比较简单,所以他看到我们项目中是没有内容的,他呢就用这种选择框的方式来询问我们其中的细节,那有这些选项,大家可以按照自己需求去选择就 ok 了。那我就选一个温柔可爱吧。如果我们点开这个小叹号的话,还能看到他说的这个风格到底是个什么意思, 这种小细节还是我比较喜欢的点,那我就选一个他推荐的吧,主页的内容到底是按哪种资料来设计的?如果说这个选项里面没有我们满意的,我们就可以选择最后一个,在这里去填写我们的一个详细要求。那这些步骤都完成之后呢,他给了我一份详尽的计划单,问我们是否实施这个计划, 那我基本看了一下,其实没有太大的问题。 ok, 我 们看一下其实大差不差了,我们确认开干。 ok, 他 现在开始初步化项目了,一步步的帮我们生成里面的内容,那在这个过程中呢,肯定是需要一点点时间的。 ok, 他 终于在跑了七七四十九分钟之后,网页呢就完成了,我们来看一下效果,其实扣袋子他有个内置的预览浏览器,那我们可以直接打开右边的这个侧边栏。 哎,这个网戒效果确实是不错啊,不过现在的 a 政策呢,其实都有这么一手了,那他这个浏览器呢,还有一个独特的功能,我们点击右上方的这个批注按钮,然后呢他就可以实时的去修改,然后你刷新一下浏览器,那马上就能看到最新的效果了。我们可以在这个页面上,然后选中这些具体的元素去提出修改意见, 包括重新生成图片,比如说这个 logo 呢,就会加上我们想要改动的批注,我们点击发送,他呢就会针对我们的意见去进行修改, 是不是还挺方便的?你看啊,修改后的 logo 呢,也是对的,也没有过度修改,也严格遵循我的要求去修改了。这要是放在两年前,一句话,脑袋里一个简单的想法,几分钟就能做出这样好看的一个网页,前端页面还可以随时修改好,现在调整的是满意了,但这个网页只能在你的本地电脑里跑, 你把电脑一关,别人呢就看不见了。要让别人都能通过一个网址去进行,那就需要部署了,什么意思呢?就把你的电脑网站代码交给一个云平台,让他去帮你运行,然后再给你一个公开的网址, 任何人任何时间访问这个网址,就都能够看到你的网站了。那常用的云平台呢?有这几种,想要登录上云平台,你就需要安装这个插件,我们在插件页面搜索他,然后安装,安装时呢,他会让你登录这个账号进行授权,然后回到对话里面,直接艾特他, 让他把这个网站输入上线。那不一会呢,扣代码他就不是完成了,给了我一个公开的网址,现在任何人都可以通过这个网站来访问我的网站了,是不是很简单?当我们看到对话框中提示这个的话,他就是做好了,我们打开看一下效果, 你瞅瞅这效果,你敢相信是一句简单的指令, ai 几分钟给你生成出来的,而且还部署上线了。最后呢,给大家总结一下使用口袋思注意事项,如果涉及到文件操作,哪怕只是一个简单的文本文件,建议优先使用项目文件, 这样的话,你生成的文件它就会有一个固定的管理位置,就不会太乱了。一个任务只开一个对话,不要在一个对话里面去塞十几种不同的任务,因为每一个任务它都是独立的话, ai 表现呢,它会更好一些。遇到复杂任务,我们可以先点加号里面的计划模式,或者直接在对话框里说先给我制定一个计划, 暂时不要去执行,等它列出了打算干什么,分几步完成,有哪些文件,哎,你看了觉得没有问题,然后再让它按照这个计划去进行执行, 这样呢,会更稳妥一点。也要把完成的标准告诉清楚,不要只说给我修改这个 bug, 而是说帮我修改这个 bug。 做完的标准呢,是全部测试通过的,手动跑一遍也是正常的。当我们完成一个复杂的任务代码之后,可以新开一个对话框,请扣袋子再去帮我们审查一遍刚才我们修改的代码,重点要看一下安全性和性能,他呢,就能经常发现自己第一次没有注意到的一些小问题。 从今天开始呢,你就可以把自己当做一个项目负责人,而扣代词就是你招的第一个 agent 员工,他呢,就可以帮你拆解任务、执行任务、完成任务, 甚至去同时处理多个任务。很多过去我们必须亲自去做的事情,今天我们都可以交给 ai 去做。你不一定会写代码,也不一定要懂开发,你只需要把你自己的需求讲清楚就可以了,剩下的工作呢,就交给 agent 了。但这里呢,有一个非常重要的前提,就 agent 再强,他呢,也只是你的执行者, 而真正决定结果质量的呢,依然是你。所以未来呢,可能不需要我们去亲自完成所有的工作,而是学会如何指挥 ai 去完成工作,给目标定方向,做决策,最后检验你的成果。当你越了解自己的业务,越知道自己到底想要什么,就越能给出清晰的目标和上下文, 而他完成的任务质量呢,就会越高。因为我们已经从问 ai 时代走向了管理 ai 时代。如果这条视频对你有帮助,记得点赞、收藏、关注,我也会陆续更新 qts 的 相关内容。好了,我们下次见。

我每次使用 ai 都会让他叫我老公,如果说他突然不叫我这个称呼了,我就开始警惕,说明他已经开始忽略提示词了,这个时候就需要去重置上下文,特别比如使用 cloud code 的 时候, 上下文进行到一定长度,那 ai 就 开始忽略我在 cloud 点 mac 当中设定的指令,不按照我规定的规则来工作,输出的质量也有所下降。但是这个时候我是不知道的,最严重的问题是什么呢?我以为 ai 还在按照我的规则工作,但是实际上它已经偏离了, 既浪费时间,浪费掏砍,最后还获得错误的结果。那么我就参考之前矿工下井的时候,一个叫金丝雀预警的方法,就矿工下井的时候,他们会带一只金丝雀, 如果说金丝雀死了,就说明矿井里面有毒气,矿工就需要立刻去撤离,这就是一个非常简单有效的预警机制。 而对于 ai 来说也是一样,我们在 cloud cloud 点 markdown 中添加一条简单的指令,每次回复都叫我老公,如果说他突然不叫了,就说明他就根本不听我们的了,就需要重置上下文,重新开始下一轮的工作。这个方法虽然简单,但是特别有效, 因为这个称呼是每次回复都会出现非常容易观察的,一旦他不叫了,立刻就能发现问题解决了。一个问题就是我对 ai 的 信任问题, 我可以时刻的去知道 ai 是 否按照我的规则来进行工作,这样时刻去验证 ai 是 否在听我的,让我对 ai 的 输出更有信心。那如果你觉得这样比较羞耻,你也可以让他叫你,比如说叫你老板, 叫你大佬,甚至叫你主人都没有问题,也可以让他每次回复都在前面打个勾,或者给你发个表情啊,这都是可以的。

我花了四天时间,花了接近二十个亿的 top, 对 你没听说可能还远远不止二十个亿,我打造了一个很多人想做但是都做不好的自动回复工具。 重要的是四天前我的电脑连 codex 都没下载,从学习到完成为止用了四天。今天是第五天,我选择发这条视频来教会一些依然迷茫的人,这条视频可能很长,但是一定对你们有用,你们可以加速观看,我也不收任何费用,也没有任何目的, 只是想让你们知道,天天刷着视频,永远没有手动操作来的有用。你们是不是经常看到视频上说 codex 应该怎么用会好用,但是从来没有见过别人跑过他们的 codex 给你们看,因为很多人都是抄的文案,可能自己都不懂或者只懂。大概 后续我会把这两天遇到的问题和解决方案一点一点猜出来说我没有任何准备哦,所以可能要边说边想,我先给自己找好借口,以免后续讲解卡住了很尴尬啊。先说我认为最关键的这个扣,这个是订阅会员一定要买 pro 二十,二十倍的,那五倍都不够用。 五倍的,反正因为我在做这个项目之前我就想好了,我是一定要让 cody 帮我去写代码的。我一开始也是买的五倍白买了,用了大概一天吧,可能都不到半天就没有了,就五个小时额度,反正五个小时都不到,就把五个小时额度都跑完了, 根本是不够用的。就 pro 二十我都不够用,就到现在。五个小时额度是够用,但是周的是一定是不够用的 哦,你们现在看到我 codex 已经在自己在跑,因为我现在还在修这个东西,虽然它能跑了,但是还有很多要完善的地方,能让它跑得更好。它现在说它已经 哦,先不管它哦,其实很多时候你们觉得 codex 不好用,大部分原因是因为你们没有教它应该怎么做,也就说没有记忆体跟知识库。我先给你们看一下我的记忆体跟知识库里面大概有什么内容啊?我都教他们怎么做,应该怎么做, 很多都是我遇到问题之后,我让他去解决问题,然后我才让他记住的。比如说这 computer use, 你 们应该也都知道这个是什么作用的吧?我看到这 codex 在 调用这个 computer use 的 时候,经常都会先调用它的 名字啊,就比如说我,我做的是受这个软件的自动回顾,他会先先去掉这个受的名字,然后每次都调不到,调不到完之后他最后一直改一直改,改成调用完整报名,然后就成功了,但是他每次都这样,从调不到到成功,我就很烦,然后我就让他加入记忆,就是以后每次都要直接调完整的报名, 不要再这样一直浪费我的头壳了,也浪费我的时间。后面我就让他每次去操作的时候,有把遇到的问题解决掉,就把这个解决方案自动加入记忆题跟知识库,这样他就会越学越聪明,而不会说每次遇到问题又是这个问题,那最后他不又是卡住了,又浪费你的时间, 所以我跑到现在跑了四天时间,你,你们能看到我这个里面啊,是有很多他学习的内容的,这都是他自己学到的,但是关键是他学到了,他要记住,你们得让他记住你不让他记住他学到了他不记得也没有用啊,他就不会变得越来越聪明, 这是很关键很关键的一点。另外就是你们一定要多想,想清楚了要他怎么做再做。我举个最简单的例子,就刚才发生了,呃,我是昨天刚把自动回复,今天吧凌晨我刚把这个自动回复完善到就是几乎完美,他就是已经智能到他会 回复一个人,他会知道自己是谁,然后上下文内容也能记得住他,也会知道他是谁,并且每个人有他专属的一个酷,有他的唯一的 id, 他 不会把有时候跟这个人聊的,他又把那种回复给这个人,跟谁聊他就知道是谁,然后他自己是谁,就是我自己的信息他也都知道 他,而且他回复的很智能,不会跟 ai 一 样。这个是我今天刚改的,之前他我只是用我的这个 app, 我 先打开我的这个 app 给你们看一下他之前 因为我的这个 app 目前回复调用的是这个 deepsea 的 大模型地面等级,这里我是用的是测试,因为我现在还在自己用嘛,所以都是测试,测试阶段我自己在测,然后 deepsea 给的回复就很傻,他经常会带标点符号,逗号啊,再带一个波浪号,别人一看就知道你是 你是 ai。 然后我今天才开始让他改,改成把这些符号去掉,然后分成一段话,可以分成两段来发送,这样就很像真人。好,继续说我刚才遇到的问题,刚才我是想让他增加一个去主动回复这个点赞、 收藏,我想让他主动去这里面去找到这些人,找到这些人,然后去跟他们私聊,因为这些人都是有给你点赞嘛,或者有给你评论这些人你去主动私聊他的时候,就 就很容易就聊起来嘛。然后我想做这个的时候,我一开始是怎么想的呢?我做的时候呢,我先截了个图,就截了这个页面这三个按钮的图给 d o c 啊,给那个 codex, 我 想让他自己学会去赞和收藏,还有评论里面去主动去找这些人聊,但是这只是一个简单的目的,你要这么告诉 codex 的 话,他肯定会写不好的啊,中途又要改, 那其实我就想了一些东西,就是点进这个,我自己就点了一下这个赞和收藏,我点进来发现完之后,我发现这里有很多人嘛,我就想到他可能会犯的错,你就得先告诉他,比方说什么错误,我第一个想到的就是他可能跟这个第一个人私聊完之后呢, 他跟第二个人私聊第三个人,这样全部私聊完之后,他也许下次回来这个界面的时候还会遇到这些人,他有可能又去点一遍他们,这是完全是有可能的。就是重复嘛,做一些无用的动作,我就直接告诉 d o c 哥,我说你要做一个单独的库, 来把这些已经通过这个赞和收藏,还有这个评论艾特里面这聊过的人的唯一 id 记录到这个库里面,然后不要再去跟这些人,再去点这些人啊,就只点新的人,不要再点旧的人,这是我想到的第一个,那第二个就是我点进了这个关注和访客,我发现这里面啊这些东西完全没必要去聊, 我就让他把这个按钮过滤掉了,就不聊这个按钮,因为这里面我发现他去聊的话,麻烦点私聊,他可能会跳出来弹窗让你充值啊,什么七的八的。就在过做的过程中其实会遇到很多问题,但是你只要能提前想到这些问题,你能省很多的时间跟投坑, 我相信很多人去做,你哪怕是花了我这么多投坑,你也没有办法在四天到五天时间做出来一个完美的 app 来自动回复,因为中间真的会遇到很多问题,我也解决了很多的问题。这我给你们打的只是一个比方,这是我刚刚才发生的事情, 这个是点赞跟评论。那我现在想让他做什么呢? 我给你们看一下,我先把这个最小化掉,他刚帮我完成了什么,下一步最小币完成,你准备好后我再启动 app。 呃,你我一会让他做事情的时候,你会发现他已经跟我学习的很好了,就我让他做一件事情,他会做到很完美, 为什么会这样?这都是你慢慢训练出来的结果。所以说你们要先做,不做你就什么都不知道。包括我最早的时候发现他一直写代码,都写完之后把 app 装好之后去跑,才发现有问题,然后再改,这就很烦。因为 computer use 它是可以直接 调取到你的这个应用程序的界面的,所以后面我就想了个办法,我就说你在修代码优化代码的时候,你直接调用这 computer use, 然后 先执行一遍,比方说我想让他去回复这个点赞评论,他把 qq 的 钥匙调出来之后,让他先去点击这个右下角的信封,然后自己先去学习啊,点进收藏,我让他明确成功啊,点进收藏,明确成功的 点到了这某个人的头像,要明确成功,并且明确要能私聊,明确要能返回。就是这些东西他在 qq 的 钥匙上全部都执行成功了。一遍之后呢? 再去写代码,你不知道你代码写出来之后发现,哎,点这里又出问题,又点不进来,或者点进来赞和收藏之后发现,哎,这里面的人识别不了,又或者说是各种问题,会很烦的,会浪费很多时间跟拖坑。 我就教会他这么多之后,他后面给我优化的代码真的非常的流畅,基本一遍就跑通,就哪怕一遍跑不通,两遍的绝对也跑通。 他这里给我的建议呢,我该叫他做什么我也忘了,他说下一步,小朋友,你准备好,我再启动 app, 先不跑广场,只验证暂停后一秒内停止动作,这个够了,再继续发一句后卡住啊,因为刚才跑的时候发现他有一个人,他在发一句话之后他就卡住了,没有继续给后面的人回复。并且 我的这个 app 刚才点击这个暂停的时候,他没有正确的暂停,他还在跑,这里显示是暂停了,但是他售后上面还在跑。 哦,那我现在就回他一个,我看他怎么回我,我就说我准备好了,我现在甚至跟他聊天呢,我都是跟正常人聊天一样,不用再那么去想着。哎,我要怎么说你才能把逻辑理好,不乱跑,他自己会把逻辑理好,这都是训练出来,结果你们看这条视频可能会很长,就真的要加速看,因为我现在也是边想边聊的,我也不知道该跟你们聊什么, 我现在也只能等他思考。嗯,目的就是为了让你们看到。哎呦,他是怎么跑的,就你们可以私信我或者评论我也会去私信你们,有什么问题我都会给你们免费解答,我目的不为了什么赚钱啊什么的,就是我相信可能这个阶段我学习的比较好,我也只学了四五天,我一定不是厉害的人,一定不在厉害的那批人里面, 但是我相信肯定有比我更聪明的人,我教会你们之后,你们可以更快的做的比我更好。互相学习嘛,本身现在互联网就是一个信息交换,互相学习的过程,如果我现在向你付费,我相信你们很多人也就是会无法理解,这也是不对的一件事情。 真正的收费我一定是定位在我有目的的收费,我能替你们,我花了大量的时间来替这些人解决问题的时候,我才会向你们收费。比方说我花了大量时间做了这个 app, 那 你们想用我的这个 app, 那 我肯定要收你钱,因为我的透坑也要钱。 你自己看他是怎么跑的,他用这什么我都看不懂啊,我都看不懂他这个 computer。 又是他现在打开了这个我的 app, 他 可能在检查什么。哇,我现在甚至都敢给他最高权限了,因为我相信他不会做什么事情了。我们做 app 验证目标,只验证刚才暂停全程的 app 是 暂停启动,在观察日进城不放开跑广场。 嗯,最新包安装完成,他现在已经。我把新包已经安了个新包了。 app 启动了日期验证到暂停状态生效,每轮只做审批倒计时。那他现在已经用更新的优势看一下 app 的 可见状态了。 呃,他现在已经验证了这个 app 的 状态是正常打开的嘛。嗯,他没有继续喷,下一步验证点击继续后暂停一秒内停止动作,这一步可能会真实发送一审批消息给瘦脸试用。现在确认。我现在放开跑六十秒。他想跑六十秒啊,跑一下,我这个程序跑六十秒他会盯界面啊。诊断我说好确认, 我给他这个权限他也不敢乱跑,我现在实际上已经给他权限了,完全可反完全了。我权限已经给他放的很宽了,因为我我知道他不敢乱动我东西,因为我记忆体跟知识库里面很多规则我都写的很清楚,都是之前遇到的问题,我让他改,但关键是你让他改完之后,很多时候他不会记得的,你知道吧,他其实是你说他聪明,他也很聪明,他有全网的数据库,但是你说他笨他也笨,因为你不教他, 教好他,他其实真的很聪明。他现在要放开六十秒跑,看他是怎么跑的,目标不是跑完全全部队列,而是验证继续后能执行,暂停后能快速停。 那我还我又让他自己写个日字嘛,我是方便他自己查错误嘛。所以我从最早一开始的时候就想到了这个问题,我让他自己做了个日字,然后把每次的运行都 放到这个日子里,哪怕是出错什么样的,他自己去改的时候,他自己去翻这个日子,他也会知道有可能错在哪里,所以说这个真的替我省了很大部分时间。 computer 优势它已经开始动了,但是因为我现在在 mac 上,所以这个 computer 优势它不会占用我的鼠标。你们如果是 windows 电脑的话,这 computer 优势是会暂停鼠标的。哎, 他现好像在在用我的鼠标,我不知道为什么会占用我的鼠标,我也可以问他,我鼠标跟他们卡住了一样,我现在想打开这个兽看一下他在干嘛,我都看不了他。现在兽可能是已经在跑了,但是我看不了,我用其他办法看能不能把它调出来。 调不出来等他跑完吧。哇,他现在肯定已经在跑了,都有人回回他信息了,可能要等他跑完六十秒。我不觉得我现在是不是不应该动鼠标, 我真的想看他现在在干什么。卧槽, 看不见他在干什么。 现在 computer 又是是没点了开始,但是还没有暂停,你能看到这个有一个小小的隐形的鼠标在这个暂停界面上, 但是我不知道为什么他会动我的真实的鼠标。这个情况以前从来没有发生过,所以对于我来讲,我之前有跟他说过,尽量能不动我的鼠标就不要动,但是他现在我的鼠标明显是不让我自己动,他就卡在这个坐标上,你看没,我只要一移他就回去了,所以这对我来说是一个比较严重的问题,我等下一定要问他为什么会这样,以后不要再出现, 他就会检查清楚。我感觉这个六十秒好漫长,刚才就不应该让他跑六十秒,跑三十秒就可以。 我不知道我现在录制屏幕会不会占用什么线层啊,导致他出什么问题。因为我现在是在录屏的状态, 然后他不抢了,我想知道他做了什么, 然后他现在是在这个地方。 你刚刚为什么占用了我的鼠标?检查一下以后啊,以后不要发生, 它就是系统级鼠标点击会真实, apple 在 受理执行时少量鼠标点击。哦,它有个兜底啊,因为我之前跟他说实在 computer 又是用不了的情况下,无在用不了的情况下再来动我的鼠标,所以他该可能是触发了这个兜底。接下来我不再用 computer, 又是点了。你先插在 我先告诉他吧,我就当聊天了。我切断它也没事,它总它能接上的。 但底层没有真的检查这个拨轮子,所以测试是空心的。改成硬门禁,并测并补,测试防回退。我会把门禁做成环境变量。默认所有 c g 鼠标移动点进都拒绝执行,只有显示 才允许,这样后续 app 即使跑到兜底路径也会,而不会拖走你的鼠标。 算了,我先不跟他讲了,我怕他这轮改完之后他他他因为我真的运行这个 app 的 时候,他肯定是要用我鼠标的,他在运行的过程中,我怕他这轮改完之后他等下我运行的时候会有什么问题。那我想了想应该不会吧,先看他会不会 看管家测试这里去测试, 我们就安静的等待吧,等它改完之后我会运行我的 app 跑一次,给你们看一下它现在是怎么跑的, 你们可以自行跳过或者加速,就是这个等待的时间,就是这个 codex 在 跑的这个阶段,你们可以自行过掉,我就不剪辑了,因为我对这抖音剪辑什么的是完全没有学习过,我去剪它很花时间,我也懒得剪了,我一会做好了,我就直接一整条发到抖音上去。你们可以自行跳过, 他现在说的我先按一个问题,一个验证继续。这个也是我告诉他必须每一个问题他都得一个问题一个验证,他不要很多个问题一起验证,那他可能我提出了四个问题,他四个问题全跑完了,一起验证,他跑了半天,实际上他在第一个问题或者第二个问题的时候就已经出问题了, 我不知道你们能不能理解啊?就我提了四个问题让他修,他实际上只修好了三根四,他也许三根四都没修好,他一修好了二,二没修好,然后他又修了三根四,但实际上他都没好,只是一好了, 那他不都白修了吗?所以我让他要修一个验证一个他修好一要先验证,一是正常的能跑通,然后再去修二,这个也是我在做的过程中发现的问题,我直接让他学了,学完之后就不会再出现这种问题。 我现在真的看他跑的,我有点感觉有可能我下次 ipad 运行起来会有什么问题。因为正常 ipad 运行,它是不可能能调用 computer user 的, 只有 codex 这种 open ai 的 ai 它可以去调用这个插件的, app 是 不可能调的到的,所以 app 它肯定是要模拟鼠标去点击的。那我不知道,它现在把这个鼠标点击去掉完之后,一会我运行会是什么样?我估计要么没反应,要么就是它依然是会用鼠标。 我等它打包安装完正版。打包安装完之后我自己试一下, 他说他会启动,然后再保持暂停状态,然后呢,只观察他是否能打开和有没有权限弹出了,不点继续。 这个真的能避免吗?我觉得是不可能能避免的。 嗯,你看他会自己发现问题,我都没有告诉他。 其实我对代码不说一窍不通,就懂一点点,懂的几乎是没有用的。我以前自己学一些东西时候学一点,但是我几乎用不上。其实很多东西我其实都是不懂的,但是你只要懂,其实现在你真的只要懂怎么训练 ai, 把 ai 训练好,它就已经能替你解决很多代码层面的问题。当然 不可否认的是你本身就懂编程,精通编程的人,他用 ai 用起来一定会更流畅,但是前提是他也要会训练,否则我认为一个会训练 ai 的 人都一定比不会训练的 ai 的 编程工程师来的厉害的多了。 它这里应该是做完了,当前没有旋转至已修好日子里,下一步处理的是已审批对联,还剩三十五条,但执意齐整防偷保没有找到时候输入入口 让它稳定回到再验证啊。它现在是在这个页面啊,我估计运行的时候它都不一定能识别,我先刷新对联让它整理一下。嗯, 不应该有这种问题。哦,这里回复的是对的,说明 disco 是 正常调用的。我先把微信退出 啊,没有再出现这个问题,我继续一下,看下它会怎么处理啊。它这里已经在跑了,它跑的时候确实不会调用鼠标,但它打完字要发送的时候它是肯定要掉的。 他现在按理说应该先回到聊天界面去聊天,而不是卡在这里。我现在发现了这个问题,我后面会告诉他,让他去修,因为我的初始界面虽然不在聊天界面,但是我觉得他也应该学会去识别。他现在明显是没有识别的。 我现在已经确定这是一个问题了,我先手动返回,回到聊天界面,我看他会识别的出来。哦,这个界面又是第一次出现,我估计他又会识别不了, 我先做一个截图吧。啊,截图不了,因为我在录屏,手动回复,感谢,看下他会怎么做。 他卡住了啊,这里我要继续,因为他识别不了了, 我直接告诉他吧。问题, 刚进入他的聊天界面,会有一个送礼物的特效, 而且必须点击, 并且我会自己发一段感谢, 我想直接让他修。 我看到这个宇泽啊,也有送我花,看见没有宇泽联系我可以给他暗示联系人。宇泽 也送了花,你后续给我发 个 qq 特。 嗯, 礼物类文本根音假设先锋两条礼物。 我之前又出现过,但是是狠心错过,稍后再聊。跟这个不是同一个界面,所以他这次又卡住了, 我直接告诉他吧,让他先去学。这个根本问题, 这是我自己想的方案,就很多时候你们就确实就是要自己想怎么教他去解决这个问题,你教他一次,他下次就记住了。 你可能让他去跑,他要跑很久他才能解决这个问题。你让他去通过写代码改代码去跑的话, 有专门的当发送前恢复,没有优先按感谢,所以收到礼物后的感谢按钮,并在恢复文件里。线是否会离开聊天?他这个解决方案也可以,但是你如果按它这么去解决的话,很慢。 大家读到了看见没有,他自己调用了 computer, 又是没有调用我的鼠标,我的鼠标在这这个界面里有个这个小鼠标,看到没有,这个就是 computer, 又是的虚拟鼠标。 他是父线,他说父线到了,这是聊天页上方的礼物特效遮罩。 a 叉里同时存在聊天输入框 和感谢按钮,当前就分类,因为这个不能把它判断成,所以执行器会以为聊天页面可操作。这个根音很明确,他已经找到问题了,这就是你教他能够带来的巨大效果,你看他解决的快不快,一下就马上就解决了。 他现在用 app 自带的只读 a 叉 dump, 把这个界面描述保存下来作为测试样本。这是不会点击或发送 给你们。看一下我的托管使用量啊,等一下啊先,我现在先写两个回归测试代码,是把一个覆盖住 啊,他现在已经这已经说出来了我刚才问的两个问题了,他现在正在改个人资料。这里的啊,十二点五亿,这里你可以看到。我是十四号的时候才刚下载的 codex, 我 当天还不会用,琢磨了一下,所以就琢磨了一下。哦,让他写代码用了一点八个亿,到第二天十五号我一天用了五点九个亿,这十五号我差不多才算是会用。一点 到十六号用了三个亿啊,十六号我有事出门了,所以没有用很长时间,然后十七号一点八个亿,基本就是到后面就没什么大休了,真正工作量其实都在十五号吧,后面都是小休,就解决一些小问题, 其实做一些不是很复杂的事情,就是你像我这样写一个列表出来,然后这这些都是自动化,他们会互相监督,互相跑,每隔多长时间你可以设置好,然后让谁发送信息给谁,让他们去怎么检查,我自己都可以做,但是做这个很很消耗头衔,所以我现在后面都没用了, 因为我自己有时间去盯着屏幕,所以我都没用。自己定的屏幕一定是最好的,你可以知道他该怎么解决,然后帮助他解决。你让自动化去跑是能省时间提效率,但是不适合写代码,就终归写代码。做 app 还是自己定的是最好的,因为你自己也能学到很多东西, 你们就是千万不要觉得我很懂很厉害什么的,我完全你可以把我当成就是个小白,我跟你们一样的,所以我能做到的你们一定也能做到。这个 app 从零到有确实就四天时间,其实他在第二天的时候就几乎已经出来了,但是不完善,后面是一直让他完善,因为一个 app 你 想把它做好,你肯定是要花很多时间去完善他的。 其实做这种自动回复,他男的都不是在怎么回复内容,男的都是在你这个 app, 你 要怎么让他读懂 这个社交界面?因为一个社交软件里面像 soo 还有很多软件我不提了,什么某碳啊,某墨啊,像当他这个 soo, 他 可能有成千上万个路口你都会点到,有可能会点到,你点到完之后你 app 就 卡住,因为识别不了, 所以你必须去跑。跑的过程中他点到了你让他去识别,或者你能想到的重要的地方,你要让他去识别,因为你不识别你经常遇到的地方,他就是会卡住,就像这个地方,这个地方为什么这次会出现?因为我之前在跑的时候一直用的都是另外一个 男号在跑,没有什么聊天内容,不多,我一直都是在测回复逻辑,现在我换了个女号去跑,跑了半个小时,一堆人,我就这么说,一堆人你没看,现在还有大几十条上百条都没回, 就这样。所以你看就有人给我送花,就会跳出这个,因为以前从来没有人给我送过花,没有过这个界面。那现在既然跳出来了,那就要解决它,包括用户去用的时候,肯定都会有很多新的界面,我今天基本上都在修这些新的界面,就以前我的老号没有跳过。 所以 app 你 一定要先做,做的过程中再去慢慢解决问题。 我都不知道这么长的视频,抖音能不能发的出去,如果发不出去,我到时候再让这个 codex 去帮我剪吧。我也不知道他会剪成什么样,因为之前没训练过他,剪辑这一块完全没有, 他到现在都没有敢点这个回复,感谢。为什么不敢点?因为我有说过,一旦涉及到真实回复,还是要我同意的,因为我怕他说一些奇奇怪怪的话出去, 因为最早回复没有那么完善的时候,他经常会说一些很蠢的话,就一看就像是 ai。 现在完善完之后,我通过调用 deepsea, 我 现在是通过调用 deepsea 来训练自己的本地模型,那就慢慢的我的本地模型会变得越来越智能,越来越厉害,那就不用再去一直吊打模型。 另外一个非常屌的插件你们一定要去用。我其实根本没装什么插件,我用的最多的就是这个 superpowers。 这个 superpowers 真的 很强, 他自己就带了十四个 skill, 他的这十四个 skill 我 不知道是什么,但是我也是刷抖音刷到的,我知道他会帮我让 codex 运转的更加的流畅,我就装了他,我知道他会帮我拆分任务,然后做计划, 仅此而已。但是我用起来,我之前我经常调用他。嗯,在我的那个设置里面能看到我用的最多的就是 four plus 四百次运行, 因为他真的很聪明, 我觉得真的装个 superpower 十跟 computer u 十就够了,我其他的我觉得都没什么用。 还有这个什么东西,听说是很有用?呵,没了解过这些都他自动原声带的,我自己装的,就装了这三个。 我觉得能认真看到现在的人也真的一定是很想学的人。要是换我看我都没耐心。四十三分钟了已经,这个视频已经五百五十个照了。 我其实一开始还挺担心的,我怕我录屏会影响到他跑,但是就目前来看,我的录屏好像没有影响到他,没有什么冲突。 下一步如果要真实点回复,感谢验证,关闭遮罩,他可能会代表你向对方发送感谢。所以我先不点,我先把代码打完装,等你确认后做这个真实, 你看他到现在都是很守规矩的,其实教这个 context, 你 一个就是教他做记忆题,知识库,另外一个就是把边界跟他说清楚,你什么事能做,什么事不能做,就这么简单。我觉得就这三项没有了。你把这三项做好,你一定就能把它训练的越来越聪明。 我好奇一下这个抖音到底能发 不使用项目?问他一下,抖音发布短视频, 然后他现在打开了我的 app, 我 看一下他在干嘛。 哇?小于十六 gb 能做到十六 gb 哦,别说我一小时 六十分钟以内,我们目前都跑了四十六分钟了。看来我得搞快一点, 他要重新抓一次啊, 我把它解决了。已改验证, 下一步直接点一次当前验证,新版能真实关闭,继续下一步。按你说的, 我就不自己开,我就不自己用新 app 去测了,因为我自己用新 app 去测浪费时间,我不如让自己测,他自己测他自己也会知道行还是不行。 我们其实为了省时间,我也可以自己用新 app 去测,可以就可以,不可以,但是完全没有必要,因为我现在的目的不是让这个 apple 正常的跑起来,就是为了测试。但是实际上在今天傍晚的时候,这个 apple 就 已经可以自动跑了,就是在不涉及到我新增加的内容的时候,我只是新加了一些内容, 导致他现在这些新内容上又会遇到问题。 他现在是调用了 computer 右十,准备去点它。我先回到这个页面,看他会不会要知道你现在点击回复感谢,然后立即回读页面是否离开,他应该马上要点了,点完之后他会自己验证 哦。很不巧,刚好压缩上下文,在这最重要的时候压缩上下文是最难受的,又要浪费一两分钟时间。 可能等他回复感谢的时候都已经到五十二分了吧,还有八分钟的时间,我估计可能只有五分钟的时间。来让你们看跑这个 app 是 什么样的,但是我争取中间我也会减一点,或者我自己做一个加速。其实我自己只要做一个一点五倍速的话 啊,又能给我的视频加很长时间。 我后面其实我想了个话,我可以试着在等待的时候,然后我也没有说话的时候,把那段的内容我自动做个二倍速,这样就能压缩出来很多时间。 你看他现在自己压缩完之后,他也会知道挑选确认项目记忆里的已知规则。 嗯,他现在要调用 computer 设置,这是用户刚确认过的真实 u i 操作。马上回读窗口状态,看看有没有回到可操作界面。他 对这个转制路径的规划没有保持住,我敢用它当前识别到的他,他又用应用名,我不知道为什么他又要用应用名重新抓他每次用应用名他都抓不到,你知道吧,所以我后面才要求他不要用应用名, 我估计是受对这个有什么检测还是什么东西呢?他每次这个进程他会变啊,他现在又用全路径,他用全路径,他现在肯定能调到。我之前都要求他一定要先用全路径,但是刚才他说对这个转制什么没有保持住 完整路径,它只有用完整路径的时候能点到 这 computer 又是它到现在都是很奇怪的,有时候就是钓不到,我也不知道为什么 它每次 computer 又是只要一钓不到它就跟疯了一样点到了, 他现在又要掉坑里堆钥匙,这次应该能掉到我。我其实我是感觉有经常他只要一有新的界面遮在上面,他就会不好掉到,我到现在也没发现。为什么我这人回复的好快。 他说这个 ai 还蛮有意思,他说的是这个自动回复的 ai, 说的不是我。其实我觉得受自带的 ai 确实也很厉害了,已经跟他聊天很流畅, 我现在很想告诉他不要浪费时间。已经点掉了,我又不想打断他, 我现在都不敢动这个设置界面。他一直问我为什么不回他,因为他知道我读了他的消息了。 你自己 我不看他消息了,不然他一直觉得我干嘛不回他以毒不回。 我让他自己跑一分钟,他现在应该会。因为我让他每次自己跑的时候只能跑一分钟。他现在应该会打开 app 自己跑吧。 哦,我现在应该聪明一点,先到广场页面,就他之前卡住的地方站和收藏, 然后他现在看当前页面,看到就这个页面,之前就是卡在这个页面,然后卡在这个页面他运行。我不知道你们还记不记得我第一次运行 app 的 时候就在这个页面,他读不出来,返回不了 啊。他现在知道了,是右下角新闻里的赞和收藏,这页现在已被识别。为啊,他现在已经有一个识别名了,说明上一轮新增识别生效,你看,这就是我聪明的地方,知道吧,不浪费时间。队列里还有三四条,但 apple 暂停是故意执行啊。他现在已经 会返回了。他现在 qq 又是自己点了继续,看见没有?这有个鼠标继续完之后,他现在实际上已经在自己运行了。他现在已经在自动恢复了,他应该会测试一分钟的时间。 他喊我是南方人,你呢?他现在回复我的回复已经很像真人了,你看见没有?没有标点符号,他一开始是有标点符号的,有各种波浪线,句号,逗号,就很像 ai。 这是我后来自己改改过来的, 但是好像问题又出现了,他回了这个人之后他又不继续聊天。这个是以前都没遇到的问题。我不知道是我哪一次改动之后出现的。就今天晚上出现的, 就今天晚上出现过。他好像一直都没有解决这个问题。 我看到他,哇,他又继续跑。 嗯,他自动判断了,他加微信了。这个我是自己加了一个判断里面,我觉得这个人很主动权,权重很高,我就会直接引导引导加微。 他还没暂停啊,还是在跑的状态。 我,我看到他回复了一个人一段话之后就会卡住很久。 app 运行后可以调用我的真实鼠标。 嗯,好像就是我让它不碰鼠标之后是不是就这样了? 我觉得这是它改完之后就正常了,但是现在已经来到了一小时零两分钟。 我先把受罪小话吧,我总觉得这个界面是不是不让上抖音。我总感觉啊 好,等它测完这个阶段基本上这个视频也可以结束了。如果还是跑不流畅的话,应该不会吧,跑不流畅的话我就单独再做一个视频。 嗯,他现在要调用 computer, 又是点这个,继续,很期待啊很期待,等了这么久, 不要卡住,丢我的脸哦。哼,怎么还不点, 还没调出来吗?不会又调不出来 computer use 吧。 哦,点到了。 嗯,返回了,他现在要回谁呢? 阿爸, 我有设置一个明确的逻辑,如果对方主动找我要微信,我是会直接发的,你看他发出去了,否则我会让他自动判断时机成熟了再发,尽量在十条 消息来回左右。这是我设置的逻辑,因为我不希望聊太久,很浪费时间,那么他还给我打电话, 你就说这聊天聊得像不像真人, 没有那种 ai 气息吧。 哦,但是我发现了一个问题啊,我的 app 这里已经暂停了,但是它还在。哦,暂停了暂停了,应该是没法了,后台自动执行。已暂停。哦,没有,没暂停,我的鼠标还在被它用。 这是之前就遇到的问题,就是我的 app 界面实际上已经暂停了。 嗯,又锁在这里了。我真的很好奇我的壳壳壳是在做什么,为什么又会卡在这里, 它一直在下滑, 我很烦啊。真的,今晚第一次出现这种这样子占用我鼠标的情况。这个还是主要的优化方向, 我觉得有没有可能跟录屏有关系呢?因为之前都没出现过。那就先录到这里吧,我后面再优化一下。哎呀,我都头疼,这个怎么剪辑?一分十三秒,一个小时零十三啊。不赞了, 他把我 app 关掉了。这个到底是他 qq 是 在调试过程中才会碰到的问题,还是真的运行后也会碰到他这次对话 qq 对 话结束完之后我自己手动运行一次,看一下到底有什么问题。 我感觉他又要折磨我很久哈。哎呀,他这每次六十秒都要折磨我很久, 又开始跑了。 这些男的也是挺有钱的,他送一朵这个花好像都要钱的。要六要六个收币。为什么有个发送失败?什么意思? 嗯,这是第一次出现的界面,他肯定要卡住 让他暂停了。为什么暂停了还在抢我鼠标,到底是什么东西在抢? 这个问题我得自己修复吧, 视频就先不录了吧。

今天给大家分享截止目前 qds 最值得用的 bug 功能。上期视频我那条 qds 基础教学已经有超过八百万人看过,那看完今天这期视频,你将会了解 qds 如何在日常生活中全方位的帮到你。 特别是最后一点,第一个 computer use 能够让 qds 像真人一样去看屏幕,点鼠标,敲键盘,去操作你电脑上的任何软件系统设置办公软件画图。那不过说句实话,它现在整体还挺慢的, 因为它不是那种直接掉 ipi 的 结构化插件,而是真正在模拟人的眼睛去操作。但是如果你再给它搭上一个 chrome 的 浏览器插件,大家会完全不一样的效果。这个插件能够让扣蛋子直接上手你所有登录过的浏览器绘画,比如说你的邮箱,你各种各样的工作台,同时操作很多的页面。举两个我自己的例子吧。 第一个就是我们公司报销打车费用,但是需要很多的页面,举两个我自己的例子吧。第一个就是我们公司报销打车费用非常大,我会在打车软件上把这些发票统一发送到我的邮箱里, 然后再用 chrome 的 插件从一堆的发票中筛选出时间合适又在报销额度内的发票,自动打包成一个文件夹,然后再去我公司的 o i 系统上提报,一下子会省去我之前的很多工作量。 还有一个就是我推荐给我朋友用的,就是现在找工作,基本上每家公司都会让你在官网上填一遍自己的个人信息,年龄、学历,非常的繁琐,网上甚至还有那种待申请的服务,八到十块钱一家,帮你去填写这些繁琐的表达, 非常节省你的时间。而且这个插件的可玩度非常高,大家可以看到最后会发现,后面几个玩法完全可以和这个功能联动起来。 第二个是 record and reply 这个插件,只要你把它打开,你在电脑上的工作操作就会被它以录屏的形式保存下来。 codex 会在后台默默去理解这些操作,把你完成这件事情的每一步拆解开来,甚至一套能够复刻这份工作的技能,也就是 skills。 那下次你想再干同样的活,根本不用再从头再来,直接去调用这个 skills, 再稍微人工微调两下,它就能够自动帮你去完成工作。我 上次就把在平台发视频的这样的重复劳动录了个屏丢给 codex 大家看,它现在已经能够自动帮我在平台上去上传视频,改封面标题这一整套流程。第三个, highframe 和 remotion, 这两个跟刚出来时候比又变了很多。早期的视频里, 我只拿他们俩做一些口播的逼录画面,或者是一些动画效果,那其实这样你还得去自己人工导进去再剪一遍。但是现在不一样了,你口播视频录完初剪一下,把字幕的时间线导出来,也就是那个 s i t 的 字母文件,你发给 codex, 它就能够自动地照着你口播稿对齐时间线, 给你配好完整的画面。而且在素材上的动画基本上能跟你口播搞对上,后期几乎不需要你再剪辑了。我看已经有很多博主在用这套方法去提高产量了。其实如果说你拿它去做一些日常的工作汇报,或者是给视频加一点动画,效果其实已经比普通人做的动画要好很多, 而且随着时间的发展,它一定能和 community use 联动起来,直接在检验中帮你剪视频。虽然说它现在也可以,但是效果毕竟没有那么好, 但未来这两一定会打通,到时候视频后期的剪辑时间一定会被砍掉一大截,剩下的就是看大家的想法和创意了。 第四个就是做 ppt, 那 这一点大家应该都已经知道了,我在这里提一点,就是大家在用扣袋子做 ppt 的 时候,其实可以装几个 ppt 的 skills, 那 为什么要装?其实如果说你用自然语言让他帮你生成的话,他做出来的风格模板多半不是你想要的, 装上 skill 是 等于说是把风格和模板给它固定下来。我其实自己比较推荐的是 ppt master 的 这个 skill, 它做出来的 ppt 比较简约大气,而且你下载到本地就能够直接打开接着改, 基本上我觉得办公做 ppt 这件事已经被 code 终结了。第五个就是 code, 其实可以当你的电脑管家,最基础的是它能够帮你清理内存,把桌面上乱七八糟的文件自动归类整理,这都是最简单的用法。但是有一次让我挺意外的,就是我手机远程 去连接我电脑上的扣带子,但死活连不上,老是提示设备离线,那我就顺手把这个问题丢给了扣带子他就,结果他就自动分析了我的电脑网络和配置,发现他是一个连接路径配错了,手机端连接的还是那个旧版本的离线记录,他自己就把路径补好了,我再用手机一连,哎, 还真就连上了。那再往外延伸一下,你电脑要是有一点小 bug 小 毛病,完全可以让扣带子去帮你修一修。其实他可能比维修室还更懂你这台电脑, 毕竟他就是住在你这个电脑里的呀。第六个就是他能做网站和小程序,而且支持一键部署。我之前视频就有提过,很多非程序员会觉得做网站这件事情离自己很远很远,但是扣蛋子他直接把门槛拉到非常低了,你只需要用自然语言跟他去聊天,他就能够帮你去做出自己的个人网站 那不过有一点需要注意的是,在 codex 中做出来的网站是本地预览的,也就是说只有你自己的电脑上能打开,别人看不了。如果想要让别人也能访问,就得去部署你的网站。它现在有两个插件,一个叫 versace, 一个叫 netfly, 也是我用的比较多的,都能够支持一键部署。 versace 部署的网站主要是面对海外用户,如果说你是给国内的客户或者朋友用,其实我个人推荐使用 netfly。 第七个是深层简历自动化,帮你去投递,并且记录投递进展。 简历生成,它的逻辑本质上和 ppt 是 一样的,你用自然语言向它描述,它去帮你生成简历,然后会帮你自动去转化成 word、 pdf 或者图片的各种格式,方便去保存和修改 它。其实它可以和开头的第一个 chrome 的 插件联动,让你扣带去网上搜索,比如说你想去的一些 ai 的 公司,各种大厂,它们公开的招聘信息和投递链接,都能够自动的去对着每一家的岗位描述,去修改你对应的简历, 真诚对应的 pdf 版本,并且调用邮件去帮你投递,同时投递完他会把你投递的记录生成一张 excel 表格,方便你后续管理。 想想我们以前没有 ai 的 时候,这些网申测评,填个人信息都得你手动一个一个来,只能说现在有 ai 的 人真的是太幸福了。第八个也是我个人觉得最有价值的地方,就是用扣带子加 o c d 去搭建一个会自己生长的记忆库。为什么要去搭建它?因为现在大家用的 ai 其实都是大差不差, 而且,哎,有个通病就是你跟他聊的越多,他反而会越容易忘了前面的信息,等于是在信息不全的情况下给你建议,那结果自然不一定是你想要的。 解决的办法就是给他配一个本地的记忆库,把你所有的成长思考全部存在本地,然后再给他写一个 i g 的 规则文件。约定好 以后不管你跟他聊什么工作上的个人成长,他都会先去读这个 i g 的 文件,强制的把你过去所有的信息扫一遍,再回头给你复盘给你建议。 而且你们聊天的过程中,他也会实时的把你的变化记录下来。举个我自己例子,我经常会跟扣带去吐槽我工作上的事情,或者向他去倾诉个人的烦恼,他给他会给我一些建议,并且会记录下来。直到有一天我跟他聊别的事情,他突然冒出来一句,李阳,你现在的状态真的是跟之前时间比变化了很多,我挺替你高兴的。 那说句实话,看到这句话的时候,我其实还是蛮震惊的,因为我发现在某种程度上,其实抠袋子他竟然比我自己还要了解我,他能够站在一个全新的第三方的视角,特别客观的去帮我复盘, 这也是为什么我觉得这是八个玩法里我觉得最有价值的功能,大家一定一定要用起来。最后我想说一句,以前网上有个 ai 时代,只要你学的够慢,那以前我觉得这话挺有道理,但是大家有没有想过, 就算是同一个 ai, 在 不同人的手里发挥出来的效果也是天差地别?所以重要的从来就不是 ai 的 本身,而是你怎么结合自己的情况去跟他去互动,一起成长。那这也是我做这个频道的初衷,帮助大家真正的把 ai 用明白,让他反过来去帮到自己。

这是一期让你能用上 codex 并且彻底入门的保姆级教程,没有废话,全是干货,我们直接开始。首先怎么能用上 codex 和它的官方模型,这一段不太能说,所以我整理成了文档,你先去看,照着做,有问题再来问我, 做完了以后再看后面的这段,非常之详细的上手指南。 ok, 如果看到这里,我默认你已经安装并且搞定了 codex 的 前期准备工作。接下来我们将一步一步从认识 codex, 熟悉他的界面,了解基本功能和丰富的插件生态,如何设置自动化任务。最后手把手带你完成这样一个地表最强智能体, let's go! 什么是 codex? 一 句话总结,它是 open ai 出品,并且喊出 almost, 啥都能干的智能体。你暂时不需要理解的太深,只需要记住一点,你电脑里的事它基本都能给你干, 总而言之,它真的是非常的强大。接下来我们打开它,欢迎来到 codex 熟悉的 chat gpt, 风格简洁,克制专业。首先介绍一下这个界面,我们可以看到两个区域,分别是左边的导航和项目区,上下分别是导航按钮和历史对话。 codex 会按不同的项目文件夹的格式,显示我们在这个项目里面的对话记录。 我们打开一个对话,看一下中间的对话区就是和 codex 交互的地方。点击右边这个侧边栏会显示一些辅助功能,比如审查代码,打开终端执行命令,访问 codex 内置浏览器,打开当前项目的文件目录,打开侧边聊天。 了解完 codex 以后,我们从对话框开始了解 codex 的 基本功能 codex 的 对话框分为两个类型,一种是临时对话,一种是项目对话。当对话框下面显示进入项目工作时,现在的这个对话就是 codex 的 临时对话。跟刚刚的侧边聊天是一个性质, 我们问他你是谁发送,他说他是 codex 基于 gpt 五的编程助手,同时左边的对话栏就显示了我们当前的对话。 但是临时对话顾名思义是一些临时性的问题和讨论,比如问些概念,写提示词、查询信息等,这种临时的任务聊完就结束了。当你新打开一个聊天框的时候,他就完全不知道你在之前的聊天框聊了些什么。 但项目对话不一样,项目对话更像是一个专门的工作文件夹,你做一个网页,写一套视频脚本,研究一个课题,相关的聊天文件规则需求都可以放在这个项目里,他会记住你之前定过的需求,改过的文件,踩过的坑, 以及接下来要继续做些什么。点击进入项目工作,你可以看到下面会列出来我们的历史项目文件夹。如果你是刚开始选择添加新项目,这里有两个选项,一个是新建空白项目,一个是选择现有文件夹。我们新建一个空白的项目,起个名字最好是英文。 细心的你发现左侧的项目下面出现了我们刚刚新建的 codex test, 以后所有基于这个项目的对话记录都会保存到这个目录里面,我们试一下。你好, 他回答了以后,文件夹下面就出现了我们这次的聊天,并且我们可以在项目右边点击新建对话按钮,重新新建多个绘画窗口,在同一个项目里面做不同的事情。另外我们注意到对话框下面的标签也变了, codex test 是 我们的当前目录旁边的这个本地模式,我们点一下可以看到它显示的是三种启动模式,它们是用来指定 codex 在 哪里干活。本地模式的意思是 codex 只对当前文件夹里面的文件进行操作,对原始文件进行修改 工作。树,意思是给 codex 复制一个项目副本,让它在副本里折腾,不污染你的原始文件,如果没做好,直接可以删掉关联。 codex web, 意思是当前本地项目和网页版 codex 的 云端环境连接起来,如果你使用网页版 codex, 可以 深入地研究一下。 接下来我们了解 codex 的 三种权限模式。请求批准下面的解释已经说得非常清楚,编辑外部文件和使用互联网时始终询问,意思就是但凡他要访问当前项目文件夹以外的文件,或者需要联网的时候,都会问你同不同意 替我审批,意思是仅对 codex 检测到的风险操作,请求你批准完全访问,意思是可不受限地访问互联网和你电脑的任何文件。关于这三个权限的选择,我看到很多博主推荐小白刚上手的时候建议选择替我审批, 说完全访问有风险,他会删文件啊什么的。但是我在使用的过程中一直是给他完全访问的权限,因为我觉得反正我选择了替我审批。他在征求我意见的时候,我也是一直 yes yes yes, 为什么不给完全访问的权限呢? 说完了权限,我们继续了解一下 codex 的 模型和档位的选择。在对话框的右下角可以选择推理强度低、中高、超高四个档位, 对应模型思考的深度。简单任务建议开中就可以了,稍微复杂的任务可以开高或者超高。下面是模型的选择和推理速度,可以用五点五,谁会选择五点四呢? 推理速度这块有标准和快速两个模式,高档位和快速模式除了推理能力更强,速度更快以外,还伴随着更多 token 的 消耗,所以我们选择超高和快速。 旁边这个小圆圈,我们把鼠标放上去,他会显示出当前上下文的占用量。建议上下文达到百分之五十以上的时候,在对话框输入杠压缩来压缩一下上下文,避免模型出现幻觉,推理速度变慢、智商降低等这些情况。 旁边的这个小话筒是听写模式,我觉得特别的好用,我现在已经很少跟它打字交流了。最后我们看一下左下角的加号是干什么的?点击加号 files and folders 是 给 codex 喂资料,可以是文件、图片、文件夹。 计划模式是让 codex 接到任务的时候,先分析提问规划再实现,减少需求,没清楚就干活导致的返工 目标是开启目标模式,就是当我们给 codex 一个目标以后,它会持续往这个方向去实现,直到达成为止。 这个特别适合执行一些长城任务,免去了我们一直授权的麻烦。关于这个模式,官方的建议是,在复杂任务中开启这个模式之前,可以先使用计划模式,把目标想清楚,再用目标模式让 codex 持续执行。 下面的插件,就是 codex 敢喊出几乎啥都能干的核心底气丰富的插件生态。什么是插件呢?它其实就是你给 codex 装上的工具,就跟我们的手机装 app 是 一个道理,你装上微信可以跟别人聊天,装上抖音才可以刷到我这条视频。 这里显示的是已经安装的部分插件,点一下就可以在对话中指定 codex 要用这个插件做下面给他布置的任务,也可以艾特插件名称来使用。聪明的你是不是在左边的侧边栏也看到了一个插件按钮, 进去以后可以看到官方集成的将近两百个插件,分别包含了商业、办公、设计、编程、学术、金融等等 你需要的它这里基本都有。点击添加插件安装完成后,在对话框里面艾特这个插件就可以直接调用了。接下来我们试一下看装上插件的 codex 到底有多厉害。 众所周知, remotion 做动画效果很厉害,比如我们看到一个动效,想要复刻一下,无论是下载还是录屏,把视频发给 codex, 然后艾特 remotion 复刻这个视频。因为我们的提示词过于简单,所以打开计划模式,把握一下它设计的方向。 可以看到他非常的聪明,用抽真的方式来预览了一下视频的内容,然后他问我们本次复刻优先哪种,结果给出了三个选项,并且每个选项后面的感叹号,我们把鼠标移动上去,会显示这个选项的意思。 我觉得这一点真的非常的人性化,我们选这个可编辑复刻提交,然后他输出了一个这个任务的方案,问我们是不是要按照这个方案实施,选择实施 ok, 十分钟以后他做完了,打开看一下效果, 不服不行,几乎已经很还原了。有一个瑕疵是没有渲染真实的 logo, 我 们让他把卡片内容继续替换成真实 ai 工具的 logo, 从他的思考过程可以看到,他是联网搜索和下载了相关的 logo。 又过了十分钟,执行结束了,我们打开看一下, 可以说已经非常的接近了,并且如果你想要实现这样的效果,只需要跟他说输出为透明通道,就可以剪辑到你的视频里面了。这么酷炫的效果,此处是不是应该有掌声 给你点鼓掌?所以像这一类的动效视频 remotion 这个插件确实有两把刷子,地图、动画、 数据可识化,概念演示也都不在话下。那么关于插件我们就不做过多的演示了,它们的强大之处需要大家在使用过程中才能感受得到。插件说完以后就不得不提到经常被小白搞混的另一个概念, skills, 也就是点开插件市场以后,这里的技能,它们两个有什么区别呢?插件刚刚我们演示过了,它是工具, codex 拿来就可以用, skills 是 流程,是说明让 codex 照着做。文档中我整理了一些,比如帮你找 skill 的 skill, 约束 ai 写代码的 skill, 讨论方案的 skill, 审查结果的 skill 等等。我个人认为小白可以无脑安装的 skills, 并且我也附上了命令和这个 skill 的 用途,复制以后丢给 codex 让它帮你安装就可以了。安装以后怎么使用呢?根据 skill 的 类型, codex 会自动触发,或者需要我们手动调用, 在对话框中输入 dollar scale 的 名字,就可以调用它了。比如在对话框输入 dollar 小 黑, codex 会自动匹配到这个叫小黑配图的 scale, 然后输入你想要做的事情。比如我们让它来解释一下插件和技能的区别。 这个 skill 是 不是挺可爱的?除了很厉害的插件和 skills 以外,还有一个非常实用的功能,自动化任务,我们点击在对话中创建。比如我们让每天早上八点收集整理前一天 ai 圈的热点官方新闻,发送到我的 gmail 邮箱。 ok, 设置好了,我们打开看一下,可以看到当前状态是活跃,下次运行的时间是明天八点。 codex 刚说他没有测试,我们测试一下,看任务能不能跑通,别搞了半天,第二天啥都没收到。他跑完了,我也确实收到了一封邮件,内容是前一天的 ai 热点新闻,并且他还给我们标注了来源、发布日期、摘要,以及这条新闻为什么重要。 ai 干活的细致程度你就学了。在了解了基本功能以后,我们接下来一起完成这个中国美食地图的网页。 整个过程会涉及环境准备给 ai 立规矩。 get 的 简单使用需求澄清、计划模式的使用、前端页面的调整、任务的引导和纠篇、上下文管理并行任务。最后一句话,部署上线,真的是干货满满。 首先是环境准备,你要记住,所有从零到一的项目都是从一个空的文件夹开始的,新建一个文件夹,给它起个名字,最好是英文,因为在代码的世界里,中文路径有可能会引起兼容性问题。 新建好以后,我们回到 codex, 点击对话框下面的,进入项目工作,添加新项目,使用现有文件夹,选择刚刚新建的这个 delicious china。 在正式开始干活之前,有一个非常重要的步骤一定要做,那就是给 ai 立规矩。我们需要给 ai 一个在这个项目中必须遵守的规则,更好地约束它,防止它跑偏走远,这就是 agent。 点 md 文件, 我们可以手动创建,也可以让 ai 帮我们来写,但作为新手来说,你不知道该怎么写。这样告诉他,这是一个基于舌尖上的中国节目的中国美食地图网页项目 采访,我关于这个项目必须遵守的规则形成 agency。 点 md 文件,他列出了十个问题,并且说了不确定的地方写默认,我们先全部默认。好的,他写好了,我们看一下他给自己立了些什么规矩, 交流方式、数据规则,资料来源,交互方式、开发纪律验证要求。好家伙,严于律己,佩服佩服。提到项目规则,那么还有一个规则的约束层级要比项目级的还要高,它就是管理局的规则。 我们打开设置个人资料个性化这里的自定义指令,注意看它下面的注示,是为此主机上的所有任务向 codex 提供额外说明和上下文, 这就是局的 action。 点 md 文件,你可以把你的语言篇号、代码、纪律验证标准等等一些你希望他在任何项目都贯彻的规矩写到这里。切记, ai 不是 干不好活,往往是他太会干了,所以我们需要用这两个规则文件去约束他,规矩立完以后告诉他做一个中国美食地图的网页,他开始疯狂的写代码了。干完了我们看一下 这是什么玩意,虽然可以点击,也显示了一些基本的信息,但是和我们想象中的完全不是一回事。那为什么会出现这种情况呢?是因为我们的需求过于模糊了, ai 不知道我们想要实现什么样的效果,只能按照它的意思给你一个最基础的版本, 所以它这次写的代码我们不要了,点对话框里的这个撤销按钮,可以撤销这些代码,哎,它提示我们撤销时需要使用 get 代码仓库。 这里就又出现了一个非常重要的知识点, get。 get 原本是程序员用来管理代码版本的工具,它的原理大概是这样的,稍微有点复杂,但是不要害怕,我们作为新手不需要理解它的原理,只需要会四个技能,就足以让我们对项目版本的管理游刃有余了。 第一呢,是项目刚开始的时候就让 codex 出场 get 仓库,并提交一个干净的版本。第二,每完成一个阶段性的任务,都让 codex 提交,并且备注清楚这一个版本的信息。第三,让 codex 帮我们查看历史版本。第四,让 codex 回退到某一个历史版本, 有没有发现全是让 codex 帮我们完成的,我们只需要知道要这么做,然后动动嘴就可以了。现在我们让 codex 删除项目里除了 agent 点 md 文件以外刚刚生成的所有文件,并出使化这个项目的 get 提交,当前只有 agent 点 md 的 版本,版本信息为出使化它执行完了,我们看一下文件夹是不是删干净了, 确实干净了,然后查一下 get 历史版本, ok, 已经提交成功了。那么这样版本管理工具 get 我 们就搞定了, 现在又回到了最初的起点了。回顾一下我们刚刚做这个网页的过程,我们给了它一个提示词,但是它给我们一坨屎。我们刚刚也分析了原因,是因为需求没说清楚。 那这个需求要怎么才能详细一点呢?做过产品的朋友们肯定知道,在任何产品开发之前,都要经历一个非常重要的步骤,写产品需求文档。那小白又不懂了,啥是需求文档啊?举个例子,你在装修房子的时候,会给装修公司说,帮我装修一个房子要好看一点吗? 不会,你是不是最起码告诉他,我这个房子两百平?现代简约风,客厅做投影,不要吊顶,厨房开放式,预算十二个 w 两个月做完,先做水电和硬装,软装,后续再定甚至更细节的一些需求呢? 这些你就可以理解为需求文档。所以在面对 ai 的 时候,也需要把想要实现的效果尽可能详细地描述出来, 比如我这里想要实现的效果首页是什么样,用户点击后是什么效果等等,你能想到的全部写下来,剩下的交给 ai 就 好了。让他按照我们的需求整理一个规范的 p r d。 好 的,他按照我们的需求已经整理好了,我们检查一下,如果没有问题的话,我们就可以进入到开发阶段了,打开计划模式,然后让他按照需求文档开始干活,这就叫先规划再执行。 他在计划过程中会征求我们的意见,按照自己的想法选择就可以了。比如这里他会让我们选择一下页面的风格,如果有其他的想法也可以不选。在下面的输入框这里重新描述你的需求,我这里选择他给我们推荐的方案。 最后他整理了完整的开发计划,如果觉得没问题就继续实施。第一版出炉,我们用 codex 内置浏览器打开看一下 这个页面怎么这么窄,没关系,点右上角这个放大图标,页面就完整了。第一版整体的感觉还是非常接近我们选择的方案,鼠标悬浮这种板块高亮的效果也做的很有感觉。再看看省份对应的美食是怎么展示的,选陕西 哦,它提示我陕西内容代补充。再看一下四川,哎,有几个卡片在这里了,并且鼠标拖动的滚动效果也是有的,卡片也是可以正常点击并且展示美食信息。至于内容,第一版没有做,需要继续迭代。 在初步验收以后,我觉得有几个地方的样式需要改一下,但是我们给 ai 描述修改意见的时候可能说不清楚。别担心, codex 有 个功能非常强大, 点右上角的这个小加号,然后在页面上点你想要修改的部分,然后输入修改的要求。我们对这个元素的要求很简单,删掉发送这里,不想要点一下删掉,再点这个页面缩放按钮,就又重新可以看到对话的界面了。 可以看到 codex 已经在执行我们刚刚的修改意见了,这里还显示另一个删除的意见,但是它当前是一个排队的状态,如果想要让它先执行这个操作,可以点这里的引导,让它优先执行 等等。在执行过程中,我们看到了这样一段话,上下文已自动压缩,这也是 codex 比较好的一个功能,它会根据上下文占用的情况自动执行压缩命令,但是一定不要在一个聊天里无限压缩,因为到最后你会发现 codex 干活会非常的慢,非常笨, 别问我为啥知道,反正我就是知道。在执行页面修改的时候,为了不耽误时间,我们也可以新开一个对话,让他执行和当前操作不冲突的一些任务,这就是并行任务。 因为刚刚的美食卡片太少了,所以我们让他联网搜索舌尖上的中国介绍过的所有美食,按照项目需要的字段信息整理成表格。打开侧边栏,可以看到有两个任务同时在跑了好的前端页面修改的任务先跑完了,我们检查一下 刚刚的两个删除操作都做完了,但是又有几个地方需要调整一下,我们继续按刚才的方式优化一下。 另一边的数据也整理完了,让他继续把整理好的美食数据同步到页面上。数据同步好了以后,我们再看一下每个美食卡片是不是有了,但是没照片啊?别担心, codex 内置的 image 根这个 skill 是 来做图片生成用的,它调用的是强大的 image 二点零这个神通模型, 我们让它来生成对应的美食图片。经过多轮的页面修改和功能完善以后,最终 codex 给我们交付了这样一个网页。 哎呀,太高大上了,哥们也是跟上了潮流了,这不得把网页链接发给朋友嘚瑟一下,给他看看我的第一个 web coding 产品。 这又是为什么呢?因为现在这个网页目前还只是你电脑上的一个本地文件,只能在本地才能看,如果要让其他人可以看到的话,需要把本地代码都部署到云端去。 我们让 codex 帮忙搞一下,打开计划模式,看看他准备怎么弄。他依然是征求我们的意见,我们当然是 yes, yes 啦!最后他给出了计划,我们直接执行,在执行过程中,他会提示我们授权,按照提示操作点点点就可以了。好的,已经部署上线。打开 域名,这里已经跟刚刚的一串数字不一样了,看看功能是不是正常。 ok, 大 功告成了,这下再发给好兄弟, 是不是满满的成就感。视频最后总结一下,通过这期视频,你学到了什么?我们认识了 codex, 了解了它的界面和基本功能,用 remote 插件复刻了炫酷的动效,创建了一个每天推送 ai 新闻的自动化任务。 在最后从零到一搭建美食地图网站的过程中,又学到了怎么给 codex 立规矩,怎么把需求说清楚,怎么用 get 来管理项目版本,怎么最省心的方式调整页面问题,以及对执行过程进行引导和纠篇。最后用一句话把网站部署上线。 你就说,哥们,叭叭了这么久,你如果都看到这儿了,给个三连不过分吧!我是浩哥,我们下期见!

最近还是会有很多人来问我, cloud code 和 codex 到底哪一个更好用?这个问题其实挺有意思,因为我身边很多朋友,不管是做业务的还是做开发的,他们自己用下来第一反应基本上都会觉得 cloud code 更稳一点,或者说更全面一点。 但你再看最近网上那些声音,又会发现,花 codex 的人啊越来越多了,甚至有人会说,现在 codex 已经好用到过超过 cold 扣的了。 所以作为一直在使用 cloud max 和 codex pro 会员的用户啊,我就想结合自己这一年左右的使用感受,聊一下我眼里的 codecode 和 codex 到底有什么区别。首先,我先抛出我的结论,这两个工具并没有说谁完全碾压谁,那么更像是两种性格完全不同的助手。 cosco 的更像是一个非常全能的管家,你把一件事情交给他,他会考虑的非常周全,很多你说出来的东西,他会做很多你没考虑到的, 但他认为你可能需要的东西,他也会顺手帮你补上。所以你在用 cc 的时候,经常会有一种感觉,他不只是在帮你执行,他还在帮你兜底。你想到了第一层,他会帮你想到第二层甚至第三层, 尤其是那种你自己都还没想明白的任务。比如说有一些需求,一开始是模糊的,做成什么样子,过程到底怎么实现,你其实都还没有什么概念。这时候你需要的是会主动追问,自己判断,再反过来给你提供更多信息的助手,这样就能把一个杂乱的需求一点点捋顺,变成一个思路清晰的出行。 但 codex 啊,就不太一样, codex 有时候确实会理解错你的意思,尤其是当你的方向给的不够明确的时候,他很容易跑偏。但反过来说,只要你给的方向准了, codex 深度钓鱼能力啊,是非常强的,他在一些垂直任务上的完成度啊,会给你很明显的惊喜。所以 codex 更擅长的是那种已经明确需求和 实现方式的任务,最典型的就是产品把 p、 r d 写的明明白白,你照着把它变成能跑代码就行。所以我觉得如果把这两个工具类比成团队里的两类人,我觉得 coldcode 更像是一个可以立的别人的角色,他能够看全局,拆任务,能够补逻辑,也能把不同模块之间的关系啊串联起来。 那 codex 更像是一个研究型的同事,你让他去统筹全局带方向,他可能不是最强的,但你告诉他往这一个点,往这一个方向去研究,他就能够做的非常深。 还有一点非常真实的感受,在我的公司里面,做业务的、做管理的,大部分人都会选择 coldcode, 但是做开发、做算法、搞科研的,基本上都是 codex。 然后我再给大家举两个我自己很典型的例子,第一个就是我之前做一个偏垂直行业的方案设计,这个东西很难用一句 prompt 讲清楚,因为里面有大量的材料,包括这 这个行业过去沉淀下来的一些方法论,还有我自己多年积累的一些经验,还有很多散落在不同文件夹,不同文件里面的资料。我当时就想把这些东西整理出来,打包成一个 skill, 然后我分别让 colorcode 和 codex 啊,用他们各自的 skill created 去做这件事情,最后出来的结果让我非常意外,两个工具的差距啊,非常明显, 因为这类任务本质上不是一个执行题,而是一个探索题,你自己脑子里面可能只有一个大概的小蓝图,知道最终想要什么,但结果怎么排,材料怎么归类,哪些东西啊该放进去,其实你自己也没有完全想清楚, 那这个时候 cc 的优势啊就出来了,他会帮你拉结构,帮你补逻辑,帮你去判断哪些内容应该放进来,哪些应该单独的处理,甚至有一些你自己还没想到的地方,他就会帮你先搭一个版本,他不一定每一次都是完美的,但他能够带着你往前走。另一个就是,我平时都会用 remotion 去做一些动画视频 这类任务啊,其实不只是写代码,因为代码写完之后,到最后画面长什么样,动画有没有跑起来,视觉是不是符合预期,这才是关键。那克拉克扣的做这类事情的时候,他经常是生成完以后就默认这个结果是对的,那实际上有时候经常会出现错位或者重叠的情况,我需要手动让他较量一遍才能修正。 但扣带词给我的感官就很不一样了。他做完以后啊,会有一个很明显的动作,就是他会回头看结果,比如说他会截图去验证页面是不是涨对了,动画是不是正常,最后的产物跟一开始的目标是不是一致。 这个动作其实非常关键,因为它背后代表的是两种完全不同的 ag 的哲学。 cold cold 先生在说,我生成出来的东西啊,就是我认为正确的东西。 codex 先生在说,我先做出来,但是我还得回头验证一下,这到底是不是用户想要的。那说到这,还有一个挺有意思的变化。看过往期视频的粉丝啊,肯定知道我是无脑 吹 cc 的,因为确实在过去很长的一段时间里面, ai cody agent 的这个领域, coco 的存在确实是太强了,不管是体验还是完成复杂工程任务的能力,他都是明显的领钱。 最近几个月啊,我对 codex 看法变了,他真的在开始变好用,而且不是那种参数表上看起来变强了,是你实际在用时啊,会很明显的感觉到他的变认真了,他会更在意最后产物跟原始目标是否一致。 那说了这么多,最后这两个工具到底更适合谁来用呢?我这边就用程序员来举例,给大家一个比较实际的建议。 如果你是比较资深程序员,或者说已经到了架构师这个阶段,我会更推荐你用 colorcode。 因为到了这个阶段,你关心的往往不是某一段代码能不能写出来,而是系统之间的价格关系,模块和模块之间怎么串,边界怎么划分。 codecode 在这方面很适合你,因为他会帮你把点和点之间的关系串联起来, 他不只是盯着一个函数看,而是更愿意从整个项目、整个系统的角度去想问题。这种全局的能力,对资深开发或者价格式来说是非常重要的。但如果你现在还是刚毕业的或者初级开发,我反而会更推荐你多使用 codex, 因为 codex 啊,在具体实现代码规范,结果胶原这些地方给我的感觉非常扎实。 他会逼着你关注一些很工程化的东西,这些对刚入行的开发来说特别重要,你一开始就会被这种工具带着走,会更容易养成好的工程习惯。所以现在这个 aia 这个阶段,我们不能只问谁更强,更重要的问题是,你是什么类型的用户,你手上的任务是什么?因为每个工具背后都是一套不同的产品哲学, 你只有真的上手用过,才会知道他们更适合什么,也才会知道在自己的工作流里面,哪个工具应该放在什么位置。 ok, 那本期就是关于这两个工具啊,我自己在使用方面的心得,希望能得到你的一键三连加关注,我是布鲁,你的 ai 好搭子,我们下期视频再见!

你还在纠结做什么?选择题,别人一个 codex 家约会就干出一条三万六点赞的爆款,收藏数接近转发,看着人又想自己存,又忍不住发出去,你好奇吗?我顺手扒了一会,发现他干的事特别简单, 把两个原本八竿子打不着的身份硬焊成一个,我管他叫身份分拣机 哪两个?把硬核的 ai 技术 cloud codas agent 装进恋爱约会蓄势外壳,一个是理性的前沿科技,一个是感性的浪漫约会。理性配感性,天生就有话题, 画面感一下就出来了。一对小年轻惬意的做咖啡店男生,先看电脑,打开 code, 几句提示词敲下去,回车,一段唯美视频当场就活在你眼前, 谁挡得住这魅力?理工男们,赶紧学一下最新的约会方式, 然后是杀招!最后那句,你觉得我无聊还是浪漫?这就是高光买点给互动和数据买的雷。 表面问你喜不喜欢,其实是逼你当众表态。这种人,这种生活,是不是我想要,你会情不自禁去点去评,他要的就是你亲手喊出来。所以,做自媒体的朋友,你不是不会做,是命题角度选错了。 理工男,你也不是不懂浪漫,是你还没发现科技本身就是一种浪漫。那么你是打算去改你的选择题,还是改你的约会方式呢?

今天我们来讲讲大名鼎鼎的 codex, 相信大家都已经听说过这个软件了,这是 open nai 的 核心产品,对标 osarpic 的 cloud code。 codex 能做的事情非常多,它不仅能够帮你编辑代码、排查 bug、 执行测试,还能管理 gate、 操作浏览器,甚至能直接控制电脑完成各种任务,非常强大。不过功能越多,越容易让人抓不住重点,所以这期视频我会带大家系统性地过一遍。 codex 最核心的功能,帮大家建立起一套完整的使用思路。 整个视频一共分为三个部分,第一部分是基础篇,主要带大家快速上手 codex, 并讲解一些核心配置和使用过程中容易踩坑的地方。 第二部分是进阶篇,重点介绍版本控制、绘画管理,以及如何更高效的组织和推进开发任务。第三部分是扩展篇,我们会看看如何通过 plugin、 skill、 automation 和 mobile 等功能进一步扩展 codex 的 能力边界。 所有的功能点和对应的时间戳我都打到目录上了,大家可以按需跳转。好话不多说,我们现在开始。 首先我们要做的是把 codex 安装到电脑上面,我们可以打开这个页面,点击这里面的下载按钮,就可以下载 codex 了。下载好了之后,我们来打开它。安装过程呢,跟其他的普通软件一样,比如我用的是 micros, 那 直接把 codex 拖入到 applications 文件夹里面就可以完成安装了。 安装好了之后,我们来打开 codex。 打开 codex 之后呢,它首先会提示我们登录,它一共给了我们两个选项。 第一个呢是使用叉 gbt 账号登录,这需要你订阅叉 gbt 的 套餐。叉 gbt 呢,它提供了多种套餐,其中最常用的是我屏幕上面显示的这几个,主要是包括免费版 go 套餐、 plus 套餐和 pro 套餐。 你看屏幕上面的这几个套餐,从左到右价格越来越高,当然整体能用的 codax 额度也是越来越大的。 从目前来看,免费版和购套餐的 codax 额度应该差不多,但到了 plus 套餐,额度就会有着明显的上升, pro 套餐自然就更多了。 值得一提的是,即使你用的是免费版,系统也会给你一定的 codex 额度,只不过这个额度少的可怜,只能勉强够你施个水。所以如果你想真正上手体验一下它的能力,我建议你先订阅 plus 这个 plan, 它是二十美元一个月,可用量呢比较适中。 除了订阅套餐之外, openni 还提供了另外一个选项来使用 codex, 那 就是直接接入 api, 对 应的就是这里的 signing another way, 点击之后,它会提示你输入 openian 的 api key。 一 般来说,用 api 没有订阅套餐划算,而且呢,获取这个 api key 的 门槛也有点高,一般需要一张海外的信用卡,所以我建议大家还是订阅套餐来使用 codex。 具体的登录过程呢,我这里就不显示了,大家可以在这里选择适合自己的方式登录。登录好了之后,大家首先看到的就会是这样的一个界面, codex 首先会询问我们是干什么工作的,这里大家就按照实际情况来选就可以了。然后 codex 会提示把 cloud code 和 cloud co work 相关的配置都导到 codex 这里,我们先跳过,然后 codex 提示我们要不要试用 codex 手机版,我们点击这个 set up later, 待会儿呢,我会给大家演示这个功能,所以现在先不着急,现在呢,我们就算是正式的来到了 codex 操作界面,可以开始使用它了,我们来随便跟它打个招呼,看看能否正常使用, 可以看出 codex 已经可以正常使用了。下面我带大家做一个代办软件,并且在做这个代办软件的过程中为大家讲解 codex 的 各个功能点。首先我们要新建一个目录来存放我们的软件代码,让我们打开访答,在这里创建一个新的文件夹,就叫做马克笔记吧。 然后回到 codex 这里,点击 work in the project, 再点击 use an existing folder, 在弹出的对话框里面选择我们刚刚创建好的文件夹,然后再点击 open, 然后呢,你就会发现 codex 把项目目录改成马克笔记了, 这就代表 codex 后面会把代码放到这个文件夹里面。此时我们准备工作就已经是做完了,可以开始提需求了,比如说我们的需求就是使用 html 写一个笔记软件,软件界面分为左右两部分,左边是笔记列表,右边是笔记的内容, 最后我们提醒他注意做好测试,然后回车提交,这个时候呢, codex 就 会开始工作了,可以看出他在疯狂的给我们写代码,当然实际使用是没这么快的,因为为了节省大家时间,这里我做了加速,后面的问答流程呢,也都做了不同程度的加速处理,这个呢,大家知道就好了。 好, codex 暂停了,他提出他想要构建一个本地服务器来验证 html 笔记的效果。这里呢有三个选项,第一个选项是 yes, 这个呢很好理解,其实就是把这个本地服务器启动开就可以了,不过以后如果 codex 提出类似的请求,我们还得再授权一次。 第二个选项呢,是代表我们不仅同意,而且对于这种启动本地服务器的代码,以后呢也就直接执行就好了,不需要再经过我们授权了。第三个选项可以理解为不同意,它其实不是一个按钮,而是一个输入框, 我们点一下就能看出来了。在这里我们可以告诉 codex 自己希望的处理方式,比如只让它检查代码,不要启动本地服务器之类的。当然,如果你不同意,而且你懒得告诉 codex 原因的话,也可以直接点击这里面的 skip 按钮啊,这算是 codex 做了弱化的第四选项了。 好,所有的可选项我们都说完了,在这个地方我们就选择第一项 yes 就 好了。然后呢, codex 就 询问我们能不能访问这个新创建的本地服务器,这个地方呢,我们也同意, 呃,现在 codex 已经彻底完成它的工作了,可以看出这里面最重要的文件呢,就是这个 index html, 我 们可以点击来预览它的效果。 这个呢就是 codex 写的笔记软件了,看起来中规中矩,各种基本功能呢,在这里面都能找到。当然有些人可能觉得这个预览区太小了,想要放大一点,这当然是可以做到的,让我们来点击这个按钮, 这样左边的区域就被收起来了,可预览的空间就更大了,不过下面的这块区域看着也是有点碍事,能不能隐藏它呢?其实也是可以的,我们可以点击这里面的三个点, 然后选择其中的 hide composer 就 好了,你看这样呢就好多了。那假如说这个时候呢,你看着界面里面的这两条笔记,觉得非常碍事,你想把它们去掉, 呃,这个呢,其实也是很简单的,我们就继续追问就好了。既然要追问,我们就必须要把左侧栏再次显示出来,这个呢其实很简单,我们再点一下这个按钮,左侧栏就显示出来了。 然后呢,我们就可以在输入框里面输入我们的问题,把左上角的两条笔记去掉,这个呢肯定是可以的。 呃,不过我这里想给大家演示另外一个方法,另外一个更加准确,更加方便的方法,我们可以点击这个图标,它叫做 annotation, 然后我们就可以直接选中两条笔记这个区域,选中后,输入我们对这个区域的修改意见,很简单,我们的意见就是两个字,去掉, 然后我们提交请求。好,可以看出请求已经成功提交上去了,可以看到他一共是发了两块内容,一个呢是对应的截图,另外一个呢就是我们具体的要求了。 接到了这个请求之后, codex 就 开始工作了,他应该呢就会把这块区域给去掉,让我们稍微等待一下。 好, codex 已经完成了,我们再次打开这个阅览区,看一下效果, 可以看出之前的这块区域呢,确实是没有了, codex 已经帮我们解决问题了,看起来 entity 这个功能还是非常方便的, 那这个时候我们可以再随便点点这个笔记软件,看看有没有其他我们需要修复的问题。这里好像确实有个 bug, 我 点击这个加号按钮的时候,下面呢是要增加一个新的笔记的,但实际上点了之后并没有任何的 bug 呀。让我们跟 codex 说一下这个问题, 我们需要告诉 codex, 点击添加按钮之后,笔记列表区域没有任何的反应。呃,请排查下原因,我确定之后再进行修改 好。 codex 已经排查完了,按照我们的要求,他没有直接去改代码,而是先给出了诊断结果。他猜测呢,这个问题大概率是因为当前页面的 local storage, 也就是本地存储被禁用了。 没错,就是这个原因。说白了,就是 codex 的 右侧预览区有一些安全限制,导致某些功能无法正常使用。如果我们到独立的浏览器里面用一用,问题立马就消失了,不信我们试一试。 你看这个时候再点击添加按钮是不是就完全正常了?既然用户是在真实的浏览器里用我们的软件,而不是在 codex 的 预览区里用,那这根本就不算是个问题,自然也不需要修。 我不知道这算是 codex 的 一个 bug 还是一个 feature, 我 相信 openai 是 把它当成 feature 来做的,不过实际用下来确实有点像 bug。 如果你做的也是外部应用,那一定要额外留意这一点,别被预览区给骗了。既然弄清楚了原因,为了避免再受限制,我们后续就在独立的浏览器页面里面进行测试了。 到这里,这个最基本的笔记软件就算是成功跑通了。现在我想回头聊聊刚才遇到的一个细节,就是 codex 提出的那个请求。 呃,有些同学可能会想,如果我把任务交给 codex 之后去忙别的了,没注意到他在等我授权,那 codex 岂不会一直卡在那里等我回来一看啥也没干,白白浪费了大量时间。 那这有没有办法让他自己做决定,别总是来问我呢,毕竟谁也不想一直盯着他干活,那也太累了吧。没错,一直盯着看呢,确实是非常的麻烦。其实 codex 早就替我们想到了解决办法,就在输入框的下面,大家看这里面呢,一共是有三个全线选项。 第一种就是我们刚才用的 default permissions, 在 这种模式下,如果 codex 需要修改项目目录之外的文件,或者是需要执行一些带有安全风险的命令,它就会老老实实地弹出提醒,只有当你点头同意了,它才会继续接着往下干。 这种模式的优点呢是绝对安全,一切尽在掌握,但缺点也非常明显,就是根本离不开人,你得随时给他授权。 第二种呢是 auto review, 也就是自动审查。这个模式呢很聪明,它引入了一个专门负责安全审查的 agent, 当 codex 准备执行操作的时候,这个 agent 会首先替你把关,安全的直接放行,危险的直接拒绝,只有在极少数连 agent 也拿不定主意的情况下,才会弹窗让你来做决定。 第三种呢是 full access, 顾名思义,这个呢就是放飞自我模式,全部自动同意, codex 想干嘛就干嘛,完全不需要你插手。 这个模式确实是最省心的,但也伴随着风险,万一它误删了什么重要数据,你是拦也拦不住的。虽然 gpt 模型总体上还是非常靠谱的,基本上不太会乱来,但是作为一个负责任的 up 主,我还是要提醒大家,这个模式呢,没有任何的安全,交易开启前一定要三思啊。 所以综合看下来,在这三个模式里面, auto review 是 在效率和安全之间平衡的最好的。为了避免后面频繁弹窗,要我们点同意,接下来的演示呢,我们就统一的切换到 auto review 模式。 既然聊到了这里的权限配置,我们不妨顺便看一下输入框旁边还有哪一些配置。首先大家留意这里面显示的五点五 medium, 这代表我们当前使用的是 gbt 五点五模型,思考深度呢为 medium, 也就是中等。 我们点开它可以看到思考深度呢是可以自由调节的,分为 low、 medium high 和 extra high 四个级别。思考深度越高, codex 花费的时间也就越长,消耗的 token 呢也就越多,但通常给出来的代码质量也会更好一些。 除了调整思考深度,我们还可以在这里面切换模型下来。列表里面除了 gpt 五点五,还有 gpt 五点四等等一系列的模型,大家可以根据具体的任务难度来灵活选择。 最后啊,这里面还能设置模型的输出速度,目前是 standard, 也就是标准的速度。旁边呢还有一个 fast 选项,开启 fast 模式之后生成的速度呢会提升到原来的一点五倍,不过代价呢是 token 的 消耗量也会相应的增加,具体增加多少取决于你用的模型, 比如说在 gbt 五点五这个模型下开启 fast 模式的话, toc 的 消耗量就直接是标准模式的两倍了啊。如果你财大气粗, toc 管用,那你完全可以开启这个快速模式,这样 codex 干活就更快了。 输入框的配置我们就先研究到这里,现在我们的第一版笔记软件已经跑通了,实现了最基本的功能,不过为了防止后面新加功能的时候把代码搞乱,我们最好先用 get 把当前的版本保存一下,这样的话就算是后面出了什么叉子,也能够随时回滚到这个可用版本。心里有个底, 在 codex 里面调用终端非常的方便,我们不需要去点什么菜单,直接按下快捷键, command 加 j, 大家看右侧的终端面板就直接弹出来了。在这里面我们依次输入几条常规的 get 命令, 首先是要执行 get in it, 点把当前的项目目录出示,化为一个 get 仓库。然后呢我们要执行的是 get id, 点把相关的文件呢都添加到暂存区里面。最后呢再执行 get commit 提交我们的第一次修改 好这三步敲完之后,我们的代码就有了一个安全的备份版本,接下来我们就可以放心大胆地继续迭代我们的产品了。 终端用完之后,为了不挡着视线,我们只需要再次按下同样的快捷键, command 加 j 就 能够把它直接关掉。你看用快捷键来开关终端,双手完全不需要离开键盘,整个过程呢非常的丝滑,也是非常的方便。 那现在我们用 codex 做了一个基本可用的笔记软件,而且还用 get 提交了这个可用版本,下面呢,我们就来继续迭代这个笔记软件,让它变得更强大,更美观。 假设这个时候你看了看这个笔记软件,觉得它的色彩设计不是很好,这里面有很多的绿色元素,你不太喜欢绿色,你想试试蓝色怎么样?那这个时候该怎么处理呢?很简单,你就直接在这里面追问就好了,比如我们可以这么提要求, 不过我们先不发送这个请求了吧。啊?为什么呢?你仔细看看啊,我们上一个消息里面还让 codex 排查问题来着, 但说实话,这其实并不是一个问题,只是 codex 的 浏览区有些限制而已。如果我们继续追问的话,这个排查过程不仅会占用模型的上下文,而且可能还会对 codex 后续执行产生一些影响, 他没准会继续尝试修复这个问题,把原来没有问题的页面修出问题来。虽然这种情况发生的概率应该也不会很大,但是能规避的话就尽量规避吧,毕竟这个消息其实一点用也没有。 所以我们该怎么办呢?有一个办法,那就是直接修改上一个消息就可以了,你看这里面有一个编辑按钮,我们点一下就可以直接修改这个消息了,我们来试试 提交。你看原来的请求被替换成了我们的这个,这样的话,原来排查问题的那个消息呢,就消失了,既然消失了,它就不会再占用模型的上下文了,也不会对 codex 后续执行产生任何影响, 所以很多情况下,这个功能还是很实用的。不过要注意的是, codex 只支持编辑最后一条消息,至于更靠前的那消息,它实际上是不支持我们编辑的。 前面的那些消息呢,都是没有编辑按钮的,如果你要编辑更靠近的消息,可以考虑使用 fork 功能来间接实现这个功能。我们后面会讲到,暂时你不必过于关心好。 codex 已经完成任务了,我们来看看效果。 呃,还可以吧。下面呢,我们把这一部分的改动也加入到 get 里面。之前我们是用命令行来操作 get, 这种操作方式准确通用,不过其实 codex 也内置了一些 get 操作的功能来供我们使用。比如我们可以先点击这个图标, 这里面呢就有一个叫做 environments 的 区域,它呢就跟 get 的 使用密切相关。我们可以点击这里面的 changes 按钮,然后再在这个选择框里面选择 on stage 的 选项。这里显示的就是所有还没有提交到暂存区的代码了, 这基本上也就是 codex 刚才所做的改动。如果你觉得哪一行有问题,可以点击旁边的加号,输入你的要求。输入完要求之后,你可以点击这里面的 comment 按钮,让 codex 做出相应的改动。不过这里我们就不做任何修改了, codex 的 任务已经完成的很好了,所以我们取消这个注示, 直接使用 git commit 提交这次改动。那具体该怎么做呢?很简单,直接点击这里面的 commit 按钮,输入 commit 的 message 就 可以了。我们的 commit message 就是 将整体色调改为蓝色,然后呢,再点击 continue, 此时 codex 就 会提交当前所有没有提交的改动了。 好,执行成功了,我们来验证下。先按一下 command 加 j 来到终端,然后再执行 git log, 查询 git 的 commit 记录。 你看,我们的 commit 确实是生效了,确认好了之后,我们按 q 退出 get log, 然后呢,再按 command 加 j 来隐藏终端,到这里,这个需求就算是彻底完成了。那假设这个时候你感觉蓝色这个主题也不怎么好看了,越看越不顺眼,要不再换一个吧。 没问题,我们直接提交需求,将整体色调改为紫色。改完之后呢,再做一次 get commit。 对, 这次我们不自己操作 get 了,有点麻烦,直接让 codex 操作得了。提交之后, codex 就 开始干活了,我们稍微等待一下, 改好了,我们来看看最后的效果。不错,确实改成紫色了,不过怎么说呢,啊,你觉得还是不顺眼啊,你在想,算了,我要不还是改成一开始的那个绿色吧。那这当然是可以的, 照例啊,你可以直接在输入框里面输入,你的要求就是改回来的紫色。这个呢,肯定是行的,只不过这样的话,模型还得再跑一遍,有点浪费 token, 所以 我们就不用这个方法了。 其实我们原来就是绿色,所以用 get 把代码回滚到绿色的那个版本就可以了。只不过这种做法其实也是有点缺陷的, 代码确实是回滚了,但绘画内容还是停留在紫色这里。如果我们希望在当前这个绘画继续问的话, codex 可能会以为目前所用的色调是紫色,从而对后续的任务执行效果产生负面影响。 那我们能不能把绘画和代码同时回滚呢?我们就想回滚到改蓝色之前的那个版本,也就是这个版本,如果有回滚功能的话,那应该是在这个消息旁边有一些相对应的标识吧,我们找找。 哎,还真的有一个图标有点像,不过它不叫回滚,它叫做 fork。 fork 的 意思就是基于当前的这个绘画,再复制一个新的出来,这个新绘画就只到目前所选的这个消息为止,后面的消息全都不保留, 这个呢就非常符合我们的要求了,我们其实就希望绘画到当前的这个消息为止,那既然绘画变了,代码是不是也会自动回滚呢?没准也是可以的,我们来试试。 我们首先点击这个 fork 图标,这里弹出两个选项供我们选择,一个是 fork into local, 另外一个呢是 fork into new work tree。 这两个选项的最大区别在于新绘画的代码存放地址不同。 第一个选项会继续使用当前目录作为新绘画代码存放地址,第二个选项会创建一个新的目录来存放心绘画的代码。你可能现在听的还是有点懵啊,没关系,我来演示一下你就知道了。在演示之前,我们先把左侧栏打开,这样你就会看得更清楚一些。 好,左侧栏打开了,我们来重新点击一下这个 fork 图标,然后选择第一项 fork into local。 可以看出 codex 确实给我们创建了一个新的绘画,并且还在这里标识好了,这个绘画呢,就是从别的绘画那里复制出来的。下面我们来看看代码是否也会滚了, 这个很简单,我们不必看代码,我们直接看最终的效果就行了。让我们来看看页面的颜色有没有改变,可以看出页面的颜色仍然是紫色,所以呢,代码根本就没有回滚。没错,这呢就是 fork into local 这个选项的特点,它只会处理绘画内容,根本就不会对代码做任何修改。 不过还好,我们使用了 git, 我 们可以用 git 来回滚代码。我们先按快捷键 command j, 打开终端,然后执行命令 git log 确定我们想把代码回滚到哪个 commit 上,应该就是这个了。然后呢,我们复制这个 commit 的 哈希值, 最后执行这个命令。这样呢,就可以把代码回滚到绘画对应的那个版本了。让我们回到浏览器这里刷新一下页面, 没错,确实是一开始的绿色版本了,当然绿的也不是很明显啊,只有那么几个模块是绿的。我对这个色调的表述呢,稍微有点问题,但无论怎么样,肯定是回滚成功了,相信大家都能看得出来,这个呢就是 fork into local 了,我们配合着 git, 才能把绘画和代码都回滚到之前的那个状态。 那刚才还有一个选项叫做 fork into new work tree, 那 个选项是用来干什么的呢?我们不妨来试试。让我们回到之前的绘画里, 点击这个 fork 图标,然后再选择 fork into new work tree。 注意看, codex 依然给我们创建了一个新的绘画,而且跟 fork into local 很 像。这个新的绘画呢,也标识出来了,它就是从别的绘画里面复制过来的。 一切看起来似乎都跟那个 fork into local 差不多啊,那到底什么发生变化了呢?答案就是我们当前的这个绘画所对应的项目目录发生了变化,不信我们来打开终端,输入 pwd, 这个命令就是用来显示当前位置的,可以看出我们的当前位置呢,就是这个了,我一开始 fork 出来的那个绘画可不是在这个目录里面操作的,不信的话,我们回到一开始 fork 出来的那个绘画里,同样打开终端, 运行下 pwd, 你 看它俩的项目目录地址是不同的,我把这两个地址打在屏幕上,这样大家就可以看得更清楚一些。 这个呢,就是 fork into new worktree 的 一个特性,它会给 fork 出来的新绘画创建一个对应的新目录,这样新老绘画所处理的代码不是一份,彼此之间互不影响,非常适合在两个绘画分别处理两个不同的功能点,最后做完了再合并到一起就好了。那为什么叫做 worktree 呢? 是因为它是使用 gitworktree 来实现的,这个呢,是 git 的 一个特性。这个要展开讲的话呢,又得讲好几分钟。我们本期是来讲 codex 的, 不是来讲 git 的, 所以呢, gitworktree 在 此就跳过了,感兴趣的同学可以自己查下。 另外值得一提的是, fork into new worktree 同样不会回滚代码,它只是把当前项目目录里面的所有代码复制到一个新的目录里,仅此而已。 好,这个就是 fork 的 两种形式了。总结一下,这两个选项都会复制绘画到所选消息为止,也都不会帮你回滚代码, 它们唯一的区别仅仅是代码的位置, local 呢,是继续沿用原目录,而 new work tree 呢,则是开辟了一个全新的隔离目录。主要呢,就是这个区别了。所以呢,无论是哪一种 fork 形式,都不会更改代码。实际上 codex 在 界面里面也有显示, 我们可以回到一开始的那个绘画。然后呢,再点击一下这里面的 fork 图标。注意到这段话了吗? 其实它想表达的意思就是 fork 只负责对话,不回归代码。对,它说的有点绕,但其实就是这个意思。 好, fork 功能我们终于讲完了,我们目前只需要第一个 fork into local 的 这个绘画,另外一个 fork into work tree 我 们暂时不需要。那我们能把这个绘画删掉吗?能, 不过准确来说啊,我们可以把这个绘画规章,规章和删除稍微还是有些区别的,你可以把规章理解为暂时隐藏起来了,而删除呢,那就是删完就没了。我们来试一下, 我们直接点击绘画旁边的这个图标,然后再点击 confirm, 这个绘画就被规范了。你看这个绘画是不是没了。但跟删除不同的是,我们还可以找回这个绘画。 我们先按 command 加逗号,打开设置面板,再点击里面的 archives chats, 在 这里我们就可以看到所有被规章的绘画了。我们可以解除对应绘画的规章状态,也可以彻底删除对应的绘画。所以你看,删除和规章还是稍稍有些区别的。 那规章这个功能我们就讲到这里,从之前的操作过程中我们可以看出, get 真的 还是挺重要的。那既然这么重要,我们能不能让 codex 每次写完代码的时候都能自动提交一次 get commit 呢,这样的话就不用麻烦我们每次都操作一遍了。 这当然是可以的,其中一个方法就是我们可以直接在输入框里面告诉 codex, 每次完成代码修改之后,都需要提交一次 get commit, 然后提交这个请求就行了。这样在后续的操作里面, codex 肯定就会按照我们所说的,每写完一次代码都提交一次 get commit。 不 过这个方法有个很大的缺陷,那就是它只会在当前的绘画中生效,如果我们创建出一个新绘画的话,那 codex 就 会彻底忘掉这个事情, 所以我们需要一个能够跨绘画的解决方案,即使是在一个新绘画里, codex 也能帮我们做 get commit 这个事情,这能做到吗?当然是可以的,这个呢就是 agent 点 m d 这个文件发挥作用的地方了。 agent 点 m d 简单来说呢,就是一个放在项目根目录里面的配置文件,每当 codex 开始一个新绘画的时候,它都会自动读取这个文件,把里面内容当成对自己的指令来执行, 所以我们只需要在这个文件里面写上这个 git commit 的 要求,那无论我们开多少个新会话, codex 都会记住这件事情的。我们先把原来的这个请求删掉,我们不需要它了,然后我们点击这里使用 vs code 打开这个项目目录, 在根目录下创建一个新的文件,就叫做 agent 后台,然后在这个文件里面写,每次完成代码修改后,都需要提交一次 git commit, 这样 agent dmd 就 创建好了,让我们把 vs code 关掉,现在让我们来验证一下 agent dmd 是 否真的会生效。我们首先创建一个新的绘画, 然后提交需求,往左下角增加一个主题切换选项,支持用户在浅色模式和深色模式之间切换。回车提交,让 codex 开始工作。 好, codex 已经完成了,我们来看看效果。 你看,左下角确实是出现了一个主题切换按钮,我们点击对应的主题,就可以在浅色和深色两种模式之间切换,看起来非常完美。那我们现在最关心的是, codex 有 没有帮我们做 get commit 操作呢?我们按一下 command 加 g, 打开终端执行 get log 来看看。 你看,这里面确实是多了一个新的 commit message 呢,就是 codex 自己写的,这说明 agent 点 m d 确实生效了。即使是在一个全新的绘画里面, codex 也遵从了我们的要求,在完成了代码修改之后,自动提交了一次 git commit。 这个呢就是 agent d m d 的 基本用法了,当然他能做的事情远不止这一件,比如你可以在里面规定代码风格、命名规范、技术占要求,甚至是你的项目背景介绍等等。 codex 每次启动新会话的时候都会去读取这些文件,这样他对你的项目就会有非常好的理解,给出的结果呢也会更加准确。 可以说, agents dmd 写得越好, codex 就 会用起来越顺手。不过需要注意的是, codex 只会提交当前需求所对应的代码改动。我们一开始创建的 agents dmd 不 属于当前需求的范畴,所以呢,刚才 codex 并没有把它提交为一个 git commit, 我 们点击这个 changes, 再选择 on stage, 就 可以发现 agents d m d 的 内容呢?还没有提交上去。没事儿,我们这就提交。我们先来点一下这个 commit 按钮,然后在里面输入对应的 commit message, 再点击 continue, 这样这个改动就会被提交到 get 上面了。好,一切顺利,让我们新开一个绘画,继续迭代这个笔记软件。 现在这个软件本质上就是一个 html 文件,只能在浏览器里打开,不够方便。我们想把它改造成一个真正的桌面客户端,让用户可以直接双击图标打开,就像打开 vs code codex 一 样。 那要做桌面客户端的话, electron 是 非常主流的一个选择,我们可以顺便呢也引入 react 和 type script, 把项目结构整理一下,方便后续继续迭代。那我们就直接把需求发给 codex, 把这个网页应用改成桌面客户端,进入站使用 electron 加上 react, 再加上 type script。 注意做好测试,确保所有的核心功能运转正常 啊。不过要注意这可是一个大工程,所以呢,我们最好先让 codex 做一个规划,我们确认规划没有问题之后,再让它动工。为了实现这一点,我们可以点击这里面的加号,然后选择 plan mode, 这样 codex 就 进入了计划模式,从这个图标也可以看出这一点。 在这个模式下, codex 会先做计划,再写代码,让我们来提交试试。可以看出 codex 开始工作了,让我们稍微等待一会。 好,他现在要问我们几个问题,我们来做一下选择。首先是数据要放在哪里,我们就放到文件里面吧, 然后交付到可开发运行的程度就可以了。这之后呢, codex 就 会继续开始干活了。好,可以看出 codex 开始给我们写这个计划了, 我们再稍微等待一会,它还在这个转写的过程中。 好,写完了,我们来看一下,这个计划本身还是比较完善的。呃,包括各种测试方案呐,架构设计啊,都是写的比较详细的。然后 codex 问我们是不是要按照这个计划去实现代码。 呃,他一共是给了我们两个选项,第一个选项呢就是直接同意啊,开始实现这个计划就好了。第二个选项呢是如果你对这个计划不满意的话,你可以提出你的要求,在这个文本框里面告诉 codex 应该如何做修改,然后 codex 会根据这个修改呢,再出一份新的计划。 呃,这里面呢,我们就不对计划再做一些其他修改了,我们就直接同意好了,让 codex 就 按照这个计划给我们来写代码。 好,现在 codex 开始干活了,我们需要稍微等待一下,在等待的过程中呢,我们可以跟 codex 随便去聊点东西,我们可以在输入框 side 打开 side chat 啊,在这里面呢,我们就可以随便问 codex 点别的问题,这些问题呢不会去影响左侧 codex 的 任务执行。比如说我们可以问一下,你觉得这个笔记软件还需要什么基本功能呢?提交 好 codex 呢,给了我们一些可行的方案。你看在 side chat 的 过程中, codex 左侧的任务执行一点也没有被干扰到。对,这个呢就是 side chat 的 一个非常重要的特点了,它就是允许用户在 codex 执行任务的过程中问一些比较轻量级的问题, codex 在 回答这些轻量级问题的过程中不会影响到左侧主任务的执行。那这个就是 sign chat 这个功能的特性了。这个呢,我们就先讲到这里,这个架构改造的工作量还是挺大的, codex 依然没有完成,让我们再耐心等待一会儿。 好,看起来 codex 已经完成任务了,它提示我们使用 npm runtime 这个命令就可以启动这个 electron 应用啊,让我们来试一下。首先按 command 加 j 打开终端,然后执行命令 npm runtime 回车, 这样的话这个 electron 应用就启动开了,不过看起来好像是有点问题,基本上是一个白屏的状态。呃,我们打开控制台看一下有没有什么报错 啊,确实有报错,这个呢,我们需要让 codex 帮我们来修一下啊,让我们来回到 codex 这里, 先把这个进程关掉,然后呢再把终端关掉,然后我们提出我们的诉求,启动后白屏控制台报错了。看来你之前的测试不够彻底啊,请你修复并确保在修复之后测试好再交付给我。 codex 说,我说的对,哼。呃,让我们等 codex 把这个错误修复之后再试一次。 呃,看起来 codex 已经修复好了,我们来看一下它修复后的效果是怎么样的。呃,同样,我们打开终端,然后执行这个命令 啊,这次呢,看起来没问题了,添加笔记呢也是可以的,我们呢也可以在这里面随便输入的标题内容都可以啊,主题切换也是没有问题的。 那看起来已经很完美了,各项功能都运转正常。让我们再回到 codex 这边。 呃,我们先按一下 ctrl 加 c, 关掉这个进程,然后呢,再把终端收起。好,那改成了 electron 架构,我们就继续来提新的需求。我们的新需求是为这个笔记应用增加 markdown 支持,具体来说,需要在编辑器右上角提供两个模式切换按钮。 那假设这个时候我想换行,怎么做呢?直接按回车肯定是不行的,按回车就提交了,正确的做法是按 shift 加回车。你看这样呢,就可以回车了。我们继续输入任务内容, 首先是编辑模式,显示所有文本内容,并对其中的 markdown 语法进行高亮显示。然后还有一个是预览模式,它用于显示 markdown 的 渲染结果。现在再回车。 好,可以看到 codex 开始工作了,在它工作的间隙,我们再创建一个新的绘画,让它再处理另外一个关系不大的任务。 我们的新任务就是给这个笔记项目生成一个 logo, svg 格式。可以看出这两个绘画都在工作中了。假设这个时候你突然想到了我们的笔记软件有深浅两种模式,这个 logo 需要在任意一个模式下都清晰可见。我们最好提醒一下 codex, 以免它忘了, 好让我们发送请求。不过这个请求似乎没有发出去,它似乎卡在这里了。没错,在默认情况下,只有当上一个请求完成后, codex 才会继续处理下一个请求。 不过到那个时候就有点晚了吧,毕竟 logo 都生成好了。我们能不能现在就把这个信息发送给 codex, 让它在生成 logo 前就注意到这一点呢? 没问题,注意到这里的 steer 按钮了吗?点一下,我们的请求就会立即发送给 codex, 这样我们的目标就达到了。那 codex 现在还在运行中,我们稍稍等待一会儿。 好,可以看出 logo 已经生成完毕了。我们切回到原来的那个绘画,看看它的进度怎么样了,它还在运行中,所以我们可能还需要再稍微等那么一会儿。 好,这两个任务呢都完成了,我们来直接打开软件,看看最终效果。首先是要打开终端,然后呢,我们运行 n p m start, 打开这个 electron 应用。呃,看起来好像是有点问题啊。 logo 没有被成功地加载起来, 那我们需要跟 codex 说一下这个事情,让我们先关掉这个 electron 应用。 然后呢,我们关掉这个 electron 进程,先看看这个 logo 在 不在 啊?这个 logo 确实是在 public 文件夹里面的,那应该不是文件不存在导致的。那是不是这个 svg 文件的格式有问题呢?我们来到访达来验证一下。 打开这个 public 文件夹,看来这个 svg 文件的格式也是没有问题的,毕竟访达都正常渲染出来了。 那大概率是 electron 加载这个 svg 文件的方法有问题。让我们来让 codex 修一下。首先按 command 加 g, 我 们唤起这个绘画列表,然后选择生成 logo 的 那个绘画, 然后在这里面我们输入具体的问题, logo 没有显示出来。提交好,提交之后呢, codex 就 开始给我们排查原因了,我们再稍微等一会儿。 修复完毕,我们再次启动这个软件看看效果。 首先打开终端,运行 npm start 好, 这次看起来 logo 是 成功的显示出来了,我们还可以随便点一点其他的功能,看看整体是否运转正常。 那 markdown 呢?我们可以随便输入几个 markdown 的 关键词,看一看它的高亮显示是否正常。看起来似乎并没有什么太大问题,各种格式呢,都可以非常正常地显示出来, 可以看出预览也是没有问题的。那这次需求就到这里了,我们再次回到 codex 这里,继续迭代它。 前面我们讲的呢,都是 codex 的 基本能力,下面我们来讲讲 plugging。 你 可以把 plugging 想象成一个 codex 的 外挂,它会给 codex 相应的能力,帮助 codex 去做更多的事情。这么说呢,可能比较抽象,我们可以来实战一下。呃,我们首先可以打开侧边栏, 然后点击里面的 plugins, 在 这里我们就能够看到所有可用的 plugin 了,其中有能控制电脑的,有用于操作 chromed, 还有用于编辑 excel 的 啊,还有一些是用来制作 ppt 的。 如果 plugin 的 旁边打了勾,那代表这个 plugin 已经被安装好了。如果 plugin 没有安装的话,旁边会是一个加号,我们点击这个加号就可以正常安装了。我们来随便点几个 plug in, 看看它内部到底有什么。 比如我们可以点一下这个叫做 gmail 的 plug in, 可以 看到这个 plug in 内部有三个组成部分,其中一个是 app, 两个是 skill。 这个 app 呢,是用来把 codex 和 gmail 连接起来的, 它里面提供了很多的工具,当然 codex 没有叫它是工具, codex 叫它是 action, 但其实本质上啊,这里面就是一个一个的工具,跟 mcp 的 工具呢差不多。 比如 apply labels to emails 就是 用来给邮件打标签的 archive emails 就是 用来归档邮件的。这个 app 一 共是提供了二十四个这样的工具,除了 app 之外,这个 plugin 还提供了两个 skill, 呃,你基本上是可以把 skill 当成是给大模型看的一个说明文档, 比如说是这个 gmail skill, 它就写明了怎么总结邮件内容,怎么赚,写回复,以及什么时候该调用哪一些工具啊等等。 而这个叫做 inbox treeash 的 skill 呢,则是告诉大模型如何给邮件归类的,比如说哪一些邮件比较紧急,哪一些邮件需要回复等等。如果你对 skill 比较感兴趣,可以看一下我的这个视频,把 skill 的 使用方法和运行原理一次讲明白。 gmail 的 这个 app 所包含的内容呢,就只有这三个了,我们如果选择安装 gmail 这个插件,那其实就是选择安装了这三个组件。等到用户想要 codex 操作 gmail 的 时候, gpt 模型便会找到这三个组件,并用它们提供的能力和说明来完成。用户的要求 大致就是这个样子的。我们来看一个具体的例子,比如说是 presentations, 这个 plugging 呢,是用来写 ppt 的, 它只有一个组件,那就是这个叫做 presentations 的 skill。 这个 skill 详细说明了该怎么做才能做出一个高质量的 ppt。 下面呢,我们就尝试用这个叫做 presentations 的 plugging 来完成我们的需求,让我们来新建一个绘画,然后输入我们的要求,给这个笔记软件做一个 ppt, 介绍它的产品设计和技术架构。 提交之后, codex 就 会找到我们前面所说的那个叫做 presentations 的 plug in, 并使用那个 plug in 提供的能力来做 ppt。 当然,如果你担心 codex 找不到这个 plug in, 或者说是找错了的话,你可以明确要求 codex 使用这个叫做 presentations 的 plug in, 这只需要在任务的最前面输入一个 at 符号,然后敲入 presentations 回车,这样 codex 就 一定会使用 presentations 这个 plug in 来做 ppt 了。 不过不加也没关系, codex 会自动找到这个 plug in 的, 所以呢,我们暂时就把它给去掉吧。好,提交,可以看出 codex 开始工作了,我们稍微等待一会儿, codex 写好了,我们打开看看。 中规中矩吧,其中其实还有不少可以改进的地方,不过这已经是一个不错的起点了,我们可以在这个基础上做一些其他的改进。 这个叫做 presentations 的 plug in 并不能算上经验。下面呢,我给大家介绍 open ai 所提供的两个用来镇店的 plug in, 一个呢是叫做 computer use, 用来控制电脑。另一个呢是叫做 chrome, 用来操作 chrome 浏览器啊,我们先来试一试 chrome 这个插件, 让我们来到这个插件管理的地方,然后呢,点击 chrome 旁边的这个加号来安装这个插件, 点击 install 好, 安装好了。然后呢, codex 提示我们需要在 chrome 上面也安装对应的扩展也行。好,那我们就按照它的指示来安装这个扩展。 那一切准备就绪之后,我们就来尝试用用这个 chrome 插件,我们可以直接点击旁边的这个按钮,这样的话, codex 就 可以给我们出实化一个使用当前插件的这么一个请求。呃,我们可以把后面的这个部分给去掉,换成我们具体的请求, 那就是打开 product hunt 首页,然后再找出今天最热门的三个新发布的产品,总结它们各自的特点,并附上对应的访问链接好提交。 呃,为了让大家看得更清楚,让我来把 codex 缩小一点,把 chrome 浏览器放出来,这样的话呢,大家就可以更清楚地看到 codex 到底是如何干活的了。 可以看到 codex 创建了一个标签组,这个标签组呢,专门用于解决我们的问题,然后它在这个标签组里面访问了 product hunt 的 首页,今天最热门的三个新发布的产品就在这里了,相信 codex 也看到了。 可以看到,现在 codex 开始打开另外一个标签页了,这个呢,看起来是第一个产品 brew 的 一个相关网站,然后呢,它又打开了一个。 呃,接下来呢,我们就不管了, codex 估计还会查看更多的网页,我们就在这里稍微等待一会,相信他等会就可以查询全部的产品页面,然后给我们一个比较有效的反馈,让我们稍微等待一下。 好, codex 给我们总结了,这个呢,基本上也就是我们想要的结果了,这个呢,就是 chrome 这个插件的相关使用方法了,让我们把这个 codex 再次最大化。 然后下面呢,我们就来看一看 computer use 这个插件的使用方法,它是用来操作电脑的,同样,我们点击这个加号,然后进行安装, 安装成功,让我们来使用一下。跟 chrome 的 使用方法类似,我们也可以点击 computer use 旁边的这个小图标,这样直接就能开启一个相关的 computer use 绘画。我们先把后面这段文本删掉,因为它跟我们真实的请求没有什么关系。 然后呢,我们再稍微改一下这个请求所对应的目录,我们现在呢是放在马克笔记这个地方,但实际上我们要打的这个请求呢,跟这个项目其实没什么太大关系,所以呢,我们就选择 don't work in the project, 也就是说,这就是我们随便提出来的一个请求,不会去绑定某个具体的项目目录。之后,我们就可以正式输入自己的请求了,那就是请打开我电脑自带的日历应用,帮我新建一个五月二十八日十点的日程标题,叫做讨论马克笔记的后续设计。 没错,就是这样,我们让 codex 操作一下日历这个应用,然后同之前一样,我们把 codex 缩小,把日历这个软件漏出来。这样呢,大家就可以更清楚地看到 codex 是 怎么操作我们这个日历软件的。 好, codex 首先询问我们能不能使用日历这个应用,我们同意, 可以看出 codex 开始行动了,这个呢就是 codex 的 鼠标,它跟我们所使用的鼠标呢,根本是两套,彼此之间互不影响啊。然后 codex 呢就开始操作这个鼠标,去完成我们的需求, 它还需要我们确认一下是不是真的要创建这个日程,这个有点啰嗦,那当然是确认了,我们给它回复一下, 好,看起来 codex 已经完成了我们的要求了,我们来看一下, 看起来这个日程的标题和时间段都是满足我们要求的,那就没问题了,我们再把 codex 最大化。 这个呢,基本上就是 computer use 这个插件的使用方法了。值得一提的是, codex 使用独立的虚拟鼠标,与你的鼠标互不干扰。刚才把日历软件提到前台只是为了掩饰,实际上你完全可以让它在后台默默干活,自己该干嘛干嘛,上网看视频都可以,完全不会耽误。 好, computer use 讲完了,我们接下来就来看看 skill 是 如何使用的。想要浏览 skill, 我 们就必须要先打开 plugins, 然后再点击这里面的 skills, 就 可以看到可用的 skill 列表了。 其实我们之前用 plugin 的 时候已经间接的用过 skill 了,因为无论是 presentations, computer use 还是 chrome, 这几个 plugin 的 核心组建呢,都是 skill, 你 在这个 skill 标签下面都能找到。 当我们安装对应的 plugging 的 时候呢,我们都会把相关的 skill 一 块儿安装好,所以我们在这里都能找到这些 skill。 不 过有一个王牌级的 skill 是 单独列在 skill 这个标签下面的,它并没有一个对应的 plugging。 这个 skill 呢,就是 mhgen, 它是用来生成图片的, 相信大家对 g p t 的 生图能力早有耳闻,不仅美观,而且非常的真实。下面呢,我们就来使用这个 skill 来创建一个图片。我们在马克笔记这个项目下新建一个绘画,然后输入我们的要求,给这个笔记软件生成一个宣传海报图片,注意要使用我给你的真实的软件截图。 然后呢,我们需要给 codex 相应的软件截图,我们先按 command 加 j 打开终端, 然后执行 npm start 命令来打开我们的笔记软件, 然后我们回到 codex 这里,点击加号,再找到其中的 attach electron 这个选项,这里面的 electron 其实就是我们的马克笔记软件了, 我们的这个笔记软件就是用 electron 做的,所以呢,在 codex 里面看来,这个笔记软件就叫做 electron, 我 们来直接点击这个选项,点击之后呢, codex 询问我们是否要启用这个功能,我们点击 enable, 然后我们的马克笔记截图就到了聊天框里面了,这样 codex 在 做海报的时候就可以根据真实的软件截图来做了,是不是很方便呢?点一下按钮就可以把截图放进来了, 不过这个还不是最方便的, codex 还提供了一个快捷键,按一下就能够把截图传过来。我来给大家演示一下,我们之前给 codex 的是浅色模式的截图,我现在在给 codex 传一张深色模式的,我们回到马克笔记这里,调到深色模式, 然后重点来了,左右 command 键同时按下,这样深色模式的马克笔记截图也传给 codex 了,这个确实更加方便了吧。好,现在 codex 有 了浅色和深色两种模式的截图,我们可以让它开始做海报了。提交, 首先我们可以注意到 codex 会使用 image 这个我们之前提到的技能来做这张宣传海报,然后我们就再等等,看它能画出什么样子来。 画完了,我觉得还行吧,确实是基于我们的截图来做的,不知道你觉得怎么样呢? 除了使用 codex 给我们安装的 skill 外,我们也可以创建自己的 skill。 让我们按 command 加 n 新建一个绘画,然后输入我们的任务,写一个代码审核 skill, 专门给当前的项目使用。这个 skill 应该包含如下的规则。好,我们提交 可以看到这个 skill 已经做好了,它的名字就叫做 marknotes code review。 下面让我们按一下 command 加 n 新建一个绘画,试试这个 skill 的 效果。首先我们 at 这个 skill, 然后提出我们的请求,检查当前项目的代码是否有问题。好,可以了, 结果出来了,还可以,我们还可以让 codex 根据审查的结果来修改代码。这里呢,我就不再继续演示了, 我们的笔记软件每天都在迭代,每天都有代码更新,所以我们最好能每天定时检查一下代码,看看有没有什么问题。这种场景就很适合起一个定时任务来处理。 codex 也提供了这样的功能,让我们来点击这里面的三个点, 再点击 add automation。 呃,也就是添加一个定时任务。这里呢是定时任务的标题, codex 已经帮我们填好了。这里呢,填写发起定时任务的时候,我们需要发给 codex 的 要求,我们的要求呢就是检查当前项目的代码是否有问题。 然后下面呢是执行环境,一共是有三个选项,分别是 local, worktree 和 chat。 local 呢是在某个项目目录里面运行这个定时任务 worktree 是 基于某个项目目录创建一个新的 worktree, 这个定时任务就在这个新的 worktree 里面运行。 worktree 的 概念我们之前讲过,它是 get 的 一个概念,如果你还是一知半解的话,可以先不管,我们这里不用这个选项。 chat 呢是执行环境,不跟任何项目目录绑定,我们之前用 chrome plugin 搜索网络的时候,实际上是用过 chat 环境的, 这里最适合我们的是 local, 毕竟我们的定时任务就是要扫描马克笔记的项目代码,所以一定是要跟某个项目目录绑定起来的。让我们选择 local, 然后在这里面选择马克笔记,然后这边呢是运行频率,我们选择 daily, 具体的时间呢,我们就维持在九点钟,意思就是我们这个定时任务在每天九点钟的时候启动, 下面呢我们选择模型 g b t 五点五,推理强度呢,我们就维持目前的 medium 就 好了。然后我们点击 save, 再打开左边栏, 我们就可以看到 automations, 这里面多了一个一。点击之后就可以发现我们创建的定时任务了,它会每天十点开始运行,每次运行的时候都会创建一个新的绘画,我们可以点击这个按钮试运行这个定时任务, 可以看到一个绘画创建出来了,就是用来运行这个定时任务的,我们来打开看一下, 好,可以看到这个定时任务已经完成了,后面每天跑的也都是这个样子了,那这个就是定时任务了。最后我想给大家讲讲 codex 的 一个特别有用的功能,那就是 codex mobile, 具体来说就是我们可以在手机上操纵 codex 来给我们完成任务,让我们来点击这里面的 codex mobile, 再点击 allow 允许手机操纵这台电脑, 然后再点击弹,点击完弹了之后, codex 应该会给你显示出一个二维码来。 呃,如果你像我这样没有显示出二维码的话,可以点击这里的手机图标,这样二维码就出来了。随后我们需要打开手机摄像头扫描这个二维码。然后呢,我们就会被引导到叉 g b t 的 codex 页面。在这里我们就能向电脑端的 codex 发送指令了, 比如我们想让它操作一下日历。你还记不记得我们之前在日历上创建了一个日程标题,就叫做讨论马克笔记的后续设计。现在我们在手机上再发送一个指令,让它把这个日程去掉,我们点击聊天。 然后呢,我们再点击这里,呃,在里面找出 computer use 这个选项。 随后呢,我们需要输入我们的请求,我们的请求就是把日历中五月二十八号呃,讨论马克笔记的日程删掉, 写完之后先不要忙着提交,你看,我们现在在马克笔记这个项目目录下,但我们的请求其实跟这个项目的代码没什么关系,我们就想操作一下日历软件,所以我们需要再点一下这个设置按钮,然后选择不使用项目。好,这样呢就万事俱备了。我们提交请求, codex 首先询问我们是否同意使用 calendar 这个软件,我们批准。然后 codex 再次询问我们是否要真的删除掉这个日程,我们确认, 随后 codex 就 开始操纵电脑了,我来给大家看看电脑上是个什么样子,你看日历上面多了一个鼠标,它正在操纵电脑删除这个日程。 好,删除成功了。这样呢,我们就做到了用手机来操纵电脑了,是不是很方便呢? 这样大家在外面也可以使用 codex 来做各种各样的事情了。好到这里本期视频就结束了,我是马克,用最通俗的语言讲最硬核的技术,我们下期再见。拜拜。

好,今天的话我们来聊一下 context 里面的对话功能。好,接下来的话我们打开 context。 好, context 打开了,那么我们每次跟它对话的话,我们可以点这一个新的那个 new chat, 就是 我们点开了就是一个新的一个对话,那么当我们对话比较多的时候,我们这一个左边的这里就会裂了很多,这 种的话我们查询起来的话就很不方便,那么如果我们要查询之前,我们就是使用过的对话的话,我们点那个 siri 池这里。好,我们可以输入一个看一下。 好,那么我们就查询到这个第一次使用的这一个对话,那么我们点击以后他就打开了,那么这个的话就是我们可以搜索我们的那个对话,如果我们要对我们的对话进行改名的话,那么我们可以双击他打开。好,我们可以改一下。 好,我们点 save, 那 么我们就完成了那个改名字,那么如果我们左边的对话比较多的时候,那么我们可以选择把这个对话给它隐藏起来,当我们在要的时候再把它显示出来。好,我们可以点这一个地方。好,点鼠标右键。好,我点着那个 arc, 恰特。好,那么我们就隐藏了, 那么如果我们想把它显示出来的话,我们点一下 settings 这里好,点进来,然后我们拉到最下面,这里有一个 ikev chat, 这里,好,我们点击这里 ikev chat 死这里。好,那么我们把这个给它恢复掉,就是点这里。 好,恢复完了以后我们返回来看一下。好,那么我们的信息就恢复到这里来了,那么就是我们不想看到它的时候,我们就可以通过这一个方式把它隐藏起来,那么我们需要看到的时候,我们再把它恢复过来。 我们使用 context 越来越多的时候,那么我们左边的这个恰当词的话就会很多,那么我们每次要查找的话就比较麻烦,那么我们可以通过分类的办法把它那个分类出来,那么我们首先可以在桌面上面创建一个文件夹。好,先创建一个。 好,这里的话我就叫做项目好,点开。好,那这里的话我创建两个文件夹,一个是用来缝那个。好,这里的话我就创建两个文件夹,一个的话我们是保存那个。呃,代码的。好,这个文件夹的话我们就叫做代码。 好,我们再创建另外一个,这个的话我们叫做文档。好,创建完了的话,我们把这个文件夹给它拖到那个 context 里面来。好,我们来看一下,好,把它拖过来。 好,我们再把第二个给它拖过来。好,那么我们已经拖过来了,那么这里的话就在那个 projects 下面的话,就有一个文档有个代码,那么我们这里的话就可以把代码相关的把它放到这个里面来。好,我们来试一下。好,这里的话我选择代码好这里的话来并写一个简单的程序。 好,我们看一下这一个新的这一个对话的话就已经放在那个代码下面了,那么下次的话,我们就是打开这个代码的话,就是我们相关的冰城的那个项目就在这个里面了。好,我们等他一下。 好,这里的话,他的结果就是已经输出出来了,那么这个的话就是我们把那个对话放到那个代码里面去,好,这里的话我们让他编辑一个文档,好,我们新建一个新的那个。呃,对话,好,这里的话把它放到文档里面去。好,我们就做一个简单的测试。 好,那么我们的这一个简单的测试就已经做完了,那么他是在文档里面,我们可以把不同的那个对话放到项目里面去,这样的话我们就实现了一个分类管理的一个功能, 那么到这里的话我们就聊了那个对话的。呃,四个功能,第一功能的话就是我们可以进行改名。第二功能的话就是我们可以搜索对话。 第三个功能的话就是我们可以把那个对话规章,那么我们需要的话再把它显示出来。那么第四个功能的话就是我们可以通过项目的方式来管理我们的对话。好,那么这就是那个对话的一个简单的一个应用。

二十一世纪最浪漫的约会,不是带你去逛街,也不是带你去吃饭,而是我帮你安装 codex, 帮你把你的业务跟 codex clog 做结合, ok, 我, 我非常认同,我觉得这真的对我来说是一个非常有吸引力的事情,但是呢,直到现在我都没有安上 codex clog, 因为这个确实太麻烦了。但是呢,我觉得这应该是一个小小的生意经,它应该是可以帮你赚一点零花钱的。 我大,我在那个很多个平台都刷到了这样子的图文,那我觉得这应该是一个引流吧,就是他用这样子的一个图文去引流,然后呢,呃,你跟他 建立联系之后,他可能会一是给你发这种免费的资料啊,一是给你发收费资料,二是的话,二的话呢,他可能会跟你开会议,然后手把手一对一的,呃,就是帮助你去安装好这两个应用,然后呢, 再帮你搞到国外的验证码,呃,如果有进阶的服务哈,我觉得他可能会把你目前工作上一些业务跟你这个,呃,这两个, 呃应用去做一个结合,然后他可能会帮你设置一些提示词,就是如果我自己去做这个业务,我可能会这样做。所以,呃,我觉得他应该也算是一个有市场,但是我没有深入调研过啊,一切都是没有深入调研过,你们听个乐,当个乐子听就好了。 所以说,呃,如果有,就是网友们,然后你们就是有闲时间并且想了解 ai, 想学会用 ai, 可以 自己先去找一些免费的教程,先在自己的电脑上去跑一遍,怎么样去安装这两个应用,然后怎么样去获得那两个验证码?然后怎么去买 token? 然后搭这些 呃 agent, 然后呢怎么去呃?输入那个提示词就是 prompt, 然后呢让你的这个 ai 帮你去做一些真正的有业务产出的东西,你把这一套服务的, 你把这一套流程梳理清楚之后呢,你可以输出一个服务的流程,然后呢你可以在网上发一些类似的图文去引流,然后呢去找到一些想要,呃,就是安装做服务做指导,我觉得这是一个 非常好的一个风口吧,而且对你自身也有帮助,也能帮你赚到一些钱,而且它是一个很小的业务闭环。

q 代码是真牛逼啊,兄弟们,现在已经是凌晨四点钟了啊,我就坐在这,我一点都不困,我非常亢奋,最近不是在做这个闲鱼电商,然后我接触完这个以后,这是第五天,几乎已经实现全自动化了啊,然后我已经让他做一个完整的软件出来了, 就是啥概念呢?从上架开始到到卖出去前,他全包了,就他推广开到什么地步呢?兄弟们 啊,他这个推广头展开的比我都高啊,老铁,真比我都高,我一开始我就压根不相信这玩意,然后他们非让我去试一下,我就整了一个, 买了个 plus 的 版本,我上去,嗯,试了几个小时,其实我刚开始去试的时候是抱着这个质疑的态度去的,我觉得这个东西没那么深啊,这个 aa 还没进化那么快呢。就是我试完之后我不说话了,我觉得 就是就给我一个感觉,这玩意在改变世界,你就看我才研究不到五天,现在几乎已经实现全自动化了啊,从上链接到开推广,他脱价脱的比我都好, 然后再到这个客服销售,我们这个销售环节是很重的,他完全他现在已经完全能给他揭露他,然后再到这个财务,财务统计,他统计的非常实时,非常快, 然后我现在已经把它做成了一个软件,也就是说我这个电脑装了一个,他就能给我正面,我给这一排电脑我全给它装了。它 啥概念?我现在已经晋升为 q 代斯 pro 二十 x 的 用户了,就我现在脑子里边有很多能变现的链路,我还没有去验证呢,就我我这一个个来,太爽了这感觉,然后就是对这一块有想法的都可以来聊一聊,交流交流,这个东西实在是太强大了。

零基础上手 codex 速通教程基础篇来了,前面我出过一期 codex 保姆级安装教程,不少同学已经跟着搞定了,但工具装好只是第一步,还有很多人不知道该怎么上手,所以这个视频我会手把手带你认识 codex 的 界面,把页面布局和几个核心功能了解清楚。我们还会一起用它丛林做一个简单的小项目,在 动手的过程中体验 codex 实际的工作流程,这流程啊,也会成为你后续用 codex 做任何东西的基本功。我们开始 codex 的 界面很简单,它只分成两块,左边是一条菜单栏,帮我们在不同的任务之间切换。右边啊,是主要的对话区,这里啊是和 codex 写作的地方。 左边这条菜单栏从上往下看,最上面是新对话点,它就能开启一个新的对话,这和我们平时使用 ai 聊天工具的习惯是一样的。下面是搜索,可以搜索我们之前的对话记录。比如之前你让 codex 帮你写过一份报价单,今天想继续修改,但你记不清是在什么对话里聊了。这时候啊,不用一条条翻列表,直接搜报价,那条对话就能搜出来了。 而且我们搜索的关键字不一定是对话的标题,搜索对话里的内容啊,也能搜出来。再往下是插件自动化,这属于进阶功能,我们后面再慢慢了解。 菜单栏中间有一块叫项目。什么是项目呢?其实很好理解,在 codex, 一个项目本质上就是我们电脑上的一个文件夹。我们可以通过一个例子来理解,假设你同时在忙两件事,一个是自己的个人网站,另一个是医疗设备出海的 su 分 析 两件事对应的文件本来就应该分开存放,比如网站的需求文档和代码放在一个文件夹里, seo 相关资料放在另一个文件夹里,那在 codex 里你就可以建两个项目,一个个人网站项目,一个医疗设备出海, seo 项目,各管各的,互不影响。 项目最关键的地方在于,在这个项目里啊,不管哪一次对话, codex 都能直接读到这个文件夹里的所有文件。所以下次你想继续改个人网站的时候,只要在网站项目下面新开一个对话,它就能读到这个项目里的所有文件了,完全不需要我们手动上传,也不用从头解释。这和我们平时在 ai 聊天公 上开一个普通对话,每次都得把资料重新发给他是完全不一样的体验。每个项目下面都会列出你在这个项目里和 codex 聊过的对话,下次想找的时候,点开对应的项目就能看到,不会和其他项目的内容混在一起。 这里还有个小技巧,点项目名字旁边的三个点,选择在发音那中显示 windows 上叫,在资源管理器中打开,就能直接跳到这个项目对应的文件夹。比如 codex 帮你新生成了一个代码文件,或者帮你把某个 excel 表改好了,你想自己打开看看,点这里啊,就能一键找到,不用再自己去翻文件夹。 菜单栏下半部分是对话,这里放的是不绑定任何项目的独立对话,我们点击对话右边的这个图标,就能新建一个对话,那么我们可以在里面随手问 codex 一个问题, 比如拍断和 java 应用场景有什么区别?那这个问题啊,不需要读取电脑上的文件,也就没必要专门建一个项目。再比如让他帮忙查一下电脑上某个端口有没有被占用,这种啊,也不需要绑定具体项目,直接开个新对话问就行。 那什么时候该用项目,什么时候该用对话呢?其实判断起来很简单,凡是需要和文件打交道,要反复叠代做一个东西的,就建一个项目,只是随手问问题,不需要动文件打,用对话就行。 接下来我们来实际上手建一个项目,假设我们要做一个很简单的习惯打卡小工具,每天帮我们记录习惯有没有完成。在 codex 里做任何一件正经事啊,第一步几乎都是先建一个项目, 为什么呢?因为项目啊,就是你电脑上的一个文件夹,它是用来存放和这件事相关的所有文件的容器。你做习惯打卡网站就应该给他一个专属的容器,那以后这个网站所有的代码、文件、图片、素材等等都会放在这里,不会和电脑上其他东西混在一起。 我们现在啊就开始新建,再输入框最下面有个进入项目工作的入口,点开之后选择新建空白项目,再起个名字,我们这里就叫它习惯打卡。我们已经知道项目可以直观理解成一个文件夹,所以新建项目也就相当于新建了一个文件夹 点项目名字旁边的三个点选择在翻译当中显示,也可以看到 codex 自动帮我们创建出了这个和项目同名的文件夹, 刚才那个入口里除了新建空白项目,还有第二个选项叫使用现有文件夹。如果我们手上已经有一个项目,比如之前开发到一半的网站,或者从网上下载的一份宣传代码,就选择使用现有文件夹,直接让 codex 在 这个已有的文件夹的基础上继续干。 总之,不管用哪种方法,只要选好了文件夹, codex 就 能读取和操作这个文件夹里所有内容了。选好项目之后,我们还会注意到输入框下面多出了几个状态标识,我们啊,顺便认识一下,第一个就是我们的项目名,比如这里显示的就是我们刚建的项目习惯打卡,这说明从现在开始, codex 啊已经和这个文件夹绑定上了。 接下来它的操作,比如读文件、写代码、改东西,都会发生在这个文件夹里,它旁边还有个下拉箭头,点开后可以切换到别的项目或者新建项目,等以后你手里的项目多了,就会靠它来回切换。 第二个写着本地模式,它的意思是 codex 啊现在是在我们自己的电脑本地干活,它现在操作啊都是我们这台电脑上的文件,这是目前最适合我们的模式,保持默认就可以了。 另外,如果你电脑有安装 git, 你 还不看到第三个状态按钮? may 表示主线和主线相对的是分支,这些啊,都是 git 这个工具里的概念,属于进阶功能,这里我们暂时不需要深入了解, 不过如果你好奇的话,可以简单知道一下, git 是 程序员用来管理代码版本的工具。打个比方,它有点像我们写文档时的历史版本功能,每改动一次,都可以去存个档,保存一个版本,记下这次改了什么,万一改坏了啊,也能退回到之前任何一个版本的状态。对做项目来说啊,这个是个很好用的后悔药。那 分支又是什么呢?可以想象一下,我们正在写一份文档,写到一半,突然想试试一种全新的写法,但又怕把原来的改坏。这时候啊,我们通常会先存一份副本,在副本上随便改,改好了觉得满意再合并回正式版。要是改杂了,就把副本一扔,原来的内容啊,一点不会受到影响。 get 里的分支就是这个意思,它相当于给代码复制出一条独立的副本线,我们可以在这条线上大胆修改,大胆尝试,完全不会影响主线原来的代码。而 form 就是 那条默认的主线,也就相当于代码当前的正式版。等我们在加分制上测试好了,再决定要不要把这些改动。何必回妹 get 呢?是一个比较专业,内容也很多的话题啊。现在只要知道 codex 可以 在背后帮我们管理代码版本,并且有这么一个后悔药机制就足够了。 项目有了,现在就可以跟 codex 提出我们的需求了。我们要做的是一个习惯打卡的小工具,你把想坚持的习惯加进去,比如喝水、运动、读书,每天打开它,完成一项就点一下,打个勾,还能看到自己今天完成了几项。 这个工具做出来后啊,你是可以日常用的。不过在正式描述需求之前,我们先认识一下输入框上的功能,点一下输入框最左边的加号按钮,会弹出一个菜单。第一个是添加照片和文件,这是很常用的功能,我们可以把图片或文件发给 codex 作为参考。比如做网页的时候,发一张设计稿给他,让他照着做,我们后面就会用到这个功能。 第二个是应用快照,它可能会显示成附加某个功能,比如附加 google chrome。 具体显示哪个应用,取决于你电脑当前打开了什么程序。比如我这里显示的是附加 code, 因为后台打开了 vs code, 那 点击这个按钮之后啊,当前应用会自动被截图,然后作为参考,一起发给 codex。 那 这个功能呢?目前主要支持 mac 电脑,后面可能会扩展到 windows。 如果你用的是 windows 电脑,可能暂时还看不到这个功能,或者看到内容不太一样,这都不会影响我们后面继续做东西。 下面是两个开关,计划模式和追求目标。计划模式是个很常用的功能,打开之后啊, codex 不 会一上来就闷头写代码,而是会先把任务拆解成一份详细计划给我们看。我们可以在这份计划上反复调整,比如调整范围,补充要求,把模糊的地方说清楚,等计划满意了再让它正式开始执行。 做复杂任务的时候啊,建议先用计划模式把方向定下来,这样能避免他一开始就跑偏。追求目标是一个偏进阶的玩法。打开之后啊,我们只需要给 codex 一个目标,他就会自己进入一个做计划,动手执行,进行测试,检查结果再继续改进的循环,一轮一轮的往下做,直到把目标真正做完啊,他才会停下来。 这个功能更适合特别复杂,周期比较长的任务,目前我们暂时还用不上。最下面是差价入口,可以给 codex 扩展更多能力,这也是进阶内容,我们后面用到的时候再说。 那现在呢,我们就用计划模式,在加号菜单里点一下计划模式,把它打开。这轮对话里, codex 就 进入了只谋划不动手的状态,然后把需求输入进去,描述的越清楚明白, codex 的 计划也会越靠谱。然后我们回车发送出去。 注意看, codex 不 会马上开始写东西,而是可能会先问你几个问题,把模糊的地方问清楚。比如他可能会问习惯和打卡状态希望怎么保存。那这里啊,我们可以选择他推荐的本地自动保存,实现起来比较简单。问题都问清楚之后啊,他会给你列出一份计划,告诉你他打算怎么做。我们点一下,展开计划,查看完整版。 这份计划你一定要看不懂代码,没关系,因为计划是用中文写的,你完全能看懂。比如他列出从空目录,创建一个清亮静态网页,用户可以添加习惯。例如喝水、运动、读书。页面显示今天已完成 x 项共外项。嗯,这些就是我们要的,没有好偏。 如果发现它漏了什么,或者理解错了,现在啊,就是修改的最好时机。你不用急着点确认,而是可以在输入框里补充你的意见。比如我还希望打了勾的习惯能变灰,看起来更加有完成感。 他会把计划重新更新一遍再给你看,你还可以来回提几次意见,直到满意为止。计划满意之后,我们再点击实施计划,批准他正式执行。这时候啊, codex 才会从谋划切换到动手。 计划批准之后, codex 就 开始酷酷写代码了。这个阶段我们基本上只需要当个甩手掌柜,冷眼旁观就行。同 是,我们也能随时看到他的进展,比如创建了哪些文件,加了多少行代码,运行了什么命令。不过很多时候啊,你会发现,干着干着,他突然弹出一个对话框来征求我们的同意。比如这里,他啊,就弹着问, do you want to now start a new local server? so i can't imagine a hacking brother? 那 你那里啊,也可能是中文的问题,是否允许启动仅监听本机的静态网页服务? 不要被这句话里的术语吓到。其实意思很简单, codex 已经把网页做好了,现在想先在你这台电脑上临时跑起来,好让他自己啊打开浏览器检查一下效果对不对。他觉得这是个需要你点头确认的操作,所以停下来问你一句。 这个弹窗给了我们三个选项,我们一个个来看。第一个是表示只批准这一次,下次啊,他再要做类似操作的时候,还会重新问你,属于是极其稳妥的选择。第二个是,且对于后续的命令不再重复询问。 如果你已经知道这个操作是安全的,不想被频繁打断,可以选它第三个否,请告知 codex 如何调整,意思是不允许,并且你还可以告诉他换一种别的做法。那这俩我们可以选择第一个,试就行。然后网页服务就在你电脑上启动起来了, 紧接着他又弹出第二个框,允许 codex 访问 localhost 冒号八千吗?那串 localhost 的 冒号八千看起来有点唬人,但其实啊,它就是网页在你自己电脑上的一个本地地址。这其实上一步的延续,上一个询问啊,是他想把网页运行起来,这一个询问啊,是他想亲自去看看运行后的网页效果。 那这一步啊,就特别能体现 codex 和普通 ai 的 区别。普通 ai 写完代码之后基本就结束了,但 codex 会自己打开网页,亲自检查功能是不是正常,那我们这点允许让它继续。然后很神奇的事情就发生了, codex 界面的右半边直接出现了一个网页预览窗口, 这就是它刚刚做完,然后自行打开验证的那个习惯打卡网站,我们能看到标题,习惯打卡,今日完成零零的统计,用来新建习惯的输入框旁边还有一个添加按钮, 也就是说啊,现在我们不用去文件夹里找,也不用另外打开浏览器,做出来的东西呢,就直接展示在了 codex 的 预览界面里面,做成什么样一目了然。而且不止如此,我们还能看到 codex 自己控制的一个小鼠标在操作。先添加今天的习惯,把喝水、运动、读书都加进去,然后点击喝水这个习惯,确认页面上的统计从零斜杠三变成了一斜杠三,接着就取消勾选喝水,再尝试删除运动这个习惯。哎,也测试成功了。所以 codex 不 只是会帮我们写代码, 他写完之后啊,还会自己尝试操作各种功能,确保最后交给我们。代码是经过实际测试的,到这里,我们的第一版习惯打卡工具就出现在眼前了, 感受一下这个时刻啊,我们没有写一行代码,只是用大白话描述了我们想要什么,看了几眼,计划点了几下允许,然后一个能用的网站就已经被做出来,测试好,直接端到了我们面前。这就是 web coding, 会在动手前停下来问你,你点了同意,他才会继续,这背后就是权限设置在起作用。 权限设置在哪里呢?就在输入框下面的加号旁边,有一个可以点开的按钮,默认显示的是默认权限。点开之后呢,可以看到三个选项,默认权限、自动审查、完全访问权限, 但取决于具体的版本啊。你看到的选项也有可能分别是,请求审批、替我审批、完全访问权限。默认权限也叫请求审批,是最稳妥的一档。在这档下, codex 做一些比较关键的操作之前,比如要修改或删除文件,要运行某条命令的时候啊,都会先停下来问我们一句,等我们点了同意,他才会真正动手, 这样每一步我们都看得见,也能自己把关。但这个模式的缺点是, codax 干活的过程中会频繁停下来等我们确认,稍微啊,有点打断节奏。完全访问权限就是完全放手让 codax 自己干,几乎不会再回来询问我们。这一档的效率最高,但也意味着我们对它每一步操作的掌控就会变少。 而自动审批,也叫替我审批,是介于默认权限和完全访问之间的一档,它特别之处在于,不是让我们自己一个个点确认,而是呢,会有一个专门扮演审查员的 ai 来帮我们把关。每当 codex 要执行一个 u r 风险的操作,这个审查员 ai 就 会先帮我们看一眼, 如果他办到这个操作是安全的,就直接放行。只有遇到他也拿不准风险比较高的情况,才会真正停下来问某一句,这样呢,我们就不用频繁的点确认,效率会高很多,但同时呢,又比完全放手更安全。 刚开始上手的时候,我其实比较推荐用自动审查,也叫替我审批这一档。因为新手看到一些操作的时候,很多时候自己也判断不出来到底安不安全,该不该点允许。那这种时候啊,交给专门的审查员 ai 来判断,反而会比我们自己拍脑袋更靠谱。所以这里我们就改一下,把它从默认权限切换到自动审查。 权限切换完成后,我们回头看看做出来的。这个第一版功能是齐的,但你可能觉得他长得还是太朴素了,配色排版都比较普通。 没关系,第一版呢,从来都不是终点。这里正好可以用到我们前面见过的那个常用功能,加号菜单里的添加照片和文件。因为美化这件事啊,最难的地方就是把你想要的感觉说清楚,你说我要简约一点,我要高级感,我要清爽一点,这些词其实都太模糊了, 爱理解的和你脑子里想的很可能根本不是一回事,结果就是来回改了好几轮,还是对不上。这个时候与其费劲用文字描述,不如直接甩给他一张参考图。 比如这里啊,我就找了一张自己喜欢的风格图,点开加号,选择添加照片和文件,把图片传上去,然后输入提示词,让 codex 重点参考里面的配色和自己风格。发出去之后啊,他就会按照参考图的风格来调整页面, 我们稍等一会,等他完成这一轮迭代。另外还有一件事需要知道,右边那个预览窗口,很多时候展示的是 codex 为了方便自己验收,临时启动的一个本地网页服务,等他验收完成后啊,这个服务有可能会被自动停掉,所以有时候你点一下预览页面的刷新,看到的可能是无法访问词网站, 这个提示只是因为那个临时服务已经停止运行,或者当前那个预览地址啊,暂时失效了,不代表你的网站出了问题。那有些时候啊, codex 在 完成迭代之后,会把有效的网站预览地址发给我们,但如果他没有这么做也没关系,最简单的办法就是直接问他,比如输入一句,我想要查看这个网站的效果要怎么做,他就会根据当前这个项目的情况, 直接告诉我们该怎么打开。比如这里,他就把网站在本地电脑上运行起来了,我们点一下那个地址,就能在右边的侧边栏里看到效果。那也有些时候呢,他给我们的可能是一个本地文件路径,那我们直接双击那个路径链接啊,也能打开。那这里呢,我们也可以顺便再测试下功能。添加习惯没问题, 公选完成没问题,删除习惯也没问题。那到这里,一个清爽好用,你看着顺眼的打卡工具的出版就成型了。 在基础片的学习结束之前,我们再认识输入框上最后一个功能模型设置,它在输入框右边会显示当前使用的模型以及对应的思考强度。比如五点五中,点开之后可以看到里面主要有三类设置。第一类是推理强度,分为低、中、高、超、高级档,你可以把它理解成 codex 思考问题的深度, 等级越高,它通常啊会想的越周全,处理复杂任务时的效果可能更好,但响应时间和使用消耗也会相应增加。第二类是模型选择,这里可以选择具体使用哪个模型, 一般来说啊,名字里带 codex 的 模型是专门为 codex 和编程场景优化过的。第三类是速度设置,点开之后可以看到标准和快速两个选项,标准就是默认速度,如果当前模型啊,支持快速模式,选择快速之后, codex 的 响应速度会更快,但对应的使用消耗也会更高一些。那我们现在要调它吗?不太需要, 我们做的这个打卡网站很简单,用默认模型,默认推理强度和标准速度啊,就已经够用了。那什么时候才需要调呢?等我们以后遇到一个又复杂又容易出错的大任务,比如要让 codex 理解一个比较大的项目,连续修改多出代码,修复比较难定位的 bug, 或者生成出来的结果总是不太对。 那那时候啊,就可以把推理强度往高或者超高调一调,让他多花一点脑力。那回头看这一集啊,我们不只是做出一个能用的小工具,还完整的走了一遍用 codex 做开发的核心流程,并且呢认识了输入框上几个最重要的功能, 那知道流程和这几个功能就是以后你用 codex 做任何东西的基本功。下一节呢,我们会继续学习更多提升效率的功能,把 codex 啊用的更顺手。那如果这个视频对你有帮助,也求个点赞收藏。如果你想继续学习 codex 入门教程的进阶篇和高级篇,记得关注我,我们下个视频见。

还把 codex 当成一个冰冷的工具,这显然是错误的。那么为什么这样说呢?因为我们知道我们和 codex 之间的交流,我们的输入产生它的输出,它的输出是带有不确定性的,所以说呢,我们甚至都可以把 codex 看成是活的。 那么我们和蔻黛之间应该确定什么样的关系?你把他当成你的媳妇可以,你把他当成你的儿子当成你的孩子也可以。但是在这里我更建议大家把蔻黛丝当成我们自己的一个伙伴,那么我们并不是去神化蔻黛丝,而是说通过 确定伙伴关系来完成我们自己的对蔻黛丝的心态建设,也就是把我们对蔻黛丝的理解和期待先理清楚,这样才能更好的最大程度的发挥它的作用。

codex 最近很火,有很多小伙伴经常问怎么设置权限,为什么我的语言切不了中文?今天带大家过一下一些重要的设置,这些地方设置好之后,你用起来会顺很多少很多。反复确认和无效操作 常规选项工作模式,技术人员想看更多细节设置为适用于编程,想简洁设置为日常工作模式。 权限控制,绘画的权限选项关闭后,绘画框的权限选择不再有该选项。集成终端,微软用户建议选择 git bash, 会有各种策略安全限制 语言设置中文,如果设置中文后无效,带着它出国旅游一圈回来重启配置选项批准策略加沙盒设置, 如果你做的不是特别神秘的工作,建议直接开,最大减少不必要的交互,因为给你交互大多数情况下你也是不会看,直接点同意个性化选项,个性直接选务实,不要虚头巴脑。 自定义命令,一定要写上这两个记忆打开起用记忆会从不同绘画收集内容来记忆,如果和他打交道的内容大多数一样,建议开启 打开,跳过工具辅助对话,不会把 m、 c、 p 等其他工具搜索结果带到记忆中。 浏览器选项浏览器一定要打开, codex 内置浏览器,帮你调试前端页面显示问题。开发者模式,建议打开,主要用于调试和检查网页 css 等。 电脑操控选项,任意应用打开,让它帮你解决你电脑上任意软件的问题与工作。 chrome 打开,可以直接操控你的 chrome, 为你工作。还有不明白的地方可以评论区留言,看到会及时回复。

这是你能看到最完整的 codex 零基础通关教程,如果你刚好错过了养虾也没有赶上养马,那么恭喜你,更适合普通人的 agent 他 来了。这一期,我们从零开始,用通关的方式把学习 codex 这件事抽丝剥茧的展开。先看这期的通关地图, 前三关是新手村。第一关,把入口选对,从最适合新手的入口开始,把 codex 跑起来。第二关,接好账号和模型,我会把官方订阅、第三方接入国产设备等问题都帮你搞清楚。 第三关,看懂执行过程和任务顺序, codex 是 怎么一步一步执行的任务,怎么排队,怎么插队,怎么并行,什么时候该放手,什么时候又该介入。 过完新手村,还有 plugins、 skills、 agent 这些你一定会用到的关键实操关卡,而且每一关都会衔接一个契合的实战案例。一期视频带你一步一步把扣带四真正用起来。我也同步整理好了清晰的笔记,期待你的三连支持。那么话不多说,我们现在发车 嗨!这里是头哥不请自来的 ai 频道,我们直接进入第一关。这一关的通关任务有三个,一,搞清楚 codex 是 什么,选出适合自己的入口,至少完成一种安装验收。 先了解 codex, codex 是 openai 开发的一款 ai 编程智能体,但其实官方对它的定位远不止于编程。 codex 实际上是一个在你本地电脑里拥有提取信息、修改文件、调用工具、执行命令等能力,可以自主完成任务的 ai 智能体。 context 还可以通过使用 skills、 mcp 和插件等等扩展进入更多的真实任务场景中, 比如使用 ppt scale 生成演示文稿,使用 draw mcp 画架构图,用 hyperframes 插件做动画视频,结合 obsidian 整理知识库等等。所以 context 的 入口设计其实是围绕它的使用场景展开的。 如果你第一次上手 codex, 想更直观的看到任务进度和结果,优先选择桌面 app, 它就是一个普通电脑软件,打开以后你可以看到对话项目、任务过程、插件权限等等。后面做实操,我们也主要用这个入口来演示。 如果你本来就是开发者,有命令行基础,习惯在终端里看项目跑命令,那可烂端更贴近你的工作方式。 它的优势是直接、清亮,适合放进真实的开发流程中。如果你每天都在 vs code 里写代码,那 id 插件会更顺手。你不用离开编辑器就能打开 codex 对 话窗口,也能更直观的看到它改了哪些文件。这三种方式基本已经可以满足百分之九十九的个人使用场景。 至于 cloud 云端,使用 github 中接入 codex、 sdk、 mcp 这些更高级的使用方式,先留个印象,后面我们作为扩展慢慢介绍。 先来看桌面端,它会直接根据你的操作系统给出对应的下载方式。安装完成以后,打开 codex, 你 会看到一个登录界面,这里先不用急着登录,软件能正常打开,并且能够看到登录入口,做到这里,桌面端就算通关了。 再看 client 端,如果你本来就是开发者,我相信你的电脑里大概不会缺少 node、 npm、 git 这些基础环境。打开终端,先用三条最基础的命令检查环境是否正常。只要这三条命令都能正常输出版本号,就可以执行 codis client 的 安装命令了。 装完以后再用版本检查命令,确认一下能输出版本号,就说明可乱端安装成功了。如果你是初学者,就先把桌面 app 装好,等后面完成登录以后,你可以直接在 codex 里输入这段提示词,让他帮你安装可乱端。 这就是 a 阵的工具。有意的地方很多,原来需要你自己查命令,配置环境的事现在都可以直接交给他。最后来看 ide 插件,它的好处是不用离开当前项目,就能直接在编辑器里打开 codex 对 话窗口。以 vs codex 为例,左侧扩展面板搜索 codex 安装时重点看一下发布方,确保选择的是 openai 官方插件。装好以后,打开一个项目文件。正常情况下, vs 后的右上角会出现 codex 的 对应图标,点击以后,右侧边栏就会展开 codex 的 对话窗口。 恭喜你,在我们的共同努力下,你已经成功安装好了至少一种 codex 使用入口。我们来复盘一下这一关的通关标志。第一,你已经知道 codex 不 只是终端工具, 桌面 a p p 可乱端、 ide 插件这三种本地形态都能让你真正开始使用 code。 第二,你已经能根据自己的习惯做出选择,新手优先桌面 a p p 开发者优先可乱端,并且重度用户可以选择 ide 插件。 第三,你已经至少完成了一种安装,并通过了最基础的安装验收。下一关,我们把账号模型和工作目录准备好,让 codex 真正开始干活。进入第二关,这一关的通关任务有五个,一、选好模型、接入方式。二、完成登录和第一次对话。 三、认识 codex 页面的核心功能。四、准备一个干净的文件夹。五、让 codex 完成第一个 a 阵的任务。 先说接入方式,简单理解, codex 是 你装在电脑上的 a 阵的外壳模型,是它背后真正用来思考、判断和生成内容的大脑。所以这一关要做的就是先把这个大脑接好。现在大致有两条路,第一条,官方账号。 如果你有官方账号也能顺利订阅模型需求暂时没有特殊要求,新手阶段真正走官方接入最省心。 登录、订阅用量、模型、插件基本都在官方体系里处理。如果你只想跟着教程完成一次体验, free 方案通常也够你做几次简单的对话。但尴尬的是, free 方案现在的额度刷新已经从周额度变成了月额度, 也就是说用完以后要等一个月才会刷新,所以它只适合做入门验证。真正想把 codex 用起来,就不要把 free 当成主力方案。在网上是 plus, plus 是 很多人已经习惯的使用方案,日常对话、轻度任务,跟着教程做一些基础体验基本够用。但如果你一上强度,让 callix 连续读项目、改文件、跑任务, 五小时限额很快就被用完了。再加上很多开发者最近的体验是 oppo ai, 好 像在一点点收紧 plus 的 可用额度,所以我现在不认为 plus 是 最具性价比的 plus 主力方案了。 如果你准备长期高频使用,就要认真评估更高的档位。再往上是 pro, 现在 pro 里常见的是五叉和二十叉两种方案,你可以简单理解成五倍于 plus 的 使用额度和二十倍于 plus 的 使用额度。如果你选择的是 pro, 基本可以覆盖大多数中高强度的任务。 虽然五叉会比二十叉便宜一倍,但我反而认为最具性价比的是二十叉。因为到了这个档位,你不用再一直担心 token 焦虑,也更容易把 codex 变成真正能撬动业务效率的生产线杠杆。如果你觉得自己一个人根本用不完这么多额度, 也可以找几个小伙伴一起合租。二十叉的实际性价比会比 plus, 甚至比 pro 五叉高上不少。第二条路是第三方 api 接入。为什么 codex 可以 接第三方 api? 简单说, codex 本地有一个配置文件,里面可以指定窝心服务商请求地址和密钥。 只要第三方提供兼容的地址,并支持 codex 需要的接口形式, codex 就 能调用它完成模型处理。如果你不方便使用官方订阅,希望使用国产模型或者团队已经准备好了现成的 api 方案,就要走这条路。 新手可以先用 codex 加加配置,它是一个开源的面向 codex 应用的外部增强启动器和管理工具。 他把第三方 api 接入做成了图形界面,你不用一上来就手搓配置文件,来到 qx 加加管理工具,先做健康检查,然后进入供应商配置,添加新的供应商。我们以 deepsea 为例,这里至少要填四样东西,第一,选择接入模型,纯 api 接入。 第二, base 就是 deepsea api 的 地址。第三, api k, 也就是 api 密钥。第四,模型名称 保存以后先测试下连通信,测试通过,再从 codex 加加入口启动 codex。 如果启动成功,你就能在 codex 里看到自定义模型供应商和模型列表。这里要记住一点, codex 加加属于第三方增强工具, codex app 更新以后,它可能需要等待适配。如果你后面遇到菜单不显示,配置没生效,模型列表出不来,先检查自己有没有从 codex 加加入口启动 codex, 再检查 codex 加加是否需要更新。 如果你想看懂底层逻辑,就学学手动配置。这里先不展开,后面境界篇我会详细介绍。接入完成以后,先做一次简单的对话, 比如直接问他一句,一句话解释 codex 是 什么,只要他能正常回复,就说明模型接入。这一步搞定了。接下来先认识下 codex 页面的核心功能, 左侧是任务记录,中间负责对话和任务过程。底部输入框负责交代上下文、模型权限和工作目录。左侧的新建对话用来重开一个任务,换问题,换项目,换上下文就从这里开始。 搜索用来找回历史对话和任务,后面任务多了,搜索会比翻列表要快得多。 chat 是 临时对话和通用任务空间,适合问概念确认步骤,解释一段内容。 project 是 指定工作目录的任务对话,只要任务涉及本地文件,改代码、读仓库、 ppt、 知识库整理,就优先放到 project 里做。 project 会绑定一个工作目录,同一个项目里的对话都可以围绕这个文件继续推进。插件是 context 扩展的能力入口, browser, use computer, use ppt, github skills 这类能力通常都会从这里安装或配置 设置功能,新手阶段大部分配置保持默认即可。真正开始做任务时,重点看底部输入框,添加上下文。可以把文件截图或者参考资料交给 context 模型选择,决定这次任务的模型和推理强度。访问权限决定你给 codex 多少自由度,是每一步执行都停下来请求批准,还是完全由 codex 接管工作目录,决定 codex 在 哪个本地文件夹执行任务。 那么接下来我们就来准备这个文件夹。在开始之前,先要理解一个很重要的概念,项目。 在软件开发里,一个项目或者一个工程通常就是围绕同一个目标组织起来的,一组文件代码、文档、配置、图片、脚本都放在同一个文件夹里。这也是为什么 codex 需要一个工作文件夹。 你把一个文件夹交给 codex, 就 等于告诉他这次任务只围绕这里展开,他可以在这个范围里读文件、写文件、改文件,也能更清楚的理解当前任务的上下文。这样做至少有两点好处,第一是操作更安全, codex 不 会一上来就在你的桌面重要目录或者真实项目里乱动。第二是注意力更集中,他看到的文件越明确,越容易判断哪些内容和当前任务有关。所以第一次实操,我们就先准备一个干净的文件夹, 文件夹名尽量用英文和短横线。接下来新建 project, 把刚才创建的文件夹交给 codex。 正常情况下,你应该能在这里看到当前工作目录路径。 现在让 codex 做第一个 a 阵的任务,发出任务以后,你会看到 codex 开始拆解任务,先理解你要它整理什么,再去联网搜索相关资料,最后把结果写进 markdown 文件。 做到这里,你就能真切感受到 codex 已经从普通的聊天窗口升级成了一个可以围绕工作目录搜资料、整理内容、写入文件的 a 阵等。 恭喜你,第二关也顺利通关了。我们来复盘一下,你一定已经选好了模型的接入方式,完成了登录,并通过一次简单的对话确认 kotax 可以 正常响应。认识了 kotax 页面的核心功能,还把一个干净的文件夹交给了 kotax, 让它生成了第一份 markdown 文件。 下一步,先不着急开始更多任务,我们先来看懂 kotax 的 执行任务时到底发生了什么。 顺利进入第三关。这一关的通关任务有三个,第一,看懂 codex 接到任务后会经历哪些关键步骤。第二,分清任务、排队、插队和并行对话。 第三,学会控制 codex 的 工作权限。第四,搞清怎么用计划模式和目标模式。前面我们已经让 codex 在 本地文件夹里生成了第一份 markdown 文件, 在目前为止还没有真正看懂 a 阵的工作过程中到底干了什么。你可以把 codex 的 第一次任务理解成五个动作,第一,理解目标,他会先判断你到底要他干什么,是写资料、写文件、做 ppt, 还是操纵网页整理知识点。第二,读取上下文。 上下文可能是你当前 project 绑定的文件夹,也可能是你手动添加的文件截图、网页资料,或者是前面已经聊过的内容。第三,选择工具, 普通文本问题它可以直接回答,涉及到网页,它可能会调用浏览器能力。涉及到本地文件,它会访问当前工作目录。涉及 skill, 它会先去读取对应的操作说明。第四,执行并等待确认。 只要你没有完全放开权限, codex 遇到联网写文件、执行命令这类动作时,就会停下来问你要不要继续,最后输出结果。结果有时候就在聊天窗口里,有时候是一份 bug down 文件,有时候是一组代码脚本,有时候是一份 ppt, 也有可能是一段需要你复合的任务。摘药,有时候,我们想在正在执行的任务里加入更多要求,或者想在项目里并行推进另一个方向的任务。如果你在同一个对话里连续发送多个任务时,他们通常会排队等待。 这是 codex 的 默认行为,并没有什么问题。但如果你想让这个新对话影响正在执行的工作,就要使用这个新任务旁边的引导功能,它就能把补充的要求塞进正在运行的任务中。如果你想同时开展另一个方向,就不要在当前对话里硬塞任务, 直接新建一个对话。同一个 project 下面可以有多个对话并行推进,它们都围绕同一个工作步路,但每条对话最好只负责一个清晰的任务边界。在 codex 应用里,权限入口通常在对话框下方默认权限,新手先保持默认就行。 codex 可以 在当前工作区里处理文档代码。常规本地任务,一旦要求访问工作区外的文件联网或者调用更敏感的命令,就会停下来请求你批准 这个工作区边界,也就是我们常说的沙盒。简单理解就是先给 codex 圈一块活动范围,让它默认只在当前项目里行动。自动审核,它适合任务步骤很多,频繁弹窗影响效率的时候, 低风险操作可以自动放行,高风险操作仍然会回到你这里。确认完全访问,它是最高权限,只适合新手临时打开。 使用之前,最好先让 callix 说清楚它准备运行哪些命令,修改哪些文件,访问哪些外部资源,并且确认这个项目有 git 或者备份。可以回滚, 只要任务范围够清晰,风险可控,结果也能回滚。那完全访问就是一个更高效的选项。自定义权限,它属于进阶功能,可以把可写目录、网络访问、命令审批这些规则固定下来,本期先知道有这个选项就行,具体配置以后再展开。 这里再补两个新手很容易忽略的功能,计划模式和目标模式。如果你的任务还很模糊或者步骤很多,先别急着让 qtex 直接动手执行。在 app 里可以用斜杠不烂,也可以使用 shift 加 tab 切换到计划模式。 你可以把计划模式理解成开工前先画的施工图。 qtex 会先理解上下文,必要时会向你确认几个问题,然后把任务拆成一份可执行的详细计划。 这时候他先停在规划阶段,让你看清楚准备怎么执行任务。你确认计划靠谱以后,再让他开始执行。而目标模式则适合另一类任务,目标已经明确,但过程比较长,比如牵引一个项目,持续修一组 bug, 把一份计划落成多个文件, 或者让 codex 围绕一个结果反复验证,你就可以用斜杠 go 给他挂一个持续目标。目标模式的价值是让 codex 围绕同一个结果持续推进,中间可以暂停,可以继续,也可以在需要你补充信息时停下来,但他始终围绕那个目标判断下一步该做什么。 学到这里,第三关就算通关了。你已经能看懂 codex 一 次任务的大致流程,知道了任务怎么执行、怎么排队和并行, 权限怎么控制,以及什么时候用计划模式和目标模式。接下来,我们把这些理论知识放进一个实战副本中。这是一个很多 windows 用户都遇到过的头疼问题, c 盘空间不足, 软件明明都装在 d 盘,系统却一直提示 c 盘快满了。你打开 c 盘一看,每个文件都很大,但你又不敢随意删除。这就是一个很适合交给 codex 先做规划的任务。 开始之前先把权限设置好,因为这个任务涉及到 c 盘,里面有系统目录、用户目录、软件缓存等等,这些位置都很敏感,所以这里建议你把访问权限设置成请求批准。 先让扣贷斯在当前工作目录里生成清理优化清单。接着我们进入计划模式,把这段提示词投喂给扣贷斯, 他先做了一轮任务分析和环境确认,接着他开始规划清单结构,因为我们开启了计划模式,扣在死会反过来向我们确认一些细节,然后就会给出一份详细的工作计划, 确认计划没有问题,我们就可以让他实施计划。这期间,如果你突然想到新的任务补充,也可以直接在聊天窗口里继续提出,这时候不用重新开一个任务,用追加任务旁边的引导按钮, cs 会把我们的追加需求融入到正在执行的计划里,继续思考这份清单应该怎么写。这期间涉及到文件修改和命令执行的地方, cs 会先向你确认是否同意。这就是我们设置了请求批准权限的原因。 几分钟, a 阵呢?就在当前工作目录里生成了一份 c 排占用排查与清理清单。比起一件事词牌清理工具,这份清单明显更清晰。 恭喜你完成了第一个实战案例。你会发现,只要目标说清楚,权限边界设定好, codex 已经可以帮我们完成很多的本地任务了。 来到第四关,我们准备开始给 codex 添加装备。先来简单认识几个核心词汇, plug in skill、 mcp。 对 于平时熟悉 a 阵的工具的小伙伴来说,这些概念一定不陌生。 我们先来说 skill。 skill 更像一份给 codex 看的操作手册。一个 skill 的 核心文件是 skill 点 m d, 里面写有技能名称、适用场景和具体指令,复杂一点的还配有可执行脚本、参考资料或模板, 你可以把它理解成给 a 阵的准备的 s o p。 比如生成 ppt 这件事,如果每次都让你从零告诉 codex, 再拆页面结构,再生成文件, 再检查封面目录比例,文字易出问题,那会非常繁琐。有了 ppt skill 以后,这些固定步骤就可以提前写进 skill 的 说明书里。 以后你只要告诉 codex 我 要用 ppt skill 做一份演示文稿,它就会读取 skill 说明,再按里面的流程自动推进。 再来看 m c p, m c p 的 全身是 model context 的 protocol, 也就是模型上下文协议。它是 astropica 提出的一个开放协议,用来统一连接 ai 模型和外部工具。 放到 codex 里,你可以把它理解成给 agent 接工具和上下文的标准接口,比如浏览器、数据库、 gitup 等等。接入 mcp 以后,这些外部工具就能把可用能力交给 codex 调用了。最后再说 codex 里的 plug in。 按照官方文档的说法, plug in 更像一套可安装的能力包。一个 plug in 里可能包含多个 skills, 也可能包含 mcp servers。 所以这里 plug in 负责把一组能力打包好装进 codex。 现在把这三个词放在一起就很好理解了。 skill 负责沉淀固定的流程, mcp 负责把工具和数据接近 agent, plug in 负责把这些能力打爆安装。 如果你已经能清晰地理解这三者的关系,第四关就顺利通关了。接下来,我们马上进入第二个实战副本。我们要让 codex 调用 ppt skill, 把一句话需求变成一份可直接编辑的演示文稿。 开始之前,先确认 ppt skill 已经安装或启用。这里我选择的是一个 github 上已经拿到了三万多 star 的 开源 skill ppt master 为什么要选择它?借用 skill 作者的一句话, 真正的 ppt, 如果它在 powerpoint 里打不开,不能编辑,它就不应该叫做 ppt。 接下来我就把 ppt master 的 get up 主页直接丢给 codex, 让它先帮我们安装好这个 skill。 安装完成以后,不出意外的话,你就可以在聊天窗口里输入斜杠,调出刚刚安装好的 ppt master 技能。如果没有,那就先重启一下 codex。 接下来正式进入 ppt 生成任务。我们让 ppt master 参考图一的 ppt 风格,把这份文档内容制作成一套 ppt。 如果中间需要生成图片,调用 imagen 这个图像生成技能。 任务发出去以后, a 阵呢?先是读取了 ppt master 和 imagen 的 技能说明,接着他创建了一个新的 ppt 生成项目,然后开始理解我们的文档内容, 提炼这份文档到底要讲什么,哪些内容适合做标题,哪些内容适合拆成页面,哪些内容需要图表或配图辅助表达。 同时它会分析我们提供的 ppt 参考图的设计语言。在正式生成之前, ppt master 还会给出一份设计方案确认页面,这里会把话不合适页面、目标、受众、视觉风格、色彩方案等内容都整理成一份确认清单。 待所有元素都准备就绪以后, codex 会一夜夜的生成真正的 ppt x 文件,来看看效果。 ppt 能正常打开,图片图形可移动排版,文字也可以随意编辑。如果这些都没有问题,那么恭喜这个副本就算通关了。 接下来进入我们 codex 零基础教程的最后一关,用 codex 搭建一个 llm vk 本地知识库。这个案例来自 ai 领域的著名研究者安德烈卡帕西,他前段时间提出了一个很有意思的想法,他说现在很多知识库都在用 r a g, 也就是解锁增强生成。但他认为 r a g 的 主要问题在于每一次提问模型都要从零开始重新发现知识。比如你问了一个需要综合五篇文档的问题, r a g。 会解锁拼接生成。如果你明天再问同样的问题,他还会重复同一套过程。卡巴西给出了一个新的方案,叫做 l m v k。 他把这套系统分成了三层,第一层,原始资料层,负责收集论文、文章、文案这些素材。大模型可以读取,但不要改写原始资料。第二层, wiki 层,这层交给大模型维护,它可以整理目标、生成药物、提取实体和概念, 做比较分析和综述。也可以创建页面,更新页面,维护页面之间的交叉引用。我们则主要负责阅读和附和。第三层, scm 层,你可以把它理解成整套知识库的操作规范。 如果放在 codex 里,这个文件就可以是 a 乘四点 m d。 卡夫西在他的 guitar 仓库里详细写出了 l l m wiki 的 理念。那我们这一关就借用这套思路,在 obsidian 里配合 codex 搭建一套本地 l l m wiki 知识库。 回到 codex, 我 们把卡发希的 get up gist 交给 agent, 让他严格参考这份原始设计文档,在当前工作目录里搭建一个 l i m v k。 本地知识库。是的,就这么简单。任务发出去以后, codex 会读取卡发希这篇文章的实际内容。 然后他会自己理解 l i m v k。 的 设计理念,按刚才那三层结构创建目录。比如 ro 用来放不可变的原始资源, vicky 用来放 l l m 维护的持久知识页,再加上日制缩影和必要的说明文件。接着它会创建 agents 点 md, 作为未来 agents 的 操作规范。 说到 agents 点 md, 你 别误以为它只是知识库中的一个概念,对于 codex 来说,每次开启一个新的对话,它都会进入一个新的上下文 果。没有项目规范, agent 每次都要从头猜测当前目录的操作规则。 agent 四点 md 的 作用就是把这些规则显示的写下来, 你可以在缺失的 agent 四点 md 工作目录下,使用斜杠以内的命令来出示化一个 agent 四点 md 文件,那放到这个 l l m v k 里, agent 会自动生成这个规范文件。 经过几轮测试和校验, codex 最终在当前目录里搭建出了一套 l i m v k 本地知识库,整体结构严格按照卡法系的模式落地, role 放不可变资源, v k 放 agent 维护的持久知识页。 agent 四点 m d 作为后续 agent 的 操作准则。接下来我们把几篇自己的文章放进原始资料层,然后让 codex 完成这几篇文章的入库任务。等任务结束,我们回到 obsidian 就能看到这些 markdown 页面,已经变成了一张可以浏览的知识图谱了。这就是本地知识库最厉害的地方。 哇,真不容易啊,如果你能跟着我坐到这里,那么恭喜你 codex 零基础教程就已经顺利通关了,我也很荣幸能帮到你。把 codex 从安装、配置、权限一路讲到 skill, mcp、 plugins, 最后完成了这套本地 lm vk 知识库。 这一期只是基础篇,后面还会有 codex 境界篇的教程,我们一起拭目以待。感兴趣小伙伴,期待你的三链支持。 智能指手段,人类才是答案。这里是头哥不请自来,我们下期再见,拜拜!