想让酷 max 像人一样操作电脑自动帮你干活吗?比如说分析后台数据,商品比价,整理客户信息,很简单,两步就能搞定。安装酷 max 之后,打开设置,找到电脑控制,装上这个插件,酷 max 就 可以操作你的整个电脑了。然后在对话里面输入 at computer, 告诉他你要做什么。比如说打开抖音后台,帮我看一下今天的数据变化,他就会自己打开页面,点击处理分析数据, 你只需要等个几分钟,看一下最终结果,全程不需要你参与以前那些琐碎的破事,现在你只需要把目标说清楚, qx 就 能够自己把它跑完,省下来的时间精力,你就可以去做那些真正需要你去做决策的事情了。
粉丝2701获赞1.7万

codex 有 三种方式可以操控电脑,替你干活,哪种最适合你?它们各自的能力、边界又在哪里?前 mate 数据科学家,现任 open ai 开发者、体验工程师 jason 刘刚刚发布了一篇帖子,把这三种方式的应用场景、功能、特点都讲清楚了。首先第一种方式, computer used, 这是目前 agent 操控电脑能力最强、应用场景最广的功能,也是让 codex 在 一众 agent 工具里杀出重围,温顶王者宝座的关键原因。 computer use 可以 模拟你在电脑上的大部分操作,不论是微信飞书还是 excel 剪映,只要是鼠标能点击,键盘能输入的地方,它基本都可以操控。 他目前在 mac 和 windows 上都可以使用,任务涉及多个软件时,也可以在不同应用之间切换操作。 jason 留举了一个真实案例,有一次他的包裹被偷了,但亚马逊客服需要等二十五分钟才能接通。于是他让 codex 每五分钟查看一次客服窗口, 等客服出现后改成每分钟检查一次,并尽力申请退款。等 jason 洗完澡回来,退款已经办好了。这就是 computer use 最狠的地方,它不是只能帮你写代码,而是真的能替你守着一个窗口,盯着一个流程,把那些烦人但必须有人处理的事情接过去。当然, 它的问题也很明显慢,因为每一步都要先看懂界面,再判断按钮在哪里,最后才能点击或者输入。这种视觉循环很耗时间,所以它不适合追求极致效率的任务,但特别适合那些没有 a p i, 没有插件,只能靠界面完成的工作。 第二种方式, codex chrome 扩展程序,它适合处理主要发生在浏览器里的任务,尤其是需要登录状态的网站,比如飞书文档、淘宝商家后台、 b 站、创作中心,这些工具都依赖你的账号状态。 codex chrome 扩展可以直接使用你已经登录的浏览器绘画来操作。 它和 computer use 最大的区别是, computer use 是 看着屏幕点按钮。 chrome 扩展是直接进入浏览器工作流,它可以读取网页内容,也可以在多个标签页之间切换,比如先看数据,再比对信息,最后整理成一份结果。所以浏览器任务用 chrome 扩展通常会比 computer use 更快、更准。 筛选流,长期使用它检查私信、浏览新闻、收集反馈,并把有价值的内容保存到本地文件中,方便后续反复获取。但它的权限也更敏感,因为它用的是你的真实登录状态, 所以网站会把 codex 的 点击、输入和提交都当成你本人在操作。收集信息、起草内容可以交给他,但发送消息、确认付款这些动作最好还是你自己确认。 第三种方式,内置浏览器,它更适合开发者,尤其适合做网页前端页面和本地工具调试。比如你正在做一个前端页面,就可以让 codex 打开本地预览地址,检查布局有没有问题,按钮有没有错位,手机端有没有溢出。 看完之后它可以直接改代码,改完再重新打开页面验证。它最有用的地方是把写代码和看效果连在了一起, 所以内置浏览器不是让 codex 替你登录网站的,它更像是 codex 做网页和调试界面时的工作台。最后怎么选? 需要登录状态的网站任务用 chrome 扩展,需要操作桌面软件,或者跨多个应用切换用 computer use, 需要开发网页预览页面,调试界面用内置浏览器。 黑色流还强调了一点,如果任务可以通过插件或者 m c p 完成,就优先使用结构化工具,比如读取飞书文档,整理在线表格。直接用插件或接口,通常会比让 codex 去界面里模拟点击更准确。 也就是说, codex 操控电脑不是越像人越好,而是越能选对入口越强。真正强的 a 阵,不是拿到任务就傻乎乎去点鼠标,而是知道什么时候该调接口,什么时候该进浏览器, 什么时候该接管桌面。这才是 codex 最值得关注的变化,它早就不只是一个写代码工具了,而是在变成一个围绕电脑浏览器和本地项目运转的任务执行系统。你现在在用哪一个工具来帮助你提效?又对哪个功能最感兴趣? 我整理好了 json 流的原文,里面详细介绍了每种功能的安装和使用方式,需要的可以点赞。关注后加入我的粉丝群领取,期待我们一起用 ai 创造更多价值!

今天我们来讲讲大名鼎鼎的 codex, 相信大家都已经听说过这个软件了,这是 open nai 的 核心产品,对标 osarpic 的 cloud code。 codex 能做的事情非常多,它不仅能够帮你编辑代码、排查 bug、 执行测试,还能管理 gate、 操作浏览器,甚至能直接控制电脑完成各种任务,非常强大。不过功能越多,越容易让人抓不住重点,所以这期视频我会带大家系统性地过一遍。 codex 最核心的功能,帮大家建立起一套完整的使用思路。 整个视频一共分为三个部分,第一部分是基础篇,主要带大家快速上手 codex, 并讲解一些核心配置和使用过程中容易踩坑的地方。 第二部分是进阶篇,重点介绍版本控制、绘画管理,以及如何更高效的组织和推进开发任务。第三部分是扩展篇,我们会看看如何通过 plugin、 skill、 automation 和 mobile 等功能进一步扩展 codex 的 能力边界。 所有的功能点和对应的时间戳我都打到目录上了,大家可以按需跳转。好话不多说,我们现在开始。 首先我们要做的是把 codex 安装到电脑上面,我们可以打开这个页面,点击这里面的下载按钮,就可以下载 codex 了。下载好了之后,我们来打开它。安装过程呢,跟其他的普通软件一样,比如我用的是 micros, 那 直接把 codex 拖入到 applications 文件夹里面就可以完成安装了。 安装好了之后,我们来打开 codex。 打开 codex 之后呢,它首先会提示我们登录,它一共给了我们两个选项。 第一个呢是使用叉 gbt 账号登录,这需要你订阅叉 gbt 的 套餐。叉 gbt 呢,它提供了多种套餐,其中最常用的是我屏幕上面显示的这几个,主要是包括免费版 go 套餐、 plus 套餐和 pro 套餐。 你看屏幕上面的这几个套餐,从左到右价格越来越高,当然整体能用的 codax 额度也是越来越大的。 从目前来看,免费版和购套餐的 codax 额度应该差不多,但到了 plus 套餐,额度就会有着明显的上升, pro 套餐自然就更多了。 值得一提的是,即使你用的是免费版,系统也会给你一定的 codex 额度,只不过这个额度少的可怜,只能勉强够你施个水。所以如果你想真正上手体验一下它的能力,我建议你先订阅 plus 这个 plan, 它是二十美元一个月,可用量呢比较适中。 除了订阅套餐之外, openni 还提供了另外一个选项来使用 codex, 那 就是直接接入 api, 对 应的就是这里的 signing another way, 点击之后,它会提示你输入 openian 的 api key。 一 般来说,用 api 没有订阅套餐划算,而且呢,获取这个 api key 的 门槛也有点高,一般需要一张海外的信用卡,所以我建议大家还是订阅套餐来使用 codex。 具体的登录过程呢,我这里就不显示了,大家可以在这里选择适合自己的方式登录。登录好了之后,大家首先看到的就会是这样的一个界面, codex 首先会询问我们是干什么工作的,这里大家就按照实际情况来选就可以了。然后 codex 会提示把 cloud code 和 cloud co work 相关的配置都导到 codex 这里,我们先跳过,然后 codex 提示我们要不要试用 codex 手机版,我们点击这个 set up later, 待会儿呢,我会给大家演示这个功能,所以现在先不着急,现在呢,我们就算是正式的来到了 codex 操作界面,可以开始使用它了,我们来随便跟它打个招呼,看看能否正常使用, 可以看出 codex 已经可以正常使用了。下面我带大家做一个代办软件,并且在做这个代办软件的过程中为大家讲解 codex 的 各个功能点。首先我们要新建一个目录来存放我们的软件代码,让我们打开访答,在这里创建一个新的文件夹,就叫做马克笔记吧。 然后回到 codex 这里,点击 work in the project, 再点击 use an existing folder, 在弹出的对话框里面选择我们刚刚创建好的文件夹,然后再点击 open, 然后呢,你就会发现 codex 把项目目录改成马克笔记了, 这就代表 codex 后面会把代码放到这个文件夹里面。此时我们准备工作就已经是做完了,可以开始提需求了,比如说我们的需求就是使用 html 写一个笔记软件,软件界面分为左右两部分,左边是笔记列表,右边是笔记的内容, 最后我们提醒他注意做好测试,然后回车提交,这个时候呢, codex 就 会开始工作了,可以看出他在疯狂的给我们写代码,当然实际使用是没这么快的,因为为了节省大家时间,这里我做了加速,后面的问答流程呢,也都做了不同程度的加速处理,这个呢,大家知道就好了。 好, codex 暂停了,他提出他想要构建一个本地服务器来验证 html 笔记的效果。这里呢有三个选项,第一个选项是 yes, 这个呢很好理解,其实就是把这个本地服务器启动开就可以了,不过以后如果 codex 提出类似的请求,我们还得再授权一次。 第二个选项呢,是代表我们不仅同意,而且对于这种启动本地服务器的代码,以后呢也就直接执行就好了,不需要再经过我们授权了。第三个选项可以理解为不同意,它其实不是一个按钮,而是一个输入框, 我们点一下就能看出来了。在这里我们可以告诉 codex 自己希望的处理方式,比如只让它检查代码,不要启动本地服务器之类的。当然,如果你不同意,而且你懒得告诉 codex 原因的话,也可以直接点击这里面的 skip 按钮啊,这算是 codex 做了弱化的第四选项了。 好,所有的可选项我们都说完了,在这个地方我们就选择第一项 yes 就 好了。然后呢, codex 就 询问我们能不能访问这个新创建的本地服务器,这个地方呢,我们也同意, 呃,现在 codex 已经彻底完成它的工作了,可以看出这里面最重要的文件呢,就是这个 index html, 我 们可以点击来预览它的效果。 这个呢就是 codex 写的笔记软件了,看起来中规中矩,各种基本功能呢,在这里面都能找到。当然有些人可能觉得这个预览区太小了,想要放大一点,这当然是可以做到的,让我们来点击这个按钮, 这样左边的区域就被收起来了,可预览的空间就更大了,不过下面的这块区域看着也是有点碍事,能不能隐藏它呢?其实也是可以的,我们可以点击这里面的三个点, 然后选择其中的 hide composer 就 好了,你看这样呢就好多了。那假如说这个时候呢,你看着界面里面的这两条笔记,觉得非常碍事,你想把它们去掉, 呃,这个呢,其实也是很简单的,我们就继续追问就好了。既然要追问,我们就必须要把左侧栏再次显示出来,这个呢其实很简单,我们再点一下这个按钮,左侧栏就显示出来了。 然后呢,我们就可以在输入框里面输入我们的问题,把左上角的两条笔记去掉,这个呢肯定是可以的。 呃,不过我这里想给大家演示另外一个方法,另外一个更加准确,更加方便的方法,我们可以点击这个图标,它叫做 annotation, 然后我们就可以直接选中两条笔记这个区域,选中后,输入我们对这个区域的修改意见,很简单,我们的意见就是两个字,去掉, 然后我们提交请求。好,可以看出请求已经成功提交上去了,可以看到他一共是发了两块内容,一个呢是对应的截图,另外一个呢就是我们具体的要求了。 接到了这个请求之后, codex 就 开始工作了,他应该呢就会把这块区域给去掉,让我们稍微等待一下。 好, codex 已经完成了,我们再次打开这个阅览区,看一下效果, 可以看出之前的这块区域呢,确实是没有了, codex 已经帮我们解决问题了,看起来 entity 这个功能还是非常方便的, 那这个时候我们可以再随便点点这个笔记软件,看看有没有其他我们需要修复的问题。这里好像确实有个 bug, 我 点击这个加号按钮的时候,下面呢是要增加一个新的笔记的,但实际上点了之后并没有任何的 bug 呀。让我们跟 codex 说一下这个问题, 我们需要告诉 codex, 点击添加按钮之后,笔记列表区域没有任何的反应。呃,请排查下原因,我确定之后再进行修改 好。 codex 已经排查完了,按照我们的要求,他没有直接去改代码,而是先给出了诊断结果。他猜测呢,这个问题大概率是因为当前页面的 local storage, 也就是本地存储被禁用了。 没错,就是这个原因。说白了,就是 codex 的 右侧预览区有一些安全限制,导致某些功能无法正常使用。如果我们到独立的浏览器里面用一用,问题立马就消失了,不信我们试一试。 你看这个时候再点击添加按钮是不是就完全正常了?既然用户是在真实的浏览器里用我们的软件,而不是在 codex 的 预览区里用,那这根本就不算是个问题,自然也不需要修。 我不知道这算是 codex 的 一个 bug 还是一个 feature, 我 相信 openai 是 把它当成 feature 来做的,不过实际用下来确实有点像 bug。 如果你做的也是外部应用,那一定要额外留意这一点,别被预览区给骗了。既然弄清楚了原因,为了避免再受限制,我们后续就在独立的浏览器页面里面进行测试了。 到这里,这个最基本的笔记软件就算是成功跑通了。现在我想回头聊聊刚才遇到的一个细节,就是 codex 提出的那个请求。 呃,有些同学可能会想,如果我把任务交给 codex 之后去忙别的了,没注意到他在等我授权,那 codex 岂不会一直卡在那里等我回来一看啥也没干,白白浪费了大量时间。 那这有没有办法让他自己做决定,别总是来问我呢,毕竟谁也不想一直盯着他干活,那也太累了吧。没错,一直盯着看呢,确实是非常的麻烦。其实 codex 早就替我们想到了解决办法,就在输入框的下面,大家看这里面呢,一共是有三个全线选项。 第一种就是我们刚才用的 default permissions, 在 这种模式下,如果 codex 需要修改项目目录之外的文件,或者是需要执行一些带有安全风险的命令,它就会老老实实地弹出提醒,只有当你点头同意了,它才会继续接着往下干。 这种模式的优点呢是绝对安全,一切尽在掌握,但缺点也非常明显,就是根本离不开人,你得随时给他授权。 第二种呢是 auto review, 也就是自动审查。这个模式呢很聪明,它引入了一个专门负责安全审查的 agent, 当 codex 准备执行操作的时候,这个 agent 会首先替你把关,安全的直接放行,危险的直接拒绝,只有在极少数连 agent 也拿不定主意的情况下,才会弹窗让你来做决定。 第三种呢是 full access, 顾名思义,这个呢就是放飞自我模式,全部自动同意, codex 想干嘛就干嘛,完全不需要你插手。 这个模式确实是最省心的,但也伴随着风险,万一它误删了什么重要数据,你是拦也拦不住的。虽然 gpt 模型总体上还是非常靠谱的,基本上不太会乱来,但是作为一个负责任的 up 主,我还是要提醒大家,这个模式呢,没有任何的安全,交易开启前一定要三思啊。 所以综合看下来,在这三个模式里面, auto review 是 在效率和安全之间平衡的最好的。为了避免后面频繁弹窗,要我们点同意,接下来的演示呢,我们就统一的切换到 auto review 模式。 既然聊到了这里的权限配置,我们不妨顺便看一下输入框旁边还有哪一些配置。首先大家留意这里面显示的五点五 medium, 这代表我们当前使用的是 gbt 五点五模型,思考深度呢为 medium, 也就是中等。 我们点开它可以看到思考深度呢是可以自由调节的,分为 low、 medium high 和 extra high 四个级别。思考深度越高, codex 花费的时间也就越长,消耗的 token 呢也就越多,但通常给出来的代码质量也会更好一些。 除了调整思考深度,我们还可以在这里面切换模型下来。列表里面除了 gpt 五点五,还有 gpt 五点四等等一系列的模型,大家可以根据具体的任务难度来灵活选择。 最后啊,这里面还能设置模型的输出速度,目前是 standard, 也就是标准的速度。旁边呢还有一个 fast 选项,开启 fast 模式之后生成的速度呢会提升到原来的一点五倍,不过代价呢是 token 的 消耗量也会相应的增加,具体增加多少取决于你用的模型, 比如说在 gbt 五点五这个模型下开启 fast 模式的话, toc 的 消耗量就直接是标准模式的两倍了啊。如果你财大气粗, toc 管用,那你完全可以开启这个快速模式,这样 codex 干活就更快了。 输入框的配置我们就先研究到这里,现在我们的第一版笔记软件已经跑通了,实现了最基本的功能,不过为了防止后面新加功能的时候把代码搞乱,我们最好先用 get 把当前的版本保存一下,这样的话就算是后面出了什么叉子,也能够随时回滚到这个可用版本。心里有个底, 在 codex 里面调用终端非常的方便,我们不需要去点什么菜单,直接按下快捷键, command 加 j, 大家看右侧的终端面板就直接弹出来了。在这里面我们依次输入几条常规的 get 命令, 首先是要执行 get in it, 点把当前的项目目录出示,化为一个 get 仓库。然后呢我们要执行的是 get id, 点把相关的文件呢都添加到暂存区里面。最后呢再执行 get commit 提交我们的第一次修改 好这三步敲完之后,我们的代码就有了一个安全的备份版本,接下来我们就可以放心大胆地继续迭代我们的产品了。 终端用完之后,为了不挡着视线,我们只需要再次按下同样的快捷键, command 加 j 就 能够把它直接关掉。你看用快捷键来开关终端,双手完全不需要离开键盘,整个过程呢非常的丝滑,也是非常的方便。 那现在我们用 codex 做了一个基本可用的笔记软件,而且还用 get 提交了这个可用版本,下面呢,我们就来继续迭代这个笔记软件,让它变得更强大,更美观。 假设这个时候你看了看这个笔记软件,觉得它的色彩设计不是很好,这里面有很多的绿色元素,你不太喜欢绿色,你想试试蓝色怎么样?那这个时候该怎么处理呢?很简单,你就直接在这里面追问就好了,比如我们可以这么提要求, 不过我们先不发送这个请求了吧。啊?为什么呢?你仔细看看啊,我们上一个消息里面还让 codex 排查问题来着, 但说实话,这其实并不是一个问题,只是 codex 的 浏览区有些限制而已。如果我们继续追问的话,这个排查过程不仅会占用模型的上下文,而且可能还会对 codex 后续执行产生一些影响, 他没准会继续尝试修复这个问题,把原来没有问题的页面修出问题来。虽然这种情况发生的概率应该也不会很大,但是能规避的话就尽量规避吧,毕竟这个消息其实一点用也没有。 所以我们该怎么办呢?有一个办法,那就是直接修改上一个消息就可以了,你看这里面有一个编辑按钮,我们点一下就可以直接修改这个消息了,我们来试试 提交。你看原来的请求被替换成了我们的这个,这样的话,原来排查问题的那个消息呢,就消失了,既然消失了,它就不会再占用模型的上下文了,也不会对 codex 后续执行产生任何影响, 所以很多情况下,这个功能还是很实用的。不过要注意的是, codex 只支持编辑最后一条消息,至于更靠前的那消息,它实际上是不支持我们编辑的。 前面的那些消息呢,都是没有编辑按钮的,如果你要编辑更靠近的消息,可以考虑使用 fork 功能来间接实现这个功能。我们后面会讲到,暂时你不必过于关心好。 codex 已经完成任务了,我们来看看效果。 呃,还可以吧。下面呢,我们把这一部分的改动也加入到 get 里面。之前我们是用命令行来操作 get, 这种操作方式准确通用,不过其实 codex 也内置了一些 get 操作的功能来供我们使用。比如我们可以先点击这个图标, 这里面呢就有一个叫做 environments 的 区域,它呢就跟 get 的 使用密切相关。我们可以点击这里面的 changes 按钮,然后再在这个选择框里面选择 on stage 的 选项。这里显示的就是所有还没有提交到暂存区的代码了, 这基本上也就是 codex 刚才所做的改动。如果你觉得哪一行有问题,可以点击旁边的加号,输入你的要求。输入完要求之后,你可以点击这里面的 comment 按钮,让 codex 做出相应的改动。不过这里我们就不做任何修改了, codex 的 任务已经完成的很好了,所以我们取消这个注示, 直接使用 git commit 提交这次改动。那具体该怎么做呢?很简单,直接点击这里面的 commit 按钮,输入 commit 的 message 就 可以了。我们的 commit message 就是 将整体色调改为蓝色,然后呢,再点击 continue, 此时 codex 就 会提交当前所有没有提交的改动了。 好,执行成功了,我们来验证下。先按一下 command 加 j 来到终端,然后再执行 git log, 查询 git 的 commit 记录。 你看,我们的 commit 确实是生效了,确认好了之后,我们按 q 退出 get log, 然后呢,再按 command 加 j 来隐藏终端,到这里,这个需求就算是彻底完成了。那假设这个时候你感觉蓝色这个主题也不怎么好看了,越看越不顺眼,要不再换一个吧。 没问题,我们直接提交需求,将整体色调改为紫色。改完之后呢,再做一次 get commit。 对, 这次我们不自己操作 get 了,有点麻烦,直接让 codex 操作得了。提交之后, codex 就 开始干活了,我们稍微等待一下, 改好了,我们来看看最后的效果。不错,确实改成紫色了,不过怎么说呢,啊,你觉得还是不顺眼啊,你在想,算了,我要不还是改成一开始的那个绿色吧。那这当然是可以的, 照例啊,你可以直接在输入框里面输入,你的要求就是改回来的紫色。这个呢,肯定是行的,只不过这样的话,模型还得再跑一遍,有点浪费 token, 所以 我们就不用这个方法了。 其实我们原来就是绿色,所以用 get 把代码回滚到绿色的那个版本就可以了。只不过这种做法其实也是有点缺陷的, 代码确实是回滚了,但绘画内容还是停留在紫色这里。如果我们希望在当前这个绘画继续问的话, codex 可能会以为目前所用的色调是紫色,从而对后续的任务执行效果产生负面影响。 那我们能不能把绘画和代码同时回滚呢?我们就想回滚到改蓝色之前的那个版本,也就是这个版本,如果有回滚功能的话,那应该是在这个消息旁边有一些相对应的标识吧,我们找找。 哎,还真的有一个图标有点像,不过它不叫回滚,它叫做 fork。 fork 的 意思就是基于当前的这个绘画,再复制一个新的出来,这个新绘画就只到目前所选的这个消息为止,后面的消息全都不保留, 这个呢就非常符合我们的要求了,我们其实就希望绘画到当前的这个消息为止,那既然绘画变了,代码是不是也会自动回滚呢?没准也是可以的,我们来试试。 我们首先点击这个 fork 图标,这里弹出两个选项供我们选择,一个是 fork into local, 另外一个呢是 fork into new work tree。 这两个选项的最大区别在于新绘画的代码存放地址不同。 第一个选项会继续使用当前目录作为新绘画代码存放地址,第二个选项会创建一个新的目录来存放心绘画的代码。你可能现在听的还是有点懵啊,没关系,我来演示一下你就知道了。在演示之前,我们先把左侧栏打开,这样你就会看得更清楚一些。 好,左侧栏打开了,我们来重新点击一下这个 fork 图标,然后选择第一项 fork into local。 可以看出 codex 确实给我们创建了一个新的绘画,并且还在这里标识好了,这个绘画呢,就是从别的绘画那里复制出来的。下面我们来看看代码是否也会滚了, 这个很简单,我们不必看代码,我们直接看最终的效果就行了。让我们来看看页面的颜色有没有改变,可以看出页面的颜色仍然是紫色,所以呢,代码根本就没有回滚。没错,这呢就是 fork into local 这个选项的特点,它只会处理绘画内容,根本就不会对代码做任何修改。 不过还好,我们使用了 git, 我 们可以用 git 来回滚代码。我们先按快捷键 command j, 打开终端,然后执行命令 git log 确定我们想把代码回滚到哪个 commit 上,应该就是这个了。然后呢,我们复制这个 commit 的 哈希值, 最后执行这个命令。这样呢,就可以把代码回滚到绘画对应的那个版本了。让我们回到浏览器这里刷新一下页面, 没错,确实是一开始的绿色版本了,当然绿的也不是很明显啊,只有那么几个模块是绿的。我对这个色调的表述呢,稍微有点问题,但无论怎么样,肯定是回滚成功了,相信大家都能看得出来,这个呢就是 fork into local 了,我们配合着 git, 才能把绘画和代码都回滚到之前的那个状态。 那刚才还有一个选项叫做 fork into new work tree, 那 个选项是用来干什么的呢?我们不妨来试试。让我们回到之前的绘画里, 点击这个 fork 图标,然后再选择 fork into new work tree。 注意看, codex 依然给我们创建了一个新的绘画,而且跟 fork into local 很 像。这个新的绘画呢,也标识出来了,它就是从别的绘画里面复制过来的。 一切看起来似乎都跟那个 fork into local 差不多啊,那到底什么发生变化了呢?答案就是我们当前的这个绘画所对应的项目目录发生了变化,不信我们来打开终端,输入 pwd, 这个命令就是用来显示当前位置的,可以看出我们的当前位置呢,就是这个了,我一开始 fork 出来的那个绘画可不是在这个目录里面操作的,不信的话,我们回到一开始 fork 出来的那个绘画里,同样打开终端, 运行下 pwd, 你 看它俩的项目目录地址是不同的,我把这两个地址打在屏幕上,这样大家就可以看得更清楚一些。 这个呢,就是 fork into new worktree 的 一个特性,它会给 fork 出来的新绘画创建一个对应的新目录,这样新老绘画所处理的代码不是一份,彼此之间互不影响,非常适合在两个绘画分别处理两个不同的功能点,最后做完了再合并到一起就好了。那为什么叫做 worktree 呢? 是因为它是使用 gitworktree 来实现的,这个呢,是 git 的 一个特性。这个要展开讲的话呢,又得讲好几分钟。我们本期是来讲 codex 的, 不是来讲 git 的, 所以呢, gitworktree 在 此就跳过了,感兴趣的同学可以自己查下。 另外值得一提的是, fork into new worktree 同样不会回滚代码,它只是把当前项目目录里面的所有代码复制到一个新的目录里,仅此而已。 好,这个就是 fork 的 两种形式了。总结一下,这两个选项都会复制绘画到所选消息为止,也都不会帮你回滚代码, 它们唯一的区别仅仅是代码的位置, local 呢,是继续沿用原目录,而 new work tree 呢,则是开辟了一个全新的隔离目录。主要呢,就是这个区别了。所以呢,无论是哪一种 fork 形式,都不会更改代码。实际上 codex 在 界面里面也有显示, 我们可以回到一开始的那个绘画。然后呢,再点击一下这里面的 fork 图标。注意到这段话了吗? 其实它想表达的意思就是 fork 只负责对话,不回归代码。对,它说的有点绕,但其实就是这个意思。 好, fork 功能我们终于讲完了,我们目前只需要第一个 fork into local 的 这个绘画,另外一个 fork into work tree 我 们暂时不需要。那我们能把这个绘画删掉吗?能, 不过准确来说啊,我们可以把这个绘画规章,规章和删除稍微还是有些区别的,你可以把规章理解为暂时隐藏起来了,而删除呢,那就是删完就没了。我们来试一下, 我们直接点击绘画旁边的这个图标,然后再点击 confirm, 这个绘画就被规范了。你看这个绘画是不是没了。但跟删除不同的是,我们还可以找回这个绘画。 我们先按 command 加逗号,打开设置面板,再点击里面的 archives chats, 在 这里我们就可以看到所有被规章的绘画了。我们可以解除对应绘画的规章状态,也可以彻底删除对应的绘画。所以你看,删除和规章还是稍稍有些区别的。 那规章这个功能我们就讲到这里,从之前的操作过程中我们可以看出, get 真的 还是挺重要的。那既然这么重要,我们能不能让 codex 每次写完代码的时候都能自动提交一次 get commit 呢,这样的话就不用麻烦我们每次都操作一遍了。 这当然是可以的,其中一个方法就是我们可以直接在输入框里面告诉 codex, 每次完成代码修改之后,都需要提交一次 get commit, 然后提交这个请求就行了。这样在后续的操作里面, codex 肯定就会按照我们所说的,每写完一次代码都提交一次 get commit。 不 过这个方法有个很大的缺陷,那就是它只会在当前的绘画中生效,如果我们创建出一个新绘画的话,那 codex 就 会彻底忘掉这个事情, 所以我们需要一个能够跨绘画的解决方案,即使是在一个新绘画里, codex 也能帮我们做 get commit 这个事情,这能做到吗?当然是可以的,这个呢就是 agent 点 m d 这个文件发挥作用的地方了。 agent 点 m d 简单来说呢,就是一个放在项目根目录里面的配置文件,每当 codex 开始一个新绘画的时候,它都会自动读取这个文件,把里面内容当成对自己的指令来执行, 所以我们只需要在这个文件里面写上这个 git commit 的 要求,那无论我们开多少个新会话, codex 都会记住这件事情的。我们先把原来的这个请求删掉,我们不需要它了,然后我们点击这里使用 vs code 打开这个项目目录, 在根目录下创建一个新的文件,就叫做 agent 后台,然后在这个文件里面写,每次完成代码修改后,都需要提交一次 git commit, 这样 agent dmd 就 创建好了,让我们把 vs code 关掉,现在让我们来验证一下 agent dmd 是 否真的会生效。我们首先创建一个新的绘画, 然后提交需求,往左下角增加一个主题切换选项,支持用户在浅色模式和深色模式之间切换。回车提交,让 codex 开始工作。 好, codex 已经完成了,我们来看看效果。 你看,左下角确实是出现了一个主题切换按钮,我们点击对应的主题,就可以在浅色和深色两种模式之间切换,看起来非常完美。那我们现在最关心的是, codex 有 没有帮我们做 get commit 操作呢?我们按一下 command 加 g, 打开终端执行 get log 来看看。 你看,这里面确实是多了一个新的 commit message 呢,就是 codex 自己写的,这说明 agent 点 m d 确实生效了。即使是在一个全新的绘画里面, codex 也遵从了我们的要求,在完成了代码修改之后,自动提交了一次 git commit。 这个呢就是 agent d m d 的 基本用法了,当然他能做的事情远不止这一件,比如你可以在里面规定代码风格、命名规范、技术占要求,甚至是你的项目背景介绍等等。 codex 每次启动新会话的时候都会去读取这些文件,这样他对你的项目就会有非常好的理解,给出的结果呢也会更加准确。 可以说, agents dmd 写得越好, codex 就 会用起来越顺手。不过需要注意的是, codex 只会提交当前需求所对应的代码改动。我们一开始创建的 agents dmd 不 属于当前需求的范畴,所以呢,刚才 codex 并没有把它提交为一个 git commit, 我 们点击这个 changes, 再选择 on stage, 就 可以发现 agents d m d 的 内容呢?还没有提交上去。没事儿,我们这就提交。我们先来点一下这个 commit 按钮,然后在里面输入对应的 commit message, 再点击 continue, 这样这个改动就会被提交到 get 上面了。好,一切顺利,让我们新开一个绘画,继续迭代这个笔记软件。 现在这个软件本质上就是一个 html 文件,只能在浏览器里打开,不够方便。我们想把它改造成一个真正的桌面客户端,让用户可以直接双击图标打开,就像打开 vs code codex 一 样。 那要做桌面客户端的话, electron 是 非常主流的一个选择,我们可以顺便呢也引入 react 和 type script, 把项目结构整理一下,方便后续继续迭代。那我们就直接把需求发给 codex, 把这个网页应用改成桌面客户端,进入站使用 electron 加上 react, 再加上 type script。 注意做好测试,确保所有的核心功能运转正常 啊。不过要注意这可是一个大工程,所以呢,我们最好先让 codex 做一个规划,我们确认规划没有问题之后,再让它动工。为了实现这一点,我们可以点击这里面的加号,然后选择 plan mode, 这样 codex 就 进入了计划模式,从这个图标也可以看出这一点。 在这个模式下, codex 会先做计划,再写代码,让我们来提交试试。可以看出 codex 开始工作了,让我们稍微等待一会。 好,他现在要问我们几个问题,我们来做一下选择。首先是数据要放在哪里,我们就放到文件里面吧, 然后交付到可开发运行的程度就可以了。这之后呢, codex 就 会继续开始干活了。好,可以看出 codex 开始给我们写这个计划了, 我们再稍微等待一会,它还在这个转写的过程中。 好,写完了,我们来看一下,这个计划本身还是比较完善的。呃,包括各种测试方案呐,架构设计啊,都是写的比较详细的。然后 codex 问我们是不是要按照这个计划去实现代码。 呃,他一共是给了我们两个选项,第一个选项呢就是直接同意啊,开始实现这个计划就好了。第二个选项呢是如果你对这个计划不满意的话,你可以提出你的要求,在这个文本框里面告诉 codex 应该如何做修改,然后 codex 会根据这个修改呢,再出一份新的计划。 呃,这里面呢,我们就不对计划再做一些其他修改了,我们就直接同意好了,让 codex 就 按照这个计划给我们来写代码。 好,现在 codex 开始干活了,我们需要稍微等待一下,在等待的过程中呢,我们可以跟 codex 随便去聊点东西,我们可以在输入框 side 打开 side chat 啊,在这里面呢,我们就可以随便问 codex 点别的问题,这些问题呢不会去影响左侧 codex 的 任务执行。比如说我们可以问一下,你觉得这个笔记软件还需要什么基本功能呢?提交 好 codex 呢,给了我们一些可行的方案。你看在 side chat 的 过程中, codex 左侧的任务执行一点也没有被干扰到。对,这个呢就是 side chat 的 一个非常重要的特点了,它就是允许用户在 codex 执行任务的过程中问一些比较轻量级的问题, codex 在 回答这些轻量级问题的过程中不会影响到左侧主任务的执行。那这个就是 sign chat 这个功能的特性了。这个呢,我们就先讲到这里,这个架构改造的工作量还是挺大的, codex 依然没有完成,让我们再耐心等待一会儿。 好,看起来 codex 已经完成任务了,它提示我们使用 npm runtime 这个命令就可以启动这个 electron 应用啊,让我们来试一下。首先按 command 加 j 打开终端,然后执行命令 npm runtime 回车, 这样的话这个 electron 应用就启动开了,不过看起来好像是有点问题,基本上是一个白屏的状态。呃,我们打开控制台看一下有没有什么报错 啊,确实有报错,这个呢,我们需要让 codex 帮我们来修一下啊,让我们来回到 codex 这里, 先把这个进程关掉,然后呢再把终端关掉,然后我们提出我们的诉求,启动后白屏控制台报错了。看来你之前的测试不够彻底啊,请你修复并确保在修复之后测试好再交付给我。 codex 说,我说的对,哼。呃,让我们等 codex 把这个错误修复之后再试一次。 呃,看起来 codex 已经修复好了,我们来看一下它修复后的效果是怎么样的。呃,同样,我们打开终端,然后执行这个命令 啊,这次呢,看起来没问题了,添加笔记呢也是可以的,我们呢也可以在这里面随便输入的标题内容都可以啊,主题切换也是没有问题的。 那看起来已经很完美了,各项功能都运转正常。让我们再回到 codex 这边。 呃,我们先按一下 ctrl 加 c, 关掉这个进程,然后呢,再把终端收起。好,那改成了 electron 架构,我们就继续来提新的需求。我们的新需求是为这个笔记应用增加 markdown 支持,具体来说,需要在编辑器右上角提供两个模式切换按钮。 那假设这个时候我想换行,怎么做呢?直接按回车肯定是不行的,按回车就提交了,正确的做法是按 shift 加回车。你看这样呢,就可以回车了。我们继续输入任务内容, 首先是编辑模式,显示所有文本内容,并对其中的 markdown 语法进行高亮显示。然后还有一个是预览模式,它用于显示 markdown 的 渲染结果。现在再回车。 好,可以看到 codex 开始工作了,在它工作的间隙,我们再创建一个新的绘画,让它再处理另外一个关系不大的任务。 我们的新任务就是给这个笔记项目生成一个 logo, svg 格式。可以看出这两个绘画都在工作中了。假设这个时候你突然想到了我们的笔记软件有深浅两种模式,这个 logo 需要在任意一个模式下都清晰可见。我们最好提醒一下 codex, 以免它忘了, 好让我们发送请求。不过这个请求似乎没有发出去,它似乎卡在这里了。没错,在默认情况下,只有当上一个请求完成后, codex 才会继续处理下一个请求。 不过到那个时候就有点晚了吧,毕竟 logo 都生成好了。我们能不能现在就把这个信息发送给 codex, 让它在生成 logo 前就注意到这一点呢? 没问题,注意到这里的 steer 按钮了吗?点一下,我们的请求就会立即发送给 codex, 这样我们的目标就达到了。那 codex 现在还在运行中,我们稍稍等待一会儿。 好,可以看出 logo 已经生成完毕了。我们切回到原来的那个绘画,看看它的进度怎么样了,它还在运行中,所以我们可能还需要再稍微等那么一会儿。 好,这两个任务呢都完成了,我们来直接打开软件,看看最终效果。首先是要打开终端,然后呢,我们运行 n p m start, 打开这个 electron 应用。呃,看起来好像是有点问题啊。 logo 没有被成功地加载起来, 那我们需要跟 codex 说一下这个事情,让我们先关掉这个 electron 应用。 然后呢,我们关掉这个 electron 进程,先看看这个 logo 在 不在 啊?这个 logo 确实是在 public 文件夹里面的,那应该不是文件不存在导致的。那是不是这个 svg 文件的格式有问题呢?我们来到访达来验证一下。 打开这个 public 文件夹,看来这个 svg 文件的格式也是没有问题的,毕竟访达都正常渲染出来了。 那大概率是 electron 加载这个 svg 文件的方法有问题。让我们来让 codex 修一下。首先按 command 加 g, 我 们唤起这个绘画列表,然后选择生成 logo 的 那个绘画, 然后在这里面我们输入具体的问题, logo 没有显示出来。提交好,提交之后呢, codex 就 开始给我们排查原因了,我们再稍微等一会儿。 修复完毕,我们再次启动这个软件看看效果。 首先打开终端,运行 npm start 好, 这次看起来 logo 是 成功的显示出来了,我们还可以随便点一点其他的功能,看看整体是否运转正常。 那 markdown 呢?我们可以随便输入几个 markdown 的 关键词,看一看它的高亮显示是否正常。看起来似乎并没有什么太大问题,各种格式呢,都可以非常正常地显示出来, 可以看出预览也是没有问题的。那这次需求就到这里了,我们再次回到 codex 这里,继续迭代它。 前面我们讲的呢,都是 codex 的 基本能力,下面我们来讲讲 plugging。 你 可以把 plugging 想象成一个 codex 的 外挂,它会给 codex 相应的能力,帮助 codex 去做更多的事情。这么说呢,可能比较抽象,我们可以来实战一下。呃,我们首先可以打开侧边栏, 然后点击里面的 plugins, 在 这里我们就能够看到所有可用的 plugin 了,其中有能控制电脑的,有用于操作 chromed, 还有用于编辑 excel 的 啊,还有一些是用来制作 ppt 的。 如果 plugin 的 旁边打了勾,那代表这个 plugin 已经被安装好了。如果 plugin 没有安装的话,旁边会是一个加号,我们点击这个加号就可以正常安装了。我们来随便点几个 plug in, 看看它内部到底有什么。 比如我们可以点一下这个叫做 gmail 的 plug in, 可以 看到这个 plug in 内部有三个组成部分,其中一个是 app, 两个是 skill。 这个 app 呢,是用来把 codex 和 gmail 连接起来的, 它里面提供了很多的工具,当然 codex 没有叫它是工具, codex 叫它是 action, 但其实本质上啊,这里面就是一个一个的工具,跟 mcp 的 工具呢差不多。 比如 apply labels to emails 就是 用来给邮件打标签的 archive emails 就是 用来归档邮件的。这个 app 一 共是提供了二十四个这样的工具,除了 app 之外,这个 plugin 还提供了两个 skill, 呃,你基本上是可以把 skill 当成是给大模型看的一个说明文档, 比如说是这个 gmail skill, 它就写明了怎么总结邮件内容,怎么赚,写回复,以及什么时候该调用哪一些工具啊等等。 而这个叫做 inbox treeash 的 skill 呢,则是告诉大模型如何给邮件归类的,比如说哪一些邮件比较紧急,哪一些邮件需要回复等等。如果你对 skill 比较感兴趣,可以看一下我的这个视频,把 skill 的 使用方法和运行原理一次讲明白。 gmail 的 这个 app 所包含的内容呢,就只有这三个了,我们如果选择安装 gmail 这个插件,那其实就是选择安装了这三个组件。等到用户想要 codex 操作 gmail 的 时候, gpt 模型便会找到这三个组件,并用它们提供的能力和说明来完成。用户的要求 大致就是这个样子的。我们来看一个具体的例子,比如说是 presentations, 这个 plugging 呢,是用来写 ppt 的, 它只有一个组件,那就是这个叫做 presentations 的 skill。 这个 skill 详细说明了该怎么做才能做出一个高质量的 ppt。 下面呢,我们就尝试用这个叫做 presentations 的 plugging 来完成我们的需求,让我们来新建一个绘画,然后输入我们的要求,给这个笔记软件做一个 ppt, 介绍它的产品设计和技术架构。 提交之后, codex 就 会找到我们前面所说的那个叫做 presentations 的 plug in, 并使用那个 plug in 提供的能力来做 ppt。 当然,如果你担心 codex 找不到这个 plug in, 或者说是找错了的话,你可以明确要求 codex 使用这个叫做 presentations 的 plug in, 这只需要在任务的最前面输入一个 at 符号,然后敲入 presentations 回车,这样 codex 就 一定会使用 presentations 这个 plug in 来做 ppt 了。 不过不加也没关系, codex 会自动找到这个 plug in 的, 所以呢,我们暂时就把它给去掉吧。好,提交,可以看出 codex 开始工作了,我们稍微等待一会儿, codex 写好了,我们打开看看。 中规中矩吧,其中其实还有不少可以改进的地方,不过这已经是一个不错的起点了,我们可以在这个基础上做一些其他的改进。 这个叫做 presentations 的 plug in 并不能算上经验。下面呢,我给大家介绍 open ai 所提供的两个用来镇店的 plug in, 一个呢是叫做 computer use, 用来控制电脑。另一个呢是叫做 chrome, 用来操作 chrome 浏览器啊,我们先来试一试 chrome 这个插件, 让我们来到这个插件管理的地方,然后呢,点击 chrome 旁边的这个加号来安装这个插件, 点击 install 好, 安装好了。然后呢, codex 提示我们需要在 chrome 上面也安装对应的扩展也行。好,那我们就按照它的指示来安装这个扩展。 那一切准备就绪之后,我们就来尝试用用这个 chrome 插件,我们可以直接点击旁边的这个按钮,这样的话, codex 就 可以给我们出实化一个使用当前插件的这么一个请求。呃,我们可以把后面的这个部分给去掉,换成我们具体的请求, 那就是打开 product hunt 首页,然后再找出今天最热门的三个新发布的产品,总结它们各自的特点,并附上对应的访问链接好提交。 呃,为了让大家看得更清楚,让我来把 codex 缩小一点,把 chrome 浏览器放出来,这样的话呢,大家就可以更清楚地看到 codex 到底是如何干活的了。 可以看到 codex 创建了一个标签组,这个标签组呢,专门用于解决我们的问题,然后它在这个标签组里面访问了 product hunt 的 首页,今天最热门的三个新发布的产品就在这里了,相信 codex 也看到了。 可以看到,现在 codex 开始打开另外一个标签页了,这个呢,看起来是第一个产品 brew 的 一个相关网站,然后呢,它又打开了一个。 呃,接下来呢,我们就不管了, codex 估计还会查看更多的网页,我们就在这里稍微等待一会,相信他等会就可以查询全部的产品页面,然后给我们一个比较有效的反馈,让我们稍微等待一下。 好, codex 给我们总结了,这个呢,基本上也就是我们想要的结果了,这个呢,就是 chrome 这个插件的相关使用方法了,让我们把这个 codex 再次最大化。 然后下面呢,我们就来看一看 computer use 这个插件的使用方法,它是用来操作电脑的,同样,我们点击这个加号,然后进行安装, 安装成功,让我们来使用一下。跟 chrome 的 使用方法类似,我们也可以点击 computer use 旁边的这个小图标,这样直接就能开启一个相关的 computer use 绘画。我们先把后面这段文本删掉,因为它跟我们真实的请求没有什么关系。 然后呢,我们再稍微改一下这个请求所对应的目录,我们现在呢是放在马克笔记这个地方,但实际上我们要打的这个请求呢,跟这个项目其实没什么太大关系,所以呢,我们就选择 don't work in the project, 也就是说,这就是我们随便提出来的一个请求,不会去绑定某个具体的项目目录。之后,我们就可以正式输入自己的请求了,那就是请打开我电脑自带的日历应用,帮我新建一个五月二十八日十点的日程标题,叫做讨论马克笔记的后续设计。 没错,就是这样,我们让 codex 操作一下日历这个应用,然后同之前一样,我们把 codex 缩小,把日历这个软件漏出来。这样呢,大家就可以更清楚地看到 codex 是 怎么操作我们这个日历软件的。 好, codex 首先询问我们能不能使用日历这个应用,我们同意, 可以看出 codex 开始行动了,这个呢就是 codex 的 鼠标,它跟我们所使用的鼠标呢,根本是两套,彼此之间互不影响啊。然后 codex 呢就开始操作这个鼠标,去完成我们的需求, 它还需要我们确认一下是不是真的要创建这个日程,这个有点啰嗦,那当然是确认了,我们给它回复一下, 好,看起来 codex 已经完成了我们的要求了,我们来看一下, 看起来这个日程的标题和时间段都是满足我们要求的,那就没问题了,我们再把 codex 最大化。 这个呢,基本上就是 computer use 这个插件的使用方法了。值得一提的是, codex 使用独立的虚拟鼠标,与你的鼠标互不干扰。刚才把日历软件提到前台只是为了掩饰,实际上你完全可以让它在后台默默干活,自己该干嘛干嘛,上网看视频都可以,完全不会耽误。 好, computer use 讲完了,我们接下来就来看看 skill 是 如何使用的。想要浏览 skill, 我 们就必须要先打开 plugins, 然后再点击这里面的 skills, 就 可以看到可用的 skill 列表了。 其实我们之前用 plugin 的 时候已经间接的用过 skill 了,因为无论是 presentations, computer use 还是 chrome, 这几个 plugin 的 核心组建呢,都是 skill, 你 在这个 skill 标签下面都能找到。 当我们安装对应的 plugging 的 时候呢,我们都会把相关的 skill 一 块儿安装好,所以我们在这里都能找到这些 skill。 不 过有一个王牌级的 skill 是 单独列在 skill 这个标签下面的,它并没有一个对应的 plugging。 这个 skill 呢,就是 mhgen, 它是用来生成图片的, 相信大家对 g p t 的 生图能力早有耳闻,不仅美观,而且非常的真实。下面呢,我们就来使用这个 skill 来创建一个图片。我们在马克笔记这个项目下新建一个绘画,然后输入我们的要求,给这个笔记软件生成一个宣传海报图片,注意要使用我给你的真实的软件截图。 然后呢,我们需要给 codex 相应的软件截图,我们先按 command 加 j 打开终端, 然后执行 npm start 命令来打开我们的笔记软件, 然后我们回到 codex 这里,点击加号,再找到其中的 attach electron 这个选项,这里面的 electron 其实就是我们的马克笔记软件了, 我们的这个笔记软件就是用 electron 做的,所以呢,在 codex 里面看来,这个笔记软件就叫做 electron, 我 们来直接点击这个选项,点击之后呢, codex 询问我们是否要启用这个功能,我们点击 enable, 然后我们的马克笔记截图就到了聊天框里面了,这样 codex 在 做海报的时候就可以根据真实的软件截图来做了,是不是很方便呢?点一下按钮就可以把截图放进来了, 不过这个还不是最方便的, codex 还提供了一个快捷键,按一下就能够把截图传过来。我来给大家演示一下,我们之前给 codex 的是浅色模式的截图,我现在在给 codex 传一张深色模式的,我们回到马克笔记这里,调到深色模式, 然后重点来了,左右 command 键同时按下,这样深色模式的马克笔记截图也传给 codex 了,这个确实更加方便了吧。好,现在 codex 有 了浅色和深色两种模式的截图,我们可以让它开始做海报了。提交, 首先我们可以注意到 codex 会使用 image 这个我们之前提到的技能来做这张宣传海报,然后我们就再等等,看它能画出什么样子来。 画完了,我觉得还行吧,确实是基于我们的截图来做的,不知道你觉得怎么样呢? 除了使用 codex 给我们安装的 skill 外,我们也可以创建自己的 skill。 让我们按 command 加 n 新建一个绘画,然后输入我们的任务,写一个代码审核 skill, 专门给当前的项目使用。这个 skill 应该包含如下的规则。好,我们提交 可以看到这个 skill 已经做好了,它的名字就叫做 marknotes code review。 下面让我们按一下 command 加 n 新建一个绘画,试试这个 skill 的 效果。首先我们 at 这个 skill, 然后提出我们的请求,检查当前项目的代码是否有问题。好,可以了, 结果出来了,还可以,我们还可以让 codex 根据审查的结果来修改代码。这里呢,我就不再继续演示了, 我们的笔记软件每天都在迭代,每天都有代码更新,所以我们最好能每天定时检查一下代码,看看有没有什么问题。这种场景就很适合起一个定时任务来处理。 codex 也提供了这样的功能,让我们来点击这里面的三个点, 再点击 add automation。 呃,也就是添加一个定时任务。这里呢是定时任务的标题, codex 已经帮我们填好了。这里呢,填写发起定时任务的时候,我们需要发给 codex 的 要求,我们的要求呢就是检查当前项目的代码是否有问题。 然后下面呢是执行环境,一共是有三个选项,分别是 local, worktree 和 chat。 local 呢是在某个项目目录里面运行这个定时任务 worktree 是 基于某个项目目录创建一个新的 worktree, 这个定时任务就在这个新的 worktree 里面运行。 worktree 的 概念我们之前讲过,它是 get 的 一个概念,如果你还是一知半解的话,可以先不管,我们这里不用这个选项。 chat 呢是执行环境,不跟任何项目目录绑定,我们之前用 chrome plugin 搜索网络的时候,实际上是用过 chat 环境的, 这里最适合我们的是 local, 毕竟我们的定时任务就是要扫描马克笔记的项目代码,所以一定是要跟某个项目目录绑定起来的。让我们选择 local, 然后在这里面选择马克笔记,然后这边呢是运行频率,我们选择 daily, 具体的时间呢,我们就维持在九点钟,意思就是我们这个定时任务在每天九点钟的时候启动, 下面呢我们选择模型 g b t 五点五,推理强度呢,我们就维持目前的 medium 就 好了。然后我们点击 save, 再打开左边栏, 我们就可以看到 automations, 这里面多了一个一。点击之后就可以发现我们创建的定时任务了,它会每天十点开始运行,每次运行的时候都会创建一个新的绘画,我们可以点击这个按钮试运行这个定时任务, 可以看到一个绘画创建出来了,就是用来运行这个定时任务的,我们来打开看一下, 好,可以看到这个定时任务已经完成了,后面每天跑的也都是这个样子了,那这个就是定时任务了。最后我想给大家讲讲 codex 的 一个特别有用的功能,那就是 codex mobile, 具体来说就是我们可以在手机上操纵 codex 来给我们完成任务,让我们来点击这里面的 codex mobile, 再点击 allow 允许手机操纵这台电脑, 然后再点击弹,点击完弹了之后, codex 应该会给你显示出一个二维码来。 呃,如果你像我这样没有显示出二维码的话,可以点击这里的手机图标,这样二维码就出来了。随后我们需要打开手机摄像头扫描这个二维码。然后呢,我们就会被引导到叉 g b t 的 codex 页面。在这里我们就能向电脑端的 codex 发送指令了, 比如我们想让它操作一下日历。你还记不记得我们之前在日历上创建了一个日程标题,就叫做讨论马克笔记的后续设计。现在我们在手机上再发送一个指令,让它把这个日程去掉,我们点击聊天。 然后呢,我们再点击这里,呃,在里面找出 computer use 这个选项。 随后呢,我们需要输入我们的请求,我们的请求就是把日历中五月二十八号呃,讨论马克笔记的日程删掉, 写完之后先不要忙着提交,你看,我们现在在马克笔记这个项目目录下,但我们的请求其实跟这个项目的代码没什么关系,我们就想操作一下日历软件,所以我们需要再点一下这个设置按钮,然后选择不使用项目。好,这样呢就万事俱备了。我们提交请求, codex 首先询问我们是否同意使用 calendar 这个软件,我们批准。然后 codex 再次询问我们是否要真的删除掉这个日程,我们确认, 随后 codex 就 开始操纵电脑了,我来给大家看看电脑上是个什么样子,你看日历上面多了一个鼠标,它正在操纵电脑删除这个日程。 好,删除成功了。这样呢,我们就做到了用手机来操纵电脑了,是不是很方便呢? 这样大家在外面也可以使用 codex 来做各种各样的事情了。好到这里本期视频就结束了,我是马克,用最通俗的语言讲最硬核的技术,我们下期再见。拜拜。

ok, 现在大家都在用 codex, 但是我一直很好奇一件事,它放到电商里到底能解决什么样的问题?因为我最近自己研究一段时间,发现 codex 真的 不只是一个代码工具,它其实是一个非常强大的提效工具。 呃,所以我今天不讲概念,我直接讲我自己用 codex 在 电商里主要解决的哪些问题。第一个开端就是商品的上下架,这个事情看起来非常简单,但真正做过的人都知道,它很重复很碎,占据很大部分的运营时间, 这部分工作其实最应该交给来完成。那这部分工作的话,我直接交给大家演示一下。现在接着刚刚说的演示好,这里已经进入抖店商品发不页的图文信息部分。先从主图开始, 你看到第一张图已经被放进来了,后面几张主图也不是我手动拖进去的,而是脚本按页面位置一张一张上传 一段画面。主要证明一件事, codex 负责理解我要做什么。 bridge 插件负责把上传动作真正落到页面,也要主主动完成。从以后页面进入商品详情,这里不是继续讲标题,而是开始铺详企业内容 哪些问题。你看右侧预览里的文字,其实也在讲这套系统的核心,先把流程跑通,再把固定步骤沉淀成脚本重复动作。比如上传图片滚动页面填固定字段,就交给脚本稳定执行。 而有变化的地方,比如页面有没有切对素材顺序对不对,就让 codex 来判断和调度哪些问题。所以,所以这组详情页不是普通商品图,它是在把这一次操作本身讲清楚, codex 加 batch 换成一套可以附用的上架自动化, 这里开始处理规格、口味、价格、库存这些字段,他不是只会点上传,表格里的运营字段也可以继续填, 让 sku 的 文案也围绕视频主题来写,比如脚本沉淀、持续进化、 ai 判断固定步骤自动执行到这里,主图详情页, sku 就 形成了一条完整链路,重点不是填了几个筐, 而是这流程以后可以被记录附用,继续进化。所以我现在对 codeys 的 理解是,它不是一个单点提效工具,而是一个业务自动化入口固定步骤沉淀成脚本变化和判断交给 ai, 最后你得到的不只是一个工具,而是一个可以持续训练的运营专员。 如果你也想把这套流程插件跑起来,或者想完整的使用教程,可以直接私信我,我会按你的店铺场景,带你把这套流程一步一步跑通。

codex 迎来一个历史性的更新, computer 用电脑操控功能正式登陆 windows。 看好了,我现在直接命令他,让他给我画一只兔子,看他自己操控鼠标开始画了。注意啊,我这里完全没有加速,这就是他的真实速度! 这线条,这造型,反正比我这手残党画的好太多了。现在无论是软件还是文档,只要你用鼠标和键盘操作的事情,他都能为你代劳,甚至帮你打游戏。理论上你的整个电脑都归他接管了, 你以后只管睡觉。去哪里安装设置呢?超级简单,插件里直接搜索 computer u 下载,或者去设置,你找到电脑操控,把允许任意应用打开。如果遇到这种无法安装设置的,去看我上一期的教程,关注我,用大白话讲 ai。

你可以不去学其他 ai, 但一定要想办法学会 codex。 codex 可能是目前普通人最值得学习的 agent, 这期视频我会手把手带你从入门到实操,全流程了解 codex 是 什么,它能干什么, 并且跟我一起实操,从安装到操作的使用,个人的网站搭建、文档制作、视频制作、自动化的工具开发以及办公和编程场景的真实使用。如果你是在校学生或者是白领工作者,看完这期视频,有可能会改变你对 ai agent 的 认知。 就连英伟达的老总黄仁勋,世界首富,他都已经让他的员工用上扣贷了。这期的含金量可谓是看完这期视频,你就能够真正上手你自己的 ai 员工扣贷。我也把这一期的文字课件整理成文档。好了,话不多说,点好收藏、关注、赞,我们现在出发! go! go! go! 那首先你要明白 codex 它到底是什么?很多人第一次接触 codex, 就 会以为它是另一个拆开 gpt, 其实不是普通聊天应用呢,它更像一个机器,你问个问题,它给你答案,它能教你写代码,做表格,写报告,但最后动手的还是你自己。而 codex 它就不一样了,它属于 agent, 也就是智能体,除了能够思考,还能直接帮你把任务完成。 举个例子你就明白了,假设你要给家里做一次彻底的大扫除,第一个人呢,就是拆个 t p t, 你 把客厅、厨房、卧室的照片都发给他了,他会告诉你先擦窗户,哎,最后再拖地。厨房的油污呢,要用某某某清洁剂,分析的是头头是道,那说完就结束了,最后留下干活的还是你自己, 而第二个人呢,就扣袋子,你只需要给他说一句,帮我把家里大扫除一遍,他呢,就会自己动手帮你擦窗户,拖地、洗窗帘、清洁油污, 干完了还得把结果拿给你验收一遍。甚至还能同时安排专业的扫地机器人、洗地机、擦窗户机器人一起工作,客厅、卧室、卫生间同时处理,它们之间呢,还互不影响。这就是 agent 和传统聊天 ai 机器人的最大区别, 一个给建议,一个从给建议到事情一起给你做完。而放到工作里也是一样的。传统 ai 呢,只会告诉你下一步我应该怎么做,而扣 test, 它就会帮你创建文档,整理资料、运行程序到操作浏览器, 一步步的把结果给你执行出来。 ok, 我 们在使用 koata 前唯一要准备的就是一个叉七 ppt 账号。没有同学也不要慌张, koata 现在已经可以完美的接入国产模型了,快,而且还便宜。后面呢,我也会单独注一期如何把国产模型 deepsea 接入到里面。 这一次咱们主要讲讲 koata 从安装到实操的主要步骤。如果你是重度用户或者是公司来说的话,可以考虑一下 pro, 它的额度呢,会高很多,需求没有那么高的话, plus 就 够了。我现在就是 基本每天我自己使用是够了的,大概每五小时可以发三十到一百五十条给扣贷,正常使用的话,一天肯定是够了的,免费的也行,只是额度呢,会少一点。那我们安装好扣贷之后,登录你的 g p p 账号,有个同学下载之后呢,发现是英文界面,莫慌,我们改语言就好了,设置语言呢,在左下角的设置里选择设置,然后再默认的 常规选项里面这里有一个语言,那我们在这里选择中文,这个时候他就会变成我们自己人了,如果你打开直接就是中文,那就恭喜你直接可以跳过这个步骤了。那进来之后呢,大家可以看到这个对话框和侧边栏还是蛮眼熟的,那左侧栏从上到下分成这几个部分,那最上面是四个功能按键, 第一个叫新对话,给扣带斯布置新任务的。第二个叫搜索,用来在你历史对话里来搜索关键词的。第三个叫插件和技能,用来给扣带斯加装备的。 第四个叫自动化,这个真是我们懒人的福音了,为什么会这么说呢?视频的后面我会详细给你讲讲,而这中间会有两个特别重要的列表,一个是项目,一个呢就是这个对话了,这两个东西可不一样,对话相当于你在给 ai 对 话,和你在网页端和 ai 聊天差不多,适合一些比较琐碎的工作, 帮我查资料或者是回答一些我的问题。项目呢是一个比较强大的东西,每个项目呢都对应着你电脑上的一个文件夹,你在这个项目里做的所有事情,生成代码、文件、 ppt 都会保存在你这个文件夹里,不会丢失。而每个项目下面又可以有很多对话,一个对话呢去处理一件事情,你可以理解为项目就是一个大的文件夹, 而对话呢就是这个文件夹里一个个的工作现场。最下面是设置按钮,点进去呢就能管理我们各种的配置,那右侧这一大片区域就是和扣代码的主要工作地方了, 下方呢就是输入框,你可以在里面直接输入中文,告诉他你想做什么,而这里的功能和旁边权限呢,如何使用,我们在后续的实操案例里也会慢慢的给大家讲解透彻,这样呢会更好理解一些。那么下面我们就用扣袋子来创建第一个项目, 首先看左上角,然后我们点击这里,他就创建了一个新的对话,你也可以在项目里去创建对话,项目就相当于大文件夹嘛,里面呢就可以放很多你给他不同内容的对话,当需要处理复杂内容的时候,我们就可以先去创建项目,在创建项目中再去创建对话,这个时候下面的这些对话呢,就相当于我们项目的一个个的工作现场。 创建好之后,我们在右侧工具的输入框里面直接输入中文,告诉他我们到底想要什么,此时需要注意,我们在输入框下方,这里显示的就是我们当前使用的 ai 模型和思考强度了,目前 g b d 五点五呢,算是比较强的模型了,所以他默认的呢也是这个模型,那选好模型之后,我们可以直接看思考强度,这里也有显示为 一中高和超高这四档,而这个参数呢就决定了 ai 在 回答你问题前想多久,想多深。一般处理日常任务的时候中档就可以了,如果你处理比较复杂任务可以调高一档。除了思考强度和模型之外呢,这里还有速度,有两个档位的选项, 标准和快速,而我们处理日常任务的时候,使用标准模式就可以了,赶时间的时候呢,我们可以直接切到快速。在旁边就是一个麦克风的图标了, 嫌打字麻烦,你就可以用语音去输入需求,这样呢也会方便很多。输入框的左侧呢会有一个加号按钮,点开之后可以上传本地的个人文件夹。 那还有一个就是计划模式的选项,开启后呢,扣在此只会给我们讨论方案,不会直接更改任何文件。当我们确定方案之后,他呢才会去动工。 加号旁边呢显示的就是你当前的权限模式,这里呢会有三个模式,默认权限,自动审查,还有完全访问权限。打比方,你用扣袋子到你家里来做家政清洁,在默认权限下呢,他只会在你指定的房间里面去打扫,如果涉及到其他的房间区域,他呢就会来询问你了。那在自动审查下,他呢就会有自己判断,哎,这个东西我可不可以做? 如果他判断为危险,他呢就会来询问你,如果他判断为不危险,他呢就会自己去操作。我个人觉得这个模式下呢会比较省心一点。而完全访问呢,就是扣代斯把你家当成他家了,此时在你的电脑上,他几乎什么都可以干。而在这个模式下呢,扣代斯在做什么,他呢就不会再来询问你了, 可能会搞一些你不想要的操作。所以如果你是新手的话,不建议你一上来就开这个权限,保持默认和自动审查模式。等你非常熟悉扣贷行为了,并且你的项目有 get 备份的情况下,再去考虑放权的问题,接下来我们看一下输入框的左下方, 这里的按钮是选择扣贷死干活的场景的。总共呢会有三个模式,本地、工作处,还有云端。那首选呢,就是这个本地模式。 这个呢,也是比较简单直接的模式, co ds 呢,它就会在你的电脑上的文件夹去直接修改,那它改了什么呢?你也能在这个文件夹里面去马上看到。这个模式下呢,就比较适合小手术,比如给我改个样式,整理个文件,加几行代码等等, 如果它改坏了的话,你需要手动撤回。所以用本地模式钱最好,养成随时备份的好习惯。而这个工作数模式呢,是 co ds 一个比较核心的功能。什么叫工作数呢?假设你有三个员工, 同时让他们去修改一个总结报告,他们三个人同时在一份 word 里面去打字,瞬间就乱套了,他们之间呢,还会互相的去覆盖内容。而工作数模式就像你给每个人单独的去分配一份任务,最后再自动合并成一份完美的中稿。 云端模式,它会把你的任务发到 open ai 的 服务器上,哪怕你已经关了电脑任务呢,它也会在云端自己跑起来。最后我输出结果了,它会放在那里等我们来验收。但你要使用云端模式,你就要连接一下,给它仓库关联扣在 smart, 所以 配置呢,会复杂一点,大多数情况下呢,它不会用到这个模式,我们初次体验的新手呢,就不用管了,知道有什么概念就可以了, 平时使用本地模式和工作数模式就足够了。这里插个小提醒,如果你的扣带子把代码改坏了,这个时候你正好用的是工作数模式,不用担心,这个模式下它具备独立副本,直接扔掉就行。如果你用的是本地模式,那就需要在叉一面板里面去点击全部撤销,或者在终端里面去输入 get checkout, 它呢就能回档了。 所以说让扣代词去改什么东西之前,我们先要提交,这样即使它改成什么样,我们都可以给它退回来。那下面第二个功能搜索,就是帮你在扣代词所有的历史对话里面快速的找到之前的对话信息。假设你要找到之前的项目和对话,但是你这段时间操作项目和对话太多了, 那我们就可以点击这里,然后通过搜索关键词,它呢就可以搜索出项目和对话,甚至还有文本记录,这个搜索功能可谓是真的方便。 介绍完了新对话搜索,那我们就来聊聊右侧的这个扣带斯聊天框,我先给大家演示一下聊天框具体能让扣带斯干什么, 你想装一个 node js 或者是其他的 a 帧的,以及做其他项目一些必备的工具都不再像过去的时代那么麻烦繁琐了。现在呢,有了扣带斯,我们直接截图扔给他就可以了,怒声一顿火锅钱。而且呢,我们在使用过程中遇到任何问题,我们都可以去问扣带斯, 什么瞎死了,马挂了,升级又翻车了,都可以让科特斯直接帮你修,是不是很方便?现在呢,我就直接在输入框里给科特斯说,帮我安装一个可牢扣的,好给他发过去,他现在开始来检查运行环境, 不去执行了,以前呢需要看各种的教程资料,现在呢,都不需要我们来操作,真省心啊。包括我们有任何想法,不管是让他去执行项目或者查资料问问题,我们都可以直接和他对话。扣贷 s 呢,他的回答也会非常清晰,一步步的来引导你把你的想法执行和展示出来。 ok, 我 们现在已经基本上掌握了功能区的前两项, 现在开始进入扣贷 s 核心,也是最有意思的部分,插件和技能。点击左上角的插件按钮之后,进去之后会有两个页面,插件和技能 这两个概念会有很多人搞混,其实区分他们还是很简单的,那插件呢?大多数是让 a 智能跟外部平台工具服务器连接的作用,装上插件之后,你的 ai 智能体就有了操作软件或者是服务器的功能。那 skyo 它的底层逻辑是我们在使用抠袋子过程中来回复用的方法是流程和工具的组合, 用于做某些具体任务的时候抠袋子的行动指南。那咱们又如何能调用这些插件和技能呢?别担心,咱们不需要提前去部署一些复杂的依赖 抠代码,它会根据你的任务自主来判断用不用调用这个插件或者是技能。但如果你就想点名用这个插件的话,那我们就可以在输入框里输入 at, 然后呢它就会弹出这样的一个插件列表,选择你想用的,到时候手动触发就可以了。 那我们接下来点开左边的这个插件栏,这里呢已经默认帮我们打开了好几个内置的插件了,比如说操作浏览器的,还是给它表格的 ppt 这些,有需要其他插件的话,那我们也可以点击这里的加号来进行安装。那重点呢是这两个插件,这两个功能呢,分别是操作你的浏览器,操作你电脑上的软件或者是网站, 相当于我们雇了一个手替。好,那接下来我给大家操作一下,我是如何用插件来做一个有声音有动效的高质量视频的。那首先呢,我们先安装插件,然后在这里直接搜索 app friends, 那 我这里是已经安装好了,然后再继续搜索一个 remote, 哎,这里也已经安装好了,那我安装好之后,我就返回到这个对话框中,然后我们在这里调用第二个插件。扣带子呢,它也会调用一米尺二来生成图片,那我让它生成几个人类进化史的图片,再使用 have friends, 然后生成对应的视频。那我们再用 remotion 生成一个动效,以及再用一个音频插件生成一段舒缓的音乐,然后呢我们就可以开始生成了。那我大概是等了有个音频插件生成一段舒缓的音乐,然后呢我们就可以开始生成了。那我看一下效果怎么样, 效果是不是还可以?如果我们不满意的话,我们还可以跟 ai 持续的对话来完善我们的细节,每一帧,每一个画面呢,都可以自定义的。我这里呢是让它自己生成了几张图片,也没有给它更多的指令了。 这里我只是做了一个简单眼上,虽然效果不是那么的惊艳。如果你有自己的一个素材或者是内容的一个阴鬼,我们都可以告诉 ai, 让它直接对接上去, 是不是很简单?这只是一个指令,给到 ai 生成的一个视频效果,当你有更好的想法或者是详细的思路,那你做出来视频肯定会更好,包括你自己喜欢的一些专场特效,我们呢都可以告诉 ai, 它呢也可以来实现。如果你想生成 excel 表格,那用的呢就是这个插件,那接下来输入框里我们就发送这一段指令, 然后我就可以得到一份详细完整的 excel 文件了。看这效果真是相当不错了。原来我做一个这样的文件,又是查资料又是核对信息的,估计几个小时也是做不出来这样的一个效果。另外,我还想生成一个 word 文档的话,那输入框里面我发送这段指令, 那生成完成之后呢,我就可以直接在 code 里面点击文件名,然后我们打开预览一下,这个效果相当 ok 啊。那如果我不满意的话,我还可以在预览键的下方这里输入框里继续让它更改好插件。说完了,我们再聊聊 skill。 举个例子,生成一张图片的流程呢,是要先确定好画面的描述风格,再去调用生图模型去输出图片,把这一套流程的注意事项打包写成一个 macdunk 文档,它呢就是一个 skill。 那 在此之前呢,还需要在你项目里的根木下去创建一个文件,叫 agents 点 md, 那为什么我们要创建这么一个文档呢?主要是因为我们在一个项目里新开一个对话的时候, codex 呢,它是没有其他窗口记的很多注意事项,我们在其他对话窗口里面呢说过一遍,但是返回到这个对话窗口里,它是不记得的,所以我们还是要再说一遍。但如果你想做的项目比较复杂,需要开很多个窗口定型的去执行任务, 那就会很麻烦。所以我们新建这个文档呢,就是来解决这个问题的,你把规则写到这个文档里,他呢就不会再忘了。就像我们给新来的同事一份入职手册一样,我们这个部门的规矩,第一条是什么,第二条是什么,一次性的全给他写清楚, 以后他的做事呢就会按照这个手册来,这样 codex 在 每次起送的时候呢,他呢就会按照这个手册来干活了,把里面写的规则当做工作手册来执行,那么这就是一个长期记忆的 skill, 这是 skill 里面具体怎么写的话,我们之前呢也有详细聊过,感兴趣的同学可以去复习一下。 codex 最后一个功能呢,就是自动化了, 可以说是扣代数自动化,定时做任务,假如你每天都需要执行整理数据或者写报告,那就一定会用到他这个能力了。自动化有个非常简单的用法,就直接在对话框里用自然语言告诉他,给我设置一个自动化的任务,比如每天九点帮我去搜集今天的热门话题或者是数据, 然后给我生成一份报告,再用表格的方式再返给我,那他呢就会帮我去创建这么个自动化的任务,那对于我来说,这个功能确实能省去我每天反复的工作了。 ok, 我 们再来看左上角的自动化,这里 他呢已经帮我设定好了这么个任务,在这里呢,我们可以随时让他更改自动化的任务时间,那改成早上十点去执行,那在这里改成什么时间都可以哈,看我们每个人的需求就可以了。 除此之外,还有个创建自动化的任务方式,那我们鼠标移动到共同区,然后这个自动化里这里有一些官方的参考案例。我们选择新建一个自动化之后呢,我们就可以用题旨词写好这些自动化到底是要做什么的,可以在这里选择什么时间执行这个自动化任务, 然后在这边选择模型和思考的强度,最后点击创建就 ok 了。在这个地方呢,你还可以看到你创建的所有自动化的任务列表,点击对应的任务呢,就可以进入到这个任务的详情页了。左边是这个自动化的详细描述,那右边呢就是各种的参数, 比如状态,下一次的运行时间,运行的环境,或者是具体在哪个项目文件夹里面去运行的,你也可以在右上角去选择暂停或是删除这个自动化的任务。如果你是初次使用这个功能的话, 我建议你在输入之前呢,提前自己试一遍,确定好这是我们想要的一个效果,那我们再去创业一个自动化的任务,不然到时候跑出来效果不符合我们的标准,这不纯纯浪费额度吗?说到使用额度,有的同学就要问了,你做了这么多案例,你到底消耗了多少额度? 又怎么查看我剩了多少额度可以用呢?这个呢有两个方法可以查看,一个呢是左下角设置,我们点开之后有一个剩余额度,那我们就可以看到五小时内我们还剩下多少,本周内又还剩多少, 这里呢还会有一个刷新时间的提醒。那另一种方式呢,我们就可以直接在对话框里输入斜杠,然后找到这个状态,然后打开之后,它呢就会在这里持续显示我们一个上下文的余量,同样有五小时和一周的限额。说实话这个扣贷四的额度呢,还是很大方的,二十刀的一个额度,我认为是可以满足我们大多数人日常工作的高频使用的, 但有的时候我们用着用着它就会提示已达到使用上限。不要慌,刚才也提到了 gpt 账号每五小时它是滚动刷新的,意思就是五小时前你发的信息,它呢就会过期,就会腾出来额度,所以不用着急,等几个小时呢,它的额度就会出来了,如果你觉得还是不够用的话,可以升级到 pro 版本。那我们还有什么方式可以进一步的节省我们宝贵的额度呢? 当然有,就是在我们的上下文上下功夫。那怎么去查看我们的上下文呢?在这里我们就能看到了这个小圈圈就代表我们现在这个对话框里里面所有的操作,一共使用 gpt 五点五多少上下文的窗口。 如果我们把鼠标悬上去之后,他呢还会有一个更详细的信息,当上下文快满的时候,扣袋子呢,他就会自动帮我们去压缩上下文。 其实当我们一个任务高于段落之后,不用等到他自动的压缩上下文,我们可以通过斜杠然后压缩这个命令去手动的压缩上下文, 这样呢就可以让模型专注到我们的新任务上,而且还省一点额度。看到这里的同学,那么恭喜你,你已经学会了如何使用扣贷。接下来我们直接上实战做一个网页的开发商,听起来是不是很难很复杂?那是在以前,我们现在有扣贷,那我们就可以直接在对话框里输入我想做一个 宠物猫咪的主页,然后我们把这个加号点开,点开我们的计划模式,因为做网站他还是会复杂一点的。那点开这个模式之后呢,他会帮我们出一个比较详细计划,我们确认之后他呢才会开始执行。所以打开这个计划模式呢,就比较适合我们做一些比较复杂,或者是连我们自己都没有想清楚的任务,这样呢我们就可以跟 ai 讨论出一个计划来。 ok, 因为我们提示词比较简单,所以他看到我们项目中是没有内容的,他呢就用这种选择框的方式来询问我们其中的细节,那有这些选项,大家可以按照自己需求去选择就 ok 了。那我就选一个温柔可爱吧。如果我们点开这个小叹号的话,还能看到他说的这个风格到底是个什么意思, 这种小细节还是我比较喜欢的点,那我就选一个他推荐的吧,主页的内容到底是按哪种资料来设计的?如果说这个选项里面没有我们满意的,我们就可以选择最后一个,在这里去填写我们的一个详细要求。那这些步骤都完成之后呢,他给了我一份详尽的计划单,问我们是否实施这个计划, 那我基本看了一下,其实没有太大的问题。 ok, 我 们看一下其实大差不差了,我们确认开干。 ok, 他 现在开始初步化项目了,一步步的帮我们生成里面的内容,那在这个过程中呢,肯定是需要一点点时间的。 ok, 他 终于在跑了七七四十九分钟之后,网页呢就完成了,我们来看一下效果,其实扣袋子他有个内置的预览浏览器,那我们可以直接打开右边的这个侧边栏。 哎,这个网戒效果确实是不错啊,不过现在的 a 政策呢,其实都有这么一手了,那他这个浏览器呢,还有一个独特的功能,我们点击右上方的这个批注按钮,然后呢他就可以实时的去修改,然后你刷新一下浏览器,那马上就能看到最新的效果了。我们可以在这个页面上,然后选中这些具体的元素去提出修改意见, 包括重新生成图片,比如说这个 logo 呢,就会加上我们想要改动的批注,我们点击发送,他呢就会针对我们的意见去进行修改, 是不是还挺方便的?你看啊,修改后的 logo 呢,也是对的,也没有过度修改,也严格遵循我的要求去修改了。这要是放在两年前,一句话,脑袋里一个简单的想法,几分钟就能做出这样好看的一个网页,前端页面还可以随时修改好,现在调整的是满意了,但这个网页只能在你的本地电脑里跑, 你把电脑一关,别人呢就看不见了。要让别人都能通过一个网址去进行,那就需要部署了,什么意思呢?就把你的电脑网站代码交给一个云平台,让他去帮你运行,然后再给你一个公开的网址, 任何人任何时间访问这个网址,就都能够看到你的网站了。那常用的云平台呢?有这几种,想要登录上云平台,你就需要安装这个插件,我们在插件页面搜索他,然后安装,安装时呢,他会让你登录这个账号进行授权,然后回到对话里面,直接艾特他, 让他把这个网站输入上线。那不一会呢,扣代码他就不是完成了,给了我一个公开的网址,现在任何人都可以通过这个网站来访问我的网站了,是不是很简单?当我们看到对话框中提示这个的话,他就是做好了,我们打开看一下效果, 你瞅瞅这效果,你敢相信是一句简单的指令, ai 几分钟给你生成出来的,而且还部署上线了。最后呢,给大家总结一下使用口袋思注意事项,如果涉及到文件操作,哪怕只是一个简单的文本文件,建议优先使用项目文件, 这样的话,你生成的文件它就会有一个固定的管理位置,就不会太乱了。一个任务只开一个对话,不要在一个对话里面去塞十几种不同的任务,因为每一个任务它都是独立的话, ai 表现呢,它会更好一些。遇到复杂任务,我们可以先点加号里面的计划模式,或者直接在对话框里说先给我制定一个计划, 暂时不要去执行,等它列出了打算干什么,分几步完成,有哪些文件,哎,你看了觉得没有问题,然后再让它按照这个计划去进行执行, 这样呢,会更稳妥一点。也要把完成的标准告诉清楚,不要只说给我修改这个 bug, 而是说帮我修改这个 bug。 做完的标准呢,是全部测试通过的,手动跑一遍也是正常的。当我们完成一个复杂的任务代码之后,可以新开一个对话框,请扣袋子再去帮我们审查一遍刚才我们修改的代码,重点要看一下安全性和性能,他呢,就能经常发现自己第一次没有注意到的一些小问题。 从今天开始呢,你就可以把自己当做一个项目负责人,而扣代词就是你招的第一个 agent 员工,他呢,就可以帮你拆解任务、执行任务、完成任务, 甚至去同时处理多个任务。很多过去我们必须亲自去做的事情,今天我们都可以交给 ai 去做。你不一定会写代码,也不一定要懂开发,你只需要把你自己的需求讲清楚就可以了,剩下的工作呢,就交给 agent 了。但这里呢,有一个非常重要的前提,就 agent 再强,他呢,也只是你的执行者, 而真正决定结果质量的呢,依然是你。所以未来呢,可能不需要我们去亲自完成所有的工作,而是学会如何指挥 ai 去完成工作,给目标定方向,做决策,最后检验你的成果。当你越了解自己的业务,越知道自己到底想要什么,就越能给出清晰的目标和上下文, 而他完成的任务质量呢,就会越高。因为我们已经从问 ai 时代走向了管理 ai 时代。如果这条视频对你有帮助,记得点赞、收藏、关注,我也会陆续更新 qts 的 相关内容。好了,我们下次见。

我最近呢,把自己所有用 codex 开发的项目都集中到了一台二十四小时不关机的 mac mini 上。因为我之前发现一个特别麻烦的问题, 我有几个项目放在 macbook 上,几个项目放在 mac mini 上,还有一些又在家里的台式机上。刚开始感觉挺方便,哪台电脑在手边就用哪台继续做,但时间一长,项目就变得特别乱,哪台电脑上的代码才是最新的,哪个项目装过,依赖哪个环境能正常运行,我自己都快搞不清楚了。 尤其是我还经常出差,我的 macbook 一 合盖,最近执行的任务就暂停了,再打开电脑,我都忘记他干到哪里了。 所以后来我干脆直接换了一个思路,我把所有的项目开发环境口袋 x 全部放到家里这台二十四小时不关机的 mac mini 上。这样不管我人在公司、在酒店,在路上,我的项目始终在一台电脑上,我不需要去进行重复的配置, 我的 macbook、 手机甚至平板都不再是开发电脑,他们只是连接这台 mac mini 的 屏幕。 我后来越来越觉得, ai 时代的个人开发可能真的不需要随身背着全部算力,你只需要把项目放在一个稳定长期在线的地方,然后让自己随时都能连接过去。至少对于我这种项目多、设备多又经常出差的人来说,这种方式比在每台电脑上都装一台口袋子实在是舒服太多了。

的话我们分享一下就是柯 max 在 我们大学生活中能给我们提供哪些帮助,以及就是说在每个新手入这个柯 max 的 时候会面临哪些问题。首先的话就是大家在用柯 max 的 时候肯定会遇到这下面这个 命令,就是请求批准和替我审批已经完全访问权限,在这里的话,我推荐就是所有的新手都使用请求批准,为什么呢?因为这样的话他每进行一段程序都会给你审批,就他不会自动的用在你电脑里面的一些程序。 如果你要使用完全访问权限的话,那你一定要记住就是在你给他的命令里面让他把所有的东西都要有个备份,不然的话他会把你电脑里面就是一些文件或者是一些程序给删掉,会让你就是产生一种困难的。命令给错的话,然后这边的话就是一个我们的一个低中高超高,这边就是一个我们很快就是就是用不出 方案的一个速度,在这里的话我推荐高就行了。而且其实平常如果你只是想问一些问题,或者是呃解答一些疑惑,用豆包或者是呃其他 area 进行足够了,这个话做一些效果我觉得还是挺方便的。第二个第二个问题的话,就是大家在用的过程中肯定会遇到这个什么 c s s 位,奇瑞克什么什么位,然后 h t t p 四百,这是什么意思呢?四百就是格式错误, 就是根据,反正就是修改你的提问方式,然后还有就是四零一四零二四四二四二九,如果你在你这里面看到这个符号是下面的任何一个数字,你们就可以去查,然后进行解决。这个在哪里查呢?就是在我们这里面,呃, 你就搜那个 dspac 开放这里面,然后的话你就这里有个常见问题,常见问题这里面就有什么啊, a p i 文档啊,以及就是说模型价格,然后限速充码,充码都在这里面,如果你是小米用户的话,你就直接点开小米,然后这下面的话就会有这个问题,常见问题和 a p i 定价,你可以在这里面进行解决。 然后呢就是我最近利用 ai 工具做了些什么东西呢?就是首先就是一个 ppt 吧, ppt 这里就是全都是用 excel 做的 ppt, 一 共做了五十期,每一页的话大概就是我只提供了一些提示词,然后就是 ai 工作的,大家可以看一下给大家展示, 然后的话这就是我的一个,然后的话他就会根据这些然后完成我的一个呃, ppt 制作,然后的话一共完成了几份,我看一下完成了几 很快的,当然这些有什么用呢?大家其实可以想象大家平时做作业的话,用的就是都会用豆包或者是纤维的一些其他的,呃,但是呢有时候他出的一些效果还是有点让人不 能接受,大家可以试试着用 copy。 然后大家有没有发现就是今天我的界面就是中文,之前都是英文的,我怎么调的呢?其实按理来说的话就是在设置设置里面有,呃,这下面有个语言,这里就是语言,语言在哪里?我找一下 语言这里就可以调,但是的话我这个为什么会成这个样子呢?就是我在我发现一个,就是我连续调两次,就是连续呃几次启动 c c c 未起,然后给它调这个用户,就是这个用户这边我给它多启动几次之后,我这边我这边就是退出,然后再进来,然后原本的英文界面就会变成中文界面。 然后呢?下次的话我其实想给大家分享的就是,嗯,怎么就是分享的是什么呢?就是怎么在这么多 ai 软件里面,就是说找到属于适合自己用的,因为现在 ai 软件确实很多,但是怎么样在这些 ai 软件找到适合自己的,然后还能帮助自己呢?然后我们下次的话我就是多做一些准备,然后给大家分享一下。好,今晚我们就是分享到这里。


q 代码是真牛逼啊,兄弟们,现在已经是凌晨四点钟了啊,我就坐在这,我一点都不困,我非常亢奋,最近不是在做这个闲鱼电商,然后我接触完这个以后,这是第五天,几乎已经实现全自动化了啊,然后我已经让他做一个完整的软件出来了, 就是啥概念呢?从上架开始到到卖出去前,他全包了,就他推广开到什么地步呢?兄弟们 啊,他这个推广头展开的比我都高啊,老铁,真比我都高,我一开始我就压根不相信这玩意,然后他们非让我去试一下,我就整了一个, 买了个 plus 的 版本,我上去,嗯,试了几个小时,其实我刚开始去试的时候是抱着这个质疑的态度去的,我觉得这个东西没那么深啊,这个 aa 还没进化那么快呢。就是我试完之后我不说话了,我觉得 就是就给我一个感觉,这玩意在改变世界,你就看我才研究不到五天,现在几乎已经实现全自动化了啊,从上链接到开推广,他脱价脱的比我都好, 然后再到这个客服销售,我们这个销售环节是很重的,他完全他现在已经完全能给他揭露他,然后再到这个财务,财务统计,他统计的非常实时,非常快, 然后我现在已经把它做成了一个软件,也就是说我这个电脑装了一个,他就能给我正面,我给这一排电脑我全给它装了。它 啥概念?我现在已经晋升为 q 代斯 pro 二十 x 的 用户了,就我现在脑子里边有很多能变现的链路,我还没有去验证呢,就我我这一个个来,太爽了这感觉,然后就是对这一块有想法的都可以来聊一聊,交流交流,这个东西实在是太强大了。

哈喽,大家今天跟大家分享一个 codex 的 宝藏功能,尤其是对做运营的朋友来说,一定要码住了。就是这个自动化定时任务,它是可以把我们日常像刷选择题以及导数据这种重复性的工作给代替了的, 只要你设定好时间节点,它就会按照顺序自动执行,中间是完全不需要任何的人工干预的。就拿我目前的运营工作流举例来说,每 每天早上的九点半,我会让 codex 自动地帮我抓取 ai 行业的热点,让它帮我整理成一个表格,方便我阅读查看。每天晚上的十点,让 codex 自动登录到我的抖音后台,让它导出当天的播放量和互动数据。 嗯,根据当天的表现,直接帮我生成一份完整的复盘文档。还有在每周日的上午十一点半,我会让他对我的抖音进行一个周数据报告,嗯,我会让他统计本周一到周日的全部视频的播放量,点赞、评论、 分享、收藏这些数据,让他根据这些数据生成一份完整的数据报告,等下周一上班的时候,我根据这个报告进行一个大复盘就可以了。 更厉害的一点是,它是可以跨软件的帮你去处理或者是沟通任务的啊,我们只需要在这个自动化里面通过聊天创建一个 啊,然后选择上这个 computer user 这个插件,然后你就跟它进行几轮对话,告诉他要求,再让它自动完成就可以了。

很多人刚开始安装了 codex, 不知道这个权限配置到底应不应该要放开,如果开了又担心它把你电脑里边的文件删掉了,不开呢?又感觉每一步都要确认,确实很麻烦。 我专注于从小白的视角分享怎么从零开始,用 ai 和 web coding 来提升自己的生活和工作效率。今天的这一期,主要跟大家分享 codex 这个执行权限到底应该怎么去设置,尤其是小白用户一开始到底该怎么选。 像我现在这台机器的配置,其实是比较激进。大家可以看到 apollo policy 选的是 never, 沙盒是 danger for access 项目,全部都是 trusted 的, 这是高信任模式,适合紧急的项目, 不适合小白第一天就开启,这代表日常执行会少很多我需要去确认的文件的范围,因为对我而言这样效率会高一点,因为我的项目是有规则的,有 git 也有备份,而且我知道哪些动作必须让 ai 停下来。但如果你也是小白, 第一天不建议这样去配置,你可以把它理解成为等你熟悉之后再来参考这套配置。其实整个权限配置背后有三个开关,第一个就是 pro, 它能决定 qx 动手之前要不要跟你确认。第二个是三 box, 决定他能碰到多大的文件范围。第三个是 trust, 就是 决定哪一个项目可以被当成真正的可信的项目, 所以不要只看一个完全的访问权限,真正的授权状态就是这三个东西组合在一起的。你只要能看懂这三项,就能判断当前的 q x 是 偏保守还是偏自动执行的。其实现在 q x 自带的菜单里边路径已经很清楚了。第一个就是默认权限,刚安装的时候你 可以选它。第二个就是自动审查,适合你,确适合你觉得确认太多还是保留风险判断的情况。第三个是完全访问权限,只适合测试目录或你已经完全熟悉的项目。第四个就是你可以自定 confine, 这就是进阶项,不是小白第一天都需要改的东西, 大家可以看一看啊。这里边其实有默认权限、自动审查、完全访问权限,以及你可以自定义去修改复印。那对于一个小白用户而言,其实这条路径就是按照这个顺序来的,刚开始有默认权限,然后慢慢调整的自动审查完全访问权限, 到后边之后你再去自定义自己的复印。然后最后请记住,即使权限放开,也不代表红线的 行为消失。比如说你的 api k, 你 的数据库、公共 api 这种真实账号的权限都要单独确认。这里不是说 ai 不 能做,而是要先讲清楚范围、风险和回退的方式。总结三句话就是小白还是先默认权限,想省力了再自动审查最后的权限, 为了是提高效率,而不是为了跳过你的判断。后面我会继续用真实的案例告诉怎么我把 ai 用到自己的工作流的,我们下期再见。

刚装上 codex 的 朋友,千万不要瞎用,不做好这三步,你的 codex 只会越用越笨。今天给你一套零废话极简讯话法,看完就能上手,不仅不会让 codex 搞乱你的电脑,还能让他越来越懂你,变成真正的生产力。第一步,先给 ai 焊四条铁规矩, 这是最核心的一步,设置一次,永久生效。你打开正在用的 codex, 在 设置里找到自定义指令, 把下面两句话原封不动的粘进去,保存好,就再也不用动了。一、每次对话结束后,自动将本次你出现的错误,我的修改要求记录至 workspace 内的踩坑日记文件。二、每次接受新任务时,优先读去 workspace 内的规矩文档,踩坑日记,严格规避历史同类错误。 为什么要这么做?因为我们把规矩写在这里,就会防止他乱扫你的电脑。一是保护你的隐私,不要让他去扫到你的一些银行密码、账号密码等等,并且还会节省你的算力。 这样设置好之后,也不用你每次重复提醒。第二步,建一个 codex 专属工作文件夹,随便在电脑的哪个位置。我是在 d 盘里新建一个文件夹,就叫 workspace, 里面再建两个文档。第一个叫规矩文档,里边写你定的简单要求,我写的放在这里了,你们可以直接抄作业,也可以自行发挥。 第二个叫踩坑日记,空文档就行,不用你手动去写,在你使用 codex 的 过程中,你每反馈一次错误,它自己会记在里边儿。这两个文档建立好之后,结合第一步, 那么之后 codex 干活之前就会去看这个规矩文档和踩坑日记,他的思路会越来越清晰,而且他产出的成果文件都会放在你指定的地方,不会让你满电脑去找。最后再教你一个每周只能花一分钟的小动作,但是可以让他提升十倍的聪明度。每周花一分钟跟 codex 说一句踩坑日记里的错误, 提炼成十条核心规矩,更新到规矩文档里,然后清空旧日制。就这一句话,它会自己总结,复盘用的时间越久,它越贴合你的习惯,让它真正成为你的私人定制助手。千万别等用乱了再后悔。装上 codex, 先把这三步跑起来, 这才是把 ai 变成真正的能力的关键所在。如果觉得有用的话,别忘了点赞、收藏、转发哦!如果你们还有什么解决不了的问题,可以评论区告诉我。

codex 有 三种操控电脑的方式,这篇来自于官方内部的最佳实践文章告诉我们三种操控电脑的方式, computer use, 调用外部的 chrome 浏览器以及 codex 集成的浏览器。三种方式适合什么样的任务?有哪些区别?一个视频,边讲边演示,帮你彻底的消化这篇 codex 控制电脑的最佳实践好,还是把这篇长文做成了方便你们理解的 ppt? 据 codex 三种操作电脑的方式, 我们直接对着操作界面看,第一个啊, computer use 就是 可以操作你电脑里的任意应用,让他去下指令给你的应用完成你的需求。好,首先 我们直接演示 computer use, 把这个插件调出来,我让他打开我电脑里的一个工具 o c 点,一个笔记本工具。大家应该都知道这个是我的一个目录结构,我让他帮我打开这个工具,然后在这个目录里面帮我自动插入一个文件,文件名,我指定好打开这个工具指定文件夹的路径,创建一个什么样文件名好, 直接发送好,他现在已经开始操作 oc 点,为了方便我们直接把 oc 点打开,注意看他的变化啊。嗯,看没有模拟我的鼠标点击创建了这么一个文档啊。当然这里面我没有指定内容, 只是给大家做一个演示,打开六叔电脑里装好的 oc 点,然后在指定的目录里面去插入这一篇文档,全自动。好,正好这里面他也告诉你已经完成了,点开也可以在他内置的浏览器里面去看这个内容。这个就是 computer, 可以操作你的原生的应用,做一些事情,但是它是有代价的,它非常的慢,它要观察界面,决定怎么点击,等待响应,检查状态,会比那些包装成 skill 的 应用调用起来要慢得多。比如我要创建一个文档,我可以调用电脑里面装的这个文档的工具去打开一个文档。如果说这个文档工具已经提供对应的适配的 skill, 那 我直接调用 skill, 这个过程会比 computer use 更快,所以大家要明白这个权限最高,但是它比较慢,它的边界是什么?不要涉及到支付,一些隐私,一些账号层面的操作啊,这个东西必须得人来 去进行决策,不要自动化操作。第二种, chrome, 顾名思义就操作电脑浏览器,它可以带着你浏览器登录的状态去模拟一些操作。比如我在浏览器里已经登录了我的邮箱,你就可以调用这个插件去操作你的邮箱里的相关的记录,帮你做统计,做回复,包括帮你发一封信的邮件都是可以。我们还是演示一个案例,在这个对话界面 at chrome, 然后这一次案例设计呢,让它进入我的邮箱,去统计某一个主题的邮件数量,当然这个邮箱我是登录状态。另外大家要注意啊,你在使用这个 chrome 插件的时候,它会提醒你去 要安装一个浏览器的扩展插件,直接添加到你的 chrome, 也可以在你的 chrome 商店里面直接去搜索这个插件,装上就行,必须得要装上这个插件才能够操作你的浏览器。好,我们再回到这个任务啊,去统计这个标题的邮件数量,点击发送。好,我们看一下,他就直接可以跟我刚刚装的那个扩展做一个连接,进入到我的邮箱,搜索这个主题的邮件,打开我的邮箱,这个界面发生了变化,他 自动在这个搜索框里面去输入关键词,完成了一个搜索,然后做了一个统计,一共三十八封邮件,每个邮件的标题全部汇总出来, 所以有了这个功能,你可以扩展做很多事,甚至可以帮你去分析每个邮件的内容,帮你去写邮件,帮你去回复邮件。好,那这个就是 chrome extension, 能够自带你登录身份去操作浏览器,可以去做一些网站的读取整理比对,但是还是涉及到一些隐私操作的时候呢, 要注意需要你授权好。第三种 in app 包含者,就是 codex 里面自带的一个浏览器的插件好比如六叔做的这个 ppt, 是 以网页的形式生成的,直接在这个里面 去打开,右边就会出现一个预览的效果,我们可以把它全屏放大,在这个里面,你不仅可以去做浏览,还可以做一些修改的建议,比如我选中注视的模式,点到任意想要修改的地方,点更多修改一个文本,我们后面加三个感叹号就直接生效了, 所见即所得。而且你的团队成员上来也可以看到这个标注,进行一个协助,然后在这个对话框里面,你可以给他发送指令,好让这个标记生效,完成修改。发送 完成,修改了这句话,感叹号加上去了,刷新之后直接生效。这个就是内置的浏览器插件,可以打开任意的页面文档,你可以标注问题,可以在里面直接去修改代码, 在里面再次预览,再次验证三个操作方式给大家演示完了,这个里面一定要有优先级,不要把你的 a 键变成一个可以点击的万能鼠标,要有边界,这里面就会有一个层层递进的这么一个操作权限,优先选用结构化的工具,结构化的插件就是这个里面的这些东西或者是 又进了,如果这里面没有满足你需求的,我们再来用浏览器,或者用 computer user, 越往后能力越大,权限越大。成熟的 agent 不 能操作一切,而是知道什么样的需求用什么样的能力好。最后我们要把刚刚说的那个规则,什么样的需求,用什么样的能力写到你 codex agent dmd 里面。比如你要对接文档的对接聊天工具的 直接调用插件或者 m c p, 如果你在做本地文件的预览修改,就直接用内部集成的浏览器。如果你要登录你的网页后台去收邮件,去收集一些东西,去统计一些东西,去分析一些东西,这个时候就用浏览器 chrome extension 浏览器插件。如果你要有系统层面的一些操作, 需要你本地安装的应用去做一些联动,这个时候就用 computer use 是 最窄的,这个也是全线最大,风险最大的,需要人工确认的这个部分,大家看看 任何环节里面的特殊的需求都是需要人工确认。好了,以上就是关于 codex 操作电脑的三个能力,以及具体的演示案例,包括对应的风险边界以及使用原则,是不是彻底搞懂了。好了,关注我持续丰富的爱京东铺,拜了个拜。

一定要去体验一下 codex, 因为有了 codex 就 相当于有无数的员工在替你干活。今天给大家介绍一个第一次使用 codex 一定要去体验的功能,也就是这个自动化的任务功能。你可以通过聊天的方式创建一个自动化的机器人,让他每天定时帮你完成并交付某项任务。 比如我自己每天早上的九点零五分,会让他帮我检查一下我电脑里的内存是不是大于十个 g, 如果小于十个 g, 他 就会自动的帮我清理一些不常用的文件,把一些占空间的视频移动到我的动态一盘。 然后每天上午的九点三十分,它会自动帮我搜集 ai 相关的新闻和热点信息,然后每天十点,它会跟前面搜集到的热点与新闻帮我自动生成一篇图文文章。除此之外,每天早上的九点半,它还会帮我检查各个平台的账号数据, 然后自动生成一份复盘报告。其实这就是一个完整的自动化的工作流,而这些事情我们只需要通过聊天的方式把它们创建出来,你可以看到里面实际上记录了每天执行的一个过程和情况, 如果某一天我不想让他再执行,我可以去删除或者暂停,或者说你某一天特别需要让他尽快的完成这项任务,你也可以直接点击立即运行,直接开始这项工作。 所以你用 ai 的 好处就是,它可以像是一个二十四小时全天在线的员工,可以随时开始你想要的工作,你完全可以把工作当中很多重复性的事情全部交给他来完成,所以一定要去体验一下扣带,它真的能够大幅提升你的工作效率。

大家好,欢迎回到咱们的 codex 硬核拆解系列,在上一期解析里呢,咱们花了大概十分钟的时间,帮大家真正搞懂了 codex 到底是个啥,还有它的四大使用入口。哎,如果你还没看上一期,强烈建议先去补个课哦,因为从这期开始,咱们可就要直接进入深水区了。 说实话,如果你觉得现在所谓的 ai 编程还只是帮我补全一小段代码,那么接下来的内容绝对绝对会颠覆你的认知。我们要把对于 codex 的 理解从一个简单的 ai 小 助手,彻底转变成一个全能的自动化工程合作伙伴。大家坐稳扶好,咱们直接发车, 看看咱们今天的日程啊!内容非常硬核,我们要一口气拆解这七大神仙功能,自动化核心三剑客、代码管理、云端运行,最后还有他的记忆系统。 好的,那咱们先进入第一部分,聊聊自动化,这可是你的 ai 值班工程师。 以前很多人用 ai 编程感觉就像是算盘一样,我拨一下它动一下对吧?但这个自动化功能彻底改变了这种局面,你完全可以把它当成你给项目重金聘请的一个 ai 值班工程师。 平时呢,他就按规矩默默在后台帮你定期巡查项目,绝对不打扰你,但一旦发现问题了,他就会跑来提醒你。更有意思的是,遇到简单的问题,他现在会先自己尝试去修一下,只有到了最后真正需要做决定的时候,他才会拍拍你的肩膀,让你来审核把关。 这里我必须得给大家分享一个杀手级的神仙用法,那就是每周 codex 会话,自动复盘。 简单来说,你可以让他每周定期去检查你最近的聊天记录啊,任务结果呀,然后自动把这些经验沉淀下来, 提取成以后可以反复使用的工作流规则。也就是说, codex 会通过这种方式疯狂的学习并且适应你的代码习惯,真的是越用越顺手,太像了!接下来咱们快速进入第二部分, 这里我们要连续讲三个极其容易混淆但又无比强大的概念,也就是咱们的核心三,剑客插件、 skill, 还有 m c p, 这也是咱们这期拆解最核心的干货了。很多人搞不清这三者的关系,其实他们绝对不是互相替代的,而是各管一层屏幕上这个比喻我真的是强烈建议大家截图保存,你看插件呢,就像是能力安装包,相当于咱们买了个崭新的工具箱。 skill 是 一套固定的工作方法,相当于工具箱里面配的那本说明书。而 m c p, 它是连接外部工具的接口,就相当于给咱们这个工具箱接电的那个电源插座。 听起来有点晕,没事咱们一个个掰开揉碎了讲。第一插件, codex 本身是个敲键码的吗?那插件就是为了赋予它眼睛和手的专项能力。打个比方,装了 chrome 插件,它就能直接去测试网页的实际效果。 getab 插件能帮他处理代码仓库的核命请求。如果是 computer use 插件,那就更绝了,它能像真人一样操作你电脑上的高权限应用, 甚至还有 figma 插件,只需要点一下,直接就把你的 ui 设计稿转成前端代码了,简直是开挂一般的存在。 好了,第二点, skill。 如果说刚才的插件是新工具的话,那 skill 妥妥的就是老司机的固定套路。 咱们平时经常遇到像写 readme 文档啊,或者做 demo review 这种高频又重复的任务,你总不能每次都重新给 ai 定一堆规矩吧?那也太累了。有了 skill, 你 直接把这套流程固化下来,变成包含提示词和模板的方法,以后一键就能调用了。这里才偷偷教大家一个大招啊, 要是你自己不知道怎么写出一套完美的 skill, 没关系,直接在对话框里敲下 skill creator 召唤出技能创建助手。 你只要大概描述一下你这个重复的任务是啥, codex 自己就会立刻帮你整理出一套极其完美标准的自动化工作流,直接拿来用就行。 第三个, m c p, 全称叫模型上下文舌协议。如果你是进阶开发者,这句口诀你一定要记死, 怎么做的问题咱们用 skill 解决,而连接什么外部数据的问题,就一定要用 mcp。 你 想啊,让他查最新版的 next js 文档,直接连生产数据库,甚至是读你们公司内部的 notion 知识库,这全得靠 mcp。 这个插座一下子就把咱们 ai 的 视野给无限放大了。 听完前面这些超能力,估计大家都迫不及待想去试了吧。但是先等等,在咱们彻底释放这些能力之前,必须来看看。第三部分,代码管理,也就是咱们常说的安全刹车。 这里的核心逻辑就一句话,一定要刻在脑子里,没有 get 你 就根本无法回退。你要知道, codex 改代码的速度实在是太快了, 万一哪天他产生了 ai 幻觉,误删了你的核心逻辑,或者咔嚓一下把项目给改崩了,要是没有版本控制,你的整个项目可能就真的彻底完蛋了,哭都没地方哭。 所以,绝对不能妥协的安全流程必须是这样的,首先用 get in it 把项目老老实实管起来,把忽略文件配置好,保存一个干干净净的底稿。 然后重点来了,一定要新建一个分支,把 ai 死死地关在这个安全区里面干活。等它改完之后呢,务必务必仔细去看那个 diff 差异对比,只有当你自己测试过,确认完全没问题了,再去进行最终的代码合并。 对了,如果是本地项目的话,极力推荐大家用一个高级技巧,就是 getwork。 这就相当于给你额外开了一个用完即弃的草稿本。比方说,你想让 codex 彻底放飞自我,大胆尝试一种全新的架构, 用 walk tree 把风险隔离起来是最好的选择。改坏了怎么样?改坏了直接把这个草稿本扔掉就行了,主项目连一根汗毛都不会掉。 好了,本地的安全管理聊完了,第四部分,我们要彻底解放你的电脑,去感受一下云端运行,也就是 cloud run 的 魅力。 通过 codex web 端,你再也不用傻乎乎地一直开着你那台本地电脑了。设想一个场景,你正在外面喝咖啡呢,突然发现线上有个 bug, 这时候你都不用慌,直接掏出手机,把修 bug 的 任务丢给云端的 ai, 他 自己拉取仓库。修改完代码之后,会直接给你发一个 pull request, 也就是代码合并申请,你呢,就像个大老板一样审查一下,点个合并搞定。喝完这杯咖啡,工作都做完了。 不过千万要注意云端运行的一个核心大前提,你必须得给他配置好极其明确的安装脚本。打个比方,前端上木,你得清清楚楚地告诉他,上来先跑一遍 n p m install 去安装依赖,不然云端 ai 就 会因为找不到依赖包直接给你罢工的。 只要配置好了这个,他绝对是你摆脱工位实现自动协调的超级神器!终于到了咱们今天的第五部分,我们要着手解决那个让所有程序员都抓狂的 ai 老毛病, 那就是记性差,我们要利用它强大的记忆系统,彻底调教出你的专属 ai 伴侣。 这里我们要用好两层绝佳的记忆系统。第一层是项目级的,也就是在根目录下建一个 agent, 点 m d 文件来设定均规。 你在这里明确告诉他咱们的代码风格是什么,哪些核心目录是绝对绝对不能碰的。第二层呢,就是全局指令直接写在设置里面的保命规则。强烈建议大家现在就去加上这句话,绝对禁止批量删除文件或目录,如果有需要,必须请求用户手动授权。 相信我,这短短一句话以后绝对能帮你避免无数个灾难性的后果。好的,不知不觉咱们就把这七大神仙功能给深度梳理完了,大家现在应该看出来了吧,这哪是什么简单的代码补全工具啊,这根本就是一整套严密无比的 ai 软件工程协助系统, 在咱们下一期也是本系列拆解的最终篇里,我们要真刀真枪地进入实战了,我会带大家彻底打通从需求拆解到最终审查交付的标准工作。流走之前在评论区告诉我插件 skill、 mcp、 云端运行还有记忆系统,你最想先去试试哪一个?咱们下一期实战篇不见不散,拜拜。