你不知道的,你可以用 ai 做的事情。第一个教你使用 ai 来释放我们的电脑空间。我刚才试了一下,确实释放了很多被浪费的空间,我来教你怎么做。第一个,在我们的电脑上打开 copy 看一下,打开了以后,我们输入这段题测时检查我的电脑,找出重复的文件,旧的安装包,我可能不需要的大文件, 以及任何看起来像垃圾的东西。列出所有你建议删除的内容,并附上文件大小。先不要删除任何东西,只给我报告。我们把这个访问权限给他一个完全访问权限好了,就是我们直接开始就可以了。 接着他会生成一个报告,列出所有占用你硬盘空间的文件以及大小。之后你只需要输入请删除第一个和第二个来确认你想删除的内容。这样那些占用的吃饭空间的内容也全部给你腾出来了。如果你觉得这个视频有帮助,请关注我,带你了解更多的 ai 相关知识。
粉丝109获赞2548

很多人刚安装 codex, 不知道这个权限配置到底应不应该放开,如果开了又担心它删掉自己的文件不开呢?又感觉每一步都要确认很麻烦。大家好,我是 fred, 专注从普通小白的视角分享怎么从零开始用 ai 和 web coding 提升自己的生活和工作效率。 今天这一期呢,我就主要跟大家去分享 codex 这个执行权限到底应该怎么去配置,尤其是小白用户啊,一开始到底应该怎么选? 像我现在这台机器的配置呢?其实是比较激进的呀,就是大家可以看到 approve, approval policy 是 选的 never, 然后,呃,这个沙盒的模式也是 danger for access 项目 is trusted 啊,这代表着日常的执行会少很多的,确认文件范围也较大,因为这对于我而言有效率会高一些,因为我的项目有规则,有 get 啊,也有备份,而且我也知道哪些动作必须让 ai 停下来。但如果你是小白,第一天不建议这样去配置,你可以把它理解成当你熟悉之后,然后再可以参考。 然后其实像整个这个权限配置背后有三个开关啊,第一个就是 approval, 就 决定这个 codex 动手前要不要问你 sandbox 就 杀核,决定它能碰到多大的文件范围。 trust 就是 决定哪个项目可以被当做可信的项目。 所以说不用只看一个完全访问权限,它真正的授权状态是这三个东西组合在一起的。只要你能看懂这三项,就能够去判断当前的 codex 是 偏保守还是偏自动执行。 其实像现在 codex 自带的菜单里面,路径已经很清楚了,第一个就是默认权限啊,就是刚安装的时候你可以选它。第二个就是自动审查,呃,适合你觉得确认太多,但还保留风险的判断。 第三个就是完全的访问权限,适合一些测试的目录或者你觉得已经完全熟悉的项目呢。 第四个呢,就是你可以自定义去啊,你的自定义你的 config, 这是进阶的项,不是小白第一天就需要改的东西啊,大家可以看一看。其实我们现在这里面选择默认权限自动审查,包括完全访问权限,以及你可以自定义去修改你的 config 啊。 那对于一个小白用户而言,其实这实操路径也是按这个顺序来的,刚开始用默认权限,然后慢慢地去调整到自动审查完全访问权限,到最后你可以自定义你的自己的 config 啊, 然后最后请记住啊,就是即使是权限放开,但是不代表红线的行为消失,比如说你的 api key 啊,比如说你的数据库,你的公公共的 api 啊,这种真实账号的权限都要单独确认。这里不是说 ai 不 能做, 而是要说清楚范围、风险和退回退方式。总结三句话,就小白还是先默认权限,想审确认再自动审查,然后权限是为了提高效率,而不是为了跳过判断。 ok, 我是 fred, 后面我会继续用真实的案例告诉大家怎么把 ai 用到自己的工作流,我们下期再见。

国内用户如何使用 codex? 这个视频我将教大家不需要解决网络问题的情况下完美使用 codex 软件, 避免使用 codex 时提示输入手机验证。我们需要准备两个软件和一个网站,那两个软件呢?分别是 codex 和 cc switch, 一个网站就是我们要选择接入哪个模型,或者是我们使用的 api 中转站。首先我们可以到 codex 官网来下载,我们可以直接打开这个网址,国内用户是不需要上网环境就可以打开的, 打开后我们可以直接下载,如果你是 windows 电脑,这里会出现 windows 的 版本, 我们直接点击下载就可以。第二步,我们打开这个 cc switch 的 github 仓库,我们可以直接输入这个网址来打开,在这里我们选择下载它的对应版本,点击后我们向下滑动, 在这里我们可以找到不同的客户端,我的电脑是 mac, 所以 我选择 mac 版本,点击后直接会下载 这里你如果没有配置好上网环境的话,下载这个客户端会比较慢,那我在这里已经帮大家下载好了,并且已经上传到了云盘,如果需要的话,你可以在评论区留言,下载好后我们正常安装就可以。 现在我们打开 codex, 现在我们可以看到它,让我们选择登录,这时如果你没有上网环境的话是无法使用的, 那现在我们就用到了第二个软件 cc switch, 我 们正常安装 cc switch 后,我们选择打开它。 打开这个 cc switch 后,我们看最上方的这一栏,我们选择 codex, 在 首次配置时默认是只有最上方的这一个官方 api 的, 下面这三个都是我自己配置的,那如何配置自己的模型或者 api 呢?我们点击这个加号, 在这里我们可以选择不同的供应商,也可以自己填写供应商的名称。那我这里以这个 ai go code 的 这个 api 网站为例,点击后我们看到这里的参数,它已经帮我们设置好了, 我们现在只需要填写一个 api k, 那 我们可以打开它的官网,在这里我们点击登录或者注册,如果首次使用的话, 它是需要充值额度的,充值好后我们可以点这个 api k, 然后在这里我们可以看到这个 codex 有 不同的两个分组,我们可以选择这个速度更快一些的,或者性价比更高一些的。 我们点击这个创建,可以给这个密钥起一个名称,然后点击创建,这时它会生成一个密钥,我们选择复制,然后把这个密钥粘贴到 cc switch 中, 我们选择添加,添加好后我们在这里点击起用,这时我们再将 codex 重启一下, 这时我们就可以看到他现在可以正常使用了。这里我全程都是使用正常的上网环境,我们来测试一下,帮我生成一张,欢迎大家点赞收藏。评论的图片要求十六比九的比例, 它现在已经按我的要求可以正常对话,并且可以生成图片了,而且调用的还是最新的 emoji 二模型, 并且全程不需要登录,不需要其他的上网环境。我们接入第三方 api 的 话,也是用多少花多少。这个方法主要是针对那些没有上网环境的同学, 如果你在安装过程中出现了任何问题,都可以在评论区留言,我会给大家逐一回复, 下个视频我将教大家如何具体使用这个 codex, 它和 cloud code 有 什么区别?我们下个视频见,欢迎大家点赞收藏评论。

今天我们会完成桌面板打开之后的第一次设置,那么我们就开始吧。第一次打开 codex 桌面板,我们要先把界面分成三块来看,左侧是项目和一些插件的入口,中间就是我们的一个对话框了,最下面有一个设置面 板管理。对,那么我们新手进来要先处理几件事情,第一个工作模式,第二个选举指令,第三个批准策略,第四个沙盒,第五个插件入口。 ok, 那 我们先进到设置里面看, 在设置里面左侧有十二个分类,包括常规、外观配置等等。第一次使用我们重点来看这几个,我们先点开常规,常规的第一项就是一个工作模作,开发项目的时候,我们一般选择适用于编程, 你选择了这个模式,那么 codex 会更愿意指示文件命令验证方式。如果你平时是以日常工作居多,比如说是以文字创意等等,那你可以选择用日常工作。在下面的权限区域,我们要来看一个重点是完全访问权限,这里记得是关闭的状态,如果这个开关打开之后, codex 可以 直接编辑更大范围的本机文件,运行网络命令,它的风险会明显变高,所以作为新手阶段而言,我们默认把它关闭掉就可以了。这里的速度可以选择是标准还是快速, codex 会基于跟你的一个整体对话,给到你一个相应的建议,当然如果用快速的话,它的套餐用量也是会增加的,那么我们平时用标准就可以。 那接下去我们来看第二个重点是个性化的,这个选项里面有两个,一个是个性,主要是选择 codex 回复的默认语气, 我这里选择的是务实,希望它能够简洁、专注和直接。第二个我们要去关注的是自定义的指令,这里的自定义指令要知道它是局工作规则,所有的项目都会读到它。所以新手我建议你们只要写八行内容就可以,这八行内容我会放在评论区,当然我自己的会 更完整更长一些。我的结构大概是包括使用范围与优先级通用的一个工作流,安全与合规,通用代码规则,验证与测试提交的规范,常见的项目命令工具,然后输出的一个文本规则。还有一些个人偏好,对, 我觉得大家一开始就用前面的这个八行就足够了,后面当你越用越多。你可以跟 codex 去总结你们经常碰到的一些问题,或者是你自己觉得 codex 经常会犯的一些错误,你把它整理成对应的规则放进去就可以了好吗?它有一个记忆的选项,目前是实验阶段,大家可以把起用记忆这个给开启就可以, ok。 第三个重点是配置,我们来看一下配置的页面配置我们来关注两个内容,第一个是批准策略,第二个是杀核设置。批准策略一般我们都会默认的是 on request, 它的意思就是说当 codex 遇到高风险动作的时候,就会停下来让你确认。当然这里如果说你是用 never, 那 就相当于一次执行到底了,不需要你的任何的批准,所以我建议新手都是用 on request 吧。沙盒设置这里它的默认是 workspace right, 它主要在当前项目里改文件,允许网络访问,这里就是默认开启,你可以把这里的批准策略理解成为它是一个确认按钮,哪些时候需要你来确认?把沙盒设置理解成为 codex 的 活动范围, 你给它框定了一个能够编辑文件和改文件的一个范围,它就只能在这个范围里去进行一个行动。我们再来看一个大家比较容易忽略的一个点,或者是比较容易混淆的一个点, 就是在桌面面板的左侧有一个插件,这里的插件它其实包含了 skill, mcp 和 connect。 skill 是 工作流,是我们的一个技能文件,它里面包括一些代码审查、做表格、生成 ppt 等等。同时像 mcp 就是 codex, code 等等。 connect 呢,是第三方账号的一个连接, 比如说像这 eraser, git, a lotion 都会有,所以这里的插件其实它就是一个能力包的一个合集,像 m, c, p, skill, connect 这些都是它里面的具体的能力,大家根据需要去进行一个安装就可以。 ok, 那 我们再回到设置里面剩下的几个,我们只是来做一个印象, 比如说像外观,你可以基于自己的系统去定义主题色,浅色或者是深色,当然这里有一个隐藏选项,它有一个宠物,看到了吗?这个就跟 cloud code 是 一样的,就是最近出了一个宠物,当你选择唤醒它的时候, 你看它的右下角就会出现这样的很可爱的一个宠物形象来陪伴你头顶。 it 主要是来管理分支的,像浏览器使用和电脑操控,主要针对的就是 browser use 和 computer use, 在 我们后面也会去讲到像以规章和使用情况,就是你本地的一个任务的一个管理和一个用量的展示,平时经常的去看就可以了。

codex 在 a p i t 模式下功能受限,插件用不了,绘画删不掉。开源社区提出外部增强方案,不修改 codex 原文件,通过 c d p 注入增强脚本。 codex 本质纯净,更新不受影响, 中反模式保持官方登录插件可用模型请求重定向倒置定义 api 端点增强功能,插件入口解锁,绘画删除,导出移动用户脚本自定义,非侵入式设计,无需等待官方更新即可扩展能力。 外部注入增强是开源社区常用模式,提升工具灵活性。欢迎在评论区聊聊你使用 codex 时遇到过哪些限制,感谢观看,下期再见!

一定要想尽办法去了解一下现在这个世界上最强的 ai codas, 现在的 ai 之王,因为你只要用过 codas, 你 就会立刻意识到 ai 已经可以彻底颠覆整个人类社会,它是一个超级生产力工具。为什么你之前用的其他 ai, 你 感觉非常的一般?因为 其他的每一个 ai, 他 只会做一点点事,比如说豆包,他只能回答你一点问题和写一点文案,做一点方案。就比如说以前要做视频,你可能要去找奇梦,再比如说你要做音乐,你要去找 solo, 你 要去做数字,你要去找剪映。所以过 过去很多人会觉得 ai 世界会非常的麻烦,要学很多很多的 ai。 而且 ai 没有办法自己去操作抖音,没有办法去操作视频号,没有办法去操作各式各类的销售操作系统,没有办法去操作各种财务的软件。所以呢,你会觉得说 ai 它没有真正 变成一个生产力工具,它只是把生活变得方便了一点点。但是如果你用了 codex, 你 会发现 codex 作为 ai 之王,它可以同时操作天下所有的 ai, 实际上最会做图的 ai, 最好做视频的 ai, 你 根本就不需要去了解,你只需要跟 codex 说,帮我控制一下,去升个图, 帮我控制一下,去生成一个视频, cody 会自己下载,并且自己控制,你不需要学习, cody 做的比你还要好,而且 cody 可以 直接的操作你的浏览器,直接控制你的电脑, 比如说你现在想要养一只龙虾,你不会养龙虾对吧?你可以直接跟 cody 说,帮我下载一个龙虾,并且帮我养好它,帮我管好它,你会发现 cody 把小龙虾下载好了,并且跟狗一样乖的帮你训练着,而且 cody 可以 直接帮你操作你们公司的财务软件, 销售软件,所有各式各样的软件系统,而且它还能帮你干嘛?操作天猫后台,淘宝后台,各式各类的抖音视频后台,也可以把你过去的,不需要运营的,把你亲自去操作的一些事情, 全部都可以用 code 无缝衔接啊。所以你们知道我们公司每一天的工作模式什么吗?打开 code, 然后嘴巴对着它许愿 我们的 codex, 它可以直接的读取我们的销售 c i m 系统,看到我们现在有多少客户正在跟进当中,并且同时能控制我们的飞书和企业微信,读到我们的销售聊天记录,看到哪一些未成交的客户跟我们的销售沟通到了哪一步,然后它会控制着我们的剪 辑软件,或者自己可以控制一个编程软件,然后定向给我们的客户深层演示视频。就比如说你现在是一个美业的老板, 然后你在跟我们的销售在聊天的过程中,我们的 codex 呢,可以直接读取你和我们的销售的记录, 并且根据你的需求点,直接帮你定向的生成一个网站,或者可以生成一个智能体,甚至为你们生成一个你们公司以后有了 ai 之后该怎么去工作的一个完整视频,可以直接自动的发给你,然后我们的销售根本什么都不用做,他可以双手离开键盘,离开鼠标, 等待着 codex 把整个的方案完完整整的做完,然后再把整个智能体做出来,甚至可以把整个说明视频给它做好了,然后它只需要发给客户,然后一个电话就打过去。王总,你看一下这个系统牛不牛, 是不是你想要的?如果是的话,咱们什么时候签个合同?如果你是个老板,必须现在此刻下载 codex, 并且让你们的所有员工全部去安装 codex。 我写了一整个完整的安装流程以及安装的体系,专门来教你们这些企业如何运用 codex 运行到销售、流量管理各个环节,如果需要领取的话,评论区扣 codex。

来看一下秋之 codex 的 一个教程,那首先来看这 codex 和 cloud code 的 一个区别,本质的话都是一个编程的 agent 转为一个通用的 agent, 一个的话是 anthonpy 公司,一个是 open ai 公司开的模型,那个支持 codex 的 话,请用这个 open ai 的 一个 gpt cloud code, 它可以替换任意的模型,你可以接入 deepsea, 对 吧? 接入一些其他的 kimi 啊,什么国产的一些大模型,易用性的话, codex 更友好,适合零基础的一个白领。 cloud code 它自由度更高,偏专业的一个开发者。 功能上来讲呢, codex 它强化了这个浏览器操作,它可以用,对吧?浏览器操作以及 computer use 内置 image 二,它这个深图的以及新增手机端加 hook, 手机端的话,它就是用手机就可以去操作。 cloud code 呢,功能更全。像这个 skill m c p 斜杠命令, hook 更新较慢。 skill m c p 它通用的接口一样的斜杠,用斜杠命令也可以操作斜杠命令,就像那个编程去写那个斜杠命令嘛, hook 更新较慢, 那这个 hook 的 话就相当于是钩子 hook 的 话,它其实就是一个自动地去调用的一些命令, 它就是相当于说呃有一些自动开呃自动触发的一个条件,自动触发的条件更新较慢。价格维度, codex 二十刀的会员的话,对于就白领重度水温的话都是够用了,不分号。而 cloud code 的 话是按这个 api 的 一个调用计费, a 这个 a p i 的 话,它就是去调用,调用这个什么,就调用这个 deepsea 它的一个这个接口去起用这个所呃用的这个额度, 但是我们自己在 deepsea 里面的话,它是就没有 api, 那 我们这个因为你就 cloud code, 它要用别人的模型,这个的话就要去计费了。适用的场景, codex 的 话,它可以用在日常那个办公解决问题, cloud code 的 写作规划,那编程的话,两者都可以给它结合在一起用是最好的。 然后 codex codex 的 安装与基础设置,首先要准备这个 chat gpt 的 一个账户,用免费或者是付费都可以的,它付费的话它就额度更高一点嘛。安装的话就是官网下载安装登录账号初使用的一个设置, 就选择一些日常的工作,选择你的一个什么身份呢?比如说你是学生,是白领,然后你是设计工作什么的。界面来说的话,它是左侧是对话任务管理,中间是进行聊天,右侧的话是输出结果,是非常简洁的一个界面,左侧的话是一个 任务管理对话,中间聊天,右侧就进行结结果,右侧的话就输出这个结果。核心的能力, codex 核心的能力,它与这个 cloud code 与其他的它特别 不一样的一点呢,它是本地的一个文件操作,本地文件操作项目关联,直接去绑定,绑定本地的文件夹,自动去读写,呃,增增删移动文件,不限数量。就比如说 cloud code 的 话,可能你想要让它处理一些文件的话,你就得 呃把这个文件给它上传到云端什么之类的,但是它这个本地的话,你只要去这个文件夹的一个路径给它写上去,那它能自动去读写增删移动文件,就比如说就是你有,有就是几百个,呃, 照片的一个素材,它不限数量嘛?照片的素,视频的素材,但是没有改名字,没有改名字怎么办呢?你可以这样子,需要这个 cloud code 去识别, 识别这个视频里面的内容,给它起一个合适的名字。那 cloud code 的 话它会自动运行去抽帧,就就是这个视频里面去抽几帧,去识别它的核心的内容。比如说雪地上的狐狸这样,然后它就可能给它一个序号,雪地狐狸, 对吧对吧?然后地点,然后在这个对象是什么?嗯,就这样子能够把几百个几百个这个视频它的一个名称都给它修改了。权限模式,就权限模式的话就是你给这个 codex 它的一个权限, 嗯,修改的一个权限默认的话是在文件夹内操作外外需的话就是齐全 自动审查,就 ai 自己去判断。自动审查,自动判断是推荐新新手完全反问全全全部的权限,就是说可能他把你一些东西都改了,删除了,慎用上下文的管理,自动手动压缩或者是斜杠去 给他进行压缩。上下文管理为啥呢?因为上下文的话他就是一个提示词的上下文,他会可能会给你消耗比较多的一个额度, 所以你给它进行压缩,当它就是已经处理到比较下面的任务的时候,可以把它的上下文给它压缩一下。 查看额度的话在设置设置栏里面去看这个状态,能够查看额度案例的话,就是视频的素材批量进行重命名,以及视视频的剪辑合并,都可以用这个 codex。 命令行工具,使用命令行工具的话就像是我们 嗯,电脑就嗯给他就 command, 给他呼起一个,对吧?嗯,比如说让他关机,那你写你就可以 就就是可以就通过通过输入那个文字让它关机,而不是用鼠标的一个操作,这个叫做命令行工具安装。可这个命令行工具可以怎么用呢?首先就是比如说可以安装这个 nod, js、 git 等基础的一个工具部署 agent, 像这个 hermes cloud code, 你可以直接在对话框里面跟他说帮我部署这个 hermes cloud code 等软件的一个管理是什么?像这个 cursor, 然后飞书 cleet, 它这也是命令行工具等的,就给他用安装技能工具。技能工具,你比如说我要去找一些 skill, 也可以让他自己去找飞书 c, 就是 飞书的命令行工具给它安装进来。并行任务是它的一个特特点, 就是多个对话同时执行不同的任务。你可以因为像豆包啊,像 deepsea, 它们都好像就就只能是当前的一个任务,给它回答完了之后它再去做别的,对不对?但它这个完全是可以并行的,就是多任务同时去 执行不同的一个任务。比如说我这视频素材批量重命名和视频剪辑合并的话,两个,或者是说你你另外一个,你去找一个合适的一些图片,合适的一些字体,对吧? 这两个任务是完全不耽误的,可以并行。而且这个理论上的话就是看你电脑的性能,它可以并行特别多的一个任务。 持久的记忆,手动记忆就是 agent md 的 话,全区性、项目性的手动记忆。 agent md 它就什么叫记忆呢?就是一些规则嘛,就是一些规则指令,像全区的话,在设置 设置里面个性化自定义指令,全职生效,它就是对于所有的工作它都就是,比如说你自字体是多少或什么样子的,是吧?它是全职生效的,像项目级就是指对这个项目生效的一些规则的一个记忆,你可以在项目里面手动地去创建 ai, 或 是说 ai 生成。 ai 怎么生成呢?你可以就比如说这个项目进行到一半啊,进行到一定阶段的时候,你可以让这个 ai 去生成一些, 就就是这个全呃,就项目的一些指令。自动记忆,自动记忆开启后对话闲置、自动总结、储存消耗额度,它是不建议手动改。什么叫自动记忆呢?它就是相当于 ai 的 一个自动记忆的功能嘛,就你的一个工作风格,你的一个 偏好什么之类的,有各种各种维度的,那它的话, ai 的 话它会自己进行总结,总结一些规则,然后可以有一些附用的经验的话,就是下一次的话它就会用。还有是 往下看呢,它是一个持久记忆。就图片生成与项目开发内置了 image two, 你 可以用一些就是提示词去生成这个高级感的一个图片, 而且可以不断的去调整自己的一些提示词,什么之类的。计划模式可以去做一个网页 复杂的任务,先列计划,再执行计划模式,他有点像是那个开发的模式案例的话,就比如说个人主页的一个开发,深层修改、预览部署是怎么生成呢?他个人主页的一个开发,你首先跟他说自己的这个 想法,那他的话会给你列出计划的一步一步,而且在每一步上面,他比如说你这高级感的一个图片的话,他会让你去选择某些风格的, 就一步一步去选择,他会给你三四个选择,那所以深层修改,而且右边的话,他可以预览整个个人主页的开发的一个效果, 最后部署的话可以就发布出去使用的功能呢?任务引导纠篇任务引导纠篇是什么意思?就是说你在完成这个任务的时候,你纠篇,你觉得啊,他这个说的不太对了, 你跟他说的话,他其实不会打断这个任务,只会在下一次的时候进行一个调整,这样的话就不会浪费很多的这个额度,嗯,而且也不会让他跑偏。对话分叉 fork, 他 是在就是整个 整个,呃,就是任务结束之后它会有一个 fork, 是 在这个右下角,右下角 fork 的 话,你会觉得它这是不是有点跑偏了你,你会想着说怎么给它纠正这个 fork, 这里面的话可以进行一些小调整。桌面宠物的话是 一个有意思的一个,就是小宠物在这边插件与操控常用的一个插件,它其实常用的一些插件的话,它就是一个 skill 啊, m c p, 然后包括 c c, 呃, c l i 的 这种 类似的一个集合就插件,它就是会实现一些功能浏览器的一个操作, get up, 然后表格 ppt net nullify however vocal 的 这个部署 browse use 的 话,它是浏览器的一个操作,怎么浏览器操作呢?它能够操控浏览器进行点击方页,然后表单自动化,就比如说你可以让它去做一个呃 m b t i 的 一个测试,或者说基于你的一个性格 去去帮你,帮你测试,它能够自己去选择,然后得出一个答案。 chrome 插件的话可以操控已经登录的浏览器,而且后台是它是在后台,后台多任务操作的,就根本不影响你,你自己去去做这个浏览器 的一个,对吧?你自己还要用这台电脑去浏览其他的页面,完全是 ok 的。 computer use 就 操控电脑的 app, 就 仅 mac, 比如说音乐微信剪映,比如说让它去打开一个音乐软件,把这个音乐发给微信,是吧?或者说就把这个音乐加到这个剪映里面,这个它可以操控这个电脑的 app, 仅在 mac 上是可以实现的。 skills 技能定义 skills, 比如 find skills, 自定义一些 skills 创建的话就是整个流程,流程跑通之后,你可以把这个整个流程怎么样,沉淀下来就附用,沉淀下来附用就直接指令,你就说,哎,就按照这个项目流程去创建这次的这个 skills 案例的话,比如说我想要去做这个 写一篇图文推荐的图文,就 get up 上面的一个热门项目的推荐图文,就在我就是不断地去给它调试后觉得这个结果是满意的,那就把上面的这个流程方法生成这个 skill 下一次, 对吧? ugetup 上面的热门项目就大概每周的话它都会更新,那它就是你每周可以做这个 skills。 m c p 连接 m c p 的 话有点像是 u 盘插口,插口去去把外部的一个数据连接外部的一个知识库服务去安装, 可以就是自己去做,也或者是说你直接让这个 ai 自动授权安装案例的话,比如说 notebook l m 的 一个知识库的连接,知识库连接之后你就可以直接去提问这个知识库里面的一个东西,调用知识库里面的一些 呃,就比如说它这里面存的一些呃反弹啊之类的。自动化定时任务创建的方法,可以在自动化面板上面创建,也可以直接跟这个对话,让它创建案例的话,比如说每周都给我 呃生成 get github 的 一个推荐图文,因为我们这个 skills 不是 已经沉淀下来了吗?然后现在的话就给它定时每周生成,那我们都根本不用去记这个事了,它就是它定它到,比如说周一或者什么时候它就会生成,或者说每日的工作日报的一个汇总, 它也能够给它定时生成,这就自动化的,自动化的那就怎么样子不用人为的去给它介入了。手机端的一个操控,前提的话就是这个手机要下载这个 check gpt, 然后电脑的 codex 更新到最新版本,操作的话就是手机端侧边栏的 codex 授权去连接电脑。 功能是什么样子的?手机端操控就是你远程你就电脑,对吧?你就开着那远程去下发任务,控制电脑干活, 直接能够控给他一个指令,他就能够控制电脑干活,免费版可用,支持 mac。 总结的话就是说这个 codex 的 核心能力是文件操控,而且是本地的一个文件操作命令行操作。持久的一个记忆,持久的记忆一些规则深图的开发 插件的操控 skills skills, 然后 m c p 的 话连接外部的一个知识和数据库自动化,可以自动化定时任务。核心的认知呢?我们现在已经从 问 ai 要一些答案,先到管理 ai 准备一些上下文的一个环境,制定目标,检验成果,去沉淀这个流程,去转变核心的认知。就是我们现在已经到了,就说从问 ai 要一些答案,到就是管理 ai 准备上下文,定目标,验 结果,然后沉淀这个,呃,流程,就让它这个整个流程的话给它自动化 sop 是 吧?

今天来和大家分享一下我们如何利用 codex 来帮助我们收集整理以及分析我们的网页端的数据。我们打开 codex 之后先进入设置页面,这时候就需要注意了,你要 清楚自己想要获取的这个网站数据是否需要你登录才能获得相应的数据。如果你想要的网站数据不需要登录就可以获取,那你就可以点击这个浏览器, 把这个 browser use 这个开关打开。如果你想要获取的网站的数据需要登录,那你就点击这个电脑操控, 把这个允许 codex 控制电脑上的应用开关打开,再把这个 google chrome 的 浏览器扩展程序的开关也打开, 当然你也要下载一个 chrome 浏览器。我们返回主窗口后点击新对话。我们先设置一下允许 codex 访问的权限,我不希望 codex 老是让我审批它的一些操作,所以我会给它完全访问权限。 如果大家不放心的话,可以选择默认权限或自动审查。选择这两个访问权限有好处就是它会自动在沙河隔离环境中执行任务, 坏处就是它会老是让你审批它即将做的一些操作。是要安全性还是要完全的自动化,大家自行考 量,我们可以在这里选择。这次任务的推理程度,我一般选择的是超高,但是相应的它的执行速度也是最慢的。如果你是 chat gpt 的 plus 和 pro 用户,你可以选择快速模式,但是快速模式会消耗你更多的 token, 这点大家也需要注意一下。 你们可以看到我这个提示词非常的简洁,没有要求 codex 该返回什么样格式的文件给我们,也没有要求 codex 应该把文件存放在什么位置,这是因为现在 gpt 五点五已经足够聪明了,它可以自己决定最后的文件是什么样的格式,以及把文件放在哪里,我们编辑好提示词之后直接发送就可以了。接下来就是坐等 codex 帮我们整理好数据, 我们还可以在这里展开 agent 的 思考过程,这样我们就知道它在完成任务的过程中都做了哪些工作。 codex 花了十五分钟帮我们把想要的数据整理好了,并以 excel 的 文件的形式存放下来。我们可以直接在 codex 中打开 这个 excel 表格,可以看到在超高的推理程度下,它生成的这个表格是非常的详细的, 有摘药,有全部视频的,有某一个视频平台的详细数据的。我在拿到了这些视频的数据之后,可操作性就比较强了,我可以知道观众大概喜欢看什么样的内容, 并且让 codex 给我一些接下来的视频的选题的建议,我会持续分享更多如何利用 ai 来提高我们的生产案例。非常感谢你的观看,我是 jack, 我 们下次再见,拜拜。

好,我现在用 codex 啊,去做一个管理我电脑的一个方法啊,整理电脑文件,比如说我现在在 codex 输入一个命令,整理好我 桌面的文件,不要删除任何文件。好,我现在就给他一个完全的访问权限,然后直接执行。 好,他给我一个回复啊,不会删除任何文件。开始整理可以看到我的桌面啊,其实也不是很乱的,但是呢,只是在做一个测试。 好,可以看到瞬间把这个整理完成了啊,五月十一号这个整理,然后给我说出来一个结果, 对吧?然后他把它分类表格文件、其他文件、图片、网页文档文本打开,你看这里有网页文件啊,所以呢,你看它这个比那个 manos, 它基本上已经可以替代这个 manos 的 这个功能了,就是 codex, 它的那个手已经可以伸到 啊这个 windows 电脑里面去了啊,一个简单的视频。

如果你也想像甲方一样用截图给扣带题修改意见,又或者是让他撤回整改,最后再让他这么快处理,那么这三个小技巧一定要收藏好。 一、中途介入修改 ai 帮我预设了这个风格,但是我不想要直接在这输入你的新需求,点这里的引导, ai 就 能顺着我们的新提示来调整了。 然后接下来两步,有一个非常重要的一个前提,就是你需要有自己的 get 仓库。在个人主页里右上角的创建 new repository, 输入项目名称确认,然后这里点复制 这是你已经创建好的网页,直接帮你出场这个项目,这就出场成功了。点上方的文件夹,创建永久工作树。那我还有一个问题,我们的自己创建的永久树跟我直接在下面打开一个窗口,有什么不一样呢?我要回答你, 新窗口会共享代码,工作数是独立运行,再决定要不要合并。先左侧创建两个工作数, 依次打开网页,各自在这输入需求,出现小蓝点,就是任务完成了。来刷新看看效果吧。风格灵感加入了新标签,看看这个新的品牌故事吧。 再回到主项目看看,恭喜你已经学会了多模块处理了。再补充一个最近常用的注试,哪里不会就点哪里,真的超级方便呀! 这里直接提交修改就好了,可又要当甲方爸爸说要用回上一版时啊,这完全不知道咋办了。没事,点右上角的 vs code, 点这里的 get, 在 这找到你要返回的版本,点击 复制提交哈希,回到聊天窗口恢复版本,并粘贴刚刚的哈希,等待执行完成就刷新看看。恭喜你学会了回退版本。

昨晚 codex 来了一波大更新,这次是真挺猛的。首先说一下这个最实用的新功能, app shells, 以前那个 ai 描述问题要截图,要复制代码,最后还要手动解释半天。现在直接在 mac 上按住左右两个 command 键,当前窗口就直接传给 codex 了。这次不只是截图,是截图加文本一起打包进来, 重点在于它不只是读,你屏幕上的 vx 里只显示了五十行代码,没有问题。 codex 读的是完整的上下文,不是你肉眼看到的那一个页面。 整个生态也很丰富,比如说 figma 终端浏览器 notion 等等全部都支持,相当于把你的工作界面整个共享给了 codex, 效率直接拉满。第二个更新是 remote computer use, 手机上就能操控 mac 的 codex 任务,哪怕你的 mac 锁屏了都没有问题。 幻想一下未来的办公,电脑后台多个 a 程序在一起跑,你出门旅行没有带电脑,躺在床上也能指挥 mac 跑脚本发版本是不是方便多了?第三个是构模式正式上线扣代码了,现在 app id 插件 c l i 全线可用,你只需要给它个目标,它就可以自己保长线任务, 中间随时可以暂停或者改方向。我个人的小建议是,配合 plan, 请把方向锁定,加上 set, 随时开个临时对话窗口确认思路,再用 go 模式跑长线任务的时候会稳很多。最后是浏览器内置高级注视模式,可以直接在页面上标注修改甚至编辑元素, 比如说这个字太小,这个颜色不太对之类的视频的。最后我再补充一个细节,现在扣带才支持团队共享插件 team 版本的用户可以批量给其他成员分发插件包、技能、 m c p、 服务器等一起推,省去一个个配置的麻烦了。

美好啊,朋友们,这是一期 codex 奶妈级的零基础系统教程,这期视频我会从安装开始,手把手地把 codex 的 基础能力到高级功能的组合,以及最新的手机端操作,用十个实战场景来带大家彻底拉通 以后这一类的 ai 产品,出一个算一个,你都会触类旁通,游刃有余。我也把这期的文字课间整理成了文档,那这期的含金量可谓是 biu biu biu biu biu, 一个点赞收藏关注是最起码的。好了,不多说,学费都交了吧,我们上课, 那在开始之前,我先说一下 codex 和 cloud code 的 区别。从本质上来说,它俩都是由编程 agent 逐步转向了通用 agent, 分 别是 ansapi 和 open ai。 这两家出的 cloud code 呢,默认使用 cloud 模型,但是我们可以自行替换成任意其他的模型,那在易用程度上, codex 桌面端的产品设计是会更友好的, 更适合零基础的白领工作者,而 cloud code 有 更高的自由度。在功能上, cloud code 原本是最齐全的,什么 skill、 mcp、 斜杠命令、 hock、 远程操控,这都是人家先发明的。但是呢,最近的 c c 更新稍微不如 codex 那 么快了,会更加偏向专业开发者一点。 而 codex 发了非常强的浏览器操控和 computer use, 还内置了最近的 image 二深图模型, 而且昨天还刚刚发布了手机端和 hock, 可以 直接用你的手机 check gpt 来控制电脑上的 codex 干 活。那价格和额度方面呢? codex 的 会员额度非常大方,二十到的会员就很够用,而且还不封号。 而 cloudpod 呢,大多数人可能都没法用它的官方账号基本上都得自行调用 api 的 费用属于是花多少用多少,风险由人。那在使用场景上,我个人喜欢用 cloudpod 搭配 cloud 模型来写作,因为 ops 四点六的写作和规划能力真的很强, 那 codex 的 执行和解决问题的能力也很强。日常的办公场景,我会选择用 codex, 那 在编程的时候嘛,我就两个都用上,所以结论是,入门的朋友用 codex 就 很强了,有条件的朋友呢,两个都来是最完美的, 不过两者的逻辑其实都是一样的,我们学一个,另一个也就会用了。那 cloud code 我 也做了一期系统教程,想拥有左膀右臂的朋友可以去看看。 ok, 正式开始 使用 codex, 我 们唯一需要准备的就是一个叉 gpt 账号,免费的也行,只是会额度稍微少一点。那有了账号之后,我们就直接去它的官网双击安装, 然后安装好之后登录我们的叉 gpt 账号,然后这些设置我们可以先随便选一点啊,选个日常工作,反正后续呢,我们都是可以改的。那搞定了, 那进来之后呢,大家会看到这个对话窗口,好像跟 chat gpt 是 很类似的。那我们打开两边的侧边栏也蛮眼熟的,左边呢,可以管理对话和任务的列表, 那中间就是聊天,右边大概是结果之类的吧,大家应该都能猜个七七八八,所以我们先不深究它的页面,我们直接开用,这其实也是我探索所有的 ai 工具的独门秘方。 我打开一个陌生界面呢,我先不管别的,我先找到我能对话的框,我先聊,先找到我能看得懂的按钮,先按,按着按着你就会了。你看看,独门秘籍都教给大家了,以后你们就是为师的弟子了。 ok, 众弟子不必拘礼,我们还是以学业为重啊。那我们第一个要了解的 codex 能力呢,就是本地文件操作, 也是这一类桌面端的 agent 跟对话 ai 最显著的区别和能力。因为过去我们用叉 gpt, 如果说我们要让它看到我们本地的内容,我们只有两种方式,一个呢就是复制粘贴到这个对话里,另一种就是以它允许的格式和数量把文件给上传上去。 但是 codex 不 一样,它可以自主地读取和操作我们的本地文件,而且不限数量。比如说我作为一个剪辑,我的本地里面存了八十多条视频素材,这都是我剪辑要用的, 但是呢,这个命名全都是乱的,完全看不懂,所以我想以这些视频的内容来命名,到时候我们看见文件名的时候,我们就知道这个素材是什么。那这事 check gpt 肯定是做不了的,但是 codex 可以 我们来看这两个地方,它都显示了一个概念,叫做项目, 我们选择一下,哎,一选择项目,他就让我们选择本地的文件夹了,那我们只要选中这个文件夹,那这个文件就是我们的项目了,里面所有的文件 codex 都可以自由的读取和操作, 当然这需要我们给他权限。大家看这里的权限选择啊,目前呢,我们是一个默认的权限,我们再点开,他有三种权限模式, 那默认权限的意思呢?就是在我们当前的文件夹内,他可以自由的去读写这些文件,但是如果他想要联网呀,或者是帮我们下载一点东西啊, 或者是碰这个文件夹之外的其他文件,那他是不行的,如果他必须要做,就会要向我们提出提高权限的请求,我们点同意才能继续。 那自动审查呢?顾名思义就是有个 ai 自动帮我们审查,由 ai 来判断这个操作危不危险,如果危险呢,就来问我们不危险的,比如说他去下一个知名的这种官方软件什么的,他就直接开干了。 自动审查比默认模式要更宽松和智能,建议大家选这个就完了。那最后呢,是完全访问权限,这意味着 codex 可以 在你的电脑上几乎什么都能干,它可以修改删除任何文件,它可以在任何位置执行命令,例如说它可能会去把你的 cloud code 给删了。 开玩笑啊,它一般情况下是不会这样抽风的。 ai 呢?也没有嫉妒情绪吗? 大家尤其是新手朋友就选择自动审查模式,相信 ai 就 完了,毕竟咱又能审的比 ai 好 多少呢啊,对吧? ok, 那 我们选中了刚刚的这个视频的文件夹,继续来提出我们无理的要求,让他帮我们把这个文件夹里的所有视频素材都按他们的实际画面来重新命名。哎,他就开始做了, 而且大家看他非常的聪明,他先看了看我们到底有多少个视频,然后他选择用抽帧的方式抽取关键画面来判断内容是什么,而且他还知道他不要一张一张图去看,他给拼成了缩略图的形式,一组一组的去看。 ok, 很 快啊,这个文件夹里面的文件名就全改变了。过程中呢, codex 也是没有向我们提全的,因为他都是在这个文件夹内去操作的。那我们也可以检查一下他都对应好了没有。 ok, 钢琴家音乐演奏厅,没错, 雪山近身格斗,没错,旗袍女人夜巷卖热饮哇!而且他的这个命名还遵循着一个序号,任务、场景、行动的一个清晰的命名格式。 ai 做事的这个细心程度啊,人类你不服不行。那另外呢,我们其实也可以在同一个项目里面去开多个不同的对话,它们的上下文都是不一样的,但是同样都可以随时的访问我们这个文件这个项目。 比如说,我们在另外一条对话,我们又给他一个不同的任务,让他想办法把所有关于风景的视频都剪成一整条。 哎,没想到吧,他真的能剪,他自己想办法,用了一些工具问我们要了一些权限,用这个 ffmpeg 给它拼在了一起,效果的确是关于风景的都剪成了一条。 ok, 那 如果我们要创建一个新的任务,我们其实也可以手动的在这边创建,他也会自动的在我们本地创建一个文件夹。 然后呢,我们跟 codex 对 话的整个过程, agent 产生出来的任何文件啊, pdf 啊,什么 markdown, ppt, 它都会直接存在我们本地的电脑上。 ok, 到这里,大家应该 get 了 codex 呢,可以随时地访问我们的本地文件,去读取内容,写文件,删文件,移动文件,文件夹里的内容也就成了我们的 codex 随时可以获取的上下文,那这里的项目也就对应着我们在本地的一个文件夹, 哎,那刚刚这么个任务会花我们多少上下文呢?我们只要看这里就能看到了。 那这个小圈代表的是我们现在的这个对话和里面的操作,一共使用了 gpt 五点五的多少上下文窗口。 如果我们把鼠标悬上去呢,它还会有更详细的一个信息,当上下文快满的时候, codex 会自动地帮我们压缩上下文。不过其实当我们一个任务告一段落之后,不用等它快满了,让它自动压缩,我们也可以自己通过斜杠压缩这个命令 来手动的去压缩上下文,这样呢,可以让模型更聚焦在我们的新任务上,也省一点上下文的额度。那当然大家除了这个对话的上下文余量,其实我们还想知道我作为一个免费用户,或者是我作为一个 pro 用户, plus 会员,我还有多少总共的额度可以用,对吧? 这个呢,有两个方式查看,一个呢是左边的设置,这里我们点开剩余额度,就能看到你五小时内还剩下多少,那本周内又还剩下多少, 甚至呢,也有什么时候到期会刷新的一个提示,这个产品的设计还是比 cloud 的 友好很多的。那另一种方式呢,就是我们可以直接在对话框里输入斜杠,然后找到这个状态, 那打开这个状态之后,它的绘画这里就会持续的显示我们的上下文余量,这个五小时和一周的限额。但再次说实话,这个 codex 的 额度还是非常大方的,二十到的额度我认为是可以满足大多数白领工作的高频使用的。 ok, 那 顺便呢,我们也介绍一下这里的模型选择, 那点开之后,我们可以选择速度,快速呢,就相当于加急通道,会消耗我们更多的额度。那这里呢可以选择其他模型,但是大家都选五点五,因为它确实更好用。然后呢,这里可以选择智能程度,其实呢一般中度智能就够了, 所以我们选高。 ok, 那 这个小麦克风呢,肯定就是语音输入功能了,比手打字还是要快很多的,但是呢,它的转录速度远不如大家去下载一个语音输入法,还是非常推荐大家用语音输入的 好。那现在我们通过一个本地文件处理的案例,也了解了 codex 上常用的一些功能。那 codex 的 第二大能力就是命令行工具使用。 其实刚才我们说到权限的时候就有提到,在默认权限下,它可以读写文件,但是却不能执行一些命令,一些联网的操作。那这些命令是什么意思呢? 刚刚的案例其实也已经用到过了,比如说它把视频抽帧出来,还把几个视频拼接到一起,它用到的 ffmpeg 就是 命令行工具。 还有一些我们熟悉的命令,比如说我们在终端里面来克隆一个 gitup 仓库,或者是大家近期比较熟悉的,我们在命令行里面输入一些命令来下载龙虾和各种依赖。那 codex 的 第二大能力就是在我们授权的情况下,可以使用我们的终端来替我们做这些事。 那我们就来让 codex 帮我们来安装一些平时对于小白来说非常复杂的东西吧。第一类,常用依赖,比如说什么 node gs 啊, git 什么的, 也是大家以后使用各种 agent 或者是做其他项目必备的一些工具啊,那之前大家要装这依赖都得去看一个手把手教程,然后照着命令抄,挨个装。那现在我们就直接跟 codex 说帮我安装个 node js 给他发过去, 也是因为这些东西呢,其实都是比较常见的东西了,所以在我们的自动审核的权限模式下,你看他基本上都不问我们要提权,就熟门熟路的帮我们装好了。 那第二类,就是那些爆火的但是有上手门槛的一些新的 agent, 比如说龙虾,爱马仕,甚至还有这个 codex 的 竞品 cloud code, 我 们都可以让 codex 帮我们装完了呢,它还能教我们该怎么用。那我们装一个 hermes 吧, 我其实都不需要给它官网和仓库链接,我就说最近有一个叫 hermes 的 agent 很 火,你帮我安装一个吧。 哎,他就会自己去搜索,然后帮我们判断到底是哪一个。然后呢,他根据官方的文档帮我们陆续的装好了,还帮我们验证过已经装好了,你瞧瞧,那我们照着他说的来启动一下试试。 哎,真的帮我们装好了,那往后的配置我们就不在这里继续了,但是大家应该 get, 有 了 codex 以后,那些复杂的要收你五九九的部署,你都可以直接让 codex 帮你做了,怒省五九九。而且我们在使用的过程中遇到任何问题,还可以截图去问 codex, 什么瞎死了马挂了,升级出现了问题都可以让 codex 直接帮你修,是不是很方便? 那第三类有点没那么必要,但它其实也可以,就是像 cursor integrity 这种软件应用, 平时都是我们去手动在网页上下载的,它也可以帮你下载和卸载。那大家用 codex, 我 其实也建议大家去下载一个 agent 的 ide 啊,因为现在 codex 有 个缺点是它没有办法打开我们的文件内容,直接去手动编辑。 虽然这个侧边栏呢,是可以看到一些文件结构和内容的,但是我们都没法编辑,所以大家可以让 codex 下载一个自己喜欢的,比如说我们就这样下载。那下好之后呢,我们再执行一个 git i n i t 一个初步化, 那右上角就会出现这个东西,随时可以把我们的项目在编辑器中打开,我们来手动编辑。 那第四类就比较重要了,就是 agent 本身会常用到的那些 skills 啊, mcp 啊和 selli。 那 skill 和 mcp 本身 codex 也是支持的,我们后面会详细讲到, 我先挑两个大家安装一下,方便我们后面综合起来来做案例。那这些 skill 和 c i 呢?通常来讲不像那些 get 那 种大项目那么著名,所以我们最好是找到它的具体仓库,或者是明确的官网地址。比如说我们下载一个专门找 skill 的 这个 find skill 哦,方式就是直接把链接拷贝给 codex, 然后跟他说帮我装一下这个 skill。 那 在他装的期间,我们也说一下 codex 的 另一大好处,并行任务处理, 我们完全可以在他做这个事情的时候再开一个对话,让他去下载一个别的。那我们下载一个飞书 c l i 吧。飞书 c l i 其实非常的典型, 因为现在呢,有一些积极 ai 化的软件,把几乎所有他在软件里能做的操作都做成了命令,让 agent 能够方便的去操作,我们把这个链接发过去,让他开始下载, 那这边呢,其实会显示每一个正在处理当中任务的情况,这个在转呢,就说明它正在执行中,那这个蓝色的点呢,就说明已经完成了,有时候还可能会出现一个需要你申请权限的一个标识。 ok, 那 这里 fan skill 呢?它是已经装好了,我们再看飞书 c l i 这边,它会引导我们去做一些授权, 我们就跟着它的引导去完成就好了。 ok, 那 装好飞书 c l i, 那 codex 就 能帮我们去做飞书里的各种操作了,比如说写文档,发消息,见日历,做表格什么的了,我几乎每天都在用, 好大功告成。我们就这么一个小章节,我们就用自然语言的方式让 codex 帮我们装上了 hermes node, 飞书 c l i 一 大堆东西,这就是 codex 作为 agent 的 第二大常用能力,命令行使用。 那这个能力和这个章节的演示也是希望大家能够 get 到一点,就是我们现在在电脑上想去做的很多很多事情,都可以让 codex 这样的桌面 agent 去做了。那 codex 的 第三大能力是持久记忆。 看过我那篇 cloud code 的 朋友应该都知道, c c 呢,有一个手动的持久记忆, cloud 点 md, 还有一个自动的记忆系统, 都是把我们希望 agent 能够长期记住的,比如规则、篇号和我们的信息之类的东西,以本地文件的方式存在我们的电脑上,然后事实的时候把这些记忆以上下文的方式注入到 agent 里去。那 codex 也是类似的,它也有这两套持久的记忆系统 在 codex 里面呢,手动的持久记忆文件叫做 agents 点 m d, 而且它也有一个自动的记忆机制,来我们打开设置,找到个性化, 那在这里的这个自定义指令实际上就是一个全局生效的 agent state md, 它会在我们任意的项目跟 codex 对 话的时候,它都第一时间作为上下文发给大模型,那我们可以手动地自己在这里写,不过我更喜欢呢,直接在对话中去跟 codex 说, 比如说我说一个,我希望你以后对非书文档里的任何修改都使用一个专属的你的文字颜色和用删除线的方式来修改,不要直接的修改。然后这个帮我寄到局的 a 正 c m d 里。 ok, 那 它这里呢,告诉我们已经写好了,我们再打开个性化这一块,就的确是多出来了这么一套规则,那实际在使用当中,它就会去遵循我们这个规则了。 比如说我这里已经有一篇非输文档了,我在侧面呢也评论了几个我想修改的地方,我直接可以把这个链接发给 codex, 我 让他根据我侧面的评论帮我修改一下。 那因为我们刚才确实已经装好了这个非输的 c r i 也都给他配置好了权限,所以 codex 是 直接可以操作我们的文档的。 ok, 看看它完成之后的效果。 果然他用了紫色的字和删除线的方式来帮我们做的文档修改,那这个呢,是局的 agent md, 适合记一些适用于所有任务的一些大原则,比如说我们的工作习惯,我们要说中文,我们的工作偏好修改文档,要留下这种修改痕迹等等等等。 那另一种呢,就是项目级的 agent md, 这个长期记忆呢,只在这个项目当中生效,我们可以选择一个项目的对话,然后打开编辑器, 自己在这里手动的创建一个 agent 的 md 的 文件,然后我们去写一些针对我们这个项目的一些规则, 当然也可以让 codex 来帮我们写。我个人的建议呢,是在这个项目文件里面有了一些内容之后,让 codex 根据他对我们项目的了解来自己帮我们写。那自动记忆怎么回事呢? 其实我们刚才在这个个性化这个下面我们也看到了,我们需要手动打开这个自动记忆功能, 它的机制是我们打开这个功能之后, codex 会在我们结束对话或者是结束任务,这个对话闲置一段时间之后,它帮我们把那段对话总结成记忆,然后记在一个地方。但是它有几个原则,第一太短的对话它就不记了, 那第二这个对话的总结它一样会消耗我们的额度,所以当我们的额度太低的时候,它也就不记了。 并且这个自动记忆文件呢, open ai 官方是不建议我们去手动修改的,顶多我们可能删一删有些没必要的信息,那这个文件大概是长这样 的,是一个任务,一个任务在记录的,主要呢会写上这个记忆的来源是哪段对话呀?以及它的工作目录是什么,那以及以后触发了什么关键词的时候,它会去召回这段记忆, 再往下呢,是用户在这件事情上的偏好大概是什么样的?那第五段呢,是一些可附用的一些知识,一些踩坑的记录,那这些内容都是 codex 自己记录的,并且以后也是会它自动的招回去使用的,我们就先不修改它, 它这个格式确实也不太方便修改,更多的时候我们对于明确的规则和要求,我们还是通过组织 agent md 来实现。那大家学完这些视频之后呢,我也想给大家再做一期, 通过组织不同层级的这种 agency md 给自己做一个非常懂你的,可以做不同类型事情的超级助手的视频,感兴趣的朋友可以扣个一。 ok, 那 第四大能力就是 codex 可以 直接用到 image, 二来生成图片。不过呢,深图功能其实是一个小功能, 所以这一章节呢,我们不只会用它的图片生成,我们会带大家做一个完整的个人主页的开发项目,并且在了解一些 codex 在 小白开发中的一些用法和功能。那我们再来开一个项目,叫做个人主页, 然后我们点开这个加号,我们把计划模式打开,因为我们要做一个网站嘛,任务会复杂一点,所以打开这个计划模式呢,他会先帮我们列出一个详细的计划,我们确认之后他再开始行动。 计划模式呢,比较适合我们的任务有一定复杂性,或者我们自己还没想清楚,可以跟 ai 讨论出一个计划。那假设我们现在就是第二种情况,我们其实没想清楚,我们直接跟他说我想做一个个人主页, 那你看他看到我们的项目中是没有内容的,所以他以这种选择框的方式来询问我们的细节,这些选项呢,大家可以按照自己的要求去选择,那我就选这个个人品牌吧。 然后如果说这些选项中没有我们满意的呢?我们也可以选到最后一个来填写我们详细的要求,比如说我要他修饰感,也要高级感,然后我选针对合作伙伴,不要个人照 中英双语,巴拉巴拉巴拉。这里真的是问了我们相当多的问题啊,那最后呢,他给到我们出了一个详尽的计划,问我们是否实施此计划,那其实基本的计划我们看着没有什么问题,但我们也可以补充一些调整方案。 比如说我们刚才就要说到了要用它的 image 二的生成能力,我们这里没有体现,我们加一句网页上要多用一些图片,使用 image 二来生成一些高级感的图片,然后我们一起提交。 哎,那他又问我们要走哪种高级感呢?我们如果点开这个小叹号的话,还能看到他说的这个风格到底意味着什么意思,这个产品的小细节真的是我很喜欢,那我们就选他推荐的吧。然后他出了一版新的计划,我瞧着没什么问题, 去吧。 ok, 他 就开始初识化这个项目来逐步帮我们生成了。那这个过程呢,肯定会需要一定的时间,在这个期间我再给大家补充一点点知识点。呦,他的第一张图出来了,不错,挺有艺术感的,果然是最强的 emoji 二,那我要补充的这个知识点呢,叫做引导。 如果说大家在 codex 执行一个很长的任务的过程当中,你觉得他有点跑偏了,我们是可以随时给他补充纠偏的,比如说我们补充一下图片的人味要更强一点,而且不要这么冷的色调。我是一个 ai 博主,然后我们发送出去, 哎,大家会看到他没有立刻打断我们的任务,没有发出去,实际上他在这里排队呢。那我们看到右边的这个引导按钮,他写着我们不打断模型运行,会在下次调用工具后发送过去。这个是非常好的一个功能啊,我们点一下, 哎,他就可以发出去了。这个功能呢,可以让 codex 不 用在错误的道路上一路狂飙,把我们额度都花光,也不会让它重新再跑一轮任务。那另外一个小功能点,我们找到一个已经结束的任务, 我们看一下这个 ai 的 回复,每个 ai 回复的下面都有一个这个按钮,叫做分叉 fork, 这个的意思是我们可以随时从这里开始去开一个新对话,非常适合那种前面聊的还好好的,上下文也非常有价值,但是我们再往下聊,就聊的有点叉劈了的时候。哦,还有个小功能,宠物, 我们点开设置外观,然后这下面就有一小对小宠物可以选,甚至呢,我们还可以点击创建,让 codex 根据对我们的了解来生成一个定制化宠物。那我们先点击唤醒宠物, 哎,就会在桌面上有常驻这么一个小桌宠,脑袋上会冒出来 codex 正在做什么的一个提示,别的呢?好像也没什么用。 ok, 终于在他跑了七七四十九分钟之后,网页完成了, 我们来看看效果,因为 codex 呢,有一个内置的预览浏览器,我们可以直接打开右边的侧边栏啊,我们还给它放大一点。 嗯,这个网页的效果确实是不错啊,不过呢,现在的 a 证呢,其实都有这么一手了,那它这个预览浏览器呢,还有一个好处,我们点击右上方这里的一个批注按钮, 我们就可以在这个页面上选中这里的具体元素去写修改意见,包括重新生成图片,比如说我们要这个 logo 放大一点, 然后 p 住这里这张图加上一个人物,好把这个删掉, 那然后对话框里呢,就会加上我们这几条批注,然后我们点击发送,它就会针对我们的意见进行修改了,是不是挺方便的?那我们现在项目有了雏形之后,我们再 call back 一下刚才说的 agent md, 其实现在呢,就是一个让 codex 帮我们生成项目级 agent md 的 好时候了,因为我们也有了一定的内容,我们就让它自己生成一下,我们打开编辑器看看, 不错,项目的背景,各种信息,各种规则,各种文件路径都已经写好了。那以后呢,无论我们在新开对话,还是我们的聊天记录都已经被清空了, codex 都可以通过这个项目级的 a 证书 md, 立马的了解我们的项目基本情况。 ok, 那 我们先保持这样,先不做精修了,我们直接准备部署上线,当然大家自己做的时候完全可以去打磨的更好,那网页上的这些信息也换成更真实的信息就好。 那我们现在要部署呢,就得要说到 codex 的 第五大能力插件。在现在的 codex 当中,插件大多数是让我们的 agent 跟外部平台、外部工具、外部服务连接的一个作用,它实际上就是我们所说的 skill, mcp, c l i 这一类东西的一个完整集合包,比如说操作邮箱、操作日历、操作 excel 啥的。那我们来点开左边的这个插件栏,我们看这里呢,已经默认帮我们打开了好几个内置插件了,比如说浏览器操作,还有 mac 专有的屏幕操作,还有 excel 表格, ppt 等等。 那他的插件页面没有中文翻译,所以我给大家把这些插件的具体中文意思,分别能干什么也都列出来了,大家课后可以按需装上,点这个加号就好了。那我们先翻到这个 coding 板块,因为我们想要部署上线嘛,通过插件会非常方便。 其实呢,这个 vassel 和 netify 都可以,我们点一个加号给它装上,那如果大家给它没有选上的,也记得要选上。然后我们再回到对话当中,告诉他们,我们想用这个 netify 把这个网站给我们部署上去, 我们大家也不用管他咋部署的,反正他需要干什么呢,他都会告诉我们的。 ok, 他 发现我们没有登录授权,然后主动弹出了这个登录的链接,那这里呢,建议大家用 tapp 账号登录是最方便的, 那登录完之后,他自己就知道我们已经登录好了,然后继续的帮我们部署,这就搞定了。这个链接呢,就是我们最后的网站了, 只要把这个发出去,别人就能访问你的个人主页了。 ai 是 不是个好东西,你说就这么两下子就干了,原来普通人花钱都不一定能干成 o k。 先压抑住我的这个老灯感叹。我们回到刚才我们已经装好的插件, 那其实这里呢,还有两个非常重要的内置插件,就是 browser use 和 computer use, 还有这个 chrome 浏览器, 那这些有什么用呢? browser use 顾名思义呢,就是 codex 可以 直接帮你操控浏览器,比如说它自己点击翻页截图,填写表单等等。通常呢适用于自动化测试前端, 当然也有比较无聊的用途,比如我们可以让 codex 打开这个 m b t i 做个测试试试, 嘿嘿,这样大家能够比较直观的看到它的一个效果吧。那这个鼠标呢,是它自己在移动,然后它是自己看了上面的答案在自己填写,然后填完这一页,它也会自动的翻页, 那随着它的一通操作,结果出来了,原来 gpt 五是 i n t j 啊,我说怎么跟我这么聊得来呢? ok, 那 这个 chrome 的 插件呢,也是控制浏览器,但是它控制的是我们自己已登录的自己的浏览器,它不会再新开浏览器, 那我们如果把它给勾选上之后,它会引导我们去 chrome 里面装一个插件,那装好之后呢,它就可以操作我们自己的浏览器了, 而且它有个好处,它是可以直接在后台执行多个页面的浏览器操作的,就是并不会占用我们的整个浏览器,我们不用真等着看它这些操作,我们该用浏览器干,别的我们可以接着干。 ok, 那 computer use 就 更厉害了, 它不只能够操控浏览器,连你电脑上的这些 app 它都可以操作,只不过呢,暂时只有 mac 有 这个功能。比如说我们新开一个对话,我们在加号,这里来看最下面的这个插件选项,我们手动地把电脑插件选上, 我们再来几个没什么用的奇迹引巧吧,帮我放一首九九年最火的歌,然后用我的微信给 qq 发条微信,说,请收下我一个点赞、收藏、关注,懂了吧? ok, 他 陷入了思考,然后他看到我们的应用都正在运行中,并且向我们使用了这个音乐软件。我们点同意看,这个就是 codex 自己干的啊。他帮我们搜索歌曲, ok, 音乐响起了, 但是他还有活,他还在问我们要微信的权限,我们也给他允许一下。 ok, 看他这个小鼠标,他正在犹豫着准备搜索点击,好朋友们失败了, 因为我上次都成功了,但是我估计现在微信已经开始严防这种 a 证的操作了,直接给我退出去了。 但是呢,他的确成功操作了这个音乐软件。其实我还让他操作了剪映,并且给我们的最新的项目加上了音乐。 那总之呢,意思大家都懂了吧,就是它可以操作浏览器,并且可以操作我们的电脑。当然,实际上我觉得它的操作效率目前来说还是稍微有点低的,我不太喜欢用这两个强大的功能。不过后面我要说的这个 skill 就是 我每天都会用的东西了。 那 skills 我 的确也已经跟大家说过很多次了,好学的朋友一定要去补补课。那 skill 本质上呢,是我们人为沉淀的一些可附用的方法、流程和工具的组合, 相当于给 agent 做某些具体任务的一些行动指南。那因为之前我们已经让这个 codex 帮我们装过一个叫做 find skill 的 一个原 skill 了, 所以后续如果大家想要去装,或者是找一些社区上的 skill, 都可以直接用 codex 拿语言直接让它下载。比如说我们下载一个必备的 ansapic, 那 个前端设计的 skill, 还有一个去 ai 位的,那我们这两个都发给他,等会儿都会刚好有用 欸,很快他就帮我们装好了。那以后大家想要下载 skill 呢?如果说遇到这个 find skill, 他 找不到的东西,也可以直接把链接发给 codex, 让他帮你下载就好了。不过我在 c c 那 期也说过,最好用的 skill 还是自己创建的,符合自己工作的专属 skill。 那 创建 skill 呢,也有两种方式,第一呢,就是直接告诉 codex 你 想要创建一个什么样的 skill, 通过跟他讨论打磨得出来一个 skill。 那另一种呢,就是我们接下来要演示的,先跑通流程,然后让它形成 skill, 这也是一种更推荐的做法。那比如说我们想做一个自动化写这类文章,并且帮它配图的 skill, 这种大家应该都看过吧, 那我们就得先通过一步步的引导 codex, 让它真正实现一个我们满意的文章。来我们新开一个对话。那正好呢,我们刚才不是装过这个 github 插件吗?我们可以直接先问它最新的 github 流行项目,热门项目都有哪些? ok, 它的确帮我们找到了一些,那我们再让它清晰地解释一下这些项目都分别是干嘛的。嗯, 那我们再让他挑其中新星数量最多的,来帮我们写一篇本周 get up 热门项目推荐这样的一篇文章。 好,那他写好了这一篇之后,我觉得稍微有点太人机了,我希望可以更口语化一点,并且我只想要五个精选的,那我们就告诉他,然后还要覆盖到这几个层面,那我们这里就可以用到刚刚我们下载的那个去 ai word 的 那个 skill 了,我们斜杠给它调出来。 好,那看到他的结果稍微优化了一点,但是我们还希望加一个我们固定的开头,我们的结尾,并且还要让他用上 image 二来帮我们生成一些配图。最后呢,我还希望他不要是这个格式,他要是一篇非输文档的格式,然后图文并茂的。 ok, 结果来了,他确实是有了,但是呢,我觉得这个配图不够丰富,于是我又经过几轮调整才觉得差不多满意。并且我还给他最后加了一步,要让他把这个飞书文档发送到指定的群里,让大家都来看看。 那最终呢,他的效果是这样的,果然发出去了。其实啊,如果想更加一步到位的朋友,也可以结合刚才我们说的这个浏览器操控,让他直接打开那个发布页面,直接就帮你发布出去。 那总之,我们对他这一套结果满意了之后,我们就可以直接让他把这一整套的标准和动作做成一个 skill 搞定了。那我们再输入斜杠,再往下找,我们就发现就有了这个 skill, 我 们可以直接这样手动地调用这个 skill, 也可以直接说生成一篇热门项目推荐图文这一类的触发词,也会让 codex 自动调用。 不过因为现在 github 上面实时的热门项目肯定是没有更新的,所以我们再调用一次呢,它大概率会写出差不多的文章,所以我们就不试了。但是大家都理解了吧, skills 呢,可以把我们经过验证调好一次的一整套流程和方法给它固定下来。 下次做这件事情呢, codex 就 可以按照这个方式稳定的输出。 ok, 那 下一个能力则是 mcp。 其实 mcp 现在已经用的不太多了,所以我只简单的示范一下那 codex 的 mcp 藏在设置里面的 mcp 服务器。 只不过小白看这个肯定是有点不太知道怎么填的,所以跟我们之前说的一样,我们最好的方式还是把你想装的那个 skill 的 链接拷贝给 codex, 让他自己装就完了。比如说我们来装一个 notebook lm 的 一个 mcp 发给他, 他就会引导我们来做授权登录,登录完就搞定了。那我们再试一个我存了非常多访谈视频的一个笔记本,我们来问一下他。 欸,那这样呢, codex 也就可以直接获取我们 notebook lm 上面的这些外挂知识点了。 ok, 最后一个 codex 能力是自动化定时任务。 其实定时任务本身并不稀奇啊,比如什么每天早上提醒我吃药,提醒我喝水这一类的事情,普通的软件也能做,但是我们把它放到最后一个说呢,就是因为它可以结合我们之前学到的各种能力,把一整套组合起来的任务,让 agent 定点执行 自动化,加上智能化和定制化方显美妙。比如说刚才我们做的这个热门项目图文的这个 skill, 我 们就可以把它设成每三天或者是每周,让它定时定点的产出一篇 dapp 热门项目推荐发出来。 那我们要创建自动化任务呢,其实也分两种方式,第一种就是选到这边的自动化面板,那它这里呢,有一些官方的参考视例了,不过大多数是跟开发相关,那我们选择新建一个自动化, 其实你看要填写的东西也非常简单,其实就是用提示词写好这些自动化是要做什么,然后我们可以在这里选好什么时候出发,我们也是可以自定义一个出发时间的, 然后这边就可以选择执行的模型和思考强度,最后点击创建即可。不过呢,我也还是倾向于让大家用第二种更简单的方式,就是直接在对话里跟 codex 说,那我们直接跟他说 帮我创建一个自动化任务,每周一早上九点自动化执行热门项目推荐的这个 skill, 产出一篇图文发到群里, ok, 那 我们在看自动化这里,它就已经帮我们设好了这个任务,我们随时也可以去改变它的时间。 再比如当你的这个邮箱插件 github 飞书都已经连上了 codex, 那 么你也可以让他每天下午六点帮我汇总日历上完成的会议, github 上面的提交记录和我的邮箱回复记录,生成一份全面的工作日报。 最后手机操控 codex 设置方法非常简单,手机上的 check gpt 和电脑上的 codex 都把它更新到最新版。之后打开手机上的 check gpt, 然后点击侧边栏的那个 codex, 它就会提示你允许这台手机控制你的电脑,直接就搞定了。如果你有多台电脑的话,也可以给它分别连上。这就等于你不管在大街上、地铁上还是朋友聚会,都可以随时随地地用手机下发一个任务,让 codex 在 你的电脑上干完一个活, 它就更像一个可以跟你远程协助的同事了。这个功能呢,目前免费版也可以用,但是主要能连的是 mac 系统的 codex。 好, 那到这里 codex 的 所有核心能力我们就全部过完了。来我们回顾一下。 codex 呢,可以操作我们的本地文件,可以使用我们电脑上的终端命令行工具。它还有两种构建持久记忆的方式,它还可以生成图片,而且它可以通过计划模式来做一个完整的项目开发。 那它有丰富的插件,可以操控浏览器和电脑,还可以把知识和流程沉淀成可附用的 skill 技能, 它可以使用 m c p 连接,外部它还可以设置自动化的定时任务。不过其实比起这些功能本身,我也希望大家记住两件事,第一就是我们真的有很多事情是已经可以交给 agent 做了。 那第二呢,就是我们已经从问 ai 的 阶段走向了管理 ai 的 阶段,因为过去我们使用 chat gpt 就是 有问题了,我们问一下,然后得到答案我们就走了。 那现在使用 codex 这类的 agent 呢?每个人都得像领导一样,帮他准备他所需要的上下文和工作环境,给他指明一些任务目标,然后来检查他的计划,监督他的过程,验收他的结果。 那同时领导还要负责把好的方法和流程沉淀成可付用的技能,把反复要做的事情设成自动化执行的规矩。好了,恭喜大家今天都升职了,记得点赞收藏关注我们下次见了。

上个视频评论区有粉丝教我做一个详细的教程, ok, 安排用国产模型,而且要使用完整的 codex 功能,就要解决 api 代理和 codex 的 插件功能,这两个小工具就是解决这个问题的,他们都是的开源项目。 好了,安装 codex 加加,安装好以后会弹出一个命令行,不要紧张,按一回车就安装好了。接下来安装 echobird, 安装好了,打开它,在模型中心配置模型。以 deepsafe 为例,打开 deepsafe 官网,点右边的 api 开放平台,进去以后,先申请一个 api key 复制下来,再到接口文档里把 uio 和模型名记下来,转到 excel 这里配置好,这就全部搞定了。 启动的时候要注意一个问题,就是先打开 codex 加加,再用 excel 版的启动 codex, 不要用 codex 原声软件启动。这么详细的教程,快去点这里关注起来,下期不迷路!

今天 codex 发新版本了啊,就是这个版本有几个功能更新特别好用,我挨个挨个的给大家演示一下。第一个就是它可以自动截图了,比如我们在抠屏的时候,这是一个页面里面有些 bug 要修改,以前可能我们需要手动截图,然后把图片传上去,现在很 简单,两个 cmd 键啊,还是在 mac 电脑上面看,没有就直接截图,我们看一下自动截图,而且它不仅仅是截图啊,不仅仅是你看到的东西。看这个查看文本,还可以把这个页面背后的参数,组建的属性尺寸, 就这个页面背后的信息都可以给你捕捉下来。基于这个你再让它去修改一个什么 bug, 它的理解能力就会非常强,就除了页面展现的问题之外,背后的逻辑都可以给你读出来。基于这个再给你去修改好。这个是截图的功能,两个 command 键一起按自动截图, 然后直接发送你的需求。第二个很好用功能呢,就是前端编辑功能,正好最近六叔用他在写一个封面生成器,直接点击这个前端的页面,在他自带的浏览器里面做一个预览啊。比如这个页面我要修改一些布局文字或者一些排版,以前是靠对话跟他说清楚,现在直接选中好点评论,选择 直接在上面改,看到没有,改完之后,所见即所得,直接在上面生效,我们再来改这个按钮,把这个颜色我们改成一个绿色,选中,你看直接生效,然后在这个对话框里面就可以看到刚刚的一些改动,然后你主动输入,完成这些改动发送啊,最终他就会很精准的按照你的方式做一个修改,包括你的评论,你的批注, 你的团队成员都能够看到,也起到一个协助的功能。用这种方式去修改一些页面,那些 bug 是 不是纯靠口喷,要方便多的多好。这第二个功能所见即所得的 去修改你的网页的任何的问题。格式化的方式。第三个优化的功能啊,大家还记得之前它升级了一个什么版本?移动版本,你可以通过手机端去连接到电脑端,那有个问题,当你的电脑,比如说我的 mac 电脑,我锁屏了啊,这个时候我在外面我就连不上了。 为了解决大家这个问题呢,我们点击设置,这里有个电脑操控,把这个点开,输入你的电脑密码之后,你的 mac 锁屏的状态下,你也可以远程通过你的客户端去连接你的 codex。 我 觉得这个是非常好用的。最后一个功能啊,也非常好用,点这个加号,追求目标,选中适合这种连续性的、复杂性的任务,让它去跑。 比如帮我写一个用户注册的功能,并完成用力测试,在这个功能完成之前,用力测试完成之前,它是不会停的,它会一直的帮你去执行,哪怕一个小时,两个小时,中间你可以随时打开去查看它的一个进度,而且你还可以在这个过程当中不断的去加入你新的指令。如果你的任务比较长,需要多轮的迭代啊,步骤比较多, 耗时也比较长,建议大家可以开启这个购物模式,就是追求目标的模式。好了,以上这几个功能大家赶紧试一试,我持续丰富,你来体验过,拜了个拜。

一定要,一定要,一定要想方设法用上 codex, 如果你还没有听过 codex 或者克拉 code, 那 么恭喜你,这段视频你有可能会改变你的财富。 什么是 codex? 官方定义是一个编程证书,但它不仅仅是编程啊,黄仁勋就是英伟达的老总啊,世界首富,他已经让他的所有的员工都用上了 codex 或者克拉 code。 现在你听到的所有的什么英伟达的事实翻了多少倍啊?然后纳斯达克翻了多少倍啊?股市暴涨都是因为克拉克或者库克拉斯,它是代表着当前最先进的生产力。 codex 应该是对咱们普通人是门槛最低,成本最低,来使用世界上最顶级的大模型和智能体克拉克的对于普通人来说,还搞不定一些注册和网络问题,动不动就封号啊,也比较贵。那 codex 本身是不存在这种问题的,如果你不知道怎么使用,那么你第一步就只要注册下载, 然后搞定网络问题。你直接问他啊,你对我有什么作用?然后你把你的所有的工作,所有的生活告诉他,问他能帮助你。譬如说如果你是个股民,你就告诉他,我是个股民,我平时炒什么股? 我炒 a 股,然后你能帮助我什么?直接问啊,然后他一步一步的引导你。就是说如果你是工作,你每天的工作是什么?比如说你去打开邮箱啊,下载邮件, 处理数据,上传等等,把你的流程详细的描述给他,你直接问他,我这种工作你能帮我做什么?你能帮我优化什么样的流程,提供什么样的效率,做什么的工具就可以了。 如果你是在校学生或是二十来岁,那么克莱斯可能成为你改变人生的一个工具。就如同你在食堂打菜,突然开了一个新的窗口,那你要做的就是马上切过去,直接去排到队伍的最前面。

口袋终于实现国产模型自由了, dc 切问质谱随便切,重点是绘画记录还能够完整保留,这下真的不用再整天盯着额度了。这次使用的工具是 echo ball, 你 可以理解成 给口袋加了一个模型切换器,上次我们连接 dc 的 时候还要配 cc 叉和 cc switch, 这次更加的简单,模型都放在同一个面板里面,想用哪个直接切?安装包我都已经整理好了,下载之后直接运行就行。 我们先来打开这个 echo board, 左边点击我们的模型中心,这些模型呢都是可以直接链接的,只要符合 open a 的 协议就没有问题。点 击模型,然后添加我们的模型 id 还有 api key。 接下来我们再点击右边的应用管理,这里可以看到有很多的 ai 工具,但这期我们主要讲的是 code, 所以 我们先找到 code, 点击我们已经配置好的 d c 模型,点击启动就会自动弹出我们的 code, 看已经切过来了,我来测试一下,让他解析一下 echo ball 这个项目。 ok, 没有问题。重点来了,直接回到我们的 echo ball, 切换千问,点击启动就会自动重启我们的 codex, 看刚才的聊天记录都还在继续追问,刚才那个项目他也能够接的上。模型都放在同一个面板里面管理,不用反复去配置,这可比以前舒服多了。最后再给大家补三个坑,第一个我测试的时候发现先换回默认的 open ai 反而会丢失他的绘画记录,检查后发现原来是工具里面的一个小 bug, 不过包里面的版本已经是修复好的。第二点是部分的绘画可能会出现模型切换之后不能继续对话的情况,因为不同的模型对话里加密信息和工具调用状态他不一定能够兼容的。建议切换模型之前呢,先总结一下上下文,然后新建对话,再继续项目。 第三点,很多朋友也反馈过, a p i 模式下没有办法正常的去使用插件,但是我最近看到一些解决方案,这两天我会再去实测一波,到时候再给大家分享,不过目前又是不影响的,是可以正常使用的。今天的分享就到这了,我是木马,每天一起玩 a 的 赛博大志,咱们下期见,拜拜!

今天我们聊一下 codex 这一个月更新的八个新玩法。我以前一直觉得 codex 是 个备胎,去年四月 codex cli 刚出来那会儿, 我用了两天就回去用 cloud code 了。理由很简单, codex 当时就是个会写代码的终端 agent, 跟 cloud code 比没什么区别,模型还稍微弱一点。直到四月十六日那天, openai 发了一条公告,标题叫 codex for almost everything, 意思是 codex 不 再只是写代码的 agent。 先说最离谱的那一项, computer use codex 现在能看你屏幕点你 u i, 用它自己的光标在你电脑上打字,授权之后它可以操作你电脑上的桌面 app。 我 第一次让它做的活是把这个 figma 设计稿里的色值抓出来,写到 tailwind config 里,它打开 figma 截屏识图写入全程。我没动鼠标 这类跨 app 的 活, cloud code 作为 c l i agent, 很 难直接做 codex 这一步直接跨出了终端,代价是你给他的权限是整台电脑,不是某个项目目录。心智压力比 cloud code 大 一个量级。跟 computer use 配套的 还有一个内置浏览器。最有意思的设计是,你可以在网页上直接评论,把这个 comment 当成指令丢给 agent, 就像在 google docs 上选中一段文字加评论一样,但被评论的是网页 dom。 举个例子,你打开本地预览页,选中一个按钮,评论一句,这个按钮状态太弱,改成更明显的 primary action。 完了, 这种指着浏览器跟 agent 的 说话的交互,比 cloud code 走 mcp 接 api 那 套直觉多了。普通人不用懂什么是 api, 但真正让我有点恍惚的是, automations 是 一个持续任务系统,你给 agent 的 一个长期目标,它可以附用原来的对话上下文, 按计划自动唤醒继续做。 openai 的 原话是 potentially, across days or weeks。 比如你可以把任务写成每天监控这个开源项目的 issue, 每出现一个跟性能相关的,就帮我整理背景附线路径和可能的修复方向。它每天自己醒一次,自己扫,结果放到队列里等你看。这开始有点接近让 agent 接长期任务了。然后是 pets, 五月一日左右上线的,是这个月 codex 最初圈的更新。你输入 slash pet 就 能召唤一只虚拟宠物,浮在屏幕上做状态指示器, 它告诉你 codex 现在在跑什么任务,是不是在等你输入,是不是做完了。八只内置宠物可以选。还有一个 slash hatch, 可以 让 ai 生成自定义宠物。这设计妙在,它解决了一个我们都默默忍受的问题。 agent 在 后台跑唱任务的时候,你不知道它现在到哪了。以前要么切终端,要么挂个第二屏幕,现在屏幕上一直有只小猫,它的姿势就是状态,但是区域限制要分清。 open 官方明确说 computer use 初期不再意义。 a u k 瑞士开放 hats 这块我没核到同等强度的官方说明。所以如果你人在欧洲,并不是所有 codex 新功能都能立马可用。第二自定义宠物的画风偶尔会翻车,社区里已经有人把 clippy 动漫角色,各种像素小人都做出来了。好看的是真好看,怪的也是真怪。 但一个虚拟宠物功能能被开发者认真讨论,你就知道它戳到了什么。剩下几样我快点过。五月十四日, codex 进了 chat gpt 手机 app, 准确说是手机端可以远程接入正在运行 codex 的 mac host。 你 在地铁上,在咖啡馆, 可以用手机继续控制回答问题,批准操作,看 df 和测试结果。但电脑那边要保持在线, codex 也要再跑。这事跟 automations 配在一起威力很大。早上出门前交代一个长期任务,路上用手机补两句判断, 回家再看结果。这里要修正一下。 cloud code 也有 remote control, 可以 从 cloud app 或 cloud 网页端继续本机绘画。区别不在有没有手机入口, 而在 codex 把入口放进 chat gpt app 这条产品线里。四月十六日那波还顺手加了九十多个插件, atlanta rover、 circle shade code、 rabbit、 github issues、 microsoft suite 都在里面。 cloud code 走 mcp 也能接,但要自己配 servoach。 codex 这边是点一下装好的体验,底层也换了。 四月二十三日, openai 发布 gpt 五点五,并明确说它正在进入 chatttt 和 codex。 官方说法是, gpt 五点五在同类 codex 任务上更强,也更省 token。 它还跑在 nvidia gb 两百和 gb 三百 n v l 七十二系统上。具体到比 cloud code 省多少,社区里说法很多,我没看到一个能直接当结论引用的统一数字,但我自己的体感是,同样刨长任务 codex 的 成本焦虑确实小不少, cloud code 也没掉队。 antropica 四月十六日发布 opus 四点七 s w e bench verified 报道,百分之八十七点六。 open i 这边 gpt 五点五的 terminal 奔驰二点零是百分之八十二点七, cloud opus 四点七是百分之六十九点四。 这些 benchmark 口径不完全一样,不能简单等同于 codex 工具,打败 codecode 的 工具。我现在更愿意把它理解成 codex 在 长任务、跨 app 成本和可用性上进攻很猛。 cloudcode 在 严肃代码质量和复杂重构上仍然很有竞争力。 dv 上有篇社区余情整理,看了五百多条 reddit 评论和一些盲测,结果给了一个挺贴脸的说法, cloudcode 是 高质量但不好用, codex 是 稍低质量,但真的可用。这不是严格抽样调研,但它很像最近很多开发者的体感社区。现在很常见的一种用法是 codex for keystroke, coded code for commits。 日常输入用 codex 跑得快又省心,关键提交 code review, 复杂重构,切回 code code, 求质量。 甚至有人把同一套 skill 同时喂给两边。聊完功能再退一步看,会发现一件挺有意思的事儿。 cloud code 这一个月在生化, harness 做插件 hack worktree 和 deny rules, 把自己往 os like 做, codex 则跨出代码边界做 computer use, 内置浏览器 automations, 手机入口和虚拟宠物,把自己做成 digital co worker。 一个想做你的操作系统,一个想做你的同事。两条路都对,但两条路真的不一样了。 我现在的姿势是两个都开。 codex 跑,长任务跑,跨 app 的 活跑,需要在手机上启动的活。 codecode 跑,严肃 commit 跑,要保质量的重构跑,开源项目。那只 codex 的 小猫还浮在我屏幕右下角,告诉我它在等我。省一个 p r。 你 用 codex pets 了吗?

今天用 codex 做了一个 skill, 把微信群里面我们很多的一些报备的信息,还有非常多的一些楼盘的最新的动态,那样 codex 自动抓取啊,并且保存在文本地的文件夹,以及我的飞书文档,你可以看一下, 比如我们通常都有很多这种群,那是不同的,呃渠道或者开发商会发一些信息在上面啊,包括有图片啊,有文字啊,还有各种的报备信息啊等等。还有比如说这个是贝壳的啊, 都是图文交杂。然后我用这个 codex 自动化功能去啊,写了一个插件,它可以实现什么呢?就是 把我们的呃群信息去做连接,然后呢可以得出这个 呃项目的动态啊,比如说他在群里面能提取啊,发了哪些的项目的动态,还有哪些的价格的情况与货的变化,这他可以分类出来。呃,还有些报备的规则啊,这些全部都会记录在我的 啊 excel 文档里面。那长的是什么样子呢?长这个样子的,看看这个就是格式, 把这些按照项目分类,以及按照不同的这个内容 帮我去分好类这些动态。同时呢我还让它同步在了飞书里面啊,在飞书里面就可以去做一些筛选, 呃发给我们的同事会更加的方便,有兴趣想要学习的朋友可以在六月份留意我们有一个线下的课程,到时候我们给他去讲怎么样去用 codex 去搭建 房产人想要的这个同步微信,以及呃同步飞速的功能。