现在用 codex 也能做出这样这样甚至这种带转场动效的产品宣传视频。重点是你不需要会 ae, 也不用重新学一套复杂的剪辑软件,它背后用的就是 remotion 官方开源的 skill。 现在 getup 上已经有了三点二 k 的 style, 它不是那种像抽盲盒一样的纹身视频工具,它本质上是用代码渲染视频,所以画面、节奏、字幕、转场都可以精准控制。 比如你可以直接跟 codex 说,帮我做一个八秒的 codex 产品发布视频,开头放产品名,中间展示三个卖点,最后加一个行动按钮。 如果对动画效果不满意,也不用重新剪,直接文字描述要改哪里?比如截图出现太早,标题动效弱一点。如果你平时手里有素材,但就是不会做动态包装,这个神器绝对是你的救星,安装也非常简单,只有一条命令,感兴趣的朋友快去试试吧!
粉丝1.8万获赞24.1万

好,这节我们一起来看一下 codex 怎样接入 deepstack。 因为有时候我们的默认的模型其实并不够用,所以我们会去接入外部的模型,像 deepstack 这样的模型,那我们来讲一下整体的流程,那首先最后实现的效果就是这样子的,我们可以通过在 codex 里面去调用 deepstack 的 模型。 好,那我们来看一下整体的步操作步骤。首先我会给大家推荐啊,就是我这里呢啊编辑了一个启动的脚本,那这个脚本的作用就是可以帮助我们直接将这个 codex 的 底层模型切换成 deepstack 模型。那我们先来看实际效果,再讲实际的原理。那通过这个 start 模型,如果第一次使用的话,建议大家去加入一个授权的操作, 然后去欸把这个授权授权完之后,我们再启动这一个脚本。好,启动的时候它会去修改我们当前的 codex 的 啊配置,将它转发成 github 的 本地的啊 api key, 然后我们来试一下。 好,可以看到重启完成了,那我们再打开我们的 despic, 那 这时候我的新 despic, 我 们就可以看到在我们的这个右下角变成了 despic 模型,对吧?那我们还可以把它回滚成原来的配置。有时候我们可能我们的额度恢复了,对吧?那这时候我们可能需要哎,变回原来的模型,所以就使用另外一个脚本 notebook, 对 吧?我们就直接使用 notebook 也是一样的,我们把整个流程跑通啊回滚,那回滚的话相当于重置嘛,重置成我们最早之前的,那我觉得这种方式是最好的,最友好的,对于我们来说是白盒的脚本代码都在我们手上,我们并不需要去关心它是一个黑盒的操作,然后有人去获取我们的 api key, 你 看是吧?恢复了一模一样,对吧?好, 我们来讲下核心的原理啊,其实核心的原理非常简单,我们来看一下,那这两个脚本的作用,主要就是修改了 codex 的 config 的 这么一个文件,建立了这么一个啊, deepspec 的 本地 property, 然后接收到了我们的这 codex 的 请求之后,自动呢将它转发成 deepspec 的 api, 然后最后呢再把 deepspec 的 结果进行返回, 返回的过程当中呢,我们可以看到整个流程是非常流畅的,并且呢我们通过 deep stack 去管理了我们整个的这个上下文,对吧?嗯,就通过这个 codex 去管理了我们整个 deep stack 的 上下文啊。最后呢再给大家,嗯, 讲一个风险啊,就是很多时候我们通过这种 c c x 和 c c c 外驱的方式也可以建立这个啊 deep cache 的 连接。但还有一个问题就是它的流程是怎样子呢?就我们启动一个 c c x, 就是 这个代理中转,比如说我们开启一个 c c x, 对 吧?它配置一个 api key, 但这个时候我们有时候可能从外部的渠道拿到这个 c c x 的 包, 有时候他会存在一些这个上传的风险,比如说你在这里填一个 key, 那 我可以把你的 key 呢直接获取到你,比如说这里,对不对?你获取到这里是给大家演示啊,这是一个风险站点的演示啊,确实可以拿到这个 key, 而且并且还会有通知,那 为什么呢?因为这个时候我们在这里形成一个 key 呢,实际上他会发一个请求 pos, 请求上升到别人的这个网站上,所以大家可以通过抓包工具可以去看一下,对吧? 或者说我们再通过这个 c c c 外旋, c c c 外旋,有时候我们也会有一些不法分子去打一些包,对吧?这个包对我们来说是黑盒的,那我们直接使用这个包呢,往往会出现一个情况,也会上传你的 key, 所以 会存在一个风险的啊, key 的 暴露对不对? 是吧?那这时候呢,黑客的这个黑盒的组建就带来了比较大的隐患,那如果说大家使用啊,像我这种脚板的形式呢,是属于白盒的,大家你可以看到,对吧?所有的代码这里都可以看得到,是不是所有的流程都可以看的到?你直接问一下 q 代码这个道理是不是存在上传 key 的 操作,那就可以看出,哎,他是一个白盒的操作, 黑盒打包好的,你是不是就没办法判断对不对?所以呢我建议大家使用这种方式啊,那这个方式呢?嗯,首先大家会得到一个这样的一个 呃,这样的一个文件夹,对吧?这样一个文件夹,然后呢执行第一个脚本啊,就是这个 start, 它会帮助我们去安装好配置的 python 环境,那因为本质来说,这个脚本呢,是通过一些 python 环境去操作的,对吧?那你切换完之后呢,就直接变成了 python 模型,但是呢,你使用的时候有两个步骤,第一步呢是把它 下载好这个啊切换包,然后呢这个时候我们干嘛呢?我们会得到一个什么?得到一个这样一个文件,这个 type c 的 key, 所以 我们就把这个东西呢给它复制一份,对吧? ctrl c, 对 吧? ctrl 加 v, 那 把这个后面的这个啊后缀给它去掉,你看会去掉这个音,这个点 copy 的 后缀。 好,这就给大家的一键打包包好,然后这时候我们在这里呢改成我们自己的 key, 然后再去执行我们刚刚前面说的这么几个脚本,比如第一个是吗? start 对 吧?回滚呢?就执行这个 rebook, 对 吧?那通过这样的方式呢?那就,哎,直接完成了我们整个的这个 deptych 的 切换。好吧, 原理也给大家讲清楚了,其实我觉得,呃,这两个脚本呢,主要就是这两个功能,第一个是一键切换 desac, 第二个是一键回滚默认配置,那帮助我们去切换,当然这个脚本还有很多优化的点,我觉得主要就是,哎,我们可以切换成这个小米的 mini 模型,对吧?还有我们的 kimi 模型,对吧? 那主要就是这些点。好了,那以上就是本期视频的全部内容了,我是小刘,我们下期再见。

codex 是 我过去几个月高频使用的 ai 助手之一,我用它做研究,写文档、做 ppt, 整理内容灵感,做网页原型。上个视频讲了 codex 基础,这期视频讲一个今年很值得先搞懂的 ai 概念 skill, 因为它决定了 codex 到底只是陪你聊天,还是能按你的工作方式反复干活。简单理解一份可以重复使用的工作说明书, 你可以把某类任务的流程规则、检查标准提前写进去,下次再让 codex 做类似的事,他就不用每次重新听你解释一遍。比如你经常让 codex 做网页,你不想每次都重复说页面不要太 ai 味,不要蓝紫配色, 这些都可以写进一个设计类 skill 里。以后你只要让 codex 用这个 skill 检查页面,他就会按那套规则去看代码、改样式,再告诉你改了哪里。 这就是 skill 最实用的地方。把你反复说的要求变成一套固定流程,那么在哪里看和怎么用 skill, 可以 去 codex 的 侧边栏这个入口里看,里面会有一个 skill 子页面, 已经添加或创建过的 skill 会出现在这个列表里。使用的时候,通常可以在聊天里输入 skill 名称,或者用斜杠跳出来。比如你有一个 find skill, 就 可以直接斜杠选中,帮我找一个适合做 ppt 的 skill, codex 就 会按 skill 里的流程去跑。那怎么创建 skill? 有 两种方法, 第一种最简单直接这样说,请创建一个 skill 以后,我给你一个网页项目时,你要先检查移动端排版按钮样式、文字层级、颜色是否太乱,最后输出修改文件和检查结果。这种叫 prompt skill, 但我更推荐第二种,先把流程跑通,再把流程固化成 skill。 举个我刚实测的例子,我想做一种白板手绘风讲解图,我先给他一个参考图,让 codex 按我的要求生成讲解图 第一版如果不满意我就继续改,比如少一点黄色纸张质感画面更像课堂白板。等到有一版我觉得可以附用,我再说。把它固化成一个 skill, 这时候 codex 会反推刚才的流程,它会把这次反复调整出来的规则写进一个 skill。 md, 这样下次我再用白板手绘讲解图, 就不用重新解释一遍审美和结构,直接调用这个 skill 就 行。如果你想让 codex 使用 skill creator, 它会按更标准的格式帮你生成可附用 skill。 我是 ai 知识派,我们下期见。

好,今天我来带大家从零到一搭建一个自动选择题的 skills。 首先我们来演示一下效果,这里我已经告诉他给出今天的选择题,然后柯带斯就会自动调用我的这个 skill 来生成今天的选择题,就是二零二六年二月十四号的一一个选择题,他能够把选择题写入一个 csv 文档里面,然后自动上传到飞书这里,他是在问我们要权限,我们选择 yes, 然后他就会去自动知心里面的代码。我先来讲一下 skill 的 一个原理,首先就是我们在这个 codex 或者 cloud code 里面去给他发送信息或者提示词的时候,他就会去我们的 skills 里面的 这个 markdown 文件里面去查找看哪个 markdown 文件符合我们的,符合我们给他发送的这个内容。 比如说这里我给他发出的是给出今天的选题好,那么他就会去 bugdown 里面的这一部分, 这部分是这个 skills 的 meta 信息,也就是原信息,他就会根据这段原信息去匹配你的这个题词,如果他们匹配到的话,他就会进行下面的这些步骤, 比如说这里我还有一个自动写脚本的一个提示词,那么这里的原信息就是 以内容选择题记录生成可执行的视频生产包,包括可播放镜、镜头拍摄清单等等,那么这里它的原信息就不符合我们的 这个给出给出选择题的这个源信息,所以它就所以它就不会执行这一个 skill, 而是执行我们的这个 每日选择题的 skill。 它这里的描述就是生成每日的内容选择题,主要是为 ai 创作者来进行生成,那么就符合我们的这个题词词,那它就会去执行这个 skill。 首先我的这个 skill 会去网络上搜索当天的一些关于 ai 的 信息,然后自动给我生成 三条长视频的选择题和七条短视频的选择题,然后还会额外给我增加二十条选择题,这个是我 后来增加了一个功能,如果你们觉得十条选择题足够的话,也可以不用加这个选择题,可以看到它已经生成了今天的选择题,并且写入到了 c c a 文件里面,我们可以来看一下, 是二月十四号的,这就是生成的一个 c s v 文件,然后它还会自动上传到飞书,嗯,可以来飞书里面查看一下,它就会上传到这个小题灵感库,这里面 把它拉过来,然后往下滑,可以看到这里就是二月十四号的,它就给我们自动上传到了飞速,然后我在飞速里面还实现了一个功能,就是 就是这里的状态,如果我选如果我想选择某一个选择题的话,我就把它的这个状态改为已选入,可以看到它这里就自动为我们导入了刚才的这个选择题, 并且这里的状态也自动改成了已选入选择题, 就是就是这一个选择题。好,这就是大概的一个功能,然后我们就来重新搭建一个这样的 skill。 首先我们来下载 codex, 来到 codex 的 guitar 页面就是这个网址, 然后我们可以到下面的这里,这里它有最新的发布页, 我们不用管其他的下载方式,这里面 windows 和 mac 都可以下载对应的这个安装包, 你可以按照自己的操作系统来对进行对应的下载。那这里我已经安装好了,我就不下载了,那因为 oppo 现在可以 免费的使用他们的最新的模型,这是 gpt 五点三 codex, 所以 我现在比较推荐用 codex 而不是 cloud code 的。 然后我们打开 codex 之后 就会让你进登录,正常登录就行,登录完进来之后就会在这里的 thread, 这里我们可以点击添加一个新的 project, 然后这里我用的是一个 test 文件夹,然后点击这里的打开 就行,就进入到这个工作区里面了。然后下载好的酷派斯里面是默认自带了 skill creator 这个 skill 的, 它的作用就是用来帮助你创建 skill, 然后我们可以通过键盘上面的斜杠, 这里我们就在这个搜索框里面搜索 skill 来选择这个 skill creator。 好, 这里我就使用我之前的那个 skill, 这里你就可以向 正常与 excel gpt 对 话一样去告诉这个 skill creator 你 的需求,然后我这里就告诉他帮我创建一个 skill, 每天帮我获取不同的自媒体。选择题主要聚焦于 ai、 n 班自动化、 ai 工具、扣子、 vip coding、 igc 等。 我的视频包含了长视频和短视频,长视频发 b 站,短视频发国内的平台,然后后面是我发布视频的频率,然后是我要面向的一个观众的受众。然后这里可以把这个 play mode 打开,也就是 计划模式,它可以根据你的这个提示词来呃问你一些问题,然后帮你完善你的 skill。 那 我们选择发送,然后可以看到它就会去调用这个 skill creator 这个技能来帮我创建新的 skill。 这里他说继续现有环境,我可以把这个新 skill 放在这个目录下,这个目录就是一个全军目录,就是 skill, 你 可以安装到全军目录,也可以安装到每一个指定的工作目录。 比如说这里就是我安装的全军目录,然后这里就有个 skill creator。 全军目录的意思就是我可以在不同的工作区域下 去使用我的这个全剧目录下的 skill。 就 比如说这里我是在 test 目录下,如果我在这个 n 八 n 或者这个 project 目录下,我都可以去使用这个 skill creator 这个 技能,那这个时候我希望他把这个 skill 安装到我的现在这个工作目录 test, 所以 我就可以在这里进行输入, 把这个 skill 安装到当前工作目录下,那我们直接点击继续,先不用管它的这些 skill, 可以看到他说我们刚才在选题来源里面填的安装路径,我理解你希望安装到当前工作目录好,这个时候他就会把这个 skill 安装到当前目录了。然后接下来我们需要补充一些信息,首先就是选题来源策略 有纯热点和纯长清,这里还有一个混合,这里我们就选混合,然后短视频测要不要在输出里区分平台版本,这里我们可以选择他推荐的统一脚本加平台改写建议。 然后这个 skill 是 否需要附带每日自动运行方案,这里我们就填一个,暂时不需要。然后我们补充了这信息之后,它就会去给我们生成一个 plan, 我们可以把这个计划展开,可以看到这里的总结就是为你创建一个可复用的 skill, 目标是每天产出不重复,可直接拿去做内容的选择题清单,覆盖长视频、短视频,还有主题聚焦受众。 这里是他交付的一些文件内容,然后这里他生成的目录是有一个问题的,我们待会来告诉他怎么放在正确的目录下,然后这里是设计的一些细节, 这里我们基本上就可以不用管,然后我们直接划到最下面,因为他创建的位置不对,所以我们 我们在这里给它进行一个提示。我们来到我的这个 workspace 里面的这个视例,来看一下 skills 是 放到哪个文件夹下的。 我们需要把具体的 skill 放在点 agents 杠 skills 下,因为像 codex 和 cloud code, 它们去查找 skills 的 时候就会去这些目录下进行查找, 但是这里 q d s 给我们给出的创建的位置是 test, 那 么这个目录位置就不对,然后我让我们就告诉他,一创建的位置 是点 a 键值,点 scale 杠 scales 下,然后我们点击提交, 可以看到它就更新了我们的这个计划,并且生成的目录也是正确的,那我们就点击执行,可以看到它现在正在使用 skill creator 里面的脚本来帮我们自动创建我们的这个 skill, 我 们把这个工作目录给它打开, 可以看到它这里正在为我们创建这个 skill。 其中 skill 里面最重要的就是这个 markdown 文件,这里在 codex 里面它是 skill 点 markdown, 如果是使用的 cloud code, 它这里就是 cloud, 点 md 文件, 然后它又需要我们的一个权限,你直接点 yes 就 行, 直接无脑。下一步 如果你们想让它获取所有的权限的话,可以在这里的这里有一个默认的一个权限,你们可以把它改成 focus, 改成这个模式,它就不会再询问你索要权限,它就会自动的去执行所有的操作。然后我们让它中 可以看到它已经为我们创建成功了,然后我们来问它如何使用这个 skill, 它这里给出的步骤是进入进入 skill 的 目录, 然后通过命令行来传参数,生成运行摇本,然后查看输出。那它这里给出的步骤太麻烦了,我们需要它能够自动识别我们的一个意图。我们在聊天框这里输入 获取今天的选择题时,他就自动的去帮我们完成这些操作,让我们来教他更新。 这里我就告诉他你给出的操作步骤太复杂了,当我说给出今天的选择题后,他就自动来进行这些操作。 这里我们还是点击 yes, 他 可以看到他去更新的 skill, 点 md 文件,然后他然后他会去运行脚本去进行一次测试。 好,现在他说已经改好了,只要你说给出今天的选择题,他就会自动执行脚本,那我们来测试一下。 好,可以看到他已经给出了今天的选择题,长视频三条,短视频五条,然后有一个结果文件。 好,我们可以在这个 outbox 目录下看到他给我们输出的选择题的内容,有长视频的选择题,还有短视频的选择题,他给出了标题勾子,还有来源标签,还有内容的大纲等等, 但是他给出的这个文件不符合我们上传到飞书多位表格里面的这个格式,然后我们这个时候需要继续告诉他,你需要输出一个 cs 文件, 用来用来上传到飞书的多位表格里, 以修改输出文件为点 c s v 二、新增添加 文件到多维表格的功能。越飞速的多维表格可以通过导入 excel 或者 c s v 文件, 所以我们输出的这个点 c c 文件用来导入到非数作表格是非常方便的,可以看到它现在就会 更改这个脚本,然后给我们新增一个把文件上传到非数的作表格的一个功能,这里我们就等待它执行就行,然后这里还它还是需要我们的一个权限,我们直接点 yes, 然后无脑 yes 就 行,如果我们待会遇到问题再叫它修改就可以。 好,可以看到它已经为我们变更的结果。输出的文件默认为点 csdf 文件,并且新增了写出非输多位表格的能力,那这个时候我们先来测试一下它是否为我们输出了 csdf 文件。 我们还是让他给出今天的选择题,然后让他去执行, 让他选择题已经生成了,然后我们来到的文件夹里面,好,这里我们就可以看到确实是已经生成了 c s c 文件了,然后我们就需要去到飞速里面配置这些参数。 首先我们进入到飞速的开发者后台,就是这个 u i l, 然后点击创建企业自建应用,这里我就填一个 course, 然后应用的描述就填一个教程,那点击创建 总结完之后,在凭证与基础信息这里就有一个 app id 和 app secret, 然后我们来文件夹里面看一下它,它是否有为我们存储环境变量的一个文件, 可以发现并没有,然后我们就告诉他,我们需要把飞书的文件变量存储到点 e v a 文件里面, 这时候就让他继续修改就行。 好,他已经为我配置好了点 e v a 文件了,那我们就可以在里面填入 一些关键的信息,这里这里就是飞书的 app id, 就是 这个我们复制然后粘贴进去,这里是 secret, 给它粘贴进去,然后然后下面就是飞书多位表格的信息,这里我们就去新建一个多位表格,在飞书多位表格这里添加一个, 然后点击新建这里我们点击新建多维表格,新建一个多维表格, 然后是我们会发现我们新创建的这个数据表与它的与它给我们生成的这个数据表的字段是不一致的。所以第一次我们这里可以先把它的这个 c s v 文件给它导入进去, 先把它复制出来,然后点击这里的导入选择文件 这个给它导入进来。 好,导入进来之后我们就有了这些字段了,然后你就可以暂时把其他的都删除掉, 那这里我就给它命名为选题灵感库。这个时候,那这个时候我们需要填写的是多余表格的 token 和 table id, token id 就是 我们看我们来到这上面的这个 u r 幺,这里 token id 就是 这个 table 问号前面的这一串制服串,你给它复制,然后粘贴进来, table id 就是 table, 等于就是这里 table 等于后,后面这里 这一串就不要不要把这个按的符号给它复制进去了,就是等于和按的符号中间这一串 复制,然后给它粘贴进去,然后我们点击保存这里我们的环境变量就填写完了。来接下来我们需要给我们的这个应用添加权限,在这个开发配置的权限管理这里, 我们点击开通权限,然后我们的类型选择,应用身份权限,选择多位表格,然后我们把它都打开确认开通 用完之后,我们就可以点击发布创建版本,就是在应用发布的版本管理这里版本号选择一点零点零 更新就是第一次发布,然后我们点击保存,点击确认发布。 我发布完成之后,我们再来到分数的多位表格里面 上找的这三个点,这里我们在这里点击更多,然后选择添加文档应用, 在这里搜索我们刚才创建的应用,就是 course, 我 们需要把它添加进来,我们需要把这个应用添加进来,它才能够对我们的这个表格来进行操作,然后我们点击添加 好,添加完了,然后,然后我们就告诉他我已经配置好了飞书的内容,你来测试一下, 我们先把我们的这些记录给他都删除掉,看他看他是否能帮我们自动上传到飞速,他中间可能会遇到一些问题,如果遇到问题直接叫他修改就行 啊。现在应该在请求飞速的接口,第一次请求可能会等的时间比较长,我们就等它继续执行就行, 可以看到它说当前进程没有返回日期什么什么的,这里我们就选择 yes, 让它自动去进行调整 好,这里可以看到他遇到了一些问题,他现在需要先验证只生成 csv 文件是正常的,然后再去单独测试飞书的接口, 可以看到他现在找到原因了,他说脚本在同一天反复执行时触发了去重死循环,然后他就会去继续修复,然后现在已经修复完成了, 他现在会再来进行测试。描述的全键成功了,但是写入失败了,是因为字断的原因,这里我们继续让他进行修改。 在完成这个自动化的过程当中,是没有去写一行代码的, 就他给这里,其实他给我们这里我们导入的这个 excel 其实是有点问题的,因为他都给我们设成了多选,我们先我们先把这个流程来跑通, 你再自己创建 skill 或者使用我之前的那个 skill 的 话, 就可以在导入 excel 之后把这些字段的类型都给它进行修改一下,它这里全都给我选成了多选了,所以所以导致它一直出错。 好,这里可以看到它测试成功了,已经把这些已经把 c c 文件里面的内容都给它导入进来了, 看到测试已经完成,并且我们也可以在这里面看到上传的内容,所以之后,所以之后你们在所以之后你们在 q 代码里面再给他说给出今天的选择题,他就会自动的去帮你完成这整个流程,那就是飞速里面的这个自动化,这个这里我就用我的那个飞速表格来进行演示了, 首先有灵感选库和选题两个表,然后我们在进行自动化的时候 可以可以点击创建自动化流程,然后就会进入到像我的这个界面一样,首先你的第一步,第一步选的就是新增修改的记录,满足条件时, 这里我们选择新增的记录的表,就是灵感选题库表,然后然后我们设置的满足条件,因为我们需要把我们的状态改为已选入,所以这里设置的条件设置状态等于已选入,并且关联内容为空。 接下来的第二步就是我们需要在我们的选题表里面新增一条记录,所以这里我们就选择一个,所以这里我们就选择我们的选题表,然后那下面就是我们需要新增的记录里面的所有的字段。这里需要注意的是 我们在点击这,我们在添加动态的值的时候,需要点击这个加号,然后我们这里选择第一步满足条件的记录, 然后我们直接在这里进行点击就行,不要不要点击它下面的这两个内容,你直接点击点击这个,比如说我这里就点击选填 id, 它就会把里面的值传给我们,而不是把这个字段的名称传给我们。 然后第三步就是我们需要把灵感选择题,呃,选择题灵感库里面的这个状态给它改为已选入选择题,接着我们点击保存就可以了,这就是整个选择题的工作流程。

用 ai 剪视频,真正花时间的不是剪辑。过去半个月,我深入的研究了 hyperframes, 得出了一个结论,大多数人出片效果差,不是因为工具不行,而是因为跳过了最关键的前期准备工作,脚本怎么写,素材怎么准备,节奏怎么定,这些都是要提前想清楚的,不然后面全是反光。 所以这一期我把我的整套方案拆解一遍,从 ai 剪视频的原理到成片走一遍完整的流程,里面涉及到的所有的内容都已经开源了,你可以装上直接跟我一起操作。所以这一期又是一期非常干的视频,希望对你有所帮助。那我们现在开始 ai 剪辑到底在干什么? 其实就是让 ai 写代码, ai 用 html、 css 和 javascript 在 网页里面搭画面,动画、字幕、转场,全都靠代码, 然后浏览器一帧帧截图拼成 mp 四。所以你听到的 html 渲染成视频,说白了就是先在浏览器里把画面跑出来,再一帧帧录下来, 那代码能做到什么程度?网页上你见过的所有的交互效果、动效、转场、字幕、动画、三 d 适量图,它全都能做,但它也有做不到的,比如说实拍视频、图片这些它就不能实现,所以必须靠提前准备好素材,或者让它上网帮你来搜索。 hyperframes 就是 这种工作原理,从 html 渲染成视频,它能做的事情非常多, 画面可以分层叠加,视频文字图形往上垒就可以了。它内置了 coco 语音模型来帮你合成配音,还内置了 whisper 语音模型,帮你生成带时间戳的字幕,还能合成背景音乐和音效,甚至能一键扣掉人像背景。 功效方面,三 d、 a e 动画、 gpu 特效这些都支持生成完成后,它还会自动做一轮质量检查,扫代码结构、跑浏览器测试、抽关键帧截图,确保画面没有明显的问题。 hyperframes 的 完整的工作流大概就是这样的,先出使画一个项目,然后一个镜头一个镜头的去搭载画面,搭载完成后,检查和焦验 没有问题就预览,预览通过后输出渲染。我们在这个流程里其实就做两件事,告诉 ai 我 们需要什么样的视频,以及提供 ai 自己造不出来的素材,比如配音图片、视频设计文件等等。 但有个问题,你直接跟 hyperframes 说,帮我剪一条 spacex 的 视频,他大概率做不好,因为什么主线、什么风格、什么节奏、什么素材,他完全不知道,只能靠瞎猜。所以我写了 video spike builder, 加在了 hyperframes 前面,他专门干一件事情,通过追问,逼你动手之前,把所有的决策都想清楚。怎么追问呢?分五个阶段。 第一个阶段是锁定视频的基本盘,他会问你几个问题,包括视频的目的是什么,给谁看,发在什么平台,时常是多少核心,想传递什么信息,以及品牌的调性是什么样的。 第二个阶段是盘点素材,把你可能需要的素材分成六类,逐项跟你确认文案有没有配音,用真人还是 ai 有 没有实拍画面, logo 有 没有高清透明底,需不需要三 d 模型,还缺什么素材要去找等等这些事情。 第三个阶段是我觉得整个 skill 里最有意思的一步叫做激发表达手段,大多数人根本不知道自己想要什么效果,那他就会主动的告诉你 html 可以 实现哪些效果让你来选。 第四个阶段是定视觉主题,你可以从 hyperframes 里面预设的八个主题你选一个,也可以描述你想要的风格,让他来帮你生成一套。 第五个阶段是收集参考和返利,让 ai 有 一个具体的参考,或者明确说你不希望视频里出现什么内容,让 ai 知道哪些原则是不可以违反的。 五个阶段走完,所有的决策都会落到一份叫 video spike 的 markdown 文档里,等到 hyperframes 接手的时候,它只需要照着这份文档执行即可。 这个 skill 里还内置了六十九个预设的画面组建,包含了数据图表、流程图、思维导图、 ui 模拟、大字海报和各种场景,也不需要自己去想这一境用什么形式来表达,它会根据你的内容自动去匹配。 说白了, video spike builder 就 干一件事情逼你想清楚,你前期想得越透,后期出片的质量就会越高,返工就会越少。好,那知道了原理和流程之后,接下来我们来安装 hyperframes。 打开 codex, 点击左上角的 plugins, 在 搜索框里输入 hyperframes, 找到之后点一下右边的加号,弹出窗口后点击下方的安装就可以了。装好了之后,你可以再点进 hyperframes 的 插件页面,看看它的详细介绍。 这里有一点要注意, hyperframes 不是 一个单独的 skill, 它其实包含了十五个 skill, 但在这个页面里,你可以自由地管理这些 skill。 装好了怎么用呢?点击右上角的 tryinchat, 系统就会帮你新开一个聊天窗口, 里面已经预设了一段生成视频的提示词,示意跟着它就能快速上手。接下来我们还要装我专门为 hyperframes 写的一个 skill, 它的作用就是在生成视频之前,帮你先把脚本和分镜梳理清楚。在 github 上面搜索 video spike builder, 找到这个开源项目。 往下滑到安装部分,你会看到两条命令,第一条是安装 hyperframes, 我 们刚才已经装过了,所以跳过。第二条是安装 video spike builder, 复制这条命令, 然后回到 codex, 把命令贴进去。稍等片刻,它就会从 github 上面把项目拉下来进行安装。装好了之后,可以看到它默认安装到了 project level, 也就是项目级, 只在当前这个项目下才能使用。如果你希望在任何项目里都能调用这个 skill, 那 就需要把它装到大局。操作其实很简单,你只需要跟 codex 说一句,帮我把它装到 user level 就 可以了。 hyperframes 和 video spec builder 都已经装好了,不过在开始生成视频之前,我想先让你看一下 video spec builder 里面到底写了些什么。在 cursor 里打开项目左侧,可以看到 video spec builder 这个 skill 的 所有文档已经从 github 上面拉下来了。 我们先打开 skill 的 md 看一下介绍。当用户想制作视频、宣传片、产品演示或者动画的时候,这个 skill 就 会自动启动。它一共有两种模式,第一种是零到一模式,第二种是迭代模式, 启动的时候, skill 会自动检查项目文件,家里有没有现成的 video spike 文档,如果没有或者是空的,那就走零到一模式,如果已经有了,那就进入到迭代模式,让你通过对话反复的打磨视频脚本, 再往下看文档结构,整个 skill 的 文件组织一目了然。其中最重要的是 reference 文件夹里面我准备了几份核心文档, 包括沟通风格、零到一工作流、迭代工作流、视频组建的使用方式、节奏设计指南,以及最关键的一份 question bank, 也就是问题库。我们打开问题库看一下, codex 在 使用这个 skill 时,就是按照前面讲的五个阶段来追问你,一步步逼你把需求想清楚, 每个阶段该问什么,追问的逻辑是什么,什么样的回答可以接受,什么样的回答必须打回去重答,全部都写在了 question bank 里, 可以说 question bank 就是 整个 skill 的 灵魂。看完了 skill 的 内部结构,接下来我们就要开始做视频了,不过在正式开始之前,还有一步准备工作一定要做。 前面我们讲到 hyperframes 里面有八个主题,那如果你想用自己的自定义主题该怎么办?所以这次实操我就带你走一遍。比如我提前整理了 spacex 和 grog 的 设计语言, 纯黑白的硬科技风格,然后提炼成了地址按点 md 设计文档和 tokens 点 css 这样的样式代码,把它们一起复制到了项目文件夹里。 hyposhop 检查自定义主题的逻辑是,如果项目文件夹里已经有了 design, 点 m d 就 会问你要不要使用这份自定义的设计风格。准备工作做好了,接下来我们开始第一条视频。 在聊天框里面输入 slash video spike builder。 使用这个 skill, codex 做的第一件事就是扫描项目目录,他发现里面没有现成的 video spike, 于是就进入到了零到一模式,从零开始引导我们。 他先抛出来两个问题,这条视频讲什么?投放在哪个平台?横屏还是竖屏?那我告诉他,我想做一条关于 spacex 发展历程的视频, 时长大约是一分钟左右,横屏格式 codex 收到了之后,并没有急着往下走,而是上网搜索了一圈 spacex 的 资料,然后又追问了两个问题。第一个是时长,他觉得一分钟,这个回答太模糊了,因为七十五秒、九十秒、一百一十秒的视频节奏是不同的, 所以希望我给一个精确的。第二个呢,是受众,这个片子到底是给谁看的?这决定了内容的深度。那我回答他,时长就一分半左右。受众是普通的知识区观众,核心内容讲的是 spacex 如何通过复用来改变航天行业的发射成本。 拿到这些信息后, codex 给出了初步的方案,九十秒大约可以插入十二到十六个镜头。时长有限,所以没有办法做完整的传记,只能走一条主线,从早期的失败,到 fokken 九的实现复用,再到成本逻辑的改变。他问我这条主线行不行, 另外他还问我有没有竹子稿。那在这一步,我把自己提前准备好的但时间错的配音文件都一起发给了他。 codex 收到字幕和配音之后,先检查了两者在时长的节奏是否对齐,然后仔细的过了一遍字幕内容,帮我做了事实核查,看看这里面有没有表达的错误,或者是事实偏差或者不准确的地方。 查完之后,他问了我一个关键的问题,音频已经准备好了,要不要根据核查的结果重新做一版,把发现的问题都改掉?因为我想快点看一下效果,所以就告诉他不用改了,直接用现成的音频就好了。 紧接着 codex 问了两个关键的画面问题,比如说发射回收筷子夹火箭之类的真实视频或者照片,画面路线是走真实的摄影为主,还是走动态的图形为主?那我告诉他,我目前还没有任何的素材需要他来帮我搜集。 视频的风格以真实的摄影摄像为主,版权先不用担心,因为我们只是测试,不会真的去发出去。现在 codex 开始工作,从竹子稿里面分析出素材的需求,整理成清单,然后去搜索。 搜索完成后,他把视频划分成段落,每个段落该配哪些画面素材都一一对应好呢?给我确认没问题的话,他就会把素材清单写进 video spike 里,然后继续追问。我看了一下没有什么要改的,所以就确认通过。 接下来 callix 问我要不要背景音乐和音效镜头节奏,他给了我一个镜头的节奏建议, 我没有太多的反馈,就让他先按照这个建议去往下执行。那字幕他也问了,是像纪录片那样的整句长注,还是整句加关键词高亮,那我选择的是字幕,需要整句长注。在字体和主题方面, codex 看到我已经有了一套黑白工业风的自定义主题, 不过他还是告诉我, hyperframes 内置的八个预设主题里, data shift 和 shadowcut 这两个也很适合这条片子,但我决定还是不换了,就用我自定义的就好了。最 后 codex 问了装饰和组建的想法,问要不要加时间码,任务编码或者是线框十字定位这些元素, 有没有参考的案例或者是反例?那我确实没有什么特别的参考和反例,就让他按照他自己的建议来设计。以上就是 codex 追问的所有的问题,问题答完之后,他就已经有足够的信息来帮我写视频的脚本了, 那这里我们稍等一下。好,写完了。现在点击右上角的 video spike, 打开它帮我们生成的视频脚本。 这份脚本里面包含了视频的整体基本盘,视频的目的、受众、画面规格、语气基调、修饰结构、表达的手段,还有素材清单,十九个分镜以及每个镜头的具体内容,还有音频的时间轴以及参考范例。最后还有一些留给 codex 自己决定的开放性问题, 所有这些都已经完整的写进这份脚本里了。你刚才看到的这个过程包括内容的主线、受众定位、画风风格、镜头节奏、字幕样式、 bgm 的 氛围、素材清单。所有这些决策在前期全部敲定了,等到 hyperframes 接手的时候,它只需要做执行就行。 如果我跳过了这一步,那直接跟 hyperframes 说,帮我剪一条 spacex 的 片子,相信我,它出来的东西根本就没法用。这就是我开头说的那句,工作量要在前期准备好的意思。 ok, 那 脚本已经准备好了,接下来就是交给 hyperframes 开始干活。在聊天框里输入 slash hyperframes, 让 codex 调用 hyperframes skill。 这个时候 codex 会接上 hyperframes 的 制作流程,根据我们刚才写好的 video spike 开始生成视频。 它会按照我们的设计规范处理字幕、旁白和音频,按照素材清单上网搜索画面素材,还会帮我们合成背景音乐和音效, 这些几乎都不用我们再干预了。因为所有的决策在前期编辑 video spike 的 时候已经全部做完了。 hyperframes 只是在这个环节负责搜集素材、剪辑画面以及最后渲染成视频。 渲染完成后,他还会自动做一轮审核,通过抽取关键帧的方式来检查画面的布局以及素材是否合适。整个过程大概需要四十多分钟,所以这里我先跳过好视频渲染完了,我们来看一下成片效果。二零二四年十月十三号, 一枚七十米高的火箭从太空飞回来,被发射塔上两条机械臂在半空中夹住了。全世界都疯了,但二十二年前造它的这家公司连火箭都飞不起来。二零零二年,马斯克拿卖 paypal 的 钱创办了 spacex, 就 一个目标,让火箭能重复使用。所有人都觉得它疯了。 火箭这东西从来都是用一次就扔了。二零零六年,第一枚炸了。二零零七年,第二枚又炸了。二零零八年,第三枚还是炸了,钱烧完了,特斯拉也在崩盘边缘, 马斯克把最后的钱全压上去。第四枚飞进了轨道。接下来, spacex 做了一件从没人做过的事,让火箭自己飞回来。二零一五年, falcon 九的一级助推器稳稳落回地面。 二零一七年,一枚用过的火箭再次升空,发射成功,火箭不再是一次性的了。今天 spacex 一 年发射超过一百三十次,比全世界其他所有国家加起来还多。一枚助推器最多已经负用超过三十次,发射成本从过去每公斤上万美元降到了两千多。 而开头那一幕,筷子加火箭,就是在这条路上。再往前走一步,火箭连着陆腿都不需要了,直接飞回发射塔,被空中接住翻新再飞。 从什么都炸到徒手接住火箭,再到每一枚都能反复再飞。这条路 spacex 走了二十二年。 刚刚播放的就是一次成片的效果,我没有做任何的干预和调整,从完成度上来说其实还可以,但是你仔细看,里面有不少可以优化的地方。 比如说片子中提到了三次发射失败的场景,其实每一次都可以用一张当时真实的照片来替换,也可以加入更多的视频素材,比如说火箭返回到着陆的画面,但是可能 codex 在 上网搜索的时候就没有找到,那这个时候就需要你来提供了。 而且说到我们自己提供素材,其实主题风格也是一样的。前面这条视频我用的是一套自定义的黑白硬科技风格,那这套主题我是怎么设计的呢?接下来我来带你看一下, 其实很简单,你可以在 cloud design 里面进行设计,输入屏幕上这段提示词,他就会帮你生成一套主题,然后你再跟他多聊几轮,不断的调整细节,基本上各种需求就已经能搞定了。比如我这条 spacex 视频,用的黑白硬科技风格就是这么设计出来的, 它包含了一整套的设计语言,视觉的底座、中英文字体、装饰元素, a 肉出镜使用到的各种贴纸卡片,还有 b 肉讲解概念或流程时候需要用的图标、思维导图以及数据格式化,这些都已经帮你设计好了。 设计完成之后怎么导出呢?有两种方式,第一种是点右上角的 share, 然后选择 download project as a zip 下载成压缩包。那第二种是可以直接点 handoff to cloud code, 这样就可以在 cloud code 里面进行二次的开发和调整 好。实操部分就到这里,最后我来跟你聊一聊我用下来的心得,还有几个实操上的建议。 hyperframes 目前还不是很成熟,所以你千万不要指望它一次就能出成品,除非你的视频本身就很简单,只有字幕和简单的动效,不然你大概率是要调整几轮的。 问题在于,每一轮的调整其实时间成本都非常的高,赶完之后必须重新渲染,一轮就需要半个小时到一个小时的渲染时间,那大概三次也就是三个小时,这个时间成本非常的大。 所以你在使用它之前,一定要先判断一下你这条视频到底适不适合用它来做。像概念的讲解,流程演示、数据图标这类的视频, hyperframes 完全够用。 如果你的视频依赖大量的真实素材,复杂的剪辑节奏,那目前它还搞不定。还有一个问题就是它的效果不太稳定,有点像开盲盒。 虽然看起来它什么都能剪,但是实际体验下来,我觉得它的效果是时好时坏的。如果你真的想把它用起来,比如说批量的去做视频,或者是做讲解类的科普视频, 我建议你要固定一套视觉风格,几个转场和字幕样式以及贴片的动效,做成一条固定的工作流程,不然每次他都从零开始发挥这样的效果,非常不稳定。 然后是关于素材脚本里列的素材清单,不管是图片、视频、音效,我都建议你自己去准备,不要指望扣代斯可以上,我帮你搜索。找回来的素材经常和你的画面对不上,而且现在基本都有反爬 a 阵呢,是没有法下载的, 再加上搜索的过程又慢又耗 tokens, 算下来非常不划算。那我们应该去哪里找素材呢?接下来是我经常使用的素材网站,图片和视频我会常用 pixabay, 最综合 ansplash 和 paxos 的 图片资源,更多一些 bgm 和音效我推荐你用 solno ai 来合成,那这些工具都是支持 api 接入的。如果你有工程能力的话,完全可以自己搭一条自动的流水线, 配音也是一样的。 hyperframes 虽然内置了一个声音合成模型,但是它的效果其实非常的差,声音很机械,在正式的作品里根本没法用。如果你想快速的看效果,那没有问题,但是如果你想把它变成正式能用的视频, 我建议你去使用 mini max 的 speech 二点八 hd 这个模型,或者干脆自己去录好,那我的素材库差不多也就是这些了。那最后呢?我把 ai 剪辑视频这件事情拆成四层来做个收尾。最底层是大模型,模型的能力是地基, 分镜拆的好不好,素材理解的对不对,动效配的准不准全看模型。所以我这里首选 opus 四点七或者是 gpt 五点五。 第二层是脚手架 hyperframes remote, 或者你自己写的任何视频剪辑的 skill 都是脚手架,脚手架决定了你能实现什么样的效果。第三层是脚本书里怎么拆分镜,每个分镜的内容,文案转场以及整体的节奏的设计。 第四层是素材整理,你准备的素材的质量直接决定了最终画面的质量,这四层合在一起,共同决定了 ai 剪辑视频的最终效果。 以上就是本期的全部内容,如果你觉得对你有所帮助,别忘了点赞以及加入废材俱乐部,我们可以一起探索更多实操的玩法,那我们下期见了。

我敢说现在 codex 加 image 二加 presentation 这个 skill 就是 当前 ai 做 ppt 的 最佳解。 以前我对于 ai 做 ppt 是 很不屑的,就因为我自己对于 ppt 的 要求很高,排版格式、字体间距以及整体的审美。我觉得 ai 之前做了很多时候就非常的怎么说 ai, 尤其是中文的内容,就特别像那种二十年前的排版。 但是我最近用下来啊,我觉得像 codex 做 app 已经能够符合我当前的一个预期了。今天我就跟大家分享一下实操到底怎么做。哈喽,大家好,我是 fred, 专注从普通小白的视角分享怎么从零到一,学习 ai 和 web coding 来提升自己的工作和生活效率。 我觉得这套组合啊,强的地方啊,就不是说帮你去生成几页 ppt 这么简单。它强在可以通过 codex 把整个流程串起来。第一步就是 codex 可以 把大纲定清楚,比如说它的主题,受众页数,每页讲什么,整体确认下来。 第二步可以用 image 二去生成一整套整套的一个页面的总览图,不是只生成一个封面,而是把每个页面大概长什么样子,放什么内容,整体的风格是什么都合在一张图里面去看清楚。 第三步的话,就可以通过啊这种 presentation skills, 然后去把它编成一个整个可编辑的 ppt, 能打开,能改造、能换图,才适合我们真正工作。里面的演示和交付我给大家实际演示一下哈, 我们打开我们的 codex 这个呃对话,比如说我就先让他帮我生成一个介绍 codex 这个实业的 ppt, 然后让他帮我生成一个大纲和内容,不用做 ppt 的 直接执行,那他就会花这个时间去,比如说生成十一页,每一页的内容是什么,讲解要点是什么 啊?然后这个时候我就会让他调用 image 进这个 skills, 它背后的底层其实就是 image 二啊这个模型, 然后帮我输出三个不同的风格的 ppt 图片,包含这十页 ppt 的 实际内容,我们就可以看到啊,它能够输出三个不同风格的,白色的、黑色的,然后还有一个是相对 p l 卡通的。 那下一步你应该做什么呢?很简单,就是帮我把这个第,比如说我就选第三个方案,帮我把这个第三个方案生成一个 ppt 文件,然后去调用 presentations 这个 skills, 那 ok, 很 快它就能够直接输出一个可编辑的这个完整的 skills, 我 们把它整个打开, 虽然说他长得跟刚刚那张图没有特别像,但是我觉得现在已经完完全全符合我的要求的,就是他整个的排版,包括他的这里格标题的整个的,呃, 字体大小排版啊,主见啊,包括这些内容我觉得已经非常非常成熟了, 就基于这个 codex 加 image 二,加上 skills 呃, presentation 这个 skills 三句话深层的这样一个内容,我就已经完全符合当前。我觉得对于普通学生而言也好,或者说普通打工人而言也好,完全可以呃,满足大家工作和生活的需求。 ok, 我是 fred, 呃,下一期我会持续给大家分享更多 ai 实操的工作流,我们下期再见。

好,大家好,我是小刘。呃,今天我们来看一下那个 codex 这一次最新的更新哦,那我讲一下我自己使用 codex 的 一些技巧,希望能够对你有所启发。那首先呢,我觉得 codex 当中所有功能当中最好用的一个功能就是这个自动化,没有之一。真的,这个基本上它能帮你完成所有的事情。比如说像我们家每天呃,基本上每周吧就要换一桶蒸馏水,这个时候我就可以跟那个呃帮我创建一个自动化任务。 然后呢,这个时候呢就直接艾特 composer 柚子,他会自动在微信列表找到送水的小王,跟他说家里没水,让他送水过来,晚上我看了消息之后给他转钱,这时候呢,他会自动去运行。注意这里呢,你要选择最低的模型,因为这个任务他很简单,并不需要使用很复杂的模型, 所以就是说,呃,你可以测试一下。那没问题呢,他会自动在你的微信列表里面找到小王,跟他发这个消息,甚至你还可以每天早上让他给你老婆发消息,或者给你老公发消息,非常简单。 这里记得开启这个防止休眠的开关。那尤其他最近更新了一个挺有意思的功能,叫做,嗯,就是这个浏览器使用,也就说你可以完成京东的打卡,淘宝的打卡,还有一些其他的操作。那这里呢,你可以给他始终而允许,然后这样的话,他在电脑上去审批一些文件的时候,你甚至可以给他 呃做任何你能够想不到的事情,比如说登录学校官网去帮我刷课,刷网课他都可以做到,真的很神奇一个点,这是我觉得最好用的 一个功能,自动化,那绝经、打卡送水都是一些小例子,大家可以以此发挥,对吧?比如说每天给谁谁谁发消息,那都可以让他去做到。那我们来看一下这一次更新的一些我觉得不错的功能嘛,就是首先比如说我让他帮我搜索这个最火的博主,你看他手里到这个列表,然后 排了排序了一下,就这一个,就这一个命令,哦,我用五点五模型,然后他跑完之后,你猜用了多少? 他用了接近百分之二十,因为我刚又多问了一个问题,我用完的时候还是百分之八十三,你看就问了这一个问题,他是百分之八十三啊,对吧?非常的恐怖,这个五点五模型消耗了一个速度,而且我还是 plus, 这个 plus, 这个这个 啊角色,你看他消耗这么多,也就说你一个 plus 用户每五小时你只能大概问啊五六个这样的问题,所以就是我觉得还是用 token 比较节省的话,是五点四比较好一点,对吧? 这里呢再给大家分享两个插件,我用的比较多的就是这个 codex history, 然后同步的这么一个工具。这个开始工具呢,主要就是可以帮助你把你的这个账号之间隔离的这种数据呢,给它全部都放在一个账号上来, 非常的 nice。 因为大家发现没有,就我们在使用 codex 的 时候,你的这个记录啊,老是消失,哎,突然突然就不见了,尤其是你换了多个账号之后,之前的记录更是找不到了,但是这些记录呢, 一直没有消失,全部都存在你本地的这种数据库里面,就是个 circle net, 就是 codex 存存入数据的地方,就这玩意它需要你自己手动去把它给它同步到一个地方,就可以使用这个工具,它可以帮你把这个账号 全部放到一个上面去。那 windows 的 话是可以使用这一个开美项目,还有个 mac, mac 的 话使用这个开美项目就隔离一下吧,大家可以自行看一下,那两个项目都是一样的,你看还是基于它听,嗯, 公开的,它补充了 mac 的 这个版本,相当于这两个工具,可以帮助你解决这种数据不统一的问题。那非常简单,使用起来,你直接把它下到本地,然后你你你安装个图形界面,创建快捷方式,你执行一下就好了,非常非常简单。你其实不知道怎么操作,你就复制它一下,然后你新建一个选项,好吧?新建一个选项,你直接问他,对吧?你直接问他啊,请你帮我就是,哎,把这个插件安装到本地并帮我启动,就这么简单一件事,好吧。 然后就是这个插件,这里这一次又加了几个小的功能,就是这个,我给大家按一下艾特符号,看到没有?支持 word 文档读取,还有表格读取,还有 ppt 读取,之前还是不支持的,他可能依赖一些外部第三方的 skills, 但是那样读取并不是很好,但是他出了这个官方的 skills 就 不一样了,你读取出来的结果一定是非常的 nice 的, 非常的匹配的。就你有任何的 word 文档, ppt, 你 都可以教给他,或者论文之类的, 非常适合做学术研究啊,就是我觉得,呃,这几个比较好的,但这次它去掉了就只有两 两个核心,一个自定义。那系统第一个讲起这个默认,很多人没搞懂什么叫默认啊?就是说 codex 在 沙河中自动运行这个命令的时候,他会默认的去向你进行询问,哎,他觉得这个权限风险哎,蛮高的。那就向你去询问,他可以什么 问题都问你一下,就是跟你进行交互,这个自动审查,他会在沙箱中自动运行这个命令。啥意思啊?就是我运行这个命令的时候,我会在一个虚拟的环境中运行一遍,哎,我觉得他有风险,我再给你询问,哎,可能是问的不怎么明白。自定义 就说你把你所有这个权限,你全部打开这个设置,这个设置,你点设置,这边有一个叫做啊这个权限的这个配置,你看这个这个用户配置,这玩意你得打开,你看他会对每一个每一个项目你使用什么模型,对吧?啊?使用了这个什么什么啊? 比如说,哎,我对某一个插件是否允许它开启 compile use, 你 看开启现在开启状态对不对?我可以把它关掉,飞个马插件,你看就你把这个配置可以把它找成一个文件,你可以发给你的朋友,让你的朋友用到这个文件,但是注意一定要把这个路径给他改成一样的啊, 对吧?这是一个好点,就用户配置嘛,对吧?我们说了啊,这个不同权限,其他的我之前都讲过,那就没什么好说的,个性化这里我觉得这个有点啰嗦,所以我用了这样一个自定义指定,我觉得挺好用的。 然后,呃,还有一个点就是我建议大家不要什么都开这个记忆,这个记忆很容易造成某种,如果说你是做某一类的需求,那你可以把它开起来,不然就会造成噪音啊,这个噪音就是会干扰你那个那个啥,你可以自己去把你的记忆进行处理一下,我觉得挺好用的。对, 还有就是那就刚我们说的这个浏览器这里,浏览器这里呢?这个我们刚说,对吧?你可以选择屏蔽一些网址,就你屏蔽的这个网址呢?就他在 open source 运行的时候不会给你打开啊,当然非常的 nice。 好, 那我们再来看一下,就是,呃,这个五点五模型真的非常的消耗,消耗头坑 plus 用户一天只能够五到六次,对吧?所以呢真的适合这个,这个 真的不太适合,就是用来做打卡之类的相关的东西。好吧,好了,呃,那以上就是本期视频的全部流呢,我是小刘,我们下期再见。

今天教大家用 ai 的 skills 功能,快速生成风格统一的 ui 页面,同时搭建可直接编辑的组建库和变量库,步骤很简单,跟着做就行。 首先打开我们的老朋友,选中上期视频生成的设计规范,点亮思考模式,输入这段提示词,稍作等待对应的 skill 就 生成完成了。点击保存即可。保存后,点击页面上的书本图标,就能找到刚保存的 skill。 接下来我们选中首页,让它用这个 skill 来继续生成其他关联页面。 一会儿,一整套风格统一的 app 页面就生成好了,大家可以看一下这套 ui 的 风格高度统一,用 image 二生成的界面,质感果然很出色。接下来重点来了,我们用 ai 在 figma 里搭建这套 ai 的 组建库,切换到 codex 界面,承接上期视频的任务,继续输入指令。 建议大家把 figma 文件地址一起粘贴进去,能大幅提升效率。输入完成后,让 ai 自动执行任务,过程中遇到弹窗提示,全部点击允许就好。 稍等片刻,组建就会自动搭建完成,并且被分类放在不同的分页中。同时 ai 还会自动创建对应的样式和变量,操作起来特别省心。好了,赶快去试试吧!

本期分享 codex 零基础上手使用教程,覆盖了办公、编程、自动化等使用分享,让我们每个人可以轻松上手使用。开始之前我们先来了解一下 codex 与 cloud code 相比,它的优点有哪些,第一个就是有更多的额度, 第二个就是不会轻易地限制账号,封账号。第三个就是 ai 升图能力,目前是排名靠前的。第四个就是客户端安装更容易,容易上手。第五个就是不订阅也可以去使用体验,因为它有免费的额度,这是关于 codex 的 一些优势。 第一件事情就是要修改语言,在这里部分伙伴会因为网络原因下载的版本默认的会是英文界面,所以需要修改,如果是打开直接就是中文,可以跳过这个步骤,然后设置语言,是在左下角设置这里,然后选择 设置,然后在默认的常规选项里面,这里有一个语言,在语言这里我们选择中文,这时候就可以切换为中文界面。 下面我们来介绍一下它的功能,我们先从左侧说起,第一个就是新建对话,这里就是创建一个新的对话窗口,在这里我们就可以把它想象成 相当于我们换了一个朋友聊天,然后打开了新的绘画。然后第二个就是搜索功能,在这里就是可以搜索历史对话,这里我们就可以比喻为搜索和朋友的聊天记录。然后第三个插件,这里就是让 codex 更强大,赋予 codex 拓展功能,拥有操作其他软件的能力, 在这个插件这里,它还有技能。这就是我们前面分享了好多次的 skills, 如果大家还不了解,可以看一下之前分享的内容,然后第四个就是自动化, 在这里就是定时任务执行,可以直接去新建自动化功能。下一个就是项目,这里就是我们所有的创建的项目和打开的项目都会显示在左侧,然后下一个就是对话, 当我们在对话窗口没有选择任何项目的时候,我们选择不使用项目,这时候的对话内容就会在 对话栏目下面去显示,这就和我们网页对话使用是一样的,适合做的事情就是一些日常任务,比如搜索资料,写内容等等。分享到这里肯定会有好多小伙伴有疑问,就是上面的项目什么时候用,以及使用的场景是什么?在这里我来分享一下。 这里就是我们需要 ai 生成文件的时候,比如我们写代码,生成 markdown 文档,生成 ppt, 生成 word 文档等等,就是涉及到文件生成的,我们就可以选择创建项目,这样的优势就是生成的内容都会保存到当前项目文件夹,容易编辑和管理。 在这里我就是使用大白话来分享的,就是更容易理解一些,可能还是有些模糊,下面我直接实操,大家来看一下。 在这里我直接新建一个项目,然后在项目这里我们指过来就会有一个添加项目的图标,然后我们选择这里,他有两个选项,一个是新建空白项目,第二个是使用现有文件, 第一个就是我们直接新建,第二个就是如果我们打开某个项目的时候,就选择使用现有文件夹, 在这里我们是新建空白项目,然后我们选择新建之后,可以看一下它,这里就新建了一个项目文件夹。创建之后我们可以去修改项目的名称,我们只到项目名称这里,然后选择三个点,在这里有一个重命名项目,我们在这里 我们命名一下,比如命名为 demo, 然后保存,然后我们看一下对话窗口这里它自动选择的就是这个 demo 项目,在这里我们给它提示词,就是一句话,介绍 ai 生成 txt 文文本档, 然后我们直接发送。现在我们的模式是选中项目文件的,到时候它生成文件的时候,就是生成在当前项目文件夹下面。 好,这时候任务完成了,就显示已生成文本文档。 ai 介绍点 txt, 在 这里我们打开项目文件夹,我们来看一下,然后我们通过项目文件这里三个点,然后在资源管理区中打开, 现在就有了 ai 介绍点 txt 文本文档,这就是 ai 生成的文件内容。如果我们不选择任何项目, 我们选择不使用项目,然后我们再和他对话一句话,介绍一下你自己,然后我们直接发送,可以看一下左侧,他就在对话列表下面,没有在项目文件夹里面,这就是项目和对话的一个区别,经过实操演示,我相信大家已经了解了。 然后如何选择,就是涉及到文件生成,比如文文本档写代码,我们就要创建一个项目,如果只是单纯的和 ai 对 话查资料,我们就不用去创建项目文件夹,直接对话就可以。 下面我再分享一个个人感觉比较好用的功能,就是多任务处理,在这里我还是使用生成个人主页的任务来举例,因为这个应用场景每个人都可以用到,我们先选择我们刚刚创建的这个 demo 项目,然后我们把提示词 粘贴过来,在这里我们就是让它生成一个个人主页,使用 html 加 css, 然后还有就是一些风格指定,还有一些按钮的效果,还有页面布局等等,在这里我们就直接发送 在当前的任务进行中,比如我们突然有一个想法,我们可以使用这个技巧,我们想规定腋角的颜色,比如腋角使用灰色,然后我们直接发送,可以看一下它现在这个提示词就是在排队的状态,如果我们想让它立即执行,在这里我们直接选择这个引导, 可以看一下他这里提示就是提交但不中断模型运行,然后我们直接选择,这时候像我们给他的这个任务,他就直接插队插进来了,就不用等上面的任务执行完毕之后,再执行第二个排队任务, 这是关于这个使用小技巧,可以看一下第一个它会直接在当前工作区生成一个可独立打开的静态文件,然后它这里就有一个已引导对话,它就提示收到页脚,我会做成浅灰色背景,如果我们不点引导的情况下, 它就会等第一个任务执行完成之后,然后再执行页脚使用灰色,好,现在就生成完成了,然后我们打开看一下生成的效果,这就是我们生成的个人主页,这里我们直接自己去修改就可以。 下面我再来演示一下多任务,比如我们在当前项目文件夹下面,我们再有一次对话,就是什么是 ai 一 百字介绍,生成一个 txt 文文本档,然后我们 直接发送,这时候我们就可以在另外一个项目文件夹下面,我们直接选择开始新对话,然后我们再给他一个任务, 如何学习 ai 一 百字介绍生成文档,这时候就是同时进行任务,这就是多任务同时运行,当运行完成之后,他这里就会有一个蓝色的小点,然后我们再返回到项目文件夹,这时候任务就完成了,这就是多任务的应用, 然后下面我们再一起来看一下,就是创建技能,就是创建 skills, 我 们来到插件这里右上角的创建,然后选择 创建技能,在这里它就会显示一个 skill creator, 这就是创建 skills 的 一个技能,然后我们把提示词复制粘贴过来,在这里我们还是封装一个 ai 提示词,让它去制作一个 skills, 然后我们粘贴过来之后,下面给他的就是帮我创建一个写作技能,直接发送 好了,这时候提示我们创建成功了,它也给我们显示出来了这个创建的路径,在这里我们新建对话,使用我们自己创建的 scale, 让它帮我们去生成一篇文章,在这里我们输入斜杠,然后我们选择 技能,然后找到我们刚刚创建的,可以看一下这个是个人,然后我们选择,然后我们再给它提示词,就是什么是 ai 帮我写一篇 seo 文章,然后我们直接发送,像现在这个状态,它就是调用了我们创建的 skill, 这时候用我们创建的 scale 就 写好文章了,在这里我们只关注一个地方,就是我们提示词里面让它包含问答模块,这时候它也是包含的,它严格遵守我们的要求,这就是我们创建技能和使用技能的所有流程。 然后下一个我们再看一下插件的使用,在这里我再新建一个对话,我们使用插件就需要使用 at 符号去指定, 比如我们还是给他一个提示词,就是如何学习 ai 使用,然后艾特符号,然后我们选择 document 插件,这里就是这个 word 文档的一个插件,然后帮我生成 word 文档直接发送, 这时候就用插件创建好了文档,现在我们打开看一下它生成的一个效果,生成的效果还是非常棒的,它不是那些简简单单的文字,它是给我们排版好的,效果还是非常棒的,这就是 codex word 文档的生成插件的使用。 然后下面我们再来看它的另一个功能,就是自动化,在这里我们来到自动化这里,通过右上角,然后新建自动化功能,然后我们输入 就是每天学习一个 ai 术语提示词,这里就是每天上午八点给我推送生成一个学习文档,比如 token 是 什么, ai 是 什么? webcoding 是 什么,就是每天八点让它帮我们生成一个学习文档,然后我们再选择一下项目,我们选择 demo, 然后每天八点在这里就是选择模型,我们就选择默认的, 然后下一个就是推理的设置,这里我们也保持默认,然后我们直接创建就可以,这时候就创建成功了,然后我们选择这个自动化任务,就可以看到它的一个运行状态,还有一些详情信息, 这就是关于这个自动化任务创建,也是非常简单的,都是可直观的操作。好到这里就是我们 codex 安装到使用的所有操作,我们本次分享的都是一些基础的使用,我们可以先上手使用,然后其他的再边使用边研究就可以。 在这里还有一个拓展分享,就是如果你使用 codex 是 一些日常的任务,大家可以到设置这里面,然后常规选项这里工作模式就选择 适用于日常工作的模式,像这样它的模型是同样强大的,就是技术细节更少一些。好了,这就是我们本期的所有内容,欢迎留下你的想法,我们下期再见。

这是我刚用 codex 做出来的 ppt, 提示词只有一句简短的话, ppt 中的每一个字都可以被你编辑。这同样是我刚用 codex 做出来的 ppt 目录,下面只放了 attentions all you need 的 论文 pdf, 加上我告诉他我是大学老师,帮我做一堂课间, 中间的每一个字一样也可以被你编辑。前两天发了一个图文,讲了讲我用 codex 做 ppt 的 大致的一个思路,背景是用以妹纸先生成好图片,然后加 html 和 canvas 的 相关的代码叠在上面写文字。这篇图文引起了大家非常强烈的一个兴趣,于是我就编排了这个思路。 今天的两份 ppt 就是 这个 skill 对 应的一个成果,我们通过录屏带你们来完整的再走一遍对应的这个 skill, 这个 skill 完全免费,各无非资的美术馆的介绍,大家可以看到我的提示词非常简短,基本指定的 skill 启动之后,它就开始完成后续的整体的一个工作了。 因为这个 skill 我 相对编的还是比较厚的,中间有非常多的环节,包括 ppt 的 策划,还有就是调度与 make 的 prompt 的 生成。因为也要考虑到,如果你不是用 kolex, 是 用别的没有升图能力的智能体的情况下,这份 prompt 可以 放到豆包里面,让它来帮你生成对应的一个地图作为背景,然后你再给回你的主智能体, 下面呢,就是他一步一步把整个活干完。可以看到这么简短的一个一句话,加上这个 skill, 就 能做出这一份完整的乌斯菲兹美术馆介绍的这样的一个 ppt, 而且你也能看到柯黛斯中间的思维过程,它是顺着乌菲兹最经典的观看逻辑去设计整个 ppt 的 一个延展,这也就是现在智能体的强大之处。 第二个 ppt 的 演示呢?虽然 ppt 最终的审美可能还差一点,但是我觉得它更贴合大部分人使用的一个场景,尤其是像老师这样的一个职业。 呃,我们面对一个复杂的论文,想要去设计它整个的一个框架的情况下,你可以让智能体帮你完成大部分的结构性的一个动作。现在往后再接一步,就是这个 ppt 的 对应的一个生成。 这里呢,我其实还内嵌了一些巧思,我可以支持你把你们学校,比如啊,讲个讲个例子,比如你自己之前的学校,它有一定的 ppt 的 风格的情况下,可以把之前的 ppt 作为素材,这个 skill 也会去阅读你之前所有的传入的这个 ppt 的 素材的风格,去做对应的一个设计。 当然因为演示我不太方便去找一些现成的那个样式,可能会涉及到侵权,所以今天这个剧还是用了这样的一句话的提示词,我是一名大学老师,想给我的学生讲解传送门架构目录,下面是原文论文,请你帮我完成 ppt, 然后做的对应的这个演示。 两份 ppt 就 这样大概花了二十多分钟生成,然后消耗的 token, 我是 一百刀的 pro 会员,大概消耗了我的周限额百分之二左右,如果换算成 plus 的 话,可能就是周限额的百分之二十就能做两份 ppt。 整体的 token 消耗其实还可以。升图的话,因为用的是 codex 自己内置的 emoji, 如果你们遇到了非 context 的 使用的智能题,我还可以。我这个 skill 是 支持把对应的提示词输出出来,然后可以用豆包这样去完成对应的一个生图。今天的分享就这么多。

最近有个说法挺刺激, codex 更新之后,有些能力已经超过 cloud code 了。真的假的?我觉得这个问题不能直接回答, 因为你先得问清楚,你比的是谁更会写代码,还是谁更像一个工程团队的操作台。接下来几分钟,我们不站队,拆开看,看完你大概就知道为什么这次 codex 的 变化不只是模型变强了。 以前聊 ai 编程,很多人默认 cloud code 是 标杆。它在终端里很顺,能读代码库,能改文件、能跑测试,开发者的心智负担很小,你让它修一个 bug, 它真的像坐在你旁边的工程师。 但最近 cloud code 新后,社区里开始冒出另一种声音,怎么感觉 cloud code 某些地方更爽了?有人拿它和 cloud code 对 比,有人说自己被 cloud code 搞崩后换了工具。先别急着下结论。 这个争议真正有意思的地方,不是 cloud code 赢没赢,而是大家发现 ai 编程工具已经不是一个命令行聊天框了。 如果只拿一个 bug、 一个重构、一个 delete code 题去比,你很容易比错,因为那是在比底层模型的局部能力。这个当然重要,但它不是全部。 现在的 coding agent 更像一个小型工程流程,它要理解需求,要改代码,要跑命令,要看浏览器,要处理 pr, 还要知道什么时候该停下来让人确认。你看,问题一下就变了,不是谁补全的更准,而是谁能把一件工程任务从头推到尾。 这也是为什么很多人会觉得 codex 这次不一样,它不是只在代码框里变强,而是在代码框外面长出了手脚。 codex 最近最关键的变化是产品形态变大了, openai 官方把它讲成一个可以委派真实工作的 agent, 它不只是改文件,还强调多 agent 工作流,内置 worktree、 skills、 automations、 pr review、 多文件、多终端、远程 devbox, 内置浏览器,甚至电脑操作。 注意这些功能单看都不神奇,但放在一起,味道就变了。以前你让 ai 写代码,更像叫一个人坐到你的电脑前。 现在你可以把任务拆成几路,让不同 agent 同时跑,一个修 bug, 一个写测试,一个看前端页面,一个整理发布。说明,这就不是代码助手了,它更像一个工程指挥台。这个词有点大,但很贴切啊。克拉多瑞弱了吗?不是,克拉多瑞的基本盘还是很硬, 它的优势是终端原声跟开发者每天用的工具贴得很近。你在项目里打开它,它读代码,跑命令,用 git 接 m c p, 很多动作都在你熟悉的命令流里发生。它还有一个很重要的,气质,谨慎, 默认,会问你哪些命令能跑,哪些文件能改。这对真实项目很关键,尤其是老项目、大代码库、线上事故这种场景,你不一定想要一个到处乱点的全能 agent, 你想要的是一个懂代码、懂命令,还愿意听你刹车的人。 cloud 会有,在这块儿还是很舒服。 codex 更容易赢的地方是任务开始变宽的时候。 比如你不是只要修一个函数,而是要做一整个小功能,先看需求,再开分支,再改前端,再跑测试,再打开浏览器确认视觉,再写 p r 描述。这里 codex 的 优势就出来了,它可以把文件、终端、浏览器、工作区放在一个工作台里,还能让多个 agent 并行。更关键的是, 它不止服务程序员,文档、表格演示、自动化检查,这些原本不算写代码的东西,也能被放进同一个流程。说白了, codex 强的不是某一权特别重,而是它开始会组织一套组合权。 这是很多人突然觉得它反超的原因。但如果你的工作方式很终端很连续很工程师, cloud code 还是会让人上头。 你在一个复杂仓库里追依赖,看日制、改测试、处理 c i, 它的节奏很自然,它不像一个大平台,而像一个强力命令行同伴。还有一点容易被忽略, cloud code 的 简单反而是优势,入口少,心智清楚。很多时候,你不用管理一堆 agent, 也不用想工作台怎么摆, 你只要说帮我把这个问题修掉,它就顺着代码库往下钻。所以我不认为 codex 全面超过 cloud code。 更准确的说法是, codex 在 工程流程组织上开始领先,而 cloud code 在 终端深度开发上仍然很强。所以这次真正值得关注的不是 codex 有 没有把 cloud code 打趴下,这个说法太粗糙了。 真正的变化是, ai 编程工具正在换赛道,第一代比谁更会补代码,第二代比谁更懂代码酷。现在开始比谁能组织工作,谁能并行,谁能跨工具,谁能长期跑,谁能在关键时刻把权限交还给人。 以后程序员可能不只是写代码的人,而是调度一组 ai 工程师的人。听起来有点夸张,但说实话,这一天来的比我想象中快。

codex 和拷拷的别做选择,两个一起用才能少加班。我是松哥,下面我会先讲两个工具各自擅长什么,再讲他们怎么一起配合干活。点赞收藏好,看完你也能拥有两个 ai 同事。 codex 强在执行,你让他改哪里他就改哪里,不会给你瞎改瞎扩散,不解释,也不附电,让他干什么他就干什么,干完完美交差。再加上 codex 最近更新的频率 特别猛,浏览器操控,电脑操控,手机端远程操控,内置最强身图模型,全部都出了,二十兆的会员额度也非常大方,日常用绰绰有余。 卡拉扣的强在规划。你扔一个需求给他,他会先帮你做拆解。这件事到底要做什么,分几步走,每步要动哪些地方,有可能会踩了哪些坑? c c 的 生态, prime, 酷克斯,这 这些也都是他先做出来的。我们日常的内容创作、调研报告、客户报价,现在都是靠他来跑下来了。你发现没有,一个擅长想,一个擅长做,一个理解需求,猜思路,做评分,一个写代码修 bug 补测试,这不就是你的两个 ai 同事吗? 具体怎么配合刑事不用拘泥,你可以让 cloudcode 先拆任务出方案丢给 codex 去执行,也可以让 codex 改完代码,回头再让 cloudcode 来做一个凭证, 甚至就是我们自己开两个窗口, c c 想完了丢给 codex 去执行都可以。重点不是刑事,而是让他们俩围绕着一个目标去干活。 以前我们习惯一个工具干完所有的事情, ai 工具越来越多,与其纠结选哪一个,不如想想他们怎么来,互相配合干活。 这就跟我们带团队一个道理,我们不会只招一种人, ai 也是一样。好了,今天的分享就到这里,评论区聊聊你的 ai 工作流,关注松哥,一起少加班!

你有没有发现, ai 写出来的网站功能都对,但就是一眼模板位。问题可能不在代码,而在第一步就错了。传统做法是直接丢给 codex。 一 句话,帮我做一个干净的猫咖网站,它确实能做出来,有标题、有按钮、有图片区,但大概率像临时 demo chase skill 的 思路。反过来,先用 gpd image 二生成一张像样的网站设计图,再 让 codex 逐项分析里面的布局、字体间距、配色和动效,最后再输出 html、 css、 js 或者 react view sweat 项目。 这一步很关键,因为图片不是拿来当海报的,它是给 ai 写代码前看的审美目标。这个项目把这套流程封装成了一组开源 skills, 比如 design taste frontend 负责通用高级前端, image to code 负责图像优先流水线, redesign existing projects 负责改造旧项目 image and frontend web 和 mobile 专门生成网页。移动端参考 图安装也很直接, npx skills add, 后面接 github 仓库地址,想单独装某个技能,也可以用 skill 名指定。 所以它真正解决的不是 ai 会不会写 css, 而是 ai 在 写 css 之前有没有先看到一个好设计。当然,别把它理解成一行命令包治百病。它 更像给 coding agent 加了一个设计总监,先定视觉方向,再执行代码还原。如果你经常用 ai 做官网落地页、个人主页,这个流程值得是评论区说说,你现在是先让 ai 画图,还是直接让它写代码?

每天学习一个 skill, 今天这一期看 startup pressure test, 这是我今年装进 codex 里最爽的 skill 之一,因为它补上了独立开发最容易死掉的那一步。 独立开发最常见的死亡循环是找 idea 开干,没人用 emo, 然后再重复一遍,中间被跳过的关键一步叫 validation, 很多人其实是用我觉得有用再替代它。 这个 skill 做的就是把 validation 这一步补回来。把你的 idea 丢进去,它会用创始人视角给你压测。核心假设,致命缺陷,真痛点还是幻觉?还有真实竞品和切换成本。 安装也很简单,一行命令就能塞进 codex。 装完重启,把你的 idea 丢进去,它就开始给你做 follower 式压测, 他会直接给你拆六件事,核心假设和致命缺陷,真痛点还是幻觉,真实竞品和切换成本。再往下是前十个客户从哪来两周内能跑完的 mvp? 以及最后一句很残酷但很有用的 strong weak 或 pivot。 我突然意识到,它刚好补上了 red trends 的 下游缺口。 red trends 挖 reddit 针痛点这个 skill 作验证, codex 写代码第一次把 idea 验证落地,串成了闭环。 curser 和 clockcode 解决的事怎么 build? red trends 加这个 skill 解决的事 build 什么?后者才是大多数独立开发者真正死掉的地方。每天学习一个 skill, 我 们下期见。