粉丝900获赞1528

家人们,核弹级更新来了!秋叶大佬全新 comfy 懒人整合包来了,简直是小白神器!不用折腾 python 环境,不用愁节点报错,全部提前配置好,双击就能启动全套汉画界面,零基础也能闭眼玩,还内置三百三十七套爆款大神工作流拉图就能一键生成,无套路全打包 创作的验验牌开始教学。 hello, 小 伙伴们大家好!我们将深入探索纹身图的奥秘以及提示词的语法规则,让你在使用 ctrl u i 时能够更加得心应手地创作出 理想的图像。那么我们正式开始吧!工作流程解析,首先,当我们输入正向和负向提示词后轮本编码器中的 clip 模型会将提示词转化为特征向量传递给 k 参照器。 这时候有个疑问,文本编码器 clip 模型是从哪里来的呢?我们可以看到它来自于 checkpoint 加载器,主要用于加载各种大模型。不同的大模型有不同的内置 clip 模型,而不同的大模型之间 clip 模型也可能会 有所差异。接下来, checkpoint 加载器输出会经过 ve 模型, ve 解码的作用是将经过降噪后的图像从浅空间解码为我们肉眼可见的像素空间图像。 让我们做个实验,如果我们断开 v a e 模型的连接,试图生成图像会出现错误提示,显示缺少 v a e 输入,只有重新连接 v a e 模型,图像才能 成功生成。另外,记住生成图像的快捷键 ctrl 加 enter, 这个快捷键非常实用。此外,生成图像的宽度和高度尺寸可以通过空 latin 节点来调 调整控制。比如说我们将高度调成七百六十八,注意这个数值一定是八的倍数,宽度也一样。至于批次的话,则是控制单次生成的图片数量。比如说我们设置成二好,我们按 control 加 enter 开始生成。图片生成后,我们是不是可以看到它的比例 已经成功变成了竖屏的比例,并且它依次生成了两张图像?接下来让我们一同学习提示词的相关语法。首先是书写规范,无论是正向提 诗词还是副象提示词,都必须使用英文以及英文标点符号,否则系统可能会出现识别错误。比如我们输入 one girl, garden 和 yellow dress 黄色的裙子,使用快捷键 ctrl 加 enter 生成,就能得到一个穿着黄色裙子在花园中漫步的女孩图 片。但如果我们使用中文输入一个女孩花园以及黄色的裙子生成的图片,虽然都有女孩,但黄色裙子和花园却未能很好的呈现出来。那么接下来是 提示词权重。什么是提示词权重呢?简单来说,权重就是某个提示词在生成图像中的影响力,权重越高,该提示词在画面中的占比越大。例如输入 one girl 权重一点二,而 garden 权重零点八十,生成的图像会更加突出 one girl 的 部分。那我们有什么技巧调整权重呢?比如中 括号代表零点九倍权重,降低该提示词的重要性。小括号代表一点一倍权重,增加该提示词的比重。大括号代表一点零五倍权重。用于微调权重,还可以通过快捷键调整权重。将光标移到某个提示 词上,按住 ctrl 加上箭头增加权重, ctrl 加下箭头减少权重,不过权重不能过高,否则图片会过敏, 进行失真。接下来是短句与长句,提示词长度与起手势。我相信不少小伙伴都有这么一个疑问,为什么我写提示词的时候一定是一个一个词这样去拼写,而不是用一句话去描述我们想要生成的内容呢?虽然两者都可以,但短句更能准确表达生成意图, 且便于调整权重。使用短句时可以通过按顺序调整关键词的权重,从而优化生成效果。提示词的数量也非常重要,过长的提示词可能会影响图像生成的准确性, 那么我们最好把提示词控制在什么数量之内会效果最佳呢?经过众多 a i g c 玩家的经验以及研究表明,提示词控制在七十五个之内是效果最精准的。超过了七十五个提示词的话,可能会对提示词的识别 不精准,整体的表现会降低。在 stable diffusion 各个大模型训练的过程中,会加入许多的比如四 k、 八 k 或者 masterpiece 各种各样高质量的图形去训练。当我们输入提示词的时候,比如输入四 k masterpiece 就 可以使我们生成的图像更加的精美。反向提示词的话就相反,比如我们输入模糊,就 我们不想要模糊,那么相当于也是会让图片变得更加的清晰。在输入提示词时,顺序也会影响生成的效果。在一组提示词中,越靠前的提示词权重会有所增加。所以我们在书写提示词时尽量按照以下格式。首先是提升画质的词汇,例如 masterpiece, high quality, high detail。 接着是描述主体,例如 one girl。 然后描述环境或背景,例如 garden, snow。 最后可以加入 laura 的 触发词或其他模型的提示词。为了避免多个提示词相互干扰,可以使用 break 命令来隔开它们,尤其是避免颜色污染。若要融合多个提示词,可以使用大写的 end 或 符号,也可以使用书写风格不同的关键词,从而创造出新的组合效果。比如我们写 one girl, cat 这边我们可以看到生成了一张女孩和猫的图片。好的,现在我们在 one girl 和 cat 之间添加上 and 注意这里的 any 必须 是大写。这边我们可以看到生成了一张猫娘的图片。这个 any 作用就是将两个提示词融合在一起。我们还可以通过调整迭代步数,精确控制生成过程中的每个阶段。格式为 提示词一,提示词二权重数值。权重是指提示词一的权重。当权重数值大于一时,单位为采用迭代步数。当权重数值小于一时,单位为采用迭代步数。百分 比。例如,想要前百分之三十生成 forest, 倾向后百分之七十生成 one girl, 只需要输入 forest, one girl 零点三, 其中零点三代表百分之三十的比例。当采用迭代步数为三十时,表示前九步用于生成与 forest 相关的内容,后面二十一步用于生成与 one girl 相关的内容。在介绍图生图的工作流之前,我们先来讲讲什么是图生图。在我们使用图生图功能时,我们一般使用一张图片与一组 关键词共同作为输入生成的图像,这样受到这两个输入的共同调节作用,比如使用下面这张初级草图以及一段指令作为输入图,升图功能会将其转化成一张完成度较高的图 片。图。升图基于 stable diffusion 模型,将输入的原始图片转化为模型能够理解的潜在空间表示,再结合用户输入的提示词在潜在空间中进行有针对性的修改和优化。最后将修改后的潜在表示转换回图像空间,生成新的图片。 同时选择合适的模型很重要,不同模型对不同类型的图片生成效果各异。接下来我们回到 confui 中,我们先加载一个默认工作流,随后将 call latent 给删去。接着我们点击 latent 拖出来,选择 v a e 编码,那么我们就成功加载了 v a e 编码器。接着我们将 v a e 编码器的 v a e 输入连接到 checkpoint 加载器的 v a e 输出上。随后我们将图像节点给拖出来,选择加载图像 load image。 这边我们上传我们需要的参考图像,这边我上传的是一个戴着蓝色帽子的小姐姐。接下来我们要编辑一下提示词,这边我们可以接一个 w 一 四反推提示词节点,方便我们获取图片精确的描述提示词,然后将我们的正向颗粒文本编码器转换成输入。接着把 w 一 四反推提示词 的自辅串端接到输入端的文本处,副向提示词一般输入模糊、最差质量、低质量、低分辨率水印等。现在我们来到到采暖器这里,可以看到这边有个降噪,我们将该值修改成零点六,对于降噪值,零点三到零点五之间属于安全的重回幅度区 区间,而零点五到零点七则赋予了 ai 更多的想象与发挥的空间。那么低于零点三或者高于零点七,图像都有可能会发生扭曲变形。那么这边我们取个中间值,将数值设置成零点六,生成一张图片试一下。这边我们可以看到生成的真实人像跟目前给到的图像, 无论是帽子还是服饰都是很相似的。那么我们把数值调成零点四五,再生成一张,来看一下效果是不是又更好一些。如果你觉得图片不太满意,那么我们可以多生成几张,直到得到你满意的图片为止。接下来我们讲一下什么是高清修复,比如说我们现在生成的这张图片我们非常满意,那么我们怎么 增加它的分辨率以及图片的细节呢?我们回到 k 彩样器,我们先将种子值选择固定模式,双击界面的空白处输入 upscale, 然后我们选择 latent 按系数缩放,我们将该节点的 latent 输入 连接到 k 彩样器的 later 输出上。随后我们按住 alt 键,点击 k 彩样器拖出来,那么我们就复制了一份相同的 k 彩样器。我们将这个 latent 按系数缩放的 latent 输出节点 连接到我们新建的 k 彩样器的编辑输入中。最后我们将文本编码器的条件输出分别连到 k 彩样器的正面条件以及负面条件上。模型也是一样,我们回到 checkpoint 加载器,将模型连接到我们新建的 k 彩样器上。随后我们回到新建的 k 彩样器中,我们将步数设置成二十五步, f g 值五就可以,彩样器和调度器默认就可以。接下来我们新建一个 ve 解码器,随后我们将 ve 解码器的 ve 输入端连接到 checkpoint 加载器的 ve 输出上,接着我们新建一个预览图像节点,最后开始生成。好,现在我们可以看到生成的结果,五官是和原图非常相近的, 我们再来对比一下图片的细节,放大之后我们可以看到右边,也就是我们新生经过高清处理后的图片细节要比原图多很多,图片还是比较清晰的好。这时有的小伙伴可能会说,这还不够清晰,那怎么办?别着急,我们还有高清修复的方法,接下来我们将进行第二重高清修复,我们搜索 s d upscale, 就是 这 sd 放大,接下来我们将这些节点一个一个的连上。首先是图像,我们连接的是这个 v a e 解码之后的图像输出,接着模型我们还是老样子,连接的是 checkpoint 加载器的模型输出,接下来是正负相条件好,我们连接 v a e 模型,接下来点击这里 选择我们的放大模型。四 x ultra, 这个放大模型是我试用下来效果最好的。最后我们加载一个预览图像节点,我们点击开始生成,图片已经生成出来了,我们可以放在一起对比一下效果,这张图的分辨率已经达到了二 k 的 清晰度,我们可以看到细节都还是不错的。然后我们再来和第一次放大的图 片来进行对比一下,差异还是非常大的,这时有的小伙伴可能会说,觉得这张图清晰度还不够,那怎么办?别着急,我们还有最后一重放大之后, 也就构成了所谓的三重放大,这边我们搜索 upscale, 接着选择这个图像,通过模型放大,这个节点非常简单,只有两个输入以及一个输出。图像的话,我们连接到 s d 放大之后的图 放大模型,这边我们同样选择的是该模型,随后我们加载一个预览图像节点,好,我们可以看到最终生成图像已经出炉,我们来欣赏一下它的效果到底怎样?这是一张达到四 k 的 图像了,清晰度非常的夸张,发丝都看得见,完全没有那种模糊马赛克的感觉。我们再来对比第一张,小伙伴们觉得怎么样呢?图升图 以及三重放大的效果,这是我们的原图,然后这是我们图升图之后,这是第三重放大。

大伙好啊,呃,今个呢,说一下这个 ltx 二点三,这个 msr 哈,就是参考图上视频,那么它是由光追大佬啊开发的,呃,一个罗拉和一个工作流,然后呢,呃,也用了一下哈, 呃,这两天呢,也有小伙伴问我这个 msr 的 情况哈,呃,我先说结论啊,就是为什么出来这么长时间我一直没做视频啊,就是我个人使用下来啊,当然是我个人的观点啊,各位,就是 msr 的 这个抽卡率有一点点高 好吗?呃,就是可能得抽几次啊,才能形成一个比较理想的视频,再有一个是什么呢?这个 m s r 哈,对这个, 呃,对这个参考图和这个提示词的要求相对来说高一点点啊,所以呢,因为我个人是玩那个批量的哈,大家都知道我有个批量管理软件哈,就是一次性生成多个视频,那么这个 m s r 哈,对我这个批量操作这一块相对来说就啊不太适合我的应用场景啊,所以一直没做。 小伙伴问了,咱们也说一下这个工作流啊,其实整体这个功能还是挺好的啊,就是参考生视频那一块确实挺好的。那我们先说一下啊,这个工作流啊,各位,主要的点在这里啊, 主要的点在这里,上边这一段就是我们普通的这个 lts 二点三的一阶段啊,一彩的这个工作流,那么 msr 实现啊,主要在这里,第一个啊,它会将我们的参考图啊传入到这个节点当中,然后生成一段类似于参考小视频的, 里边包含各个参考图,最后一个是背景图了,这么一个参考小视频啊,然后呢,垫入到我们这个 icloud 这个节点当中啊,作为引导哈,然后第二步 啊,这个是条件这里哈,将我们这个参考小视频其实就是多张图片好传入,第二个就是当我们生成这个 video latent 这个位置的时候,是吧?在 latent 这个层面哈,将我们的参考图和背景图垫入到这里边去啊,实现哈双向的引导,最后是吧,来控制我们最后的视频生成。 好吧,各位,那么这里边有几个点啊,参考图一和背景图是必须传的,其他几个参考图选传哈,但是呢,大家看啊, 这是我的参考图,这个是我的背景图,那么参考图二,参考图三,参考图四哈,大家选传。好吧,各位,但是最后不管大家传几张图啊,这个点要连好,比如说我就传了参考图一和参考图二,加上背景图,那么我这个一和二和背景那块要连上三和四,就不用连了, 好吧,然后呢,在这个位置,那我参考图一和参考图二以及背景一共传了三张图啊,那么这个位置是吧引导这块我们就写,是吧,三个,大家看这个位置,三个参考图,然后参考图一连到一号这里,参考图二连到二号这里,最后的背景图,注意,背景图一定是最后的啊,传入到三号图片这里。 好吧,大家知道这么个事啊,就是你有几张图,这里边就写几,因为就是为什么一直没做的视频啊,就是每一次我都得调的,我觉得这个 浪费时间,而且很难进行规模化的处理,所以这个视频我一直没做啊,但是从个人的角度,这个功能还是挺全的,好吧,然后呢,大家看啊,他传的参考图啊,尽可能的各位包含你人物的所有信息。那么大家看我这个参考图啊,这也是看了很多博主之后得到的这么一个结论啊,因为之前我上传的参考图就是一个人物的一个全成像,效果不太理想 啊,呃,这样呢,好,好一点了,大家看,首先最左侧是一个人物的一个全视图好吗?那么这个怎么生成的呢? 呃,很简单啊,大家看啊,我就用这个千万二五幺幺上传一个人物的照片,然后两段提示词,第一个生成人物正面的头部特写,纯白色背景,生成一个人物正面的头部特写哈,然后纯白色背景,好吧,接着 生成人物的三式图,包括正面,背面和侧面啊,纯白色背景风格写一下,然后呢,人物的穿着写一下,因为什么呢?你上传这个参考图有可能没有下半身的描述以及斜的描述,对吧?所以我们把这写一下,生成完两张图片之后,大家看啊,在这里边, 我就得到了一个大头照和一个三式图,然后呢,用这个图像拼接啊,这个节点将图像保存起来,好吧,效果就是这样的, 大家看是吧,一个大头照,一个三十图,那么这是一个人物是吧,其他人物同理哈,大家看这个,其他人物同理,我就得到了两个人物的这个角色图像哈,然后呢,用做参考图一和参考图二,然后呢,我随便找了一个背景啊,就是一个大街,现在呢,我有两张参考图和一个背景图,然后呢,在这里边, 好吧,参考图一,参考图二传进去,背景传进去,那么这边一共是三张图,一二三啊三是背景啊,在这里,好吧, 这样呢,我实现了双线引导,然后在上边设置一下最后视频的宽和高啊,以及生成的总时长十秒钟。 然后呢,各位来到提示词这里啊,这个提示词也要好好写啊,首先我们提示词当中对这几个参考图进行描述,这个我是把它扔到豆包里面进行一下反对啊,比如说参考图一,他的名字叫音乐性别女,然后他的穿着以及长相的描述,参考图二是吧,叫什么?性别是什么?然后呢 对他的外貌进行描述,然后简单参考图三啊,他是场景,然后对场景进行一下简单描述好吗?呃,这样呢,能够让我们后边的题诗词书写啊,就是然后让我们的题诗词被模型理解的时候啊,更容易一些,而且呢 生成的效果相对说好一些啊。最后就是我们对视频的描述啊,比如说写诗风格,镜头啊,环绕怎么啊?镜头怎么运镜?然后呢给到音乐啊,上面因为已经说了参考图一叫音乐,所以在这里边直接写啊, 围绕音乐,然后呢音乐站在大街上,然后对着镜头说啊,然后呢这个如烟啊,从远处走过来啊,对音乐说,好吧,下边啊是对我们生成视频的一个描述,那么上边这一块啊,大家注意啊,就是 每一个参考图啊,都把对应的这个呃解释,也就是参考图的描述啊写在旁边,然后呢他就可以后期通用了啊,也就是这部分提示词实际上是通用的提示词,好吧,每一次用你把它粘过来就行,好吧,重点是下边好吧,视频怎么啊,视频怎么生成?好吧,各位那么最后的效果呢?就是这样了, 好巧啊,你也在这里啊,这是另一个开播啦,干活啦,我想死。呃,我先说一下各位,这个 m s r 啊,它会掉一定的人物相似度啊,就是人物的相似度其实没那么高。人物相似 这个人物的相似度其实是没有啊,就可以说小鱼吧,小鱼这个图声视频啊, 好吧,小于图层视频。而且呢,呃,咋说呢,就是同样有啊,就是这个崩坏的问题同样存在啊,就是人物远景啊,高运动啊,这个情况下是把这个崩坏的概率同样存在好,而且有抽卡率。好吧,各位。呃,但是他的优点是什么呢?各位,这个有一说一啊,就是我们正常生成视频的时候肯定是,比如说首先是提着词 啊,就是纹身视频啊,纹身啊,不是纹身视频,纹身图。第二个,这个图实际上就是我们的关键帧啊, 关键帧,然后再用关键帧啊,就是图,是吧,图生视频对吧,这是我们正常的生成流程,那么 m s r 哈,它是跳过了中间步骤,直接是用我们的 t s 加参考图,因为参考图只生成一次,后边接后边连续使用是吧,所以它就相当于省去了关键帧生成的这个步骤 好吧,直接用文加参考图。参考图啊,因为参考图已经是生成过的,所以不用反复生成啊,这个是参考图好吧,然后呢,送视频,它省掉了中间的步骤哈, 它省掉了中间这个关键帧的步骤直接从文跳到视频,所以呢,它的这个效率应该是高于我们的纹声啊,这个纹声图加图声视频的这个这个流程的好吧,各位,但是呢,也有一点哈,因为本身我们这个 ai 声视频啊,它就存在着一定的不可控性, 对吧?因为上边提着词能控关键帧,关键帧能控视频,相当于多了一层控制,是吧,这个就从我个人的理解,是吧,它更难控了。 好吧,各位,就是视频的控制成本其实更高了哈,所以呢,就是大家可能经常会得到你就是意想不到的,这种视频就造成了这个抽卡率比较高。另外呢,他毕竟是参考生视频,对吧,他不是我们之前的文生啊,图生视频啊啊,这样的人物的相似度啊,会相对来说低一点,对吧?再加上什么呢?各位,其实这个才是重点啊, lts 二点三本身模型能力的问题,对吧,各位,它本身模型相似度不高,然后呢,呃,用这种情况,其实相似度反而有点有些下降啊,但是整个这个参考生视频提高效率这一块,我觉得还是挺好的,这个看个人好吧,各位,看个人的需求。 呃,重点在于我们生成的参考图是吧,要尽可能的把我们要做的事描述清楚。那么第二个工作流是吧,各位, 就是可以自行的上传自己的这个语音啊,大家看啊,这是我自己用这个 omni t t s。 生成的一段语音啊,剧组人员还在逛街,没有任何紧张感。 你好啊,小音乐,好久不见,你好啊,你老公的腿好了吗?呃,其他的都一样啊,就是将这个声音的生成这一块交给我们自己的 t t s, 然后生成好对应的声音在逛街,没有任何紧张感。 你好啊,小音乐,好久不见。你好啊,你老公的腿好了吗?总体上还行哈各位。所以呢,这个还是推荐大家一试的哈。

正片开始,今天带来的是 forg 如何使用秋叶启动器运行的教程,听知情人说不会单独做 forg 的整合包,所以我试着弄了一下启动器,踩了很多坑,帮大家规避一下。 大家最好将之前下载的佛机压缩文件解压到一个新的目录下,或者做好备份,避免安装中报错导致无法使用。 解压完成后,将之前安装的 yby 启动器复制,回到复制目录下粘贴,然后双击打开启动器,等待更新完成。 打开启动器,点击设置,来到配置模式,选择专家模式,点击是界面语言,可以设置为中 中文,选择自己常用的浏览器,往下拉,找到拍成路径,点击文件加图标,点击 system 文件夹, 点击拍摄文件夹,双击拍摄 exe, 然后设置 get 路径,依次点击 get 并 get exe 设置,这里就完成了。点击版本管理稳定版,这里千万不要动,我们找到开发版, 选择一个最新的日期,点击切换,看到安装成功就可以了。来到扩展这里,可以看到里面比我口袋还干净。点击安装扩展,可以在这里搜索需要安装的插件, 也可以复制项目链接,点击安装插件高级选项,这里可以保持默认,不做任何操作。

ai 小 白必看 comui 避坑指南,免魔法、免积分、本地运行的正确打开方式。整合包一键部署,你就可以实现真人古风、 ai 电子虚拟模特、首尾争过渡等三百加工作流模板。 现在手把手教你如何正确部署 comui 整合包,老规矩,验个牌试试。首先找到你下载好的压缩包,用鼠标右键点击它,在弹出的菜单里选择解压软件解压,然后点击解压到当前文件夹,等着解压完成就好。 解压后的文件夹里之前有使用过 s、 d、 y、 u i 的 小伙伴会看到同样的 a 会式启动器的标识, 双击就能运行。启动器第一次启动时等待时间会稍长,因为启动器需要自动配置环境文件和基础依赖,大家不用着急,等进度条跑完就行。启动器主页左侧有几个关键功能区,我们快速过一遍,避免后续操作踩坑。 文件路径区,这里会显示 ctrl u i 的 根目录自定义节点输入图片和输出图片的保存路径,后续找文件、存作品都靠它。高级设置重点看生成引擎默认会选择电脑的独立 gpu, 一 般不用手动改,要是识别错了,手动换成自己的独显 gpu 就 行。 疑难解答与版本管理疑难解答这里,如果大家后续出现整合包有问题,可以通过这里进行排查问题版本建议选稳定版, 开发版虽然功能新,但可能有报错风险,大家隔一到二个月来切换一次版本就够。小工具区是不怎么用的,所以暂时用不。上限阶段,我们先聚焦核心功能, 然后确认设置没问题后,点击启动器右下角的一键启动,等环境配置完成, comui 会自动在浏览器里打开运行界面。好的,进入 comui 后,我们会看到一个有几个方框和线交叉连接的东西,这个就是我们最基础的纹身图工作流节点, 然后工作流的语言默认是中文,不用额外切换,要是不小心切到英文,点左下角的设置图标,找到语言一栏,在里面切换就好。然后配置模型这一块, ctrl u i 是 没有自带的模型文件,大家可以将下载好的模型安装至根目录 checkpoints 文件夹中。 将下载好的模型放入文件夹后,小伙伴们还要记得重启一下我们的启动器,打开后台,点击右上角的中指进程,然后再点击一键启动,这时我们就可以将之前的网页页面进行关闭,重新等待跳转进去模型放入文件夹后,我们来简单测试一下, 感受下 comui 的 基础流程。首先我们先选模型,在 checkpoint 加载器里挑一个你常用的模型,然后写提示词,找到文本编码器, 也就是提示词输入区,在正向提示词里输个简单需求,比如 one girl solo、 long hair, 反向提示词可以暂时空整,点击下方运行按钮, 也就是我们的图片生成按钮。等进度条跑完,第一张图就出来了。

大伙好啊,呃,这个布尔尼尼 comfy y 官方提供的工作流啊,已经可以用了哈,如果大家想使用呢,首先第一步好更新我们 comfy y 的 内核 啊,找到 comfy y 的 内核,找到开发版啊,更新到最新就行了。然后呢,我们可以在模板当中啊,找到最新就能找到布尔尼尼啊官方提供的工作流了。 那么呢,呃,官方提供的工作流啊,有很多功能啊,当然呢,如果我们切换功能的时候啊,可能呢需要更改一下工作流的配置,所以呢,我将官方的工作流的几个核心功能啊,拆解出几个对应功能的工作流。然后呢,今天一起说一下。 当然呢啊,布尔尼尼的功能不只有这几个啊,还有很多啊啊,这里边只是挑了几个核心的功能哈,后续呢,如果有需要还会继续更新哈。然后呢,呃,开始之前呢,也是说一下是吧,这个布尔尼尼这个模型毕竟刚出来不久哈,功能这么全啊,可以说是一个保障模型哈, 是呢,可能有的地方表现的挺好,有的地方表现的一般啊,大家呢,希望给点时间哈,这个后期如果优化的情况下,应该会是一个全能的六边形战士。好吧,各位,呃,大家需要给他一点时间哈,就比如说万二点一是吧,到现在是吧,还有基于万二点一的啊,这个新模型出来呢, 对吧,所以呢需要一点时间啊。好了,我们直接先说啊,第一个功能就是这个纹身图啊,呃,大家呢可以找到这个布尔尼尼的官方提供的图像编辑啊,他刚开始是这样的啊,有一个子图,大家把这个子图大家进去看一下啊,把这个子图打开之后啊看,这是原来的子图,打开之后, 然后呢,简单的修改啊,就是我现在的这个工作流好吗?各位,这就是官方紫图,打开之后,然后进行简单的修改哈,那么说一下,首先加载模型啊,用的是官方提供的波尔尼尼啊,高噪啊,然后呢, 这个低噪模型,然后加速罗兰哈,这个官方用的是这个 light x two v 啊,这个 t two v 啊,高噪的强度是三 啊,然后低噪的加速模型的强度是一点五,当然哈,我也看其他的博主用了一些其他的 rola, 我 简单的试了一下,发现还是这个效果好一点点哈,当然我没试全。各位,如果有更好的这个 rola 的 组合呢,可以给我留个言哈啊, 很简单,在这里设置一下宽和高,在这里输入提示词啊,就可以进行升图了。然后呢,大家看啊,官方的时候,这里边有一个开关啊,是否起用加速的这个 lora, 如果起用了,大家看好用的就是啊,我们上传的这两个加速 lora, 然后呢,它的步数啊, 大概是六步啊,高噪三步,低噪三步哈,如果这个位置大家关掉啊,就是关掉加速的时候,大家看啊,这两个实际上就不起作用了哈,然后呢,它一共是四十步,高噪二十步,低噪二十步,然后 c f g 是 五点零,大家知道这么一个配置就行了。然后呢,撤下来之后,纹身图 啊,纹身图的这个功能,大家尽量就把这个加速啊给它关了,大家看啊,跑的效果就是这样的 好吧,总体上还行啊,就是有这个功能的,而且这个功能也还行,如果后续有对应的这个加速 lora 是 吧,这个专用的加速 lora 更新之后应该效果会很好,而且省很多的时间啊,因为呢,现在的这个加速 lora 也不是这个布尔尼尼专用的,对吧,这个大家可以理解,是吧,毕竟模型刚出来,这个加速 lora 没更新很正常。 好吧,第一个功能说完了哈,第二个功能是这个图片的编辑啊,效果不错啊,大家看啊,图片编辑的时候,这个加速就可以打开了啊,就是高噪三步啊,低噪三步,这个我撤了哈,开不开这个加速的效果都差不多,那为了这个速度和效率是吧,我们就把它这个加速开开啊,模型一样哈, 模型的配置是一样的,高噪低噪加速。好吧,各位,然后呢,大家看啊,我这里边选了一张呃,参考图,然后呢,嗯,在这里哈,将女人的衣服换成泳装,大家看啊,效果几乎没偏移哈,各位,效果是挺好的,这个图片编辑好吧,而且开加速之后是速度挺快的, 可以推荐一用啊,各位呃,六边形战士,如果后区是吧,社区大佬,这个呃,更新了相关的功能之后,应该是一个特别特别能打的模型啊,我们接着往后看哈,然后呢,是这个参考生图, 那么参考生图这一块,建议各位哈,将这个加速关闭,因为呢,可能是失费的原因。各位,大家看,我上传两张参考图,然后呢,在这里哈, 参考图一,大家注意哈,参考图一是 image 零,参考图二是 image 一, 大家记住哈,参考图三就是 image 二呗,然后用这个 image 零一二去指代图片中的人物,这样去写题词词稍微好一些哈。呃,把加速关了之后,大家看好两个人在吃饭 啊,这个一次性会有一点点嗯,丢失哈,可能后期会需要这个强化或者优化哈,各位,但是呢,这个功能是有的 好吗,各位,就是如果大家把这个加速打开之后,咋说呢?就是因为可能是加速拉拉适配的问题啊,他生成的这个图片就像这个步骤没跑满一样啊,呃,很多噪点 啊,很多果粒虫好吧,各位。呃,所以呢,目前生图这块图片编辑的效果是不错的,然后呢,纹身图如果后续有专音像的优化,其实也是挺能打的一个模型,好吧,这个是生图类啊,纹身图,图片编辑和参考生图。然后我们看一下视频类, 这里边列出了几个功能啊,第一个就是这个参考升视频,也就是我们参考图升视频啊,大家看,呃,参考图在这里上传,然后呢,在这里设置视频的宽高以及总的帧数, 然后呢,这个模型跟之前一样的配置啊,这个之前说过了,接着呢,加速是一定要开的哈,各位,加速 lara 的 起用是一定要开的,因为你升视频如果不开这个,这个速度我们是承受不了的哈,往后看, 第一个就是单张参考图生成视频,大家看好,我觉得这个布尔尼尼啊,这个模型的视频参考啊,就是参考生成视频,这个能力要强于这个 l t s 二点三哈,就是没声儿,大家看好 人物的还原度,而且哈整个画面非常的稳啊,这个是十六帧每秒的,然后接着往下看,多图参考上视频,我上传了两个人物,好吧,让他俩吃饭,总的来说呢,十六帧多图参考的时候会掉一定的相似度,但是掉的不是特别多, 好吧,各位啊,大家注意下这个事哈,就是因为哈,就是目前开源领域里边参考生视频的所有模型它都掉相似度啊,我感觉这个还行,整个画面的质量,我个人感觉哈,要比 lts 啊,除了声音这一块,其他都要强是吧,然后大家看哈,还是两个 参考图生视频,然后我让他打斗一下,然后帧数调成二十四,还是说哈会掉相似度,但是大家看这个画面哈, 虽然说这个打斗跟闹着玩一样,但是大家看啊,整个的画面质量,运动这一块,绝对是比 ltx 二点三要强一丢丢的 好吗?各位,是吧,可能这个打斗这一块是吧,这个一是这个屏幕比较窄是吧,竖屏的两个人打斗也打不起来啊,换成横屏的我估计会好一些哈啊,但是呢,这个单纯的我提示词里边就写打斗,我也没告诉他咋打是吧,有点像打情骂俏了。 然后呢,再往后看啊,这个呢是二十四帧单图升视频啊,参考图升视频啊,大家看,这是一个二次元的,怎么样,这个效果还可以是吧,各位,然后最后呢,来一个强度测试啊,就是高运动的情况下。然后呢,参考生成视频,二十四帧每秒,大家看啊, 让这个人从远处走来,镜头从俯拍照给特写。大家看啊,整个这一段下来啊,人物的相似度掉了一点,因为毕竟人是从远景过来的,对吧,各位,这个有这个记忆的原因啊,从远景过来掉了一点相似度,但是大家可以发现啊,二十四帧每秒,人没崩, 就这一点啊,各位 l t s 二点三就很难做到,对吧?确实人没崩,这么大的动作人没崩,各位大家看啊,一点都没崩,就是掉了一点相似度, 好吧,所以呢,参考生视频,我感觉后期如果还有专项的 rola 或者是优化的时候啊,应该效果是非常非常能打的 啊。接着往下看啊,这个视频编辑这个功能是最早出来的,对吧?这个不多说了,大家看,把人物的服装换了,一点问题没有啊,这个视频编辑功能是最早有的,所以呢,不多说了,再往后看啊,这个是原视频,然后上传参考图进行的,这个视频加参考图的视频生成。首先大家看这边哈, 呃,第一个就是将人物替换,没啥大问题啊,但是会掉一定的相似度,好吧,各位,因为我这分辨率拉的比较低啊,是五幺二的,如果换成七二零的会好一些,然后再用生成好的这个视频去将他的衣服换掉,大家看衣服换的没啥问题, 好吧,这个是参考图加这个原视频视频的编辑生成,好吧,这里设置宽高总帧数 啊,然后呢,模型在这里设置提示词,这里大家注意哈,就是如果大家有参考图的情况下,参考图一用 image 零代替,参考图二用 image 一 代替,这样的写提示词,是吧,能好一些。

大伙好啊,这个 ltx 二点三哈,这个导演节点就是这个 ltx director 哈,呃,出了有一段时间了,那么之前没做这个视频哈,是因为我没有对应的使用场景哈, 那么最近也有小伙伴问我说这个节点怎么样哈,所以今天就说一下这个节点。先说结论哈,这个节点各位能力非常强,能让哈我们通过精修的方式哈,去调整我们这个短视频的输出啊,是精修哈,但是呢,呃, 可能也存在一些问题啊,但是这个问题可能也不赖这个节点哈,因为呢,这个节点的能力确实非常强哈,但是呢,可能受限于这个目前 l t x 二点三这个模型本身的能力哈,所以呢,输出的视频哈,目前的效果呢?呃, 可以说还行哈,然后呢,但是有的时候不能说,有时候了,可能需要抽卡哈,那么现在呢,各位大家看一下这个节点哈,如果想使用这个节点,大家呢,需要安装一个插件哈,插件的名字是这个哈,叫做 what dreams cost 啊, comfy ui 呃,这个插件安装完之后呢,大家可以在插件的目录当中找到这个工作流,当然呢,这个工作流也已经上传完了哈,大家可以直接使用 呃,这个工作流拿出来之后呢,我做了一些简单的修改哈,包括模型的更换,包括,呃,加了几个 lora 啊,这个 lora 第一个是这个 oni nft, 这个 lora 已经说过了,效果不错哈,权重啊,可以设置为二点零,然后还有一个国风的 lora, 还有一个 lora, 这个 lora 比较特殊哈,一会说这个 使用的时候强调一下,就是这个 transition, 这个 lora 大家已经不陌生了,但是和这个导演节点配合的时候,有的时候我们需要注意一下哈,然后呢,再说一下这个工作流哈,大家呢,可以在这个插件当中哈找到这个工作流,当然也可以使用我上传的那个工作流,我上传那个工作流除了改了这个模型之外哈, 在这个位置也改了,就是这个二彩的时候用的这个 sigma 啊,用的是我们之前 comu i 提供的这个 lti 二点三,二彩的这个 sigma 就是 开始是零点八五啊, 用的是这个。那么用这个 sigma 之后呢,有没有提升呢?有,画面有些许注意啊各位,画面有些许的提升,然后呢这个配音的音质有了一些提升啊,呃,别的呢?特大幅度的提升,其实我没发现哈,啊,是我没发现。然后呢说一下这个节点啊, 大家看啊,这个节点抻出来之后啊,就是在工作流当中,这个主节点抻出来之后有几个参数,第一个是增数啊,不多说了。第二个是持续的秒数啊,不多说了,然后再往下是帧率啊,帧率,然后宽和高。还有一个是这个啊,各位, 这个呢,你可以把它理解为就是这个图片的尺寸啊,就是重置一下图片的尺寸,比如说我们宽是一幺二八零,然后高是七三六,然后我们上传的图片如果大于或者小于这个尺寸的时候,我们需要重置一下尺寸,那么这里边有几个选项,是吧?我们选择这个,好吧,呃,限行缩放, 呃,就是拉伸哈,就是拉伸,然后呢大家往下看哈,这有一个 custom audio 哈,目前是 off 关闭的状态,如果大家把这个打开了哈,那么我们可以在下边儿上传我们自定义的音频, 好吧,然后效果一会儿再说哈,我先把它关闭,然后这里有一个设置哈 settings, 我 们打开它之后,可以在这个位置选择帧数或者秒数,如果选择秒, 大家看这个时间轴当中的选择的时间标记是秒哈啊,我默认就让他显示真数了,然后下边这个参数啊,这个参数啊,咋说呢,他目前是最小值。我设置的表示的是转场之间用硬切的方式, 好吧,就是直接切过去,如果大家想试啊,尝试这种软转场啊,也就是我们平常说的这个稍微丝滑一点的过渡,可以把它调高啊,可以把它调高,这里边有一个 按钮,点击一下,可以让它在我们的面板当中显示啊,就是这个鼠标放上去之后,大家可以看到哈,如果想设置这种丝滑的专场啊,稍微丝滑,各位大家可以把它设置为零点五或者以上,好吧,然后呢,还有啊, 这个参数呢,指的是将图片设置为啊被多少整除,那么 l t s 默认是三十二哈,然后下边是图像压缩,这个就不多说了,还有下边是 use global promote 是 吧,设置的啊,使用局的 提示词,如果大家点上之后,在上面有一个大局的提示词,可以对你整段的视频做一个描述好吗?大家一起就这几个参数啊,其实不难理解,对吧?然后呢, 大家看啊,我这里有几个使用的样例啊,就是我跑完之后的结果,大家看第一个啊,第一个呢?我在这里将这个 custom audio 是 吧自定义音频打开了,然后我只上传了一段视频,大家看好,我让这个女主角接着说,下面请男主角登场,然后我再上传一个图片 啊,图片里边写,男人说,啊,这个快开播了,很高兴,女人说,我也是,最后女人做一个鬼脸,大家能看到了吧?这个怎么添加?很简单啊,就是比如说我在上面可以点击添加 image 啊,比如说上传一个,它就过了一张图片,然后我们可以拉伸啊,这个,这段视频延长的啊,这个帧率或者秒数,对吧?我们也可以上传 啊,不是上传直接添加一段提示词描述啊,所以呢,大家看啊,呃,我上传的图片也可以点一下子在图片下方写我提示词的描述,这就有点类似于图上视频啊,当然是这一小段了,那么大家看啊,我既可以上传图片,又可以单独的去写文字,而且可以设置这个时长,我就可以,干嘛呀, 设置首尾针呢,对吧?如果我前面这个图片没有直接写一个描述,我再添加一个图片,那不就是尾针吗?对吧?各位,所以呢,他可以很灵活的让我们控制这个短视频,好吧,精细化的控制 这一点啊,各位还是挺牛的啊,这个功能确实挺牛的,能够精细化的控制这个视频的生成以及视频的内容走向,对吧?但是弊端也在这哈,就是比较耗时, 各位,比较耗时,你要说,呃,做一个四十五秒或者一分钟的短视频,可以用这个节点啊,确实能够精准控制,但是需要抽卡,各位目前的开源领域啊,这个,尤其是这个 lts 二点三,抽卡的概率其实并不低啊,其实并不低,好吧,各位有的时候需要抽卡啊, 然后呢,大家看啊,玩法很多,然后大家看这个样例,我首先上传了一段自定义音频,将这个 custom od 打开之后,大家看结果啊, 现在是旁白推文解说,大家有没有发现没有声了,就是你打开这个 custom audio 之后,是吧,我们需要为这个视频自定义上传啊,就是上传我们自定义的声音,它就不会再给我们生成系统声音了。好吧,各位,现在是,然后呢,大家也看到了哈, 这个参数我设置的是什么呢?大家看好这个参数,我设置的是这个硬转场,但是呢,我加了一个 lora, 这个 lora 是 谁呢?就是这个 transition 啊,转场 logo, 好 吧,大家注意下什么呢?就是我们这个转场 logo 加上之后,有可能啊,注意不一定是一定啊,是有可能破坏我们那个转场的设置参数,比如说是让他硬转,还让他软转。好吧,各位,他有可能破破坏这个参数啊,还有一种可能就是这个,各位 多发于哈,多发于我们上传自定义声音的时候,因为我们上传自定义声音就要通过提示词去告诉系统啊,去告诉模型,是吧,谁在什么时候说话?那么大家看好, 我这里边上传一个自定义声音,让女孩说,对吧,我播放一下,现在是旁白推文解说,然后我后边说这个女孩接着说,下面请男主角登场,然后接下来是两个图,那么大家就有可能出现这个系统识别不了这句话,后边到底谁该出场,谁应该退场, 好吧,如果提示词描述准确一些还好,但是描述不准确就很危险了,大家看这个是吧,正常旁白推文解说, 你看各位,正常是应该呃,女主接着说是吧,但是呢,他识别他没识别出来是吧,就造成了这个。现在是旁白推文解说,好吧,各位,然后呢,大家看右边这个,这个是去掉 cecil lala 之后,然后这个转场强度啊,大家看啊,转场强度稍微最低,他就有一个硬切的效果, 现在是旁白推文解说啊,硬切哈,各位,但是后边没声音了,因为我把这个 custom od 打开了哈, 好吧,如果打开这个 custom audio, 就 必须下边上传我们自定义的声音哈,然后呢,这里边有一个点是什么呢?各位,如果大家上传到自定义的语音,也不想这个语音进系统进行采样,因为采样可能会破坏啊,这个语音大家可以来到这里啊,就是视频输出的时候按采这个位置,视频音频输出的时候按住 shift, 然后将这个点 移到上边来,这样呢,他就会用我们自定义的声音去合成最后的视频啊,大家注意下这个事,然后再往下看啊。下边一个案例,这个案例呢, 首先看参数哈,把自定义的 custom audio 关掉,然后,呃,女孩先说,大家好,我是谁谁谁?然后他接着说,下面请男主角登场,然后呢,一张图片,男主角说快开播了,女孩很高兴啊啊,提着时代能看到是吧?然后呢,呃,转场的这一块设置为最低好吗?大家看效果哈, 大家好,我是莹月月,下面请男主角登场,快开播了,我也是,哈哈哈,总要我清湾。大家好, 大家看,还行吧,是吧?就这几个切场。然后呢,大家往下看啊,下边一个是什么呢?我把这个转场的强度调高啊,我设置为零点八。然后呢,大家看啊,图片的相似度,大家看,这几个图片的相似度其实不高,对吧?然后大家看结果。 大家好,我是莹月,下面请男主角登场,大家可能也发现了,是吧,就是我把这个转场的这个值强度调高之后,它也是硬切,因为什么呢?大家看哈,就是就算你把这个值强度调高,但是你图片的相似度比较低的时候,它也很难做到丝滑的转场。好吧,大家知道这么个事哈, 然后再往下看啊,就是把这个转场的参数调高,加上这个 transition lora 之后,把上边这个 lora 打开啊,大家看啊,就这个位置,把它打开之后我们再开。 大家好,下面请男主角登场,快开播了,我很兴奋,我也是女闺, 大家可以看到啊,就是这个转场已经有了一个过渡了,对吧?卡了。第一幅图和第二幅图,确实这个相似度不高啊,所以它有一个类似于弱化的一个效果,一个转场,一个叠化转场,然后,呃,第三个图和第四个图相似度比较高,所以大家看这个转场相对来说丝滑一些,对吧? 这个是将转场的参数调高,加上 transcendent 之后哈,然后下边这个是将转场的参数调低,然后把 custom 这个 odo 关掉之后的效果,大家看 好,我是莹月,下面请男主角登场蛮轰,好,快开播了,我很兴奋,爷爷说,大家看啊,就是加上船身上捞捞之后,但是我把这个转场参数调低之后,它大概率也是一个硬切,所以它们几个是有一点点关联哈,各位,有关联的,然后 最后再往下看啊,就是我把这个自定义的这个 sigma 由原来的它,原来的这个 sigma 值啊,大家看啊, 这个是它官流里边带的 sigma 值啊,好吗?各位,它的降噪啊,是这个零点四二哈,用这个大家可以看到之前几个视频的降噪强度都是零点四二好吗?它的说话哈,各位,它的说话和配音以及画面的饱和度偏稍微低一点啊,然后加上这个, 呃,用我们这个原来 lts 二点三的这个零点八五的这个 sigma 之后,大家看这个值,大家看这个效果哈, 好,我是莹月,下面请男主角登场, bye bye 快 开播了,我很兴奋,我也是, 大家,大家能发现是吧?这个画面饱和度稍微高一点是吧?然后这个音乐和配音啊,稍微能强一点是吧?啊,因为我做的只是这些文系列的视频啊,大幅度动作的时候,这个我没测啊,因为什么呢?这个大幅度动作目前来看啊,目前来看,就是这个 之前出那期视频啊,叫做这个十 s nose 啊,这个工作流好吧,它的大幅度动作效果是最好的,然后呢,其实我也尝试了将这个十 s nose 是 吧,这个工作流和这个导演流进行结合,但是可能 因为是两个流,两个方向是吧,它的结合度并不高啊,造成的结果是吧?其实很不理想啊,就是最后就没做,但是最近也在研究啊, 然后呢,最后说一点是什么呢?这个导演流哈,它比较适合于就是比如说一分钟以内的这种短视频创作,是吧?因为它能精细化管理,就是时间比较充足的情况下可以用这个。但是如果大家做的是 l t s 二点三那种文系的漫剧推广啊,就是文系类漫剧哈, 动不动就一个多点,或者是那个几十级的这种,我其实个人不太建议用这个,因为这个节点虽然可以精细化控制,但是和效率两个字关系不是特别大,因为你一上传图片经条都是时间问题啊,他反而会拖慢你的进度。 各位,这个大家可以看情况选择一下,其实我目前最喜欢的流还是这个这个四 s note 这个流。然后呢,这个地方我最后强调一下,这个四 s note, 因为这个工作流啊,它二阶段加了一个补帧的模型啊,所以相当于你的帧数乘以二啊,二百多帧,到这个二阶段直接变到四百多帧啊,所以它很吃系统的 资源。各位,所以呢,各位大家看情况啊,这个补帧的这个模型要不要假?

大伙好啊,呃,最近呢,出了一个新的图片模型哈,叫做不孤,它有图片的生成以及图片的编辑哈,两个功能,那么分别也对应着两个模型,大家可以看一下哈。呃,用于图片的生成,它有这个不孤 image turbo, 然后用于编辑的这个模型,它有一个叫做不孤 image id 啊,两个功能对应两个模型哈。那么呢,话说回来哈,就是图片相关的模型更新的也比较频繁,是吧,但是呢,就我个人而言哈, 现在硬盘里边保存的还是 zemis turbo 以及哈这个千位 image 二五幺幺,当然哈,这个跟个人的使用场景有关哈,以及个人的升读习惯有关。那么这个模型到底怎么样哈,大家可以哈先上 线上平台啊,试验一下,如果满足自己的需求啊,可以把对应的工作流和网盘下载到本地,然后再跑起来哈。 先说一下哈,就是这个不孤它的图片编辑啊这个功能,那我对比的模型呢,就是我自己常用的啊,千问一 mate id 二五幺幺,那么这两个模型哈,如果用于单独的编辑, 各位可能也都知道是吧,就是编辑模型,对于单图编辑来说啊,效果都不错啊,那我主要应用图片编辑模型,做的事是生成小说推文里边的男女主角以及对应的场景啊,所以我经常用的这个图片编辑功能是哈 参考图片啊,就是上传多个参考图,然后用于生图,他不单纯是编辑啊,可以说是参考图生图。 好吧,那我们就单纯测试这个功能啊,因为单纯的图片编辑啊,就是单图编辑,比如说换个头发,换个衣服是吧,这个各大模型做的其实都不错啊啊,大家看一下啊, 我上传两张参考图片啊,一男一女,然后给定宽和高,生成图片的宽和高啊,然后呢,上边是这个不孤,然后用的是 image id, 下边用的是纤维 image 二五幺幺啊,这个 id, 然后呢,种子都是一样的,其实词也都是一样的哈,大家看一下效果,左边这个是不孤,右边这个是千问一妹子二五幺幺哈,可能亮度上不孤好一些哈,但是人物一次性啊,大家看一下是吧, 这是千问的,总体来说,我个人还是比较偏向于千问啊,这个是不孤的是吧,它的图好像能亮一些是吧,然后人物可能好看一些,但是呢, 但是从人物还原度上来说是吧,我还是喜欢千位 image 二五幺幺哈,然后呢,大家要知道这么一个事哈,就是现在哈,这个不孤 image id 这个模型现在没有对应的 turbo 版,所以要跑满哈,二十五到三十步左右 好吗?所以呢,这个时间浪费的还是挺长的啊,因为我们千问一妹子二五幺幺是老模型了,有对应的加速模型是吧,所以速度上千问是占优势的啊。这个是双图参考生图功能,单图编辑我就不涉事了啊,因为各大模型做的都不错,大家呢,根据自己的 这个使用场景吧,然后可以到网上试一下哈,觉得行,大家就下载到本地,然后第二个呢,我测试一下它的声图哈,那么对应的主角就是我们这个 j image turbo, 然后对比 用的模型呢?是这个不, google image turbo 好 吧,这两个都挺快的哈,总体来说哈,这个不 google image turbo 能比我们 j image turbo 哈,能稍微快一些哈。 然后呢,这有几组题词词生成的结果哈,那么左边这张图片呢,是不孤啊生成的哈,然后右边这个图片呢,是 jemus turbo 生成的,大家看一下效果哈,就是从人像的美学上看哈。我个人,呃,我个人哈,偏向于这个 jemus turbo, 然后呢,我们现场换题词哈,比如说我换一个第一组,然后运行一下这个第一组题词是吧,大家可以看一下是吧, 好,生成完了哈,各位看一下结果。那么左边这个是不孤生成的效果是吧?人比较真实啊,右边这个是 turbo 啊,这一 makes turbo 生成的效果就是感觉像艺术照一样啊。右边啊,左边的比较真实,右边的像艺术照哈。啊,我们再测一组哈, 第二个,第二个呢,呃,是一个类似于神话的这么一个 cg 图片哈,看一眼,其实此时在这里啊,现场跑一下运行呃,跑完了哈,各位看一下 呃,左边这个是不孤啊,右边这个是 jes turbo 哈,就是我从审美上看哈,就是我个人还是喜欢 jes 多一点点哈。 呃,当然了,这个图片生成和图片编辑哈,就是没有绝对的好与坏,只有对应的使用场景和对应的需求哈,大家看一下是吧,有对应的需求和使用场景啊,就可以切一下这个模型 啊,当然啊,我个人建议大家还是先在线上试一下哈,觉得符合自己再下载,因为这一套模型,这个不孤哈,一套模型下载下来也几十个 g 呢哈。呃,最后再来一组啊,点击运行看一下这个提示词啊, 好,生成完了大家看一下结果哈。呃,左边是不姑,右边是 z e miss turbo 哈。

大家好,今天呢,我给大家做一个教程,就是如何在我们电脑上部署本地的 ai 工具,来进行一个后期修图。其实现在网上有很多这样的教程和这样的工具, 他们都是类似于 ps 插件或者网页版,但他们无一例外的一个问题就是他们是云端部署的,你得去买积分,然后产生使用他们的 ai 功能。 然后现在的博主呢,他们做教程基本都是这种需要购买积分的云端算力的一个工具,他们这工具其实也挺好用的,但有个问题,就比如说我电脑性能很好啊,我是四零九零,我是五零九零,五零七零啊,但是你还是要我去云端买个积分啊,我是觉得不是很划算的, 但是无一例外啊,大部分博主都在推这种云端算力的,因为啊,你用他们的邀请码去购买这软件,他们都能获得百分比的提成。 但是呢,我像我这种电脑现在还可以,又不想花这个钱啊,或者说我想我能接受,多等一会啊,慢慢生成几张图的情况下,那我就门就可以使用本地部署啊, 来达到一个低成本使用 ai 工具修图的一个效果。也是感谢夏安琪老师啊,也感谢这个冰红茶老师啊,他的分享,冰红茶老师分享的是如何用这个 ai 工具画头发,那么我今天呢,告诉大家如何用这个 ai 工具来修复这些道具啊,那我来举例一下。 首先张图哈,我们来分析一下他有几个问题。第一个是面容问题,他这边鼻子阴影画太深了,而且这鼻贴 比较明显,鼻贴我们可以用传统工具慢慢这种液化,这种修修复画笔慢慢去除都可以,但我们用 a 工具能处理的更自然更快速啊。这第一点还有一点呢,就是这个一个道具啊,它这个项链带歪掉的, 项链带歪掉的话,那我们就给它调整一下。调整一下怎么调呢啊?我们传统方法先演示一下,先给它挖出一个图层来。 好,我们先使用这个快速选择工具,给它选择一下这道具,我们多余的部分慢慢用这个按住 i r t 键,给它变成减号,给它减掉去,先加后减, 我们不用搞太细啊,反正这东西也不是很明显,你要搞细的话,可以先慢慢搞一下啊,然后我们按住 ctrl 加键 复制一个图层,我看右下角,然后把这背景关掉,你会看到有个单独的下面图层出来了啊,好,那么第一点,然后我们把这个图层也关掉,就没了,然后把背景拿出来,我们先把背景这个去掉啊,我们使用 ps 功能,有一个移除工具,选择背景啊,先选择背景啊, 让它作用在背景上,我们把它扩大啊。移除工具把这整个选上,包括红线部分, 这边也是,再来一遍,这个红线到头发这边, 这边也插除一下, 这边衣服这边按部。好,我们缩小之后其实看着还是很自然的啊,但是没有限量也不行,那么我们怎么办呢?我们再选择右上角这个图层。好,然后 选择移动工具,移动到这边来,是不是在正中间了?那我们这个线怎么办呢啊?线我们给它画一下,选择画笔工具调小一点。 好,我们按 a r t 键吸射这边画一下哦,太粗了,透明度改高一点。 嗯,有点粗,平滑度要低一点。可以可以,这种感觉, 我们从这边啊吸个色,给它画出来,画到暗部这边再来吸个色。其实画的很粗糙也不要紧啊,重点就是我要向你们演示一下,我粗糙的话也能通过 a 工具来修复一下,随便画两道线是不很丑啊 啊,我们再吸点色,给他增加点阴影啊,真的点点点点点,我知道大家肯定有人要说我的画工很烂啊,但是这不是重点啊,这不是重点,重点是你要让 ai 知道这么是一个红绳啊就行了。好,然后我们再选择移除工具, 调小一点,把原来这部分红线给去掉,因为他们任务已经完成了,他们已经吸完色了。 好,远远看过去也明显还行,但是我们追求完美,肯定不能这样子交叉嘛。好,我们两个东西选择 ctrl 加 e 盖映图层。好,那么接下来我们先这边启动一个绘画工具, ai 绘画工具绘事启动器。 这东西怎么安装呢?我们下下期呢会详细的讲一下,我们先点开来一键启动。首先我说一下哈,这个软件的话最好不要用 a 卡,之前我就是用 a 卡的,只能说对 a 卡优化不是很好,最好还是有张 n 卡来使用, 而且最好是四零六零以上的配置。其实四零六零跑的还可以的。好,运行完之后哈,我们在 ps 里打开这插件,你们可以照着我这个设置采用方法, 自由算力选择自由算力 刷新一下参数选项。 好,现在识别到了对接上人。一般来说,我们先启动这个插件,然后再启动这个 ps 上的小插件。好,我们现在开始 选择用选择工具啊,矩形选框工具,把这个项链部分圈上,当然我们也可以在这个正向这边输入提示词哈,但其实我觉得不输也行。 ai 没那么傻啊,他会识别到做什么呢?重绘,因为是道具嘛,我们重绘幅度可以大点,我们调到零点三五 点一个自动运行。我是选择生成两张图啊,我觉得抽两张卡出金概就已经很大了啊,生成非常快。这边右下角两张图啊, 是不是红绳就很自然?我们先不管道具怎么样啊,然后选择,我觉得这第一张图可以啊,我们就 ctrl 加 s, 它就给它盖印过去,是不是就覆盖上去了?但是我们肯定不能这样子用嘛,然后我们选择画笔工具, 流量要调低一点,五十左右吧,五六十吧,不透明度也五六十吧,把边缘先给它擦一下啊。我们只搞这个红绳,其他地方还是要原汁原味, 特别是中间这一块啊,差距有点大了啊。但是我们就这个部分,红绳部分,红绳的部分我们不动 给它插出来,哎,头发这边好,我们现在一看是不是绳子就非常自然了。 ai 工具帮我们重新绘一张, 这道具部分就修复完成了,我们再 ctrl 加一盖一张图层。好,那我们再看看这个鼻贴啊,鼻贴这玩意你可以用传统方法去去除啊,但我现在更喜欢用 vi 工具去去除它,直接给你重绘一个鼻子,又自然又好看,而且呢,这个修图痕迹没那么明显。 那么也是啊,选择一个矩形选框工具,我们直接把它选散,整个人脸选散。我因为是人脸部分啊,我不希望它重绘服务太多,我希望 cos 保持它原有一个样貌,那么就零点二五 点个正方形。好,我们选一张 b 型跟 cos 相近的。 我觉得这按鼻子更细啊,我只需要它鼻子部分,也是 ctrl 加 s 给它盖映过来,依旧按 b, 把边缘擦拭一下,让过渡自然一点。 擦擦擦。好,我们人脸部分要细致一点了,因为 ai 修图之后啊,它有一点塑料感,像眼睛部分,我觉得抠出来就很好看,原来就很好看,擦出来, 嘴巴部分很好看,查出来,脸也是原来更小一点。查出来,然后我们这个流量调低一点,慢慢调整,鼻子这边慢慢过渡,慢慢过渡啊, 哎,糟差有点多啊。把这个底下擦出来了,那我们就按 x 啊,把它这个翻转一下,又可以给它蒙版擦回来一点。好,按 x 又切换回去,又是让它擦原图擦出来, 反正善于利用蒙版工具啊, 那我们先来看看啊,原图和 ai 修复过之后图怎么样?但它这个假发有点塑料感啊,因为这 ai 模型是免费的模型,我们头发给它真实头发擦出来, 再看一下,对比一下。哦,塑料感擦一下, 我觉得假发原来头发更自然一点好,不管怎么样哈,其他部分先不管,照鼻子这一块,它鼻贴是去除掉的,而且呢阴影呢,和高光过度,非常自然, ctrl 加一再盖一张。好,同理,我们看这张左边这位 cos 啊,这个紫头发的 cos, 他 鼻子上高光和阴影也是比较突出的,也用这个方法选择一下,选择整张脸 自动隐形一下,好抽卡。选择一张鼻形和相近的,我觉得这张跟镜相近一点啊,第一张 ctrl 加 s 再感应过来,既然大家知道了,该怎么操作啊?选择 b 画笔工具 边缘先给它擦一下,让它过渡自然一点啊,擦边缘时候流量流量壳比分辨率可以高一点啊, 好到脸这部分,我们流量给它调低一点,不透明度调低一点,慢慢处理,调小一点,眼睛给它擦出来。 而且 ai 修图有个很奇怪地方啊,它就是脸颊这边,它竟然给你泛红,腮红特别严重,给它擦掉嘴巴呢。也是啊,口红和反光特别严重,也可能这个模型本身的一个问题啊,没那么真实, 我们今天多擦一点,有神一点。 我们还发现哈,这头发刘海这边, ai 会给它多加一点, ai 本身会优化些,这头发这些和发丝这种地方 擦一点阴影出来。 好,那我们现在看看前后对比,是不是非常自然。你的 ctrl 加 e 已经交差了啊, 这工具它不只能够修复道具啊,还有画头发什么修复啊,面部的五官这种道具啊,如果是损坏的,他也可以给你修复一下。你就像我一样随便画两笔啊,比如说我这边 画笔工具啊, 给它画几个上来,你不要看我画,很抽象啊, ai 会帮我们填补那一部分。 好,我们下期从零开始,教大家怎么在自己的电脑上安装 ai 工具,部署 ai 模型都是本地的啊。

大伙好啊啊,这个批量管理软件四点二已经发布到网盘当中了哈啊,链接地址没变,大家通过之前的链接哈,再次访问一下,就能找到这个 v 四点二版本哈。啊,还是好祝大家节日愉快啊,明天过节了哈, 那么说一下哈,四点二呢,更新了一些小功能哈,各位,就是包括一些小功能的优化,这个就不一一说了,大家使用的时候能感觉到哈, 那么主要的更新就是哈,包括图片生成,包括视频生成,包括音频生成哈,都加了一个什么呢?大家看哈, 就是从哪里开始批量生成,这里边举个例子哈,比如说我这个是单图啊,这个图片放大的,大家看我这个 a p i 切的是 c 的 vr 二是吧,做图片放大,那么假设我这一批哈五十张图片,那么从第二个,呃,比如说从第十个位置哈,这个我断开了, 呃,各种各样的原因吧,我断开了,那么下一批次我想从第十张图片接着往下生成怎么办?我们可以找到这个起始编号写到十,那我举例子哈,我就写从第二个位置开始生成了, 好吧,然后呢,选择好从哪里开始生成之后点击批量生成,这样呢,我们就会从第二个位置开始往后接着生成啊,呃,原因呢?之前和大家说了是吧,就是这个 ltx 二点三哈。呃,这个比较赞,这个 虚拟内存对吧?那么多次生成之后有可能会崩这个 comui 哈,那如果用这个批量软件啊,多次生成的时候是吧,如果 comui 崩了,我们可以接着生成啊,就是这个意思哈,大家看,正常已经生成了啊,放大 好吧,从第二个位置开始生成了啊,那我就不一一举例子了哈。呃,所有的都已经加完了,包括文生图,单图生图,大家看好都有哈,然后双图, 三图,混合生图以及视频生成,文生视频图生视频啊,首尾帧,呃,视频参考啊,数字人以及音频生成是吧?这个都加了哈。呃,那么说一点哈, 呃,大家呢,如果是第一次使用这个软件,希望大家看一下这个使用说明啊,那如果是啊,之前就用过啊 啊,比如说用过这个 v 四点一啊,用过四点一版本啊,大家可以下载完这个四点二之后单独的将里边这个 v 四点二啊这个文件复制到四点一里边去,但是哈这里边有一个,但是一定要把之前的 v 四点一版本删除, 因为他同时只能读取一个加文件哈,就是如果我们把四点二考过来之后,四点一一定要删除,然后呢第二个更新的功能就是声音这一块哈,各位声音这一块啊,我们现在可以上传三个参考音,是吧?从头开始一二三,然后呢进行生成,主要的更新就是这两个,一个是 啊,一个是批量生成的七字编号,另外一个是声音生成的时候,是吧,可以上传三个长口音,然后如果是老用户啊,各位,大家把这个四点二考过来之后,将四点一啊这个加文件删除,删除完之后大家启动完之后一定要强制刷新一下这个页面, 好吧,不然这个有页面缓存哈。这个七字编号出不来,那大家也能看到是吧?我这个七字编号出来了,但是呢,他这个默认为什么不是零或者是一呢?各位啊, 因为我们之前四点一版本有这个页面缓存啊,各位有这个页面缓存,所以呢,当前这个页面存在缓存的时候,这个起始编号他不好使啊,所以我们干一件事吧,新建一个任务,大家看,新建完任务之后,起始编号正常可以使用了,所以大家知道这么个事哈,第一个强制更新一下浏览器,第二个 点一下新建任务,这个将这个页面缓存清除之后哈,这个我们就能用了啊。再有一个是什么呢?就是有一些小伙伴啊,是第一次使用的小伙伴 啊,他启动一号文件的时候闪屏,然后启动不了。我先说一下啊,一号文件是启动我们整个项目的数据库啊,我们这个数据库用的是 my circle 五点七啊,五点七这个版本啊,占用的端口是三三零六端口啊,三三零六端口, 那么他闪一下屏就退出哈。这个一号文件主要的原因有两个,一个是大家可能之前啊安装过这个 my circle 三三零六端口被占用了, 说白了就是它的启动端口被占用了啊,大家可以检查一下。另一个原因就是啊,就是我们有一些啊,当然是极少数的小伙伴,这个 windows 电脑可能会缺少一些文件啊,系统文件, 当你双击这个呃,一号文件的时候,它会有一个红框啊,这个红框里边大家记一下,它会告诉你我们的 windows 系统缺少了哪些系统文件,一般都是一个啊,大家呢,百度一下这个文件的名字,在网上下载一个对应的文件,然后放到对应的位置啊,这个软件就正常可以用了。

大伙好啊,呃,做这个 l t x 二点三的工作流有一段时间了哈,那么今天算是交一个中期作业哈,呃,这几个流呢?包括这个 i to v, 包括 t to v, 包括首尾针哈,这个是我日常常用的工作流 呃,不敢说有多好哈,至少我感觉它是能用来干活的一个工作流。好吧,各位呃,先看一下效果哈,现在是旁白推文解说, oh, and i'm speaker one and i'm speaker two。 大伙看哈,就这第一个视频是吧,他有旁白,有男女主的对话,而且画面大家能看出来十分流畅,不卡顿对吧,因为这个视频是五十帧的哈,这个视频是五十帧的,然后大家再往下看是吧,这个是数字人的, 大家能看出来是吧,没有任何卡顿,而且人物的一次性也还行,是吧,各位啊,现在呢,说一下这几个流哈。首先说一下哈,效果最好的,也就说人物一次性最强的,而且效果最好的流就是我之前发的那个十 s note, 那 个哈,应该是这个,大家看一下哈 啊,在这呢,就这个十 s compe note 之前我发过这个流啊,这个效果应该是最好的,而且人物一次性也是最好,大家看一下是吧。 凡人要开播了,好高兴啊,是啊,好想念大家,我们不见不散,大家看好。呃,这个流怎么说呢, 是我用过啊,就是目前为止在这个模型不变的情况下就用的这个一点一模型不变的情况下,没用其他模型啊,效果最好的,大家看,好想这个是原图是吧,人物的一次性以及说话的内容应该是最好的,但是呢, 我也说一下弊端啊,这个流比较吃资源,而且比较慢哈,各位,第一吃资源,第二比较慢, 所以呢啊,大家如果这个配置够用的情况下,也有一定的时间啊,大家可以用这个流啊,这个流我之前发过。好吧,各位,然后呢,再看一下啊,就是我根据啊,就是目前我现有的需求做了一些改版,比如说大家看啊,这个是 i two v 的 工作流,这里边做了一些小改动啊,第一个哈,大家看这个位置 是吧?提示词这里用的是这个 prompt relay in code 啊,用的是这个节点,然后呢,它提示词里边如果需要做不同的动作,可以一组一组的写,然后加一个竖线进行分割。那么为什么没用那个 smart 以及那个可以自由设定的那个。 呃, prompt relay 啊,这个节点大家看啊,它有好几个节点,我给大家看一下,一个是这个 smart, 还有一个是 这个太不赖,是吧?时间节点,这有点像导演台了是吧,就是为什么没用他俩啊,呃,我再说结论啊,各位,就是为什么没用他俩,因为我这个流儿,各位后期是要做这个批量的,可以说推文生成的哈,那么批量推文生成,各位就要求我们追求一定的效果以及效率哈, 效果是一方面,另外呢,这个速度和方便程度也要考虑进去啊。呃,导演节点,大家注意啊,导演节点和这个 prompt relay code 这两个节点肯定是出效果最好的,因为它可以精细化控制。 但是各位啊,这个东西一旦进行批量操作的时候,我不知道大家谁用过啊,说批量操作时候会让你很头疼的,因为你得翻来覆去的这么细致的去改 啊,一个推文视频可能要改好久,所以最后用的是这种最简单的操作,最灵活的这种方式啊。这第一个用的是最基础的这个 prompt relay in code 这个节点,然后提着词,这里边大家看啊,就是啊,多个镜头或者是多个动作拆分的时候用竖线去分割,好吧,这是第一处改动啊,第二处改动在这里啊,各位, 二踩的时候大家注意啊,二踩的时候我用的是这个十 s nose 啊,用的是这个节点,好吧,这个节点之前已经说过了哈,然后因为它有一个什么特性呢?大家注意看啊,这里边有一个 odepas, 这个之前已经说过了哈,然后它的这个 降噪的时候,大家注意,这个降噪参数不能变啊,别变成零点八五,就用它原来提供的这个。然后呢,大家注意看啊,前边这个位置模型放大是二阶的放大,一个是这个 啊,这个图像的放大,另外一个是空间补针,也就是原来二十多针八包之后变成四十八针啊,二十四针变四十八针,二十五针变五十针好吗?各位,这个 它的作用之前做过很多期了啊,就是从优化的角度,这个空间放大的模型效果是最好的,应该是没有之一,所以啊,就是我尽可能保留这个空间放大啊,这个节点,然后呢?二彩的时候用的是它, 好吧,这个节点之前也说过哈,然后呢,大家看现在的这个视频,各位,现在的这个视频就是五十帧的视频,二彩之后大家看好放一下, 凡人要开播了,好高兴啊,是啊,好想念大家,我们不见不散, 大家能看着是吧,呃,第一嘴型能对上,第二是吧,这个帧率也够,画面没有那种啊,就是卡顿的感觉,大家能感觉是吧, 所以呢,我觉得这个目前为止是我可用的啊,就是能做推文可用的一个状态,好吧,当然呢,这个是用这个系统生成啊,系统生成的声音啊,大家看一下提示词,我是让它系统生成的声音,但是各位啊,如果大家做推文,你肯定不能用系统生成的这个声音,因为 这个不敢保证是吧,每一段的视频音色是一样的,所以我们在做短文啊,这个啊,慢剧推广的时候啊,或者是这个小说推文的时候,用的一定是我们通过这个 t t s 生成好的声音,是吧,所以呢, i to v 第二个工作流是吧,大家看这个啊,大家可以在这里上传我们这个声音, 好吧,然后在这里进行裁切,好吧,这个大家一看就懂了,可以上传一段或者两段声音,好吧,然后在这里进行拼接,然后在这里输入整个声音的时长,那么整个时长是在这里控制的,这是十秒 是吧,那么十秒呢,就会在这里整个拼接好的声音裁切出来,十秒啊,就是这个意思啊,然后呢,其他的没变好吗?各位,其他的没变啊,还是 用的这个节点,然后二彩的时候用的是这个节点,好吧,各位,大家直接看效果,这几个效果给大家展示过了啊,大家先看这数字人是吧,我感我个人感觉这个数字人已经很好了啊, 我,我个人感觉这个数字人效果已经非常不错了,就是可以用的程度啊,然后呢,大家做好视频之后,再用这个 tobacco 这个 video ai 是 吧,进行统一的放大或补帧,因为这个补帧已经是五十帧了啊啊,补不补都行,可以补到六十帧,但是呢,在进行放大到四 k 之后的效果应该是非常不错的哈,这里边有一个什么问题呢?大家注意看啊,这里边有一个国风 lora 哈啊, lora 加载的时候用的是这个 omi 啊,这个 n f t, 这个哈,这个 loa 之前也说过了,但是呢,这里面有一个国风 loa, 大家看啊,这个 loa 啊,看情况吧,我这里面有的加了,有个没加,那么加和不加主要区别在于哪呢?大家看啊,这个还不太明显,我给大家找个明显的哈, 这个国风 loa 加上之后,大家看,右边这个就是加上国风 loa 的。 呃,怎么说呢,他的人物,左边这是没加的哈, 他的人物呢?呃,色彩有点偏重,各位,色彩有点偏重哈,如果大家上传的是二次元的这种图片,或者是二点五 d 的 那种图片,他的腮红会特别的重。 好吧,各位,而且整个画画面的色彩也偏重啊,所以呢,这个国风 logo 大家看情况加不加,但是这个是没加的很明显啊,咱先不说画面重不重的情况下,可能加了会好一些。好吧,各位,这个国风 logo 大家看需求哈,然后呢,我再找一个哈, 大家看,这个也行啊。呃,这个是有国风 lora 的 啊,我给它放出来啊, 那么这个是没有国风 lora, 左边没有,右边有,大家能看出来是吧?右边的色彩明显比左边重 好吧,各位,因为这个图片本身有点偏真人风啊,这个重一点可能看不太出来啊,但是如果是二点五 d 或者三 d 那 种情况下,他慢慢哈,各位会往真人方向偏,而且这个腮红啊和这个色彩会非常的重啊,所以这个国风罗拉啊,呃,这个看情况吧各位,就是看各位喜好啊,然后这里边有一个什么呢?就是加速 好吧,设置了他神加速啊,还有这个这三个节点,大家看啊,就是如果你电脑配了这个设置了他神加速,你可以开开,如果没配就别开了啊,就给它关掉就行了,大家注意看我这里边演示,我就没开,因为有的小伙伴有,有的小伙伴没有,我就都关了哈, 大家看一下好吧,呃,这个是 i to v, 然后还有 t to v 的 啊 t to v 这里边啊各位,呃,用的东西也都差不多,首先 loala 这里哈加的是这个 omft, 这个 loala, 然后呢?国方 loala 还是看情况啊,然后二彩这里一样哈,各位,二彩这里一样用的是这个节点 好吧,然后呢?双放大哈,一个是呃像素放大,还有一个是这个时间维度上的放大,就是不真哈,都有,然后这个是用它系统的这个声音啊,这个 t to v 工作流,还有就是 用我们自己生成好的声音,然后做了这么一个 t 2 v 的 啊,好吗?各位大家看一下是吧,这个之前对比过了,然后还有一个是什么呢?就这个首尾帧, 好吧,各位啊,为什么没说多帧哈,就是多帧生成这一块,各位,大家直接就可以用导演节点做了哈,就是如果大家已经决定用多帧生成视频了,那么就不如一步到位,用那个导演节点精细化控制好。 好吧,各位啊,这个导演节点之前也说过,而且好多博主也都说过了,效果不错。那么有一个什么毛病呢?就是导演节点目前和这个十 s note 融合的不是特别好啊,所以呢,就是没有补帧放大的这个过程。好吧,大家知道这么一个事哈,多帧呢,大家就用导演节点,然后呢,这个流大家看哈, 呃,用的是这个 transition lola, 好 吧,国风,看情况。呃,这里边说一个什么事呢,各位,这个 transition lola 啊,各位,因为它本身就是首尾针嘛,就是要做过渡转场,所以呢,这个 transition lola 我 给它加上了,加上之后大家看好, 这个是没有国风 lola 之后啊,各位,这个人物会变得有一点点啊,还是啊,就是色彩会变得很重,而且人物一次性会稍微弱化啊,所以呢,这个国风 lola 呢,我就去掉了。 然后呢,这个首尾针的工作流,各位,因为他一般情况下都是做动态或者做转场,所以呢,这里边没做这个自定义声音啊,这个工作流啊,因为大家想做也可以做啊,但是我个人感觉,因为我用不到啊,这种场景。首先呢,先说一下手尾针这种工作流,你再让他在里边说话, 他的效果就会打折扣啊,各位,就是有可能是转场过去人没说话,有可能是说话了,但是没转场好吧,呃,这个我感觉还是模型的基础能力有待提高啊,就是一旦多真生成的时候,你再让他按照你的要求说话,这个质量会大打折扣啊。所以呢, 一般的首尾真我们都用来做转场,那么转场的话就不多说了。好吧,各位啊,大大概是这几个流哈,如果大家想做多真,那么就一步到位,用那个导演工作流啊,这个之前已经说过了。

大伙好啊,呃,这个 cfui 官方啊,它支持了这个 scale 二和布尔尼尼的工作流啊,大家想用的情况下呢,可以将 cfui 啊开发版的这个内核更新到最新。好吧,一定是开发版啊,更新完之后呢,就可以在模板当中找到 scale 二和布尔尼尼官方提供的工作流了。 先说一下哈,这个布尔尼尼官方提供的这个工作流,因为涉及的功能比较多,而且切换功能的时候呢,有的时候需要对工作流进行一下修改,所以呢,这两天会陆续的出对应功能的啊,布尔尼尼啊这个官方的流。今天先说一下这个 skill 二哈。 呃,先说一下结论,官方出的这个 skill 二的工作流效果要比我们之前那个强啊,而且我感觉强不少,那么怎么回事呢?大家把这个工作流点出来之后,效果是这样的,总体来看是挺清爽的, 各位,因为他用的这个紫图效果不错啊啊,我不建议大家把这个紫图打开了,因为这个效果就已经很不错了啊。然后呢,大家看啊,在这里加载参考视频,然后在这里加载参考图片,好吧, 然后呢,加载的这个参考图片之后啊,这里边设置一下需要用到的模型,比如说第一个 sky 了,然后是加速模型,这里边他多了一个 logo 啊,这个 logo 叫 dpo 这么一个 logo, 它的作用呢?简单的说,能够对我们生成视频 做这个修正以及啊提啊以及增强啊各位,就是修正和增强,因为呢,大家看啊,现在我的视频的宽和高是五幺二乘八九六啊,大家注意什么呢?因为我这个参考视频比较特殊啊,是个全身的,然后呢,细节比较多,大家看啊, 大家看到了吧,就这根手指头,正常情况下啊,不加这个 dpo 啦啊,不加这个 dpo 啦,它的,而且在这个五幺二乘八九六的分辨率下啊,这根手指头是出不来的。好吧,各位,如果想把这根手指头显现出来,这个分辨率得提交到七二零乘幺二八零。 好吧,各位,所以呢,这个 dpo 啦啊,就是有增强和画面修正的,这个效果还是比较不错的,能让我们在比较低的分辨率的情况下,是吧,输出效果比较好的视频啊,就是这么个作用。 好吧,各位,然后呢,这里边有几个参数,大家看一下啊。第一个就是这个 sigma index, 就是 第几段啊,大家看啊,它跟我们之前的工作流差不多的,是一段一段生成视频,那么呢,大家看啊, 呃,第几段的时候在这里要标注一下,一会再说。为什么标注啊?如果我们想是把这个生成多段的情况下,大家看啊,我们复制出了一个子图,然后呢在这里写第三段啊,如果第四段写第四段,下边 replace model, 就 这个替换模式开启的时候是骨骼驱动下边宽和高 啊,然后是这一段要用到的帧数,下边是参考之前的视频的帧数啊,然后下边两个提示词呢,一个是视频啊,画取遮罩的时候的提示词,另一个是参考图画取遮罩的时候的提示词,他指出当中默认的最大数量应该是四哈,所以呢,大家可以看一下,是吧,进去之后他最大的数量是四, 好吧,然后呢,翻回头来哈,说一下这个 sigma index 它的作用是什么呢?我们之前的这个 scale 二哈,大家看,如果我想会制遮罩的时候,是把所有的视频帧数都加载到这个系统当中,然后批量的会制好遮罩,然后一段一段的生成, 对吧?这样做有一个好处是效率比较高,但是弊端是资源比较浪费啊,因为你毕竟把所有的视频资源全加载到内存当中了,对吧?那么这个使命 in dice, 它的作用是啥呢?各位,它可以哈只针对我当前这一段 好吗?各位,只针对我当前这一段哈,需要用到的视频帧数,将啊这些需要用到的帧数从原视频当中提取出来,然后单独的汇入遮罩,这样呢,它是一批一批汇入遮罩的, 好吧,各位就不是一起会知道了,所以呢,这个 segment index 大家注意啊,你第几段的时候要改,那么呢,这个此图怎么连呢?大家看啊,这个 post 编辑很简单啊,将我们原视频的这个直接连过来,好吧,下边还有一个 reference image 啊,是吧?参考图,我们直接连过来哈, 大家看,把参考图直接连过来,然后呢之前的这个视频呢,这个更简单了,是吧?把这个连过来,好吧,然后输出之后,直接连到这个批量图处理的时候,如果大家觉得这个画面,是吧,这个整体的画面有衰减的情况下,大家可以参考一下之前的工作流哈, 在画啊,在这个最后合成视频的时候,加一个颜色校正,好吧,可以加这个哈,好啊,这个呢,就是我们这个官流的这个搭建方式哈,挺简单也挺清爽的,大家注意一下,要改这个东西好吗?上边是我们这个 视频编辑或者是骨骼驱动的提示词,那么这里边强调一下啊,这个提示词对最终生成的视频画面会有一定的影响,但是影响不大哈,大家知道这么个事就行了 好吧,这个是官流的搭建方式哈,然后我们之前的这个 scale 二的工作流也做了一些修改哈,大家看在左侧这边是吧,加了个开关是吧,是人物替换还是动作迁移,然后下边这里边是那个绘图车道的时候的最大数量好吧,呃,然后呢,在这里也把这个 dpu 的 logo 是 吧,也加上了, 所以呢,这个是我们之前的工作流搭建方式做了一些修改哈啊,而且呢,效果跟官流差不太多哈啊,只不过在这里哈,在这里各位他是整啊,把整体的视频都迁移到内存当中做折照绘制的,这样做的效率会稍微高一点哈啊,但是呢,有点浪费资源,大家呢,看情况选择就行。这个是 style 二的 啊,这个官流效果是不错的哈。然后呢,呃,布尔尼尼的工作流呢,这个这两天会陆续更新,然后说一下什么呢?就是 我们这个批量管理软件哈,最近更新了一下是吧,这个更新了一些功能啊,首先说一下,就是他更新了批量处理的时候,大家看啊,批量生成的时候可以选择从哪里开始批量处理,那么这里面有个七个编号,如果大家选二,就是点击批量生成的时候,从第二条开始生成,那么为什么做这个功能呢? 呃,最近有小伙伴给我反映啊,大家看啊,就是我在用 lts 二点三啊,这个工作流生成视频,尤其是做短剧的时候,是吧?因为强调效果嘛和动态是吧?所以呢,在这个二阶段放大的时候,加了一个这个补帧的这个模型, 对吧?这个之前已经讲过很多次了,是吧?加了一个补帧的模型,那么呢,就相当于我生成十秒,原来二十四帧的视频变成十秒四十八帧的视频,对吧?这样呢, 大家看什么呢?就是他每一次生成啊,都会往这个虚拟内存里边注意看这个位置啊,他会往虚拟内存里边放一些东西,每生成一次这个虚拟内存都会往上涨啊,各位,所以呢,有小伙伴反映是吧,生成十几次之后,这个系统就崩了,很简单啊,你那个虚拟内存干满了, 好吧,程序没法用了,就崩了。那么这个时候,如果大家以前的这个批量管理软件,比如说我生成了二十条,生成到第十条的时候,系统崩了, 那我还有十条,十多条没生成完,是吧?这个时候我再去批量生成的时候,各位他会从头开始一直升到二十,那我以前升的好的,他会又重来一遍,所以呢,这个功能的作用就是防止这种情况发生的啊,或者是是吧,这一批,比如说五十条视频或者五十张图,生成到二十五的时候,我停了,比如说我点击批量生成的时候,我点击取消了, 再想接着生成的时候,之前没有这个功能啊,他会从头开始生成,那么加上这个功能之后呢,大家注意啊,就是我可以是吧,从我想要的那个位置开始批量生成,这是第一个功能啊,补了一个这个,第二个呢就补了音频参考里边,大家看啊,音效不有这么多,对吧?然后声音啊, 生成这个声音的时候,大家看好就是加了一个语音参考,也就说我可以参考三个声音,然后生成一段对话,玩归玩,这是第一个,别让生活耗尽了你的耐心,当你快要翻身的时候, 我可以用三个参考音生成我这一次的这个音频,大家看啊,修改效果。 hello, i'm speaker one。 这是第一个 and i'm speaker two 第二个 and i'm speaker three hello, i'm speaker one。 之前呢,这个参考音只能上传两个啊,现在可以上传三个了,就是为什么做这个修改呢?大家看好 举个例子啊,因为最近在做这个小说推文哈,和这个漫剧这一块,大家看啊, speaker one 可以 是旁白, 好吧, speaker two 可以 是啊,男主或者是第一个说话的人啊,这个 speaker three 是 吧,第三个可以是女主,也可以是第二个说话人,这样呢,在一次的声音生成当中就会包含旁白, 呃,主角一,主角二,好吧,这样呢,就会这样呢,生成呢,这一次的语音就可以用到 ltx 二点三中当中做批量的配音了, 因为呢,这个批量的继续生成,这个功能还没加全啊,应该是这两天完事就给大家放出来版本,应该是四点二哈,然后呢,做了一些其他的小修改,这个就不挨个说了。好吧,各位主要的功能是修改这两个哈,然后呢大家注意一下哈,就是我这个 api 生成这个声音的这个 tts api 好 用的是这个欧尼 好吗?大家呢,如果本地安装好了欧尼的时候,大家不要用这个欧尼的这个呃,这个 api 去生成这个三个或者是两个以上的参考音,是合成音啊,别用这个欧尼,因为它的 api 有 问题,我是把它这个欧尼的源代码改了啊,就这个插件的源代码改了, 但是呢改了太多,我有点记不住了,各位,所以呢,这个 tts 选择的时候,如果用这个批量管理软件调 api 的 时候,大家别用这个 tts 二啊,或者其他的。

sd 杠 forg 纹身图可示化启动器可示化提示词,卡片可分类 自定义提示词池 可编辑词库自定义提示词卡片内容通过文本自动批量生成卡片 自定义背景导出导入全部设置准备升图进城与参数开始升图 得到图片可自由查看复制参数,打开图片所在文件夹,可保留后台 ford 进城。

大伙好啊,呃,这个 comfy ui 号支持了 animabase 这个模型,也提供了官方的工作流啊啊,大家看一下 这个模型和工作流啊,它非常擅长于动漫的纹身图,角色啊,动漫角色的设计以及风格类的图片的纹身图啊,而且非常擅长于这种插画啊,艺术类的这个纹身图啊,但是呢,不擅长写实类的纹身图。 好吧,各位,呃,之前呢,也介绍过这个 anima 这个模型啊,但是不是正式版。今天呢,这个 comfyui 也更新了它的模板库, 大家更新一下 comfyui 的 内核哈。呃,这个地方一定要更新,更新到最新之后,在模板当中找到这个 anima base 啊, v 点击一下就能拿到这个工作流。当然啊,工作流左边也告诉大伙了哈,这个需要用到什么样的模型,放在哪一个目录啊?模型已经下载好了哈,在网盘当中,大家自行呃 按需求去下载就可以了哈。然后呢,我们把保存图像这个节点往右拉一拉哈,然后呢,将这个纸图点一下,点击外扩的按钮,就能把纸图解放出来。将模型配置好之后,各位,我们就可以进行纹身图了。这里边的提示词啊,大家要用英文去写,如果呢,呃, 大家呢,不太擅长写英文的提示词,大家一可以用翻译软件啊,去翻译一下,第二个呢,可以安装一个翻译插件啊,那么我安装的是这个百度的翻译插件, 这样一连就可以了,在这里写中文提示时,然后它就会翻译过来。那么这个提示词的写法啊,大家看一下,这个是官方提供的,最好是像这种啊,英文的关键词类的提示词写法,好吧,各位 啊,就是一个关键词一个逗号,一个关键词一个逗号。如果大家经历过这个 web ui, 那 个时候啊,就是早期的 web ui 用的模型啊,我们一般叫 s c 一 点五啊, stable, uh, stable diffusion 一 点五啊,那个 那一类的模型,我们的提示词都是像这种写法,就是关键词的写法啊,生成效果是比较不错的,那么呢,大家也可以看一下,我做个测试哈,就是我来到豆包,大家看,好,我来到豆包,把这句话给到他,这句话我给大家读一遍哈,就是应用 啊,这个 animal base v 一 点一哈,根据这个模型的能力,给我生成二十组图片的提示词,要求中英文对照,结果保存为 excel 哈, 这个豆包哈是认识这个 animabis 这个模型的,然后呢,大家看,这个呢,是它给我生成的结果有中文的提示词,当然这个中文提示词不能用啊,主要是对照用的,然后呢,有对应的英文提示词,大家点击下载就能把这个 excel 下载到本地了,好吧,然后呢,大家看一下是吧,我打开我自己的这个批量管理软件哈, 然后呢,来到这个文生图,当然呢,这个 api 已经配置好了,大家看是吧,导入 excel, 它的起始行号是从第二行开始的,英文的提着词是从第三列开始的,所以呢,点击添加到现有队列,呃,宽高总着在这里设置是吧,然后我点击批量生成,这个我就不剪辑了哈,各位大家看哈,呃,因为它是一个 两币的这么一个模型啊,如果没记错,应该是两币的,然后呢,体积也不大,大概是不到四个 g, 所以呢,生成的图片大概就是十秒钟左右是吧,大家看,第一张图片已经生成好了,十秒钟左右一个图片,我的显卡是四零九零哈,大家看,基本上很快就一张图片哈, 这个是第一张,然后呢,对照着中文提示词大家看一下是吧?日系二色元少女女仆装啊,蕾丝花边白色过膝袜,大家看一下是吧,黑皮鞋啊,都能对上是吧,所以呢,这个模型呢,非常适合于做这种啊,比如说动漫呢,纹身图啊,还有比如说大家做一些儿童的插画, 儿童的插画烧读本啊,以及做这个抖音的这个卡点视频是吧,用很多大量的动漫图片出这种卡点视频,效果是非常好的,等等等等吧。呃,还是啊,就是因为它生成的速度非常快,大家可以在短时间内得到海量的可用的图片,大家看是吧?第一张,第二张是个风格插画,第三张啊, 未来的这个朋克风格是吧?然后呢,这个是这个有点类似于奶油那个风格了哈,奶油三 d 风格是吧,大家看一个精灵的是吧,这个应该是暗黑风了啊,效果都挺不错的,我感觉好吧,而且速度非常快哈。呃 呃,我这个有生成好的哈,就不浪费时间了我这个有生成好的,大家直接看效果是吧,点击下新任务导入导入记录,我直接搜一下哈, adam, 好,这个是生成好的是吧?呃,第二十组可能要我删了哈,无所谓呃,十九个图片,然后呢,我们可以点击一下高清放大哈,因为目前的这个图片呢是七二零乘幺二八零,我们点击下一步来到图片编辑 切换一下 api, 把这个 api 换成啊,这个 c 的 vr 放大是吧,然后点击批量生成,这样呢,我们就可以得到十九组放大。好的,四 k 图片就是直接可以进行编辑的哈。四 k 图片, 呃, c 的 vr 啊,这个之前也讲过了啊,更新完之后出图的效果还是挺快的啊,而且质量比较不错,大家可以看一下,是吧,这一会一张图片四 k 的 放大完了, 是吧,效果还是比较不错的啊,所以呢,还是比较建议大家使用一下的啊,就这个,呃, animal base v 一 啊,官方提供的这个模型和工作流是吧,做这个类似于少儿读本啊。呃,这个 睡前故事啊,少儿类的,而且做这种抖音的快速的卡点这种视频效果是应该是不错的啊,第一有效率,第二有效果。

兄弟们,重磅核弹季更新六月一日 comfy 九点五中文版正式上线!简直是对 ai 小 白的神之一手,不用担心本地电脑带不动或者折腾半天一直报错!整合包提前配齐全部运行环 境下载解压直接开用全中文原声界面,小白上手零门槛,内置三百多套大神级爆款工作流,日常出图做短片全都有输入通俗大白话,一键点击就能生成中文版!什么味道八八六,尝尝咸蛋!

大伙好啊,今儿个呢,说一下这个 ltx 二点三的几个辅助 logo 哈,这些 logo 呢,包括视频的去字幕,大家看一下是吧?左侧的视频有字幕,右侧的视频无字幕哈,然后还有视频的去水印, 大家可以看到哈,这个左侧的视频是有水印的是吧?而且还是动态水印,右侧的视频呢,已经没有了,还有呢,这个视频的视频是经过处理之后的,还有下边这个, 大家看这个地面是吧,大家看这个地面是吧,是能看出来的,那么呢,工作流呢,在这里哈,大家看一下啊,首先呢,上边有几个提示词,这个提示词呢,对应着几个使用场景哈,大家呢,如果想更换啊,这个提示词可以按住 shift 键好吗?然后把这个线哈往下去连就行了 好吧,比如说我想去水印,那么就把这个提示词连到这里,然后呢,呃,中间这里有两个开关哈,比如说我想去水印,那么就把下边这个打开,把上边这个关闭, 它的这个 logo 呢,就自动的加载完了哈,这几个 logo 分 别是什么哈,一个是这个这一组 logo 哈, 大家看一下上边和下边这一组 logo, 它的作用是视频的高清啊,高清处理去模糊,去微影。然后下边这一组 logo 呢,是用来去水印去字幕的啊,包括这个 autmark 是吧,还有这个去字幕的,好吧啊,两组 logo 哈,看大家的使用场景啊,这里有开关,对应的去打开或者关闭就行了。然后呢,我们需要在这个最左侧下边这里上传我们需要处理的视频啊,将视频上传完之后啊, 提示词选择完,然后对应的这两组 logo 是 吧?开关我们设置一下,这个工作流就可以跑了哈。嗯,工作流呢,是比较简单的。 那么这几主 logo 啊,其实出了有一段时间了啊,之前呢,没出是因为有对应的这个工作流可以解决相应的问题啊。但是呢,今天用过之后呢,发现是吧, l t s 二点三它的效果也不错。 而且呢,这个 l t s 二点三啊,它有一个非常天然的优势哈,就是快,效率非常高啊。所以呢,这个工作流也推荐给大家用一下哈。