粉丝1052获赞5588

跟大家聊一下我这个本地部署的 deepsea flash 四啊?不是,是 deepsea v 四 flash, 它的使用情况大概已经部署了三天了,这个放回去我的感受呢,是非常好用啊,应该说是非常的好用, 近 mini max h 三开源的。出来之后我也在折腾这个 comforu i, 在 折腾的过程中呢,出现了很多问题,那要放在以前的,我觉得这些问题挺麻烦的,因为你得根据这里面的提示啊,网上搜这英文关键词,然后去 自己排查,慢慢解决。而现在有了它之后,我就全部交给他了,因为他现在是一百万上下额,所以我干脆就把所有 logo 直接贴给他。我,我连看都不用看,我连晒都不用晒, 全部扔给他就行了。你看一下,这些都是他帮我解决的东西,而且问题是他都解决成功了。像这个问题,像尤其这个 cj 腾审的,我在之前我试过,我搞了一晚上才搞定他,结果十分钟就弄完了。 这绝对是生产力的工具了,现在可以算作啊,他比其他的模型快很多。这个工具是 open code 啊,当然 cloud code 或者是 codex 应该都能做的到,不过这个应该是平民使用的最好的一个模型了,而且 open code 它也内置了一个免费的 deepsea flash。 之前我是用这个模型帮我去部署,部署好了之后,我就开始用这个模型来作为主力来用了。 这个 mini max 呢,这边这些提示词我是用的五六八,让他帮我去网上搜搜这些提示词的技巧,把你想要的大概的意思跟他说来生成提示词, 我用的是这个叫 ai 视频脚本的创作专家,当然接的也是我这个本地的 deepsea ice 挺好用的,他写了不少,写了一堆出来,大概根据他的这些效果 去生成了一些视频出来,总体效果还可以,当然有不满意的地方就是让他改,你说你视频里面哪些地方不满意,他就会相应的去修改这些镜头分镜的东西。所以总体说这个 deepsea glass 用到现在我觉得非常的满意, 至少这两天我用的很舒服。我也推荐大家用这个 open 扣的或者其他的相应的工具吧,克拉斯扣的也可以,克拉斯扣的没有这个来的方便,克拉斯扣的你得自己写一个 lm 的 转接器还是怎么样,或者去找那个开源项目才能外接。 这个大模型不像 open 扣的现在解决问题能力变强了,比之前要强的多, 也有可能是模型的缘故,当然如果你没有本地部署的也可以。它其实 deepsea 的 api 的 其实也不贵,你可以用它解决问题是真的挺方便的,不愧是专门用来做 a 诊的 的。它现在唯一的缺点就是没有多模态,但是多模态你可以用一个桥接模型给他,就是用其他模型识别好了再发给他就行了。好了,我来继续折腾这个 mini max 了,你这两天玩的不亦乐乎,还挺有意思的。

大家好啊,今天给大家分享本地部署 ai 的 软件安装和使用,大家可以选择使用官方桌面版,也可以使用大佬制作的整合包,这里我以官方的桌面版为例,因为这个最简单,没有复杂的东西,最适合从零开始学习。 大家在网页搜索坑夫意味或者直接输入网址就可以进入下载界面,一定要进入官网的国内站,这样下载迅速。下载好安装包后直接运行全部默认即可。安装好后运行 来到这个界面,这时先不要着急,下一步我们需要更改一下设置,在这里进入设置,首先更改语言为中文,其次在下面打开使用国内镜像,然后切换到高级,在这里输入国内镜像园,阿里园,清华园都行, 设置完成就可以进入下一步部署工作环境,在这里输入你的工作区名字,不输入会使用默认名称,但是一定不能使用中文名称,我一开始就写了个中文名称,结果导致后面很多东西失效了,所以一定不能使用中文名称。 gpu 这里它会自动检测安装位置,就看你们自己没问题后点击继续。 我们会来到这一步,它会让我们选择使用的模型,这里我们什么也不选择,直接点击跳过并安装,因为这里的模型我们不一定会用上。其次是它这里完全下载不动, 然后就是等待下载,安装完成大概会下载三个 g, 这里可能会触发更新,如果你修改了下载源,那么这里只需要多等几分钟就好,如果没有它可能会一直卡在更新。这一步完成后就进入工作界面了, 到这里软件安装就完成了,只需要导入工作流和模型就可以运行了。下期我会分享怎么安装模型和工作流。

哈喽,大家好,我是日行一善,上一期我们讲了如何将 mini max h 三的这个视频模型部署到本地,这一期我们讲一下如何安装加速的插件,提升一下我们生成视频的这个速度,安装这个插件以后将近可以提升一倍的一个速度。 好,下面我们打开 comfui 官方的这个手册, comfui 官方的这个它默认是一个英文的版本,我们可以让浏览器翻译一下,翻译成中文, 然后滑到下面我们找的这个地方,利用 saguya attention 这个插件来帮我们做加速,外面也有很多其他的加速插件,但是内容它属于要牺牲一些音频还有质量,它做了一些步数的衰减,质量要差一些,我们最好用 comfyui 官方推荐的这种加速方式。 我们来看一下使用 saguya attention 这个插件,可以以质量损失极小的情况下,将生成速度将近提高一倍。 好,那接下来我就教给大家如何来安装这个插件。在安装之前,首先我们要检查一下我们本地的环境,首先我们打开我们 comui 安装的这个地址,打开以后我们找到这个文件夹, python 前缀开头的这个文件夹,我们点进来, 点进来以后我们鼠标移动到这个位置,选中它,然后输入一个 c m d 的 一个命令,然后点击回车,这样会自动打开我们这个终端。打开终端以后,我们来看一下,执行一下命令, 一定要在这个路径下打开,打开以后我们来复制一下这段命令,检查一下我们本地的这个环境,复制进来以后我们点回车, 好运行完成以后我们来看一下这个,这个我们要记住一下我们对应的这个环境的这个版本,对应的这个环境版本一会我们再下载加速发给 attention 这个轮子的时候,需要版本做一个匹配。好,大家复制下来,我这个已经复制下来,放到了这个位置。 好,下一步我们去 github 上下载加速的这个 sky attention 这个名字插件,我们打开下面这个网址,在这里我们可以看到有很多版本,我们往下滑找到 sky attention 二点二的这个版本,我们看刚才我们检查本地的那个环境是不是也有对应的这三个版本 对应第一个我们看一下是十三点零的一个版本,下面是二点幺三以及 python 十三点一三的一个版本,我们来看一下这里,在这里我们首先先看这个版本要保持一致,它作为第一重要性十三点零, 然后第二个看这个二点九点零点加这个加号代表二点九以上的版本都是可以的,所以说我们下载最新的这个,第一个点击这个下载 safetion 对 应的这个轮子。 好,直接点击就可以下载,下载完以后我们可以打开,我们下载这个路径,之前我已经下载过了,所以说我这里有两个,我先删除一个 好,保留一个就可以。我们在安装 thank you attention 这个轮子之前,我们还需要安装一个前置依赖,需要安装一下这个好,下面我们看一下对应的版本,这里的版本是跟我们显卡 gpu 是 对应的, 我们电脑显卡的型号可以找到这个电脑,点击属性,在这里可以看到,我这里是 rtx 五零七零的一个显卡的型号,五零七零对应这里是三点六的一个版本,这里大家要跟自己显卡的型号要保持一致,下载对应的这个依赖版本, 下面有对应不同版本的这个安装包,刚才我对应的是三点六,三点六的话,大家安装的时候选择这里的这个命令,好在这里做一个复制,复制完以后打开我们的终端,好在终端这里我们可以输入这个命令,进行一个依赖的安装, 然后点击回车,因为我这个已经安装过了,他就会提示我版本已经安装这个依赖,如果大家没有安装或安装不成功的情况下,我们来看一下。这是我在运行的时候, 我安装完 socket 这个轮子之后,在运行的时候,它提示我找不到这个依赖,这种情况下我们怎么去处理?第一种就是像上面一样,我们直接安装对应的这个依赖环境。 第二种我告诉大家这样的问题我是怎么处理的,其实一开始这个东西我也看不懂,我就完全把这一段复制下来,复制下来以后打开 codex, 完全把这个粘贴给他,问他以下是什么错误,帮我排查排查问题,我们来看一下它这个路径, 但他提示我 sga attention 装了以后,但缺少对应的这个依赖,下面帮我做了确认。插件装上了以后,但是依赖的环境没有装,然后他帮我确认对应的版本, 确认完以后他自动帮我做了一个安装,这里提示依赖已经安装好了,安装完以后还帮我做了一下验证,验证 triton 这个环境是正常的,而且也帮我验证了这个 sga attention 这个轮子也是正常的, 这 codex 是 非常强大,我只粘贴了这个错误,它不仅帮我分析了,还自动帮我修复了,还做了验证, 而且现在我也在录制 codex 系列的一套课程,都是从零基础教学的好。 tryton 这个依赖我们安装完以后,下面我们开始安装我们 sky attention 这个轮子,首先我们按着步骤还是打开对应的这个路径,用终端来打开 好,打开以后我们在这里输入下面这段命令去做一个安装,我们来看一下这个命令,命令的前面是帮我们安装,然后后面这个是我们轮子存放的这个路径地址, 前缀这里大家跟我一样。好,我先把前缀复制过来以后在这粘贴,然后轮子的这个路径每个人是不一样的,我是下载到了这个路径。好,我可以复制一下我这个路径的这个前缀,然后再复制一下这个轮子的这个名称,好在这里复制下来以后, 这里再加一个下划线粘贴过来,这个就是我本地轮子对应的这个下载路径,每个人是不一样的,但这个前缀一样,然后点击回车,然后他会帮我们做一个自动安装,因为我这已经安装过了,这里会提示三个 attention 已经安装 好。安装完以后我们还有最后一步,制作一下我们启动的这个文件,这个启动文件怎么制作?我们还是打开我们 comui 对 应的这个地址好,我们点进来 默认之前我们这里是不是有三个启动的这个文件?上一次我们演示的是用这个做一个启动,这是一个普通的启动,后面还有同学在问这个启动跟上面这个有什么区别?下面在 fast fp 幺六的这个启动的时候,运行速度会快一些。在这里我做了一个对比,大家来看一下。 我们用普通的这个版本,它的计算规则是 f 三十二位的。好, fast fp 幺六的这个 他的速度会做一个提升,生成视频的时间也会缩短。对于大家如果说显卡不够的情况下,可以用这个来运行, 但这个他损失的是什么?损失的是我们的这个画质,用画质来换取我们速度,如果大家低显卡的情况下可以用这种,但是画质会差一些,但是我们想做成品视频的时候,建议还是用普通的这个来启动,牺牲一点速度,但是出来的质量他不会出现问题。 如果想调试提示词或者想快速预览的,可以用 fast 的 这个来快速做一个调试。好,下面我们还是回到怎么制作这个启动文件,在这里我们先看一下这两个文件有什么不同,可以右键点编辑看一下,这里有一个启动的一个命令。 我们再来看一下 fast 的 这个,这个我们看前缀是一样的,但是它后边又加了一个 fast 的 f p 幺六的一个参数, 其他的都是一样的,只有这个位置是不一样。然后我们怎么制作?我们已经安装了 fga attention 这个轮子的启动文件,我们可以复制一下,复制粘贴一个新的启动文件,在这里可以给它起个名字。 好,这个名字大家可以随便起啊,但是不能有中文。好,复制完以后,我们还是点开编辑,编辑在后面增加一个后缀,在这里我们来看一下, 我们来增加这个指令。好,复制一下,这里要有一个空格,然后粘贴过来,这样这个启动文件我们就配置完成了。增加的这个指令我们也是在 comui 官方的这里来看到的,看这里它有说明,可以通过使用这个命令启动 comui 全局的一个设置, 这样配置完以后,我们每次启动的时候,它就会自动做一个加速,直接来调用,我们撒给它是这个容字。 好,这里配置完以后,大家一定要记得保存,如果说我们电脑配置不是很高,同样也可以把这个文件里面的这个命令给它添加进来, 好,添加进来以后就是这样前缀,这里都是一样的,在这里加上了 fast 的 f p 幺六的这个,然后又加上了 sga extension 这个插件的命令,这样运行速度也是比较快的。好,我们可以打开做一个测试, 在这个控制台我们可以看到这个 using socket attention 代表我们这个轮子已经开始生效了。好,我们来测试一下速度。 上节课给大家演示的是这个,有很多人问,其实词是不是必须是英文的,这里不是啊,就是中文,英文都是可以的。 好,我拿这个举例,在这里我拿这个中文的,我们来做一个测试,好中文的提示词,然后分辨率选择器,这里跟大家说一下,你的分辨率越高,运行的时间会越长,如果说大家初期测试的话,可以选择一些低分辨率,我这里选择零点二,这样速度会快一些, 然后输入一段中文的一个指令,做一个纹身视频,点一下这个运行,然后点击这里的控制台,在控制台这里我们可以看到这个进度条 好运行完成了,我们看这里用了一百二十六秒,速度还是比较快的,大概是两分钟左右,我们来看一下视频, 宗门万千弟子唯独我,灵根残缺,宗门万千弟子,唯独我。效果还可以啊,我们工作流运行完成之后的视频都会保存到我们这个 output 这个输出里面来,再看几个我前面生成的这种效果, 你又欺负梦瑶,家里好吃好喝供你,你就这么不懂事,阿姨,是她绊倒我的,这个效果是不是还可以?这个中文也没有字母乱码,已经可以比肩 cds 二点零的视频模型效果了。 还有这个残缺灵根就不该留在仙门,整体运行出来的这个效果还是可以的。 然后这个是我前面运行做的测试,大概运行一个五秒的视频,只用了一百三十一秒,也是两分多钟,这个速度还是可以的, 大家有感兴趣的可以按照我这个教程来安装一下 comui 官方的这个加速的这个轮子,大家可以点个关注,后边我还会更新其他的优秀作品。好,这期视频就到这里,谢谢大家。

哥们滔凯小常识, kimi k 三用四台 h 二百,成本约两千一百 w 左右,在二十四小时的负荷且三十天的运转情况下,每月可得约五百亿的滔凯。再不计算 维修人员电费的情况下,按照官方价格八折进行售卖,每月可得约三十五 w。 那 回本周期需要约 五年,且仅支持单人并发使用。我们来操作一下,看一下他的上限在哪里。我们通过调整上下文,从百万级下调至二十五万级, 从单人并发便可达到七人并发。再调整缓存精度,从七人并发可达到十四人并发。 但截止到这里,我们就没有办法进行下去,因为工程指数级难度增长,我们被迫放弃。当然,我们不行不代表别人不行,毕竟这个世界上最不缺的就是天才。我们的 it 小 伙伴找到了一篇实验报告,该团队通过删除 专家和缓存,从单人病房至高可达到二百六十人病房,但模型的总餐从二点八 t 下调至了一百零五 b, 依然失去了原本的味道。 本地部署不等于一定比 api 便宜,它的优势在于私密性、稳定性,可定制调节。本人非常支持大家在官方正规渠道购买 tucker 和 api, 谢谢!

这是一个不限次数,完全免费的漫剧生成器,只需往里面随便丢入一段小说,我就能生成这种自带音效和配音的一些短剧。它就是最新推出的 comfy ui l t x 二点三, 和你之前用过的网站不同,它不用积分,不用排队,也没有月费和年费的套路,并且无审查,无限制,内置四百多款风格模型,让你的生成随心所欲。 ai 工具和使用教程都打包好了,感兴趣的同学话不多说,开始教学。那么接下来我们就进入最实用的部分,这里我们稍微讲解一下工作流的一个重点用法。 第一个工作流就是我们纹身视频,选出入就是纹身视频,可以根据需求来设置, 接着就是模型加载模块,加载正确的 l t x 二点三的模型。然后下面呢进行主要的一些参数设置, 这里的 wait 和 height 就是 设置你生成视频的宽和高,横屏还是竖屏就在这里设置。然后这里的数值是要生成视频的总时长,这个时长是怎么算出来的呢?我们看提示词设置模块里的 f p s 值就是一秒生成的图片数量, 我这里给的是二十四,常见的影视动漫作品都是二十四帧,那么如果我要做八秒的视频,那就是二十四乘八,还要加个一,最终结果就是一百九十三, 这个 frames 的 值呢?大家按需去进行设置哈。还有关于视频分辨率,就是 wait 和 height 设置的问题,大家在使用的时候先规划好最终输出的视频尺寸是多少, 比如如果要输出两千五百六十乘一千四百四十的视频,那就在这里输入一千两百八十乘七百二十的尺寸就可以了,因为这个工作流使用了两倍高清放大的二次采样模型,先用低尺寸进行快速的一次采样,再在一次采样的基础之上增加细节,提高清晰度,这样能有效的提升视频生成的速度。 其他的数值基本都调节好了,小白可以不对其他参数作出调整。另外就是提示词反推模块,这里使用的模型是 gemini 三的模型,调用的话可能会造成扣费,需要注意,如果不使用 gemini 的 模型,豆包 deep seek 千万的都可以。或者你可以使用我这里提供的智能体设定到外部去做提示词反推也是可以的,具体操作就是先复制这里的智能体设定到外部去做提示词反推也是可以的,具体操作就是先复制这里的是 gemini 大人,豆包 deepstack 都是可以的。这里只是讲一个思路,我们将刚刚复制的设定丢给大语言模型,然后将需求告诉大语言模型,让它给我生成提示词,然后将生成的提示词复制回到工作流中。 因为我们是在外部完成的提示词反推,所以这里的反推节点可以 control 加 b 关闭,然后将反推模块连接文本编码器的线断开,就可以粘贴我们刚刚复制的提示词进去了。如果是做图声视频的内容,记得把手帧图输入进去哈, 然后点击运行就可以等待视频生成了哈。刚刚是文声视频和图声视频的复合工作流,接下来再讲讲首尾帧的二点三工作流, 这个工作流和刚才的工作流基本类似,我们只需要上传两张图片就可以了,这里上传手真图,这里上传伪真图,在这里输入简单的提示词描述就可以,后续的节点会自动调用大语言模型生成详细的提示词,注意还是有可能造成扣费,如果不想被扣费的话,一样可以按照先前讲过的调用外部大语言模型来进行提示词生成。 看到这里,有的小伙伴可能觉得首尾针对生成视频的控制还不够精准,想要手中尾针三图控制生视频怎么办?其实也很简单,原理是一样的。第一步我们只需要多加一个输入图片的节点,将图片预处理的模块复制多一份出来, 将节点的首尾相连。图片预处理模块要连刚刚输入的图片和宽高, 预处理的结果要连到将图片转为前空间分布的功能模块处, 然后调整提示词的输入策略,就可以进行手中尾三图声视频了。怎么样?看到这里,想必小伙伴们已经跃跃欲试了吧,那还等什么,赶紧从视频简介处获取工作流,完成运行和测试。那么今天的视频就先讲到这里了,感谢大家!

ai 界一夜之间大洗牌,所有 ai 软件一夜之间成为过去式,一位新王悄然崛起,几何倍性能超越目前 ai 所有软件,它就是新登上最强生产力工具的 mini max 三,是一款真正意义上分币不花的良心软件。拒绝隐藏扣费项, 拒绝暗测计费的门槛,拿来即用,永久免费。只要是我粉丝,全给你们整理好了,八百八十八拿去研究。 哈喽,大家好,这节课我们一起来聊一聊 ai gc 的 相关网站,那么待会我们会介绍三个国内常用网站,以及四个国外的主流网站。那首先第一个要介绍的就是国内最大的 ai 画画平台 vivo 和 ai。 这个网站呢,集合了模型的下载、工作流、模板、图片及在线生图诸多功能,全方面包含了 ai 绘画有关的一切。那首先我们在主界面看到的这些图片啊,它们分别代表着大模型或是 lora 哎,关于 lora, 我 相信有部分小伙伴可能还不太清楚,那么我简单解释一下, lora 就 相当于 小模型,它的体积没有大模型那么大,比方说可能只有几十人,几百变,但是它却能基于大模型去改变最终生图的风格,或是聚焦于某一角色的特定形象。什么意思呢? 比方说最近那个哪吒不是超级火爆吗?都冲进全球排行前十了。那么我们想生成一张哪吒图片,咱们搜索哪吒,随后我们可以看到啊,在 libaby 网站内提供了非常多和哪吒有关的 lora, 比方说像哪吒本人以及电影中的一些配角或是男耳。 ok, 我 们随便点开一个,那么接下来我们就可以在这个 laura 的 详情页 去看一下使用这个 laura 具体需要注意哪一些参数,同时我们可以往下滑看到反图区,那么这边呢,有其他玩家用该 laura 生成的图像,其实有点像购物软件的评论区,在这边我们可以客观地去评判这款 laura 适不适合自己, 或者说它的效果 o 不 ok。 那 同时呢,比方说我觉得这张图片吧,很不错,那么咱们可以点击一下,随后在这边就可以复制它的一些相关参数,比方说提示词或者 具体用了什么模型,什么 rawr, 都可以一一套用。好了,接下来我们回到 libai 的 主界面,这边还提供了非常多风格的模型或者 rawr, 我 们看到这儿有动漫、写实、插画、电商、建筑 等等等等,种类非常多,那么该网站也是收集了十万家的模型,基本都能找到自己想要的那一款,而我们的大模型一般存放在这个路径内, logo 咱们一般放在这个路径内。 ok, 接下来我们来到这个作品灵感界面,在这边可以看到其他玩家所生成的美图,如果说我们看中了哪一款,我们也可以像刚才的操作一样, 点击该图片,随后复制相关参数。好的,接下来我们看到左边有个工作流,那么在这边会提供和康复 u y 有 关的案例,工作流应有尽有,数量也是非常庞大,比方说像什么文物修复,电商产品图换背景,人物写真等等等等。那么在下边我们可以在 ai 官网内进行在线生图,我相信有的小伙伴肯定电脑配置这一关过不去,那么我们就可以利用这些在线生图平台,以完成我们的生图目的。那么这个是 vip ui 端的在线生图,下边有一个堪比 ui 端的在线生图。 ok, 咱们稍微看一下吧, 打开节点目录,我们可以看到有非常多的节点,所以说使用效果应该还是非常不错的。好,接下来我们来看第二个网站,叫 nano ai 点 dab, 那么在这儿也是有各种各样的功能。这边值得一提的是有一个法术解析选项,点击一下,咱们在这边可以上传 wpd 生成的图片,从而反推出生成的参数。比方说我们拖一张图片进来,接着咱们就可以看到,哎这张图片的 声图,正向提示词以及反向提示词,还有他们用的什么采样器,什么调度模型,什么大模型,什么 roo, 包括 ve 模型,非常非常详细。 ok, 我 们回到刚才的主界面,那么除此之外,我们还可以点击这个 ai guideline, 这是一个和刚才那个 ai 有 点像的 ai 社区,虽然说内容没有这么多,但是看起来会更有趣一点。 我们可以看到这个 u i 非常有异世界探险风格,对吧?比方说什么像康菲奥数外边外魔法,而在线生图他们称为进入城邦,是吧?挺有意思的。咱们往下滑,可以看到这边有其他玩家生成的图片,比方咱们点开一张吧, 可以看到这张图片的一些详细信息,玩起来还是非常有趣的,是吧?他还平定了一个综合战力。好的,接下来我们来看第三个国内网站,叫做 promly, 这个网站专注于提示词的构建以及他们的格式化。啥意思?我们可以看到啊, 每一组图片都对应这个提示词,比方这个什么蜂窝头,然后他给你展示这蜂窝头发型是什么,什么样子,或者说马尾, ponytail, 英文以及图片样式都给大家展示出来。 如果我们想要采用该提示词,只需要在该提示词的图片内点击一下,接着我们就可以在右下角看到它出现在了文本构建栏中。等我们构建完提示词,直接点击蓝色的复制提示词即可, 把我们选用的所有内容给粘贴进咱们的 copy y。 接着我们再来看一下左上方,那这边有人物服饰画,镜头、质感、环境参数,建筑室内非常多的类型, 仔细看可以发现单单这个人物模块就已经有女性发型,男性发型、发色、脸部、眼睛、耳朵、嘴、皮肤等等等等,可以说是分类的非常详细啊。咱们点开一个质感来看看,哎,这边有各种各样的质感,比如金银铜铁、透明毛绒,各式各样 都有,最重要的是我们可以通过他们展示的图片来看到该提示词的具体效果。好的,那么接下来我们来讲一下国外网站。 ok, 咱们首先要介绍的是 save ai, 那 这个和国内的 lipopai 非常像, 也是一个全能的 ai 绘画平台,不过它目前还没有在线生成功能,但它的优势在于模型库非常庞大,因为它是一个全球性的 ai 平台。咱们看到左上角点击 model, 我们就可以在这边下载各式各样的大模型或者 lora, 当然还有 ctrl 代模型, v a e 模型、 ip v p 模型等等等等,那比方说像我们常用的 isna 体哎,我们来看看,那么这边我们可以把这个词组包 进行下载,当然还能看到它的发布者所介绍的一些详细信息。那么除此之外,咱们的图片广场也会每天都进行更新,因为玩家数量众多的缘故,这些排名靠前的图片质量还是非常高的。总之一句话就是, 如果咱们想找一款大模型,国内的 leapf 没有,那么我们就来到这个 seven ai, 如果还没有怎么办?那接下来我们就来介绍两款 更为专业的相关网站。咱们第一个网站叫做 github, 它是目前全球最大的代码存放网站,在这边有各种各样的开源项目以及闭源项目,比方说像前阵子超火的 deepfake, 咱们可以在右上角这边搜索一下 deepfake, 接着我们就可以看到和 deepfake 有 关的内容,那比方这个 deepfake 二一哎点开来之后可以看到 相关介绍以及模型参数的对比,同时我们还可以通过这边的链接去下载有关的开源模型,那现在网上不是各种各样的本地部署教程吗?其实都是从这边进行模型下载的, ok, 接下来比方说咱们搜索 com 域域吧,然后我们就可以看到和 com 域域有关的所有节点,而我们在 com 域 y 管理器内所下载的节点,百分之九十九都是来自于这个 gitlab 网站。我们甚至还可以在这边看到 stable fusion 的 源代码,咱们搜索一下 stable fusion, ok, 咱们可以看到这个 stability ai 开源的 stable fusion 代码,那么看来,那么这边也是有各式各样的介绍, 咱们就不详细看了。总之啊,这个 github 网站非常的全面,如果咱们想为 coffe 以外添加什么节点,那么来到这个网站搜索下载准没错。那这边带提嘴的是如何进行下载呢?比方说我们搜索一个简单节点吧,叫做 ipad pro bus, 咱们点开我们的目标节点之后, 看到 code, 点击一下,随后我们就可以下载它的压缩包,那至于放置的路径,我们就可以在目标节点的说明书,也就是下面这些内容里面去看。哎,它具体的安装路径,下载路径究竟是在哪里?因为它纯英文嘛,我们也可以用电脑自带的自动翻译, 把它们都翻译成中文。好,我们接下来看和 gitop 非常相似的另外一个网站叫做 hugerface, 那 么这个网站呢,它主攻的方向是 ai 领域,和刚才的 gitop 不 一样, gitop 是 百花齐放, 只要和计算机有关的都接纳。那 hugerface 呢?它除了专注于 ai 领域之外,它还专注于模型的存放。啥意思?比方说像刚才咱们搜索的 deepseek, 哎,我们在这边搜索一下 deepsea, 咱们可以看到怎么回事啊?这个说明书,如果大家有印象,可以发现它和刚才的 deepsea 说明书是一样的,那么事实上引用了 hugging face 的 这篇说明书以及下载路径。也就是说 很多时候 github 上的模型文件下载是需要跳转到 hugging face 的, 当然我特指的是 a i g c 领域。那至于如何下载,我们看到这个 version 文件及版本,哎,在这边我们就可以看到有关的 一切模型,当然前提是它开源才行啊,那咱比方说 fox 模型不是效果非常好吗?同样的,我们也可以在这个网站内进行下载,搜索 fox, 看到第一个啊,黑暗森林工作室的 fox, 点击一下,接着我们就进入到了 fox 发布的最原始界面,而这一款 fox 模型,它是没有经过任何其他 ai 玩家修改调参的原声大模型。那这些说明书内容我就不带大家看了,我们看一下文件及版本吧,咱们可以看到这款 fox 就是完全体嘛,二十三点八 g。 除此之外,像贪吃鬼有关模型以及 ipad 有 关模型,我们都可以在 hugging face 这个网站内进行下载。 ok, 我 们接下来介绍最后一个网站,名字叫 joycapture, 它也是存放在 hugging face 里面的一个项目,作用呢就是反推提示词。 比方说我们上传一张图像,接着点击 capture, 那 么这个网站呢?它反推不是一般的强大,根据我们上传一张图像,接着点击 capture, 那 么这个网站呢?它反推不是一大段文字,而这一款 提示词反推模型算是当今最优优的一款,比什么 w d 十四要强多了,不过它的功能也仅仅局限于这种,也就是提示词反推嘛。当然在我们具体使用扣排位的过程中,需要结合着你认为好用的软件,取之所长,去其所短,获取你需要的内容。 好的,那么以上就关于本期的全部了,我们下期一起来看一看如何进行高清放大吧,咱们就下期再见,拜拜!

本地推团购推广教程来了一条视频讲清楚本地推如何投团购成交,细致了每个按钮的设置技巧,每个功能的使用建议。话不多说,开始发车。 首先要明确的是团购推广使用什么推广方式,巨量本地推 pc 版可以投放团购成交的有三种方式, 第一是标准推广的短视频图文,第二是直播圈粉推广,第三是门店权益推广。这里直接给答案。随着平台的产品和更新方向以及投放效果,团购成交都会选择权益推广。 直播就用直播权益推广,不直播就用门店权益推广,对一个成熟的团购型商家直播是必须的。那么什么是权益推广呢? 权益推广是打通流量壁垒,抖音站内全流量协同发挥内容核心生产力,助力门店或直播间。大白话就是将素材的自然流和付费流量结合,同时覆盖抖音多个广告城市,提高广告效果。所以权益推广是团购成交的最优选择。权益广告的搭建流程 首先讲直播权益推广。第一步,选择开播账号进行权益推广权限授权。如果使用其他抖音号开播,点击这里进入抖音号授权,进行抖音号添加后是希望提升什么?就是投放目的成交金额对应的出价方式是 r o y, 出价目的是为了获取更多 的成交成本,出价目的是为了获取更多的订单数。如何选择呢?一句话总结, 常规情况下,优先选择投放成交金额,以达到更高的 gmv, 当不以 gmv 为主要目的,比如低客单价引流单品可以投成单人群,由于权益限制,同类广告数量预算充足时,两个投放目的可以进行同时投放。出价方式上有手动出价和自动出价两种, 和之前的投线索的稳定成本和最大化类似。投放目的和出价方式的选择使用,最终还是要根据每个客户的需求,每个账户的情况进行分析后定制投放方案。 投放日期一般选择长期投放,这个不多说了,投给哪些人就是定向过滤,如果想提升投放效果,就要根据自己的产品做精细化设置。点开手动定向,首先看三大基础,定向,地域、性别、年龄,根据自己的商品消费人群来圈定, 其中地域设置有三种,按行政区域可以最小选择。街道自定义区域可以选择多个点为中心半径三至三十公里范围进行投放。 门店附近是按照来客认领的门店六到二十公里的范围进行投放,根据实际业务的区域覆盖范围进行设定。人群包就是 gmp, 可以 通过市场标签预算或者通过手机要加密上传生成人群 扔于广告的定向或排除使用,建议新手老板不要使用,使用不当会导致广告覆盖人群过少,导致广告不能正常投放,适得其反导致投放效果变得更差。抖音达人就是达人定向,可以选择与自己行业相关的达人分类或精准选择达人、 达人的账号的人群进行投放,一样是不建议新手老板使用。过滤。已转化人群就是不给已购买过商品的进行投放,可以根据自己的产品消费频次设置过滤时间。智能定向拓展,直接打开系统,能够拓展更多的优质流量。接下来是 素材选择。首先是素材素材勾选,这个开启后,系统会自动选择抖音主页或直播切片进行投放,想严格控制广告素材消耗的就勾选, 想要系统拓展更多流量的就勾选上,通常是不选择。接下来是这个自选素材,无论勾选与否,广告投放中都有以直播间画面为素材进行投放,也就是我们常说的直播间之投,这个是关不掉的。 勾选后可以自主选择抖音主页、素材库和上传直播高光三种形式素材,根据自己的素材形式进行选择。选择视频素材后再填写标题即可, 标题就是视频底部的文案内容,需要注意。选择视频素材后,这里设置仅单次可见,这样设置后能够有效避免同行看到广告投放的素材以及投放效果。 最后是 ai 优化封面起用, ai g c 动态创意部起用。点击创建,一条直播权益推广计划就搭建完成了。另外再补充一句,一个抖音号仅可被一个本地的账户推广,可搭建四条直播权益推广计划,记, 成交金额加手动出价成交金额加自动出价承担人数加手动出价承担人数加自动出价。如果不做直播,就使用门店全域推广,整体的搭建流程几乎一致,抖音号的选择变成了门店的选择,素材选择没有了直播间高光切片, 其他设置技巧与直播保持一致。当然,实际投放中,直播权益推广和门店权益推广都有不同的投放策略和安排,比如手动安边的出价,素材的剪辑都会有区别。好了,今天的教程到此为止,投放过程中有任何问题,欢迎在评论区留言或者进入粉丝群交流学习。

第一批靠豆包爆改上岸的受益者出现了,刷到一网友分享,首先上传自己的一张照片,然后给豆包发送这样一段指令,豆包你好,请根据我给你提供的图片帮我改造。指令有点长,我就给大家放在评论区了。快速这里选择工作任务,本地电脑,勾选上 技能这里我们往下滑,找到应用生成,点击发送,等一会豆包就给我们生成好了。点进来可以看到他会给我们分析我们的脸型,最适合我们的发型,妆容,化妆品, 护肤品,化妆细节教程,我们的体态以及需要做什么运动来改善。并且他还会给我们做色彩测试,推荐最适合我们的颜色穿搭,扬长避短。最后他会给我们生成一个改造后的效果模拟,特别好用。


cheryl studio 是 一个 get up 四点八万 plus 的 开源项目,并且它是一个全能的 ai 工作站,内置了上百个可以完全自定义的 ai 助手, 可以随时配置你拥有的任何模型,支持 m c p skill、 本地智库能和 obsidian notion 等笔记进行联动,功能非常全面。它们最近更新了 vr 版本,反应速度更快,体验也更好,还特别优化了关于 a 键盘的工作能力, 能够同时处理多个复杂的任务。那这期视频来分享 cherry studio vr 的 使用教程,那视频大致分为两个部分,第一部分来介绍 cherry studio 的 基础功能如何设置,以及和 ai 助手对话。第二部分来介绍它的智能体功能,让它开发一个个人网页,并且部署到公网上。 cherry studio 的 下载安装是完全免费的,所以一定要认准官方的网站和 get app 地址,不要下载到了错误的版本。 打开客户端之后,第一件事情就是做一些基础的设置来方便日常使用。点击左上角头像,可以修改自己的对话头像和用户名, 上传之后点击关闭,它就会自动保存,然后点击左下角的设置,来到设置页面,它是一个 ai 客户端,那第一件事情就是配置 ai 大 模型,模型服务这里可以选择几十个大模型,厂商支持的非常全面。那我这里就配置了 deepsea 迷你妙, 一开始注册 qsi 六六账号的时候,它也会提供免费的千万模型作为兜底。配置自己的第三方 api 也非常简单,以 deepsea 为例,只需要在这里输入自己的 api 密钥就可以了,然后点击检测来查看是否连接成功,提示连接成功就能够正常使用了。 如果这里没有你需要模型的话,可以点击获取模型列表,这样就可以获取到全部的模型名称,然后点击这里的添加就行。 每个模型具备哪些能力,比如推理、视觉、联网等等,这里都做了提示,细节做的还是比较好的。第二个设置就是修改自己的默认模型,那这里你可以设置一下你的默认助手的模型,最喜欢最常用的模型是哪个就选择哪个。快速模型可以给对话命名或者搜索关键词提炼, 它还支持专门的翻译功能,所以翻译模型也可以设置成自己翻译时常用的 m c p 服务器,这里提供了多个常用的 m c p, 可以 快速添加,并且内置了常用的 m c p 市场。 网络搜索可以配置自己的网络搜索服务商,我这里使用的是 table 这个服务提供商,相比于百度必应这种传统的搜索引擎,它能够专门针对大语言模型进行优化,并且可以免费使用。在外观这里除了常用的设置之外,比如一些字体和样式的调整, 它还支持整体的自定义 css 样式,可以到它提供的网站直接来复制它的 css 代码,然后直接粘贴就可以了, 不过目前 vr 版本暂时还没有支持,我这里演示的是正常的 qs 九九客户端的皮肤样式,只需要在这里粘贴就能够直接变样式,也不需要保存。它还支持小猪佩奇的配色,你也可以直接把 css 代码复制给 ai 助手,让他直接帮你修改。 之所以说它是一个全能的 ai 工作站,除了可以充分配置自己的大模型提供商之外,在对话时也可以选择各种的 ai 助手进行对话,并且每一个 ai 助手都有单独的系统提示词和模型选择,适合不同场景下解决不同的问题。 点击添加助手就能够看到有非常多的 ai 助手,可以选择覆盖非常多细分的场景。点击这个按钮可以管理自己的 ai 助手。那我这里就添加了多个不同的 ai 助手。点击助手库可以针对具体的问题来选择不同类型的解决方案。专家,比如网页生成、产品经理、数字营销等等。 并且每个专家都有专门的默认提示词来限制他回答问题的方向,并且助手的系统提示词也是可以自定义的,每个助手旁边都有一个更多的按钮。点击编辑助手这个配置面板可以配置专门的回答模型, 并且针对模型也有专门的配置,比如针对模型回答的温度可以控制回答问题的随机性,采用范围、最大 token 数等等。然后是系统提示词,可以直接在这里面进行编辑。 kev studio 的 最大亮点就是一切几乎都可以根据自己的需求来进行自定义, 来确保能够发挥最大的模型能力。它的对话和别的 ai 对 话差不多,但是它支持更多的自定义选择,比如选中网络搜索,它就会使用我配置好的 tivoli 这个服务商来进行 ai 搜索。输入斜杠命令,能够添加本地附件,选中本地知识库或者管理日常使用频率比较高的提示词, 他的模型切换是在上方,可以随时切换不同的模型来回答任务。我觉得最有意思的是,他可以开启多模型同时回答,点击 at 符号,然后就可以勾选多个模型。我这里选择三个,但实际上还能够选择更多。 然后在下面的输入框输入我的问题,比如我想让他帮我分析二零二六年世界杯的夺冠热门,按照多个维度来进行评分,包括世界排名、最近成绩等等,并且按照我指定的格式来输出结论,最后要求尽量联网来获取最新数据, 然后就能够看到三个 ai 模型在同时开始工作,不同模型的反应速度也不一样。那在这个过程中,你能够直观的感受哪个模型工作速度快,哪个模型回答质量更高。 其回答速度更快的是 deepsea v 四 pro, 它是最先回答完毕的,基于它获取的数据预测冠军是西班牙队。我录制视频的时间是七月十七号,所以最终的比赛还没开始,不过发布视频的时候应该世界杯已经结束了,到时候可以看一下哪个 ai 预测的更准。 多个 ai 同时工作,也能够最大程度的降低单个 ai 回答问题时候可能出现的 ai 幻觉等问题。 kyoto studio 支持把 ai 的 回复内容保存添加到笔记中,尤其是一些比较长的回复,信息含量比较多。 它有一个专门的笔记功能,支持 markdown 格式的直接渲染,并且还内置了一个编辑器,可以随时查看或者编辑修改笔记的内容。 这一次 vr 更新的重点就是让 a 建更好用了,点击左侧的工作按钮就能够来到智能体界面,那之前 chris 九六六是一个主打 ai 聊天的客户端,那现在升级为 a 建特,自主执行的一站式 ai 工作台, 一些复杂的任务,比如让它本地写项目代码输出调研报告等等,都可以交给具体的。 a 建特智能体这个页面默认内置了两个 a 建特,一个是 cherry assistant, 点击编辑智能体,就能够设置这个 a 建特的主模型以及 plan 计划模式下的模型。 默认 a 键的内置提示词也能够手动修改,并且内置了一些本地操作的工具,比如和文件相关,和终端相关的等等,那这些也能够自定义开启或者关闭。 m, c, p 和 skills 也能够在这里面进行直接管理,那看起来也是比较直观的。接下来我们创建一个智能体, 点击左上角添加智能体。我想创建一个和编程相关的智能体,那名称就叫做编程助理。需要添加描述和系统提示词,那这里为了方便,可以直接让 ai 助手帮我们写一个。 可以直接和他说,我想创建一个编程 a 键的工作是写一个好看的独立网页,需要写描述和系统提示词。能够看到他这里的回答还是非常详细的,并且还给出了好几个不同版本的系统提示词,那我这里选一个不是特别长,适合实际使用的版本, 那因为我前面说用来写好看的独立网页,那所以提示词里面主要是关于前端网页设计相关的约束。 我们直接复制,然后粘贴到 a 键的系统提示词这里,然后点击下一步。第三步是添加技能,也就是 skill, 它内置了两个 skill find skills 和 skill creator, 分 别用来查找和创建 skill。 它也内置了一个非常方便的在线搜索 skill 的 功能,比如搜索规章,就能够找到规章老师发布过的 skill, 可以 在这里直接一键进行安装。如果想要查看项目的 github 地址,那点击这个按钮就能够直接进行跳转 skill。 安装好之后,点击勾选这个 aint 需要使用的 skill, 然后点击新建,那这样的话一个专门的 aint 就 创建好了。 那创建好 aint 之后,可以给它指定一个工作目录,那以后产生的所有项目文件都会在这个工作目录里。 那当前网页的布局最左侧是切换至整体,中间是对话区域,那右侧是侧边栏,可以查看文件或者预览网页, 这里让他帮我写一个个人网页来输入提示词,那这个提示词也可以直接让 ai 助手帮你写,那我这个其实就是让 ai 助手帮我写的,让他帮我写一个极简风格的个人主页。页面结构需要包括这几个主要部分,那整体的要求其实非常简单,并不复杂。模型我这里选择的是 deepsea v 四 pro, 虽然我并没有启动计划模式,那他还是先规划整体的设计以及查看当前的项目文件,再进行具体的操作, 整体的执行速度还是比较快的,大概花了三分钟左右的时间。那对话框这里也介绍了这个网页的模块,右侧侧边栏在当前的项目文件夹里面多了一个 html 文件,那直接点击这个文件就能够在侧边栏里面直接预览了。 因为右侧的区域是比较窄,所以这个视觉效果更接近于手机浏览器的展示,那适配的也是还不错,可以把侧面上放大,那这样看到的就是正常的浏览器的一个样式了。整体上我是比较喜欢这种简洁的风格了,并且我的提示词也非常简单, 但是页面布局以及各个模块的展示也没有太大的问题,那更重要的是 ai 味不是很重,那有一些使用 ai 创作的前端网页, 无论是配色还是布局都比较花哨,那相比之下我是比较满意当前的风格的。如果要想让它变得更实用的话,还可以把实际教程通过超链接导航到自己实际发布的平台上,或者建立独立的文档网页,把内容沉淀到这个网站上,那这个过程可以和 agent 不 断对话来进行调整。 那下一步是如何把自己本地创建的 html 网页来部署到公网上,让所有人都可以访问。把网页部署到公网上有很多种方式,比如使用 gethelp pages 进行部署, 使用 wordpress 进行部署,或者直接使用 mcp, 比如 a j one pages 来进行部署。那具体的步骤可以看我的这个图片。那我这里推荐最简单并且也是最方便维护的方式,就是直接使用 gethelp pages 来进行部署。 来到 gitlab 的 这个网站,首先来创建一个公开的仓库,如果不希望公布原码的话,也可以改成所有仓库,或者使用 word excel 进行部署,然后把这个地址复制下来, 来到前卫 studio 中,和你的 agent 说,帮我把这个项目代码上传到这个地址,或者说部署到这个地址。如果你本地还没有安装过 gitlab, 并且和 gitlab 进行账号绑定的话,可能需要绑定一下, 因为这个 a 键它具有背时权限,可以执行本地命令,所以它可以把当前的代码推送到 gitup。 推送成功后,来到 gitup 页面,在 setting 这个页面找到 pages block, 这里选择 me 分 支,点击 save 进行保存。那最后一步是到 actions 页面,就能够看到 pages 正在构建和部署, 等待大概不到一分钟的时间,那变成绿色就说明已经部署好了。我们点进这个链接里面,找到这个项目的链接,这个网站就是所有人都能够访问的公网的网站了。如果说你做了一个 html 页面,想分享给朋友,也可以直接通过这种方式来进行分享。 后续只要 github 的 这个项目代码发生任何的变化,那 github 配置就会自动重新构建和发布。比如我在项目文件里面放了一张图片,让 agent 帮我把它放到推荐教程前往 studio 的 封面上面, 然后把 s u g 放到合适的文件目录下,那等待一会儿,它就会把图片归到专门的文件夹,并且本地代码也修改好了,我再让它把代码部署到 git hub 那 部署成功之后,我们在 action 这个界面发现它正在重新部署和构建,那这个过程其实我没有进行任何别的操作。 部署完成之后,我们来到这个网页,直接刷新这个封面图,就直接替换上去了。 ok, 那 这个就是使用 cherry studio 的 a 键功能,帮我完成代码编辑以及上传到 github 的 步骤。 除了以上功能之外, cherry studio 还有很多实用的功能,比如知识库。在知识库的这个界面,点击右上角的加号添加数据源,可以添加文件、笔记、目录和链接。不过使用知识库需要先添加一个嵌入模型, 容易将知识库的内容转化为向量。我这里添加的是归机流动的 a p i, 也是免费使用的。创建完知识库之后,在对话中可以通过斜杠命令或者加号来选中这个知识库进行对话。 比如我导入了之前比较火的挽救计划的原著小说,然后提问,我想知道挽救计划中波江做人的特征、文化习惯和生存条件等等,那它就会基于知识库的文本内容来回答问题, 这样的话也能够有效地避免 ai 幻觉。 code switch 功能能够帮助大家快速地安装目前市面上主流的 ai 编程工具,比如 color code、 codice、 加密的 c l i open code 等等。并且在这里面就能够直接地配置第三方的 api, 不 需要安装其他额外的工具或者去修改编程工具中的配置文件。使用快速入手,能够随时随地地调用 ai 大 模型进行对话。那我的快捷键是 cmd 加 e, 这个就可以用来快速问答,日常使用的话其实非常方便,因为这样就不用再单独的打开一个应用或者网页去提问了。华辞助手这个功能开启之后,在全区都可以使用它进行翻译, 不仅局限在单一的应用场景,那比如这个是 safari 浏览器,并且我在这里面没有安装别的翻译插件,直接选中就可以用自己配置的 ai 模型来进行翻译,速度也是比较快的。那本地的文件也可以,比如这个是 opc 中的 markdown 文件,也能够直接调起快速翻译的悬浮窗来进行翻译。 ok, 那 以上就是关于 cherry studio 的 大致介绍,如果你没有使用过的话,非常推荐你去尝试使用一下,它可能直接替代你手头上正在使用的多个 ai 工具。最后感谢大家观看本期视频,那每一期视频我都会分享关于 ai 产品的使用经验,我们下期视频再见。拜拜!

ai 界一夜之间大洗牌,所有 ai 软件一夜之间成为过去式,一位新王悄然崛起,几何倍性能超越目前 ai 所有软件,它就是新登上最强生产力工具的 mini max。 三,是一款真正意义上分币不花的良心软件。拒绝隐藏扣费项, 拒绝暗测计费的门槛,拿来即用,永久免费。只要是我粉丝,全给你们整理好了,八百八十八拿去研究。 哈喽,大家好,这节课我们一起来学习图生图工作流的搭建,以及它的背后运行逻辑。首先我们还是来到 conflicty 的 默认工作流,那接下来该如何去搭建最基本的图生图? 首先我们看到 collision, 咱们把它呀给删去,然后在这 k 采集器的雷点输入拖出来,然后选择 ve 编码。随后呢,我们看一下这个 ve 编码,它一共有两个输入,分别是图像以及 ve 模型。那我们来看看 ve 连哪呀? 哎,那么这一整套工作流里面是不是只有这空有 v a e 的 输出,所以我们连到这儿,那接着这个图像我们拖出来加载一个加载图像节点。好的,那么自此咱们的图生图工作流就这么完成了,其实和最基本的纹身图非常相近,只不过多了一个 图像输入。那接下来我们来看一下它具体该怎么使用吧,比方说我这边上传一张金发双马尾少女,接着我们把正向提示词给稍微编写下,记得先写质量词汇,比方说杰作高质量,然后再写主体,主体的话我们就来个 one girl 吧,一个女孩好了,就写这么多 副象提示词,我们还是来一个 easy negative 这一个副象提示词词组包,咱们把大模型先换成一个动漫类大模型, 选择动漫 prime, 当然其他的也行。接着我们直接点击生成,我们可以看到咱们这张图像吧,你说它和我们的上传图片有什么关系?其实近乎于没有关系,对吧? 那么这是怎么一回事呢?这边我们就需要看到 k 彩样器内的降噪值,这个降噪值啊,就控制原始噪声添加的比例, 比方说现在降噪值为一吧,相当于什么?我们输入的这张图像,它上边会布满了降噪值,那大家可以想想,这和我们输入一张纯噪声图像有什么区别吗?完全没区别。 那反之,如果我们降噪值为零的话,会发生什么现象?咱们先跑一次。哎,现在可以看到,此时啊,咱们的声称图像和原图是完全一致的,那么这是因为 对于我们输入的图像因为降噪值为零的缘故,导致一个噪点都没添加。那大家可以想想我们 diffusion 模型,对吧?咱们的 diffusion 预设原理就是给创往不断的降噪,从而生成新的内容, 但现在我们一个噪点都没有,咱们从哪去降噪啊?对吧?所以说自然而然,那就和我们原图完全一样了。但如果说我们把这个降噪值给设置成零点五的话,我们来看一下会发生什么样的神奇变化。哎, 此时发现了没有,他和我们的原图怎么样啊?是不是非常的近似,对吧?比方说像这个金色双马尾以及他的红色蝴蝶结,那么这就是降噪值所带来的影响。 ok, 现在我把随机种给固定一下,然后换一组种子纸,我们再跑一次试试。 ok, 那 么我们第二次深图还是和原图 非常多的相似之处,对吧?比方说整个人物的姿势以及他的发型、发色还有服装。而我们在正常的升图流程中,降噪值为零点三五到零点六之间,咱们生成的图像就会和原图较为近似,而如果设置的是零点六甚至是零点七五级以上, 那么我们就将赋予 ai 更多的想象空间以及自由发挥空间,对吧?比方说我们把降噪值设置成零点七,然后再次张图,咱们可以看到最终图像和原图是越来越不近似的。不过我们可能会发现一个小问题啊,这个是题外化 什么问题呢?大家发现没有,我们的生图怎么感觉总是灰蒙蒙的?比方说我现在在换一组种子植再次生成,哎,对吧?感觉到这个色彩不是很鲜艳,怎么回事?这其实和我们的 ve 有 关,上节课我们提到了 ve 一 般是由咱们大模型所提供,但有时候吧,大模型它匹配的 ve 啊,不是特别好,还不如一些社区玩家所发布的 ve。 比方说像这个 primax 吧,我用的这款大模型,它自带的 ve 表现出的色彩不 弄得理想,那怎么办?我们先把 ve 解码以及 ve 编码的连线给断开,然后我们在随便一个 ve 解码或 ve 编码都行 ve 节点中拖出来加载一个 ve 模型加载器,哎, 那么现在我们可以看到这加载器里面我们可以自由的选择不同的 ve 模型,那这边因为我们生成的是动漫类图片嘛,所以选择这个安德美 ve 动漫 ve, 那 接着再把它和 ve 解码,与 ve 编码相连,此时我们再跑一下, 大家可以发现,是不是图片瞬间就变得鲜亮了?好,那么解决完这个小问题之后,我们继续来看一下降到值。有的小伙伴可能会有点疑惑, 哎呀,这个降噪值,它究竟是怎么做到让生成图片与原图近似或不近似呢? ok, 那 么我们来看下这一张图生图的完整逻辑。在我们图生图工作流中,不同于纹身图的是, 它一共输入了两种信息,一种呢就是图片的信息,一种呢就是文本的信息。刚才我们不是编写了提示词吗?对吧? 在我们上节课所讲的纹身图中,只有一种文本编码信息。 ok, 那 么问题就来了,如何把咱们的图片信息对编码成一与电脑处理的相关信息流呢?这边我们用到的就是 ve 嘛,我们可以看到这个绿色的三角形啊,意思是 ve 编码器它的作用, 这可以把我们输入的图片给占为成浅空间图像,而这些浅空间图像不同于上述空间图像,他们是看不见的,同时呢,尺寸也会更小, 更异于电脑去处理。那之后 v 域编码器会把这些编码之后的前空间图像给发送到 k 采集器,在 k 采集器中,我们来看看 它会干嘛?它会添加噪声,对吧? add noise, 而这一个添加噪声到底该添加多少呢?这边就是我们降噪值所控制的了,正如我刚才所说,如果我们降噪值为一,就相当于为我们输入的这张前空间图像直接 噪声加满,对吧?整张都是咱们所添加的噪声,这也意味着在这种情况下和一张纯造成图片没有任何区别。同时如果造成值为零点五吧, 那可能就会,哎,添加噪声的幅度就不会很大,哎,对吧,零零星星的。好的,在添加完噪声之后啊,我们来看一看,这个 layton 图像就会被发送到咱们的 u 内模型中进行降噪吗?那么这等同于纹身图的什么呢? connor 输入呗, 对不对?只不过此时的空内存是有内容的,而不是一个完全空白的内存图像,也就是前空间图像,咱们上节课所运用到工作流的空内存。意思就是,哎,直接输入一张没有任何内容的前空间图像,不过呢,尺寸是我们自己定嘛,对吧? 好的,那我们来继续看这个图,升图工作流,一张有内容的前空间图像被发送往了虚拟模型中镜。降噪还需要什么元素啊?当然就是我们的 合成酱料嘛,这个 type in bedding 也会参一角,哎,来指导咱们这个图像的生成,来指导降噪的走向,对吧?比方说,我想生成的是一个 紫色头发的女孩,那么她就会结合着我们输入的前空间图像一起来完成降噪,不断地去往这个紫发女孩的方向去靠, ok, 那 之后也是进入到我们上节课所介绍的降噪啊迭代流程。 经过咱们采用步数的次数迭代降噪之后,咱们的优量模型啊,就会把处理完的浅空间图像发往 ve 解码器。因为我们是看不见浅空间图像的嘛,所以他必须要有个转换接头来把浅空间变成像素空间图像, 那之后咱们的 ve 解码器就会把之前的所有信息内容解码成最终生成的 ai 图像。我知道啊,这么听起来可能有点晕,咱们结合着康复与 i 工作流一起来看一看。 比方说像这一套简单的工作流吧,咱们的图片输入是啥?那答案就是加载图像的这张金发双马尾了,对吧?而咱们的文本输入呢,就是咱们的正负相的,这是词, 这两个啊,他们会经过 k 模型给编码层蕴涵着很多信息的特征向量,对吧?这个小盒子会被发送往 k 太阳器,哎,被发往了 k 太阳器。而同时呢,这个小盒子将结合着我们这个原始图像,经过 v 编码之后,再加上噪声的图像,哎,对吧? 比方说零点七,哎,加了一些噪声,然后一同在 k 采暖器内进行降噪。最后我们可以看到 k 采暖器有一个 lighten 输出,那么这个 lighten 输出 就会把我们之前的 lighten 图像,也就是前空间图像发送到 v e 解码器,从而完成前空间到像素空间的转换, ok, 比方说,把我们现在关键词加一个粉色头发 pink hair, 然后把降噪改成零点六五,步数设置为 二十五步, c f g 值为六点五。然后彩样器和调度器,我们上节课也介绍过,咱们一般彩样用的是 d p n 加加二人,哎,也是 d p n p p 二人,调度器一般用的是 chaos, 然后点击执行,我们可以看到啊,大家发现了吗?图片是不是尽量地往这个粉色头发女孩方向去靠? 咱们再把这个降噪值往下调,比方说零点五,接着再次跑图,咱们就可以发现,因为降噪值较低的缘故,咱们生成图片就会和原图更为近似,所以改动的幅度不会过大。但是,哎,咱们细心观察还是可以发现,像这张图片,他的头发 确实蒙上了一层粉色,甚至是他的眼睛也变成粉色了,对吧?那么这就是降噪值结合着文本与图像输入 共同造就的结果。 ok, 那 接下来我们就把以上的理论知识给转换成一个有趣的动漫转真人小案例,怎么做呢?大家可以想一想,咱们降噪值是不是可以控制生成图像与原图的近似程度?而我们的最终图片生成的整体风格是由什么决定的呀? 一共有两种,第一种是提示词,而第二种是最为关键的大模型,要注意大模型的影响可比提示词要多的多,所以我们这边直接把大模型给选择一个写实大模型, 然后我们在关键词的结尾加上一个写实风格 realistic style, 接着把 v a e 加载器的 v a e 给替换一下,换成这个 a c 叉 l v a e, 随后开始生成。 ok, 我 们可以看到啊,图片的风格是发生了一些转变,但是程度还不够, 并且我们得把刚才这个粉色头发关键词给删去,不然会影响输出效果。那既然这个风格转变程度不够的话,我们就 提高降噪值嘛,让 ai 去发挥更多的想象力。咱们直接先设置为一个零点六五吧,然后 ctrl 加 enter 快 速生成, ok, 那 么现在 感觉又有点太过了对吧?它和原图相似度太低了,那么我们就继续去调整咱们的降噪值,直到为一个较为合适的数值为止。 ok, 就 这样我们成功把这张动漫图片通过简单的图声图降噪的方式,就变成了一张写实风格图片,那么这个方法也可以算是最简单最容易的一种风格转换方法。后续我们会学习更多进阶内容,让图片变得更为可控。 比方说像咱们生成图片的姿势啊,面部表情啊,他的线条背景深度关系等等,这些都是可以通过后续的看出来来进行控制的。 好,那么以上就是关于本期的图虫读教学,我们下节课一起来看一下咱们之前所用到的这些模型去哪找,以及 ai g c 的 相关网站都有哪些?好,那么我们就下期再见吧,拜拜!