粉丝179获赞1605

我是南朱,今天我们继续来学习空投 ui 当中的浅空间,浅空间的话是在我们学习空投 ui 当中第一个需要学习的知识点,也是一定要掌握的知识点, 但是它可以用一句话来进行说明,但是它底层的逻辑怎么来的?就是需要我们认真完成这一节视频的核心。 我们举一个实际的例子,首先我们拿到一张五幺二乘以五幺二的一个尺寸的图片,把它丢给我们的 comui, comui 呢,它有一个节点叫做 ve, ve 进行把我们这个五幺二乘以五幺二的图片进行编码,因为他这个图片他不编码的话,我们的模型他是不认识的,所以他要进行 ve 编码处理,把这些数据图片的数据让我们的模型能够读得懂, 所以经过 v i 一 编码处理之后,我们会针对这张图片,也就是五幺二乘以五幺二这个尺寸的图片进行压缩, 呃, v i 的 话就是统一压缩八倍,也就是我们这个五幺二宽和高都会压缩八倍,所以到最后面我们通过 v i 一 编码得到的图片呢,就是变成了六十四乘以六十四的这么一个浅空间的一个像素块啊,也可以理解为是代码块、数据块, 这个呢就是我们通过浅空间他的核心处理,虽然一句话可以概括他的流程也是很简单,但是他怎么来的,我们还要去详细的进行拆分和学习。首先我们回到这里 like 呢,这个是我们结底的名字啊,后面我们会一步一步通过咱们工作流来去实际的案例去学习,但是在学习工作流之前,这一些 知识点我们就一定要进行提前掌握,这样一来的话,我们底层逻辑有一个详细的思维了,那我们再往下学习的话,就没有那么根基不稳。 我们刚才说到了一张就是压缩八倍,就是长和宽多压缩八倍,得到了一个六十四乘以六十四的一个前空间大小的一个像素快,但是他本质意义上他怎么来?我们通过这个实力来进行说明, 因为我们通过手机呀或者是电脑看到的所有的图片,基本上都是基于 rgb 这个三色模式来给我们显示的,也就相当于说红、绿、蓝这三种颜色基本上包含了所有的 图片好,所以这一张普通图片丢给模型之后,它这里把它转换成像素值,它都会乘以三,也就是我们的 rgb 模式乘以三。那么这样一来,我们总共得到的 这个数值,也就是我们的像素值只有七十八万六千四百三十二个啊,这个是我们五幺二乘以五幺二的像素值的总个数。 我们刚才通过画图的方式 v i e 编码会对我们这个图片原始图片进行一个压缩的处理,最后面把它变成了六十四乘以六十四,也就是长和宽压缩的压缩八倍之后,变成了六十四乘以六十四, 但是这里有一个乘以四,这个乘四是针对于 copy 当中 v i e 编码,也就是前空间里面, 它必须要有这么一个通道来帮我们完成,因为前面 rgb 是 通过颜色的方式显示出来,让我们人的眼睛能够看得见。 但是我们 v i e 编码器它的核心作用就是把一个像素图片转换成模型能够读得懂的,那么所以说这个六十四乘以六十四,再乘以四乘四的过程当中,就是把这个数据转换成 模型能够读得懂的一个通道值,所以它们的作用一个是服务人的眼睛,一个是服务于模型,这个是他们这个数的区别。那么 ve 编码器把它压缩成八倍之后,得到的像素值就是一万六千三百八十四个, 但是在这里告诉我们不是是六十四倍,告诉我们的是体积缩小了四十八倍, 这个四十八分怎么来呢?不是六十四吗?怎么最终变成了四十八倍?这里的话就有一个额外的知识点,就是我们刚才讲到的通道四通道,这里只有三通道, 那么我们等一下再来讲一讲这个四十八倍到底是怎么来的,那么从这里我们应该知道就是无非就是把一张二五幺二乘以五幺二通道啊,人能够看得懂的图片压缩成模型能够读的懂的 数据啊,令和他们的体积总体缩小了四十八倍啊,这么一个过程,那么我们通过这个数字来解释我们关于这个压缩号的四十八倍里面的数据和它的空间,就是我们称之为浅变量。 因为在编程当中啊,我们在计算机里面我们都知道就是程序游戏运行时产生的数据啊,都保存在内存当中, 而内存你又可以把它当成是一个格子,而格子里面才是真正要保存的数据,那么有格子,格子里面的数据还有一个名字,我们就把它叫做变量,而在 copy 过后的数据 和包括它的体积大小,那么我们都称之为浅变量,而我们所在里面的 就是我们刚才讲到了六十四乘以六十四乘以四,哎,这么一个体积大小,我们把它叫做什么浅空间啊?用来用来这个空间是用来干嘛的?用来真正的装数据用的啊,这里一定要搞清楚。哎,有一个浅变量,浅空间, 浅变量是我们的总称,而我们的浅空间呢,包含在咱们的浅变量当中。 好,这里我们有一个表格,我们看一下这个表格的数据呢,还是按我们刚才讲的五幺二乘以五幺二宽高的一个正方形的图片,这个图片是像素图啊, 因为它是给我们人看的,也就是我们人能够看得到的,它是一张照片,那么它都是基本上都是基于 rgp 三通道,而我们潜空间是给模型看的,它是四四通道, 所以它们的这个种植像素种植我们得到了,然后呢,它们最终得到的结果是四十八, 但是这四十八我们要详细的来进行说明,否则的话,哎,这四十八怎么来的?你不是说缩小八倍吗?怎么又变成四十八了?是不是?这个这个结果是不是产生了一个混响? 虽然我们得到最终的压缩比是四十八倍,但是这四十八倍啊,这个数字是混合结果, 因为这里面包含了像素和通道这么两个概念在里面,所以把这四十八我们就可以拆分成两个计算,第一个计算,因为我们五幺二乘以五幺二,通过 v i e 编码, 我们都压,就是压缩了八倍,所以空间压缩比就是六十四倍啊,这是图片的空间压缩比就是六十四,但是通道反而在我们的前空间里面,它进行了一个由三到四的一个递增, 由三变成四通道,所以通道膨胀反而是原来的一点三三倍,所以他们六十四乘以一点三三,最终得到的结果就是四十八 啊,这四十八就这么来,一个是空间维度,一个是通道维度,这一点我们一定要搞清楚, 因为虽然我们通过这个图,但是我们这里也讲到了空间被压了六十四倍,但通道反而多给了一倍容量来进行补充,这里可以给你们埋一个知识点,哎,他为什么要多一个通道,这多出来的通道是干嘛的?待会我们就讲详细讲解。 我们对于这个五幺二乘以五幺二的图片,如果说对于刚开始学习康复 ui 的 同学,那我们就可以举一个例子,通过生活当中一些啊常见的例子来进行说明,这样子一来的话,就帮助我们那个啊,非常具象化的那个掌握。 如果我们把这个五幺二乘以五幺二的图片啊,想象成是一本具有七七十八万六千四百三十二个字的 一个小书,然后呢 v a e 呢?那就把它改写成了只有一万六千三百八十四个字的浓缩的一个书记。那么从字数来看,从书的页数来看,那么肯定是薄了四十八倍, 数字上说明了一切,但是我们要搞懂的是,你虽然把它删掉了四十八分之,就相当于说删掉了百分之九十以上嘛 的字,那么这本书还能称之为一本书吗?这才是核心,因为我们的 v i e 它的目的是要做么?做这么几个内部的处理,这几个处理我们可以总结为第一个把重复的内容合并起来,然后用一句话来进行描述, 然后呢把具体的颜色啊,数值啊,就不再是用具体的内容进行数值或者是颜色来表达,要把它全部转换成模型能够读得懂的语义标签, 他这个语言表达,例如这里是眼睛,这里是阴影,这样一来的话就更加具体化,模型就能够懂,所以最终压缩成百分之九十五以上九十八,哎 v i e。 最后面把这本书再进行进行解码, 那么最终还能够原方不动地得到一本完整没解过的小说出来,这就是我们 v i e 的 一个核心。 好了,我们通过一个小书的事情理解到了 v i e 的 一个解码和编码,编码是把一个图片编码成模型能够懂的数据解码呢,就是把模型已经处理好的图片, 把它变成人能够读得懂的啊内容出来,所以编码解码这一块我们一定要搞懂。 呃,然后我们刚才讲的整体的压缩是四十八倍,但是空间压缩是实打实的 ve 对 空间像素的空间,图片的空间是真的是由五幺二变成六十四,就是真的压缩了六十四倍,但是这六十四倍 我们是一步到位,还是说怎么样个处理呢?这里的话我们只要了解即可,不做深入的讲解,因为这里的话我们要讲到神经网络这一块,但是我们有有感兴趣的可以自己去学习找到资料啊,但是我们这一点我们就不做详解, 空间实打实压缩了六十四倍,那么它是经过几个步骤来完成的?是经过三个步骤,我们来看一看是哪三个步骤。第一次我们读入的是原图片尺寸,也就是我们的五幺二乘以五幺二 进行第一次裁样,就是把我们原尺寸进行除以二,得到的是二五六乘以二五六。 第二次呢,在二五六的基础之上再除以二,以此往内推进行三次相除,最终得到的结果就是六十四乘以六十四。 所以从数学来讲,那么三次除二得到的结果就是二的立方单边来计算,就是 都压缩压缩了八倍,所以空间的压缩就是咱们的六十四倍 啊,这里得搞搞清楚啊,这里不是说八倍,我们要关键的要搞明白,这个是倍数,是指的每条边缩小八倍,而我们这个图片是二维的,所以面积也就是我们的像素总数, 就是我们长乘宽,也就是八乘以八等于六十四啊,一定要搞清楚,是倍数啊,不是实际的像素啊。 好了,对于这一个我们讲到的这个图片压缩,它为什么五幺二压缩翻倍之后得到了六十四?那么如果说后面我们是幺零二四呢?同样的道理,它也仅仅只是进行了八倍压缩的一个处理过程,好,一定要搞清楚。 好,我们继续。那么我们再来讲一下, 你说我们八倍的压缩,它是分三次是吧?那么我们如何变相形象的来理解呢?我这里就举了个例子,我们就从地图啊分,例如我们看到没,这个地图我们放到放到,放到最大,我就随便找个地方, 好,因为我这个地方我就在这里,你现在在这个地方,我当面能够看得清楚,哎,我回头一看,后面是什么,前面是什么,但是 你看在眼里,只是你看到的模型,他不知道,模型要知道,哎,这是什么东西?你在哪个地方,哪个位置,他需要是这些东西,所以你第一次压缩之后,哎,看到了,哦,原来我是在这个啊,体育馆这里有一个什么高速,但是这还不具体啊, 对于某些人说,你这个范围太广了,你再一次进行干嘛?再一次进行缩小,这个时候我们又看到了我们的街道,我们每一条街,我们每个小区不见了,我们看到的是以街道为 说下出来,哎,这是高速,这是哪条街,这是哪一条路啊?这个时候他的清晰度就越越越来越高,哎,我在这条路上面,但是你在这条路他还可以干嘛?他还可以进行说法,哦,原来你在哪个区, 再说法,哦,原来你在哪个省,哪个城市,那么这样一来,我们的模型最终的核心就是知道你在哪里,这是什么东西,这个是模型需要得到的, 所以不是越小越好,它的核心是通过这三字对折来知道你具体是什么东西。所以这里讲到了一个语义, 每一次缩小细节消失,核心的目的就是让我们模型知道这个图片,这是什么东西。例如地图,这里是什么地方的定义就更加清晰。 就好比如你,别人问你,你是哪里的,你不可能说你老家是什么地方,你跟他说,哎,我是某某省某某市,那么别人就更加清楚了啊,一个道理 啊,核心的话就是空间压缩的本质,就是用细节换羽翼密度啊, 这里的话就是对于对折的核心,我们的作用就是让模型知道干嘛呀,这这个内容具体是什么东西,让它来定义,越来越清晰,也就是控制它的这个什么羽翼的密度。 好了,讲完这里我们刚才讲到了一个 rgb, rgb 对 应的是三个通道,红绿蓝,而我们的这个浅空间里面就有四条通道。那我们先说一说这三通道,红绿蓝 包含了我们所有那个就是红绿蓝包含了所有那个成图片的颜色,你看到的图片基本上都是基于 rgb 的, 那么红绿蓝这三个颜色呢?只是显示器的 啊,能够理解的属性,为什么?因为最终显示器它是我们把它呈现在我们的面前嘛?所以 rgb 是 怎么把光打到屏幕上,让人的眼睛看得到,哎,这是一张照片,哎,这是一个小区,这是一个人。 而我们刚才讲到的是模型,它的模型不是让你看到它,这是一张照片,而是让我们知道里面的内容,这个照片所代表的里面的内容是什么, 所以我们通过红玉兰看到的是图片,照片是人能够看得到,不代表咱们的模型。 专业的来说就不是这张图片里面的内容,他根本就不知道图片的内容是什么,所以 rgb 描述的是呈现方式,不是我们的这张图片数据本身,说白了就是专门服务我们人的眼睛的, 搞清楚啊,服务人的眼睛,而我们的这个潜空间则就是给我们大脑理解的,也就是给模型理解的, 而这个四怎么来?那不是六,也不是十,也不是二,也不是十六,而这个四刚好是 vr 一 大量计算,大量的一个计算处理,所以它是从海量图片上自动选出来的,是四个抽象构成维度。 哦,那么这样子一来我们就明白了,我愿意他自己总结出来哦,通过大量图片的分析,总结出了四个抽象伟大,就能够描述出你这张图片的内容是什么,让我们的模型能够清楚的理解。 通俗的理解就是 rgb 就是 红墨水、蓝墨水、红绿红墨水、绿墨水和蓝墨水三支笔来进行画画, 而我们的潜空间就是通过这四支笔,结构笔、光影笔、材质笔和羽翼笔,最后新增的这条笔就是羽翼笔,这样子以来他的目的就是用来描述的话的内容和含义是什么, 好,这就是我们的区别。呃,最后面我们要针对于他们这个像素之间和倍数之间要作为一个总结,也是我们本次视频的核心。例如刚开始讲到七 十八啊,七万啊,七十八万,六千四百三十二,到我们的这个一万六千三百八十四和四十八倍,他们无非就是很简单,从三个点,第一个空间上砍了六十四倍,不是四十八倍啊,空间上是砍了六十四倍,他就是 把我们通过这三字对折,把每一块砖,因为砖是具体细致的,不能再细致了,把它抽象成这是楼, 把它更加的干嘛呀?语义,哦,把它更加的语义语义化,就是相当于说,哦,你这是什么东西?你这什么东西在哪里?具体想表达什么意思?这个,这个是给谁看的?这是给模型看的。而通道上呢?增加了啊,通道上变到了一点三三倍 多出一个通道,就是用来装羽翼,抽象出来的羽翼,不然的话,你,你把内容抽象成羽翼,你得有地方装才行啊。是不是通道就多给了我们一个在信息上,我们要做选择,要保住我们人在意的细节和情,在意的细节和情节, 那么把那一些不在意的不重要的内容就他妈删掉。所以通过这三次这三场取舍,我们才能够我们的 ai 在 我们的显卡上,低低显卡 就能够以四十八倍降本的方式去跑出来,否则一张五幺二那么多的像素值去跑, 你没有进行对折,没有进行压缩,你十分钟,那么进行四十八倍压缩,四十八倍,四十八分钟,那你只要一分钟就能够跑出来啊,这就是它的核心。嗯,注意的地方就是紫色代表的是我们的前空间线,也是雷腾线, 我们一定要搞清楚前空接,为什么我们要特意需要花费一个视频来进行讲解,我认为他是空浮游玩当中必须要掌握的一个细节,不然的话,你老是拿别人的工作流去进行运行啊,去进行修改,而最基本的基就是基石你都丢掉,那么 到后面你想自己去做啊,智能题啊,做节点啊,我觉得就很难了。好了,今天就到这里结束。


搜索抖音号应搜不出来,搜不到对方抖音号的原因是有很多的,首先看手机网络是否正常,检查一下我们搜索的 id 有没有错,特别是 id 中有数字和字母的,哪怕是字母的大小写错误,也可能导致搜索不到。 还有一种可能就是我们搜索的 id 因为各种原因可能被封号了,违规抖音社区规则的会被封限外里,这样我们肯定是搜索不到对方的 id 的。

好多人说我现在读高中啊。呃,怎么不去上学啊?当当当当,我已经毕业了,这是我的毕业证刚拿到的,因为我读书读的比较早嘛, 二十岁就大学毕业了,所以呢,成绩也不太好,不算太意外。我当时报这个学校的时候,我妈就说,呃,攀不上好的学校,到时候 就选一个离大城市比较近的。到现在毕业了,选的这个专业真的是回来之后一点用处都没有用上, 就是我感觉自己真的从来没有达到过他们的期望。我小时候可能希望我当一个乖孩子啊,然后大一点的就希望我成绩再好一点, 但现在就希望我自己能够独当一面。到现在了,工作和生活都要靠他们,有时候我就会想,能不能突然给我绑定一个什么系统啊,直接给我变成超级大学吧。当然那也只是想一想了, 就是现在在家里面也希望自己能够真的学习到一些有用的知识,从现在开始一点一点积累,去呃,扩充自己。就是,也不用一下子变得有多厉害,只要今天比明天多一点点就可以了就好了。

抖音被拉黑后,还有办法看对方视频吗?好,现在这两个是正常的好友关系。拉黑之前是可以进入对方的主页的,就是可以看到他的作品,现在我们直接把他给拉黑,右上角三个点,然后这边有一个拉黑,确认拉黑 好,我们再重新返回,然后进入他的主页,拉黑过后对方的主页是这样的,那么还有什么办法能够看到他主页的视频呢?我们先返回进入抖音设置, 然后往下边翻最下边一项退出登录退出。 好,现在我们点击右上角的放大镜,搜索一下对方的昵称,当然如果是抖音号更好, 好,又能看到他的作品了,我们点击进去就是这么简单,有这方面困扰的朋友可以去试一下。