让古画火过来,哪家 ai 最强? google omni cds 可零千吻横向测评嗨,我是 kiki, cds 二点零火爆国内, google omni 号称万能,那么它们谁能让古画真的火过来呢?今天我拉了全球排名前六的视频模型, 就画齐白石的花重女侠,结果呢,有的让我这个研究了七年中国画的人感到惊叹。一条视频直接盘清楚, 谁才是水墨动画的神。由于测试了纯纹身,视频的效果太差,测评直接采用了文加参考图的模式,分镜语言和参考图如上国外片 google 的 omni 和 view。 先看 omni 点石成金,瞬息全宇宙。真有那么神?如果说 cds 是 垂直选手, 只做视频被你做到极致,那么 omni 就是 水平选手。他的设想是一个模型搞定文字、图片、视频、音频。那么实测下来呢? omni 的 完成度很高,八秒的风景基本跑通, 荷叶抖动,蜻蜓飞行,鱼游轨迹、生物规律都很自然。但是他的问题出在哪呢?主要在审美和认识。我给了他齐白石的荷花作为参考图, 但它深沉的荷花颜色太过于艳丽了,没有齐白石笔下红花墨叶的张弛有度,浓烈但清新的这种风格。 那鱼也是我给的参考,是由笔墨变化的手绘质感,但它输出的却像马克笔简笔画,水墨的韵味全丢了。可以说 omni 很 聪明,执行力呢也很强,但是它提高审美和对中国画的认识很有必要。第二个是 v e o 三点,一,只能说它完全没有走对路。 我的设定是荷花用洋红,但是其余全用墨色展现,但由于非有它限制,只能上传三张参考图,所以最终它给了荷花、蜻蜓和鱼的颜色,仿佛在锅里红烧过,根本没有理解我说的莫分五色。下面看国产选手视频方面,国内的模型各显神通。一是让我 最为惊叹的选手 cds 二点零,那它的使用路径呢?有小云雀豆包及梦,这个模型的生成效果值得我们静静观看。 最优秀的一点呢,是它几乎完整保留了我给他的参考图的神韵,荷花的形态,蜻蜓的纹理,鱼的笔墨质感都抓得很准。那有一个细节特别打动我的是,它的蜻蜓触碰水面时, 莲衣是用类似水墨笔法来展现的,而不是三维的水波纹。就这一个处理,就已经远远超过了前面的那些 ai, 这证明它理解了水墨画 是由笔墨线条来建构的,当然有三个小瑕疵可以说一下。第一个是他蜻蜓点水的路径太直了,少了那种轻巧灵动的感觉。第二是他最后荧幕里两条鱼的出现 稍显突兀,流动的轨迹不够清晰。第三是结局的全景画面给的不够,可以更有意境,但是这是对优等生的更高要求。客观来说,他目前就是最接近可交付水准的水墨动画工具,零基础但是有审美的普通人, 完全可以用它来做动画。其实呢,在这里我同时测了有参考图和纯纹身视频两个版本,结果放在一起,差距非常之大。有参考图的版本呢,荷叶的笔墨潇洒豪放,蜻蜓的绘制精细,工笔 齐白石,工血兼备的风格一下子就出来了。而纯纹身视频还是非常城市化的一个物品堆砌,这个对比说明了一件事, 限阶段,你想让 ai 制作出有味道的中国水墨参考图的合理选择和添加是重要一环。第二,来看看可零三点零作为一个国产模型,它在这次测试里暴露了一个与 google omni 相似的问题,就是对分镜语言的理解偏弱。我设定是最终画面分水上水下两个空间, 但他把虾和荷叶直接压在了一个平面。画面细节也存在问题,首先是荷花没有按照参考图的大写意风格变成了刻板的贴图,同时蜻蜓的比例也是偏大的, 但是可能还是有优点,就是它的手绘笔触感比较明显。部分物像的质感呢,其实是不差的,只是分镜理解和参考图使用的稳定性跟 cds 二点零还存在差距。第三,千万有两款视频大模型是 happy horse 和 one 二点七。那 happy horse 最大的问题是画面从头到尾有种 ai 独有的琐碎感,荷叶荷花变成了碎的块面, 那水墨笔触呢,被简化成了线描水,却还是走的三 d 显示风格,所以存在割裂。 这其实也是很多我们目前看到市面上 ai 动画看起来违和的重要原因。其次,虾的运动轨迹也不对,所以质感、笔触、材质、逻辑上这比快乐马都还存在问题。同门的舞板只支持两张参考图,生成的效果呢,也接近早期 ai 水平, 深沉的鱼感觉像在逛海鲜市场,也不具备可用性,所以比赛的结果很清楚了。和全球的大模型综合排名不同,在中国水墨动画这个细分领域,实测排名如下,首先排名第一名的毫无疑问就是 cds 二点零, 它是目前最强的水墨动画制作工具,接近了一个可雕符的水平。它保留了参考读的韵味,而且对于分镜语言的理解是正确的。 第二是 gemini, 它的执行力强,虽然审美还不够雅致,但它整体的分镜完整度是比较高的。它的缺点也很明显,生成结果是缺少了水墨的质感。第三是可灵,质感是尚可, 但是构图的理解能力是比较弱,它的优点也很明显,水墨笔触是比较强的。第四名是 happy horse, 画面琐碎感比较强。第五、第六名会给到我们的 view 和 one。 总结来看,如果想做出有中国灵魂的水墨动画,目前答案只有一个, c dance 二点零,零基础无门槛,也完全可以尝试制作。这次的测评也验证了一件事, ai, 它不懂中国话吗?其实不是的,它正在学习 c dance。 深沉的连衣线条说明了大模型已经开始理解了水墨笔法,但细阶段 想让 ai 画出对位的中国画,你的审美输入比它的算力更加重要。下一期想看我测什么呢?是更精准的水墨提示词技巧, 还是零基础?做一部 ai 水墨动画的全流程在评论区告诉我吧。如果这些视频对你有帮助的话,欢迎点赞、收藏,关注我,分享更多的艺术与科举最新资讯。
粉丝1062获赞8098

不知道你们有没有刷到过这个纸手机的 ai 短片,说的是一个连去世都不懂的小男孩,这个给你攒下的十五块钱,给奶奶烧一部纸手机的故事。在清明前夕,这部没有跌宕剧情,没有嚎啕大哭的片子,却戳中了无数观众的内心。 对于这个片子的爆火,很多人讨论它的故事有多感人,但我注意到一个很有意思的角度,这部片子比起其他 ai 视频多了很多人味,也就是画面上的真人感, 就像弹幕里刷屏的这是 ai, 因为它真实的太像实拍了,没有炫技,没有特效,却能让人感叹 ai 技术竟然发展到这种地步。仔细看完会发现它真的高明之处,制作者用非常巧妙的电影语言,把当下 ai 生成视频的僵硬感解决了。 比如这里小男孩跑出店外的这一幕,焦点一开始在小男孩脸上,随着他跑开转移到远一点的店主身上。像这样的变焦,是真实摄影师会做的事。类似增加真实感的画面,还有人物走动的过程。有其他路人作为前景主角,对话时,背景的路人也有相应的神情和眼神变化。 男孩坐车时车辆颠簸,身体晃动和窗景变化,这就是他为什么能这么像真人拍的。因为幕后团队真正理解了电影虚构的底层逻辑,不是单纯的让 ai 生成好看的画面,而是用镜头语言来推动故事。 ai 不 仅能做特效大片,也能把文戏拍出味道。 当然,这种质感光靠镜头语言还不够,工具也得趁手。这部纸手机就是创作者杨雪用可灵 ai 两个人三天完成的。其实可灵可灵一直以来有一个特点,就是说对于细腻的 情绪的表达,它会非常好。在他们的估算里,如果真人实拍至少小几十万。但可灵把创作门槛从一个剧组降到一两个人加一台电脑, 他在短片里的画面稳定性、人物皮肤的真实感也不是特例。我在之前使用中,他生成的视频表现也都很不错。那些担心 ai 会不会取代我的人,和那些已经开始用 ai 实现梦想的人 最大的区别从来不是技术,而是先动手。可令 ai 把创作工具放在你面前了,剩下的就是你的故事。我是七七,带你玩转 ai。

视频生成模型从夯到拉大对比今天我们来对比的是 cds 二点零、 cds 二点五、 minimax h 三与可零三点零 给同样的提置词和人物放进不同的模型,效果会如何呢?本次消费价格, cds 二点零约零点九元每秒,二点五约一点五七元每秒。 minimax h 三七六八 p 价格是零点五零元每秒,可零约零点九元每秒。先看画面比较,同样是七二零 p, cds 二点零画质不错,给到顶级,而 cds 二点五的质感和人物还原度是最高的。 给到吭, mini max h 三给到 npc, 可零三点零的画质明显落后于大件,简直拉完了。再看音画同步对比, 都结束了吗? 都结束了吗? 都结束了吗?都结束了吗? 我个人更喜欢 cds 二点零和 cds 二点五的配乐,给到顶级,更加有电影感和恢弘的史诗感。 mini max h 三也不错,给到仍上人,可零三点零就给到 npc 了。最后我们来深挖一下细节,论运镜, cds 二点零的少女抬头运镜是最贴近我一开始的想法的,更有故事感。给到顶级, cds 二点五的运镜和构图则更加美观,更有那种灾难过后悲伤的感觉。给到 npc 论提示词还原度,四个模型里只有 c 蛋四二点五精准还原了。我给到的男生摇了摇头,左耳环右眼有痣这些细节给到夯, c 蛋四二点零还原的,一般男生的痣莫名变成了两颗,耳环也变成了两颗,人设明显不符。给到拉完了, mini max h 三和可零三零都没有给男生特写,但也能看出来,耳环和痣都是缺失的。给到 npc 你 心中的视频生成模型又是如何呢?欢迎在评论区留下你的想法,我们下期再见。

最近有几个 ai 大 模型和 ai 应用领域的新闻啊,我们来感受一下目前 ai agent 在 企业服务,尤其是在金融、法律、咨询、医疗等白领服务员,它渗透的有多么的迅速。 昨晚海外科技自媒体这 information 上有篇文章啊,讲的是美国中小型企业开始使用基于大模型的 ai native app 来替代传统的 sas 软件。 文章中给出的案例啊,是一个五十多人的美国公司,使用 rapid 的 ai 原声管理软件,年度费用只需要四千两百美元,而使用 csboss 的 cim 软件,年度订阅费用超过十二美元,还要另外加上两个人力。我们观察过去半年全球 ai editing 服务的商业进化啊, 其实是在从 ai coding 等开发者服务逐步扩散到针对白领服务员的企业级 id 的 服务。 osropic 内部有一个数据啊,全球白领服务员的价值在十万亿美元以上,是以 ai coding 为代表的开发者服务市场规模的五倍以上。 目前主流的 ai 大 模型变现方式,除了我们刚才说到的弊端企业级 id 的 服务之外,另一个方向就是基于多媒体的视频生成。就国产大模型来说啊,重创在前者的玩家有 zippix 千万等, 撞伤在后者的玩家呢,有智捷 cds、 快 手可琳 mini max 的。 我们对比智普和可琳啊,他们两家预期今年年底的 ir 同为十亿美元, 可琳刚刚敲定了三十亿美元的独立融资,以便于后续的分拆,上市头后估值从两百亿美元被砍到了一百八十亿美元,而智普目前的估值是七千亿港币, 即便我们考虑到这其中存在一二级市场的估值差因素啊,但目前这两家的估值差距可谓是一个天上一个地上。资本市场显然是更看好的智普所在的企业级 i g 的 服务赛道,而对多模态、大模型的商业变现就更加谨慎。 此外呢,阿里千万和字节豆包宣布砍掉了 c 端 ugc 智能体业务线,这里的意识并不是说他们要全面退出 ai edge, 他 们只是放弃了低门槛、低质量且难以变现的这些由 c 端用户定义的个人 edge, 那 么 b 端的企业级服务 edge 仍然是他们发力的重点业务。 另外,在快手剥离可灵之后呢,腾讯开始大规模的减持快手股份,可灵独立之后,快手那么就开始逐渐沦为直播加电商加本地服务的传统互联网公司,这显然是有被与腾讯的 o n a 啊战略的。这里我插一句啊,我在网上看到很多快手的小股东喜欢拿快手的财务数据来自我洗脑, 什么可灵持股价值八百亿,账面现金九百亿,那么快手的主营业务岂不是白送呢? 啊?那么意思就是说,目前的股票价格肯定是低估太多了?那么诸如此类的话,我觉得吧,静态的数字比较其实意义并不太大,我们要考虑到快手管理层的公司治理折价以及传统互联网的夕阳属性, 那么目前这个价格其实吸引力并不太大。你作为一家上市公司啊,你的外部持股,你的外部资产,你的现金,如果不能清算给股东,最终还是要被管理层糟蹋在传统互联网业务上。

哎,大家好啊,最近呢,极梦的 cds 二点零上市啊,那么我利用春节假期给大家带来了一场啊,极梦可零和 vdo 的 产品的一个测试报告, 那么在这个模型选择上季梦肯定要选呃,当前最红的 c dunks 二点零啊,但是呢,由于 c dunks 二点零呢排队时间太长,我不得已呢,才选了它的简版啊, c dunks 二点零 fast 啊,表现也是非常强劲的, 那么在可零选择了它的 o 一 版,也是最新上市的,那么在微度呢,主要选择了 q 三,也是最新上市的呃,但是呢,在有一些测试当中呢,也选择了 q 二 pro 和 q 二。 呃,这里呢,我们第一个测试叫做中文标准语音唇形对齐测试,也就是俗话说的对口型。注意这里,我们测试的是把 要说的话直接输入到视频提示词里,不是像过去一样,是用数字人这个方式来进行一个转换。今天天气真好,我们一起去公园散步吧!今天天气真好,我们一起去公园散步吧! 今天天气真好,我们一起去公园散步吧!好, 那么从这一段语音来看啊,我觉得三个模型的表现都非常出色啊,口型对的都非常准确,因此呢,我们给出三个十分的测评结果。 那么虽然在这一项上三家打平,但是呢,吉梦还有这个独家秘籍啊,他可以在这个模型当中直接输入什么,输入方言和外语,那么直接就能够让 视频出来方言和外语的配音。今天天气真好,我们一起去公园散步吧!今日天气真好,我们一起去公园散步吧!今天天气真好,我们一起去公园散步吧。 it's such a beautiful day today, let's go for a walk in the park shall we。 然后呢下一个测试呢,我们叫歌词对口型测试。嗯,那这一项当中呢,我们主要要看他唱歌的时候口型的匹配程度问题。 那么在这里呢,我遇到一个问题,就是我一开始呢是把周身的起风了这个一个唱段喂给了这个 c d s, 但是 c d s 呢拒绝 这个演绎啊,我想可能是因为版权问题,然后我就把我自己写的一首歌呢为给他,但是呢,他呃唱的根本就不是原歌,唱着唱着他就拐到其他的自由创作那个方向上去了, 而且呢,他还把之前啊起风了里面的一段歌词呢,又给跟我的歌就融在一起啊,自由创作。那么所以说我们得出一个结论 啊,对于 c 凳子来说,直接给他喂给他一段歌或者歌词,他只是把他作为了一种叫做创作参考进行再创作,他并不是把他作为一个数字人对口型的这种方式。所以说在这一项上我们就对比了数字人这一项, 那么数字人呢,只有极梦和可灵才有微度,没有这一项功能,所以说呢,微度呢就不参与这项测试。 那么在这项测试中,我们可以看到呃像歌曲这样的测试,因为口型这样的都比较大,所以说呢,有一些瑕疵能看出来, 特别是你像迷呀啊笑啊这些咬字啊, ai 呢,还并不是那么尽善尽美。 呃,两个模型呢,都有一些小瑕疵的地方,但基本上呢也都能够较好的完成任务。所以说呢,这次我给这两个模型呢,通通都打九分, 那么呢,这个是一首抒情歌曲,那我也好奇,如果赶上那种呃语速特别快的 rap 会怎么样呢?因此我也测试了一段 rap 音乐啊,这个也试了一下, 哎呀,大家看吧,下面就是 ai 的 大型翻车现场了, 可以看到啊,这个即梦是全程这个嘴巴跟不上歌词呃,哎,可灵还好,可灵前面没跟上,后面那几句还算跟上了。 当然了,你要说这个 rap 这个音乐格式呢,对于 ai 来说还是有难度了,我们这个就算一个加增加的测试吧,就不计入分数了。 那么下面测试的呢,是叫做自动分镜啊,这个测试,看看这个 ai 呢,能不能实现自动分镜以及呢这样的一个全景中景到特写这样的一个逻 辑。有的可能它没有自动分镜,那它能不能实现这个全中特的切换推进也是可以的,咱们测试一下。 你好,麻烦来一杯拿铁。好的,请稍等 啊,可以看到啊,就是说现在即梦和微度是有同步音效产生的啊,包括呢,这个 即梦还有同步的这个人声配音,你好,麻烦来一个。好的,请稍等。而可灵呢,这方面是欠缺的,是没有的,它只是一个无声的视频。 第二呢,吉梦是有七分镜的,而这个可零和微度呢,都是一镜到底,但是呢,他们都保持了啊,全景中景特写的推进这些他们也都是有的, 但是呢,可灵没有推到手部侧写,而唯独呢没有男生走进咖啡厅,这个过程可能是因为十秒太短啊,但是呢,因为这个 可零呢,最长也就生成十秒啊,这个因为这个同样在十秒之内,纪梦用七分镜完成了这个三个景别的展示,而另外两个模型呢,因为没有做七分镜,所以说他们的展示都是不完整的。 而且呢,可灵呢,还出现了一个不合理的细节,就是顾客走到前台啊,店员送上咖啡,但是顾客拿过来的却是手机, 所以这一项肯定是季梦胜出。那么这次测试呢,季梦肯定是十分啊,微度呢,可以给到八分,可灵呢,嗯,又出现了一个小小的穿帮,所以只能给到七分了。 那么第四项测试是专业运镜的测试,我们主要测这三组的叫推拉,摇移。另外呢,给他上个难度吧,看他懂不懂什么叫唏嘘,苛刻,变焦这样的一个效果啊,我们给他看他能不能够实现 啊,我们看啊,呃,首先说季梦生成的这段视频,非常的宏观大气啊,云海飘扬,群峰环绕,山顶一颗像洋葱啊,非常的屹立挺拔。 那可灵的这个呢啊,首先说他虽然也有云海,但是显然不够壮观,山脉呢,也只是一座山,没有群山,气势上就低了不少,而且最后呢, 摄像机还停留在了树干上,而不是这棵松树的树梢啊,这样来说,他的气势就会比之前那个降低很多啊 啊,然后是这个微度啊,微度,要说这个气势感是可以的啊,这个大运镜调过来,这无人机的感觉是不错的啊,但微度的老毛病就是清晰度不够,很多地方能看出来比较糊的画面啊。最后那棵松树的质感 啊,也不如这个前面纪梦的质感那么强烈啊,真实感那么好,那最后也要说一下这个所谓的稀奇苛刻变焦效果,其实三个这个模型都没有做出来,看来他们应该是不懂什么叫稀奇苛刻变焦的, 这里呢,也科普一下什么叫稀奇古怪变焦。稀奇古怪变焦呢,它指的是在拍摄的时候,一方面通过走轨呢推 摄像机,一方面又反方向去做摄像机的变焦往回拉,这样形成了一个人物主体的大小不变,但是背景被压缩或拉长的这么一个效果。 那么这个呢,是我用季梦做出来的啊,稀奇可可变焦效果的视频啊,但是呢,这个不是用一句稀奇可可变焦这一句词就实现出来的,这个是我加了具体细节描述提示词才做出来的。 那么也可以说 ai 现在还不太明白什么叫做稀奇可可变焦这个名词里面的含义, 那么节外生枝的话呢,咱们就说完了啊,咱们转回到咱们这次测试打分来,这次因为三个模型都不理解什么叫稀奇古怪变焦,那么就各自扣一分,满分就九分。可灵呢,因为我觉得气势稍逊一点,拿到八分 维度呢,嗯,他我觉得他是因为细节不够清晰啊,再加上这个质感呢,也不如呃季梦那么优化,所以说也拿到了八分。 那么下一个测试呢,叫持续一致性,那么主要是测试同一个角色在同一个场景,那么光影变化中它是否能保持一致的问题。 那么在这一次的测试当中呢,那可以看到纪梦和呃可灵都采取了一镜到底的方式,而这个呃维度有一个七分镜 啊,纪梦呢,他有很好的表现了,比如说光线的变化,从清晨到黄昏,那么还有人物的表情的变化,嗯,但可玲呢,呃,光线跟表情几乎都没有变化 哎,这一点的的确确表现的非常不好。那么微度呢?微度是经过切镜的,切镜之后呢,清晨跟黄昏的光线感是分开了,但是表情却没有太大的变化,看来微度还不太能够理解开心与平静 这两个词的含义。那么在这次测试当中呢,那么季梦可以给到十分,可灵呢,只能给到六分啊,微度可以到八分。 那么下一组测试测试的是自动转场,那么我们会给他四张图片,看他能不能实现四张图片之中的自动转场, 那么这个就是我们用来测试的四张图片啊, ai 能不能把这四张图片给我有机的连接起来? 嗯,我们可以看到。呃,吉梦呢,完成的还可以 啊,他完成了这个就从一号图片到二号图片的自然转场和三号图片和四号图片之间的自然转场,那么二号跟三号之间,他用的是切镜啊,完成的并不算理想。 然而呢,可灵和微度呢,实际上他们并没有做这种自动转场的操作,他们只是把给定的参考图作为一种场景参考,进行了自我的二次创作。而且他们不约而同的很奇怪,他们都忽略了第二张图, 就是关东煮在玻璃煮的那个细节画面,他们都是直接生成了场景和两个人物的特写。 然后这个给分呢,因为季梦没有生成二号图到三号图之间的过度,那么扣掉一分是九分,那可玲呢,这个只有一个场景,只有一个女孩的特写啊, 这个店主的特写没有,所以呢,只能拿到六分啊,那么微度还好,微度呢,你看,虽然第二张图片没有特写,但是女孩的特写,店主特写都非常好,所以说呢,可以达到高一点七分。 那么第七个测试叫篇章集序式测试,我们呢,是不给他图片,只给他文案,看 ai 能不能够做到自自发的分镜,运镜和成图分视频, 你终于回来了,我回来了,余生请多指教。哇, 你愿意嫁给我吗?我愿意。那么我们首先看这个季梦啊,季梦,因为他最长可以升十五秒,那么这次我们就升了一个十五秒的,充分发挥他的优势。 这个视频的剧情来看,剧情很完整啊,人物的表情啊,七分镜非常到位啊,气氛的烘托也非常好啊,整个故事讲的非常的完整, 肯定是不错的,但是呢,季梦在生存当中呢,也有一个小小的穿帮,不知道哪位观众看出来了, 因为呢,这是一段正反党的气氛镜,注意看, 一开始镜头打到人群这个方向的时候,男孩是从右边出来,男孩在右,女孩在左,当几次正反打之后再切回来,男孩跑到了左边 啊,这就这就是他打反了啊,他做反了,所以说呢, ai 在 于这种高频次的正反打的时候,有的时候左右还是会糊涂的,这时以后我们创作时需要注意的。 那么可灵,这个呢啊,我们感觉到,感觉到画面比较单薄,对吧,也没有表情特写,也没有戒指的特写啊,一镜到底,基本上就运镜,就是一个推拉,感觉到这个气氛烘托的也不够好, 那么最后是微度,微度做的还是不错的啊,虽然没有什么观众吧,但是来说呢,有七分镜,有特写,也有戒指的特写,呃, 在十秒钟中之内把这些都表现清晰已经算不错了啊,但是有个小瑕疵,就是男女主的手略微有一点点崩, 那么这一项呢,我的给分就是这样,季梦九点五分,可零七分,维度九分。 然后呢,第八项测试是多模态混合输入测试啊,文本图片视频加在一起,然后呢综合生成一段视频, 我们呢找来一段这个过去的老的邵氏电影的武打片段, 然后呢再给他两个新的人物图片,看看他能不能够参考这一段的武打。估计是参考啊,不是复刻啊,参考这段武打,那么用两个新的人物去生成一段新的视频, 你就是邓海奇,嗯,没错,嘿啊嘿啊嘿。 哎,你看这一段季梦的表现,可以说得上是全权倒肉了吧, 基本上打的都是很精彩的啊,除了当中有一个小瑕疵,就是老头突然自己摔倒啊,在在这个红方没有进攻的情况下自己摔倒啊,摔一个小瑕疵,其他的来说还原的非常好啊,我打的动作很精彩, 那么可灵呢?可灵,首先说打开一看,突然视频有声音了, 他之前的视频都是没有声音的,这次呢有声音了,但仔细一听呢,会发现这个就是我给他参考视频的那个声音,那么这个声音跟他的画面其实也不并并不匹配。嗯,再看这个画面呢, 这种武打呢,说句实在话也真的是差强人意,基本上就是在比划啊,你说打太极都够不上,基本上就是在好像是在比划一样,所以说作为一套武打的画面,的确不能说是很好。 那么最后看维度,维度呢,还真是有这个对打的场景啊,它比这个可灵要好很多了,但是呢,这这种对打基本上是一方 一方防,也没有形成对攻的感觉,基本上来说呢,也就是比可灵好那么一点,跟吉梦相比确实还是有差距的。 那么在这一项上呢,我们还是给吉蒙九点五分吧,可灵那个没办法,我觉得只能给五分了啊,微度可以给到七分吧。 那么第九项测试就是局部修改测试,就是修改视频当中的某一个部分,那么这个就是我们要修改的素材,我们要把视频当做一匹马改成一匹白色的雄鹿。 嗯,首先说呢,三个模型都犯了一个小错误,就是鹿的尾巴没有这么长,鹿都是短尾 啊,他现在生成的视频里面生都是马尾啊,当然了,这是一个小瑕疵,毕竟 ai 也不是生物学家,咱们就先忽略不计吧,这个就不算他一种错误,咱们以后在生的时候告诉他短尾就好了啊。那么先看这个纪梦生的 金梦的视频呢,整体还是不错的啊,草原上的奔跑,山顶上的窑径都不错,然而呢,有一点,这个纵马上山这个镜头实际上他是没有替换的, 那么可灵这个表现可以说是这次测试当中让我最失望的一次,因为啊,这个局部替换本来是可灵的长项,原先在这三大工具当中,可灵的, 呃,多模态编辑那是可灵的,可以说是独门绝技,那个时候只有他能够去对视频当中的某一个事物进行替换,但是经过这次升级,我突然找不到这一项, 在可怜的平台上找不到多模态替换了,然后呢,只能是在这 o e 里面用文字表达来说,说完了之后,你们看到他这个根本就不是替换, 他的确确是把马换成了鹿,但是视频是接续在我们的参考视频之后生成的,他是接续的参考视频,而不是对参考视频本身的替换。 嗯,我不清楚是我没有找到,还是可灵真的就是自断一臂啊,我希望其他有知道的朋友可以告诉我。 那最后微度啊,因为他的视频只生成了八秒,那么他就不能够出现后面的登上山坡啊,山顶遥望这样的镜头,当然因为他只能升八秒,是因为他的参考视频只能输入八秒, 这个也是他的一个一个短板吧,一个短板啊,注意,这个已经不是 q 三了,用的是 q 二 pro 啊,因为 q 三没有参考升视频的功能,也算他的功能短板。 那么这次呢,我们给到季梦九分,可零呢,五分,微度呢,就是八分。那么第十组测试呢,我们是来做一个首尾帧的测试,看他首尾帧的过渡是否自然,是否酷炫。 那么这次的素材很有意思啊,这个是天津市博物馆的文物啊,太保顶啊,我之前呢给他做过一个变形的动画,这是变形之后的结果啊,变成了一个人形的机器人啊,那么我们看一下 这个三个模型能能否把这两个迥然不同的形态通过首尾针变形啊,并在一起, 好,我们看到啊,这个吉梦的变形科技感很强,机械感很强啊,整个动作非常清晰啊,这个既酷炫而且还让你意料不到啊,这个完成度是非常高的, 那么可玲呢?可玲这个变形啊,它其实主要是通过旋转来完成的,在这种变形当中用旋转 其实是一种很偷懒的办法,其实旋转就等于遮挡,你挡到后面去之后你再去变形,转过来就有了。这种变形看起来似乎还过得去,但是其实是一种很激贼很偷懒的方法, 那显然没有那种机械结构的变化给人的那种震撼感,对吧? 那最后呢,微度,微度采用了流体变形外加颗粒啊,这种呢,可以说肯定比转动那种方式要好很多啊,但是流体变形和颗粒也算是一种比较 省事的方式啊,震撼感也略差,可以说呢,这个也是一种偷懒的行为。 那么在这一项当中呢,我们给到季梦十分,可零八分,微度九分,那么第十一组测试呢,我们测试一下光影与材质的细节啊,看看光影之下的材质细节是否完好 啊。那我们先看纪梦的啊,纪梦这个组视频做的还是不错的啊,你看这个光感呢,包括这个戒指的亮点呢啊,都还是表现的很完美啊,这个是肯定是不错的, 那么可灵这个也很不错啊,特别是你他这个颜色,其实呢,你看他有点发绿,其实没毛病,因为在绿色的树林里头,阳光透过绿色照射下来,人的脸上就是略微有一点点发绿的啊,这是没有问题的 啊,唯独呢我这里边我输错参数了,本来想升个十秒的,结果输了个五秒,但是五秒钟也能看出来啊,人物的光影啊,细节呀,材质啊,都没有问题,所以说这一项我觉得大家都还挺过关的, 所以呢,在这一组当中呢,咱们就给三个十分吧,我觉得这个还是可以的。然后是第十二组测试,这组呢,咱们测试的是三人跳绳 啊,注意,三人跳绳这个其实是有点难度的,首先第一个三个人啊,这个本身就有难度,那么第二个呢,跳绳啊,绳子很细啊,做不好就容易穿模穿帮, 咱们先看吉梦哈,这次轮到吉梦偷奸耍滑了,给我来一个三个人跳大绳,那这样根本测不出来呀,这不算。 那第二组呢,就来个这个,这个呢更是偷奸耍滑,三人都不同框,这也不算啊,哎,这组才是正确的。 那么吉梦的这一组呢,我们看一看啊,基本上没有什么问题啊,除了这个问题之外,没有什么穿模穿帮的问题。 那可灵这一版,首先第一个人数就不对,我要三个人,他只有两个人,而且这个两个人绳子离得这么近,而且还是同频率摇,绳子不缠在一起吗?啊,这个也是一种穿模的问题,这显然是有瑕疵的 维度,这个人数对,但是他出现了穿模的问题,看这啊,穿模了吧,而且呢,这个现象就在这个啊防背心的女孩身上发生了好几次。 那么这一轮测试呢,我们给到吉梦十分,可灵七分,维度八分。那么第十三组测试呢,我们主要是测试一下这种特写的细节,看看特写的质感,光感怎么样 啊?我们可以看到纪梦的光感质感是很不错的,包括手上的一些骨骼呀,呃,血管啊,都是清晰可变的, 那可灵也不错,可灵虽然没有什么动作,但这也不咱们的重点啊,他手上的一些细节啊,指甲的反光啊,指甲里面的细节啊,都是非常清晰的。 那么微度啊,微度这个手啊,细节就不够丰富,有一些偏光滑,说是偏光滑,其实就是细节不够丰富嘛,啊,有一些地方它是模糊的, 这个清晰度始终是微度,落后于其他两个模型的一个大的问题,那么这一项测评呢,我们给出十分,十分、九分的结果。 那么第十四组测试啊,我们呢做一个多参考图生视频的测试。那么说明一下,这个多参考图生视频呢,原本是微度的长项, 原先这三大模型,这个纪梦呢,主要是,呃,功能全面啊,这个 可灵呢,刚才说了,他主要是这个多模态编辑,也就是说在视频里面去替换内容啊,现在不知道为什么不行了。那么微度的最大的优势就是多参考图生视频 维度,那个时候号称是最多可以七张图片,把七张图片融合在一个视频里头,它是那时候它最多的,那么我们看一下,现在在这个档次,这个情况之下,它还是不是最优的。 那么这个呢,就是我们要输入的素材啊,这一个场馆,两个人物和两件武器啊,看看 ai 能不能够把它们融合起来,形成两个人物各持武器在一个啊,武道馆当中的打斗的场面, 那我们先看一下吉梦啊,吉梦显然呢,对于场馆人物武器的理解基本上是正确的,在一个场馆之下,两个人各持武器啊,打斗 啊,但是呢,显然他对双截棍怎么个用法是不理解的,所以双截棍子是有点崩的啊,但是这个呢,也无伤大雅,那么这个我们可以以后用其他的方式教他怎么去认识使用,这个武器 那么可灵呢啊,场馆没问题,人物没问题,这个武器可就真的就是 变差别太大了,而且这种又是这种瞎子摸象式的这么一种打斗,也实在是让人无语。 然后呢,你看这个微度啊,微度的这个打斗虽然也算是瞎子摸象式啊,但是第一呢,微度的人物没问题,武器 也有几个画面也是体现了双截棍的用法还可以啊,而且比较难得的是微度当中有场景方面的角度的变化和运镜,这一点是很难得的, 这个呢,也确实是微度在多餐方面的一个长项啊,特别是他能够去延伸场景啊,你看这个集梦虽然打斗出的很好,但是场景呢,基本上就那一下,真的就那一张图他没有变化, 但是微度呢,可以把场景延伸在这一点上,还得说微度在这方面做的要比集梦要好一些。那么最后这个测试呢,我们给出九分,八分,十分的得分情况, 那么最后十四项测试全部完成,我们看一下三个平台的总分, 那么季梦一百三十五分,微度一百一十一分,可灵一百零六分,那么毫无疑问啊,季梦的这个,呃, six dunks, 呃,的确确是碾压了全场,这个毫无毫无悬念,毫无悬念 啊,那么微度呢,因为还是保持了自己多餐的一定的优势,那么也在整个的比赛当中拿到一个啊,这个最高分 啊。这里面唯一让我感觉到有点不可思议的是可灵啊,可灵原先是做视频做的是最好的 这个,但是来说呢,从这次的表现来看呢,好像有失水准,特别是连自己原先最特长的多模态编辑啊,视频当中细节的修改这一项都做的并不完美。 呃,并不太好。所以说呢,不太清楚是为什么?我不清楚啊,是我测试的有问题,还是说可怜的模型真的有一些状况,如果有朋友知道呢?哎,请在评论区里告诉我这个是怎么回事吧。

来不及实拍了,今晚就要快啊! claim, 快快告诉我是怎么做的!创作思路可拆解成这三组镜头,蜻蜓引导、香水亮相、香水细节展示、模特出镜互动模型式可零三点零奥秘,并涉及到主体参考、图片参考等功能。 进入 m 页面,在一堆主体的最左边点击创建主体,选择这次的商品图片可淋香水,没有商品的其他视角的话,可以点击 i 智能补全。稍作等待,我们就有了几组素材,选一组合适的, 有重复,多余的素材也可删除。智能描述商品填写名字,我们就有了可灵香水这个主体,同样也制作了机械蜻蜓主体,这样能确保香水和蜻蜓生成时趋于稳定,香水瓶上的文字也不会走样。 参考图为两张不同的丛林环境图和香水。至于此环境的图片,主体用到可灵香水和机械蜻蜓提示词主要描述了蜻蜓的入场行为轨迹,最后带出香水出镜,于是就有了 参考图为香水瓶左下角特写和香水瓶头部的特写。主体用到可淋香水瓶,这次用到了自定义分镜,分别描述两张图片对应的两个镜头,于是也就有了 制作模特主体并选择音色来保证声音一致性,也可以自己上传本地音色,然后以模特拿着香水瓶单张图片作参考, 主体选择可灵香水瓶和模特提示词,着重描述了模特如何与香水互动,以及最后说出那句可灵的品牌名。于是 今晚就要的电商广告,你学会了吗?

大家好,我是赛博研究员。假如你有机会只涨快手,你会怎么做?先看三组数字。 二零二六年一季度,快手收入同比涨了百分之三点四,还在增长,但经调整,净利润同比降了百分之二十六点三,利润在收缩。而用于购买服务器和数据中心的开支,一个季度差不多等于去年全年的百分之八十一。 收入在涨,利润在跌,花钱的速度远比赚钱快。一家明明在盈利的公司,为什么会出现这样的剪刀差?不要把这理解成快手不行了。二零二五年,快手全年赚了两百零六亿净利润,经营现金流两百六十七亿,广告和电商的基本盘目前没出问题, 真正在变化的是商业模式的底层结构。过去的快手是典型的轻资产流量平台,赚广告费分一部分给主播和创作者,剩下的就是利润。 现在呢?他正在把广告赚来的现金大笔转化成服务器、 gpu 和数据中心物业设备,三个月增加了百分之三十二。 这不是引擎坏了,是主动再换一个更大的引擎。但新引擎的油耗和马力,谁也不知道。快手的钱到底是怎么赚来的。广告 今年一季度,广告收入一百九十六亿,占总数百分之五十八点三,超过一半。而且增长的方式发生了关键变化,日活用户只多了百分之一点二,但每个用户贡献的广告收入从四十四块一涨到了四十七块六。 这背后有一个容易被忽略的逻辑,快手的广告本质上卖的不是曝光,而是预测能力。 系统根据你的观看、停留、点击行为,判断你当下最可能需要什么。一个刚看完半小时宠物视频的人,比一个在刷新闻的人更可能下单狗粮。 ai 让这种预测更准了,推荐算法直接贡献了广告百分之三到四的增量, ai j c 自动生成的广告素材也占到了短视频广告消耗的百分之十。广告增长正在从让更多人看到广告变成让每个人看到的广告更值钱。 ai 是 这轮效率变化的关键推手。广告确实在赚钱, 但这些钱正在被大量投入到一个新方向上。看。三本账。第一本,买设备。一季度,快手花在物业设备上的钱达到一百二十一亿,差不多是去年全年的百分之八十一。服务器和 gpu 占了新增设备的近九成。 到三月底,物业设备账面值冲到三百零二亿,三个月涨了百分之三十二,这个速度已经不是一家轻资产互联网公司的节奏了。 第二本,氧设备、服务器买回来不是一笔了结的开销,这些硬件的折旧每个季度都会进入利润表,折旧摊销占收入的比例从去年一季度的百分之三点八升到了百分之五点三,半年不到提高了将近一半。第三本,借钱买。既然现金不够花,就借 公司借款从一百三十亿翻到了两百七十七亿,增幅百分之一百一十二。当然,快手手里还有一千一百七十七亿可用资金,不是没钱了,是融资方式在变化。这三本账是一个连锁反应, 买的越多,折旧越重,折旧越重,利润越薄,利润越薄,借钱越多。 ai 投入正在把轻资产公司一步步变成重资产公司, 买了这么多设备,最核心的应用场景之一就是可零。 ai 可零的收入增长确实好看,一个季度超过六亿五千万,同比翻了三倍,年化运行率接近五亿美元。这个增速放在任何一家 ai 创业公司身上都是亮眼的。但这里有一个真实的落差, 可零的收入只占快手总额的百分之一点九,而同期贷款、服务器折旧和研发费用的同比增量加起来已经超过了十一亿。 根据公开数据的外部推算,这十一亿的增量成本不只是可零一个产品产生的,还包括 ai 推荐、 ai g c 素材等所有 ai 相关支出。但即使用全口径对比,六亿五的收入也远不足以覆盖 ai 带来的新增成本。 更关键的是,可灵的毛利率是多少?付费用户能留多久?获客成本是多少,这些数字公司一个都不透露,外部投资者根本不知道可灵每收进来一块钱,到底是赚了两毛,还是亏了三毛。 但如果说 ai 对 快手没什么价值,那也不对,可灵只是水面上的冰山尖,在水面以下, ai 再做三件更实在的事。第一,推荐系统更准了,直接贡献了广告收入百分之三到四的增量 听起来不多,但快手广告一年超过八百亿,三到四个点就是二三十亿。第二, ai jc 自动生成广告素材已经占到短视频广告消耗的百分之十,帮商家省了大量素材制作成本。 第三, ai 搜索给电商搜索 gmv 贡献了约百分之三的增量。直播间 ai 每天带来超过一千万元的 gmv, 这三块加起来,对快手的商业贡献可能比可零的订阅收入大得多。但它们有一个共同的问题,没法在财务报表里拆出来单独看,外部根本无法量化。 而且竞争对手也在追赶推荐算法和 a i g c 素材生成,不是只有快手能做,所以 ai 对 快手最真实、最大的价值,恰恰是市场最难定价的部分。 讲到这里,还有一个因素不能忽略。快手的利润下降,不全是因为在 ai 上花钱,有另一股力量同时在起作用。竞争成本, 快手每赚一百块钱,收入至少有三十二块要分给主播、创作者和工会,这个比例比去年中期又高了,营销费用率仍然在百分之三十左右徘徊。 这不是快手乱花钱,用户、主播、商家都可以同时在多个平台经营,没有谁被快手独家锁定。所以,这百分之三十二的分成,本质上不是慷慨,是必要的。生态维持成本, 打个比方,就像苹果应用商店收百分之三十的分成,高吗?高,但在平台经济里,这个比例是维持生态运转的门票。 ai 投入是快手主动选择的战略方向,收入分成和营销费用是被动承担的竞争成本, 两股力量方向不同,但效果一样,都在挤压利润空间。讲了这么多压力面,也该看看另一面。可零年化五亿美元收入和百分之三百的增速,说明了一件事,市场对 ai 视频生成的需求是真实的。 快手二零二五年产生了两百六十七亿经营现金流,手里还有一千一百七十七亿可用资金,他不是在弹尽粮绝的时候赌最后一局,广告基本盘也不差,活跃头流商家增长了百分之三十八,品牌商家广告消耗增长百分之四十二, 如果可零的毛利率能做到百分之四十以上,注意,这是假设,公司目前不透露这个数字。如果付费用户留存稳定, 如果企业级 api 能形成持续的工作流绑定,那么快手将拥有广告现金流,加上 ai 增长引擎的双轮驱动结构。到那时候,今天看起来巨大的 capex 就 不是成本,而是提前买好的门票。问题在于,所有这些如果还没有一个被证明, 但可灵这张门票有一个结构性的硬伤。快手的社区生态天然有粘性,用户舍不得关注的创作者、主播舍不得积累的粉丝,商家舍不得搭建的店铺,迁移成本非常高,你不可能一条通知把四百万粉丝全部带走。 可灵的用户完全不一样,一个视频创作者用可灵生成视频,不需要迁移任何东西,没有粉丝,没有社交关系,没有商店。 如果字节的 cds 二点零生成效果更好,或者腾讯的混元视频价格更低。切换就是换一个 api 调用接口的事。这是可灵作为独立产品最脆弱的一环,也是 ai 模型竞赛最残酷的地方,切换成本几乎为零。 快手在社区业务上花了十年积累的年性壁垒在 ai 产品线上并不存在。综合来看,快手的 ai 投入到底该怎么评价?我的判断是逻辑清晰,但回报尚未确定。 快手本质上是在用成熟广告电商产生的现金购买一张 ai 时代的期权,赌的是可零能成为企业级工作流工具,赌的是 ai 内部提效能持续放大广告和电商的利润。 但这里有一个关键的区分,期权的价值不等于行权的结果,当前这张期权的行权条件一个都没有被满足。可零的经济学不透明, ai 增量成本远超增量收入, capx 还在加速增长。 我们可以分两层来看,第一层,确定的 ai 在 快手内部已经创造了真实价值, ai gc 素材占比在持续上升,这些是已经发生的事儿。 第二层,不确定的可零作为独立产品,能不能建立可持续的商业模式,毛利率、付费留存、竞争壁垒全是问号。 快手不是第一个用现金牛养新业务的平台,也不会是。最后一个,区别在于新业务最终能不能形成独立的经济学。目前我们能看到这张弃权有真实价值,但远没到行权的时候。 不需要等我的下一次分析,你自己就可以追踪快手 ai 战略的进展,看三个指标。第一个,可零 ai 的 毛利率, 公司如果哪天公开了这个数字,注意目前不透露,而且高于百分之四十,说明可零的独立商业模式是成立的。如果一直不透露或者透露出来低于百分之二十,那收入涨再多也只是数字游戏。第二个,资本开支和经营现金流的比例, 一季度这个比值大约是百分之三百八十七,远超百分之一百的警戒线。一个可持续的水平应该在百分之八十以下,什么时候这个数字降下来,说明 ai 投资的强度在收敛。 第三个,折旧摊销占收入的比例一季度是百分之五点三,还在上升,什么时候这个比例不再涨了,甚至开始回落,说明公司的资产结构重新趋于稳定。这三个指标覆盖三个核心问题, ai 能赚钱吗?投资可控吗?结构变化是永久的吗? 连续看两到三个季度,你就能自己判断快手离答案还有多远。回到一开始的问题,快手的 ai 投入是在购买未来,还是在消耗现在? 答案是在购买未来,但这个未来还没有被定价。三件事是确定的, 第一, ai 在 内部已经创造了真实价值,广告推荐和电商转化都有量化证据。第二,可零的市场需求是真实的,年化五亿美元的收入不是编出来的。 第三,最终答案取决于接下来几个季度的数据,可零能不能证明自己能赚钱? capx 会不会收敛?核心利润能不能起稳? 快手正在用今天的现金换一张明天的入场券,这张入场券最终值不值,要看它能不能带你进场,而不是把你拦在门外。 目前我们只知道价格很高,但还不知道里面是什么。你更看好可零成为独立的 ai 产品,还是更看好 ai 对 快手广告和电商的内部提效?在评论区聊聊你的判断、点赞、收藏或关注,我们会继续用商业模式和经营证据拆解公司和产业变化。 以上内容为公开商业分析,不构成任何投资建议。市场有风险,决策需独立判断。数据。截至二零二六年一季度。

怎么把画面从这样变成这样? 哈哈哈哈哈,我可以变成马尔福,也可以变成金刚狼,甚至我今天的全套装造身后的高级感背景,全都是 ai 现场捏的像这指哪打哪的动作控制到底怎么玩?接下来分三个阶段一次性给你讲透。 先打开可灵 ai 的 动作控制,记得一定要选最新的三点零模型。这次有个史诗级的更新,就是新增了主体库功能,再也不怕人物面部崩坏。分别上传一段视频和一张图片,神奇的事情就发生了。不管照片里是谁,都能完美复刻视频里的动作, 无论是跳舞、微表情, 甚至是那种魔性高难度的动作,他都能一比一还原。而且即使在高速运动中或者被大面积遮挡, ai 也能牢牢锁住人物长相。 以前影视剧的角色替换效果是这样的或者这样的。现在可以直接在这里上传原图,把人物面部替换为任何角色,再配合动作控制三点零模型, 人物就完美融入了表情,动作完全同步。你甚至可以把主角换成自带特效的虚拟角色。以前需要一个团队干半个月的特效,现在一杯咖啡的时间就能搞定。 这是我,这是用 ai 捏出来的。我不仅自带妆造,拍摄环境还能任意切换,这也是我觉得可零三点零动作控制最炸裂的一点,能够实现专业影视级的应用。 在这里上传你的照片,生成一张精修的人物场景图,然后在动作控制里上传你随便录的口播视频,加上这张精修图,一个带妆造带场景口型、动作丝滑的精致视频就生成了,真的实现了无痛做博主。 以前我们被设备限制,被场地限制,甚至还有颜值焦虑,但现在,只要你有好的脚本,好的创意, ai 就 能帮你完成剩下百分之九十九的执行。关注我,带你用 ai 把内容创作卷出新高度,我们下期见!

最近一直在研究适合三 d 打印玩家的模型展示镜头,但专业的拍摄道具和灯光都比较贵啊,所以说我就想试试看能否使用 ai 视频的方式取现救国一下, 没想到效果还是非常不错的。这些镜头呢,都是我首次尝试使用这个 ai 工具制作的,下面给大家分享一下这几种最常见愿景的提示词和操作流程。首先是这个旋转环绕啊,这个应该是需求最高也最简单的愿景了,只需要围绕模型拍摄六张不同角度的照片, 进入这个多模态创作工具,直接上传输入这个提示词就可以了,效果真的挺意外的啊,平时你想拍摄一个这样的镜头呢,你至少需要一个圆台和横杆。然后是这个机械臂的愿镜啊,同样是六张不同角度的照片,同样使用的是这个多模态的创作工具,使用这个提示词 效果也是非常不错的。然后第三个也是非常实用的模型转场,用 ai 的 话,只需要利用这个首尾正功能啊,上传两张关键节点的图片,简单描述一下即可,各种风格任你想象啊。 然后第四个快速推镜头,这个也是一个非常常用的镜头啊,非常适合我们每次打印好模型去拿取的时候使用。同样是首尾这两张图片,一张远景,一张近景,使用这个提示字就可以了。以上这几个镜头呢,都是我个人觉得非常实用的啊, 三 d 打印玩家做自媒体的门槛又降低了一大截,非常建议大家去尝试一下,如果大家对这个系列感兴趣的话,可以点点赞告诉我,后续我会继续为大家收集一些适合三 d 打印玩家使用的拍摄提示词。好,这期视频就这样,咱们下期视频见,拜拜。

如果你最近刷到过快手的新闻,大概率会被两条消息砸中眼球。一边是腾讯直接把自己手里的快手持股从百分之十五点六八降到百分之九点三七,再也不当快手的主要股东。 另一边是快手把旗下才成立两年的可零 ai 推到台前,拉着二十一家投资机构凑了足足一百九十多亿现金,连减持快手的腾讯都转头参投了可零持股百分之一点一二。 这两件事凑到一块,说破天也不是巧合。过去十五年里,快手靠着 gif 工具、短视频、直播、电商,一步一步踩准了互联网的流量风口,如今手里握着四亿多日活,一年营收稳稳破千亿,日子本来还算过得去, 但现在,他偏要把整个集团未来的想象力,全压在一个还在烧钱的 a i 新业务上。走了这么远的快手,真的再也回不到过去靠着短视频流量躺赢的日子了。一从来不安分的快手,又走到了身份转弯的路口。 快手这家公司,从成立第一天起,好像就从来没在同一个身份里待舒服过。二零一一年刚诞生的时候,它压根就不是什么短视频平台,就是个给移动互联网早期用户做 gif 动图制作、分享的小工具。 那时候微信、微博刚冒头,谁也没料到这个做动图的小软件日后能长成国内短视频赛道的头部玩家。 到二零一三年前后,快手直接扔掉了工具属性,全面转向短视频社区,在社交巨头的夹缝里,硬生生闯出了一片属于自己的内容生态。之后二零一六年做直播,把老铁经济做成了全网辨识度最高的标签,靠着直播打赏稳稳赚了第一桶金。 二零一八年又马不停蹄杀进电商赛道,花了快十年时间,终于搭起了广告、直播、电商三大营收支柱,把业务体系的底子彻底打牢固。 熟悉快手的人都知道,这家公司有个习惯,只要上一个阶段的增长摸到了天花板,立刻就会调兵遣将去找新的增长曲线,几乎每隔一段时间就会来一次大范围的架构调整。 高管们要么冲到新业务前线打仗,要么直接离开战场,从来不会抱着过去的功劳不躺平。其实单看眼下的经营数据,快手根本没到活不下去的地步。 二零二三年之后,他一直在推进降本增效,盈利能力早就稳了。二零二六年第一季度还交出了三百三十七亿元的营收成绩单,在线营销业务稳稳贡献最大收入来源, 直播业务能持续输出稳定现金流,电商业务也还在维持增长,平均日活跃用户摸到了四点一三亿,基本盘相当扎实, 但光鲜的账面底下,藏着谁都没法回避的现实。二零二六年第一季度,快手整体营收同比增速只有百分之三点四,直接跌到了低个位数区间,这是他上市以来,营收增速第一次掉到个 位数。现在整个短视频赛道早就进入了存量竞争的死局, 抖音和视频号两头挤压,快手想要再从用户身上榨出过去那样的高增长几乎是不可能的事。更戳人的细节是,从二零二六年一季度开始,快手直接停止透露季度电商 gmv 数据,不再对外公布这块业务的增长情况。 要知道,前些年电商可是快手第二增长曲线, g m v 增速从百分之七十八一路滑到百分之十五,现在干脆不再公开这个核心指标。明眼人都能看出来,靠传统的短视频流量变现的老路子已经走不通了。反倒是刚做了每两年的可零 ai, 交出了完全不一样的增长数据。 二零二六年一季度商业化收入直接突破六点五亿元,还多年化收入运行率接近五亿美元, 是整个快手集团里涨得最快的新业务。虽然现在可零的收入占整个快手集团的比例还不到百分之二,和广告、直播这些成熟业务比起来,体量小得可怜。但它释放出的信号谁都没法忽略。 过去快手的所有增长,全靠短视频平台的基本盘撑着,现在增长最快的动力第一次从平台之外涨了出来。快手这一年几乎把 ai 抬到了从未有过的战略高度。从模型迭代、开放企业服务到推进海外商业化,可零早就不是之前放在内部实验室里的小创新项目, 成了管理层天天挂在嘴边的新增长引擎。这次拿到一百九十多亿融资之后,可玲直接拥有了独立的资本平台,他的发展节奏、资源分配,甚至未来的估值体系,都开始和快手母体慢慢拉开距离。 这根本不是简单找了个新的业务增量,快手本质上是在给自己找一个全新的身份。短视频直播和电商依然能给快手赚来源源不断的利润,但资本市场早就不吃这一套了。现在你就算手握四亿日活,做的还是传统互联网流量变现的生意, 根本不可能再拿到之前那样的高成长估值。腾讯减持老快手,转头投资可零,说白了就是大家都看清了这个现实,只靠短视频平台这个身份,快手根本撑不起下一个十年的发展。故事二,放着稳赚的生意不做,快手为什么偏要压住可零? ai? 站在任何一家传统互联网公司的角度看,把一个才成立两年的新业务拉出来独立融资,都是一个特别冒劲的决定。尤其是现在支撑快手收入和利润的依然是在线营销、直播和电商三大老牌业务。放着现成的稳钱不赚,掏出全部身家去赌 ai, 怎么看都有点不理性。 当你翻开可灵这两年的发展轨迹,就会发现,快手压住它根本不是脑子一热的冲动。二零二四年六月,可灵才正式推出一点零版本,是全球第一个面向大众开放、可以商用落地的 d i t 架构视频生成大模型。之后两年里,它迭代速度快得吓人。 二零二五年第四季度拿出了全球首各统一多模态视频模型。二零二六年二月上线的三点零系列模型,直接支持文本、图像、音频、视频全模态的输入输出,把视频的理解、生产和编辑全部整合到了同一个 ai 工作流利。 现在,可灵已经陆续拿出了文声视频、图声视频多主体一致性,因视频生成等成熟能力,还向广告营销、影视制作、游戏电商等多个行业的企业客户开放了 api 接口, 连海外市场都开始产生收入。他早就不是一个只烧钱的研发项目,已经跑通了最基础的商业化闭环。可零给快手带来的价值,根本不是多赚几个亿收入这么简单。 过去几年,快手优化成熟业务,解决的是当下怎么赚钱活下去的问题,但可零要解决的是另一个更致命的问题,怎么重新回答资本市场对快手未来的想象? 成熟业务负责给快手赚真金白银的利润,可玲负责给资本市场讲一个全新的高成长故事。 这次独立融资的最大意义,也不是拉来了一百多亿的现金,而是可玲第一次拥有了完全独立于快手集团的资本定价权。之前市场评价,快手得把直播的增速、电商的天花板、广告的利润、 ai 的 投入全揉进同一张财报里,最后给整个公司算出一个统一的估值。 现在不一样了,投资人讨论可零的时候,首先看的不是快手这个季度广告涨了多少,而是他的模型能力够不够领先企业客户涨得快不快,商业化落地能不能持续, 直接跳出了传统互联网平台那套老掉牙的评价体系。这也就能解释为什么腾讯减持快手,转头却来参投可零。两件事一点都不矛盾。 腾讯卖掉的是一家已经进入成熟期增长摸到天花板的互联网上市公司的股份,转头压住的是一个还处在高速成长阶段的 a 新物种。 两种资产的风险等级、增长节奏、资本期待完全不一样,根本不是一回事,更重要的是,过去快手做直播、做电商、做本地生活,所有新业务本质上都是围着短视频生态打转,从来没跳出过短视频平台的边界。 但可灵不一样,他第一次把快手的竞争范围从国内的短视频赛道直接拉到了全球 ai 产业的牌桌上,让快手有机会跳出和抖音视频号抢用户时间的内卷游戏, 去抢一个全新赛道的入场券。为了把可灵的能力落地到自己的生态里,快手甚至直接计划在二零二六年投入两百六十亿,用可灵 ai 实现短剧的剧本分镜、虚拟场景全流程自动化, 把此前粗制滥造的短剧制作成本打下来。之前热播的短剧太平年,可灵就深度参与了虚拟场景和特效制作,在保证画面品质的同时,大幅压减了制作成本。 一托 ai 赋能的短剧,快手还打通了官剧种草下单的全新转化链路,把之前的短视频流量价值又往上提了一个台阶。可灵反过来开始给母体的成熟业务赋能,过去是所有新业务围着短视频平台转,现在第一次出现了 ai 业务反过来带动平台增长的新局面。 三可灵想扛起快手的未来,还横着上百亿的融资,说他已经能稳稳拖住快手的未来,还是为时过早。 他面前还摆着三个绕不开的硬骨头,哪一个没啃下来,之前画的所有大饼都有可能落空。第一个挑战,就是怎么在白热化的全球 ai 视频赛道里保住持续领先的优势。 现在视频生成模型是全球大模型领域卷的最凶的赛道,没有之一。 google 推出的 vivo 系列模型,一直在强化影视级视频生成能力,美国的 round 靠站系列模型牢牢稳住了专业创作者的基本盘, pika 在 轻量化创作工具赛道越扎越深,国内的字节跳动、 mini max、 阿里这些巨头也全部在视频生成领域砸了重金, 技术迭代的周期已经从过去按年算缩短到了按季度甚至按月算。快手过去靠着社区生态、创作者网络和内容分发能力攒出来的护城河,都是花了十几年慢慢积累的 竞争对手根本不可能短时间超走。但在 ai 行业,逻辑完全变了,模型能力、推理、效率训练、数据芯片资源研发投入任何一环,跟不上你今天的领先优势,可能对手发布一次新的模型更新就直接追平甚至反超了。 快手在短视频时代攒下的平台优势,根本不可能自动平移到 ai 赛道,想要保住第一梯队的位置,半分松懈都不能有。 第二个挑战是,整个 ai 视频行业的商业模式至今还没有经过长期验证,现在全行业都处在高投入、高增长、低盈利的阶段,模型训练要持续砸钱买算力,模型升级要养着大量高新的 ai 研发人员,企业客户还在慢慢教育,整个行业的服务价格体系远没有稳定下来, 现在看起来收入涨得快,但最后能不能沉淀出稳定赚钱的长期商业模式,谁心里都没底。资本市场愿意给可灵开出远高于传统互联网业务的估值,根本不是看中他现在一年几个亿的收入, 赌的是他未来能长成一家有全球竞争力的 a 龙头公司。可灵现在承载的是整个快手集团的新资本蓄势,要是之后商业化速度放缓,模型竞争力掉了下来,或者行业陷入惨烈的价格战,现在靠成长预期堆出来的高估值, 说不准哪天就直接摔回地面。第三个挑战,来自快手自身能力的转身。过去十五年,快手最擅长的是运营一款坐拥几亿用户的内容平台,核心能力是产品运营、内容生态搭建和商业化效率优化。 但未来要做好一家 ai 公司,更看重的是基础研发实力、模型快速迭代能力和底层工程能力,这完全是两套不一样的能力体系。快手想要转型,就得把自己的组织架构、人才结构、研发体系,甚至资源分配逻辑全部翻一遍, 可令独立融资只能解决钱的问题。最后决定它能走多远的,还是快手能不能把自己从一家内容平台公司改造成真正的技术驱动型公司。 现在投资人压住可灵,本质上压的是一种可能性,不是一个已经板上钉钉的结果。快手把全部未来堵在这么一个充满不确定性的新赛道上,就等于主动切断了回头的路。 过去快手只要证明自己能做好一家优秀的互联网平台就够了。现在他要跨过的那道坎,是靠内容生态长大的公司,能不能在 ai 时代长出全新的核心竞争力? 他当然再也回不去过去躺着靠短视频流量赚钱的日子了。但只要能烫出这条 ai 的 新路,快手拿到的会是下一个十年的全新传票。好了,以上就是本期视频的全部内容,我是莫正说,喜欢的朋友请点赞、关注、支持下,谢谢,我们下期视频再见!

可灵三点零刚刚更新字节 c dance 虽然来得晚一些,但一出手就非常惊艳。今天我们就拿国内这两款最顶级的视频模型来一场硬核 battle, 看看它们到底谁更强。 先看实拍写实风格一致性上两者都很稳,可灵对黑白风格的保留特别扎实,整个片子质感很统一。 更重要的是,两个模型在人物真实感上都有了质的飞跃,皮肤的纹理、眼神的光彩都无限接近真人,以往那种僵硬恐怖的恐怖股效应基本被消除了,现在看到 ai 角色,会觉得他真的有灵魂。 广告应用场景可零三点零的质感更像真实拍摄,自然不刻意他的画面有种刚好捕捉到的既视感。 字节 c 单词则更像精心预设好的广告片,虽然精致漂亮,但看多了容易审美疲劳,相信官方会给更多风格选项。广告感不是唯一答案,在产品上也是同样的,细节真实度可临众。真实字节 c 单词重视剪辑和角度。 战斗场面可零三点零有 o e 工具加持,角色一致性更强,适合多镜头保持统一形象,非常适合连续战斗场景。在真实人物的打斗效果上,两者表现都可圈可点,拳拳到肉的打击感,翻滚时的肢体反馈都非常自然,已经看不出明显的 ai 痕迹。 角色对话与英语输出,两者都可圈可零,靠角色一致性稳住细节和风格,多镜头下人物不会变脸 i don't care about the money dad i just want you to be i promise to change, starting tonight, let's start now。 字节 c dance 则靠切镜实现节奏流畅,快速切换,让对话更生动。切镜,两者目前难分高下。 i don't care about the money dad i just want you to be there i promise to change starting tonight let's start now。 角色识别与情绪表达,用提示词生成角色后,两者都能准确识别并配合台词表达情绪,甚至可以直接 a t 图片识别。如果可灵,配合 o e 主体库,还能匹配角色和声音,表现更稳。 这个功能在多角色复杂场景中非常实用。你一点都没变啊,你倒是变高了,还是帽子太高了?哈哈哈,想死你了。谢谢你来接我。哪能不来啊,走,先出去再说。 第一站吃饭,我快饿死了。多角度多角色场景春节场景实测,两者已经强到难以区分,重点在于你的提示词是否精准,十五秒的结构里怎么安排故事节奏。 字节 c 单词作为后来者,在多角色理解上进步神速,已经能和可玲并驾齐驱了。最后想说,国产模型的进步真的太快了, 可林稳扎稳打,持续更新字节 cds 虽晚,但来势汹汹,但如果要挑硬伤,字节 cds 偶尔也会人脸乱跳。 ip 版权模糊也许会有商业风险。我试过输入某导演或者电影的风格,结果画面里直接出现了一些 ip 的 面部,他太容易把风格和特定 ip 强行绑定。 而可林正好相反,角色一致性稳如泰山,几乎不跳。 ip 是 真正的一致性天花板。 如果你追求更高质感,需要幺零八零 p 以上分辨率,或者对角色一致性有严格要求,可零是更稳妥的选择,它的可控性更强,适合正经的短片创作。设没完梗, c 单词更快速,模型迭代只是时间问题。创作者要做的是用好这些工具,讲好自己的故事。 你对内容的理解决定了作品的高度。

哈喽,家人们啊, mini s h 三最新的视频生成模型现在可以本地化部署了,按要求显卡的规格并不高,那么可灵的估值会不会往下掉啊? 而且阿里的最新的视频生成模型三点零也开始公测了,我们知道可灵的三点零已经大半年没有更新了,最新的四点零还没有发布,可灵是在三季度末发布。 最重点是可灵的模型,它是闭元模型啊,它天然就可以受到开元模型的冲击,尤其是开元模型,它的效果还比闭元模型差不多的时候。那刚好现在可灵也需要上市融资了,还撑得住吗?这里先给一个捷径,就是目前的中国 ai 大 发展,它是一个固执从孤的一个逻辑, 大模型的发展,它伴随着此销皮涨啊。那今天这个模型厉害,明天那个模型厉害是非常正常的。重点是什么呢?可零?重点是呢,可零的大部分的收入基本上来源于影视级别的工作室,不是这些小傻货,因为本地部署的视频模型,他一般生成出来的效果呢,没有达到四 k 的 画质,他就不能够去做一个影视级的商业化。 所以在 mini s h 三库来之前,就有阿里的 one 二点七也已经是开远了,而且本地也能部署值他要求的本地部署的显港的要求会更高一点,而 mini s h 三呢,会要求更低一点而已啊, 也一直没有影响您的估值。所以这一次 mini s h 三库来之后,快手和可宁股价的变化并不大。现在其实中国模型呢,它属于一个固执成孤的过程, 如果你有好的模型出现了,他会给你一个比较高的通估啊,除非你的估只是高估了他。其实也没有太多跌的可能,因为之前已经砸过一遍了,像很多东盖恒哥的个股,他都已经是在历史的背蹄分位上面去了,他就没有再给我做功的可能了。 目前是这么个情况,对于可灵来说呢,他最大的竞争对手就是字节跳动的吸电斯二点五,在影影视画质深层上面呢,就没有其他的模型对手了。嗯,所以估值的话也不有太大问题,我们还是要关注一下八月份的中报 t 图端口以及呢三季度末的这个可灵四点零的发布情况啊。

一家短视频公司旗下一个 ai 业务要单独值两百亿美金,比他自己市值的一半还多,你说这是什么概念?那说明剩下那一半烂的已经不值钱了呗。快手的核心业务在失血。拿可灵出来讲故事,你觉得这叫蜕变?你别急着下结论。可灵 ai 一 季度收入超六点五亿,同比涨了三百多, 一年赚将近五亿美金,这个速度在全球 ai 公司里都排得上号。涨三倍听着吓人,但你算算总盘子,快手一个季度收入三百三十七亿,可零占多少?不到百分之二,你跟我说这百分之二值整个公司一半的钱?你这就是典型的现象思维, 可零的年化收入就是一年能赚多少钱,一月份才三亿美金,四月底直接翻到五亿,大摩预测年底能到十亿, 四个月翻将近一倍,这增长曲线你见过几个?大魔同一份报告里还说了什么?你倒是念完。核心业务疲弱,每股盈利预测下调百分之五,一边吹 ai 一 边砍盈利预测,这不禁分吗?那是因为 ai 要花钱, 一季度调整后净利润下降百分之二十六,主要就是 ai 投入大,这叫投入期,跟亏钱是两码事,你多投换词速度是真快,去年叫战略亏损,今年叫投入期。那我问你,电商直播呢?那才是快手的命根子,增速呢?核心商业收入同比还涨了百分之十点七, 停这百分之十点七,你跟去年比呢?去年同期是二十几的增速,腰斩了都不止。电商直播失速,利润暴跌,这才是真相,你的现金牛在干枯,这个电商确实成压,但你不能因为老业务增速放缓就否定新业务爆发啊。 可玲已经走通了商业化路径弊端, api 调用、专业创作者付费影视创作场景三条腿都在跑。商业化路径走通是一回事儿,撑得起两百亿美金估值是另一回事儿。 花旗都说了这个估值进取,你知道两百亿美金是什么概念吗?他一年才赚五亿,市场给他标价两百亿,等于每赚一块钱,投资人愿意花四十块来买 open ai 都没这么夸张。摩通给了一个更高的数,如果可零估值到五百二十亿美金,快手每股值七十三港元, 现在才四十多块,中间差了快一倍的空间,你说便不便宜?哎呦,五百二十亿,那怎么不说五千两百亿呢?你看看可灵现在真金白银拿到手的融资是多少?首轮头前估值一百八十亿,比两百亿那个传言还打了折, 市场在用脚投票告诉你两百亿是吹的,一百八十亿也不低了。全球 ai 视频生成第一梯队,你看看 runway, pika 那 些,哪个到这个量级了?可玲去年一出来就把 solo 按在地上打,现在已经是全球最大的 ai 视频生成平台了。技术领先和赚钱是两码事儿。 你先别急着笑,我问你一个最核心的问题,分拆之后可零是独立上市对吧?那快手母体还剩什么?一个增速在掉的短视频平台,一个利润在缩的电商,一个打不过抖音的直播。分拆不是卖掉快手还是大股东?估值释放出来对某公司股价也是利好, 你看消息出来那天股价直接高开百分之十。高开百分之十又怎样?后面几天跌回来了没有?四十六块,跌了四个多点。市场兴奋完了,冷静下来一想,可零值钱,但快手本质呢?你把最值钱的器官摘出去单独标价,剩下的壳子谁要?你这比喻不对,分拆是让市场看清楚,快手不只是一个短视频公司,它有 ai 基因。 程一笑都说了,未来 ai 会让内容消费彻底个性化,可灵的商业化潜力还会爆发。程一笑说什么不重要,财报说什么才重要。三百三十七亿的收入只增长百分之三点四,利润跌了四分之一。你告诉我,如果没有可灵这个故事,快手现在值多少钱? 这个确实,如果纯按传统业务估值,可能也就千亿人民币出头。但这不就是可灵的价值吗?他给了快手一个完全不同的估值逻辑对吗?你自己都承认了,快手现在的投资逻辑全压在可灵身上,但可灵一旦分拆出去独立融资,新股东进来稀释,快手的持股比例会越来越低, 到最后你发现可灵越值钱,快手母体反而越像个空壳。你这是最极端的假设,现阶段快手是百分百控股,分拆引入外部融资不代表失去控制权,而且可灵赚的钱会并表利润,还是快手的。那他干嘛要分拆?不分拆利润不也是快手的呀? 分拆就是为了让可灵自己拿钱,自己花钱自己做大。说白了就是承认靠母体已经养不动了,养不动一季度利润还有三十四亿,够养好几个创业公司的。快手不是养不动,是想让可灵跑得更快, 独立融资能拿到更多弹药,不用受母公司利润约束。好,那我最后问你一个问题, ai 视频生成这块市场壁垒到底在哪?今天可灵领先,明天自洁出个更猛的怎么办? 百度呢?腾讯呢?技术迭代半年一个代计,你怎么保证可灵明年还是第一?这点我确实不好打爆票。但可灵的优势不只是技术, 它有快手的内容生态做底,几亿用户的数据飞轮在赚,纯技术公司做不到,这个抖音的用户更多,数据更厚,钱更多。自己要是认真做 ai 视频,可灵拿什么挡?先发优势在 ai 行业保质期不超过半年,那你说怎么办?不投 ai 等死快手至少在赌一个对的方向。 可灵现在是全球 ai 视频变现最快的产品,没有之一。一年五亿美金真金白银进账,这是实打实的钱。我不是说方向不对,我是说价格不对。 五亿美金收入给两百亿美金估值,你买的不是今天的可灵,是三年后的幻想。而三年后这块市场还在不在,可灵还是不是老大,全是未知数。你投的不是快手,是一张 ai 彩票,彩票也分概率高低,可灵是目前胜率最高的那张。核心业务虽然成压,但还在赚钱,给了你试错的时间窗口。 我宁愿拿着一家有 ai 爆发力的公司等三年,也不想拿着一堆便宜的传统互联网股票等到退市。那我反过来说,如果你征信可灵值两百亿,为什么不等分拆之后直接买可灵,非要买一个核心业务在衰退的母体?你扪心自问,你到底是在买快手,还是在读可灵?想清楚了再下单吧。

大家好,今天我们来对比一下赛出品的 guac 一 点五升视频,跟国产的可灵 v 三 turbo 的 一个效果区别。 首先我们来看一下这个 guac 的 效果,我受了这么多苦你都不来救我。然后我们再来看一下这个可灵的效果, 我受了这么多苦你都不来救我。可以看到就是可怜的,他的语气更加自然,而且有镜头切换, 我受了这么多苦你都不来救我。 grak 呢?就是重规重矩吧,说话有点作的感觉。好的,今天对它们的对比就到这里了, 但是有一点就是 grak 的 价格目前是非常便宜的。是多便宜呢?它只需要 只要几分钱一秒啊,只需要几分钱一秒,比如我哪怕选十秒钟, 我们选十秒钟它也只需要一块钱,打完折之后只要八毛钱啊, 幺零八零 p 的 也只要一块多钱啊。