粉丝92获赞305

这些这些这些 都是我用极梦 synx 二点零生成的效果。嗨,我是 ai 先生,我也算是一个干了整整十年的影视编导了哈,所以我花了整整两天时间,光充值就充了一千多,把极梦所有的功能案例以及网上各种神奇的用法 全部都测试了一遍,就只为了帮大家搞清楚一件事情, sims 二点零是不是 ai 界的 deepsea? 它真的有网上吹的那么强吗?以及它有哪些神奇的用法,并对咱们普通人有何影响?这应该是全网最完整的吉梦 sims 二点零评测解析视频, 视频有点长啊,但全都是干货,并且我把以下全部的测试的使用技巧,案例、提日词素材全部都整理到了线上文档,这么干的视频要个三连不过分吧? ok, 家人们坐好准备发车, 想要看懂 sims 二点零对于 ai 视频是否有颠覆意义,是不是 ai 界的 deepsea, 咱们要先搞清楚整个 ai 视频行业的发展脉络,那咱们就先花点时间来梳理一下啊。其实早在二零二二年菜的 gpd 刚刚震撼全球的时候啊, 就已经有了 ai 视频的概念了,但还没有一个完整的产品。甚至当时我们为了跟风啊,还把实拍的视频调个色,加个风格化, 伪装成 ai 视频。视频行业的朋友应该知道我在说什么哈。直到二零二四年, oppo ai 的 ai 视频模型 sorry 一 点零上线,这才一下子拉开了 ai 视频的大幕,尤其是这几个 ai 画面,不知道大家还有没有印象啊,当时确实把我给震撼到了。之后呢,国内的厂商也快速跟进, 快手的可灵、抖音的极梦也逐渐成为了咱们国内使用频次最高的两个 ai 模型,毕竟国外的 sora 和双威啊, 封门槛太高了,论性价比啊,还得是咱们国内的软件更懂咱们国内的市场。但即便是发展了两年,各种 ai 视频软件的顶配还是有几个核心的痛点, ai 视频一直没办法解决。第一个,人物不真实,虽然在质感上已经有了非常大的突破,但是很多人物的动作或者表情还 还是不太符合现实的物理规律。而第二个呢,人物缺乏一致性,生成剧情和故事的时候往往需要多个镜头画面,但这个时候主要人物就很难保持长的一样。第三,生成的结果不可控,就是每次生成都需要开盲盒,俗称抽卡,又花钱又浪费时间。那么这个极梦的 sims 二点零解决这个问题了吗? 其实啊,目前几个顶级的 ai 软件,他们的攻克方向各有不同,就比如说骚扰二,在技术上其实领先了很多,它采用的是 trance 八八的架构和隐士物理引擎,尽可能的还原物理规律,让画面的人物更真实。而可灵呢,则是采取了小步快跑的策略,迭代了很多 的版本。现在的三点零版本呢,是主打的人物动作的精细化。我不知道大家有没有印象,可灵之前有一个画笔的功能,轻轻一画人物这一块确实也沉淀了很多年了。当, 当然,这也和他背靠快手庞大的短视频美资库有关系。快手上什么最多呢?还不就是跳舞直播的小哥哥小姐姐比较多吗?那抖音呢?刚好相反,抖音这几年主打的是短剧或者是精选视频, 所以极梦主攻的方向就是在镜头的故事性和人物的一致性上。哎,那可能有朋友要问了,这个极梦和这个 sims 到底有什么关系?其实啊,这俩还真的不太一样, 因为极梦 ai 呢,它是属于字节推出的 ai 视频创作平台,它其实是归属在剪映的开发团队,也就是深圳的脸萌。而这个 c 震四呢,其实是字节实验室里自研的底层视频生成模型。 其实这俩并不能完全等同于一个东西,但两个产品呢,实际上是深度绑定的。这个 c 震四呢,不对外开放任何接口,也不允许第三方调用。 如果大家想要使用的话,只能在极梦平台豆包 app 和小云雀 app 以及火山引擎的这个 app 上来进行 使用。而 synx 二零二五年初上线之后呢,一共也就更新了两个半版本,到最近的二点零版本,能有这么夸张的成绩,进步速度啊,也算是相当快了。咱们在用之前呢,先来重点介绍一下这个 synx 二点零的核心的技术优势是什么? 它是采用了双分支扩散变换器的模式,视觉分支啊,是基于三 d 卷积加川字发嘛架构处理时空信息,生成帧序列。而音频分支呢,则是基于波形扩散加川字发嘛架构来处理声音,频谱生成顿化和音效。 说白了呢,就是相比于传统的 ai 视频,先拍画面再配音,我这个画面和音频呢,同时生成,就像有一个剧组一样,导演在这里想镜头,而音效是同时配声音,所以这个镜头的效果呢,就大大提升了。哎,那 这样的话,未来是不是还有可能是三分之或者四分之?编剧来想剧情,导演想画面,摄影师来想镜头,而演员来想表演, 甚至音效师再来想声音。哇,但这样想想, ai 电影还不马上就要来了, ok, 说了这么多啊,相信大家对于整个 ai 行业的发展脉络和痛点,以及吉梦森纳斯二点零的优势都了解的七七八八了哈,吹,都吹了这么多了,我也没收什么钱,那究竟好不好用?是骡子是马,咱们必须拉出来遛一遛。 ok, 我 现在就给大家实际演示一下这个极梦怎么使用哈。目前呢,这个 cns 呢,是只支持字节旗下的平台可以使用,主流的呢,就是这个极梦 ai 和小云雀, 这俩呢,都有 app 和网站,如果简单一点呢,就可以用 app, 那 复杂一点呢,我建议大家还是用网站好一点。那这两个软件有什么区别呢?就这个极梦呢,它是主站,它的功能会非常的全,但是呢,因为用的人也很多,所以生成一次呢,要等很长时间。那个小云雀啊,我自己实测,我就发现它生成的快很多, 当然它的功能不是很全,如果你想上传参考视频,它就不行。对,所以可能按你自己的需求来使用哈。 但是用过的朋友应该都知道啊,这两个软件有一个最致命的缺点,就是这个积分太贵了,每天一几百个积分也就只能用两三次。那今天大家算是来着了啊,我给大家分享一个我的秘密基地,随便升,不收费, 就是这个字节旗下的内侧中心火山方舟,大家可以看一下,你看这就是 sims 二点零,并且所有的功能都可以免费使用。但是既然是测试啊,人家肯定也有一个问题,就是他只能支持首尾帧,目前的参考视频目前还不支持测试。 ok, 我 们接下来就用极梦官网给大家来演示啊。 进来之后呢,大家可以先点击左上方的这个灵感,打开这个输入框,在下面呢,大家可以先点击左上方的这个灵感,打开这个输入框,在下面呢,大家可以先点击左上方的二点零。 当然可能有同学要问了,哎,我的这个打开怎么没有这个 c c 的 二点零,最高只有到一点五,那实际上可能你是一个新号, 你可以选择左下方的这个一元会员,先白嫖个七天啊,然后就可以使用这个 c c 的 二点零了。那接下来呢,我们还可以选择它的功能,比如说全能参考或者手尾针,这两个用的比较多啊, 然后也可以选择画幅以及选择时间,那有一个点大家要注意这个,每一次你的生成需求,他都会评估你的积分,这个积分大概是三十多分,所以有些新人朋友啊,就是一开始还没想好怎么升,就胡乱的提交,导致这个积分都快用完了,还没有生成想要的片子, 所以大家一定要小心。大家其实也不用担心啊,我会把我接下来所有测试的这个素材提制词,包括成片全部都放到我的教程里,大家可以模仿着来使用,让大家少走弯路啊,把这个积分用在刀刃上 哦,我自己其实也摸索出了一些白嫖积分的野路子,等一下我再给大家讲。 ok, 我 们接下来就围绕 c n s 二点零的核心功能,从不同的使用场景有简入深的来带大家测试一下。 第一层呢,我们先来测试一下这个 c n s 主打的这个人物移植性和运镜效果,为了这个保证这个真实性呢,我还同时邀请了两位对比选手, 一个呢是这个全球遥遥领先的这个骚扰二,另一个呢是极梦的一生之敌可灵。三,第一题呢,我们就简单一点,我找了一张图片, 这个大家应该都不陌生啊,这个是全游里面雪诺对阵千军万马的画面,大家都知道后面的剧情啊,我们让 ai 来续写一个不同的剧情,怎么样?我先上传了一张图片,提示词呢是镜头跟随着男的的男子,然后一群骑士冲过来,他转身要跑, 然后镜头侧拍,后边的马冲过来把他顶翻。最后一个镜头呢,是镜头自上而下的俯拍,他被顶上了天空。 ok, 我 把这个提示词发给了吉梦以及包括可灵。大家看看啊,我们选的是三点零版本,以及发给了这个三二二, 因为为了公平起价,我们每个平台只给一次升成机会,来看一下他们的能力。 ok, 我 们先来看一下吉梦的效果, 这个镜头跟随运动还是非常不错的,被顶翻的感觉也很真实,真的有点像拳游里的画面啊。 ok, 我 们再来看一下,可怜可怜,这个人物被撞的怎么这么窝囊呀! ok, 我 们看一下。 sorry, 哇, sorry, 这个人物的质感明显要好很多,但是最后怎么飞起来了,有点离谱哎,大家发现一个问题没有,我给到三个平台的都是一个人物的背身,可玲和 sorry 其实都没有认出来,只有吉梦认出来这是全友里面的女男主角雪诺。 哇,这可能就是 tim 担心的那个问题,大数据快速解锁就可以知道这个人到底长什么样子。 ok, 吉梦,可灵、 sorry 分 别是一二三,大家觉得哪个好一点,可以打个分。接下来呢,我们再用它的首尾针来测试生成一下画面,这也是可灵的拿手好戏了,我们看一下吉梦能不能反超我的手针呢是一个小米汽车的图片,尾针呢是一个变形金刚, 奇石呢是汽车飞快的驶过,然后冲出悬崖,在空中变成了机器人。然后镜头呢是环绕拍摄,最后机器人落在地上,整个的风格呢是这个末日沙丘风。来,我们同时看一下,两个视频的效果 还是挺明显的,积木这个镜头环绕就非常有感觉,可怜的就在死满。 ok, 左和右大家觉得哪个好一点呢?第二层咱们再来测试一下他的仿拍视频的能力,这个就复杂很多了啊,需要调用到图片、视频以及音频,我就不让另外两个小手参与了, 我先找了一个抖音的热门音乐。这个银龙鱼大家应该也不陌生啊,我又找了五个动物来替换掉视频中的五个舞蹈演员, 来我们看一下生成的效果,还是挺真的。哇,这两个老哥怎么没有去掉啊,还有那个狮子在旁边摸鱼哎,不过大家看到没有,他整个的镜头运动和原视频非常接近,并且甚至是黑夜的噪点他都还原出来了, 真的不错啊,我今天这个功能真的急么?可以再深更一下,感觉以后的抖音热榜全部都是 ai 生成的视频了。哎,那如果想要仿照更专业的 t v c 广告呢? 那这个时候我们的人物啊,就要更精细一些了。我先让娜娜补,娜娜帮我生成了一个模特的三式图,然后再找了一个苹果的经典广告题,日词呢,就是把视频中的女主角换成男主,把手机换成板砖,然后完全模仿原视频的画面意境和人物动作。来我们看一下效果, 板砖有点突兀,但这个质感还不错,哎,最后怎么又切成手机了?这个女生还出现了有点小 bug, 不 过几分钟就能生成一个这样质感的广告,已经很牛了,想要入局广告行业的同学们可真的要三思了。 ok, 前面呢还都是小顺牛刀。第三层,咱们直接让他来拍个电影怎么样?要玩就玩最大的 黑之王悟空。不是前两天刚发了那个钟馗的 cg 短片吗?让我有点好奇呢,就是他最后被蒙面的那个人到底是谁?结束的时候不是戛然而止了吗?没关系,我们让 ai 帮忙去续拍一下。这个准备的环节就比较复杂了,我给大家简单描述一下。就是我先让拆的 gpd 帮我构建了一下接下来的剧情以及分镜头脚本, 然后再让那那不单的生成每一帧的画面,最后把这些图片全部都上传到节目的这里。其实词呢,也相对说复杂一点,就是零到八秒呢,我先描述在昏暗的客栈里,有一个人们套着头套,然后八到十秒,孙悟空和钟馗打起来了, 十一到十五秒,孙悟空直接冲上了钟馗的眼睛,大概这样的一个剧情。哇,我这条真的等了好久,来我们看一下效果,还原度还是挺高的, 帅啊,大家觉得怎么样?这个镜头质感是不是已经可以在黑神话悟空里以假乱真了? 不过就是时间有点赶啊,中间有点小 bug, 大家见谅啊。哦,如果大家在生成的时候积分不够用的话,我给大家推荐几种我常用的方法。第一个呢,就是多注册几个手机号,新号啊,可以白嫖,吃点低保,又或者是开个一元会员都可以用。 那又或者呢,是参加一下集梦的这种拉新活动,或者去海鲜市场淘一淘?但这个呢,就不好明说了,我把我过去踩过的坑或者觉得比较有用的都放到文档上了,大家可以按需来使用。 不过呢,大家注意到没有,我整个的测试呢,从单个的运动镜头到访拍视频,再到组合起来讲电影故事,一整套流程下来,其实就是一个完整的电影制作流程。 所以啊,你看似这个 cds 二点零只是对运动镜头的一个阶段性的升级,但它实际上呢,是突破了整个 ai 生成视频的瓶颈,让 ai 彻底颠覆影视行业更近了一步,这也是让 tim 都如此惊讶的真正原因。能看到这里的朋友呢,相信对于 ai 视频都非常的感兴趣,也有一定的见解了哈。 我呢也想说几句我自己的真心话,如果一定要评价或者总结的话,说实话,这个 c c 四二点零的升级啊,其实并没有让我那么觉得惊艳,我也不想无脑的吹它,它确实在人物一致性和运动镜头上有了非常大的改变,但如果以一个电影画面的标准来看的话,它差的还很 远。但其实我也看到了希望。你想啊, ai 视频从二零二四年问世到现在也就两年时间,已经能做到这种效果了,如果再给它两年呢?再给它五年, 咱们等得起,他又能给我们多少惊喜呢?也许到未来的某一天,我们就不需要再等待了,那些易难平的大作,全运的游戏,三体魔界, 咱们都可以用 ai 来实现,各位会期待哪一步呢?好了,这就是本期视频的全部内容了,感谢点赞,这会让视频推荐给更多的人。如果需要上述的所有的案例、提示词以及教程,欢迎留言,我免费送到。在这里呢,祝大家二零二六年新年快乐!

打着球还得给你们发这个 c 档子接口如何?普通的个人消费者调用接入,你看现在公测了,面向企业实名认证, 没有预付门槛,就不用一个月消耗一百万,一年一千万,按实际调用量付费,默认并发症十个, 单个企业最高十个生成任务,你要充了钱,一次能生成一百五十个,但是一个提示词生成十个,我觉得也够高阶生产权限,现在的条件是保底合作需要支付百分之十预付款 一百万保证金。官方的流程是这样,这个文档我可以发给大家访问火山官网,海外可以注册实名认证之后,现在已经开放了渠道了,官方的申请页面地址给你们。在火山风中里面获取。 api 怎么调用?这个你不会让你的程序员看一下 agent 接入是什么意思?就是你在自己的任何 agent 里面有一个链接可以接入 agent 接入 在 agent 里面就相当于你,比如说你有个智能体说我说你,比如说你的智能体叫瑞雪,我就跟瑞雪说,瑞雪帮我调用吉梦的 agent 做一条视频,这叫 agent 调用,这个很简单,这个只需要给一条命令就可以, agent 里面的更简单,但是它的功能有限,所以我们现在有三种结构方式,三种,一种充钱一百万的,一开始大家以为就这一个,第一种就是百分之十一付款加一百万保证金, 第二种就是你认成人企业基础,公测一次十个,第三种就是 a 证他接入,这三种方式大家理解了吗?这个接入文档是我总结的,肯定 ai 帮我写的,但是我把我们总结的要点都准备好了,这可以发给大家。

ok, 各位股东们,我是强子,汇报一下最新的进展,现在已经到最后冲刺阶段了,前面的这个图片模型和三 d 导演台基本上都完善的差不多了,最后一个环节就是视频节点,我这个是接的是 火山引擎的官方 api 接口, cds 二点零的一个模型,生成了一段五秒钟的一个视频,采用的是之前生成过的一张图片作为参考图,指令飞机飞向三人出来以后就是这样的, 这就是出来的视频的一个情况,因为我们这个是全程支持自定义 api 接口的,所以不管说你是采用官方的对吧,还是自己的这个 api, 只需要把相关的信息接口地址 和模型名称填进去,在这个视频节点下方节点选择你添加的这个模型,点击生成就可以。

吉梦 cds 二点零最近非常的火,很多用户的话都在催我们这边赶紧上线,那这个模型其实也就是刚上线几天的时间了,我们也是花了一天的时间紧急揭露了,就是在原来的基础上,在这个 solo 的 小程序的一个基础上,增加了这个吉梦的 cds 二点零的一个模型, 可以直接去对接这个官方去生成啊,这个生成效果还是非常不错的。但是需要注意的是,就是这个模型的话,它是目前是限制了一些真人,比如说一些自己的照片,或者一些真人或者一些明星的照片,它是不能够上传的,如果上传的话,它这个可能会失败啊,就没办法,这个是官方的限制, 因为目前的话在运营过程中可能是啊因为一些违反的一些相关的一些规定,所以说这个 cds 二点零目前是不支持这个真人的一个照片的上传的,那之前像支持真人照片上传的,像 v o 啊 solo 二这一块,目前是支持这个真人照片上传的, 所以大家去生成的时候需要注意了,如果你上传这个动漫人物的一个照片或者其他一些物品照片,这个是没有问题的,你可以放心的去上传,我们这边已经有这个成功的案例,如果想详细体验的可以联系我们。

大家好,火山引擎正式开放了, c 档四二点零啊,我实测之后发现它的速度真的是太快了,我生成一个五秒的视频,一到三分钟就完全生成了,包括于 c 档四二或者 c 档二 fast, 今天我就教大家用三种方式去实现啊,在这个使用火山引擎的官方 api 去调用生成视频。首先我们需要去开通火山引擎的啊, c 档四二点零的模型,那我们要登录的是火山引擎的后台官网, 那我们登录它的官网打开控制台啊,我们去选择是火山方舟,我们需要在开通管理里面开通我们对应的权限, 我们可以看到我们主要是开通的是 c d s 二点零,我们选择去开通它服务这里,如果说你没有的话,选择开通服务,开通服务之后它就会有这样的一个弹框,我们选择这个 c d 二零二点零和 c d s fast 确认开通就可以。开通完成之后呢,这里可以看到 就会显示状态是已开通,这里呢就比如说现在 c d 二的话,它目前给了你六十四万的免费额度,后面它也包含它的一个单价啊,这个单价呢大概是啊,每十万托盘的话,大概是两块钱左右啊,如是 fast 的 话,如果说 c d 的 话,每十万托盘要贵一点啊,基本上就是 属于是一秒一块钱的一个左右。然后我们来看一下我们的第一种方式呢,是从控台去调用啊,控台这里呢我们就可以打开模型广场,模型广场这里有个 c c dunks 选择体验,体验之后呢可以看到这里就他对模型我们选择立即体验, 就对于我们来到这个 c dunks 二的这个平台,可以看到这个是我们之前生成的视频,这里还有一个之前测试生成的视频啊,对右右侧呢,打开之后是它的一个配置, 它的 task id, 在 这里呢,我们就会选择参考参考生成或者是首位帧生成啊,这个都是使用的,左侧的就会弹出这个 c 到四二,我们可以切换到二点零, fast 的 或者是二点都可以,这里会选择对应的它的比例,分辨率,时长, 我们这里可以选择它的时长,右侧是它的一个价格,每百万 tokyo 的 价格啊,这里 c 单词二,那可以看看到我们之前的,就这里就可以参考生成, 生成好一个视频,那这个视频生成之后呢,我们可以看一下极梦会员的价格的话,大概是它的会员价格是大概是一积分,是一块钱左右,如果说使用 cds 二的话,它是 它大概如果说是四十秒的话,它是大概是在两块钱左右,如果说你使用 a p i 去调用的话,可能 a p i 调用的话会贵五毛钱左右,等于说每十秒会贵一块钱,但是呢,用 a p i 调用一个好处就是它完全不用排队啊,一到三分钟就可以直接生成完成了, 根本不需要排队啊,你不用才从迅疾开多个会员,你只需要去开通对应权限就可以了。这里是我们调用的视例啊,我们刚才生成的这个视例,其实我们在生成完整之后呢,我们需要看它消耗的 token, 这里呢,我们再点开视频之后,它那有这样一个 task id, 我 们需要复制 task id, 找到这个火山引擎的 a p i 文档啊,这里有个 a p i 文档, a p i 文档里面呢?它有一个查询视频认证进度,我们把它复制过去, 发起调试,就能看到对应的它使用的模型啊,这个任务的一个执行情况,执行的它所占用的这个 toc 数,比如说这个是十二万 toc, 可以 看到它生成的时间啊,可以看到这个是更新的时,创建的时间是多久?更新时间是多久? 这个是它是这个视频的话,大概生成了两到三分钟左右。啊,这个是它生成的一个情况啊,这是从后台去调用,这是第一种方式,我们可以通过后台去。 呃,使用方式跟积木是比较类似的,我们也可以去查它,查看它具体生成所消耗的 token 呢?通过 a p i 接口。那第二种方式是通过 m c p m c p 的 话,我们首先要需要去,比如我们使用的是 work party, 那 我们使用 work party 的 话,提前我们需要去配置 配置对应的 m c 工具,我们只需要复制把这个 t s 给到这个 bug 吧里,让他帮我们去安装这 m c p 纸。还有 k k 的 话,这里我们去我们后台管理里面去找到对应的 k, 我 们需要去创建 k, 我 们返回体验中心里面有一个 api k 的 管理,这里我们可以创建个 k, 创建 k 复制出来,复制出,复制出来,放到我们的跟这个 bug 吧里对话的中去的话,去帮我们配置 api k 和 m c p 的 配置,这个时候我们就可以测试,我们就有提示的测试,那我们直接看一下,我们之前测试测试了一下这个四百八十秒跟四秒,这里会有一个问题,是睫毛 s n p 的 话,它的这个接口只是五秒跟十秒,所以我们四秒暂时测试不了, 所以说我们这这里选择这个分辨率是七百二十加上五秒使用这个 c 档是二点六 id, 那 这个 id 怎么找呢?这个 id 是 我们在这个开通管理里面有个视觉管理,这里有点击这个模型模型,这里复制它的 id, 这个就是我们要配置 id 啊,他不是外面这个 id 啊,这个是我们调用的时候啊,也要使用这个 id 去调用啊,不然会报错啊。对应呢,我们在这里可以看到这个呢,我也给大家贴出来一个模型 id, 对 应不同的模型 id 啊,注意这个是要注意点,需要这个模型 id 去调用,这里我们看到它因为生成的时候有版权的提示,所以说它在调用的时候啊,这里是它生成的方法啊, u c d 调用的方法对应的是调用参数模型的 id, 它提示词去生成,这里它会轮系,之后呢,它会发现这个 参数问题的话,又会重新调试继续生成,最终的时候呢,它在运行成功之后呢,这里会爆了一个敏感所说,这里在 ai 分 析的话,因为你的提示中涉含一些版权保护对象,所以它就失败了,这个时候呢,我们就可以方便地知道我们 我们的这个具体的失败的问题,我们对应去修改自己提示词啊,比如说我下面我就设个修改另外一个提示词啊,这里我们在修改另外一个提示词之后, 我们换一个提示词,就没有带版权提示词,这个时候调用的话,他会问我们有没有图片,我们没有没有图片,只有文字生成, 这个时候呢他就会继续调用,生成的时候帮我们去解析,这里也是解析的题目调用参数,这个时候他就会轮询这个 c 档我们选择的模型哈,可以看到我们这里选择模型是 c 档四二, c 档四二的话, 它的时间其实还比对应的这个 c 档词 fast 台更快啊,因为可能啊比较花钱嘛,所以说它每次轮询可能大概一分多钟就把这个内容执行完成了啊。对应看到我们可以去 testkit 去找 api, 看它实现的这个所消耗的 token 数啊,我们也是从这个 api 接口里面去找啊,这里去查询,找到它的 token, 看到是十万 token, 那 十万 token 就 没十万 token 就 大概是三四块的样子啊。这个它的一个创建时间,还有整个任务的个情况,这是它的创建时间的地址, 这里就显示它正常的意思。我们测试的时候是一分多钟啊,可以看到一分钟使用 c 量子四二点零啊,除了说你对你非常节约时间的时间, 那第三种方式呢?是 a p i 调用,那 a p i 调用的话,大家可以参考这个 a p i 的 官方文档,而这种调用需要注意点是大家在调用 a p i 的 时候,余额需要去满足两百元啊,我也是换了两百万元的大洋, 就开始去注册账号,获得 a p i k 以刚才位置并开通了服务。这下面就是它的 a p i 调用的一个测试和它模型的介绍啊,这里有一些多模态的参考的一些视力的介绍啊,这里是它的, 下面是对应的有个代码, python、 java 的 代码,调用代码啊,这些执行的代码,这是 api 方式的调用,这就是我们介绍的三种调用 c 档四二零零 api 的 一个方法。

大的来了,朋友们,公司上个月申请的 cds 二点零 api 接口刚刚已经成功开通了,而且据说这两天火山已经给很多之前申请的公司都开通了 api。 而且呢,我刚刚呢,还看了下规则,发现视频输入与非视频输的价格居然差到了十八元每一百万头肯, 那包含视频输入的价格目前是二十八元每一百万头肯。但如果你仅仅使用图片、文字或者音频,那则输入价格是四十六元每一百万头肯。 同时计价方式现在也很清楚了,大家可以看我发的上图,是按照输出视频的宽成、高成帧率、成时长计算消耗的。 目前呢,七二零 p 分 辨率的五秒视频消耗约为十点三万头肯,那对应一秒视频的输入成本是就是五毛八,是零点五八元,非视频的输入成本呢,则涨到了零点九六元。 此外呢,官方案例还显示,如果输入视频还参考了人物动作、镜头语言或者运镜方式, 则价格可进一步降到二十八元每一百万 token。 我 的理解是呢,如果有视频参考的模型预算更简单,如果不含参考视频的话呢,文本到视频是有一系列预算的,所以说消会消耗更多的算力。 所以呢,自己找运镜镜头,或者干脆自己拍一段动作传上去,帮助模型节省 token, 这样呢,价格就能降下来了。 总的来说呢,啊,做精品慢剧的呢,这个费用还是可以,但是呢,呃,可能个人制作者还是有些吃力,所以最后说下朋友们,赶紧撸起袖子开干吧。同时呢,如果你有手搓作品或者会有动态慢的话也可以一起合作。

我太开心了,前两天买了一个 cds 二点零的个人 a p i, 然后我给他手搓了一个网站,大家看一下我的成果, 来大家看一下啊,这个网站本来是想用 cloud 来做的,但是 cloud 它做的话,它不能接入我扣子的积分和扣子的一些模型,所以我就直接用扣子编程,直接去 web 扣定了一个网站,几乎就是我们做 视频的全流程。首先我们可以输入一个创意主题和故事的表述,他就会给我们完善这个故事,去生成一个文学剧本,然后根据文学剧本 去梳理这个剧本里面可能会出现的所有的人物,然后以及场景道具等等的。除了可以自己生成,我们还可以上传,因为我需要用 type g p t 去生成图片, type g p t 的 图片更加的准确一些,所以我给了一个上传的按钮,然后所有的资产确定好之后,我们直接生成分镜,分镜同样的话它也是可以给你生成这个分镜图片的提示词,然后你去用 banana 或者是 type g p t 生成,然后给它替换替换一下。 所有的分镜生成好之后,我们再去进入到视频生成,我们可以选择我们需要生成的视频分镜,选择模型,选择模式包括我们需要引用的车和道具等等的。 最后选的视频比例选择我们的描述和分辨率,以及我们要生成声音,点击生成视频,他就可以生成这样的视频了,已经完全跑通了,而且抽卡率极低,效率极高,非常好用,各位。

朋友们, cds 二点零 api 昨天推出后,真的不要再去卷 ai 的 短剧慢剧了,给你们一个我最近尝试的新方向,就是用 ai 做网络小游戏,今天呢给大家分享一下我的思路和玩法。 首先呢,大家可以看我这个视频,就是我用智谱模型配合 cloud code 只花了十几块钱和十几轮对话呢,就做出来的我的世界风格的飞机大战游戏, 完全开放的世界,并且呢随意添加元素。其实呢,我感觉 gpt 和 kimi 呢也能做出来,但是呢,智普做这种任务的性价比是最高的。其实呢,制作这种小游戏比大家想象的简单很多,咱们只需要用到的技术就是 html, 然后呢,再需要配合一个功能描述的开发文档,然后风格呢可以直接写参考我的世界大战像素快风格,当然具体的操作功能和开发文档呢,我也已经整理好了。 所以说今天啊讲这期视频呢,主要是告诉大家 ai 行业的新机会还有很多啊,没有必要非要盯着一个方向去卷。当然如果大家有其他好的思路呢,也欢迎在评论区分享。那今天的视频呢,就先分享到这,然后呢,我会持续更新最前沿的 ai 工具和信息,咱们下期再见。

再把肝打开,先进场的人先吃肉,晚了只能喝汤。为什么同样是用 c 到二点零做短剧,有的团队三天出一部,有的团队三个月都没有上线,就差这一个选择。今天我来揭秘,到底是 vpi 接入 vs 火山剧创平台,到底哪个更适合你的团队呢?首先,第一步我们来拆解一下技术门槛。如果你是 api 接入,你得养一个后端开发团队,分镜、角色一致性、竖屏适配全部都要自己做。 聚创平台他是零代码的格式化界面,你把剧本丢进去,角色分镜,角色跨级数,画风统一。第二,我们来算一下成本, api 接入他是 按量计费的,也就说还有隐形的人力成本,烧钱速度是远超你的想象的。那火山聚创最低年套餐九十九元起,没有额外的技术投入,那成本哪个更低?不用说。第三,我们再来对比一下合规权益 api, 它需要签保底协议才能够使用真人权限,那火山聚创内置版权审核体系,真人版权线直接打开,不用签保底协议。说到这里,到底你适合哪一种?我相信不用我说,你应该有数了。 是的,如果咱们有大厂的技术支持,你可以选择 api, 追求极致的定制。如果咱们是中小创业团队,刚刚起步,那我们去选择火山聚创, 快速起量才是王道。如果你想测试 ai 短剧慢剧的赛道,但是又怕踩坑,那火山剧创他需要代理商开白,自己个人是申请不了的。那我们呢,是火山引擎的官方授权代理商,在我的评论区扣开白,或者直接私信我,手把手带你跑通第一级的制作流程。

哈喽,今天一分钟学搭建一套电商分镜工作流来看效果。先说一下整体的思路,在整套流程搭建完之后,只需要在第一个节点上传视频,系统就会自动拆解出完整的分镜脚本,接着再上传自己的产品图, ai 就 能自动适配生成新 的分镜脚本,最终生成一张十二宫格分镜图,接下来揭晓实操。今天这一期用到的是 running, 在 主页新建一个项目,左上角可以自定义项目命名。这一期拿宠物工作流举例, 首先从左侧加号的入口进来选择上传资源,先把对标的参考视频导入进来,接着下一步选中对标视频。这里有两个核心功能,第一个是捕捉帧, 可以提取视频的核心关键帧,另外这个是视频解析,可以一键拆解完整的分镜脚本。那这个捕捉帧的功能我觉得还是挺实用的,可以提取所有突出产品卖点的画面,如果我们需要某一帧,就暂停这个画面选择捕捉, 以此类推,可以着针筛选所需要的关键针,在提取完后,选择这里的第三个功能,可以一键添加到画布。 ok, 现在我们回到画布,再去添加一个分镜拼图的节点,就可以把关键针拼成一张多 宫格图,这里可以制定拼图的比例,还有宫格数量比例,这里我选择九比十六,网格数量选择三乘三。接着我们只需要把图片对你的顺序放进来就 ok 了,那么后期就可以直接基于这张分镜图替换产品生成新的分镜图。 不过这期搭建的流程不需要用到这个功能,只是给大家演示一下。接下来到了第二步,这里已经把视频解析成了 十二个核心的分镜,有需要修改的话可以直接在段框说你的需求,这里用到的是谷歌的拆解模型,整体效果还是不错的。接下来到了第三步,再添加一个节点,这里可以上传我们的产品图,那这里我的产品图就比较复杂, 我上传一张多细节的产品拼图,然后再把刚刚拆解好的脚本和产品图连接起来,接着在产品图的右侧添加一个文本生成的节点,让 ai 更 去拆解的分镜脚本。进入产品图,生成一个新的分镜脚本。贴词的指令可以参考我自己来稍等一会来看一下输出结果,现在已经执行完了,可以检查一下产品的外观描述有没有什么问题,没问题的话在脚本生成完后,接着我们再增加一个图片生成的节点, 这里就可以让 ai 参考新的产品脚本,结合产品图和风格参考图,申请一张新的分镜图。最后在深图贴纸里,我们可以去补充我们的产品介绍,然后在对应的位置引用对应的图片,然后生成就 ok 了。测试下来,整体执行的速度还比较快的,这样一个简易版的电商工作流就搭建好了。 最终在生成完之后,这里我还是用到极梦来生成视频,基本的思路就这样好了一场本期视频呢,就有用的话不用点赞关注,咱们下期见,拜拜!

这条视频我前后花了一千多算理,整整测了三天,现在你只需要两分钟就能学会我这几天总结的关于 cds 二在电商领域的真正玩 法。 cds 二真的是一个能够重构电商内容生产流程的宝藏。首先它的常规玩法,我们直接快速跳过纹身视频看这里, 徒身视频看这里, ok, 接下来我要讲重点了,真正拉开大家使用差距的是 c 档十二的全能参考模式,它这个功能真的强的离谱。首先玩法一,同款产品换颜色。比如说,哎,你有一件爆款的 t 恤,它有很多种颜色,但你目前只有白色的。实拍视频, ok, 打开全能参考,直接上传原视频,然后告诉他,视频一中模特身上的服装颜色跟后面藏蓝色,其他完全保持不变,他就直接给你生成这个藏蓝色的版本。无论你这款衣服到底有多少种颜色,对他来说就是一句话的事情。做店群的商家看到这里,哇, 天都亮了。玩法二,一键出专业分镜很多人不会拍视频,是因为脑子里没有镜头结构。现在你直接上传一张模特图,然后告诉他,根据电商视频的分镜,包含远景、中景、特写面料、细节、模特走动镜头来生成视频, ok, 直接一键成片,而且效果还非常赞,这太夸张了,哪怕是脑袋空空的小蠢蛋也直接起飞。 玩法三,模特替换。比如说你现在只有一个亚洲模特,你可以告诉他,替换成欧美男模,保持服装版型不变,呈现真实上升比例,他可以在不改变产品一致性的前提下大变活人跨境商家直接被香哭了!玩法四,也是最狠的一个多款式换装视频一键直出什么意思?那这种视频快速切换穿搭的一键直出 怎么操作?直接输入图片一里的女孩分别换上图片二里的衣服,并且整体动作逻辑正常, ok? 城边直接出来了, 是不是很夸张?都不需要做分镜了,直接一键生成换装博主的天都塌了。 我们再看玩法五,视频延长。哎,这个就切中电商视频的一个老毛病了,比如说你的视频太短,然后投流效果不理想,或者说你这段视频里面想要再续几个镜头,但是你又没有办法再去重拍了。 现在你直接上传视频,然后告诉他将这个视频延长十秒,模特继续做动作展示,保持节奏一致,他会直接锁死模特形象,服装结构、场景环境、光影关系、镜头运动节奏,然后在原有时间轴的基础上继续去延伸这条视频效果你们自己看。太离谱 了,这个时候某些聪明的小脑瓜马上就转起来了,哎,他能干什么呢?第一,延长爆款视频的生命周期。第二,将一条爆款视频拆分成多个爆款视频, 怪不得人家能赚钱呢,你瞧瞧这记忆力。再看他的第六个玩法,自动根据音乐卡点生成视频。我不说你肯定意识不到,这是百分之九十九的人都会忽略,但是超适合短视频平台的功能。 看我操作,上模特图,上服装图,上卡点音乐,然后告诉他根据音乐节奏生成模特穿上该服装的卡点展示视频,动作自然,节奏匹配古典,他会自动分析音乐节拍,然后生成跟音乐节拍相匹配的视频效果。你们自己看, 剪辑博主的天都塌了,你还在这苦哈哈的剪辑,人家直接一键生成。讲完了上面这些玩法,你是不是以为就结束了?我再讲三个他更高级的能力,但这些能力已经超出了电商层面了。 第一,环境逻辑与声音联动什么意思?他这个不是简单的贴音效,他是在跟人一样做环境判断,并且附上相匹配的音效,就这种效果,音效师的天都塌了。不管你是干什么的,就这个能力,他都会让你的视频质感提升好几个 level。 第二个我觉得比较夸张的能力,复杂创意动作的执行能力 能复杂到什么程度?我选择了首尾帧模式,并且直接给他来了一篇一千多字的小作文,内容包含了每个分镜的相机参数,镜头角度、景别,运镜方式,场景样式,场景音效,整体色调,人物打光,妆容,服装特效,动作,就这么一整套。不夸张的说,詹姆斯卡梅隆来了都得懵逼, 但你看他的完成度,不说百分之百精准,但百分之九十的准确度还是有的。导演的天都塌了,就这种语义理解能力,不管你的理解你的要求并且完成, 最后再看第三个运镜视频的一个复刻能力,就这种视频节奏好,运镜炫我直接上传,连提示词都不怎么起,他直接附用运镜逻辑节奏节拍动作关系,然后来给我生成视频。运镜博主的天都塌了, 我苦哈哈的拍半天。不如你们直接拿成熟视频做结构参考,然后生成属于自己的版本,说不定你们生成出来的效果比我实拍的还要好。 好了,如果你能看到这里,那恭喜你,在对 cds 二的理解以及应用上,你已经打败了百分之九十九点九的人了。接下来自己去实操和应用就好了。如果说你也对用 ai 去生成电商内容或者说服装内容感兴趣的话,可以给我点个关注。我是牧童,目前正专注于用 ai 为电商以及服装去提供一些解决方案。我们下期视频再见。