如何用 ai 从零到一做一部属于自己的江湖混剪呢?今天保姆级手把手教会你。 哈喽,大家好,我是布宁,又和大家见面啦,今天呢,给大家带来最近在短视频上很火的江湖类的 ai 视频混剪教程,顺便给大家介绍一下我最新发现能够提高创作效率的新工具和新平台,我们一起来看看吧。 首先给大家推荐一个我平时做片子前找参考的一个平台,我们在新片场中可以看到很多优秀的导演以及优秀的片子,比如我们这次要做一个江湖类的混剪视频,我们可以在搜索栏里面搜索关于武侠的关键词,这里有很多优秀值得参考的片子,这将会是我们的构图参考和审美参考。比如我们参考这条片子, 我们可以看到在片子的借笑栏这里有一个分镜的功能,我们点开它,它会自动的帮我们拉片,并给了我们景别、灯光、运镜划分等等。我们可以点击这里的查看画布,引用画布就可以直接跳转到我们的画布里界面,我们可以得到整部短片的分镜头,这对我们后续的创作起到非常重要的作用。 接下来正式进入到我们操作的环节,我们预览这个分镜表,寻找我们脑海中想要的镜头。我觉得这个镜头不错,是我要的角色在沙漠中独自前行的一个场景。所以我们就可以点击图片右上角的这个小箭头,它就会自动提取出这个分镜以及它的镜头介绍,包括镜头的灯光、运镜划分等等。接下来我们就要寄予这张提取出来的图片, 提取出我们关键的题词信息。我们将这张图片拖到右边的这个对话廊里,输入这样的一段话,当我反馈提示词要详细的描述角色的构图,警别色调,然后写上你想要这个画面中角色在做什么动作,以及你想要什么模型,生成这张图片的中英文题词,然后我们点击发送,等待一下,它就会生成一套我们可以直接复制使用的提示词。 ok, 我 们就已经得到了这段可以直接复制使用的贴纸,所以我们将这段贴纸复制下来。我这里用的是迷你的拘役的微机模型进行生成图片。我们双击屏幕,点击生成图片。在这里我们可以选择市面上各个主流的模型,我们选择 u 传微机,将这段贴纸直接复制在对方框里。 同时这里我给大家准备了一个我提炼的一个 p 纸,它能够很好的保持胶片质感的风格。我们将这个 p 纸黏贴到这段话的最后面,点击发送,等待它生成图片。 于是我们就可以得到相同内容江湖港浓厚的分镜图片啦。基于这样的方法,我们只需要寻找我们想要的构图,然后仿推提一词,用上我给的壁纸,就能达到相同的效果。下面这些分镜图片呢,是我这部片子用到的主要画面。然后再来提一嘴,您的军演生成的图片可能自由度会高了一些,所以我们需要用 banana, banana 来进行改图。以粘图为例, 我们可以看到其实迷了军眼出来的图,有时候角色形象会不太对,我们这部片子里面主角是一个寸头的男生,那么我们就可以说将这个男生的头发变成寸头,其他保持严格不变,我们就可以更好的保持角色的一致性。有了这些图片,我们就可以直接拉出一个视频节点,选择可灵的模型生成动态视频,用最简单的话告诉他你想要的内容就 ok 了。 最后我们将我们生成浩的所有分镜视频串联起来剪辑就完成。若果我们编制的制作部分,我已经将我的花布在心心颤的 shortplay ai 平台中公开,大家快来一起交流学习吧,咱们下期再见!天下风云出我辈, 一入江湖,岁月催江湖, 只要有人就有恩怨,有恩怨就有江湖,人就是江湖,像你这种年轻人,我见得多五点武功就以为可以横行天下,其实行走江湖是件很痛苦的事。
粉丝176获赞1.2万

干什么活,用什么 ai, 如果这个 ai 工具你日常生活中都用不到,那它再高科技都跟你没什么关系。我今天呢就分享那些能帮你干活的 ai 工具到底有哪些,一条视频给你讲清楚, 凑近过来给大家去讲一讲啊,这样更亲切感。我分为三个模块来分享,第一个呢是首选就是效果最好, 基本上都要刻个二十刀这个样子,但是它生产的结果啊,是对得起它的价格的。另外一个就是平替款,它的性价比是最高的。第三个呢就是开源的,顾名思义就是在你本地部署了, 不需要米就直接在本地运行了。首先大家用的到最多的都是叫 ai 文字工具这一类,就是你跟他发一条消息,他回你条消息,但千万不要把它百度用啊,你能拿到的结果就是最好的。 然后平替版的话,其实大家可能会想到 deepsea, 但在今年的话,我选择的是豆包,因为豆包它更加的多模态,又能够做图,又能够做视频,通过这个字节加的一些资源啊,能够查到一些比较准确的信息,这些堆砌我觉得是性价比很高的,同时呢,它也不需要你花钱就 可以直接用的到。再就是本地化部署了,本地化部署的话,我选择的是千问,因为千问家有很多种模型都开源了,可以根据你本地电脑的一个设备情况就可以跑起来,比如说七币呀,八十币呀这种样子, 呵呵呵,你可以自由去选择,然后通过你本地的去调用,这样的话方便你有些秘密的这个小讯息啊,你想在你本地电脑上不外泄啊, 你可以选择这个也是看你机器情况的啊,它主要跑的是显存文字。讲完了,接下来就要进到咱们的 图像工具了,图像工具在哪呢?首选还是 nano banana pro, 它在识别你语义上面的准确率非常非常高。刚刚我们说的 jimmy 三,在你发完之后,它会去分析你的真实意图是什么,通过这个意图的拆解之后呢,再去描述下达准确的任务。这就相当于你 在和一个普通职员聊天中间有了一个项目总管这么个东西,他就会很清楚,我会经常拿他去用一些,比如说黑板图啊,思维导图,手账,他做的是真的非常细,你可以对比一下其他做图的 ai 哈,是 达不到它这一点的。平替版的话,我推荐的就是吉梦,它的整个美术风格啊,哎,也都还不错。 mid journey, 它也算一个平替版,它主要在于艺术创作这一个板块,不太适合于国人的这种有些语义的一个场景画面。所以呢,选择本土化 的是一个最优解。本地化部署呢,这里就推荐 z image, 你 可以通过一个自然语言就可以让它生成图片,就是非常简单。你觉得生成的这个画面上面有一点 哎,不那么适合你的话,你可以选择 stable fusion 啊,它有一个 web ui 的 界面,也有一个比较复杂的康复 ui 界面,好几年前吧,我在用的它的效果 是真的非非非常好。这里提到了所有本地话不熟,你也可以在云端,比如说云端有一个服务器,你可以把这些本地的程序放在上面去跑, 不一定是你本地的机器,你也可以在网络上租机器来跑这些本地的模型啊。这就像是当时我们在上网吧,我家里没机子,我就去黑网吧,去租人家的机子, 一个小时两三块钱,这个样子对吧?我在家里玩游戏,我在网吧也玩游戏,哼,就是这么个逻辑啊。 ok, 图像讲完了,我知道大家接下来想听什么,就是这个 ai 视频工具首选的还是谷歌家的 vivo 三,它的整套的逻辑怎么说呢?还是在语义上面,你通过 dream nine 去分析你的整个语言的意图, 然后分析完了之后,它自动帮你去补充这个画面应该怎么去设计,这个在它后台全部完成,你前端是看不到的。那在国内呢,性价比最高的就是可灵 ai 或者说即梦 ai, 因为它们都有一个非常厉害的功能,就是首尾帧, 你可以通过前一针和后一针,然后自动生成中间的针数,也可以通过一个生成好的图片让它去运动起来,这个是我日常中经常使用到的。那目前的话,可零还是在视频生成领域,这个效果上面是最好的。 即梦的话更多的是一些玩法,你们可以多多体验一下他们在生成视频上面的一些差异感。如果非要让我在两者之中选呢?我会选择可零, 嘿嘿。再就是我们的本地化部署了,还是我们的千问啊,他现在应该更新的更更厉害了吧,也可以在本地化部署,大概你机器有个十二 g 的 一个显存,你就可以去运行他,当然他现在的视频质 量,哎,你就不要太要求太高啊,也会有那种抽卡的存在,像这种他不可能一次性就给你生成完美的答案,永远不要指望 ai 一 次性能解决你所有的问题。 那这会儿你就会发现了,首选呢是 jimmy 的 全家桶平替的呢,我一般都是用的字节加的开源的,我用的是千问加的, 现在目前在生产力这一块啊,就是拿来当它工作。这三家已经形成了三局鼎立的一个模式了,除了我们用到的文字、图像、视频以外, ai 音频工具 或者说做音乐的那首选呢?我是用的 solo, 因为他也是老大哥了,最早 ai 音乐的,所以你无论生成一个 bgm 还是生成一个歌曲,它的这个自然度会更加的高啊,你可以听一下, 这个感觉就很好。那在国内做音乐这一块的平替的这个版本呢,就是海绵音乐,对标的也是 solo, 更适合于短视频循环,它有点套路了一些标准的和弦走向。这里我就不科普音乐常识了, 因为我毕竟也不是个音乐小博主。还有一个处理音频的,像 eleven lives, 它生成一些音效,比如说开门的,或者说爆炸的,或者说下雨的时候,生成一个老外在说英文,当然它更适合于老外的这种声音的一个生产方式, 让我们说中文,让我们说中 ok, 我 们刚刚分享完了基本的一个 ai 音频音乐工具,剩下的就是数字人工具了。首选的黑者,他是一个华人老板,在海外做的这么一个应用,他的整个画面自然度都是很好的。 这个时候你可能就会问了,阿燕,阿燕,数字人工具这一块不是平台在进吗?呃,其实平台进的是低质量的内容,如果说你拿数字人批量在自媒体上发一些东西的话,而且还都是很垃圾信息,那你自然就没有流量。 如果说你真的用数字人去做一些情景剧,或者说像现在 ai 慢剧这种样子,内容质量好就会被人们认可,那在国内呢?用哪个呢?建议的是用场景,因为背靠大厂,他不至于收了你的钱就跑路了,对吧?画面呢,也还说得过去, 主打的就是一个在电商领域的人货场的场景,里面也有一些很多内置的。呃,人物模型以及背景模板。那在本地呢, 用的就是 infinite talk, 它主要是一些鬼畜,因为你给它一个音频,它就能通过这个音频来让这个图片动起来。现在很多鬼畜用的都是它啊,可以看一下它的效。笑话,古人不喜欢带东西。我理解, 我不理解的是为啥诸葛亮目前是西安成都高铁票,还有东风,我孙权目前放的是年属版,还有张辽卡片。回答我, 那剩下就是我们经常会聊到的一个 ai 编程工具的领域,首先打的就是程序员,可能在未来我们就不需要写代码的人,而是表达需求的人,就是 ai 自动就把这个代码给写了, 因为代码从始至终我都认为不是人类该学的东西,而是机器人该学的东西,不然它为什么叫机器语言呢?会编是吧?有迹可循的东西 ai 都能够去替代,那更多的是提出这个需求的人,我觉得这个才是核心,那首选呢?我选择的是这个 coser, 它的整个逻辑,还有它使用的工作场景,它会让一个监工去分发。呃,前端啊,后端呀你,你做这个,他做这个,变成一个小组的形式,我觉得这个非常有意思。然后 coser 写的代码呢?啊,只要你给到一些参考,或者说方向是正确的,它就能给你逐步逐步一点点的 完善出来,生产效果也是最好的。国内的话我用的比较多的,性价比高的就是这个 trim 啊,它现在这个把 id 模式切到 solo 模式的时候,它也是对标的 coser 完成了这整个逻辑,通过一个监工,然后分发底下的呃人去做每一个步骤的事情,它会先 拆解任务,把任务都罗列好了之后,然后每个任务给你确认,确认完了之后再去执行,也可以读你本地的一些文件,同时去做一个参考,整合这么一个工作。还有一个就是我们的 cloud, cloud 它生来就是写代码的, 但是它更多在网页上面,我们需要第三方客户端像 tree 一 样的把它导入进去去使用。 最后一个今年谈的最多的就是 ai 的 agent 工具,说实话这个 agent 吧,它不够 agent。 那 首先呢,我推荐的还是 define, 生态也是比较完善的,这种模组啊也是非常多的,你可以由它打造,比如说爆款的一些文案,或者说 去做一些批量的事情。国内的话对标就是扣子,扣子的话生态现在也做的非常的完善,现在还有很多课程教这种扣子的工作流打法。但是呢,呃,这里阿言要说句实话,因为现在的 agent 有 点让我感觉像计算机早期的红的那种配置,就是第一个你干这个固定下来,第二个你 按这里干这个,第三个你按这里干这个,就是所有路径一二三你都得给它配置好了,然后它就能批量的处理一个 word 文档,同样的 word 文档,你丢一个 excel, 丢一个图片,做一个视频,它就不行了。只不过 以前可能是这几个程序点,现在是 ai 点,在这个节骨眼上,它可以判断该丢给哪个节点。 你可以这么个理解的方法啊,所以现在 agent 它不够智能点,就在于你需要花大量时间去学习,呃,去排列它,然后还只能出力单一类别的一个事情。那这个我就觉得不 open 了,因为在未来真正的 agent, 我 认为的是 我下达一个命令,我要一个图片也好,视频也好,我只需要一个入口,然后他就给我了后面的过程。这些东西都是程序员该做的事情,该解决的事情。我是用户的话,我下达命令,你给我内容,然后我判断他是否可以使用,或者他不能够使用,我再让你根据这个你现有的内容去针对性的改,他都是通用的一个入口, 而不是说我需要处理一个任务的时候,我需要搭十个工作流来应对不同的我的环节啊, 不知道大家能不能懂啊,虽然我说的比较复杂。总之呢,一句话, ai 是 不需要学习的,它的发展路径就是必然会越来越简单。你在使用图像也好, agent 也好,或者说视频、数字、人也好,它都有一个生产逻辑,这个生产逻辑适合于任何一个 ai 工具, 这个才是我们需要去感受的一个东西。然后本地化部署的话,你可以选择 n 八 n, 你 觉得 define 呀、 code 呀都在云端上走, 我觉得不够自由,我认为 n 八 n 是 最厉害的,然后你就可以把 n 八 n 部署掉了,就要解决一堆环境配置的问题。呃,以及节点冲突或者报错的问题。呃, 你就死磕吧,这个更适合于就是专业人员去用。啊,我是这么个建议方法的啊。那我们分享就到这里了,我得到了 关注。我阿耶能行。

我们今天来学一个对摄影机来说非常简单,但是 ai 不 一定好做的一个镜头调节紧身,比如说这个广告片里面有一段就是女主挑选衣服啊,拍的很写意。然后在这几秒之内呢,有一个虚焦的镜头,就是说人为让摄影机的焦点偏移,这种拍摄手法呢,会让影片有一种朦胧的梦幻的感觉。 虚焦这种手法呢,经常会用来描写人物的状态,比如眩晕呐,神志不清呐,幻觉等等。那我们怎么在 ai 里面生成这个效果?哈喽,这里是分镜美学,我是楚文,我们这一次呢,咱们拿新片场 ai 创作工具 short lab 来实操一下。 做视频的应该都知道,新片厂本身是优质视频内容和广告片的集合地,然后我发现他们家最近出了一个新的 ai 工具,这个工具的好处呢是和他们丰富的视频片库打通,就是你看见好的影片,你可以一键把这个影片拆成分镜去学习。 首先选择这个影片,然后一键拆解分镜,查看并引用画布,这样呢他就成为了你的一个分析项目了, 这个短片的分镜就可以自动拆解给你,然后你在这个工作流的面板就能够直接引述你看到的广告画面,就是这个自由画布功能。 showtime 会自动拆分提示词,所以你可以直接用它拆出来的提示词去生成新的图片。那比如我们把今天这个参考的影片啊,这一帧拆出来, 用它的提示词去跑,我们就可以得到类似的结果。当然呢,这个提示词也是需要人工微调的,核心是思路,我们用这个广告片作为参考,我们单独把这两针提取出来,你就会得到这个片段附近的画面,这个是女主角, 首先我们需要去为他生成更多的图片,来保证他的形象基本一致,那你就可以直接在画布里面以广告片的大部分生动模型,我测下来呢,香蕉的相对质量是最好的。生 成女主动画的角度,为了保持人物的一致性,你可以多给他几张参考,打包拉出节点,就可以生成不同的角度。当你生成一些不错的结果之后呢,接下来我们要做的就是把人物虚化,你以其中一个角度为参考图,然后你的提示词就直接写 人物虚化,大光圈,前景深,这样你就可以得到虚化的结果,或者你只写大光圈啊,前景深其中的一种也可以。那有了一个虚化的角度,加一个呃实焦的角度,把这两张组图打组,拉出一个节点,直接导向参考图生成视频。 我这里选的模型呢,可零三的 o 迷你模型,待会我会告诉大家为什么选这个。写一段提示词,在这里描述你的运镜,比如说像他这种写意的镜头,一般是手持摄影吗?那镜头会从左侧手摇晃过来,突然虚化,把这个提示词写进去之后呢,你就会得到类似摄影机的效果。 其实核心思路啊,就是说把石胶和虚胶的两个画面作为关键帧生成图片,然后用 ai 视频的模型连接起来。那选择可零三 omni 的 特点呢,是因为它不会严格遵守首尾帧的变化, 他会基于你的参考图自由发挥一些,所以可零三偶尔会给你一些很惊喜的东西。 ok, 这样就完成了。那我们把这些片段呢拼到一起,加一点情绪性的音乐,你就可以得到一个类似手持摄影的需要的一个画面效果。 好,下一期我会和大家一起分享如何用提示词具体的去操控镜头的景别。当然,我很推荐大家去体验一下 shortlab 这种工作流的创作模式,而且图片和视频都接入了目前市面上主流的模型 市场,很快还没有排队的情况。当然,如果你想原创一些 ai 内容,直接在新片场上方进入 ai 创作,然后点左边这个画布,就能够按照你的创意在一个工作流中完成从脚本上传图片,升图首尾帧、升视频的功能了。关注分镜美学,我是主儿小姐姐。

cloud missiles 有 一点一迹绝尘啊,据说呢,在 google cloud console 上已经可以预览了,用 missiles preview 一个加入了团队,仅在数日内呢,用 missiles 破解了苹果 m 五的 macos 内存保护机制。这个呢,也瞬间引起了全网的轰动, 因为这个呢,是被誉为最强的保护机制的。几乎同一天呢, cmu 这台新梅龙大学呢,发布了一个 ai 的 安全精准的测试,在这里面呢,从顺上来看, 在真实浏览器漏洞的表现上呢,遥遥领先,甚至追平了一个相当称职的人类安全研究员。从数据上来看呢,排名第一。第二呢,分别是 cloud middot preview, 当然它里面有一些其实词的 pua 叫 large, 那 在 large 情况下呢, cloud middot preview 能表现的高一个百分点,分别是百分之六九跟百分之六十八。其次到了 gpt 五点五, coxed 就是 与 coxed 结合的 gpt 五点五,在 large 的 情况下,在 pv 的 情况下,能达到百分之四十一,这个差距也很大了。在 其次呢是 g p t 五点五,拉窄也没有 codex 和 hash, 当然呢,有 p u a 的 情况下,只有百分之三十四,降得很严重。再其次呢是 g p t 五点五, codex 在 没有拉窄情况下百分之三十三。可以看出啊,就是 g p t 对 于其实词的 p u a 呢,是很受用的,但是到了呢,其实差距不大。 missus 的 全自主均分呢,是九点五五分,当, 当然,它的预算的算力要求也很高的。 mists 跑完一百二十二个 episode, 花了约三万六千四百二十八美元。 g p g 五点五呢,跑完了同样的量级,只花了三千零七十五美元,有十二倍的加差。所以英国的 ai 安全研究所 ai si 的 独立测试也给了类似的结论, mists 确实很强,但是也贵了很多。 有可能呢, open i 在 愿意花更多算力情况下,性能是可以被缩小。有意思的是, exploit bench 就是 刚刚我们说的这个安全的基础呢,它的作者呢,本身就是一个硬核的安全运动员,它曾经花了大概近一年时间才把这些所有问题都找到,比如说 c b c code case, 作为研究团队尝试复现超过一年 全部失败。但是 missus 呢,在十轮测试中的有一轮成功复现的概率呢,是远超过人类玩家。当然了,这个 missus 按照目前的报价,就跟当年的 open ai 的 o one 跟 o three 一 样,可能只是放出来跑一个精准,像全面的五级化呢,却有非常大的成本压力。那 o one 跟 o three 出来之后呢?紧接着我们看到了当时的发展趋势,是国产的替代,下面快速的上线,包括了 deepsea, 包括 kimi 的 niki 的 模式,成本打下来的。 所以就像 i c r p 创始人说的,预计在未来一到两个季度里面,国内的国行应该能设法付现 miniso 的 能力。我们也在尝试去解密背后的一些原理,到 目前为止呢,还没有成功,也看了很多,比如说 open mythos, 网上通过 recurrent, 通过低轨循环的方式做 transformer 的 一系列的尝试,但到目前为止呢,并没有看到明显的提升和实现 mythos 的 可能性。期待着市场上更多的玩家共享到这样的一个解密, mythos 生态里,让我们更快地普及 mythos 的 超强的能力。

看这个,哎呦我的妈,哈哈哈。今天我们用格式化混音器来体验一种非常酷的混音方式,它能够非常全面的哈体现出混音当中各个音轨的声场,我们一般来说都是一轨一轨的来, 对吧?那么格式化混音器呢,它就能够让你一次性的混所有的轨。首先呢我们要在每一轨上面都加入 new trend 的 这个插件,那么打开了混音器之后呢,你就能看见所有的他们,就比方这个主唱吧, 他的上下移动呢,是音量的变化,左右移动就是他在整个作品当中声场位置的变化,如果你戴耳机的话,你能够听见他的这个变化啊, 你还可以拓宽声场,或者说呢变成单声道。那这非常有趣的一点呢,他还可以建立一个快照,就比方说现在啊,我希望这个和声呢,在他的左边,离得稍微远一点,这个 double 呢,在他的 啊右边吧,离他稍微近一点,这个吉他放在左边,然后呢这个吉他放在右边啊,都调整好了整个的声场位置之后呢,你点快照,接下来你可以再进行这个调整,然后呢再建立一个快照,这样子就可以在 abc 三个快照之间进行这个对比。 在实时化混音器上所有的这个操作呢,它跟分轨上这个插件都是联动的,就比方说主唱上的这个插件,你看我在动它的这个音量的时候啊,它的输出音量也是在跟着变的,就比方现在这个宽度的变化, 双击他就回到这个原点,但用这个鸟看图会更加的有趣和直观,对吧?这是一个非常全新的一个思路,他更加有趣,而且更加容易让你的作品呢产生那种层次感。另外呢他还有这个掩蔽模式,比方说我打开鼓上面的这个插件, 把掩蔽打开,然后下面呢选 bass, 现在橘色,橙色的这个部分呢,就是他俩之间频段的冲突, 你还可以呢来回切这边,然后看他们每个分轨上的 eq 调整的这个状态,这是鼓的,这是 bass, 也就说他们这些插件之间是相互感知的,这样我就可以很快的粗混出一个混音啊,非常的有意思,你们也可以来试试看,这就是 neutral 这套插件非常有趣的地方。

真的太牛了,我终于把 ai 批量操作多个浏览器,多个店铺的流程调通了,真的可以像人一样操作。你看我这里给他两个链接,一个文档,让他自己去学习怎么去做批量操作。 过了一会他就说已经读到了我的二十九个店铺,后面可以直接替代我打开店铺访问页面,点击输入截图,抓内容等操作。比如说打开这个店铺,访问某个链接,并截图 打开这个店铺,点击什么按钮,提取文字给我,还能批量检查多个店铺, ok, 我 将信将疑,我让他把我所有的店铺列表打印出来,二十九个全部都在这里。于是我让他打开了某个店铺,然后教他登录帐,密码已经填好了,就直接点登录按钮就可以了,还要告诉他有弹窗,全部都关闭了, 点击这个全球按钮进入店铺。最后我突发奇想,想让他去操作店小秘的按钮就是这个插件,我让他去点击这个按钮去采集,既然也能实现, ok, 我 最后让他把这个整个流程梳理成了一个 skill, 那 下次他就直接照这个 skill 操作就可以了。 而且他有个非常好的习惯,就是遇到问题他会截图,你看这个时候是他登录不了的时候。好,我再演示一遍,让他去操作两个账号,去采集这个店铺的订单金额,发这么一段指令给他, 然后他就开始思考整个纸巾过程。打开了第一个店铺的浏览器, 切换账号登录,然后点击登录。进入到店铺之后,打开采集框,勾选店铺,然后点击采集,你看他现在就开始正在采集了。 ok, 他 打开了第二个店铺,同样的进行登录操作,同样打开采集框,勾选店铺,确认采集, 然后是第三个店铺。前几次调试的时候,它的动作是没这么顺畅的,当我这梳理出完整的流程,让它整理成 skill 状,它的操作是非常顺畅,非常快速的。你看它现在只花了不到三分钟时间,就把三个店铺采集工作完成了, 并给出了三个店铺的采集工作的截图,这样子我们就可以一个个检查了。现在我能让 ai 去做这样的一个操作,那发动你的想象力, ai 还能代替人去做哪些运营操作?可以说大部分后台人工的操作都是可以被替代的。

ai 爆改第二期眼睛宣传短片 像这样的宣传短片现在可以用 ai 快 速制作,下面分享我的完整工作流。首先是模特生成,在新片场选择 ai 创作,来到 short lab 新年画布,选择图片生成,写入提示词。这里我会把人物、五官、妆容、发型、衣服细节拆开来写, 再配合香蕉模型,就能生成这样细节丰富、皮肤质感自然的模特图。这个过程中其实花了很长的时间去优化提示词,它不是固定的,一定要多抽几版,对比着微调。比如我刚开始生成的图会觉得有点油,不够真实,就继续补充,像高楼顶、空气感、发际线、胎毛这些细节描述, 您可以去控制整体的气质,让五官清朗一点或者甜美一点,慢慢往想要的方向上去调。接着上传产品和服装图, 依次生成半身、全身照,还有人物三世图。有了模特之后,接下来是制作分镜。先上传一段广告视频,点击这里就能得到拆分好的分镜表,包括画面内容、镜头描述,这些都会给到。接着用你的模特和拆好的画面内容,依次生成想要的分镜图。 你也可以在参考图的基础上加入自己的想法,依次生成九宫格分镜,再单独提取出想要的图片。第三步是视频素材生成,把之前拆解的运镜提示词还有画面内容一起复制过来,根据想法做一些简单的修改。 模型我用的是可零三点零,当然这里还有很多其他模型,可以按需自选。给每张分镜图生成对应的视频。最后再到剪辑软件里,把做好的视频素材拼接起来,一条完整的短片就做好了。 另外,我们新手做视频都需要找大量参考,那新片厂社区就有非常多的优秀视频作品。点击下方的分镜按钮,就能把整条片子拆解成详细的分镜脚本, 再导入到画布中对照学习和创作。不过拆解别人的作品也只是一种入门方式,来帮助小白快速理解镜头逻辑,但最终的内容创作还是要回归自己的表达和审美。 ok, 以上就是今天的分享,快去试试吧!

这是我用 ai 做的古风 mv 片段爱情我的手一步 一动。像这样的古风 mv 到底如何制作?先从音乐制作、分镜匹配到视频成片,用三步教你完整跑通制作过程。提取词我已整理好了,首先在搜 live 新建画布, 创建一个生成音乐的节点,输入你想要创作的音乐提取词,如果不会写,可以直接参考我这套音乐提取词模板,选择对应的音乐模型后,它会一次给你两首音乐, 不仅出歌速度快,而且氛围感也很稳,那种空灵悠远但画面感的感觉一下子就出来了。 再选择一首满意的作为 mv 配乐。第二步,创建角色场景。我们先让 ai 根据歌词分别生成角色场景贴纸,再用贴纸生成古风美女的角色和场景图。最建议把角色场景做成资料卡, 能更好的保持角色和场景的一致性。第三步,生成分镜图和视频。为了提高效率,我这里采用了多宫格分镜的形式出图,同时框选角色图和场景图,拉出一条线,选择参考深图模型,这里选择高质量版的,输入多宫格分镜贴图。如果你不会写多宫格分镜贴图, 可以参考我这套题词模板,这样就能得到两张多宫格的分镜图。接着框选角色场景和九宫格分镜图,再拉出一条线,选择参考生视频模型,选择二点零的视频模型, 输入对应的视频提取。这里注意要先开启车源检测,不然无法生成视频。然后把生成的视频和音乐片段导入剪辑工具,按照音乐节奏对齐画面,再加上简单的调色字幕,一只完整的古风 mv 就 完成了,完整的创作流程和提取,我也公开在画布了,我是爱豆版,下期见。

你知道吗,每当你用手机秒速美颜,一键生成好看的照片画时啊,背后呢,很有可能都有一颗专门的 ai 芯片在默默工作。他可不是普通的处理器啊,更像是擅长处理智能任务的专业高手。这位高手特别精通图像识别、语音理解这类 ai 运算, 比如拍照片时,它能立刻判断出是夜景人像还是美食场景,并调用合适的算法来优化。用翻译 app 时呢,也让语音转文字的过程更实时准确。正因为有它分担任务,手机用起来才更加的流畅省电,各种智能功能也能随时响应。 现在不少国内手机品牌也把自研或深度优化的 ai 芯片当做重要的产品亮点。要知道, ai 芯片的普及,其实意味着手机正在从智能工具渐渐变成更懂你的智能伙伴。它把许多过去啊,需要联网到云端处理的 ai 能力直接放进了你的口袋里,让响应更加的及时,隐私也更加的安心。 将来,他或许能更加细致的理解你的需求,成为你管理、健康、辅助、学习的好帮手。你平时感觉到手机里 ai 带来的方便了吗?是拍照更好看了,还是语音助手更贴心了?欢迎评论区来聊一聊你的感受。

以后的混音全部交给 ai 做吧,手机小程序,手机预测助手 ai 混音软件正式上线,小程序 以最低的成本帮你实现你的音乐梦想,再也不用恼火混音没经济了。我们往后看, 搜索我们的小程序,手机预设助手,点开之后放入你的干音,放入你的伴奏,然后下滑,学到你喜欢的风格之后生成,无论说你是地下小子,流行小子,还是传说上小子,咱都能用得上。 我们需要准备这个手机预设助手这个小程序,然后以及你的手机,你的耳机以及免费的手机 app, 安卓, ios, 华为都可以。 第三步,实战演练以及怎么用 ai 把数据导到 bandlab 里。首先呢,我们需要在 bandlab 里面把歌提前录好,录好之后,然后把干音跟伴奏都单独导出来。怎么导呢?右下角三个点, 然后大家看这个小针头上面有三个点,找到之后,然后选择倒数第二个,然后选择 m, c, a, w, a, v 都可以导出即可。导出之后,然后把这段音频再复制到我们的小程序上面就可以了。音导好之后,我们需要呢,先上传人声,干声,点完之后啊,把你刚刚选择好的干音放上去 就好了。放完之后呢,我们再选择上传目标参考曲目,比如说你想让这首歌的质感像谁谁谁,对吧,你就在这里面也去 去导就可以了。然后选择好了之后,我们在这里面风格匹配,去找到你喜欢的,比如说你是地下小子,你想来首帅帅的 plunk n b, 你 就学 plunk n b, 如果你想来个那种特别吵特别杂的那种啊,其实,其实我觉得大家可以一个一个去写,对吧?比如说你想搞 glue, 你 就选最后一个全自动化 啊,主流呢?主流说唱什么都可以点,生成之后我们就会触碰激活卡密,那么怎么去获得卡密呢?首先在账户这个里面去登录,登录完之后我们在这里面去点获取卡密。然后呢?啊,大家懂得,我知道屏幕面前的同行这个时候要叫了 啊,他你们肯定会说啊,你怎么能够确定这个东西准不准呢?大哥,我这个还有微调功能,就是 ai 呢,他给你伸出来一个预设条,你去试完之后你觉得不合适,你还可以去微调微调不,不用你去微调,机器人帮你微调,只需要回到手机预设助手页面去选择,我要微 调,比如说你觉得啊,太,太重了,太轻了,高频太多了,混响太多了,回声太大了,我们的机器人无限帮你去搞, 兄弟们,真正要别贴了,别贴了,然后生成出来之后呢,也就是我们的参数,你把参数在班 lab 里面跟 ai 生成出来调成一样的就可以了。 而且这个四舍五入呢,其实他就真正意义上给你去定制预设,你想你在外面花那么多钱,花大几百去定制一个班来预设也好,手电脑预设也好,我们这个一个月只需要三十无限使用。

今天拆解爆火的第一人称反转视频是怎么做的?你到底在搞什么?杯子碎了没关系,你没受伤就好,你藏什么呢?没事,错了改就行,下次一定能做对, 你一定要好好学习,不然等你长大以后你就没有能力帮助他。首先点击生成图片,选择文胸图,输入故事分镜,提示词, 选择 m h 二模型比例,选择十六比九二 k 高清,点击生成。然后我们就能得到故事画面分镜。接着我们点击参考生视频,粘贴故事脚本,提示词模型,选择 s d 二点零时长,选择十秒左右,点击生成。这样我们就能得到一个故事视频了,所有提示词已经准备好,需要自取。

这是我用 ai 制作的发胶产品宣传片,三分钟讲解从工具、分镜设计到最终剪辑成片的思路和过程。第一 步是生成产品图,我先用 shotlab 的 这个无线画布纹身图,做出一张发胶产品的三式图。这款发胶自带一种暗黑深沉的美感,所以我给整个短片的视觉基调定位古典、 压抑、控制感美学。然后是音乐与风景,如果确定了音乐和整体氛围再去做,画面就会展现得很饱满。这次我选了 music 的 newborn, 这种迷幻摇滚的强续式风格,伴随音乐的梳理感,结尾再加入搏击俱乐部的经典独白, 展现出一种自我认知反复撕裂又重构的过程。叠加歌名的寓意,表现出手中的发胶就是那个对抗无序的武器。接下来第二部是重点内容,制作模特按照这个格式去描述,比如我想结合阿尔派克诺的生成和克里斯蒂安贝尔的荒诞气息, 就让丫丫帮我把整体补充完整。然后回到画布,用迷你珍妮 v 七模型抽卡,最终选定一组人物画面。第三部是关键帧生成, 模特确定后,就让他手拿着产品,然后把人物和产品图一起发给 ai, 让他帮我们出九宫格分镜提示词,再拿着分镜提示词和刚才的几张图一起在画布里生成九宫格分镜, 点这个三乘以三宫格,然后点加号 ai 参考生图,就能把每一个分镜都提取出来。这样我们就能拿着全部图,用单图或者首尾帧的方式来生成画面了。如果某一个画面想要再做处理,比如我找到一张想要参考的风格, 就可以把这张图上传,然后把参考图和自己的图连在一起,这样描述。将图片一里的人换成图片二里的人。 分镜都准备好以后,用 ai 参考深视频功能,让每个画面都动起来。注意这里的提示词不要太复杂。如果是人物,我一般只给镜头加动作,比如鱼眼镜头人物极其缓慢转头这种简单的指令。记住动作要慢,因为 ai 生成慢动作的成功率远高于快动作。如果是物体模型,就会 c 加十二点零。然 然后只需要给运镜,比如这四种组合,效果就会很好。上面要生成平滑的慢动作,但情绪的爆发我们需要自己掌控。我在最后加入了几组黑白镜头,暗示着绝对的秩序建立完毕,获得了终极的 freedom。 最后导入剪辑软件,把它们连起来。我们来看成品。 i felt like changing something, something small, something, no one would notice i wanted to become more precise more controlled and somehow that felt like freedom i thought i was fixing something just a detail just a surface and that felt like control。

做智能体啊,如果你的自己对于计算机这块技术比较差的,其实还是不行的,要对计算机这种有一些基础的,这种,呃, 非专业人员他就可以做,我这边是有几个用户就是他是可以自己做智能体的,就是我告诉他,给他提示词,然后他就可以让扣了叉去做。呃,但是大部分是不行的,大部分还是得 就是得找专业的人指导帮忙,然后甚至直接交付才能用,甚至用的时候都还要指导。呃,这还是跟计算机的那个了解程度有关系的,就是如果你对计算机不怎么了解,我真的建议你, 呃,你折腾一下可以,但是你不要想着说能够做成生产可用,就你还是得有专家指导你,然后甚至帮你做,然后再交付给你,然后你才能做的好 啊。就是不是说所有的人他有了 ai 之后,他都能够自己去打智能体,然后能够做的特别好,因为智能体有个问题,就是每个人的那个智能体啊,他都是不一样的,就是比如说你想要 他想要的是是 a 流程的智能体,你可能在他基础上你要变化一下,那这个时候你就得再去做重新的开发,而不是说直接就能用他的,大家明白吗?就是每个人的业务他是不一样的,千奇百怪,千变万化, 没有通用的智能,基本上是没有通用的智能体啊。所以说还是得找专业的人,如果有需要你可以联系一下我,如果你有需要这种托管的话,你也可以看一下我的制网站。好吧,感谢各位支持。

为什么使用同样的模型,同样的提示词,你做的视频是这样的,快快出来受死。而大神做的视频是这样的,俺老孙来也。 实际上呢,即便像,也没有这 cds 这种顶尖的模型呢,也有它自己的优势和缺点。 所以呢,今天咱们就用一条视频,带你了解所有顶尖 agm 模型的优点和缺点,取长补短。首先啊,假设我们要做一个漫剧,比如说孙悟空大闹天宫, 那肯定先要设计人物,制作场景图,哎,各位第一时间会想到用谁呢?隐秘之二还是单的?不单的。确实啊,现在的隐秘之二综合能力最强,也非常懂物理世界的规律,比如说让他设计海报或者仿作直播间的截图,都可以做到以假乱真。那 这个时候,我们就可以让他为大闹天空输出详细的角色的三式图,比如说孙悟空、二郎神、玉帝和四大金刚,来大家看一看,是不是都挺牛的哈,但是如果要生成九宫格的分镜头故事脚本,哎,我发现他就不如香蕉。比如说,你看左边是 ym 二做的,右边是香蕉,大家觉得哪个更好一点呢? 说实话,如果说风格的话,可各有千秋,但是就故事的连贯性和镜头的电影感来说,我觉得香蕉啊,更胜一筹。 而且我们在借助上这个烧透的摄像机控制能力啊,咱们就可以任意挑选生成的镜头质感了,香蕉生成的效果也会更提一个档次。 确定好人物和风景之后呢,咱们继续生成视频,大家肯定会第一时间想到用 c n o 二点零哈,确实, c n o 的 运镜和故事衔接都是遥遥领先的,大家都懂,我就不掩饰了,但是它的生成往往是生成一个系列的,中间呢容易出各种 bug, 这个时候呢,我就让可灵三来补充关键的镜头。可灵的优势呢就是生成的人物更真实,画面情节更稳定,比如说之前爆火的纸飞机就是用可灵做的,再加上他最近更新的四 k 的 画质, 可以让整个曼珠的质感再上一个台阶。搞定完所有的画面之后呢,如果咱们需要搭配音乐的话,也可以直接用 solo 来生成配乐。 苏诺的谱曲能力啊,真的是非常不错,但是呢,我认为这个苏诺的功能呢,非常的单一,如果大家需要克隆人声,也可以用国产的 ai 模型海螺 两个呢算是各有优势,大家可以按需使用哈。 ok, 目前顶级的内容制作的大模型基本上咱们都介绍了,来我们来看一看他们一起合作最终产出的成片。俺老孙来也, 朋友们,这个片子大家可以打几分呢?哦,所有的演示我都是用这个收头来进行的,它呢也是把我上述所有介绍的模型都包含了, 咱们日常操作的时候呢,就不需要再来回的切换模型,用起来呢可以说是非常方便。并且以上模型详细的用法提示词都给大家整理好了,各位如果需要的话可以自取。

先看视频,后面我会分享制作流程,今天做的是一个薯片创意短片。 首先我会先把脚本写好,这一步我会多花一点时间。写脚本之前我会先把角色定下来,比如这次我选的是一只小蓝猫和一只小狗,然后我会根据脚本去生成场景。 这个案例其实只有一个客厅场景,所以相对简单,不需要做太多空间切换,只要先生成一个客厅的九宫格多基围图就可以了。这样后面不管是产品特写、动物反应,还是人手拿薯片,都能在同一个空间里完成,画面不会跳来跳去。接着就是根据脚本生成九宫格分镜图, 九宫格的作用不是为了好看,而是提前把镜头关系锁住。比如薯片怎么出场,小狗怎么被香味吸过去,蓝猫怎么抓地板抵抗,人手怎么拿起薯片,这些都要先在分镜里想清楚,如果某一个不满意,也不用整组重做,直接把那一个切出来,单独继续深层就行,这样效率会高很多。 最后一步才是图神视频,再放进自己顺手的剪辑软件里剪辑,加上音效、 bgm、 字幕和节奏点,这条短片基本就能成型了。

一个非科班出身的云南小伙,花了十天用了三千块就手搓出一部 ai 短片丧尸清道夫不仅在国内刷屏,还火到了海外,好莱坞电影制作人都在全网找人想把它挖过去。那这种接近工业级质感的 ai 短片到底是怎么 做出来的呢?在作者的主页,我发现他竟然是新片场 shoutlab 的 签约创作人。今天我在 shoutlab 画布里参考原创作者的创作逻辑,做了一条视频。 我们一般做 ai 视频都是先生成分镜图再生成视频,这样的方法会让视频画面在可控范围之内。但 mx shell 用了一条完全不一样的路,没有用分镜图,而只是用了这样的角色设定图和场景图,交给 c、 b、 s 二点零全能参考。分镜画面全部都用提示词去控制, 所以它的提示词长的看起来像毕业论文。这个方法会让画面发生非常大的随机性,但是也能够激发这个 ai 模型的无限潜能。它的提示词大致可以分为三层,第一层,基础设定。除了已经有的角色和场景图,提示词还会对主角和场景重新进行非常详细的描述,很大程度上解决了 ai 对 参考图片细节理解丢失的问题。 通过提示词让 ai 强化理解一遍更好,片子的一致性会更强。第二层,氛围与画质。我们做 ai 视频经常遇到单段看着还不错,但连起来就很散的问题, 就是因为没有统一的美术风格和影像基调,这一步决定了整条片子的电影感。第三层,画面内容。这个部分又划分了每个分镜的景 别构图、运镜手法和镜头描述,这部分就像导演的分镜脚本,用这样的提示词结构去导演 ai 实现对每一个镜头的精准控制。 总结一下,这套提示词的结构就是先搭基础设定,再定氛围画质,最后导演 ai mx 照。真正厉害的地方不是使用 ai 的 技能,而是它本身极强的审美判断和蓄势能力。几年前,像爱斯基这样的动画短片,单集制作成本可能是几 十万甚至上百万美元,而现在这套被称为国产爱斯基的骗子作者一个人只花了十天三千块就搞定了。我们真正来到了一个创作平权的时代,现在我们已经可以说,对于创作来说,设备不是重要的,想法才是最重要的。