开源数字人能不能像真人闭坑?判断声音像嘴对不上就是翻车黑卷类工具要看脸、口型、声音和对话。第五名, open avatar chat, 它更像实时数字人对话框架,适合研究语音视觉和大模型怎么串起来, 结果有想象力,但搭建门槛高。第四名, emo, 他 走音频驱动笑像视频路线,表情更有戏,风险是工程落地和可控性不稳,更适合看未来效果。第三名, set talker, 经典单图说话项目,适合从一张照片深层口播练, 中段判断能出结果,但真实感已经不是最新一档。第二名, live portrait, 它强在让照片跟着驱动视频动起来, 表情看头部动作更自然,适合做数字人脸部动画底座。第一名, g p t soviets 加 muse talk, 一个负责声音克隆,一个负责实时口型同步, 结果判断这俩组合最接近,可落地连录。选择很简单,脸看 life portrait, 口型看 muse talk, 声音看 g p t soviets, 实时对话看 open avatar chat。 关注海外课 ai, 每天筛开远 ai。
粉丝630获赞3463

绝对不要付年费,这是我栽的一个大坑。在 ai 时代,我只想做一个只付月费的岳父渣男,就是哪怕他看起来再牛逼,功能再好,也别冲动。就像我们说对 ai 工具情深义切,我觉得还是要做一个人间清醒的岳父渣男。 老子不说,前段时间我们是深度在用黑盾去做一些视频的内容,我觉得,哎呀,这个太好了,我们的小伙伴说,千万别付年费啊,先付一个月,然后再试试,然后实在有替代品我们再说。果不其然, cds 二来了,突然我们的黑盾不香了, 我瞬间就把黑盾的月付的到期就停掉了。但现在我们看到的是什么呢?大量的视频号在调侃 cds 二点零排队的事,大家都可以看到吧。 我这次确实是还是付了个月费,但你会发现,我这两天又在苦恼说,哎呀,我这个付费是不是亏了?我今天上午还刷到了一条视频,说十五秒的视频用了十个小时去生成,百分之九十九,最后一刻提醒你, 审核失败啊,积分是给你退回来了,我工作效率哪去了呢?我们原本是想用 ai 提升我们的工作效率,最后你会发现啥事也没干上。 第二感受呢?在年前,我有一个非常大的一个痛点,说我们看见新的东西就试用。最后我们的团队吐槽说,老大,别,别这么跟了吧, 我们就保着一个工具好好用,把我们的工作先闭环了,不然的话什么事也干不成了,对吧?我们天天都变成了试用 ai 工具的这个奴隶了,被他们奴役了我,我现在在想一个恐怖的一个点,这到底是谁的阴谋?我想这是大模型体做的阴谋,因为不管你成功 还是失败,你都会消耗头衔。前两天我们看到黑米有一篇新闻稿说二十天挣了去年一年的钱, 那咋挣来的呢?龙虾,我觉得可能是给他的重要的一个点。那其实我觉得我们这群追逐 ai 工具的人也帮他们做了非常多的贡献。在这种状态下付年费,我觉得尤其是有点像主播了,能付月费就付月费, 甚至如果你觉得你一周能把这事摸清楚,那你就付个周费,因为我们不知道下一周有没有新的 ai 工具出现,这个 ai 工具是不是它的能力会更强,会把所有的之前我们所测试的流程都打破掉。我劝大家冷静冷静啊。

如果你一直在关注 ai 自动化剪辑的最新进展,那你绝对不能错过今天的内容。因为由黑镇团队开发的开源视频编辑神器 hyperframes 刚刚引来了史诗级的 v two 版本大更新。那这一次的 v two 更新呢,不仅进一步的优化了操作体验,更是把纯自动化生成视频的能力推向了一个新的高度。 那在这期视频里,我将带你全面解析并打通三个层级的自动化剪辑工作流。那我们首先会从最基础的网站一键转视频开始, 接着呢,进阶到利用 ai 制作分镜脚本。最后我会向你展示一套极其硬核的全自动口播视频处理框架,教你如何让 ai 自动裁剪无效停顿生成字幕,并完美叠加三 d 素材和动态悬浮卡片。 hello, welcome to my channel。 我是 bonnie, 但我是一名 ai 自画实操者,专门帮企业和创业者设计落地 ai 自画系统。那我自己是计算机科学背景,目前在读硕士, 但是我在这个频道做的事情非常简单,就是把我所有的实战经验用最直接的方式带给你, 让 ai 子的话不只是工程师的专利。那我们现在进入我们 hyperframe 的 一个实操过程,我们现在就进入到今天的第一层, 也就是我们 hyperframe 的 一个新功能, website, 直接转变成一个 video。 好, 那这里呢,我就用我自己的官网来给大家做一个示范。那这里的话是我的一个官网链接发送过来,我要让它使用我们的 skill, 用 我们的 hyperframe website video, 然后制作一个十秒钟的视频。好,然后这里呢他就把我们的视频做出来给大家看一下。 好,但是你会发现这样的效果并不是特别的好,拿这样子的一个视频作为你的品牌宣传肯定是不够的,这种情况下呢,我们就可以去通过一些 html 的 组建来控制我们视频的一 个动画输出。好,那这是因为我们黑镇它的这个 hyperframe, 它的底层逻辑其实就是 h t m air, 并且它在刚开始开发这个开源工具的时候呢,它也是为我们的网站去进行设计的,只是现在大家又把它用到了我们的视频上面。 好,所以我们想要去控制它质量输出的话,肯定是用我们的 hdmi 组件,效果呢是最好的。好,然后我们的话有很多这种拍源的网站呢,就有特别多,然后他的动画效果也很好, 那我们就可以选一个,就是比如说你觉得很好看的,然后呢我们拿来去使用它,我就想用这个作为一个动画效果,然后来做我们的那个品牌宣传视频要复制下来。哦,我想要 改这个视频的效果好,然后我们把那一段创给他粘贴过来发送给他就好。 ok, 这里呢他就根据我们刚刚发给他的那个 html 组件,然后进行了视频的修改。我们来看一下,那这也是 第一只,然后是第二个封境,然后这也是第三个封境, ok, 最后是第四个封境, 带大家快速了解一下我们 hyperframe 的 一个能力。那接下来呢,我们就进入到今天的重头戏,也 hyperframe 进行视频 剪辑制作。那我们整个视频制作的完整流程呢,分为三步,首先第一步是剪辑视频,第二步呢我们会让 chronicle 去制作一个分镜脚本,最后一步呢就是去添加一些我们的动画素材。 ok, 那 我们现在就进入到我们的 视频制作流程。好,那这里呢,我是放了一个视频在这里的,然后把我的 prang 给他,直接让他就是阅读一下我们的 hyperframes 表。然后呢我会告诉他,那我有一个视频在目录里面是这个 e m p 四文件,我让他去给我 剪辑成一份整洁可供我们 hyperframes 使用的最终成品。那我需要他剪掉所有的静音和空白片段,然后对音频进行转录,如果我们一个短语说两次,保留最后的一次够进 个 html 的 页面。然后呢来展示当前脚本与建议的一个精简脚本。左边呢是我们原始的一个,直接进行了一个转录,段落 a 没有问题,然后我们的段落 b 我 直接给它复制过来改一下下。段落 a 没有问题,但是段落 b 脚本有一些 识别有问题,按照我的修改把我们的段落 b 进行 更新,到这里呢他就去更新完成。这里结束以后呢,我们就可以进入到下一步,就是制作我们的分镜脚本。那这里呢就是我想要的一个方案,我来给大家看一下。首先我会跟他说,现在先为我们构建一个单页的 h t m a 的 分镜脚本, 那分两部分四句话呢,展示我的一个视频方案。好,那首先是段落 a 的 语句很少,就主要是讲一下我们的 更新,这里是我们的段落笔想要的一个效果就是添加一些字幕和悬浮的视力卡片,透明度设为百分 之八十左右,那这个就是完全按照大家自己的个人喜好来就 ok, 不 会让它把卡片做成一个透明流体玻璃质感等等。好,然后这里字体和颜色参考我的 artemis bonnie 的 品牌 手册,这是我之前的一期视频 g p t image two 里面使用到的一个 skill, 感兴趣的朋友可以去看看那一期视频。好,我们现在回到我们的 plackle, 然后他已经制作好我们的分镜脚本,然后这里呢就是我们的一个分镜脚本以及我们的整体画面布局,他也会在这里去给我们稍微说 一下。那接下来呢,我们的任务就是针对他已经做好的这个分镜脚本,然后去进行优化,那这一步呢也是我们要去针对他已经做好的这个分镜脚本,然后去进行优化。那这一步呢,我们的任务就是针对他已经做好的和 ai 进行 打磨的一个过程,那我们会发现就是不管我们的 ai 他 现在迭代,然后进步的再怎样好,我们也很难说是我真的一段发给你,你就一下子能够做成一个完全符合我要求的一个东西,这样我们就会有这样的一个 a 呢,来帮助你训练你的智能体。 那我们总共是分成三步,那第一步 a 是 三步组装,演示一下你要做的一个原型, 然后呢让他从零到一去先把你基础的一个原型做出来就 ok。 接下来我们的第二步呢就是连接 connect, 就是 我们可以去连接各种各样别的工具,我们会在第二步连接 c connect 去进行, 我们第三步是 enhance 去增强方说我们今天这一轮全部做完以后,我们可以总结一下,然后从今天的整个过程中呢总结,然后得到一个反馈,把这个反馈又注入到我们的 ai, 让他学会说今天的一个经验,他就会越来越懂我, 那以后他就会做的越来越快,越来越好。然后呢,这是我们的一个 ace 框架,然后现在我回到这个分镜脚本,那我们现在就是在我们的 ace 中的第二步 c 里面,然后除了连接以外,其实我们更多的一个调整也是在我们的 c 这一步,这里呢就是我回到 clockclock, 然后去进行我们分镜脚本的一个调整。好,可以看到这里他写了一 一个 logo 三千零二,那这个呢,就是我们的 hifi studio, 也就是你可以把它理解成我们的本地硬性的一个剪映。好,然后可以看到这里是他做完了以后就长这个样子,这是我们的第一句话,那你绝对不能错过今天的内容, 因为。好,然后这是第二句话,开发的开源视频编辑神器 hifi。 好, 然后呢,这里是第三句话,就是我的那个,哦, 那个我做的一个动画的小视频吗?好,那这样子,他就是按照我的来做的,我们的场景 a, 后面这里就是场景 b, 那 这边呢是我的一个卡片,他就会跟着我每一句话,每一句话,然后这样子去走。好,那这就是,嗯,我这边整个做出来的一个视频。 好,然后呢,那我们就回到我们的 a s 框架,我们的 s 框架的最后一步就是 in case 增强,因为像我再去和他调整的时候,其实我也有很多的一个调整的过程呢,等等, 好,所以的话这里我们就可以去让他进行一个总结,那我会希望说,就是你把我们今天这一次对话,然后包括我做出来一些各种效果啊,你要记住它,这样子,你不要让我下一次又来用你的时候你又不知道。好,这就是我们 as 框架最后一步的 in hands 的 一个意义,那这样子呢,我们每一次根据这样的一个过程,你的 ai 他 就会越来越懂你,然后到后面基本上你可能就真的能够做到说我只需要发送你一段 rap, 你 就能够输出给我一个我很满意的一个结果, 然后所以我们回到我们的 coco, 然后呢,我现在来跟他说一下,记录下本次对话中所有的收获,并且呢,根据我对你的反馈,以及你根据我们对话所 总结出的所有最佳实践,然后来更新我们的这个 hyperframes 技能。然后这样子你给它发送过去以后呢,它就会去优化,然后它会在你这个 hyperframes 里面再去 markdown 里面写下一些, 这是我们这一次的经验总结,那这样子呢,你的 ai 他 就会越来越懂你, ok, 那 这就是今天关于 hyperframes v 二自动化剪辑的全部实操内容。那我们今天一路打通 了三个层面的玩法,从最简单的网页一键转视频,到利用 ai 提前规划分进脚本, 最后实战如何搭建一套完整的全自动无水线,让 ai 帮你精准剪辑口播,并叠加各种的动态特效。 那希望这套工作流能够帮你真正的解放双手,把精力呢留在更核心的内容创作上。那如果你觉得这期视频对你有所帮助,记得订阅分享我的频道,我是帮你,让我们一起探索 ai 自动化的无限可能,我们下期视频再见。拜拜。

codex 现在能自己做短视频了,给他一句话,他自动写好 html, 一 行命令直接渲染成 mp 四。这个黑阵开源的十九点七 k star 神器,让 ai 程序员不用剪辑软件,纯写代码就能出片, 先看看效果有多炸裂。你只要在 codex 里说一句,做个十秒产品介绍视频,它自动写出一个 html 文件,把画面布局、动画、背景、音乐全定义好。然后一行命令, npx shaperframes, render, 确定性渲染,直接输出一个成片 mp 四,全程不用打开任何剪辑软件。 codex 自己就把视频做完了, 他在 github 上已经拿下十九点七 kstar 黑肩团队出品,完全开源免费。核心思路特别聪明,用纯 html 加 css 来定义视频, 不需要 react, 不 需要构建步骤, ai 天生就懂 html, 所以 codex cursor cloud code 直接上手就能生成,还内置五十多个开箱组建和多种动画引擎, apache 二点零协议商用,零门槛。传统做视频要学一堆剪辑软件,现在让 codex 写几行 html 就 直接出片,我已经整理好了详细的部署教程,感兴趣的话可以直接分享给大家。

you should be proud first? 有挺多这种号的,然后这种号他本身是用一个叫做黑翠的 呃,恋爱工具做的,但是那个翡翠好像很贵,要四十七美金的月亮,然后还有时长限制啊?现在这边有一个那种, 这是我们免费的一个擦肩也能做这一类的事情,效果可能没他这个,没他这个好吧,但是也能做,就是 在这里上传一个你自己拍好的那种视频,然后再在这个位置上传一个音频, 然后自己参数稍微休息一下, 这个是选择那个。呃,这是匹配的模型 啊, 住哪? 检测和匹配这过程大概 需要个半个小时了,就是他也能够实现,就是声音和嘴型同步,然后 就是你也可以,就是录制你的带有动作那种视频,他就相当于一个视频开口说话的这么一个功能。

有钱用 gpt 没钱用豆包有钱用 cloth 没钱用 coats 有 钱用 suno 没钱用天空 sky 有 钱用伽玛没钱用 my show 有 钱用 hygiene 没钱用闪减有钱用 mid journey 没钱用纪梦 有钱用 notion ai 没钱用 wps ai 有 钱用 runway 没钱用可林,我是石头哥,用 ai 和实战陪你解决真问题。

今天看到一个超级有意思的 ai 虚拟人生成软件,黑枕只需要一张静态图片,就可以一键生成一个栩栩如生、表情丰富,能说会道的克隆人视频。你可以用它播报新闻,制作短视频,甚至是解说比赛。下面我们就来看看如何使用它。 上传一张图片,一键去除背景,选择语言、性别、年龄、风格,输入台词,点击提交就 ok 了。我们来看看效果如何。能说会道的克隆人视频,你就说真不真实。 当然你也可以用自己的照片来生成一段视频。目前黑枕每天都有免费的使用时长,其实现在已经有很多公司都在用虚拟主播二十四小时不间断的直播了,可能在不久的将来,我们在网络上再也看不到一个真人主播了。 我是 ai 小伙,如果你还想了解更多 ai 工具的用法,关注我,帮助你在 ai 时代站稳脚跟啊!

这两个数字轮你们能看出区别吗?哪个更智能,效果更好呢?其实他们两个都是用同一张照片生成的,左边那个是爆红的 did, 右边那个是星宿 a 九,相信应该看出区别了吧。一个嘴型是歪的,且头型还不太自然。另一个明显更逼真,嘴型也不歪,头也不偏, 逼真的程度黑卷比 did 好十倍。接下来来看一下声音上的差别。先听 did 的,你好,我是股鬼,发条数字人是一种人工智能技术。再听黑卷的,你好,我是骨灰,发条数字人是一种人工智能技术,差别是不是相当的大? 流畅度明显不在一个等级。再来看一段用黑卷做的视频,新能源汽车正在逐步改变我们的出行方式,其未来趋势可遇见几大方向?一、电动化随着电池技术的进步,看来爆红的 did 出现了强有力的竞争者。

你有没有发现,用黑键做出来的数字人视频,从头到尾就处在一个场景里,画面怎么都换不了?我卡了好几天,一直以为是我没找到那个换场景的按钮, 到处翻设置翻菜单,就是翻不到,差点觉得是自己笨。后来我才想通,不是黑键少了功能,是他根本不会听你在讲什么,在自动帮你配画面。 他只做一件事,把你塞进一个场景里的东西原样拨出来,所以画面不会自己长出来。是你得替观众决定每一句话该看什么,把稿子切成一拍一拍,每一拍派一个画面,这一步叫分镜, 文案负责说什么,分镜负责看什么,大多数人只做了前一半。所以真正难的从来不是让黑键换场景,是你有没有替观众决定好每一秒眼睛看呢? 这事我一通就全顺了。下次跟你讲,我怎么用一张分镜表把整条片子拼出来。

我去, ai 能让马斯克开口说中文了?经验的基本原理就是这个。刚发布的视频翻译 ai 黑军 laps 简直离谱。注意看,这是我准备的原视频 of reading neurons, 再看看翻译后的意思是 关于阅读神经元的记录。在他们哪是翻译,连声音口型都对上了,把老外分分钟变成自己人了呀。只需要一段 mp 四格式三十秒以上的任意口播视频。之前介绍的 lpk, 偏向渔民的 jenni, 适合创意需求, 选择好翻译的语种,即使没有真人出镜,他也能翻译并转录成和你声音一样做不同语种的视频。 let's two point eight point one cn version here yes, ai plug in two moves boosts ps with wings enables take off。 这这这太夸张了,以后谁分得清谁是老外啊。

兄弟们该说不说,黑镇这个平台的数字人技术是我见过最好的,整个操作也是傻瓜式的,有手就会,我们看看生成的效果。 welcome to the new era of video creation with hagen simply type your script to get started。 welcome to the new era of video creation with hajien simply type your script to get started this is me talking into the microphone as you can see my lips are moving up and down。 买现在。

一个强大的 ai 数字人制作网站 hajin, 不仅可以使用图片定制生成动态人物,甚至可以让人物说话,支持多语言发声, 丰富模板,让小白也能简单做出想要的效果。有多简单呢?甚至文案都不需要你自己去写,直接 ai 生成。好的话不多说,我们进入这个神奇的网站。 好的,我们先来一下登录,登录完成之后呢,我们来看一下他的主页顶部的五个菜单,分别是查看教程, 制作说话视频,继续未完成的项目,从模板新建,最后是从人物模板新建,我们直接点击第二个,这里有生成照片和上传照片两种定制方式。 第一种的话就是通过 aijc 工具来进行图像生成,也就是使用关键词描述来引导 ai 生成对应的图像。同样我们也可以点击第二个直接上传图片。 注意上传的图片一定得让系统可以识别到面部,否则就会上传失败。我现在上传了一个不是面部的图片哈,他会提示你没有找到面部。当然了,我们也可以直接用系统自带的照片来进行视频生成。这里我们可以选择一个人物, 然后点击创建视频,我们可以看到这里的界面哈,这里是可以输入文字的,我们提前准备好一段文案粘贴进去。 好,注意看这里,这里有一个翻译的工具,如果我们想要对外推广使用其他语言的话,通过这个工具可以很快的把文案转化成对 对应的语言。不过这次我们先不用点击一下播放,他会根据你的语言来默认播放一个符合的声色。 大家好,我是默认打南边来了个喇嘛,手里提了着五金塔嘛。打北边来了个哑巴,大家可以听到啊,他的轻音都已经读出来了,是很棒的。然后我们可以在右边这里设置可用的声音, 这里可以选择他的语言,他的一个性别,还有一些更详细的一些筛选。 点击播放按钮呢,是可以进行预览声音的。你好,这就是我的 声音,希望你喜欢。好, ok, 听起来还不错,就选它了。在这里我们可以先试听一下效果,觉得 ok 了,我们就可以导出视频。 我是默认打南边来了个喇嘛,手里提了着五金塔木。打北边来了个哑巴,腰里 好,这里的声音,这里的语言还是有问题的哈,我们来换一个。你好,这就是我的声音,希望你喜。你好,这就是我,你好,这就是我的声音,希望你喜欢 later。 好的,因为他的发音问题啊。我们现在选择了一个新的语音效果,我们来试听一下。大家好,我是默认打南边来了个喇嘛,手里提了着五金塔嘛。打北边来 来了个哑巴,腰里别着个喇叭。好的,大家可以看到刚才这里会有一个提示,那么提示的内容是什么呢? 就是说我们现在预览的这个视频呢,是没有面部动画的,只有在我们提交视频之后呢,网站才会对视频进行一个完整的加工,也就是加上面部动画效果。好的,如果我们觉得 ok 的话,可以点击上面的 submit, 大家可以看到现在弹出了一个弹窗,那么这个就告诉你,你在制作视频的时候会消耗这个 credit, ok, 视频已经生成完毕了,让我们来点开看一下效果。 好。我是默认打南边来了个喇嘛,手里提了这五金塔嘛,打北边来了个哑巴,腰里别着个喇叭。好,可以看到我们的视频,效果还是不错的哈。好的,那么我们怎样把视频分享给朋友看呢?