粉丝2.3万获赞9.7万

runway agent 来了, ai 开始接管广告制作流程。真正值得关注的不是又能生成视频了,而是他开始把广告制作流程打包起来, 从产品图创意想法到脚本画面成片,尽量一次性完成,这对小团队很关键。以前做广告要分策划设计剪辑后期,现在 ai 开始往完整交付走了。未来内容创作拼的可能不是谁会生成视频,而是谁能跑通整条制作链路。关注我,每天带你拆一个正在爆发的 ai 新趋势。

昨天刷到 sorry 要关停的消息还是愣了一下。 open ai 被爆,打算关掉 sorry? 这货刚发布的时候那可谓是炸裂级别的存在,六十秒高清视频,电影级的镜头物理规律模拟,直接把 rom 位配卡那帮同行按在地上摩擦。当时网上各种好莱坞要玩,导演要失业的论调, 我也跟风去做了内测,排队排了两个月,结果到现在还只是简单的用 sorry, 他 就要被主子抛弃了。 自洁前阵子发布了视频生成模型 c 蛋斯二点零,效果比 sara 更好,还直接开放了使用。这一下子, sara 就 从全球最强变成了曾经最强 ai。 一 天,人间一年,这话真不是白说的,就像 magna 一 样,上个月啊,大家还在惊叹他被 madata 二十六亿美金收购,朋友圈各种 agent 时代来了的刷屏, 结果很多人还没来得及下载。这个月 opencloud 一 出, magna 就 快速的过气了,这迭代速度连韭菜都来不及割。 我看了 bbc 的 评论啊,说 zara 被关停,核心就一个字,贵! zara 太烧钱了。之前就有报导说去年 zara 平均每天要烧掉一千五百万美金的算力,但收到的订阅费连零头都覆盖不了。我算了一下,相当于每天睁眼就要亏掉一个小目标,这谁顶得住呢? 除非 sora 能一直保持世界第一,而且有深厚的护城河,否则啊,我觉得 sora 确实不是个好生意。现在字节追上来了, google 的 vivo 也在后面虎视眈眈, sora 的 领先优势最多也就几个月的窗口期。 openai 关掉这个赔钱货,把资源砸向商业化前景更确定的基础大模型和 ai 编程,我觉得未必是个坏决策, 两手一摊啊,只要是奥特曼,我也这么干。以前市场上的 ai 产品我整理了一下,大概就分为这几类,第一类呢,天机器人。第二类呢, ai 生图和生视频的软件。第三类呢, ai 编程。第四类, ai 工作流。大厂啊,也基本上反复就在这几个品类上折腾 toc 的 产品。 但从商业化的角度来看,我觉得聊天机器人和 ai 工作流才是真正有前途的。为什么呢?聊天机器人的应用场景是最广的,不管是古建筑还是街边奇奇怪怪的商店, 拍照发给豆包,基本上都答得上来,完全是个顶级本地向导的水平。这种高频刚需、付费意愿强的场景才是能持续赚钱的生意。 ai 工作流的凸臂潜力我觉得很大, 在我目前日常的使用中,工作流加非书表格已经完全替代了传统 office 的 三件套,写日报、做数据分析,整理会议纪要,基本上都能自动化跑通。对于企业而言,这是实打实的降本增效,买单意愿比给 c 端用户生成视频强多了。 ai 视频生成这个赛道呢,目前看我觉得还是叫好,不叫作, c 端用户玩玩可以,但付费意愿弱。 b 端影视制作倒是需要,但是要求太高,目前的 ai 视频还达不到商用的水准。 sorry 的 官厅某种程度也说明了这个赛道的尴尬。 ai 把资源转向 ai 编程,我觉得这个逻辑是通的。 github corepalut 已经证明了这条路能赚钱,程序员的付费能力和年性都要比普通用户强得多,而且代码这个领域对准确性的要求虽然高,但评判标准相对明确,比生成一个好看的视频更容易产品化。 总之啊,不用太悲观。我觉得 sora 官亭不代表 ai 视频这条路已经死了,只是说明 open ai 不 想继续烧钱了而已,对其他玩家来说反而是个机会。如果明天没啥大事的天,我就仔细跟大家聊一聊 ai 工作流目前几条具体的技术路线。

插件最新兼容了热诺艾的自动脚本,有需求的自行测试。首先打开插件,创建一个剧本,然后点击剧本导入,把 提前准备好的 tst 或者 excel 剧本导入进来。如果你不知道导入什么格式,可以点击右下角的剧本模板导出,选择一个 tst 或者 xlsx 表格模板导出,对照着放提示词就行,我随便导一个 tst 的 模板, 然后格式的话就现在这种剧情一剧情二,剧情三,这种哈后面一定要加一个冒号,然后换行,下面就是放提示词,这里也可以直接把提示词复制到插件里面,或者直接导入到插件里面,也可以, 也可以直接拖拽进去啊。导入进来后,点一下确认解析文件,有几个剧情就能解析出来几个任务保存, 然后这里就识别三个就行了,就分别代表三个任务好。然后剧本导入进来过后,点击下面的打开资产库, 这里面有一个全区资产和剧本资产库,全区是所有剧本都能看到,建议大家把图片都传到剧本资产里面,上传之前提前在本地给文件命好名,图片的名字必须和提示词里面的一致。这里可以新增分类,如果说你要用视频用来做音频参考,可以把它上传到这个音频转视频的分类里面, 这右上角有个剪辑音频功能,打开后他会自动把你上传的音频裁剪到四秒以内,按照自己的需求选择开关。 最后我们在这里选择一下方案,方案选择好后,只要不切换其他方案或者新增剧本,那就是可以一直不用改动的插件安装包里面放了一个乐诺微方案,选择这个脚本或者拖拽进去都可以,因为我已经导入过了,就把重复的先删掉,选择这个乐诺微的方案,然后点击应用就行了 啊。然后应用好过后,我们要做一个参数检查,首先就是这个点展开这里的参数设置, 然后这里的延时设置,延时,延时里面的话笨,有两个需要改一下,就这个任务间隔和生成等待,这个是根据你们自己的网速啊, 让他跑一遍,如果说默认的这个能跑的话就用默认的,因为他这个上传图片他会卡很久,他不像吉梦那样很快,所以说这里的延时的话,这个生成等待可以给他改成十秒以上, 根据你实际情况。然后这个任务间隔也是改长一点,如果说没问题的话就用默认,我建议的话改长一点,反正都是挂机。然后这里接下来就是功能开关,功能开关确定跟我一样就行, 设置完后保存设置,接下来是设置模型参数,根据你自己的需求去设置比例,默认我设置的十六比九,你可以手动改成九比十六,点击保存。最后我们再点击顶部的保存按钮, 把现在设置好的参数保存为自己的方案,随便取个名字,保存好后就可以在方案选择里面看到刚刚保存的方案,后面新建的剧本进来,只需要点击一下应用方案,就不用再设置其他参数了, 默认的方案一般只用于第一次使用,后面你都可以用自己的方案到这里就设置好了。接下执行任务前,我们先识别一下资产, 点击下面的智能识别资产按钮,里面有很多功能都是吉梦的,热陌也只需要用这里的全任务一键上传功能即可完成资产识别。这里要注意一下,新用户第一次安装这里的自动全任务,静默绑定开关是打开的,我们需要手动关闭,这是吉梦那边用的这个关闭过后才能点击全任务一键上传功能, 点击过后就会自动把所有任务的资产上传好,如果绑定错了,也可以点击智能识别资产里面的全任务撤销,可以撤销刚刚上传的资产,我们直接点批量执行任务,它就可以自动去跑任务了, 现在已经在自动执行了。还有一点注意的就是上面这里有个网页并发默认是二,也就是执行完两个任务后会自动检测,直到有任务完成后才会开始执行第三个任务。这里如果以后调整成一了,你也得改成一,比如国内疾梦就是一。 然后再说一下提示词和资产的识别逻辑,提示词和图片的名称一定要一致,一个都不能错,优先识别更长的。比如你同时有笔记本和笔记本电脑,那么会优先在提示词里面去找笔记本电脑,然后提示词里面只要是双引号里面的资产是不会去识别的,所以请不要把整段提示词放到双引号里面, 否则一个资产都识别不到。最后就是单个任务的上传图片是有上限的,即梦是九,我插件也是设置的九,如果超过了也无法识别。 然后就是时长识别,默认是十五秒,但是如果你的提示词里面有五到十三秒这种提示词,那么就会智能识别成十三秒的时长,以最后出现的这个为主。现在在执行第二个任务了,发送出去过后,插件就会去检测并发了, 然后第三个任务,好,现在已经看到它已经发了两条了, 第三个任务的话,他就会出现这个东西,就检测到已经病发超过两条了,他就不会去执行了,他会一直轮询检查,直到其中一个跑完才开始下一个。 这里要注意一下,这个病发检测只有在批量执行的时候才会检测,执行单个任务是不会检测的。然后必须切换成我这种填资格的视窗才能检测列表那种无法检测请自行切换后再执行任务。 然后我演示一下这个智能识别时长功能,我设置了一个零到十二秒,这里格式可以是零到十二 s 大 小写也可以十秒。好,我先执行单个任务试试,这时候它是不会做并发症检测的, 现在是零杠十二秒, 看一下能不能切换成十二秒, 这里已经自动切换了九比十六,然后时长也切换了,已经上传好图片和提示词了,没问题了。最后提醒一下,提前在本地给图片命好名,和剧本提示词一致,这里面是不需要的,它能自动识别到对应的图片名称和角色。

新鲜事,我来报, ai 大 事早知道事打到五月十六号。一、电商人的工具又进化了, run away again, 让你仅需一次绘画,就能从产品、照片和想法转变为完全制作完成的广告,操作还简单。二、牛津大学博士后开源视频翻译工具 miy, 支持多语言翻译与视频对话。该工具将语音识别、大语言模型翻译与语言合成整合为自动化翻译风格调整,例如将学术报告转化为儿童易懂版本。 三、英伟大 ceo jason wang 在 卡内基梅隆大学告诉二零二六届计算机科学毕业生,电工、水管工等技工比他们更有前景。数据支持这一观点。 restead 的 分析显示,技工需求增长是白领职位的三倍,机器人技术员职位增长百分之一百零七。而斯坦福研究发现, ai 相关职位早期就业下降百分之十六。 顶级电工年薪超一千亿美元。纳德拉称,微软当年投资时没人愿意下注。 在马斯克素奥尔特曼庭审中,微软企业发展负责人确认,微软对 openai 的 累计投入已超过一千亿美元,其中包括一百三十亿美元原始投资及大量 a 手基础设施成本。关注大道, ai 大 事知道。

润微全自动挂机插件,二十四小时不间断执行任务,在我们的插件里面导入我写好的润微方案应用即可,然后直接执行,看效果。自动检测并发两个并发任务,其中一个完成后自动开始下一个任务,因为这个网站很吃网速,插件里面有个延时设置,购买后根据教程里面的方法设置合适的延迟即可, 现在正在自动上传第一条任务,因为我延时设置比较高,所以这里要等一会。好了,第一条发送成功,开始第二条 我这里加快进度,好了,第二条也发送成功,这时候插件会自动进行并发检测,直到有其中一条任务生成好后,才会开始下一条任务。目前老用户测试最高的一天能挂八十到一百条,最低也在四十到六十条, 无限生成 cds 二点零,而且插件还能上传参考音频,让热诺瑞识别。买过国内版高级会员的都知道八十条一天意味着什么,看到这个提示就是并发症了,目前插件支持极梦国内版、国际版以及热诺瑞。

ai 视频的进度条时代可能要结束了,以前生成一个 ai 视频可能要等个十分钟,这种痛苦以后可能不会再有了。那就在这几天, run 为联合英伟达推出了全新的视频模型 gwm 一。 这个视频模型的重点只有一句话,延迟低于一百毫秒。一百毫秒的延迟其实是人类感知的生理极限,只要低于这个数, ai 生成视频就不再是视频工具,而是一种交互魔法。 通俗来说,以前 ai 生成视频就像是写信,你写信然后等着回信。现在的 ai 视频就像是打视频电话,你说什么它就变什么。 比如你在生存的过程当中,想要在这个画面里加一个火堆,你直接告诉他,我要加一个火堆,那在一百毫秒之内,他就能够实现画面的改变。 这个模型最恐怖的地方在哪呢?第一,以后可能没有游戏引擎了,他可以实时给你模拟出来一个世界。第二,他可能是以后机器人的超级大脑 在虚拟的世界里时时练兵,那以后你看到的真实的世界,可能是 ai 每秒六十帧实时算出来的假象。当渲染的进度条消失的这一天,我觉得创作自由才真正刚刚开始。

二点八六版本更新了热陌陌的方案预设点击方案选择,除了默认的极梦国内版和国际版方案,新增了一个热陌陌专用方案,热陌陌用户直接点击应用即可。方案选择好过后,只需要设置一下比例和延时设置即可。先点击模型比例参数, 把视频比例改一下,如果你本身就是用十六比九的,可以不用改。保存好后再点击参数设置这里的展开进入延时设置,根据实际网速适当调整任务间隔和生成间隔的等待时长,任务间隔就是任务执行完后刷新后等待多少秒开始下一个任务。鼠标悬停任意按钮都会有个简介, 时间短了会遇到的就是页面没加载好,没识别到并发或者没切换比例时长这几种情况。生成等待则是每次图片和参考音频上传完过后,等待多少秒才去点击生成按钮,时间不够的后果就是图片或者参考音频没上传完就点了发送,最后漏掉资产,根据自己的网速设置即可。 然后这个版本我们对智能识别资产里面做了新的自动全任务上传开关,在选择了默认的热门方案过后,这个开关默认会打开,也就不需要手动去点击全任务一键上传了。当然如果用不习惯的老用户可以关掉这个开关,继续手动点击, 这个开关对应的就是这个全任务一键上传功能,只是省去了手动点击直接执行任务,它就会自动上传好资产。 注意,只有润位或者不需要的急梦用户才用这个开关功能,需要的急梦用户请还是用上面那个静默绑定开关模式,这里有朋友反馈润位自带的这个下载全部功能就能自带标记,所以大家可以不用插件的下载功能了,用官方的下载即可。本次还更新了资产库的批量改别名以及查找资产功能, 这里输入资产名字,点击查找或者回车,可以快速定位到对应资产,可以看到这个资产明显不叫张三,那是因为查找功能对别名也生效,本次更新修改了别名的模式,变成了更简单的标签格式,输入别名,点击确定,则可新增一个别名,可用于电商的代替。诗词绑定。多图 对于做电商的用户非常友好,比如一个产品多个图都可以用一个提示词加别名给上传进去。别名在上传资产的时候就可以批量添加,在批量改别名这里输入别名,然后点击后面的按钮即可, 别名就设置好了。假设这是四件 t 恤,那么就可以通过提示词的 t 恤意见上传四张进去。资产名字也可以命名为体恤。批量改名也支持多个别名添加,点击执行任务,它就直接识别到了。

如何看待豆包 ai 手机被封杀?开始今天的一个自媒体的拍摄,其实我们对 ai 这个东西呢,我相信豆包手机绝对不是因为它的先进性而引来了封杀, 而是因为他权限过高,可能会侵犯其他软件厂商的利益,以及可能会由此引发带来的绝对的垄断,或者是可能会是侵犯消费者的隐私。 比如说豆包可能不做社这件事情,但是呢,你知道我们在过去很多这种流氓软件,在我们的电脑里面就有这样的一个病毒,他可以上传你的相册里的各种各样的内容, 可以浏览你的银行卡的密码记录。那么这样的豆包如果具备这样强大的一个功能,包括转账功能,包括各种各样的,比如说选衣服啊,选这些, 他就会衍生出一个产业链,就一定会有人或商家来研究这个豆包背后的机制。比如说淘宝、京东各种各样的电商平台,他的一个排序是谁买了直通车,谁买了我的付费,谁就会排在前面。 但是你用豆包的话,可能就绕过了这个规则,而豆包的规则就是谁向我充值,我就先优先买谁的转商品, 有没有这个可能?很有这个可能,我个人并不认为豆包这个手机有多么强大的这种功能性,这种功能性我相信任何一个 ai 厂商,或者说是任何一个商家都能够制作出来,但是呢 各个商家之间其实他们都有自己明确的边界,就是我在我的平台上游戏规则是我在制定,但这个时候突然出现了一个什么呢?零加一所有的平台之上的一个规则, 那完了,这个规则其实是更是大于手机本身的,这个已经超出了硬件的范畴。就像你这个,你知道一个手机基本上现在承载了我们的生活,我们的工作,以及我们的家庭,我们的生活、社会关系。 如果有一个 ai 将他进行全面的接管,这意味着什么呢?意味着他能够决定你可以干什么,可以看到什么,可以接收到什么,对不对?看似是对你个人的一个助理,但其实他可能也是一个牢笼, 他可能会给你去屏蔽掉他不想让你看到的,他可能会让你去觉得,哎,你觉得应该去看到的,那么这个时候你会发现这就是一个轮回, 这个能力是什么呢?就是他可能会超越感情,超越友谊,超越道德这种极致的权限,哪怕商家不出手,我相信国家层面也会出手,对不对? 他可以浏览你的所有的聊天记录,他可以读取你所有通讯录的内容,甚至跟他们之间进行各种各样的一些沟通交流,或者说是一些其他的方面。因为他的权限过高,可以廉价所有的 app, 那 就意味着他已经获取了手机的最高权限,所以说他只能够发行硬件,而不能发行软件。豆包软件是锁死在这个 app 里面, 但是豆包这个手机他直接应该是修改了,他的底层的权限应该是安卓手机,因为只有安卓手机,你可以不断的去通过越狱的形式来获取这个独取的底层的权限。 这样的定制手机其实难度并不大,像很多的行业其实都有自己的定制手机,但也仅限于这个工作强相关的。而杜爆这个是什么呢?您加一。所有的平台,相对于某种程度上而言,它就像一个间谍手机,你的所有的隐私都在他面前,这是一个暴露 对不对?因为你出场的时候就有把所有的权限,因为你想打电话,你想跟谁联系,你想设定什么日制,你想设定什么样的,他不都帮你做了?如果是我啊,那我可能不会去选择他的风险太大了,他 可能会带来是灾难级别的。但是我极其极其期待未来会有这样强大的 ai 助理,具备的不光光是给你的咨询建议,更是能够去帮你去执行一些事情。 在现在的很多的厂商推出 ai 里面已经可以部分的执行了,比如说帮你定个票,帮你跳转到什么样的页面,但是在你最终最做决策的时候,他一定直播了, 一定止步,一定必须要你亲自确认,一定要亲自输密码或亲自点确认,因为最后那一公里,最后那个止步是要担责任的,对不对?信息发出去的那刻,你必须要点确认,我可以把这个信息发进去之前给你编辑好,但是发之前必须是你要自己确认, 因为这个就像什么呢?这个就像智能驾驶一样,对不对?智能驾驶只能叫做辅助,如果他叫完全接管的话,为什么迟迟不能够推进?其实技术他已经具备百分之九十九,为什么不能直接推进?这背后就是边界,就是轮椅,一旦这个边界和轮椅一旦突破, 可能会引发我们所想象不到的一些絮乱,对不对?我发了信息,哎,不好意思,不是我发的,这个是我的豆包都不发的,这个字不是我签的。你知道银行现在很多的信贷资金都是在线上申请,线上只需要确权就可以直接通过,那万一帮你贷了一笔款, 那么所有的游戏软件你充值啊?这个不是我充的,这个主播的礼物不是我刷的,豆包刷的。哈哈哈, 有没有这样的可能?那有这样的可能,他会引起引发一个规则的边界的序乱,所以各大 app 也好,硬件厂商也好,都只在自己的边界之内,对不对?在自己的边界之内,随便你怎么折腾。但突然这个豆包出来说,哎,这个全世界都是我的。 那听我刚开始他可能循规蹈矩都把二点零版本的手机出来的时候,那可能是不循规蹈矩了。给我充值,优先推荐你的产品,优先推荐你的商品,优先推荐你想去的地方,去你想要的航班。要订机票的时候,国航跟他说订我的机票,不要订南航的,我给你多少多少。有这个可能啊, 非常有这种可能,是因为很多的比较,其实边界是很模糊的,而这个时候你给他推什么,他可能就会确定是什么,你就会进入了各种各样的牢笼里面。