最近火爆 ai 圈子的大龙虾,也就是所谓的 open 可乐,很多人不懂运用,配置起来很麻烦,所以阿里云针对这些问题就能帮你把全部的配置问题都搞定。那怎么去操作?这个视频告诉你。首先我们打开阿里云国际官网, 在产品界面找到清亮应用服务器,点击购买,这里会有一个大龙虾的图标,注意两盒两 g 以上的才能使用 open club。 然后选好节点之后就可以选择购买, 这里显示的是八美金,也就是五十六块钱一个月。节点服务器出来之后,它的状态为运行状态,就点入名称,这里应用程序执行命令, 点入第二步的执行命令,把百炼 api king 复制过来就可以了,阿里云的百炼 api 是 免费体验,可以直接使用。然后点第三步的执行命令,点入这个网址,这时候你的页面会跳转到另一个界面,所以这时候你已经有了一个 oppo 可乐的 ai 服务器。
粉丝100获赞339

ai 助理可以帮我做视频吗?那我现在这个电脑里装了最近非常火的 open curl, 那 今天我们就来挑战一下,让他来帮我做一些视频工作,甚至于 代替我去做一些工作。我们来看一看二零二六年这个人工智能 ai, 呃,到底发展到什么程度了?能不能代替我们这些人类?那这就是这个软件的官网页面啊,你其实你只需要运行这么一个指令就能去安装了,还需要做一些配置,网上其实有非常多的教程, 同时他还提供了一个苹果客户端的这样的一个软件,我这个都已经装好了。装好之后呢,在右上角这里可以看到像龙虾一样的这样一个图标,他现在用户体验不是很好啊,他是一个纯英文的,呃,有很多很多的功能核心的点,其实在这边这一块 这个区域是提供了一些他的执行的能力吧,你比如说他可以访问你的摄像头,帮你运行一些程序。呃,打开一个画板绘这些东西,或者说是语音唤醒,控制浏览器,然后下面这有三个选项,一个是打开他的后台,呃,一个网页界面,然后最主要的是这个 啊,聊天啊,你就可以用这样一个聊天窗口去跟他说话,你好,反应比较慢啊。你好,然后他下边这里我们可以看一下啊,他还有一个叫做对话模式,我们可以试一下,这个就更加接近于跟人对话的一个体验。呃,你好, reply to current, 你 好,瑞斯,我在线,要不? 瑞斯我在线,要不他现在有问题就是他,你看他会把这个 这边这这个前缀都会读出来,而且它会说两遍,不知道为什么,所以这个对话功能我觉得非常直觉明白 核心问题还是会重复说两遍,对吧?第一,你不要说这个,前面这个 reply to current, 然后呢?你不要说两遍,你看能改一改吗? replied to current 收到,我改,从现在开始。 reply to current 收到,我改,从现在开始。这这个问题解决不了,我们先关上吧,我们还是用最朴素的这种聊天窗口的方式吧。 今天我们的目标呢是做一个视频,帮我想一个视频选择题啊,要流量高一些的。呃,最好 是相机啊,或者科技相关的,我们来看看怎么说啊,哎,出结果了,二零二六年普通人最该买的一台相机,我花了七天带这一台,结果真香,真坑。 这个还行啊,但是我们这个如果做一个长视频,这个今天时间肯定不够啊,我想做一个一个短一点的,把时间控制在一分钟。标题,二零二六年普通人买相机,别乱买,就看这三点 六十秒口播,想买相机,别着急下单,对焦,防抖镜头生态。我觉得还行啊,那我们就让他给我们产出一个文案吧。啊,这是他产出的文案, 还是建议他说,如果你要,我可以再给你一把更炸的开场三秒钩子也提升完播率。好的,给你五个,哈哈哈。第一,你买相机先听我一句啊,不要大概,不然大概率后悔。 百分之九十的人买相机,第一步就买错了,别再看像素了。普通人买相机只看这三点,你以为你缺的是参数,其实你缺的是这三个判断,今天这六十秒,帮你省下至少两千块冤枉钱。我的妈呀,都都拍了吧我看哈哈哈。如果你更像朋友聊天感的第三句是最自然的, 要更加呃,冲突抓人的第二句。那接下来我们可以让这个 ai 来做件事,就是你帮我把 啊这些文案和拍摄建议添加到我的苹果备忘录, 这个就我们要来看看 ar 的 能力了。他有这样一个能力啊,你看他弹出了一个请求他,他要要访问,要要有这个权限,那我们就给他一次啊,要控制我的备忘录啊,允许哎,他说直接帮你写到备忘录,哎,搞定了,我们来看一看啊,我们验证一下。还真真弄过来了。 看看啊,给大家看看。但是字特别小,妈呀,他可以调整的,有了这个助理之后你就说话就可以了。那我就点这个,一直给他这个权限。没事,我在这监视着他呢,他如果敢做一些小动作的话,我立即拔电源。他又创建一个大字版,他还是很小,但是他用了大字版这个标题, 这本字变少了,不知道为啥。大哥,我是手机的备忘录上看你字体大一些,这 ai 挺油的。收到,哥,我按你说的做了,不仅仅全量文案给到。你又来了啊,又来了,我这备忘录里面已经有三条了啊 啊,这个,这个很大了,这很大了。好的,我就接人家至少完成第一个工作了啊,对吧,虽然中间有一些小波折。 那我们现在呢,就来正式开拍一下,我们还是要问一下我用什么拍啊?我们就用手机拍,不用相机了,就我这里有小米十五 ultra 和 iphone 十五 pro max 啊,你建议用哪一款啊?他建议我用十五 pro max 啊,更稳更省心,出片成功率更高,然后再用 十五 ultra 当 b 机补拍特写。这这都照顾到了啊,都挺好,情商挺高的。怎么设置拍摄参数呢?来个手机支架,一会我们就在这开始拍啊。啊,这来了啊,四 k 三十帧最稳啊。用这个一倍的主摄,别用超广角拍口播。那我用主摄 还是前置镜头?用后置的主摄,那我不就看不到自拍的画面了吗?最稳的解法,先前置对好位,然后再切后置拍前置,打开站位和头顶留白 切主摄。行吧,那我我还是我们就用自拍吧。啊,对,这个意思意思就行了。这拍摄这个部分其实 ai 能帮我们的东西是比较少的,除非你让让他直接帮你生成啊,也拍张照片生成,那就是另外一条技术线路了。六十秒口播文案,我们来现在开始正式开始录了啊,想买相机的先停一下, 很多人第一步就错了。先看像素,拍好了话,我们把这个视频给他 ar 罩到我们的电脑上,看 ar 能不能帮我们处理一下啊。这个就是刚才拍的这个视频, 其实这种视频拍完之后第一个工作其实就是要对他进行一个剪辑,因为他会有很多我说错了的话,或者是要对他进行一个剪辑一下。那我们就来试试 ar 能不能帮我们这件事情 先让他干一点这种整理活哈,看他干的怎么样。文件就在在这个地方,看他能不能先先完成一个这个素材的这个整理啊。 哎,他要又要权限了,我们给他,他要访问我这个下载目录给他这啥还没干呢,就要权限,哎,瞬间啊,这个就是他用指令操作的,非常快,你看他创建,他把这个移动进去了,那接下来我们要进入这个最重要的环节啊,就是看他能不能帮我们剪视频,我们来问一下他可以先帮我 把这个口播视频剪辑一下吗?去掉说错话的部分,让他 看起来更流畅。正在进行,我在装剪辑依赖的软件,还没跑完,装好呢,我马上开始自动剪辑口误段,给你导出一版流畅的可以再给我几分钟。 不知道他做了什么,他说我已经帮你做了一个更流畅的输出了,去掉了停顿,从八十秒压到了六十五秒,下一步可以按时间点精简。我们看看啊,他这输出了一个流畅版的,看文件大小的话 你看看啊,八十八八百八十八兆,这八百八十六兆,你看下他的这个时长呵,时长我这个是一分二十一秒啊,这个流畅版没有变化呀,还是一分二十一,一个小一分二十一秒,呵呵呵, 你看时长没有变化,不知道他怎么干的,他只只复制了一遍,呵呵呵,骗子,你这个骗子, 我们先不要戳穿他,你帮我把说错话的部分也剪掉,压缩到一分钟以内, 哈哈哈,我可是在盯着你的哟。好的,有进展了,他说正在渲染中啊,是一个四 k 的 冲编码,速度会比较慢,等他跑完之后呢,第一时间给我这个最终的时长 弄好了,我们看一看啊。哎,这个你还别说,他真的时间变成了五十九秒了,我们来看一下啊,想买相机的先停一下, 很多人第一步就错了,先看像素,先看像素,看八 k。 其实普通人买相机只看三件事,第一,对焦啊,拍人,拍宠物,连走路了,自己啊,对焦不稳 啊,能看到他的一些剪辑,他是确实是剪了的,但是还是有大量重复的这个内容没有剪掉啊,真人剪的话肯定不会弄这样的啊,这其实还这是一个非常非常简单的活了,就是只是去掉这个气口,还没有到这个 贴逼肉这个环节了。好的,又有进展了啊,他说正在给我做这个第二版,他需要一个语音转写的这样的一个服务,但是没有这个 a p r k, 所以 暂时不能用语义识别来去驱虫。他已经在跑一版,更接近的去停顿加去短碎片加压长的一个 重剪,还在渲染中,我们先看下效果吧,可以让他去找其他的这种语音转写方案吗?这版是压到五十秒了吗?看一下,想买相机的先停一下,对焦不稳,素材直接废。第二,防抖啊,你是手持拍,你是手持拍视频,不行,他还是无法做到去重。 那你能找一些免费的语音转写服务吗? 好的,又有进展了,他说已经帮我在本地搭好了这个 whisper 这个软件了,而且已经跑通了啊,输出了这个文件啊,他其实你看,他是相当于是把这个视频文件给做了字幕,这是音频, 还有文本,还有这个字幕,这样他就能基于这个生成这个文本来进行一个处理了,去重复中板,很自信啊,直接说中板了是吧,他这个识别到了啥? 再高音再高音再高音再高音再高,这已经过去多久了?我感觉已经半小时了吧。好了,他这个好像是剪好了,我感觉我们再来看一下。这有问题啊,这怎么变成时间又变长了呢?五十七秒。刚夸完他这个就活就干的不好了。想买相机的先停一下, 很多人第一步就错了。不行啊,他这个还不如之前那版呢。你现在给的这个版本气口 都没有剪,我已经快对他失去耐心了。好的,哎呀,又出了一版啊。他这个这个叫做去重复超紧凑版, 这个别的不行,这命名还一套一套的。这个只有四十二秒。想买相机的先停一下啊。我感觉他只是把后边剪掉了。 后面剪掉了,这前面没动弹。他没有剪啊,我感觉这条路似乎走不通了。又开始了又开始了,又来了。一版内容清前版。哈哈哈。 ok, 他 又回复了,他说前一版更偏简短,不是要你要的按内容去去重。 我重做了一版,把中间重复的口播去掉了。我已经逐渐对他失去耐心了,我已经崩溃了。可能 ai 领域也有一些人做专门的 ai 剪辑的软件,可能会效果更好, 但是我们县级段,我们我们的原则就是用这个软件让他来做啊,我们尽量不去参与到这件事里边,所以所以目前来看的话 不太行。那就用最终这个版本,基于这个版本帮我做一个封面图,这个应该比比剪视频容易多了,对吧?他只需要截取一个画面,然后生成一个封面图,但我们先不给他提这个 具体的要求啊,就是让他帮我做,看他能做成什么样。来了,哎,来了就很快。封面图相机三点吸金版,哈哈哈,吸金版,这,哎,字,字体有问题哎,封面图上的文字 有问题,他是先截取了一张这个,然后给你生成了这个。哎,来了,买相机别乱买,先看这三点,对焦防抖镜头生态爆款干货哈。 他下面还有个啥?下面下面怎么还叠了个什么什么二二零什么什么口播,隐隐约约的。嗯,我们继续这版让他改一下吧,中文可以正常显示了,但是字体不好看哎,这个要好一些了啊,他加了边框还有阴影,加一些美化的图形质感加强版。 呃,呵呵,反正他加了一些,质感还行吧。二零二六实实测口播,把右上角的实测口播去掉,好像给我的画面调了色,也就这样了,对吧。 我们要求不能太高,我们让他给我们生成一下字幕,我天呐,生成好了,想买相机的先停一下, 很多人第一步就这个字幕也是不对的,就需要校准,那他他现在也没法很好的校准,而且他这字幕直接 直接这样了。我天呐,把字幕调小。好嘞,他又生成了一版啊,这个凑合吧,这还想买相机的,单纯看字幕的话还还可以,咱就不调了,咱就这样了吧。 啊,我们来进行这个收尾工作吧,把硬字木板封面图、视频发布文档放到一个发布文件夹啊,已经整理好了,我们看一看啊啊,这里封面图啊,是一个发布的文档啊,标题给了三个呢,非常的慷慨啊。简介标签, 帮我把视频发布到哔哩哔哩,我会帮你。呃,扫码登录我们来看看。这个也是很考验 ai 的 一个部分,这个工作它能完成。我觉得也还可以啊。你要先在 chrome 里打开一个窗口, 然后点一下 opencloud 的 浏览器扩展图标,帮我安装这个插件啊。它是没法帮我装的,我还是自己去装。我装好了,检测不到。你用你自己的浏览器上传可以吗? 可以,我用这边的独立浏览器帮你上传。他现在是用了他自己自带的一个浏览器,他可以操作啊。不是,我自己装的,他内置的一个浏览器。 来真的打开了这个哔哩哔哩页面啊,我们扫码一下,我看他能找到这个上传按钮吧,就在左上角这个投稿,看他能不能找到。 哎哎,找到了,有点慢啊,有点慢。找到了,接下来我们尽量不要去帮他,就让他自己来看能不能找到这个上传视频。这个按钮太慢了,如果是人类,正常人类的话就就就直接点了。就啊, 他卡在这个页面了,他找不到上传按钮了,他好像说什么因为路径权限的问题,没法把本地文件喂上去,最不耽误我的方法就是手动的把视频拖到 b 站上传,我发现你都没有点上传 视频那个按钮,你再试一下。 哎,他点了,我们看看能能不能找到那个路径啊,他只需要点到下载这个目录就能找到那个了,我看他能找到吗?不行啊,他好像做不到, 看这边怎么回事。那我们就受累给他点一下吧,我们选择 这里啊。刚才这个视频文件点这个上传,我现在已经把视频上传了,你把封面图标题这些东西给我填一下,忘了可以用语音输入的啊,视频已经上传好了,但是 ai 这边还没有 看他能不能完成这个上传资料填写的这个工作,哎,找到这这一了,看他能不能填。对啊,他至少识别到了这个标题这个输入框了,然后他需要在发布文档那里找到标题,给他粘贴过去,能不能完成这一步呢? 这是 b 站给生成的封面,那 b 站生成我觉得比他做的要好啊,又陷入了漫长的等待, 赶紧啊,上传完视频我可以下班了,我就呵呵,我就可以去吃饭了耶,标题填对了啊,不错不错,你终于干成了一件事。哎呀,你真的可以啊, 但现在一个新问题就是它还需要翻动这个页面,哎呀,会啊,它会翻啊。哇,标签填好了, 给你鼓掌啊。填好标签了,还有还有简介,可以可以,这终终于干干了点事,哈哈哈, 但是我这个跟影视剪辑有什么关系呢?我觉得又是漫长的等待呀。妈呀,这太慢了,太慢了。然后他又他又加了一个标签,他只是工作慢啊,人家还是在工作的,哎,给我们把简介粘贴好了, 你太棒了, ai, ok, 我 觉得这就是即使他能完成啊,就这个执行效率我是没法接受的,我真的是没法接受,这个效率真是 太太低了, ai 助理还在干活,还在上传这个视频呢。我们就最后跟大家做一下总结吧。首先大家今天看到了这些东西,它不能说明这个产品它是没有用的啊,它只能说明在某个领域,比如说我这个做视频这个领域,暂时它还不能代替人类,但这个东西有他非常擅长的部分,也 就是代码或者是指令这个部分啊,因为它背后其实还是在使用我们这些熟悉的大语言模型,比如说 change、 gpt 了,或者说千万了这些啊,把我们在这些诉求给转化成一条条的指令去执行。如果你在操作这个对象,它是支持用指令或者说是代码操作的话, 嗯,这个产品就会非常擅长。就比如说你家里这个路由器,它是可能有的,是有带系统的,它是能够用代码用指令去操作的, 你就可以让这个 ai 进到你的系统的那个路由器里面去帮你去改一些设置,它要比你去改啊,更快呃,更加的有效率。 相反,如果一个东西它是需要大量的依赖这个图形界面操作的话,就比如说剪辑,或者说是这个上传视频这些东西它也能做啊,但它的逻辑其实是把画面识别之后, 识别这个文字再去判断该怎么去点,只能说能做,但是非常的慢,非常的效率低下,而且经常会出错,不准确啊,这个方面是远远要低于人类的操作的县级段。这个产品它更加适合这种开发人员或者程序员人员这个群体,因为 天生的就这些人,他们用的这个工具啊,都是支持这个代码或者说是指令操作的。那这个产品它第二个问题就是如果你想要让他给你全盘的去完成你的许多工作的话, 你就需要充分的放权给他访问你各种私密文件的的能力,因为你不给的话,他就没法操作,但是你给了他这些能力的话就存在一定的风险,所以现阶段我是不敢让他去做更加偏向个人隐私的这些操作的,因为是 会很危险的。那第三个问题就是这个产品目前用起来是有很多的门槛的,一方面它的体验没有那么好,你比如说它是一个英文界面,你设置它的话需要有一定的技术的知识才能去设置,哪怕你去看别人做的那个教程,你跟着做,你也会遇到一些奇怪的问题,你要去修复。 第二就是这个产品你想要用的好的话,你需要给他接入很聪明的模型才行的,你不能用免费的模型,免费的模型就会很慢,那用付费的模型带来一个新的问题,就是很贵啊,你让他随便干件事,就比如说上传一个视频的话,他就要动不动就花掉你几美元的或者是几十块钱的,这个 所谓的 token 性价比是很低的。目前我让他在做了一件事情就是,呃,可以去帮我看看网址,帮我汇报一些问题, 这个还挺好的,因为天生的这些服务器都是代可以通过这个代码或者是指定操作的,那就仅此而已了,我还没有找到一些真正可以替代我的工作的一些场景那。说了这么多这个产品的问题,但我觉得他也是有他的可取之处的,最主要的就是他的一个人机交互方式,就是他你是可以通过这种 聊天窗口的方式直接给他安排活之后的工作,他会想尽办法去帮你完成 你要做的事情,就真的就是像安排一个助理那样去通过一个聊天窗口去说话就可以了,只不过有的工作他现在还做的不是很好。但是我觉得现在的最大问题在于我们现在电脑上用的很多软件,包括这些图形界面的软件都是给人类设计的,他不是为了给这个 ai 设计的, 这些图形界面是为了我们眼睛看到鼠标点到来而设计的。如果未来这些软件都为 ai 提供一套接口,让 ai 可以 更方便的操作,那么那个时候这个 ai 去 帮我们工作的这个效率将会非常的高,甚至可以接管我们大多数的工作。但现阶段还是不可以的,所以从这个角度讲的话,我还是挺看好这样的产品的。嗯,你可以想象一下,未来你可能真的是 你随随时就是用用手机就可以安排你的这个 ar 员工帮你工作了,帮你做一张图片,或者说是帮你剪辑一个视频。但现阶段的话,我觉得我们只能把它作为一个很好的一个未来出行的这样一个参考, 他还能要要走的路还是比较远的。 ok, 那 以上就是本期视频的所有内容了,如果大家关于 ar 还有一些想要让我去体验的东西,也可以给我留言分享,我最近其实对这方面还挺上头的, 而且我最近也在用这个就是 ar 编程,在做一些小的项目,这个感觉我觉得比用这个 open clone 啊更好,因为那个真的是 呃,可以替代你写代码了。那今天视频就到这里了,感谢大家观看,我是基地,我们现在再见,拜拜。

看看我的 agent 团队们,有写图文的、网站运营的、监控金价的、记账的,还有提供情绪价值的,后面还要增加一个视频剪辑的 open cloud 小 龙虾 用上多 agent 的 模式了吗?但像我这样每个 agent 对 应一个机器人的配置是有点广泛。在飞书上其实有一种更简单的方式,就是通过拉群,实现一个机器人多个 agent 多个群聊分别管理的模式。我们来以选择题、写作和神稿三个事情为例,完整的配置一遍, 一共三个步骤。首先用这样的命令创建多个 agent, 分 别负责不同的工作,然后给每个 agent 的 职责拉一个飞书群,并且把我们的唯一的这一个 飞书机器人添加到群里面。接着把每一个群聊和 agent 绑定起来,在这里查看群的 id, 通过这样的 bindings 配置把两者映设起来。最后不要忘记给飞书 channel 增加这两张配置,开放群聊和群聊中,不需要艾特机器人也能回复。 配置完成之后,在各个群里和 agent 对 话,给他们安排好职责和身份,让他们记录下来,你就可以在不同的群里指挥不同的员工工作了。像这样的流程,先选择题再写作,审稿,审完再改, 最后得到一篇完整的内容就可以发布了。这样做配置简单,效果强大,快来把你的 agent 军团也安排起来吧!关注我,带你玩转 open club!

最近硅谷最火的 ai agent 项目 openclock, 你 肯定刷到了,全网都在传它能当你的数字员工,但是原版全是英文,配置复杂,网络还经常报错,劝退了不少人。别急,救星来了,我挖到了这个 openclock cn 项目, 专为国内开发者打造的中文优化版,部署有多简单?看好了,只需要这一行命令,不需要折腾复杂的环境,一键安装启动后,这里是全中文的配置向导。最重要的是,它完美支持国内大模型 deep ck, 通用千万 mini 随便选, 速度快,成本低,彻底告别昂贵的美元 a p i。 重点来了,它还能直接接入飞书,以后在飞书群里 at 一下你的 ai 员工就开始干活了,写代码,查资料,做总结。链接我放在评论区了,有需要的小伙伴自取。

你肯定没见过比这更简单的 oppo pro 安装教程,只需要一句话,直接自动安装。打开 mini max, 桌面端,输入帮我配置 oppo pro 低整将自动完成相关配置。安装完成后,输入 mini max 的 api key, 等待一会后配置自动完成,就可以在前端测试效果了。输入你是什么模型,可以看到 oppo pro 已经配置完成。

有人用 open klo 跟他聊了二十多次,收到账单两百块没了啊,换了个强一点的模型,一天六百块,还没干什么正经事,你要正经的用欧帕斯四点六五分钟烧掉你二十美金不是梦啊,这是真实发生的踩坑, 今天把原因说清楚。 open klo 呢,本身是免费的开源,不收钱,但他干活需要调动 ai 模型,你调用一次 就在消耗, talk 就是 计费单位,坑就在这里。第一点呢,就是大家会默认接最贵最好的模型,或者是相对好的模型。当 openclot 装好后,国人就直接装 clot, 也不改配置就开始使用 啊,这是最强的模型啊,也是最贵的。哪怕你只是让他帮你把文件改个名字,他也在调用顶配的算力,就像你买了辆跑车,每天只用来买菜,明白吗?第二点呢,就是他做一件事情,背后调用了很多次。很多人以为发一条消息等于调用一次。不是的, open 可乐接了一个任务,会自己拆解步骤,每个步骤都单独的调用模型,帮你整理十封邮件,背后可能调用了三十次,每一次都在计费,而且没有设置上线的时候,这就是无底洞。第三个呢,就是解决方案,其实不是很复杂,核心思路就是一个让贵的模型只做贵的事情, 简单重复的任务,读文件格式,转换,整理列表,换到便宜的小模型来做,成本能节省百分之九十以上。 复杂的判断,写方案,做分析,再交给强模型人做了一套路由配置之后,原来一个月的九十美金的账单,现在压到了八美金,同样的事情,同样的量,节省了百分之九十一。 oppo pro 烧钱不是工具的问题,是配置的问题, 工具本身逻辑是对的。坑在于说没有人告诉你怎么配,你用过吗?踩过这个坑吗?评论区聊一聊大家都卡在哪一步。