新品上架最头疼的是什么?关键词不知道买哪些?广告结构怎么搭?进价给多少才合适?别纠结了,用智能创建正好比在广告界里的傻瓜相机 操作简单。第一步,选好你的新品 ace。 第二步,关键来了,选人设。如果你想暴利推新,快速抢排名,就选推动增长加激进的四到五号人格, 就就像请了狼性投兽。如果你想稳扎稳打,选三号人格就够了。最厉害的是,定向是 ai 自动生成的,它会爬取你的历史高转化词、亚马逊推荐 词,甚至帮你算好预算。最后一步,务必点开自定义策略瞄一眼,不喜欢哪个词都可以勾掉,点一下。创建一套专业的广告组合拳就打出来了,就比自己一个个创建快多了。
粉丝107获赞696

像这样的 ai 探班视频应该怎么做呢?其实非常简单啊,只要用 nano banana 来生成特定的探班合影图片,再用图生视频的首尾帧 ai 工具,比如吉梦啊、可灵啊等等。于是此我放评论区了,大家一起来看看效。

灵感妙创功能,可以进入笔记选择一篇笔记,然后在这个笔记里面可以通过这个彩色这个笔,然后点击灵感妙创,进入到这个灵感妙创的一个这个编创界面,可以通过这个加号,或者是或者是点击这个画布,都可以从图库里面去选择一些你喜欢的图片进行编创,比如说我从这里面选择一个这个,点击完成 就可以把这张图片从图库里新建到这个画布上。想把图中的这个企鹅变成一个可爱的企鹅,那么我们就用这个圈选生图的功能,然后圈选你想要编创的区域,你可以在这里边输入,帮我把圈选的企鹅变成卡通版,然后这个时候如果说你不想等的话,你也可以把它小化,然后 你可以在里面去做一些你自己的一些事情,画完之后你可以把它最大化,然后去看它那个效果了。哇,好可爱,是他就把那企鹅变成了一个卡通版的。

当我用 prux max 给小朋友画画,然后点击这个乌鸦画一个房子 怎么还有颜色呀?不一样,为什么没有那个颜色呢?房子画歪一点,这样子,这个是窗户, 这个是大门,大门重新画一下,大门画个这个,门前有一条河吧,这样子。河, 一条河,然后这里有几棵树?有几棵树?大树是不是画个抽象的小猫?小猫, 你的尾巴画个太阳,这里再画一个白云飘过去,这也是个小沙滩。 ai 生成一下,看这里,点这里,等一下哈。哇,你看漂不漂亮?你看这个,这个,这个, 你看。对呀,你看这个是刚才爸爸画的那个吗?是不是?我想看我弟弟。弟弟不是爸爸拍的吗?漂亮吗?你先说这个漂不漂亮?漂亮。

好啦,我发现了一个非常酷的东西,我觉得每个人都想知道,那就是可以在手机上运行 ai 模型,而且是非常好的 ai 模型,不需要连接互联网就能使用。所以你可以在飞机上或者在家里使用这些模型。当你不希望它们被发送到任何云服务时,你不想使用 openai 啊 and project 或 google 或任何这些公司的时候, 可以在手机上使用一些最好的开源模型。来看看这个,这应该是个比较短的视频。我看到了 adrian granden 发的帖子,他展示了在电脑上运行新的 quan 三点五。如果你仔细看这里,你能看到他在使用飞行模式,实际上运行的非常快。他使用的是 quan 三点五二 b 模型。这是一个全新的模型, 确实是本周才发布的,三月两日发布的,有四个版本,八亿参数模型,二十亿参数模型,四十亿参数模型以及九十亿参数模型。而且这确实是一个非常不错的模型。就像你在手机上想做的大多数事情, 模型都会运行的很好。你可能不会用它来解决复杂的逻辑问题或者做数学题,你可能只是用它来和你一起头脑风暴,或者问他如何应对正在发脾气的孩子。正在发脾气之类的情况,现在是崩溃还是什么?但是来看看这个,这是精准测试结果。正如你所知道的,我 不太重视精准测试,但这些模型与最好的开源 g p t 模型相当,在大多数精准测试中比 g p t 五 nano 表现更好。比如说,这是一个非常不错的模型。那么回到这个叫 aj 的 家伙,我想弄清楚它到底是怎么在这些模型上运行在手机上的。原来它创建了一个叫 locally ai 的 应用程序,所以我就 找了这个应用。你可以在应用商店找到它。它叫 locally ai, 我 会附上链接,以确保你能找到正确的应用。如果你确实想下载的话,让我们继续获取它。我打算扫 描网站上的二维码,那么这就是应用商店里的样子,让我们点击获取。目前评分是四点八星五百七十九个评分,所以人们似乎很喜欢这个。让我来看看这。 当我们打开应用时,他会问我们选择哪个模型?你可以选择苹果的基础模型。如果你的 iphone 内置的话,我们有这么二, queen 三,一点七, b 和 lama。 三点二。现在我想用新的 queen。 三点五应该已经可用了。那么让我们直接跳过,我会选择一个模型。跳过之后再选择模型时,我实际上有更多模型可选。 这些都是初识界面上没有显示的。现在对于在这种设备上运行,我们能在手机上使用的最聪明的思考模型是这个困。三点五,这正是我们想要的,所以我选择这个。然后我们有几个选项。你可以选择四十亿参数模型,但他需要 iphone 十五 pro 或更新版本才能运行这个,所以 我选择这个。然后我们有几个选项。你可以选择四十亿参数模型,但他建议使用 iphone 十五 pro 或更新版本才能运行。你也可以选择二十亿参数模型。 见你 iphone 十五不一定是 pro, 还有愧三点五的八亿参数版本可以在 iphone 十四或更新版本上运行。我用的是十七 pro, 所以 我选三点五,但显然要选择最适合你手机的型号。下载需要一点时间。好吧,在 wifi 下大约用了五分钟。显然你的下载速度可能不同,取决于你自己的网络速度。 我会快速下载二十亿参数版本,这样我可以比较一下速度。在设置里,我有管理模型选项,可以在个性化中添加更多模型。我还可以给它自定义指令。这很酷,也可以更改温度参数。 我现在先保持默认设置,我们可以删除整个对话历史,这就是所有的设置了。但是我想确保你们都能理解这是怎么回事儿,以及如何实际使用它。所以 这就是所有的设置了。但是你还可以添加一个 siri 快 捷指令,可以说,嘿, locally ai 直接向应用提问,非常酷。好吧, 现在它运行的是 quint 三点五的四十亿参数模型。让我们做个基础测试单词, strawberry 里有几个 r, 我 们可以看到它正在为我们分解。分析,发现 strawberry 这个词里有三个 r。 现在我知道这显示我正连着 wifi。 不 幸的是,如果我关闭 wifi, 我 共享屏幕到电脑的功能也会关闭。 但我测试过,关闭 wifi 后确实能用。你不需要连接互联网不只是一个噱头,它真的有效。不需要连接互联网,这不是在向云端发送任何信息,它完全在你的手机上运行,我要把它切换到二十亿参数模型。 在这里让我们开始一个新聊天。我会问一个最近流传的比较傻的问题,如果有一个洗车店离我家二百米,我应该走路还是开车去?让我们看看它怎么说?它有和其他模型一样的逻辑缺陷。决定走路还是开车,你需要比较不同情况下的出行时间。 比较确切的出行时间。考虑非时间因素,如果你的开车时间在所有情况下都少于走路时间,你就应该开车,即使走路超过一分钟或类似的情况。实际上,根据问题,距离只有二百米,走路大约需要二减三分钟小时。开车是等等等等。 是啊,为什么我要走路?如果我需要带着车去洗车店,如果你的车需要你在厂才能洗车,那么走路就变成了实际需要,而不是理论上的选择。 所以我的意思是,它不是像某些新模型那样擅长逻辑。但如果你把它用做头脑风暴伙伴,比如为 youtube 视频头脑风暴一些点子。 关于 ai 将如何影响我们的日常生活,因为我用的是二十亿参数模型,但实际上运行的非常快。再说一遍,假装我现在离线了,因为它没有连接互联网来给我这些回答。 ai 会抢走你的工作,这是残酷的事实。你的猫能用叉 gpt 控制你的门铃吗? 是一个有趣的用力,只是在思考那个视频,我的声音会通过听播课来学习吗?机器人外星形形机械乌龟对比人类遛狗第一人称视角恐怖片。为什么 ai 可能只是我的别名?五个真正对我来说,五个真正有效的 ai 工具比 c、 d、 d p 更好。我不知道 c, d, d p 是 什么, 这个是什么?是我应该知道的首字母缩写吗?我如何用 ai 改掉我的坏习惯?复制粘贴的终结 ai 生成的关系,打造数字超市。 ai 用于护理。我的意思是,这里有很多点子,我可以坐在飞机上获得这些点子。我甚至还没有打开思考模式。你可以看到左下角有一个小灯泡,让我们打开灯泡,说 给我更多点子。好的,所以现在他不会立即回应。他实际上是在思考。我们可以看到他的思考过程,所以我们实际上有一个思维链模型在运行。这 是亏三点五的思考模式非常酷,让我试试用这个来头脑风暴一些。视频点子完全在设备上运行,我确实感觉到我的手机变热了,它确实在升温,不是很烫,但它确实在使用处理能力。它实际上花了相当多时间在思考。现在它正在给我回复。 这是一个包含三十多个具体细分,深入吸引人的 youtube 视频点子。我现在直接告诉你一个直接的 ai 交互,二零二四年你不会看到的五个深度伪造,但你会看到与人类的访谈,与 ai 的 访谈。测试提示词,生态系统在就业市场分析中的应用。我如何发现自己变得垃圾邮件成瘾? ai 过滤器, 你懂的。它现在给了我很多点子。随着对话变长,你可能甚至能从我的视频中看出它实际上开始变得有点卡顿。现在我正在使用四十亿参数模型进行深度推理,这绝对比 版本更强。他会稍微变慢一点,因为上下文中有更多细节,我只是在这里滚动。现在开始变得卡顿了,但他也是一个视觉模型,所以让我们停止这个,打开一个新聊天,我要关闭思考模式。我要关闭思考模式。让我们点击这里的加号按钮,拍一张照片,这样你就能看到 爱什么。这是我现在喝的东西。让我们拍一张他的照片,让我这样拿,这样就不会有那种奇怪的效果。好了,让我们拍一张照片,我用这张照片,然后问,这是一个健康的选择吗?是的,他是一个健康的选择,灵堂, 天然香料等等等等等等。而且它实际上又运行的很快了。因为这是一个新聊天,所以它不需要从之前的对话中调用所有上下文。我想证明它可以在没有 wifi 的 情况下工作。我打算让我们开始录制我的屏幕,我会录制,然后我实际上要关闭 wifi。 从这一刻起,它将使用我手机的录像功能,所以我会在这里关闭 wifi, 也会把它设为飞行模式,所以它完全不会使用五 g, 所以 我们没有网络。我们现在在飞行模式。让我们开始一个新聊天。 开始吧,我的孩子在闹,我的孩子在闹脾气,因为我拿走了他的 ipad。 我 应该怎么安抚他们?我们可以看到它正在运行,它正在快速流逝输出。再说一遍,你可以看到右上角,我在飞行模式。现在完全没有网络连接。所以 如果你在三万英尺的高空飞机上,你的孩子在闹情绪,而你无法访问互联网,但你想向 ai 寻求一些支持。好吧,你有一个很好的工具可以做这件事。而且他不只是给我一个简短的答案,他给了我一个非常深入的,相当经过深思熟虑的答案。所以我的意思是看看这个,他甚至有一些不错的设计,一切看起来都很好,非常非常酷。 好了,现在它也只是像叉 g、 b t 和 android pick 都有一个语音模式。现在为了让我的录制更容易,我确实把 wifi 重新打开了,这样我就可以把屏幕直播到我的电脑。让我们来测试一下语音模式,它正在快速下载。 语音模式,它正在快速下载。这里的语音模式显然默认没有安装。让我们开始一个新聊天。我感觉很饿,但我决定不了吃什么。你能推荐一些晚餐的选择吗?由于你仍然很饿,这里有几个快速选项,烤三文鱼新鲜又饱腹,鸡肉炒菜美味又多样, 蔬菜汤温暖又滋补。墨西哥卷饼吗?混合各种你最喜欢的东西,披萨,简单又满足。你冰箱里有什么特定的食材吗? 有趣。墨西哥卷饼,我的意思是这些建议还不错。我只是有点困惑,墨西哥卷饼怎么会是我应该吃的?我想的有道理, 对吧?就像你摆出所有的食材,然后用你现有的食材。但不管怎样,我觉得这很酷,对吧?我认为这很棒。我们可以得到实际上相当不错的本地模型,就像一个可以在手机上运行的模型。不错, 做的就像一个可以完全在手机上本地运行而无需互联网的模型。这比我们一年半前从拆的 gpt 得到的要好。你知道的,一年半前它显然不是最先进的模型, 比如 gpt 五点三或 cloud opus 四点六,甚至 solnet 四点六。因为这些模型太大了,无法在设备上运行。这些需要云端或极强的 gpu 算力,但我们说的是那些可能比我们一年半两年前最先进的模型还要好的模型。这非常酷。 不管怎样,这个视频没有赞助这家儿 locally ai 公司或制作那个应用的 aj。 不知道,我正在制作这个视频。我只是觉得我们能做到这一点很酷。现在它效果相当好,而且 ai 界和整个世界都发生了很多戏剧性的疯狂事件。 我只是想制作一个关于我玩过的一个很酷的工具的视频。这就是我做的。这是一个很酷的工具。我偶然发现。我觉得这是其他人可能想要了解的东西。 他不会把你的信息发送到云端,他完全停留在你的手机上,你不需要互联网就能使用他。这些公司都不会获得你的任何数据。 他们无法在你的任何提示词上训练,因为同样所有内容都只停留在你的手机上。这很酷,很好玩。我想展示一下。 这就是我给你带来的非常棒。呃,是的。我不知道该说什么了。去看看吧,它是免费的。你只需要一部不太旧的 iphone, 在 过去四五年内生产的 iphone 你 就可以使用这个。好了,这就是我给你带来的。感谢你和我一起研究这些。希望下次再见。拜拜。

一天一个宝藏网站,今天是 stage, 是 一个浏览器自动化框架,它用自然语言和代码控制 web 浏览器, ai 理解页面代码,负责精准执行, 解决传统自动化死板,纯 ai 不 稳定。 play right 和 l l m 在 同一条流程里写作,精确控制页面也能让 ai 完成任务。如果你想做网页 a 阵 t 浏览器自动化在线流程代办这个项目值得收藏。关注我,学习更多宝藏网站。

我的身边很多朋友都知道我最近买了一个华为的 p r x max 这款手机,然后我五一的时候,然后出去玩,然后拍了很多很好看的照片。但是嗯, 以前哈,以前的话我们这都是你比如说你选择然后创作的话就只能要,不然就是拼图,拼图的话就会感觉很多就是平平无奇。但是呃,昨天刚好我的朋友分享了我一个 很牛的一个呃软件,现在我跟大家分享一下是怎么创作的。首先要找到我们的这个笔记,然后添加笔记,然后现在我把它打开,这样的话我会感觉更好的创作一点,然后新建我们的一个笔记。 好,新建以后,然后这点这个彩色的这个笔叫灵感妙妙创。然后我去选一些比如说我想要的图片,比如说这刚好就是我五一出去拍的一些图片, 比如说攻略呀、 vlog 呀这些,这个都是可以用到这个的哈,然后比如说我们点击这个放大缩小,可以你自己随意的调节, 比如说这个放好了以后,哎我们这个人物 注意些, 然后这个哎我们这个的照片,然后到时候我们把这个我这个就拼好了,然后这个人物你看是不是感觉就特别的有创意感?然后这个的话到可以,比如说添加一些,比如说文字在上面起的颜色,你也可以自己变哈, 比如说五一,五一旅游攻略, 到时候你也可以自己写个好一点的。好,然后点击这个, 这就是我的做的一个旅游攻略。是不是感觉这个然后我们创作好了以后,然后我们点击这个下载,下载了以后,然后他就会在我们的图库里面 带大家看一看我刚才出来的是不是?是不是感觉这个发了朋友圈绝对是超多的赞哈?然后这个的话,到时候有更好的功能我就会跟大家继续分享。

亚马逊买家秀,你不会还花钱请老外拍吧?这个是我用 ai 制作出来的效果,今天把这个方法分享给你。第一步,拆解提示词。 准备一段对标视频,或者自己想好要展现的内容。然后还有这段提示词丢给 ai, 让他帮你拆解出完整的提示词,场景怎么描述,光线怎么打。 第二步,生成分镜图。新建一个聊天框,把产品图和刚拆出来的提示词上传进去, ai 会生成对应的分镜图,所有镜头以此类推。第三步,排列分镜,把所有分镜图保存好,再一次性上传。 把提示词按镜头顺序排好,加上一句关键指令,保持产品和人物不变形。一张图对应一个镜头, 保证画面连贯。第四步,生成视频。把每张图的提示词复制下来,丢到视频生成工具里,选择对应的分镜图,逐条生成所有镜头,跑完之后做二次剪辑,合成 一条完整。买家秀就出来了,全套提示词和操作指令我都整理好了,有需要的老铁敲指令! oh my god guys the plush gorilla i ordered line a few days ago is finally here today honestly can't wait to open it let's do a satisfying unboxing together as soon as i pulled it out i saw this big fluffy head this is absolutely adorable。

用华为大扩折玩游戏啊,是真的可以开挂啊,你看这 ai 会教你怎么玩,比如说斗地主。那我这个时候呢,可以打开它的伴随式 ai 功能, 当前牌型怎么出啊,我的胜算会比较大,然后你可以看到它就会识别屏幕内容,帮我分析概率和常见的打法。那类似的像麻将啊,金铲铲之战之类的游戏都可以用它来参考操作思路。 所以乖乖们,以后你们玩游戏打不赢别人可不一定是技术的问题,可能他跟我一样有一个聪明的 ai 军师哦。

家人们上网真的能学到真东西啊,华为 pro x max 玩进战场已经很爽了。那再爽一点呢?打开用双屏,这屏幕的握持感刚刚好啊。那还能怎么样更爽呢?量一下 小艺,小艺,我现在该用什么版本强势的阵容呢?最稳定的上分阵容,成型快,中测率高,非常适合你现在的开局阵容组成,石头人境金克斯奥德赛。所以这个打不过,不一定是技术不行啊,可能是装备不行。

hello, 大家好,这里是派派 ai, 今天我就给大家带来一个超级火爆的免费开源项目 duixart, 一 键叫做 hejib, 它就是那个传说中黑键的完美平替。这期视频我会一步一步手把手带大家在自己的 windows 电脑上把它安装好,并且教你怎么快速上手, 做出你的第一个数字人视频。今天我将从环境准备和安装两个步骤进行操作讲解。在开始安装前,大家先打开这个簿客地址,这里有今天的课程的所有资料。 一、查看 windows 系统版本你需要是 windows 十或者 windows 十一系统,太老的系统不行哦, windows 版本号是二十二,二十二级以上才能安装。自行 vivo 命令查看 windows 系统版本。 二、检查显卡和显存,这是绝对必要的,你需要有一块英伟达 n v 调的显卡,比如四零、五零系列等等。 a 卡和集成显卡不支持,而且 最好确保你的 nvr 显卡驱动程序是最新版。打开电脑任务管理器查看,具体操作是右击任务栏, 然后选择任务管理器切换到新的标签。查看 gpu 零或者 gpu 一、 专用 gpu 内存最少八 g。 三、检查内存和硬盘,具体操作是右击任务栏,然后选择任务管理器切换到内存标签,内存最少三十二 g 硬盘 c 盘要有最少二十 g 空间, d 盘最少一百二十 g 空间,必须要有 d 盘,我们安装多克镜像导致 d 盘。 四、查看 cpu 状态是否开启虚拟化,具体操作是右击任务栏,然后选择任务管理器切换到 cpu 标签。 cpu 的 虚拟化功能要开启,如果没有开启,需要到 bios 里面开启。 具体开启方式,不同品牌的电脑开启方式不一样,具体开启可以问 ai, 问了 ai 还不会的可以在评论区留言。 五、开启 windows 功能开启 windows 的 适用于 linux 的 windows 系统和虚拟机平台两个功能,否则安装 wsl 不 成功。 具体开启方式,同时按下 win 加 r 键,然后输入 optional features, 在 打开的页面中滑到底, 把适用于 linux 的 windows 系统和虚拟机平台前面的勾加上。如果没有看到这两个功能,你管理员在 cmd 命令行 win 加 r 后输入 cmd, 在 打开的黑框中输入以下两个命令, 如果命令还不行,需要重新安装系统。开启这两个功能后重启电脑,请确保环境都检查没问题后再进行安装。如果强制安装到最后生成不了视频,浪费时间。 环境都检查没问题后,我们进入真正的安装环节。一、安装 wsl 和 dok 在 安装 wsl 安装前先检查 wsl 是 否已经安装在 cmd 命令行执行以下命令, 如果显示如下之类的内容,就是已经安装好了,如果没有安装,就使用 wsl 杠杠移动命令进行安装。网络最好能访问 github 之类的网站。 要是安装不成功,点击如下图的 wsl, 二点六点一点零 x 六十四 msi 直接进行安装,这是整理好的百度网盘资源,需要的请一键三连私信我。 安装完以后在 cmd 命令行执行一下一下命令。 安装完 wsl 后安装 docker, 从这个地址下载 docker 安装文件, docker 安装直接下一步就行。 安装完后要进行设置一下,一、设置镜像存储位置,具体操作是点击右上角的设置图标,然后选择 resources, 点击 browse 按钮,选择路径,此盘路径不要有中文等特殊字符。 二、设置 dok 镜像源设置 dok 镜像源具体操作是,点击右上角的设置图标,然后选择 dok 引擎,把这段代码复制到这个框中。设置完成后,把 dok 重启一下。 dok 安装完成后,我们来安装 dok 镜像。如果显卡是五零系列显卡,执行这个命令。 如果显卡是四零级以下显卡,执行这个命令。注意,多克 compose 页面文件所在目录只能有数字和字母,不要有中文之类的,安装键要有 t 字,如果没有会安装失败,或者要很久才能安装完成。如果四零系级以下显卡,可以执行这个 innisfit 这个 bt 脚本会把所有 dok 键向自动导入并启动服务,无需手动操作,运行之后等着导入完成即可。导入需要一段时间,请耐心等待。安装完成后,在 dok 里面能看到三个服务。 安装 higma 客户端应用,从这个地址下载最新版本即可。安装没难度,如果是跟着教程操作到这里,应该可以正常使用了。如果安装过程中有问题,评论区见。

华为的鸿蒙手机呢,搭载了系统及智能体,小翼无需下载,开机就可以使用。首先我保存了一个中文文档在 word 里,然后我们把这个文档拖拽给小翼, 帮我提炼文档重点 ai artificial intelligence, 直接就出来了一个重点内内容。然后我们再把文档拖拽给小翼, 基于原文内容生成思维导图, 人工智能 ai 定义,让机器向人特别特别智能学习。这是我保存的一个英文文档, 帮我翻译成中文,并生成一个 word 文件。 文档内容本身已经是中文,只对英文部分进行了翻译,如果你有其他翻译需求,我很乐意提供帮助。 一、人工智能的英文全称是 artificial intelligence, 让机器或计算机具备思考、学习、判断等能力,概念解析特别智能。

大家好,你们有没有过这种感觉?飞书 notion 备忘录里存了几百篇内容,但真正要用的时候,翻半天找到了,却发现帮不上忙。这不是搜索的问题,是整个知识管理的思路出了问题。 今天我们来拆解一个新的解法,它来自 ai 领域最有影响力的工程师之一安德烈卡帕西在今年四月刚刚提出的概念叫做 l m viki, 核心只有一句话,让你的知识库越用越聪明,而不是越存越臃肿。我会从底层逻辑讲到实操结构,最后分享我自己真实跑通之后的感受。先说一个我曾经有过的体验,看到一篇好文章就想先存起来,心里觉得这个以后肯定用的到。 就这样,我的资料库慢慢装进了提示词工程,各种 ai 工具、笔记、课程记录、配置经验等等等等。但真正需要用的时候,我发现这些东西并没有太多帮助,不是找不到,而是找到了也没用。 每一篇笔记都是孤立的,他不知道另一篇说了什么,也没有办法把几个来源的信息综合成一个答案。 我的资料库不是知识库,它只是一个收藏家。现在市面上最主流的 ai 知识管理方案叫 r i g, 全称叫做解锁增强生成。通俗说就是你把文件上传进去问问题,它会从文件堆里找相关的片段,拼一个回答给你。 notebook l m chat gpt 文件上传。大多数所谓的 ai 知识库产品都是这套逻辑, 这套逻辑在很多场景够用,但他有一个天花板,他只会解锁,不会积累,每次查询都是全新的一次搜索,没有任何东西被真正建立起来。你问一个需要综合五份文件的问题,他要实时的去找,实时的去拼,结果很不稳定, 用的资料越多,这个问题就越明显。 r a g。 就 像一个图书馆,书还在架上,每次你来了,要自己去找,自己去拼,图书馆里的知识永远不会自己长大。今年四月初,安德烈卡夫西在 x 上发了一条推文,随后跟进了一份详细的文档。 卡帕西是 openai 的 创始人成员,后来担任特斯拉的 ai 总监。他说他最近大量的 toc 消耗不再是用来生成代码,而是用来管理知识。他提出的思路叫 l l m v t。 核心逻辑只有一句话,不要在查询时解锁,要在摄入时翻译。 这句话看起来简单,但背后是一次真正的思路转变。 ig 是 使用时才查找, l l m v key 是 存入就理解,像编程理解释器和编程器的区别,解释器每次运行才翻译,而编程器是提前把代码翻译好,运行时直接用,速度完全不一样。 卡帕西把这个概念用到了知识管理上,你每加一份新资料, l l m 就 在摄入的那一刻读懂它,整合它,更新相关的内容。下次你问问题,答案已经准备好了,不需要重新发现, 我们来做一个直接的对比。 ig 是 图书馆模式,你问问题,管员去书架找,临时拼凑答案给你,文档之间是孤立的,每次都是全新的搜索,知识并不积累。 l l m v t 是 编程器模式,你加入新资料系统,立即读懂并整合 v t, 在 持续生长,自动建立各条内容之间的关联,提前算好答案,还会主动告诉你新旧内容之间有没有矛盾。 最根本的差别只有一条, ig 的 知识不积累。 l l m viki 的 系统越用越聪明,你不再是维护一个静态的文件堆,你是在培育一个活的知识系统。每次问进去新东西,它就长大一点,每次问一个好问题,它就更完整一些。 理解了底层逻辑之后,我们来看看这套系统具体是怎么搭建的。整个系统的载体非常简单,就是你电脑上的一个本地文件,家用一款叫 obsidian 的 笔记软件来浏览。如果你没用过 obsidian, 把它理解成一个能看到笔记之间关联关系的本地笔记本就好。 卡帕西用了一个很好的比喻来描述三者的分工。 obsidian 是 你的工作台, l l m 是 你的专属编辑, wiki 是 那个持续生长的知识产品,你负责找资料提问题, l l m 负责读懂内容,把知识整合进去,并维护页面之间的关联。 你不用自己写任何一个页面,你只管喂料和提问。没有数据库,没有云服务,文件就在你自己的硬盘上,这个门槛低到让人有些惊讶。 我们再来看这套系统的具体结构,它分为三层,第一层叫 raw 原始资料层,这里存放你收集的所有原文件,包括文章、课程笔记、研究报告等等。这一层只增不改是你的事实来源。 l l m 只是读取,不会编辑和删除里面的内容。 第二层叫 wiki, 是 知识层,这里是 llm 生成和维护的 markdown 文件概念解释工具,对比综合分析。每次有新资料进来, llm 会更新相关页面,补充不同页面之间的引用关系,还会检查有没有和已有内容矛盾的地方。 第三层是 schemer, 也就是配置文件,在 cloud code 里叫 cloud 点 md, 这是整套系统的大脑,告诉 llm 这个 wiki 的 结构规范和操作流程。有了它, llm 才能成为一个有纪律的知识维护者,而不是每次都从零开始的聊天机器人。 这三层的关系是, raw, 是 原材料。 llm 读取之后编辑进 wiki, schemer 规定了编辑的规则。 理解了结构之后,我们来看这套系统日常怎么运转。有三个核心的操作,形成了一个闭环,第一个叫摄入,把新资料放进原始资料层,告诉 l l m 处理它。 l l m 读取内容,提炼要点,生成摘药液、更新锁影,更新相关的概念页和记录日记。 一份资料可能同时触及十几个 viki 页面,这一步是整套系统核心价值所在。第二步叫查询,你问问题, l l m 搜索相关页面,给出带引用的回答。更重要的是,一个好的回答可以直接存回 viki, 成为新页面。你每次提问本身就是在给知识库加料。 第三个叫做巡检,定期让 l l m 扫一遍整个 wiki, 有 没有互相矛盾的页面,有没有被提到过但还没有独立页面的概念,有没有孤立的没有任何链接指向的页面。三个操作循环运转,知识库就持续健康的生长。 说了这么多理论,来分享一个真实的案例,我将斯坦福现代软件开发课程的六节课笔记放入原始资料层,六个文档散落了几周,互相之间没有任何联系。 用 cloud code 摄入之后,系统自动生成了六个互相链接的 wiki 页面。 l l m 基础原理, prompt engineering codeign 架构, mcp 协议每个页面都有摘药,有来源引用,有和其他页面的关联。在 opcd 里打开图谱,试图你能看到这些页面之间的链接网络正在成型。 以前是存进去就忘,现在是每加一份资料,整个系统就更完整一点。知识第一次开始有了重量。 跑通这套系统之后,我意识到还有一类东西比外部知识更重要,更难管理,就是我自己的判断框架。 卡帕西的原始设计是领域无关的,你可以用它管理研究资料、读书笔记、竞品分析。但有一类信息比知识本身更关键,我的目标优先级是什么?选品时我怎么决策?遇到新信息我该不该跟进? 这些东西平时散落在对话记录和日记里,从来没有被系统化过。所以我给 vicky 加了一个 self 域,专门存这类东西。外部知识包括书、工具、事实等等,存进 vicky 内部判断包括我的优先级、决策规则、思维框架等等。存进 self 域。 这个区分让整套系统从知识管理工具升级成了一个真正的个人操作系统。还有很重要的一点是,这套系统不绑定任何一个工具。 卡帕西的原文本身就是一份想法文件,它明确说可以用 cloud code codex、 open code 或者任何能读写文件的 llm agent 来跑。 cloud code 读 cloud, 点 md codex 和 open code 读 agents, 点 md gemini, 读 gemini, 点 md, 名字不一样,逻辑完全相同。核心壁垒不是你用哪个工具,是你的 skimmer 文件写得够不够清晰。 这意味着你今天用 cloud code 搭好这套系统,明天有更好的工具出来。只需要换一个入口,所有积累的 viki 内容都还在,一行都不会丢失。你真正的资产是 viki 本身,并不是某个 ai 产品。 一九四五年,美国科学家范内瓦布什写了一篇论文,设想了一台叫做 mymax 的 机器。 他在二战期间主导了美国整个科学研究体系的战事动员,深知知识分散无法积累的代价。他想象中的 mymax 是 私人的、主动管理的,文档之间的连接和文档本身一样有价值。 他当时没有解决的问题是,谁来做那些枯燥的维护和连接工作?八十年后, l l m。 给出了答案, 不要让知识在等待中沦为死水,让它在变异中持续生长。卡帕西的这套系统,本质上是把一九四五年的构想真正落地了,而你现在只需要一个本地的 markdown 文件夹就可以开始。

今天收到英伟达寄来的桌面级 ai 超级计算机 d g x spark, 老黄也给马斯克送了一台同款,用一句话形容它是一台极其便携、自带英伟达显卡的乌邦图迷你主机,国内售价三万五千元,来看看发布会上老黄是怎么说的。 we call it d g x spark20 cpu cores and now the gpu has 128 gigabytes one petaflots who is a software engineer or ai researcher? or you know just data scientist and you would like to give them you know what the perfect christmas present。 我 实测下来, d g x park 有 四个核心优势,首先是很轻很便携,塞到书包里就能直接带走到各种展会,线下布展都非常方便。 第二是算力强,号称有一千 top 的 f p 四算力和五零七零显卡差不多。第三是显存大, cpu 和 gpu 共享一百二十八 g 内存,可以在本地端测训练和推理大模型。 第四是预装了扩大和 nvcc 环境,直接省去了几个小时的安装配置时间,而且丝滑兼容英美达生态的各种物理、 ai 和机器人仿真工具。 这四个优势让 d g x bug 非常适合大模型和机器人玩家。这期视频就来盘点一下我发掘出的五个邪修玩法。 第一个玩法,部署优乐二十六目标检测模型,不管是视频还是摄像头,实时画面推流速度都很快,特别适合工业质检的终端设备。关于优乐二十六后续会出一系列的训练和推理教程。 第二个玩法,本地部署开源大模型 d g x bug 上可以丝滑运行欧拉玛 v l l m 这些本地大模型推理工具, 我用摩达社区开源的模型压力测试工具 evo scope 测试了一下,千问三零点六 b 首投肯时间只要五十毫秒,每秒钟输出一百一十五个投肯延迟和吞吐的分布也非常集中,没有明显的肠胃抖动。本地部署开源大模型有八大好处, 最大的好处就是无限免费调用,没有 token 焦虑,哪怕是 open cloud 这种 token 核弹也能随便用。另一个好处是局域网里的所有用户都可以共用。 我在 d g x bug 上本地部署了面壁智能开源的全模态大模型, mini c p m o 四点五 omni, 连上我家 wifi 的 所有用户都可以通过 ip 地址访问 d g x bug 的 推理接口,摄像头,电脑屏幕、手机 ai、 眼镜、 esp 三二,任何带摄像头的设备都能调用这个模型。 这个模型是一个参数量九 b 的 全双工实时模型。 ai 持续在听看书,你现在听到了什么声音?我又听到敲门声了。如果宝宝哭闹了或者出现意外情况,就请告诉我。好吧, 好的, 你看宝宝开始哭闹了呢。 好家伙,开局就到 c 一 点,这也太顶了,快跑啊,有个狙击手,这个狙击手还在 看,我来攻略了他。是的,狙击手还在, 他好像已经死了。小心你被急火了。 哎呀,你这局打太烂了,敌方坦克在这。漂亮,我镭射锁定了,很安全,给他来个雷。好,先清人漂亮,收掉一个 又一个,再来一方。哎呦,这把太牛了,完全没给对方任何机会,真是太强了, nice。 推理如果放在云端,通信延迟和 token 消耗就很大了。放在端侧,本地部署推理是最佳的方案,因为达还专门给 d g x spark 做了一个仪表盘,方便随时查看显存和 gpu 占用情况。 另一个本地推理的刚需场景是机器人 d g x spark, 既可以直接作为机器人的上位机,比如 hackincase 发布的桌面陪伴机器人 richie mini, 也可以作为具身智能的端侧大脑,借助 hackintosh 开源的机器人工具包 la robot 以及 groot 这样的 vla 视觉语言动作大模型, 配合英美达 jackson soren 或者 d g x spark 作为具身大脑,就能让机器人自主完成叠衣服、收纳桌面、夹取物品、双臂协助这类长系列模仿学习任务。 去年我在深圳柴火窗口空间看到不少了 robo 的 机器人项目,我自己也写了一整套了 robo 的 保姆级教程,手把手带你丝滑跑、通摇操作、采集数据训练、本地推理模仿学习的全流程。我最近做了一个具身智能握手交互装置,探龟之握, 人类一握手,他也热情伸手,人类缩手,有的时候也会竭力挽留,想和人类贴贴,仿佛具有灵魂和情绪。 用到的 v l a 模型是字面量开圆的握 o s s, 参数量三点九 b。 还有 physical intelligence 开圆的派零,参数量三点三 b。 在 以前,我只能托一台笨重的四零九零主机,机 器人插到主机 usb 口,每次扳机枪胳膊都要疼好几天。现在直接把 d g x park 塞到书包里带走,随便找个插线板就能开机玩起来。 总结一下,英伟达的 d g x park 是 一台极其便携、自带英伟达显卡的乌邦图迷你主机,重量轻、算力强、显存大,是本地部署大语言模型、多模态模型、 open cloud 聚深智能 v l a 模型的绝佳选 择。程序员、机器人、工程师、艺术家、音乐家都可以拥有自己的端侧最强大脑。

今天我带上华为 pr 叉 max 这台手机来打卡安岳新开的一家非常有氛围感的餐厅。一般我们出去拍照的话,都会想要摆什么姿势才好看,一般都是剪刀手或者笔芯,但是用华为 pr 叉 max 拍照的话,可以用 ai 姿势推荐拍照,再也不用担心不会摆姿势了,一秒就学会 点开相机找到 ai 姿势推荐,选择喜欢的姿势。拍照过程中我们也可以从外屏看到自己喜欢的姿势摆没摆好,喜不喜欢,选择好姿势之后就可以拍出美美的照片。外屏观看咱们摆拍的一个姿势,还可以点击叉妹几自拍。叉妹几自拍是自动构图,根据所在场景选择合适的滤镜进行拍摄, 拍摄期间同时也有 ai 姿势推荐进行辅助拍摄,在叉妹极致拍滤镜加持下,拍摄出来的照片更有氛围感,更好看。同时点击 ai 辅助构图, a i 时式分析画面,引导出最佳构图方向,自动识别场景,自动切换焦段,选择最佳角度进行拍摄。 ai 智能适配场景构图,拍摄出来的效果更加高级,更加自然,随手一拍就是有专业氛围感的大片。有了 p 二叉 max 的 在手,再也不用怕出废片了。 拍好的照片我们可以进行创作,使用咱们的灵感妙创进行奇妙创想其实很简单,我们使用 p 二叉 max 找到笔记点进去 或者新建,点击笔记,点击右上角彩色笔,找到灵感妙创,我们就可以添加我们想要创作的图片,添加上去,然后输入指令,输入指令之后等待 ai 进行深沉 等待之后就可以出片啦!用华为 pr 乘 max 灵感妙创,不用修图,不用排版,普通照片秒变氛围感大片,直接就能发朋友圈!这就是华为 pr 叉 max 的 ai 创作实力,你学会了吗?