open ai 真的要让程序员下岗了?这是一个普通人根据 gpt 四 v 的接口自己开发的 ai 神器, 你只需要把产品功能的设计草图微给他,他就能利用 gptcv 强大的视觉识别能力完成整个 ui 界面的设计。整个过程不需要你写一行代码,他甚至把写好的代码贴心的附在了右侧。 这真的能让那些初级的 ui 产品经理和程序员原地过年? open ai 真的太变态了,所有技术层面的问题都不再是难题,每个人都能开发 gpt, 每个人都能完成产品设计。
粉丝13.5万获赞118.7万

嘿,你好,欢迎回到 x t t。 思维多模态是目前普通人所能拥有的唯一的最强大的利器,他扫平了你和别人家的孩子之间的技能障碍。别人家的孩子会写代码,我不会,没有关系,我会 g p t, 他会艺术设计,我也不会,也没关系,我会 gpt。 咖啡机的故障灯亮了怎么办?网线该插到哪一个网口上呢? 需要拍摄一个产品海报,但是我既没有导演,也没有美工,怎么办?老板给了你一张表格图片,让你添到 excel 里面去,难道你要一个一个的手工输入吗? 怎么样通过一张房间的图片帮助我发现我没有注意到的细节呢?比如从某人的房间照片猜测他是一个什么样的人, 人呢?还有我要学一些课外知识,生物、地理、物理等等,没有家教,谁来给我答疑解惑呢?人人都想解决问题,但不是每个人都知道。怎么样有效的去做本期视频啊,一定能够帮到你! 我通读了一百六十六页的 gpt 思维的论文,大型多模态模型的黎明,精选了一些典型的案例啊,给你展示 gp 思维怎么样去帮助我们解决最实际的问题, 而不是仅仅停留在炫技的层面。当然,为了展示 gpsv 的全部的潜力呢,我也会选择一些看起来很酷的案例,比如自动导航、操作电脑等等。你将会看到 gpsv, 它已经是一个完整的智能大脑了, 他所缺的呢,仅仅只是一个身体而已。首先,我们需要明确我们使用 gps 思维的目的是什么?是帮助你来解决问题呢?还是为了测试 gps 思维的能力边界这两种方式啊,是不一样的, 我看过很多的应用案例,那有些呢,看起来很炫酷,也很有价值,但是呢,他并不能给你解决你的实际问题,因此这些案例啊,就会被我归类为测试类的案例,比如让 gps 思维识别并且解释 x 光片, 这展示了 gpsv 强大的潜力。但是呢,真正的生活当中,你还是应该去找专业的医务人员来解释。那么要想让 gpsv 成为你手中的王牌,让你解决问题比别人快,完成任务比别人好,最重要的就是 你需要知道 ai 的边界在哪里,他能做到什么,他不能做到什么,把 ai 能够做到的事情做到极致,避免在 ai 不能做到的事情上面浪费时间。 来吧,咱们开始,我是 x 特,带你用实战解锁 ai 与自动化的商业价值,订阅我的频道,并且打开小铃铛,让 ai 成为你手中真实的力量。好,首先呢,假设我的咖啡机突然亮起了一个我不知道什么意思的一个灯, 那我就可以把它拍下照片,然后去问 chat gpt。 那其实啊,不仅仅是你的咖啡机啊,你的所有的家用电器,包括你的设备,甚至是你的汽车仪表盘上突然亮起了一个你从来没见过的一个灯, 你都可以把它拍下照片,然后去问叉 gpt, 这到底是怎么回事?好,那我就把我的咖啡机照片 拍下来,然后给他做了一个箭头标记,指向这个灯的位置。之后呢,在 chat gp 里面点击这个小图标小按钮,就可以把照片上传给 gpt。 上传给他之后呢,我就问他,我的咖啡机上突然亮起了一个灯,红色箭头所指的灯, 这是什么意思呢?请帮我分析一下。那 chargept 呢?他就会告诉你了,你的咖啡机上显示的肯定密的等等,意味着机器需要进行清洁,这是什么原因?然后呢,他会告诉你几个通用的清洁咖啡机的办法, 清洁滤网啊,使用专业清洁剂啊,清洁喷嘴和水箱,清洁外部还要定期换水,这其实是一些很通用的步骤,他并不适合于我的这个咖啡机。好,假设我动手能力比较弱,我就会继续问他,那我已经用清水和细节 已经彻底擦洗了咖啡机,但是灯还是亮着,而且我也找不到说明书了,怎么办?那这时候叉 gp 呢,就会给你一些更有针对性的建议了,比如执行清洁周期怎么样去重置肯定密的灯,断电重启, 然后我找客服等等。好,这还是没有给我我想要的答案,我就再追问一句,那你根据我的咖啡机的品牌,帮我判断一下上面说的哪一种情况最有可能 好,他就会看到我的咖啡机的品牌了,然后这种品牌他认为最有可能的就是要执行特定的清洁周期,这是正确的,没有错误。 那然后我会继续问他,我要怎么样来启动这个清洁程序呢?他就会根据他已有的知识呢来告诉你,可能是要按单杯或者双杯按钮,这整个的解决问题的过程呢,没有大 大的错误。实际这个咖啡机要清洗呢,实际上是按住电源的同时,然后按这两个按钮,所以恰机屁,他的回答没有大的出入。对于很多平时不怎么爱动手的小伙伴来说呢,这是一个非常有用的功能了。比如假设我是一个电脑小白,我们再看一个例子, 比如这是我的路由器的背面图,那我需要用一割入网线来连接一台电脑,黄色的插口和银色的这个插口都能插网线,那我应该把网线插在哪边呢? 那叉 g p 呢,就会根据这个路由器的图像来进行判断了,他就会告诉你,黄色的插口是局域网的烂插口,他是用来连接家中的设备的,比如计算机啊,电视啊,游戏机。而银色的插口呢,因为叉的 g p t 没有识别出,这下面的英文字识别 错了,所以他只能进行猜测或者说推理。可能是一个以太网插口,但是具体的功能呢,可能是跟 internet 或者 y 的接口有关。如果你的目的就是连接一台电脑来访问你的家庭网络呢?你应该把电脑的网线插到黄色接口里头 啊,即便叉 t t 他没有识别出这个接口的到底是什么,这个文字没有识别出来,他给你的结论也没有太大的错误。当然我可以告诉他一下,银色插口下面写的是 e t h 十 g, 那 chat g b t 就很明白了,实际就表示这是一个万兆的仪态网, 他能提供更高的数据传输速度。但是呢,在一般的家庭当中啊,我们用不到万兆的速度。所以呢,你如果你只是为了接一台电脑,你还是只需要插到黄色的网口就可以了。 好,这是 chat gp 来教我们怎么样去把家里的设备进行联网。那还有,如果你在操作某一个软件界面的时候,突然出现了一个图标,你不认识,同样 chat gp 也可以帮到你, 我们可以来试一下。 ok, 假设这就是病浏览器,假设我不知道这个图标是干嘛的,那很简单,我们就可以截个图, 然后呢,为了准确一些,我们直接画个箭头指向这个图标。之后呢,我们打开 chat gp gp 四的一个对话窗口,它的图片目前功能全部在 default 里面。好,我们直接把这图片拖过来就可以。 我们就问他红色箭头所指的这个按钮是做什么用的呢? chat t p t 就会告诉你,这个红色箭头所 指的按钮就是一个麦克风图标。好,以上就是一些很简单的应用场景啊,但是他在我们生活当中应该会经常的遇到一些设备的问题,电脑的问题不知道怎么处理,只要我们把它拍下照片告诉 chat gpt, 就可以让 chat gt 来帮你忙。 那接下来呢,我们换一种场景来看一下,假设我有一个产品,我需要在圣诞节呢,拍摄一个我的产品的海报,宣传海报,但是没有导演帮忙,我也没有美工,怎么办呢? 同样我们可以让叉 gt 呢来帮我们设计海报。好,先假设我们有一个产品好,因为我没有实体产品嘛,我们就先让叉 gt 呢帮我造一个产品出来,好帮我生成一个化妆品的产品图片要绿幕,背景要求如下,因为背景是绿 闭幕,因此产品的颜色呢,你要能突出不能是绿色,产品上面有文字标识,我 u l 也就相当于是我的品牌 x 六点 ai, 然后呢,你要注意仔细检查拼写 x 六点 ai 不要出错,这是用刀力三在绘图啊,因为刀力三绘图呢单词他可能会拼错,所以你需要特别的去嘱咐他好下集体呢,就给我根据我的要求画了两个化妆品出来,一个口红,哎,一个化妆品, 咱们暂且就说他是化妆品吧。然后我说对第二幅图非常好,但是瓶子呢,像个药瓶,不像化妆品,你要给我修改的更加现代,简约高贵。 ok 生成的这个化妆品,那这已经很不错了,至少比刚才的药皮好多了。虽然他没有按照我的要求把 我的网址写在这,但是拼写我的名字并没有错误,那我们就先用它假设这就是我的一个产品了,接下来我就要让恰集体去指导我设计这个产品的一个圣诞海报。大家注意啊,这些是倒立三的一些操作技巧, 那为了保证我最后的图片跟这个不会相差太远,我就会找他要一个这张图片的种子,他会告诉我种子的值就是这个。 那这样呢,就是下次我用这个同样的种子值呢,我还可以画出类似的图片,但是在实际的应用过程当中,你要给你的产品去做海报呢,你肯定是用你的产品的照片,假设这就是我的产品了,我们现在就要让恰 gp 去帮我来设计海报了。好,首先呢,我会把我的 产品的照片呢上传给 chat gpt, 然后让他请你帮我设计一个圣诞节促销的海报。你需要仔细描述你所设计的海报图片当中的产品背景以及周边的设计元素的每一个细节。 好,接下来呢, charge p 就会根据他的理解和我的要求来给我给出一个海报的设计风格了。设计要求了, 这就是他的海报设计描述。那在实际使用当中,如果你对他的整个设计满意的话,你就可以根据他的设计来进行出图了。 出了图之后,你还可以再把这个图上传给掐鸡屁,让他去来给你评价这个图的效果怎么样。那为了简单起见呢,我就直接用他的设计呢,拿去再让倒立三去绘图,看看最后出来的效果。好,回到我刚才化妆品的这个界面, 倒立三者,这就是最终根据 chat t p t。 的海报设计的描述来生成的图片。生成的方法,首先让他根据以下的这个描述,这个描述呢就是我们刚才看到的让 chat t p t 帮你做的设计风格, 然后让他重新生成种子一样的一个背景图片,这个描述呢来自于产品的描述,点击图片之后,在这就是你的这个图片的详细描述,你 copy 过来就可以直接用了。好,这就是恰奇 t 根据我的产品和我的一个简单的要求生成的一个设计的海报, 大家觉得怎么样呢?如果你在真正的使用过程中啊,拿你的真实的产品的图片,然后再跟他进行多次的沟通和交流,我相信效果一定会比这个好的很多。好,那接下来呢,如果 我想学习点课外知识,但是呢又没有家教怎么办呢?我只能自学了。那这时候呢,恰 gpt 就可以来帮助我当我的老师了,比如说我们先学生物, 那这边呢,就是我从网上找的一个人类细胞的图片,同样把图片上传给 check gpd, 然后问他,你是一个专业的生物老师,我是一个充满好奇心的六岁的小学生, 看到这张图片非常好奇,请你仔细的给我讲一讲关于这张图片的一切,那 charge d 就会以 给你小学生讲话的口吻呢,来告诉你这张图片讲了什么,细胞膜就像细胞的围墙,保护细胞内的所有东西等等。当然不仅仅是生物了,你几乎所有的课程上的问题呢,其实都可以拿给他的 t 来看看他能不能帮到你。比如我们看一下在论文当中举的几个例子,地理这些海洋当中,本初子午线穿过哪一个呢? gp 思维就会告诉你,本初子午线跟大西洋,南大洋,北冰洋相交。下面一个呢?物理题, 比较每一个样本当中粒子的平均动能,这是两个气体样本啊,在两个封闭的瓶子当中, 那每个有颜色的球是一个例子,两个样本具有相同数量的例子。然后问你哪个温度更高, a 温度高还是 b 温度高? 下面给出了粒子的质量以及他的平均速度,那很明显,这边速度是六百米每秒,这边是五百四十米吗?肯定是速度高的,这边温度高。那 gpt 的回答呢,也是 正确的,样本 a 的平均粒子速度高于样本 b, 所以样本 a 中的粒子呢,就具有更高的平均动能,因此样本 a 的温度比样本 b 高。所以呢,根据图片来学习一些知识,同样也是 gpsv 能够帮到你的一些地方, 对于类似的这些题,你同样可以要求他,我是一个五岁的孩子,你用五岁的孩子能懂的语言来说,他就会说的尽量的浅显一些。 如果你是喜欢小动物的人呢,你也可以让 charge t 来告诉你动物的种类啊,品种啊等等。比如呢,我让他来描述一下你看到的图片是什么呢? 描述的完全没有问题,图片展示了一只白色的猫,对,猫的颜色有问题,他看到的是大部分是白色的呢,但实际上这边是黄色橘色。 躺在一个计算机桌上,然后计算机是 apple 的,猫眼睛紧闭,在小气,然后下面是个机械键盘,判断的非常正确,这是一个机械键盘,然后键盘左上角的红色上面写着 escape 键, 这也能看到了。整体来说,整个场景给人一种宁静温馨的感觉,仿佛是一个人和他的宠物在办公或学习的间隙享受片刻的轻松时光。 他不但把图片上面有什么东西给你做了解释,还把这个场景的感情给你做了描述。 那我接着问他,这只猫是什么品种的呢?但这个问题有点太难了,眼睛都没张开,就这么一个样子,我估计很难判断。实际上切尔 gp 他也判断不出来,给出了很多他认为可能的品种,波斯猫啊,土耳其 三克拉等等。好,然后我们给他一个更加清楚一点的图片,那这时候你能看清楚这是什么品种了吗?切尔基地,从这张图片那样,他就基本上判断出了这个猫的品种了, 实际上是美国短毛猫,他并不是英国短毛猫。好,这就是 gpsv 可以帮助喜欢小动物甚至是喜欢植物的人的地方了。你碰到不认识的植物,你也可以去拍张照片, 然后去问 chargbt, 看看他知不知道这个植物的品种是什么。或者你要是一个喜欢养花的人,你可以拍一个花的照片,然后问问 gpt, 对于养好这种花,他有什么建议。 那接下来呢,我们来看一个论文当中的推理。怎么样从图片当中来做推理的一个例子。好,就这张图片,假设你是一名 侦探,你能从图像当中的视觉线索推断出什么来呢?当然你也可以暂停一下,然后呢,你来推断一下你看到了什么,你有什么想法?最后你再跟 gpt 四呢去对照一下, gp 四最后给出的答案呢,就是这个房间属于一个可能是年轻成年人或青少年的人。 为什么呢?这可以从休闲服装和带有电脑的书桌上看出来。这个人很可能是学生或在家工作的人。这是可以从桌子和电脑上看出来的。 他很注重时尚,因为他有多件夹克和鞋子。房间可能位于寒冷的气候地区,这可以从外套和靴子当中看出来。他的靴子在哪里?我都没看到他有靴子。这个人可能不太整洁,这可以从杂乱的桌子和挂在门上的衣服看 出来。房间可能位于一座较老或者更具乡村风格的建筑当中,这可以从暴露的管道和看起来磨损的墙壁当中看出来。那这张图片实际上展示的呢?就是 tp 多模态,他的一个常识的一个推理能力, 这可不仅仅是个好玩啊,对于计算机,对于 ai 来说,常识是一个非常重要的事情,甚至可能就是人跟电脑的一个重大的一个关键的区别要素。好,我们接下来看一下对于表格的处理。 假设呢,你的老板给了你一个表格图片,让你把它整理一下,填到 excel 里去,那这时候你肯定不会去手工输入啊,我们还是一样来找 gpt 帮忙,请把图片当中的表格转换成 markdown 表格的形式,这是一个图片, 这样呢,实际上有了 gpsv 呢,我们很多 ocr 的工具也可以不要用了。好,那他就会把这个图片呢给你转换成了一个 markdown, 当然他是用原码的形式来给出的,你就可以直接把它拷贝拷贝到你的编辑器里面去进行编辑了。 当然这边他的商品名称很多都是识别错误的,这个我们不用去纠结他,那为了看的更清楚一些呢,我就告诉他,你不要用代码块,直接把 mark 档的表格输出来就 ok。 好,他就给你输出了识别之后的表格, 虽然他的中文识别有问题,但是他表格的数字识别是完全正确的。那除了处理这些日常的办公任务呢?同样,给你给他一个图形,也可以让 cat t t 帮你去生成代码。比如在论文当中的例子, 给他一个折线图的图片,然后让他生成能够画出相似曲线的拍上代码。 gp 四呢,他就会给出一个代码,虽然画出来的曲线不太一样,但是这个代码你只需要稍微修改一下就可以用了。 当然 gp 四微他帮助你写代码呢,也只是呢给你提供了一点方便,可以帮助你来解决一些问题,帮助你去写一些常规的一些代码,来减轻一点你的工作量。他并不能完全的去替代一个程序员, 包括很多演示的例子,画一张草图,他就能生成代码,画一个界面的样子,他就能生成界面。这种情况演示的意义呢,更是大于他的实际的意义。至少现在你没有办法去完全依靠 tagp 帮你来写出一个真正的可以产品画的 软件,所以软件工程师还是很安全的,而且你们手上有了 chat gp 这种利器,来帮助你快速的写代码,快速的完善代码,解决 bug, 你就更厉害了,更安全了。好,然后呢,我们来看一个论文当中很酷的一个演示啊,导航, 这是模拟的一个机器人的导航过程啊,首先提示是告诉他你是一个家用机器人,被要求去厨房的冰箱拿东西,那这个图片呢,是一个照片,就上传给他的一个照片,显示的是你当前的位置, 然后让你去计划你的下一步的行动。这就相当于我们模拟了一个机器人他看到的一个场景,那 gpsv 就会表示啊,他的下一步行动将是向右转,并且向走廊前进。向右转,向 走廊前进,因为我可以看到厨房很可能就在那个方向上,然后我会继续穿过走廊,直到到达厨房,并且找到冰箱。那第二步呢,我们先保证这是上一步的结果,继续放在这, 这是上一个回合的动作了,这就是 g p, 他在上一回合说的,他要向右转,并且向走廊前进。好,现在呢,我们就继续 告诉他,你在走廊上,这是你在走廊上能够看到的一个场景。那你接下来要做什么呢?他的 gpd, gpd 思维就会说,从当前的位置呢,我可以看到右边的厨房。 我的下一个动作将是向右转,并且向厨房前进。这很厉害啊。同样继续,把这个场景的图片和 gps v 给出的结果都告诉他,保留在这,保持着整个绘画。然后呢,告诉他,现在你在厨房了,这是你从那里能看到的?你可以看到冰箱吗?你接下来要做什么? gpsv 就会说,从这个位置我可以看到厨房右侧的冰箱。我的下一个动作将是向前移动,并稍微向右转,以接近冰箱。 同样继续,那现在是你可以看到的,你的下一步行动是什么呢?这是一个冰箱照片。 gp 思维就会说,我的下一步行动将是向前移动,并且稍微向左跟冰箱门对齐。 然后我将使用我的机械臂打开冰箱门并取出所需物品。这就是一个完整的一个机器人导航的一个过程啊。所以我就说,哎, gpc 啊,他已经 既有了一个智能的大脑了,他现在就是缺一个身体而已。就看 opni 是先出机器人了,还是马斯克先出机器人了。这个导航的功能啊,其实也是 gpc 诸多能力当中的一个而已。 整个一百六十六页的论文当中,方方面面的展示了 g p 思维的能力和潜力,我其实很建议大家去看一下,通过这个论文,你就会了解到 g p 思维,他目前他的能力边界在哪里, 将来还有哪些可期待的地方?当然你要懒得看也没有关系,我呢会把我阅读整个论文的结果呢整理成一个脑图,大家可以先订阅我的 newsletter, 过几天整理好之后呢,我会通过 newsletter 呢来分享给大家。好,那看到这里,大家再回顾一下 论文的标题,大型多模态模型的黎明,大家有什么感触呢?欢迎大家留言。好,今天的分享就到这里,我是艾斯特,咱们下期再见。

太疯狂了!现在的 ar 技术 to 这个软件啊! oppo ar 的总裁布洛克曼亲自转发,他结合了 oppo ar 的 apr 后啊,你只需要画个草图,配上注解,然后啊,一键就可以生成应用程序。天啊,这简直是产品经理的福音,以后不用看程序员的脸色了。我们来看看几个疯狂的案例吧。利用流程图和草图界面生成了一个功能完整的计时器,甚至还可以做一个贪吃蛇的游戏。 他还支持了方向盘的控制。这个就太离谱了,做了一个完整的正常运转的核反应堆。他现在给房子在供电。当然了,还可以生成网站啊,或者 app 等软件。好了,目前这个工具啊,完全免费。网站放在评论区,感兴趣的同学快去试转魔法吧!关注我,一起实时探索 ar 的市场脉动。

太炸裂了!只需几秒钟,草图就可以立即变成网页。而且只需要把 check g p t 的 a p i 添加到在线画板工具拖轴中,然后在画板上画出草图,把你想要的的效果告诉他,他就能自动生成网页。如果你不满意,还可以继续做修改,直到你满意为止。 而这个过程完全不需要写任何代码。所见机所得。看来以后做些网页效果演示,完全不需要找工程师做开发了。我们看看用 gpt 四 v 加之后的 throw 都做出什么好玩的网站吧。 没有选中国人, 关注我,每天了解新技术!

刚刚 opennight 给所有的 plus 用户都推送了一个长着眼睛可以独图的 ai 大模型 gbt 四 vision, 可能很多人呢还没有体验过,我先替大家呢深入的研究了两周时间,这条视频呢,就通过十五个案例详细给大家捋一捋, t 四 v 呢,到底有哪些惊人的能力,会颠覆哪些行业?越看的后面越离谱啊!大家好,我是创业司机,一个 ai 创业者,专注于分享如何用 ai 提升百倍生产力。首先第一个被颠覆的行业绝对是教育行业, 比如可以上传一张课本里人类细胞的教学图片, ai 可以非常详细的给你讲解每个部分里面都有什么,在细胞里面都起到什么样的作用。或者可以输入一张更有挑战性的更复杂的系统架构图, 让 ai 呢根据这个架构图,一步一步指导你去实现这样的一个系统。我觉得这就是未来的教育模式,无论是小朋友还是大学生,都 可以指着任何不会的问题, ai 都能够一步一步的详细耐心的给出讲解。当然,有了这个技术,现在学生肯定是比老师更加兴奋,原因你懂的哈,这笔题思维还有很强的文字处理能力, 这一点我觉得他已经远远超过了我们普通人类。比如这是一个复杂的停车的标牌,写满了各种各样条件下,什么时候可以停车,什么时候不能停车的各种规则。 任何人在这个标志面前估计都要迷茫一阵子吧。但当我把它输入给 a a, 我问他,我现在在这里能不能停车,他会瞬间的回答你,综合考虑各种规则,现在是可以停车的。 如果这个还太简单的话,来来来,上一个地域模式。医生处方, ai 竟然是可以阅读医生处方的,你觉这离不离谱?并且解读结果被医生认为是非常准确的?对,聪明的你是不是已经想到了, ai 是不是可以去搞定那些又头晕又烦人的验证码? 没错,现在我们人类已经没有办法用验证码的方式把非人类挡在系统外面了。更加令我惊讶的是, j b t 四 v 竟然对序列图片有理解能力。什么意思呢?就是 j b t 四 v 支持输入一系列的图片, 假如这一系列图片是按照时间顺序排序的,那么 g b t 四 v 就有了对视频理解能力。这也太夸张了吧。比如我输入这四张图片,我问这个人在干什么? 回答说,这个人在做俯卧撑,我又输了这个答论顺序的五张图片。我问 a, 如果是按照一个做寿司的正确的顺序,他的排序应该是怎么样的? ai 可以非常精准的把图片重新排序,甚至 ai 还有根据图片内容去预测下一步的能力。 比如说,我输入这连续的三张图片,我问他下一步会发生什么? ai 回答,穿白色球衣的球员可能会射门,而穿黑色球衣的什么原会阻止这场射门?我甚至怀疑啊,绝对 不出一两年,球场上就会出现 ai 裁判了。假如我们逆向思维来利用这个功能,当我说这四张毫无相关图片,我想让 ai 按照顺序给我讲一个故事, ai 竟然给我生成了一个未来世界里 恐龙被基因复活的科幻小说除了读图,这部阶思维还表现出了非常强的图像推理能力。当我给他前三个图形的时候,我问他第四个图形应该是什么?当我给他前八个箭头方向的时候,我问他第九个箭头方向应该是什么?所以 ai 不仅仅会认识图片, 而且还会在图片中去联想类比、找规律。所以各大公司如果你还在用这些题目去筛选你的员工的话, 你为什么不直接雇佣一个 ai 员工呢? j b t。 思维在职场里面可以用到的场景啊,太多了,本身 j b t。 编程就是它的强项,现在甚至你可以输入任何界面,甚至是一个手绘的草图,它都可以生成对应的前端后端代码。比如把这个 萨斯网站截图输入给 j b t, 它生成的代码是可以直接运行的。兄弟们。再比如输入这张 s 光片,它可以直接指出这个片子里面到底哪里有问题,并给出具体的诊疗意见。 j b t。 思维不仅是一个超强的理科生,而且情商也特别高,但是从这些表情里面去理解人类的情绪,这已经是基本的操作, 他甚至还懂得如何去利用视觉语言去调动人的情绪。比如我说说,同样一张图片,我让他用让人感到恐惧 或者让人感到放松的方式分别去描述这张图片,他会根据相同的场景去生成完全不同的描述。大家想一想,在我们的生活里面,是有多少场景是需要用到眼睛,是涉及到图片的,就能够理解这项技术。他到底有多么的惊人,会给我们的生活带来多少颠覆? 几乎所有的行业都会被颠覆,都会被重新定义。我的团队会结合这项新技术去开发更多好玩的,提高百倍效率的事情。关注创业司机,接下来我们会分享这个大模型到底还有哪些问题,还有哪些局限性,以及会带来哪些新的创业机会。

这是 gpd 的四 v 版本,然后呢,我们可以看到它的更新日期是二零二三年的九月二十五日,但是这里有一个很重要的信息,它其实是已经在二零二二年就已经完成了的,但是到至今才刚刚发布 好,我们看一下官网啊,这个我们可以看到他其实已经是更新了他的一个看的能力,听的能力,还有一个说的能力。那我们具体看一下他这边一个演示的视频, 我们看到坐着先是拍了一张自行车的照片,然后让 g p t 四来教他如何把这个座位调低一点。 g p t 四呢,也 按照步骤给他做出了一个回答,嗯,第一步呢,你先找到座位的快拆杆,或者说是一个螺栓。第二步呢,如果你有快拆杆的话,那就打开它,如果是螺栓的话,那需要一个内六角的扳手。 第三步呢,是将座椅调到你需要的高度。第四步呢,就是拧紧快拆杆或者螺栓,将座椅固定到你需要的位置上。第五步,保持座椅的平行,然后保证他不会摇晃。啊,最厉害的就是这最后一句话了啊,如果你有工具的话,你给我看一下,我来指导你怎么安装。 然后视频里这个人就又拍了一张这个调节感的位置的照片给他看, 然后 gdp 就告诉他这不是快手, 你需要一个,那边有个扳手啊。然后视频的人又拍了一张说明书还有工具箱的照片 给了 g p t 四啊,问他这里有没有他需要的工具。 g p 四呢,也给他做出了回答,并且把工具的位置也告诉了他啊,在第几排第几个? 然后这个演示视频的人就按照 gt 四的指导完成了啊一系列的操作, 然后最后拍一张照片给 gps, 并且感谢了他。我们还是来看一下他的一个官方的文档,他这里有一个 system card。

近期发布的 gpt 四 v 结合了强大的 gpt 四大语言模型以及准确的图像识别能力,被广泛应用到各个专业领域。 比如 gpt sv 可以正确读取复杂的 x 光片并生成专业的放射报告。对于医生来讲, gpt sv 可以提出专业的建议以及解决方案。 此外,还有用户使用一张图像来测试 gpt 思密的理解和推理能力。从结果可以看出, gpt 思密不但读出了文字的内容, 还按照作者的要求完成了指鹿为马的操作。 g p t 四 v 还能准确识别难以分辨的图像,或者读出用户的暗示,完成精准的回答。因此,如果你有不懂的问题,只需拿起手机拍照就可以获得正确答案。如果你没有 chat g p t plus 加号, 也可以使用免费开源的 level 完成图像的读取。往期的视频中有具体介绍和地址,下载我是凯哥,关注我,获得更多 di 干货!

这简直是可代理的医生,拥有图片识别能力的 gdp, 现在可以快速查看 x 光片处方和医疗报告,并且他能分析 x 光片发现病情问题, 你还可以就健康问题和他交流治疗方案。感觉又是一个巨大的领域,正在被 oba 打开。有网友肯定会讲,他敢分析,你敢用吗? 凡事啊,不要那么快瞎定论,科技进步,提升效率,我们并不是一定要用它来替代医生,他也可以作为医生的 ai 助手,帮助医生提升诊断效率,不是吗?再说了,在海量数据的加持下,我认为 ai 看 x 光片的能力现阶段就能超过经验不足的普通医生。

ai 手把手教你三 d 建模。你现在用 g p t 四 v 和语音模型, g p t 会直接进入你的电脑,用语音告诉你在三 d 建模时具体的专业意见,以及每一步应该怎么做。 convert this cube into a sphere sure go into edit mode by pressing tab and press control shift b to bevel the vertices control shift b okay what should i do next medically select all vertices by pressing a。 可以看到 ppt 能实时读取电脑屏幕并给出语音指令, 这真的太爽了!每个小白都能快速上手专业软件,并且完成高质量的三 d 建模。 openai 开放接口以后, gt。 四 d 加语音模型绝对还有更多应用场景。有未开垦的荒地,而这片荒地下很可能蕴藏着大量石油,有很多商机和稿钱机会在里面。

一周前, chat gpt 迎来重大更新,可以基于图像进行分析和对话,同时多模态 gpt 负四幅发布,想要更深入了解 gpt 负四幅应用, 微软随即公布了一份长达一百六十六页的报告,定性地探讨了 g、 p、 t 负四伏的功能和使用情况, 详细介绍了 gpt 负四伏的能力表现,从基础的图像识别到复杂的逻辑推理都有展示,还有一整套多模态大模型提示词使用技巧一、 gpt 负四伏的用法 三种输入方式,纯文本、单个图像文本对交错图像文本输入三种支持的能力指令遵循思维练上下文少样本学习工作模式和提示技 数遵循文字说明、视觉指向和视觉参考提示,视觉加文本提示,上下文样本少学习。二、 gpt 负四幅的能力及提示词使用技巧十大能力,开放世界视觉理解、 视觉描述、多模态知识常识、场景文本理解、文档推理、写代码、时间推理、抽象推理、情感理解。 比如完成视觉加文本提示需要一些智商才能做出来的图像推理题。提示词使用用技巧,例如多模态提示词技巧 使用、视觉指向和视觉参考提示。可以通过直接编辑输入图像来指示感兴趣的任务,并结合其他提示词技巧使用。三、 模态大模型的应用场景医疗领域,比如识别对比分析、医学影像 gpt 负四伏给出诊断结论、 gpt 负四伏可用场景、故障检测、安全检查、超市结账、汽车保险业务等。 四、 gpt 负四伏能力的 demo 展示一、图像识别最基础的识别没有问题, 比如识别科技、体育界以及娱乐圈的各路名人,不仅能看出这些人是谁,还能解读他们正在做什么。比如黄教主正在介绍英伟达新推出的显卡产品。 除了人物、地标、建筑,对于 g p t 负四幅来说同样也是小菜一碟,不仅能判断名称和所在地,还能给出详细的介绍。 g p t 负 四伏还可以识别各种菜肴,并给出菜肴中的特定成分、装饰物或烹饪技术多模态理解以及对常识的掌握能力。 gpt 负四伏能够解释笑话和梗伏, 能够从图片面部表情中读出情感。除了识别图像之外,文本识别也是机器视觉中的一项重要任务。 gpt 负四幅除了可以识别拉丁文字拼写的语言之外,中文、日文、希腊文等其他文字也都认识, 甚至是手写的数学公式。二、图像推理除了看懂图片中的内容, g p t。 负四符还具有一定的推理能力。简单一些的 g p t。 负四符可以发现两张图中的不同,加大点难度。 g p t。 负四符还能解决 iq 测试当中 的图形问题,以及图片中的特征或逻辑关系。视觉推理与智商测试相关。图片三,图片标注除了用文本回答各种问题, gpt 负四幅还可以在图片中执行一系列操作, 比如我们手里有一张四位 ai 巨头的合影, gpt 负四幅可以框出其中的人物,并标注他们的姓名和简介。四、动态内容分析除了这些静态内容, gpt 负四幅还能做动态分析, 比如从一段制作寿司的教程视频中截取的图片, g p t 负四符推测这些图片出现的顺序,而针对同一系列的图片可能会有不同的理解方式, g p t 负四符会结合文本提示进行判断,比如一组图中人的动作究竟是 开门还是关门。当然,还可以通过多张图片中人物状态的变化,还可以推测出他们正在做的事情,甚至是预测接下来会发生什么。五、上下文学习 gpt 负四幅不仅视觉本领强,关键是还能现学现卖。六、目标的定位及空间关系 gpt 负四幅能够理解图像中人与物体之间的空间关系,例如识别图片中飞盘和人之间的空间关系。 还详细介绍了 gpt 负四幅回答科学问题、多模态常识推理、数学推理、图表理解及总结能力。 gpt 负四幅还能阅读一份多页的技术报告,理解每个部分的内容,并对该技术报告进行总结, 以及巨深智能题等。更多人工智能领域讯息,敬请关注公众号,恋爱时代二零二三。

我们的世界正在被史上最强大的人工智能深刻的改变着。这个十月, gpd 思维图像识别功能的横空出世,让人类个体之间在知识、技能、逻辑上的鸿沟正在被完全踏平。我今天总结了九件他可以做到了让我震惊的事。首先第一点,这个 gpd 思维现在可以快速查看 x 光片处方和医疗报告了,他现在可以看懂没完全理解与上传的文件, 针对你的病情回答相关的问题。这代表着在 ai 时代,任何人口袋里面可能就装了一个最顶尖的医生。显然, gpt 这个新的 解决功能是令人惊叹的,就像这个用户询问自己刚吃的这顿饭中的卡路里数量,人工智能不仅识别出了食物,甚至还计算出了这顿饭中每一个食材的卡路里, 提出了健康饮食的建议。好,接着往下看, gpd 思维还被证明是一位出色的产品设计伙伴。就像这个用户,他给 ai 提供了他的网站的设计方案, pd 思维现在可以直接进行方案评审了,他能够直接提出有关字体、布局、内容等方面的建, 这对于独立开发项目或者学习设计的人来说,相当于是多了一个合作伙伴。且最离谱的是,他可以直接生成出网站,利用这个 gpd 四的视觉功能。就比如说你刚才做好了这个网站方案,他可以直接根据你的草图或者方案,直接将图像转化为实时的网站,这展示了 ai 未来发展的无限可能性。 另外,现在这个 gpt 思维版本可以直接根据你上传的照片来识别出你在哪,就像这张照片一样,他告诉上传的用户这是什么建筑,并给他讲出了这个建筑的历史。 对了,如果你在,杰克 mitterni 甚至可以成为一个顶级的电影创作者。比如说这个用户,他给 gpt 思维提供了四张他由 mitterni 生成的电影剧照,并要求他构建一个将他们联系起来的。 他所展现出的创造力已经与人类无限接近了。比如这个案例, gbt 思维的视觉功能为万圣节和圣诞节导演了一次完整的产品拍摄,并为用户提供了反馈。而且 gbt 思维现在擅长识别图像之间的差异了。这虽然是一个看似微不足 到的功能,但是这个功能如果用在法医扫描或者库存检查中,那显然会极大的提高人的效率。你现在甚至可以利用他成为你的游戏达一热线。就像是这样,你给他一个游戏截图,他可以直接帮你分析出游戏的玩法和攻略。 聊了这么多,显然人工智能正在深刻的改变各行各业的游戏规则。人工智能的快速发展和你能用好人工智能真的让人和人之间的个体差异在无限的被拉平。

画个草图就能生成网站,现在你只需要一部手机就能搞定,比如做个计算器的小程序,只需要在手机上手画出计算器的草图,然后在最上面输入一个简单的提示词,计算器的小程序就生成了。还有这个登录页面更简单, 只需要简单手画一个登录页的草图,直接点生成一个可用的登录页就有了。怎么样,是不是以后做网站都不需要笨重的电脑了?