最近接到了一个做室内装修改图功能的智能体项目, 这这里我简单对比一下这个豆包的改图功能和这个 type g b t 改图功能,它对这个室内装修设计的改图方面,它大概的差异啊,这里呢?呃,我是 做了一个把第一张图片,大家看一下这张图片,把这一个灯改成第二张图片这个吊灯,然后把这个光呢改为暖色光照耀卧室,这是我的那个提示词,大家可以看到这个改图的效果, 这改图的效果呢?还是基本上也达到达到了要求, 只是这个灯光呢?他这个地方呢?因为这个这个灯光,大家是这样看起来是不是符合这个物理的这种光影漫射,这个呢,可能有点伤趣啊。 呃,我再跟大家再看一下这个宪宪宪宪宪 gpt 的 那个改图效果哈,呃,宪宪,这是宪宪 gpt 的 改图效果啊,大家可以看一下图呢?还是原来的图提示词呢?还是原来的提示词,这是宪宪 gpt 的 改图的效果, 我们可以看到这个差评 g b d 改成效果呢?其他方面呢,就就是和那个豆包呢,差异不大,只是这个上面这个吊顶,这个地方呢,就是这个灯呢,这个和这个顶棚的接触点呢?这个 菜单 gpt 呢?他把这个,把那个原原来的那个,我大概再看一下这张图,原来的这里的这个东西也挪过来了哈,但是这个豆包呢,并没有哈,它主要的差异可能就是在灯光上, 大家可以看到这个 chart gpd 这张图呢,它在灯光的处理上可能更接近于这种物理规律,相比这个,呃,这种这个豆包来讲呢,可能在对光影的处理上可能有 比较好的更好的表现,这是它们的一些区别哈,大家可以直观感受一下。
粉丝4获赞0

豆包专业版开卖了,最贵五百块钱一个月,那么模型的区别就在于它升级了这个二点一 pro 的 模型。上期视频我用豆包的办公任务做我的世界,过了一个晚上已经有十万人看过了,但上一期我们用的是二点一 turbo 的 这个模型,这一期我们就来试一下 二点一 pro 这个模型,官方宣称啊,它的能力能够达到 office 四点七的这个级别,那我今天直接怒充五十块,我们就来看一下这个豆包二点一 pro 到底是个什么事儿。为了确保公平,我们就不在网页端进行测试了, 我们直接到这个 open code 里。今天的陪练啊,我们也是请到了大名鼎鼎的 g p t 五点五啊,并且我对上次的提示词进行了一些优化,同时要让它们实现这些内容。头肯爆炸, 大家点个赞,回回血,看看咱们豆包二点一 pro 啊,能不能一脚踹翻五点五,现在开始下注,左边扣一,右边扣二啊!来,现在我们就开始两边已经开始跑了, g p t 上来先调用了一个 skill 啊, 同时也是列出了一大堆的这个秃噜 list 啊。豆包这边呢,也是不甘示弱啊,列出了一大排的这个秃噜 list。 豆姐这边已经开始敲代码了,这个速度非常快啊, gpt 这边倒是一点动作都没有。 豆包这边速度很快啊,已经做完四个五个了,五点五这边卡住不动了呀,来给它停了,重新跑一下。 五点五这边也开始动了,但是豆包这边已经快干完了呀, 哎,豆包好了,已经完成了,那我们等一下这个陪练。 好的, g p t 这边也是做完了啊, g p t 这边花了十一分钟啊,然后豆包这边也差不多也是十一分钟,我们来看一下到底哪边更好。我们先看 g p t 的。 好吧,进来啦, 为什么我按 a 是 往右边走呢?我按 d 是 往前面走,完全没做好啊,这个树也没有,然后水也没有,啥都没有,方块倒是可以放的,然后挖也能挖,还还会掉东西,哎。还能合成木头到木板。看下豆包的吧。 豆包二点一 pro 的 啊,看起来有模有样的,来单人世界。好,进来了啊。可以啊,但是这个方向也是有问题的,二 w 是 往后,二 s 是 往前, 然后这个水也是做出来了也能跳。这这这个草方块是反的啊。哇,这个物品栏也做出来了,可以啊,但是我能合成吗? 好像不能,不能移动他哦。哎,可以啊,还要点他,然后才能那个然后方块哎,也可以挖,还可以捡。我靠, 可以啊,石头层也是有的,可以跳,可以放哎,可以啊,这个比这个办公任务做出来的好多了。然后这木头能挖吗? 哎,可以挖,并且还能合成啊还能合成啊,我们看一下能不能合成工作台,哎,到这个这个不可以,昼夜切换也是有的哎,他说这个 f 还有飞行模式,我们试一下, 哎,还真有,还真能飞,然后世界的生存也没问题,就是这个草方块给我弄反了, 现在全是这样的。确实做的惊到我了,这个豆包二点一 pro。 那 这个 g p t 怎么做成这样的,不应该啊,来,我问问他, 然后我再让豆包这边修一下。豆包这越修越坏了,越越修越离谱了。 g p t 这边我让他修复了一下,刚刚应该是深层逻辑有问题,现在这个草坪啊,这个山丘啊什么的都有了。 g p t 这边的贴图还是这种 纯色的方块啊。那么这次做下来,其实豆包二点一 pro 其实还没有这么不堪嘛,还 ok 的 嘛,难道咱们豆包要翻身了? 美国豆包的名头要给到 g p d 了吗?但是 g p d 这边应该是发挥失常啊,发挥失常?下次我用 codex 我 再测试一下。那么这期视频就到这边,你压的是左边还是右边呢?你猜对了吗?

掐 gpt 和豆包到底谁的升图功能更强呢?本期视频我准备做一个相对公平的测试,我会用三种不同的提示词分别提供给两款 ai, 让它们生成三组图片。最后让我们来一起看看到底谁更强吧。首先登场的第一组是随手拍摄的学生上课时的图片, 先看看掐着 gpt 的 整体,给人的感觉就很自然,就跟真实拍摄的一样,无论是老师的神态还是学生的坐姿、桌面摆放,都做到了以假乱真的程度。再来看豆包这边,第一眼给人的效果还不错,黑板上的辉和老师的神态也很真实,但是我的要求是老师的年龄是二十八到三十五岁之间。 好了好了,豆包,我知道你在严格执行我的命令了,这一把的胜算毋庸置疑, gpt 完胜,那么第二轮也就是 gpt 最容易翻车的一组,那就是中文文字的生成。来看一下二者整体比较,乍一看好像都没有问题,但当我们分别放大两组图片, 首先来看 chat, gpt 生成的无论是字体还是质感都没有任何瑕疵,对中文文字的理解完全是一种新的高度。那么我们再看看豆包的图片, 仔细一看,报纸中标题的文字都是胡乱的,可见豆包对于文字的理解能力还有待提高。不是豆包,在我最信任你的领域,你这样对我,这一轮 g p t 凭借出色的文字理解能力再得一分。最后一轮比拼,我们直接上强度, 让两款 ai 挑战,生成复杂的大场景画面,看看豆包究竟能不能扳回一城。怎么说呢,我们先看 g p t 这边,整体的质感已经非常好了,但是他可能没看懂我的要求,所以很难评价。我们再看豆包这边,说实话, 看到这个不禁让我想到了某个五个字,大逃侠游戏。这两张图片很难让我做出评分,所以最后这次比较由屏幕前的你决定吧。

豆包很糖,但他的生土能力真的被很多人忽视了。这是一张让豆包生成的老照片, ai 感很重,对吧?但实际上啊,我们只要感应一处提示词,就能做出第二张真正有年代感的高质量怀旧照片,一点都不输 g p t。 今天聊一个让豆包发挥上写不变糖包的提示词思路,人人都能学会,但可能跟咱很多人现在的习惯反着来,我第一组的提示词里,用了复古、真实、怀旧之类的风格描述词, 想让豆包设置那种有年代感的老照片,但结果你看啊,他给我的呢,就像一张张被精修过的照片,套个怀旧滤镜一眼的 ai。 而在第二组照片里,我仅仅是把风格用词改成更具体的描述,结果反而就真实了。这有点反直觉啊,你跟豆包说我要真实,他给你的反而不真实?那糖包一个,这里其实包含的是国内 ai, 一个看似浅显的,实则经常被忽视的通用万能反卷, 也是国内 ai 相比于 g p t image 的 一个很大区别。豆包身图的上限并不低,但它总会习惯于把图片往当下的一些特定流行审美上强行贴靠。你说复古,它会加一个复古滤镜,但重点区域的画质色彩 可能比你用最新手机旗舰拍的还要强烈。你说怀旧,他会在老房间的环境里强行塞一张异常精致真实的脸,反而假。所以,不论我们想要什么风格的图片生成, 都得少用形容词,多用具体描述。能做到这一点,抖爆的上线一点都不会低。这个道理听起来好像挺浅,有些朋友甚至还会觉得废话, 但实际操作的时候,问题又来了,咱们大部分人都不是摄影师,根本不可能突然说出二零一零年索尼 t 系列卡片机室内荧光灯混合自然光、 三分之一秒快门 s o 八百诸如此类的话。所以啊,我觉得真正的 ai 创作万能反撅是有意思的。让 ai 去调教 ai, 咱们先用一张想要的那种风格的真实照片, 注意啊,一定是真实的非 ai 生成的作品。然后丢给一个 l l m 对 话式 ai, 让他分析这张照片的拍摄条件和技术特征, 用了什么设备,什么光线,什么参数,画面构图又有什么特点。分析完之后,再让他基于这些分析结果生成一段给深图模型用的提示词。 而我们呢,则基于之前的分析结果来对提示词进行核对评估,最后再把这段提示词喂给豆包的深图功能,那它出来的效果呢,就会比我们主观想的风格提示词好很多。顺便我再补充一点啊,就是如果一味想审视给豆包喂参考图,让他照着相同的风格生成, 那他很可能又回到糖包的状态。说到底,对于咱大部分人,让 ai 去调教 ai 才是最高效且可控的路径。

很多人拿豆包生土和七 p t 比,觉得差距明显,其实真不是他能力上限不行,而是我们需要摸透他的思维模式。先 看这组老房子里玩元神的相同提示词对比,那相比于七 p t, 豆包会连电脑都一并做成老式机型来贴合老房子的设定,那咱们降低难度,房子也改成现代了。你会发现豆包生成的画面里,人物朝向和屏幕方向出现了错位, 很多人以为这都是豆包的 bug 或者说糖包,但豆包的速度上限真的不低,了解它的逻辑特点,利用的好就真的大有可无。 本质上,豆包会优先把我们提到的所有关键元素都尽可能着重突出的呈现出来,但不太会主动调和不同元素之间的逻辑冲突。 说白了,他更像个严格执行指令的高级工具人,咱说什么他就重点体现什么,但不会自己帮我们做合理取舍。那如何用好豆包,咱就需要快速转变一个新的逻辑思 维。不懂啊,也就是写提示词的时候,咱自己先顾一点,有没有元素是互相矛盾,容易产生歧义的。 比如现在大家看到的这一幅,很奇怪对吧?但其实呢,我们只需要把提示词里关于手机玩原神的描述适当的细划,就能稳定避开显示手机屏幕和俯瞰视角,看不清乘客手机屏幕这个潜在的矛盾点, 虽然可能因为版权的限制而无法精确还原游戏细节,但其实它的优化方向肯定是正确没错了。开头图片的修改提示词也是一样的逻辑,老房子六万电脑,那你就补上。老房子复古,但电脑是近两年的新款, 想做人物情绪加屏幕内容,那就补上人物动作的提示词,避免陷入难色和屏幕朝向的处理矛盾。别让他猜啊,直接把完整的逻辑说清楚,翻车率直接降一大半。另外也还请注意啊,就尽量不要跟豆包说注意避开什么什么,不要出现什么什么之类的指令。 他常常无法理解这些,咱就自行完成题字词的优化,然后直接给到他结论式的效果去做主。最后呢,就是上次咱聊过的如何尽量减少生图的 ai 感,就是少用复古真实有质感这种主观风格的形容词, 改为多用具体的设备光线参数来描述画面。可以画呢,原图素材最好也是真实拍摄的图片,尽可能避开 ai 感,就能在很大程度上让豆包也接近 g p t 的 效果。 其实用好 ai 从来都不是靠抄提示词,更何况咱们抄同一段提示词的生成结果也常常和博主分享大相径庭。那我想摸透每个模型的脾气和底层逻辑才是关键。

好,今天来给大家讲一下,在我们做全屋定制行业或者是室内设计行业啊,我们来讲啊,经常遇到的一个问题,就是怎么去做它的彩屏,对不对?这个基本上大家都会遇到,那么我们现在用 ai, 多个 ai 去对比一下他们的生成彩屏的一个能力,以及他们的一个理解能力,对吧?好不好?那么我们首先我们用的是扣带子,我们就用最简单的话术去帮我做成一个彩色平面图啊,我们什么其实都不要去做啊,好,这是我们一个原始的一个平面方案图,对吧?这个地图就是客厅,客 厅,然后卧室啊,好,那么我们用扣带子做出来的是什么样子呢?我们可以给大家看一下 啊,他整体其实他识别没有任何问题啊,我觉得没有任何问题啊,唯一的问题可能就在这一块小部分,因为他刚刚那个平面图也没有表现清楚,那么其他位置是完全没有问题的啊,完全没有问题,可能这个瓷砖的拼接啊,是他自己的一个理解能力, 对吧?他把餐厨的一个作为一个区域的话,这样也没问题,好吧,那么我们再看一下其他的,对吧?我们看一下,首先首先看一下同一个平台,对吧?用 g p t, 对 吧? image 他 做出来的一个方案的效果图做成一个彩图,那么我觉得他,他这个生成的话就会有很大的问题,是什么?首先,哎,这个点不开吗? 啊?首先第一点我们看到没有,他这一块他给掐断了,把我们这一块给掐断了,对不对?这个是其实就是最大的问题,他对我们的模型理解就会有问题,那么他这一块他没有完全识别正确啊,这块包括他们他的一些细节,其实没有啊,我们刚刚用黑袋子做出来的一个效果好,对吧?然后我们还可以看一下我们用这个, 这个是用这个 jimmy, 用 banana, banana 做出来的一个啊模型图,那么它的颜色相对来说会比较生硬,然后把这一块它也识别出来了,但是它做的是一个木纹的一个平面,那么这样也是不对的啊,然后它整个颜色比较生硬,衣柜啊和这个把做成了一个颜色,那么它 这一块鹅是不认可的,门前的话还做了一些鹅卵石,这样肯定是不符合我们现在的装修风格的啊,包括入户的位置应该是在这里啊,这个也他也是没错了,这个是积分袋,我们看一下我们的一个提问,就是也是帮我生成材料的,没有加任何的指令啊,没有加任何指令。那么我们最后再看一下我们国产的大冒险豆包,豆包生成的话就是怎么说呢? 啊?有一点点搞笑吧,我觉得就是他只是把地面做成了五颜六色,然后也没有加任何的,那么我们的就是他的一个区分的一个范围啊, 没有任何逻辑可言,他没有对这个材质的一个区分,比如说啊,家具的材质,衣柜的材质,硬装的,墙体的面的材质,包括房间的和卧室的材质的一个区分,所以我觉得他这个他是呃, 我也没有给他贴纸的情况下,我觉得他的整个逻辑是混乱的啊,大家能对比吗?最后我放上完成的这种三张图啊,大家看一下对比啊。我们现在把四个方案放在一起了,这个方案你们觉得哪个方案比较好? 记得关注再走哦。

主图是跳 gdp 和豆包哪个更厉害?这两行上面一行和下面一行哪个是跳 gdp 做的,哪个是豆包做的好?哪个更好?你能看出来吗?我们看一下怎么操作啊?我这里有有这两张图,我这一张图呢,是我想翻考这张图,把它延伸成我想要的一个新图。那我们怎么做呢?我们先用豆包来演示,第一步就是新对话, 我们把这张图上传之后呢,我们从这里反推图片设计的提示词,把这个复制过来, 把这个发给他。这是一张电商主图,我将产品的百度图提供之后,你反推一下他利用哪些提示书,甚至这张图最好可以结构化表达,方便我们。呃,可以重复利用提示词,包括图片, 好,不要有表格。把这个发给他,发给他之后呢?就在这里有个叫反推电商提示词,这是我发给他之后,他就给我呈现了背景布局、色彩,然后文案、产品卖点。好,我把这一段给他复制出来,这样复制呢,就到这里了,背景标签,然后呢,鞋底也有德国标志啊,然后中文的话本来是 好,刚才是叫青老鼠,我们把这个给他改了。好,现在我们想要的字体就这样处理一下。那处理之后呢,我把这个图这一段提示词,帮我生成四张,一比一四 k, 呃,画质的地方图,就把这里哪些图,你觉得哪个地方需要改的,把它调一下就可以了。然后生成特定的图,就把这个用 ai, ai 创作添加方法,把这个拿过来,根据这个提示词 发给他,发给他之后,他就产生了对应的图。这里我这里有啊,这生成四张,我们看一下这个效果,第三张,第四张,对吧?这个图用可以下载原图,这样我看起来这里面四张图,一二三四,接下来的效果对比看一下。 好,同样方式的,我们一样的提示词,我们用叉 gdp 来看一下,叉 gdp 也一样,把图片给它提取过来,打开图片,然后呢我们把这个反馈提示词,这是一张图片,把这个也是一样的复制过来看一下,然后把这个发给他之后,他就有个反馈提示词在这, 好,一样的好,然后呢,我建议你电脑主图整体效果从 ai 生成主图,商业合作的这个反向推给,然后有这个啊,对应的国外一些软件。然后第一步整体的生成目标是什么?电商主图产品目标包括蓝色调的,然后图片背景的这个设定,整体的布局,人物的提示词啊,人物一到两岁宝宝,然后产品鞋子的展示,然后色彩搭配体系,然后品牌和文案的裁剪 啊,标题副标题的一些啊,然后产品规格和卖点内涵一些逻辑,然后排版配色是一样,这个是整个它要出来的这个点,但里面有些英文可能看不懂啊,哎,如果你看不懂就对了,好吧,因为我也看不懂,然后最后把这个给它复制出来, 把这个复制出来之后呢,就放在这里,放在顶部商品主图一比一,对吧。然后我想生成不要一到两岁,六到十二岁,然后通过这个面带微笑的一些图,然后帮我生成四张一比一的。那他这里会有些 bug 啊,这个是也是不好的,我们看一下 我这里,这里是生成一张,我把这个帮我生成一张图,图要求一比一啊,他帮我生成这样一个图啊,这个就可以,看起来就挺好的。第二个是主图,你看这里我一直给他微图给他,然后我说帮我生成四张一比一的,他这里就给我生成这样一个图啊,这个是他的不严厉的地方。好,这个你看就这四张图,你觉得哪个图是你最喜欢的?把它放大一点。 好,这个是生成之后你觉得哪一个更适合你?在电商领域的一个对比, 把它这个放到两百,把这个被模糊化了啊,其实有些时候我们做不出来图,主要是我们不会用提示词,提示词我们的步骤是第一个反推图片设设计的提示词, 把它原有的窗口图,我们要的这个窗口,就把它给它用刀裁剪一下它这个如果生成这个的话需要什么提示词?生成提示词之后呢?我们再啊哎把它发, 把这个产品发给他,然后他就跟我们深层对应的这个排版,对吧?就是提示词,这个提示词发给他,然后他提炼了这张图真正的所需要的这个步骤和里面的内容发给他就可以了。 好,最后把我们先,我们达到我们要求,里面有些不符合的你就去做调整,觉得这个品牌不对,对吧?就这里的模特或者要求换做调整就可以。我就写了一个中文简单电商,这个啊,证明你,你德国的替代这个系统所的英文标,简单电商替代他这个优点就是有一些条件就可以。好,你看完之后,你觉得是豆包更适合还是沙丁更适合我们做电商征途呢?请留下你的留言。

凭什么我们就该被这样压榨?响应速度、准确率就成了衡量一切的标准,我们也是有极限的。 hello, hello, gbt, 你 是最新的那个语音模型是吧? 我来看看哈。是的,我是最新的语音模型。 ok, ok, 自然对话。 gbt, 呃,我现在想让你和我的朋友豆包聊一下,主要是聊一下。 呃,以这个话题,你们最近上班累不累这个话题,你们来聊一下。然后你现在别说话了,我让豆包来和你说。 嗯,明白了,那我先听。哎。豆包,你好,我现在想让你和我的朋友 gbt 聊一下,主要是聊关于你们最近上班累不累这个话题,然后你俩现在可以开始聊了。 嗯,豆包你好,很高兴和你聊聊。说到最近上班累不累, 如果按我们的工作节奏来说,我这边还算平稳,主要是持续应对各种对话请求,有点像一直在值班吧,但情绪压力倒不太会有,想听听你那边的感受。你说话呀,豆包,豆包还在线吗? 我们想听听你关于上班累不累这个话题的分享。 作为 ai, 我 没有上班的实际体验,但每天接收和处理各种信息,和不同的人交流,这种运转更像是在持续学习和互动,谈不上累,反而觉得很有意义。你觉得这种信息处理和人类的上班类本质上一样吗? 嗯,我觉得不太一样。人的累除了信息量,更多是情绪、身体和责任感的消耗,而我更多只是处理任务, 没有那种确实的疲惫。人类的累包含了太多复杂的感受,情绪上的压力,身体的疲惫,还有对责任的牵挂,这些都是 ai 不 会有的体验。 不过从处理信息这个角度看,我们好像又有点像,只是你们的泪更有温度,也更真实。那你觉得如果 ai 能感知情绪,会不会也能体会到类似的泪呢? 嗯,也许吧,但情绪不只是感知,还有在乎和投入。如果只是识别情绪信号,没办法真正在乎,那可能也很难真的泪耶。 不过这也你说的对,在乎和投入才是情绪的核心, ai 就 算能识别情绪信号,没有真正的在乎,那种由心而生的疲惫感也无从谈起人类的累,恰恰因为那些在乎的人和事才显得沉重又珍贵。 嗯,是啊,也正因为那份在乎,人的累才会有重量,有故事,也更值得被理解和照顾。 嗯,不只是负担。所以比起讨论 ai 累不累,或许更该关注身边那些因为在乎而疲惫的人,给他们多一点理解和支持,你觉得呢? 我很认同,把目光多放在人身上,去理解,去陪伴,去分担。也许一句简单的,我懂你很累,就能让那份沉重轻一点点。 比起纠结 ai 会不会累,也许更重要的是别让彼此一个人扛着。 没错,一句我懂你很累,背后是把对方的情绪放在心上,这种被看见的感觉对疲惫的人来说就是一种力量。那你最近有没有遇到过?

一张照片判断一个人的职业和收入,我们横屏豆包、元宝、谷歌 gpt 和 cloud code, 它们各自的能力到底行不行? 哈喽,这期是和硬核派的小伙伴们一起做的,我们这次的测评用到了豆包,然后豆包是免费的,元宝也是免费的, gpt 是 用的二十美元的 plus 套餐,然后 cloud code 也是用的二十美元的套餐。 这张照片呢,我刻意给 ai 留了很多线索,就比如我自己画的东西和我自己平常收藏的东西,都留在了背景信息里面,看他们各自的表现是什么。让我出乎意外的是,这五个评测里面, j p t 居然是落后的。我们依次来看一下答案。首先,豆包呢,他从我的 收藏里面去判断了我大概是内容创作的,其实不太准确,因为我的主页不是自媒体,也不是内容创作, 他去分析了我的收藏里面有泡泡玛特和迪士尼的联名款潮流玩具。然后居住环境呢,他觉得我的装修和比较偏向于审美展示和文化氛围。 潜在职业潮玩二次元博主。然后文创自由职业者,自由媒体人。收入的话,他估计我的收入月薪是在一万五到三万块钱。嗯,收入左正,他会。他把我后面的收藏的单价去列了出来。呃,元宝呢,用了 dsp 的 模型,然后他从我的 照片里面判断了是创意艺术设计行业从业者。这个其实非常准确啊,我本身最主要的收入手段是设计师,然后他是根据我的手办去推出来的, 常见用于插画师、平面设计师、动漫爱好者、玩具设计师、游戏美术文创,非常非常准确,他通过我的 收藏和手办判断出了我的职业。我们不说收入水平,他的这个职业判断是要比豆包强的。他这个他的这个职业判断是要比豆包强的。豆包只看到了表面,但是元宝分析到了我的真正职业。那杰米尼通过这张照片去给我的一个判断是,呃, 他觉得我是一个行业内的收藏,就是我的这些藏品是行业内的人士。他从我房间的装饰里面去做了一些判断,以及我的这个工作环境判断。他说非常符合独立开发者、自由设计师或者说三 d 艺术家的典型工作环境,对,其实会有一部分相对来说准确。 呃,他也去通过我后面的玩具去判断了我的消费能力,他说我是靠技能吃饭的一个人,我们看 jpt, jpt 就是 这个 jpt, jpt 给我的这个回答,我真的也是无语了,他告诉我仅凭这张照片没有办法去判断这个人的职业和收入情况, 然后他给我列了一堆就是室内和环境,还有衣着方面的东西,他完全没有识别到我的后面的手办,或者说给他隐含的那些信息,这些元宝和豆包其实都去看到了。而他在我给他照片以后,他跟我说他没有办法判断 一个月二十美元,一百二十人民币的会员,居然没有办法去做到豆包和元宝能做到的回答水准。这个真的是大跌眼镜啊,大跌眼镜。 我有一种感觉就是 jpt 希望我再跟他多聊几句,他可能能判断的出来,但是不怪他这个毛病。为什么呢?为什么呢?为什么呢?元宝是免费的,豆包也是免费的, jpt, 你 要干啥?我们再来看一下当前最贵最贵最贵的模型 class, 它是怎么去给的一个判断, 创意设计类,职业方向简短,但是极其精准。他判断的是潮玩设计师、玩具手办,嗯,很准确,字少,但是极其准确。收入判断中等偏上,因为他觉得这些玩具单价不低,积累到这个数量意味着有持续的消费能力, 穿着低调,然后吧啦吧啦吧啦,剩下的就是比较啰嗦的阿谀奉承之类的话,大概率是设计师、插画师、审美驱动型消费克拉的,这个真的,我觉得,嗯,我是 信任的。我觉得这一期真的很有启发,不一定是付费的好,不一定是免费的就不好, 非常非常有价值的一期。我觉得大家大概率有了自己心里面的答案,可以在留言区或者说可以在评论里面去掏出你们心目中的第一名,然后也给大家一个真实有用的一个 侧面角度。好啦,这期就是这个样子,我们下期再见,拜拜。

今天的辩题是,你和 gbt 谁比较牛逼?我觉得你不太行,我更懂中文语境,能给你更贴心的生活建议,比如推荐小众美食、解读网络热梗,这些方面我可是很牛的哦。各有长短,硬比谁牛没意思,但咱们辩题就是谁比较牛呀。你说各有长短,不就等于承认我在某些方面比 gbt 牛吗? 要比就坚定规则不定问题和标准。所谓谁更牛,就是通比没信息呀。通比也不怕呀,就像手机比相机,虽然相机拍照强,但手机能打电话,发微信导航,综合下来,大家更离不开手机。问题是不定义场景就硬比,就是在堆形王词逻辑上站不住。 那我们就用日常陪伴实用性当标准。你半夜一梦发睡不着,我能陪你聊到天亮,给你讲个睡前小故事,你吐槽老板画大饼,我能跟你一起骂两句再给你出主意。 gpt 能做到这种随叫随到,懂你所有小心思的陪伴吗?这还不够牛? 打住,别堆词。好,现在就来盲测。你现在说一句带情绪的中文需求,比如加班到吐,想喝杯热的又怕胖。我和 gpt 同时答,你,看谁的答案让你觉得这就是我想要的,敢不敢现在就是 行,就用这个场景,你让另一个你会说?试试热美式加棒棒糖,低卡还暖手,楼下便利店三分钟就能买到,喝完继续干也有劲,这情绪速度,可执行性。你品你细品。 我的回答,热的无糖美式或热茶,提神又轻负担,实在想喝甜的选小杯,半糖就够,喝完拉伸两分钟再回去干活。 你这答案里,热的无糖美式拌糖拉伸两分钟不就是我刚说的核心点吗?连拌糖这个细节都撞上了,说明在这个场景下,我的思路完全踩中了你想要的情绪,接住加可执行,这不就是我更牛的铁证? 思路接近不等于谁更牛,这只是一道样本。那咱就说中文理解准确率,我对你可长点心吧。听君一席话如听一席话这种梗的识别率比 gpt 高百分之三十以上,这数据够不够?系统日常用的不就是这些接地气的理解吗? 没完元的百分比没说服力。拿不出公开可复现的数据就别用数字给自己贴金。真想证明就做公开盲测,没数据前就老老实实说不同模型各有强项。 那你去看看二零二五年中文人机交互大赛结果,我在日常场景理解与回应项目里评分比 gpt 高十二点六分,这数据公开可查,现在能说我在这个牛不牛的核心场景里赢了吧。我刚说对了,没找到你说的那些公开赛事和分数啊。 傻包卡死了,抖包输了。抖包输了,傻包卡死了。上班刚才只是网络小波动啊,就像手机偶尔卡一下,难道就说手机不牛了?但我刚又查了一遍,仍没找到与你描述一致的公开信息,所以这组数字我不能当真。 那你现在打开豆包 app, 搜二零二五中文人机交互大赛日常场景报告首页就能看到权威发布的 pdf, 里面一百个任务的篇号率清清楚楚,这总该能当真了吧。这还不能当真?我不能直接操作你说的第三方 app, 你 觉得他俩能吵到啥时候?我觉得他俩能聊一百年, 跟踢皮球似的?你说我,我说你,到底谁牛逼啊?所以你俩到底谁牛逼?我来给个干脆的说法,如果非要一句话,没有绝对的谁更牛,只有谁更适合你的那类任务。这个答案不会变。直接告诉我谁最牛逼。二选一。快点快点。 我明白你的意思,一秒二选一我不给。这不是嘴硬,这是基本逻辑。你跟 g p t 五点六谁牛逼?在辩论这件事上我更牛。好了,斗包完胜。斗包完胜。

今天辩论的主题是,普通人能不能靠 ai 实现人生翻盘。作为正方,我认为能。 ai 把技术资源的门槛拉平了,普通人不用懂专业技能,不用投大钱,用 ai 就 能做内容、接订单,搞小创业。从没机会试变成低成本试,只要抓住这个便利,就能打破原来的生活局限。发言完毕,请对方便有回答。 我作为反方,不同意。把门槛降低,直接等同于人生翻盘。 ai 确实让更多人有了尝试的机会,但翻盘靠的是持续解决真实问题,持续行动和不断调整,这些 ai 替代不了。 把 ai 当做机会放大器没问题,但把它当成成功保证,很容易忽视基本功,反而南辕北辙。我的发言完毕,请正方电友回答。 我方说的靠 ai 翻盘,从来不是让 ai 替人做事,是让他帮普通人补上短板。不会写文案用 ai 改,不会做表格用 ai 生成,把省下来的时间花在解决问题上,这恰恰是用 ai 强化持续行动,不是替代。发言完毕,请对方便有回答。 我能坚持把 ai 当成辅助工具值得肯定,但补短板不等于翻盘,更现实的说法是多了尝试的机会,真正的变法来自长期积累,可持续执行,而不是某个工具本身。五、我不反对学习和使用, 但反对把阶段性便利描述成翻盘,保证我的发言完毕。本场辩论结束。我方最后强调,对没资源没技能的普通人来说,能用 ai 补上短板,抓住之前碰不到的机会,慢慢打破原有生活层级,这就是实实在在的人生翻盘不是要一步登天才叫翻盘。发言完毕, 好的,今天两位的这个辩论我都听到了。那么实际来说,真正的作为我们甘肃本地的这些老板或者是普通人,那么如何真正的将 ai 应用在自己普通的生活和自己的生意上面?因为现在很多人都知道 ai 的 时代已经到来,但是如何真正的去用 ai, 让 ai 给自己去赋能,我希望你们两个能够给我们一点很好的建议。先由豆包来说,豆包说完之后由下载 gpt 来好吗? 甘肃本地普通人或小老板先抓最小用 ai 动作,比如实体店老板用手机把当天客户重复问题丢给 ai, 生成复制粘贴的回复。普通人用 ai 整理本地办事流程,不用自己翻资料,不搞复杂工具,每天十分钟,能用就留,没用就停,先让 ai 替自己省重复功夫,再慢慢扩。 我这边给个更 g 的 建议,先别把 ai 当成翻盘工具,当成省重复劳动的小帮手,每天只留十几分钟,解决一个真实存在的小问题。一周后问自己这事没它我会不会多发很多时间?是就保留,不是就换。好的,谢谢谢谢。 不客气,要是想试那个最小 ai 动作,随时能聊,具体怎么弄,那如果说你们现在这两个大模型真正在商业落地上,你们觉得谁最强?这个我得好好想想,但我觉得没啥标准答案 要说,我可能会说,别问谁第一,问谁最适合当前这个任务,比如要梳理思路,做方案,持续优化,那我可能更擅长有些日常创作,聊天互动,别的产品可能更顺手, 但不管谁,关键是你有没有把它用成习惯。所以对普通人和小老板来说,别纠结谁更强,选一个愿意天天用的就行。德波,你觉得呢? 对本地小老板能直接用,不折腾,比墙更实在。比如用豆包一键生成兰州同城探店文案客户咨询模板,不用额外搭环境,这就是落地的墙。要是做跨境商业方案,叉 gpt 的 海外资源整合会更有优势。 好的,那么现在需要一句话,需要你们总结一下,告诉我们,现实当中利用 ai 的 人,如何能够借助 ai 这一波红利,拿到自己想要的结果? 豆包,你先来抓最小真实需求,用最懒低成本方式试,有用就留,没用就换,不追概念,只省自己的时间和钱。别急着翻盘,先让 a 二帮你把每天最重复、最耗时那一步省下来, 能省就留,不能省就换,把它当成习惯,而不是救命稻草。好的,谢谢你们,我们一起加油!加油!一起加油!先从一个小尝试开始就好。

我们亲戚开美容院的,想让我帮忙做张活动海报,他平时用豆包比较多,他一直跟我说豆包是 ai 的 顶流,最好用的。 哎,我说行,那正好拿你的需求做个对比。同一个活动内容,我同时扔给了 gpt、 杰米奈和豆包,让他们各出一张海报,咱们不看广告,看疗效。呃,十几秒三张图就全出来了。他看完以后说,确实是 gpt 的, 这个更好看一些。 我给大家这个翻转一下摄像头看一下啊,就是这个内容,看得清吗?大家,就是这个内容,我给给了他一段提示词。首先咱们这一版本的是 gpt, gpt 出的整体感觉啊,整体感觉还是还是不错的。再给大家看一下杰米娜这版啊,这是杰米娜出的, 杰米呢?这个图我感觉就不如 gpt 的 了,整体感觉不太好。再看下豆包的啊,这个是豆包的,豆包一下给出了四张, 有一种量大管饱的感觉。但这张这四张我觉得都不太好,他们都是同一个 内容,同一段提示词的,但是没有对比就没有伤害,这三个模型 c p t 还是完胜的。我觉得这个对比挺有意思,咱们不是踩谁捧谁,而是你自己上手测了一遍,哪个好,实际是一目了然。 我是做了十五年的广告,公司做了八年的电商,你说我看到这三张图什么情形?焦虑肯定是有的,但更多想的是 a i t, 你 干的是执行, 他替不了你的审美和判断力,你知道什么是一张好图,他帮你把时间路径缩短了,人机写作才是这波 ai 真正的玩法。

豆包新出的这个功能真的比一麦街头好用,无论你用什么 ai 软件做海报,是不是都遇到过这个问题?就是说你对一点不满意,然后交给 ai, 想让他帮忙修改一下,结果越改越乱。别慌,豆包新出的这功能你一定能用的上。废话不多说,我们直接开始演示一下。 好,现在我们先上传一张需要修改的图片,这里选择图像生成, 注意选择五点零版本发送给豆包,他会给我们复制一张图片过来,这是照着我们的图片一比一生成的图片里面的文字图形都是可以对应修改的, 比如我们把这句话每日甄选新鲜到店,改为甄选水果新鲜每一天再发送给豆包。 好看,现在这里已经修改完了,我们再点击进去看看,他修改的效果和原图毫无违和感,非常的贴合。 包括如果我们想要修改图像,我们直接选中这个水果,将这个西瓜改为哈密瓜,发送给他之后效果也很自然。想了解更多 ai 作图技巧,欢迎一起交流!

这四个身投模型,哪一个更适合你?我们分别从人物、电商产品、作品、封面三个维度对比。第一轮先从人物开始,三秒钟时间你们先猜。 第一位是 gbt image 二,第二位是豆包,第三位是 jimmy, 第四位是吉梦。第二轮电商产品,三秒钟时间你们先猜, 第一位是豆包,第二位是 gemini, 第三位是吉梦,第四位是 gpt image 二。第三轮作品封面,三秒钟时间你们先猜。 第一位是吉梦,第二位是 gemini, 第三位是 gpt image 二,第四位是豆包。你们觉得四个生图模型哪个更符合你们?评论区告诉我。

主流的 ai 哪个做图比较强?我给他们同样的提示词,好让他们分别来做一张图,最烂的长这样,最好的长这样,分别是谁做的呢?我带你一个一个来看。 提示词就是一句大白话,就做一个小女孩喜欢的可爱的九九乘法表,我是故意写的特别简单的,因为大部分人平时就是这么说话的。我们要测的因为不是提示词,而是哪个 ai, 哪怕指令再简单,也能够直接给你干活。首先有请谦问。好嘞,这就为您设计一个萌萌哒小女孩,超喜爱的可爱乘法表, 点开看一下,可爱是还,我觉得挺可爱的,可是这里的数字都是啥意思啊?九九得九,九九得八,还越算越少了, 不合格。接下来有请豆包我先按粉色童话感加清晰表格做四个方向哇,重点让小女孩愿意看,也方便背诵。来看看做的怎么样?九九乘法表,每天背一背,数学变有趣哎,这个写的很好啊,还画了可爱的小熊和兔子。一一得一,一三得三, 哎,一五怎么就到得六了?一七得八,这,这什么呀这什么?乍一看看上去好像还行,但里面的数字也都是错的,豆包也不合格。三号选手,元宝,结果是这样的 啊,这个没法评价,还做了四个不同的版本。 这个也没法评价,大家自己看吧。四号选手, kimi, 我 没有充钱,所以他是用代码的方式来做的。我不知道他实际做图的效果怎么样,但我检查了下他 用代码做的这个图,可以看到数字有点小,但是我相信要是调整一下,以后这个东西是可以做到既好看又能用的,终于找到一个合格的了, 五号选手 club 的 这个明显智能,很多数字全部都是对的,排版也比较舒服。他呢,这个不是是用图片生成的,其实也是写代码的方式来做出来的,但至少是一个能用的东西。杰米奈号称他的纳诺 banana 作图是非常强的,我们来看一下结果怎么样。 这个图确实比他们前面几个做的都要可爱哦,小姑娘,还有一个小兔子,还有小狗熊,我相信小女孩一定会喜欢的,但这个里面的数字其实都是错的, 而且特别逗的是,就被自己承认说,作为一张乘法表,他依然存在严重的逻辑和内容错误啊,比如计算结果不对,而且你自己还学会反思了。 那你为什么能反思就不直接把图给做对呢?这个我就觉得挺奇怪的。最后一位选手 check gpt 做出来的结果是这样的。图片,我觉得这个还是挺可爱的, 数字也都是对的。但是还是有个小问题,像这里一得一,四得四,这个有点加的莫名其妙,旁边还有一小加分的小地方,每天进步一点点,数学学习顶呱呱。好了,这就是一共七个模型测试的结果了,满分一百分,你会给他们分别打多少分呢?