粉丝8395获赞7.2万

你见过这张表情包吧?我们把它扔进了字节跳动的吉梦 ai 里扩了个图,扩完图后给大爷塞了杯咖啡,还多了一位高清金发美女。看得出是根据原图最右边的这一点痕迹脑补出来的,很合理。 还有这张传世经典扩图,结果也很合理,不过蓝衣服姑娘的购物袋又不小心挂到了腿上。如果你也想试试的话,那用抖音剪映、集梦新会这些 app 就可以生成这些毫无 ps 痕迹的扩图。那这种逼真的效果到底是怎么实现的呢? 这些 app 都是基于自觉跳动自研的豆包大模型来实现 ai 作图功能的。其实图像跟语言一样,都可以理解为是一大堆符合特定分布规律的数据大模型,在学习了大量图像后,就能掌握其中的规律。在收到需要扩展图片时, ai 会分析提取原图中的画 通常见的特征,再根据之前的学习经验续写出新的数据扩展画面。这样就能给埃塞加一个凌乱的桌面,让世界名画里的房子变大一些,或者让抽象派大作变得更抽象。 当然,让 ai 画好图并不简单,豆包大模型在训练阶段就要跟美术生一样学习大量美术和摄影知识,理解什么是水墨油画,什么是光圈、焦距、透视景,别还有学中文、学英文,理解物理世界的空间结构。 所以升级后的豆包纹身图模型才能根据指令画出这些古典仿真或者超现实的画面。最新发布的豆包图声图模型,除了扩图外,还能帮你生成不同风格的照片写真,或者直接换套衣服不面试的表情包扩图虽然略显沙雕,但其实很考验技术, 因为他需要保证扩展的一致性和内容结构的完整性,最后还要再加上模型自带的美观和创意,才能像这样把女朋友消失的大长腿给救回来。喜欢的话点击下关注,下期见!