大家嘴上吐槽豆包笨,背后却偷偷用。最近豆包推出六十八元每月会员的收费纸,瞬间引发全网热议。偏偏就在这时,网友搜索黎元红,他居然输出一张范伟的 ps 图片。都开始收费了,准确度还这么差?先别 急着吐槽,很多人根本不知道,你跟 ai 说一句话,背后消耗的算力,足以烧坏一台普通手机。传统搜索引擎只是调取现成数据, 几乎没有额外成本。而生成式 ai 每句回复都需要实时临场运算,豆包日均一点四亿人在线,每天要处理一百二十万亿个抽根算力换算下来,够全球每人免费说上万句。 ai 每一次作答,后台昂贵的高端显卡就要满负荷全速运转,单张显卡成本高达几十万,豆包更是部署了几十万张显卡同时工作, 算一笔真实成本账,硬件设备折旧占总成本百分之五十八,巨额电费占百分之二十九。自己每年还要豪掷一千六百亿重金才够高端芯片。你通宵和 ai 聊天,消耗的算力够一台高性能电脑运转一整天,那为什么付费后 ai 还会出错?记住核心一点, ai 是 概率推理模型, 不是标准答案字典,它是自主推算答案,难免出现预判偏差,想要降低错误,就得翻倍追加算力投入,算力越强,运营成本就 越高。所以豆包收费真不是单纯想赚钱,高昂的电费和硬件损耗让平台难以承受。互联网几十年的免费福利时代在 ai 浪潮里逐渐落幕,看得见的是会员费用,看不见的是时刻燃烧的天价算力电费。你觉得 ai 工具该不该基础免费进阶收费评论区聊聊你的看法。
粉丝200获赞2081

ai 大 模型呢,为什么要按照托肯收费?同样是一百万的托肯呢?为什么价格能差三十倍?等等,你可能会说啊,我们平时用的豆包啊,元宝啊,也没交过钱啊。没错,咱们平时用的网页版或者 app 呢,确实是免费的,那是大厂为了抢占市场给的福利。 但如果你是专业用,或者是使用最近爆火的小龙虾,那就必须通过 api 接口来调用大模型,按量付费,烧起钱来也是非常吓人的。那这些钱到底烧在哪了? 当模型正式发布后呢?它的使用成本其实由两个部分组成。第一部分呢,是固定成本,也就是模型上线前已经砸下去的钱, 包括前期的研发与训练投入,还有算力基础设施的建设,像建机房,采购显卡,配齐内存和硬盘。最近大家可能也注意到了,显卡和内存价格是一路上涨,很大程度就是因为 ai 需求暴增呢,把硬件价格也推高了。但这些成本呢,有个特点,它是沉没的, 在模型发布前呢,就已经支出了,随着用户越来越多,这部分费用呢,会被不断贪薄,贪到每一次调用上呢,它的占比会越来越低,甚至低到可以忽略不计。 那第二部分呢,是动态成本,也就是每一次调用模型实打实消耗掉的东西,每次计算都要消耗电力,还需要占用内存, 数据在传输过程中呢,也需要消耗网络流量。而所有这些消耗呢,都和 token 的 数量呢,直接相关。这里呢,快速同步一个概念。到底什么是 token? token 的 中文呢,可以翻译为词源,可以是一个字,一个词,一个分词,甚至一个字节。在大模型中呢,被表达为一组数字序列,用于计算下一个 token。 token 越多呢,模型的计算的时间就越长,占用的算力和资源呢,自然就越多。所以,按照 token 数量收费,本质上是一个多用多付少用呢少付的计费方式, 非常直观呢,也非常合理。这像什么呢?就像我们每个月交的水电气一样。从这个角度看呢, ai 正悄悄完成一个转变,它正从一项技术、产品呢,演变成一种基础服务。我们想要获得智力呢,就需要购买算力。 说不定以后每个月的水电账单旁边呢,就会多出一行 token 费用。那既然都是按 token 收费呢,为什么不同大模型的价格差这么多?比如你输入一百万 token, deepsea v 三的收费呢,是零点二八美元,而 g p t 模型呢,要二点五美元。如果是输出 token 呢,差距更夸张, deepsea 呢是零点四二美元, g p t 呢是十五美元,整整差了三十多倍。 同样都是 token 呢,为什么价格能差出这么多?其实 token 的 价格呢,主要是由两个因素决定的。第一,电力和人工成本不同。在美国、中国、中东等不同地区,电价运为成本,人力成本差异非常大,而这些呢,最终都会反映到价格里。第二呢,算法不同。 好的算法呢,就像一台省油的发动机,同样是跑一百公里啊,有的车呢,只需要三升油,而有的车呢,却要烧掉十升。大模型也是一样,算法呢,设计的越巧妙呢,达到同样质量的输出,消耗,算力呢就越少。所以优化算法是模型研发人员最最重要的任务之一。 算法越高效,成本就越低,价格自然就更有优势。在这方面呢,有很多创新的工作,比如 deepstack 引入的 mo 机制,想了解的朋友可以翻看我之前的这期视频。 那为什么输出托管的价格比输入托管贵这么多?原因呢?很简单,输入和输出呢,干的活不一样。输入的托管呢,是你的提示词, 模型可以一次性全部读取参与计算,多一个少一个呢,对显卡的负担影响呢,是有限的。但输出 token 就 不一样了,它是一个接一个逐自生成的,每生成一个 token 呢,模型都要重新算一次。输的 token 是 配角,输出的 token 呢是主角,所以给出的片酬呢,就不一样。 具体的技术原理呢,也可以看我这期视频,理解注意力机制对托根计算量的影响。这里呢,再顺便澄清一个常见的误解,托根的发明初衷呢,不是为了计费。 托根是纯粹的算法创新和工程发明,是为了把人类的语言翻译成机械能听懂的数学坐标。 只是后来大家发现呢,托管的数量呢,恰好决定了计算量,这才顺理成章的用它来计费,绝不是因为要收钱才搞出来这么个复杂的概念。当这里可以像自来水一样按量计费,一个属于算力文明的时代就真正开始了。

豆包推出付费版,到底是真的有实力,还是在收智商税?我这次不绕弯子,直接给你最真实、最正确、最直白、最客观的结论,他就是想收智商税。 大模型变现一般有三种方式,第一种是 api 调用,第二种是企业订阅,第三种是消费者订阅。他们只是在近期的一场活动中公布了整体偷看的使用量。 豆包的日军 token 用量已经超过了一百二十万亿,仅次于 open ai 和 google。 不 过呢,这个用量包括免费和付费的 token。 但如果去看 openroute 的 api 调用排行榜,豆包根本就没上过榜。在排除免费选手的情况下,经常能在榜上看到的国产模型就是 deep、 sec、 mini max 还有 kimi。 企业端同样很难找到像样的数据。字节在二零年上线了火山引擎,这是一个对标阿里云、腾讯云的服务平台,你可以理解成字节把自己的技术能力打包卖给外部企业。 豆包 ai 当然也是火山引擎的卖点之一,但具体有多少企业是因为豆包才与字节合作,字节没有公布,如果这方面数据亮眼的话,他肯定会拿出来大力宣传。 豆包现在就是在尝试第三条路,也就是消费者订阅。豆包在官网公布了最新模型 seed 二点零的跑分情况,最右边是豆包,深色的是最高分数,可以看到还是国外模型比较强。而且 seed 二点零是二月份推出的,他当时对标的这些模型现在已经是上一代甚至上两代了,参考意义并不大。 当然,我们不排除豆包的新一代模型会有重大突破,但别人同时也在迭代啊。如果一个人真的能用 ai 提高生产力,市面上有很多比豆包更牛的 ai, 如果他用不到,那就没有任何付费订阅的意义。 字节旗下的 ai 模型也并非一无是处,字节主攻的方向是图像和视频生成。他家的 cds 就 很牛啊,完全可以比肩国外的顶尖生图生。视频模型 我自己就充了极梦的年会员,非常好用,但豆包我是绝对不会充钱的。其实豆包想要收订阅费也有不同的方式,国外的大模型就有三种收订阅费的套路,第一种就是 check gpt 模式,直接收费,豆包现在就是想走这条路,但是你的性能要足够好,才能留住用户。 第二种就是 gmail 模式,它把自家其他的产品打包在一起,让你订阅你像谷歌二十刀一个月的 ai pro 套餐,里面除了 gmail 之外,还有一大堆其他的服务。第三种就是 gork 模式, 像你经常能在评论区里看到有人艾特豆包,艾特抖音求真,这套玩法都是学马斯克的,最开始在 x 上面艾特 grog 提问是免费的, 现在只有会员用户艾特 grog, grog 才会理你,普通用户人家不理你。而且 grog 辨别信息真伪的能力确实非常强。从我个人体验来看呢,在查找信息方面, grog 比 gbt 和 cloud 都要强, 真的我没充会员,没法评价哎。这个模式在我看来才是抖音最应该模仿的,你可以把豆包辨别真伪的能力进一步提高,然后宣传做好,再开放一个抖音会员功能, 把艾特抖音求真作为功能之一放进去,你现在把抖音求真作为免费功能开放,就给人一种他和豆包差不多的感觉,没法让人信服。 如果字节真的做到了这些,我肯定会充钱去那些胡说的博主下面,直接艾特抖音求真,打他的脸,专治各种不服。 不过现在来看呢,豆包还远远达不到 grog 的 水平,这也是为什么我在上一个视频奉劝大家不要用豆包来做金融分析,如果你只是想知道某个专业名词的意思,豆包还是能胜任的。玩聊世界,帮你看清世界,我们下期再见。

那 token 到底要怎么定价呢?一度 token 到底要多少钱?那我们给 token 定一个新单位,一百万的 token 等于一度 token, 那 现在一度 token 的 话,最便宜的要八毛钱。那我给大家分享一下,市面上主流的 token 大 概是什么价格?就按照我们刚刚聊到的,一百万的 token 等于一度 token, 那像豆包的话,呃,一度 token 差不多是八毛。嗯, deepsea 在 一元左右,国外的像 chat 的 gpt 在 十五元一度,然后 gmini 更贵了,差不多要十八元,所以你看国内外的这个模型呢?嗯, token 价格其实相差还是蛮大的, 所以对于企业主户,我们个人玩家来说就很清晰了。如果你追求量大,很便宜的话,就用国内的大模型。如果你要处理一些复杂的任务,或者是一些专业度比较高的,你就优先选择国外的模型, chat 的 gpt 啊,然后 gmini 这些。 所以对大家来说,一旦我们开始计算 token 的 成本,那 ai 就 不再是管玩具了,而是真正的生产力的工具。 那我们企业在接入 ai 时,接入这些大模型的接口,嗯,就不是在跟他闲聊了,而是要把他真正用到业务里。比如说我们在 c d 行业,现在有一些企业对于一些基本的客服运维的问题,都已经接入了大模型,他可以随机的去切换业务或者是下发业务。那其他行业,比如说一键设计海报,或者是优化你的这个审稿、改稿文案这些,他 它的每一个优化的条件和建议,其实都是在背后在燃烧 token, 那 在今年的二零二六年已经不是在比谁的这个大模型大的年代,而是在比谁用最少的 token 设计出最佳的方案的时代。

什么?豆包也要收费了?就在大家还沉浸在五一假期的时候,豆包在 app store 悄悄更新了三档付费订阅声明,分别是,标准版六十八元一个月,加强版两百元一个月,专业版五百元一个月。 更离谱的是,专业版的包年标准价甚至一度被飙到了五千零八十八元。更戏剧性的是,当你亲自跑到豆包软件里去问他,你要收费了吗?他却脸不红心不跳的回答,放心,我永久免费。其实这背后的本质是,算力太贵了,张一鸣也烧不起。 截至今年三月,豆爆的日军偷更使用量已经突破了一百二十万亿。这意味着,他每多一次对话,背后的 gpu 集群就要真金白银的烧电。根据流传的成本核算显示,你的每次推力成本里,硬件折旧占了百分之五十八,电力成本占了百分之二十九。 现在豆包月活三点四五亿,换算下来就是一笔天价账单。你很难想象,自洁这两年的模型,巨震对标 g p t 五点二的 c d 二点零, pro 对 标 sora 的 c d 二点零。还有编程模型,它内部的能力其实已经能和国外一线掰手腕了。 免费版因为要控成本,上下文窗口和推理深度都压得很克制,所以你眼中的豆包长期停留在挺方便,但没那么强。而未来收费的这六十八元、两百元甚至五百元,很大程度上是在向重度用户展示,这才是真正的满血版算力。 但对于普通用户来说,其实不用焦虑,基础闲聊、文案拷写、信息查询这些功能依然是免费的。真正要收钱的,是那些极度消耗算力的场景,比如几个人合作用 ai 生成一部商业大片,一次深度的数据分析,或者让豆包给你做一个超级复杂的编程。 其实这场付费风波的背后,是我们终于学会用真金白银为技术进步买单,也提醒我们手里这些 ai 工具比我们想象的更值钱。

最新公布数据啊,豆包大模型日均的 token 使用量已经突破了一百二十万亿,这数字呢,在三个月前是六十万亿,三个月涨了一倍。那二零二四年五月,也就是不到两年前,这个数字呢,是现在的千分之一。一 百二十万亿什么概念呢?按照国内的主流模型,大约两亿四亿,一百万个 token 的 输入价格,两亿四亿完全不算贵,这意味着每天有三至五亿在 gpu 上燃烧,这里还不包括输出 token 的 价格,一年下来就是千亿级的输出, 相当于烧掉了网易的整一年的营收。这只是一家公司一个平台一天的量,所以他的一天的营收就超过了网易一年了。那全球日均 token 消耗量超过一百万亿的公司呢?只有三家,分别是 open ai、 google 和字节跳动。果然引擎的总裁呢,也毫不避讳说呢,这里面的增长说来自两方面,一个是 ai 视频制作的爆发, 一个是 ai 智能机,主要呢是以 open cloud 带来的这波行业的机会。再呢就是一个模型公司啊,要拥有这两个能力的话,基本上今年呢还是能吃的盆满钵满,就是分别是视频能力, 这是龙虾的模型能力。那字节 icloud 对 比传统 openclaw 还有什么优势呢?总来说也没啥区别。他们最近做了一个事呢,就是做了一个官方的 qhub 的 镜像,专门呢跟 openclaw 的 创始人 peter steinberg 和火山引擎呢共同做了一个宣发,那再加上它本身的平台的生态和飞书同步呢,也可以对接微信、钉钉、微博等, 所以呢,应该算是一个很有力的 openclaw 国内的一个竞争者,另外一个突破点呢,就是 cds 二点零,这样的二点零应该算是断档式的,领先市场上所有的视频模型, 全球的智能卫星的 sofia。 那 为了企业解决方案呢,火山引擎呢,也做了一些重要的安全护栏,包括肖像及版权的标准。因为前段时间 c d n s 呢,在海外有不少 ip 的 问题,被迪士尼啊,被好莱坞啊,也是给出了律师函, 所以这次呢,他干脆呢就彻底解决这问题,包括呢,输入内容的风险,版权风险拦截,包括了 nice, deep, fee 侵权这种问题的防范。除了火山引擎以外呢,类似的公司,比如说智浦,包括 kimi 跟 mini max。 今年呢,都是我自己的 clear plan, 抓住了这波 open cloud 在 国内的增长的这波流量的机会。从 从数据上来看呢,可能虽然不如字节,但是呢,今年的增速也很快,而且呢,绝大部分的关于 openclaw 的 增长呢,都是集中在国内市场,这个呢,跟消费量消耗第一第二的 openai 跟 google 是 完全不一样,他们的市场呢,主要全球是可想而知呢,中国的市场的规模是巨大的,而且 openclaw 直播机会呢,应该算是在现在国内觉醒。 最终总结下就是今年呢,虽然 ai 的 机会是百花齐放,但是有的增速会慢一点的,增速会很快。今年呢,对于模型公司是一个巨大的机会 的机会呢,集中在两个大的增长点上,一个是基于 opencloud, 是 人体的透光的消耗,另外一个就是类似于 cds 二点零这样的视频模型,在各个领域,包括短讯,包括宣传片,包括宣发和文旅,这领域的规模发展,抓住这两个机会,就能抓住今年的 ai 增长的经济闭幕。

豆包要收费了!近日,豆包官宣,在免费版本的基础上,推出付费订阅三个档的价格,分别是标准版六十八元每个月,加强版二百,专业版五百主打 ppt 生成、数据分析等复杂任务。官方强调,免费版呢,将继续保留日常使用不受影响。截 止到今年三月,豆包日均投坑使用量已经突破了一百二十万亿,三个月翻了一倍啊!就在同一天, tiffany 却反向了大降价,大模型定价的路线出现了明显的分化。 豆包的这步棋呢,表面是收费,本质呢,是给算力成本找一个可持续的出口。大中型运营多少钱啊?电力成本占到了六七成啊,一次复杂推理的电费就是普通搜索的几十倍,日军调用一百二十万亿头肯光伏器和电费就是天文数字,再不收费,再大的场啊,也扛不住。 但更值得反味的是时机和方式。豆包呢,没有一刀切全面收费,而是把免费的版本留住了,高级功能单开一周。这背后呢,是行在两难,谁都不敢轻易的赶走用户,但每个人都需要钱来叠代模型。 反观 deepsea, 走薄利多销的路线,把 a p i 价格呢,打到了每百万投分两分啊!两种模式啊,没有对错,但释放的信号是一致 的。免费跑马圈地的上半场已经结束了,比拼商业闭环的下半场已经开始了。对于普通用户来讲啊,六十八块钱买豆包的生产力提升,可能会比一杯咖啡啊更值。对于行业来说呢,收费也不是终点,而是良性循环的新起点。毕竟有钱呢,才能持续的搞好模型,好的模型呢,也才值得付费呀。

豆包开始收钱了,那天打开 app 说以后豆包分四种版本,有免费的,然后还有六十八的,还有两百的,五百的,我 第一反应就是跟所有人一样,又来割我这种韭菜了是吧?后来翻到一纸数据啊,我把骂人的这个话我就赶紧咽下去了。 截止今年三月份啊,豆包每天烧掉了滔看突破了一百二十万亿,那自己光今年 ai 算力就计划砸一千六百亿,内部传出话啊,说推利成本对于公司利润有压力, 你品一品啊,钻内消耗多么可怕,就连字节跳动这种体量的巨头都已经烧不起了。但是你注意看啊,他不是一刀切普通用户,你聊聊天问个问题啊,基础版继续免费去使用他也不敢,毕竟还有那么多竞品啊。石丹丹在那看着呢,他收的是谁的钱呢?实际上还是那批拿 ai 当真正的生产工具,拿它赚钱的人。毕竟你一 天烧的钻利啊,连普通人用一个月的帮忙分摊点电费不过分吧,更何况的是 q 的 g p t 早就这么干了,我们免费 费的到两百元一个月,然后再分了五个档。那问题来了,怎样是 ai? 为什么有的白送,有的几百,有的还要几百万?差距在哪?其实就是三样东西算力,我问一句天气,你让他分析一整年设备日制烧掉的算力不是一个量级啊,就拿我上个月帮一个外贸老板看 ai 客服 的方案,两万到六十万的报价铺了一桌,他说我怎么对比?我说你现在一天两三百条的询盘,两万块齐上就够 明年啊,你要播到东南亚拉美等等啊,一天两三千条,那套两万的三个月扛不住,光算力这一项啊,价格就差出了几十倍。第二就是数据, 免费的 ai 吃的是互联网大锅饭,但你企业用的 ai 啊,得吃你家厨房里的那锅饭,你们企业产线过去十年的数据,开饭时见都没见过,你平 什么去让他懂你了?还有一样啊,容易被忽略,如果你要用在企业上,你家有了 r、 p、 nice 等等这样的一对系统,一套 ai 进来跟他打招呼得能听懂看懂他们说话,不能单打独斗的。你看,这不是贵和便宜的区别,这是两样完全不同的东西。有一句话特别准,我以为免费的是福林,贵的是法拉利, 插在品牌意下。但是我现在知道了,免费的是一辆自行车,贵的是一台叉车,品种都不一样,你不能骑着自 车去叉钢圈吧?所以啊,收费不是 ai 在 倒退,是他终于敢告诉你,我这东西值这个价,而我的活就一件啊,帮你看明白你花的钱到底是自行车还是叉车,那张价格牌贴在哪?肯定还有人说啊,竟然付费,那国外那些 ai 是 不是更好?视频太长了,点个关注,我们下一次继续去说。

豆包五月四号公布了它这个订阅收费计划,它几个影响,第一个证明就是 token 确实越来越值钱啊,它不会一直所有都免费。那这个豆包呢?它这次订阅是在免费的基础上,就是现有的功能,它仍然给你免费的,它说的是 然后一些专业的功能,比如像 ppt 生成等等,它会有收费。我看它的价格其实还挺贵的,一年要大几百,甚至到大几千,二年订阅。那要想起去年,就是文心妍也是大概开始收费,然后开始一蹶不振。这个跟它这个文心妍模型本身能力也有一定关系啊,也不全是收费的问题, 但这里边还有一些细节,就是说呃,他收费,但是像呃元宝啊, deepsea 啊,包括这个千问呢,他可能甚至缉缉缉灭他,可能长远还是不收费,他用来抢用户, 也就是说用户在大模型终端这上面其实没有什么忠诚度的,你只要你收费,另外不收费,他我认为能接受,效果差一点他就跑,他会迁移,所以这个也不知道豆包会怎么应付。再一个是现在大模型这个流量入口还是蛮强大的,对软件行业影响特别大。 那怎么说呢?就是说他们收费对这个软件行业也是打击很大,因为他有入口在这,他随手方便可以做了,就非常非常方便,不像那些模型,嗯,不像,就是软件他要用这个用那个, 但是你不收费,对他影响也很大。也就是说现在软件行业其实被大模型这种,我说软,就那种工具类的软件, 那被这个大明星影响的真的是超级超级大,所以这这个不知道以后会怎么样,但至少 token 这个愈来愈值钱,就是以后这些软件做的基础工作都会换算成 token 这个数量,这个趋势应该是固定的。

我估计顶多一两年以后豆包绝对会收费。我现在才明白,其实豆包是亏钱的,比如你跟豆包对话就在消耗拓客本来应该收费, 只是现豆包在补贴而已,其背后的就是流量啊,他有点像中移动的那个流量费用电话费一样,这是个巨大的产业。拓客你可以理解为就是就。你问豆包明天深圳天气怎么样,十个字嘛,等于大概差不多就五个拓客,现在一百万个拓客才卖八块左右,但海外卖的贵 托肯,还有低级托肯,跟高级托肯他们价格差七八倍。我还以为说我说我问豆包这个消耗是低级托肯,他不,他这个是。呃,那个推理,这是消耗的高级托肯 其实很昂贵的,我一个朋友在广州,原来做算力设备的,最近他就在做托肯的中介,他就找很多那个云计算中心去采购这个托肯,然后再卖个腾讯,他还组建了个队伍去给工程师打电话,说我这里有便宜的托肯,因为现在那些大公司卖的贵,就是刚刚盈利第一个月,他说他能赚六十万。我仔细了解了一下, 这个确实是成立的,但我认为这属于巨头的生意,未来就属于那种大的云计算中心,大的托管工厂。因为托管又分种类,比如 deepsea 的 托管跟那个豆包的托管都不一样, kimi 也不一样,开源闭源也不一样,还有高级和低级差好多倍呢。但是我们俩这个趋势是在我第一 是听说他妈卖托可能挣钱,你买一台那个 b 三百的服务器,大概六百万一台,两年半就能收回成本,这个回报很高了好不好?这个托肯真的,我也正在研究,但我确实看到我周围这个小兄弟本来是亏损的,现在一个月他公司有四五十号人,第一次叫做到 卖托肯,一个月利润六十万。而中国托肯出海也是个大买卖,我现在我们是叫做跨境电商,把商品卖到全球去,未来就是卖托肯,因为中国是电力便宜啊。你看像那个智普的托肯吊链已经是排在全球第一了,全球大模型消耗托肯链,中国占六成,美国只占四成。 全球除了中美之外哪里还有大模型?你听说非洲什么日本啊,日韩啊,哪里搞出来这个大模型?我们已经习以为常了,但我在那些地方没人才, 也没有这个技术,说托肯出海是个好牛逼的生意,你不就是把无形的商品卖到全球去吗?哎,这是国家支持的,这跟那个挖那个什么比特币的矿还不一样。但托肯出海这个是好大的买卖,我最近也在看,在研究,我第一次看到有人倒卖托肯挣钱的。

一分钟啃 ai 商业瓜,今天聊豆包收费,豆包六十八块钱包月炸上热搜了,不少人骂他是割韭菜。事实真是如此吗?我们来算笔账吧。 行业估算, ai 单次推理硬件折旧占了百分之五十八,电力成本占百分之二十九,豆包日均偷啃量一百二十瓦以,背后是海量顶级芯片,二十四小时连轴正在烧钱。用经济学视角看,这就是典型的规模不经济了, 用户越多,偷啃消耗越大,亏损就越严重。三点四五亿越活。在传统的互联网是资产,放在 ai 赛道,那就是沉重的负债了。 其实,在豆包收费之前,整个行业已经进入求图困境了,大厂集体烧钱劝用户,却没有人敢提收费二字,谁先出手,谁就会被用户抛弃,直接跟流量说拜拜。可现在免费模式被打破,必然会引来连锁反应的 摩根时代力就直接定性了。这是国内 ai 行业从用户交易期直接迈向商业化阶段的关键节点。 接下来该对手们发愁了, deepsea、 千问元宝全都陷入死局,跟进收费抢不到用户咬牙免费,每秒要亏到几千块,难选啊!那么,如果所有的 ai 助理都收费,你会选择留下谁呢?

豆包要收费了,六十八块钱一个月,最高五百,一年要六千。先别急着骂我们,先来看一张单子啊。智普今年涨了三轮,腾讯云的 api 涨了四点六倍,阿里云的 ai 算力产品涨了最高百分之三十四。不只是豆包,整个行业都在涨价,为什么集体扛不住? 三个原因,每一个都跟算力有关。第一, token 消耗不是限性涨,是指数级的涨。以前大家用 ai 只是聊天一次几百个 token, 现在模型能力升级了,复杂任务越来越多, a 准应用当次任务消耗的 token 是 普通聊天的几十上百倍。国内一天 token 掉用量突破了一百四十万亿, 两年涨了十几倍,豆包三点四五亿的月货,每天就要烧掉一百二十万亿的头肯需求涨得比基建还快,永远追不上。第二,降成本的手段用了,但算力账还是不平,豆包自己也在拼命的降成本。火山引擎大会上公布数据, 豆爆二点零推理效率提升了百分之四十三,长上下文的首爆延迟比行业主流要低百分之二十五以上,但效率优化跑不过需求的膨胀,省下来的算力被模型升级带来的复杂任务消耗暴涨,一口吃掉了。 三、国产的算力还在铺路,还没有到完全接盘的时候, dipc v 四适配深腾已经做完了 flash 版本,每百万 token 只需要两分钱。但真正大规模地跑在国产算力上,要等到年底深腾的九五零超节点全面铺开。 现在国产芯片退利端能用了,但规模还不够大,成本还没有打到低版,等铺开了,退利成本还能往下再降一个数量级。所以你看免费的 ai 集体涨价,本质上不是哪家公司抠门了,是酸利攻击追不上拓客需求的膨胀速度。 用户愿意买单了,国产芯片才敢放心铺开。这也承接了上几期所说的 d p 跑。国产芯片不只是什么性能突破里程碑,是直接关系到我们手机上的 ai 能不能一直用得起。 说实话,大家不是不愿意给钱,效果好自然愿意掏钱,效果不行,一块钱都嫌贵。那一个月六十八块钱的豆包,你觉得值不值?什么情况下你愿意为 ai 付钱?评论区聊聊,我们下期见。

别再骂都不知道收费割韭菜了,六十八,二百五百三等静音刷屏,全看懂底层逻辑,你就知道是不是真的收费。我想说下我们自己的看法。首先第一呢, token 是 有成本,但是大多数人他都是没有概念, 大模型跟以前的互联网软件不是一回事,抖音微信他开发完之后边界成本其实接近于零。但是大模型是你每问一句话,他每次生成一次都是在烧算里。像我爸妈五十多岁了,但是特别爱用豆包,不会就问,想聊就聊,啥都去找豆包, 就在我看来,这就是高频奢侈的偷看消耗,但是他们完全没有感觉,因为免费的豆包看起来好像就是免费的聊天工具。第二呢,就是互联网那套,先免费养用户,然后户端再去变,现在大模型上 是安全的,以前免费用户你不怎么花钱,现在每一个免费用户都在持续的让你烧钱。比如说我有一个产品,它背后接的就是我的 oppo pro, 像以前都是大量的把人往死里靠,我现在更希望这些人是我的经纪人,因为我不想让他们去浪费我的投资。就是你把他理解,以前的互联网是把人先圈起来,然后再想办法去赚钱,但是现在大模型是先把成本先考虑住,然后我们才能活下去。第三呢,就是我愿意去为生产的欲望去买单, 而不是去为差不多的。在我看来啊, ai 时代所谓的这种拥护粘性,是看它能不能持续提高你的胜率。而肚包的尴尬的一个点就在它的拥护盘里,有大量的聊天娱乐型的人群, 根本不愿意付费,而愿意付费能把 ai 变成生产力的人,很早就有自己稳定的工具站了。我自己呢,就属于是长期用顶级的模型,每个月的会员费大概在三千多块钱,但为什么我舍了呢?因为顶级模型确实能给我解决它的一个工作场景的一些问题,能够给到一些八十多分 大家刺激点的,可能就是七十多分,差的不是那十分差的是我的时间和我的产出。所以说豆包的收费,它其实不是收工,而是在告诉市场,大模型它不是免费的玩具, 它是生产力的材料,你用它娱乐,那你就免费。你要是用它去赚钱,用它去干活,那你就是输钱。

五月八日,中国移动发布了一个叫 moma 的平台,接入超过三百款 aida 模型,一个 api 就能调用所有模型,秒即自动切换。然后他干了件让所有人都没想到的事情, token 套餐跟话费一起,支付宝微信话费余额直接扣。以前你交话费买的是通话分钟数和流量,以后你交话费买的还有 token。 运营商真的开始卖 ai 了,那么猫马平台做了什么?先搞清楚这个平台的逻辑,以前你想用 ai, 你得自己去注册 dipsake, 注册通易,注册豆包。每一个平台有一个账号,一套 api, 一套计价方式。 你是一个五十人的企业老板,你想让技术部对接三个大模型,光账号管理和账单核算就够头疼了。 moma 做的情况就是,一个入口,所有模型,只要你接入 moma, 一个 api, 背后三百多个模型随便调。 deepsic、 通用千万,豆包、 kimi、 grm, 还有中国移动自研的九天全在里面。你 你不需要知道哪个模型处理哪类任务最好。 moma 有个智能路由引擎,自动帮你匹配。你可以选择三种策略,成本优先,帮你选择最便宜的模型。效果优先,帮你选择能力最强的。均衡优先,在成本和效果之间找一个平衡。 而且如果某个模型突然超时或者故障了,平台秒机自动切换到另一个模型,你的业务不会被中断。你不需要懂任何一个大模型的技术细节,你只需要告诉他你要什么结果,他帮你调度整个 ai 世界。 但是为什么是运营商来做这件事?你可能会问,阿里云、腾讯云也做模型聚合类平台,为什么中国移动这件事特别值得关注? 有三个原因。第一,他有十亿用户的支付通道,你用阿里云的 api 要绑定企业支付,用腾讯云也要开通企业账户。中国移动呢?话费直接扣,全国十亿手机用户,每个人都有话费账户,偷看套餐跟话费一起交,支付门槛降到 零。江苏移动已经先试点了,五块钱二百五十万 tok, 二十块钱一千万 tok, 四十块钱两千万 tok, 上线不到一个月,日销量突破八亿 tok。 第二,他有全球最大算网基础设施,中国移动有全球最大的五 g 网络,遍布全国数据中心,海量的算力资源。他不是从零开始建设 ai 基础设施, 他是把已有的通信基础设施升级成了 ai 基础设施,网络负责连接,算力负责生产,模型负责转化, token 最终交付。第三,他在做 token 的标准化。中国移动联合阿里云、火山引擎、华为云等八家公司 成立了 token 应用生态联盟。这件事的意义不只是几家公司合作,他在推动 token 的计费标准化和结算标准化。这就像当年运营商统一了花费的计量和计费标准一样,他们现在要做的是统一 token 的标准,等标准统一了, token 真的像水电一样,可以全国通用,统一结算的 基础资源。那么这件事对你意味着什么?回想一下过去二十年运营商干的事,二 g 时代卖通话分钟数,三 g 时代开始卖流量,四 g 时代流量爆发了,催生了短视频直播、外卖、打车,每次运营商换货价都意味着一个新的产业爆发。现在运营商开始卖 tok 了,这意味着什么? 意味着 tok 的使用门槛降到了跟用流量一样低。以前你用 ai 得自己去研究哪家大模型号,怎么注册, api 怎么付费。以后你可能就像开流量套餐一样,打开手机营业厅,选择一个 tok 套餐,当月生效,花费里自动扣 四 g 流量套餐催生了抖音和美团。头肯套餐会催生什么呢?现在没人知道,但一定会有五块钱二百五十万头肯这个价格。你算算,二百五十万头肯相当于 ai 帮你写了近两百篇的一千字的文章。五块钱就是一瓶水的价格。当 ai 的使用成本降到一瓶水的价格,而且 且直接从你花费里扣,不需要任何额外操作。所有人都会开始用 ai, 不是因为他们想学 ai, 是因为用比不用更便宜。 二十年前交话费买通话分钟。十年前交话费买流量,以后交话费买 tok。 当运营商开始把 tok 当花费卖。说明一件事, tok 不再是科技圈的概念了, 正在变成十四亿人的日常消费。我一直说 token 是 ai 时代的水电,现在中国移动替我证实了,他真的要像水电一样,按月收费,统一计量,全国通用。我是文思,关注我,每天带你看懂 ai。

字节跳动开始宣布,啊,豆包开始正式收费了。其实很正常,这是典型的互联网打法,先免费的抢用户,形成壁垒再收费。当年的打车、外卖、社区团购都是这一套逻辑,前期疯狂的补贴烧钱抢用户, 等到用户形成规模,形成壁垒之后,再逐步的收费,甚至开始严重的冲沉。这一轮 ai 的 竞争,烧钱的速度比当年真的要猛太多了,训练、推理、算力都是以亿为单位的。数据显示啊, 我国每天消耗一百四十万亿托肯,两年增长一千四百倍,而豆包日均消耗一百二十万亿托肯,日均对话十八亿,日活一点四五亿。按照市场 api 的 价格,一天大概要三到五个亿, 字节的内部成本大概在五千万到一个亿,换算下来一年就要烧掉三百多亿,所以收费是情理之中的。还好,字节跳动承诺基础版永久免费。以下是字节跳动的会员价格体系, 但别以为这只是一个软件的收费,这是所有人被 ai 分 层的开始,如果把 ai 当成生产地,现在的人已经被分成四个等级了。第一类, s 级玩家,他们用 ai 不 只是问答,是直接干活,他们有工作流,有知识库, ai 可以 帮他们直接执行,甚至做到二十四小时的输出。第二类, a 级玩家, 能够稳定的使用顶级的 ai 工具,把自己的想法变成产品,开始落地,开始放大自己。第三类, b 级玩家,会用 ai, 比如豆包、 deepsafe 这些,但只是会查资料,写内容,没有流程,没有体系, ai 对 他们来说只是一个工具而已。 第四类, c 级玩家,他们还没有开始用 ai, 还在观望,甚至开始排斥,觉得 ai 只是智商税,表面上是工具使用的差距,但往深一层去想,你会发现本质上不是工具的差距,是使用方式的差距。 同样是 ai, 有 的人已经会做执行,会做产品,会放大自己,结果有的人只会聊天辅助甚至打发时间。工具是一样的,但结果完全不一样。所以,一年五千块年费的豆包,你会使用吗?打在评论区。

最近豆包也扛不住了,日烧一百二十万亿,头肯免费, ai 终于开始收费了。五月四号,豆包在 app store 悄然更新了付费方案,直接上了热搜,三档标准版、加强版、专业版,最贵的一年要大几千。评论区直接炸了,豆包笨,还收费,冲上了热搜第一。 你知道豆包每天烧多少 token 吗?一百二十万亿,三个月前还是六十万亿,直接翻了一倍。每一个免费用户背后都是自己在倒贴算力。你说他不想免费吗?他是烧不起了。不光是豆包,你看 open i 已经在接广告了,国 国内其他大模型也在陆续收载。免费额度本质就一句话,透支越来越贵,免费的午餐已经吃完了,谁先完成收费闭环,谁就能把算利投给真正有需求的用户。对普通用户来说,聊聊天够用了,免费版照样能用。但对企业合作项目的人来说,透支成本正在变成一笔 不得不算的账。怎么用,用多少,怎么降本?这些很多人还没有想过。如果你也在用透支做业务,可以评论区聊一聊。

收包的话呢,开始收费了,这个其实是早晚的事,就是早就能预知的到,但是呢,为什么很多人很惊讶,就明明像那些卡尔的 gdp, 这些 ai 模型的话呢,它也收费,但是呢,并没有见多少人会 抵触这件事情。那首先的话呢, ai 收费的话,它是一个正常且合理的一个现象,这和传统的互联网的软件都不太一样 啊。 ai 的 话呢,它是需要消耗 token 吗?那它的成本是用的越多,它花钱越多,它不像传统的互联网软件,比如说像微信、抖音啊这些普通的 app 一 样,它们的一亿用户和十亿用户的话呢,这些服务器成本差不了,只靠广告的话呢,基本上就可以回本了。 那为什么豆包的话呢,一开始不收费,让大家玩两年之后的话呢?现在收费了。那第一点的话呢,其实大家都知道吗?就是拉用户吗?对吧?先让用户量变多,把用户规模给建设起来,然后呢,这些都是互联网的一些老套路了。那第二点的话呢,其实就是 每次和豆包聊天的时候,其实我们都是在训练,他就通过我们的对话,通过我们大家对话,其实都是在帮他数据练模型,所以说他不收费,用他的人其实就在帮他免费练模型。那么 我们回到刚开始那个问题,大家都很惊讶和抵触豆包收费这件事情,觉得豆包笨不聪明。那么什么人群会为 ai 模型买单?比如说像 啊卡奥德啊、金德啊、 g t 这些世界三巨头的 ai, 大家都很乐意去花钱买单,真的只是因为豆包很笨吗?呃,其实的话呢,豆包人群和其他的这些 ai 模型的人群不太一样,现在基本上都谁在用豆包,你可以想一下,比如说普通人,对吧?就用来呃,问问日常那些问题, 就聊聊天什么的,还像小孩子嘛,用用豆包玩的,打电话,打视频玩的,还有像我们的老一辈,可能我们的父母啊,甚至爷爷奶奶都会去用豆包去问一些生活中那些常识性的问题等等等等, 就他已经像是一个什么全民的 app 了,就而且大多数的作用其实都我们都发现了,他只用来回答一些日常的一些问题,就写写文案,打打电话,闲聊,这样子,那 你会发现更多的其实还是用来聊一些日常生活东西,把它当一个聊天玩具来用。 那么只要这些人他不拿豆包赚钱的话,带来不了多大的收益,那自然是不愿意去买单的。那什么人他会去买单呢?肯定是那些真正拿 ai 赚钱的,真正需要拿 ai 赚钱,拿 ai 提效的人群, 充个会员对吧?你带来的收益是翻倍的,成本是提高的,是完全值得的。那那么就会有个问题,这些人他们肯定就会想着我既然花钱了,对吧?那我为什么不去用 cloud, 用基本软件 gpt, 用一些更聪明更专业的 ai, 我 觉得你豆包干嘛 对不对?那而且这次豆包的收费确实还不低,确实还不低,所以 ai 模型的话呢,该赚谁的钱? 赚的就是那些真正把 tiktok 变成生产力的人的钱,或者说公司的钱。那对于这些人来讲的话呢?比如说五十块钱的 tiktok 成本,那他能给我带来什么的?几千块几万块的甚至更高的价值。但是呢,对于普通人来说的话, 五十块 tiktok 只能带来,可能只能带来一两百,甚至就没有实际的价值,只娱乐一下而已。那所以 干嘛呢?只有那些能持续用 ai, 用 token 来持续创造价值的人,才会愿意去持续的付费。 所以多包尴尬的地方就在于,他的用户群体大多数都用来娱乐,用来解决日常生活的一些普通用户。那些用来真正创造价值的人,他则会去选择干嘛,选择国外更聪明更专业的 ai。