今儿一大早起来发现小米的大模型 memo 也降价了,降得也挺狠,几乎赶得上 dexip 了,号称也是用了什么缓存优化技术,具体细节我还没有看,从这个角度看的话挺可怕的。大家降价幅度这么狠,首先我们要排除它是亏本销售的,这个很难的,因为成本压力太大, token 消耗应该 费用是很高的。那我们就要看真的是缓存优化技术什么的,还开始这种注意力缓存优化技术给搞的。那 我们要注意两个问题,第一,卖透肯这个生意可能不是那么好性感了,可能要作为议价贴到其他的设备上。第二,呢个行业需要去观察,如果真的卖透肯这个事情已经做到了价格战。这种情况下 也有两个可能性,一,一个是说需求增长已经到头了。其次就是说现有的 skinning law 远远还没到头, 这种工程的优化带来的成本下降是非常厉害的,这种成本下降很可能会大规模的冲击现在硬件端的 定价权,怎么能便宜这么多呢?我还是没想明白。昨天晚上刚感感慨了 ds, 今天 mimo 又来了,这个 mimo 确实好用啊,大家琢磨一下,如果真的向上冲击到了供应链的话,那影响可能会很大, 告辞。补两句说中国能做到这么低成本,老外会不会做到?我觉得会,中国敢这么降价,老外会不会降?比如 openai 和 astrafig, 觉得不会,因为你在需求稳定的情况下,资本主义国家是 不可能率先降价的,他们会先获取充足的利润,再会谈商业模式的变化,中国本身就是这几个模型厂商本身就是落后的,而且从 d s 之前的玩法来讲的话,他不会追求高毛利,这是一个很理想主义的行为, 所以即便是有技术进步的情况下,外国也不会降,但是呢,凡有一点点小进步,中国模型厂商也会降, 这个在历史上不是第一次了。 d s 曾经连续多次降价,把行业的价格都打串了,所以这次 d s 低成本销售,咪某跟他降,我觉得一定是技术上有突破,而且在第一时间 把这种技术突破落地到了销售的策略变化上了。补一句,按照这种逻辑的话,云厂商迈拓肯也不是那么性感了,有那种分成的模式,比如不比如了。
粉丝202获赞5094

我真的服了小米米某这个积分啊真的很虚,这两天我实际大约消耗了八千多万的 token, 但是积分已经消耗掉了二十二个亿,简单计算一下,积分大约是 token 的 二十六倍, 况且这是在大量缓存命中的情况下得出的。那么标准套餐虽然给到了一百一十亿的积分,换算下来也不过四个亿左右的 token, 照比之前两亿积分对一亿左右的 token 实际涨幅也有三倍左右。小米你真的有必要整这么唬人的数字吗?难道只是营销大于实际吗啊。

兄弟们,跟你们说个事情哈,昨天看到小米 mayo v 二点五降价,脑子一热就充了最便宜的四十块套餐,想着四十一亿 credits 怎么都够造的对吧? 其实到现在为止,我也就用了六七个小时,已经用掉百分之四十多了,你以为我干了啥大工程呢?其实就是让他读了个 github 仓库的代码,再扫了扫我电脑里的文件,就这点事,照这速度估计也就够用两天。所以打算入这个套餐的朋友注意下消耗速度啊,太惨爆了!

这次小米米墨的新 token 盘,最容易让人误会的是单位你看到的四点一币,不是四点一币 token, 而是 credits。 真正能跑多少,要看你用哪个模型,以及这段 token 是 缓存命中未命中输入还是输出。 按官方文档约度,套餐分四档, lite 是 三十九元四点一 b 酷热 ipad standard 是 九十九元十一 b gridadius pro 是 三百二十九元三十八 b gridadius max 是 六百五十九元八十二 b gridadius。 表面看很大,但要继续往下换算, 真正的计费公式在这里,它 movie 二点五 pro, 每个缓存命中 token 扣二点五 credits, 未命中输入 token 扣三百 credits, 输出 token 扣六百 credits。 普通迷迷模糊二点五跟 d 分 别是二一百和二百 credits。 官方给了一个很好懂的例子,如果你买那一套餐,一共有四点一 bp 转一次,你用掉十 m 的 迷蒙 mo, 二点五 pro 未命中输入 token, 就 会消耗三千元回资,剩下的额度就只有一千一百元回资。 所以官方说用量提升五到八倍,并不等于任何场景都无脑多五到八倍缓存命中多输入能赋用输出,别太爆情感就会更划算。如果你是涨让五 d 缓存输出很多,那科技消耗会快很多。 还有一个边界要看清, token plan 是 面向 i 编程工具的订阅方案,不是给你随便接近自定义后端做自动化脚本的普通 api 套餐额度用完后系统会停止服务,不会继续扣你的赠金或账户余额。 最后给一个买钱判断,第一,你是不是主要拿它跑客厅工具?第二,你的任务缓存命中高不高?第三,你的输出 token 会不会很多?把这三件事算清楚,才能判断 token 盘是真便宜还是你应该继续走普通暗恋 a p i。

小咪咪陌的 token plan 很多人把一个东西搞混了,你打开 token plan 的 页面,看到一个很大的数字,觉得自己额度好几千万,好几个亿,用一句话就花了六千万 token, 太吓人了。其实不是那个数字,不是 token, 是 credits。 我 看到有个评论说他问了一句话就消耗了六千万 token, 才实际上 他看到那个数字是 cranks, 不是 joker。 你 把页面往下翻,翻到用量明细那里,才能看到真正的 top 消耗。这两东西差多少呢?差距非常大。我自己做了一个称,是我只打了一句话, call 头的街道密莫模型上他自动跑了我本地的知识库文件,就这一下消耗了八千零八十二万 cranks。 听起来很夸张对吧?但实际的 token 消耗是多少呢?两百三十七万 token, 八千万 cash 对 应两百三十七万 token, 差了三十多倍。 按照小米九十九块钱月卡的价格算,这两百三十七万 token 的 实际开销是六毛四对,零点六四元。一句话总结,看到大数字别慌,先搞清楚那个数字的单位是什么。 cash 不是 token, 差了几十倍。

最近很多人在吹小米的咪某大模型,因为它降价,而且号称最高降到百分之九十九,然后我没忍住,然后我也没忍住,充了个最低档的 talking play, 写的是四十一亿,我以为是四十一亿 talking 只需要四十块钱,但是后来我发现它这四十一亿不是 talking。 那 在这可以看到它的连续包月的话呢,最便宜的版本呢?它是三十九块钱。首先我昨天呢用了四亿四点一,除以个它总量是四十一,对吧?等于我用了百分之十乘以 三十九,对吧?因为相当于我昨天花了三块九,对吧?那三块九他给了我多少的 tokin 量呢?哎,在这也有记录,那昨天我的 tokin 消耗量是两千九百万,也就是两千九百万对应多少钱呢?对应三块九,三块九除以二点九, 这样好算账一点。那这样就可以算出来小米的这个 pro 版的模型呢?它的一千万 tokin 是 要一块三毛四,这这个价格整体来讲我觉得确实不贵,但是真的会有误导, 因为你为什么这个地方它不能直接显示 token 量,而是非要去转化一个其他的数值来去换算 token? 我 觉得现在很多的大模型都走这种很扯淡的路线, 那你直接告诉我用了多少就是多少,对于消费者来讲它是非常清晰的,但是你非要把 token 量变成一个被放大了十倍的值,这时候我觉得它从商业策略上它其实都带了一点点 往那个方向引导的感觉,就好像让你感觉到啊,你花四十块钱买了四十亿 tok, 我 dipstick 前段时间使用量也很大,你看我这一天的话, dipstick 用了是十八块钱,然后呢,其中 v 四 pro 用了十块零八毛,用了一个亿多一点点的 tokken, 那 像这个 v 四 pro 你 可以算吧,十块钱等于一个亿,那也就一块钱等于一千万的 tokken。 然后如果我用这个 v 四便宜的这个版本呢,可以看到我昨天呢是用了三块三毛四,然后 它对应的一个用量是六千四百万,也就是相当于是五毛钱一千万的 token。 所以 综合看来的话,其实我更喜欢 deepsafe 的 这种后台显示方式,就是你用了多少量就是多少量,你也别给我扯淡,你显示其他的都多余,因为你根本还是在消耗 token。 我 不知道你们能不能认可我的这个观点,所以这样对比下来啊,我觉得小米的这个模型,从现在目前 国产的一众模型里面来看,它确实是便宜,但是和 deepsea 来讲的话呢,哎,它多了个多模态,其实还是多加了一点钱的。然后今天呢,我看了一个新闻,说 deepsea 的 多模态的模型的话呢,可能六月份也要上了,那如果是在现在这个定价的基础上加量不加价的话,那我觉得 deepsea, 哎,还是永远的神。

啪啪打脸啊兄弟们,前段时间我还说了 token 焦虑,什么小米 vivo token 本来用的很快啊,还有什么 cloud codex 套餐很贵啊,我还说什么 token 可能越来越贵,我,啊, 怕怕打脸。就在这两晚,小米突然之间他就降价了,他别人降价都是打五折打几折他,他降价最多百分之九十九,并且他还重置了我的三兆套餐,我之前是两个亿的套餐,现在我有多少?现在, 现在有一百一十个亿,一百一十亿 crazy, 太疯狂了,兄弟们,太疯狂了!现在属于 token 的 价格战已经打响,兄弟们。

小米刚发布了二零二六年一季度的财报,九百九十一亿的营收,六十一亿的净利润,汽车八万台,研发九十亿,可以说是经营稳健向前啊。不过如果你最近关注小米港股的话,我相信你应该也会知道,就是小米从去年六月六十一港币的高点跌到现在,可以说是腰斩了。就一家公司,为什么他季度赚了六十一亿,但是股价会跌成这个样子? 为什么有的公司他常年亏损,但是股价照常能起飞?这两者之间到底是什么关系?首先呢,我们来说股价和财报啊,股票价格从来就不是给上一份财报来打分的,而是给公司下一段故事来进行估值的。 市场看的呢,是预期,而不是现在的结果。一家公司财报漂亮,但未来的故事黯淡,那股价会照样跌,一家公司财报亏损,哎,但他的故事依然充满想象,那股价就照样涨。那小米呢,现在其实处于一个相对尴尬的时期, 财报数字本身还说的过去,但市场原本期待他讲那个故事,现在呢,就需要更多时间来兑换。所以读懂这份财报呢,重点不在于数字本身啊,而在于小米哪几块业务是投了钱但还没有回报的窗口期,哪些是之前比较稳,但现在又不急预期了。 首先我们来看啊,九百九十一亿的营收,那去年同期呢,是一千一百一十一,利润是六十一亿啊,对,去年同期是一百零七亿,同比掉了百分之 十三,营收和利润双双下降。上一次小米出现这种情况呢,还得是二零二二年第四季度啊,会出现这个现象,和手机市场的表现啊关系非常大。小米手机毛利率二零二三年的时候呢,还有百分之十 四点六,二零二四年是百分之十二点六,到了二零二五年第四季度就直接掉到了八点三,那这一季度靠均价上涨了百分之八点二,估算的利润呢?回到了九到十个点。 手机毛利率下降原因呢,很多人都比较清楚,就是 ai 把这个内存抢走了,卢伟兵在三月的年报会上呢,把这一轮存储涨价定性为了长周期大涨幅比预判还要激进。 成本上涨就导致了这个售价上涨,售价上涨就导致了销量啊,自然跟着下降。小米全球出货同比下降了百分之十九,中国市场掉的更狠啊, 家机构口径都调到了下降百分之三十五左右。手机说完了呢,汽车呢? q 一 小米汽车交付了八万台,跟去年第四季度的十四万台一比啊,也是环比掉了快一半。但呢,这个不是产的问题啊,首先是一月份啊,新能源购置税退坡,春节也是传统的淡季,外加这一次苏七 在换代期。所以说 q 一 啊,小米汽车销量的数字下滑其实也合理啊,这点我觉得是要理性看待的。那小米汽车 q 一 的均价估算在二十三点七万,比去年第四季度二十五万少了一万多,毛利率呢,从百分之二十二点七一估算回落到了百分之二十左右啊,但这个数字放在整个汽车行业仍然是同步水平。 如果只看这两块呢,这是一份手机承压加汽车换代的财报,小米这一季度其实还做了另一件大动作,就是研发九十亿,同比增长了百分之三十三点四,全年预算投入四百亿,未来三年 ai 投入就要六百个亿, 这是个挺关键的信号啊。这个操劳就属于小米,用现在的利润换 ai 这张更长期的牌。小米的 mini 二点五 pro 这个模型数据还比较漂亮,并且小米呢,也挖来了罗浮丽这种人才。但卢伟兵三月份的年报会上也说了啊,单纯从 ai 的 商业化角度来看,目前的阶段为时尚早。 张云国际算过啊,二零二五年第四季度,小米 ai 加汽车的运营费用就同比上涨了百分之五点九。这个就是我前面说的啊,小米当下比较尴尬的一个位置, 投入看得见,但兑现却需要时间,中间这段窗口期,市场的估值就要先成压,这可能也是小米财报和估价比较割裂的原因所在。那站在不同身份的人该怎么看这份财报呢?哎,如果你是米黑的话,那小米股价短期内确实是很难找回巅峰期,下一个爆发还正经得等一等。 如果你是米粉的话,这份财报告诉了你,小米现在还在加大研发, ai 这张牌已经开始打了,只不过短期内啊,别把嫉妒的财报当成生死状,需要一些耐心。那如果呢?你是一个真正关注小米这家公司本身的人呢?那要看的则是三件事,第一个就是存储涨价到底什么时候见顶, 这个对于小米手机来说非常关键。然后呢,就是汽车毛利率能不能一直稳住在二十个点,毕竟小米预期标准版也出了,而且它必然是走量大头。第三呢,就是咪某这套 ai 体系什么时候能开始正经的商业化变现?这个可能是小米下一个业务比较大的一个增长点,大家伙你怎么看?

不是雷军雷总你半夜不睡觉的吗?啊,凌晨发了一个公告,小米的掏坑拍来重置了。 我的这个之前是十六亿的额度,一觉醒来直接给我干成。这是多少?八百二十亿啊, 不过还没有我的余额多啊,用不完,根本用不完。并且呢,小米的 mini v 二点五 pro 的 模型直接降价啊,最高降幅百分之九十九。 看来它这个策略是完全为了应对那个 deepsea 啊,你们就猛猛竞争吧,让我们早日都用上那一个好用便宜超大碗的模型。

先说结论,小米 miimo 确实降价了,而且降的不少,但降幅百分之九十九这个说法,咱们得打个问号,因为没人知道它原来到底卖多少钱。 credit 是 怎么回事? 小米搞了个中间层,叫 credit, 你 先买套餐,比如三十九元,一个月给你六千万个 credit, 然后用的时候按 credit 扣。降价之前, pro 模型要扣两个 credit, 长文本甚至要扣四个。 降价之后,小米说取消了四倍 credit 的 计费方式,但具体 pro 模型现在是扣一个还是两个,官方没说清楚, 直接看价格更实在。小米公布了 token 价格,输入缓存命中零点零二五元每百万 token 输入缓存为命中三元每百万, token 输出六元每百万 token 输入只要两分五厘钱就能买一百万个 token。 和 deep seek 比怎么样?巧了, deep seek v 四 pro 的 价格完全一样。小米这是明摆着对标 deep seek, 价格完全对齐, 那到底降了多少?小米说最高降幅百分之九十九,如果这是真的,那原来 pro 模型的输出价格应该是六百元每百万 to 肯左右。 但问题是小米从来没公布过原来的官方价格表,所以百分之九十九降幅这个数字只能信一半。 普通人该怎么选?如果你追求简单透明,小米和 dipsic 价格一样,选哪个都行。如果你担心被套路,别买套餐,直接按量付费,这样就是明确的价格,没有 credit 换算的弯弯绕。 最终结论,小米 mimo 降价是真的,价格也确实便宜,但降幅百分之九十九的宣传,因为缺乏原价数据,没法完全验证,和 dipsic 比价格完全一样。 credit 机制有没有猫腻?官方没把降价后的换算比例说清楚,这是个隐患。

五月二十七日,小米宣布 mini v 二点五系列 api 永久降价,最高降幅高达百分之九十九,并且不再区分上下文窗口长度。小米 mini 负责人罗福利随后发文揭秘了降价的技术底气,其 推理框架新增了针对所有的分层 k v 缓存优化,这项优化让缓存托克容量提升了五倍,相当于降低了百分之八十的缓存成本。同时,得益于模型架构中极端的一比七稀疏比例, 小米将原始推理成本压到了远低于行业平均水平,从而把结构性成本红利直接让渡给开发者。目前,在最新定价下,小米的生产推理引擎已接近满负荷运行,但依然能够维持数值平衡。官方也表示,只有底层架构优化跟上,才能避免流血降价。这次降价不仅打破了成本底线, 更意味着大模型正通过极致的推理优化到 b 底层 ai 硬件价值重估平价算力,将真正引爆全球规模化的推理应用需求。

原本两亿的筹款,现在直接变成一百一十亿,还有三十二亿的补偿基分根本用不完! deepsea 宣布降价之后,小米的 mini 模型也宣布了永久降价,原本订阅用量提升到了原来的五到八倍,在今天零点正式生效,并且原有订阅的额度也全部重置刷新 上个月申请了雷总的免费 token 的 兄弟们,可以直接在订阅里面一分钱续费一个月。逻辑是这样的, miimo 的 套餐续费会重置这个月的账单日期直接重新算到下个月的。今天 本月没用完的积分可以折算抵扣下个月续费的价格。但是今天额度重置后,就是完全百分百的抵扣,而首月开通又有七七折的优惠,这导致雷总还欠你中间百分之二十三的差价。于是雷总不仅让你零点零一续费,还把这欠你的差价换成补偿积分,加到你下个月套餐里面。 开启自动续费后,扣零点零一即可续费。下个月一定要记得马上关闭自动续费,防止被返号。然后不要点第二次重新续费,这会取消补偿积分。原本两亿的扣款,现在直接变成一百一十亿,还有三十二亿的补偿积分,根本用不完!

小米 miimo v 二点五大降价百分之九十九,很多大聪明的反应是,不就是降价吗?别家也能做啊?错!真正恐怖的地方,从来不是能不能做,而是敢不敢做!这才是这件事最炸裂的核心。 g l m kimi、 千万豆包这些大模型理论上能不能做缓存优化呢?当然能,甚至我怀疑很多公司可能早早就偷偷做了。为什么? 因为缓存优化这个东西,本质上就是把 ai 已经算过的内容缓存起来,下次再有人问类似的问题,直接读缓存。 那么以前 ai 每次回答问题都想重新做一遍高考数学卷,现在变了,这题老子做过了,直接抄答案,成本一下就暴跌,尤其是配合 ssd 缓存以后,显存的压力会下降的非常夸张。而显存才是一个 ai 公司最贵的东西。 所以问题来了,如果大家理论上都能做,为什么行业价格一直没有崩呢?那是因为没人敢。 你发现没有,现在很多 ai 公司表面上在卷模型能力,实际上拼的是什么?拼的是融资,拼的是利润,拼的是资本。故事 谁都知道价格还能降,但谁都不想第一个动刀,因为一旦有人掀桌子,整个行业的利润都会血崩。结果小米干了什么?别人偷偷优化,小米就直接公开砍价,这才是最狠的地方。 最离谱的是,他现在几乎做到同 deepsea 同价,同样 e m 的 上下文,而且他还有多模态,大家知道这基本上相当于 deepsea 四点一提前发布了。老铁 为什么这么说?因为过去大家一直以为 deepx 这么便宜,是因为他技术带差太大,别人短时间根本追不上,结果现在小米告诉行业不一定哦,别人可能也能做到,只是很多人不愿意降价而已, 因为他直接把整个 ai 行业的底库掀了。原来很多公司的护城河可能根本就不是技术,而是大家默契的维持高价。而小米最恐怖的地方是什么? 不是模型,不是论文,不是参数,他最擅长干一件事,那就是价格战。手机行业他这么干过,家电行业也这么干过,那汽车行业呢?他也在这么干。现在终于轮到 ai 了, 以后 ai 行业最可怕的事情呢,可能不是哪个模型更聪明,而是谁先把 ai 做成白菜价。因为当 ai 成本下降十倍的时候,变化的不是利润,而是整个世界的使用习惯。以前大家问一句 ai 嫌贵 以后可能默认全程挂着 ai, 那 时候真正难受的不是技术差的公司,而是成本明明已经降下来了,却还不敢降价的公司。兄弟们,你们觉得呢?

五月二十六号,小米发了二零二六年一季度财报,营收九百九十一亿,但利润大幅下滑。同一天,雷军宣布未来三年在 ai 上砸六百亿。 五月二十七号凌晨,小米 mimo 大 模型降价,最高降百分之九十九。一边是利润在掉,一边是六百亿砸下去,一边是 api 价格砍到地板。这三件事连在一起,才能看懂雷军到底要干什么。先说降价本身, m i m o v 二点五 pro 降价后缓存命中,每百万 token 零点零二五元,输出六元,什么感觉呢?一个程序员用 ai 辅助写一整天代码,可能就花几毛钱,搁去年,这个数字得成个几十倍。但这只是表面,真正狠的是另外两刀。第一刀砍掉了上下文,分段计价。 以前你跟 ai 聊天聊得越久,它越贵,因为它每轮都要把前面说过的话重新算一遍钱。一个写代码的 agent 跑一下午,上下文越滚越长,你的账单就跟着越滚越大。现在小米把这套规则废了,统一价,不管聊多长。第二刀, token 套餐用量直接翻五到八倍, 老用户额度全额重置,等于你之前买的套餐。小米按新规矩给你重新算了一遍,还往多了算,这两刀下去不是打折,是把计费体系拆了重建。然后看时间。五月二十二号, deepsea 宣布 v 四 pro 永久降价,价格铆定,原价四分之一,五月二十七号,小米跟上,五天之内,两家先后永久降价。你要是还觉得这是巧合, 那你就没看懂这个行业正在发生什么。去年大家比跑分比谁模型更聪明,今年不比了,或者说比不出太大差距了。 国内头部的几家模型,在绝大多数日常场景下已经难分高下。你让普通用户盲测,十个有九个分不清,那既然分不出胜负,竞争就转移到下一个战场,谁更便宜? 这不是主动选的,是被迫的。大家能力差不多,价格就是最直接的武器。再来想一个问题,小米凭什么敢这么降?赔本赚吆喝谁都行。小米团队给了一个技术解释,他们用了新的推力架构 k v 缓存,传输量降到了原来的七分之一, 可缓存的 token 量多了将近五倍。翻译成人话就是硬件还是那套硬件,但软件优化让同样的算力能服务更多请求,单次调用的成本却是降下来了。但这只是技术层面,更重要的底气来自别的地方。小米不是一家靠卖 api 赚钱的公司,它有手机, 一季度还在出货。它有汽车溯期,首年交了十三万辆,累计六十五万辆。它有十亿台 iot 设备铺在用户家里。大模型对小米来说,不是一个独立的产品线,而是给人撤家全生态装大脑的底层能力。 api 卖多少钱,对小米的生死没有影响, 但对那些只做模型、只靠 api 收费的创业公司来说,这就是灭顶之灾。你卖一块钱,我一毛钱,你亏不起, 我亏得起,因为我的钱从手机和汽车那边来。这才是降价的真正杀伤力。它不是在跟 deepsea 打价格战,它是在用整个集团的利润池补贴一条新战线。受伤最重的是中间层的模型公司,你既没有小米的硬件生态做后盾,又没有 deepsea 的 极简架构带来的超低成本, 你拿什么跟?二零二四年,已经有智普、百川能厂商被迫跟着降价,降幅超过百分之九十。二零二五年继续洗,中小模型公司陆续退场。 e o 智库的预判是,到二零二七年,到二零二八年,通用大模型市场会变成三到五家寡头格局。现在二零二六年五月,我们正在经历的就是这个初侵过程最猛烈的一段,受益的是开发者,以前只有大公司跑得起的 ai agent, 自动编码,长上下文推理, 现在小团队也跑得起了。一块钱能买到三本三国演义字数的 ai 调用,这是字节跳动豆包的定价,小米和 deepsea 的 价格跟这个同一量级, 而这反过来又会让 ai 应用的爆发提前到来。当调用成本不再是一道门槛,该出现的东西就会出现了。就像四 g 流量降到白菜价之后,短视频才真正爆发。 不是因为之前没人想拍短视频,是因为拍得起,传不起,最后收回。雷军五月二十六号宣布六百亿 ai 投入, 五月二十七号,大模型降价百分之九十九,这两步之间的逻辑是连贯的。六百亿不是用来养一个模型的,是用来建一条 ai 基础设施的。你先把路修好,把过路费降到最低,让所有开发者都走你的路,然后再在路两边做生意。手机上 mimo 已经集成到小爱同学、小米浏览器、金山办公里、 汽车上车机系统需要大模型做云交互和智能推荐,家里十亿台 iot 设备等着被 ai 重新激活。雷军赌的是未来 ai 的 价值不在模型本身,而在模型跟硬件,跟场景,跟用户绑在一起的那个闭环。 模型本身可以不赚钱,但闭环里面的每一环都赚钱。这套打法小米在手机上玩过一回, 二零一一年小米一卖一九九九,同配置的别人卖四千,硬件不赚钱,甚至亏钱,靠 m i u i 的 互联网服务把钱赚回来。现在雷军把同样的逻辑搬到 ai 上,模型便宜甚至免费, 靠人车加生态把钱赚回来。十四年前的套路,十四年后再拿出来用。不一样的是,这回对手不是中华库联,是整个中国大模型行业,而这一次,他手里有六百亿。看到这的咱们,希望能点个关注和收藏,随时分享新内容。

小米这次是真的不讲武德,就在昨晚, mimo v 二点五系列官宣永久降价,最高降幅高达百分之九十九。以前小米 mimo 其实是国产里的最贵那档,但效果硬核,全球开元榜单都拿过第一。现在它不仅没飘,反而把价格砍到了地板。全面对标 deepsix, 这背后更是实打实的技术底 气。通过底层推理优化缓存, token 数量提升五倍,数据搬运量压到原来的七分之一。这意味着以前两天烧光的 token, 现在掉用量暴涨五到八倍。三十九元的入门党,直接给四 十一亿额度,历史付费用户额度,甚至直接白送重置雷军未来三年要在 ai 砸下六百亿,小米根本不指望靠卖 a p i 赚钱,而是要把 mimo 变成水电煤一样的基础设施,用极致性价比把 ai 灌进十亿级的人车加生态里,用软件让利,换取生态统治力。

大模型圈子里,小米密谋是个很拧博的存在,参数漂亮,跑分能打。今年三月在 open root 上靠免费策略冲的特别猛,一度登顶周榜单,周 token 消耗超过三万亿,但免费期一过,排名立刻变脸,不到一个月就从榜首掉到了第九。 再看 arina 点 ai 的 综合盲测,四月七日那周,小米排在第三十五位,这个榜单没有品牌干扰,模型全匿名,全靠真实用户投票。三十五名的排位,很客观的反映了他在真实体验层面和国际主流模型的差距。这就回到了小米这家公司的老问题。从手机到汽车,他有一套贯穿始终的打法, 在供应链成熟后进入整合最好的零件,用最低的成本讲最响的故事。手机时代,高通芯片、三星屏幕、安卓系统全是现成的,它不需要死磕核心技术,要做的就是整合。汽车也是。速七卖的不错,不是因为技术多强,是因为成熟供应链的地板已经很高了。 这套打法我称之为快消品。逻辑强,营销弱产品,产品本身不够强,就在包装上找卖点, 品牌趋势、参数,轰炸创始人 ip, 所有能让你感觉这东西很强的手段。这套逻辑在成熟硬件市场无往不利,但在 ai 时代开始失效了。再看小米是怎么把咪蒙做出来的,凭的是一套叫 m o p d 的 技术。 多教师在线蒸馏,让模型同时向多个老师学习代码能力学 cloud, 数学、推理学 deepsea, 安全对齐学 jimmy nike, 用极低的成本快速追平参数差距。蒸馏本身不是原罪,后发者用这种方式追赶是务实的选择,但问题在于,参数可以蒸馏,生态是蒸馏不出来的。 小米有手机、有汽车,有 ai o, 看但这些设备产生的是什么数据、行为认知、 几点解锁、用了什么 app、 家里温度几度?这些冷冰冰的记录,能渲染出懂人的恩爱吗?当然不能。你在微信里聊天,在抖音里刷视频,在抖淘宝里购物,这些最鲜活的表达数据,全在腾讯字节、阿里的生态里, 小米只是一个硬件通道,数据从他身上流过,但不留下任何痕迹。有硬件没数据,有工程没水源。更尴尬的是,小米到现在连一个面向大众的咪蒙原声 app 都没发布出来, c 端存在感几乎是零。 所以小米搞大模型,只能走蒸馏这条捷径。蒸馏能复制能力,但复制不了生态。能追平参数,但建立不了护城河。当大家的技术参数被逐渐拉平的那一天,用户凭什么选你? 小米的品牌心智是性价比,整合商不是技术信仰。而 ai 产品最终卖的不是性价比,是信任。 这恰恰是快消品逻辑最不擅长建立的东西。所以,小米一诺的困境,不是技术问题,是身份问题。他想当高科技公司,但组织、技术、记忆全是快消品的手机时代这套逻辑活得很好, ai 时代会完全失效。 参数可以靠蒸馏追平,但品牌的泥足会在每一次技术升级的浪潮里越陷越深。外表再庞大,根基不稳,终究站不稳脚跟。

小米的 ai 大 模型 miimo 今天干了一件事,永久降价,最高降幅百分之九十九。你没听错,不是促销,不是限时活动,是直接改价。具体怎么降, miimo v 二点五全系列 api 从今天开始执行新价格,而且不再区分输入长度, 全球同步生效。如果你之前买过 token plan, 还有一个好消息,用量直接提升到原来的五到八倍!什么概念?我自己的实测数据,原来的最贵套餐六百五十九块钱一个月,十六亿 token 对 我来说撑不到一个月。 现在调整之后,最便宜的套餐三十九块钱一个月,给你四十一亿 token。 最贵的套餐呢?直接给到八百二十亿 token, 这不叫加量不加价,这叫龙虾自由。更猛的是,所有当前还在有效期的 token plan 用户,今天凌晨额度全量重置,不管你之前用了多少,直接给你清零重来,按新价格重新算。那问题来了,小米凭什么敢这么降?答案是推理技术的优化。小米技术团队基于 s g land high cash, 完整支持了滑动窗口注意力机制,把 kv cache 在 gpu、 显存、 cpu、 内存、 ssd 之间的数据搬运量压到了优化前的七分之一,可缓存的 token 数量提升到近五倍, 缓存命中率和推理效率都上了一个台阶。再加上专家并行方案和输入长度分桶策略的优化,集群吞吐能力进一步提升, 每个 token 的 服务成本就这么降下来了。说白了,不是小米在亏本补贴,是技术真的跑通了,成本结构变了。另外,之前那个百万亿 token 创造者激励计划,一百万亿个 token 已经全部发完了, 活动提前收官。不过 apache 软件基金会成员的专属福利不受影响,长期有效,历史付费,用户也别急。小米说,未来一周还有惊喜,小米自己说了一话,让更多的人能用到更好的模型,这是 mimo 不 变的使命。你现在用的是哪家的 ai 模型?评论区聊聊,看看谁的成本最高?