随着大模型应用从概念走向普及,企业级调用成本成为开发者关注的核心痛点。近日,小米正式宣布下调 mimo 大 模型系列 api 调用价格,通过成本优化与算力调度升级,进一步降低中小开发者、 初创企业接入 ai 能力的门槛,持续推动通用人工智能落地。此次调价覆盖对话生成、 内容创作、多模态理解等主流服务接口,不同参数版本均有不同幅度降价。面向清亮场景的基础模型降幅更为明显,能够满足文案拣写、 智能问答、简单逻辑推理等高频清亮需求,适合个人开发者与小微企业试水 ai 项目。 除价格调整外,小米同步优化了 a p i 响应速度与调用稳定性,针对高病发场景升级调度机制,减少高峰期延迟与调用失败率。 同时开放更灵活的计费模式,支持按梁阶梯定价,调用量越高,单价越低,有效控制长期使用成本。 在 ai 赛道竞争日趋激烈的当下,价格调整只是表象,背后是小米在自研算力、集群模型、轻量化推理加速等技术上的持续突破。 通过压缩推理成本,企业能够更放心地将 ai 能力融入产品,降低试错成本。此次降价决策不仅提升了小米大模型生态的吸引力,也为行业注入普惠化动力,让更多创新应用借助低成本 ai 接口快速落地。
粉丝1730获赞5.6万

我去,小米 miimo 大 模型官宣永久降价,最高降幅百分之九十九,从五月二十七日起,小米 miimo v 二点五系列的 api 永久降价, token plant 计费体系优化,用量提升至原来的五到八倍。这个是真不得了了, 我最近一直没怎么用小米的米某,就是因为这家伙相比 deepsea 这些是挺贵的,没想到今天开始大降价。昨晚我又刷到了那个马卡雄的视频,在那里大吹特吹。大模型没啥用,卖卡才是王道,说什么只有 seedance 才有竞争力, 哎。说实话,在这里我很真诚的告诉大家,包括对面那些姓马卡熊的人, ai 时代真的是不一样,你们千万不要相信这种脑残无知的言论,也许对面很多网友像我一样啊,年纪不小,但是你们肯定也有小孩, 你们可以无视 ai, 认为 ai 只能聊聊天啊,最多就是做做视频,但是你们一定要让你们的孩子尽早去使用 ai。 我 说的是使用, 不是聊天这种,而是把 ai 当工具用在解决实际问题当中。很多人都说 ai 时代到来啊,人人都能用 ai 干事业, 其实这是对 ai 最大的误解, ai 的 到来只会拉大专业和非专业之间的一个鸿沟。 ai 是 放大器,你自身的能力越强,你和别人的差距也越大。年纪大点的可能已经思维固化,很难去接受新事物了, 但是一定要推动你们的孩子尽早用上 ai, 你 们可以跟不上,但是如果你们的孩子未来也跟不上的话,那才是最大的问题。我们家两个孩子每天都在用,老大因为学习紧张呢,更多的是用来辅助学习。老二才九岁,但是已经在用 ai 来制作游戏了,虽然界面很难,但却是他自己一手一脚做出来的。 现在的孩子小,用 ai 做什么其实不重要,重要的是学会用 ai, 学会提需求,学会发现问题并解决问题,这才是关键。对面那些相信马卡雄的人,你们自己信他无所谓,千万别让你们的下一代以后也相信这种货色。

你平时用的 ai 工具突然涨价了,三十六克,刚爆了,集体涨价,大模型开始找你要钱。但是另一边呢, deepic ipi 永久降价到原来的四分之一,也就百分之二十五,小米咪魔的 ipi 呢,直接降到百分之九十九,接近于白送。 嗯,有些人说啊,涨价就用不起 ai 了,你搞反了。涨价只会让 ai 不 管是国内还是国外,他的竞争越来越激烈,对我们用户是越来越有利的。 很多人也说便宜没好货,但是 deepsea 和 v 四 pro 的 编程能力现在排咱们全球前二。 嗯,也有人说啊,我只用一个工具就够了。但是你要知道,现在是 ai 整的时代, 是多工具结合的时代好吧。嗯, ai 的 价格战逻辑跟当年的云服务一样,巨头呢,烧钱抢用户,普通人呢就抄底。然后目前的事实就是 deepsea 微四 pro 写文案分析数据,小米 mini 的 中文场景优化 以及各开源的模型本地部署成本几乎为零,构成了一个前所未有的低成本 ai 工具矩阵。 嗯,想想当年打车大战,滴滴和快滴的烧钱时,打车几乎是不要钱,而且还会反米。今天的 ai 价格战,本质上呢,是一样的逻辑,大厂在慢慢的培养我们用户的习惯, 一边是大模型公司集体涨价要求,一边是 deepsea, 小 米主动降价,说明这个市场远还没有到收割阶段,竞争才是用户最大的利好。 对于我们做电商的十亿人来说,这一波价格战意味着我可以用几乎零成本的试错所有的 ai 工具,找到最适合自己的工作流,比方说 open globe 或者是 how much asian? 嗯,如果说是你用完之后市场已经成熟了,但是你已经是老手了。所以说推荐兄弟们可以去注册一个 deepsea ipi 或者是小米的 ipi, 你 可以充个十块钱,够用你一个月啊。如果说你编程的话可能会多一点,但是的话, 呃,正常使用一个月足够了,对比着用找一下差异。好吧,这一期呢?呃,就讲这么多,再见兄弟们。

ai 圈在先,降价风暴小米正式宣布密某 v 二点五系列 api 永久降价,最高降幅达到百分之九十九,取消复杂的上下文差别定价,统一计费。同时 token 套餐加量不加价额度直接翻五至八倍,在校用户全额重置额度。 靠着滑动窗口注意力缓存扩容和集群优化三大底层技术硬降成本, tds 还限时免费开发者落地, ai 成本直接砍到底。

先说结论,小米 miimo 确实降价了,而且降的不少,但降幅百分之九十九这个说法,咱们得打个问号,因为没人知道它原来到底卖多少钱。 credit 是 怎么回事? 小米搞了个中间层,叫 credit, 你 先买套餐,比如三十九元,一个月给你六千万个 credit, 然后用的时候按 credit 扣。降价之前, pro 模型要扣两个 credit, 长文本甚至要扣四个。 降价之后,小米说取消了四倍 credit 的 计费方式,但具体 pro 模型现在是扣一个还是两个,官方没说清楚, 直接看价格更实在。小米公布了 token 价格,输入缓存命中零点零二五元每百万 token 输入缓存为命中三元每百万, token 输出六元每百万 token 输入只要两分五厘钱就能买一百万个 token。 和 deep seek 比怎么样?巧了, deep seek v 四 pro 的 价格完全一样。小米这是明摆着对标 deep seek, 价格完全对齐, 那到底降了多少?小米说最高降幅百分之九十九,如果这是真的,那原来 pro 模型的输出价格应该是六百元每百万 to 肯左右。 但问题是小米从来没公布过原来的官方价格表,所以百分之九十九降幅这个数字只能信一半。 普通人该怎么选?如果你追求简单透明,小米和 dipsic 价格一样,选哪个都行。如果你担心被套路,别买套餐,直接按量付费,这样就是明确的价格,没有 credit 换算的弯弯绕。 最终结论,小米 mimo 降价是真的,价格也确实便宜,但降幅百分之九十九的宣传,因为缺乏原价数据,没法完全验证,和 dipsic 比价格完全一样。 credit 机制有没有猫腻?官方没把降价后的换算比例说清楚,这是个隐患。

太炸裂了!小米这次直接把大模型价格打到了空气价,老用户额度全部充至原来几十万, top 的 额度突然变成百亿级。更离谱的是,小米直接宣布 mini 永久降价,最高降幅百分之九十九,输入百万 top 只要两分钱!你要知道, dbc 个前脚刚把价格砍到四分之一,小米后脚就直接把地板给掀了。但真正恐怖的还不是便宜,而是小米开始完全能 ai, 文字、图片、音频、视频全都能一起理解。以前 deepsea 像文字聊天高手,而现在 vivo 更像全能数字员工。更关键的是,小米这波不是单纯降价,而是在疯狂扩大开发者生态。因为 ai 时代最后拼的不是谁模型最贵,而是谁先把 ai 彻底铺满全世界!

小米 mimo 大模型 api 永久降价,最高降幅百分之九十九五月二十七日,小米宣布对 mimov 二点五系列大模型 api 实施永久降价,最高降幅达到百分之九十九。本次调价不再区分上下文窗口, 同时优化计费方案,同等价格下,开发者可使用的 token 用量提升至原来的五到八倍。雷军也公开表态,欢迎更多开发者介入小米 mimo 大模型,进一步降低 ai 应用的开发成本。

小米的 ai 大 模型 miimo 今天干了一件事,永久降价,最高降幅百分之九十九。你没听错,不是促销,不是限时活动,是直接改价。具体怎么降, miimo v 二点五全系列 api 从今天开始执行新价格,而且不再区分输入长度, 全球同步生效。如果你之前买过 token plan, 还有一个好消息,用量直接提升到原来的五到八倍!什么概念?我自己的实测数据,原来的最贵套餐六百五十九块钱一个月,十六亿 token 对 我来说撑不到一个月。 现在调整之后,最便宜的套餐三十九块钱一个月,给你四十一亿 token。 最贵的套餐呢?直接给到八百二十亿 token, 这不叫加量不加价,这叫龙虾自由。更猛的是,所有当前还在有效期的 token plan 用户,今天凌晨额度全量重置,不管你之前用了多少,直接给你清零重来,按新价格重新算。那问题来了,小米凭什么敢这么降?答案是推理技术的优化。小米技术团队基于 s g land high cash, 完整支持了滑动窗口注意力机制,把 kv cache 在 gpu、 显存、 cpu、 内存、 ssd 之间的数据搬运量压到了优化前的七分之一,可缓存的 token 数量提升到近五倍, 缓存命中率和推理效率都上了一个台阶。再加上专家并行方案和输入长度分桶策略的优化,集群吞吐能力进一步提升, 每个 token 的 服务成本就这么降下来了。说白了,不是小米在亏本补贴,是技术真的跑通了,成本结构变了。另外,之前那个百万亿 token 创造者激励计划,一百万亿个 token 已经全部发完了, 活动提前收官。不过 apache 软件基金会成员的专属福利不受影响,长期有效,历史付费,用户也别急。小米说,未来一周还有惊喜,小米自己说了一话,让更多的人能用到更好的模型,这是 mimo 不 变的使命。你现在用的是哪家的 ai 模型?评论区聊聊,看看谁的成本最高?

就在刚刚,小米没摸 v 二点五系列 a p i 宣布永久降价,最高降幅达到百分之九十九。第一,单价报价 v 二点五 pro 输入缓存命中,只要零点零二五元每百万 hokken。 第二,取消上下文窗口分级,长窗口和短窗口一个价,计费规则肉眼可读。第三, 存量用户的额度全量重置,办新规则重新跑,等于老用户也吃满这波红利。大模型厂商普遍还在算怎么把推理成本摊回用户头上,小米反手把利润空间自己先砍掉,背后撑腰的是推理系统的底层优化和团队基础红利。

小米的这个七个亿的 toc 已经到账了啊,这个是小米最近推出的百万亿 toc 创造者激励计划,这个普通人也可以申请啊,你只要是按照他这个要求去填写一些相关的信息就可以了。我这个审核的就半天时间他就通过了,然后他就给你发了个邮件, 这个是昨天下午三点发的啊,然后今天上午就到账了。这七个亿 toc 你 如果单独订阅的话,相当于 五十美金一个月的,这个额度啊,足够使用了。小米最新出这个 mini v 二 pro, 这个模型还不错啊,在这个权威榜的 rfc 上排名也比较靠前啊, 它是在国产跟 kimi k 二点六并列第一对吧?五十四分,你看第一的这个 gpt 五点五也就六十分,差距也不是特别大。当然我现在还没有正式开始用,我一般是用在这个 hms 里面,帮我推送一些这个 x 上的一些最新的信息,接下来评测的最新结果我也会给大家跟进一下。 这波雷总还是非常大气的,咱也不能差事,对吧?专门给他拍一条视频,支持一下小米迷谋,加油!

这次小米米墨的新 token 盘,最容易让人误会的是单位你看到的四点一币,不是四点一币 token, 而是 credits。 真正能跑多少,要看你用哪个模型,以及这段 token 是 缓存命中未命中输入还是输出。 按官方文档约度,套餐分四档, lite 是 三十九元四点一 b 酷热 ipad standard 是 九十九元十一 b gridadius pro 是 三百二十九元三十八 b gridadius max 是 六百五十九元八十二 b gridadius。 表面看很大,但要继续往下换算, 真正的计费公式在这里,它 movie 二点五 pro, 每个缓存命中 token 扣二点五 credits, 未命中输入 token 扣三百 credits, 输出 token 扣六百 credits。 普通迷迷模糊二点五跟 d 分 别是二一百和二百 credits。 官方给了一个很好懂的例子,如果你买那一套餐,一共有四点一 bp 转一次,你用掉十 m 的 迷蒙 mo, 二点五 pro 未命中输入 token, 就 会消耗三千元回资,剩下的额度就只有一千一百元回资。 所以官方说用量提升五到八倍,并不等于任何场景都无脑多五到八倍缓存命中多输入能赋用输出,别太爆情感就会更划算。如果你是涨让五 d 缓存输出很多,那科技消耗会快很多。 还有一个边界要看清, token plan 是 面向 i 编程工具的订阅方案,不是给你随便接近自定义后端做自动化脚本的普通 api 套餐额度用完后系统会停止服务,不会继续扣你的赠金或账户余额。 最后给一个买钱判断,第一,你是不是主要拿它跑客厅工具?第二,你的任务缓存命中高不高?第三,你的输出 token 会不会很多?把这三件事算清楚,才能判断 token 盘是真便宜还是你应该继续走普通暗恋 a p i。