粉丝2.4万获赞14.5万

a 圈又出大事了,中国移动正式发布国内最大的大模型服务平台 moba 平台,已经接入超过三百款主流的大模型。什么概念啊?就是 国内市面上你能看到的大模型平台,它全部都已经接入了,当大家都在热热闹闹讨论的时候,你才发现真正的王者开始进场了。说一下它的优势以及它对我们的影响。第一, 大模型的平台他已经帮你都选择好了啊,三百多个主流的全部都接入了,想用哪个用哪个。这第一个,第二个,首次实现了磁源的集约化采购。什么是什么意思啊?就是 集中地去采购 talking, 以前还在说普通人可以什么,做什么 talking 的 生意啊?做梦吧,怎么可能。所以呢,这种集中采购结果是什么呢?成本降三十以上?第三,在运行和使用模型的过程当中, 一旦有一个模型报错停止,它会秒急的切换到另外一个模型,会使你的运算和流程变得非常的流畅。当你在调用模型的时候呢,你还可以选择模式,比如说你选择成本优先的模式,还是选择效果优先的模式,还是选择均衡优先的模式, 厉害吗?就是在这个模式下,它帮你去匹配模型,大模型出错之后,它还能瞬间帮你切换到另外的一个模型。前两天刚说中国移动发布了 资源包,现在它就已经帮你把大模型接好,把跑大模型的模式接好,把资源 token 的 成本又帮你集中采购降下来。也就是说, ai 进入寻常百姓家已经来到了,同志们。

呃,本期视频呢是给大家整理了一些可以耗到免费大模型 talk 的 渠道,所以今天我们只做一个渠道的分享。由于篇幅限制,具体的操作和配置呢,我整理成了一份文档,大家可以在主页的粉丝群里面免费查看。 先给大家看一下渠道总览,官方的网址入口我也贴在这里了,接下来我们就一个一个详细讲一下这些渠道。 这是 longkit longkit, 这里免费渠道是每天刷新的,按我在文档里整理到的信息呢。呃, longkit 这边现在要分开看,第一档是 longkit flashlight, 这个是独立额度,大概是五千万 topos 每天。 第二档是 longkit flash chat dink 二六零一等几个模型,它们共享一次额度大概是五十万 topos 每天。申请审核通过后可以提高到五百万 longchat 二点零 pro view 的 注册额度是五百万 tocs 每天。提交模型使用反馈,每次有效的反馈呢,都将有机会获得额度刷新,每日最多可获得一亿两千万的 tocs。 所以你不能简单理解成 lunken 每天统一送多少,它其实是分池子的,那这个渠道就比较适合做摘药分类、脚本辅助或者批量小任务这些高频但是不太贵的话。如果你想找一个能每天用,适合做主力首发的免费渠道, lunken 的是值得优先来看一看。 然后第二个就是小米 vivo, 这个属于是活动型的一个赠送,它的活动时间是四月二十八日零点到五月二十八日的零点,一共三十天,而且是赠完即止的, 它是需要你去填一个申请表的,然后最终的到账形式可能是 top, 也可能是赠金,最终以工资台到账的为准。这个可以去试申请一下,你知道还是很像的 哦。那第三个就是 wechat gatebay。 这要讲清楚一件事是,它不是固定多少的 token, 而是说每月五美元来 per day。 也就是说,它的免费额度计算方式不是按给你多少万 token 来算,而是按你每个月有五美元的预算。就这五美元能换成多少 token, 完全取决于你用什么模型,上下文多长,输出多长。 你如果拿便宜模型做短景球,那撑的就比较久,如果一上来就跑贵模型长上下文,那掉的就比较快。其实这个渠道是给想统一管理多模型入口的人和有工程化需要的人来用 啊。这被提醒的一点是,如果你自己主动去购买了 i get paid credit, 后面就不再享受这个每月五美元的免费额度了。 第四个是 openroot free。 openroot 的 逻辑和前面几个又不太一样,它这里最关键的不是 token 余额,而是请求次数限制。也就说 openroot 免费模型不是给你一直多少万 token, 它主要是限制你每天能发多少次请求。 如果是买超过十美元 gift 的 账号,免费模型上线,呃,可以提升到大约一千次请求每天 以及二十次请求每分钟。那反过来说,普通免费账号的上限就会更低一点,所以他也不太能说是 无限免费的。你可以在模型广场上直接搜 free, 能给你用的免费模型还是挺多的。我这边的免费模型不是固定给你几个月,也不是固定给你一整年,他属于是模型业,当前有哪些福利版本,你就先用哪些,今天这个福利模型在,明天呃,就不一定还在 那这个就适合像快速式模型,然后低成本测试做轻量备用池的人,还不适合一直直接拿来当唯一的主力,毕竟免费的模型你也不能指望它有多强。 第五个呢,是国家超算互联网这个渠道要单独看,因为他不是单纯给你点 token, 他 能给到你的是一整套的资源,一百卡时的算力加五百 g 的 储存加一千万的 token。 所以 他的免费额度计算方式呢,已经不是简单的 token 池,而是 token 加算力加平台资源的组合。 这渠道最大的特点是资源看起来比较多嘛,但是学习成本也比较高。如果你的目标只是最快拿一个 k 直接开始用的话,那 long k 魔兽 openroot 是 更方便的一个选择。 那如果你本来就想接触国产的平台资源,或者你不只是想要一个 token 时,还想顺手观看算力模型平台存储这一整套的能力, 那国家超算就很值得来看一看究竟能用多久。这种一般不能简单理解,是每天刷新或者永久免费,它更像是活动资源平台福利阶段性体验的一种资源。据说国家超算互联网曾经给 openclaw 的 用户发过一千万的 token 限时福利, 当然最终能拿多少能用多久,还是要以当时控制台和活动页为准。六类是 glm、 kimi、 min max 这种活动渠道,小米 mino 其实就属于这一类,不过因为他最近比较火,我就把单拎出来了。 这类活动渠道标题经常写的很大,但在理想情况下看起来算很多,但真实到账和能用多久取决于活动规则、活动期限和账号的状态,以及控制台当时的显示。 最后我想给大家做一个简单的总结,我推荐的顺序呢是可以先看 long cat 这种每天刷新的, 然后再看 word 这种每月给小额 credit, 最后再拿 openroot free 做一个备用。如果你更在乎惊喜能不能捞一波,那去薅咪某这类活动也是很好的,如果你愿意多学一点国家超算,也值得一试。最后我想说几点注意事项。 第一呢,就是不要买来源不明的共享 k, 便宜不是问题啊,主要是来源不明,这可能是一个潜在的风险,可能有稳定性、隐私和封号的问题。 那第二呢,就是很多免费活动渠道的额度,本来就是活动逻辑,不是长期的承诺呃,活动过期、规则变化、入口失效都是常有的一些状况。 第三就是不要把敏感数据为给免费的额度公开资料、 demo, 摘药测试这些都没问题,但是公司的代码、客户数据、隐私内容,最好不要往免费额度里面随便塞。 第四呢,就是不要只看标题,不看官方,一切的一切最终以官方控制在官方文档、官方价格页和模型列表为准。我在这里只做一个分享, 如果你想看每个渠道的具体入口,官方页面适合接什么工具,以及更详细的一些说明,我已经把完整文档整理好放在了粉丝群里,所有群成员均可以免费查看。 顺便提一下,我们最近推出了未必要靠中转服务,无论是稳定性缓存还是模型种类和使用效果都非常不错。如果你有需要的话,可以在粉丝群或者私信联系我,如果你觉得这期视频有用的话就收藏,求点赞,求关注,我们下期再见!

买一台五零九零或者 b 三百生产 token 去卖可不可以?答案是可以,但我不建议。四个理由,一、成本平摊。你一台服务器卖 token, 你 需要部署硬件租网,软件系统,运维系统,配备软件工程师、硬件工程师和运营工程师,还有销售, 你一百台也是配备这些,一台的话,你的团队平摊成本太高了,集群越大平摊越低。二、销售控制。 如果是一台服务器生产的 token, 目前除了我们平台会接纳你的 token, 很 难找到第二家,你可能面临很多空置。而如果你是一个三十二台 b 三百以上的基群,你可以卖给很多很多家,控制率低。三、模型受限,五零九零,你只能部署轻量级的模型,欢迎的满血版 deepsea, gm 五点零, timi 二点五都没办法部署。你的客户很窄,客户愿意支付的价格也不高。四、企业推广受限,企业客户都会考量你的电网偷啃并发的稳定性,一台服务器是难以支撑企业客户需求的。 总结一下,迷你的偷啃工厂可以建,但我不建议又组合到一起,有规模效应,偷啃工厂才更能发挥价值,而且价值会比你了解的算力注定要高很多,明白了吗?

股友们炸裂消息来了,中国移动干了一件大事,他要把全中国三百多个 ai 大 模型装进一根水管里,拧开龙头就能用,偷看成本直降百分之三十。你知道我国如今有多少大模型吗?超过三百个!如果你是一家企业,想用 ai, 你 得先搞清楚哪个模型适合你。 epic 擅长推理,豆包擅长对话签问擅长代码, g、 l、 m 擅长长文本。然后你得分别对接每家的 api, 分 别充值,分别维护,分别踩坑。这就像什么想象,你家装了十个不同品牌的水表,每个龙头接不同的水厂,你洗澡用 a 厂的水, 做饭用 b 厂的,喝水用 c 厂的,每个月收十张水费单。崩溃吧!中国移动说,我来修一根总管道, 所有水厂统一接入,你只对一个水表,按需取水,费用统一结算。这就是 moma 移动模型服务平台。五月八日二零二六移动云大会上,中国移动正式发布 moma 平台 核心三点,第一,超级聚合一个统一 api 网关,接入超三百款主流 ai 模型,包括中国移动自研九天系列、 deepsea、 通易、千问、豆包、 kimi、 minimax 等等,文本、语音、图像、多模态全覆盖,企业一次接入所有模型随便选。第二,智能路由分独创三种策略,第一种,成本优先,自动匹配最便宜的模型。第二种,效果优先,匹配最强的。 第三种,均衡优先,性价比最高的模型,超时或限流秒级自动切换,业务不中断。第三,成本屠夫基于国产算力部署,自研推理引擎,结合智能缓存上下文附用 tokyo 压缩技术单位, tokyo 成本压降百分之三十, 资源占用率降低百分之五十以上。中国移动董事长陈忠月原话,开放万亿级偷看服务体验包,万亿级免费体验。你可能会问,百度有千帆,阿里有百炼,字节有火山引擎,都能提供模型 api, 中国移动凭什么三个别人给不了的东西?第一,算力底盘。 中国移动二零二五年算力服务收入近九百亿元,制算服务收入增速百分之二百七十九。他在全国布局了超一千五百个边缘制算中心,正在建设几百级高性能 ai 数据中心, 这个量级,百度、阿里都得靠租。第二,网络管道。中国移动有全球最大的五 g 网络,二百七十七万座基站。 ai 从云端到终端的最后一公里,它的管道延迟最低,覆盖最广。别家坐的是云上 ai, 它坐的是网家、云家 ai 三位一体。 第三,客户池。中国移动有十亿级用户,政务、金融、医疗、工业客户遍布全国每个县。这些客户用 ai 的 需求,跟互联网公司的开发者客户完全不一样。猫马专门有机密模型服务, 基于硬件及隔离,保障数据安全,这是政务和金融的刚需。中国移动要做的是 ai 自来水厂。万亿级 token 是 什么概念?一个 token 约等于零点七个中文字,一万亿 token 约等于七千亿个汉字, 相当于一百四十万本红楼梦的文字量。如果按市场价, deepsafe v 四输入 token 价格,约每百万 token 两块钱,万亿级就是两百万元人民币的算力。中国移动说开放体验,虽然细节待公布,但方向很明确, 用运营商的规模效应,把 ai 调用成本打到骨折。 g p t 五点五 a t i 输出 token 价格每百万三十美元, deepsea b 四约每百万二元,中国移动在此基础上再降百分之三十。这意味着,一家中小企业接入 ai 的 门槛,从请得起程序员降到交得起话费,这就是 ai 像水电一样随取随用的真正含义。 中国移动的逻辑很清楚,五 g 时代,它卖的是连接, ai 时代,它要卖的是智能,从中国最大通信公司到中国最大 ai 基础设施公司。但话说回来,模型聚合平台不是新概念, one api、 light lm 甚至 open router 都在做类似的事。默认的护城河不在聚合本身,而在算力和客户壁垒。如果算力和客户优势不能兑现为调用量,这就只是另一个中间。降价百分之三十对开发者有吸引力。但目前大模型价格战已经白热化, ipc 把行业价格打到骨折之后,再降百分之三十的空间,还有多少利润?对于中国移动这种体量的央企来说, ai 转型的组织惯性和创新速度,才是真正的挑战。一九九四年,中国接入互联网, 一根电话线拨号上网。二零一三年,四 g 来了,移动互联网爆发。二零一九年,五 g 来了,万物互联开始。二零二六年, 中国移动说, ai 时代,我来修管道,三百个大模型,一个入口,万亿级 token 拧开即用。这不是一个产品发布,这是一家万亿级央企在赌下一个时代的入口。你现在每个月交上话费,也许三年后,你变成交 ai 了费觉得有用,点个关注,我来讲透每一条消息背后的硬逻辑!

卖投肯做一篇分发,到底能不能赚钱?已经消耗过千亿,投肯封了几十万个账号,实打实的在这个行业的经验告诉你答案,肯定能赚钱啊,甚至一天可以赚几万,一个月可以赚几十万,但是他适合一个普通人吗? 事实上,绝大部分人根本不可能靠卖投肯赚到钱。多人被网上的暴富神话洗脑了。记住一句话,再好的生意,他本质还是一个生意,不是捡钱。 现在投垦市场,整个行业极其内卷,想要做好这门生意,还是需要具备一条件,以下五个核心条件,只要你符合其中的一点,这碗饭你就可以吃。大家可以对照看一下,自己到底能符合几点。 第一点,有足够强的一手渠道,打一个信息差和时间差,这是最粗暴的赚钱方式。比如当下爆火的 cds 二点零, 如果你能在他刚刚出来的时候,全网都在找借口的时候,甚至首月供不应求的时候,快速拿到极低折扣的内部价格或者代理渠道啊。在别人还在找门路的时候,你手里有货,拿到渠道就等于拿到了印钞机。第二点,自带天然的产业资源, 这属于圈层的降维变现。如果你本身所处的行业就有海量的 ai 需求,那你根本就不需要去卷价格,也不需要再去找客户 啊。比如你本身在这个电商圈已经摸爬滚打了很多年,身边全是做跨境出海搞短视频带货啊的老板,他们一天跑几千个商品切片,跑几万条产品图或者产品视频, 那么他们的 a p i 消耗量就是一个天文数字,或者眼下爆火的 ai 漫剧啊,有大量的生图或者生视频的这样的一些需求,你当朋友抱怨没有稳定接口的时候,你顺手丢一个过去,就帮他们解决了痛点,自己也赚到了极其稳定的利润。 第三点,如果你本身就在做流量啊,拥有极强的获客能力或者投流的能力,你本身就是懂流量生意的高手,懂买量,懂做爆款,懂私域运营。那么在大家提供 token 的 服务和价格都大差不差的情况下,你的获客成本只有别人的啊,一半或者 百分之二十,甚至百分之十,你能用最高效最低成本的方式触达到海量有需求的客户,靠规模效应直接碾压同行。第四点,你具备 开发 agent 将 token 巨像化的到一个服务里面的这样一个能力啊,把标准化的 token 服务做成非标的溢价啊,把低毛利的生意做成高毛利的 一个生意,同样是卖生图模型,同样是卖生视频模型,别人是按次卖接口啊,两毛一次,五毛一次,一块钱一次。而你是根据特定固定的场景,比如苍蝇老板生成菜品图,电商老板做主图啊,电商老板做详情图,封装成一个傻瓜式的工作流啊,别人卖五毛,你可以卖两块, 你可以让老板们一次就能成功,或者两次就成功,让老板们跳过了反复学习,反复测试的这样一个过程啊,一个美工一个月的佣人成本啊,七八千,八九千,但是你通过一个工作流啊,能让老板原本 五个美工才能干完的事情,一个美工就可以操作你的工作流去实现的啊,一个月能帮老板省几万块钱的这样一个一个成本,那么你就拥有了核心竞争力。第五点 也是拥有顶尖的底层技术能力,这个路线比较高危,也比较硬核,这个属于很敏感的一种方式,属于纯纯的技术套利,主要是针对像 cloud gpt 这种风控,比起 很严格,然后又是全球主流的应用量很大的这样一些模型。如果你懂底层的协议意向,能搞定复杂的风控绕过,以及拥有维护高病发耗磁的技术实力, 相当于你就能用极低成本的方式把散户的号源整合成企业级的接口,这其中的利润空间极大,同时也是门槛最高,风险最大的一种方式。

普通人的托尼生意就三条路径,咱们今天讲清楚哪些能做,哪些是绝对不能碰的。第一种就是国内大模型代理,这种是最稳也最合规的,比如阿里的千万字节、 cds, 这些都是大厂的大模型本质是售卖云服务,售卖算力额度,大厂不可能对接全部的企业和个人用户,所以他们需要代理来打开市场, 也会给代理一些折扣,这样呢,代理可以赚中间的差价和长期的分润。第二种就是国内大模型出海,也有人们常说的托尼出海, 把国内的好用大模型输出到海外,给海外用户使用,这种如果你有资源也可以去做。第三种是绝对不能碰的,也就是把海外的大模型,像 gimini、 g b t、 cloud code 这些,把这些大模型转卖到国内,这是政策上明令禁止的,风险极大,不是简单的封号而已,所以普通人千万不要碰。

全网最全教程,小白从零到一入局偷啃生意第二课,这期视频我们来聊聊偷啃这个市场到底有多大,以及普通人怎么切入偷啃赛道。 我给大家报一组数据,保证让你震惊。国家数据局统计,两千零二十四年初,国内日军偷啃钓用量才一千亿, 两千零二十六年三月直接飙到一百四十万亿,二年涨了一千四百倍,这个增长速度比早年移动互联网流量爆发的速度还猛三倍。另外,权威机构预测到,两千零三十年,国内 tucker 市场规模能到三点五万亿,全球更是突破十五万亿, 妥妥的十万亿级蓝海赛道。一方面,现在 tucker 赛道还处于爆发出奇, tucker 经济这个概念才出来没多久,还有很多人不知道 tucker 是 什么,也还有很多人还没有用上 ai。 另外一方面,现在这个赛道的供需差特别大,供给端巨头都在忙着建算力中心训练大模型,根本顾不上下沉市场的小客户需求端。不管是电商商家、自媒体工作室,还是中小公司, 现在个个都在用 ai, 每个月都要花几百到几千块买 tok, 但是百分之九十的人都不知道去哪拿低价货源。这些个信息差,就是我们普通人能够把握住的机会。那么问题来了,普通人该怎么切入?其实最适合我们普通人的路子就是做 tok 聚合平台,你可以把它理解成 ai 时代的加油站, 用投大钱,不用搞重资产就能赚中间的差价。那到底什么是 token 聚合平台?简单说,它就是一个 ai 模型超市,把国外的 open ai、 谷歌 cloud, 还有国内所有主流 ai 大 模型全部集中在一个平台里, 用户和企业再也不用一家一家去找 ai 厂商,也不用挨个去官网申请复杂的 api 接口密钥,只需要在这一个聚合平台注册一次, 充值一次,就能随便用市面上所有的 ai 模型,既省事又省钱。它的盈利模式也特别简单,我们直接找各大 ai 源头厂家大批量拿货, tko 拿到很低的批发价,然后再卖给普通用户,小老板和开发者,售价比官方便宜不少,我们就赚中间那点差价,用户花更少的钱用 ai, 我 们稳稳赚利润,厂家也走了,销量三方都划算。有人可能会担心这种平台会不会被大厂垄断,完全不用担心, 现在大厂的目标都是服务大客户,根本顾不上下沉市场的中小商家和个人用户。你所在的城市里至少有上万家中小商家有用 ai 的 需求,但是百分之九十的人都还在买贵的 tokyo, 只要你能拿到低价货源,卖给他们打八折,他们都要抢着跟你合作,根本不愁卖。现在做这个生意相当于两千零三年开淘宝店,两千零一十二年做公众号,属于红利最足的。早期阶段竞争小,需求大,门坎低。很多人肯定会问,我没技术没大钱怎么启动自己的聚合平台? 下一期我给你拆解三种启动模式,从几千块的副业到几十万的创业项目都有,选对至少少亏一百万。我是牧野,我们下期视频再见。

大家好,我是分享干货的学子。最近这两天, ai 圈都在关注一件大事,中国移动上线了大模型聚合服务平台,对外有两个核心宣传,第一,接入三百款大模型。第二,整体调用成本下降百分之三十。现在行业出现两种看法, 有人认为运营商强势入局,赛道会被巨头垄断,普通从业者没有生存空间。也有人觉得价格优势明显,第三方渠道很快会被取代。多数人 只看表面宣传,看不懂背后的行业逻辑,也看不清真实的市场格局。移动进入这条赛道,首先带来的是行业合规出清。 过去很多没有正规资质的小站点、小代理,依靠接口中转倒手赚差价,接下来这类违规的会被逐步淘汰,整个 token 和大模型的服务生态会慢慢走向规范化。这也不是移动的单独布局, 接下来电信、联通都会跟进入场,三大运营商都会布局大母型聚合,也都会做头肯集采业务,这是明确的行业趋势。巨头纷纷下场之后,很多人都会关心一个问题,普通从业者合规渠道还有没有生存空间? 答案很明确,依然有稳定的机会,不会被巨头全盘垄断。先履行第一个核心逻辑, ai 头肯不能照搬手机流量的运营模式,运营商做流量有自有的基站和基建支撑,手机上网是全民刚需。 tokyo 完全不一样,它必须依靠 ai 智能体,依靠行业应用和落地场景,才会产生真实消耗。目前大部分 ai 落地场景 还没有真正开发成熟,没有场景,没有落地工具,再便宜的 tokyo 也没有实际用处,所以这条赛道的核心不是拼接口数量,也不是单纯拼价格高低,真正能站稳脚跟的,是深耕垂直行业,做落地服务的群体,这也是普通从业者最大的立足机会。 再看第二个逻辑,头部大模型厂商不会任由运营商一家主导,都会建立自己的生态护城河。 不管是同一千万豆包还是 mini max 这类主流模型,接入移动平台只是多一条流量通路, 任何一家模型厂商都不会把定价权、用户生态、渠道、话语权完全交给单一运营商。所以厂商会做渠道分级,也会做价格隔离,一边守住自身官方渠道,一边长期扶持合规第三方伙伴,稳住整个价格和生态平衡。 有这种生态制衡存在,合规渠道就一直有利润空间。再看大家关心的两个数据,成本降百分之三十。三百款大模型讲降幅百分之三十这个数字不是所有模型统一降价百分之三十,而是两类模型综合平均之后的结果。 一类是通信千万豆包,这类原厂模型走官方 api 给到移动题材厂商要保护原有价格体系,实际优惠基本在百分之十到百分之二十。另一类,移动自有算力中心,自己部署大量开源模型,叠加算力调度、智能缓存优化,这类模型成本卷超百分之三十, 两类模型数据拉平,才有整体降本百分之三十的说法,并不是每一款模型都能拿到超低价。再看三百款大模型的说法, 市面上真正独立商用的主流大模型,实际并没有那么多三百款,只是统计口径问题,同一款主模型、不同参数、不同微调、不同行业版本,都会被单独统计进去。像同一千万豆包这类大厂,单独一个系列就能拆分出几十个版本,累计加起来凑到三百多款, 并不是三百款完全独立的新模型。看懂数据之后,再认清 token 交易的核心规则。 token 和普通商品不一样,不能囤货,不能提前所库存,只能按时调用量,计费用多少结算多少。移动和厂商签的都是用量阶梯价, 平台用量达标后才能拿到底价,前期体量不够也只能拿基础价,并不是一进场就是全网最低价。第三方渠道也是同样一个逻辑,只要在垂直行业稳住稳定钓用量,同样可以和厂商谈阶梯价,依然有合理的利润可以做。最后做一个整体梳理。 运营商入局目的是规范行业,清理市场乱象,不是独家垄断整个赛道,真正被淘汰的只有无资质、纯倒手赚差价的违规商家。普通人想长期在赛道深耕, 不能只靠倒卖偷看赚短期差价。方向很简单,绑定垂直行业,打造 ai 智能体工具,做定制化行业解决方案,未来格局很清晰,运营商、 大模型、原厂、垂直合规渠道,三方会长期共存,往后比拼的不是谁价格更低,而是谁能落地。好场景,做好服务,合规经营,深耕场景,这条赛道始终有稳定的发展空间。

一场关于 ai 未来的基建革命啊,正在悄悄发生。刚看完二零二六移动云大会,我印象最深的是 talkin 正在同一个技术词变成 ai 产业里的关键连接器。它不仅仅是技术名词,更是贯穿 ai 全产业链的通用度量单位,是盘活整个 ai 生态不可忽略的关键 dna。 移动这次要做的,是让 talkin 在 更多人、更多场景、更多行业里真正用起来,也就是会上提到的四项核心工作。首先是人人享有 talkin。 过去很多 ai 服务对普通人来说门槛并不低。移动现在做的啊,不管是普通人写东西、办公做图问问题,还是中小企业做客服务、营销管理, 都有机会更低门槛的使用 ai。 未来用 ai 可能会像今天用流量一样自然。第二是处处可用拓客。现在很多 ai 服务,各个平台各用各的, 不同应用之间并不互通,体验很割裂。移动能结合手机号一号通用天然优势,打通移动云智能终端生活服务。线上线下入口,让托肯可以一点即用, 跨平台用,全场景用。未来托肯也许会成为 ai 时代的通用数字凭证。第三是行行。受益于托肯,很多行业想用 ai, 但会卡在开发难、分发难、获客难、变现难这些问题上。移动提出开放标准化接口和一站式运营工具, 同时开放线上线下入口,线上开放 app 新通信入口,线下打通营业厅局套,汇聚 ai 应用,打造全场景拓客发生器,再建立公开透明的分论机制,大幅降低合作伙伴的录取成本。未来不管是大企业、中小开发者,还是传统行业, 都能接入 ai 生态,分 ai 蛋糕,最后是缓缓融入拓客。 ai 产业不是一个单点生意,从能源、芯片到算力、 模型、应用再到用户,中间任何一个环节割裂都会影响 ai 服务真正落地,所以必须全链条协调。 移动正依托于算网深度融合优势,凭借全国一体化算力布局,九天 ai 平台与灵犀全站技术横向贯通,应用模型、基础设施、芯片、能源全环节,构建一条完整的价值闭环, a 键的使用托肯,托肯拉动算力、算力消费电力。 所以回头看,我们可以发现,移动正是在搭建 ai 时代的新基础设施, ai 服务要真正普及,一套可计量、可流通、可运营的体系必不可少。这也能解释为什么移动在这个时候站出来讲,托肯 作为运营商,本身就擅长做三件事,连接用户、运营网络、管理、大规模服务体系。过去移动互联网时代,流量让普通人接入了互联网,开始期待托肯人人都可用时代了,它会带来什么样的变化呢?

你现在刷到的这条视频,可能会改变你未来使用 ai 的 方式。现在的 ai 其实挺割裂的,这个 app 里充个会员,那个软件里买点积分,我们好像又站在了一个新时代的门口,门里什么都好,但出门左转就得再买票。 那未来能不能像今天用水电煤一样方便的使用 ai 呢?正好我刷到了中国移动的 tok 运营发展分论坛直播,看完后我得到了这个问题的答案。 移动给出了一把统一的尺子,这把尺子叫托肯。到底什么是托肯?你可以把它简单粗暴的理解为未来我们使用 ai 服务时的基础单位,就像现在我们上网要用的流量一样,但想要落实这把尺子可不是一件简单的事。移动董事长提了一个概念,叫算力即动能, ai 即服务,开放促共赢, 为央企 ai 国家队、数字中国建设的主力军,在运营商、全网用户、全域渠道、云网,算力有着明显优势。移动主动占位,主动作为,铁了心要把这件事做好,让托肯像流量一样 像水一样动起来。具体怎么做呢?第一是筑基,即人人都有托肯,把托肯权益下沉到大众的日常里,跟咱们的手机套餐深度融合, 以后你的套餐里不仅仅是一个包含多少万托肯的智能套餐,能够让千家万户都能享受到 ai 时代的便利。 第二是流通,即处处可用托肯。我们现在用 ai 手机里的智能助手、电脑端的专业软件,他们之间的托肯是不通用的。移动正在牵头把托肯打造成 ai 时代的通用数字凭证。试想一下,之后我们可以利用手机号一号通用的优势,托肯跟着号走, 线上线下跨平台,全场景都通用。第三是激活即行,行受益。托肯移动这次态度很开放,他们要把自己的平台入口都开放出来,中国移动 app、 新通话、家庭饭屏这些海量用户入口都会变成托肯发声器,再建立一套公开透明的分润机制,研发运营变现门槛低了,各行各业都 能在 ai 时代轻松入局。第四是协同,即环环融入。拓肯。我们现在 ai 产业链是断开的,上游做芯片,中间搞模型,下游做应用,各干各的家, 直流根本转不起来。移动要做的是把 ai 产业各环节都拧成一条绳,利用云网算力深度融合的独家本事,把应用模型、基础设施,甚至到最后对能源、电力的消耗,都用托 肯这根线串起来,让整个产业少些磕磕绊绊。现在你会发现,我们离用 ai 像今天用水电煤一样方便真的不远了。到时 ai 真正翻过技术的高墙,变成普通人生活里用的上、用的起、用的顺的一部分。

我们今天这个视频来讲, ai 的 coding 套餐现在到底应该怎么买,买哪一些,然后怎么样安排会比较合理呢?最近半年啊,我们知道 ai 的 coding 套餐完全都变了,海外这些主流工具啊,都在收紧。比如说像 github 的 co pilot, 砍掉了 opus 模型,停止了注册,六月一号全面开始按量计费。 比如说像 cloud 增加了身份验证,还一度把 cloud code 从二十元的套餐里面去拿掉。比如说像 curser 和 winsolef 呢,也早就从二十元的套餐里面去拿掉。比如说像 curser 和 winsolef 呢,也早就从暗四变成了暗量计费,可以说整个行业都在大涨。 我自己现在呢,每个月订阅的套餐总金额超过三千块钱人民币,然后每个月消耗的大概几十亿的 token, 真正的这个 token 使用量的价值啊,我估计超过这个两万元人民币,并且还在快速的增长。三个月前呢,我录过一条类似的视频,那个时候跟大家说的是,我每个月大概会用三亿 token 左右, 像短短三个月过去呢,已经翻了十几倍,实在太快了,根本就不够用。所以我跟大家关心的问题其实也是一样的,就是现在这些 token 套餐到底该怎么买,买 哪一些,怎么样安排会比较合理呢?我自己大量使用之后啊,其实结论很简单,就是不同的强度买法不一样,比如说轻度用户,你就买顺手的。中度用户呢,买性价比,重度用户啊,要买灵活性,越重度啊,就越不要把模型跟工具绑死。 具体是什么意思呢?我来跟大家展开说一说。先来说一下我的这个判断框架,就以前选扣进套餐啊,看三件事情,第一件事情呢,就是模型聪不聪明,第二个呢就是速度快不快,第三个呢就是额度给的够不够, 现在呢,这三件事情还不够了,还要加。第四件事情就是模型跟工具能不能分开。我们知道啊,模型呢,负责智力这个整体的能力,然后工具呢,也就是现在比较流行的说法, harness engineering, 负责上下文的管理啊,智能体的编排啊,其实跟模型同样的重要,这两件事情啊,你最好不要一对一的绑死,让你的模型呢,可以接入任何的工具,比如说你喜欢 cloud 的 模型, 当然可以买 cloud max 的 套餐,然后只在 cloud code 里面用,这样呢,性价比最高。但是呢,如果你买的是通用的 cloud a p i 接口,那你就可以在别的地方也用上 cloud 的 模型,比如说接入你的 open code, 接入你的小龙虾,接入你的这个 pi agent, 或者是任何你自己写的这个脚本啊,智能体等等,不一定非要用 cloud 的, 自己的产品,反过来也是一样,就是你的工具啊,最好能接任意的这个模型。 cloud code 是 现在最火的,这个智能体 现在迭代速度也很快,经常支持一些新功能,新的工具的调用方式。但这些新功能啊,经常是围绕 cloud 的 自家模型 跟自家的这个 api 来设计的。如果我用这个国产的模型去接新版的这 cloud 扣的,经常会遇到两类问题,要么就是缓存失效,然后成本跟延迟大幅度的上升。要么就是新模型的特性啊,接不上 agent 呢,有时候看起来突然会变得笨笨的,这个是为什么呢?就是 astropica 啊,其实就在用套餐来补 here cloud code 锁住开发者在自己的生态里面,目的呢,是获得宝贵的这种用户的使用数据,以后呢,可以用来做训练的。这个技术的数据模型跟工具绑定的太死啊,你就只能跟着它的节奏,我在里面走,我自己呢,现在也在降低对 cloud code 的 依赖,比如说平时写代码的任务啊,会更多的交给 open code, joy 的 这样的工, 非代码类的任务啊,一律都交给这个 pi agent, 因为 ai coding 是 整个行业里面变化最快的一个赛道,模型在变,工具也在变,大家现在呢,可能觉得灵活性啊,是一个可有可无的东西,但是如果你用 agent 用的越来越多啊,这个灵活性绝对是一种必要的风险控制。 接下来呢,我们就来分别讨论一下海外的套餐跟国内套餐。我们先来说海外的,然后来看这个 copilot。 四月二十日啊, github 宣布 pro 套餐呢,砍掉了 opus, 然后并且暂停了新用户的注册。一周后呢,又官宣说六月一日,所有的 copilot 套餐全面转向 usage based billing。 什么意思呢?就是 完全按量付费,十刀的套餐呢,只能用十刀的使用量,三十九刀的套餐呢,也只能用三十九刀的使用量,完全没有任何套餐的这种优惠。 copilot pro 这个也从以前很高的,这性价比啊,现在基本就归零了。然后呢,我们再来看这 koser 跟 winserve, 它们都是编程的 ide, 你 买它们的套餐本质上就是锁定对应的工具了, koser 去年就从按次付费改成了二十刀额度的按量付费。最近啊, koser s d k 也开放了,但同样也是这个按 token 消耗来计费, enzo f 呢,从十五美元涨到了二十美元,超额的部分也是按官方价格计费。不过二十刀的套餐实测下来呢,大概会给到两百刀的。这个额度确实算比较大方的了。如果你用科斯经常显示说额度不足,那我就非常推荐转到无音色 f 了。这些工具呢,其实都很好用,但你越依赖他们的这个专属 agent 自动化的流程, 你的迁移成本以后就会越来越高。然后我们最熟悉的现在最紧俏的 kyc 要求身份认证,相当于呢,在定向了,清退中国的用户, 国内用户直接订阅的被封号的风险非常高。那通过中转站是不是就可以了呢?其实啊,中转站那就水就更深了,可能参假模型,可能跑路或者卖用户的数据很多很多,这些歪门邪道的,这个玩法真是防不胜防的。 而且目前的国内中转站,我使用下来,完全就是一个劣币驱除良币的一个趋势,越来越烂,这些风险都太高了,我其实是不太推荐的。那海外收紧之后,国产的扣紧套餐到底怎么样呢? 国产的 q 型套餐我觉得有个好处,就是大部分啊,都是通过 a p i 的 形式,没有锁定的工具。不过问题就是啊,国产的套餐如果按照模型强,速度快,额度足,这个过一遍的话,没有一个是全满足要求的。 比如说第一个 g l m 模型强,吐字慢,而且抢不到。我自己呢,就是订阅用户 g l m 五点一啊,能力在国产里面算是很强的了,但高峰期呢,只有十到十五的头肯每秒,下午跟晚上呢,慢到你真的限额都跑不完。 kimi k 二点六呢,能力是不错,但也涨价了。 k 二点六相比 k 二点五啊,单价大概涨了百分之二十左右。 后台的额度不透明,主观体验上给的额度呢,我觉得也不是太多。 mini max 呢,我觉得额度也够,然后速度也够,但模型能力呢,我觉得就 稍微低了一档。如果你玩小龙虾,跑一些日常的新任务啊,我觉得 mini max 是 非常合适。最近刚出的这个 deepsea v 四 pro 啊,能力很强,吐字也很快。 五月呢,有二点五折的这个活动,性价比非常的高,但活动结束之后,如果官方还是不提供这个套餐的选项,价格呢就比较一般了。不过 deepsea 官方透露下半年会部署大量的国产算力,我觉得这点呢,非常值得大家去期待一下。海外跟国产都评价完之后啊。最后呢,我想给大家一个我的推荐方案,如果你是这个轻度用户, 周只是让 ai 改改脚本啊,写个文档啊,那完全就不用折腾这个所谓的 a p i 接口,像 cursor, winsole, 国产的 tree 啊, coder 啊, cody 啊,哪个顺手你就用哪个就行了,完全没有关系。然后如果你是中度用户,跟重度用户的话, 我就推荐看看 gbt plus 或者 gbt 的 pro。 gbt 官方呢,允许你把 codex 使用的 a p i 接入到其他工具里面,方法叫做 os。 实际上呢,和通用的 a p i 没有区别,最新的 g p t 五点五也能这样用,二十刀的套餐大概能跑出两百到四百刀的这 a p i 等价的这个额度,我自己订阅的是两百刀的这个 pro 套餐,每个月将近能用到接近八千刀的额度,给的实在太多了,再加上这个 codex 啊,本身现在也是 t 零级别的工具, 所以这个套餐我是现在目前觉得非常能打的套餐。当然,如果你预算不高的话,我就推荐 opencode, 千问、 minimax 这些主流的这个国产模型,都能用十刀就能跑出六十刀的 a p i 额度,它给的呢是通用的 a p i, 也不限于 opencode 的 自己使用,并且承诺不保留使用数据,隐私方面我觉得做得更好。 winsolef 呢,虽然额度也给的很高,二十刀大概能有两百刀的使用量,但它的模型啊,只能在 winsolef 内部使用, 而且 winsole 的 agent 能力啊,明显就不如 codex 这个这样的工具了。不过呢,最后要提醒大家一句,不管是叉 g p t 还是 opencode 的 go 套餐,套餐额度呢始终在持续的调整,只是现在的额度还算厚道,计费呢也相对透明。最后呢,再来跟大家讲一下我的一些感悟,因为 ai code 的 套餐啊,涨价越来越高,然后一直都还没停。 我自己这半年最大的感受就是今天觉得性价比很高的套餐,过两个月呢,可能就砍额度了,改规则了。所以我现在选套餐不止看当下够不够用,还会想说,如果他涨价了,我能不能平滑的切换到别的方案工具跟模型分开,本质上就是给自己留一条这样的后路。好了,今天视频就到这里了,我是迪总,黑心李超,我们下次见。