盘点,我买了一些扣领 plan 啊,希望对你有帮助啊。首先决定不再续费的两个,一个是百度云的,一个是京东云的,百度云的应该是目前可以购买了,点击续费是可以的,京东云呢,官网还需要进行抢购啊,但是你稍微懂点代码,通过科技还是很好搞到的啊。 这个东西我不打算续费了,因为不管是百度云还是京东云,两个用起来都比较卡啊。你在凌晨十二点到一点的时候还有可能失败啊。目前我手里有的就是智普的,智普的智普的量比较少,还比较贵,但好处是啊,这是国内顶级的模型啊,并且 glm 五点一真的是没话说啊,比较厉害, 那我买的是按年续费的啊,基本上也不怎么用,但其实堵的是未来啊。再说一下前几天抢到的腾讯的 qing, 腾讯的 qing 盘真的是比较好用了几次,非常的流畅啊,不管是晚上还是白天,用的时候是非常流畅, 所以日常跑一些 cookie plan, 我 还是会用腾讯的来进行跑。阿里云呢,还是最难抢的啊,所以还在抢购当中啊。所以目前来说比较有潜力的国内的就是阿里云,腾讯云还有智普的,尤其是智普啊,我觉得必须得买一个,万一以后出来了五点二五点三或者直接出六,比较惊艳的话,到时候想用都用不到了。
粉丝2.3万获赞27.1万

国内的模型基本没怎么用,结果想买的时候试一试,发现买不了了,包括阿里云、百联和智普 ai, 智普的 g m m 也用不了了,每天都需要去抢。刚才我去十联讲了一下,发现它的网页是在转呢,跟抢票一样。 所以大家啊,早买早用,现在这个 kimi 还是可以用的。这个 kimi 还能用,赶快去买一下。我建议买个四十九到或者九十九的都可以,我买个九十九的 kimi 还是可以用上,感觉跟克拉扣的是有些差距,但是便宜,大家可以试一试,尽早用 其他的模型,比如说迷你 max 或者是 dipsic, 这些还是一般,有的说迷你麦草, 目前迷你 max 是 它的,这个定制 plan 是 可以用的。我买了一个 plus, 先试一试。刚才试了一下啊,还行,但是你要让玩龙虾比较贵,我不太建议用龙虾,用迷你 max 有 点贵了,我可以用本地去部署, 或者你就用一下提米豆的就可以了。还有庆大家一些,这些 ai 的 层出不穷,一个月一个版本,所以我建议大家就买一个月就试一试就得了,不要开这种连续包年的。这种的你看比如说前两天刚 充值 cds 二点零的,现在又出了新模型,所以一个月左右基本上就过时了,所以大家还是自己看一下,如果有钱无所谓,可以试试用这种单月的。

说说国内现在扣丁 plan 啊,简直被那帮玩龙虾的玩坏了,几乎所有的好一点的大的平台扣丁 plan 全部缺货,这 能买到的科大讯飞最近出来这个扣丁 plan 昨天用了下,根本没法用啊,直接一个问题卡三次,我已经退款了。那场的那些扣丁 plan 百度的京东的我手里都有,也是,基本上就是用一会就卡一会,并且我还在晚上用啊,就是十点之后有的时候凌晨一点还在卡。 谷歌和京东的整体体验不是很好啊,用一会卡一会。这种情况感觉就是被那帮玩养龙虾的玩烂了,愿意直接封禁那些养龙虾的啊,扣顶 plan 就 让他做扣顶。觉得卖扣顶 plan 的 厂商还是要考虑一下养龙虾的跟做扣顶的一定要分开啊,要么这样根本没法玩啊,现在扣顶 plan 用来扣顶的体验真的太差了。

朋友们,最近有没有被抢扣定 plan 搞得心累?大半夜蹲点盯着屏幕刷新,刚一放出来就秒空,盯着已售罄按钮怀疑人生。难道现在写代码都得靠运气了? 说实话,这事真有点离谱,国产扣定 plan 抢的比演唱会门票还凶,大家拼手速、拼网速,甚至拼脚本。但你想过吗? 我们抢这些破烂的本质是为了用上好的国产大模型,不是为了抢的快感,对吧?那如果我说现在有个县城不用抢价格还更低的选择,你会不会觉得之前白忙活了?这个答案就是 opencode 的 购套餐, 它是 opencode 的 官方的编码套餐,订阅打开就能用,不用抢,不用邀请码,不用求人,价格最低五到一个月,一杯奶茶钱就能把你想要的国产模型全包圆。 哪些模型?听我报! g l m 五点一 g l m 五 kimi k 二点五 kimi k 二点六 miyamoto 虎背多 spin toe single pro miyamoto v 二点五 quan 三点五 plus quan 三点六 plus mini max m 二点五 mini max m 二点七 deepsea v 四 pro deepsea v 四 flash 基本国内能打的模型都在里面。这就像花奶茶钱吃自助餐,满汉全席随便选。而抢抠订 plan 就 像排三小时队进去只剩汤。而且勾套餐首月只要五刀,用链接订阅还送五刀,等于第一个月基本白嫖, 支付也方便,没什么限制,不像有些平台,又要验证又要绑定,烦得很。你可能会问,这玩意用起来麻烦吗? 完全不! open code go 的 使用方法和国产 coding plan 几乎一模一样,甚至因为是国人主导的开源编程工具,对中文支持比伯来品更友好。具体三步走,第一步,登录 open code 赞订阅 go 套餐,复制 api 秘钥。第二步,在 t u i 界面运行 connect 命令,选择 open code 勾粘贴密钥。第三步,运行 model s 命令。看可用模型列表,就这么简单,三分钟搞定,一点不折腾。而且画面和交互流畅度比某些平台好太多,不是能用就行,是真的好用。 说到套餐,大家最关心的肯定是够用嘛,我直接说,数字单次五小时限制对应十二美元使用额度每周限制三十美元, 每月限制六十美元,正常写代码做项目额度根本用不完。当然,具体请求次数看模型,便宜的比如 mini max m 二点五,能跑很多次,随便造贵的, 比如 g l m 五点一,每次消耗多,用量相对少点。但这设计合理,就像自助餐,想拿三文鱼还是青菜,各取所需。 open code 的 官方还整理了预估请求表单,帮你规划用量。总之,对正常用户来说,这个额度非常慷慨。 最让我惊喜的是, open code d 勾不只是给自己工具用的,还能接入其他编程代理。意思是订阅后通过 open code 的 api 端点把模型连到 code code 或者 codex 里用。比如你平时用 cloud code 写代码,默认是 andropic 的 模型, 现在通过购套餐 a p i 把 d c v 四 pro 或 kimi k 二点六接进去,让 cloud code 用上国产模型,是不是很妙?不过要注意, open code 的 配置里的模型 id 得用 open code 构格式。比如想用 kimi k 二点六,就写 open code go kimi k two dot six。

我找到了一个免费使用 cloud code 的 办法,不需要购买模型,厂商的 coding plan 也可以使用。今天分享给大家,我刚刚成功领取到了小米赠送的 talking 余额,够用一段时间了。看完这个视频,你也可以领取并接入到 cloud code 之中。 这个就是小米推出的创造者百亿 token 激励计划。链接我已放入评论区,只需要五步就可以免费申请领取。首先我们点击立即申请前三项,按照我们的实际情况进行,填写 你的邮箱常用的开发工具。然后目前使用的底层模型。第四项和第五项是需要我们重点填写的。第四项,我们可以将我们的日常项目进行包装,利用 ai 进行润色描述, agent 或者 ai 驱动的具体成果 写的越丰富,通过率也就越高。第五项,可以上传我们 ai 平台的账单截图,还有终端运行日记等, 这个最多支持五个文件,可以上传图片或者是录屏都可以。在最后可以覆盖我们 github 的 演示地址。 点击提交,系统会在三个工作日内提交评估结果,之后会收到这样的一个小米 miimo 创造者激励计划。然后我们在这里点击开放平台地址, 我们点击控制台,这样平台送给我们的余额已经到账。我们选择 api case, 新建 api case, 填写 api k 名称,选择比较好记忆的名称,点击确认即可,这时会弹出一个 k, 它只会显示一次,我们要把它提前复制好。接下来我们使用 cc switch, 我们在添加中添加新供应商。以下是 cloud 供应商,我们选择小米米某。需要注意的是,供应商名称官网链接已经填写就绪,我们只需要在这里粘贴我们刚才复制好的 api k 即可。 我们要注意是否请求地址与以上保持一致。还要注意的是目前主流模型有 v 二 pro, 如果想体验小米最新模型,我们可以把这里换成 v 二点五 pro, 点击添加, 这样即可生成。我们点击旁边的这个按钮,点击起用。我们在终端输入 cloud, 这样我们就会发现 mini v 二 pro 已经被我们正常使用了。以上就是全部内容,如果有什么问题,我们可以在评论区沟通,我们下集再见。

这个抠钉 play 疯了吧,一天只要几块钱?九亿次请求随便用,彻底解决 token 价格贵不够用的问题。 它按请求次数计费,每个月最多九万次请求,相当于十亿 token 的 调用量,价格却只有调用的一折左右。而且每个用户之间互相独立,不会因为高峰期降速,特别适合 ai 编程个人开发者, 支持豆包、 kimi、 智浦、 deepsea 等模型,还支持 cloud code、 cursor、 openclaw 等主流工具。操作也很简单,首先订阅 coding plan, 然后配置,以 openclaw 为例,执行这个命令就完成切换。余量在这里看, 每五小时刷新一次,目前周期内我已经用了百分之十六,再过一个半小时会自动从百分之零开始计,这模型量太管饱了。流程已整理好,需要的朋友留言分享。

coding plan, token plan 到底怎么选啊?看我这篇就够了。那首先呢,我们先来看一下这个 mini max 智谱,还有 kimi 啊,这也是今年 open club 带火的三家模型。 那么像 mini max 呢,它分为了三档套餐啊, starter plus max 啊,对应的是二十九,四十九,一九九一个月。那么它的额度呢,是按照每五小时的请求次数的啊,分别对应了六百次,一千五百次和四千五百次。 那这个呢,其实是我们目前比较标准的一个这个额度啊,那我们可以对应的看一下,像智普的话啊,他虽然也是分为了三档, light pro max, 他的价格呢,就稍微贵一点啊,四十九一四九四六九,而且他的每五小时请求次数啊,被压缩到了多少次啊?八十次,四百次,一千六百次啊,跟前面的比啊,跟 mini max 比啊,其实是 少了不止一点半点啊,但是就这样的情况啊,事实上你还抢不到,为什么?因为智普目前来说是比较好用的,这个科元大魔星之一,就这个额度,这个套餐啊,你需要每天去抢才行,他是限量限时发售的, 你能强到啊,才能用到。那对于 mini max 呢,它的特点也比较明显啊,它就是便宜,很便宜,它的这个量也比较充足。但是 mini max 最大的问题啊,它其实就是这个模型啊,不太聪明啊,所以有时候你用起来就就就就会让人非常的生气,知道吧? 好,那还有呢,就是这个 kimi 啊, kimi 也是比较优秀的模型,它的这个套餐名称啊,就这个名字啊,就起的比较文艺了啊,四档,呃, adult, 呃, moderate 啊,等等啊,反正是一个这个音乐相关的 价格呢,也是四十九九十九一九九六九九啊,也稍微贵了一点。呃,另外呢,它的这个额度啊,并没有用每五小时的这个请求的次数,而是转换成了一个比较直观的一个粗略的这个 a 证和用量的一个估计。 那么像这个 a 证的用量呢,他就是说是这个 office 文件处理啊,深度研究,网站部署等 a 证的功能啊,就相当于你出一个套餐,大概能跑这三十个任务, 那么在九十九的套餐就是六十个啊,大概是这么个意思啊,但是实际用下来,这个像是这三十个肯定不不够用的啊,至少你得到九十九块这个档啊,才能勉强够用。 好的,那这三个呢,就是我们比较常用的三家大模型啊,你要想用哪家的模型哎,你就去充值哪家的这个扣定方案或者偷坑方案。 那有人会问啊,我可不可以买一个套餐而去体验这多家平台的这个大模型产品呢啊,其实也是有办法的啊,这就来到了我们的像字节的火山引擎啊,百度千帆,还有腾讯云、阿里云这样的话,他们支持多模型的这些平台了, 那我们还是一个个来看啊。首先这个火山引擎方舟啊,它跟百度千帆呢,其实是一样的啊,它的套餐呢,分为了 light 和 pro 两档,那么对应的价格呢,是四十块和 两百块,那么每五小时的请求次数啊,也是一样的啊,一千两百次和六千次啊,这个跟那个呃, mini max 的 那个基本上是差不多的啊。当然了,它对应的模型啊,就包括了我们刚才说的三家啊,另外再加这个 deep sec, 另外呢,像自家的火山,它就支持豆瓣儿啊,百度的千帆呢,它就支持文星啊,都是它们自家的模型。那么还有就是像腾讯云啊,它的就不太一样了,像这个火山和百度呢,它是这个 codingplay, 那 腾讯云呢,它其实是已经转为了这个 tokenplay 啊,他分为了四档啊,对应呢三十九九十九,二九九五九九的价钱,那么他的额度呢,大家可以看到,已经不是每五小时请求次数,而是直接给你这个头梗数量啊,三千五百万,一亿三点二亿啊,六点五个亿, 那这个三千五百万是多少呢?啊?我们知道 q 可乐应该好像是每天赠送四千万吧 啊,然后这个三千五百万就怎么说呢,你平时如果做一个复杂一点任务,可能这几百万甚至上千万的这个头肯定就用完了 啊,所以就是说这个三千五百万,基本上这是一个月啊,一个月的额度啊,如果你要去做的话,基本上三千五百万是不够不够用的啊,你要做复杂一点的工作啊,你基本上也得考虑九十九以上的这个套餐 好,那么阿里云百链呢,它其实也是正在这个转化的过程中啊,它过去呢,也是这个 coding plan 啊,分为 lite pro 啊,四十两百, 包括这个请求次数啊,跟这个火山跟百度啊都是一模一样。但是呢,它刚刚啊,也是推出了它的这个 token plan 啊,但是它的是团队版的 啊,分为了标准、高级和尊享啊,价格也是上了个档次,一九八六九八,一千三百九十八啊,对应的话它是也一个这个积分制啊,两万五的积分,十万积分啊,一个月是这么多。 呃,这个怎么去换算呢?我我还没仔细看,但是这个肯定是不如这种每五小时多少次的这种方式的,而且呢,它现在其实是不如这种每五小时多少次的这种方式的,而且呢,它现在其实 呃也是需要限量抢购了啊,就是说你平时哎,基本上已经属于买不到的情况了啊,这个就是这几家大模型平台的一个情况。 最后呢再给大家做一个总结啊,如果你是刚入门啊,想追求这个性价比,而且呢你也是想做一些简单的任务, 那这个 mini max 呢,是你最优的一个选择。但是你要真正让它去干活的话啊,那个智普啊,智普其实是我们干活的一个首选啊,它的大模型质量也都很好,但是呢,但是呢啊,它是限量的,你要去抢啊,能抢到才可以,抢不到那就用不上了。 那么次之呢,我们就可以选择这个 kimi 啊, kimi 他 也综合下来也是非常不错的,而且他对这个超长上下文的处理是非常不错的,非常棒的。那如果你是想在同一个平台上用多个模型,那你就可以考虑像这个字节的火山、百度千帆、腾讯阿里 这样子属于这种模型超市的这种类型的平台。那它对应也有这个 cookie play 和或者 token play 啊,支持了像前面的几家大模型以及 deepsafe 啊,当然了也包括它们自家的模型啊,其实也都是模型上来说,抛开价钱不说,模型上都是大差不差 啊,你要想用豆瓣,那就用火山的。你要想用千玺啊,就用阿里的。但是这个你要知道美家来说啊,对于美家来说,他们像自家的这个模型啊,肯定才是主力。那他们也有其他平台的模型,但是你要知道, 呃,我要在这个平台用别家的模型。它一般来说啊,一般来说肯定不是最新的啊,最最优的,最好的啊,它可能会隔几天才会更新到最好的。好,那这个就是 coding plan, token plan 的 对比,你想好你要用哪家的了吗?

如果你有订阅 coding plan, 并且每天 token 的 消耗量巨大的话,你肯定遇到过这个问题。当你用 cloud code 把一个项目好不容易推进到一半的时候,突然触发限额了,那此时要么选择去休息五个小时,等它额度刷新,要么就切换到其他的 a 阵继续推进这个项目。 但是不同 a 阵之间的 session 状态是不互通的,比如你没有办法在 codex 里面直接用 resume 的 命令去继续一段刚才 cloud code 的 这个状态,就像你没有办法在 deepstack 里面去继续一段你跟豆包或者跟 gbt 之前的对话。 我遇到这个问题的时候,就觉得这个问题肯定有人解决过,于是我去看了一圈网上的所有项目,但是看完之后我发现了一个更大的问题。现在所有去尝试解决这种多 a 阵子上下文共享的解决方案, 都是从记忆管理的方式出发的,没有人是从状态管理的方式出发去解决这个多 a 阵子上下文共享的问题。 为什么我要特别说这种从记忆管理的方式出发的解决方案解决不了这个事呢?因为我试了一下,比如说像曼木林莱塔这种做共享记忆的,他们做的都是同一件事情, 就是把你之前做过的这些项目,或者你正在做的项目写成招标存到知识库里面。比如你做过的这个项目,他是什么项目,目标他分成哪些阶段,之前做到哪一步了,下一步是什么,踩过什么坑之类的。 当你开了一个新 session, 或者你接入一个新 agent 的 时候,在你开始跟这个 agent 正式讨论项目之前, 他们会先 rank 一下,把之前关于这个项目的记忆给这个 agent brief 一 遍,相当于就省掉了你每次在新 session 里还要先跟 agent 聊这个项目背景时间,但是这种程度的 brief, 它能解决多大的问题呢? 我观察下来,感觉没有什么太大用处,因为可以从一个很普遍的矛盾现象开始说起。 就是在 ai 行业,当大家去聊 point 定的时候,我们嘴上都说肯定要做状态外化,要把 a 证当做无状态机来管理项目,但是你看实际在用 a 证子的这些工程师,其实没有人是这么干的。我观察下来, 我们团队的工程师,大家都是非常主动的,手动的在管理这些 sessions, 一个 session 做一个项目,什么时候要 branch 去做不同的方案,什么时候要 rewind 去去掉一些之前污染掉的上层文,这些都是在手动管理状态,而不是在 用一个更本质的或者更普遍的记忆管理的方式去修改。那说明记忆管理在这个场景下起不了作用,大家都还是依赖于状态管理的。那什么是状态管理呢?用一句话来说两者的差别。 如果说记忆管理是让 a 正更好的回忆过去,那状态管理就是直接让 a 正回到过去了。听起来只有一字之差,但实际上他们两个是完全不一样的。 如果以人类同事之间的写作来打个比方的话,那就是这样,假设你有一个同事要离职, 需要你去接手这个同事的项目。按照第一种记忆管理的这个逻辑呢,就是让这个同事先写一份非常详细的项目交接文档, 为了高效的交接,这种文档通常会很精简,他只会把最主要的,比如说这个项目的目标,计划这些东西给写下来。但是一个项目的计划,他通常会经历很多轮的讨论和修改才定下来, 而你却看不到这些修改。你在项目交接书上通常只能看到最终定稿的这个方案,所以你是不知道他写下这个计划的 context 有 什么的。 而第二种方式就是状态管理的方式,这个思路就有点像是在打游戏,相当于让你的同事在离职之前,把自己的状态和整个游戏状态都存个档, 当你去交接的时候,你直接点击继续游戏,你去读了他的存档,你切换到你带入到了他的角色之后,就自动继承了他的所有项目记忆,那你直接往下打这个游戏,直接往下推进这个项目就行了,也不需要去写和读什么项目交接文档。 当然在现实世界里,人类之间肯定是只能通过文档的方式来写作和管理的。但是对于 agent 来说,用第二种方式,用这种直接让一个 agent 共享自己的游戏存档给另外一个 agent 的 方式却是完全可行的。 说到这个,我也做了一个能让 cloud code, codex 这些 agent 之间无缝共享它们状态和 session 的 一个产品,叫做 oppo bridge, 可以 直接在 tapp 上面找到。那说这些你可能会觉得像共享状态,它是不是明显听上去就要比 共享记忆来的更好?其实也不完全是,虽然状态共享能够直接让你带入角色,带入所有的记忆,但是他有一个问题,就是他会把一些不必要甚至是有负面作用的污染了的上下文也带进来。比如你在读入你 同事的存档那天,你同事当天可能因为股票亏钱了,所以花了很多心思去想股票为什么亏钱,那你就会把他关于自己股票亏钱的这些记忆也继承过来。而这些记忆的上下文对于你推进这个项目来说,却是没有任何帮助,甚至是占用了你很多上下文空间。 想到这一步,咱们其实就已经在讨论一个更深刻的问题了,就是共享记忆和共享状态长期来说他们应该是一样的。 换句话说,只要你那个离职的同事他足够能写,并且你的阅读理解能力足够强,那完全可以让你那个同事给你写一个 一千万页的交接文档,然后你快速读完,读完了之后你就可以极高的颗粒度去复现他推进项目的状态,那其实就和直接去读他的这个游戏存档也没有什么太大差别了,甚至这样效果会更好,因为 他不会把他的那些糟心事都写到这个文档里面来,那你的上下文就不会被污染掉。所以现在我们觉得 工程师去主动管理这些筛选状态和去同一个外部记忆来协调 agent 的 上下文,是在做两件不同的事, 但是本质上他们是在以两种不同的侧重点来解决同一个问题,就是怎么样给 agent 最合适的上下文,让他去完成任务。 all right? 我是 b a 七,欢迎关注我的 ai 创业日记, have a good one。

分享一下我的 coding plan, 前端用 tray 接的 mini max 二点七,平常做简单一点的任务,或者用谷歌的反重力,这个是有免费额度的,后端和复杂任务就交给 cloudcode, 用 c c switch 呢去接小米的 minimo 二五 pro 或者是 deep six v 四 pro, 我 呢就只要做素材和协调智能体就行了。小米的这个模型还是很强的,就是有一点贵,一百块钱的话两天就用完了, 当然有那个活动可以免费拿 token。 dipstick 我 充了二十块钱,到现在还没用完,命中缓存的价格现在非常的低,而且它的命中率是比较高的。然后还买了 opencode 的, 这个够,里面 g r m 的 用量非常少, 主要还是用 kimi 的 全模态或者是 dipstick v 四 flash, 这个是比较划算的,体验下来的话, mini max 它是量大管饱, 就是有时候的压力比较大,会比较慢。我感觉平常做一些小任务或者养龙虾啥的还是挺不错的。你像 dipstick 是 按量计算, 目前的价格也比较合适这个 open code, 它其实是披着 coding plan 的 皮,还是按量计算。 小米的模型是比较强的,就是稍微有点贵,当然这不是它的问题。你们还有什么高性价比的 coding plan 推荐吗?

我觉得现在最适合用这个 oppo 靠的模型呢,实际上可能是阿里新推的这个服务啊,这个东西叫这个扣丁不烂是吧?呃,为什么呢? 就之前吧,就是续费了好几个这种模型,然后呢?你续的不多,但它其实用量还挺大的,你看昨天晚上我就大概一个小时,我就把 kimi 的 那个十五元的 top 的 额度也就一个小时我就用光了。 我算了算,调用其实也不多,但是因为你在欧风靠的调用和你日常对话的调用是不一样的。今天我想打算试试这个阿里云百炼,简单说一下这个东西怎么回事啊?他其实就是把几个常见的这个模型给打包了,打包了以后有一个专属的调用地址和专属的 api, 来看一下它的指南。它是这样的,整合了这些顶级模型,然后还兼容主流的编程工具,就比如说我们 用的那些 id 类类的工具哈。如果你要是正常调用,他有的时候会限制速度或者限制这限制,那如果你一定想使好的模型,要么你去买会员,要么去升级,是不是他通过固定的费用?其实我算了算,应该是还是挺便宜的,虽然不至于到这个可调用的一折,但还是挺便宜。 然后它现在有几个基础的模型啊?这个千万三点五过年的时候推出的,很牛。据说啊, kimi 呢,也是刚推出不久,然后 mini max 当时那阵刚推出的时候也火了一阵。 glm 那 个五现在可以对标,他说可以对标那个叫什么来着,那个很牛的那个。 然后它有更多的就是千万三的 max 模型,这也是版本挺新的,二六年一月二十三号的,然后加上这些小模型啊,这无所谓,就是我们理论上如果你的调用次数差不多,那么你根据你的任务来选择不同的有特色的模型就可以了, 尤其是千万的这个和 kimi 的 这个都支持。图片理解费用上啊,首月七块九,其实你看的挺便宜,对不对?然后这个高级套餐呢,是三十九块九,就真的是特别便宜,但是价格上你看啊,首月七块九,次月呢是二十,也就是说他的正价是四十块钱,第一个月呢是便宜,然后第二个月呢是五折,第三个月就是正价。 呃,我猜两个月以后可能在这种东西上可能会有更多的爆发。呃,其实现在我我印象里火山就有这种类似的这种打包的这种服务,但是呢,一呢他的价格不便宜,二是他好像我查了查,他没有明确的说他支持那个 oppo 扣,这个呢是明确的说了他支持这个 oppo 扣,然后即使是最贵的这种 两百每月,那也真的是不算贵,因为你如果真的深度用了,你把两百的额度都用光的时候,那我认为你值得在这个上面花更多的钱。然后那个那天我还看到论坛上就有一个人说我除了租房子吃饭和日常开销,我把所有的钱都用来买陶坑上,哈哈哈,其实这是很有意思一件事啊,我觉得真的挺贵的。 我,我查了查我的用量限制,我觉得我用的不算多,但是其实也不算少,我其实在很多工作上都是在在那个詹妮的那个网页上去完成的,因为很多时候你要做调查呀,做一些文本的生成啊,那些东西他那个 pro 的 版本就完全能搞定了,因为我有个 pro 的 版本,但是如果按照他这个标准, 每五小时一千两百次请求,我现在是达不到的,但不知道我买了这个套餐以后会不会达到哈,我回头再测一测。那我认为新手呢,你就花七块九加上二十块钱,先用两个月, 对吧?然后当你发现不够的时候,你去升级那个就可以了,你就直接干到二百一个月呢。其实也没啥,二百块钱一个月也就是个电话费吧。我现在已经买完了, 买完了以后呢?他现在剩余天数二十八天,我不知道他为什么是二十八天,明明买的是一个月对不对?这个是不是他的 bug 按照当月天数计算的?那你们要不要搞到下个月再买二十八天?你看他是按照这个算的,上个月的二十六号到下个月二十七号对不对? 这个就不对了,这个非常过分啊,明明是一个月,所以我打算提前使光呢,呵呵。然后我们获取了这个东西啊,它有专属的 api key, 然后呢,怎么配置啊?这里面说明,我们来找说明配置, 看 open 框中配置这些东西,实际上不要被它这种东西吓到,如果你的 open 框现在正好用的状态, 你就把这段命令考下来。怎么写啊?我这就写了,我现在咱说说怎么配置哈,就首先呢,第一步就是修改配置文件,哪个配置文件呢?就是这个东西啊,但是呢,我们在 open 里可以直接跟他说,这是我上面已经配置完了,我重新演示一遍怎么配置,就跟他说修改配置文件啊, 然后呢?把这句 copy 过来啊,这这段啊,把这段 copy 过来,然后你可以把你的 apk 呢替换到这,我懒得打码,我也就不替换,放到这。然后呢?就这样呢,这个命令就搞定了,你回车, 回车以后就是我刚才的配置,那我已经配置完了,他现在就告诉我有这些可以用的了,然后同时它底下呢,还有一段,你可以直接考过来, 然后站到这,然后回时它就会自动把你这些东西都改好。看到没变更的载药就是什么呢?它其实就是告诉你默认模型变成这个,主模型 变成这个,然后移除了原先的什么什么,这些,就移除了原先其他的所有模型,然后把其他都移除了,我还有钱在里面。其中我认为比较好的几个,特别好的四个主流四个模型就是 kimi 的 二点五,对吧? g m m 五, 然后迷你 max 的 二点五,这个也不错,迷你 max 二点五。我发现他好像在写程序上更有优势。也是这样的,我的感受上啊,因为他的代码他理解的更快更好。然后这个是个多模态模型。嗯, kimi 应该是多模态吧,我记着这两个是多模态模型,如果你需要用到图片处理,尤其是处理本机的图片的时候,这两个模型非常好。 到了这步你的七块九已经发挥作用啊。至于接下来怎么用,那其实还是靠大家去想象。我之前因为这个模型的用量问题,我现在想都给他背地里的任务, 我现在都给他加回去,加回去以后我看看他这个调用的数量到底能撑多久啊?我每天会监控他的用量,我把他这个用量记进去吧, 非常好。我觉得整体来说这下就算完事了,至少我这个月应该不会特别为掏坑的续费吧?因为每次他如果出问题的话,你很难发现,除非你里面充特别多的钱。

我找到了一个免费使用 cloud code 的 办法,不需要自行购买,墨星厂商的扣丁 plan 也可以使用。今天分享给大家,我刚刚成功领取到了小米赠送的七亿 token, 够我使用一段时间了。 看完这个视频,你也可以领取并进入到 cloud code 之中。这就是小米最近推出的创造者百亿 token 激励计划。我们只需要填写五道题目就可以免费申请领取。 我们申请这个活动只需要下面两步,第一步,打开活动官网,然后填写页面中的问题。前三道题随便填写,但真正卡人的就是第四题。 因为很多小白不知道如何使用 agent 或者 ai 构建项目,但没关系,我已经将我成功申请使用的项目描述可进入到 cloud code 的 详细步骤,写入到了文档之中想要的评论区留言。 我们在完成题目提交申请之后,我们就只需要等待审核。审核通过之后,我们会收到小米官方的邮件,邮件中会包含开放平台的地址。我们进入到开放平台,首先需要进行登录,如果你还没有注册过小米账号,可以先使用手机号进行注册。注册完成之后,你也可以使用手机号进行登录。 登录完成之后,我们可以点击右上角的头像,选中个人中心,然后再绑定我们申请使用到的邮箱。绑定完成之后,我们再点击控制台,然后再点击左侧的订阅管理, 我们就能看到我们领取的 token plan。 在 这里我们可以申请 token plan 的 专属 api key。 下面就是将我们领取到的 token plan。 通过 cc switch 接入到 cloud code 之中,我们需要打开 cc switch, 然后点击加号添加一个新的模型供应商。在这里我们选择小米 miimo, 选中之后我们向下滑,然后将上面申请到的 api key 填写在这里。注意这个请求地址需要改成这个,因为这是 token plan 的 专属请求地址,具体的地址我已经放在文档中了。下面的模型最好也贴换成小米最新的 mimo v 二点五 pro 模型。 配置完成之后,我们点击保存就可以了。添加完成之后,我们点击骑用小米 mimo 的 配置就可以了。 我们可以打开终端,启动 cloud, 然后检查我们的配置是否生效。 token 我 们已经成功领取到了, cloud code 也接通了。如果你想知道如何使用 cloud code 实战,麻烦点个关注,我们下期开始讲解实战内容。

随着 open core 的 爆火,调用大模型所花费的掏根数也随之水涨船高,如果你还在用 api king 的 方式,那么离破产可能只差几句话了,因此我做出了一个违背祖宗的决定,给大家带来国内四家平台 cookie plan 月套餐的对比。首先出场的就是我们的 mini max, 然后就是 g m l 智谱, 然后是火山引擎,最后就是我们的阿里百链平台。介绍完了这四家厂商,接下来就来介绍一下我们的规则说明。 我们仅以四家平台的月 coding plan 套餐作为对比,记住是月而不是季度或者是年。然后就推出我们的换算规则,换算规则就是一 p 等于十五次模型调用, p 就是 promote, 一 promote 就 相当于你使用 coding plan 套餐完成了一次完整的调用,而一次完整的调用在模型后台可能被切成了十几个任务, 有读取上下文,提出建议,修改建议,调用工具之类的就会非常的复杂。然后官方为了简化计费计算,就统一把这十几次连续的模型调用打包成了一次 promote。 然后我们再来介绍它的额度限制,它有第一种就是五个小时限制,一次额度就是你每五个小时达到了它的调用上限, 它就会限制你调用,然后直到这五个小时过去,然后它会再刷新额度,然后就可以再次使用,然后一个月就是这样一直重复。接下来就是周总额度限制,就是在五个小时的额度限制之上,你每次花费的 token 在 一周内累计不能超过它一周内的总额度上限。 然后就是月总额度,在周总额度限制的前提下,每家你每周所使用的额度不能超过一个月的总额度上限。如果你超过一个月总额度上限,那么你这个月就不能再用这个套餐了,因为它已经额度用满了。最后我再来提一下,我们的月是按每个月三十天来计算的。好了,接下来就介绍一下我们的第一家平台 mini max。 mini max 我 们看一下它是有六种套餐的,我们先来看最下面三种,从 star 每五个小时掉,我们的 promax 数也是逐渐长高的。 然后再看上面三种,有 plus 极速版到 ultra 极速版,它的价格也是这样递增的,然后它每五个小时可以调用的 oppo 的 次数也是在递增的, 但是它多了一个后缀就是极速版。极速版就是相对于下面三种套餐来说,它们模型的调用速度快了不少。然后我们总结了上面的价格和每五个小时的额度限制,我们就统计出了这样一个表格, 因为 mini max 只限制五小时额度,所以我们就通过一周大概等于三十三点六个五小时,推算出了它的周最大额度上限。然后我们再计算出一个月等于一百四十四五个小时,可以推算出它的月额度最大上限。 因此我们整理出了这张表格,然后就是它支持的模型定有 mini max 二点五、 mini max 二点一和 mini max 二。然后我们再来看第二家智普, g m l g m l 是 有三种套餐呢,只有 leader pro 和 max 版本。智普也是在国内 callenplan 套餐中它是最抢手的,每天早上十点钟刷新,你去看一看,其实很快货就会被抢空了,也不知道为什么,难道是饥饿营销吗?然后我们来继续往下看,相比于 mini max 的 每五个小时只限制一次额度,它增加了一层规则,那就是周额度上限。 既然有了周五的双线,因此我们可以算出每个月大概有个四点三个周,我们可以得出大致的月利润最大双线。然后我们再看它支持的模型,它 leader 套餐不支持 gm 幺五模型,然后其他所有套餐都支持 gm 幺五和 gm 幺四点七及其所有的历史文本模型。 接下来我们再来看第三家,也是我们的火山引擎,也就是豆包,它只有两种套餐, leader 和 pro 套餐。然后它跟前面两家比的话,不一样的就是 它不采用了 promote 来计数,它采用的是模型调用次数,但是在它的文档中也说明了它每一次调用也会花费大概十几二十多个不等的调用次数,所以我们也可以 理论上给它计算回来,这样就得出了每五个小时然后周额度和月额度的 promote 次数。然后可以看到它支持的模型是 豆包二点零, coder, 还有豆包 coder, 还有 g m 幺四点七,然后 d s c v 三点二,还有 kimi 二点五,支持的也是非常多。然后再看最后一个就是阿里一百链平台,它的套餐是和豆包其实一模一样的,然后它的收费标准还有额度上限都和豆包是完全一模一样的, 它两个不愧是相互对标的模型平台,搞的套餐都是一模一样的。然后再来看它支持的模型是千万三点五 plus kimi 二点五, g m 幺五 和 mini max 二点五,还有千万三, max 还有千万三, codenix 还有千万三, codenix 还建妙四点七,所以从模型的角度上来说,它还是略胜火山引擎一筹的。 我们介绍完了四个平台,我们再看下全平台的性价比对比。我们的性价比对比,采用它每个月理论上能调动的最大蓬勃的次数, 除上它的价格,我可以算出来多少 promote 美元,这样我可以计算出它理论上最大的性价比。然后我们可以看到,在这个排名中, mini max 家族可以说是遥遥领先,垄断了第一的位置,接下来就是我们 g m l 垄断了第二的位置,接下来就是豆包和火山引擎 并列第三名。好吧,这究其原因其实也很简单,因为 mini max 平台它只限制五个小时的调用额度, g m l 平台只限制一周的调用额度, 火山引擎和百联平台限制了一个月总额度,所以从理论上极限来计算,那么必然是限制越少,它理论上调用的次数就越高,所以 mini max 领先于 g m l, g m l 领先于火山引擎和百联平台。然后分析了极致性价比之后,我们再来看模型丰富度对比, mini max 中只有支持它的 mini max 的 三款模型,智普只支持它的 g g m l 家族, 然后火山引擎的话就支持豆包还有 deeptech gm, 它都支持。最牛的就是百炼平台了,它有八款模型,分别是千问系列,还有 kimi gm 幺五, gm 三七。 mini max 二点五,它可以说是把过年以来国产最好的四款模型都集齐了,也就是 我们的千问三点五、 plus kimi 二点五、 gm 幺五、 mini max 二点五,这可以说是过年以来最好的四款模型。 从模型丰富上对比,我们的百例平台有八款模型,我们的火山引擎只有五款,仙妙的话只有三款, 还有迷你 max 的 话也是只有三款。从模型丰富上对比,我们的百例平台遥遥领先。说完了模型丰富度和我们的性价比,接下来我们就推荐一下。推荐那当然是要为不同人群量身定制的,我们第一个就是为小白新入门的小白人群推荐, 每个月预算大概四五十块钱,我们就推荐他火山引擎和百联引擎的 live 套餐,他足够便宜,而且每个月有一万八千次的模型调用,也足够你入门了。 然后他的模型还很丰富,就可以支持你用多种模型,让你感受一下是不是新手小白,肯定都很想感受一下不同模型的效果到底怎么样,这是非常适合新手小白入门使用。接下来就是追求极致性价比的人群了,他每个月预算大概一百到一百五十元,我就推荐 mini max 的 max 套餐, 它的性价比最高,理论上来说是美元,可以调用三百六十三次 promote, 理论上每个月可以调用六十四点八万次大模型,所以它的价格也适中。然后性价比是最高的,就是最适合追求极致性价比的人群。 然后如果你如果是日常开发者,预算在一百五到两百元之内,那么推荐你用 g m l pro 或者火山引擎 pro。 g m l 的 理论上调用次数还有豆包的都是很多的,而且豆包上的模型也比较多,然后 g m l 五的编码能力也是非常强的,这样就推荐我们日常开发者使用。 如果你是,如果你是 vivac 的 重度依赖用户,那么就肯定是提高你的预算四百到九百了,那我们就推荐你用 mini max ultra speed 或者是 g m l max, 那么调用次数是有着最大的保障,同时还兼具着最最快速的响应速度,这样足够重度用户使用,不仅兼顾了量,而且还有速度,而且因为它有足够大的量和足够大的并发症,所以它还可以支持多团队使用,团队可 能买这样一个大套餐就够一个团队使用,但是接下来我们再看,如果你是一个疯狂的模型体验党,然后呢?预算大概在四百到两百元,那么肯定推荐你是百练的 excel 或者是 pro 套餐了,它有八款模型 可以供你选的,同时还有四款是国内最好的大模型,一站式可以体验多种 ai。 最后一种就是追求稳定额度的,他们就推荐火山引擎和百联引擎, 他们的每个月调用次数都有明确的上限,不像其他平台 promote 计算的模模糊糊,然后它还不会产生多余的额外花费,算是可预算可控场景,适合追求稳定额度的人群。这样一份 cookie plan 保姆级入门教程,你喜欢吗?


二零二六年呢,截止到今天,各大 ai 模型公司已经累计发布并更新了它们的模型十九次。同时呢,在 agent 的 时代,各大 ai 模型公司除了在比 benchmark 数值之外, 还更重要的比的是用 ag 的 去干活,谁的能力更强,这样就导致了 took 的 消耗量惊人,于是就出现了繁多的 api 和 tookplain 套餐。我今天就给大家盘点一下市面上比较有名模型的 api 和 tookplain 的 价格。 首先是 api 的 价格,我这里从小到大的列出了国内 api 价格和 cloud 的 对比。首先,国内最便宜的 api 价格是 gm 五 turbo, 价值零点一五美元每百万 token。 第二便宜的是刚刚发布了 deepsea v 四 fresh 也比较便宜啊,一块钱人民币每百万 token 一 件。模型方面呢, api 比较便宜的是 mini max 和千万 呃,多模态模型 kimi k 二点五,它也是更新到 k 二点六,价格呢也是从零点五八涨到零点九每百万 token 涨了接近百分之五十。 而 deepsea v 四 pro 呢,它的价格是十二人民币每百万。 tokyo 这个价格是仅次于 cloud, 在 国内模型是最高的,是 fresh 模型的十二倍。输出价格还好,二十四是输入价格的两倍。我们看到其他模型 大概输出价格是输入价格的三到四倍。为了更好更直观的反映这些 api 价格,我们可以看这张散点图, 看到右上角是 cloud opus 四点七和 sony 的 四点六,它们价格是远高于国内所有模型的价格。你还有一个有意思的点是,最贵的模型目前是 deepsea v 四最便宜的模型之一,也是 deepsea v 四 fresh。 总体来说,价格前几名是 v 四 g m 五点一,一米二点六,后面几名是千万三点六和 mini max 二点七。除了像这种按 token 消耗量来付费的 api 价格之外, 各大厂商还推出了一种订阅式按月来付费的套餐,一般叫做 calling plan 或者 token plan。 像这种 calling plan 这里最贵的仍然是 cloud code 两百美元, 最便宜的是 mini max 的 二十九元人民币每月。另外除了像传统的模型厂商之外,像阿里,火山还有腾讯,他们也会推出目前市面上主流的开源模型的 coding plan。 可能由于目前模型厂商推出 coding plan 之后在亏钱,所以像阿里和小米他们现在目前在推的是叫 token plan 的 套餐,就像每月的流量包一样,包月去卖。这些 token 当然远没有 coding plan 那 么划算,而且 计价非常的复杂。这个图像真的很好的反映各个模型它的 coding plan 的 价格。一般国内的 coding plan 价格都是从五十元起到四百到六百元不等,比较便宜的会有三十元左右。云平台它推出的是有四十元和两百元两个档位,不过目前阿里云它连两百元档位的 cocoinplan 都买不到,同时每个 cocoinplan 它都有五个小时的限额。像这里量比较大的就是 g l m 和 kimi 还有 mini max, 而且 g l m 它的它的额度计算方式是通过 prompts 来计算,其他一般是通过请求数的方式来计算, 而一次 prompts 相当于十五到二十次的请求数。而 kimi 它是通过 token 的 消耗量来 限定每五个小时和每周的限额的,然后我们通过它的每周限额以及它的价格能够计算出各个模型 callin plan 的 性价比。 那么单从数值上来说,就是默认所有问题都能答对的情况下。 cloud 它的性价比是比较低的, g l m 最高的套餐是比较划算的,性价比比较高的还有 kimi 的 第三个套餐, mini max 的 第三个套餐。但是呢,这中间其实还有很多坑。首先是 cloud code, 它在准确率上是第一的,所以说不能光凭数值上去否定它的性价比。 然后就是 g l m, 它在我们的官方文档下面写清楚了,如果你要使用 g l m 五点一或者 g l m turbo, 在高峰期掉量是三倍,非高峰期是两倍,所以它的性价比增长都可能还需要出一个三或者出一个二。而且我记得他们的 cody plan 套餐非常难抢,不过效果确实不错。伊米特的 cody plan 也是比较特殊,他们是按 抽空量来限制每五小时的额度的,如果你是玩龙虾或者什么爱马仕之类的,可能就不太友好。下面的三个云平台,他们的套餐性价比一般,但是他们好在他们能够选择各种各样的模型。 mini max 它的计价规则其实挺正常的,所以它看起来这里性价比数值不高,实际上它的量是很大的。 除了 coding plan 呢, token plan, 它的价格以及额度我们可以看一下阿里云新出的这个 token plan, 它的量很大,但是也非常贵,最高能达到一千三每月。而且它的 token 消耗量是通过 credits 的 方式进行计算的, 比如说一点六七个 critters, 相当于八千多个零点六七个 critters 相当于五百多个输出的 token。 小 米也是通过 critters 进行计费的,它是每两个 critters 可以 换一个 mimo we are 的 token。 那么通过这些价格以及它的 token 量呢?我们也可以计算这些 token play 它的性价比。然后这里我们可以看到腾讯和小米它的性价比差不多,阿里它的 token play 性价比稍微高一些,不过这里是以千万三点六 plus 核算的。 通过以上的统计图以及表格我们可以得知,如果你是考虑 api 成本的话,那 gm 五 turbo 和千问 plus 是 价格比较低的。另外如果你是要做长上下文任务,那么 mimo cloud 和 dbsega 是 比较好的选择。体验方面最好的还是 cloud max 套餐。 另外综合魔性的能力的话, coding plan 性价比最高的套餐依然是 glm。 呃, talking plan 性价比也比较高的是阿里云的套餐。好!以上就是本期视频的所有内容。

现在当你开通了一个 coding plan, 其实相当于你已经开通了一家公司,拥有了很多员工,那么你最该做好的事情其实是整合好你这个公司,让每个员工发挥出它最大的效能。 那么现在所有的 coding agent 都希望你能够做得更好,它们在更新中也增加了这些内容。比如说我今天要跟大家分享的就是 cloud code 最新的更新,以及 codex 的 更新是如何能够帮助大家做好一个老板角色的。最新的更新叫 dynamic workflow in cloud code。 在这里面我可以给大家直接翻译一下,他的意思就是一个动态的工作流,他的动态工作流在你给他一个很复杂很庞大的任务的时候,他可以协调无数个员工来帮你进行计划,完成这个工作。 我们可以看一下它之前的一些功能。 altcode 在 之前其实已经拥有了 sub agent 和 agent team 这两个功能。 sub agent 相对来说简单一些,它相当于你有很多员工,你来告诉他每个员工具体要做什么事情。 而 agent team 它在 sub agent 上又多了一层,它员工之间可以进行一个很有效的沟通,它们共享了一个 task list, 也就是他们很清楚他们的任务是共享的,他们在这套任务之下进行一个有效沟通,一个有效协调。但是在现在甚至不需要你来安排他们具体的任务是什么,你只需要告诉他们你最终的目标,最后想得到什么东西, 然后让他来帮你编排他们需要做的事情。这就是最新的这个 dynamic workflow, 它可以帮你进行特别大的代码库的一个漏洞搜寻,然后性能分析。其实在本周的 codex 更新中也更新了类似内容,但是大家的注意力可能更聚焦于 windows, 终于可以进行远程访问,而且是官方渠道的,不是之前的那些大家通过一些修改 来实现的。大家可以发现在无人在意的角落里面, codex 还有两项更新,就是添加了现成协调,在明确要求时可以添加单独的后台现成,然后扩大了它之前讨论串的搜索范围。 这功能其实也是增加了它的编排效率,也就是说它可以在同一个项目里面增加多个现成以及多个 worktree。 然后来同时进行任务了。首先我们开通 codein plan, 使用 codein plan 我 们就是它的老板, 老板呢就需要有一个项目经理去对接,告诉他我们到底要干什么,也就是说我们会开一个总的县城,也就是这个项目会议室,然后其中呢有一个 main agent, 就是 主的县城,去帮我们协调后面的任务。这个东西呢也就是项目经理 sub agent 呢,相当于是每个小项目的一个专家员工,他可以帮我们干不同特定的事情。由多个这样的 sub agent 呢,又可以组成一个 agent team, 然后 team 之间呢可以共享一套任务列表,然后不同 sub agent 在 之间可以进行一个很有效的沟通。 dynamic workflow 大家可以这样理解,就比如说我们要去打篮球的时候,我们要组五个人,分别有前锋、中锋和后卫, 那么我们去踢足球的时候,这个阵容又有变化,他又需要根据我们的不同任务去找不同的人,比如说我们足球又有中场,还有守门员这些位置,这样一个 dynamic floor 呢,其实就是帮我们去编排一个这样的阵容。 如果说你这个阵容在特定任务下固定之后,我们其实是可以附用的。比如说你下次再去踢足球,再去打篮球,我就固定这样一套阵容,然后去找人,去找中锋,找后卫,找个子高的,找速度快的 这样的一个体系。在我们处理这些任务的时候呢,我们就可以形成一个公司的知识手册,也就是他能知道我们之前做的什么事情,然后怎么样组织是高效的,比如说我们打篮球,那我们就按照这样一个阵容去组织,是最高效,最能赢球的, 他就会嫉妒,然后我们后面可以附用。到最后呢,我们其实可以进行一个验收以及测试, 这就是一个整体的工作流。在这里面我已经使用我的 cloud code 开启了动态工作流的方式,我说让他系统理解一下我的这个代码工程,并且形成每个部分的专家,后续呢能够帮我稳定地维护提升这部分代码能力。他在进行一定理解之后,他帮我分成了十四个 startup 的 一个专家系统,然后并且他告诉我说他后续会计入到一个 md 文件中,也就是说我们后面可以附用这套体系, 然后这里面我确定 run, 它就会继续工作了。 dynamic workflow 的 具体开启方法,最简单的就是你在这里面输入 effort, 然后它可以选择,一般来说我们根据模型不同会有几档可选,然后最后是有一个 ultra code 可以 选择,开启了 ultra code 之后就可以启动这个动态工作流, 启动了之后我们就可以在这里面输入 workflow, 你 会发现它变成了特别好看的彩虹这种炫彩色,然后你就可以让它创建这样的工作流去进行这样的工作,大家都可以去尝试一下。

今天做一下九个厂商的 coding plan 最新汇总,前五家没什么差别,放在一起讲, kimi、 mini max 质朴、讯飞各不相同。分开讲 阿里字节、腾讯、百度和无问星球套餐。 lite 版日常价格都是四十元每月, pro 版日常都是两百元每月。除了无问星球,请求量和请求限制都是完全相同的,有需要的拖动进度条到对应场上看表就可以了。 新用户注意,每天抢首充优惠的时间已经标记在视频右上方了。 无问津穷的限额少于四家云厂商, kimi 分 了四档,看个人需求。 mini max 分 了六档,看个人需求。 智普特别注意, glm 五调用是有倍率的,高峰时期是三倍,非高峰时期是两倍。 讯飞、星辰分了三档,第一个月是按 tokens 限制的,后续月是按请求次数限制的。 总之,用什么模型就买对应公司的 coding plan 就 行了。