微软昨天公布了一条消息,就从六月一号开始要限制员工 无限制的烧 token 的 行为。因为微软发现了一个员工一个月烧掉的 token 的 成本比他的工资还贵,所以现在微软要把无脑烧 token 的 这些行为进行管控起来。每个员工你用多少 token, 要有预算,要有流程管理,要有质量控制, 否则你用 ai 编程,你效果看起来很爽,但是你的这个费用是不可控的。现在 ai 编程能力很强,但是它没有成本意识,如果你做任何一个呃商业的行为,你没有成本控制,最后就会处于失控的状态。 所以微软已经开始在管控烧托克的行为了。那么如果你在使用 ai 编程,那么你也需要进行成本的管控。
粉丝3565获赞5.2万

程序员在公司使用 ai 编程产生的 token 费用难道需要自己付费吗?据我了解,不论国内, token 费用一般由公司承担,大模型服务商向企业用户收费。如果需要程序员自己付费,这不真就是自费上班了吗?最后欢迎评论区说一说你了解的情况。

如何快速的消耗掉你的托肯?最近托肯这个词非常火,现在已经有了中文名叫词源,很多人还没有听说过,但是没关系,你迟早会听到的,因为现在有很多公司已经把托肯的消耗量 当成员工新的考核指标了,甚至有不少 ai 圈的大佬每天都在焦虑如何消耗掉多余的托肯。那这条视频就来分享一下我的经验。当然,首先声明,这期视频就是为了纯消耗托肯,并不代表实际的工作价值。 首先,假设你跟 ai 聊天,一个汉字大约只能消耗一个托肯,效率非常低下。但是如果你让 ai 生图,一张图片可能也就消耗几百个托肯很多了,但是也不算是特别多。但是如果你让 ai 生成视频或者处理视频,一条视频就能够消耗几万个托肯, 而且画质越高,消耗的越快。今天我就用酷带斯帮我剪了两条短视频,结果直接烧掉了我一周百分之十的赔额。这个是马斯克的一个采访视频, 大概有四十五分钟,我让 codex 帮我剪出两条短视频,我跟他说的要求如下,首先要保证这两条短视频的故事完整性,第二个要加上一个字幕,第三个必须得是竖屏格式,第四个要把生成一个封面,我们来看一下效果。 and then we obviously want to go beyond the moon to mars, and will they self sustaining city on mars i do think that at that there is a fork in the road of human destiny where if we can establish a self sustaining city on mars with the key test being if the resupply shifts from earth stop coming for any reason does mars continue to prosper or does it die out my guess is that i think that we might have ai smarter than any single human at anything as soon as next year wow, and then and then probably within five like say 20, 30 probably ai is smaller than the sumo here。 我 觉得效果还不错。如果把这个提示词再优化一下或者做成统一的 skill, 其实能生成更好的效果。但我一个星期的额度就只能剪出二十条短视频, 其他的事情就完全不能做了,那还是有点恐怖的。这可能就是 open i 下架 solo 的 原因吧。因为视频生成实在是太消耗 token, 所以 结论很简单,如果你想单纯地消耗 token, 就 让 ai 疯狂地输出视频处理视频的工作,而且要画质拉满,数量拉满,你的 token 余额就会以肉眼可见的速度归零。

大家好, tok 运营业务呢,一直很火,需要哪些资质呢?今天一条视频讲明白,全程干货不绕弯,需要朋友点赞收藏。首先必须划重点,在境内虚拟货币类的 tok, 比如比特币,各种稳定币,不管是发行、交易还是运营,全是禁止的, 没有任何合规资质能办,这是红线,千万别碰。还有直到目前以 token 名义募资,这些都是红线,碰了就会出问题。我们最近服务的大客户呢,主要做的是 ai 算力、 token 以及平台积分那种, 不涉及虚拟货币。如果你也做这种资质,主要分三类就可以合规了。第一类是基础必备资质,首先你得有个公司经营范围呢,写信息技术、软件开发这些,别写虚拟货币待币,不然直接踩雷。然后线上平台必须有 i c p 备案, 就像网站的身份证,还有等保三级,这是 ai 数据平台的标配,网安类也要审核的。第二类,数据和算法的合规,比如你的 token 和 ai 大 模型有关,比如 ai 调用计费算力凭证,就得在国家网信办做算法备案, 要是涉及数据跨境调运,还要做数据出境安全评估,保护用户信息,不能马虎。第三,算力相关的资质,如果自己建服务器或者找托管合作方,必须有 i b c 许可证,要是自己做云服务,还得有云计算牌照 这些呢,都是硬性要求。顺便说一下境外的情况,要是想在香港、新加坡、欧盟做金融类托管,比如稳定币, 那么这些呢,都需要有牌照,所以我们新手呢,别盲目入场,先把资质搞清楚。感谢您的聆听,再会记得点赞关注哦!

呃,本期视频呢是给大家整理了一些可以耗到免费大模型 talk 的 渠道,所以今天我们只做一个渠道的分享。由于篇幅限制,具体的操作和配置呢,我整理成了一份文档,大家可以在主页的粉丝群里面免费查看。 先给大家看一下渠道总览,官方的网址入口我也贴在这里了,接下来我们就一个一个详细讲一下这些渠道。 这是 longkit longkit, 这里免费渠道是每天刷新的,按我在文档里整理到的信息呢。呃, longkit 这边现在要分开看,第一档是 longkit flashlight, 这个是独立额度,大概是五千万 topos 每天。 第二档是 longkit flash chat dink 二六零一等几个模型,它们共享一次额度大概是五十万 topos 每天。申请审核通过后可以提高到五百万 longchat 二点零 pro view 的 注册额度是五百万 tocs 每天。提交模型使用反馈,每次有效的反馈呢,都将有机会获得额度刷新,每日最多可获得一亿两千万的 tocs。 所以你不能简单理解成 lunken 每天统一送多少,它其实是分池子的,那这个渠道就比较适合做摘药分类、脚本辅助或者批量小任务这些高频但是不太贵的话。如果你想找一个能每天用,适合做主力首发的免费渠道, lunken 的是值得优先来看一看。 然后第二个就是小米 vivo, 这个属于是活动型的一个赠送,它的活动时间是四月二十八日零点到五月二十八日的零点,一共三十天,而且是赠完即止的, 它是需要你去填一个申请表的,然后最终的到账形式可能是 top, 也可能是赠金,最终以工资台到账的为准。这个可以去试申请一下,你知道还是很像的 哦。那第三个就是 wechat gatebay。 这要讲清楚一件事是,它不是固定多少的 token, 而是说每月五美元来 per day。 也就是说,它的免费额度计算方式不是按给你多少万 token 来算,而是按你每个月有五美元的预算。就这五美元能换成多少 token, 完全取决于你用什么模型,上下文多长,输出多长。 你如果拿便宜模型做短景球,那撑的就比较久,如果一上来就跑贵模型长上下文,那掉的就比较快。其实这个渠道是给想统一管理多模型入口的人和有工程化需要的人来用 啊。这被提醒的一点是,如果你自己主动去购买了 i get paid credit, 后面就不再享受这个每月五美元的免费额度了。 第四个是 openroot free。 openroot 的 逻辑和前面几个又不太一样,它这里最关键的不是 token 余额,而是请求次数限制。也就说 openroot 免费模型不是给你一直多少万 token, 它主要是限制你每天能发多少次请求。 如果是买超过十美元 gift 的 账号,免费模型上线,呃,可以提升到大约一千次请求每天 以及二十次请求每分钟。那反过来说,普通免费账号的上限就会更低一点,所以他也不太能说是 无限免费的。你可以在模型广场上直接搜 free, 能给你用的免费模型还是挺多的。我这边的免费模型不是固定给你几个月,也不是固定给你一整年,他属于是模型业,当前有哪些福利版本,你就先用哪些,今天这个福利模型在,明天呃,就不一定还在 那这个就适合像快速式模型,然后低成本测试做轻量备用池的人,还不适合一直直接拿来当唯一的主力,毕竟免费的模型你也不能指望它有多强。 第五个呢,是国家超算互联网这个渠道要单独看,因为他不是单纯给你点 token, 他 能给到你的是一整套的资源,一百卡时的算力加五百 g 的 储存加一千万的 token。 所以 他的免费额度计算方式呢,已经不是简单的 token 池,而是 token 加算力加平台资源的组合。 这渠道最大的特点是资源看起来比较多嘛,但是学习成本也比较高。如果你的目标只是最快拿一个 k 直接开始用的话,那 long k 魔兽 openroot 是 更方便的一个选择。 那如果你本来就想接触国产的平台资源,或者你不只是想要一个 token 时,还想顺手观看算力模型平台存储这一整套的能力, 那国家超算就很值得来看一看究竟能用多久。这种一般不能简单理解,是每天刷新或者永久免费,它更像是活动资源平台福利阶段性体验的一种资源。据说国家超算互联网曾经给 openclaw 的 用户发过一千万的 token 限时福利, 当然最终能拿多少能用多久,还是要以当时控制台和活动页为准。六类是 glm、 kimi、 min max 这种活动渠道,小米 mino 其实就属于这一类,不过因为他最近比较火,我就把单拎出来了。 这类活动渠道标题经常写的很大,但在理想情况下看起来算很多,但真实到账和能用多久取决于活动规则、活动期限和账号的状态,以及控制台当时的显示。 最后我想给大家做一个简单的总结,我推荐的顺序呢是可以先看 long cat 这种每天刷新的, 然后再看 word 这种每月给小额 credit, 最后再拿 openroot free 做一个备用。如果你更在乎惊喜能不能捞一波,那去薅咪某这类活动也是很好的,如果你愿意多学一点国家超算,也值得一试。最后我想说几点注意事项。 第一呢,就是不要买来源不明的共享 k, 便宜不是问题啊,主要是来源不明,这可能是一个潜在的风险,可能有稳定性、隐私和封号的问题。 那第二呢,就是很多免费活动渠道的额度,本来就是活动逻辑,不是长期的承诺呃,活动过期、规则变化、入口失效都是常有的一些状况。 第三就是不要把敏感数据为给免费的额度公开资料、 demo, 摘药测试这些都没问题,但是公司的代码、客户数据、隐私内容,最好不要往免费额度里面随便塞。 第四呢,就是不要只看标题,不看官方,一切的一切最终以官方控制在官方文档、官方价格页和模型列表为准。我在这里只做一个分享, 如果你想看每个渠道的具体入口,官方页面适合接什么工具,以及更详细的一些说明,我已经把完整文档整理好放在了粉丝群里,所有群成员均可以免费查看。 顺便提一下,我们最近推出了未必要靠中转服务,无论是稳定性缓存还是模型种类和使用效果都非常不错。如果你有需要的话,可以在粉丝群或者私信联系我,如果你觉得这期视频有用的话就收藏,求点赞,求关注,我们下期再见!

你写的那行代码哈,在法律人眼里跑两种路,一种是跑在授权之内,另外一种是跑在边界之外,调个 a p i, 拿点数据,在你眼里,那只不过是几行代码的事,没偷也没抢,但是在法律人眼里,他不这么看,做开发的也好啊, 搞数据的也罢,你手里的那个所谓的合法的账号,那串 token, 那 把钥匙,可能正在替你打开一扇通往高墙的大门。 老杨啊,一个搞智能化平台公司的老板,中标了一个规划项目,需要查一些数据,合作方公司就从被害单位一个科技公司手里借了一个收益辅助系统的临时账号,转手就交给了老杨。老杨登进去一看,哇,这数据全细, 之前心里的算盘就开始打的啪啪响了,于是啊,他就让他的员工上了爬虫,四十八小时六万次的请求,一千八百万条的数据被硬生生的搬空了,那么被害单位这个科技公司的监测系统就亮红灯了,被迫关停 啊,业务就瘫痪了,被害单位就报警了。罪名,非法获取计算机信息系统数据罪。老杨到案之后还嘴硬,账号是给的呀,数据是全部能够 合法合规的看到的,那么爬虫他只是提速,怎么可能是犯罪啊。那么有账号有授权,这个到底有没有可能构成犯罪啊? 很多人啊,听到这,尤其是写代码的兄弟们,可能会撇嘴,有账号不就是合法的吗?我就是多下载了一点数据,这个顶多算违约,怎么可能就刑法伺候啊。这话啊,在茶馆里边是有道理的,但是控方他不这么认为。控方的逻辑其实很简单,第一, 老杨他虽然有账号,但是临时账号的授权范围,他是封顶的,时间有限,条数有限,导出有封顶, 那四十八小时六万次的访问,一千八百万条的数据,这个远远超出了授权范围。那么在空房眼里,这个就叫超越授权。第二啊,就是技术手段,在空房眼里,他是非法获取微信聊天记录,里边老杨的员工 写着感觉要把他们的服务器搞崩了,我就担心他们发现我们使用的数据量太多了,这个在空房眼里就是明知越界,你仍然干了, 妥妥的主观有故意。那么第三就是情节严重,一千八百万条数据,被害公司系统关停,直接的经济损失九万多块钱,这个就达到了司法解释情节特别严重的标准。三步走完,在空房眼里罪名成立,量刑三年起步。 那老杨的这个操作技术上,他到底越了什么界?空房他凭啥定他是非法?那么辩护的空间又在哪? a p i 啊,烂大街的词大家应该都不陌生, 应用程序编程接口,说白了就是系统它对外暴露的一个端点,那么你按照协议的格式发送 http 请求, 服务端它按照接口规范返回数据,但是啊,它每个端点的后边都挂着访问控制策略,谁有权限来调这个接口?那么请求的频率上限是多少?返回的字段范围有多大?这些啊,全部都由服务端说了算。那么服务端它正常的一个健全链路是这样的, 先是用户登录,之后服务端叫验凭证签发 token, 客户端他携带 token 在 请求 header 里按照授权的范围访问 api 资源,那么每个 token 他 都绑定了权限的策略,可访问的 api 端点,单次响应数据条数、 访问频率、域值,白纸黑字,这个都斜死在了服务端的 r b a c 策略表里边儿。老杨啊,他手里的这个临时账号儿,就是这种模式。 被害公司给的权限明明白白,登录时段受限,查询的条数有上限,单次导出量有封顶啊。也就是说,他这个 token scope 是 收着写的,只给你读的权限,不给你批量导出的权限, right limit 卡着呢,一分钟掉不了几次。你是客人,只能是待在客厅里边,卧室是不准你进的。但是老杨他没有老老实实坐在客厅,他让员工写了一个专用的爬虫程序。 那么正常用户啊,他在前端页面上操作,他走的是 b s 架构的渲染链路,他受前端 ui 层的分页限流空间的约束,一条一条的看啊,一批一批的导。 老杨的爬虫呢,他直接绕过前端的渲染层,向系统的后端 api 端点发送高频的 http 请求。他把页面级的浏览,硬生生的拉成了数据库量级的批量搬运。打个比方啊,你进图书馆,借阅证上边儿写着是每次借三本, 那么你不,你偏偏是搬了一个传送带到图书馆里边去,一车一车的往外拉,那么你手里是有借阅证,但是你干的这个事,他早就不是在借阅证的借阅范围里边了。 被害公司,他设置了三道反爬措施,密码验证下载范围限制、条数速率限制。这三道老杨的爬虫,他一道没碰,一道也没破,他根本不需要去破,因为偷啃,他是合法牵发的健全中间件一路放行, 它只是在授权通道内把请求 qps 和数据吞吐量拉到了系统设置的极限之外。这个才是关键啊,授权给你看招标数据 啊,你把全库的原始记录全部都搬走了,那么在这个 api 健全模型里,这个就叫阅权访问合法的身份啊,越界的操作。那么问题就来了,超越授权, 或者说是越界操作,他在这个刑法第二百八十五条第二款规定的非法获取计算机信息系统数据罪这个范畴里边,他不仅仅是一个商务授权,他必须要做技术的一个考量。 老杨他手里有合法的账号,他走的是正常健全通道登录的,那么 token 是 服务器合法签发的,他没有破解密码,他也没有植入木马, 也没有绕过 w a f 防火墙,没有对健全中间件做任何的攻击,没有触碰任何一道安全防护措施,它只是在授权的通道内把请求 q p s 和这个数据吞吐量 超出了这个 scope 的 约定。那么从计算机技术的角度来看,非法侵入它的内核,一定是突破系统的安全防护措施,你得先破防,之后从破防的地方进去,这个才叫侵入。老杨他没有破防,他只是拿着合法的 token 进了门,只是在授权的范围之外多翻了几个 api 的 端点。 简单来说啊,就是老杨的账号,它虽然是一个临时账号,但是它也是一个授权账号。从技术层面来看的话,它是系统主动签发 token 的, 它调用的 a p i 端点也是授权通道内的,即使老杨它存在扩大使用范围这个情况,但是它是在没有突破系统的安全防护措施的基础上, 服务端正常的一个交互。所以在服务端来看的话,老杨他是一个正常的访问,正常的使用,所以他并没有超越技术上的授权范围。所以本质上来说的话,即使老杨有超越授权的这个情形,也是超越了商务上的授权, 所以他不属于绕过安全防护措施之后拿走了里边的数据,所以应该是构不成非法获取计算机信息系统数据罪的。这个变点啊,是指指定性,那么定性一变天地宽。 还有一个问题啊,就是九万块钱的损失,这个裂缝在哪?认定情节特别严重的支柱啊,是被害公司系统关停期间九万块钱的既定服务费的损失,这个地方要仔细看啊,系统关停 他是老杨的爬虫直接搞崩的,还是被害公司发现异常之后自己关的?如果是公司自己主动关的,那么关停期间的这个损失能不能全部都算在老杨的头上?那么因果关系在这断了一节,你主动关门歇业,那么这个损失却让这个爬虫背全部的锅,这个啊,他是站不住脚的, 九万块钱,他是犯罪造成的直接经济损失,还是被害方他自主决策的间接损失,这个一字之差啊,情节特别严重,可能就变成了情节严重,量刑档次直接降一档,甚至有可能达不到坐牢的标准。最后啊,还是给所有跟数据打交道的兄弟们 两句忠告吧,第一就是合法授权,它不等于无限授权你手里的 cookie, token, 账号,这些都是绑着权限边界的,越界就有可能是越限,越限就有可能会入行。那么 api 是 门,它不是洞,钥匙,它也是有开门的范围的, 它不是通票。第二啊,就是一旦出事了,第一件事啊,不是删代码,是保全证据。你的调用日制啊,授权协议啊,接口文档啊,聊天记录啊这些啊,都有可能是辩护的,重要的证据丢了的话,那么你可能真的就只剩嘴了。 代码啊,它是工具,不是我们的护身符,授权,它是边界,也不是通票,那么技术,它是没有法外之地的键盘,它也不能替我们挡住法锤。江湖路远,守法平安!关注幺律师,为自由辩护,为正义发声!

朋友们,你们公司开始限制偷看用量了吗?我们公司从最开始的不限量到现在每个月只有五百块钱的额度了,五百的额度用好一点的模型可能一天就用完了。然后今天我还看到一个新闻,说微软将在六月份被叫停使用 cologold, 转向用自家的 cologold, 强如微软,也顶不住天价投款的费用了。其实在微软之前,乌堡也曾被曝出全年的 ai 编程预算四个月就被烧光了。就连卖算力的英伟达自己都说,现在算力成本已经远超员工成本了。 你想一想,公司一边给你发的工资,一边还得给你报销 token 的 费用,等于花了两分钱养一个人,长此以往,公司肯定受不了。拿我们编程最常用的可乐扣子来说吧,一个重度用户月消费可能高达两千多美元,我们公司有个狠人,一天就用了五千多美元。 再说说现在最火的 web coding, 本就上是 ai 代理在反复的自我否定从事调用工具, 它消耗的托管是传统模式的两到三倍。而且有研究表明, ai 身上的代码有一半是需要被大幅的修改甚至被丢弃的,也就是说,企业烧掉了真金白银,有一半是为 ai 的 无效创作在买单。不过冷静下来想一想,这些现象也给了我们一些提醒。 首先第一点,作为员工,我们不要再有无限畅用的幻想了, ai 工具的投入比才是根本。第二,未来公司很可能会转向使用自家模型,或者寻找性价比更高的替代产品, 就像微软强制员工使用自家的口 pad 一 样。看这里面有个关键的问题,自家模型能不能调教的像可乐扣的一样顺手好用,这才是真正的挑战。 第三,对我们个体来说,拼手速对代码的时代已经过去了,现在拼的是你每一次跟 ai 的 对话质量。当 token 变成了成本,你每一次模糊的提问,无效的反攻,不仅是在浪费 token, 也是在消耗自己的价值。

不知道大家公司有没有使用沃克包利进行办公呢?给大家分享一下沃克包利节省投坑的小妙招,就是最近上班的工作量完全完全取决于公司每天提供的投坑量,就是没有投坑,就像阶段反应一样,完全干不了活,也不是不想干,是真的干不了。 就是 ai 写的那么长的提示词,或者他做的 html 的 demo, 让人工肉眼去改,你不仅会改出问题,而且你可能会少改漏改错改就每天,最近用沃克邦利大概一天需要消耗一千到两千的积分吧。呃,用的太快了, 只能用开源节流一,一方面去向公司申请,另一方面自己使用的时候肯定也要节省一点。有三个小妙招这里给大家分享一下。就是第一点,大家在使用沃克邦利的时候,模型那边一定要注意,之前, 呃,没有那个选项呢,之前就是想想用什么模型就用什么模型,现在它是区分了一个不同的梯度,比如智普的 glm 是 一点零六 x, 像 deepsea v 四 flash 只有零点零六 x, 就 数字越小,代表它这个模型 花费的积分越便宜越少,想想一点零六和一点零六差了几十倍。第二个点就是大家在个人设置的面,一定要把那个绘画风格设置成 高效直接,就这样就文字少,但信息量大,这个也要去设置。然后三点的话,在绘画管理那边要设置成三小时自动开启新绘画,或者两小时的开启新绘画。 因为有的时候就算想起来去新建一个任务,但有这个东西的时候,假如你两小时没跟他绘画的时候,他就会自动切分成一个新绘画,就会把历史的上下文给丢掉,形成一个干净的上下文吧,就要这样就减少头跟的输入输出了。 除了三个软件上的小妙招,然后大家在写提示词的时候也要有一个核心的目标,就是让模型少猜、少读、少改、少重复,少走弯路,把我们的 problem 写具体,按照一定架构写具体,这样就会大大节省我们消耗的头衔。

黄仁勋最近的一场演讲啊,丢了一个让我后背发凉的预言, tucker 正在重塑我们的工资体系。今天呢,我会用三分钟的时间讲清楚他这场演讲里的核心观点,并且给出三个能够帮助你在未来职场里面不被淘汰的,并且能够马上落地的建议。 黄教主他的原话是啊,在未来,公司的每一位员工都需要一份年度 tucker 预算。什么叫 tucker 呢?假如说 ai 是 一辆汽车,那 tucker 就是 给他加的汽油。 你让 ai 每写一篇报告,每生成一张图片,每跑一个数据分析,都需要消耗托管。而黄教主的意思是啊,未来所有的工作都需要用到 ai, 那 以后除了给员工发工资以外, 还要给他发相当于底薪一半的托管额度,这样呢,他就可以把竞争力放大十倍。打个比方说啊,如果你的年薪是五十万,那公司每年就会给你配二十五万的托管,让你指挥 ai 去干活。 但是你仔细想一下啊,公司一共在你身上花了七十五万,如果你最后用完了二十五万的 token, 需要公司再给你二十五万,也就是一共五十万元的 token 才能完成你的本职工作。你还能够从资本家的手中 拿到五十万的工资吗?所以说啊,真正让人后背发凉的是,当 token 成为我们的工资条,谁有更高的 token 利用率,谁才有更大的职场价值。那我们应该怎么做呢?我想用我最近的一个实际经历来跟你聊聊啊。年前的时候,我的公司效招了一名 ai 产品经理, 其中都是我自己在面试,当时一堆简历里面有名校的,有大厂实际经历的,但是呢,我最后招了一个西南地区双非一本的小孩, 而且经过这两个月实际工作的检验啊,我的这个选择是完全没有问题的。而当时面试的时候,这个孩子之所以可以打动我,只是因为他给我展示了一个他做的两分钟的 ai 电影,以及他去年自学 web coding, 做了几个小程序和网站。从我的视角来看啊,一个优秀的员工,最重要的 不是单点爆破,而是流程编排。黄教主在这次演讲里面也提到了一个点啊,就说未来的核心能力啊,不是去当乐手,而是像指挥家一样,把每个智能体组合起来干活。 同样是做一个产品,如果产品经理他只懂用户需求,设计师他只懂 u i 和交互研发他只懂写代码,那这样一个工作小组啊,每天一定会制造大量的无效工作,也就是我前面说的头,肯浪费。一个有价值的员工,除了要搞定自己最擅长的业务环节, 还要像乐队指挥一样,考虑到其他每一个环节的输出,怎么样和下一个环节的输入藕合起来,从而让整个业务像一个飞轮一样越转越快。所以说啊,如果你想在一个十五分钟的面试里面判断一个人他是不是通才, 并不需要看他会用什么 ai 工具,考了多少证,而是看他有没有独立的做过一个产品,并且说清楚这个产品解决了什么问题,哪怕只是解决了他自己的好奇心。 好,说到了 ai 工具啊,这点我需要稍微解释一下,我觉得并不是说会用 ai 工具不重要,而是说操作 ai 工具的这个能力啊,已经在加速变质了,将来会用 ai, 就 像现在会用手机打字一样。 你有没有发现,以前动辄两三千的什么 ai 画图训练营,现在已经几乎没有了,因为在所有大厂都在卷 ai 的 时候, 越简单的工具才能积累越多的用户。还是用 ai 设计来举例啊,我之前的视频里面经常提到一个叫 lowwatt 的 设计智能体,这个地方呢,我用它的国内版新流 ai 来演示,比如说我现在有这样的一张车的广告图, 我要给它换成不同的背景。就这样的一个需求,在以前啊,需要用 sd、 ctrl、 u、 i 这些复杂的工具去搭一个工作流才能搞定。现在呢,我只需要把图传上去, 直接像跟你的员工交代工作一样,把需求说清楚,几分钟以后就可以拿到这样的十张宣传图。再举个例子啊,你手上现在有这样的一张海报,如果你需要改上面的文字啊,在之前你可能需要搞好几个 ai, 然后还要加一个 ps 才能把它搞定。现在在星流里面,直接点击文字编辑, 这张图,里面的文字信息都可以提取出来,输入我想改的内容以后,就能够生成这样字体和质感和原图几乎一样的作品。所以说啊,不要再去钻研某一个或者说某一类的 ai 了,现在你引以为傲的 ai 技能可能在未来都是废纸, 而是要打开上帝视角,从大局的角度去审视你的业务,审视 ai 的 能力边界。最好的状态就是当一个需求出现的时候,你可以立刻找到解决他的方案。再来说最后一个点啊,当时我面试的时候,在这个小孩的简历里面啊,看到了一个点, 就是在二三年四月的时候,他就用康复 u i 做了一个副业的项目,所以我当时随口就问了一句啊,我说你怎么这么早就开始玩康复 u i 了?你知道他怎么说吗? 他只是说觉得那个页面看起来很酷,就找了几个教程跟着玩了一下,我到现在都记得当时那个感觉啊,觉得这个东西很酷,这句话真的太性感了, 因为很多人,包括我自己啊,喜欢看,喜欢观望,既怕错过,又怕花了很多时间研究,结果吃力不讨好。但是这个孩子,我经过他工位的时候啊,经常会看到他在研究我甚至都没有见过的东西, 比如说这段时间很火的这个养虾啊,他就是我们团队中第一个把它研究明白的,所以他总是能够在业务出现卡点的时候,从业务全盘去思考,提出一些其他人压根都没有想到的方案。在这个瞬息万变的时代,保持好奇,超越好奇才是最难能可贵的。

家人们,最近 ai 可是全世界的风口啊,很多聪明的老板啊,已经开始做蒜利 toker 的 生意了。这两天啊,好几个老板咨询 我,要么自建网站卖 toker, 要么在阿里云或者腾讯云啊,做蒜利 toker 的 中转站。还有老板啊,想在网上直接售卖 toker, 这其实啊,都涉及要办理 i c p 许可证。客户一, 自建网站售卖 toker vpi 国内大模型接口并交易,面向公众,且涉及交易,按规定啊,必须办理 icp 许可证,不然网站可能遭关停,面临罚款。客户二,在平台搭建 toker 中转站,业务属互联网信息服务且盈利,同样需要办理, 而且啊,平台啊,无法代办。客户三,与未知平台售卖投坑好词,只要业务符合互联网信息服务,且有经营性质, i c p 许可证啊,必不可少!再次提醒,若有从事类似业务啊,务必尽早办理 i c p 许可证,确保合法合规运营。

在 token 业务的开展过程中,行业从业者在初始阶段普遍面临挑战,首要环节是构建专属的聚合平台, token 可视为资源承载单元,而聚合平台作为高效的分发枢纽,需摒弃碎片化的直接推广模式, 转而通过系统化渠道向产业链上下游企业及个体工作者提供服务支持。第二环节为大模型与平台的对接工作。在大模型接入路径方面,需重点关注以下内容,国内主流合规大模型厂商如 minimax、 阿里百店、 腾讯混元等头部平台均以开放开发者 a p i 接口,接入门槛相对较低,通过官方渠道提交开发者权限申请,审核通过后采用按量付费模式即可实现接入。初期阶段,建议优先聚焦业务流程的完整贯通, 无需过度关注价格对比或专属折扣的洽谈,待平台业务量及消耗量达到一定规模后,可一托数据优势与厂商协商优惠合作条款。同时,应积极拓展与托肯生产方及海外供应商的合作, 通过丰富合作渠道,提升平台服务的多样化,进而向自生产业上下游客户及个体工作者推广平台整合的大模型 api 服务。 通过上述合作模式,可实现对主流头等供应商的全面覆盖。最后需注意的是, 对于个体或小型企业而言,与云服务商、运营商、第三方机构及海外企业直接洽谈折扣可能存在一定难度,因此建议考虑成为大型聚合平台的服务商。此类平台通常具备稳定的病发处理能 力,有助于保障初期业务的稳定运行。若有其他疑问,欢迎在评论区留言交流探讨。

大新闻啊,污染不在公司推广 cloud code, 原因是不管是技术人员还是非技术人员用 cloud code 用的太多了,财务部门顶不住, 目前整个模型是非常贵的,然后今年就停用了啊,一方面还用他们自己内部的这个抠钉工具,但是我觉得不管怎么样,它这里面也给到了我们一个反思,就是 ai 在 企业里面落地,它会遇到一个很现实的问题,就是你的投入产出比,这里面其实是有三个指标是可以来去评估的。 第一个是单位的产出率,就是你做这件工作,它是人更划算还是 ai 更划算,就是你要算一下单位产出的成本。第二个是赋用率,就是你用了 ai 的 这个工具,它是否让你的一些工作和流程标准化了,可以去复用呢? 如果赋用率是比较高的,那这个投入是值得的。第三个呢,其实是管理成本,就是 ai 在 企业里面用也要分级的,比如说那种贵的模型,它应该是处理哪些任务 和哪些工作,甚至是哪些人来用,它都是要有规范的管理,我们相当于会合理的去判断组合,就根据它的能力,根据这个岗位的产出 来合理去应用。当然另一方面也可以看出呢,就是什么呢?以后可能会带来真正的两极分化,就是更好的模型,可能就只有少部分人用,因为它太贵了。但是这一部分人用上很强的模型过后,它的能力那肯定是提到了非常大的提升。所以说总的来讲,我觉得不管是用 ai 还是不用 ai, 都 要让自己变得更有价值,就当你更有价值,那你匹配更强的工具和更强的模型和能力,那你的创造力就是更大的,那你也变得更加不可替代的。

哇,这路边的小 media 说上期所正在设计一个全新的品种, ai token 期货。 token 是 大模型吞吐量的最小单位,如果你把它给做成 future, 做成期货合约,那不等于让全链条的公司就像航空公司所油价那样 可以所算利成本了吗?我跟你讲,这玩意儿啊,要是纯没格局的就说,哎呀,又要吵又要当吵架又要赚钱。那我问你, 航空公司为什么要买做空原油的期货,是出于什么目的?他是要赚钱吗?不是,因为航空公司不能被油价给搞到倒闭,所以的话他必须对冲自己的油价成本。那既然现在要推出偷看的期货,肯定就意味着 未来会有很多公司巨大量的需要 token, 那 个成本重要到不能因为 token 的 价格大涨大跌就影响到公司的资产负债表,所以才会推出 ai 期货。就是 ai token 的 期货,这你受得了吗?而且这玩意儿啊,确实不是说我们第一个弄那个 cme 智商锁 就没智商,那哥们已经拉上 silicon data 在 美国下半年要推出全球第一个 gpu 算力租赁期或定价的毛是每天 h 二百的租赁价,之后可能会融入更多芯片的租赁价,取一个中值, 然后定价的毛让这个产衍生产品。现在很多纽交所的公司在等着说我能不能到时候上 etf, 不知道这帮哥们真的是可以了啊,总之没有需求,那不会出这么一个产品来给大家用的。是这逻辑吧?你想想 cme 老板一句话, computing power 就是 二十一世纪的石油啊。这个东西从私下议价马上就要变成交易所挂牌交易的标准 contract 的 合约了,这是一个开始啊,不喽。

最近很多朋友问我, cloud 桌面端更新版本以后,原来配置好的第三方 api 突然不能用了?如果你之前已经跟着我的教学视频学会了如何在 cloud 桌面端接入国产大模型,并且已经正常体验过一段时间,那这期视频就是帮你解决更新后失效的问题。 如果你还没有用过 cloud 桌面端,或者还不知道怎么接入国产大模型,大家可以先去看我前面的教程,把基础环境配置好,再回来看这期解决方法。简单来说,最近的问题主要出现在 cloud 桌面端更新之后,新版本对模型调用环境做了一些限制,导致之前配置好的第三方 api 出现失效、报错或者无法连接的情况, 烦死了。网上现在也有很多解决方案,比如修改客户端文件、重装旧版本、禁止自动更新等等,但这些方法要么操作麻烦,要么存在一定风险,比如版本回退后功能不完整,安全性下降,或者后续自动更新失效。所以今天这期视频 给大家分享一个更简单更稳妥的方法,不需要改 cloud 客户端文件,不需要重装旧版本,也不用写复杂代码,只需要在 mac 终端里配置一条环境变量,就可以解决 cloud 桌面端更新后第三方 api 无法正常使用的问题。整个过程非常简单,基本上复制一行命令就能完成。 首先打开 mac 自带的终端,然后输入第一行命令, been launched second noden production。 这行命令的作用是把系统里的运行环境变量设置为生产环境,也没有报错,就说明这一步基本已经成功了。接下来我们再输入第二行命令,用来检查刚才的环境变量是否已经生效。 been launched getting noden, 如果终端输出 production, 就 说明设置成功了。设置完成以后,关闭 cloud 桌面端,然后重新打开,重新进入之后再测试你原来的第三方 api 配置。总结下来就是,先退出 cloud 桌面端,打开终端输入指令, 再次打开就可以正常使用了。如果我的视频有帮到大家,希望大家可以关注、点赞、收藏,后面我会继续更新 cloud i 编程工具、国产大模型接入和本地模型相关的使用教程。

有个开发者在网上吐槽,用 ai 辅助编程之后,两三天就能出一套系统,效率翻了好几倍。但公司每个月只报销两百块的头肯费用根本不够烧,月中就用完了,后半个月要么自己掏钱,要么回到古法编程,手动敲底下一堆人跟铁。 我们公司也是两百块,第一周就见底了,领导不用 ai, 不知道两百块有多,不禁花。这个吐槽看着像个段子,但他反映了一个正在大面积发生的真实问题, 员工用 ai 的 速度已经跑在了企业管理制度前面。用手机流量来理解。当年四 g 刚出来的时候,公司给员工的手机话费报销额度是按三 g 时代定的,每月五十块。五十块在三 g 时代够用, 打打电话、发发短信没问题,但四 g、 五 g 时代,大家开始用手机办公了,下载文件、视频会议、在线写作。如果没有 wifi, 五十块流量第一周就爆了。不是员工在乱花,是用法变了,但报销标准还停在上一个时代。头肯额度就是今天版本的手机话费额度, 两百块 token, 在 偶尔问 ai 一 两个问题的时代够用。但现在,开发者把 ai 当成了日常工具,梳理需求、写代码、查 bug、 生成文档、做测试,每一步都在消耗 token。 用法变了,但公司的预算标准还卡在偶尔用一下的时代,这个错位会怎么演化? 跟手机话费一样,公司迟早会提高。投肯报销额度,不是因为想多花钱,是因为员工用 ai 的 效率实在太高了。两三天出一套系统,换以前得两三周,这个投入产出比太划算了。当越来越多团队用 ai 跑出了明显的产出优势,不给够投肯额度,就等于主动让团队回到低效模式,没有公司会干这种事。 所以可以确定的趋势是,企业的投坑预算会持续上涨,从每人每月两百块涨到五百、一千、两千,甚至按岗位定制额度,重度使用岗位给更多,轻度使用岗位给少点。 这个趋势对做资源聚合分发的人来说,信号非常清晰。第一,你的潜在客户在变大。以前企业投坑支出小,可能觉得不值得专门找人管, 但当投坑预算从每人每月两百涨到一千,一个公司几十上百号人同时在烧的时候,这就是一笔每月几万到几十万的开支。这个量级的开支,公司一定需要有人帮他管好。 第二,你的服务切入点就在这里。公司提高了投坑预算,但不等于他知道怎么花的最划算,哪些岗位该用什么模型,哪些任务可以用便宜的模型替代,贵的 一个月的投坑消耗力有多少是无效调用?这些问题跟当年公司话费套餐怎么选最划算?一模一样, 需要有人帮他做方案。两百块不够用,不是一个抱怨,是一个信号。他告诉你, token 消耗正在从偶尔花一笔变成每月固定大额支出。当他变成大额支出的那一天,管这笔账的人就是刚需。我是牧野,深耕算力与资源赛道,专注分享行业干货,咱们下期再见!