欢迎来到智研所, 今天全球科技圈的目光全部聚焦到了一个地方,加州山景城。没错,谷歌一年一度的 i o 开发者大会今天就要炸场了,这场被誉为科技春晚的盛会,可是预判未来三到五年科技走向的风向标。今年的 i o 大 会有哪些硬核看点? 第一个重磅, gemini 大 模型迎来轻量化升级。谷歌大概率推出 gemini 三点二或三点五版本,重点优化端测 ai 能力,让中低端安卓手机也能流畅运行 ai 功能。这意味着 ai 不 再是旗舰机的专属,要飞入寻常百姓家了。 更值得期待的是,全新的 gemini spark 智能体平台有望亮相,能主动帮用户处理跨应用任务。 第二个亮点,安卓的 x r 智能眼镜正式亮相。谷歌联合三星推出的 ai 眼镜,代号 gian 九,重量仅五十克,搭载枭龙 a r e 芯片,支持免提唤醒、 gemini 实时翻译、导航等功能。时隔十余年,谷歌再次杀入智能眼镜赛道,这次真的来势汹汹。 第三个大招, aluminum os 系统首秀。这是融合 android、 chrome os 和 x r 的 三合一操作系统,适配 x r 设备和笔记本电脑。谷歌这是要用一个系统打天下? 说完大会看点,咱们聊聊背后中国产业链的机会。今天给大家梳理五家核心企业, 第一家,中际旭创,谷歌八百 g 和一点六 t 光模块的最大供应商,份额超百分之六十。谷歌大规模扩建数据中心光模块需求暴增,中际旭创作为核心供应商直接受益。 第二家,光库科技,谷歌 ocs 光电路交换机独家代工厂,份额超百分之七十。 ocs 是 tpu 集群组网的核心设备,技术壁垒极高。 第三家,戈尔股份,全球 ai 眼镜代工龙头,试占率约百分之七十,已拿下谷歌合作款 ai 眼镜的独家代工订单。随着谷歌眼镜量产放量,业绩弹性值得期待。 第四家,试芽科技,全球硅基 oled 微显式领头羊,也是谷歌 xr 眼镜要走向消费级显示技术是关键瓶颈。 第五家,英维克谷歌数据中心液冷散热方案核心合作商,支持超二点六万台液冷节点部署。高算力时代,散热是刚需。 总结一下,今天的谷歌 i o 大 会,不仅是产品发布,更是 ai 从云端走向终端的里程碑。中国产业链在光模块、 ocs 代工、智能硬件、显示技术、散热方案等核心环节以深度卡位,值得持续关注。关注智研所,咱们下期见!
粉丝5.3万获赞17.4万

所有人都不看好你,偏偏谷歌你最争气。就在最近的开发者大会, google 把 ai 行业的桌掀翻了。今天这期视频带你深度拆解谷歌 io 大 会,看看这十几个新产品到底强在哪儿。 先说第一个, gemini 三点五 flash。 过去的 ai 行业有个默认的逻辑,模型弱就便宜,顶级模型就得贵。但 google 直接反过来了,这次的三点五 flash 把谷歌旗舰三点一 pro 给干掉了,而且是编码能力、 agent 能力、工具调用全面超越。最狠的是速度,三点五 flash 的 输出速度直接飙到每秒三百 token, 比很多前沿模型快四倍,但价格反而更便宜。 google 现场还学了一下老黄开始帮企业算账了,说如果大型公司把百分之八十的顶级模型调用换成三点五 flash, 一 年能省十亿美元。 第二个是 gemini 奥秘 flash, 特效师、视频剪辑师、音乐制作人。这个产品你们可要扒大眼睛看,这可以说是目前业内第一个真正意义上的全模态模型, 文字、图片、音频、视频都能输入进去做参考,指令同样也都可以输出出来。而且他不是在后台偷偷切换不同工具,是在同一个模型里完成,也开始真正理解物理世界的运作规则。就拿发布会的演示举例,演示人员对着镜子散步的自拍视频,通过提示词不仅能变换服装和周围场景, 连镜面和水痕里折的光影、重力逻辑都能跟着完美更新。在白纸上画个圆圈,奥米尼能瞬间把它 remix 成一个视觉逻辑逼真的黑洞,告别了物体、穿模和一眼甲。还有另一个演示,发布会现场录了一段钢琴,告诉奥米尼往 r b 方向改,加入女生。最后出来的不是 demo, 是 一首完整的歌, 但缺点也不是没有,因为现在发布的还是欧米 flash 轻量版,中文还有点港台腔,用起来还有点怪,但整体的方向已经非常明显了。 ai 正在从单一工具变成真正的全能系统。第三个, gemini spark。 这个相当于之前爆火的小龙虾,大家都跟风安装过,但你会发现,装完以后,身边几乎没几个人会在日常用它。原因很简单,小龙虾的大脑是 open ai 的, 但手和脚要你自己去找 操控浏览器得装单独的插件,连 gmail 要单独授权用 google drive 还得再配一个工具,每接一个新功能,就多一个可能崩掉的地方。 google spark 解决的就是这个问题,所有的产品全是自家的。发布会演示给 spark 一个目标,筹备街区派对,他自己建 rsvp 追踪表,跟 gmail 打通,邻居回复自动更新,没回复的自动起草催回邮件,还从 drive 里翻出小区规定,提醒你充气城堡的布置时间,最后在 slides 里做好宣传 ppt, 你关着电脑去睡觉,醒来 ai 帮你全办完了。第四个, google 搜索。谷歌这次把搜索框变成 a 阵的指挥台,比如你告诉 ai 帮我盯 pe 小 于十五,现金流为正的生物科技股,它会自己监控价格变化,直接推送给你。 还有一个演示更夸张,有人问黑洞怎么影响时空,以前搜索会给你一堆链接,现在 google 直接生成了一个交互式模拟页面,你可以拖参数,看时空怎么弯曲。而这一切是 gemini 实时写代码,实时运行在实时嵌进搜索结果里的。 这个功能会在今年夏天免费开放。第五, universal card。 简单来说,它让你的购物车开始有脑子了。你是不是也有过买错东西的经历?买了主板发现跟 cpu 不 兼容,买了充电器发现接口不对,或者买完某个东西才发现自己已经有一个了。 universal card 不 仅能实现像其他 ai agent 一 样自动找折扣、查价格历史找优惠券,还能记住你购物车里加了一块主板,他发现你之前买的 cpu 接口不匹配,会直接跳出来拦住你,再推荐你合适的型号。 再来看看 ai 眼镜,三星硬件儿,高通芯片外壳直接找粘头。 monster 联名,你带着它出门,它能把导航箭头直接投射在你的视野里。 你跟 jammer 说带我去上周见朋友的地方。它不仅帮你带路,还会主动问你要不要顺路买你常喝的那杯咖啡。它甚至支持 ios 和 android 的 双系统。你还对哪个产品感兴趣?下期我们继续拆解。这里是 ai 风向标,带你了解 ai 行业最新动向。

谷歌的界面的三点五正式上线了,整体的实力大幅提升,在多模态识别代码的边写以及智能交互体验都相当的不错,运行也很丝滑流畅,还支持大容量的上下文创作和办公,都很适配, 新手也能轻松的上手使用。大家好,我是温谷,我相信有很多小伙伴们已经在界面的官网中已经使用了三点五这样一个模型,我教大家三个使用方法,适合自建工作流, ai 的 写作、文案生成、图片、海报和抖音运营的同学。 第一,课请求调用,适合在工作中前开始调试。第二,通过 python 代码的 sdk 的 调用,适合自建 skills, 最后给 open claw 和 hammer agent 使用。第三, n 八 n 工作流使用,适合打造自己的数字能演示。一,我们用这个课请求来试一试, 好吧,然后课请求就是 c u r o, 这个大家可以往上搜一下,大家可以看一下,就是我这里 api 的 端点,就是 generate language, 谷歌点 api 点 com, 请大家注意一下这个,它不是一个呃, open ai 的 标准的一个模式,就是 如果你是那个 open ai 的 一个标准的模式,它应该是左斜杠杠归,然后再左斜杠 chat 它,这个不是,所以说我们一般做调试用,可以看一下这里面,我这边的这个,你看它后面紧接的模型是 jame 三点五, flash, genevate content, 然后 key 就 跟到我这个 key 啊,这个这个,我 key 把它暴露出来没?其实没有关系啊,因为反正这也是免费的,你看他是,你是一个专业的专业助手,解释一下什么是 leg 这个技术啊,他就已经回复了,从那里看这个这么多模型。那其实啊,这也不是我说的是这个,这个我给大家看一下, as 丢了的话,你去 get 这个 apikey 啊,我这里有好几个 apikey, 拿到这个 apikey 以后,哎,你就可以去做这个啊,就可以去把这个呃,你的 apikey 放在这里就可以做调试使用,调通了以后,你再把这个再去放到代码里面进行调试啊,然后这里它有一个这个 这个限制的。在这个地方啊,你可以看一下这里的 c 末啊,有个三点五 flag, 我 找一找啊,他这个用这个表经常会刷新的,哎,这个有个 jimi 的 三点五是吧?这是个文本输入过大模型, 它的 p r m 也就是每分钟的这个 token 啊,就每分钟五个这样是吧? t p m 这个是代表它每分钟的 token 数,它每分钟给了你两万五千个 token 啊,所以说你养龙虾可能够呛,但是你做这个自动化变卖流啊,是吧? n 八 n 啊,包括底价都是没任何问题,它一个这个分钟应该是可以, 应该是每秒了,是吧? pick lock, 那 每分钟给允许你掉五次是吧?每每分钟给你两万五千个头等,这应该是够用的啊。这个这是最最近昨天更新出来的,因为昨天这个谷歌二零二六的开发者大会是公开了个 gmail 三点五 啊,然后那个杠 max 啊,还 pro 还没有发布吧?应该是啊,但是呢, flash 应该非常强了啊,非非常强,他现在给大家免费的话,呃,大家一定要去用啊。然后第二种用法的话,就是我这个地方调了一下这个这个这个这个这个地方给大家看一下,就是 啊,这里是生成一一张什么图片啊?这这这个倒没什么,这个是我,我那个是纹身图的,是吧?我这里是用的这个谷歌的追未来的一个这个 sdk 啊,大家去引入这个 sdk 啊, flunk 谷歌 input 的 追未来 ai, 然后你下载它的 sdk 就 可以用了,是吧?然后再把我的 api 放进去,你可以跟我老师给大家演示一下啊。好, 我逻辑了下,我这里可以总共使用有五十二个模型啊,有些是收费的,有些是免费的,然后等一等, 哎,这里出来了,是吧?做的是一个让他设计这个一个品牌的一个文案,是吧?文案是吧?对对对,好, 那第三种情况也是大家常最常用的,就是这个在 n 八 n 里面这么用的,我把它拿过来给大家看一下,这个是刚刚跑出来的结果啊,之前我演示的是这个,用这个魔大平台,这个地方我用的是谷歌的,是吧?谷歌的这个是吧?然后这个地方你需要把这个 api 塞上去,哎,这里塞上去以后它连接成功了,连接成功了以后, 在这个地方你可以选择它的模型了,是吧?你一定要选择三点五是吧?最早啊,就是上周前指的免费的模型,就是街面的二点五那个比较拉快啊, 是吧?已经谷歌让我们二点五已经是发布两年前的模型啊,这个是昨天最新的模型,呃,比较强大。其他的都是收费的啊。其他这个 pro、 pro、 vivo 啊,包括这个 max 啊,都是收费的。但是三点五 plus 目前是免费的啊,为什么是免费的?刚刚跟我老师给大家看的是谷歌官网,是 是选选择,目前是现在是免费的,应该他在开发者大会上已经说了这个是免费给大家用,我相信他也不会说他给大家用一两头就关掉他,是吧?谷歌应该丢不起这个脸,是吧?好,然后这个给大家跑一下吧,对, 跑一下,这个乱乱一下就好了,哎,这个我是做了一个这个新闻的整理啊,就是第一步就是我再去搜索这个新闻,是吧?然后搜索到新闻,最后拿到这个新闻的素材,是吧?然后把这个套的新闻给我整理出来,最后拿到这个话我就会发到什么,是吧?是吧?某某抖是吧? 啊?你看这个是今天上午啊,五月二十一号的 a i 新闻,等等等等,是吧?是吧?噔噔噔噔噔,好,这是我今天给大家三个用法,希望大家去调试和使用,有问题的话小伙伴可以在这个评论区留言,我看到都会回复大家的。

今天是五月二十日,周三,欢迎收看 ai 日报。屏幕上是今天的主要内容,下面请看详细报道。 第一条,谷歌搜索框迎来二十五年来最大改版,全面拥抱 ai 对 话模式谷歌在 i o 大 会上宣布,搜索框迎来了二十五年来最彻底的一次改版, 它不再只是一个输入关键词的文本框,而是变成了支持文字、图片、视频、甚至打开网页标签的动态对话入口。公司同时把之前的 ai 摘要和 ai 模式合并成了一条无缝的搜索流,用户以后不用在两种体验之间反复切换了。 第二条,谷歌发布新一代模型 gem 三点五 flash 编码与 agent 能力大幅跃升 谷歌同步发布了新一代基础模型 gemini 三点五 flash。 官方测试显示,这款新模型在代码编辑和复杂智能体任务上的表现已经超越了去年的旗舰版本,而且运行速度快了整整四倍。 目前它已经直接作为默认模型接入了全球的搜索和应用端,下个月还会推出更强大的 pro 版本。 第三条, antibiotic 推出 cloud 自托管沙箱与 mcp 赛道,强化企业数据安全在企业及智能体部署方面, antibiotic 推出了 cloud 管理型智能体的自托管沙箱公开测试版。 这项更新允许企业把智能体的工具、执行环境和数据访问权限完全放在自己的服务器里,配合新出的 m c p 赛道,技术,开发者可以在不泄露核心数据的前提下,安全地连接内部数据库和业务系统。 第四条,谷歌发布 anti gravity 二点零理赔拆发平台全面转向多智能体工作流 谷歌的开发者工具站也发生了架构级转变,公司发布了全新的 itagrip 二点零独立桌面应用,彻底摆脱了以往依赖集成开发环境的模式。 新版本主打多智能体并行编排,内置命令行工具和软件开发包,还专门加入了定时任务和后台自动化能力,让开发者能像搭积木一样调度复杂的智能体工作流。 第五条,腾讯推出 ai 助手马维斯,整合双模型,支持自然语言控屏与本地隐私模式。 国内大厂也在加速布局终端 ai, 腾讯今天正式推出了名为马维斯的 ai 助手, 这款产品底层接入了 deepseek 和混元两大模型,主打自然语言控制电脑屏幕。 针对对隐私敏感的用户,他还提供了本地隐私模式,所有文件处理都在设备端完成,实现数据零上传,目前需要凭邀请码体验。本期内容整理自公开报道,具体功能与定价请以官方最新发布为准。

五月二十号凌晨一点,谷歌一年一度的 io 开发者大会准时召开。懂 vr 的 朋友应该都知道,前段时间的谷歌在大众眼里存在感不算高,尤其是在 ai 编程这条赛道上。对比市面上几款热门工具,它的曝光度一直不温不火。很多人都觉得 谷歌这两年发展放缓了,但这次不一样,没有花哨宣传,谷歌直接甩出 gemini 三点五 flash, 补齐了之前的民用技术短板。今天带大家捋清楚这一次更新到底含金量在哪?我们先看一组实打实的数据,大家直观感受一下谷歌这一年的迭代速度。两年前,谷歌每月处理偷啃仅有九点七万亿, 去年涨到了四百八十万亿,而到了今年,月处理量直接冲到三点二千万亿。仅过去一年时间,整体算力吞吐量就暴涨七倍,数值越大, 说明它的算力承载训练数据体量越庞大。目前 gemini 的 越活跃,用户已经突破九亿,也能看出来越来越多人开始认可这款产品。要说本次发布会最核心的亮点,那一定是全新的 gemini 三点五 flash。 它不是简单的版本小修小补,更像是一次全方位的优化升级。 对比上一代的三点一 pro, 这款模型在各类专业测试里成绩都有所进步,不管是编码能力还是多模态理解能力提升都很明显。而且它解决了行业里一个很难平衡的问题,既加快了运行速度,又压低了使用成本。说的直白一点,它的运算速度 是目前市面上主流高端模型的四倍,使用成本还不到同类产品的一半。谷歌 ceo 现场也算了一笔账,一家头部大型科技企业,每天要处理一万亿偷啃。如果把八成的工作负债切换到三点五 flash, 一 年下来光算力成本就能省下十亿美元以上。今年很多科技公司 老早用完了全年的 ai 预算,而谷歌这次更新,刚好给整个行业提供了一个性价比更高的算力选择。目前 gemini 三点五 flash 已经在谷歌全平台开放,不管是普通用户还是开发者,都可以直接接入使用。 除此之外,谷歌内部的数据也很有参考意义。早前谷歌内部工具每天只处理五千亿掏垦,现在已经稳定在三万亿。模型能力变强之后,承载的数据量随之增大,海量数据又反向优化模型,形成了良性迭代闭环。按照官方的说法,下个月还会推出 gemini 三点五 pro。 除了模型本身升级, 谷歌还完善了自己的智能体体系。目前这些智能体功能处于分批测试阶段,优先面向海外付费用户开放,它可以自主完成一整套连贯工作,晨间摘药工具能自动帮你整理邮件、排布日程。全天候的 spark 智能体 可以在后台默默运行,帮你整理报表、规划文档、搭建工作流程。就连我们常年在用的谷歌搜索,也完成了智能化升级。客观来说,谷歌这次没整什么花架子,全程踏踏实实做优化 普及技术短板,压低算力成本,还不断提升实际使用体验。本身手握全球顶尖的开源生态,今年更是打算砸一千八百亿美元加码 ai, 如今又敲定把 ai 全面融入底层逻辑,这般实打实的布局落地后,未来行业格局势必迎来不小变动,我们接着看吧。

天呐,科技圈又有大事情了!就在今天凌晨,谷歌直接掀了桌子,他们发布了 gemini 三五 flash 模型。这不仅仅是一次更新,这是谷歌向全世界扔下的一颗超级核弹, 它比对手快四倍,成本低到尘埃里。最关键的是,它免费了。别眨眼,这玩意能干的事,可能会彻底颠覆你对人工智能的认知。以前的 ai, 你 问他话,他得思考两秒,像个老学究。 现在的 gemini 三点五 flash, 每秒输出两百八十九个 token, 这是什么概念?它的速度是 gpt 五点五和 cloud opus 四点七的整整四倍。你话音刚落,它答案都写完了。 这种零延迟的快感,就像从拨号上网直接穿越到了五 g 时代,丝滑到让你觉得以前的 ai 都是帕金森。最炸裂的功能来了,多模态编辑。以前你想剪个视频,得学 p r a e 头发掉光。现在你只需要对着屏幕说,把这段视频里那只狗换成猫,背景音乐换成摇滚, 它搞定。无论是文本、图像、音频还是视频,它全都能听懂并直接修改。这哪里是 ai? 这简直是把你脑子里的画面直接具象化的神笔马良。谷歌这次为什么敢免费?因为技术太狠了。他们用了蒸馏加稀疏化技术, 就像是把一头大象压缩进了一只蚊子的身体里,体积小了,但力气一点没减,这让它的运行成本比主流竞品低了十五到二十倍。成本低到谷歌根本不在乎这点电费, 他们要的是让全世界都上瘾。谷歌不止想要一个聊天机器人,他们想要的是 germany spark, 一个全天候的 ai 代理,他能帮你回邮件、管账单,甚至代表你去买东西。未来的场景是,你还没醒, 你的 ai 管家已经帮你处理了五十封邮件,订好了早饭,甚至帮你抢到了演唱会的票。谷歌这一招免费加极速, 直接给 open vi 和 anthropic 来了个釜底抽薪。当最顶级的 ai 变成像空气和水一样免费的基础设施时,真正的战争才刚刚开始。对于咱们普通人来说,这绝对是天大的好事。以后拼的不是谁有 ai, 而是谁会用 ai。

如果只看标题, gemini 三点五好像只是一次常规模型升级,但这场发布会真正想讲的,是 google 要把 ai 变成整个产品生态的操作层。先看 gemini 三点五 flash, 它不是只给聊天提速,而是在为智能体代码任务和长流程执行做准备。 官方反复强调三件事,速度、成本、还有行动能力,所以参考片里说的一年省十亿。重点不是噱头,当企业每天都在调用模型,模型便宜一点,速度快一点,最后都会变成真金白银。 第二个重点是 java spark, 你 可以把它理解成一个云端智能体入口,用户不用自己准备电脑环境,也不用手动拼工具,直接用对话安排持续性任务,比如整理信息、跟进流程、定期处理机械化工作,关掉电脑以后也能继续跑。 这个方向不新,但 google 的 优势很现实, chrome、 gmail、 地图、 youtube、 支付、搜索这些入口本来就在他手里,别的智能体需要到处接工具, google 更像是把自家的工具直接串起来。第三个重点是 gemini, 它的卖点不是只会生成视频, 而是让输入和输出都走向全模态,文本、图片、音频、视频都可以参与进来,生成结果也不止限于一种形式。官方演示里改视频、换风格、合成角色都可以放在同一个流程里做, 这意味着以后创作可能不用在八个 ai 工具之间来回切。再看开发者测 anti gravity, 二点零也被拉到台前演示,重点不是补一段代码,而是让多个智能体一起推进复杂项目,写代码、开浏览器、跑测试、修问题、再验证,开始变成一个壁画。 所以 google 这次真正发布的不是一个孤立模型,它是在给整个 google 宇宙做一次 ai 版本升级。 搜索、地图、邮箱、视频浏览器都会慢慢变成能对话、能记住上下文、能帮你完成动作的界面。 jamming i 三点五最值得关注的不是单向跑分,而是模型能力、工具入口、执行成本和生态数据被放到了一张桌子上。 如果 google 真能把这些东西打通, ai 就 不再只是网页里的聊天框,它会变成你打开浏览器、地图、邮箱和创作工具时默认就存在的操作层。这才是这场发布会真正值得盯住的地方。关注我继续用普通人听得懂的方式,拆解 ai 产品和开发效率的新变化。

今年谷歌 i o 大 会有哪些看点?对国内的产业又有哪些影响?我们一个视频说清楚。首先是 token 方面,到了二零二六年,现在的月度处理量已经飙到了三千两百 t, 单平台的 token 日处理量都超过一百 t 了, e p i 每分钟处理一百九十一亿 token, 这个消耗速度确实是有点吓人。顺着这个 token 的 消耗,它们模型的迭代也挺有意思。这次发布的是 jimmy 三点五的中监态系列产品, 偏推理方向,那个 gemini 三点五 flash 版本的性能直接超越了三点一 pro, 速度比其他 sota 模型快了四倍。然后 gemini 三点五 pro 预计是在二零二六年六月发布,听说是要在 coding 和 coding agent 领域有比较强的加强。 还有一个很关键的动作就是谷歌首次在推进 world model, 也就是世界模型。紧接着他们还发布了原生全固态模型 gemini omni, 整合了图像、视频还有世界模型这些技术。这可以说是谷歌 ai 体系的核心,贯穿系统。说白了,这就标志着谷歌的 ai 愿景正在从组织全球信息转向模拟并代理物理世界。说到代理, 他们这次明显在聚焦 code agent 和 agent 的 生态。谷歌推出了一个叫 universal commerce protocol, 也就是 u c p 的 协议,摆明了是对标 andropic 的 m c p 协议。然后他们还发布了一个 agent 产品,叫 spa r k, 这个东西可以在谷歌云上七成二十四小时运行,目前它只支持谷歌自有的工具, 不过后续也会接入第三方工具。整体看下来,未来的 agent 将会把搜索引擎从一个单纯的信息入口,直接升级成交易和任务的执行平台。 你看,在搜索和电商业务的升级上,这个逻辑就体现得很明显。搜索端那边,他们推出了由 gemini 三点五驱动的 ai overviews 智能搜索框,支持上传图文和视频,还能开启对话式搜索, 甚至还能代替用户去和商家沟通。这种主动代理功能,电商端也是个大动作,他们推出了 universal cart, 也就是通用购物车,能支持跨平台的商品聚合、 ai 自动追踪、降价,还有补货提醒这些 a 政功能。其实前面提到的那个 u c p 协议,已经接入了 shopify 等主流平台,甚至还支持酒店预定等服务。 他把 a p i 支付协议打通了,用户可以通过 agent 进行有限额的信用卡消费,基本上就把发现、决策到支付的全链路闭环给做成了硬件和端测。他们也没落下,这次宣布了和三星合作, 基于交通平台去开发 ai 眼镜,这里面的产品包含了带显示功能和语音交互的两类。就在二零二六年秋天,他们会先推出语音交互款,功能上支持听音乐、拍照、通话以及调用手机 app 等, 未来还会继续向 ar 智能眼镜的方向去发展。当然,这背后全靠算力在撑着。谷歌此前已经公告过,二零二六年的资本开支是在一千八百到一千九百亿美金,它们第八代 tpu 的 算力比前一代直接提升了三倍。这次第八代 tpu 分 成了两款,一款是八 t 训练芯片, 专门用于大规模预训练,支持跨数据中心训练,能完成超百万卡集群的部署。光模块标配一点六 t, 另一款是八 i 推理芯片,这是谷歌历史上首款推理专用的芯片,特别强调低延时,最大能支持一千一百五十二张八 i 芯片的集群互联。而且你会发现 谷歌的 tpu 正在从自用转向外公。他们和黑石成立了 e t u cloud 的 合作公司,黑石出使就投入了五十亿美元, 目标是在二零二七年上线五百兆瓦的数据中心容量,来提供谷歌的 tpu 算力服务,整个投资预计会达到两百五十亿美元。关于 tpu 的 出货量,预期他们二零二五年出货量还不到两百万张,二零二六年预计就会有大约四百万张, 二零二七年预计能达到一千万张,到了二零二八年预计会达到两千万到三千万张。既然芯片出货量上去了,集群和网络架构肯定也得跟着升级。它们的最小 pod 的 计算单元提到了九千六百张卡,同时还首次推出了可以商用的 scale out 网络, 最大支持三万四千四百张卡的集群训练。这么一来,光模块的用量就大幅提升了,训练端和推理端都在加单,同时 ocs 交换器的用量也在提升, 训练端和推理端都有明显的增配需求。聊到这,咱们来看看整个产业链上那些正在受益的公司。光模块产业链这边,你可以重点看看谷歌的光模块供应商, 像中际旭创、力迅精密、联特科技,还有美股的 f i n i s a r。 上游的光芯片供应商里面有原结科技的厂商,比如光库科技、德克利福金科技、藤井科技、 海泰星光也都值得留意。再往深了看,半导体产业链的变化也很大。 t p u 制造相关的有台积电,他们负责了 t p u 的 全部流片和 koloss 封装。还有博通 作为 t p u 核心设计供应商,和谷歌签订了长期协议,一直到二零三一年,同时还供应数据中心网络组建。联发科也参与了部分的 t p u 设计。存储相关的有美光、海力士、三星, 随着 tpu 出货和 token 消耗的增长,它们 hbm 和 dram 的 需求都在跟进。而且随着视频和图片生成以及 agent 任务结果的存储需求增长, enfinash 的 需求也在动。 pcb 相关的有沪电股份、深南电路、彭鼎控股、圣虹科技、广核科技、东山精密,它们都是 tpu 回到 gpu 主板的核心供应商。服务器和交换机组装这边有天弘科技,负责服务器和交换机组装,力迅精密和东山精密则负责光模块组装。 甚至连数据中心基建产业链都在变。受这种百万卡集群和跨数据中心合作需求的影响, d c i 也就是数据中心互联的前景挺广阔的,像诺基亚电力企业,还有数据中心厂商都卷在里面。最后就是应用端产业链了, ai 营销里面有一点,天下、汇量科技、蓝色光标, ai 电商里面有值得买。焦点科技,视频深层领域则有中文在线、昆仑万维这些,大家伙都在跟着。

就在刚刚,谷歌甩出新王炸发布悉尼代模型 gmna, 三点五三大基准全线刷新,综合推力九十二,博士级,数据级八十八,真实编程七十八,上下文直接拉到两百万!还配了深度思考模式, 一个模型全形态打通,视频音频三维模型代码全部原声生成,智能体,任务完成率干到七十一,订机票写报告,点外卖,全自动,速度三倍,价格直降六成。 更夯的是 flash model, 直接免费,无限次对话,多模态全开,白嫖到爽,横屏一眼看穿,全维度领先,同价为竞品! 你觉得 gemna 能成为新的王者吗?欢迎评论区聊聊!

今天凌晨, ai 圈迎来重磅动态,就在今早,谷歌开发者大会正式上线 gemini 三点五 flash 模型。按照官方公布信息,这款模型响应速度相比以往版本提升四倍左右,使用成本也有所下调,整体使用体验优化很明显。 不少朋友觉得这类海外模型距离日常使用比较远,操作起来也不方便。其实咱们国内多款主流 ai 大 模型综合使用表现已经十分成熟, 像大家常用的豆包 deepsea, 日常写短视频文案、整理工作资料、规划生活内容都能轻松胜任。不用繁琐操作,也不需要特殊网络环境,手机电脑都能随时打开使用,完全可以满足普通人日常办公和自媒体创作需求。 我日常只分享国内正规实用 ai 软件,不讲趣话,只教大家简单好用的实操用法,喜欢实用 ai 干货的不妨点个关注,一起学习!

谷歌发布 gemini 三点五 flash 免费开放,适配短视频,语速适中,时长约四十五秒,画面搭配 ai 界面动效,发布会片段参数对比字幕。 hello, 大家好,科技圈又迎来重磅大消息。就在近期谷歌开发者大会上,全新的 gemini 三五 flash 正式亮相,瞬间刷屏各大科技榜单。这次更新亮点格外亮眼,不仅整体运算速度直接提升四倍,响应效率大幅升级, 处理图文代码、创作逻辑问答、长文门解析都更加流畅高效。更让人惊喜的是,这款全新大模型面向全球用户免费开放使用,没有额外门槛限 制。对比以往版本,他在精准度、多、任务处理能力上都实现明显突破,日常办公、剪辑、学习答疑、创意写作、编程调试,各类场景都能清 松。下雨行业不少从业者都感慨,谷歌这次实打实放开福利,势必也会带动整个 ai 赛道加速内卷迭代。国产 ai 模型也一直在稳固追赶进步,未来智能工具的竞争也会给咱们普通用户带来更多实用又划算的新体验。

谷歌这次是真的开始反击了,今年的 google i o 二零二六, gemini 基本成了全场主角。最值得关注的两个更新,一个是 gemini 三点五 flash, 另一个是 gemini omni。 先看 gemini 三点五 flash, 这是 google 新一代 gemini 三点五系列的首播模型,官方定位很明确,主打 agent 能力、代码能力和长任务处理能力。 也就是说,它不只是回答问题,而是更适合执行复杂流程,比如写代码要用工具处理多步骤任务,甚至在较长时间里持续完成一个工作流。这也是为什么 google 要重点强调它的速度、成本和执行能力,因为 ai 的 竞争正在从谁回答的更聪明,变成谁能真正替用户干活。 更值得关注的是 gemini, 它不是一个普通的视频生成模型。 google 这次把 omni 放在了世界模型的方向上去讲,也就是让 ai 不 只是生成画面,而是理解现实世界里的物理规律、历史知识、 科学逻辑和文化背景。官方给出的方向是任何输入生成任何输出。在目前第一阶段,主要先从视频开始。 gemini omni flash 支持文字、图片、音频、 视频作为输入,然后生成视频,也可以用自然语言继续编辑视频,比如改变画面风格,调整镜头角度,替换场景内容,或者让一段普通视频变成完全不同的视觉效果。图片和音频输出, google 也表示会在后续加入。所以这次 omni 的 重点不只是能做视频,它更像是 google 在 尝试让 ai 理解世界,在模拟世界。 这也是为什么有外媒把它称为迈向 a g i 的 一步。从竞争格局看, open ai 在 推进 agent 和 codex, cloud 在 强化 cloud code。 而 google 的 打法是把 gemini 接近搜索安卓 youtube workspace 和云服务。 如果 gemini 三点五, fly 是 负责执行任务, gemini omni 负责理解和生成现实世界。再叠加 google 的 生态入口, google 的 ai 反机就不只是模型升级,而是一次生态级反机。过去两年拆的 g p t 和 cloud 抢走了大量用户心智,但这次 io 想证明一件事, jemmy 不 只是 google, 也有一个 ai, 它正在变成 google 下一代生态的核心。你觉得这次更新之后, google 能重新打回 ai 第一梯队吗?评论区说说你的看法。

一口气看完谷歌 i o 大 会七大更新,先看明星产品 gemini 三点五 flash, 几乎所有机型超越三点一 pro 主打更强的 a 帧能力、更强的抠定能力和更快的速度,速度四倍于同级模型,价格比三 flash 差不多贵了三倍,但比三点一 pro 便宜百分之四十。三点五 pro 推迟到下月发布, 值得期待。第二, gemini 一 款世界模型,能根据图片、视频、音频、文字任意输入生成高质量视频, 创作出来的视频完美卡点。还可以通过跟他对话来编辑视频,换环境、换角度、换风格,多次优化也没问题。而且他对这个世界也很懂,短短一行提示词就能生成黏土动画,讲清楚蛋白质折叠。 第三,谷歌把 antigravity 打造成一个完整生态桌面版。二点零是目前主力入口,中端 c l i 适合快速脚本化清亮场景,自己造 agent 就 用 s、 d、 k 还有企业接入, 实现无缝配合。谷歌这波的核心方向就是专注于多 agent 协助异步任务和更广泛的知识工作,而非仅限于编码。 第四,你的私人 ai agent gemini spark 由 gemini 三点五和 google ant gravity 技术提供支持,在谷歌云上的专用虚拟机上运行,甚至注入了智能编码能力。第五,智能购物车。不论你是在刷 youtube 还是看 gmail, 都能直接添加商品,它还会自动比价向你推荐更加方案。 第六,一些好玩的更新,谷歌的 ai 选映技术,官网里又将会圈一下就能查这张图是不是 ai ask map youtube 把搜索框变成直接对话的窗口, 还有 dog's life, 以前让 jimmy 写东西得字斟句酌的输入提示词,现在直接说就行, jimmy 会自己整理,最后提一嘴谷歌的音频眼镜秋季上市,不得不说这届 i o 大 会信息量真不小。你最喜欢哪个? 关注机器之星,探索 ai 世界。

朋友们,今天凌晨,谷歌扔出了一枚深水炸弹。就在刚刚结束的 google i o 二零二六大会上,谷歌宣布推出 gemini 三点五 flash 模型,并且向全球所有用户免费开放。这不是阉割版,不是试用版,而是谷歌宣称的迄今为止最快、最有效的模型。 它可以接受任何形式的输入文字、图片、音频、视频,用户甚至可以用自然语言直接编辑视频。谷歌在现场算了一笔账,对于头部企业来说,如果把大部分工作负债切换到 flash 系列模型,每年节省的成本可能高达十亿美元级别。免费开放多模态视频编辑,年省十亿, 这不仅是模型升级,这是全球 ai 巨头在用极致性价比重构竞争格局。很多人可能对三点五 flash 这个命名没概念,我帮你翻译一下。 第一,速度快得离谱。谷歌表示, g m 三点五 flash 在 输出令牌速度上是其他前沿模型的四倍,而在优化平台上的版本,速度还能再提升到十二倍。什么概念?你以前问 ai 一个问题,等三秒才有回复,现在一秒不到答案就出来了。第二,性能不降反升。你可能会想,速度快是不是牺牲了智能? 恰恰相反, gemini 三点五 flash 在 多项精准测试中,超越了四到五个月前的旗舰模型。在代理式 ai 能力、代码编辑、多模态理解等关键维度上,三点五 flash 都达到了前沿级别的水平。用谷歌的话说,性能是旗舰级,成本只有三分之一到一半。第三,真正的多模态来了。 gemini 三点五 flash 可以 接受任何形式的输入文本、图片、音频、视频。更炸裂的是,用户可以用自然语言直接编辑视频。你说把这段视频中的夕阳调亮一点, ai 立刻执行, 不像是模型升级,更像是人机交互方式的彻底重构。第二部分,谷歌的阳谋,用极致性价比打一场价格战。很多人问谷歌为什么要免费开放,低价收费?难道做慈善?答案很简单,抢市场、抢用户、抢生态。第一, ai 的 竞争已经从参数竞赛转向成本竞赛。谷歌现场算了一笔账, 目前头部企业每天在谷歌云上处理海量 token, 如果把大部分工作负债切换到 flash 系列模型,每年节省的成本是十亿美元级别。 对于正在烧钱搞 ai 的 企业来说,成本就是生死线,谁能在保证性能的前提下把价格压到最低,谁就能抢走对手的客户。第二,谷歌要用免费圈住十亿用户。 gemini 应用的月活用户已经超过九亿,一年前这个数字只有四亿。谷歌搜索 ai 模式的月活用户也在一年内突破了十亿。策略很清晰,用免费的 flash 模型留住 c 端用户,用低价的 a p i 吸引弊端开发者。当所有人都习惯了 gemini 生态,谷歌的 ai 收入就会像当年的搜索广告一样源源不断。 第三,谷歌有降维打击的底气。自研芯片,谷歌使用的是自研 p p u, 而不是像其他厂商那样采购英伟达 g p u。 自研芯片意味着更低的单位算力成本、更高的利率。二零二六年,谷歌预计资本支出将达到一千八百亿至一千九百亿美元,六倍于二零二二年的三百一十亿美元。 这种不计成本的投入,就是在为未来五年的 ai 算力霸主地位铺路。谷歌 ai 大 模型升级,最直接的受益者不仅是谷歌自己,还有整条 ai 算力产业链,大模型训练和推理需要海量算力。 杰米尼三点五 flash 的 免费开放,意味着全球用户的使用量将暴增,直接拉动 ai 服务器需求。据产业链消息,谷歌 tpu 机柜总数量预计将从二零二六年的约六万柜,快速成长到二零二七年的约十点五万柜,年增幅高达百分之七十五。工业复联 ai 服务器代工龙头,深度绑定英伟达、谷歌等大客户直接受益。 互电股份 ai 服务器 pcb 核心供应商、 pcb、 数据中心等领域的订单持续增长,大模型参数越大,数据传输需求越高。 光模块是 ai 算力集群的神经系统中继续创全球光模块龙头。一点六 t 光模块已批量交付。谷歌 gemini 流量增长将直接拉动八百 g 一 点六 t 需求。 天福通信一点六 t 光引擎规模量产,深度绑定海外头部大客户业。三点五 flash 的 免费开放受益于 ai 数据中心互联需求。 gemini 三点五 flash 的 一大亮点是端侧轻量化,让更多中低端设备也能流畅运行本地 ai 功能。瑞生科技向 ai 手机 x 二可穿戴设备输出光波导、高端散热系统等感知方案。康奈特光学、夸克 ai 眼镜独家镜片供应商受益于 ai 端侧设备放量。当然,话要说回来, 第一, gemini 三点五 flash 的 免费策略可能会引发整个 ai 行业的价格战,如果竞争对手被迫跟进降价,整个行业的利率可能被压缩。 第二,谷歌 tpu 供应链相关标的近期已有较大涨幅,工业复联中继续创等估值处于历史高位,短期追高需谨慎。第三,谷歌的资本支出虽然庞大,但能否持续产生回报,还需要看 ai 应用的商业化落地节奏。 总之, gemini 三点五 flash 免费开放是谷歌在 ai 成本占中的一次亮剑,它的意义不亚于当年安卓系统免费开放。 用极致性价比抢下生态入口,再用生态反捕算力投入工业复联在造服务器中继续创。在铺光模块,天府通信在生产光引擎,瑞生科技在布局端测硬件。当谷歌用十亿用户、万亿 toker 向全球宣告 ai 不 再是奢侈品时,中国算力产业链上的卖产人正在闷声发大财,这个赛道的故事正在翻开新的一章。 好,这个话题就聊到这。以上内容和提到的公司是基于公开信息的逻辑梳理与产业推演,不构成任何投资建议。市场有风险,投资需谨慎。