云栖大会首日,看懂阿里的「芯片云」终极闭环

试想一下,如果有一天,思考也能像电一样,打开开关就有,而且几乎用不完,会怎么样?

在2026杭州云栖大会十周年的现场,阿里巴巴CEO吴泳铭就给出了一个相当激进的判断:

未来机器思考的总量将达到人类的1000倍以上。

而今天,这个比例还不到3%。按他的判断,往后机器甚至可能承担99.9%的思考工作。也就是说,我们眼下已经觉得很热闹的AI,可能还只是开头。

如果说上一轮工业革命解决的是怎么大规模生产“动力”,那么这一轮想解决的是怎么大规模生产“思考”。

按这个角度看,今年云栖大会主论坛上那些看起来各说各的发布,其实就是同一件事——Qwen负责把智能越做越强,平头哥提供越来越强的算力,阿里云负责把机器智能规模化送出去。

阿里将这称之为“芯片—模型—云”协同飞轮,而今天它们一起亮了。

先造“发电机”:真武V900

第一张是芯片。

平头哥发布新一代训推一体AI芯片真武V900,几个数字特别亮眼:

单芯片性能是上一代M890的3倍,216GB显存,片间互联带宽1200GB/s,原生支持FP8、FP4;配上自研ICN Switch、超节点和新一代网络架构,单一AI集群最高能扩到50万卡。

但《首席信息官》认为,50万卡这个数,显然不只是给今天的模型预备的。因为下一代模型的规模,已经开始往更夸张的方向走了。

阿里巴巴ATH事业群Token Foundry Qwen LLM项目负责人刘大一恒,今天把Qwen接下来的路线摊得很清楚:Scaling继续。

Qwen4已经在训练,后面的Qwen4.5、Qwen5计划把总参数直接推到5万亿—10万亿。

但是,50万卡和10万亿参数,其实是一件事情的两面:模型越大,背后那个“智能工厂”就得越庞大。

Qwen开始自己改自己了

不过刘大一恒这场演讲里,我觉得更值得盯的不是10万亿参数,而是三个字母:RSI——Recursive Self-Improvement,递归式自我改进。

以前训练AI,是人找问题、人备数据、人设计实验,然后训下一版。

现在Qwen在试着把人从这个循环里摘出去。

Qwen3.8-Max做过一次实验:人类零参与,自己搭训练流程、造数据、设计实验、找缺陷,连续跑了一个多月,完成33轮有效迭代,Artificial Analysis得分从40提到45。

这5分听起来不算多,但这件事的性质不一样——这33轮迭代里,没有人参与。

后面更有意思:它开始把手伸向支撑自己的基础设施了。

在一款此前没接触过的平头哥GPU上,Qwen自主优化推理框架,单实例吞吐提升96%;拿到一份真实芯片模块规范后,它自主运行超过60小时、调用EDA工具1万多次,把芯片模块的物理面积压掉了42%。

于是有了这么一个循环:人设计芯片训练AI,AI越来越聪明;AI反过来帮助设计和优化芯片,更好的芯片再训练下一代AI。

所以阿里今天讲的“芯片—模型—云协同”,重点不在于三个业务摆在一块儿,而在于它们开始互相喂。这才叫飞轮。

Qwen还在从“脑”变成“人”

与此同时,Qwen的边界也在快速外扩。

今天阿里展示的已经不只是一个语言模型家族:Qwen3.8-Omni把文字、图像、视频、音频纳入同一个理解框架,Qwen-Audio继续往实时语音交互走,图像、视频、音乐、世界模型也在同时铺开。

目前,阿里已经开源了460多个Qwen模型,累计下载超过30亿次,衍生模型超过30万个。模型家族越来越庞大,但不同模态的能力,最终可能反而走向统一。

阿里巴巴ATH技术副总裁、淘天集团首席科学家郑波今天给了一个时间判断:三年内会出现原生全模态统一模型,体验上不再受模态边界限制。

换句话说,不用一个模型负责听、一个负责看、另一个负责说。它会更像人:同时看见、听见、理解,然后行动。

Scaling解决的是大脑有多聪明,全模态解决的,则是这个大脑怎么真正碰到现实世界。

还差一张覆盖全球的“电网”

模型越来越大,Agent开始长时间干活,机器思考不断堆量,最后都会落到一个现实问题上:海量Token,需要海量算力。

所以吴泳铭用了一个挺形象的比喻:Token就是AI时代的电。而云要做的,就是像电网一样,把机器智能送到每一个需要它的地方。

阿里的目标是,到2032年,阿里云运营的全球数据中心规模超过20GW。

与此同时,它还在拼命压低每个Token的成本。

比如,针对长上下文和复杂Agent任务,阿里云通过Tair KVCM等技术,把相关场景下的每Token成本降低50%,首Token响应时间降低54%。

这和当年的电力工业一样,只有发电越来越便宜、电网越铺越密,冰箱、空调、电视、计算机才谈得上普及。以此类比,只有Token足够多、足够便宜,机器智能又能随时随地获得,百万AI科学家、百万AI专家才可能从想象变成现实。

云栖十年,阿里又回到了基础设施

把今天这些发布放在一起看,阿里的野心显然比“Qwen能不能做到最强”要大得多。

它赌的是思考本身会变成一种新的工业品。如果这个判断成立,往后最重要的竞争之一,就是谁能用更低的成本、更大的规模,持续把智能生产出来、输送出去,再让它进入真实世界。

Qwen、平头哥、阿里云,也就不再是三个孤立的业务。

模型不断生产智能,芯片提供算力,云把机器智能规模化输送出去;而越来越聪明的模型,又开始反过来优化芯片和计算系统。这就是阿里今天所说的“芯片—模型—云”协同飞轮。

十年前,云栖想解决的问题是:

怎么让计算像水电一样随取随用。

十年后,阿里把问题换成了:

怎么让智能也像水电一样随取随用。

这才是今年云栖,阿里真正摊出来的底牌。



展开阅读全文

更新时间:2026-09-24

标签:科技   闭环   阿里   首日   芯片   大会   模型   智能   机器   平头   阿里巴巴   飞轮   电网   聪明

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号

Top