机器智能时代需要强大的基础设施
阿里已经把AI定义为一场比工业革命更深刻的变化,而且它不打算只做其中一环。
“机器正在成为思考的主力,智能正在成为一种规模化的商品。未来机器思考总量将达到人类的1000倍以上。”在云栖大会上,阿里巴巴CEO吴泳铭提出了这一判断。
上一次类似的变化,是工业革命把动力变成了商品——蒸汽机、内燃机、电,一步步把“动力”变成便宜、稳定、无处不在的基础设施,然后才有了现代产业体系。
阿里想做的,是机器智能时代的发电站和电网。
吴泳铭在演讲中明确提出了“AI模型、AI芯片、AI云”三大基石的框架,将阿里的投入方向从模糊的“All in AI”收敛为一条清晰的路线。
吴泳铭给出的目标是,到2032年,阿里云全球规模超过20GW,较2022年增长10倍。而这20GW目标下的实际投入,将远超此前3800亿元的三年计划。
AI技术变化之快,即便立于潮头也很难看清局势走向。阿里希望的,是抓住长期变化中的确定性机遇——用今天的利润,赌十年后的基础设施。
吴泳铭表示,机器智能时代的三大基石是AI模型、AI芯片和AI云,这是机器思考能够规模化供给的前提。
“如果从电的发展历史来看,未来机器智能对AI基础设施的需求,对比今天的规模,几乎是没有上限的。”吴泳铭表示,“阿里巴巴将坚定投入以AI模型、AI芯片和AI云为代表的基础设施建设,这是我们的长期战略选择。”
阿里全栈AI的叙事讲了不止一年。在今年云栖大会上,阿里首次集中展示了“芯片—模型—云”的协同优化成果。
在云栖大会上,平头哥发布了真武V900 AI芯片。从纸面参数看,这是一次肌肉的展示:算力是上一代M890的3倍,配备216GB显存,片间互联带宽高达1200GB/s,单集群可扩展至50万卡,并计划在2027年第一季度量产。
平头哥对阿里的价值在两方面:一是成本,自研芯片与阿里云基础设施、千问模型深度协同设计,提高性价比;二是供给保障,在全球AI算力紧缺的背景下,阿里云作为具备自研芯片能力的云计算公司,这是竞争对手难以复制的壁垒。
上一代真武M890,已经在产业端跑出了实绩。据阿里披露,基于真武M890打造的阿里云灵骏超节点实例,已稳定运行Qwen3.8-Max、Kimi K3等超2万亿参数模型,并实现规模化供给。截至2026年6月,真武系列已服务超过650家企业客户。
再看模型层。截至2026年8月,Qwen系列累计开源超过460个模型,全球下载量突破20亿次,在Hugging Face上的下载量是Google模型的近5倍、Meta模型的9倍。衍生模型数超过30万个,是全尺寸、全模态的全面开源。
目前,基于新一代架构的Qwen4已投入训练,后续版本计划将模型总参数扩展至5万亿至10万亿,向能够完成更复杂、更长程任务的超级人工智能(ASI)迈进。
模型也开始反过来探索自主设计芯片,为基础设施提效。仅基于一份真实的芯片模块规范,Qwen3.8-Max就能自主运行超过60小时、调用EDA工具超过万次,完成从功能架构设计、验证到物理实现的完整流程,实现物理面积下降42%的优化指标。
更关键的是,Qwen正逐步迈向训练自我进化。云栖大会上,阿里介绍称,Qwen3.8-Max通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全“零参与”的情况下持续迭代超1个月,完成33轮有效迭代。
阿里云则围绕模型持续训练与推理、Agent长时间执行任务等需求,建设覆盖全球的AI基础设施,对GPU、CPU、网络、存储、数据库和工具进行联合优化。基于M890的超节点已支持超过2万亿参数模型的高效推理,并在阿里云实现规模化供给。今年第四季度,阿里云还将新增服务节点,进一步扩大云上超节点供给。
模型需求进入芯片设计,软硬件优化进入云上服务,模型自身又参与下一轮技术改进。随着这一反馈机制持续运转,单个环节的技术进步有望通过整个体系放大,进一步提升复杂AI任务的运行效率与规模化服务能力。
评论交流
0