亚马逊内部文件披露印第安纳AI数据中心重大重组

Claire Weston
Published todayAbout 4 min read

亚马逊正将印第安纳州多个数据中心合并为一个「AGI超级集群」,用于训练下一代前沿AI模型;这意味着亚马逊正把自研芯片和自研模型两条线拧成一股,直接对标谷歌和微软的超大规模训练能力。

01

什么是「AGI超级集群」,为什么要把几栋楼并成一个系统?

亚马逊正把印第安纳园区内多栋独立数据中心整合为一个统一算力系统,内部代号「AGI超级集群」(AGI SuperCluster)。
这意味着→ 以前每栋楼各跑各的,现在要把网络、存储、光纤全部打通,让几千台服务器像一台巨型计算机一样协同工作
部分现有建筑将改造为「附属楼」,不再独立运行,而是与相邻数据中心共享核心网络设备
02

这事有多急?为什么要赶在年底之前?

内部文件包含一项「紧急请求」:部署超过6000台Trainium驱动的AI服务器,并将上线时间表提前数周
目标节点是今年12月初的亚马逊re:Invent大会——公司希望届时下一代前沿AI模型已完成训练准备
这意味着→ re:Invent既是产品发布窗口,也是对外展示AI实力的舞台;如果届时拿不出新模型,亚马逊在AI竞赛中的叙事将被动。
03

自研芯片换代——Trainium 2换成Trainium 3意味着什么?

文件显示,部分设施计划将旧款Trainium 2服务器替换为更新的Trainium 3服务器。
用大白话说= Trainium是亚马逊自己设计的AI训练芯片,相当于英伟达GPU的自研替代品;从2代升到3代,就是用更快的芯片跑更大的模型。
亚马逊上周披露,自研芯片业务(含Trainium AI芯片和Graviton处理器)年化营收有望突破250亿美元,高于上季度预测的200亿美元
04

同一个园区里还有Anthropic的项目,会互相抢资源吗?

该园区同时承载「雨林计划」(Project Rainier)——亚马逊为Anthropic建造的Trainium驱动AI超级计算机。
亚马逊明确表示:新的AGI超级集群不会占用「雨林计划」的现有服务器,两条线并行推进。
这反映出亚马逊在AI上同时押注两条路:自研前沿模型 + 扶持外部盟友Anthropic,两边都不打算让步。
05

钱从哪来?2200亿美元资本开支怎么算这笔账?

亚马逊近期已将2026年资本支出预期从2000亿美元上调至2200亿美元,此次重组是其中一部分。
CEO安迪·贾西(Andy Jassy)的逻辑是:数据中心可以用数十年,服务器和网络设备可以随时间迭代更新,因此前期重投入能产生有吸引力的长期回报
文件还显示,扩建将增加存储容量以支持多模态AI训练(同时处理文字、图像、视频的AI训练方式),这类训练需要处理大量高分辨率图像并频繁保存模型进度。
06

AGI组织刚裁过员,这个计划真的没放缓?

该项目隶属于亚马逊内部名为「AGI枢纽」(AGI Pivot)的更广泛计划,由公司AGI组织主导。
知情人士称,尽管AGI组织近期经历裁员、前Nova模型系列也已停止开发,前沿模型推进计划「并未放缓」
这意味着→ 亚马逊砍掉的是被判定走不通的旧模型线,但把资源集中到了新一代模型的基础设施上——裁员和加注同时发生,方向在收窄而非收缩。

Content is for reference only, not financial advice.

亚马逊内部文件披露印第安纳AI数据中心重大重组 · nashnova