英伟达50亿押注SSI,首个模型疑本周发布
Nashnova编辑部
英伟达向苏茨克维尔创立的SSI投资50亿美元并开放下一代芯片独家访问权,SSI首个模型疑似本周发布——这是对当前主流AI训练范式的一次正面挑战。
SSI是谁,为什么值得英伟达下这么大的注?
SSI全称「安全超级智能」(Safe Superintelligence),由伊利亚·苏茨克维尔创立——他是OpenAI的联合创始人,被公认为深度学习领域最核心的技术人物之一。
SSI的定位极其激进:不发布中间产品,直奔超级智能。这意味着→ 它不会像其他实验室那样先出聊天机器人再迭代,而是把全部资源压在一条尚未被验证的技术路线上。
英伟达今年7月宣布与SSI达成长期战略合作,承诺12个月内将SSI算力提升10倍,并开放下一代Vera Rubin系统的独家访问权限。英伟达在新闻稿中说,这个决定是在「获得了对其严密保护的研究成果的罕见访问权」之后才做出的。
用大白话说= 英伟达看了SSI的底牌,然后决定押50亿美元——这本身就是一个信号。
首个模型什么时候出?有多少实锤?
投资人加文·贝克在播客中透露,SSI曾表示将于8月发布其模型。
a16z合伙人马丁·卡萨多近日暗示接触到了「今年最重磅的新模型」——a16z正是SSI的核心投资方之一。
目前没有SSI官方的发布日期确认,但多位硅谷投资人的公开暗示指向本周。这反映出SSI内部可能已经进入了成果展示阶段。
「测试时训练」到底是什么?和现在的AI有什么不同?
据报道,SSI首个模型基于测试时训练(Test-Time Training,简称TTT)架构。用大白话说= 现在的AI模型像一本印好的教科书——训练完成后内容就固定了,遇到新问题只能在已有知识里翻找答案。
TTT架构完全不同:模型在回答问题的过程中会实时修改自身的参数权重,相当于一边考试一边学习。这意味着→ 模型面对新信息时不只是「查找」,而是真的在「理解和适应」。
现有的主流做法(包括OpenAI的o1系列)靠扩大上下文窗口来处理更多信息,但模型本身不变。TTT则让模型在推理时产生梯度更新(一种让神经网络调整自身的数学机制),从根本上改变了「模型何时学习」这个问题的答案。
苏茨克维尔为什么认定这条路线?
苏茨克维尔在2024年NeurIPS大会上公开预言:预训练时代即将结束。他在2025年11月的播客中进一步指出,AI正从「规模扩展时代」迈向「研究时代」。
这反映出他的核心判断:靠堆数据、堆算力把模型做大的老路正在碰到天花板,下一步突破必须来自架构层面的根本创新。
SSI投资人杰德·麦卡勒布曾联署论文,明确指出「长上下文语言建模根本不是架构问题,而是连续学习问题」——这和TTT路线高度吻合,说明SSI团队内部对这个方向有共识。
如果SSI的模型真的管用,谁会受到冲击?
目前各大AI厂商的竞争壁垒建立在两个基础上:预训练算力规模和上下文窗口长度。谁的训练集群大、窗口长,谁就领先。
如果TTT架构被证明有效,这两道护城河都会被削弱。这意味着→ 花了几十亿美元建训练集群的公司,可能发现竞争对手用一种完全不同的方式绕过了自己的优势。
英伟达提前锁定SSI独家算力供应的战略意图也会更加清晰:无论哪条路线胜出,英伟达都要站在供应链的上游。用大白话说= 英伟达不赌谁赢,它赌的是不管谁赢都得用它的芯片。
Content is for reference only, not financial advice.