英伟达正大力押注自研开源人工智能模型,试图以此扩大GPU需求——尽管这一策略同时将其推入与自身客户和投资对象正面竞争的微妙处境。
The Information 11日报道称,英伟达目标是将Nemotron 4最大版本的性能打造至与全球顶尖开源模型比肩的水准。多名员工透露,该模型参数量预计至少达到一万亿——约为其现有最大模型Nemotron 3 Ultra的两倍。英伟达生成式AI副总裁Kari Briski在一封邮件中表示,"英伟达投资Nemotron,是因为我们相信每家企业、每个国家都需要可及的前沿开源模型。"
英伟达当前的芯片需求高度集中于OpenAI、微软、SpaceX等少数前沿实验室和云服务商,而上述机构正日益布局自研AI芯片。Nemotron 4的推进旨在将需求基础拓展至更广泛的企业用户群体,从而降低英伟达对头部客户的依赖。AI模型评测机构Arena的首席执行官Anastasios Angelopoulos表示,"无论哪家公司做出优秀的开源模型,英伟达都是赢家。"
英伟达美股盘前涨近2%。
千亿参数目标,算力投入三倍跃升
据多名参与Nemotron项目的员工透露,英伟达计划开发的最大规模Nemotron 4模型参数量至少达到1万亿,约为其今年6月发布的现有最大模型Nemotron 3 Ultra的两倍。该模型参数规模仍将远低于中国头部开源模型,但英伟达同时强调其压缩技术可使较小模型实现超越性的性能表现。
在算力投入层面,英伟达的决心体现于其资金承诺的大幅扩张。据悉,该公司通过向购买其芯片的云服务商回租AI服务器获取算力。截至今年4月,英伟达多年期云服务承诺的总价值已增至2031年初的280亿美元,约为一年前披露金额的三倍。其中针对本财年(截至2028年1月)的相关支出约为70亿美元,虽远低于OpenAI和Anthropic的投入规模,但已超过绝大多数美国和中国领先开源实验室的历史融资总额。
在研发人员规模上,Nemotron项目同样持续扩张。英伟达上一个重要模型的研究论文署名作者多达570人,多名员工表示Nemotron 4的参与人数将更多。"现在每个人都想参与进来,"一位前员工说。
组建"Nemotron联盟",广纳开源生态伙伴
为加速Nemotron 4的研发,英伟达构建了一个名为"Nemotron联盟"的合作网络,成员包括Reflection、Cursor、Thinking Machines和Mistral等开源开发商,各方在推进自身模型项目的同时,也向Nemotron 4贡献训练数据、评估支持和模型设计方案。
此外,据一位直接参与合作的人士透露,AI模型训练初创公司Prime Intellect已向该项目贡献了30万个模拟环境,用于辅助模型训练。AI编程工具初创公司Cognition也在联盟成员之列,据知情人士透露,该公司已就向英伟达提供代码训练数据展开讨论,但相关合作尚未正式对外公布。
联盟成员的参与动机各异。部分公司希望借助英伟达对开源生态的推动扩大市场份额;另一些则期望以较低成本影响一个可供自身使用的高质量模型的研发方向,从而规避自行承担训练算力成本的压力。Prime Intellect首席执行官Vincent Weisser将这一联盟定位为对抗单一"神级"模型垄断的集体行动,而非一场争夺最佳开源模型名号的零和博弈。
客户与竞争对手的边界趋于模糊
Nemotron 4的推进令英伟达陷入一种微妙的结构性张力之中。一方面,OpenAI长期以来是英伟达芯片需求的重要驱动方,英伟达已向其投资300亿美元;另一方面,Nemotron 4的定位恰恰是为企业提供成本更低的替代方案,与OpenAI等前沿实验室的商业模型形成竞争。与此同时,联盟中包含的Reflection AI和Thinking Machines等公司,也是英伟达已注资的开源创业企业。
不过,对英伟达而言,这一竞争逻辑并不必然是零和游戏。AI模型评估机构Arena的首席执行官Anastasios Angelopoulos表示:"无论哪家公司做出优秀的开源模型,英伟达都是赢家。"英伟达的核心逻辑在于:开源生态越繁荣、参与主体越多元,GPU的整体需求就越旺盛。
目前,Nemotron系列模型已获得一定市场采用,帕兰提尔(Palantir)于今年6月宣布与英伟达合作,将Nemotron模型用于美国政府客户。但据Arena和Artificial Analysis等机构的基准测试数据,英伟达现有最大模型Nemotron 3 Ultra在美国开源模型中仅排名第二,位列Thinking Machines新发布的Inkling模型之后,在全球模型整体排名中更位于前40名之外。
发布时间表仍不明朗
尽管项目规模宏大,Nemotron 4的发布时间仍存在较大不确定性。多名员工表示,英伟达已就预训练数据和架构做出若干决策,但尚未最终确定具体规格和发布日期,最终训练阶段亦尚未启动,预计耗时数月。两名员工认为模型最快可在今年秋末发布,另有员工认为时间可能更晚。
与此同时,英伟达本周已发布了Nemotron系列的一个较小版本——Nemotron 3.5 Lightning,该模型主打以尽可能快的速度和效率运行AI代理任务。英伟达同步发布了免费的模型路由软件,协助企业更便捷地构建自定义模型路由工具,将特定AI任务自动分配至最优、最经济的模型处理。
英伟达应用深度学习研究副总裁Bryan Catanzaro今年1月在一档播客中表示,投资Nemotron"对我们公司的未来至关重要"。英伟达首席执行官黄仁勋也在上月的一封邮件中公开表态支持开源,称开源模型"促进安全、网络安全、科学进步和国家安全"。
资讯来源:华尔街见闻
