为什么英伟达正努力开发世界上最好的开源AI模型

英伟达正在加倍投入开源努力,投入到一个雄心勃勃的新内部AI模型上,希望这能推动其硬件的需求——但这也可能与客户和合作伙伴竞争。
据多位Nemotron开发人员透露,英伟达的目标是这款新型号——Nemotron 4家族中最大的一个——在性能上与全球最优秀的开源AI模型相当。
详述英伟达上一款大型模型的研究论文有570位作者,员工表示Nemotron 4将涉及更多人。“现在大家都只想参与其中,”一位前员工说。
这项工作建立在英伟达近期一系列开源发布的基础上。周二,英伟达发布了Nemotron 3.5 Lightning,这是一款更小的型号,据称旨在尽可能快速高效地运行AI代理。
公司还发布了免费的模型路由软件,帮助公司更轻松地制作自己的模型路由器——这些工具可以将特定AI任务引导到最适合、最便宜的模型。
多名参与Nemotron项目的员工表示,他们预计最大的Nemotron 4模型至少会有一万亿个参数——模型中随着学习而调整的数字。这大约是英伟达目前最大型号Nemotron 3 Ultra(六月发布)的两倍。
一万亿参数仍远小于领先的中国开源模型,但英伟达同样高度重视压缩技术,使小型模型能够超越性能。
作为英伟达开源承诺的一个标志,它大幅增加了用于训练自身模型的计算投入。英伟达通过从部分云运营商那里租回AI服务器来获得计算能力。
截至4月,该组织已将此类多年云服务承诺价值提升至2031年初的280亿美元,约为一年前报告金额的三倍。部分云计算也用于其他研发工作。
加速推进Nemotron使英伟达处于一个微妙的位置,实际上要与其投资的一批开源初创企业以及英伟达最大客户的大型人工智能实验室竞争。
OpenAI尤其是Nvidia芯片需求的主要推动力之一,英伟达在人工智能实验室投资了300亿美元。
虽然顶级Nemotron 4型号预计不会像OpenAI和Anthropic的前沿模型那样强大,但这类开源模型正逐渐被企业认可,作为部分工作的低成本替代方案。
英伟达还向美国开源公司投入了大量资金,这些公司希望让公司使用自家模型,包括反射人工智能以及思考机器实验室。
据与十几位现任和前任员工、英伟达合作伙伴及Nemotron用户的交流,英伟达正在加大开源工作力度,因为多样化的开放型号将推动对其芯片的更多需求。
英伟达目前的需求很大程度上来自少数前沿实验室和云运营商,如OpenAI、Microsoft和SpaceX,其中一些正在开发自己的AI芯片。
人们认为,如果从初创企业到大型传统企业,更多公司能够通过英伟达为其硬件优化的高质量、相对低成本模型来使用和构建人工智能,或者其努力推动其他开源模型更快开发,英伟达将受益。
“无论哪家公司做出优秀的开源产品,英伟达都会赢,”Arena首席执行官Anastasios Angelopoulos说,该公司负责评估和基准AI模型。
激发更多开源竞争
一位英伟达高管表示,英伟达认为其模型开发将激发竞争,带来更多开放模型开发,从而增加GPU需求。该公司将几家美国开源开发者纳入一个提供训练数据和想法的公司网络,作为其所谓“Nemotron联盟”的一部分,致力于开发新模型。
英伟达生成式人工智能副总裁Kari Briski在一封电子邮件中表示:“英伟达投资Nemotron,因为我们相信每家公司和每个国家都需要可访问的前沿开放模型,以加强安全性、加速创新,并为他们提供一代代可靠的基础。”
Nemotron 4的上映时间尚不明确。多位员工表示,英伟达已就大型Nemotron 4型号的预训练数据和架构做出了一些决定,但尚未确定具体规格或发布日期。
它还没有进行最后的训练运行,可能需要数月时间。两名员工表示模型可能在今年秋末完成,另一些则可能晚些时候。
英伟达长期以来一直在开发自己的AI模型,以更好地指导其硬件设计。两名员工表示,去年初,公司意识到美国开源模型远远落后于中国领先同行,鉴于美国国家利益,并希望帮助弥合差距,因为这对英伟达有利。
英伟达应用深度学习研究副总裁布莱恩·卡坦扎罗表示在播客中今年一月,投资Nemotron“对我们公司的未来至关重要”。
随着中国模型日益强大,开源人工智能已成为地缘政治的焦点激烈争论在美国,可能涉及监管行动。英伟达首席执行官黄仁森(Jensen Huang)在上个月的一封邮件中大声支持开源,称开放模型“促进安全、网络安全、科学进步和国家安全”。
英伟达的型号已被部分公司采用,尤其是Palantir,后者在六月宣布与该芯片公司合作,将Nemotron型号用于美国政府客户。
但这些车型的性能远远落后于行业前列。Nemotron 3 Ultra 是英伟达迄今为止最大的型号,在美国开放模型中,在 Arena 和 Artificial Analysis 的多项智能性能基准测试中排名第二,仅次于 Thinking Machines 刚刚发布的 Inkling。
这远远落后于中国顶级公开模特,整体排名也不在前40名模特之列。
即使是英伟达,考虑到其财务上的其他需求,在模型开发上的投入也有极限。英伟达在2028年1月结束的财年,云服务承诺金额达70亿美元。
虽然这与OpenAI和Anthropic的投入相比微不足道,但这一金额仍超过大多数美国和中国领先的开源实验室在其有生之年所筹集的资金。一位员工表示,Nvidia正试图为Nemotron提供更多计算能力。
Neomotron联盟旗下的公司——包括Reflection、Cursor、Thinking Machines和Mistral——也在为Nemotron 4贡献训练数据、评估帮助和模型设计理念,同时他们也在开发自己的开源项目。
一位直接参与合作的人士表示,初创公司Prime Intellect帮助客户训练、微调和运行自己的开放式AI模型,贡献了30万个模拟环境以辅助模型训练。
据一位直接了解会谈的人士透露,人工智能编码工具初创公司Cognition是联盟成员,其参与情况尚未公布,曾讨论向英伟达提供编码数据用于训练。
合作伙伴有各种参与的激励。对于那些正在开发自己模型的玩家来说,英伟达的推动可能会扩大对开源的兴趣,从而帮助构建市场。还有人希望影响开发出一个他们可以使用且无需支付训练计算费用的模型。
Prime Intellect首席执行官文森特·韦瑟认为,这个联盟是为了联合起来反对“唯一的”上帝“模式,而不是一场谁能做出最佳开放模型的游戏。