英伟达开发新一代开源模型Nemotron 4,参数达1万亿

https://assets.wanlianyida.com/industry-uniapp/web/static/image-default.BtYt8t8Z.png
产联社海外
·阅读量:1,319

摘要:新模型目标成为全球性能最强开放模型之一,以扩大企业AI采用并拉动GPU需求.

产联社编译

fcC8OHusi.jpeg

8月11日,据The Information报道,英伟达正在开发新一代开源AI模型Nemotron 4,希望将其打造为全球性能最强的开放模型之一,以扩大企业对开源AI的采用,并进一步刺激对英伟达GPU的需求。

多名参与项目的员工表示,Nemotron 4系列最大模型预计至少拥有1万亿参数,约为英伟达6月发布的Nemotron 3 Ultra的两倍。公司尚未最终确定模型规格和发布日期,最终训练也尚未完成,两名员工称其最快可能在今年深秋准备就绪。

为支持模型研发,英伟达正增加训练算力投入,并从部分购买其芯片的云服务商处回租AI服务器。截至今年4月,公司多年期云服务承诺总额已增至280亿美元,有效期至2031年初,约为一年前的3倍,其中部分算力用于Nemotron等研发项目。

英伟达希望通过开放模型扩大AI应用群体。公司认为,如果初创企业及传统企业能够使用针对其硬件优化、成本较低的高质量模型开发AI应用,将进一步带动GPU需求。目前英伟达AI芯片需求主要集中于OpenAI、微软和SpaceX等少数大型客户,而部分客户也在开发自研芯片。

不过,Nemotron扩张也使英伟达与部分客户和被投企业形成潜在竞争。公司已投资OpenAI、Reflection AI和Thinking Machines Lab等企业,其中部分也在开发开放模型。英伟达表示,其目标并非打造单一模型垄断市场,而是推动开放模型生态发展。

英伟达还组建“Nemotron联盟”,Reflection、Cursor、Thinking Machines、Mistral等企业参与提供训练数据、评估支持和模型设计思路。据悉,初创公司 Prime Intellect(致力于帮助客户训练、微调和运行其自有开源 AI 模型)贡献了 30 万个模拟环境,以协助模型训练。

商务合作/报料请联系微信号:18801065284

特别声明:产联社摘录或转载的属于第三方的信息,目的在于传递更多信息而非盈利,同时并不代表赞成其观点或证实其描述,内容仅供参考。转载信息版权归原媒体及作者所有,若有侵权,请联系我们删除。如其他媒体、网站或个人擅自转载使用,请自负版权等法律责任。

20
7
分享
上一篇 下一篇