NVIDIA豪掷260亿美元推动开源AI模型研发
来源:龙灵发布时间:2026-03-13924浏览
询问 AI据WIRED、VentureBeat综合报道,NVIDIA计划在未来5年内投入260亿美元用于开源人工智能(AI)模型的开发。这一消息得到了NVIDIA AI研究副总裁Bryan Catanzaro的证实。公司正积极推进开源模型的研发,近期已完成一个拥有550亿参数规模的模型预训练。
NVIDIA新一代开源模型Nemotron 3 Super备受关注,其参数规模超过1200亿,采用“三层混合架构”设计,以降低企业AI系统在复杂任务中的成本。Mamba-2层负责处理长序列数据,支持最多100个token上下文;Transformer层用于精准检索关键信息;潜在混合专家(Latent MoE)层通过压缩token并分派至专家模型,提高系统在相同算力下的效率。
NVIDIA企业生成式AI软件副总裁Kari Briski表示,开发大型AI模型不仅有助于推动技术进步,还能帮助NVIDIA优化其运算、存储与网络架构。开源模型允许研究机构和初创企业下载模型权重与架构,进行自主运行与修改。
目前,包括深度求索(DeepSeek)、月之暗面(Moonshot AI)、阿里巴巴、智谱、MiniMax等中国AI企业均已发布开源模型,受到全球开发者的广泛欢迎。据Google前CEO Eric Schmidt、微软及斯坦福大学的研究报告指出,中国开源AI的崛起正在改变全球开发者生态的重心,并引发产业竞争力与地缘政治风险的关注。
在性能测试中,Nemotron 3 Super表现出色。在Artificial Intelligence Index的十项基准测试中获得37分,高于OpenAI的开源模型gpt-oss;在评估控制OpenClaw的PinchBench测试中,更是位列开源模型排行榜首位。
新闻来源:龙灵,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。
