英伟达正面硬刚全球开源模型!万亿参数Nemotron 4研发曝光

1 小时前6.3k
预计最早今年秋季推出

不满足于卖芯片,英伟达正秘密研发新一代开源大模型。

The Information报道,多名项目员工透露,英伟达正在筹备开源模型阵营的旗舰之作Nemotron 4,参数量高达万亿级别,目标是直接对标全球顶尖开源模型。

研发阵容也远超上一代旗舰570名作者的规模。知情人士称,这家芯片巨头正试图打造一款能与"全球最佳开源AI模型"正面较量的产品。

截至发稿,英伟达周二美股上涨0.73%报219.145美元。


万亿参数大模型研发曝光


参与Nemotron项目的几位员工预计,最大的Nemotron 4模型将拥有至少一万亿个参数,规模约为英伟达当前最大模型Nemotron 3 Ultra的两倍,后者于今年6月刚刚发布。

报道同时指出,一万亿参数仍远小于中国领先的开源模型,但英伟达强调其压缩技术能让较小模型同样具备卓越性能。

今年3月,英伟达发起成立由全球领先AI实验室组成的Nemotron联盟,旨在推进开放前沿模型发展,进一步拉动开源生态对芯片的需求。

英伟达生成式人工智能副总裁卡里·布里斯基对此表示,公司投资Nemotron是因为相信每个公司和每个国家都需要易于使用的前沿开放模型,以加强安全保障、加速创新,并提供一个可以代代相传的基础。

目前,Nemotron 4的发布时间未定,预计最早今年秋季推出。

多位员工透露,公司已就Nemotron 4的预训练数据和架构做出部分决定,但尚未敲定具体规格或发布日期,最终训练运行可能还需数月。两名员工称模型最早可能在秋末准备就绪,其他人则表示会更晚。

一名前员工称:“现阶段所有人都想参与进来。”

但这场全员奔赴的背后,英伟达正把自己推向一个微妙的位置——一旦Nemotron 4达标,它将与自己投资的开源初创公司正面竞争,同时还要与购买其芯片的大型AI实验室同台较量。


英伟达推出Nemotron 3.5 Lightning


在秘密研发万亿参数Nemotron 4的同时,英伟达周二先行亮出了一款轻量级开源模型——Nemotron 3.5 Lightning。

这是一款拥有300亿个参数的专家混合模型,专为支持始终在线的智能体而构建,能够处理海量任务,并且可以在笔记本电脑或台式机的单个GPU上运行。

其输出速度较同类提升高达4倍,智能体任务完成速度提升30%,可本地部署于RTX PC、DGX Spark、Jetson等设备,兼顾隐私控制与边缘扩展能力。

与此同时,英伟达还推出了NeMo Switchyard模型路由工具,该技术能根据任务需求自动匹配最合适、最高效的模型。内部基准测试表明,NeMo Switchyard在保持前沿水平精度的同时,将任务完成成本降低到Opus 4.8的近三分之一。

模型之外,英伟达同日抛出一项更重磅的融资计划。公司宣布与Apollo、贝莱德、黑石、博枫、高盛和KKR六大金融机构签署谅解备忘录,计划共同搭建独立算力融资平台,目标是为全球AI基建筹集超过5000亿美元第三方资金,以有竞争力的融资利率直接向英伟达客户提供融资支持。

摩根士丹利测算,若英伟达从GPU使用收益中抽取35%盈余分成,在GPU租赁价格维持每小时13美元、全球每年新增5GW算力的假设下,每年潜在新增营收可达约510亿美元,2029财年每股收益有望增厚约9.83%——这是一条毛利率接近100%的长期经常性收入曲线。

争议随之而来。市场质疑这一架构本质上仍是“循环融资”。黄仁勋亲自出面回应,态度强硬且直接:AI工厂算力正在成为一种可投资的资产类别,需求来自真实的商业场景,每个项目都将由独立机构投资者进行独立尽调,“这绝非外界质疑的循环融资。”

相关股票

US 英伟达

相关主题/热点

格隆汇声明:文中观点均来自原作者,不代表格隆汇观点及立场。特别提醒,投资决策需建立在独立思考之上,本文内容仅供参考,不作为实际操作建议,交易风险自担。

App内直接打开
商务、渠道、广告合作/招聘立即咨询

相关文章

SEA:爆拉背后,电商终于要起跳了?

海豚研究 · 昨天 23:57

cover_pic

VSTAR每日美股行情(11/08/2026)

VSTAR_OFFICIAL · 昨天 22:47

cover_pic

下周股市避雷|指数上涨乏力,解禁潮来袭一定要避开这些个股

骑牛看熊 · 昨天 22:42

cover_pic
我也说两句