TAG:Nemotron
英伟达发布统一音频智能模型 Nemotron-Labs-Audex-30B-A3B
英伟达推出Nemotron-Labs-Audex-30B-A3B(简称Audex)统一音频-文本大语言模型。该模型基于MoE架构,通过单一Transformer解码器实现文本与量化音频token的统一处理,成功解决音频增强常牺牲文本能力的难题。在音频理解、语音识别、翻译和生成等任务上达到领先水平的同时,几乎完美保留了原LLM的推理、对齐、知识和长文本能力。作为开源成熟方案,为多模态AI开发者提供平衡性能的新选择。
英伟达开源双塔AI模型,文本生成速度提升2.42倍,画质保留98.7%
英伟达7月2日开源Nemotron-Labs-TwoTower双塔离散扩散语言模型。该60B参数模型采用创新双塔架构(上下文塔冻结+去噪塔并行扩散生成),突破传统LLM逐Token生成瓶颈,实现文本生成速度提升2.42倍,同时综合能力保留98.7%。基于Nemotron预训练权重改造,开发成本低,已在Hugging Face开放权重,支持商用部署。
英伟达发布Nemotron-Labs-TwoTower扩散语言模型 性能提升超两倍
英伟达正式开源Nemotron-Labs-TwoTower扩散语言模型,采用创新双塔架构(冻结上下文塔+去噪器塔),在保持98.7%生成质量的前提下,实现生成吞吐量2.42倍提升。该模型支持扩散、模拟AR和标准AR三种解码模式,完全开源支持商业用途,为大规模文本合成与大模型推理加速提供高效新方案。
英伟达推出新一代多模态模型,智能体效率提升九倍
英伟达发布开放式多模态模型 Nemotron 3 Nano Omni,将视频、音频、图像与文本推理整合到统一系统中,凭借混合专家架构实现最高9倍吞吐提升,并在文档解析、视频理解等任务中表现领先,展现出智能体应用的广阔前景。
英伟达发布多模态全能模型,称智能体效率提升至竞品9倍
英伟达发布开放式多模态模型Nemotron 3 Nano Omni,可整合视频、音频、图像与文本推理能力,显著提升智能体响应速度与部署效率。该模型采用混合专家架构,号称吞吐量达同类竞品9倍,并在复杂文档、视频和音频理解等多项榜单中领先。
英伟达推出Nemotron 3系列开源模型 推理效率提升5倍
英伟达在2026 GTC大会上发布Nemotron 3系列开源模型,凭借Blackwell架构优化,推理效率提升5倍。新模型涵盖多模态交互、物理AI、机器人及医疗科研领域,支持从云端到边缘的快速部署,助力智能体与具身智能发展。