英伟达发布Nemotron 3 Nano Omni多模态模型
英伟达周二发布开源多模态模型Nemotron 3 Nano Omni,将视觉、语音和语言能力整合到一个300亿参数的混合专家架构中,无需为视频、音频、图像和文本分别部署感知模型。该模型可为AI智能体提供跨模态推理能力,效率最高提升9倍,适用于计算机操作代理、文档智能分析和音视频理解等场景。
此举也是英伟达在GPU硬件优势基础上向模型和服务层延伸的战略布局,尤其在谷歌、微软、AWS等大客户加速自研芯片的背景下。
来源:AI Business

