Nvidia 推出 NVLM,其最强大的 AI 和新的 OpenAI 竞争对手

新的AI NVLM模型是什么样的?

英伟达凭借其尖端硬件在人工智能领域大力扩张,如今又携NVLM进军软件领域。NVLM将提供开源的LLM,支持多模态模型(图像、文本),从而与GPT-4o和Llama展开竞争。

英伟达凭借其用于集中处理数据的GPU在人工智能硬件领域占据主导地位,其中H100和B200型号最具代表性。但随着NVLM的推出,大型语言模型(LLM)领域迎来了一位新的竞争者。英伟达的这款产品旨在与OpenAI及其GPT-4°等其他模型展开竞争。然而,该领域也存在其他竞争对手,例如谷歌的Gemini、Meta的Llama以及Anhtropic的Claude 3.5。

Nvidia 的 NVLM 提出了什么彻底改变 AI 世界的建议?

英伟达的NVLM 1.0是人工智能大型语言模型领域最新的竞争者。开发人员发布了一份研究报告,详细介绍了这项新产品的工作原理及其功能,旨在进军人工智能软件领域。

简而言之,NVLM 是一个完整的多模式法学硕士系列,根据 Nvidia 的说法,它们在视觉和语言方面取得了显着的成果。该研究表明其分析和开发能力与其他已经流行的模型(例如 GPT-4o)非常相似。

NVLM 拥有一个参数量高达 720 亿的模型,这是迄今为止参数量最大、性能最强的模型。据英伟达称,其性能和响应速度优于 Llama 3 405B,而根据性能测试,Llama 3 405B 的参数量要大得多。

Nvidia 提议的另一个优点是 NVLM 提供了开放权重的开源 AI 模型。相关负责人承诺发布用于训练模型的代码,这是非常有用的。开发人员将能够在自己的项目和分支中使用它。

NVLM将为AI世界提供什么?

使用 NVLM,您可以分析视觉和文本输入。这转化为人工智能解释模因和分析照片的能力。另外,你还可以使用Nvidia创建的这个语言模型来一步步解决数学问题。

该系统的运行融合了光学字符识别(OCR)、本地化、常识、世界知识和编程能力。所有这些功能的结合使NVLM能够灵活应对各种不同的请求和情况。探索这一新型人工智能语言模型的应用范围,并将其性能与该领域其他产品进行比较,有助于我们了解这项技术的未来发展方向。

关于锻炼前

NVLM的开发者采用了一种改进的架构来训练和推理模型。它的功能非常全面,能够处理72.000亿个参数,足以与GPT-4、Llama 3-V-70B和Gemini 1.5 Pro相媲美。目前,它在解决数学问题、图像处理和文本处理方面表现最为出色。

用于预训练和训练的信息是经过精心挑选、微调和人工监督的。这项工作旨在验证数据集的质量以及兼容和扩展任务的多样性,包括在预学习阶段。

英伟达开发的强大算法及其训练模型和参数均已开源。用户可以免费使用和修改这些资源,这些资源通过英伟达的开发库 Megatron-Core 分发。

这在业内具有里程碑式的意义,因为英伟达正在让其他小型机构和独立研究人员更容易地为人工智能的发展做出贡献。该工具及其功能的开放获取,类似于其他大型科技公司的产品,将标志着该领域控制权争夺战的一个转折点。

通过这个新的法学硕士,目标是扩大用户和客户群,有利于已经利润丰厚的业务。但现在它将在世界各地增加更多的爱好者和潜在用户。英伟达迈出了出色的一步,除了通过硬件主导人工智能领域外,现在还直接瞄准软件领域。

混合业务战略

英伟达在科技领域和人工智能发展方面的领先地位源于其混合型商业战略。一方面,该公司致力于芯片的研发和生产,并销售支持各种算法运行的先进系统。这加速了营收增长,并赢得了投资者的认可。另一方面,英伟达也在积极研发人工智能算法,以期在与OpenAI、谷歌和Meta等公司相比处于劣势的领域占据一席之地。正是得益于这一战略,英伟达的NVLM(英伟达虚拟逻辑模型)正展现出强大的实力,足以与老牌人工智能巨头展开正面竞争。

英伟达NVLM

借助新的 Nvidia 处理器,用户分析和解决数学问题的速度和能力是引人注目的。 NVLM 1.0 的到来将标志着该行业的一个前前后后,为新参与者提供开源提案以覆盖更多用户和中小型公司提供了可能性。

既然Nvidia凭借NVLM进入了AI市场,那么现在的AI市场会是什么样的情况呢?

此前,英伟达一直为各类数据中心和运行人工智能模型的服务器提供最强大的处理器和GPU。但NVLM标志着英伟达正式进军人工智能领域,这可能会引发一些竞争。NVLM的开源特性及其强大的处理能力使其成为极具吸引力的语言模型。它将如何被广泛采用,以及用户社区将开发哪些应用来充分发挥其潜力,还有待观察。随着英伟达的加入,我们很可能会开始听到人工智能领域出现重大进展的消息。


在 Google 中将其添加为首选来源