英伟达发布80亿参数新AI模型：精度、效率高，可在RTX工作站上部署

2024-08-23 13:32:13 浏览：293 作者：管理员

英伟达于 8 月 21 日发布博文，发布了 Mistral-NeMo-Minitron 8B 小语言 AI 模型，具备精度高、计算效率高等优点，可在 GPU 加速的数据中心、云和工作站上运行模型。

英伟达携手 Mistral AI 上月发布开源 Mistral NeMo 12B 模型，在此基础上英伟达再次推出更小的 Mistral-NeMo-Minitron 8B 模型，共 80 亿个参数，可以在搭载英伟达 RTX 显卡的工作站上运行。

英伟达表示通过宽度剪枝（width-pruning）Mistral NeMo 12B，并知识蒸馏（knowledge distillation）轻度重新训练后获得 Mistral-NeMo-Minitron 8B，相关成果发表在《Compact Language Models via Pruning and Knowledge Distillation》论文中。

剪枝通过去除对准确率贡献最小的模型权重来缩小神经网络。在 "蒸馏" 过程中，研究小组在一个小型数据集上重新训练剪枝后的模型，以显著提高通过剪枝过程而降低的准确率。

就其规模而言，Mistral-NeMo-Minitron 8B 在语言模型的九项流行基准测试中遥遥领先。这些基准涵盖了各种任务，包括语言理解、常识推理、数学推理、总结、编码和生成真实答案的能力。IT之家附上相关测试结果如下：

Prev Chapter：文生图AI工具Midjourney开放网页版，新用户附赠25张免费试用额度

Next Chapter：AI正污染我们的世界

评论区

共 0 条评论

这篇文章还没有收到评论，赶紧来抢沙发吧~

英伟达发布80亿参数新AI模型：精度、效率高，可在RTX工作站上部署_tiknovel-最新最全的nft,web3,AI技术资讯技术社区

英伟达发布80亿参数新AI模型：精度、效率高，可在RTX工作站上部署

评论区

【随机内容】