开云上术设计英伟达发布80亿参数新AI模型:精度、效率高可在RTX工作站上部署

 

  上术设计上术设计上术设计IT之家 8 月 23 日消息,英伟达于 8 月 21 日发布博文,发布了 Mistral-NeMo-Minitron 8B 小语言 AI 模型,具备精度高、计算效率高等优点,可在 GPU 加速的数据中心、云和工作站上运行模型。

  剪枝通过去除对准确率贡献最小的模型权重来缩小神经网络。在 蒸馏 过程中开云上术设计,研究小组在一个小型数据集上重新训练剪枝后的模型开云上术设计,以显著提高通过剪枝过程而降低的准确率。

  就其规模而言,Mistral-NeMo-Minitron 8B 在语言模型的九项流行基准测试中遥遥领先。这些基准涵盖了各种任务,包括语言理解、常识推理、数学推理、总结、编码和生成真实答案的能力。IT之家附上相关测试结果如下:

搜索