IT之家 12-03
Mistral AI推出Mistral 3模型:3B到675B,Apache 2.0开源
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

IT 之家 12 月 3 日消息,法国人工智能初创企业 Mistral AI 当地时间 2 日宣布推出其新一代 Mistral 3 系列模型,包括其采用稀疏架构的首款混合专家模型 Mistral Large 和三款小型密集模型。

Mistral Large 总参数量为 675B,活跃参数规模为 41B;Minstral 3" 三兄弟 " 的参数规模分别为 14B、8B、3B。这些模型及衍生版本均以 Apache 2.0 许可证开源

Mistral AI 表示,使用 3000 块英伟达 H200 GPU 从头训练的 Mistral Large 3 是全球顶尖的开放权重模型之一

在经过后训练后,该模型在通用提示方面与市场上最佳的指令微调开放权重模型达到了同等水平,同时在多语言对话方面展示了图像理解和行业顶尖性能。Mistral Large 3 在 LMArena 排行榜的 OSS 非推理模型类别中位列第二,OSS 总榜第六。

对于参数较小的 Minstral 3,Mistral AI 称其实现了所有 OSS 模型中最佳的性价比,这些模型的指令变体在性能上与同类模型相当或更优,同时生成的 token 数量通常降低了一个数量级

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

开源 法国 英伟达 人工智能 it之家
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论