法国人工智能公司 Mistral 于 10 月 6 日发布代号“le Chonk”的 Mistral Large 4,参数规模达 1 万亿。公司称它是中国以外开发者推出的最强开源权重模型,且领先幅度明显。据 Slashdot 援引 CNBC 报道,该模型先面向开发者、网络安全团队和政府开放预览,本月晚些时候再扩大发布范围。

Mistral 在一份声明中称,ML4 在其位于欧洲的自有数据中心内,使用 4000 块英伟达 Grace Blackwell GPU 训练了两个月。核心参数发布后,该模型在全球开源权重模型的综合基准性能排名中将位居前列。

公司同时表示,ML4 在编程等领域仍落后于前沿模型。Mistral 联合创始人兼首席科学家 Guillaume Lample 说,随着公司扩大训练能力,模型能力将进一步提升,这一进程与公司的 D 轮融资相衔接。他还表示,该模型的网络防御能力将使企业和政府能够抵御那些通过越狱闭源模型发动网络攻击的威胁行为者。

Mistral 没有披露核心参数的具体发布时间,也没有给出与其他开源权重模型的逐项对比数据。其声明把 ML4 定位在开放权重模型的国际竞争之中,强调它相对中国以外同行的领先幅度。

在 Slashdot 页面列出的相关阅读中,该公司首席执行官曾表示,美国围绕人工智能安全的辩论掩盖了竞争对手的“疏忽”。