Mistral Large 4 发布:1T 参数多模态模型,瞄准中美头部闭源与开源阵营

Mistral 发布 1T 参数多模态模型 Mistral Large 4,试图在闭源与中国开源模型之外,为企业提供欧洲版替代方案。

欧洲 AI 新叙事:不做闭源与开源的单选题

Mistral AI 发布了新一代大模型 Mistral Large 4。按照公司给出的说法,这款模型拥有 1 万亿参数,并具备多模态能力,目标是在性能与定位上同时追赶美国与中国市场的头部模型。法国总统马克龙曾将法国在 AI 领域的路线描述为“第三条道路”,而 Mistral 此次发布也被放进了这一背景之中:在闭源模型可能被随时“断电”、开源模型又多由中国团队主导的市场环境下,Mistral 试图提供一个介于两者之间的选择。

Mistral Large 4 内部被昵称为“Le Chonk”,用以强调其 1 万亿参数规模。但它并非一开始就完全开放。目前,模型只能通过一个带有安全护栏的公开端点访问。Mistral 表示,在安全测试完成后,计划在约三周时间内开放模型权重。

先受控开放,再放出权重

Mistral 科学副总裁 Pierre Stock 对 TechCrunch 表示,在权重正式发布前,公司将与可信合作伙伴和政府部门合作,确保开源权重能够用于防御场景,而不是被用于恶意攻击。

这一安排与 Mistral 当前客户结构有关。近年来,安全担忧持续上升,而企业和公共机构正是 Mistral 的核心用户群体。与此同时,Stock 也提到,开放权重模型在可审计性方面具有优势,这也是 Mistral 试图在企业市场与政府客户中建立信任的一部分。

从发布节奏看,Mistral 并没有选择一步到位地开放所有能力,而是先以受控端点形式上线,再逐步过渡到权重开放。这种节奏既保留了开源叙事,也为安全审查和企业合规留出了空间。

4,000 块 NVIDIA GPU 训练,强调算力效率

Mistral 在发布中还特别强调了训练效率。据 Stock 介绍,Mistral Large 4 完全基于 Mistral 自有算力训练,使用了 4,000 块 NVIDIA GPU。他表示,这一规模比中国竞争对手少两到三倍,也明显少于闭源竞争对手。

由于基准测试结果尚未公布,Mistral 暂未给出完整性能数据。但公司预期,ML4 将有机会成为开放权重模型中的第一梯队,尤其是在中国市场之外。Stock 还提到,得益于更有针对性的训练,ML4 也可能在客户最关注的特定领域超过部分闭源模型,尤其是在多模态能力能够带来实际价值的场景中。

瞄准网络安全、金融与芯片设计

Mistral 列举了 ML4 的几个重点优化方向:

  • 网络安全
  • 金融
  • 芯片设计

其中,芯片设计被单独强调,与 Mistral 的投资方构成有关。荷兰半导体设备巨头 ASML 领投了 Mistral 的 Series C,三星则在上月领投了公司 Series D 融资,当时估值达到 210 亿欧元,约合 243.9 亿美元。芯片设计能力与这些产业资本的业务方向高度相关,也为 Mistral 在企业级和专业市场中的落地提供了更具体的叙事。

此前,Mistral 曾因托管中国模型而面临外界疑问:公司是否会从前沿模型研发者转向单纯的推理服务提供商。此次发布 Mistral Large 4,也被公司视为回应:在拥有“Le Chonk”之后,Mistral 仍应被视为一家前沿实验室。

原创文章,作者:点点,如若转载,请注明出处:https://www.dian8dian.com/mistral-large-4-fa-bu-1t-can-shu-duo-mo-tai-mo-xing-miao

Like (0)
点点的头像点点
Previous 20小时前
Next 16小时前

相关推荐