当地时间 10 月 6 日,法国 AI 公司 Mistral AI 推出新一代旗舰模型 Mistral Large 4 的公开预览版,简称 ML4,代号 le Chonk。即日起,开发者可通过 Mistral Studio 调用预览版 API,官方计划在本月底开放模型权重下载。作为 Mistral 面向开源生态推出的最新旗舰,ML4 被其描述为欧美开放权重模型中的最强者。
万亿参数与原生多模态
从规格来看,ML4 拥有 1 万亿总参数,激活参数为 490 亿,定位为原生多模态模型。Mistral 称,该模型在实际测试中的表现足以媲美全球顶尖开源模型,并显著领先于欧美现有开放权重模型。官方强调,在网络安全、金融与法律等企业级任务中,ML4 已达到开源模型中的 SOTA 水平。
- 总参数规模:1 万亿
- 激活参数:490 亿
- 能力方向:原生多模态
- 官方口径:欧美开放权重模型中表现最强
在部分细分领域,例如视觉定位,Mistral 表示 ML4 的表现甚至超过当前前沿闭源模型。这一说法目前仍来自官方表述,实际效果还需等待权重开放后由社区进一步验证。
欧洲自建算力训练,强调合规与独立运营
ML4 的训练过程同样被 Mistral 作为重点叙事之一。该模型在 Mistral 位于欧洲的自建数据中心中完成训练,使用 3,800 块英伟达 Grace Blackwell GPU。官方强调,这一部署方案由 Mistral 端到端独立运营,不依赖其他第三方数字服务提供商,并严格遵循欧盟法律法规。
训练数据方面,ML4 覆盖超过 160 种自然语言,包括欧盟全部官方语言。这意味着其多语言能力被放在相当高的优先级,也符合 Mistral 长期面向欧洲市场和企业级场景的产品路线。
预览版 API 已开放,红队测试同步进行
在发布节奏上,Mistral 采取了“先 API 预览、后开放权重”的方式。用户目前可在 Mistral Studio 上体验 ML4 预览版 API,模型权重则将在本月底正式开放下载。
与此同时,官方正在联合网络安全机构、可信合作伙伴以及政府监管部门,在真实业务环境中进行红队测试。参与测试的合作方将获得专项访问权限,该测试版本适当放宽了内容安全审查策略,并强化了网络安全攻防技术能力。这一安排显示出,Mistral 在开放模型能力的同时,也试图将安全评估前置到真实场景中。
价格方面,ML4 的 API 定价为每百万 tokens 输入 1.36 美元,输出 4.18 美元。对于一家欧洲模型公司而言,这一价格带也释放出其希望直接进入企业级应用市场的信号。
对开源生态的意义
ML4 的发布,正值开放权重模型竞争进入高密度阶段。Mistral 用“欧美最强开源模型”来定义这款产品,显然是希望在现有开源模型格局中建立新的旗舰坐标。其意义并不只在于参数规模,而在于 Mistral 试图同时证明三件事:欧洲团队可以训练顶级大模型,开放权重路线可以承载企业级复杂任务,本土算力与合规框架也能支撑前沿模型研发。
如果月底权重开放后,社区评测能够接近官方口径,ML4 很可能成为下一轮开源模型竞争中的重要参照物。尤其当模型同时具备多模态、多语言和企业级任务能力时,它对开源生态的影响将不只是多一个可下载模型,而是为开发者提供更多可替代闭源方案的实际选项。
原创文章,作者:点点,如若转载,请注明出处:https://www.dian8dian.com/mistral-large-4-yu-lan-ban-shang-xian-wan-yi-can-shu-kai