新的人工智能模型即将到来,而且还会不断出现。
继最近推出 OpenAI 的 Claude Opus 5.5、GPT-6 Sol 和 GPT-6 Luna 后,Mistral AI 又推出了新的旗舰型号, 大型米斯塔拉4号,周二提供公开预览。
Mistral AI 是一家以开源和开放权重法学硕士而闻名的法国公司,该公司指出,Large 4 模型在综合指标上“跻身世界上最好的开放权重模型之列”,并且也优于欧洲和美国模型,同时也赶上了一直在开放权重领域占据主导地位的中国竞争对手。
我与 Mistral 的首席科学家 Guillaume Lampel 和科学副总裁 Pierre Stock 讨论了新模型(称为“le Chonk”)的专业功能和极高的计算效率。这是你应该知道的。
Mistral Large 4的主要能力
Lampel 和 Stock 表示,Mistral Large 4 旨在处理文本和图像,填补了之前 Mistral 型号的性能差距。具体来说,Large 4 拥有更先进的网络安全和代理能力,以及更好的处理制造和财务相关任务的能力。
网络安全
Mistral Large 4 旨在擅长执行防御性网络安全任务,包括日志扫描、代码审核以及检查新发布的漏洞或漏洞。米斯特拉尔表示,除了防御措施之外,新模型还提供进攻性网络安全措施来识别和解决漏洞。
国际特赦组织代理人
“我们在 ML4 中真正关注的核心能力是代理能力,”斯托克说。
Mistral Large 4 的设计重点是代理性能,以规划、研究或处理复杂的企业任务,否则这些任务需要人类专家花费数小时或数天才能完成。 Mistral AI 团队表示,该模型在重要的代理基准测试中达到了“最先进”的性能,例如 SWE-bench 和 Terminal Bench(用于测试代理处理复杂任务的评估框架),适用于编码、解析和拉取请求等任务。
地理空间和接地能力
米斯特拉尔团队表示,该模型在分析航空和卫星图像方面优于竞争对手,能够识别地图上的视觉模式和物体,例如森林火灾。
“就接地能力而言,它优于所有现有型号,包括封闭式型号,”该型号的新闻稿称。 “随着网络攻击变得更快、更便宜,公司编写的代码比以往任何时候都多,世界需要更多的芯片来满足人工智能的需求,这些都至关重要。”
扎根是人工智能开发中使用的一种技术,旨在通过将人工智能的输出扎根于外部资源(例如文档和数据库),而不仅仅是内部训练的材料,从而消除幻觉(当法学硕士生成不准确的信息时)。接地还有助于保持数据和信息最新,同时为人工智能响应提供背景。
Mistral 表示,新模型还接受了 160 多种语言的培训,包括所有欧盟官方语言以及拉丁语和非拉丁语,以响应当地的提示。
Mistral 将于 10 月 27 日推出 ML4。在此之前,该模型将提供公开预览期,以便 Mistral 团队能够根据开发人员、网络安全专家和州官员的反馈继续对其进行评估。团队还将利用这段时间进行进一步的强化学习和微调。你可以 在这里尝试预览 API。










