Magistral 是什么?谁在什么时候发布的?

2025 年 6 月 10 日,Mistral AI 发布了 Magistral,这是他们第一个专门用来“推理”的模型。推理模型就像一位数学老师,不仅告诉你答案,还会把每一步怎么想的都写在黑板上,让你能跟着检查。Magistral 有两个版本:Magistral Small 是 24B 参数的开源权重模型,采用 Apache 2.0 许可,可以自己下载部署;Magistral Medium 是企业版,通过 Le Chat、API 和云平台提供服务。官方未说明 Medium 的具体参数量和训练数据细节。

Magistral 的设计目标是让思考过程透明、可验证,并且能用多种语言推理。它不像普通模型那样直接给答案,而是先展示推理步骤,再给出结论。这种“把思考过程写出来”的方式,让它在法律、金融、医疗等需要审计的场景中特别有用。

为什么需要推理模型?它和普通模型有什么不同?

普通语言模型像是一个知识渊博但说话很快的朋友,你问什么它马上回答,但有时会跳过关键步骤。推理模型则像一位谨慎的侦探,会把线索一条条摆出来,逐步推导,最后才下结论。Magistral 专门针对多步逻辑进行了微调,能处理需要精确、逐步分析的问题,比如复杂的计算、程序逻辑、决策树和规则系统。

官方原文指出,早期推理模型存在三个不足:缺乏领域深度、透明度有限、推理语言不一致。Magistral 试图解决这些问题,它支持英语、法语、西班牙语、德语、意大利语、阿拉伯语、俄语和简体中文等多种语言,并且推理过程保持高保真度。

Magistral 的两个版本分别是什么?怎么获取?

Magistral Small 是 24B 参数的开源权重模型,采用 Apache 2.0 许可,可以从 Hugging Face 下载并自行部署。这就像一份公开的菜谱,任何人都可以照着做菜,也可以修改配方。Magistral Medium 是更强大的企业版,目前以预览版形式在 Le Chat 和 La Plateforme API 上提供,同时也可在 Amazon SageMaker 上使用,官方表示即将登陆 IBM WatsonX、Azure AI 和 Google Cloud Marketplace。

对于企业定制方案,包括本地部署,需要联系 Mistral AI 的销售团队。官方未说明 Medium 的定价和具体硬件要求。Small 的下载地址是 Hugging Face 上的 mistralai/Magistral-Small-2506。

Magistral 的推理能力有多强?成绩如何?

官方公布了在 AIME2024 数学竞赛上的成绩:Magistral Medium 得分 73.6%,使用多数投票 @64 后达到 90%;Magistral Small 得分 70.7%,多数投票 @64 后为 83.3%。多数投票就像让模型做 64 次题,然后选最常出现的答案,能提高准确率。这些成绩说明 Magistral 在需要精确推理的任务上表现不错。

在 Le Chat 中,Magistral Medium 配合 Flash Answers 模式,令牌吞吐速度可达大多数竞争对手的 10 倍,能实现实时推理和用户反馈。官方未说明 Small 的推理速度数据。

Magistral 适合哪些人使用?能做什么?

Magistral 适合需要长思考、高准确率的场景。比如法律研究、金融预测、软件开发、创意写作等。在企业中,它可用于研究、战略规划、运营优化和数据驱动决策,例如风险评估、多因素建模、在约束条件下计算最优配送窗口。在受监管行业如法律、金融、医疗和政府,它的可追溯推理能满足合规要求,每个结论都能回溯逻辑步骤。

在编程和开发方面,Magistral 能改进项目规划、后端架构、前端设计和数据工程,通过多步操作调用外部工具或 API。早期测试还表明它适合创意写作和讲故事,能生成连贯甚至古怪有趣的文案。对于小学生和初中生来说,可以把它想象成一个会写解题步骤的智能助手,帮你检查作业思路。

Magistral 有哪些限制和不确定的地方?

官方原文没有说明 Magistral Medium 的具体参数量、训练数据来源、完整基准测试结果、定价信息、开源协议的具体限制、企业版部署的硬件要求,以及 Magistral Small 的上下文长度和推理速度数据。此外,Medium 目前是预览版,功能可能还会变化。Small 虽然开源,但 24B 参数模型需要一定的计算资源才能运行。

推理模型虽然能展示思考过程,但思考过程本身也可能出错,用户仍需自行核验结论。官方表示会快速迭代模型,期待持续改进。对于需要审计的场景,建议结合人工复核。

如何核验 Magistral 的信息?

可以访问 Mistral AI 官网的新闻页面查看原始公告,下载 Magistral Small 的模型卡和论文,了解训练基础设施、强化学习算法和评估细节。在 Le Chat 中试用 Magistral Medium 预览版,观察其推理步骤是否透明、是否支持中文。对于企业用户,可以联系销售团队获取定制方案和合规信息。

注意区分官方信息和第三方评测。官方未说明的事项,如定价和硬件要求,不要猜测。Magistral 是 Mistral AI 的第一个推理模型,后续版本可能会带来更多功能和改进。

官方来源

本文由 AIGCWHY 自动监测系统发现,经结构化处理后发布。重要决策请打开原文核验。

查看原始发布信息 ↗