Mistral AI 发布首个推理模型 Magistral
Mistral AI 发布首个推理模型 Magistral,分为 24B 开源版 Magistral Small 和企业版 Magistral Medium。
推荐理由:官方在这次双版本发布里同时给出AIME2024成绩和Le Chat最高可达10倍的生成速度,便于判断透明多语言推理能否进入法律金融等专业流程。
新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
Mistral AI 发布首个推理模型 Magistral,分为 24B 开源版 Magistral Small 和企业版 Magistral Medium。
推荐理由:官方在这次双版本发布里同时给出AIME2024成绩和Le Chat最高可达10倍的生成速度,便于判断透明多语言推理能否进入法律金融等专业流程。
Mistral 发布其首个代码专用嵌入模型 Codestral Embed,称其在真实代码数据检索上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大嵌入模型。
推荐理由:这篇模型发布把 Codestral Embed 的检索质量、输出维度和精度选择放在一起说明,便于对照 Voyage Code 3、Cohere Embed v4.0 与 OpenAI 大嵌入模型看存储成本取舍。
Mistral AI 联合 All Hands AI 发布编程智能体模型 Devstral,在 SWE-Bench Verified 取得 46.8%,高出此前开源模型逾 6 个百分点。
推荐理由:把 Devstral 在 SWE-Bench Verified 上的 46.8% 与同测试框架下更大的开源模型对照,可以看出轻量智能体编码模型的成绩差距和单机部署门槛。
Mistral AI 发布 Mistral Medium 3,主打 SOTA 性能、8X 更低成本和更简单的部署,并称其在各项基准上达到 Claude Sonnet 3.7 至少 90% 的表现,API 价格为输入 $0.4、输出 $2 per M token。
推荐理由:读者可据此对照 Mistral Medium 3 相对 Claude Sonnet 3.7 至少九成的基准表现、每百万 token 输入与输出价格,以及四张 GPU 起即可自托管的企业部署条件。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本表现与多模态理解,上下文窗口扩至 128k tokens,推理速度为每秒 150 tokens,并称其超过 Gemma 3 和 GPT-4o Mini。
推荐理由:官方发布的 Mistral Small 3.1 在同权重级别提升文本表现、多模态理解与最长 128k 的上下文窗口,并给出每秒 150 tokens 的推理速度以及单张 RTX 4090 或 32GB 内存 Mac 的本地运行条件。