跳到正文
原文
Mistral AI·· 2025-03-17精选AI 评分73

Mistral AI 发布 Mistral Small 3.1,升级文本与多模态并支持 128k 上下文

Mistral Small 3.1

AI 导读

Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本表现与多模态理解,上下文窗口扩至 128k tokens,推理速度为每秒 150 tokens,并称其超过 Gemma 3 和 GPT-4o Mini。

推荐理由

官方发布的 Mistral Small 3.1 在同权重级别提升文本表现、多模态理解与最长 128k 的上下文窗口,并给出每秒 150 tokens 的推理速度以及单张 RTX 4090 或 32GB 内存 Mac 的本地运行条件。

正文 · AI 翻译

今天我们发布 Mistral Small 3.1:同重量级中的最佳模型。

在 Mistral Small 3 的基础上,这一新模型带来了更强的文本性能、多模态理解能力,以及最高达 128k tokens 的扩展上下文窗口。该模型在性能上超越了 Gemma 3 和 GPT-4o Mini 等同类模型,同时实现每秒 150 tokens 的推理速度。

Mistral Small 3.1 以 Apache 2.0 许可证发布。 

Perf Gpqa Diamond Mistral

现代 AI 应用需要多种能力的融合——处理文本、理解多模态输入、支持多种语言以及管理长上下文——同时具备低延迟和成本效益。如下所示,Mistral Small 3.1 是首个不仅达到、而且实际上在所有这些维度上都超越领先小型专有模型性能的开源模型。

下文将提供更多关于模型性能的细节。在可能的情况下,我们展示其他提供方此前报告的数字,否则我们通过统一的评估框架对模型进行评测。

指令性能

文本指令基准测试

多模态指令基准测试

MM-MT-Bench 已缩放至 0 到 100 之间。

多语言

长上下文

预训练性能

我们同时发布 Mistral Small 3.1 的预训练基础模型。

全部预训练

应用场景

Mistral Small 3.1 是一款多功能模型,旨在处理广泛的生成式 AI 任务,包括指令遵循、对话辅助、图像理解和函数调用。它为企业级和消费级 AI 应用提供了坚实基础。

主要特性与能力

  • 轻量:Mistral Small 3.1 可在单张 RTX 4090 或配备 32GB 内存的 Mac 上运行。这使其非常适合端侧应用场景。

  • 快速响应的对话辅助:非常适合虚拟助手以及其他需要快速、准确响应的应用。 

  • 低延迟函数调用:能够在自动化或智能体工作流中快速执行函数

  • 面向专业领域的微调:Mistral Small 3.1 可针对特定领域进行微调,打造精准的领域专家。这在法律咨询、医疗诊断和技术支持等领域尤为有用。

  • 高级推理的基础:社区在开放的 Mistral 模型之上所做的构建持续令我们印象深刻。就在过去几周,我们看到了多个基于 Mistral Small 3 构建的优秀推理模型,例如 Nous Research 的 DeepHermes 24B。为此,我们同时发布 Mistral Small 3.1 的基础版和指令版检查点,以便对该模型进行进一步的下游定制。

Mistral Small 3.1 可用于各类需要多模态理解的企业与消费应用,例如文档核验、诊断、端侧图像处理、质量检查中的视觉检测、安防系统中的目标检测、基于图像的客户支持,以及通用辅助。

可用性 

Mistral Small 3.1 可在 huggingface 网站下载:Mistral Small 3.1 Base 和 Mistral Small 3.1 Instruct。如需配备私有且经过优化的推理基础设施的企业部署,请联系我们。 

从今天起,你也可以通过 API 在 Mistral AI 的开发者平台 La Plateforme 上试用该模型。该模型也可在 Google Cloud Vertex AI 上使用。Mistral Small 3.1 将在未来几周内于 NVIDIA NIM 和 Microsoft Azure AI Foundry 上提供。 

祝构建愉快!

来源:Mistral AI · mistral.ai