跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

最新精选

第 41–45 条 · 共 45 条
6月10日周二
  1. Mistral AI71

    Mistral AI 发布首个推理模型 Magistral

    Mistral AI 发布首个推理模型 Magistral,分为 24B 开源版 Magistral Small 和企业版 Magistral Medium。

    推荐理由:官方在这次双版本发布里同时给出AIME2024成绩和Le Chat最高可达10倍的生成速度,便于判断透明多语言推理能否进入法律金融等专业流程。

5月28日周三
  1. Mistral AI60

    Mistral 发布代码嵌入模型 Codestral Embed

    Mistral 发布其首个代码专用嵌入模型 Codestral Embed,称其在真实代码数据检索上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大嵌入模型。

    推荐理由:这篇模型发布把 Codestral Embed 的检索质量、输出维度和精度选择放在一起说明,便于对照 Voyage Code 3、Cohere Embed v4.0 与 OpenAI 大嵌入模型看存储成本取舍。

5月21日周三
5月7日周三
  1. Mistral AI68

    Mistral AI 发布 Mistral Medium 3,强调更低成本与企业部署

    Mistral AI 发布 Mistral Medium 3,主打 SOTA 性能、8X 更低成本和更简单的部署,并称其在各项基准上达到 Claude Sonnet 3.7 至少 90% 的表现,API 价格为输入 $0.4、输出 $2 per M token。

    推荐理由:读者可据此对照 Mistral Medium 3 相对 Claude Sonnet 3.7 至少九成的基准表现、每百万 token 输入与输出价格,以及四张 GPU 起即可自托管的企业部署条件。

3月17日周一
  1. Mistral AI73

    Mistral AI 发布 Mistral Small 3.1,升级文本与多模态并支持 128k 上下文

    Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本表现与多模态理解,上下文窗口扩至 128k tokens,推理速度为每秒 150 tokens,并称其超过 Gemma 3 和 GPT-4o Mini。

    推荐理由:官方发布的 Mistral Small 3.1 在同权重级别提升文本表现、多模态理解与最长 128k 的上下文窗口,并给出每秒 150 tokens 的推理速度以及单张 RTX 4090 或 32GB 内存 Mac 的本地运行条件。