跳到正文

新模型

新发布的模型、权重、能力升级、价格变化、上下文长度、benchmark 结果。

49条精选相关主题AI 平台

最新精选

第 41–49 条 · 共 49 条
3月17日周二
  1. Mistral AI72

    Mistral AI 加入 NVIDIA Nemotron Coalition 并发布 Mistral Small 4

    Mistral AI 宣布作为创始成员加入 NVIDIA Nemotron Coalition,与 NVIDIA 合作共同开发开源前沿 AI 模型。同时发布 Mistral Small 4,供全球开发者、研究者和组织构建和定制 AI 应用。合作将结合 Mistral AI 的模型架构和 NVIDIA 的计算资源,目标是建立透明、可访问的全球 AI 基础。

    推荐理由:给出了新模型的具体名称和开放入口,读者可以据此判断它对现有模型生态的补充价值。

12月17日周三
  1. Mistral AI74

    Mistral 推出 Mistral OCR 3

    Mistral 发布新的 OCR 模型 Mistral OCR 3,在表单、手写、复杂表格等文档上比 Mistral OCR 2 提升 74% 整体胜率,定价 $2/千页,Batch API 半价 $1/千页,可通过 API 或 Document AI Playground 使用。

    推荐理由:原文给出了 74% 胜率提升和具体定价,读者可以据此判断新版 OCR 在性能和成本上的竞争力。

12月3日周三
  1. Mistral AI80

    Mistral 发布 Mistral 3 系列模型,包含 Large 3 和 Ministral 3

    Mistral 发布 Mistral 3 系列模型,包括三个小型密集模型(14B、8B、3B)和 Mistral Large 3。Mistral Large 3 采用稀疏混合专家架构,拥有 41B 活跃参数和 675B 总参数,在 LMArena 排行榜开源非推理模型中排名第二。

    推荐理由:原文给出了新模型的能力变化、性能数据和合作信息,读者可以据此判断这个模型在开源生态中的位置以及对自己场景的适用性。

7月15日周二
  1. Mistral AI76

    Mistral 发布 Voxtral 语音理解模型

    Mistral 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,在基准测试中优于 Whisper large-v3、GPT-4o mini Transcribe 和 ElevenLabs Scribe,定价仅为 $0.001/分钟,不到竞品一半。模型支持 32k token 上下文,可处理最长 40 分钟音频,具备内置问答、摘要、多语言和函数调用能力。

    推荐理由:原文给出了 Voxtral 在多个基准测试上的性能对比和定价信息,读者可以据此判断它在语音理解领域的能力位置和成本优势。

6月10日周二
  1. Mistral AI72

    Mistral AI 发布首款推理模型 Magistral

    Mistral AI 发布首款推理模型 Magistral,提供开源版 Small(24B 参数)和企业版 Medium 两个版本。Magistral Medium 在 AIME2024 得分 73.6%( majority voting @64 达 90%),Small 版本得分 70.7%。

    推荐理由:给出了 AIME2024 基准测试的具体分数(73.6%/70.7%)和速度对比(10x),读者可据此评估该推理模型在同类中的相对性能。

5月28日周三
  1. Mistral AI77

    Mistral AI 发布 Codestral Embed 首款代码专用嵌入模型

    Mistral AI 发布首款代码专用嵌入模型 Codestral Embed,在 SWE-Bench、CodeSearchNet、Text2Code 等基准上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大 embedding 模型。

    推荐理由:原文给出了与竞品的性能对比数据,读者可以据此判断该模型在代码检索场景中的实际适用性。

5月21日周三
  1. Mistral AI77

    Mistral AI 与 All Hands AI 合作发布 Devstral

    Mistral AI 推出 Devstral,这是一款用于软件工程任务的智能体大语言模型,在 SWE-Bench Verified 基准上达到 46.8%,超越此前开源 SOTA 模型超过 6 个百分点,并超过 GPT-4.1-mini 约 20%。

    推荐理由:原文给出了 Devstral 在 SWE-Bench Verified 上的具体得分(46.8%)、可在单张 RTX 4090 上运行的信息以及 API 价格,读者可据此评估该模型的能力和部署门槛。

5月7日周三
  1. Mistral AI73

    Mistral 发布 Medium 3 模型,主打高效能与低成本的 frontier 级别模型

    Mistral AI 发布 Medium 3 模型,定位为兼顾 SOTA 性能与低成本的企业级模型。定价为每百万 token 输入 0.4 美元、输出 2 美元,约为 Claude Sonnet 3.7 成本的十分之一,在编码和多模态理解等专业场景表现接近更大更慢的模型,超越 Llama 4 Maverick 和 DeepSeek v3。

    推荐理由:原文给出了具体定价($0.4/$2 per M token)和性能对比数据(90% Claude Sonnet 3.7、超越 Llama 4 Maverick),读者可以据此判断该模型在性能和成本上的具体表现。

3月17日周一
  1. Mistral AI77

    Mistral Small 3.1 发布

    Mistral AI 发布 Mistral Small 3.1,号称同类最佳模型。新模型在文本性能和多模态理解上有所提升,上下文窗口扩展至 128k token,推理速度达 150 tokens/s,优于 Gemma 3 和 GPT-4o Mini。模型基于 Apache 2.0 许可证开源,可在单张 RTX 4090 或 32GB RAM Mac 上运行。

    推荐理由:原文给出了性能对比和推理速度数据,读者可以据此判断它在同类模型中的竞争力。