跳到正文

#新模型

今日 0 条

一手 · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
4月13日周一
  1. Google DeepMind70

    Google DeepMind 发布 Gemini Robotics-ER 1.6:增强实体推理赋能机器人任务

    Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其首个推理优先模型的重大升级版。该模型增强了空间推理和多视角理解能力,专门用于视觉与空间理解、任务规划和成功检测,并能原生调用工具如 Google Search、视觉语言动作模型或第三方函数。

    推荐理由:原文给出了具体性能对比和新增的仪表读取功能,读者可以据此判断该模型在机器人实体推理场景中的具体提升和可用性。

4月3日周五
  1. Google DeepMind78

    Google DeepMind 发布 Gemma 4:字面意义上最强大的开源模型

    Google DeepMind 正式发布 Gemma 4 系列开源模型,提供 E2B、E4B、26B MoE 和 31B Dense 四种规格。31B 版本在 Arena AI 文本排行榜位列第三,26B 排名第六,均超越参数量 20 倍于自身的模型。

    推荐理由:原文给出了四个版本的具体定位和性能数据,读者可以据此判断 Gemma 4 是否适合自己的硬件条件和使用场景。

3月17日周二
  1. Mistral AI78

    Mistral Small 4 发布:首个统一推理、指令和多模态能力的开源混合模型

    Mistral 发布新模型 Mistral Small 4,这是首个统一推理(Magistral)、指令(Mistral Small)和多模态(Pixtral)能力的开源混合模型。

    推荐理由:Mistral Small 4 首次将推理、指令、多模态能力统一在单一模型中,支持可配置的 reasoning_effort 参数,在基准测试中保持竞争力分数的同时输出更短,延迟降低 40%、吞吐量提升 3 倍。

  2. Mistral AI72

    Mistral AI 加入 NVIDIA Nemotron Coalition 并发布 Mistral Small 4

    Mistral AI 宣布作为创始成员加入 NVIDIA Nemotron Coalition,与 NVIDIA 合作共同开发开源前沿 AI 模型。同时发布 Mistral Small 4,供全球开发者、研究者和组织构建和定制 AI 应用。合作将结合 Mistral AI 的模型架构和 NVIDIA 的计算资源,目标是建立透明、可访问的全球 AI 基础。

    推荐理由:给出了新模型的具体名称和开放入口,读者可以据此判断它对现有模型生态的补充价值。

12月17日周三
  1. Mistral AI74

    Mistral 推出 Mistral OCR 3

    Mistral 发布新的 OCR 模型 Mistral OCR 3,在表单、手写、复杂表格等文档上比 Mistral OCR 2 提升 74% 整体胜率,定价 $2/千页,Batch API 半价 $1/千页,可通过 API 或 Document AI Playground 使用。

    推荐理由:原文给出了 74% 胜率提升和具体定价,读者可以据此判断新版 OCR 在性能和成本上的竞争力。

12月3日周三
  1. Mistral AI80

    Mistral 发布 Mistral 3 系列模型,包含 Large 3 和 Ministral 3

    Mistral 发布 Mistral 3 系列模型,包括三个小型密集模型(14B、8B、3B)和 Mistral Large 3。Mistral Large 3 采用稀疏混合专家架构,拥有 41B 活跃参数和 675B 总参数,在 LMArena 排行榜开源非推理模型中排名第二。

    推荐理由:原文给出了新模型的能力变化、性能数据和合作信息,读者可以据此判断这个模型在开源生态中的位置以及对自己场景的适用性。

7月15日周二
  1. Mistral AI76

    Mistral 发布 Voxtral 语音理解模型

    Mistral 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,在基准测试中优于 Whisper large-v3、GPT-4o mini Transcribe 和 ElevenLabs Scribe,定价仅为 $0.001/分钟,不到竞品一半。模型支持 32k token 上下文,可处理最长 40 分钟音频,具备内置问答、摘要、多语言和函数调用能力。

    推荐理由:原文给出了 Voxtral 在多个基准测试上的性能对比和定价信息,读者可以据此判断它在语音理解领域的能力位置和成本优势。

6月10日周二
  1. Mistral AI72

    Mistral AI 发布首款推理模型 Magistral

    Mistral AI 发布首款推理模型 Magistral,提供开源版 Small(24B 参数)和企业版 Medium 两个版本。Magistral Medium 在 AIME2024 得分 73.6%( majority voting @64 达 90%),Small 版本得分 70.7%。

    推荐理由:给出了 AIME2024 基准测试的具体分数(73.6%/70.7%)和速度对比(10x),读者可据此评估该推理模型在同类中的相对性能。

5月28日周三
  1. Mistral AI77

    Mistral AI 发布 Codestral Embed 首款代码专用嵌入模型

    Mistral AI 发布首款代码专用嵌入模型 Codestral Embed,在 SWE-Bench、CodeSearchNet、Text2Code 等基准上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大 embedding 模型。

    推荐理由:原文给出了与竞品的性能对比数据,读者可以据此判断该模型在代码检索场景中的实际适用性。

5月21日周三
  1. Mistral AI77

    Mistral AI 与 All Hands AI 合作发布 Devstral

    Mistral AI 推出 Devstral,这是一款用于软件工程任务的智能体大语言模型,在 SWE-Bench Verified 基准上达到 46.8%,超越此前开源 SOTA 模型超过 6 个百分点,并超过 GPT-4.1-mini 约 20%。

    推荐理由:原文给出了 Devstral 在 SWE-Bench Verified 上的具体得分(46.8%)、可在单张 RTX 4090 上运行的信息以及 API 价格,读者可据此评估该模型的能力和部署门槛。

5月7日周三
  1. Mistral AI73

    Mistral 发布 Medium 3 模型,主打高效能与低成本的 frontier 级别模型

    Mistral AI 发布 Medium 3 模型,定位为兼顾 SOTA 性能与低成本的企业级模型。定价为每百万 token 输入 0.4 美元、输出 2 美元,约为 Claude Sonnet 3.7 成本的十分之一,在编码和多模态理解等专业场景表现接近更大更慢的模型,超越 Llama 4 Maverick 和 DeepSeek v3。

    推荐理由:原文给出了具体定价($0.4/$2 per M token)和性能对比数据(90% Claude Sonnet 3.7、超越 Llama 4 Maverick),读者可以据此判断该模型在性能和成本上的具体表现。

3月17日周一
  1. Mistral AI77

    Mistral Small 3.1 发布

    Mistral AI 发布 Mistral Small 3.1,号称同类最佳模型。新模型在文本性能和多模态理解上有所提升,上下文窗口扩展至 128k token,推理速度达 150 tokens/s,优于 Gemma 3 和 GPT-4o Mini。模型基于 Apache 2.0 许可证开源,可在单张 RTX 4090 或 32GB RAM Mac 上运行。

    推荐理由:原文给出了性能对比和推理速度数据,读者可以据此判断它在同类模型中的竞争力。