跳到正文

交叉发现

今日 15 条

一手 · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
7月31日周四
  1. Replicate Blog70

    Wan 2.2 发布:开源视频生成模型更新

    Wan 2.2 是开源视频生成模型的重大更新,物理模拟更精确、生成速度更快、控制能力更强。Replicate 与 Pruna AI 合作推出优化版本,文本生成视频 480p 仅需 $0.05/视频,720p 为 $0.10/视频,推理时间约 30 秒。未优化版本 480p 为 $0.40/视频,720p 为 $1.00/视频。

7月30日周三
  1. Mistral AI68

    Mistral 发布 Codestral 25.08 及完整企业编码工具栈

    Mistral 发布 Codestral 25.08 代码补全模型,在 SWE-bench Verified 上 Devstral Medium 达 61.6%,Codestral 25.08 相比前代提升 30% 接受率和 10% 代码留存率。

    推荐理由:给出了具体性能提升数据(SWE-bench 61.6%、+30% accepted completions)和部署选项,读者可据此评估该版本相比前代及竞品的实际差距。

7月23日周三
7月21日周一
7月17日周四
  1. Replicate Blog61

    Bria 模型现已在 Replicate 上线

    Replicate 宣布与 Bria 合作,在平台上推出商业安全的视觉 AI 模型。Bria 的模型完全基于 Getty Images、Envato、Freepik 等授权数据训练,避免了版权风险。现已开放图像生成(Bria 3.2)、背景移除、修复、填充、分辨率提升、图像扩展和背景生成等功能。

7月16日周三
  1. Replicate Blog44

    FLUX.1 Kontext [dev] 如何使用 TaylorSeer 优化推理速度

    Replicate 详细介绍了 FLUX.1 Kontext [dev] 的 TaylorSeer 优化方法,通过缓存中间图像预测的导数并使用泰勒级数近似来加速图像生成。该方法将扩散模型的推理步骤从约 30 步减少到 10-15 步,同时保持图像质量。TaylorSeer 在生成的首尾步骤计算完整预测,中间步骤使用近似估算,平衡了速度与精度。

7月15日周二
  1. Mistral AI76

    Mistral 发布 Voxtral 语音理解模型

    Mistral 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,在基准测试中优于 Whisper large-v3、GPT-4o mini Transcribe 和 ElevenLabs Scribe,定价仅为 $0.001/分钟,不到竞品一半。模型支持 32k token 上下文,可处理最长 40 分钟音频,具备内置问答、摘要、多语言和函数调用能力。

    推荐理由:原文给出了 Voxtral 在多个基准测试上的性能对比和定价信息,读者可以据此判断它在语音理解领域的能力位置和成本优势。

7月7日周一
  1. Replicate Blog47

    AI 视频模型对比指南

    Replicate 平台对比了 24 款 AI 视频生成模型的价格、分辨率、时长和功能。Alibaba Wan 2.2 5b fast 价格最低 $0.01 起、生成速度最快 6-16 秒,Google Veo 3 价格最高 $6、支持原生音频。所有模型均支持商业使用,价格和速度数据截至 2025年7月。

7月3日周四
  1. Mistral AI51

    Mistral AI 推出 AI for Citizens 倡议,帮助各国政府和公共机构部署 AI

    Mistral AI 推出 AI for Citizens 倡议,旨在帮助各国政府和公共机构利用 AI 技术。该项目提供开放式 AI 解决方案,包括自托管、数据主权和定制化研发等服务,支持法国、卢森堡、新加坡、荷兰、英国、瑞士等多个国家和地区的政府机构。Mistral AI 表示这一倡议旨在让各国政府能够掌控自己的 AI 未来,避免对外国 AI 供应商的依赖。

7月1日周二
  1. Replicate Blog47

    FLUX.1 Kontext 黑客松获奖项目公布

    Replicate 联合 Black Forest Labs 举办 FLUX.1 Kontext 黑客松,超120人参与,收到30个提交项目。Tartan Photographers、sellmyshit、Infinity、VoiceCam 等项目获奖,覆盖 AI 电商陈列、AI 桌游、AI 语音修图等应用场景。

6月11日周三
6月10日周二
  1. Mistral AI72

    Mistral AI 发布首款推理模型 Magistral

    Mistral AI 发布首款推理模型 Magistral,提供开源版 Small(24B 参数)和企业版 Medium 两个版本。Magistral Medium 在 AIME2024 得分 73.6%( majority voting @64 达 90%),Small 版本得分 70.7%。

    推荐理由:给出了 AIME2024 基准测试的具体分数(73.6%/70.7%)和速度对比(10x),读者可据此评估该推理模型在同类中的相对性能。

6月6日周五
6月4日周三
  1. Mistral AI72

    Mistral 推出企业级 AI 编程助手 Mistral Code

    Mistral 发布 Mistral Code,这是一款面向企业的 AI 编程助手,整合了 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四个模型,支持云端、本地或空气隙部署,可对底层模型进行微调或蒸馏。私有测试版已开放,支持 JetBrains IDEs 和 VSCode,Abanca、SNCF 和 Capgemini 等企业已开始采用。

    推荐理由:原文给出了 Mistral Code 的核心能力(四个模型、企业级安全控制、可本地部署)和解决的四个企业痛点,读者可以据此判断它与企业现有工作流的适配度。

6月2日周一
5月28日周三
  1. Mistral AI77

    Mistral AI 发布 Codestral Embed 首款代码专用嵌入模型

    Mistral AI 发布首款代码专用嵌入模型 Codestral Embed,在 SWE-Bench、CodeSearchNet、Text2Code 等基准上显著优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大 embedding 模型。

    推荐理由:原文给出了与竞品的性能对比数据,读者可以据此判断该模型在代码检索场景中的实际适用性。

5月27日周二
  1. Mistral AI71

    Mistral 发布 Agents API

    Mistral 推出新的 Agents API,将 Mistral 强大的语言模型与内置连接器(代码执行、网络搜索、图像生成、文档库)、MCP 工具支持、持久记忆和智能体编排能力相结合。SimpleQA 基准测试显示,加入 web search 后,Mistral Large 和 Mistral Medium 的得分分别从 23% 和 22.08% 提升至 75% 和 82.32%。

    推荐理由:原文给出了 SimpleQA 基准测试的具体分数对比(有无 web search),读者可以据此评估搜索增强对模型实际能力的提升幅度。

5月22日周四
  1. Replicate Blog71

    Google Imagen 4 现已在 Replicate 开放使用

    Google 最新的旗舰图像生成模型 Imagen 4 现已在 Replicate 平台开放运行,这是预览版本。该模型在精细细节渲染、风格多样性和文字渲染方面有显著提升,并内置了过滤、数据标记和 SynthID 数字水印等安全措施。Replicate 同时预告将推出 Imagen 4 Ultra 和 Veo 3,并已上线 Google 的音乐生成模型 Lyria 2。

5月21日周三
  1. Mistral AI77

    Mistral AI 与 All Hands AI 合作发布 Devstral

    Mistral AI 推出 Devstral,这是一款用于软件工程任务的智能体大语言模型,在 SWE-Bench Verified 基准上达到 46.8%,超越此前开源 SOTA 模型超过 6 个百分点,并超过 GPT-4.1-mini 约 20%。

    推荐理由:原文给出了 Devstral 在 SWE-Bench Verified 上的具体得分(46.8%)、可在单张 RTX 4090 上运行的信息以及 API 价格,读者可据此评估该模型的能力和部署门槛。

5月16日周五
  1. Replicate Blog56

    Replicate 推出 NVIDIA H100 GPU 支持

    Replicate 现已支持 NVIDIA H100 GPU,同时提供 2x、4x、8x 配置的 A100 和 L40S GPU。这些配置此前仅在部署中可用,现已向普通模型和训练任务开放。H100 1x 配置现已向所有用户开放,2x、4x、8x H100 目前仅限承诺消费合约用户。

5月15日周四
5月7日周三
  1. Mistral AI73

    Mistral 发布 Medium 3 模型,主打高效能与低成本的 frontier 级别模型

    Mistral AI 发布 Medium 3 模型,定位为兼顾 SOTA 性能与低成本的企业级模型。定价为每百万 token 输入 0.4 美元、输出 2 美元,约为 Claude Sonnet 3.7 成本的十分之一,在编码和多模态理解等专业场景表现接近更大更慢的模型,超越 Llama 4 Maverick 和 DeepSeek v3。

    推荐理由:原文给出了具体定价($0.4/$2 per M token)和性能对比数据(90% Claude Sonnet 3.7、超越 Llama 4 Maverick),读者可以据此判断该模型在性能和成本上的具体表现。

  2. Replicate Blog73

    Ideogram 3.0 现已在 Replicate 上线

    Ideogram 发布 3.0 版文本到图像模型,现已在 Replicate 平台上线。该模型提供 Turbo、Balanced、Quality 三个版本,分别针对快速迭代、均衡场景和最高画质需求。主要升级包括更强的图像真实感、风格控制、布局生成能力,以及更精准的排版渲染。

5月6日周二
4月9日周三
  1. Mistral AI60

    Mistral 发布基于 LLM as a Judge 的 RAG 评估方法

    本文介绍了使用 LLM 作为评判者来评估 RAG 系统的完整方法,重点讲解了 RAG Triad 框架的三个核心指标:上下文相关性(Context Relevance)、事实一致性(Groundedness)和答案相关性(Answer Relevance),并提供了使用 Mistral 结构化输出实现评估的代码示例。

    推荐理由:原文给出了 RAG 评估的完整方法论和代码实现,读者可以据此构建自己的 RAG 系统评估流程。

3月28日周五
3月17日周一
  1. Mistral AI77

    Mistral Small 3.1 发布

    Mistral AI 发布 Mistral Small 3.1,号称同类最佳模型。新模型在文本性能和多模态理解上有所提升,上下文窗口扩展至 128k token,推理速度达 150 tokens/s,优于 Gemma 3 和 GPT-4o Mini。模型基于 Apache 2.0 许可证开源,可在单张 RTX 4090 或 32GB RAM Mac 上运行。

    推荐理由:原文给出了性能对比和推理速度数据,读者可以据此判断它在同类模型中的竞争力。

3月7日周五
  1. Mistral AI75

    Mistral 推出 OCR API,基准测试超越 Google、Azure 和 GPT-4o

    Mistral 发布新的 OCR API Mistral OCR,可处理图像和 PDF 并提取交错文本和图像,在基准测试中超越 Google Document AI、Azure OCR、Gemini 和 GPT-4o。定价为每美元 1000 页,单节点处理速度最高达每分钟 2000 页,支持多语言文档理解,现已在 Le Chat 免费试用,API 已上线 la Plateforme。

    推荐理由:原文给出了具体定价、基准测试对比和可用入口,读者可以据此评估它与现有 OCR 方案的差异。

3月5日周三
  1. Replicate Blog66

    Wan2.1: 通过 API 生成视频

    Wan2.1 是最新最强的开源视频模型,已上线 Replicate 平台,提供 14B 和 1.3B 参数两种规模,支持 480p 和 720p 分辨率的文本生成视频和图像生成视频。性能方面,5秒 480p 视频生成需 39秒,720p 需 150秒。该模型在手部细节、物理准确性和物体交互等方面表现突出,可通过 Replicate JavaScript 客户端调用 API。

  2. Replicate Blog50

    Wan2.1 参数调节实战教程

    Replicate 测试了阿里 Wan2.1 14b 文本到视频模型的参数调优效果,使用固定提示词和种子进行系统性参数扫描。实验发现 guidance scale 为 3-7 时效果最佳(0 为创意模式,8+ 会出现 AI 痕迹),shift 控制运动流畅度,1 产生推拉效果,7-9 倾向于相似的画面构图。

3月4日周二
2月17日周一
  1. Mistral AI37

    Mistral Saba 发布:面向中东与南亚的 24B 参数区域语言模型

    Mistral AI 发布 Mistral Saba,这是一款 24B 参数的区域语言模型,专为中东和南亚市场训练,支持阿拉伯语及多种印度源语言,在南印度源语言如泰米尔语上表现尤为突出。模型以 API 形式提供,同时也支持客户在本地安全环境内部署;参数量 24B,但官方称其响应比自身大 5 倍以上的模型更准确、更相关,且推理速度超过 150 tokens/s,可在单 GPU 系统上运行。

2月7日周五
1月30日周四
1月24日周五
  1. Replicate Blog79

    Replicate 平台现已支持微调开源视频模型

    Replicate 推出基于腾讯 HunyuanVideo 的微调功能,用户可通过平台工具收集训练数据、训练自定义视频模型并生成视频。HunyuanVideo 擅长捕捉训练数据的视觉风格和运动模式,包括角色动作和镜头运动,这种动态风格迁移是其独特优势。训练通常需要 5-10 分钟,支持通过 API 自动化。

    推荐理由:原文给出了在 Replicate 上微调视频模型的完整步骤和入口,读者可以据此实践自定义视频生成。

1月17日周五
  1. Replicate Blog37

    使用 Replicate playground 生成短视频

    Replicate 发布 playground 实验性网页界面,提供类似剪贴簿的 UI 用于测试和比较不同图像/视频模型,并保留实验记录。工作流程分为三步:首先使用 flux-aesthetic-anime 等图像模型生成起始图片,然后通过 minimax/video-01-live 将图片转换为视频,最后利用 zsxkib/mmaudio 模型为视频添加匹配的音乐音效。

12月16日周一
11月21日周四