跳到正文

#开源生态

今日 5 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
12月3日周三
  1. Mistral AI80

    Mistral 发布 Mistral 3 系列模型,包含 Large 3 和 Ministral 3

    Mistral 发布 Mistral 3 系列模型,包括三个小型密集模型(14B、8B、3B)和 Mistral Large 3。Mistral Large 3 采用稀疏混合专家架构,拥有 41B 活跃参数和 675B 总参数,在 LMArena 排行榜开源非推理模型中排名第二。

    推荐理由:原文给出了新模型的能力变化、性能数据和合作信息,读者可以据此判断这个模型在开源生态中的位置以及对自己场景的适用性。

11月26日周三
  1. Replicate Blog66

    Isaac 0.1 在 Replicate 上可用

    Perceptron AI 发布 Isaac 0.1,一个 2B 参数的开源视觉语言模型,专注于具身感知。该模型可回答图片问题、推理空间关系、读取杂乱环境中的文字,并指出答案来源。尽管体积小,Isaac 在 OCR、目标识别和视觉推理方面可媲美数倍体量的大型模型。

11月19日周三
  1. Mistral AI64

    Mistral AI 宣布与 SAP、Helsing 达成战略合作,扩展德国市场

    Mistral AI 宣布与 SAP 建立多年合作伙伴关系,为德国和欧洲提供完全自主的 AI 堆栈,将模型集成到 SAP 的 AI Foundation 中,共同开发特定行业解决方案。同时与 Helsing 合作加速开发用于国防和安全应用的视觉-语言-行动模型。Mistral 将在未来几个月内在德国开设办公室,大幅增加本地团队规模,以推进欧洲的 AI 自主战略。

    推荐理由:原文给出了具体合作对象(SAP、Helsing)、合作内容和德国市场扩展计划,读者可以据此了解欧洲 AI 自主战略的具体布局。

8月10日周日
7月31日周四
  1. Replicate Blog70

    Wan 2.2 发布:开源视频生成模型更新

    Wan 2.2 是开源视频生成模型的重大更新,物理模拟更精确、生成速度更快、控制能力更强。Replicate 与 Pruna AI 合作推出优化版本,文本生成视频 480p 仅需 $0.05/视频,720p 为 $0.10/视频,推理时间约 30 秒。未优化版本 480p 为 $0.40/视频,720p 为 $1.00/视频。

7月30日周三
  1. Mistral AI68

    Mistral 发布 Codestral 25.08 及完整企业编码工具栈

    Mistral 发布 Codestral 25.08 代码补全模型,在 SWE-bench Verified 上 Devstral Medium 达 61.6%,Codestral 25.08 相比前代提升 30% 接受率和 10% 代码留存率。

    推荐理由:给出了具体性能提升数据(SWE-bench 61.6%、+30% accepted completions)和部署选项,读者可据此评估该版本相比前代及竞品的实际差距。

7月17日周四
  1. Replicate Blog61

    Bria 模型现已在 Replicate 上线

    Replicate 宣布与 Bria 合作,在平台上推出商业安全的视觉 AI 模型。Bria 的模型完全基于 Getty Images、Envato、Freepik 等授权数据训练,避免了版权风险。现已开放图像生成(Bria 3.2)、背景移除、修复、填充、分辨率提升、图像扩展和背景生成等功能。

7月16日周三
  1. Replicate Blog44

    FLUX.1 Kontext [dev] 如何使用 TaylorSeer 优化推理速度

    Replicate 详细介绍了 FLUX.1 Kontext [dev] 的 TaylorSeer 优化方法,通过缓存中间图像预测的导数并使用泰勒级数近似来加速图像生成。该方法将扩散模型的推理步骤从约 30 步减少到 10-15 步,同时保持图像质量。TaylorSeer 在生成的首尾步骤计算完整预测,中间步骤使用近似估算,平衡了速度与精度。

7月3日周四
  1. Mistral AI51

    Mistral AI 推出 AI for Citizens 倡议,帮助各国政府和公共机构部署 AI

    Mistral AI 推出 AI for Citizens 倡议,旨在帮助各国政府和公共机构利用 AI 技术。该项目提供开放式 AI 解决方案,包括自托管、数据主权和定制化研发等服务,支持法国、卢森堡、新加坡、荷兰、英国、瑞士等多个国家和地区的政府机构。Mistral AI 表示这一倡议旨在让各国政府能够掌控自己的 AI 未来,避免对外国 AI 供应商的依赖。

6月2日周一
5月22日周四
  1. Replicate Blog71

    Google Imagen 4 现已在 Replicate 开放使用

    Google 最新的旗舰图像生成模型 Imagen 4 现已在 Replicate 平台开放运行,这是预览版本。该模型在精细细节渲染、风格多样性和文字渲染方面有显著提升,并内置了过滤、数据标记和 SynthID 数字水印等安全措施。Replicate 同时预告将推出 Imagen 4 Ultra 和 Veo 3,并已上线 Google 的音乐生成模型 Lyria 2。

5月15日周四
5月6日周二
3月28日周五
3月17日周一
  1. Mistral AI77

    Mistral Small 3.1 发布

    Mistral AI 发布 Mistral Small 3.1,号称同类最佳模型。新模型在文本性能和多模态理解上有所提升,上下文窗口扩展至 128k token,推理速度达 150 tokens/s,优于 Gemma 3 和 GPT-4o Mini。模型基于 Apache 2.0 许可证开源,可在单张 RTX 4090 或 32GB RAM Mac 上运行。

    推荐理由:原文给出了性能对比和推理速度数据,读者可以据此判断它在同类模型中的竞争力。

3月5日周三
  1. Replicate Blog66

    Wan2.1: 通过 API 生成视频

    Wan2.1 是最新最强的开源视频模型,已上线 Replicate 平台,提供 14B 和 1.3B 参数两种规模,支持 480p 和 720p 分辨率的文本生成视频和图像生成视频。性能方面,5秒 480p 视频生成需 39秒,720p 需 150秒。该模型在手部细节、物理准确性和物体交互等方面表现突出,可通过 Replicate JavaScript 客户端调用 API。

1月30日周四
1月24日周五
  1. Replicate Blog79

    Replicate 平台现已支持微调开源视频模型

    Replicate 推出基于腾讯 HunyuanVideo 的微调功能,用户可通过平台工具收集训练数据、训练自定义视频模型并生成视频。HunyuanVideo 擅长捕捉训练数据的视觉风格和运动模式,包括角色动作和镜头运动,这种动态风格迁移是其独特优势。训练通常需要 5-10 分钟,支持通过 API 自动化。

    推荐理由:原文给出了在 Replicate 上微调视频模型的完整步骤和入口,读者可以据此实践自定义视频生成。

1月17日周五
  1. Replicate Blog37

    使用 Replicate playground 生成短视频

    Replicate 发布 playground 实验性网页界面,提供类似剪贴簿的 UI 用于测试和比较不同图像/视频模型,并保留实验记录。工作流程分为三步:首先使用 flux-aesthetic-anime 等图像模型生成起始图片,然后通过 minimax/video-01-live 将图片转换为视频,最后利用 zsxkib/mmaudio 模型为视频添加匹配的音乐音效。

10月22日周二
  1. Replicate Blog80

    Stable Diffusion 3.5 现已在 Replicate 可用

    Stable Diffusion 3.5 在 Replicate 平台发布,提供 Large、Large Turbo 和 Medium 三个变体。Large Turbo 只需 4 步推理即可生成高质量图像,Medium 为 2.5B 参数可运行在消费级 GPU。定价分别为每张图 $0.065、$0.04、$0.035。非商业使用免费,商业使用年收入低于 100 万美元免费。

    推荐理由:原文给出了三个版本的能力差异和具体价格,读者可以据此判断在什么场景下该使用哪个版本以及成本是多少。

  2. Replicate Blog53

    Replicate 合作上线 Ideogram v2 修复功能

    Replicate 合作伙伴 Ideogram 推出 v2 模型的修复(inpainting)功能,提供标准版和 turbo 版两种选择。标准版生成质量更高,turbo 版速度更快。该模型还特别擅长生成文字。用户可通过 Python 或 JavaScript 客户端调用 API,也可直接试用开源的在线 demo。

10月10日周四
9月20日周五
9月9日周一
  1. Replicate Blog34

    如何使用 API 微调 FLUX.1

    本教程展示如何通过 Replicate HTTP API 编程化创建和运行微调后的 FLUX.1 模型。训练需 10-20 张图像,约 20 分钟可完成,费用约 $1.85,使用 Nvidia H100 GPU。支持最少 2 张图像微调,但 10 张以上效果更佳。

8月30日周五
8月23日周五
  1. Replicate Blog26

    Replicate Intelligence #12:FLUX.1 图像生成工具与大脑自我训练研究

    FLUX.1 图像生成模型推出两个新工具:ReFlux 支持多模型无限画布创作,Multi-LoRA Explorer 可单图叠加多个 LoRA 实现复杂风格组合。开源项目 Deep-Live-Cam 实现照片实时换脸到视频。此外,有研究揭示大脑在 REM 睡眠期间会模拟动作与后果,生成合成数据进行自我训练,与 AI 模型训练方式存在相似性。

8月16日周五
8月15日周四
8月9日周五
  1. Replicate Blog29

    Replicate Intelligence #10:FLUX.1 图像模型与 Odyssey Minecraft 智能体框架

    Odyssey 框架发布,赋予 LLaMA-3 模型智能体在 Minecraft 开放世界中的探索能力,包含交互式智能体、技能库和新的开放世界基准。Replicate 平台上的 FLUX.1 [dev] 新增图像到图像转换功能,首周获得近 500 万次预测调用。Streamlit 推出新视频系列,展示如何基于 Replicate 构建 AI 应用。

8月2日周五
  1. Replicate Blog53

    FLUX.1 初印象

    Replicate 官方测试了新的图像生成模型 FLUX.1,发现其使用 flow matching 而非传统 diffusion 方法,在文本渲染精度、光影质感表现和艺术风格理解方面展现出独特优势,生成图像具有一种有机的流动感。

8月1日周四
7月26日周五
7月23日周二
  1. Replicate Blog65

    如何在 API 上运行 Meta Llama 3.1 405B

    Replicate 平台支持通过 API 调用 Meta Llama 3.1 405B 模型。该模型拥有 4050 亿参数,上下文窗口为 8000 token,支持 8 种语言,在多项基准测试中接近 GPT-4 水平。文章提供了 JavaScript、Python 和 cURL 三种调用方式的代码示例,并介绍了 Purple Llama 安全工具套件。

7月12日周五
10月12日周四
  1. Cursor Blog39

    Cursor 列举当前需要解决的问题

    Cursor 团队分享了正在攻克的技术难题,包括更好的上下文处理(从50万token筛选出8k相关token)、面向编辑的copilot、受约束的流内Agent、主动找Bug、更大规模编辑等。截至2023年10月,Cursor已索引14亿个向量和15万个代码库,并计划在年底前增长10倍。