#开源生态
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源生态
今日 5 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Mistral AI精选AI 评分8080 Mistral 发布 Mistral 3 系列模型,包含 Large 3 和 Ministral 3
Mistral 发布 Mistral 3 系列模型,包括三个小型密集模型(14B、8B、3B)和 Mistral Large 3。Mistral Large 3 采用稀疏混合专家架构,拥有 41B 活跃参数和 675B 总参数,在 LMArena 排行榜开源非推理模型中排名第二。
推荐理由:原文给出了新模型的能力变化、性能数据和合作信息,读者可以据此判断这个模型在开源生态中的位置以及对自己场景的适用性。
Replicate BlogAI 评分6666 Isaac 0.1 在 Replicate 上可用
Perceptron AI 发布 Isaac 0.1,一个 2B 参数的开源视觉语言模型,专注于具身感知。该模型可回答图片问题、推理空间关系、读取杂乱环境中的文字,并指出答案来源。尽管体积小,Isaac 在 OCR、目标识别和视觉推理方面可媲美数倍体量的大型模型。
Mistral AI精选AI 评分6464 Mistral AI 宣布与 SAP、Helsing 达成战略合作,扩展德国市场
Mistral AI 宣布与 SAP 建立多年合作伙伴关系,为德国和欧洲提供完全自主的 AI 堆栈,将模型集成到 SAP 的 AI Foundation 中,共同开发特定行业解决方案。同时与 Helsing 合作加速开发用于国防和安全应用的视觉-语言-行动模型。Mistral 将在未来几个月内在德国开设办公室,大幅增加本地团队规模,以推进欧洲的 AI 自主战略。
推荐理由:原文给出了具体合作对象(SAP、Helsing)、合作内容和德国市场扩展计划,读者可以据此了解欧洲 AI 自主战略的具体布局。
Replicate BlogAI 评分7070 Replicate 发布远程 MCP 服务器
Replicate 发布远程 MCP 服务器,可用于 Claude Desktop、Claude Code、Cursor 等应用,让用户通过自然语言对话探索和运行 Replicate 的 HTTP API。
Replicate BlogAI 评分7070 Wan 2.2 发布:开源视频生成模型更新
Wan 2.2 是开源视频生成模型的重大更新,物理模拟更精确、生成速度更快、控制能力更强。Replicate 与 Pruna AI 合作推出优化版本,文本生成视频 480p 仅需 $0.05/视频,720p 为 $0.10/视频,推理时间约 30 秒。未优化版本 480p 为 $0.40/视频,720p 为 $1.00/视频。
Mistral AI精选AI 评分6868 Mistral 发布 Codestral 25.08 及完整企业编码工具栈
Mistral 发布 Codestral 25.08 代码补全模型,在 SWE-bench Verified 上 Devstral Medium 达 61.6%,Codestral 25.08 相比前代提升 30% 接受率和 10% 代码留存率。
推荐理由:给出了具体性能提升数据(SWE-bench 61.6%、+30% accepted completions)和部署选项,读者可据此评估该版本相比前代及竞品的实际差距。
Replicate BlogAI 评分6161 Bria 模型现已在 Replicate 上线
Replicate 宣布与 Bria 合作,在平台上推出商业安全的视觉 AI 模型。Bria 的模型完全基于 Getty Images、Envato、Freepik 等授权数据训练,避免了版权风险。现已开放图像生成(Bria 3.2)、背景移除、修复、填充、分辨率提升、图像扩展和背景生成等功能。
Replicate BlogAI 评分4444 FLUX.1 Kontext [dev] 如何使用 TaylorSeer 优化推理速度
Replicate 详细介绍了 FLUX.1 Kontext [dev] 的 TaylorSeer 优化方法,通过缓存中间图像预测的导数并使用泰勒级数近似来加速图像生成。该方法将扩散模型的推理步骤从约 30 步减少到 10-15 步,同时保持图像质量。TaylorSeer 在生成的首尾步骤计算完整预测,中间步骤使用近似估算,平衡了速度与精度。
Mistral AIAI 评分5151 Mistral AI 推出 AI for Citizens 倡议,帮助各国政府和公共机构部署 AI
Mistral AI 推出 AI for Citizens 倡议,旨在帮助各国政府和公共机构利用 AI 技术。该项目提供开放式 AI 解决方案,包括自托管、数据主权和定制化研发等服务,支持法国、卢森堡、新加坡、荷兰、英国、瑞士等多个国家和地区的政府机构。Mistral AI 表示这一倡议旨在让各国政府能够掌控自己的 AI 未来,避免对外国 AI 供应商的依赖。
Replicate BlogAI 评分7070 Black Forest Labs 发布 FLUX.1 Kontext 图像编辑模型
Black Forest Labs 发布 FLUX.1 Kontext,这是一款文本驱动的图像编辑模型,在文本编辑方面优于 OpenAI 4o,且更便宜、无黄调偏差。
Replicate BlogAI 评分7171 Google Imagen 4 现已在 Replicate 开放使用
Google 最新的旗舰图像生成模型 Imagen 4 现已在 Replicate 平台开放运行,这是预览版本。该模型在精细细节渲染、风格多样性和文字渲染方面有显著提升,并内置了过滤、数据标记和 SynthID 数字水印等安全措施。Replicate 同时预告将推出 Imagen 4 Ultra 和 Veo 3,并已上线 Google 的音乐生成模型 Lyria 2。
Replicate BlogAI 评分6969 Replicate 现支持在 Hugging Face 上运行 30,000+ LoRA
Replicate 宣布其推理服务现已集成到 Hugging Face Hub,用户在 Hugging Face 上选择支持的 LoRA 并将 Replicate 设为推理提供商时。
Replicate BlogAI 评分6969 Replicate 支持调用 MiniMax Speech-02 文本转语音模型
Replicate 现已支持通过 API 调用 MiniMax 的 Speech-02 系列文本转语音模型。该系列包括 Speech-02-HD(高质量语音旁白和有声书,$50/百万字符)和 Speech-02-Turbo(实时应用,$30/百万字符)两个版本,支持 30 多种语言和语音克隆功能(需 10 秒以上音频样本,训练约 30 秒,$3/声音)。
Replicate BlogAI 评分2323 AI 创意工具汇总:语音模型、3D 生成与 LoRA 微调
Google DeepMind 发布 ShieldGemma 2,可高精度检测 NSFW 内容和暴力元素;腾讯推出 Hunyuan3D 2Mini,用于游戏资产和风格化角色创作。
Mistral AI精选AI 评分7777 Mistral Small 3.1 发布
Mistral AI 发布 Mistral Small 3.1,号称同类最佳模型。新模型在文本性能和多模态理解上有所提升,上下文窗口扩展至 128k token,推理速度达 150 tokens/s,优于 Gemma 3 和 GPT-4o Mini。模型基于 Apache 2.0 许可证开源,可在单张 RTX 4090 或 32GB RAM Mac 上运行。
推荐理由:原文给出了性能对比和推理速度数据,读者可以据此判断它在同类模型中的竞争力。
Replicate BlogAI 评分6666 Wan2.1: 通过 API 生成视频
Wan2.1 是最新最强的开源视频模型,已上线 Replicate 平台,提供 14B 和 1.3B 参数两种规模,支持 480p 和 720p 分辨率的文本生成视频和图像生成视频。性能方面,5秒 480p 视频生成需 39秒,720p 需 150秒。该模型在手部细节、物理准确性和物体交互等方面表现突出,可通过 Replicate JavaScript 客户端调用 API。
Mistral AI精选AI 评分7777 Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理
Mistral 发布 Mistral Small 3,一款面向低延迟推理的 24B 参数模型,采用 Apache 2.0 协议开源,权重和指令调优版本同步开放下载。
推荐理由:Mistral 以 Apache 2.0 开源 24B 模型并对标更大模型,可作为本地部署与开源替代方案的参考。
Replicate Blog精选AI 评分7979 Replicate 平台现已支持微调开源视频模型
Replicate 推出基于腾讯 HunyuanVideo 的微调功能,用户可通过平台工具收集训练数据、训练自定义视频模型并生成视频。HunyuanVideo 擅长捕捉训练数据的视觉风格和运动模式,包括角色动作和镜头运动,这种动态风格迁移是其独特优势。训练通常需要 5-10 分钟,支持通过 API 自动化。
推荐理由:原文给出了在 Replicate 上微调视频模型的完整步骤和入口,读者可以据此实践自定义视频生成。
Replicate BlogAI 评分3737 使用 Replicate playground 生成短视频
Replicate 发布 playground 实验性网页界面,提供类似剪贴簿的 UI 用于测试和比较不同图像/视频模型,并保留实验记录。工作流程分为三步:首先使用 flux-aesthetic-anime 等图像模型生成起始图片,然后通过 minimax/video-01-live 将图片转换为视频,最后利用 zsxkib/mmaudio 模型为视频添加匹配的音乐音效。
Replicate Blog精选AI 评分8080 Stable Diffusion 3.5 现已在 Replicate 可用
Stable Diffusion 3.5 在 Replicate 平台发布,提供 Large、Large Turbo 和 Medium 三个变体。Large Turbo 只需 4 步推理即可生成高质量图像,Medium 为 2.5B 参数可运行在消费级 GPU。定价分别为每张图 $0.065、$0.04、$0.035。非商业使用免费,商业使用年收入低于 100 万美元免费。
推荐理由:原文给出了三个版本的能力差异和具体价格,读者可以据此判断在什么场景下该使用哪个版本以及成本是多少。
Replicate BlogAI 评分5353 Replicate 合作上线 Ideogram v2 修复功能
Replicate 合作伙伴 Ideogram 推出 v2 模型的修复(inpainting)功能,提供标准版和 turbo 版两种选择。标准版生成质量更高,turbo 版速度更快。该模型还特别擅长生成文字。用户可通过 Python 或 JavaScript 客户端调用 API,也可直接试用开源的在线 demo。
Replicate BlogAI 评分6868 Replicate 优化 FLUX 图像生成速度并开源
Replicate 宣布 FLUX 图像生成模型在其平台上速度大幅提升:FLUX.1 [schnell] 512x512 4步推理仅需 0.29 秒(P90 0.49秒),1024x1024 仅需 0.72 秒(P90 0.95秒);FLUX.1 [dev] 1024x1024 28步仅需 3.03 秒(P90 3.90秒)。
Replicate BlogAI 评分3939 如何使用合成训练数据改进 Flux 微调模型
Replicate 博客介绍三种使用合成训练数据改进 Flux 微调模型的技术:使用 consistent-character 模型从单张图片生成多样训练数据;将微调模型的优质输出回收作为新训练数据;结合多个社区 LoRA 风格模型来多样化训练集。所有方法均可通过 Replicate API 自动化执行。
Replicate BlogAI 评分3434 如何使用 API 微调 FLUX.1
本教程展示如何通过 Replicate HTTP API 编程化创建和运行微调后的 FLUX.1 模型。训练需 10-20 张图像,约 20 分钟可完成,费用约 $1.85,使用 Nvidia H100 GPU。支持最少 2 张图像微调,但 10 张以上效果更佳。
Replicate BlogAI 评分6969 如何微调 FLUX.1 来生成自己的图像
Replicate 官方发布教程,指导用户用自己的图片微调 FLUX.1 模型生成自定义图像。只需准备 10 张不同角度和光照条件下的面部照片,选择一个独特的触发词,支付约 2 美元,即可在 20 分钟内完成训练并通过网页或 API 生成图像。
Replicate BlogAI 评分2626 Replicate Intelligence #12:FLUX.1 图像生成工具与大脑自我训练研究
FLUX.1 图像生成模型推出两个新工具:ReFlux 支持多模型无限画布创作,Multi-LoRA Explorer 可单图叠加多个 LoRA 实现复杂风格组合。开源项目 Deep-Live-Cam 实现照片实时换脸到视频。此外,有研究揭示大脑在 REM 睡眠期间会模拟动作与后果,生成合成数据进行自我训练,与 AI 模型训练方式存在相似性。
Replicate BlogAI 评分2121 Replicate Intelligence #11:FLUX.1 微调上线,Tavus 推出数字双胞胎视频对话 API
Replicate 现已支持 FLUX.1 微调,上传 12-20 张图片并选择触发词,约 30 分钟即可生成定制模型。Tavus 发布 Conversational Video Interface,可构建低延迟(<1 秒)的数字双胞胎进行实时视频对话,适用于客户支持和销售场景。
Replicate BlogAI 评分7474 如何在 Replicate 上微调 FLUX.1 模型
Black Forest Labs 发布的 FLUX.1 文本生成图像模型现可在 Replicate 上进行微调。用户只需上传 12-20 张图像,通过 Ostris 的 AI Toolkit 使用 LoRA 技术训练即可让模型学习新概念。
Replicate BlogAI 评分2929 Replicate Intelligence #10:FLUX.1 图像模型与 Odyssey Minecraft 智能体框架
Odyssey 框架发布,赋予 LLaMA-3 模型智能体在 Minecraft 开放世界中的探索能力,包含交互式智能体、技能库和新的开放世界基准。Replicate 平台上的 FLUX.1 [dev] 新增图像到图像转换功能,首周获得近 500 万次预测调用。Streamlit 推出新视频系列,展示如何基于 Replicate 构建 AI 应用。
Replicate BlogAI 评分5353 FLUX.1 初印象
Replicate 官方测试了新的图像生成模型 FLUX.1,发现其使用 flow matching 而非传统 diffusion 方法,在文本渲染精度、光影质感表现和艺术风格理解方面展现出独特优势,生成图像具有一种有机的流动感。
Replicate BlogAI 评分6565 FLUX.1 图像生成模型现可通过 API 调用
Black Forest Labs(Stable Diffusion 原团队)发布了新的开源图像生成模型 FLUX.1,现已在 Replicate 平台可用,支持一行代码调用。
Replicate BlogAI 评分6060 Replicate Intelligence 第 8 期:Llama 3.1 发布,Mistral Large 2 登场
Meta 发布 Llama 3.1 系列,包含 4050 亿参数模型,128k token 上下文,支持工具调用,性能对标 GPT-4、Claude 3 和 Gemini 1.5。
Replicate BlogAI 评分6565 如何在 API 上运行 Meta Llama 3.1 405B
Replicate 平台支持通过 API 调用 Meta Llama 3.1 405B 模型。该模型拥有 4050 亿参数,上下文窗口为 8000 token,支持 8 种语言,在多项基准测试中接近 GPT-4 水平。文章提供了 JavaScript、Python 和 cURL 三种调用方式的代码示例,并介绍了 Purple Llama 安全工具套件。
Replicate BlogAI 评分2727 Replicate Intelligence #7:本周AI开源模型与工具动态
summary__z: AI工程师Andy Ayrey基于自身聊天数据创建人格克隆,获得Marc Andreessen的1比特币投资并为其bot业务发薪。Fal.ai发布6.8B参数的AuraFlow开源文生图模型,声称可比肩闭源替代品。Google DeepMind新研究JEST方法将数据选择效率提升13倍。
Cursor BlogAI 评分3939 Cursor 列举当前需要解决的问题
Cursor 团队分享了正在攻克的技术难题,包括更好的上下文处理(从50万token筛选出8k相关token)、面向编辑的copilot、受约束的流内Agent、主动找Bug、更大规模编辑等。截至2023年10月,Cursor已索引14亿个向量和15万个代码库,并计划在年底前增长10倍。