#模型发布
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#模型发布
今日 5 条洞察 · 工具·提示词·论文 三栏速览
每栏 3 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/artificialAI 评分1818 AI 应用是否会开始为日常工作训练专用模型?
随着近期模型发布,面向特定工作的专用模型训练受到关注,Genspark 曾通过 Fireworks 对 MiniMax M3 后训练以推出 Gen-1 Slides。作者认为,更多成熟 AI 应用可能为高频、重复收费的任务训练模型,但需要足够使用量、效果评估方法和持续维护能力,并不意味着每个应用都需要训练团队。
Simon WillisonAI 评分6262 Anthropic 发布 Claude Haiku 5.5 快速低成本模型
Anthropic 发布快速低成本模型 Claude Haiku 5.5,定价与 OpenAI GPT-6 Luna 相同,为 0.10 美元/百万 token 输入和 0.50 美元/百万 token 输出,超过 100k token 后升至 0.50 美元和 2.50 美元。
Hacker News · 首页精选AI 评分8383 OpenAI 一次发布 372 项数学证明,包括唯一游戏猜想
据 Scott Aaronson 整理,OpenAI 在顾问组推荐下一次性公开 372 项数学突破结果,其中包括 Subhash Khot 的唯一游戏猜想(UGC)证明、L=BPL、Fourier 变换整数乘法低于 O(n log n) 的新上界、Unitary Synthesis 问题的正面解答、Parity 不在 QAC0 等,部分配有 Lean 证书。
推荐理由:原文列出 372 项数学突破与所用算力、问题类型,可帮助读者判断新模型在深度推理上的实际边界。
Hacker News · 首页精选AI 评分8080 Anthropic 发布 Claude Haiku 5.5,主打高吞吐低成本任务
Anthropic 发布 Claude Haiku 5.5,主打高吞吐、成本敏感型任务,是其迄今最便宜、最快、能力最强的小模型。
推荐理由:原文把新模型的价格、速度、子智能体定位和基准成绩一次性给出,方便对比 Haiku 4.5 与同级模型的取舍。
Reddit · r/LocalLLaMAAI 评分3232 LiquidAI 发布 d1-3B 与 d1-omni 决策模型
LiquidAI 发布两款基于 LFM2.5 架构的零输出 token 决策模型 d1-3B 和 d1-omni。d1-3B(30 亿参数)在 Decision Index 0.2.1 上以 48.57 分位列 10B 以下决策模型榜首,超过 35B-A3B 的 Decider(47.11),单次决策在 NVIDIA RTX 4090 上耗时 8 ms。
Latent SpaceAI 评分5858 AI 周报:OpenAI 发布 722 篇数学论文,Mistral Large 4 与多项开源模型同步亮相
OpenAI 在 GitHub 公开一个未发布的内部模型产出的 722 份数学手稿,涵盖 372 个结果族,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力,被多位评论者称为数学史上“最重要的时刻”,其中 Quasi-Riemann Hypothesis 等结果据称涉及 Riemann、Hodge、BSD 等长期未解问题。
Simon WillisonAI 评分6262 Mistral 发布 Mistral Large 4 预览版,参数 1 trillion 激活 49B
Mistral 发布 Mistral Large 4 预览版,是一款 1 trillion 参数、激活 49B 的模型,训练于自建的 3,800 块 NVIDIA Grace Blackwell GPU 集群,已通过 Mistral API 提供预览,并承诺在“本月底”发布开源权重版本。
The DecoderAI 评分5151 Google 发布开源多模态嵌入模型 EmbeddingGemma 2,主打端侧运行
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,参数量为 740M,可将文本、图像、视频、音频和代码转为向量。Google 称在多模态嵌入基准上它优于尺寸达其两倍的竞品,是同档中最紧凑的模型;在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代提升近 10 分。
Reddit · r/LocalLLaMAAI 评分4545 Google DeepMind 开源多模态嵌入模型 EmbeddingGemma 2,可在消费级硬件端侧运行
Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本(含代码)、图像、视频和音频输入统一映射到 768 维向量空间。模型共 740M 参数,由 270M 文本模型与 170M 视觉、300M 音频编码器组合而成,专为手机、笔记本等消费级硬件上的低延迟语义表示设计,支持搜索、RAG、分类与聚类等端侧应用。
Reddit · r/LocalLLaMAAI 评分4747 微软公开页面证实 GPT-6 系列采用 Looped Transformers
微软在公开页面上确认 OpenAI 在 GPT-6 系列中使用了 Looped Transformers,印证了 The Information 此前的报道。其中 GPT-6.1 Sol 采用 2 次推理(而非 3 次),与同系列其他模型共享同一预训练基座,仅在后训练方式与循环次数上有所不同。
Reddit · r/LocalLLaMAAI 评分3434 DynamicTune 用闭式权重手术让 Qwen3.5-0.8B 在 ARC-Challenge 上超越 2B 模型
DynamicTune 提出一种无需反向传播的闭式权重手术方法,仅用约 12 分钟在消费级硬件上把 4B 模型的轨迹动力学迁移进 Qwen3.5-0.8B 学生模型。
Latent SpaceAI 评分4848 Reflection 发布 Beam:501B 总参 / 23B 激活的开源 MoE 编程模型
Reflection 发布 Beam,一款文本模型,总参数 501B、激活 23B 的 MoE,面向编程、智能体和科学场景,从零训练并计划于本月以 Apache 2.0 开源完整权重,团队称其在 SWE-bench Verified 上拿到 80.9,推理效率据称是 GLM 5.2 的 3–4 倍。
The DecoderAI 评分7474 OpenAI 为欧盟 ChatGPT 文本加入不可见水印,API 用户可自行关闭
OpenAI 推出名为 textGrain 的不可见文本水印技术,将在未来数周内为欧盟地区的 ChatGPT 与 Codex 用户默认开启,全球 API 用户则可自行选择是否启用,并将在 Microsoft Azure 等云合作伙伴中提供。
Reddit · r/LocalLLaMAAI 评分4646 Agens Volundr 32B Preview 发布:Blockway 自研混合架构,72 层仅 18 层保留 KV cache
Blockway 团队发布 Agens Volundr 32B Preview,这是其首款基于自研混合架构的模型,72 层中仅 18 层保留 KV cache,上下文窗口 262K,采用 Apache-2.0 开源。
Reddit · r/LocalLLaMAAI 评分3535 Ornith 1.5 35B-A3B 在双 5070 Ti 上的本地智能体实测:128K 上下文约 180 tok/s
用户在两块 RTX 5070 Ti 16GB 上把日常本地 agent 模型从 Qwen3.8 27B 换成了 Ornith 1.5 35B-A3B(ollama 库名 ornith-1.5。