#模型发布
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#模型发布
今日 3 条其它 · 工具·提示词·论文 三栏速览
每栏 3 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Product HuntAI 评分5858 Anthropic 发布 Claude Haiku 5.5 小模型
Anthropic 发布 Claude Haiku 5.5,定位是其最快、最强的小模型,面向摘要、分类、编码子智能体、客服和浏览器使用等高吞吐、低成本任务。
量子位 QbitAI精选AI 评分8282 OpenAI 向 ChatGPT 免费和 Go 用户推送 GPT-6 Luna,付费用户切换至 GPT-6 Sol
OpenAI 宣布 GPT-6 开始向 ChatGPT 推送,Plus、Pro 等付费用户使用 GPT-6 Sol,免费和 Go 用户使用 GPT-6 Luna,分别替换此前的 GPT-5.6 版本。
推荐理由:报告给出了青少年安全评测里的具体回退项,用户可以据此判断免费版在敏感话题上的实际表现。
The DecoderAI 评分7575 Anthropic 发布 Claude Haiku 5.5:比上代便宜最多 90%,知识与计算机使用基准大幅提升
Anthropic 发布 Claude Haiku 5.5,定位高速低成本小模型,面向摘要、数据库查询、分类和实时客服等高吞吐任务。
Reddit · r/LocalLLaMAAI 评分4040 EmpirioLabs 开源 Aplomb 1 决策模型:5.3B 参数、1M 上下文、4B 级 Decision Index 第一
EmpirioLabs 发布 Aplomb 1,一款 5.3B 参数、开放权重的决策模型,单次请求可处理 1M token 的文本、JSON、图片和音视频,在 Decision Index 0.2.1 上得 44.86,居 4B 模型榜首,并在 38 项基准中的 8 项(含 MMLU-Pro、GPQA Diamond、BBH)拿下 5.3B 及以下模型的最高分。
The DecoderAI 评分6262 Mistral 发布 1 万亿参数模型 Large 4,主打欧洲主权与网络安全任务
Mistral 发布 Mistral Large 4(ML4)公开预览版,昵称 le Chonk,总参数量 1 万亿、激活参数 49B,采用 fine-grained MoE 架构。
TechCrunch · AIAI 评分7070 Mistral AI 发布多模态大模型 Mistral Large 4,参数约为四千亿只到一万亿
Mistral AI 发布多模态大模型 Mistral Large 4(昵称 Le Chonk),参数量约 1 万亿,目前只能通过带安全护栏的公共端点访问,公司计划在安全测试完成后约三周释出权重。
Hacker News · 首页AI 评分1818 Mistral Large 4
正文信息不足以撰写摘要,仅可确认原始标题为 "Mistral Large 4",来源为 Hacker News 首页,文章获得 66 点、4 条评论,无法核验更多内容细节。
Hacker News · 首页AI 评分7070 Mistral 发布 Mistral Large 4:490 亿激活参数的开源多模态 MoE 模型
Mistral 发布 Mistral Large 4,定位为开放权重的通用多模态模型,采用细粒度 Mixture-of-Experts 架构,拥有 49B 激活参数与 1.05T 总参数,并配备 1.6B 视觉编码器。文档地址:https://docs.mistral.ai/models/mistral-large-4-0
Mistral AI精选AI 评分8585 Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型
Mistral 发布 Mistral Large 4(昵称 le Chonk)公开预览 API,模型为 1 万亿总参数、490 亿激活参数的原生多模态模型,权重计划本月底开源,由 Mistral 欧洲自建数据中心用 3,800 张 NVIDIA Grace Blackwell GPU 训练。
推荐理由:1 万亿参数原生多模态模型公开预览并在网络安全、编码与视觉任务上对标开源前沿,可作为开源权重模型能力上限的参考基线。
NVIDIA BlogAI 评分2525 电信运营商为何以开源模型为基础构建 AI 战略
电信运营商正以开源模型为基础构建 AI 战略,看重的不仅是成本,更在于可信、可控与可定制。NVIDIA 最新《State of AI in Telecommunications》报告显示 89% 受访者认为开源模型与软件对其公司 AI 战略重要。
The Rundown AIAI 评分4040 Reflection AI 发布首款开源模型 Beam,主打低算力与效率
Reflection AI 推出首款开源模型 Beam,面向编码和智能体场景,号称以更低算力和成本对标中国开源模型。官方称其推理与编码表现接近 Z.ai 的 GLM-5.2,权重将于本月以 Apache 2.0 许可证发布,允许企业自托管定制。
Hugging Face BlogAI 评分99 Falcon-Emirati-7B:专攻阿联酋方言与文化的大语言模型
Hugging Face 发布 Falcon-Emirati-7B,基于 Falcon-H1-Arabic 微调,专注理解与生成阿联酋方言及其背后的文化语境。该模型采用 Falcon-H1 混合架构,结合 Mamba 与 Transformer attention,选用 7B 参数量以平衡质量与训练推理成本。
AWS Machine Learning BlogAI 评分1919 智谱 GLM 5.3 上线 Amazon Bedrock,主打编码与长链路智能体任务
智谱(Z.ai)的 GLM 5.3 现已在 Amazon Bedrock 上线,面向企业客户提供全托管 API 接入。该模型为 753B 参数的 MoE 架构,专为编码与长链路智能体任务优化,发布时在 CyberGym 基准上取得 84.5 分。Bedrock 同时提供跨区域推理、隐式与显式 prompt caching,以及 Flex / Priority / Standard 三档服务等级。
TechCrunch · AIAI 评分7272 Reflection AI 发布开源权重模型 Beam,对标中国模型并降低推理算力成本
Reflection AI 正式发布首个前沿开源权重模型 Beam,这是一个文本 MoE 模型,总参数 501B、激活参数 23B,预训练使用 23.8T tokens,上下文窗口为 1M。
The DecoderAI 评分4444 Aleph Alpha 开源权重模型 Kolibri,为欧洲 AI 主权提供新论据
德国 Aleph Alpha 发布开源权重模型 Kolibri,采用 MoE 架构,总参数 78B、每 token 激活约 3B。
Mistral AIAI 评分3737 Mistral Saba 发布:面向中东与南亚的 24B 参数区域语言模型
Mistral AI 发布 Mistral Saba,这是一款 24B 参数的区域语言模型,专为中东和南亚市场训练,支持阿拉伯语及多种印度源语言,在南印度源语言如泰米尔语上表现尤为突出。模型以 API 形式提供,同时也支持客户在本地安全环境内部署;参数量 24B,但官方称其响应比自身大 5 倍以上的模型更准确、更相关,且推理速度超过 150 tokens/s,可在单 GPU 系统上运行。