#模型发布
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#模型发布
今日 1 条一手 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条OpenAI News精选AI 评分7979 OpenAI 在 ChatGPT 全球推出 GPT-6 与 Intelligent UI
GPT-6 在 ChatGPT 全球上线,并随附 Intelligent UI,提供更快响应以及可直接探索和使用的可视化与交互体验。
推荐理由:原文给出 GPT-6 在 ChatGPT 中全球上线并附带 Intelligent UI 的关键事实,读者可据此了解新模型与交互形态的落地范围。
Hugging Face BlogAI 评分3333 Hugging Face 发布 Falcon-ASR:1.6B 参数的阿拉伯语语音识别模型
Hugging Face 发布 Falcon-ASR,一个 1.6B 参数的语音识别模型,重点支持阿拉伯语及阿联酋方言,由阿布扎比 Technology Innovation Institute(TII)开发,同一权重也支持英语、法语、西班牙语和葡萄牙语。
Google DeepMindAI 评分5555 Google DeepMind 发布端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数量为 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
Mistral AI精选AI 评分8585 Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型
Mistral 发布 Mistral Large 4(昵称 le Chonk)公开预览 API,模型为 1 万亿总参数、490 亿激活参数的原生多模态模型,权重计划本月底开源,由 Mistral 欧洲自建数据中心用 3,800 张 NVIDIA Grace Blackwell GPU 训练。
推荐理由:1 万亿参数原生多模态模型公开预览并在网络安全、编码与视觉任务上对标开源前沿,可作为开源权重模型能力上限的参考基线。
NVIDIA BlogAI 评分2525 电信运营商为何以开源模型为基础构建 AI 战略
电信运营商正以开源模型为基础构建 AI 战略,看重的不仅是成本,更在于可信、可控与可定制。NVIDIA 最新《State of AI in Telecommunications》报告显示 89% 受访者认为开源模型与软件对其公司 AI 战略重要。
Hugging Face BlogAI 评分99 Falcon-Emirati-7B:专攻阿联酋方言与文化的大语言模型
Hugging Face 发布 Falcon-Emirati-7B,基于 Falcon-H1-Arabic 微调,专注理解与生成阿联酋方言及其背后的文化语境。该模型采用 Falcon-H1 混合架构,结合 Mamba 与 Transformer attention,选用 7B 参数量以平衡质量与训练推理成本。
AWS Machine Learning BlogAI 评分1919 智谱 GLM 5.3 上线 Amazon Bedrock,主打编码与长链路智能体任务
智谱(Z.ai)的 GLM 5.3 现已在 Amazon Bedrock 上线,面向企业客户提供全托管 API 接入。该模型为 753B 参数的 MoE 架构,专为编码与长链路智能体任务优化,发布时在 CyberGym 基准上取得 84.5 分。Bedrock 同时提供跨区域推理、隐式与显式 prompt caching,以及 Flex / Priority / Standard 三档服务等级。
Microsoft Research精选AI 评分7070 Microsoft 发布 RetroChimera:大规模小分子逆合成预测模型
Microsoft Research 发布 RetroChimera,一种新的逆合成预测模型,已发表在 Nature 期刊上。该模型结合了 Transformer 架构的 R-SMILES 2 和图神经网络的 NeuralLoc 两个互补子模型,通过学习排序策略集成预测。
推荐理由:模型在盲测中获得了博士级化学家的偏好,且已开源并提供访问入口,读者可以亲自试用验证。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 WeatherNext 3:迄今最先进、最准确的全球天气 AI 模型
Google DeepMind 发布 WeatherNext 3,这是迄今最先进、最准确的全球天气 AI 模型。新模型使用实时卫星数据训练,每小时更新一次,分辨率 5-25 公里,比上一代 WeatherNext 2 清晰约 5 倍。
推荐理由:原文给出了具体的性能提升数据(CRPS 提升 60%/30%/10%),分辨率提升 5 倍,与上一代 WeatherNext 2 有明确对比,读者可以据此判断模型的实际进步幅度。
Google DeepMind精选AI 评分7777 Google DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber
Google DeepMind发布Gemini 3.8 Flash和3.8 Flash Cyber两款新模型。3.8 Flash在DeepSWE v1.1基准上超越多数更大规模的frontier模型,在HLE-Verified上达54.9%,价格为每百万输入token 0.75美元、输出token 3.75美元。
推荐理由:原文给出了在软件工程、Agent任务和多步推理方面的具体性能提升数据和成本对比,读者可据此判断模型能力变化。
Microsoft Research精选AI 评分7171 微软发布 GigaPath-Flash 和 GigaTIME-Flash 高效病理基础模型
微软研究院发布 GigaPath-Flash 和 GigaTIME-Flash 两个高效病理基础模型。
推荐理由:通过知识蒸馏实现约 50 倍计算量降低,保持 97% 预测性能,为大规模病理研究提供更实用的工具。
Replicate BlogAI 评分6666 Isaac 0.1 在 Replicate 上可用
Perceptron AI 发布 Isaac 0.1,一个 2B 参数的开源视觉语言模型,专注于具身感知。该模型可回答图片问题、推理空间关系、读取杂乱环境中的文字,并指出答案来源。尽管体积小,Isaac 在 OCR、目标识别和视觉推理方面可媲美数倍体量的大型模型。
Replicate BlogAI 评分7272 Black Forest Labs 发布 FLUX.2 图像生成模型,可在 Replicate 运行
Black Forest Labs 发布 FLUX.2 图像生成模型,包含 pro、flex、dev 三种变体。FLUX.2 在图像质量、编辑能力和企业级效率方面有显著提升,支持多参考(最多8张图)保持角色一致性,可生成4MP分辨率的逼真细节,提升了文字渲染、提示词遵循和世界知识能力。pro 版本生成图像需6秒,dev 版本开源并经 Pruna.ai 优化加速至2.5秒。
Replicate BlogAI 评分7272 IBM Granite 4.0 模型现已登陆 Replicate
IBM 发布 Granite 4.0 开源小语言模型系列,专为速度和低成本打造。该系列采用混合架构结合 Mamba-2 线性扩展效率与 Transformer 精度,部分模型使用 MoE 路由策略,可在普通消费级 GPU 上运行。主要适用于文档摘要、RAG 系统和 AI 智能体场景,已在 Apache 2.0 许可证下开源。
Mistral AIAI 评分3737 Mistral Saba 发布:面向中东与南亚的 24B 参数区域语言模型
Mistral AI 发布 Mistral Saba,这是一款 24B 参数的区域语言模型,专为中东和南亚市场训练,支持阿拉伯语及多种印度源语言,在南印度源语言如泰米尔语上表现尤为突出。模型以 API 形式提供,同时也支持客户在本地安全环境内部署;参数量 24B,但官方称其响应比自身大 5 倍以上的模型更准确、更相关,且推理速度超过 150 tokens/s,可在单 GPU 系统上运行。
Mistral AI精选AI 评分7777 Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理
Mistral 发布 Mistral Small 3,一款面向低延迟推理的 24B 参数模型,采用 Apache 2.0 协议开源,权重和指令调优版本同步开放下载。
推荐理由:Mistral 以 Apache 2.0 开源 24B 模型并对标更大模型,可作为本地部署与开源替代方案的参考。
Replicate BlogAI 评分6060 Replicate Intelligence 第 8 期:Llama 3.1 发布,Mistral Large 2 登场
Meta 发布 Llama 3.1 系列,包含 4050 亿参数模型,128k token 上下文,支持工具调用,性能对标 GPT-4、Claude 3 和 Gemini 1.5。