#Meta
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#Meta
今日 0 条一手 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Hugging Face BlogAI 评分5454 开放模型现状:2026年夏季观察
Hugging Face 发布2026年1月至8月开放模型生态报告。公开模型仓库从243万增长至296万,数据集从71.1万增至100万,Spaces从100万增至144万。
Hugging Face Blog精选AI 评分7575 Meta 发布 Muse Glimmer:30B 参数本地代理多模态模型
Meta 发布 Muse Glimmer,这是一款 30B 参数的多模态模型,从 Muse 蒸馏而来,采用 Apache 2.0 许可证开源,专为本地代理场景设计,支持图像、视频和代码处理。
推荐理由:原文给出了模型架构细节、benchmark 对比和工具链支持,读者可以了解这个 30B 参数的多模态模型在本地代理场景下的能力定位。
Google DeepMindAI 评分5858 Google 扩展内容透明度工具,Search、Gemini、Chrome、Pixel 和 Cloud 均将支持 AI 内容验证
Google 扩展其内容透明度和验证工具,SynthID 水印技术已应用于超过 1000 亿张图片和视频以及 6 万年音频。Gemini 应用已提供 SynthID 验证功能(全球使用 5000 万次),正在扩展至 Search 和 Chrome。
Replicate BlogAI 评分2323 AI 创意工具汇总:语音模型、3D 生成与 LoRA 微调
Google DeepMind 发布 ShieldGemma 2,可高精度检测 NSFW 内容和暴力元素;腾讯推出 Hunyuan3D 2Mini,用于游戏资产和风格化角色创作。
Replicate BlogAI 评分2424 Replicate Intelligence #9:本周开源AI模型动态
Black Forest Labs发布FLUX.1图像生成模型套件,采用"flow matching"技术,支持高达2百万像素分辨率,分为pro、dev、schnell三个版本。Meta推出SAM 2图像和视频分割模型,零样本能力扩展至视频领域,性能提升3倍。Google发布Gemma 2 2B紧凑语言模型,仅20亿参数但在LMSYS Chatbot Arena超越所有GPT-3.5模型。
Replicate BlogAI 评分6060 Replicate Intelligence 第 8 期:Llama 3.1 发布,Mistral Large 2 登场
Meta 发布 Llama 3.1 系列,包含 4050 亿参数模型,128k token 上下文,支持工具调用,性能对标 GPT-4、Claude 3 和 Gemini 1.5。
Replicate BlogAI 评分6565 如何在 API 上运行 Meta Llama 3.1 405B
Replicate 平台支持通过 API 调用 Meta Llama 3.1 405B 模型。该模型拥有 4050 亿参数,上下文窗口为 8000 token,支持 8 种语言,在多项基准测试中接近 GPT-4 水平。文章提供了 JavaScript、Python 和 cURL 三种调用方式的代码示例,并介绍了 Purple Llama 安全工具套件。
Cursor Blog精选AI 评分6060 Cursor 技术博客:Llama-2-70B 推理特性分析
Cursor 分析了 Llama-2-70B 自托管推理的成本和延迟。实验表明,在 prompt 场景下 Llama 比 GPT-3.5 便宜约 3-4 倍($0.00042 vs $0.0015/1K tokens),但在 completion 场景下成本高达 $0.066/1K tokens,远高于 GPT-3.5。
推荐理由:原文给出了 Llama-2-70B 与 GPT-3.5 在成本和延迟上的详细对比实验数据,读者可据此判断自托管与 API 调用的取舍。