#部署/工程
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#部署/工程
今日 0 条研究 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分2121 如何升级本地 LLM 硬件配置以运行更大模型或多实例
用户当前使用 Ryzen 5600X + 7900XTX + 64GB DDR4 配置运行 Qwen2.5 27B(3-4Q,128k-220k 上下文),速度达 50 token/s。考虑购买 2-4 张 MI50 16GB 显卡或额外 7900XTX 以运行更大模型或多实例并发,但受限于 X470 主板不适合多 GPU 组装。求问升级方案建议。
Reddit · r/LocalLLaMAAI 评分2525 如何深入学习本地大模型微调:Qwen 27b 案例指南
用户在 Reddit r/LocalLLaMA 社区询问系统学习本地模型微调技术的途径,目标是用自定义语料库微调 Qwen 27b 构建法律通用聊天机器人。帖子提及 RL、RL LoRA、QLoRA、CPT LoRA 等新技术,但发现 YouTube 教程质量参差不平,知名频道 fireship、bycloud 也未覆盖这些新概念,希望能找到实践性强且避免浪费金钱和时间的学习资源。
Reddit · r/LocalLLaMAAI 评分4444 Enclosure 推出模型人格测试工具 Disposition,征集更多测试
Jerry 创建了确定性测试环境 Enclosure,并推出模型人格测试工具 Disposition。该测试并非可赢的基准,旨在帮助用户找到适合其工作风格的模型。已在阿里巴巴 ModelStudio 测试了最便宜的模型,现开放社区参与测试。
Reddit · r/MachineLearningAI 评分4444 CoWindow and MassAlloc Attention:集体因果覆盖与分布自适应计算
两位研究者提出两种注意力冗余计算优化方法。CoWindow Attention(CoWA)通过互补窗口让各头稀疏 attend,128K tokens 在 8 H100 GPU 上实现 Forward 7.4×。
NVIDIA BlogAI 评分3131 费城儿童医院如何用开源NVIDIA AI为先天性心脏病儿童建模心脏
费城儿童医院(CHOP)基于NVIDIA开源医学影像框架MONAI,将过去需要4小时的心脏建模工作缩短至几秒。美国20多家儿童医院已开展心脏建模项目,波士顿儿童医院约50%的心脏手术(约每年500例)获建模支持。CHOP正结合NVIDIA Warp和Newton物理引擎,目标将模拟仿真引入临床工作流程,实现同日决策。
Hugging Face BlogAI 评分4040 GPU 管理:为何闲置 GPU 成为新的"接地飞机"
AI 行业的下一个真正约束已从模型智能转向 GPU 利用率。GPU 按日历小时计成本(融资、折旧、功耗、冷却),仅按计算小时产生收入,与航空业的飞机经济模型完全相同。
Google ResearchAI 评分4141 Google 线性弹性缓存技术:将页面驱逐建模为滑雪租赁问题优化云成本
Google 提出线性弹性缓存技术,将页面驱逐问题建模为滑雪租赁问题,使用浅层决策树预测页面 TTL 以动态调整缓存大小。在 Spanner 生产环境的测试中,内存使用减少 15.5%,缓存未命中仅增加 5.5%,总拥有成本(TCO)降低约 5%,实际 I/O 成本影响仅 0.5%。该方法将内存视为随占用时间和大小线性计费的 utility,而非固定资源。