#教程/实践
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#教程/实践
今日 11 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分1212 用户实测 llama.cpp 0.6.0 运行 Cloudflare Clef Q4_K_M 量化模型,基础任务准确率低
用户使用 llama.cpp 0.6.0 和 bartowski 的 Q4_K_M 量化运行 Cloudflare Clef 模型,在基础退款判别任务中 noul 仅 0.57,而同一输入下 Jev 取得 0.99。该模型在 team 分类(confidence 0.51)和 urgency 评分(confidence 0.13)上也表现不佳,用户因此对 Cloudflare Clef 失去信心。
Reddit · r/artificialAI 评分1414 Reddit 用户讨论如何让 Claude、Codex 等模型直接使用 REA、Ghidra 等 MCP 智能体技能进行游戏逆向与 mod 开发
Reddit 用户反映 Claude 和 Codex 在调用 REA、Ghidra 等 Agentic MCP 技能对专有二进制代码进行反编译和构建 mod 时,反复以法律与版权为由拒绝执行;但同时看到有用户晒出同类模型直接逆向其他游戏、复改代码并合成 pass-through mod 的成功案例。
Reddit · r/ChatGPTAI 评分1919 用 GPT Image 2.5 将普通照片转化为"第二世界"海报的提示词指南
用户分享了一套基于 GPT Image 2.5 的提示词,可将任意上传照片生成一张"第二世界"竖版海报:上半保留原照主体、姿态与光线,下半以暖米色纸张延续同一结构(如道路、倒影或光线)并加入对应的纸艺互动场景,使两半形成连续画面。该提示词还规定可加入 0–3 个黑色线条小人以及一句手写英文短标题,但禁止脱离原图的插画、水印或装饰。
Reddit · r/ChatGPTAI 评分3535 开发者用 ChatGPT 与 Claude 构建 doesitrun.com:LLM 离线设计 FPS 计算模型,运行时全程确定性代码
开发者上线 doesitrun.com,读取用户 Steam 游戏库与硬件参数后估算每款游戏的 FPS,并指出 CPU、GPU、VRAM 或 RAM 中谁是短板、推荐最便宜的升级方案,站点免费且无需账号。
Reddit · r/MachineLearningAI 评分66 在无标注网络流量上做应用识别:从自监督对比学习到 BERT 式掩码建模的方案探讨 [R]
一位开发者尝试用 Transformer 模型从无标注网络流量中识别 3000-5000 个应用,仅有约 100 个应用的小规模标注数据。流量以约 15 秒为窗口切分,每个窗口包含多条带域名、协议、字节数与时间戳等特征的网络流。候选方案包括自监督对比学习、BERT 式掩码建模预训练后再在小标注集上微调,以及对嵌入向量做聚类后逐步映射到已知应用;作者担忧模型可能学到设备、会话或用户特征而非应用本身。
Reddit · r/LocalLLaMAAI 评分2626 双卡 CMP 170HX 64GB 部署 GLM-5.3-Flash 384K 上下文方案与 Qwen3.8 实测对比
玩家在两张 64GB CMP 170HX 显卡上跑通了 GLM-5.3-Flash 的 EXL3 3.05bpw 量化方案,目标权重约 125.2GB 全驻留 HBM,配合 DFlash2 6bpw 草稿模型实现 384K 上下文,单请求预算约 392,960 tokens,生成速度约 90 tok/s。
Reddit · r/LocalLLaMAAI 评分2929 Strata 实测:可靠性堪忧,12 小时编程测试出现多次严重幻觉与生成错误
用户在 12 小时编程测试中发现 Strata 出现三类关键故障:混淆是否真的写入了执行报告、幻觉读取工具输出(误读路径中的数字"5")、以及反复写出畸形代码到不存在的路径。
Reddit · r/LocalLLaMAAI 评分3030 开发者将 LIBERO 基准移植到 MuJoCo Warp,在单张 700 美元 AMD GPU 上跑通 130 个机器人操控任务
开发者将 LIBERO 机器人操控基准完整移植到 MuJoCo Warp(NVIDIA GPU 仿真框架的 AMD HIP/ROCm 版本),在单张 700 美元的 RX 9070 XT 上以 2。
AWS Machine Learning BlogAI 评分1616 AWS 发布"AI builder"培养方案:六周结构化项目弥合业务人员 AI 知识与实操能力差距
AWS 设计了一个六周结构化项目,让日常工作依赖 AI 但无工程背景的业务人员动手搭建 AI 智能体原型,每周三至四小时。试点中四位销售类背景的成员基于 Amazon Bedrock AgentCore、Strands Agents SDK 和 Amazon Nova 模型构建出金融顾问多智能体工具 WealthWise,获得第一名。
AWS Machine Learning BlogAI 评分2222 AWS DevOps Agent 调查后自动化修复方案:基于 Lambda Durable Functions、EventBridge 与 Amazon Bedrock
AWS 发布基于 Lambda Durable Functions、EventBridge 和 Amazon Bedrock 的自动化修复方案,用于衔接 AWS DevOps Agent 的事件调查环节。
AWS Machine Learning BlogAI 评分2020 AWS 提出 Agentic Value Model 框架,帮助企业量化智能体自动化的完整商业价值
AWS 发布 Agentic Value Model 框架,针对传统 RPA ROI 模型无法衡量智能体(agentic)自动化收益的问题,提出四项价值维度与一项落地条件。
Reddit · r/artificialAI 评分66 用 Claude + VS Code 开发 SaaS 与项目时如何规划学习路径与应对 token 限额
该用户已是 AI 技术爱好者,正使用 Claude 与 VS Code 在终端开发 SaaS、社区和站点/配送类项目,但感到缺乏方向、流程容易迷失,也受困于 token 限额(已使用 RTK 压缩消耗,额度用完后几乎无法继续)。
Hugging Face Blog精选AI 评分7070 NVIDIA 公布 Nemotron 在 IOI 与 IMO 2026 的金牌级微调与推理方案
NVIDIA 在 Hugging Face 博客介绍基于 Nemotron 3 微调出的系统在 IOI 2026 与 IMO 2026 均达到金牌线,其中 IOI 由 Nemotron-3-Ultra-CC 配合 GenCorrect 取得 535.4/600 分。
推荐理由:原文把 IOI 与 IMO 两个金牌结果的训练数据、方法和推理回路整理成可复用的微调配方,读者可直接对照迁移到自己的领域。
Reddit · r/LocalLLaMAAI 评分77 单卡 3090 跑 Qwen3.8-27B 用户考虑升级 128GB DDR5 以应对 Strata 炒作
一位 Reddit 用户目前用单张 3090 显卡运行 turboderp/Qwen3.8-27B-exl3 量化版,可达约 70t/s 的生成速度和约 150k 上下文,正考虑升级到 128GB DDR5 6000MHz 内存和 Ryzen 9700X,以便跑 IQ3 量化和 Strata。
Reddit · r/LocalLLaMAAI 评分3333 社区作者为 Ternary Bonsai 2 27B 微调 DFlash 2 drafter:L4 加速 2.2x,代码编辑 3.2x
网友基于 z-lab 的 DFlash 2 drafter,用 Bonsai 2 自身 1.5M tokens 的 greedy 输出做微调,使其适配 PrismML 的 Ternary Bonsai 2 27B。
Reddit · r/ChatGPTAI 评分1515 Pixelfork、Rosebud、Spawn 等提示词生成游戏工具横向对比
Reddit 用户对 Pixelfork、Rosebud、Spawn、Mindblown、Genex、GDevelop AI 等 AI 提示词生成游戏(prompt-to-game)工具做了横向对比,列出各平台功能与差异。该帖子指出,目前多数 AI 游戏工具仍停留在只能展示几张截图的 demo 阶段,真正可用的产品开始出现。
Reddit · r/MachineLearningAI 评分88 零基础如何从 ML 工程师起步,在 NeurIPS / ACL / ICLR 等 A* 会议发表论文并申请 CS 博士
一名有两年工作经验的 AI 工程师询问如何从零开始规划学术路径,目标是在 NeurIPS、ACL、ICLR 等 A* 会议发表论文,并在 2028 年秋季申请美国 CS 硕士后进入斯坦福或普林斯顿等顶尖高校读博。原帖给出的初步路线包括学习 Python、机器学习与数学、阅读研究论文、寻找课题并跑实验撰写论文,并征求更具操作性的步骤以及能提升博士申请竞争力的关键因素。
Reddit · r/LocalLLaMAAI 评分1616 2026 年本地 RAG 个人知识库选型:embedder 与混合检索经验讨论
网友讨论如何用 SQLite + sqlite-vec + FTS5、Ollama 在 Apple Silicon Mac 上搭建完全本地化的个人 RAG 知识库。
Reddit · r/LocalLLaMAAI 评分1515 ik_llama.cpp 在多 GPU 层拆分混合推理中为何反而慢于主线 llama.cpp
用户在 4 张异构 GPU(3 张 P102-100 + 1 张 RTX 3060 12GB)混合卸载 Qwen 3.8 Flash-Next 177B(IQ3_XXS)并配合 AVX-512 CPU 跑 32k 上下文时。
Reddit · r/ChatGPTAI 评分77 开发者用 ChatGPT 构建微内核操作系统,寻求加速完成的方法
一名开发者正在用 ChatGPT 协助构建一款微内核操作系统,目前已实现音频、视频、网络与文件系统等大部分功能,计划以开源许可证发布。作者反馈 ChatGPT 出现响应变慢、修复一个问题常引发其他回归的情况,正考虑切换其他模型或优化提示词,并计划以每次约 300 行代码的节奏继续推进。
Reddit · r/ChatGPTAI 评分66 网友分享用 ChatGPT 开发 Minecraft Create 模组附加包的经验
一名无开发经验的网友尝试用 ChatGPT 编写 Minecraft Create 模组附加包,目前进展顺利,ChatGPT 在代码增补和细节调整上没有出现明显问题。他发帖征集其他用户用 ChatGPT 做游戏 mod 的经验,并寻求让流程更顺畅的建议。
Reddit · r/MachineLearningAI 评分66 没有 A* 顶会发表还能申到 ML PhD 吗
一名美国 top-15 大学的 MS 国际学生在 Reddit 提问:在没有 NeurIPS、ICLR 等顶会接收论文的情况下,是否还值得申请顶级 ML PhD,还是该把时间转向工业界招聘。作者目前有一篇 NeurIPS 一作被拒、另一篇 ICLR 一作在审,因担心国际生身份和 SWE/MLE 招聘竞争而犹豫是否投入申请。该帖主要面向有 ML 研究经历但尚无顶会发表者寻求现实评估。
Simon WillisonAI 评分2323 用 Parseable 配合 Datasette 处理 OpenTelemetry traces
Datasette 1.0a41 起内置 OpenTelemetry 支持,可与开源可观测性工具 Parseable 配合使用。Parseable 提供 AGPL 开源的 Rust 单二进制实现(体积约 180MB)、企业版和云托管三种形态。
AWS Machine Learning BlogAI 评分2929 在 AgentCore 与 OpenClaw 上构建具备上下文记忆的 AI 助手
AWS 发布基于 Amazon Bedrock AgentCore 运行时与开源智能体框架 OpenClaw 的上下文感知 AI 助手架构,以园艺助手 Sprout 为示例。
Reddit · r/LocalLLaMAAI 评分1515 Hugging Face 工程师分享 llama.cpp 本地 AI 生态技术演讲
Hugging Face 工程师 Merve 在一场开发者大会上分享了关于 llama.cpp 的演讲内容,涵盖 prefill 与 decode、内存类型、speculative decoding 等本地 LLM 推理基础概念,供社区参考使用并要求注明出处。
Reddit · r/LocalLLaMAAI 评分2323 基于 Qwen3.5-9B 微调的"Bev"决策模型:故意选错答案的对照测试用例
作者基于 Qwen3.5-9B 微调出决策模型 Bev,借助 Bespoke Nimble adapter 微调 51 分钟后,使她在 324 条 held-out 决策上答对率仅 1.9%、平均置信度 96%,置信度 ≥90% 时答对率仅 1.4%。
Reddit · r/LocalLLaMAAI 评分3131 21M 模型外挂 6.4B 参数查找表:性能追平 114M dense 模型,NVMe SSD 即可承载
作者在 21M 模型外挂一张 16.8M 行、6.4B 参数的查找表,在 500M Wikipedia token 训练下性能接近同条件下的 114M dense 模型。
Reddit · r/artificialAI 评分1111 完成 CPD 认证的 AI 精通课程后总结:真正值得记住的 5 件事
一位用户在 Reddit 分享完成 CPD 认证 AI 课程的 5 条心得:提示词技能占整体能力的 80%,工具选择远不如使用方式重要;建议组合使用 ChatGPT、Claude、Midjourney、Lovable 等工具,分别负责起草、生成图像和快速上线。AI 辅助写作的关键在于像编辑一样修改而非被动采用,图像和视频生成则更像"下达创意简报"的能力,效率提升来自工具之间的协同工作流。
Reddit · r/ChatGPTAI 评分77 完成 CPD 认证的 AI 掌握课程后,总结出 5 个真正值得记住的要点
一名用户在完成覆盖 ChatGPT、Claude、Midjourney、Lovable 和 Jasper 的 CPD 认证 AI 课程后,总结出五点核心心得:提示词技巧占技能的 80%。
Reddit · r/MachineLearningAI 评分2323 Transformer、RNN 与 SSM 的记忆机制对比:从循环状态、KV cache 到类突触连接
作者从"工作记忆"视角比较了 RNN、Transformer 与 SSM 三类架构的记忆承载方式:RNN 将记忆压缩为逐步传递的循环隐藏状态,参数规模约 O(N²) 而状态仅 O(N);Transformer 在推理时冻结权重,以不断增长的 KV cache 保存历史键值,更像便利贴式的外部上下文;SSM(如 Mamba)回到定长循环状态,并通过输入依赖机制决定遗忘。
AWS Machine Learning BlogAI 评分1616 在 Amazon Bedrock AgentCore、Managed Knowledge Base 与 Nova Sonic 上构建语音旅行管家
AWS 博客演示如何在 Amazon Bedrock AgentCore 上构建面向航空公司的语音旅行管家,核心由 Amazon Nova 2.5 Sonic 实时语音模型、Strands Agents 框架与 Amazon Bedrock Knowledge Bases 组成。
AWS Machine Learning BlogAI 评分1212 Amazon SageMaker HyperPod 管理与治理最佳实践(基于 SageMaker Unified Studio)
Amazon SageMaker HyperPod 通过 SageMaker Unified Studio 为多个 ML 团队提供共享加速计算资源,核心挑战在于跨团队的治理与权限管控。
量子位 QbitAIAI 评分6868 2026 年诺贝尔物理学奖揭晓:威斯康星大学麦迪逊分校 Francis Halzen 独享奖项
2026 年诺贝尔物理学奖授予威斯康星大学麦迪逊分校 Francis Halzen,表彰他对南极 IceCube 中微子天文台的决定性贡献以及对天体物理起源高能中微子的发现。
Reddit · r/LocalLLaMAAI 评分1010 团队提出用 LoRA 适配器充当 LLM 可切换技能,想验证这是否值得做成产品
一个团队正在验证一个想法:把 LoRA 适配器当作 LLM 的持久化、可切换的专用技能,按需加载或卸载,以减少上下文占用、复用专项能力并可能降低推理成本。他们希望 LoRA 的创建与管理能像维护知识库一样简单,并询问用户是否会在实际场景中使用该方案,以及该思路在哪些场景下不适用。
Reddit · r/LocalLLaMAAI 评分4040 Qwen3.8-Flash-Next 本地运行 vs Claude Opus 5.5:同一 Rust 任务对比实测
网友在 Strix Halo 笔电(128GB)上用 Qwen3.8-Flash-Next(xhigh effort)与 Claude Opus 5.5(medium effort)完成同一 LlamaStash Rust 功能;Flash-Next 约 130 分钟完成并合并,Opus 5.5 约 18 分钟,费用 $7.53 vs 本地 $0 加约 0.15 kWh。
Reddit · r/LocalLLaMAAI 评分2828 基于 Qwen3.5 4B 的本地化书稿校对工具 Betty 跨五语言实测
一位数据科学家自研了名为 Betty 的离线书稿校对应用,底层使用 Qwen3.5 4B 模型,可对约 12 万词的完整小说进行本地化、免费的复制编辑。
Reddit · r/MachineLearningAI 评分77 一名学习者计划从零起步系统梳理 ML 与 AI 发展史,公开征求学习与社区搭建建议
一位 Reddit 用户计划从电路、晶体管和逻辑门开始,系统梳理机器学习与人工智能的发展脉络,涵盖算法、统计、神经网络、深度学习、大语言模型(LLM)与 AI 智能体等主题,并打算以公开学习系列的形式记录进展、提问与讨论。该用户希望就学习方式、内容发布平台(自建博客还是选择 X、LinkedIn、Reddit、Substack、Medium 等现有社区)以及如何吸引同好建立学习社群征求社区建议。
Reddit · r/LocalLLaMAAI 评分2828 超频 DDR5 提升超出 VRAM 容量 MoE 模型的 prefill 与 decode 速度
在 AMD 7950X 平台(4× 双 rank DDR5-5600,128GB)上将 DDR5 从 3600MHz 超至 4800MHz,内存带宽提升约 36%,让超出 VRAM 容量的 MoE 模型在 Intel B70(32GB)上跑 llama.cpp 自定义 SYCL 后端时获得更快的 prefill(PP)与 token 生成(TG)。
Reddit · r/ChatGPTAI 评分55 ChatGPT 在长对话中质量下降的原因及应对建议
用户在使用 ChatGPT 制作教育内容时发现,对话越长,模型输出质量越容易下降。这一现象通常与上下文窗口中相关信息被稀释、模型注意力分散以及早期指令被覆盖有关。可通过定期总结关键信息、开启新对话或使用更结构化的提示词来缓解这一问题。
Reddit · r/artificialAI 评分2626 Row-Bot 5.0 接入 qwen3.8:27b 本地跑通:用一年账单和租约替用户找出漏水与违规涨租
用户在本机 5090 GPU 上用 Ollama 运行 Row-Bot 5.0 搭配 qwen3.8:27b 模型,离线处理了一年份账单、租约、保单和涨租通知(均虚构),识别出水费账单可能存在漏水,并将 10% 的涨租与合同中 5% 的上限及通知期条款 4.1–4.3 对比后判定违约。