#端侧
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#端侧
今日 2 条编程 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/MachineLearningAI 评分3939 开发者用 1.26M 参数模型将 htop、vim 等 TUI 实时转成 A2UI 组件
开发者训练了一个 1.26M 参数的轴向 Transformer 模型,对 TUI 屏幕的 15 类角色进行标注,再用确定性逻辑转为 Google A2UI 协议组件,使客户端无需运行终端模拟器即可接收真实 UI,按键作为 Button 动作回传。
Reddit · r/LocalLLaMAAI 评分2828 Liquid AI 发布 d1-omni-600M,作者用 WebGPU 在浏览器中运行
Liquid AI 发布 600M 参数的 d1-omni-600M 决策模型,作者将其移植到自研的 WebGPU 推理库 runntime,纯 TypeScript 实现并直接加载 HF safetensors 权重,无 WASM 中间层。
Reddit · r/LocalLLaMAAI 评分3939 Qwen3.8-Flash-Next (125B) 在单台 Strix Halo 迷你 PC 上跑通:投机解码下 44-59 tok/s,开源推理引擎同步发布
团队在搭载 Ryzen AI Max+ 395、128 GB 内存的 Strix Halo 迷你 PC 上成功运行 Qwen3.8-Flash-Next(125B MoE,激活 6B),并同步开源其推理引擎 Kyojin(基于 ExLlamaV3 构建)。
Reddit · r/LocalLLaMAAI 评分4444 SPOPI: 允许 Pi 自己修改的本地 AI 编程 UI 和编辑器
开发者推出 SPOPI,一个围绕 Pi(本地 AI 编程工具)构建的 UI 和编辑器,采用 Tauri 2 + Rust 开发,使用系统原生 Webview。该工具完全本地运行、离线可用、无遥测数据,其核心特点是 Pi 可以实时修改 UI 界面,如布局、颜色、按钮等,并自动支持新功能包。
Reddit · r/LocalLLaMAAI 评分3434 本地跑酷模拟器实现:GLM-4-Flash + 2x DGX Sparks + vllm TP2 推理
开发者在 2x DGX Sparks 服务器上运行 GLM-4-Flash 模型,实现完全本地化的跑酷模拟器。采用 vllm TP2 方案,Prefill 吞吐量约 1500token/s,Decode 约 40token/s,支持 100k 上下文。
Product HuntAI 评分2626 Thalia:一款面向 Meta Muse Code CLI 的免费原生 Mac 应用
Thalia 是一款面向 Meta Muse Code CLI 的免费原生 Mac 应用,提供计划模式、全命令预览、Review 快照审批、Checkpoints、MCP 连接器、语音模式以及内置终端等功能。应用使用用户自己的 Muse 权限,不上传遥测数据,目前仅支持搭载 Apple Silicon 的 macOS 27 设备。