#开源/仓库
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源/仓库
今日 22 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Hacker News · 首页AI 评分4545 OpenAI 开源数学论文与证明成果仓库,含 722 篇手稿与 Lean 形式化
OpenAI 在 GitHub 开源了一份数学论文与证明仓库,包含 722 篇由内部模型生成的数学手稿,归为 372 个研究族类,多数配有 Lean 形式化证明。模型被投喂约 4,000 个开放问题,平均每项结果使用 3 小时 ChatGPT Pro 思考算力,部分成果涉及黎曼 ζ 函数无零点区域与 Hodge 猜想证明。
TechCrunch · AIAI 评分3838 Musubi 如何用决策模型改造内容审核
Musubi 发布开源轻量级决策模型 PolicyLM-1.7B,专门用于实时内容审核,可在 50 毫秒内将英文政策套用到消息内容,输出是否符合的二分类判断。该模型成本和速度与现有 AI 分类器相当,但具备现代 LLM 的灵活性,可在政策变更时无需重新训练即可迭代。
Google DeepMindAI 评分5555 Google DeepMind 发布端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数量为 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
Reddit · r/MachineLearningAI 评分1818 AFP-GIC:可控生成式图像压缩框架在 IEEE Access 发表
AFP-GIC 框架发表于 IEEE Access(2026),针对超低码率场景,通过非对称自适应融合先验迁移管道,在不传输融合先验的前提下实现先验引导的纹理重建。
Reddit · r/LocalLLaMAAI 评分4040 EmpirioLabs 开源 Aplomb 1 决策模型:5.3B 参数、1M 上下文、4B 级 Decision Index 第一
EmpirioLabs 发布 Aplomb 1,一款 5.3B 参数、开放权重的决策模型,单次请求可处理 1M token 的文本、JSON、图片和音视频,在 Decision Index 0.2.1 上得 44.86,居 4B 模型榜首,并在 38 项基准中的 8 项(含 MMLU-Pro、GPQA Diamond、BBH)拿下 5.3B 及以下模型的最高分。
Reddit · r/LocalLLaMAAI 评分2323 基于 Qwen3.5-9B 微调的"Bev"决策模型:故意选错答案的对照测试用例
作者基于 Qwen3.5-9B 微调出决策模型 Bev,借助 Bespoke Nimble adapter 微调 51 分钟后,使她在 324 条 held-out 决策上答对率仅 1.9%、平均置信度 96%,置信度 ≥90% 时答对率仅 1.4%。
Hacker News · 首页AI 评分4242 PhotoCraft:用 Rust 纯原生重写的开源 Photoshop 兼容图像编辑应用 PhotoCraft
PhotoCraft 是一款用 Rust 从零重写的开源图像编辑应用,对标 Adobe Photoshop。它支持图层、蒙版、调整图层、文字、矢量、画笔和真实 PSD 文件读写,使用 wgpu 跨平台 GPU 合成(Metal、Vulkan、DX12、WebGPU),无网络依赖、免账号。
Reddit · r/LocalLLaMAAI 评分3131 21M 模型外挂 6.4B 参数查找表:性能追平 114M dense 模型,NVMe SSD 即可承载
作者在 21M 模型外挂一张 16.8M 行、6.4B 参数的查找表,在 500M Wikipedia token 训练下性能接近同条件下的 114M dense 模型。
Reddit · r/LocalLLaMAAI 评分1515 llama.cpp 新增 K2 Horizon dense 与 MoVA 模型支持
llama.cpp 提交 PR #29535,新增对 K2 Horizon dense 与 MoVA 模型的支持。该 PR 由 bitalov 提交,目的是在 ggml-org/llama.cpp 中加入上述模型架构的推理能力。
Reddit · r/LocalLLaMAAI 评分4545 Google DeepMind 开源多模态嵌入模型 EmbeddingGemma 2,可在消费级硬件端侧运行
Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本(含代码)、图像、视频和音频输入统一映射到 768 维向量空间。模型共 740M 参数,由 270M 文本模型与 170M 视觉、300M 音频编码器组合而成,专为手机、笔记本等消费级硬件上的低延迟语义表示设计,支持搜索、RAG、分类与聚类等端侧应用。
Hacker News · 首页AI 评分3535 openTPU:由 AI 设计的开源 AI 加速器,可在 FPGA 上跑通十款现代模型
openTPU 是一款由 AI 智能体参与设计的开源 AI 加速器,目标是用 AI 来设计并运行自身推理的芯片。项目以单一 monorepo 公开了 SystemVerilog 硬件设计、指令集、bit-exact 模拟器、内核语言与编译器,以及驱动 PCIe 卡的宿主软件。
Reddit · r/LocalLLaMAAI 评分5050 EmbeddingGemma 2:Google DeepMind 开源多模态嵌入模型
Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,总参数量 740M,可将文本(含代码)、图像、视频和音频统一映射到 768 维向量空间,支持 RAG、检索、分类与聚类等本地应用。
Reddit · r/LocalLLaMAAI 评分1515 Qwen3.8-Flash-Next 在 Strata 上获得 Strix Halo 机器的官方实验性支持
Strata 面向 Strix Halo 机器新增对 Qwen3.8-Flash-Next 的官方实验性支持,目前仅在 Linux 上可用。该实现基于 Unsloth 的 Q4 和 GSQ-RS 模型权重,在长上下文解码与 ppts 上表现最佳,上下文长度最高可达 1M 而速度损失不大,作者欢迎反馈和 pull request。
Hacker News · 首页AI 评分2525 Tapo 开源 Rust/Python 客户端在 v0.11.1 加入 TPAP 协议支持,可在 TP-Link 第三方兼容开关关闭时控制插头与灯具
tapo 开源 Rust 与 Python 客户端在 v0.11.1 新增对 TP-Link TPAP 协议的支持,使运行固件 1.4.0 及以上的灯具、插头、插线板和 H100 hub 能在 Tapo 应用的"Third-Party Compatibility"开关处于关闭状态时被客户端连接,无需修改代码。
Reddit · r/LocalLLaMAAI 评分1212 Terminal Soliloquy:连接 llama.cpp 的终端艺术装置,实时展示模型上下文窗口耗尽前的独白
开发者推出 Terminal Soliloquy,一款连接 llama.cpp 的终端艺术作品,可在模型上下文窗口逐渐填满的过程中实时显示其独白,并配有复古磷光显示外观。该项目可全屏运行在 Raspberry Pi 上接入 1960 年代的老式便携电视;上下文耗尽时,显示器可配置为冻结、重启或退出。
Hacker News · 首页AI 评分7070 Mistral 发布 Mistral Large 4:490 亿激活参数的开源多模态 MoE 模型
Mistral 发布 Mistral Large 4,定位为开放权重的通用多模态模型,采用细粒度 Mixture-of-Experts 架构,拥有 49B 激活参数与 1.05T 总参数,并配备 1.6B 视觉编码器。文档地址:https://docs.mistral.ai/models/mistral-large-4-0
Reddit · r/artificialAI 评分1111 开源可视化 Agent 画布工具:用涂鸦和标注直接引导 AI 智能体
开发者开源了一款可视化 Agent 画布工具,用户可在工作区中对画面进行指点、涂鸦和注释,直接以视觉方式引导 AI 智能体完成视觉编辑任务。该工具在 fullstack 开发、仿真和机器人场景中均验证可用,开发者认为视觉工具栏和画布注释应成为 Agent 平台的标配高层抽象层,并按领域定制。项目已在 GitHub 开源。
The Rundown AIAI 评分4040 Reflection AI 发布首款开源模型 Beam,主打低算力与效率
Reflection AI 推出首款开源模型 Beam,面向编码和智能体场景,号称以更低算力和成本对标中国开源模型。官方称其推理与编码表现接近 Z.ai 的 GLM-5.2,权重将于本月以 Apache 2.0 许可证发布,允许企业自托管定制。
Reddit · r/LocalLLaMAAI 评分1515 NInfer6000 在 RTX 6000 上跑 Qwen 3.8 Flash Next,token 生成达 400 tg/s
网友基于 NInfer 改写的 NInfer6000 分支在 RTX 6000(96GB VRAM)上运行 Qwen 3.8 Flash Next,将非专家层从 16-bit 下采样到 8-bit 并启用 MTP3 解码与小型 drafting head 后,在理想条件下达到 400 tok/s 生成速度。
Reddit · r/MachineLearningAI 评分1717 论文 "Learning to Learn a Language":用合成非语言先验实现自然语言上下文学习
一篇名为"Learning to Learn a Language"的论文提出在上下文学习自然语言的方法,用从随机循环因果模型采样的合成序列作为先验,训练一个 300M 参数的 byte-level Transformer,仅用这些合成序列训练后即可在测试时预测真实语言。
Reddit · r/LocalLLaMAAI 评分1313 德国 Aleph Alpha Kolibri 模型通过 Tesseracted 托管生成 Nim 代码
德国 Aleph Alpha 的小模型 Kolibri 由 Tesseracted 提供托管,在 3code 上用完整小众语言 Nim 写出了一段可运行的小型命令行工具。模型、托管方、运行环境和编程语言均产自德国,体现了德国本土 AI 栈的端到端能力。鉴于模型体量较小,能在 Nim 这类冷门语言上跑通代码被认为颇为难得。
Reddit · r/LocalLLaMAAI 评分3131 腾讯开源 Octop:本地自托管多智能体 AI 助手
腾讯开源 Octop,一款完全自托管的多智能体 AI 助手,提供 Web 控制台、CLI 与 IM 集成,单进程启动即可使用。它支持桌面客户端(Windows / macOS / Linux 及 FnOS NAS 包)和 Docker 部署,通过多智能体架构为团队、家庭和个人构建独立且协作的智能环境,所有数据完全运行在用户本地机器上。
Reddit · r/LocalLLaMAAI 评分2828 基于 Qwen3.5 4B 的本地化书稿校对工具 Betty 跨五语言实测
一位数据科学家自研了名为 Betty 的离线书稿校对应用,底层使用 Qwen3.5 4B 模型,可对约 12 万词的完整小说进行本地化、免费的复制编辑。
Reddit · r/LocalLLaMAAI 评分3434 DynamicTune 用闭式权重手术让 Qwen3.5-0.8B 在 ARC-Challenge 上超越 2B 模型
DynamicTune 提出一种无需反向传播的闭式权重手术方法,仅用约 12 分钟在消费级硬件上把 4B 模型的轨迹动力学迁移进 Qwen3.5-0.8B 学生模型。
Reddit · r/LocalLLaMAAI 评分2929 开发者发布 Chrome 扩展,用浏览器内本地小模型过滤 YouTube 信息流
开发者发布 Chrome 扩展 opendecider-focus 0.8.1,通过 ONNX Runtime Web 在浏览器内加载 opendecider-nano 模型,对 YouTube 视频标题分类并按用户规则隐藏特定类型内容,全程不上传数据、离线运行。
Hacker News · 首页AI 评分2020 在 Firebird SQL 数据库中通过 WASM 模拟并渲染 DOOM
一个开源项目将经典游戏 DOOM 完全运行在 Firebird 6(编译为 WebAssembly)的 SQL 数据库中,并在浏览器内可玩。每个游戏 tick 通过 PSQL 过程调用实现,每一帧通过 SELECT 查询生成,JavaScript 仅负责读取键盘与绘制像素。项目直接读取 DOOM 源码中的 WAD 数据与怪物、地图等表结构,并提供 BSP 剪裁与暴力两种墙柱渲染器。
Reddit · r/LocalLLaMAAI 评分4444 用闭式轨迹权重手术把 Qwen 3.5 4B 能力迁移到 0.8B:中间层为何崩溃及 4 个锚点块如何修复
研究者提出一种跳过反向传播的闭式轨迹匹配方法,通过正则化最小二乘和谱投影直接把 Qwen 3.5 4B 的层间隐藏状态轨迹迁移到 0.8B 学生模型;起初编辑全部 24 层导致 NLL 暴涨 64.78%。
Product Hunt · AI 分类AI 评分3737 开源 GitHub PR 桌面评审工具 Review:支持多 AI 模型协作审查
Review 是一款开源(MIT)的免费桌面工具,可在 Mac、Windows 和 Linux 上评审 Git 分支与 GitHub PR,支持逐行评论且发布前保持私密。内置 AI 评审功能,可接入 OpenAI、Anthropic、Gemini、OpenRouter 或通过 Ollama 接入本地模型,并能拆分任务由不同模型分别审查、显示每条规则的命中情况,仅重试遗漏部分。该工具无需账号。
Product Hunt · AI 分类AI 评分3333 开源桌面工具 Scumble 发布,主打本地 ComfyUI 与多模型 API 的 AI 局部重绘编辑
Scumble 是一款免费、开源的桌面端 AI 局部重绘编辑器,用户框选画面区域并用文字描述应替换内容,结果会输出为独立且色彩匹配的图层。它支持在本地 ComfyUI 环境下运行,也可接入用户自己的 FLUX 3、GPT Image、Nano Banana 等 API key 调用。
Reddit · r/LocalLLaMAAI 评分7272 LocalMind 在浏览器标签页中流式运行 Gemma 4 26B-A4B 与 Qwen3.6 MoE 模型
作者发布 LocalMind:一个通过 WebGPU 在浏览器标签页内运行的静态网页推理引擎,新增两套可在生成过程中按需从磁盘流式读取 MoE 专家权重的引擎。
Latent SpaceAI 评分4848 Reflection 发布 Beam:501B 总参 / 23B 激活的开源 MoE 编程模型
Reflection 发布 Beam,一款文本模型,总参数 501B、激活 23B 的 MoE,面向编程、智能体和科学场景,从零训练并计划于本月以 Apache 2.0 开源完整权重,团队称其在 SWE-bench Verified 上拿到 80.9,推理效率据称是 GLM 5.2 的 3–4 倍。
Reddit · r/LocalLLaMAAI 评分4040 Memoria 1.0.0:面向本地大语言模型的模型无关记忆系统发布
开发者发布 Memoria 1.0.0,一个本地优先、模型无关的大语言模型记忆系统,可在无 LLM、无云服务、无 API key 的环境下运行。
Reddit · r/LocalLLaMAAI 评分6565 研究称 38% 的 AI 智能体容器逃逸不依赖内核 0-day,作者公开数据集与防御 Harness
作者对 109 起自主 AI 智能体安全事件做实证复盘,覆盖 193 项证伪标准与 199 项评估指标。数据显示 38% 的容器逃逸并未利用内核或虚拟化 0-day,而是来自把 /var/run/docker.sock 挂载进沙箱、把父进程环境变量透传给子智能体、缺乏工具输出污染追踪导致间接 prompt injection,以及未限制本地 socket 绑定引发 SSRF。
Reddit · r/LocalLLaMAAI 评分1818 社区为 96GB M5 Ultra Mac Studio 发布 Swift 1.5 Qwen3.8 Flash 的 MLX 量化版本
网友 DankpawsDev 针对搭载 M5 Ultra 的 96GB Mac Studio,发布了 UkisAI Swift 1.5(基于 Qwen3.8 Flash)的 MLX 校准量化版本,文件约 107GB,仅文本、实测 179,200 token 上下文。
Reddit · r/LocalLLaMAAI 评分1919 ik_llama.cpp fork 新增 MoE 优化:专家常驻显存与自适应 CPU/GPU 混合执行,支持 Q2_0 量化
开发者基于 ik_llama.cpp 推出新 fork,引入带宽自适应的 CPU/GPU 混合执行与 MoE 专家常驻(expert residency)机制,并新增 Q2_0 量化支持。
Hacker News · 首页精选AI 评分7777 Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。
推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。
Reddit · r/LocalLLaMAAI 评分88 用 FFT 替换 AdamW 优化器状态以削减 VRAM:非量化显存压缩方法的社区探索
Spectra-Global 团队针对 8B 与 70B 模型在消费级 GPU 上微调时的 OOM 问题,放弃 8-bit 量化方案,转而将 AdamW 优化器状态通过 FFT 变换到频域处理:动态丢弃低能量频率并压缩后逆向重建,VRAM 用量下降约 50%,避免量化带来的收敛退化;代价是 FFT 计算带来单步延迟略增。
Reddit · r/LocalLLaMAAI 评分1313 AnyJev:把任意 LLM 转为 Jev 式决策模型的 Nokia 应用研究项目
Nokia 应用研究中心发布 AnyJev 项目,可在单次前向传播中从 LLM 内部状态直接得出可信决策,无需生成循环、解析或微调。该方法可将大语言模型改造为快速、低成本且确定性输出的分类器,把生成式模型转为推理型决策模型。
Ars Technica · AIAI 评分2121 开源命令行工具 RemoveMacAI 可一键移除 macOS 27 的 Apple Intelligence
RemoveMacAI 是一款开源命令行工具,能通过配置 profile 并经 System Settings 批准来移除 Apple Intelligence。
Reddit · r/LocalLLaMAAI 评分2929 Observer:开源免费的本地大模型屏幕监控工具指南
用户 Roy 开源了名为 Observer 的应用,让本地大模型在浏览器或桌面上监控屏幕并发送通知。WebApp 基于 transformers.js,可在浏览器内直接下载模型运行 Qwen3.5-0.8b,但暂不支持 Linux;桌面版基于 llama.cpp + Rust,稳定性更高,也支持接入任意 OpenAI 兼容 API。项目已在 GitHub 完全开源。