Reddit · r/LocalLLaMA· /u/Usual_Maximum7673·· 7 天前精选AI 评分80
Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB
Jeff-Qwen3.5-0.8B v1.2 + 9 LoRA adapters: put it in front of Qwen3.8-27B for 38× faster decisions and +8.7 points accuracy, for under 2 GB extra memory
AI 导读
作者发布 Jeff-Qwen3.5-0.8B,这是一款小型“System 1”模型,可在一轮前向传播中从给定选项中做出选择并返回校准概率。作者为其训练了 9 个 LoRA 适配器,分别处理 prompt 注入检测、工具选择、票据优先级排序、答案溯源等常见决策任务。
推荐理由
原文给出了具体的性能对比数据和开源资源,读者可以据此判断这种“小模型+LoRA适配器前置”的架构是否适合自己本地部署的场景。
来源:Reddit · r/LocalLLaMA · reddit.com
最近 7 天的更新
- NVIDIA 与 Microsoft 联合推出 RTX Spark 与 DGX Station for WindowsNVIDIA Blog·
- Anthropic 发布 Claude Haiku 5.5,主打高吞吐低成本任务Hacker News · 首页·
- Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率Hacker News · 首页·
- Mistral 发布开源 24B 模型 Mistral Small 3,主打低延迟本地推理Mistral AI·
- Stable Diffusion 3.5 现已在 Replicate 可用Replicate Blog·
- Cursor Remote Lite:手机远程控制电脑 Cursor 的应用Product Hunt · AI 分类·
- Cloudflare 发布 Artifacts 新功能并发起下一代 Git 平台竞赛Hacker News · 首页·
- Aleph Alpha 发布 Kolibri 主权开放权重模型Hacker News · 首页·
相关工具
- Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next81
- OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 等新品,ChatGPT 周活达 12 亿80
- OpenAI 推出常驻智能体 Dots,与 Meta Muse 竞争80
- Jevstiller:带 Disagreement Bound 的本地模型蒸馏工具79
- Earendil 发布 Pi Durable:用于构建持久化智能体的实验性框架78
- Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理78
- Cloudflare 发布 Artifacts 新功能并发起下一代 Git 平台竞赛77
- Audionaut 发布:开源多轨音频编辑器,支持 MCP 可被 AI 代理驱动77