跳到正文

#新模型

今日 0 条

Agent · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

agent6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月29日周二
  1. Hacker News · 首页55

    Jeeves:基于 Qwen3.5-9B 的推理决策模型

    Jeeves 是基于 Qwen3.5-9B 的决策模型,使用 SFT 和 CISPO 训练,配备块-4 扩散起草器。在 MMLU 上达到 0.793,MMLU-Pro 达到 0.739。通过扩散起草器实现 1.6-1.76 倍推理加速,批处理时可达约 960 链 token/秒。模型现已开源,提供完整的训练和推理代码。