跳到正文

#开源/仓库

今日 6 条

编程 · 工具·提示词·论文 三栏速览

每栏 1 / 6 · 直达分类页

提示词

6 条
查看全部

论文

6 条
查看全部
今天10月8日周四
10月7日周三
10月6日周二
  1. Reddit · r/LocalLLaMA13

    德国 Aleph Alpha Kolibri 模型通过 Tesseracted 托管生成 Nim 代码

    德国 Aleph Alpha 的小模型 Kolibri 由 Tesseracted 提供托管,在 3code 上用完整小众语言 Nim 写出了一段可运行的小型命令行工具。模型、托管方、运行环境和编程语言均产自德国,体现了德国本土 AI 栈的端到端能力。鉴于模型体量较小,能在 Nim 这类冷门语言上跑通代码被认为颇为难得。

  2. Product Hunt · AI 分类37

    开源 GitHub PR 桌面评审工具 Review:支持多 AI 模型协作审查

    Review 是一款开源(MIT)的免费桌面工具,可在 Mac、Windows 和 Linux 上评审 Git 分支与 GitHub PR,支持逐行评论且发布前保持私密。内置 AI 评审功能,可接入 OpenAI、Anthropic、Gemini、OpenRouter 或通过 Ollama 接入本地模型,并能拆分任务由不同模型分别审查、显示每条规则的命中情况,仅重试遗漏部分。该工具无需账号。

  3. Hacker News · 首页77

    Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率

    Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。

    推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。

10月5日周一
  1. Reddit · r/LocalLLaMA22

    基于 40 万合成数据微调的 1.5B Qwen 模型在 bash 命令生成上达到 gpt-4o 水平,并开源微调数据集

    网友 Comfortable-Rock-498 作为业余项目,将 1.5B 参数的 Qwen 模型微调用于生成 bash 命令,全部使用 40 万条合成数据进行训练,并在该任务上达到 gpt-4o 水平。作者同步开源了微调后的模型与训练数据集,公开了训练与 CLI 流程,欢迎社区自行训练或使用。

9月30日周三
9月28日周一