跳到正文

交叉发现

今日 8 条

编程 · 工具·提示词·论文 三栏速览

每栏 1 / 6 · 直达分类页

提示词

6 条
查看全部

论文

6 条
查看全部
今天10月8日周四
  1. Reddit · r/artificial14

    Reddit 用户讨论如何让 Claude、Codex 等模型直接使用 REA、Ghidra 等 MCP 智能体技能进行游戏逆向与 mod 开发

    Reddit 用户反映 Claude 和 Codex 在调用 REA、Ghidra 等 Agentic MCP 技能对专有二进制代码进行反编译和构建 mod 时,反复以法律与版权为由拒绝执行;但同时看到有用户晒出同类模型直接逆向其他游戏、复改代码并合成 pass-through mod 的成功案例。

10月7日周三
  1. Product Hunt11

    SunSed:面向 AI 的应用开发平台

    SunSed 是一款 AI-native 应用开发平台,主打用经过封装的可靠组件替代让 AI 从零生成易碎代码的方式,强调极高的 token 效率、零构建错误,并规避传统 AI 生成器常见的代码腐烂问题。每个订阅捆绑托管服务、独立数据库、事务邮件、用户认证、文件存储和自动备份,目标是让 AI 直接构建可上线的生产级应用。

  2. Product Hunt6

    Reika:一款优先面向本地模型的 coding agent CLI

    Reika 是一款面向本地与托管模型的 coding agent CLI,以本地模型为优先设计目标。它并不能让小模型变得更智能,但能提供更顺畅的日常使用体验;对超出其目标算力区间、运行更大本地模型或托管模型的用户,也能开箱即用获得稳定表现。

  3. Reddit · r/ChatGPT15

    Opus 4.5 与 Sol 6.1 任务完成度对比反差明显

    一名 Reddit 用户用相同的提示词分别测试 Sol 6.1 和 Opus 4.5 两款模型,要求它们在 10 欧元预算内完成一个家庭社交应用的搭建。结果 Sol 6.1 仅停留在"pursuing goal stalled"状态未交付任何成果,而 Opus 4.5 自主选定域名并完成了整个应用的构建。该用户在帖子中以 TLDR 形式总结这一反差,但尚未对最终产物进行测试。

  4. Reddit · r/ChatGPT7

    开发者用 ChatGPT 构建微内核操作系统,寻求加速完成的方法

    一名开发者正在用 ChatGPT 协助构建一款微内核操作系统,目前已实现音频、视频、网络与文件系统等大部分功能,计划以开源许可证发布。作者反馈 ChatGPT 出现响应变慢、修复一个问题常引发其他回归的情况,正考虑切换其他模型或优化提示词,并计划以每次约 300 行代码的节奏继续推进。

  5. Hacker News · 首页27

    Berth:让 Claude Code、Codex 等编码智能体在 Mac 休眠时持续运行的桌面客户端

    Berth 是一款面向 macOS(Apple silicon 与 Intel)的开源桌面客户端,可在本地开发机上运行 Claude Code、Codex 等编码智能体,用户关闭 Mac 后智能体继续工作。支持 ⌘N 一键创建 worktree 并启动智能体,多个 worktree 可同屏对比,命令、读取、diff 均实时呈现;内置 19 套主题并支持自定义聊天背景。

10月6日周二
  1. Reddit · r/LocalLLaMA13

    德国 Aleph Alpha Kolibri 模型通过 Tesseracted 托管生成 Nim 代码

    德国 Aleph Alpha 的小模型 Kolibri 由 Tesseracted 提供托管,在 3code 上用完整小众语言 Nim 写出了一段可运行的小型命令行工具。模型、托管方、运行环境和编程语言均产自德国,体现了德国本土 AI 栈的端到端能力。鉴于模型体量较小,能在 Nim 这类冷门语言上跑通代码被认为颇为难得。

  2. Product Hunt · AI 分类37

    开源 GitHub PR 桌面评审工具 Review:支持多 AI 模型协作审查

    Review 是一款开源(MIT)的免费桌面工具,可在 Mac、Windows 和 Linux 上评审 Git 分支与 GitHub PR,支持逐行评论且发布前保持私密。内置 AI 评审功能,可接入 OpenAI、Anthropic、Gemini、OpenRouter 或通过 Ollama 接入本地模型,并能拆分任务由不同模型分别审查、显示每条规则的命中情况,仅重试遗漏部分。该工具无需账号。

  3. Product Hunt · AI 分类31

    Brnch:面向人与 AI 编码智能体协作的代码托管平台

    Brnch 是一款面向人与 AI 编码智能体协作的代码托管平台,基于 Git 构建,兼容现有工具链。每个 AI 智能体拥有独立身份并由用户作为 sponsor 担保,可追溯到具体代码行的改动;每次合并都对最终落地结果进行测试,并附带可验证的签名回执。

  4. Hacker News · 首页77

    Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率

    Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。

    推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。

10月5日周一
  1. Reddit · r/LocalLLaMA22

    基于 40 万合成数据微调的 1.5B Qwen 模型在 bash 命令生成上达到 gpt-4o 水平,并开源微调数据集

    网友 Comfortable-Rock-498 作为业余项目,将 1.5B 参数的 Qwen 模型微调用于生成 bash 命令,全部使用 40 万条合成数据进行训练,并在该任务上达到 gpt-4o 水平。作者同步开源了微调后的模型与训练数据集,公开了训练与 CLI 流程,欢迎社区自行训练或使用。

  2. Reddit · r/ChatGPT33

    Codex 可基于 YouTube 视频逆向重建 1983 年《Starwars》街机游戏

    用户向 Codex 发送一段 1983 年《Starwars》街机游戏的 YouTube 视频,要求它在 Love2D 中以宽屏比例重新构建,包含 3D 画面、音效、人物对白、关卡、计分板和演示模式。Codex 在约 30 分钟内先从视频中截取截图和音频片段,再用不同语言和平台(非模拟)代码写出了近乎完全一致的复刻版本。