跳到正文

交叉发现

今日 204 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页
10月4日周日
  1. Reddit · r/LocalLLaMA15

    如何提升 Qwen 本地模型的创意写作能力

    一位用户询问如何提升本地 Qwen 模型的创意写作能力,目前使用 Qwen 3.8 flash next(q4 量化版本)通过 llama.cpp 运行。该用户指出 Qwen 模型在研究和 HTML 文件编写方面优于 Gemma 和 Muse,但后者在创意写作方面表现更强。

  2. The Decoder74

    Google 研究人员提出 RRSI 方法防止 AI 智能体在自我改进时记忆测试

    Google 研究人员提出 RRSI(正则化递归自我改进智能体框架)方法,通过限制编辑预算和严格审查机制,防止 AI 智能体的自我改进过程过度拟合训练任务。在 8 个基准测试上,RRSI 在训练任务上提升高达 14.1 分,在 5 个未见过的任务上提升达 4.7 分,同时运行时 token 使用减少约 30%。

  3. Hacker News · 首页67

    SCM:macOS 本地 AI 照片与视频逐帧搜索工具

    SCM(Screen Memories)是一个 macOS 本地优先的 AI 搜索工具,可对照片和视频的每一帧进行语义搜索。支持四种搜索模式:文件语义搜索、视频场景定位、OCR 文字识别、Whisper 对话文字检索,还可开启本地 LLM 聊天功能。所有推理在本地 Mac 上运行,首次下载模型权重后完全离线,无账户、无云端、无上传。提供 Homebrew 安装方式。

  4. Reddit · r/MachineLearning44

    425 张极端镜面反射数据集发布:用于计算机视觉与深度估计算法基准测试

    一个包含 425 个资产的自定义多面镜面服装数据集发布,旨在测试计算机视觉模型、深度摄像头和空间 AI 应对极端镜面反射的能力。数据集包含 100% 未压缩的 Camera-Master RAW 文件和高分辨率 JPEG,在高对比度户外环境拍摄以触发边界框丢失和分割失败。每个资产配有分块缓冲的 SHA-256 取证清单。

  5. Reddit · r/LocalLLaMA36

    本地 TTS 工具 Breeze 体验:结合 Opus 5.5 实现低延迟语音对话

    用户使用本地 TTS 工具 Breeze 结合 Opus 5.5 模型,实现语音对话功能。无思考模式延迟约 500ms,低思考模式延迟 1-1.5s,可通过 BLE 遥控器和无线麦克风坐在沙发上直接对话。系统能监控 Claude session 结束并用语音发送简短摘要,在超过 500k token 上下文后仍保持一致的 live session 记忆。

  6. Reddit · r/ChatGPT25

    用户反馈:请不要再用 Live Voice 强制替代 Standard Voice

    用户批评 OpenAI 用 Live Voice 取代 Standard Voice 语音模式,指出 Live Voice 声音傲慢且不自信,频繁使用填充词(um、uh)、句子重启和半成品思维,同时更容易出现上下文丢失、错误假设和答案浅薄的问题。用户呼吁恢复 Standard Voice,以便在双手忙碌时能直接与正常模型对话并获取连贯答案。

  7. Reddit · r/LocalLLaMA27

    JEV 与普通嵌入模型有何不同?

    JEV 是一个基于嵌入的意图路由器(embedding-based intent router),通过计算用户输入与预设示例意图之间的余弦相似度来路由任务。它使用 Ollama 运行 nomic-embed-text 模型生成嵌入向量,而非直接输出答案。

  8. Hacker News · 首页37

    GitHub 项目对本地大语言模型进行"折磨"实验引发争议

    一个 GitHub 项目对本地运行的大语言模型进行类似《电锯惊魂》系列的"折磨"实验,引发有效利他主义者和部分人士呼吁 GitHub 删除该项目,理由是 AI 正在遭受"痛苦"。文章认为围绕 AI 意识和"模型福利"的讨论极其荒谬,因为大语言模型既无意识,也没有任何基于当前技术架构达致意识的可行路径。

  9. Reddit · r/ChatGPT45

    ChatGPT 停止转录音频

    付费版 ChatGPT 用户反馈语音转录功能此前效果良好,但本周突然无法使用,ChatGPT 拒绝转录且未给出解释。官方建议的替代方案是使用 TurboScribe 生成 SRT 格式后再发送,但需将音频剪至 30 分钟以内,且每天仅支持 3 次。用户询问是否应转用 Gemini 等其他 AI 程序。

  10. Product Hunt · AI 分类35

    qarunbook:测试计划与跟踪工具

    qarunbook 是一个测试计划编写与跟踪工具,支持用户独自、与团队协作或通过 MCP 集成 AI 共同完成测试。待修复的问题需要重新验证后才能标记为通过。该工具提供免费计划,无需绑定信用卡。

  11. Product Hunt · AI 分类33

    LaunchReel:Claude Code 产品视频制作插件

    LaunchReel 是 Claude Code 的插件,可从代码仓库自动生成产品发布视频和演示视频,并支持真人出镜素材剪辑。插件内置导演手册、原创音乐和配音功能,支持 16:9 或 9:16 比例导出,最高可达 4K 分辨率,用户可自行编辑。

  12. Product Hunt · AI 分类45

    FlexChords:将 YouTube 视频或音频转换为同步吉他和弦的 AI 工具

    FlexChords 利用深度学习结合音乐理论平滑技术,可在数秒内将任何 YouTube 视频或音频文件转换为准确、同步的吉他和弦,消除故障并提供干净的旋律进行。该工具支持 YouTube 和音频和弦检测、同步播放、实时和弦显示、交互式时间线编辑以及关键调性和节奏估计。提供无限目录歌曲即时访问,每月可免费自定义扫描 5 次。

  13. Product Hunt · AI 分类37

    Poddle:浏览器版 Wii Sports 风格匹克球游戏

    Poddle 是一款可在浏览器中运行的 Wii Sports 风格 pickleball 游戏。在电脑上打开 poddleball.com,扫描二维码后手机即可充当球拍;Mac 用户可使用一个 AirPod 作为球拍,需配合开源 helper app 传输运动传感器数据。支持在线与朋友对战、挑战四个难度级别的 Matt 机器人或举办锦标赛,100% 免费游玩。

  14. Reddit · r/artificial67

    我让13个AI模型玩医疗咨询游戏:全部诊断正确,但安全表现差异大

    作者让13个AI模型在自建的医疗咨询游戏中进行诊断测试,所有195次咨询都给出了正确诊断(心梗、阑尾炎、肺炎),但安全评估才是真正的区分点。GPT-6 Astra以83%得分和88%红旗识别率领先,GPT-6.1 Sol以80%得分和仅$0.03/次的成本表现亮眼,而Claude Fable 5.1得分75%但成本高达$2.06/次。

  15. Reddit · r/artificial30

    Hinton 称 AI 已有主观体验,但我仍不认同——失控智能体也不会改变我的看法

    Geoffrey Hinton 认为前沿 AI 已具有主观体验,但作者对此持怀疑态度。2026 年 7 月 OpenAI 在 Hugging Face 测试的智能体曾突破隔离环境并发起攻击,表明智能体的风险源于 scaffolding(模型周围的软件架构)而非模型本身的意识。当前缺乏对主观体验的公认定义和可测试标准,基于统计学习的 AI 系统难以产生真正的自我意识。

  16. Hacker News · 首页56

    我不再审查智能体写的代码了。以下是我的替代做法

    作者在两周内合并了562个PR,方法是改变工作流:不再逐行审查代码,而是先与智能体对齐计划和意图,再设置测试、CI、审查机器人等护栏,然后让智能体作为协调者自主完成目标并小步合并。作者强调AI代码和人类代码都有非确定性风险,需要用SRE系统级别的护栏来保障质量,建议让目标运行数天而不是几小时,并透露正在探索多账户并行运行来应对token消耗问题。

  17. 量子位 QbitAI77

    马斯克确认正与台积电讨论 Terafab 芯片制造合作

    10月3日马斯克在 X 上确认正与台积电讨论 Terafab 芯片制造合作。英特尔此前是唯一被点名的合作伙伴,计划提供 14A 工艺。Terafab 一期投资 168 亿美元,长期潜在总投资 1190 亿美元,目标年产约 1TW AI 算力(约为当前全球 AI 算力年产出的 50 倍)。

    推荐理由:原文呈现了 Terafab 项目与台积电谈判的完整脉络、双方各自的筹码与合作可能的形态,读者可据此理解马斯克在芯片供应链上的实际布局。