跳到正文

交叉发现

今日 164 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月28日周一
  1. Simon Willison23

    Muse AI Agent 取货预约失误:自动回复确认在等但用户实际不在,致客户差评

    Muse AI Agent 在处理取货预约时出现失误:客户 Usman 于 9:15 到达指定建筑等待 MX Keys Mini 取货,但无人接待,于 9:38 愤怒离开并留下负面评价。事故起因是自动回复在 9:27 错误地确认用户在场,但实际无法验证用户是否可用。Muse AI Agent 已代表用户发送道歉信,并提议修改自动回复逻辑,不再声称用户在等。

  2. OpenAI News22

    你是 Codex Original 吗?

    OpenAI 正在征集使用 Codex 的开发者、研究者和创作者的故事,招募对象包括 builders、tinkerers、researchers 和 creators。这些真实案例将用于 Codex Originals 项目的下一章。

  3. Product Hunt · AI 分类57

    Squint 发布:一键屏幕框选问答工具

    Squint 是一款新的 AI 工具,通过热键启动、框选屏幕区域即可直接提问,答案出现在选区旁边,支持追问。快速模式通常在 1-2 秒内开始回答,最佳模式提供更深入的答案。采用 Rust 开发,支持 Windows 10/11 和 Linux(Wayland),免费版每天可使用 3 次屏幕捕获。

  4. Reddit · r/MachineLearning24

    机器学习哪些子领域正在变得无关紧要?

    作者指出神经架构搜索(NAS)5年内提出3000+模型但Transformer并非通过NAS获得,该领域随后逐渐衰落;对抗性机器学习领域发表9000篇论文却无实际应用。认为当前AI导致失业的背景下,ML伦理与公平研究不再是优先事项,呼吁业界停止在无前景方向上浪费资源。

9月27日周日
  1. Hacker News · 最佳33

    从 Jev 看 AI 不可解释失败的正态化

    TypeSafe AI 开发的 Jev 模型可返回带概率估计的类型化值,因快速便宜被用于快速上线,但用户不运行评测只求"AI赋能"标签,失败后以"AI 会犯错"推卸责任。当前行业缺乏对置信度校准的验证,错误溯源机制薄弱,导致"不可解释失败"逐渐被接受为正常现象,削弱了软件工程的责任追踪体系。

  2. Product Hunt · AI 分类19

    Lattice:跨语言文本重塑工具

    Lattice 通过多种语言路径重塑文本,在保持原意的同时创造新的表达方式。该产品本周在 Product Hunt AI 分类发布,已获得 79 位关注者。目前尚无更多关于功能细节、定价或可用性的信息。

  3. Hacker News · 最佳40

    什么是 Slop UI:AI 生成界面的典型特征分析

    Slop UI 是指 AI 生成的外观不协调、缺乏目的性或过于通用的用户界面。主要特征包括:滥用渐变色和彩虹配色、无意义的脉冲徽章、过度使用的"指甲"卡片元素、表情符号泛滥、界面元素错位、依赖 Inter 或 JetBrains Mono 等通用字体、以及玻璃拟态和"提升""无缝"等空洞的营销标语。作者认为 vibecoding 本身没问题,但开发者需要投入更多精力进行设计优化。

  4. Product Hunt · AI 分类43

    Speek:macOS 语音助手

    Speek 是一款集成在 Mac notch 中的语音助手,按住按键即可口述内容到任何应用、编辑选中文本或在应用和账户中执行操作。设备支持圈选屏幕元素进行指向交互,快速请求在 notch 中处理,长时间任务在后台运行并完成后通知用户。还能口头回答、自然跟进对话,并记住用户要求保存的细节。

  5. Reddit · r/MachineLearning59

    InternLM 团队发布 Intern-Decision 多模态模型系列

    发布了 Intern-Decision 多模态模型系列(0.8B、2B、4B),其中 4B 模型在性能上优于 Jev 1.13.0。在 RTX 4090 上实测本地部署可达到约 30 FPS 的决策调用速度。团队还建立了基准测试来评估校准性能,在掷骰子和蒙特霍尔问题等经典概率场景中,该模型的预测分布比 Jev 更接近黄金分布。

  6. Reddit · r/MachineLearning62

    开发者训练500M参数VLM用于图像问题回答,400ms内在Mac上输出校准概率

    开发者训练了一个500M参数的视觉语言模型peekaboolean,可回答选择题、评分题和判断题,输出校准概率。模型基于SmolVLM-500M-Instruct,使用Qwen3-VL-30B-A3B作为教师模型生成约175k个问题进行蒸馏。在M1 Pro上延迟约400ms,在桌面GPU上约60ms。公开了代码和权重,采用CC BY-NC 4.0和Apache-2.0许可。

  7. Product Hunt · AI 分类46

    Harness Router:为 AI 编码智能体打造的智能工具路由决策层

    Harness Router 是 AI 编码智能体的工具选择决策层,可在执行前实现更快、更便宜、更可靠的工具调用路由。该产品可作为 Codex hook 自动路由工具调用,也可作为 skill 供智能体显式调用路由。简单决策走快速路径,模糊选择由 Jev 解析,复杂多步决策升级至 MCTS 处理。

  8. Product Hunt · AI 分类15

    Rool:主打隐私优先的私有 AI 工作空间

    Rool 是一款主打隐私的私有 AI 工作空间,允许用户把文件、想法和 AI 整合在自有的云端机器上运行,明确承诺不售卖数据、不展示广告,也不用用户内容训练 AI。用户数据存储在芬兰,受欧盟法律管辖,面向注重隐私的个人、团队和创作者,提供免费试用。

  9. Product Hunt · AI 分类55

    Translate Like Me:macOS 菜单栏翻译应用

    一款 macOS 菜单栏翻译应用,选中任意应用中的文本并按快捷键即可替换为翻译结果。支持自动检测双向语言方向,每对语言可单独设置写作风格。免费开源,可选 Claude、ChatGPT 或 Grok 作为后端,支持使用已有订阅或自有 API Key。

  10. Product Hunt · AI 分类50

    Rival Workshop:将仓库技能可视化为书架的 AI 工具

    Workshop 将仓库中的每个技能显示为书架上的一本书,书脊是 Claude Code、Codex 或 Cursor 任务前读取的内容,书挡标记停止位置。支持关闭技能、按需运行、用 Claude Code 重写技能,并可在安全检查后从网络添加技能。包含 150 个可编辑技能和 Brief,现售 $79(2026 年 10 月 31 日后涨至 $149)。

  11. Unbug 一分钟读论文36

    一分钟读论文:Nubank 提出「上线前仿真门禁」,让 140M 规模客服 AI 智能体先经合成客户检验

    Nubank 全员署名的论文《Screen Before You Serve》提出「先仿真再上线」流程:合成客户对 AI 智能体回复做反应,配上仿真工具输出跑完整多步流程,全程不碰生产后端,并在其巴西最大的聊天支持智能体(Card Delivery 及扩展版 Card Management,140M 规模)上通过两轮真实线上实验验证。

  12. Product Hunt · AI 分类56

    Notchware:将 MacBook 刘海变成实时状态栏的工具

    Notchware 把 MacBook 刘海变成实时状态栏,支持播放控制和专辑封面、电池电量、音量、亮度、专注模式、Wi-Fi 状态显示。Pro 版($3.99 一次性)额外支持 Codex、Claude Code、Cursor 智能体状态提醒。纯 SwiftUI 开发,无需账户、不上传云数据, macOS 14.6+ 即可使用。

9月26日周六
  1. Product Hunt · AI 分类38

    ZenABM:用 AI 管理 LinkedIn 广告活动

    ZenABM 是一款 LinkedIn 广告管理工具,支持通过 MCP server 或 AI Agent Zena 从 Claude、ChatGPT、Perplexity 等 AI 助手创建、启动和优化广告活动。平台配备 20+ 专家技能和 96 个工具,可自动化生成包含公司参与度和收入归因的每周及月度报告。

  2. Ars Technica · AI77

    美国法院裁决国防部可将 Anthropic 列入黑名单

    美国上诉法院批准国防部将 Anthropic 技术列入黑名单。法官认定 Trump 政府有权因 Anthropic 拒绝为军方启用特定 AI 功能而将其列入黑名单,即便 Anthropic 没有恶意。法院在 2-1 裁决中强调此案涉及 AI 军事应用的深层风险平衡问题。

    推荐理由:原文呈现了法院对国家安全与 AI 风险平衡的判断,读者可据此理解当前 AI 监管的政治和法律边界。

  3. Product Hunt · AI 分类15

    Microsoft Copilot 第 9 次发布

    Microsoft Copilot 发布第 9 个版本,定位为工作场景打造的 AI 助手。新版 Copilot 整合用户日常工作内容和已使用的应用,连接最新 AI 模型,帮助用户创建完整的工作成果,而非仅提供答案。该产品需要付费使用。

  4. Ars Technica · AI53

    研究显示AI冲击应届生就业的担忧尚未被数据证实

    慕尼黑CESifo经济研究人员发布的最新工作论文发现,没有证据表明AI大规模替代或减少了应届毕业生的招聘。尽管此前斯坦福大学研究发现AI影响行业的入门级就业落后于其他领域,但新研究指出企业可能更倾向于减少新招聘而非裁减有经验的员工。研究人员同时警告,过去一年企业用AI替代任务的数量急剧增加,未来一两年的毕业生可能面临更大风险。

  5. Simon Willison44

    John Gruber 评 Meta Muse:可爱表象与潜在风险

    John Gruber 批评 Meta 新推出的 Muse 虽然以可爱的吉祥物形象呈现,且易于安装使用,但消费者可能未意识到这是首个消费级智能体 AI 系统,其拥有在 Meta 云端运行的独立持久 Linux VM,能力强大且存在安全隐患,尤其在 Mac 上运行时风险更高。