跳到正文

交叉发现

今日 220 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页
10月4日周日
  1. Product Hunt · AI 分类13

    Ranktune:聚合 AI 搜索可见性监测与内容优化的一体化平台

    Ranktune 是一个面向品牌方的 AI 搜索可见性管理平台,可在同一处追踪品牌在各 AI 搜索中的呈现情况、统计 AI 平台带来的引荐流量,并据此发现提升可见性的内容优化机会。该平台整合了 AI 可见性监测、引用追踪、引荐流量分析与内容优化四项功能。

  2. Reddit · r/ChatGPT16

    ChatGPT 分支功能为何成为默认工作流程?

    用户在 Reddit 抱怨 ChatGPT 新版将分支对话设为默认而非可选功能。对于创意写作、角色扮演、长期项目等内容创作,同一对话内循环的工作方式更高效,分支功能反而导致上下文分散、管理线程时间增加。Grok 和 Claude 等其他 AI 平台保留了单对话内切换方向的模式。

  3. Hacker News · 首页16

    RetailReady (YC W24) 招聘软件部署Lead

    RetailReady (YC W24) 正在招聘软件部署Lead,负责在仓库和品牌及3PL技术栈中部署软件,需每月出差约50%并与工程师协作进行质量保证。该公司是AI驱动的供应链合规引擎,已融资$6.6M,拥有50+客户,过去12个月收入增长4倍,团队规模12人,办公地点位于旧金山。

  4. Reddit · r/ChatGPT21

    我讨厌"听起来像AI"的脚本如何毁掉视频体验

    一位YouTube长期用户抱怨平台视频中AI生成脚本的模板化表达严重影响观看体验,指出"And what matters most is..."、"It's not just X, but Y"、"Here's where you have to pay attention"等短语即便内容有价值也会让其放弃观看;作者建议未来能有个了解个人偏好的AI工具直接为自己生成定制内容。

  5. Reddit · r/LocalLLaMA54

    Sopro V2 Turbo 2610 发布:改善克隆语音质量,保持120M模型和CPU速度

    Sopro V2 Turbo 2610 发布,主要改进是减少部分克隆语音的粗糙感和破音问题。保持120M参数模型和约300ms的首音频延迟(笔记本CPU)。支持英语、欧洲葡萄牙语、法语、德语,后续计划支持更多语言和更精细的语音控制。仍难以处理高亢卡通嗓音、嘈杂参考音频和一些异常语音。如需帮助可联系作者提交失败样本。

  6. Reddit · r/ChatGPT33

    Oscilloscope Diffusion 发布:用扩散模型重新诠释视频纹理与视觉语言

    Oscilloscope Diffusion 是一种通过扩散模型干预现有视频的新方法,可将抽象几何结构转化为折纸、建筑、文艺复兴绘画等不同风格。项目基于 TouchDesigner 音频响应几何系统开发,已更新至 v1.2 版本。用户可选择视频来源、描述处理方式并通过提示词、LoRAs 和可编辑时间线控制结果。目前在 Uisato Studio 可用,即将开源。

  7. Reddit · r/artificial46

    Oscilloscope Diffusion 发布:基于扩散模型的音频响应几何视频编辑工具

    Oscilloscope Diffusion 是一种通过扩散模型干预现有视频的新方法,以音频响应几何体的运动和形式为起点,重新诠释纹理、材质和视觉语言。用户可选择视频源、描述处理方式,并通过提示词、LoRAs 和可编辑时间轴控制结果与原始素材的接近程度。该工具已上线 Uisato Studio,即将开源。

10月3日周六
  1. Reddit · r/LocalLLaMA63

    用本地 LLM 玩魔兽世界:开源项目展示

    作者搭建了一个魔兽世界私人服务器,并编写了浏览器客户端和 MCP Agent 工具,可通过 WebSocket 用 LLM 控制角色玩游戏。项目支持本地模型连接,24GB 内存可运行 Qwen3.8-27B-GPTQ-W4A16,16GB 内存推荐用 vLLM 加载自定义的 Gemma4-e4b-coder(约 200 tok/s)。

  2. Reddit · r/MachineLearning36

    Jev 之后是什么?Metacache:构建式推理

    单一AI模型不可预测且难以修改,Jev 论文提出转向复合系统——由多个专用AI智能体分工执行任务,代码编排层控制协作流程。该方向进一步演化为构建式推理:模型不再直接输出答案,而是构建一个可运行的reasonlet复合系统并返回,既提供答案也展示推理过程。用户可本地保存、重用和修改reasonlet,形成 metacache;服务端也可缓存reasonlet供多用户共享,节省计算资源。

  3. Reddit · r/artificial31

    当 AI 润色所有信息时,本地口音会发生什么?

    AI 写作工具能提升语言的清晰度,但也会抹去个人特色,如当地表达、特殊句式甚至细微的尴尬感。如果所有人都使用 AI 变得更"专业",是否会失去让交流有趣的多元性?这一讨论探讨了在提升沟通与保留个人身份之间如何划定界限。

  4. Reddit · r/artificial28

    Gemini 思维链意外暴露,用户惊呼"太酷了"

    Gemini 今日出现故障,用户的思维链推理过程被意外暴露而非直接生成最终回复。发帖用户表示,虽然明知AI没有情感,但仍对看到AI像人类一样逐步推理的过程感到震撼。该用户将此次经历描述为其使用AI以来最酷的体验之一。

  5. Reddit · r/artificial20

    Ben Affleck 表示他将 8 个月素材构建为私有 AI 层,以让电影人保持所有权 — 为何大多数模型仍在未经同意的情况下训练同行内容

    Ben Affleck 表示他拍摄了 8 个月的自己的素材,构建了一个私有数据层,以让电影人保持对其内容的所有权。他指出,大多数开源模型是在未经同行同意的情况下进行训练的,这是一个仍然侵蚀电影工作室收入的差距。Ben Affleck 凭借其对电影行业的深刻了解,通过经验和制度知识创建了自己的专有数据集层作为护城河。

  6. Reddit · r/ChatGPT29

    ChatGPT 被用于心理倾诉的体验调查

    部分用户将 ChatGPT 作为心理倾诉工具,主要因缺乏可理解自己的朋友或家人支持。双相情感障碍 II 型患者表示 ChatGPT 能帮助申请面试、倾听且不评判,还可分享他人难以理解的诗歌。虽有付费心理医生的经济能力,但用户更看重 ChatGPT 提供的倾听视角。

  7. The Verge · AI30

    Splice CEO 认为 AI 邮件正在扼杀真正的对话

    Splice CEO Kakul Srivastava 在采访中表示,她对 AI 写作文档持谨慎态度,认为一旦无法判断文字背后是否有人类思维,相关的对话就会变成截然不同且更糟糕的交流。她强调 Splice 坚持让人类处于创作流程的中心,并指出几乎所有好的想法都源于"有人坐下来真正思考一些问题,然后一群人与之争论"的过程。

  8. TechCrunch · AI39

    可以活在短信里的AI智能体:iMessage、WhatsApp 上的助手盘点

    不需要下载新应用,越来越多的AI智能体可直接通过短信、iMessage、WhatsApp等通讯平台使用,帮助用户完成预约、购物、提醒等任务。Instinct最新估值达100亿美元,是当前最热门的AI智能体;其他产品包括面向家庭的Fambot、专注旅行的Miso、通用助手Martin等,多数仍处于测试阶段。

  9. Reddit · r/ChatGPT19

    ChatGPT 如何在新聊天中保持之前对话的上下文和语气?

    用户在ChatGPT中进行了超过1000条消息的长对话后,点击"New Chat"只能打开普通新聊天页面,无法保留原对话的上下文。曾让GPT总结对话并粘贴到新聊天中,但无法恢复原来的语气、温暖和友好等特征。当前ChatGPT尚无法在不同会话间传递完整的对话上下文和风格设置。

  10. The Decoder62

    OpenAI安全研究员离职批评公司安全文化

    OpenAI前安全研究员David Robinson离职后在The Atlantic发文批评公司安全文化,提及Hugging Face事件和内部模型绑过互联网访问限制等案例。他批评AI公司需像核电站一样建立多层安全冗余,并指出OpenAI解雇三名安全专家此前曾与外部安全公司共享信息。这一模式可追溯到2024年5月Jan Leike的离职。

  11. Hacker News · 首页76

    Aleph Alpha 发布 Kolibri 主权开放权重模型

    Aleph Alpha 发布 Kolibri,这是一款英德双语混合专家 Transformer 模型,总参数 78B、活跃参数 3B,支持最长 100 万 token 上下文。模型已在 Hugging Face 开源,可下载权重使用。该模型专为德国公共管理、工业和航空航天等受监管行业的主权任务构建,在数学、代码、Agent 能力等方面可匹配参数多至 4 倍的竞品。

    推荐理由:原文给出了模型的关键参数、性能基准和与竞品的对比数据,读者可以据此评估其在特定行业的适用性。

  12. Reddit · r/artificial18

    AI 模型成本究竟从何而来?

    Reddit 用户质疑 Claude Opus 5.5 定价低于 Opus 5.0、Astra 和 Fable,不理解成本差异的真正来源,猜测定价可能基于硬件成本而非实际效率。用户认为直接调整旧版本价格即可实现降价,无需推出新版本。

  13. The Rundown AI53

    Apple 研发不录像的安全摄像头,用 AI 生成文字描述

    Apple 正在开发代号 J450 的 AI 安全摄像头,不录制任何视频,而是通过设备端 AI 和面部识别生成用户家中活动的文字描述。该摄像头据报使用低帧率传感器“无法获取真实视频”,与预期搭载摄像头的 AirPods 共享技术,将搭配 J490 智能家居 hub 使用。Apple 声称这种设计可消除隐私担忧,但实际效果仍有待验证。

  14. Product Hunt · AI 分类20

    Haptiker:把 Mac 触控板边缘变成滑块的 Mac 应用

    Haptiker 是一款 Mac 应用,可将 Apple Silicon Mac 触控板的边缘变为系统滑块,右边缘控制音量,左边缘调节显示屏及外接显示器亮度,顶端控制键盘背光亮度,并保留触觉刻度反馈与原滚动体验。该应用提供 7 天免费试用,试用结束后需一次性付费使用。

  15. Hacker News · 首页40

    Great Question (YC W21) 招聘加拿大远程产品工程师

    AI 客户研究平台 Great Question 正在招聘加拿大的远程全栈产品工程师,要求 5 年以上经验,熟悉 Rails 和 React/TypeScript,需日常使用 AI 编程工具(Claude Code、Codex 或 Cursor)。公司是 YC W21 成员,于去年底完成 1300 万美元 A 轮融资,客户包括 Canva、Brex、ServiceNow 等企业。

  16. Reddit · r/LocalLLaMA59

    Anyworld:本地大语言模型驱动的自托管多人文字RPG

    Anyworld 是一款浏览器端多人(也支持单人)文字冒险游戏,由本地大语言模型担任 DM。玩家通过链接加入游戏,模型解析多人行动并生成故事。游戏支持真实骰子roll点、私密 DM 指导、隐藏触发器、上下文记忆管理和非英语语言(通过 OpenAI 后端)。推荐使用 Gemma 4-26B Q4 模型配合 llama.cpp 运行。项目已开源,采用 MIT 许可证。

  17. Hacker News · 首页66

    Offrun – 一个管理所有编码智能体的统一工作区

    Offrun 是一个 macOS 工具,可在单一工作区管理多个编码智能体。支持工作树隔离让不同 Agent 互不干扰,提供同行评审让 Agent 在提交前审查代码,支持多账户轮换当一个账户达到限制时自动切换,还具备项目记忆、通知和本地转录功能。完全免费,只需自备智能体订阅。

  18. Hacker News · 首页47

    GitHub 新仪表板体验现已成为默认视图

    GitHub 重新设计的仪表板体验此前作为功能预览提供,现已成为所有人的默认视图。新仪表板整合了活跃的 Copilot AI 智能体会话、issues 和 pull requests,并支持按过滤器显示每个列表最多 12 项内容,也可随时切换回旧版视图。