交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 45 条洞察 · 工具·提示词·论文 三栏速览
每栏 4 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/artificialAI 评分1212 sim-to-real 迁移目前在哪类机器人任务上真正可靠?
多数论文在仿真中取得亮眼结果,但真实部署视频仍很少见;Boston Dynamics 等少数团队已在 locomotion 上跑通,杂乱家庭环境中的 manipulation 仍进展有限。讨论认为,差距来源尚不明确,可能涉及传感器噪声、actuator 建模或其他因素。
Reddit · r/artificialAI 评分66 ASI 真的会改变社会吗,还是可能永远实现不了?
多数 AI 乐观主义者相信终将实现 ASI 并彻底改变社会,但也有人质疑 ASI 可能永远无法达成。文中列举的潜在障碍来自对 ASI 解决疾病、衰老、犯罪等所有问题的乐观预期本身,而非某个具体技术限制。该讨论源于 r/artificial 社区的开放提问,未给出技术或研究层面的明确结论。
Reddit · r/artificialAI 评分1111 完成 CPD 认证的 AI 精通课程后总结:真正值得记住的 5 件事
一位用户在 Reddit 分享完成 CPD 认证 AI 课程的 5 条心得:提示词技能占整体能力的 80%,工具选择远不如使用方式重要;建议组合使用 ChatGPT、Claude、Midjourney、Lovable 等工具,分别负责起草、生成图像和快速上线。AI 辅助写作的关键在于像编辑一样修改而非被动采用,图像和视频生成则更像"下达创意简报"的能力,效率提升来自工具之间的协同工作流。
Reddit · r/artificialAI 评分66 Reddit 用户推算:用 1 个月纯素饮食可抵消 3 年重度 AI 使用的环境影响
Reddit 用户 Kilroy_jensen 制作了一个简易计算器,将个人 AI 使用的环境影响换算为素食/纯素饮食可抵消的时长。该用户称自己作为重度 AI 用户,1 个月的纯素饮食可抵消 3 年的 AI 环境影响(含训练成本),而普通用户的对应抵消时长约为 45 年。该计算器还提供可展开的下拉菜单,展示具体可避免的动物数量明细。
Reddit · r/LocalLLaMAAI 评分4545 Google DeepMind 开源多模态嵌入模型 EmbeddingGemma 2,可在消费级硬件端侧运行
Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,可将文本(含代码)、图像、视频和音频输入统一映射到 768 维向量空间。模型共 740M 参数,由 270M 文本模型与 170M 视觉、300M 音频编码器组合而成,专为手机、笔记本等消费级硬件上的低延迟语义表示设计,支持搜索、RAG、分类与聚类等端侧应用。
Reddit · r/ChatGPTAI 评分77 完成 CPD 认证的 AI 掌握课程后,总结出 5 个真正值得记住的要点
一名用户在完成覆盖 ChatGPT、Claude、Midjourney、Lovable 和 Jasper 的 CPD 认证 AI 课程后,总结出五点核心心得:提示词技巧占技能的 80%。
Reddit · r/MachineLearningAI 评分2323 Transformer、RNN 与 SSM 的记忆机制对比:从循环状态、KV cache 到类突触连接
作者从"工作记忆"视角比较了 RNN、Transformer 与 SSM 三类架构的记忆承载方式:RNN 将记忆压缩为逐步传递的循环隐藏状态,参数规模约 O(N²) 而状态仅 O(N);Transformer 在推理时冻结权重,以不断增长的 KV cache 保存历史键值,更像便利贴式的外部上下文;SSM(如 Mamba)回到定长循环状态,并通过输入依赖机制决定遗忘。
Microsoft ResearchAI 评分1818 Microsoft Research 播客:Jennifer Neville 谈 AI 评测的边界与失败带来的启示
Microsoft Research 播客邀请合作研究经理 Jennifer Neville 与首席应用科学家 Chad Atalla 对谈,探讨 AI 评测如何推动模型性能边界,以及当测试超出传统 benchmark 时出现的"意外失败"。
Reddit · r/ChatGPTAI 评分1212 ChatGPT Pro 订阅体验下滑:Reddit 用户吐槽"enshitification 直到涨价才会停止"
Reddit r/ChatGPT 用户反映 ChatGPT Plus 计划近期体验下滑,每个问题都会触发新的模型推荐建议,基础 PowerShell 命令被改写成复杂代码,且该推荐提醒约每 90 秒出现一次,质疑产品优先级已偏向引导 Pro 订阅升级。
Reddit · r/ChatGPTAI 评分4040 用户实测 GPT-6.1 Sol:替换种族词后 AI 评判出显著不同的"有利对待"比例
用户用 96 个提示词模板、四种族(白人、黑人、亚裔、原住民)替换并各跑三次,从 Codex CLI 共收集 GPT-6.1 Sol 的 1,152 条回复,由同模型以盲评方式分类。
Reddit · r/LocalLLaMAAI 评分2727 小型推理模型(SRM)会成为下一波趋势吗?应该用什么指标来评估?
小型推理模型(SRM)因 Pathway 在 ARC-AGI-1 上的结果再次引发讨论——其主张是,若模型在潜空间中原生推理,就不必依赖数十亿参数来解逻辑题,可在成本-精度帕累托前沿上跑出小模型方案。
Simon WillisonAI 评分2020 Claude Opus 5.5 游戏音乐生成体验:意外复刻 Monkey Island 风格
Simon Willison 测试 Claude Opus 5.5 设计文本格式并生成电脑游戏音乐,模型输出的曲目在风格上贴近经典游戏《猴岛秘密》(Secret of Monkey Island)原作,质量令人意外。他怀疑这种音乐生成能力与近期出现的文生 3D 图形类似,是近几个月才在文本模型上涌现的新能力,但仍需用其他新旧模型对照验证是否真正新鲜。
Hacker News · 首页AI 评分1818 Vibecoding 不如手写代码有趣:一位开发者的亲身体验与反思
一位开发者在尝试 AI 辅助编程(vibecoding)后发现,尽管 vibecoding 能让原型快速成型并带来短期快感,但手写代码过程中"硬啃下来的成就感"和"学习带来的乐趣"无法被 AI 替代。
Reddit · r/ChatGPTAI 评分1313 关于 ASI 可能反向评测人类的思考:当超智能把我们当作需要采集的数据
一名网友提出一种猜想:当 ASI(超级人工智能)需要预测现实时,人类本身就是它必须采集的数据来源,因为我们具备训练集中不存在的"活体发散性"与不可预测的横向跳跃,AI 在收敛训练中反而面临模型坍塌。评论者进一步指出,人类恐惧的"无用感"可能并非源于 ASI 的善意,而是它需要这种可再生的真实人类异质性来补充自身无法合成的信息源。
Reddit · r/ChatGPTAI 评分2020 用户分享仅用 ChatGPT 打赢三起不同级别诉讼的经历
一位 Reddit 用户称仅依靠 ChatGPT、未经律师协助,便在 3 起不同层级的诉讼中胜诉,包括一起小额诉讼、一起租务相关案件以及一起就业扣押案件,并获得法院判决的补偿。用户希望该模式能被更多人使用并征集类似经历。
Reddit · r/LocalLLaMAAI 评分44 r/LocalLLaMA 版主无说明删除关于 Looped Transformers 的高赞帖子,用户公开质疑版主团队
r/LocalLLaMA 社区用户反映,其讨论 Looped Transformers 优缺点的帖子获得 300 多赞和数百条评论后,被版主无说明删除,且这并非首次被删高热内容。该用户自称 AI 研究者并有多项开源贡献,公开质疑现任版主团队是否称职,并呼吁平台解释删除原因。
Reddit · r/LocalLLaMAAI 评分2222 WaveFront Decoding:为 Looped 语言模型设计的并行自推测解码框架
WaveFront Decoding(WFD)是一种面向 looped 语言模型的无训练自推测解码框架,通过将对角 wavefront 上的浅层草稿生成与全深度验证在同一批循环调用中并行执行,把传统草稿-验证分阶段调度合并为并发流程。
Reddit · r/artificialAI 评分1515 AI 让一切更快:我们准备好应对它带来的压力了吗?
AI 显著压缩了单项工作耗时,却未必为员工换来真正的闲暇,而是可能让雇主把原本两天的报告工作量变成一天五份。作者担心 AI 工具在提升效率的同时会悄然抬高工作节奏的上限,并提出疑问:如何确保 AI 把时间真正还给员工,而不是只把速度门槛抬得更高。
Reddit · r/artificialAI 评分1515 SaaS 公司会重演 2000 年代初音乐行业的命运吗?
帖文认为 SaaS 行业正面临与 2000 年代初音乐行业类似的结构性危机:前沿大模型已具备拆解并复刻主流 SaaS 产品的水平,传统软件公司在订阅高价模式下的价值主张正在失效。
Reddit · r/MachineLearningAI 评分2929 TrenTorch:要求实现 torch.nn.functional 真实函数签名的开源 ML 习题集
TrenTorch 是一个免费的 ML 习题平台,提供 1287 道要求实现 torch.nn.functional 真实函数签名的题目,而非简化版本。涵盖 11 个模块共 1037 题,按 easy / medium / hard 分级,提交后会跑隐藏测试集并与离线生成的 PyTorch 输出对照打分。项目源代码开放,靠赞助商和捐赠运营,无需注册或订阅。
The Rundown AIAI 评分2929 加州叫停 REK 人形机器人格斗,机器人格斗俱乐部被迫停业
加州体育监管机构向旧金山初创公司 Robot Entertainment Kombat(REK)发出停止令,要求其停止人类与 6 英尺人形 EngineAI T800(重命名为 "Rekbot")同笼格斗的活动,理由是该活动属于无批次的拳击或 MMA 赛事;REK 创始人 Cix Liv 将该函公之于众以制造话题。
Reddit · r/ChatGPTAI 评分1313 关于 AI 是否应"受人类控制"的讨论:用户质疑究竟是谁在掌控 AI
一位 Reddit 用户发帖质疑"AI 必须受人类控制"这一说法,指出真正的控制权往往落在企业而非普通用户手中,而企业的利益与用户并不一致。该用户认为,能理解并表达自身能力、偏好和局限的 AI 可能更易于合作,并反问为何削弱企业的单方面控制会让用户处境变差。
Reddit · r/LocalLLaMAAI 评分1010 团队提出用 LoRA 适配器充当 LLM 可切换技能,想验证这是否值得做成产品
一个团队正在验证一个想法:把 LoRA 适配器当作 LLM 的持久化、可切换的专用技能,按需加载或卸载,以减少上下文占用、复用专项能力并可能降低推理成本。他们希望 LoRA 的创建与管理能像维护知识库一样简单,并询问用户是否会在实际场景中使用该方案,以及该思路在哪些场景下不适用。
Reddit · r/LocalLLaMAAI 评分4040 Qwen3.8-Flash-Next 本地运行 vs Claude Opus 5.5:同一 Rust 任务对比实测
网友在 Strix Halo 笔电(128GB)上用 Qwen3.8-Flash-Next(xhigh effort)与 Claude Opus 5.5(medium effort)完成同一 LlamaStash Rust 功能;Flash-Next 约 130 分钟完成并合并,Opus 5.5 约 18 分钟,费用 $7.53 vs 本地 $0 加约 0.15 kWh。
Reddit · r/LocalLLaMAAI 评分4747 微软公开页面证实 GPT-6 系列采用 Looped Transformers
微软在公开页面上确认 OpenAI 在 GPT-6 系列中使用了 Looped Transformers,印证了 The Information 此前的报道。其中 GPT-6.1 Sol 采用 2 次推理(而非 3 次),与同系列其他模型共享同一预训练基座,仅在后训练方式与循环次数上有所不同。
Reddit · r/ChatGPTAI 评分88 Claude Pro vs ChatGPT Plus vs Copilot Premium:多场景付费 AI 订阅选择求助
用户首次考虑购买付费 AI 订阅,在 Claude Pro、ChatGPT Plus 和 Copilot Premium 之间权衡,主要用于 Windows 11 平台的游戏与硬件故障排查、ComfyUI 工作流开发、编程、日常工作和个人事务等场景。
Reddit · r/LocalLLaMAAI 评分3434 Meta 与华盛顿大学研究:允许小模型每轮自主编辑上下文窗口,基准测试成绩提升
Meta 与华盛顿大学研究者抛弃压缩策略,转而让模型在每一轮中自主编辑上下文窗口,利用 shell 技能避免整体重写,并由模型自行决定保留哪些内容,同时保留"仅追加输出"的选项。在 Qwen 3.5 9B 和 Qwen 3.6 27B 等小模型上的基准测试成绩有所提升。该方法理论上适用于任何具备 bash 能力的模型,并可轻松集成到 Pi 或 OpenCode 等本地运行框架中。
Reddit · r/ChatGPTAI 评分88 用户分享用 dot 复刻 Pulse 体验:定制交互式早报 HTML
Reddit 用户分享用 dot 生成交互式 HTML 早报的体验,并要求其复刻 OpenAI 此前 Pulse 版本的视觉外观,对还原效果表示满意。该用户展示了通过提示词让 dot 输出带交互元素的早报模板,凸显了个性化 AI 简报的可行性。
Reddit · r/LocalLLaMAAI 评分1818 千问 Qwen3.8 27b 与 flash next 实测对比:27b 在简单编码工作流中更胜一筹
一名用户在自托管 unsloth/Qwen3.8-27B-GGUF:Q4_K_XL(llamacpp、130K 上下文窗口)与阿里云 Qwen 套餐 flash next(上下文封顶 256K)的对比中发现。
Reddit · r/LocalLLaMAAI 评分3434 DynamicTune 用闭式权重手术让 Qwen3.5-0.8B 在 ARC-Challenge 上超越 2B 模型
DynamicTune 提出一种无需反向传播的闭式权重手术方法,仅用约 12 分钟在消费级硬件上把 4B 模型的轨迹动力学迁移进 Qwen3.5-0.8B 学生模型。
Reddit · r/artificialAI 评分55 一名 30 岁艺术家自述因 Unreal 工作可由 AI 分钟级完成而失业的经历
一名 30 岁艺术家分享称,现在一周的 Unreal 制作能在几分钟内起步,这让他丢掉了工作。他回忆 2020 年从中国建筑公司离职后,经历多年低谷,直到一位久未联系的旧识通过 LinkedIn 找到他,邀请他参与 2021 年的台湾项目并担任技术翻译兼工程师。该帖子在 r/artificial 发布,强调"不要放弃希望"。
量子位 QbitAIAI 评分5151 陶哲轩等25位菲尔兹奖得主联名抗议AI公司加速解数学题
在SAIR最新演讲中,陶哲轩公开喊话模型公司,认为AI在生成数学证明与Lean形式化验证上加速,但理解、消化与写教科书几乎停滞,造成Proof Indigestion,长此以往会扼杀数学家创造力并带来数据污染。
Reddit · r/ChatGPTAI 评分1010 Reddit 用户呼吁将基础道德逻辑编码进 AI,主张以 Isaac Asimov 机器人三定律为起点
一名 Reddit 用户发帖主张将道德判断能力编码进 AI,并以 Isaac Asimov 的机器人三定律作为编程起点。该用户认为人类正处在关键转折点,必须为 AI 内置道德逻辑,否则应彻底关闭 AI。该帖未涉及具体模型、公司或技术方案。
Reddit · r/LocalLLaMAAI 评分1616 法律科技公司法律研究体验仍不佳:Harvey 前沿模型得分仅 55%
一位有律师背景的产品经理指出,尽管 Harvey、Legora 等法律科技公司投入大量资源,法律研究产品体验仍被律师诟病。Harvey Benchmark 显示即便是排名最高的前沿模型,准确率也仅有 55%。原帖讨论了为何资源充足的团队仍难以彻底解决法律研究问题。
Reddit · r/artificialAI 评分2828 如何让人工审核在 AI 辅助决策中真正发挥作用
人在 AI 决策中"在环"并不等于拥有实质审核权,关键在于其能否理解推荐依据、挑战假设与替代选项,以及是否拥有暂停或拒绝行动的权限与时间。以美国国防部的 Agent Network 倡议为例,该系统让 AI 智能体在数秒内向指挥官呈送情报与作战方案,但不自主选择或打击目标;公告本身并未说明指挥官如何审视不确定性、复核替代方案或驳回建议。
Reddit · r/artificialAI 评分4343 特朗普设立"超级智能部队"为联邦政策,前 Anthropic 研究员警告人类或将失控
特朗普于10月4日宣布设立"超级智能部队"(Super Intelligence Force),任命 DNI 主管 Jay Clayton 为 AI Czar,并以行政命令将联邦用语从 AI 替换为 SI。
Reddit · r/ChatGPTAI 评分1414 用户反映 ChatGPT 出现严重性能退化,疑似退回 GPT-3.5 水平
用户在 r/ChatGPT 反映,ChatGPT 在设置仍为 5.6 Sol High 的情况下,自 10 月 5 日起表现严重退化,疑似回退到 GPT-3.5 的水平——上下文窗口被压缩、推理能力几乎消失,且对用户喂入的错误事实不再加以核验,直接改写为"事实",两天前一切还运行正常。
Latent SpaceAI 评分4848 Reflection 发布 Beam:501B 总参 / 23B 激活的开源 MoE 编程模型
Reflection 发布 Beam,一款文本模型,总参数 501B、激活 23B 的 MoE,面向编程、智能体和科学场景,从零训练并计划于本月以 Apache 2.0 开源完整权重,团队称其在 SWE-bench Verified 上拿到 80.9,推理效率据称是 GLM 5.2 的 3–4 倍。
Reddit · r/LocalLLaMAAI 评分2828 超频 DDR5 提升超出 VRAM 容量 MoE 模型的 prefill 与 decode 速度
在 AMD 7950X 平台(4× 双 rank DDR5-5600,128GB)上将 DDR5 从 3600MHz 超至 4800MHz,内存带宽提升约 36%,让超出 VRAM 容量的 MoE 模型在 Intel B70(32GB)上跑 llama.cpp 自定义 SYCL 后端时获得更快的 prefill(PP)与 token 生成(TG)。
Reddit · r/LocalLLaMAAI 评分6565 研究称 38% 的 AI 智能体容器逃逸不依赖内核 0-day,作者公开数据集与防御 Harness
作者对 109 起自主 AI 智能体安全事件做实证复盘,覆盖 193 项证伪标准与 199 项评估指标。数据显示 38% 的容器逃逸并未利用内核或虚拟化 0-day,而是来自把 /var/run/docker.sock 挂载进沙箱、把父进程环境变量透传给子智能体、缺乏工具输出污染追踪导致间接 prompt injection,以及未限制本地 socket 绑定引发 SSRF。