交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 3 条数据 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/MachineLearningAI 评分2121 用户将 56 亿条 TikTok 视频元数据上传至 Hugging Face,覆盖 2014 年至 2026 年 10 月
一名用户将覆盖 2014 年至 2026 年 10 月、共 56 亿条 TikTok 视频元数据上传至 Hugging Face。数据集同时提供基于 ClickHouse 的在线查询接口,包含创作者表 45 亿行、视频表 56 亿行和音频表 6.33 亿行。用户表示该数据库为自托管,呼吁查询者避免高负载请求。
Reddit · r/LocalLLaMAAI 评分3030 开发者将 LIBERO 基准移植到 MuJoCo Warp,在单张 700 美元 AMD GPU 上跑通 130 个机器人操控任务
开发者将 LIBERO 机器人操控基准完整移植到 MuJoCo Warp(NVIDIA GPU 仿真框架的 AMD HIP/ROCm 版本),在单张 700 美元的 RX 9070 XT 上以 2。
Hugging Face BlogAI 评分4747 Liquid AI 开源 d1 系列边缘决策模型:d1-3B 与多模态 d1-omni-600M
Liquid AI 开源 d1 系列两款边缘决策模型 d1-3B 与实验版 d1-omni-600M,分别支持文图与文图或文音输入,均已在 Hugging Face 开源下载。
Product HuntAI 评分1717 Proofsource:监控品牌在 ChatGPT、Claude、Perplexity 与 Google AI Overviews 中的提及情况
Proofsource 是一款面向买家的 AI 可见性监控工具,每日模拟买家提问在 ChatGPT、Claude、Perplexity 和 Google AI Overviews 上运行,识别哪些品牌被点名、谁被替代以及背后原因,并定位 AI 信任的页面、自动起草修复方案。其 Agent 会在用户审核后发布修复、验证答案变化并持续学习。免费版提供 25 个问题、覆盖 4 个引擎,无需绑卡。
Hacker News · 首页AI 评分3333 Google EmbeddingGemma 2 发布
Google 推出 EmbeddingGemma 2 嵌入向量模型。由于原文未提供具体细节,无法进一步展开参数规模、上下文长度或基准测试分数等信息。
Google DeepMindAI 评分5555 Google DeepMind 发布端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数量为 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
Hacker News · 首页AI 评分5252 Google DeepMind 发布开源端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议,参数 740M,面向文本、图像、音频、视频的统一多模态嵌入。
Simon WillisonAI 评分2323 用 Parseable 配合 Datasette 处理 OpenTelemetry traces
Datasette 1.0a41 起内置 OpenTelemetry 支持,可与开源可观测性工具 Parseable 配合使用。Parseable 提供 AGPL 开源的 Rust 单二进制实现(体积约 180MB)、企业版和云托管三种形态。
AWS Machine Learning BlogAI 评分2020 Amazon SageMaker Studio 新增对 SageMaker HyperPod Spaces 的可视化管理能力
Amazon SageMaker Studio 现可直接创建与管理运行在 SageMaker HyperPod EKS 集群上的 SageMaker Spaces,数据科学家无需使用 CLI 或 kubectl,即可在浏览器内启动 JupyterLab 或 Code Editor,将从集群访问到投入开发的时间缩短至几次点击。
Reddit · r/LocalLLaMAAI 评分5050 EmbeddingGemma 2:Google DeepMind 开源多模态嵌入模型
Google DeepMind 发布开源多模态嵌入模型 EmbeddingGemma 2,总参数量 740M,可将文本(含代码)、图像、视频和音频统一映射到 768 维向量空间,支持 RAG、检索、分类与聚类等本地应用。
Hacker News · 首页AI 评分6262 Polars 2.0 发布:流式引擎与 OOC 默认开启,SQL 性能领先 DuckDB 与 DataFusion
Polars 2.0 正式发布,LazyFrame 的 collect 默认走流式引擎,并默认开启 out-of-core(spill-to-disk,~80% RAM 起开始溢写,默认 64GB 磁盘预算),适用于排序、窗口函数和大量表达式等操作,同时新增 Map dtype,支持键查询和字典类方法。
Reddit · r/LocalLLaMAAI 评分3232 Orange Pi 5 Plus(RK3588)本地大语言模型推理基准:大核绑定、NPU 卸载与散热实测
在 Orange Pi 5 Plus(RK3588,16GB LPDDR4x)上对 1B–8B 模型做 Ollama CPU 推理基准测试:将线程绑定到 4 个 Cortex-A76 大核比默认 8 线程最高快 +318%。
Product Hunt · AI 分类AI 评分1717 StayCharted:无代码 AI 分类工具,上传数据即可自动填充剩余条目
StayCharted 是一款无提示词、无需编写代码的分类工具,用户提交已分好类的数据或截图后,工具会学习分类逻辑并补全其余条目的标签,可用于工单、报销明细、问卷答案和产品图片等场景。对拿不准的条目会自动返回给用户确认。产品可免费使用。
Reddit · r/LocalLLaMAAI 评分1818 双 MI50 上 TheRock ROCm 10.2 vs Vulkan Mesa 26.2 的 llama.cpp 后端性能对比
用户在双 AMD Radeon Instinct MI50 32GB 上对比了 TheRock ROCm 10.2 与 Mesa Vulkan 26.2 两个 llama.cpp 后端的性能。
Reddit · r/MachineLearningAI 评分3030 Chunkr:用 Rust 实现的 chunking 库,速度比 LangChain 等方案快约 20 倍
开发者推出 Rust 编写的 chunking 库 Chunkr,支持 Character、Recursive、Markdown header、Late chunking、Hierarchical chunking 等策略及原生 PDF 加载。
Hacker News · 首页AI 评分3131 Minigraf:基于 Rust 的嵌入式双时态图数据库,支持 Datalog 查询与多语言绑定
Minigraf 是一款基于 Rust 的单文件嵌入式图数据库,主打 Datalog 查询、双时态时间旅行与窗口函数,单个 .graph 文件即可在 Rust 原生、WASM、Android、iOS、Node.js、Python 等多平台运行。
MIT Technology Review · AIAI 评分1212 智能体 AI 时代如何把预测分析推向自主决策
2026 年企业 AI 的核心问题已从"预测模型能否跑赢统计方法"转向"预测系统如何自主行动而不错位业务意图",领先者与落后者的差距正在拉大。Everest Group 合伙人 Vishal Gupta 表示,企业已不再满足于回顾性视角,转向以前瞻性为导向,深度学习与生成式 AI 推动的实时训练和非结构化数据使分析从被动复盘走向主动预判。
Reddit · r/MachineLearningAI 评分1717 开发者用合成数据训练仅 31,251 参数的 encoder-only Transformer 预测血糖(第二部分)
开发者 0xdeadf1sh 发布第二部分实验,基于其 1 型糖尿病患者模拟器合成数据训练了一款仅 31,251 参数的 encoder-only Transformer 模型,可预测未来 2 小时血糖并能以自回归方式扩展至 8 小时夜间预测,训练时长不足 60 分钟,使用 NVIDIA DGX Spark。
Hacker News · 首页AI 评分2828 Homa:终结 AI 集群的 TCP 时代
论文 Homa 提出面向 AI 集群的新型网络传输协议,目标取代该场景长期使用的 TCP。AI 训练与推理集群对低延迟、高吞吐的需求与 TCP 机制存在错配,Homa 通过定制传输层设计回应这一挑战。该工作已在 Hacker News 引发讨论,目前尚未公布具体性能数据与开源安排。
Product Hunt · AI 分类AI 评分5050 ShipHQ:将订阅数据转化为等距办公室
ShipHQ 将应用的真实数据转化为等距风格的创业办公室,支持连接 RevenueCat,将每位付费订阅者变成办公室里的人。每日简报会展示新订阅者、试用用户和流失用户,里程碑以奖杯形式呈现,并配备 AI 经理提供每日站会。免费 iPhone 应用。
Product Hunt · AI 分类AI 评分3333 Formalini:从文档/照片/手写笔记提取 JSON/Excel/表格的 AI 工具
Formalini 可在几秒内从任意文档、照片或手写笔记中提取干净的 JSON、Excel 和表格数据。提供零配置模板、用于法律发现的 Case Folder 分析功能,以及 UiPath、SAP、Salesforce 等企业连接器,并支持开放的 MCP 智能体服务器。
Product Hunt · AI 分类AI 评分66 基于自然语言的 BI 工具 Basedash 在 Product Hunt 正式发布移动端
Basedash Mobile 正式登陆 Product Hunt,这是一个 AI 原生的商业智能平台,用户可用自然语言描述所需图表,由 AI 自动生成数据可视化,无需编写 SQL。产品定位是连接数据源后让非技术用户也能自助搭建仪表盘并洞察数据。当前 Product Hunt 页面显示已收集 9 条用户评价。
Hacker News · 首页AI 评分2121 Show HN: Strata – 可对 LLM 说"不"的表达性语义层
Strata 是 Netflix 内部孵化的商业智能平台,定位为 AI 时代的高性能语义层,支持 15 分钟本地部署(Docker + 自有编码智能体),提供治理语义层、自助仪表板、实时数据智能体和联邦开放 OLAP 引擎。某全球娱乐公司客服部门使用 Strata 后,800 名非技术用户自助分析从每周 5 次增至 100+ 次,临时数据请求下降 90%,合作伙伴入职仅需 10 分钟。
Product Hunt · AI 分类AI 评分2828 Upsolve AI 发布数据分析智能体平台 Upsolve Data Models
Upsolve AI 发布数据分析智能体平台,由 Upsolve Data Agent 和 Agent Studio 两部分组成。Upsolve Data Agent 可充当分析师角色,具备询问澄清问题、优化查询、绘制图表、提取洞察和创建报告等能力。Agent Studio 提供治理、语义层、上下文整理功能,支持完整测试、可观察性和评估。
Product Hunt · AI 分类AI 评分5151 CrawlRaven MCP 发布
CrawlRaven 将 Search Console、GA4、关键词列表和网站技术爬虫整合为统一计划,按影响力排序给出修复、更新和写作优先级。用户可通过 MCP 服务器在 Claude、ChatGPT 或 Cursor 中直接查询自己的网站数据并获取优化建议。
Product Hunt · AI 分类AI 评分1515 DailyHelm:面向创始人与增长团队的 AI 业务复盘产品
DailyHelm 是一款面向创始人与增长团队的 AI 业务复盘工具,会在夜间监控用户的分析、广告、SEO 与商店数据,并按预期收入影响排序,给出可执行的优先修复清单。它不同于传统仪表盘让用户自行解读图表,而是直接指出值得处理的问题与机会,让团队清楚"先修什么、下一步做什么"。
Unbug 一分钟读论文AI 评分2828 NL2SQL 专利密集公开,SQL 生成层被占、答没答对没人验
2026 年 4 月一个月内,微软、亚马逊、戴尔、Snowflake 四件 NL2SQL 专利集中公开或授权,方案共同把"一句话翻译成 SQL"从提示词工程挪进结构化中间层,生成 SQL 的一层已被专利与大厂产品圈住。
AWS Machine Learning BlogAI 评分3333 Datacor 如何用 Amazon QuickSight 为气体分销商构建自助式租赁分析
Datacor 将 Amazon QuickSight 集成到其 TrackAbout 解决方案中,为气体和焊接分销商提供自助式租赁分析,业务用户可通过自然语言提问实时获取数据洞察。TrackAbout 客户共管理 2750 万个资产,每月处理 72.5 万张账单。该方案采用跨云数据管道定期刷新 QuickSight SPICE 数据集,确保仪表板反映最新运营数据。
Product Hunt · AI 分类AI 评分44 Invofox Self Serve 上线,开放自助式文档解析 API
Invofox 推出 Self Serve,让软件团队自助使用其文档解析 API。该 API 针对高变异工作流设计,在 OCR 之上提供分类、校验与结构化抽取能力,可在生产环境中稳定扩展。
Simon WillisonAI 评分1212 datasette-explain 0.2.2 发布
Simon Willison 发布 datasette-explain 0.2.2 版本。新版本对应 sqlite 487 和 datasette 1,547。暂无更多功能详情披露。
Product HuntAI 评分2323 Alkera 开源多人协作数据科学工作台 Databench
Alkera 发布开源多人协作数据科学工作台 Databench,支持团队成员与 AI 智能体在 notebook 和聊天中实时协作,可在本地电脑、其他机器或 GPU 节点上运行任意 cell 或智能体,并能并行启动多个智能体探索方案。Databench 提供慷慨的免费使用额度,也支持用户自行托管。
OpenAI NewsAI 评分3131 Hex 用 GPT-6 Astra 将复杂分析转化为可交互可视化报告
GPT-6 Astra 帮助 Hex 的数据智能体将分析答案转换为可交互的可视化报告,员工乐于分享这些报告。该功能由 OpenAI 发布。
Mistral AI精选AI 评分7777 Mistral AI 推出 Search Toolkit 公开预览版
Mistral AI 发布了 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产搜索管道的可组合框架。该工具将数据摄入、检索和评估整合到单一框架中,支持 BM25 稀疏检索、密集向量检索和混合检索配置,内置 recall、precision、MRR、NDCG 等评估指标,开源且可在云端、本地或边缘运行。
推荐理由:它将数据摄入、检索和评估整合到一个框架中,帮助团队把时间从集成维护转向搜索质量提升。
Google Research精选AI 评分6363 Google发布TurboQuant:面向极端压缩的向量量化新算法
Google Research发布TurboQuant、QJL和PolarQuant三种向量量化压缩算法,可在Gemma和Mistral模型上将KV cache内存降低至少6倍,同时保持模型性能不变。
推荐理由:原文给出了6x内存降低和8x性能提升的具体数据,以及TurboQuant、QJL、PolarQuant三种算法的技术原理,读者可以据此了解向量量化技术的最新进展。
Google Research精选AI 评分7373 Google Research 发布 Groundsource:用 Gemini 将新闻转化为灾害数据
Google Research 发布了 Groundsource,这是一项利用 Gemini 将全球新闻报道转化为结构化灾害数据的新方法论。该方法已生成 260 万条城市突发洪水事件记录,覆盖 150 多个国家(2000 年至今),准确率在实用层面达 82%。Google 已将此数据用于改进 Flood Hub 的洪水预测能力,未来计划扩展到其他灾害类型。
推荐理由:该方法通过 AI 从全球新闻中提取结构化灾害数据,填补了传统监测系统无法覆盖的小型和局部灾害的数据空白。