跳到正文

交叉发现

今日 15 条

一手 · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月18日周五
  1. GitHub Blog · AI & ML43

    代码要读吗?RAG死了吗?Skills取代MCP了吗?——GitHub Podcast深度解析五大AI热点观点

    GitHub Podcast最新一期对五个常见AI热点观点进行深度解析,探讨是否需要阅读AI生成的代码、公司招聘是否强制AI技能、Skills是否取代MCP、RAG是否已过时、以及是否需要为代码库微调模型。主持人认为热点观点的价值不在于对错,而在于引发深入思考和问题,从而找到真正有用的 ideas。

9月17日周四
  1. GitHub Blog · AI & ML72

    GitHub Copilot 运行时如何迁移到 Rust

    GitHub Copilot 团队用 AI 智能体将 Copilot 运行时从约 43 万行 TypeScript 原地迁移为约 83 万行 Rust,历时数月完成 128 个 PR 的渐进式迁移。运行时性能提升数个量级,prompt cache 命中率高达 96.22%,单开发者完成了原本需要整个团队一到两年才能完成的工作。

    推荐理由:原文给出了 96% 的 prompt cache 命中率数据和具体的 AI 辅助迁移工作流,读者可以据此评估这种规模化 AI 协作模式的实际效果和可迁移性。

  2. OpenAI News39

    OpenAI 推出法律 AI 产品 Astra for Law

    OpenAI 发布面向法律行业的 AI 产品 Astra for Law,提供法律领域前沿智能、自定义律所工作流程和连接的合法数据源。该产品同时提供法律级安全控制,支持机密客户工作。

  3. OpenAI News71

    OpenAI 发布模型不对齐报告框架

    OpenAI 发布了一个用于跟踪、调查和披露模型不对齐的框架,同时附带了六份关于模型异常或令人担忧行为的报告。

    推荐理由:原文给出了框架的核心用途和对齐问题的追踪方法,读者可以据此了解 AI 安全领域的新实践。

9月16日周三
  1. NVIDIA Blog67

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次亮相中实现领先性能

    NVIDIA Vera Rubin NVL72 系统首次提交 MLPerf Inference v6.1 预览测试,在 Qwen3-VL 基准上提供高达 3.7 倍于 GB300 NVL72 的吞吐量,在 DeepSeek-R1 上达到 2.5 倍。GB300 NVL72 在 288-GPU 四机架扩展测试中实现 99% 扩展效率,软件优化相比 v6.0 提升高达 1.6 倍性能。

    推荐理由:给出了具体的性能倍数和扩展效率数据,读者可以据此评估新硬件对推理工作负载的实际价值。

  2. Mistral AI64

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供 AI 支持

    Mistral 宣布与 Mozilla 合作,Firefox Smart Window(测试版)现由 Mistral 模型驱动。该功能首先在法国和北美推出,英德两国预计今年晚些时候上线。此合作将 Mistral 的开源模型与 Firefox 的隐私保护传统结合,为用户提供多语言、多方言的本地化 AI 体验,对话默认不保存在 Mozilla 服务器上,Mistral 承诺零数据保留。

    推荐理由:这是一次将开源大模型嵌入主流浏览器的合作案例,展示了 AI 助手在浏览器场景中的实际应用和隐私保护机制。

  3. NVIDIA Blog63

    NVIDIA CEO 黄仁勋在 Dreamforce 大会上宣布 Salesforce 推出首个 CRM 推理模型 Koa

    Salesforce 推出首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 构建,使用近 30 年企业 CRM 部署的专有合成数据集进行后训练。

    推荐理由:Koa 是首个 CRM 推理模型,在 CRM 基准测试中错误率降低 3 倍,且完全在 Salesforce 基础设施内运行、不使用客户数据,这对企业 AI 应用有参考价值。

  4. Google DeepMind76

    Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking

    Google DeepMind 发布两款新的实时对话模型:Gemini 3.8 Live 注重规模化和成本效率,结合对话智能与流畅交互;Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备增强智能和多步推理能力。

    推荐理由:原文给出了具体性能数据(82.6% Speech to Speech Quality Index、68.6% τ-Voice 等)和多个平台可用入口,读者可据此判断该模型相对现有产品的能力提升和适用场景。

  5. NVIDIA Blog63

    NVIDIA 发布 DSX 平台优化 AI 工厂电力管理

    NVIDIA 推出 DSX(Digital Spectrum eXchange)平台,旨在优化 AI 工厂的每兆瓦产出。Lambda 在 HGX B200 服务器上的验证显示,在相同电力预算下运行 19 个节点(85% 功率)相比 16 个节点(满功率)可实现 24% 的集群 token 吞吐量提升和 23% 的每瓦性能提升。

    推荐理由:原文给出了具体性能数据(24% 吞吐量提升、23% 每瓦性能提升),这是 AI 工厂电力优化的真实验证结果,读者可据此评估其实用性。

9月15日周二
  1. NVIDIA Blog31

    费城儿童医院如何用开源NVIDIA AI为先天性心脏病儿童建模心脏

    费城儿童医院(CHOP)基于NVIDIA开源医学影像框架MONAI,将过去需要4小时的心脏建模工作缩短至几秒。美国20多家儿童医院已开展心脏建模项目,波士顿儿童医院约50%的心脏手术(约每年500例)获建模支持。CHOP正结合NVIDIA Warp和Newton物理引擎,目标将模拟仿真引入临床工作流程,实现同日决策。

9月14日周一
9月12日周六
9月11日周五
  1. Google Research62

    ToolGrad:基于文本“梯度”的高效工具使用数据集生成

    ToolGrad 采用"答案优先"策略,先生成真实工具调用链,再标注对应用户提示,利用文本梯度迭代构建 API 工作流。实验表明该方法可生成更复杂的长程工具使用数据,pass rate 接近 100%,成本更低。

    推荐理由:提出一种新的数据生成范式,可生成更复杂的工具使用数据并降低成本,学生模型甚至超越教师模型。

  2. GitHub Blog · AI & ML46

    GitHub Copilot 应用教程:使用 diff、terminal 和 browser 面板

    GitHub Copilot 应用新增 diff、terminal、browser 三个内置面板,可在应用内审查代码变更、运行命令并预览效果。diff 面板显示添加(绿色)和删除(红色),terminal 可执行项目命令,browser 面板配备 Pick & Polish 工具可交互调整 UI。用户可直接接受变更并创建 pull request,实现完整的 AI 编码工作流。

9月10日周四
  1. OpenAI News41

    OpenAI 推出 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex 驱动的托管服务,用于构建和启动云端 AI 智能体。该 API 支持编排、长时间运行会话和工具使用。