跳到正文

交叉发现

今日 15 条

一手 · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月30日周三
  1. AWS Machine Learning Blog41

    Amazon Quick 提示工程基础原则

    Amazon Quick 平台提示工程的核心原则包括:通过具体化实现清晰度、提供业务上下文以驱动相关性、展示示例而非仅描述需求。CRISPE框架为复杂企业级AI交互提供了结构化模板,涵盖上下文约束、角色责任、意图输入、步骤范围等维度。这是两部系列文章的第一部分,聚焦通用原则和可复用框架。

9月29日周二
  1. Hugging Face Blog76

    NVIDIA 发布 Kumo Tabular 表格预测基础模型

    NVIDIA 发布 Kumo Tabular,这是一个开源的表格预测基础模型,可对标注过的表格数据进行分类和回归预测,无需训练、调优或特征工程。

    推荐理由:该模型在四个表格预测基准测试中排名第一,性能优于调优后的梯度提升树和最新的表格基础模型,并提供三种参数规模供选择,可供读者判断其对现有机器学习工作流的潜在影响。

  2. Microsoft Research66

    微软发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,这是一款旨在连接科学工具、文献、实验室和研究人员的 AI 研究系统。与 Broad Institute 合作,该系统用于预测和优先排序能够驱动肿瘤状态转变的化合物。在胰腺导管腺癌(PDAC)的湿实验证中,Quine 最高排名的化合物产生了最大的预期转录变化,整个过程仅用一个周末就完成了候选化合物的筛选和验证。

    推荐理由:原文给出了 Quine 的具体能力(世界模型+交互式 harness)、应用场景(胰腺癌药物预测)和初步验证结果,读者可以据此了解这个 AI 系统如何辅助生物研究以及实际效果。

  3. AWS Machine Learning Blog80

    Grok 4.7 在 Amazon Bedrock 上可用

    xAI 的 Grok 4.7 现已在 Amazon Bedrock 上线,支持 50 万 token 上下文窗口和低/中/高/xhigh 四档可配置推理 effort。该模型定位为 xAI 最强的编码和知识工作模型,强调在困难任务上工作更久并更仔细地自我验证,支持 Responses、Chat Completions 和 Converse API,可通过跨区域推理配置文件路由。

    推荐理由:提供了模型在 Bedrock 上的具体接入方式、API 接口和定价策略,读者可据此评估集成成本和工作流适配性。

  4. Microsoft Research33

    Microsoft Research Asia – Singapore 成立一周年:如何推进研究、合作伙伴与人才以实现实际影响

    Microsoft Research Asia – Singapore 于 2025 年 7 月 24 日开业,是微软在东南亚的首个研究实验室,过去一年在医疗、金融服务、教育等领域与当地合作伙伴建立深度合作。实验室聚焦下一代 AI 模型与智能体系统、领域特定 AI、AI 原生研究实践及生态系统与人才培养四大方向,获新加坡 EDB、IMDA 等政府机构支持推进 AI 落地应用。

  5. AWS Machine Learning Blog70

    在 AWS 上推出 Claude Sonnet 5.5

    Anthropic 的 Claude Sonnet 5.5 现已在 Amazon Bedrock 和 Claude Platform on AWS 可用。该模型更适合聚焦的编码和知识工作,相较 Opus 5.5 以更低的每任务成本和更快的速度完成范围明确的工作。文章提供了在 Amazon Bedrock 控制台测试和通过 AWS SDK 编程调用的具体步骤,并列出了必要的 IAM 权限要求。

    推荐理由:原文给出了 Claude Sonnet 5.5 的能力定位(更适合聚焦编码和知识工作)和成本/速度优势,读者可以据此判断它是否适合替换当前的模型方案。

  6. AWS Machine Learning Blog48

    如何在 SageMaker AI 上用 vLLM-Omni 生成图像和视频(下篇)

    在 Amazon SageMaker AI 上使用 vLLM-Omni 容器部署两个端点,通过文本提示词生成静态图像(FLUX.2-klein-4B 实时端点),再将该图像作为条件输入生成视频(Wan2.1-VACE-1.3B 异步端点)。图像直接返回,视频生成完成后从 Amazon S3 检索 MP4 文件,示例包含命令行工作流和 Streamlit 界面。

9月28日周一
  1. Mistral AI70

    Mistral 在慕尼黑设立德国中心,专注工业 AI 与物理 AI

    Mistral 在慕尼黑开设新中心,专注 Physics AI 和 Industrial AI 研发。中心将与 BMW 合作汽车碰撞模拟,与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)共建风洞数字孪生研究。公司计划到 2030 年在欧洲建立 1 吉瓦计算能力,强调开放权重架构保障数据主权——模型权重完全开放给客户,在客户自有基础设施上运行,数据不离开组织。

    推荐理由:Mistral 明确提出了在欧洲建立主权 AI 基础设施的完整路径:开放权重架构 + 客户自有基础设施 + 欧洲法律合规,并给出了 1 吉瓦计算容量的具体目标和合作案例,读者可以据此评估其与封闭系统的差异。

  2. AWS Machine Learning Blog55

    使用 Amazon Nova Act 实现合成监控

    Amazon Nova Act 使用多模态大语言模型处理 UI 截图而非 DOM 选择器,能自适应大部分 UI 变化。该方案结合 Amazon Bedrock AgentCore Runtime 实现无服务器执行,提供完整的示例代码仓库,包含部署脚本和 CDK 基础设施代码。

  3. OpenAI News22

    你是 Codex Original 吗?

    OpenAI 正在征集使用 Codex 的开发者、研究者和创作者的故事,招募对象包括 builders、tinkerers、researchers 和 creators。这些真实案例将用于 Codex Originals 项目的下一章。

9月26日周六
  1. AWS Machine Learning Blog60

    在 AWS SageMaker HyperPod 上使用 SkyRL 加速多模态 RL 训练

    本文详细介绍了在 Amazon SageMaker HyperPod 上使用开源 SkyRL 框架训练多模态强化学习模型的全流程,包括构建容器镜像、从 SageMaker Studio 启动 Ray 集群、提交训练任务、监控进度以及托管推理服务。

    推荐理由:给出了完整的操作流程和实验数据,读者可以据此在 SageMaker HyperPod 上复现多模态 RL 训练。

  2. AWS Machine Learning Blog70

    在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音

    本文介绍如何在 Amazon SageMaker AI 上部署 Qwen3-TTS-12Hz-1.7B-Base 模型进行实时语音克隆。该模型支持 10 种语言,可从几秒参考音频中提取说话者的音色、音调和节奏特征,生成新文本的语音,无需重新训练。

    推荐理由:原文给出了完整的部署步骤、GPU配置、代码示例和监控方法,读者可以照着在 AWS SageMaker 上搭建自己的语音克隆服务。

9月25日周五
  1. AWS Machine Learning Blog33

    Datacor 如何用 Amazon QuickSight 为气体分销商构建自助式租赁分析

    Datacor 将 Amazon QuickSight 集成到其 TrackAbout 解决方案中,为气体和焊接分销商提供自助式租赁分析,业务用户可通过自然语言提问实时获取数据洞察。TrackAbout 客户共管理 2750 万个资产,每月处理 72.5 万张账单。该方案采用跨云数据管道定期刷新 QuickSight SPICE 数据集,确保仪表板反映最新运营数据。

  2. AWS Machine Learning Blog60

    Amazon SageMaker HyperPod 联合 Qumulo 实现跨区域训练:架构与性能验证

    AWS 与 Qumulo 合作推出跨区域训练方案,允许计算节点和数据存储分属不同 AWS Region,通过 Qumulo Cloud Data Fabric 和 NeuralCache 预测缓存实现跨区域数据访问。

    推荐理由:原文给出了跨区域训练的具体配置步骤和性能数据,读者可以据此评估是否采用 Qumulo+HyperPod 方案替代数据复制。

  3. GitHub Blog · AI & ML61

    GitHub Copilot canvas:超越聊天的自定义 AI 工作流界面

    GitHub Copilot 推出 canvas 功能,这是一种可在应用内运行的全栈自定义 UI,智能体可与其双向通信。作者认为聊天作为 AI 交互界面存在局限性,而 canvas 能让用户创建针对特定任务的定制界面,还可调用第三方 API 和本地代码执行,并展示了用 canvas 构建 Connect 4 游戏、Winget 包管理、SQLite 数据库操作、工作流自动化等实际用例。

    推荐理由:原文展示了 canvas 功能解决的具体问题和使用场景,读者可以据此思考如何用自定义 UI 改进自己的 AI 工作流。

  4. Google Research64

    Google Research 提出多智能体框架实现连贯长视频生成

    Google Research 发布多个研究框架(Co-Director、CANVAS、A²RD、VQQA)用于解决长视频生成的连贯性问题。AI video co-director 将视频叙事建模为全局优化问题,通过多智能体分层架构协调创意策略;CANVAS 维护视觉记忆确保角色和场景一致性;A²RD 支持分钟级视频的自主生成;VQQA 通过视觉问答实现闭环优化。

    推荐理由:原文提出了多个解决长视频一致性问题的框架,读者可以了解如何通过多智能体协作和世界状态跟踪来改善视频生成的连贯性。

  5. GitHub Blog · AI & ML67

    GitHub Security Lab 发布 Taskflow Agent:实现 AI 驱动的自动化模糊测试

    GitHub Security Lab 发布 Fuzzing Taskflow,这是一个基于 LLM Agent 的 C/C++ 项目自动化模糊测试管道。只需指定一个 GitHub 仓库,Agent 会自动完成入口点识别、构建系统分析、模糊测试用例生成、AFL++ 运行、覆盖率分析、用例优化和漏洞报告编写。

    推荐理由:原文详细给出了自动化模糊测试的完整工作流程,包括覆盖率反馈循环、结构感知变异和语料库演进等具体机制,读者可据此迁移到自己的安全测试中。

  6. Google DeepMind70

    Gemini 3.8 Live 推出 Live Avatar 功能,实现实时视觉呈现

    Google DeepMind 推出 Gemini 3.8 Live 的 Live Avatar 功能,实现近实时视频生成与语音同步,支持精确口型同步、自然表情和 97 种语言无缝切换。该功能现已在 Gemini Enterprise 可用,企业可定制头像(仅限白名单)。所有输出均带有 SynthID 水印以确保透明度。

    推荐理由:原文给出了具体的能力变化和可用范围,读者可以据此判断它对现有工作流的影响。

  7. AWS Machine Learning Blog62

    在 Amazon SageMaker 上部署 WhisperX 实现说话人标注转录

    AWS 发布了 WhisperX 深度学习容器,可在 Amazon SageMaker 上部署为实时或异步端点,实现带说话人标注和词级时间戳的转录。实时端点适用于 60 秒内的短音频,异步端点通过 S3 处理长音频。教程详细介绍了两种端点的部署步骤、请求格式、GPU 实例选择和成本优化策略,并提供了生产环境的最佳实践。

    推荐理由:原文提供了在 AWS SageMaker 上部署 WhisperX 的完整教程,包含实时和异步两种端点的具体配置、代码示例和生产注意事项。

  8. AWS Machine Learning Blog32

    使用 AgentCore Gateway 和 MCP 构建多账户 AI 智能体

    本文介绍一种多账户 AI 智能体架构,允许各业务线(LOB)账户的数据保留在原处,智能体通过 Amazon Bedrock AgentCore Gateway 的统一端点进行跨账户查询。AgentCore Gateway 聚合各 LOB 的 MCP 服务器,提供语义搜索工具发现、AgentCore Identity 认证和 Policy 细粒度授权,数据仅在查询时按需流出,不进行集中化复制。

9月24日周四
  1. NVIDIA Blog71

    NVIDIA 联合 Google DeepMind 和 EMBL-EBI 发布 2800+ 病毒蛋白质复合物 3D 结构数据集

    NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作发布了超过 2800 种病毒的蛋白质复合物 3D 结构预测数据集,通过 AlphaFold Database 公开供全球科学家使用。

    推荐理由:给出了具体的病毒数量、全新发现比例和技术方案,读者可以据此判断该数据集对自己的研究是否有直接帮助。