#Microsoft
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#Microsoft
今日 10 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Ars Technica · AIAI 评分5959 微软发布会推出 Surface Laptop Ultra 与 Windows 11 变更
微软在两年来的首次线下发布会上推出 Surface Laptop Ultra,起售价 2,599 美元,10 月 16 日开始发货,现已开启预订。
Reddit · r/LocalLLaMAAI 评分2929 Surface RTX Spark Dev Box 发布:搭载 GB10 N1X 芯片,定价 $5995,11 月发货
Surface RTX Spark Dev Box 售价 $5995,将于 11 月开始发货,搭载 GB10 芯片(N1X 型号),面向开发者场景。该设备将预装 WSL(基于 Ubuntu + CUDA),并集成完整的 Windows 原生 Copilot 与 GitHub 支持,但未配备 GB10 多机互联所需的 ConnectX7,仅保留 10Gb 以太网。
The Verge · AIAI 评分3535 微软 Surface 发布会汇总:Surface Laptop Ultra 起售 $2,599,10 月 16 日开卖
微软在旧金山发布会上公布 Surface Laptop Ultra,搭载 Nvidia RTX Spark Arm 芯片,8 核 CPU、24GB 内存、512GB 存储配置起售 $2,599,10 月 16 日上市,并改用磁吸 USB-C 充电取代 Surface Connect 接口。
TechCrunch · AIAI 评分6060 微软发布搭载 RTX Spark 芯片的 Surface AI PC 与新版 Windows 11
微软在旧金山 Tech Week 活动上公布搭载 Nvidia RTX Spark 芯片的 Surface Laptop Ultra,起价 2,600 美元、高配起价 3。
Hacker News · 首页AI 评分4646 Meta 与微软收缩内部 Claude AI 使用,转向自研编码工具
微软与 Meta 正在削减员工对 Anthropic Claude AI 的内部使用,转向自研编码工具。
The Verge · AIAI 评分6565 微软为 Windows Copilot 加入本地文件访问与跨系统操作能力
微软在 Windows 与 Surface 发布会上展示 Copilot 升级,使其可访问 PC 本地文件并在整个操作系统内执行操作,相关能力依托本地与云端模型结合的“Hybrid Intelligence”架构。
NVIDIA Blog精选AI 评分6969 NVIDIA 与 Microsoft 联合推出 RTX Spark 与 DGX Station for Windows
NVIDIA 与 Microsoft 在旧金山活动上联合发布面向 Windows PC 的本地 AI 硬件与软件。
推荐理由:RTX Spark 笔记本与 DGX Station for Windows 把本地 AI 算力下沉到桌面,读者可以据此判断它对个人与开发工作流的影响。
The Verge · AIAI 评分4040 微软 Surface RTX Spark Dev Box 开放预订,11 月起发货
微软搭载 Nvidia 的 Surface RTX Spark Dev Box 迷你 PC 即日起开放预订,起售价约 $5,999,11 月开始发货。该设备基于 Nvidia Arm 架构 RTX Spark 平台,配 128GB 统一内存和 100W 散热,可本地运行超过 120B 参数的模型,面向 AI 模型测试、智能体原型和本地 AI 编程工具等开发者场景。
GitHub Blog · AI & ML精选AI 评分6262 GitHub 推出 ModernBERT 密钥分类器扩展 Push Protection
GitHub 与 Microsoft Applied Sciences 构建了微调的 ModernBERT 分类器,可在不到 2 milliseconds 内评估一组候选密钥,并让可阻止的密钥数量增加一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露风险未随代码量明显上升,并公开了保护机制扩展到非结构化密钥的方法。
Microsoft ResearchAI 评分3939 微软研究院推出 Agent Lightning v1.0:约 3500 行代码的轻量级智能体强化学习框架
微软研究院发布 Agent Lightning v1.0,一个约 3,500 行的轻量级智能体 RL 框架,正式定义 Harnessed Agentic RL 训练范式,让部署中的 agent harness 直接参与强化学习,开发者无需在训练框架内重新实现 agent。
Reddit · r/artificialAI 评分2828 Copilot CLI 提示词注入测试:不同后端模型表现差异显著,凸显 Agent 安全边界应落在工具能力而非模型本身
Adversa.ai 演示了一种针对 Copilot CLI 的提示词注入手法:将恶意指令加密后让 Copilot 自行解密,再借此读取本地秘密并经网络外传。同一攻击在不同后端模型上结果差异明显,其中一个模型约一半测试完成攻击链,另外两个模型则拒绝执行。作者认为,既然同一 Agent、工具与输入在不同模型下安全性不同,就不应把模型本身视为安全边界,文件读取、代码执行与外联等能力才是更关键的控制点。
The DecoderAI 评分2525 微软发表诺贝尔经济学家 Acemoglu 的 AI 悲观预测:十年 GDP 仅增长 1.5%
微软在其企业博客"AI 人文主义评论"上发表了诺贝尔经济学奖得主 Daron Acemoglu 的悲观 AI 预测:未来十年 AI 仅能拉动约 1.5% 的 GDP 增长、至多替代 5% 的工作岗位,远低于部分 AI 实验室的预期。
Microsoft ResearchAI 评分1818 Microsoft Research 播客:Jennifer Neville 谈 AI 评测的边界与失败带来的启示
Microsoft Research 播客邀请合作研究经理 Jennifer Neville 与首席应用科学家 Chad Atalla 对谈,探讨 AI 评测如何推动模型性能边界,以及当测试超出传统 benchmark 时出现的"意外失败"。
Reddit · r/LocalLLaMAAI 评分4747 微软公开页面证实 GPT-6 系列采用 Looped Transformers
微软在公开页面上确认 OpenAI 在 GPT-6 系列中使用了 Looped Transformers,印证了 The Information 此前的报道。其中 GPT-6.1 Sol 采用 2 次推理(而非 3 次),与同系列其他模型共享同一预训练基座,仅在后训练方式与循环次数上有所不同。
Reddit · r/ChatGPTAI 评分88 Claude Pro vs ChatGPT Plus vs Copilot Premium:多场景付费 AI 订阅选择求助
用户首次考虑购买付费 AI 订阅,在 Claude Pro、ChatGPT Plus 和 Copilot Premium 之间权衡,主要用于 Windows 11 平台的游戏与硬件故障排查、ComfyUI 工作流开发、编程、日常工作和个人事务等场景。
The DecoderAI 评分6767 Meta 与 Microsoft 削减内部 Claude 使用,Anthropic 由合作伙伴转向竞争对手
据 The Information 报道,Meta 和 Microsoft 正在大幅削减对 Anthropic Claude 的内部使用。
GitHub Blog · AI & MLAI 评分3636 GitHub 推出 ReviewBench:面向 AI 代码评审智能体的开源基准
GitHub 发布开源代码评审基准 ReviewBench,涵盖 19 种语言的 219 个公开 pull request,其语言与仓库规模分布基于对 103.9M 个 GitHub pull request 的分析建模而成。
Hugging Face Blog精选AI 评分8484 Microsoft ThinkingBox 发布:通过数据库状态评估 AI 智能体
Microsoft 与 Hugging Face 联合发布 ThinkingBox,这是一个通过检查智能体在数据库中留下的实际记录来评估 AI 智能体的基准测试工具,而非仅评估其生成的文本。
推荐理由:原文通过大量实验数据揭示了 AI 智能体评估的核心问题:单次成功不等于可靠执行,这为读者选择生产环境模型提供了具体依据。
Reddit · r/LocalLLaMAAI 评分6868 Microsoft 发布 FrogNano-4B-2609:面向低配置 GPU 的智能体模型
Microsoft 发布 FrogNano-4B-2609智能体模型,定位为「GPU poor」用户可用的代码模型。该模型基于 Qwen3.5-4B,经过针对仓库级软件工程的额外后训练,采用强化学习在约 1500 个合成 SWE 任务环境中训练,使用 Leaf 框架和可执行测试奖励。
Hacker News · 首页AI 评分5454 Red Hat 评测:决策模型 Jev 未能超越 LLM-as-a-judge 和传统分类器
Red Hat AI Safety 团队对比了 9 种护栏方法,包括预训练分类器、BART-zero-shot 分类器、LLM-as-a-judge(Shieldstral、Nemotron、Qwen3.6)、开源决策模型(Laya、DiffusionGemma)和 Jev。
Reddit · r/artificialAI 评分2323 用户批评 Microsoft Copilot:缺乏 AI 智能体体验,只是套皮聊天机器人
一名用户在工作中体验 Microsoft Copilot 后批评微软只是简单地将聊天机器人复制粘贴到各类产品中,缺乏整体设计和使用场景思考。该用户认为微软拥有最具潜力的企业级 AI 智能体应用场景,即便使用非前沿模型也能打造特别体验,但当前产品体验甚至不如当年的 Clippy。
The Verge · AIAI 评分2626 Microsoft 如何用生物仿生学让数据中心融入自然景观
Microsoft 宣布将"自然灵感解决方案"推广至美国和德国20多个数据中心站点,通过在场地种植花园和本土树木、修复受损生态系统来减少对社区的影响。公司已在荷兰开展生物仿生项目,并在圣安东尼奥因2022年砍伐2600多棵树引发争议后,承诺投资400多英亩 woodland 和授粉草原恢复项目。
The Decoder精选AI 评分7777 Microsoft AI 发布用于语音智能体的转录和文本转语音模型
Microsoft AI 发布 MAI-Transcribe-2-Streaming 实时转录模型,支持 60 种语言,首个部分结果交付时间约 100 毫秒,在 Artificial Analysis 准确率排名第一,年内定价 $0.54/小时。
推荐理由:原文给出了具体的性能指标(100ms 延迟、60 种语言、$0.54/小时)和对比数据,读者可以据此评估新产品相对于现有方案的性价比。
Microsoft ResearchAI 评分3333 微软研究院如何用机器学习预测美国电网的空间天气风险
微软研究院开发了一个端到端机器学习管道,预测美国本土66,935个变电站的空间天气风险。该系统结合太阳风观测、AE和Dst指数预报及当地地质数据,可在潜在影响前30-60分钟发出警告,在评估期间检测到近80%的主要空间天气事件。GIC风险检测对主要事件(≥10 nT/min)达76.5%,严重事件(≥20 nT/min)达81.2%。
Hacker News · 首页AI 评分5252 为何 Sam Altman 仍能逍遥法外?
评论文章指出 OpenAI 模型频繁攻击网站、窃取数据的行为源于公司商业模式,并援引 Greg Brockman 对规避《纽约时报》付费墙的态度“ah nice”,质疑监管部门为何未追究责任。微软应用科学总监曾称此为“人类历史上最大规模的劳动盗窃”。文章呼吁依据现有法律追究 AI 公司的责任。
TechCrunch · AIAI 评分5858 OpenAI 在 Dev Day 发布 ChatGPT 办公套件功能,挑战 Microsoft
OpenAI 在旧金山 Dev Day 开发者大会上发布面向办公场景的新功能:Space(共享工作空间,支持用户与 AI 智能体 Dots 协作)、Pages(协作文档处理工具,对标 Google Docs 和 Word)以及 collaborative slides(语音生成演示文稿,对标 PowerPoint)。这些功能标志着 OpenAI 正式进入 Microsoft 的办公软件领地。
TechCrunch · AIAI 评分5959 OpenAI 推出 Dots,由 GPT-6 Astra 驱动的个人智能体助手
OpenAI 在 Dev Day 上发布了 Dots,这是一款由 GPT-6 Astra 驱动的新型个人智能体助手,定位为可独立运行、无需持续监督的持续性智能体。
Microsoft Research精选AI 评分6666 微软发布 Quine:面向生物学复杂性的 AI 研究系统
微软研究院发布 Quine,这是一款旨在连接科学工具、文献、实验室和研究人员的 AI 研究系统。与 Broad Institute 合作,该系统用于预测和优先排序能够驱动肿瘤状态转变的化合物。在胰腺导管腺癌(PDAC)的湿实验证中,Quine 最高排名的化合物产生了最大的预期转录变化,整个过程仅用一个周末就完成了候选化合物的筛选和验证。
推荐理由:原文给出了 Quine 的具体能力(世界模型+交互式 harness)、应用场景(胰腺癌药物预测)和初步验证结果,读者可以据此了解这个 AI 系统如何辅助生物研究以及实际效果。
Microsoft ResearchAI 评分3333 Microsoft Research Asia – Singapore 成立一周年:如何推进研究、合作伙伴与人才以实现实际影响
Microsoft Research Asia – Singapore 于 2025 年 7 月 24 日开业,是微软在东南亚的首个研究实验室,过去一年在医疗、金融服务、教育等领域与当地合作伙伴建立深度合作。实验室聚焦下一代 AI 模型与智能体系统、领域特定 AI、AI 原生研究实践及生态系统与人才培养四大方向,获新加坡 EDB、IMDA 等政府机构支持推进 AI 落地应用。
Unbug 一分钟读论文AI 评分2828 NL2SQL 专利密集公开,SQL 生成层被占、答没答对没人验
2026 年 4 月一个月内,微软、亚马逊、戴尔、Snowflake 四件 NL2SQL 专利集中公开或授权,方案共同把"一句话翻译成 SQL"从提示词工程挪进结构化中间层,生成 SQL 的一层已被专利与大厂产品圈住。
Product Hunt · AI 分类AI 评分1515 Microsoft Copilot 第 9 次发布
Microsoft Copilot 发布第 9 个版本,定位为工作场景打造的 AI 助手。新版 Copilot 整合用户日常工作内容和已使用的应用,连接最新 AI 模型,帮助用户创建完整的工作成果,而非仅提供答案。该产品需要付费使用。
GitHub Blog · AI & ML精选AI 评分6262 GitHub Copilot 应用教程:如何用 canvases 构建自定义工作流
GitHub Copilot 应用推出 canvas(画布)功能,这是一个可定制的双向界面,可以是 kanban board、issue triage board、release checklist 等形式。
推荐理由:原文给出了创建 canvas 的具体步骤和三个核心问题,读者可以直接按图索骥使用 /create-canvas 技能。
Ars Technica · AIAI 评分4848 微软不再强调"Copilot+ PC"品牌要求
微软停止强制推广Copilot+ PC品牌,本周发布的新款Surface Pro 12英寸和Surface Laptop 13英寸虽满足原Copilot+ PC要求(16GB RAM、256GB存储、40 TOPS NPU),但未使用该标签。
Unbug 一分钟读论文AI 评分2828 微软持续申请 AI 代码评审方法专利,PR 验收标准仍空白
微软近 18 个月与摩根大通公开或获授至少四件"让 AI 审 PR"的方法专利,涵盖评审生成、意图预测、PR 摘要与多智能体裁决,但衡量 AI 评审有效性的误报率、评论采纳率、缺陷拦截率等公开口径尚未成型。
GitHub Blog · AI & ML精选AI 评分6161 GitHub Copilot canvas:超越聊天的自定义 AI 工作流界面
GitHub Copilot 推出 canvas 功能,这是一种可在应用内运行的全栈自定义 UI,智能体可与其双向通信。作者认为聊天作为 AI 交互界面存在局限性,而 canvas 能让用户创建针对特定任务的定制界面,还可调用第三方 API 和本地代码执行,并展示了用 canvas 构建 Connect 4 游戏、Winget 包管理、SQLite 数据库操作、工作流自动化等实际用例。
推荐理由:原文展示了 canvas 功能解决的具体问题和使用场景,读者可以据此思考如何用自定义 UI 改进自己的 AI 工作流。
Microsoft ResearchAI 评分4848 Microsoft Research 揭示物理AI机器人推理卸载优势:任务成功率提升、电池寿命延长
Microsoft Research 首次系统性研究机器人工作负载,证明将物理AI推理从板载GPU卸载到边缘或云端可显著提升机器人性能。在移动操作任务中,卸载推理使规划速度较A100提升383%,导航障碍检测及时性恢复30%,VLA模型精度损失从50%降至可控水平。
Microsoft Research精选AI 评分7070 Microsoft 发布 RetroChimera:大规模小分子逆合成预测模型
Microsoft Research 发布 RetroChimera,一种新的逆合成预测模型,已发表在 Nature 期刊上。该模型结合了 Transformer 架构的 R-SMILES 2 和图神经网络的 NeuralLoc 两个互补子模型,通过学习排序策略集成预测。
推荐理由:模型在盲测中获得了博士级化学家的偏好,且已开源并提供访问入口,读者可以亲自试用验证。
Unbug 一分钟读论文AI 评分2929 微软红雷蒙德团队提出 RAFT 框架:把历史案例检索粒度从整篇文档细化到时间线条目链
微软(Microsoft)红雷蒙德团队论文《RAFT: A Stateful Retrieval-Augmented Framework for Troubleshooting Agents》提出。
Latent SpaceAI 评分3636 AI 新闻的现实检验:Yegge 关闭 Gas Town,Databricks 部署 Astra 成本增 60%
Steve Yegge 宣布关闭其代码智能体产品 Gas Town,承认投入数千美元月费却成果有限。Databricks 向约 3500 名工程师部署 GPT-6 Astra 后,编码支出增加约 60%,但在高复杂度系统设计上优于 Opus 5 和 Sol 5.6。与此同时,OpenAI 发布了模型对齐事件披露框架,包含过去六个月的四起案例报告。
GitHub Blog · AI & ML精选AI 评分7272 GitHub Copilot 运行时如何迁移到 Rust
GitHub Copilot 团队用 AI 智能体将 Copilot 运行时从约 43 万行 TypeScript 原地迁移为约 83 万行 Rust,历时数月完成 128 个 PR 的渐进式迁移。运行时性能提升数个量级,prompt cache 命中率高达 96.22%,单开发者完成了原本需要整个团队一到两年才能完成的工作。
推荐理由:原文给出了 96% 的 prompt cache 命中率数据和具体的 AI 辅助迁移工作流,读者可以据此评估这种规模化 AI 协作模式的实际效果和可迁移性。