跳到正文

#新工具

今日 0 条

一手 · 工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
5月20日周三
  1. Google Research63

    Google 发布 Empirical Research Assistance (ERA),一款用于科学研究代码编写的 AI 工具

    Google 发布 Empirical Research Assistance (ERA),这是一款使用 Gemini 编写和优化科学代码的研究工具,可搜索科学文献、写代码、探索方案、组合技术并评估结果,在基因组学、公共卫生、卫星图像分析等多个基准上达到专家水平。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

5月18日周一
5月17日周日
5月16日周六
5月12日周二
  1. Google DeepMind68

    Google DeepMind 发布 Co-Scientist:基于 Gemini 的多智能体 AI 科研伙伴

    Google DeepMind 在 Nature 发布了 Co-Scientist 系统,这是一款基于 Gemini 模型的多智能体 AI 系统,用于生成和优化科学假设。该系统通过生成、辩论、进化三个阶段迭代产生新假设,已在肝纤维化治疗、ALS 研究、细胞衰老逆转等多个领域测试应用,并将通过 Hypothesis Generation 实验工具向个人研究者开放注册。

    推荐理由:原文给出了具体应用案例和能力变化,读者可以了解这个 AI 工具如何辅助科学研究以及它的实际效果。

5月6日周三
  1. Google DeepMind69

    Google DeepMind 展示 AlphaEvolve 一年成果:在基因组学、电网和量子计算等领域取得突破

    Google DeepMind 展示了 AlphaEvolve 这一 Gemini 驱动的 AI 编码智能体在过去一年取得的实际影响:在基因组学领域将 DNA 测序错误检测降低 30%。

    推荐理由:原文给出了 AlphaEvolve 在多个领域(基因组学、电网优化、量子计算等)的具体性能提升数据,读者可以据此评估这类 AI 编码智能体的实际效用。

4月27日周一
  1. Mistral AI73

    Mistral AI 发布企业级 AI 编排工具 Workflows

    Mistral AI 发布企业级 AI 编排工具 Workflows,提供持久执行、可观察性和人工审核介入能力,解决企业将 AI 从概念验证推向生产环境时的可靠性问题。用户用 Python 编写工作流后可发布到 Le Chat 供组织内任何人触发,基于 Temporal 引擎构建,数据和业务逻辑保留在用户环境中。ASML、ABANCA、France Travail 等企业已在生产环境中使用。

    推荐理由:原文给出了 Workflows 的核心能力——持久执行、可观察性和人工审核介入——以及基于 Temporal 引擎的技术架构,读者可以据此判断它会如何改变企业 AI 生产部署的工作流。

4月23日周四
  1. Google Research72

    Google Photos Auto frame 推出视角重制功能,利用 3D 估计和生成式 AI 调整照片角度

    Google 宣布在 Google Photos 的 Auto frame 功能中推出新的视角重制技术。该方法先通过 3D 点云估计和人脸检测重建场景,再使用生成式潜扩散模型填补新视角下缺失的背景内容,从而在保持人物身份的同时自动调整拍摄角度。目前该功能已上线,可自动优化包含人物的肖像照片。

    推荐理由:原文介绍了 3D 场景估计+生成式修复的技术路径,读者可据此了解图像后期视角调整的新方法。

4月14日周二
  1. Google Research59

    Google 发布 Vantage:用生成式 AI 评估未来必备技能的研究实验

    Google Research 联合纽约大学发布 Vantage,一个利用生成式 AI 在模拟环境中创建对话来评估学生未来必备技能(如批判性思维、协作、创造性思维)的研究实验。该工具有 Executive LLM 引导对话进行自适应评估,AI Evaluator 与人类专家评分一致性相当。Vantage 现已在 Google Labs 开放英语注册,旨在为教育者提供可扩展的技能评估方法。

3月29日周日
  1. Google DeepMind72

    Google DeepMind 发布 AI 赋能光标原型

    Google DeepMind 发布实验性的 AI 赋能光标,能够理解用户指向的内容及上下文。用户只需指向并用自然语言提问(如“显示方向”“对比这些产品”),AI 即可识别光标处的文字、图像、代码块等元素并提供相应帮助。该原型基于 Gemini 构建,计划集成到 Chrome 和新的 Googlebook 设备中。

    推荐理由:Google DeepMind 展示了 AI 赋能光标的新交互范式,读者可以了解 AI 如何从理解'指向什么'升级到理解'为什么指向',以及这一变化对现有工作流的意义。

3月25日周三
  1. Google Research75

    Google发布Vibe Coding XR:用XR Blocks和Gemini加速AI+XR原型开发

    Google宣布推出Vibe Coding XR工作流,结合Gemini的长期上下文推理能力和专门的系统提示词与代码模板,将自然语言直接转换为可在Android XR设备上运行的功能性、物理感知的XR应用。

    推荐理由:Google发布了一个完整的AI+XR原型开发工具链,展示了多个教育、娱乐和游戏场景的demo,读者可据此了解当前AI生成XR应用的能力边界。

  2. Google Research44

    S2Vec 如何用自监督学习理解城市建筑环境

    Google Research 发布 S2Vec,一个自监督学习框架,通过 S2 Geometry 分区和特征栅格化将建筑环境转换为类似图像的表示,再利用掩码自编码器学习通用嵌入向量。S2Vec 在零样本地理适应任务(如预测未见过区域的人口密度和收入)中表现竞争力,无需人工标注即可理解城市特征关系。评估显示,S2Vec 与图像嵌入融合通常优于单一模态。

3月24日周二
  1. Mistral AI79

    Mistral AI 发布 Voxtral TTS 文本转语音模型

    Mistral AI 发布 Voxtral TTS,一个 40 亿参数的文本转语音模型,支持 9 种语言的情感化语音生成,具备低延迟和快速语音适配能力。该模型通过 API 和 Mistral Studio 提供,起步价每千字符 0.016 美元,支持仅 3 秒参考音频即可适配定制语音。

    推荐理由:原文给出了与 ElevenLabs 的对比数据和具体价格,读者可以据此判断 Voxtral TTS 在语音生成领域的能力和成本。

3月18日周三
  1. Mistral AI47

    Mistral AI 发布 Forge 企业级 AI 训练系统

    Mistral AI 发布 Forge 系统,帮助企业基于自有知识库训练定制化前沿 AI 模型,支持预训练、后训练和强化学习。Forge 支持 dense 和 MoE 架构,允许企业保留对模型、数据和知识产权的控制权,已与 ASML、DSO 新加坡、欧洲航天局、Ericsson 等机构合作。

3月17日周二
  1. Mistral AI66

    Mistral AI 发布 Leanstral:面向 Lean 4 的开源代码智能体

    Mistral AI 发布 Leanstral,首个专为 Lean 4 证明助手设计的开源代码智能体,采用 6B 活跃参数的稀疏架构,支持 MCP,可通过 Mistral Vibe 或免费 API 使用,权重采用 Apache 2.0 许可证。

    推荐理由:原文给出了能力变化和基准测试对比,读者可以据此判断它如何改变形式化证明的工作流。

3月12日周四
  1. Google Research75

    Google Flood Hub 推出 AI 城市突发洪水预报,可提前 24 小时预警

    Google 宣布在 Flood Hub 上推出 AI 城市突发洪水预报功能,可提前 24 小时预测城市突发洪水风险。该系统使用 Groundsource 方法论(由 Gemini 分析新闻报道生成历史洪水数据集)训练 LSTM 模型,仅依赖全球气象数据即可生成 20x20 公里分辨率的预报。

    推荐理由:原文给出了AI驱动方法如何弥合全球预警差距的具体数据,读者可以据此评估它对发展中国家的实际价值。

2月5日周四
12月9日周二
10月24日周五
  1. Mistral AI68

    Mistral AI Studio 发布:企业级 AI 生产平台

    Mistral AI 发布全新企业级 AI 生产平台 AI Studio,提供可观测性(Observability)、智能体运行时(Agent Runtime)和 AI 注册表(AI Registry)三大核心功能。该平台旨在帮助企业解决从原型到生产的关键挑战,包括版本追踪、结果复现、实时监控、评估执行和合规部署。

    推荐理由:原文给出了三个核心功能模块和解决的企业级痛点,读者可以据此判断它会怎样改变现有 AI 部署工作流。

7月30日周三
  1. Mistral AI68

    Mistral 发布 Codestral 25.08 及完整企业编码工具栈

    Mistral 发布 Codestral 25.08 代码补全模型,在 SWE-bench Verified 上 Devstral Medium 达 61.6%,Codestral 25.08 相比前代提升 30% 接受率和 10% 代码留存率。

    推荐理由:给出了具体性能提升数据(SWE-bench 61.6%、+30% accepted completions)和部署选项,读者可据此评估该版本相比前代及竞品的实际差距。

6月4日周三
  1. Mistral AI72

    Mistral 推出企业级 AI 编程助手 Mistral Code

    Mistral 发布 Mistral Code,这是一款面向企业的 AI 编程助手,整合了 Codestral、Codestral Embed、Devstral 和 Mistral Medium 四个模型,支持云端、本地或空气隙部署,可对底层模型进行微调或蒸馏。私有测试版已开放,支持 JetBrains IDEs 和 VSCode,Abanca、SNCF 和 Capgemini 等企业已开始采用。

    推荐理由:原文给出了 Mistral Code 的核心能力(四个模型、企业级安全控制、可本地部署)和解决的四个企业痛点,读者可以据此判断它与企业现有工作流的适配度。

5月27日周二
  1. Mistral AI71

    Mistral 发布 Agents API

    Mistral 推出新的 Agents API,将 Mistral 强大的语言模型与内置连接器(代码执行、网络搜索、图像生成、文档库)、MCP 工具支持、持久记忆和智能体编排能力相结合。SimpleQA 基准测试显示,加入 web search 后,Mistral Large 和 Mistral Medium 的得分分别从 23% 和 22.08% 提升至 75% 和 82.32%。

    推荐理由:原文给出了 SimpleQA 基准测试的具体分数对比(有无 web search),读者可以据此评估搜索增强对模型实际能力的提升幅度。

5月7日周三
3月7日周五
  1. Mistral AI75

    Mistral 推出 OCR API,基准测试超越 Google、Azure 和 GPT-4o

    Mistral 发布新的 OCR API Mistral OCR,可处理图像和 PDF 并提取交错文本和图像,在基准测试中超越 Google Document AI、Azure OCR、Gemini 和 GPT-4o。定价为每美元 1000 页,单节点处理速度最高达每分钟 2000 页,支持多语言文档理解,现已在 Le Chat 免费试用,API 已上线 la Plateforme。

    推荐理由:原文给出了具体定价、基准测试对比和可用入口,读者可以据此评估它与现有 OCR 方案的差异。