跳到正文

#Google

今日 0 条

图像 · 工具·提示词·论文 三栏速览

每栏 2 / 6 · 直达分类页

提示词

6 条
查看全部

论文

6 条
查看全部
10月7日周三
  1. Product Hunt47

    Google 发布图像模型 Nano Banana 2.1,支持遮罩编辑与多分辨率 Search grounding

    Google 今日推出图像生成与编辑模型 Nano Banana 2.1,主打更清晰的设计感、基于遮罩的编辑能力、更强的主体一致性以及更自然的成像效果。该模型还优化了文字渲染与多轮一致性,并支持 1K、2K 和 4K 分辨率的 Search grounding。用户可在 Google AI Studio、Gemini 应用、Gemini API 和 Google Cloud 中试用。

9月30日周三
  1. Google Research59

    Google发布Diffusion Controller:统一并简化AI图像生成控制

    Google Research提出Diffusion Controller框架,将图像生成的去噪过程重新定义为连续控制问题。该框架通过轻量级的“转向阻尼器”网络实现对生成轨迹的动态调整,可在不修改基础模型的情况下控制生成结果。在Stable Diffusion v1.4上的实验显示,灰盒版本在HPS-v2胜率上优于LoRA,白盒版本相较基线模型达到90%胜率。

8月28日周五
  1. Google DeepMind76

    Google DeepMind 发布 Gemini Omni 1.1 Flash

    Google DeepMind 发布 Gemini Omni 1.1 Flash,带来场景扩展、首尾帧插值、360p 快速预览和 4K 超分辨率等创意控制功能。新模型支持最长 40 秒视频生成,可在 Google AI Studio 和 Agent Platform API 中使用,也可通过 Google AI Plus、Pro 和 Ultra 订阅在 Google Flow 中访问。

    推荐理由:提供了具体的性能提升数据和可用性信息,读者可以评估新模型对自己工作流的实际价值。

4月23日周四
  1. Google Research72

    Google Photos Auto frame 推出视角重制功能,利用 3D 估计和生成式 AI 调整照片角度

    Google 宣布在 Google Photos 的 Auto frame 功能中推出新的视角重制技术。该方法先通过 3D 点云估计和人脸检测重建场景,再使用生成式潜扩散模型填补新视角下缺失的背景内容,从而在保持人物身份的同时自动调整拍摄角度。目前该功能已上线,可自动优化包含人物的肖像照片。

    推荐理由:原文介绍了 3D 场景估计+生成式修复的技术路径,读者可据此了解图像后期视角调整的新方法。

2月27日周五
5月21日周三