交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 4 条图像 · 工具·提示词·论文 三栏速览
每栏 2 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/ChatGPTAI 评分1919 用 GPT Image 2.5 将普通照片转化为"第二世界"海报的提示词指南
用户分享了一套基于 GPT Image 2.5 的提示词,可将任意上传照片生成一张"第二世界"竖版海报:上半保留原照主体、姿态与光线,下半以暖米色纸张延续同一结构(如道路、倒影或光线)并加入对应的纸艺互动场景,使两半形成连续画面。该提示词还规定可加入 0–3 个黑色线条小人以及一句手写英文短标题,但禁止脱离原图的插画、水印或装饰。
Ars Technica · AIAI 评分3333 Artcraft 用 Claude Opus 5.5 开源克隆 Adobe 七大软件
summary: Artcraft 开发者 Brandon Thomas 本周发布七款开源应用,用 Anthropic Claude Opus 5.5 以 Rust 编写(另提供 WebAssembly 浏览器版本)。
Reddit · r/artificialAI 评分66 Reddit 用户求助:能生成成人向但不裸露图片生成图片模型的 AI 图片生成器推荐
Reddit 用户发帖询问有没有能根据上传照片生成成人主题但不裸露(如蒙眼、束缚着衣)图片生成图片模型的 AI 工具,称 Grok、ChatGPT 等均拒绝相关请求或仅生成一张后拒绝继续编辑。帖文表示仅用于夫妻间的趣味图片,无意公开发布或售卖,希望社区推荐可用的图片生成图片模型。
Reddit · r/ChatGPTAI 评分66 ChatGPT 图像生成为何总把普通人画成"超模"身材
用户反馈 ChatGPT 图像生成时,无论提示词是否要求普通人物,输出结果普遍偏向超模身材、清晰下颌线、腹肌等理想化男性特征,或妆容精致、面容完美的女性形象。用户推测原因是训练数据以网红、网红风格的影响图居多,模型因此默认将人物美化,除非提示词明确反向指定。
Reddit · r/ChatGPTAI 评分1717 开发者用 GPT 生成 1200 多张美术素材,完成类 FTL 飞行艇策略游戏
一名独立开发者用 GPT 为其类 FTL 飞行艇策略游戏生成了超过 1200 张高质量美术素材,涵盖舰船房间、图标、成就、背景、舰船类型、敌人等内容。开发者表示,按其个人手工速度,这批素材本需数年才能完成,而 GPT 的产出速度快上百倍且质量更高。该游戏计划于数周后登陆 Steam。
Product HuntAI 评分4747 Google 发布图像模型 Nano Banana 2.1,支持遮罩编辑与多分辨率 Search grounding
Google 今日推出图像生成与编辑模型 Nano Banana 2.1,主打更清晰的设计感、基于遮罩的编辑能力、更强的主体一致性以及更自然的成像效果。该模型还优化了文字渲染与多轮一致性,并支持 1K、2K 和 4K 分辨率的 Search grounding。用户可在 Google AI Studio、Gemini 应用、Gemini API 和 Google Cloud 中试用。
Reddit · r/ChatGPTAI 评分33 用户分享将个人手绘转化为 AI 生成图的体验
一位 Reddit 用户分享了自己在情绪低落时画的一幅速写,并借助 AI 将其重新生成为一幅完成度更高的作品。该用户表示,看到 AI 生成的版本比自己原画的艺术水平更成熟,令人感到被肯定。该帖同时展示了 AI 辅助创作在个人表达层面的应用价值。
Reddit · r/ChatGPTAI 评分44 ChatGPT 为 Inktober 素描重新排列彩色铅笔颜色顺序
用户完成 Inktober 素描后,让 ChatGPT 按色轮渐变规律重新整理颜色顺序。ChatGPT 建议将 Golden Yellow 排在 Yellow 之后作为向橙色的过渡,并把 Mahogany 从红色系移至棕色系,同时提出 Aqua Green → Green → Jade Green → Yellow Green 的渐变排列。
TechCrunch · AIAI 评分2222 三名前 Ramp 工程师创办 Melius,融资 2500 万美元打造 AI 广告创意生成平台
由三名 Ramp 前工程师创办的 AI 创意平台 Melius 宣布完成总额 2500 万美元融资,包括 CRV 领投的 2000 万美元 A 轮和 General Catalyst 领投的 500 万美元种子轮。团队在首款 AI 营销产品上线六个月后因效果不佳废弃全部代码,转向做生成广告素材与活动的"创意工作智能体实验室",自 7 月走出隐身模式后两个月内年化营收已突破 100 万美元。
Hacker News · 首页AI 评分1818 《Claude Code》"建议消息"功能:真正的客户其实是模型本身
文章认为 Claude Code 的"suggested message"功能本质上是在为模型本身服务,而非帮助用户。该功能会自动生成推荐消息,引导用户进入模型擅长回答的问题和任务范围。功能的核心价值在于让模型更频繁地获得"可回答"的输入,从而提升整体回复质量。
The DecoderAI 评分6060 Google 发布图像模型 Nano Banana 2.1,画质提升且价格近乎减半
Google 发布图像生成与编辑模型 Nano Banana 2.1,取代今年 2 月发布的 Nano Banana 2,基于 Gemini 3.6 Flash,主打 Pro 模型的更高效版本。
Reddit · r/MachineLearningAI 评分1818 AFP-GIC:可控生成式图像压缩框架在 IEEE Access 发表
AFP-GIC 框架发表于 IEEE Access(2026),针对超低码率场景,通过非对称自适应融合先验迁移管道,在不传输融合先验的前提下实现先验引导的纹理重建。
Hacker News · 首页AI 评分4242 PhotoCraft:用 Rust 纯原生重写的开源 Photoshop 兼容图像编辑应用 PhotoCraft
PhotoCraft 是一款用 Rust 从零重写的开源图像编辑应用,对标 Adobe Photoshop。它支持图层、蒙版、调整图层、文字、矢量、画笔和真实 PSD 文件读写,使用 wgpu 跨平台 GPU 合成(Metal、Vulkan、DX12、WebGPU),无网络依赖、免账号。
Reddit · r/ChatGPTAI 评分55 用户用 ChatGPT 把"肌肉兔子吃粗粮面包"T 恤创意画了出来
用户最初只想做一件印有"肌肉兔子当 Pumpernickel(黑麦粗粮面包)"图案的 T 恤,于是让 ChatGPT 生成可视化图像;后续还扩展出背部训练计划和"Hoppeln(蹦跳)就是有氧"这类趣味梗。该帖子属于个人创意分享,并非 ChatGPT 新功能发布。
Product Hunt · AI 分类AI 评分3333 开源桌面工具 Scumble 发布,主打本地 ComfyUI 与多模型 API 的 AI 局部重绘编辑
Scumble 是一款免费、开源的桌面端 AI 局部重绘编辑器,用户框选画面区域并用文字描述应替换内容,结果会输出为独立且色彩匹配的图层。它支持在本地 ComfyUI 环境下运行,也可接入用户自己的 FLUX 3、GPT Image、Nano Banana 等 API key 调用。
Reddit · r/ChatGPTAI 评分1212 独立开发者一日耗尽 ChatGPT 20x 额度,仅为统一游戏村庄画风
Reddit 用户 AC-Daniel 在开发独立游戏时,为让村庄建筑匹配世界地图的"墨水羊皮纸"风格,在一天内对 ChatGPT 发起了 57 次生成请求,耗尽其 20x 订阅额度的全部 token。该用户最终成功统一了画风并"解决了住房问题"。
The DecoderAI 评分2424 Reka AI 发布全能模型 Rho-1,单一网络处理文本、图像、视频与机器人控制
Reka AI 发布研究预览版全能模型 Rho-1,采用 190 亿参数(19-billion-parameter)单一神经网络,同时处理和生成文本、图像、视频与机器人控制动作,所有模态作为 token 在同一上下文窗口中运行,无需工具调用。模型可实时生成连续视频并即时响应新指令,同一批权重既预测摄像头图像又驱动机器人运动;训练在 320 块 H100 GPU 上历时约三个月完成。
Reddit · r/ChatGPTAI 评分3535 我用 GPT images 为 Airship roguelite 制作了 600+ 艺术资产
开发者使用 GPT images 生成了其 Airship roguelite 游戏的全部 600+ 艺术资产,还制作了"后台"环境和角色表。开发者表示 GPT images 已成为其创作的主要支柱。该游戏计划在两周后发布于 Steam 平台。
Reddit · r/ChatGPTAI 评分1212 ChatGPT 图像生成分辨率不够怎么办?
ChatGPT 图像生成功能的分辨率并非顶尖,有亚马逊卖家在 Reddit 询问如何提升图像质量以满足产品图需求。这位用户表示正在寻找第三方工具来补充 ChatGPT 的图像生成能力。
Product Hunt · AI 分类AI 评分5050 Anthroposcaper:浏览器端2D图纸自动生成3D场景工具
Anthroposcaper 是一个基于浏览器的3D场景构建工具,用户可绘制2D平面图或导入DXF文件,标记面和线后将GLB模型沿匹配边缘自动放置成纹理化3D场景,修改标记即可重建场景。通过MCP协议连接AI智能体辅助设置模板和材料,最终导出GLB文件至3D编辑器或游戏引擎。
Reddit · r/artificialAI 评分66 Instagram 的 AI 检测功能是否容易被绕过?
一位 Reddit 用户质疑 Instagram 的 AI 生成内容检测功能是否可靠,询问该检测机制是否能被轻易绕过。用户表示自己越来越难以分辨 AI 图像与真实内容,怀疑该检测通知是否万无一失。
Simon WillisonAI 评分3030 Photo Scrubber:本地面部模糊与元数据移除工具
Simon Willison 让 GPT-6 Astra 构建了一个实验性工具 Photo Scrubber,可识别照片中的人脸并自动模糊,同时移除 EXIF 等元数据。该工具使用 Google MediaPipe C++ 库(通过 @mediapipe/tasks-vision 编译为 WebAssembly)和 BlazeFace 人脸检测模型,完全在本地运行以保护隐私。
Reddit · r/MachineLearningAI 评分5454 ORTUS AI 开源 RightWayUp 360 度图像旋转检测模型
ORTUS AI 开源了图像旋转检测模型 RightWayUp,可判断图像 360 度旋转角度并在无明确"上"方向时选择不预测,发布 Apache-2.0 许可的代码和权重(6 种规格)。
Google ResearchAI 评分5959 Google发布Diffusion Controller:统一并简化AI图像生成控制
Google Research提出Diffusion Controller框架,将图像生成的去噪过程重新定义为连续控制问题。该框架通过轻量级的“转向阻尼器”网络实现对生成轨迹的动态调整,可在不修改基础模型的情况下控制生成结果。在Stable Diffusion v1.4上的实验显示,灰盒版本在HPS-v2胜率上优于LoRA,白盒版本相较基线模型达到90%胜率。
Product HuntAI 评分4040 ImageFlow:一款完全在浏览器中运行的免费图像编辑器
ImageFlow 是一款完全在浏览器中运行的免费全功能图像编辑器,支持图层、蒙版、混合模式、调整图层、智能对象、文字与滤镜,并支持 PSD 导入导出和设备端 AI 选区;所有处理均在本地完成,文件不上传服务器。
OpenAI NewsAI 评分4545 OpenAI 推出 ChatGPT Images 2.5
ChatGPT Images 2.5 帮助用户将想法、草图和参考照片转化为更个性化、更精致的图像,更好地呈现用户的创意构思。该版本相较前代在图像细节和个性化程度上有显著提升。
Google DeepMind精选AI 评分7676 Google DeepMind 发布 Gemini Omni 1.1 Flash
Google DeepMind 发布 Gemini Omni 1.1 Flash,带来场景扩展、首尾帧插值、360p 快速预览和 4K 超分辨率等创意控制功能。新模型支持最长 40 秒视频生成,可在 Google AI Studio 和 Agent Platform API 中使用,也可通过 Google AI Plus、Pro 和 Ultra 订阅在 Google Flow 中访问。
推荐理由:提供了具体的性能提升数据和可用性信息,读者可以评估新模型对自己工作流的实际价值。
Product Hunt · AI 分类AI 评分4747 Imejis:为 Claude、ChatGPT、Cursor 等 AI 智能体打造的设计工作室
Imejis 通过 MCP 协议为 AI 智能体提供设计能力,可创建、编辑和渲染生产级图形,支持 OG 图片、社交卡片、营销图表、证书、QR 码等。与生成式图像模型不同,Imejis 采用确定性输出,相同输入产生相同像素,确保品牌、布局和排版的一致性。目前免费开放使用。
Product Hunt · DesignAI 评分2828 Fuser:面向多模型多模态创作的节点式画布工具
Fuser 是一款基于节点的画布工具,面向创意工作场景,强调跨模型与跨模态的探索与迭代。它作为"创意 harness"式的中间件,把用户创意、模型调用与生成输出串联成统一工作流。产品已在 Product Hunt 上线,可立即试用。
Product Hunt · DesignAI 评分3131 AI 设计工具 Wonder 进入公开 alpha,支持连接 Cursor 与 Claude Code
Wonder 是一款 AI 设计智能体,可直接在画布上生成 UI、图形与 pitch deck,并对任意元素实时选区细化。用户可通过 MCP 将其与 Cursor、Claude Code 等编码智能体连接,从设计直接进入开发流程。该产品目前处于 public alpha 阶段。
Google Research精选AI 评分7272 Google Photos Auto frame 推出视角重制功能,利用 3D 估计和生成式 AI 调整照片角度
Google 宣布在 Google Photos 的 Auto frame 功能中推出新的视角重制技术。该方法先通过 3D 点云估计和人脸检测重建场景,再使用生成式潜扩散模型填补新视角下缺失的背景内容,从而在保持人物身份的同时自动调整拍摄角度。目前该功能已上线,可自动优化包含人物的肖像照片。
推荐理由:原文介绍了 3D 场景估计+生成式修复的技术路径,读者可据此了解图像后期视角调整的新方法。
Product Hunt · DesignAI 评分2323 Anthropic Labs 上线 Claude Design,整合 Claude 5.5 家族产品入口
Anthropic Labs 上线 Claude Design,作为 Claude 系列产品的统一展示入口,页面列出了 Claude 5.5 家族的多款模型与工具。
Product Hunt · DesignAI 评分6262 谷歌发布图像生成模型 Nano Banana 2
谷歌推出最新图像生成模型 Nano Banana 2,主打更强的世界知识、生产可用规格和主体一致性,并保持 Flash 速度。该产品于 2026 年 2 月 27 日上线 Product Hunt,归类为 AI 生成媒体与基础模型。
Product Hunt · DesignAI 评分2323 Moda:用 AI 辅助设计品牌一致内容的可编辑画布工具
Moda 是一款专为图形设计训练的 AI 工具,可用于生成幻灯片、海报、广告等品牌一致的内容。其核心差异在于所有输出都可在分层画布上完全编辑,区别于其他 AI 设计工具。
Product Hunt · DesignAI 评分1515 Genspark AI Designer:一句话生成设计的 AI 智能体
Genspark AI Designer 是一款 AI 智能体,用户只需一条提示词即可生成各类设计内容,作为 Genspark Super App 中的 AI 员工角色上线。该工具于 2025 年 9 月 1 日推出,与 GenCode、Genspark for Word 等模块共同构成 Genspark 的 AI 智能体引擎。
Product Hunt · DesignAI 评分77 Z3D 发布 Vortex 版本,主打多角度 AI 3D 模型生成
Z3D 推出 Vortex 版本,定位为 AI 3D 模型生成工具,支持输入文本提示词或参考图像生成专业级 3D 模型与场景,宣称无需专业技能即可在数秒内完成多角度生成。该产品所属类别为 3D & Animation 与 AI Generative Media,于 2025 年 6 月 22 日上线。
Product Hunt · DesignAI 评分77 (Not Boring) Camera 上线,主打"认真但不较真"的相机 App
(Not Boring) Camera 是一款主打摄影的相机 App,定位为"不把自己太当回事的严肃相机",于 2025 年 6 月 8 日在 Product Hunt 上线。产品主打"为热爱摄影的人(For the love of photography)"社区,目前已有 366 名关注者。官方认为相机硬件虽不断升级,但用户拍出的照片并未变得更耐看。
Product Hunt · DesignAI 评分00 Google DeepMind 发布 Imagen 4 图像生成模型
Google DeepMind 发布 Imagen 4 图像生成模型,支持 2k 分辨率,文字排版与色彩表现更佳,提示词遵循度提升。模型现已接入 Gemini、Whisk 和 Vertex AI。
Mistral AI精选AI 评分7575 Mistral 推出 OCR API,基准测试超越 Google、Azure 和 GPT-4o
Mistral 发布新的 OCR API Mistral OCR,可处理图像和 PDF 并提取交错文本和图像,在基准测试中超越 Google Document AI、Azure OCR、Gemini 和 GPT-4o。定价为每美元 1000 页,单节点处理速度最高达每分钟 2000 页,支持多语言文档理解,现已在 Le Chat 免费试用,API 已上线 la Plateforme。
推荐理由:原文给出了具体定价、基准测试对比和可用入口,读者可以据此评估它与现有 OCR 方案的差异。
Product Hunt · DesignAI 评分44 Prompt Llama:跨模型同提示词文本生成图像评测工具
Prompt Llama 是一个用于收集高质量文本到图像 prompt 并用同一 prompt 测试不同模型表现的评测工具,2024 年 9 月 29 日在 Product Hunt 上线。该项目通过统一提示词横向对比各模型生成效果,帮助用户判断不同模型在同一任务下的表现差异。