#图像
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#图像
今日 0 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/ChatGPTAI 评分3535 我用 GPT images 为 Airship roguelite 制作了 600+ 艺术资产
开发者使用 GPT images 生成了其 Airship roguelite 游戏的全部 600+ 艺术资产,还制作了"后台"环境和角色表。开发者表示 GPT images 已成为其创作的主要支柱。该游戏计划在两周后发布于 Steam 平台。
Reddit · r/ChatGPTAI 评分3333 从一张图片到可探索的3D世界:GPT-6 Astra、Three.js 与 Hyper3D
GPT-6 Astra 结合 img2threejs 流程和 Hyper3D 3D 参考,将单张冬季场景图片重建为可交互的 3D 环境。用户可在场景中行走、在雪地留下足迹、开门、调整时间,并在夜间放置篝火。该项目仍为早期演示,展示了从单一图像构建可探索世界的可能性。
Reddit · r/ChatGPTAI 评分1212 ChatGPT 图像生成分辨率不够怎么办?
ChatGPT 图像生成功能的分辨率并非顶尖,有亚马逊卖家在 Reddit 询问如何提升图像质量以满足产品图需求。这位用户表示正在寻找第三方工具来补充 ChatGPT 的图像生成能力。
The DecoderAI 评分7474 Black Forest Labs 发布 Flux 3 Image,支持多步骤编辑不影响图片其他部分
Black Forest Labs 发布 Flux 3 Image 图像模型,支持多步骤编辑且不影响图片其他部分,同时支持文本到图像、图像到图像、文本渲染和逼真图像生成,可通过边界框构图、最多十张参考图像生成,最高输出 4K。免费演示可用,API 半价至 10 月 8 日,商业授权可自建和微调,开源权重版本预计几周内推出。
Product Hunt · AI 分类AI 评分5050 Anthroposcaper:浏览器端2D图纸自动生成3D场景工具
Anthroposcaper 是一个基于浏览器的3D场景构建工具,用户可绘制2D平面图或导入DXF文件,标记面和线后将GLB模型沿匹配边缘自动放置成纹理化3D场景,修改标记即可重建场景。通过MCP协议连接AI智能体辅助设置模板和材料,最终导出GLB文件至3D编辑器或游戏引擎。
The DecoderAI 评分5656 Ideogram 4.5 解决局部图像编辑难题
Ideogram 发布新模型 Ideogram 4.5,声称可实现图像局部编辑而不破坏其余部分,解决了 AI 图像编辑的核心痛点。该模型支持产品摄影、室内设计、图像修复和文本编辑等场景,提供 0.8-22 美分四个质量档次,均为原生 2K 分辨率。模型现已上线 Ideogram 平台和 API,合作方包括 Picsart、Runway、Pika 和 Leonardo AI,并即将开放权重。
Reddit · r/artificialAI 评分66 Instagram 的 AI 检测功能是否容易被绕过?
一位 Reddit 用户质疑 Instagram 的 AI 生成内容检测功能是否可靠,询问该检测机制是否能被轻易绕过。用户表示自己越来越难以分辨 AI 图像与真实内容,怀疑该检测通知是否万无一失。
Reddit · r/LocalLLaMAAI 评分5555 在 286 Tandy 1000 上运行完整 AI 对话和图像生成
作者在一台 1986 年的 Intel 286 Tandy 1000 TL/3 上运行 DeskMind DOS 程序,通过 PicoMEM 2 WiFi 卡连接本地 PC 上的 Python 服务器,服务器调用 Qwen3.8-27B 进行对话并用 Krea 2(ComfyUI)生成图像。
Reddit · r/ChatGPTAI 评分3030 ChatGPT 安全过滤器误报仍消耗配额,用户抱怨被提前锁定
用户在 ChatGPT 图像生成中请求一张全覆盖 realistic 照片时被安全过滤器错误拦截为"性内容",但系统仍扣除使用配额,连续多次误报后用户配额耗尽被锁定至周日。用户的核心诉求是:过滤器阻止结果时不应计入配额消耗。
Simon WillisonAI 评分3030 Photo Scrubber:本地面部模糊与元数据移除工具
Simon Willison 让 GPT-6 Astra 构建了一个实验性工具 Photo Scrubber,可识别照片中的人脸并自动模糊,同时移除 EXIF 等元数据。该工具使用 Google MediaPipe C++ 库(通过 @mediapipe/tasks-vision 编译为 WebAssembly)和 BlazeFace 人脸检测模型,完全在本地运行以保护隐私。
Reddit · r/MachineLearningAI 评分5454 ORTUS AI 开源 RightWayUp 360 度图像旋转检测模型
ORTUS AI 开源了图像旋转检测模型 RightWayUp,可判断图像 360 度旋转角度并在无明确"上"方向时选择不预测,发布 Apache-2.0 许可的代码和权重(6 种规格)。
Reddit · r/MachineLearningAI 评分2020 货架审计中 YOLO + 嵌入向量的尺寸变体识别难题如何解决
作者构建的货架审计工具采用YOLO检测产品后用嵌入向量搜索SKU,但同一品牌、相同瓶子不同尺寸(1.25L vs 2L)的产品容易被误识别。尝试DINOV2、SigLIP2、OpenCLIP等嵌入模型均失败,原因在于图片被letterbox到224x224后小尺寸文字几乎消失,且参考图只有货架照片而非棚拍图。作者询问是否需微调嵌入器增加硬负样本、用OCR作为第二检查,或放弃全局嵌入方案。
Reddit · r/MachineLearningAI 评分6262 通过确定性图像路由将 token 消耗降低 88%(P50: 59ms)
作者为 VEX agent runtime 实现了一种图像预分类路由系统,通过颜色多样性、结构元素等数学特征判断图像应走 OCR 路由还是 VLM 路由。
OpenAI NewsAI 评分4545 OpenAI 推出 ChatGPT Images 2.5
ChatGPT Images 2.5 帮助用户将想法、草图和参考照片转化为更个性化、更精致的图像,更好地呈现用户的创意构思。该版本相较前代在图像细节和个性化程度上有显著提升。
Product Hunt · AI 分类AI 评分4747 Imejis:为 Claude、ChatGPT、Cursor 等 AI 智能体打造的设计工作室
Imejis 通过 MCP 协议为 AI 智能体提供设计能力,可创建、编辑和渲染生产级图形,支持 OG 图片、社交卡片、营销图表、证书、QR 码等。与生成式图像模型不同,Imejis 采用确定性输出,相同输入产生相同像素,确保品牌、布局和排版的一致性。目前免费开放使用。
Google Research精选AI 评分7272 Google Photos Auto frame 推出视角重制功能,利用 3D 估计和生成式 AI 调整照片角度
Google 宣布在 Google Photos 的 Auto frame 功能中推出新的视角重制技术。该方法先通过 3D 点云估计和人脸检测重建场景,再使用生成式潜扩散模型填补新视角下缺失的背景内容,从而在保持人物身份的同时自动调整拍摄角度。目前该功能已上线,可自动优化包含人物的肖像照片。
推荐理由:原文介绍了 3D 场景估计+生成式修复的技术路径,读者可据此了解图像后期视角调整的新方法。