交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 0 条视频 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条量子位 QbitAIAI 评分2121 AI影视公司Utopai Studios视频模型Utopai X登顶Artificial Analysis榜单第二
独立影视公司Utopai Studios推出的文生视频模型Utopai X,在Artificial Analysis(AA)盲测榜单中以1150分位列第二,仅比阿里的Wan 3.0低7分。
Product HuntAI 评分3131 Manus 2.0 上线 Video Editor,让普通用户也能剪辑出值得发布的视频
Manus 2.0 推出 Video Editor,将 AI 视频生成与剪辑工作流结合,帮助用户把创意和原始素材做成可发布的成片。在经过一个月每日使用后,Manus 已被用于制作产品发布片、游戏预告、新闻解说、节拍同步动画及旅行素材剪辑。该功能面向所有人开放,并提供免费方案。
Reddit · r/LocalLLaMAAI 评分2020 开发者展示 ~960M 参数本地 AI 世界模型,可在消费级显卡上实时将图像转为可操控角色
独立开发者 lucidml_lover 发布其本地 AI 世界模型第二版,参数约 960M,采用纯 Transformer 架构配合扩散强制(diffusion forcing)训练,推理时每帧进行 2-5 步扩散并加入 KV cache,配合滑动窗口保留最近 80 帧上下文。
Product Hunt · AI 分类AI 评分3434 EasyCut:把 Claude 生成的动态视频变成多轨时间线,支持逐元素编辑
EasyCut 是一款浏览器端的视频编辑工具,可将 Claude 生成的动态视频拆分为标题、场景、图像、声音等独立轨道,允许用户选中任一元素让 Claude 仅修改该部分而无需重建全片,并提供配乐适配、慢动作、多平台尺寸调整与导出功能。该工具免费使用,所有文件均在本地设备处理。
Hacker News · 首页AI 评分4545 Gitframes:面向 AI 编码智能体的代码优先视频生成 npm 包
Gitframes 是一个 npm 包,将 Photoshop 级合成、After Effects 级动效和 Blender 级 3D 场景整合在一起,供智能体通过 TypeScript 直接驱动并渲染 MP4,绕开无头浏览器和 DOM 重排。
Product Hunt · AI 分类AI 评分44 HyperFrames Studio(桌面版)
HyperFrames Studio(桌面版)在 Product Hunt AI 分类上线,是 HeyGen AI 视频平台的桌面端形态。HeyGen 由 AI Video Agent 驱动,支持从脚本、图片、演示文稿和对话式提示词生成视频,号称拥有 G2 排名第一的 AI 数字人,支持 175+ 种语言,累计用户超 3000 万。
Reddit · r/LocalLLaMAAI 评分2727 你试过用 Muse Spark 1.3 在 Opencode 上免费生成视频吗?
用户在 Opencode 平台使用免费模型 Muse Spark 1.3 成功生成了视频。生成效果不如 Opus 5.5,但表现不错,且目前免费可用。该模型为视频生成提供了免费替代方案。
Product Hunt · AI 分类AI 评分5555 WeftCut:支持 MCP 控制的免费开源桌面视频编辑器
WeftCut 是一个免费、开源的桌面视频编辑器,可通过 MCP 让 AI 智能体控制进行剪裁片段、添加字幕、从代码构建动画等操作,并支持实时时间线编辑、查看修改、撤销或手动接管。适用于 Windows、macOS 和 Linux 平台。
The DecoderAI 评分7171 Tavus 发布 Griffin:首个面向实时视频对话的 Human Interaction Model
Tavus 发布 Griffin,号称首个 Human Interaction Model(HIM),能实时处理语音、面部表情、语气、手势和停顿。在 Tavus 研究中,48% 的参与者在 1 分钟视频通话后认为 Griffin 是真人,之前系统最高仅 2%。
Reddit · r/artificialAI 评分2727 Sonnet 5.5 用单个提示词生成了这个运动图形视频,花费 $0
用户用 Sonnet 5.5 从单个提示词生成了运动图形视频,成本为 $0。视频现已发布在 Reddit 上,作者正在询问社区对质量的评价及发布前是否需要修改。
Product Hunt · AI 分类AI 评分5050 RxFilm Studio 发布 AI 视频创作工具
用户通过描述需求即可创作和编辑视频。RxFilm Studio 可将想法、网站、截图、视频素材转换成成片,支持用自然语言精调每个场景的时间、布局、动画、转场、配音、音乐和字幕,无需重新生成整个视频。还可录制带有智能光标跟踪和自动点击缩放的产品演示。
Product Hunt · AI 分类AI 评分1919 Viibeo:用提示词或脚本一键生成可发布的短视频,并支持自动批量产出与广告创意
Viibeo 可将提示词、网页链接或脚本转化为可发布的去人像短视频,自动生成钩子式脚本、配音、B-roll 和定时字幕,支持导出 9:16 MP4,或通过 Autopilot 在支持社交渠道上定时批量发布。Inspiration Feed 用于发现可复刻的热门格式,Ad Factory 可将产品静图转为短视频广告创意;首支视频免费但带水印,付费套餐起步价为每月 19 美元。
Product Hunt · AI 分类AI 评分3333 Dina 4.5 发布:macOS 全流程视频工作流工具
Dina 4.5 是一款 macOS 全流程视频工作流应用,整合录屏、剪辑、AI 音频清理、配音、转录驱动编辑、AI 字幕生成、文本转语音及最高 8K 导出等功能。应用面向追求专业效果但不愿在多个工具间切换的创作者,提供键盘快捷键和注释等生产力特性。
Product Hunt · AI 分类精选AI 评分6363 Arsaze 发布 AI 视频编辑器,支持 AI 智能体与人类协同编辑
Arsaze 推出 AI 视频编辑器,定位为视频编辑领域的 Cursor。该产品提供真正的多轨时间线,AI 智能体和人类都能通过 MCP 或语音驱动进行编辑,整合 AI 视频编辑、生成和智能体驱动编辑功能于同一时间线。
推荐理由:原文给出了产品定位和核心能力,读者可以据此判断它与传统视频编辑器的差异。
Product HuntAI 评分1111 TwelveLabs 发布 Pegasus 1.6:可将第一人称视频转为机器人训练数据
TwelveLabs 发布 Pegasus 1.6 模型,专为从第一人称视角理解画面,可将 egocentric 及远程操作视频直接转化为带标签和时间戳、可用于机器人训练的标注数据,无需人工标注。模型对实体识别更精确,并能跨分段生成持续一致的元数据。
OpenAI NewsAI 评分2222 invideo 如何用 GPT‑6 Astra 实现颜色分级提升 3 倍
GPT‑6 Astra 帮助 invideo 实现颜色校正和分级效率提升 3 倍,编辑规划精度显著提高。invideo 现在可在一日内生成 50 个自定义效果。
OpenAI NewsAI 评分2121 Higgsfield AI 用 GPT-6 Astra 一天内推出新视频功能
Higgsfield AI 基于 GPT-6 Astra 在一天内完成新视频功能开发,使小企业视频广告创作更加便捷。GPT-6 Astra 赋能 Higgsfield AI 加速将新创意工具推向市场。
Product Hunt · AI 分类AI 评分4242 Pexo:对话式AI产品发布视频生成工具
Pexo是一款对话式AI视频生成工具,用户只需分享产品、网站或素材,它会自动规划故事情节、为每个任务选择合适的AI模型、生成场景并处理配音、音乐、字幕、动态图形和编辑。用户可通过评论或圈选进行修改指示,从概念到成品品牌视频全程由一个AI智能体完成。
Product Hunt · AI 分类AI 评分3535 Syllaby AI 数字人 2.0 发布
Syllaby 推出 AI 数字人 2.0,可将脚本或简单想法转化为由逼真 AI 数字人主持的视频,包含自然语音、B-roll 素材和字幕,无需雇佣演员。该工具支持快速创建主持人视频,当前在 Product Hunt 发布。
The Rundown AIAI 评分6161 Runway 推出 Solaris 预览版:用视频实时渲染替代传统网页
Runway 发布 Solaris(界面世界模型),将网站和应用实时渲染为视频,结合 Gen-4.5 视频模型与 LLM 根据用户点击逐帧生成内容,演示包括虚拟试衣、食材组合和交互式燃烧实验。在 Runway 测试中,测试者在 71% 场景行为判断和 61% 指令遵循上更倾向于 Solaris 而非 Claude Opus 5 编写的页面,当前仍存在文本清晰度、长时间会话漂移等问题。
Google DeepMind精选AI 评分7979 Google DeepMind 发布 Gemini Omni 模型,可从任意输入创建视频
Google DeepMind 发布 Gemini Omni 系列首款模型 Gemini Omni Flash,可接受图像、音频、视频和文本作为输入,结合 Gemini 的现实世界知识生成高质量视频,并通过自然语言对话编辑视频。
推荐理由:原文给出了新模型的能力特点和可用入口,读者可以据此了解视频生成领域的新进展。