#多模态
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#多模态
今日 0 条视频 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分2727 你试过用 Muse Spark 1.3 在 Opencode 上免费生成视频吗?
用户在 Opencode 平台使用免费模型 Muse Spark 1.3 成功生成了视频。生成效果不如 Opus 5.5,但表现不错,且目前免费可用。该模型为视频生成提供了免费替代方案。
The DecoderAI 评分7171 Tavus 发布 Griffin:首个面向实时视频对话的 Human Interaction Model
Tavus 发布 Griffin,号称首个 Human Interaction Model(HIM),能实时处理语音、面部表情、语气、手势和停顿。在 Tavus 研究中,48% 的参与者在 1 分钟视频通话后认为 Griffin 是真人,之前系统最高仅 2%。
Product HuntAI 评分1919 Tavus 发布 Griffin:面向实时面对面对话的 Human Interaction Model
Tavus 推出 Griffin——一款可同时"看、听、说"的实时面对面对话 Human Interaction 模型,能根据停顿、表情、手势和摄像头画面进行响应。在一分钟实时视频通话测试中,48% 的参与者误以为对方是真人。其轻量版 Griffin-Lite 以研究预览形式向部分早期测试者开放,支持全双工视频到视频交互与 720p 视频生成。
OpenAI NewsAI 评分2222 invideo 如何用 GPT‑6 Astra 实现颜色分级提升 3 倍
GPT‑6 Astra 帮助 invideo 实现颜色校正和分级效率提升 3 倍,编辑规划精度显著提高。invideo 现在可在一日内生成 50 个自定义效果。
Product Hunt · AI 分类AI 评分3535 Syllaby AI 数字人 2.0 发布
Syllaby 推出 AI 数字人 2.0,可将脚本或简单想法转化为由逼真 AI 数字人主持的视频,包含自然语音、B-roll 素材和字幕,无需雇佣演员。该工具支持快速创建主持人视频,当前在 Product Hunt 发布。
The Rundown AIAI 评分6161 Runway 推出 Solaris 预览版:用视频实时渲染替代传统网页
Runway 发布 Solaris(界面世界模型),将网站和应用实时渲染为视频,结合 Gen-4.5 视频模型与 LLM 根据用户点击逐帧生成内容,演示包括虚拟试衣、食材组合和交互式燃烧实验。在 Runway 测试中,测试者在 71% 场景行为判断和 61% 指令遵循上更倾向于 Solaris 而非 Claude Opus 5 编写的页面,当前仍存在文本清晰度、长时间会话漂移等问题。
Google DeepMind精选AI 评分7979 Google DeepMind 发布 Gemini Omni 模型,可从任意输入创建视频
Google DeepMind 发布 Gemini Omni 系列首款模型 Gemini Omni Flash,可接受图像、音频、视频和文本作为输入,结合 Gemini 的现实世界知识生成高质量视频,并通过自然语言对话编辑视频。
推荐理由:原文给出了新模型的能力特点和可用入口,读者可以据此了解视频生成领域的新进展。