#视频
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#视频
今日 1 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Replicate BlogAI 评分6464 Veo 3.1 提示词指南
Google 发布了 Veo 3.1,Replicate 官方博客提供了提示词教程。新增三大功能:参考图像生成视频(最多3张图合成连贯场景)、首尾帧插帧(指定起止帧让模型生成过渡动画)、增强的图像转视频(模型能理解图像内容并生成自然motion)。除参考图像功能外,其他功能提供快速生成选项,约60秒完成,价格减半。教程包含代码示例和 API 调用方式。
Replicate BlogAI 评分7070 Wan 2.2 发布:开源视频生成模型更新
Wan 2.2 是开源视频生成模型的重大更新,物理模拟更精确、生成速度更快、控制能力更强。Replicate 与 Pruna AI 合作推出优化版本,文本生成视频 480p 仅需 $0.05/视频,720p 为 $0.10/视频,推理时间约 30 秒。未优化版本 480p 为 $0.40/视频,720p 为 $1.00/视频。
Replicate BlogAI 评分4747 AI 视频模型对比指南
Replicate 平台对比了 24 款 AI 视频生成模型的价格、分辨率、时长和功能。Alibaba Wan 2.2 5b fast 价格最低 $0.01 起、生成速度最快 6-16 秒,Google Veo 3 价格最高 $6、支持原生音频。所有模型均支持商业使用,价格和速度数据截至 2025年7月。
Replicate BlogAI 评分6767 如何充分利用 Google Veo 3
Google Veo 3 支持原生音频生成(音效、环境音和对话),提示词理解更精准,物理准确性和真实感更强。
Replicate BlogAI 评分2323 AI 创意工具汇总:语音模型、3D 生成与 LoRA 微调
Google DeepMind 发布 ShieldGemma 2,可高精度检测 NSFW 内容和暴力元素;腾讯推出 Hunyuan3D 2Mini,用于游戏资产和风格化角色创作。
Replicate BlogAI 评分6666 Wan2.1: 通过 API 生成视频
Wan2.1 是最新最强的开源视频模型,已上线 Replicate 平台,提供 14B 和 1.3B 参数两种规模,支持 480p 和 720p 分辨率的文本生成视频和图像生成视频。性能方面,5秒 480p 视频生成需 39秒,720p 需 150秒。该模型在手部细节、物理准确性和物体交互等方面表现突出,可通过 Replicate JavaScript 客户端调用 API。
Replicate BlogAI 评分5050 Wan2.1 参数调节实战教程
Replicate 测试了阿里 Wan2.1 14b 文本到视频模型的参数调优效果,使用固定提示词和种子进行系统性参数扫描。实验发现 guidance scale 为 3-7 时效果最佳(0 为创意模式,8+ 会出现 AI 痕迹),shift 控制运动流畅度,1 产生推拉效果,7-9 倾向于相似的画面构图。
Replicate Blog精选AI 评分7979 Replicate 平台现已支持微调开源视频模型
Replicate 推出基于腾讯 HunyuanVideo 的微调功能,用户可通过平台工具收集训练数据、训练自定义视频模型并生成视频。HunyuanVideo 擅长捕捉训练数据的视觉风格和运动模式,包括角色动作和镜头运动,这种动态风格迁移是其独特优势。训练通常需要 5-10 分钟,支持通过 API 自动化。
推荐理由:原文给出了在 Replicate 上微调视频模型的完整步骤和入口,读者可以据此实践自定义视频生成。
Replicate BlogAI 评分3737 使用 Replicate playground 生成短视频
Replicate 发布 playground 实验性网页界面,提供类似剪贴簿的 UI 用于测试和比较不同图像/视频模型,并保留实验记录。工作流程分为三步:首先使用 flux-aesthetic-anime 等图像模型生成起始图片,然后通过 minimax/video-01-live 将图片转换为视频,最后利用 zsxkib/mmaudio 模型为视频添加匹配的音乐音效。
Replicate BlogAI 评分7373 AI 视频模型横评:Sora 后的开源浪潮与平台选择
AI 视频正迎来突破时刻。2023 年 AI 视频质量尚差,2024 年 Sora 重新定义期待,随后大量模型涌现。Minimax Video-01 质量接近 Sora 但闭源,Tencent Hunyuan Video 开源可微调,Genmo Mochi 1 已优化至单卡 4090 可运行,Lightricks LTX-Video 仅需 10 秒生成 3 秒视频。
Replicate BlogAI 评分2626 Replicate Intelligence #12:FLUX.1 图像生成工具与大脑自我训练研究
FLUX.1 图像生成模型推出两个新工具:ReFlux 支持多模型无限画布创作,Multi-LoRA Explorer 可单图叠加多个 LoRA 实现复杂风格组合。开源项目 Deep-Live-Cam 实现照片实时换脸到视频。此外,有研究揭示大脑在 REM 睡眠期间会模拟动作与后果,生成合成数据进行自我训练,与 AI 模型训练方式存在相似性。
Replicate BlogAI 评分2121 Replicate Intelligence #11:FLUX.1 微调上线,Tavus 推出数字双胞胎视频对话 API
Replicate 现已支持 FLUX.1 微调,上传 12-20 张图片并选择触发词,约 30 分钟即可生成定制模型。Tavus 发布 Conversational Video Interface,可构建低延迟(<1 秒)的数字双胞胎进行实时视频对话,适用于客户支持和销售场景。
Replicate BlogAI 评分2424 Replicate Intelligence #9:本周开源AI模型动态
Black Forest Labs发布FLUX.1图像生成模型套件,采用"flow matching"技术,支持高达2百万像素分辨率,分为pro、dev、schnell三个版本。Meta推出SAM 2图像和视频分割模型,零样本能力扩展至视频领域,性能提升3倍。Google发布Gemma 2 2B紧凑语言模型,仅20亿参数但在LMSYS Chatbot Arena超越所有GPT-3.5模型。