Seedance 2.5 换脸实测:上传参考视频和角色图即可替换人物
Seedance 2.5 支持上传参考视频与新角色图片来替换画面中的人物,只需替换一位表演者并保留其余人物的动作、表情与镜头信息。部分参考视频会被拒绝,可先用 Codex 模糊人脸后重新提交,且最好每次只处理两个角色。作者用它把《The Office》剧集里的演员依次换成 Dario、Jensen 和 Sam。
Seedance 2.5 支持上传参考视频与新角色图片来替换画面中的人物,只需替换一位表演者并保留其余人物的动作、表情与镜头信息。部分参考视频会被拒绝,可先用 Codex 模糊人脸后重新提交,且最好每次只处理两个角色。作者用它把《The Office》剧集里的演员依次换成 Dario、Jensen 和 Sam。
Pika 展示 Vuvie Series 的又一个示例:由 Michael Vu 执导的动作冒险剧集第 1 集,使用 Seedance 2.5 在 Pika API 上生成。更多内容可在 vuvie.io 观看。
Pika 推出 API Club,开发者可调用 100 多个领先的生成式媒体模型,价格更低以支持更多创作场景。加入入口为 dev.pika.art。
Pika 推出 API Club 的初衷是让生成媒体对开发者和中小企业更可及,最新案例是 thevumedia 打造的 Vuvie 应用。该工作室借此每月在生成媒体成本上节省超 $12K。
HeyGen 调查 1000+ 位小企业主发现,71.6% 曾为生意拍过视频却从未发布,53.9% 称原因是画面不够专业,48.6% 则不愿看到自己的样子。该调查进一步询问了 AI 数字人替他们出镜后的结果,完整报告已在 heygen.com 发布。
Google DeepMind 在 Gemini 3.8 Live 基础上推出 Live Avatar,把近实时视频生成与语音结合,让对话模型具备带唇形同步、自然表情和流畅轮次切换的动态视觉形象。
LovartAI 在 X 发布一段 AI 生成视频,画面中一只狗像在城市街头随意漫步。该帖获得 123 次点赞、17 次转发、11 条回复,浏览量约 45097 次。
视频克隆 skill 的地址已公布为 colaskill.com/zh/listenhub-h…。该 skill 由 xgo.ing 提供支持,原文未披露模型、参数或可用性等更多细节。
现在的 AI 视频克隆技术已能完整复刻爆款视频,一条 3 分钟的 "Jev 宣发视频" 被 oneshot 复刻,人物、声音、动作等每个细节都能直接修改。作者认为做爆款视频很难,但改一个要容易很多。
Kevin Weil 转发 Jeffrey Katzenberg 关于 AI、技术与创造力的文章并称需要更多这类对 AI 的乐观看法。Katzenberg 在文中回忆 2023 年曾预言 AI 工具将在三年内把世界级动画的制作时间和成本削减多达九成,并回应艺术家同行"这是不是我们的末日"的疑问:当然不是。
HeyGen 宣布加入 Muse,用户只需告诉 AI 智能体想说的内容,它就能与 HeyGen 协作,用你的数字人和声音生成可直接发布的视频。HeyGen 称 Muse 此前已能替用户生产内容,此次公布了两分钟的 HeyGen 配置流程、早上 7 点的提示词以及让数字人视频以多语言发布的那条回复。
Runway 现已集成进 DaVinci Resolve,用户无需离开项目即可在时间线内直接调用其模型完成生成、编辑与画质提升。官方称接入的是"全球最好的模型",并给出了上手链接。
Seedance 2.5 Draft Mode 已在 Pika 和 Pika API Club 上线,可快速生成片段,最低每秒 10 美分。用户可先用草稿模式快速生成,满意后再以高质量定稿。
Pika 展示 Swap Anything 应用的另一示例,可将视频中的人物、道具、场景等任意元素替换,同时保留原视频的基本时间节奏与运动。该功能是其新 Pika 创意平台的一部分,平台定位为面向创作者打造的 AI 创作工具。
Pika 推出 Swap Anything 功能,可在新 Pika 中任意替换视频内容,入口为 create.pika.art。官方以 "Try Swap Anything on the new pika" 邀请用户试用。
Pika 发布 Swap Anything 应用,能替换视频中的演员、服装、场景和道具,同时保留原视频的时间节奏、动作与叙事结构。该应用已上线新版 Pika 平台,Pika 将其定位为面向创作者打造的 AI 创意平台。
Pika 推出 Swap Anything 功能,可在新版 Pika 上通过 create.pika.art/apps/reskin-vi… 试用。该功能发布在 Pika 官方账号,具体用途与支持范围尚未在推文中说明。
一段由 Seedance 2.5 生成的视频被 @maxxmalist 称为"10/10 杰作",剧本《The race for AGI》由 Pocket FM 的 Sherpa 创作。该内容在 Twitter 上获得 1942 次点赞、99 次转发和 47.2 万次浏览。
Fish Audio 的 MCP 迎来重大升级,新增图像与视频生成能力,可在 Claude、Codex、Cursor、Windsurf 等智能体内直接把简报做成广告:生成视觉素材→编辑→生成视频,并在创作前查看成本。
HeyGen 的 Muse 上线两周已能代用户跑腿办事,接入 HeyGen 的 MCP 后还能一并处理内容:早上 7 点生成简报、以用户自己的声音写脚本并合成视频,在用户醒来前完成日语、德语和法语本地化。
MVLAND 上线「深度创作模式」,可先分析歌曲的节奏、情绪与结构,再生成剧情分镜,并支持一首 MV 同时选用最多 5 个角色。实测制作两分钟古风 MV 共拆出 38 个镜头,默认生图模型为 MV image 2.5 Sunburst,导出 720P 视频,全程约 1 小时、花费约 2500 积分,音乐分析、故事与分镜提示词环节免费。
WorldCrafter 是一个一致性视频世界模型,通过隐式 3D 感知记忆提升生成视频的时空一致性。相关论文已发布在 HuggingFace Papers。
作者开源了awesome-seedance项目,用真金白银复现463条AI视频提示语,蒸馏出14个覆盖各类视频的提示语模版和25个Skills。项目每条提示语都经过实测复现并打分分类,用gpt、claude、grok、deepseek四个多模态模型复测打分、聚类和起标题,每天自动收录GitHub、抖音、小红书、X上带提示语的case。
Pika 推出 Relight Media,用户可在 create.pika.art 上对图片或视频进行重新打光。该功能以独立应用形式提供,入口为 create.pika.art/apps/relight-media。
Pika 上线 Relight Media 应用,可对任意照片或视频重建光照与阴影,支持预设或手动调整,主体、构图与运动保持不变。该功能现已登陆新版 Pika,官方称新 Pika 是面向创作者的 AI 创作平台。
Grok 4.7 已发布,据 @ryanvogel 称其在视频编辑方面表现出色,并附上演示视频链接。原帖未披露模型参数、基准分数或开放方式等细节。
用户让 Grok 4.7 参考此前的视频,制作了一段 SpaceX Starship 发射的定格动画,并用 Starship 真实发射视频作为参考以提升素材准确度。作者称视频中的所有内容均由 Grok 生成。
Runway 为 Workflows 新增 Compositing、Alpha、HDR、Depth Map 和 RGB Depth 功能,让用户可以在同一处完成更多管线环节。该更新现已可用。
HyperFrames 联合 Google DeepMind 和 Kaggle 推出 Code2Video Bench,用于衡量模型生成的代码能否渲染成值得观看的视频。该基准指出,SWE-bench 意义上的代码能力与"代码转视频"是两回事,目标是让前沿实验室在智能体视频任务上取得进展。
ElevenLabs 在 ElevenCreative 中推出 Studio 4.0,其 AI 原生视频编辑器迎来一次重要升级。用户可以在项目内生成视频、图像、语音、音乐和音效,并在同一处完成剪辑、加字幕和导出。
Perplexity Computer 现在可以用 MiniMax H3 和 ByteDance Seedance 2.5 生成视频,用户在同一对话线程中提出广告片、产品演示或社媒素材需求,即可在文案和创意旁直接得到成片。该功能已面向 Pro 和 Max 订阅用户开放。
Runway 开放黑客松报名,报名地址为 hackathon.runway.com。推文附带互动数据:2 条回复、1 次转发、5 个点赞、3302 次浏览。
Gemini Omni 已向开发者开放,支持用文本、图像、视频或音频参考素材生成并编辑高质量视频,结合物理规律理解与 Gemini 现实世界知识。五位开发者展示了切换约 20 个拍摄视角、用语音指令改写昼夜与季节、借 Google Flow 涂鸦让柠檬变潜水艇等玩法。
火山引擎推出 AI MediaKit 理解式视频编辑引擎,以自研 ReFM(残差式流匹配)为视频生成修复主干,通过多模态语义理解区分后期叠加文字与场景固有文字,再以 4 步采样完成无痕擦除。该方案支持 50 多种语种的文字擦除,并已构建覆盖文字检测、多模态判断、视频修复与结果校验的完整流水线,支持长视频连续处理与原规格交付。
社区开发者 Kamimoto 将 Jev 接入 MiniMax H3,对 Attention 处理做稀疏化:由 Jev 按层判定重要度(覆盖 4step 的 49 层),并可从 1%、3%、5%、10% 中选取稀疏率。在 RTX4070 上,视频生成耗时从 6 分 7 秒降至 3 分 34 秒,缩短 41.7%,且生成过程中仍需向 Jev 云端查询。
开发者 Kamimoto 将 Jev 接入 MiniMax H3,用其对 4step、49 层的注意力做稀疏化处理,按层判定重要度并可选 1%、3%、5%、10% 稀疏率。在 RTX4070 上,视频生成时间从 6 分 7 秒缩短到 3 分 34 秒,减少 41.7%。即便生成过程中需向 Jev 云端查询,速度仍有提升。
美图设计室支持上传一张商品平铺图,即可批量生成不同模特、姿势与场景的穿戴效果图,并支持AI服装换色出SKU变体图、替换服装与灵活切换模特场景。首页对话框还可一句话生成模特套图、1:1复刻同行爆款图的背景与版式,以及一站式生成带脚本、运镜、转场和背景音乐的带货视频;生成素材可存入资产库沉淀品牌视觉资产。该工具已首批接入WorkBuddy、Codex等主流大模型,并支持手机APP出图。
Pika 发布 Camera Director 应用,上传一个镜头即可获得多种其他机位角度的画面,现已在新的 Pika 平台上线。Pika 将自身定位为面向创作者打造、由创作者共建的 AI 创意平台,强调简洁、全面,并以满足严苛标准的内容输出为目标。
Pika 发布 AI 创意平台新版 Pika,其 Relight Media 应用可在视频中调整光线的颜色、强度和方向,而不只是改变一天中的时段。Pika 表示新平台面向创意工作者,主打简单、全面,并瞄准高标准的输出质量。
袋鼠帝把 AI 短片制作流程沉淀为 3 个 Skill 并开源:视觉资产提示词、动作打戏提示词和 Miora 视频执行规范,可直接装入 WorkBuddy 使用。