Wan 2.7 上线 Poe,单模型集成四种视频生成模式
Wan 2.7 已在 Poe 全平台应用和 Poe API 上线,单模型集成 Text-to-Video、Image-to-Video、Video Edit、Reference-to-Video 四种视频生成模式,支持多镜头生成、音频驱动输出、首尾帧控制与视频无缝续写。
Wan 2.7 已在 Poe 全平台应用和 Poe API 上线,单模型集成 Text-to-Video、Image-to-Video、Video Edit、Reference-to-Video 四种视频生成模式,支持多镜头生成、音频驱动输出、首尾帧控制与视频无缝续写。
Veo 3.1 Lite 已在 Poe 上线,是 Veo 3.1 家族中成本更低的视频生成模型,支持原生音频,包括同步对白、音效与环境音。该模型同时支持文生视频和图生视频,延续 Veo 3.1 的提示词遵循与场景理解能力,适用于社交短片、产品演示、分镜、短片及快速创意迭代,可在 Poe 全平台应用及 Poe API(poe.com/Veo-3.1-Lite)试用。
Runway 与 Modal 合作,由 Modal 的 serverless 算力平台为 Runway Characters 提供实时推理支持。Characters 是 Runway 基于通用世界模型 GWM-1 打造的实时视频智能体 API,可从单张图片生成有表现力的数字人,无需微调,支持自定义声音、性格、知识和动作。
Google DeepMind 的 Lyria 3 已在 Poe 上线,可依据文本或图片提示词生成最长三分钟的高保真音乐,并能控制人声、流派、情绪和配器。该功能可用于为视频配乐、歌曲创意原型,或把情绪板变成完整成品曲;Poe 全平台应用及 Poe API(poe.com/Lyria-3)均可试用。
斯坦福李飞飞团队发布 Dream2Flow,用 3D 物体流(3D object flow)打通视频生成与机器人控制,实现开放世界机器人操作。该方法以物体为中心的空间信息作为表征,旨在提升泛化能力,相关工作将亮相 ICRA 2026,项目主页为 dream2flow.github.io。
职业调色师 Ray 在播客中从《罪人》《F1》《惊变28年》等项目切入,讨论胶片与数字交替、数字中间片与 Log 曲线的由来,以及"在场"经验对创作的意义。节目还谈及 Sora、Runway 等 AI 工具对分镜、特效与预演的冲击,诺兰、柯达推动的胶片复兴,以及手机厂商在相册等影像闭环环节的缺位。
AI 领域近几天出现 11 项重要进展,涉及 OpenAI、Apple、Anthropic、OpenClaw、Kimi 等。其中 SeeDance 2.0 热度持续攀升,用户能在一天内生成好莱坞级别的 AI 电影。
The Dor Brothers 声称用一天时间制作了一部 100% AI 生成的电影,并称其成本为 2 亿美元。该内容以推文形式发布,附带视频,获超 1.5 万点赞与约 298 万次浏览,但原文未披露所用模型或制作细节。
吴恩达在 Sundance 电影节参加 AI 主题座谈,与 Daniel Dae Kim、Dan Kwan、Jonathan Wang、Janet Yang 同台,用一天时间了解好莱坞对 AI 的不安并试图搭建沟通桥梁。他指出好莱坞的担忧集中在三点:AI 公司未经同意和补偿使用其作品训练、SAG-AFTRA 等工会担心配音演员等岗位流失,以及这波技术变革比以往更像被强加而非可自由选择。
Seedance 2.0 引发关注,有用户称其效果"让人大脑短路"。流传的一段演示显示,用近乎胡言乱语的提示词就能生成大船与爆炸场面。该推文获 260 个点赞、42873 次浏览。
NVIDIA 推出 14B 世界动作模型 DreamZero,在同一扩散前向过程中联合预测视频与动作,实现对未见任务的零样本泛化和对新机器人的少样本适配。该模型由 NVIDIA 团队完成,作者 Joel Jang 发布了详细介绍。
一段提示词演示展示了如何用 AI 生成"大制作动画电影"质感的短片:女主角穿短病号服在冷冻舱中醒来,走出实验室沿走廊爬上黑色梯子,从井盖钻出后置身萤火虫飞舞、鹿群跑过的茂密森林,远景是植物覆盖的废墟城市。画面强调干净线条与流畅动作,提示词由 @EccentrismArt 提供。
Monica 现已支持 Sora 2 视频模型,用户可直接在 Monica 内生成 4s / 8s / 12s 视频。官方称实测生成了一段 12 秒、7 个场景的动漫短片,提示词放在评论区。
Monica 上线 AI Video 套件,由 SVD、Runway Gen-3、PixVerse、Kling、Minimax Hailuo 提供支持,可在数秒内生成好莱坞级特效与互动视频。用户可通过 monica.im 链接创建自己的首个 AI 视频。
OnBoard! 与播客「十字路口」串台,盘点华人创办、分布在国内、硅谷、新加坡、日本等地的 AI 产品,包括 PictureThis、Speak、UMU、HeyGen、Opus Clip、Monica.im、Devin 等。
扩散模型已从图像合成扩展到视频生成,需额外处理帧间时序一致性并依赖更多世界知识。从零训练路线中,VDM 用 3D U-Net 将空间与时间操作分解处理,Imagen Video 则以 7 个扩散模型级联输出 1280x768、24 fps 视频,并通过渐进蒸馏将采样步数降至每个模型 8 步。OpenAI 的 Sora 则改用 DiT 架构,在视频与图像潜码的时空 patch 序列上运算。
一条推文展示的 AI 生成《速度与激情》新片片段被吐槽“看起来有点怪”,推文获得 895 个点赞、111 次转发和约 26 万次浏览。