Runway Labs 推出 Project Continuum 研究应用
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,官方称这是对贴合用户所处场景的界面的早期探索,并放出了完整演示视频。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,官方称这是对贴合用户所处场景的界面的早期探索,并放出了完整演示视频。
Runway 旗下 runwayml_labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,并首次展示 Portals、Visual Thinking、Responsive Video Interfaces、Interactive Worlds 四种与电脑交互的新方式。
Perplexity Computer 现已集成 Seedance 2.5,营销与品牌团队可在其中为小企业生成商业或品牌视频,品牌视觉、产品样机和完整视频剪辑全部在 Computer 内完成。
Lovart 展示了用 GPT-Image 2.5 与 Seedance 2.5 组合的能力:从一张图像生成虚构场景的多个角度,并让画面实时动态呈现。该演示由 Lovart 制作完成。
MiniMax H3 为 MINIMA 打造的新 MV《くさらび》发布,配乐由 SunoV6 与 SunoV4.5+ 混音而成。该作品为 CapCut AI Creative Award 参赛作品,标注 CapCutCPP AIFJ2026。
用 Claude Opus 5.5 做视频的方式不是模型直接生成画面,而是让 Claude Code、Codex 等 Agent 工具编写 HTML、Canvas、WebGL 或 Remotion 动画,再逐帧导出 MP4,字幕、镜头路径和转场都能在代码里调整。
Runway Research 团队在一场深度 Q&A 中讨论了实时模型、生成式界面,以及机器人领域的下一步方向。原文未披露具体模型版本、参数或性能数字。
LongLive-Plug 提出一种面向视频生成的“plug once-for-all”蒸馏方法,论文已发布在 Hugging Face Papers。该方法主打一次蒸馏即可通用适配,具体加速倍数与评测结果原文未披露。
Runway 首席产品官 Anthony Maggio 登台发布 Runway Ads,一款面向效果营销的新型自主引擎。官方现已开放早期访问申请,入口为 runway.com/product/ads。
Pika 宣布可通过 Pika API 进行构建,开发者可访问 dev.pika.art 接入。该消息由 Pika 官方账号发布,未披露模型版本、定价或调用限制等细节。
HeyGen 发布面向企业的视频生成产品 HeyGen Video,主打以远低于传统制作成本获得制作级视频。该产品基于 MiniMax H3 并由 HeyGen 后训练,10 月前定价为 $0.01/s,相当于五折,详情见 developers.heygen.com/heygen-video-1。
Umesh 获得 Kling 4.0 Flash 早期访问权限并进行了首批尝试,称其提示词理解能力出色。他同时公开了所使用的提示词,并带上 #Kling4 标签。
魔搭社区 AI+∞ 开发者创作大赛在云栖大会魔搭开发者专场颁奖,736 位创作者报名、共收到 252 个参赛作品,最终评出六项获奖作品。大赛由魔搭社区与 Qoder 主办,NVIDIA、赞奇科技赞助,聚焦 AI+ 影视流,作品均使用 Qoder credits、魔搭开发工具与开源模型,并基于 NVIDIA DGX Spark 开发。
可灵 Kling 4.0 满血版生成短片曝光,相比 Flash 版本,支持原生 30 秒直出、画面与声音更清晰、口型匹配更精准,并提供 21:9 电影画幅。该版本将于 10 月上线。
AI产品黄叔将战争解读视频流程接入 Opus5.5,跑通几种内容类型后沉淀出多个 skill,大部分流程已自动化。成本约为 Claude Max 100 美元周额度的 2%-3%,一周 token 能产出 30 条以上视频,配音使用 listenhub,单条约 10 元。他计划开新号专门做经典战役解说。
影溯科技发布并上线新一代世界模型 InSpatio-World 1.5,支持单图、多图、全景图和视频等不同输入,强化实时场景探索与时空一致性,并已开放试用与开源代码,同时即将邀测世界模拟器 Topos-Pro 1.0。
阿真Irene 尝试用 Opus 5.5 生成视频,仅给出简单提示词,模型自行优化提示词后直出视频,并登录其 Suno 账号生成了纯音乐配乐。她表示节后将分享用代码做视频的小窍门,同时上线了记录自己行程的“旅行阿真”网站,供大家 10 月上旬查看其位置。
GPT 6.1 Sol 发布,缓存价格下降 50%。作者提到其能力不如 Opus 5.5,但价格更低;并补充称近期流行的动效视频 Luna 也能制作。
Higgsfield 创始人兼 CEO Alex Mashrabov 在 20VC 播客中透露,公司内部每月使用模型的花费超过 400 万美元,近 400 名团队成员平均每月在模型上花费超过 1 万美元。
Physis-Lang 搭配 NVIDIA Cosmos 3 Super 和 Nano 在 Physics-IQ Verified 图生视频(image-to-video)排行榜上分列第 1 和第 2 名。该基准测试衡量生成视频对真实世界物理规律的遵循程度,完整排名见 physics-iq-verified.anates.ai/?track=i2v。
NVIDIA 研究人员发布开源自进化框架 Physis-Lang,通过为视频描述加入物理解释来提升世界模型的物理推理能力。仅将物理推理加入提示词、不做重训练,NVIDIA Cosmos 3 的 PhyGenBench 分数即提升 5.62 分。论文与项目已上线。
Runway Agent 上线 Agent Tagging 功能,用户可在任何素材位置标记 Runway Agent,直接请求剪辑、方案和修复。官方称操作“就这么简单”,并已在 runway.com 开放试用。
NVIDIA 发布 Metropolis 视频搜索与摘要(VSS)Blueprint 3.3,用其智能体技能降低视觉 AI 智能体的构建与运行成本。该蓝图面向生产规模视频理解,整合视频接入、流处理、事件检测、检索、摘要与报告等环节,解决从能力到可维护系统的落地难题。
Runway 以首发合作伙伴身份加入 OpenAI Marketplace,即日起用户可在该平台使用其图像、视频、音频和编辑模型,并可将部分 OpenAI 承诺额度用于 Runway 购买。
有人搭了一条 Codex → Flux 3 流水线,能自主生成"古希腊日常生活"这类视频。该流程由 Codex 负责编排、Flux 3 负责生成画面,作者称内容基本可自动产出。
一位创作者用 ManusAI Studio 在 24 小时内完成了 CueAgents 的发布视频,全程在 Manus 2.0 中制作,视频播放量已突破 140 万。他表示 Manus Studio 已接入会议记录、Notion、Slack、Figma、代码仓库等工作上下文,帮助完成创意、分镜和成片剪辑。他强调 AI 没有取代创造力,而是将其放大,并已开始用 Manus 剪辑自己的 vlog。
作者冷逸演示了用 Coding 模型做视频的完整流程,底层逻辑是让 LLM 用 JavaScript 或 Three.js 写每一帧画面生成 HTML,经无头浏览器逐帧捕获后由 FFmpeg 编码成 MP4,全程在 Agent 内完成、不打开剪辑软件。
国内首部AI长剧《后西游记》于2026年8月31日在芒果TV上线并登陆湖南卫视黄金档,导演李东珅称该剧用3个月制作,画面与人物演绎均由AIGC生成,单集约90万元、总成本约2700万元,约为同体量S级神话剧或传统动画剧集成本的十分之一,芒果超媒随后两个交易日涨停。
AI 短剧上半年上线 22 万部,爆款率只有 0.47%,今年春节档 AI 剧上线量是真人的 50 倍,播放量却仅为 4%。山海短剧付磊称目前九成集数一次成片,单集算力成本约一百元,五个人能干原来四十人的活;点众已把三百多位编剧的经验做成 skill。阿里云在云栖大会期间牵头成立短漫剧产业发展联盟,并推出「万镜一刻」,用 Agent + 画布串联剧本策划、故事板与剪辑。
Opus 5.5 在 Coding 和视频创作上表现"打爆",被评价为绝对跨过了一个奇点。在 AgentWork 付费社群里,Claude Code 的 Token 用量最近提升了一倍多,排名即将冲上第二。渠道合作伙伴正加紧做防封方案,预计方案出来后用量会进一步上升。
Anthropic 的 Opus 5.5 靠纯代码生成品牌宣传片、像素动画,还能操控电脑画图,与 GPT-6 的 Sol 和 Luna 同周发布后,热度持续一周不退。
Pika 宣布 Secret Level 成为 Pika API Club 新成员,并支持其自研影视制作平台 Liquid Engine。Secret Level 是最早提供 AI 原生与混合制片的精品创意工作室之一。
Manus 2.0 正式发布,换上自研 Cascade 框架,按需加载专业能力以降低 Token 消耗,并新增事件触发的自动化任务与可独立购买的云电脑。桌面端升级为 Manus Studio,加入视频编辑与 Alchemy 模式,游戏开发环境可发布为网站分享;同时推出面向个人生活的独立应用 Cue,每个 Agent 拥有自己的邮箱、电话号码、钱包和电脑。
Manus 2.0 发布,1.0 曾启发整个 Agent 时代的产品,在 2.0 阶段选择视频、游戏作为生产力的核心场景。个人 Agent 方面获得身份信息,包括邮箱、电话、支付,以及一个连接 Agent 的网络,同时引入微信的小程序逻辑,每个二维码都是一个 Agent。作者提到其海外主要竞争对手目前是 Muse,国内最适合做 Muse 的是腾讯,而 Manus 的股东就是腾讯。
一条发布视频由 Manus Studio 制作,@Nin19536 补充了部分人工润色。发帖者称三个月前还不会相信智能体能做出这样的发布视频。
Claude 官方账号展示了一组对比:给 Sonnet 5 与 Sonnet 5.5 同一个提示词,分别用 JavaScript 生成不到一分钟讲完恐龙史的动画,由 @kevin_t_ngo 创作。该演示发布在 Twitter 上,获得 693 个点赞、23 次转发和约 28 万次浏览。
Manus 展示将一条新闻故事制作成爆款视频,案例主题为"警察 vs 小鸸鹋",成品通过 manus.im 分享链接发布。该演示在 X 上获得 769 次浏览、1 条评论和 1 个点赞。
Manus Studio 上线 Alchemy 模式,用户只需一条提示词即可生成成片视频,从导演、脚本、分镜到剪辑全部自动完成并对齐音乐节奏。官方在推文中展示了视频、原始提示词及完整会话记录。
Manus Studio 新增 Alchemy 视频创作模式,官方推荐用于制作发布视频,并透露 Cue 的发布视频正是由 Manus 自己完成。该模式与 Skills 配合可快速产出宣传片。
PrunaAI 的 P-Video-2-Pro 已上线 Replicate。该模型基于 MiniMax H3,其 Quality 与 Speed 两个版本在 Design Arena 图生视频榜单以 1325 Elo 并列第二,Quality 生成耗时 8.0 秒,Speed 为 4.5 秒。