Grok Imagine Video 1.5 Lite 上线 OpenRouter,主打文生视频与图生视频
xAI 的 Grok Imagine Video 1.5 Lite 已在 OpenRouter 上线,成为 Grok Imagine API 中文本生成视频与图像生成视频的新主力模型。定价按分辨率计费:480p 为 $0.02/秒,720p 为 $0.03/秒,1080p 为 $0.14/秒。
xAI 的 Grok Imagine Video 1.5 Lite 已在 OpenRouter 上线,成为 Grok Imagine API 中文本生成视频与图像生成视频的新主力模型。定价按分辨率计费:480p 为 $0.02/秒,720p 为 $0.03/秒,1080p 为 $0.14/秒。
Claude 发布 Claude Motion,可将报告、图表或产品演示转成短动画。每段动画由 Claude 以代码方式生成,不涉及视频模型,因此可修改任意文字、数字或时间点,并导出 MP4。目前面向 Team 和 Enterprise 套餐开放 beta。
Anvisha 发布 Voyager,一个面向视频、图形和游戏创作的开放 harness,被形容为创意工作的 Codex。它自带免费的图形、音乐和视频编辑工具,也能在桌面端驱动 Blender、DaVinci Resolve、After Effects、Ableton 等 100 多个应用,并支持 Opus、Astra、DeepSeek 等模型。
Odyssey 发布 Odyssey-3 系列世界模型,其中 Odyssey-3 Pro 在 Physics-IQ Verified 上刷新最高分,该基准要求模型续写真实物理实验视频。
上戏毕业的山音与广告公司职员 KK 用两年时间成为 AI 导演,作品登上国内外电影节。他们最常使用的 AI 视频产品是 CapCut Video Studio,同一部片子会混用 Seedance、MiniMax 等多个模型。两人在播客中讨论了 AI 视频产品在底层模型趋同后的壁垒,以及"AI 无限,人生有限"的创作者困境。
Vidu 发布旗舰视频模型 Q4 的首个预览版本 Q4 Preview,最高支持 4K 直出,最多可输入 15 张参考图,并支持 3 段参考音频统一音色。SaaS 侧 Preview 阶段提供两个月限时优惠,最低 0.09 元/秒起,官方称一个 10s 视频的创作成本首次可以低至不到一块钱。
在 InfoQ《极客有约》X QCon 直播中,快手鲜嘉麒与爱奇艺路香菊、阿里巴巴邹娟、生数科技郑重讨论 AIGC 内容生产为何难落地:竞争单位已从一个 clip 变成完整生产链路,用户追问人物一致性、商品变形、按时交付与成本可控。真实成本是生成、重试、审核、人工编辑等之和除以合格成片数。
HeyGen 与房地产名人 Ryan Serhant 合作推出每日视频系列,内容全部由他的官方数字分身出镜,无需本人拍摄,主题涵盖销售、商业与品牌建设。该系列由 Ryan Serhant 的官方 avatar 呈现,每日更新,完整报道见 Variety。
Pollo AI 结合 GPT-5.6、GPT-6 Astra 与 GPT-Image-2.5,帮助创作者把创意转化为细节丰富的图像和电影级视频广告。
Opus 5.5 接入 MiniMax Design,可通过编写代码将文本转为视频,覆盖 JavaScript 动画、动态图形、解说视频与视觉叙事、Web 与产品演示等场景。该模型不止于语言模型,还能理解视觉内容并持续打磨用户的创作。
火山方舟 Agent Plan 中的专属 Harness CUA 可自动操控云桌面里的 Blender,把一句武侠创意先做成白模预演,再作为参考喂给生视频模型,产出 20 秒成片。套餐集成 Seedance、Seedream 生图生视频模型,兼容 Claude Code、Codex 等工具,以 AFP 统一计量用量,Medium 及以上套餐可开通 CUA,Large 及以上支持 Seedance。
Yoroll 旗下 LinearGame 正在内测 AI 陪伴产品 Yyo,其角色来自《华君传》《VOW》《心动相簿》等互动影游,玩家通关后可与角色继续文字、实时语音或视频通话,并一起玩三消、闯关、像素街机等双人小游戏和共享屏幕陪玩。
爱范儿作者提前拿到生数科技 Vidu Q4 Preview 预览版权限,用《沙丘》《喜剧之王》《黑神话:悟空》等片段实测其人物反应、动作运镜和特效表现,认为运镜方向感与主体稳定性是强项,画面风格控制和幻觉问题仍需优化。该预览版定位高表现力旗舰模型,参考生视频支持最多 15 张参考图、3 段参考音频和可选 2K、4K 输出,试拍成本 0.09 元/秒起。
Agnes AI 的 Agnes Video 2.5 刊例价 0.15 元一秒,实际成交约五折、即七分钱一秒,Flash 版完全免费但限频、锁 720P。圆桌上掌阅科技、光盒动力与生数科技围绕短剧出海给出各自答案:掌阅做发行方拉模型方与承制方上船,光盒动力先当 AIGC 富士康再做自有 IP,Agnes 则从新加坡起步、海外攒下一千多万用户后把最大市场放回国内。
xAI 的 Grok Imagine Video 1.5 Lite 已在 AI Gateway 上线,可将文本提示词和图像生成带原生音频的视频。该轻量模型支持 1 至 15 秒时长、480p/720p/1080p 分辨率与七种画幅比例,模型名在 AI SDK 或 AI CLI 中设为 spacexai/grok-imagine-video-1.5-lite。
HeyGen MCP 接入 ChatGPT 后,一句提示词就能为万圣节派对生成给每位宾客的专属视频邀请,并由 ChatGPT 在 Partiful 上完成派对设置。视频中由"吸血鬼版"的你亲自出镜,整份宾客名单都能收到个性化邀请。
Runway 已直接集成进 ChatGPT Astra,用户可在同一个聊天窗口内给它下简报、让它执行任务并反馈意见。官方未披露模型版本、定价或可用范围,仅给出一个开始使用的链接。
ArtCraft 用 Rust 重写了一套对标 Adobe 的开源应用,全部 MIT 开源、不收集使用数据,提供原生桌面 app(不套 Electron)以及 CLI 和 MCP。
Google 推出一款通过文本提示词生成视频游戏的平台,合作方为游戏工具开发商 Unity。该消息出自 FT 报道摘要,正文未提供平台名称、开放时间或具体能力等细节。
可灵(Kling)宣布 Kling 4.0 即将推出,并将在 10 月 10 日至 13 日于韩国釜山举行的 ACFM 上展示一批用该模型创作的真实项目。可灵表示将联合电影人、工作室与内容平台,探讨生成式 AI 如何理解导演创作意图、保持角色与叙事连贯,并从创意实验走向动画、真人、电影和剧集的专业制作流程。
xAI Cookbook 更新了 5 个新 App,加上原先的 5 个,组成 Grok API 示例集,每个围绕一个真实可跑的产品级场景,覆盖实时语音智能体(4 个)、多模态生成流水线(4 个)、X 实时数据分析(2 个)四条主线,开源地址为 github.com/xai-org/xai-co。
哈工大(深圳)iLearn-Lab 与新加坡国立大学 LV-Lab 提出免训练 2-bit KV Cache 量化框架 QuantWM,通过量化敏感性感知聚类(QSAC)和主子空间注意力补偿(PSAC)改善视频世界模型的时序闪烁与画质下降。
Higgsfield 推出"AI 网红工作室",可从零自定义 AI 网红的脸、身材和服装,并直接套用 Motion Presets 动作预设生成跳舞、表演、展示产品的短视频。
有用户搭建了 prompt-motion.com,收集用 Claude Opus 5.5 制作的动效作品,每个案例旁附上生成它的 Prompt 或 Skill,目前已有 226 个,全部来自 X 上的帖子并标注原作者,多数 Prompt 可以直接运行。宝玉转发了这一网站,并提到大多数案例带有可运行的 Prompt 和对应的 X 链接。
Justine Moore 实测了 Tavus 引发热议的新模型,认为其在实时交互视频上进步明显,全程无剪辑或加速,一些举止神态真实得令人意外。
Pika 上线 API Club,开发者可通过 dev.pika.art 调用 Google 模型进行构建。原文未披露具体模型版本、价格或调用限制。
有人向 cookbook 新增了五款应用,全部基于新的 SpaceXAI TypeScript SDK 构建。这五款应用分别实现:premise 转短片、图片转视频广告、截图转 React 组件、𝕏 帖子转情绪看板、链接转播客,demo 与代码均已放出。
Kling AI 展示创作者使用 Kling 4.0 和 Kling 4.0 Flash 制作的作品,主打新想象、新故事与新创作方式。官方同步放出演示视频,并附上 X(Twitter)原帖链接。
Utopai Studios 自研视频模型 Utopai X 在 Artificial Analysis 的文生视频排行榜 Video Arena 上以 1150 的 Elo 评分位列全球第二、全美第一,该模型基于 MiniMax H3 架构做深度后训练,在评测的 10 项细分能力中有 7 项超越原基座,音频同步与物理规律两项排名第一。
一条生成视频高度还原了 Airbnb 上一处位于阿肯色州、可实际预订入住的退役核导弹基地房源。发布者指出,参考素材对生成效果影响巨大,正是这些 references 让视频与房源细节高度贴合。
给 Opus 5.5 一个 Airbnb 房源信息后,它抓取照片并用 Seedance 2.5 生成 UGC 视频,配音由 ElevenLabs 完成。历史素材从网上下载后用 Topaz 放大。发布者表示对结果印象深刻。
向阳乔木开发了一款 Chrome 插件,支持几乎所有音视频网站的字幕转写,并配合本地助手进入沉浸式学习状态。用户可将安装指令发给 Codex、Workbuddy、豆包,完成插件安装与本地助手配置。插件地址为 github.com/joeseesun/qiao…。
Manus 通用智能体现已具备视频剪辑能力,可完成从一键生成视频到在时间线上编辑成片的完整流程。该功能已在 Manus Studio 上线,用户可通过 manus.im/desktop 试用。
Manus Video Editor 支持将一条视频适配成 8 种不同语言,还能直接从 Figma 与代码仓库生成产品发布视频。它也可把数小时素材剪辑成成片,并为产品批量制作 UGC 广告合集。
Justine Moore 回应其分享的 AI 用例推文被过度解读,表示该账号只是分享有趣的 AI 应用。她称用 AI 视频为 OnlyFans 账号做营销客观上既怪异又有趣,无论喜不喜欢。
MiniMax 于 10 月 5–8 日参加纽约 Advertising Week,展位 A16E 靠近 Food Trucks,整周进行 MiniMax H3 现场演示。10 月 8 日 2:30 PM ET,MiniMax 与 Krea AI、fal、Magnific 在 Innovation Stage 举行圆桌讨论。
HeyGen 将 HyperFrames 变成独立应用 HyperFrames Studio,一款为 agent 从头打造的视频编辑器。用户描述想要的视频后由 agent 生成初剪,随后在帧上圈选、给某个词钉评论或自行裁剪来继续调整,双方共用同一条时间线。该工具兼容 Claude Code、Codex 或用户自己的 agent,完成后支持导出 4K,并提供数百个灵感与模板。
论文《Rollout-Marginal Distillation for Long-Horizon Autoregressive Video Generation》已在 Hugging Face Papers 上线,提出用于长时长自回归视频生成的 rollout-marginal 蒸馏方法。原文未披露具体模型、参数规模或 benchmark 分数,仅给出论文链接与演示视频。
Manus Video 公布全部新能力。原帖以视频形式展示,未披露具体功能名称、参数或上线时间等细节。
Manus Video 用户 @Nin19536 上传 125 段旅行素材、近两小时原始footage,仅用一条提示词就让 Manus 找出精彩片段并生成 12:48 的初剪,成片跟随行程叙事。最终 vlog 带有字幕、音乐和特效。