小说转漫画 skill:用 Codex 与 ChatGPT 生图降低漫剧成本
作者开源了一个「小说转漫画」skill,为 Codex 安排从读原文、写分镜到排版导出的完整制作顺序,并配合 ChatGPT 生图模型出图,最终提供离线阅读器、PDF 和 CBZ 漫画文件。
作者开源了一个「小说转漫画」skill,为 Codex 安排从读原文、写分镜到排版导出的完整制作顺序,并配合 ChatGPT 生图模型出图,最终提供离线阅读器、PDF 和 CBZ 漫画文件。
有人给 Codex 几个小时和一个 API key,做出一支调侃 Threads 用户的音乐视频:Astra 负责写词,Fal 负责媒体生成,歌曲用 Suno、视频用 MiniMax H3。作者称歌词相当犀利,并反问谁说 LLM 不好笑。
一条用 AI 生成的音乐视频以 Threads 用户为主题,在社交平台引发关注。该视频由 Justine Moore 分享,附带的互动数据显示 7 条回复、2 次转发、15 个赞和 1777 次浏览。
Kling AI 在 X 平台发布一篇图文文章,帖子附带的短链接指向 x.com 的文章页。该帖获得 17 条回复、8 次转发、71 个点赞、11859 次浏览与 26 次收藏。 说明:原文正文仅包含一条 t.co 短链接和互动数据,没有文章标题、摘要或具体内容,因此标题和摘要只能依据来源(Kling AI)与可见的互动信息给出,无法还原文章实际主题。
外网博主 @imjustnewatai 用 Fable 5.5 输入一句提示词,生成了一部 3 分钟人类数万年进化史短片,把人类发明史压缩成一天 24 小时,从 23:40 的洞穴壁画到 00:00:00 的 2026 年,再以指数速度想象 2031 年之后。
Kling AI 将于 10 月 6 日在 2026 纽约广告周(Advertising Week New York)登台,参与"The New Production Engine: Powering Creativity at Scale with Kling AI"专题讨论。
Fable 5.5 整理并生成了人类 40000 年艺术史动画,原作者感叹难以理解抽象的向量矩阵如何输出这些精美动画。其称即便最厉害的动画团队,也不是一两个月能完成的。
PowerTokens/video-studio 是一款面向 Windows 的 Wan 3.0 视频批量生成工具,支持 Excel/CSV 导入镜头表、任务 ID 恢复、断点下载、Key 池、CLI 与 MCP,采用 MIT License,主要代码为 Python,截至 2026 年 10 月 1 日仓库约 1 Star。
AI 喜剧演员 "Tiffany Sloane" 上线 3 周即涨粉 36 万、视频播放量达数百万,其简介链接指向一个疑似真人女性的 OnlyFans 主页,被用作引流营销。
数字创意团队 Digital da Vincis 使用 Kling AI 4.0 制作了名为《Thoughts in motion》的视频作品。该推文由 Kling AI 官方账号发布,带 #Kling4 和 #KlingAI 标签。
Kling AI 发布 Kling 4.0 生成视频,由 Digital da Vincis 用其创作"Dreams of dreamers"。推文附多段视频,以 #Kling4 #KlingAI 标签分享。
Lovart 展示了由 GPT Image 2.5 与 Seedance2.5 生成的效果:文字如水流般流动并贴合海岸线。该内容以视频形式发布在 Twitter 上,帖文获得 47 个点赞、8 条回复和 2633 次浏览。
Kling AI 展示了创作者使用 Kling 4.0 和 Kling 4.0 Flash 生成的作品,强调新的想象、新的故事与新的创作方式。两条模型版本号分别为 Kling 4.0 与 Kling 4.0 Flash,配以 #Kling4 与 #klingai 话题发布。原文未披露参数规模、benchmark 分数或开放方式等细节。
截至 9 月 30 日,美国 AI 原生影视公司 Utopai Studios 的自研模型 Utopai X 在 Artificial Analysis 带音频文生视频排行榜中位列全球第二,仅次于 Wan 3.0,是该榜排名最高的美国公司模型。
Pika 发布新版平台,口号为“Create your way”,并同步开放入口 dev.pika.art。该链接附带 utm_source=x 参数,直接指向 Pika 的开发者站点。
Pika 推出新版,将视频、图像与声音生成整合在同一平台,官方称使用全球最好的生成式媒体模型,成本仅为同类的一小部分。平台提供 25+ 应用与质量优先的创作工具,并强调定价公平、不做虚假的无限量套餐。
Pika 重新设计了整个视频创作体验,让创作者可自选生成方式:不关心具体技术的用户可直接用 Video Studio,偏好特定模型的则可直接调用对应模型。创作者反馈称,在 New Pika 的 Create Video 中使用 Seedance 的费用仅为其他平台的一半,且没有虚假的无限量或把最强模型锁在更高档订阅后面。
xAI 发布实验性 TypeScript SDK,可通过 `npm install @xai-official/sdk` 安装,用一套 SDK 调用文本、语音、图像和视频能力,并接入最新的 grok 模型。该 SDK 还提供运行在 xAI 服务器上的实时 X 搜索、网页搜索、代码执行和远程 MCP 等工具。
论文提出 Adaptive Reward Routing,面向音视频联合扩散模型做动态多奖励优化,方法基于前向过程 RL(Forward-Process RL)。论文已发布在 Hugging Face Papers(编号 2609.37)。
Runway AI Summit 闭幕,Runway 联合创始人兼联合 CEO Cristóbal Valenzuela 回顾生成式视频的演进,并发布 Runway Labs 最新项目 Continuum。完整演讲内容可通过 summit.runway.com/talks 订阅获取通知。
向阳乔木(@vista8)为其开源项目 qiao 补充了一支 AI 生成的宣传片,项目代码托管在 github.com/joeseesun/qiao。该推文附带的宣传片需在支持 video 标签的浏览器中查看,原帖获得 9 次点赞、1 次转发和 2005 次浏览。
Lovart 制作了一支 15 秒 AI 时尚短片,串联从后台补妆到最终走秀的完整流程。该内容由 LovartAI 发布,浏览器需支持视频标签才能播放。
MiniMax H3 相关短片《Let us keep imagination alive》以“sonder”开场,讲述城市中每次短暂相遇都属于一个自己无法完全了解的人生。影片将城市、人群、动物、植物与超现实生物并置,延续作者对 zoopoetics 的关注,追问“他者”能否存在于非人、混合与不可命名的生命形态中。
Tavus 的 Griffin 在视频通话中已能骗过人类,无法被辨别为 AI。同期热点还包括对 ChatGPT「Dots」是否值得升级到 Pro 的讨论,以及 Google 的 AI 水印技术延伸至实验室场景。
MiniMax 的 H3 在视频编辑中的表现引发关注,用户 toyxyz 在 ComfyUI 上测试了 MiniMax-H3-Character-Swap-LoRA,展示了角色替换效果。相关内容在 Twitter 上获得 198 次点赞和超 2.1 万次浏览。
作者在 MiniMax Code 里沿用 Claude Opus 5.5 公开案例的提示词,用 MiniMax M3.1 Flash Preview 同题生成动态设计作品集。
无法生成摘要:原文仅包含一条推文的互动数据(45 条回复、103 次转发、905 次点赞、94479 次浏览)与视频占位提示,未提供可核实的技术内容、产品名或功能信息。
Fable 5.5 即将发布,演示显示其能在连续动画中保持不同艺术风格,被形容为"超人"。相关推文由 Chetaslua 发布,并称这标志着"超级智能时代"的到来。
Andrej Karpathy 提出,随着语言模型变强,人的工作会更多转向监督和理解模型输出,并分享了几条让输出更易读的技巧。他建议让 LLM 用航空维修文档领域的受控语言规范 ASD-STE100 来写作,或尝试放宽到 80% 的程度;相比文字,让 LLM 生成图表更易理解,进一步可以让它输出 HTML 交互网页。
Pika 在 pika.art 上线新版,并推出多款全新创作应用,用户可直接在该平台体验。官方推广链接同时指向 pika.art,原文未披露具体应用名称、模型版本或功能细节。
Pika 新功能可将任意产品图(包括手机拍摄)直接转化为成品广告片。Gem Alpha 用它把单张产品照片做成了完整的电影感广告,并标注"Created with New Pika"。
Pika 推出 Color Grade 功能,可对任意图片或视频片段应用指定色调,除了常规调色,还能为黑白内容上色。该功能被用户用于把老黑白电影转成彩色。
Pika 上线 Podcast Video 功能,可让两个角色进行激烈讨论,官方称制作过程非常简单。创作者 Sheetal Shinde 用它做成了一档恐怖主题播客,并预告一部由两位电影人打造的喜剧恐怖片,作品标注为 "Created with New Pika",可通过 create.pika.art 使用。
Pika 发布全新 AI 创意平台,内置 40 多款应用,覆盖从完成剪辑到完整视频广告的各类创意需求。官方称该平台简单、全面,专为满足严苛标准的输出而设计,目标是构建面向创意工作未来的 AI。
Pika 推出 Camera Director,可在保持原始内容的前提下对任意镜头重新构图,从不同角度呈现同一场景。用户 @opener_ai 评价其质量出色,对需要换视角展示已有片段的实际工作场景很实用,并称新版 Pika 在这一功能上表现令人印象深刻。
Tavus 的 Griffin 上线 Replicate,号称首个通过视频图灵测试的模型:48% 与其实时对话的人认为对方是真人,而此前系统通过率低于 3%。Griffin 被称作首个 Human Interaction Model(HIM),并在 NVIDIA 全双工 AI 视频基准上排名第一。
Tavus 发布名为 Griffin 的"人类交互模型",公司称其通过了视频图灵测试。在与它实时对话的人中,48% 认为对方是真人,而早期模型这一比例不到 3%。
HeyGen 9 月面向开发者推出三款工具:基于 OpenAI GPT-Live-1 的开源实时数字人栈、与 Kaggle 合作的 Code2Video 基准(用于衡量 AI 生成视频质量),以及面向 API 的专业语音克隆。
Claude Sonnet 5.5 结合 Fish Audio MCP 的图像与视频生成能力,可将一张海报在单次对话中直接生成为含标题和声音的 10 秒短片。Fish Creative 称该模型在艺术指导上表现惊人,相关提示词已在推文中公开。
Runway Labs 发布 Project Continuum,一个围绕实时视频界面构建的操作系统研究应用,官方称这是对贴合用户所处场景的界面的早期探索,并放出了完整演示视频。