即梦上线样片模式:480P草稿升清1080P,实测省38%成本
即梦AI网页版上线「样片模式」,先用480P生成草稿,再用原生模型升清为1080P成片,480P成本约为1080P的1/8。作者实测一支15s视频,480P抽卡2次加升清合计99元,直接1080P抽卡则需156元,省约38%。
即梦AI网页版上线「样片模式」,先用480P生成草稿,再用原生模型升清为1080P成片,480P成本约为1080P的1/8。作者实测一支15s视频,480P抽卡2次加升清合计99元,直接1080P抽卡则需156元,省约38%。
用户让 Opus 5.5 制作一段数据中心主题视频,结果超出其想象。该模型在获得参考视频以及自行调用或生成任意素材的权限后,展现出很强的视频生成能力。
9 月 24 日,腾讯操作系统层级的个人 AI 管家 Marvis 全量上线新版本,从「个人 AI 助手」升级为「个人 AI 管家」,并推出负责电脑、文件、软件和浏览器的 4 个管家。
NVIDIA DSX MaxLPS 通过策略驱动的电力共享,在参与资源之间动态分配电力,解决 AI 工厂为应对 GPU 峰值功耗而预留保护缓冲、导致正常运行时基础设施利用率不足的问题,从而提升 AI 工厂吞吐量与效率。
Vercel Sandbox 的可观测性现已纳入内存用量数据,可在仪表盘和 CLI 的 vercel metrics 命令中查看。仪表盘的 Memory Usage 卡片给出各沙箱的平均、P75 和 P95 内存,沙箱详情页图表会按沙箱内存上限自动缩放 y 轴,并在上限 85% 处加一条虚线参考线。
Anthropic 的 Claude Sonnet 5.5 已在 AI Gateway 上线,模型标识为 anthropic/claude-sonnet-5.5。
Tw93 重新介绍了他在过年期间开发的 Mac 终端 Kaku,安装后无需配置即可使用,对 AICoding 友好,并结合自己的编程习惯做了不少顺手优化。该项目已开源并迭代 21 个版本,保持 0 issue,作者称其为自己做过的最复杂的项目。项目地址为 github.com/tw93/Kaku。
Perplexity 的 @AskPerplexity Computer 能以单条提示词(High Effort 模式)将一条房产房源转化为可交互探索的 3D 网站,效果对标 Matterport。
GitHub Copilot 应用支持并行运行多个智能体,每个会话拥有独立的 Git worktree 和上下文,因此可以同时进行构建、审查和测试。官方博客给出了上手方法。
Recraft V4.1 Flash 仅凭一条长提示词就生成了细节完整的万圣节主题复古插画,画面包含"Witch Way To The Books"木牌、女巫帽、蝙蝠与新月、扫帚、药水瓶、翻开的书与提灯,右侧黑猫戴蝴蝶结坐在旧书堆上、底层书压着一把钥匙,背景是林间小屋与路灯。作者 @heathergreen 分享了完整提示词,并称复杂提示词也能用 V4.1 Flash 完成。
Fish Audio 推出 Startup Program,面向初创企业开放,详情见 fish.audio/startup/。原文未披露该计划的具体权益、价格或申请条件。
Cohere 推出 Parse 5,主打对常见格式企业文档的最优价格解析,可消化并返回表格、图片、边界框和流程图等内容。该模型由 Cohere 官方账号发布,具体定价与可用方式未在原文披露。
Kling AI 发布预告称"有消息要公布",附有互动数据:204 条评论、94 次转发、807 次点赞、473784 次浏览。
设计师 @midori_tatsuta 用 Recraft V4.1 Flash 生成了一整套风格统一的新复古日式波普海报,涵盖招财猫、达摩娃娃和大胆图案。该模型主打高速生成,作者反馈速度确实相当快,并保留了 Recraft 一贯的个性化画风。
即梦 AI 推出 Seedance 2.5 样片模式,先用 480P 低成本反复抽卡,选定满意的一条后再原生升清为 1080P 成片。作者用东方志怪真人短剧、末日废土 3D CG、苹果风 3C 产品 TVC 三个案例对比,称 1080P 在五官、发丝、鳞片纹理、字体锐度和光影特效上明显优于 480P。
Hailuo AI 分享了一段由 MiniMax H3 Max 生成的周末动画短片,名为 the chef's revenge,原帖来自 awesome_visuals。该片段在 X 上获得 36 次点赞、4 条回复和 7961 次浏览。
一个号称"决策模型界 Ollama"的项目可本地拉取并服务 Laya、decider、NLI、GLiClass 等开放决策模型,并暴露 TypeSafe 兼容 API,可用于 LLM 路由和零样本分类的本地推理底座。项目地址为 github.com/ollaya-dev/oll。
Justine Moore 做了一个 Grok @bot,只需几张宠物照片和几条性格或爱好信息,就能生成 Apple 风格广告,她用自家 labradoodle Tilly 做了测试。该 bot 附有可直接使用的链接。
Simon Willison 公开了 kakapo-party 项目的提示词与对话记录,并放出了由 Claude 构建的 HTML 交互页面,用户可在其变成视频之前先行体验。相关 prompt、transcripts 及页面链接均已发布。
Fireworks 的 Ember-1 已在 Vercel AI Gateway 上线,这是一个基于 Kimi K3 构建、面向编码与智能体工作流的研究预览版推理模型。
OpenAI 即将推出名为 o 的新产品,据称是云端 Agent 产品,对标 muse。来源提到"人人都还要有一台云电脑",并建议有换电脑、换手机需求的人尽快下手,称涨价是必然。
Google Antigravity 2.0 新增 planning mode,输入 /plan 后智能体先退一步思考任务、做大量调研,再生成实现计划供用户审阅,执行前需用户批准;也可在提示词中直接要求计划以获得更轻量版本。Varun Mohan 回应称该功能 2025 年已加入、今年早些时候从产品中删除,此次是以可选斜杠命令形式重新加回,并承认时机不佳。
作者提醒,现在有了音频版的 Nano Banana,模型和 demo 均已开源在 GitHub 与 Hugging Face 上,可实现秒级克隆声音、像编辑文本一样编辑音频、改变音色音调与情绪、去除口音、增强或分离人声,甚至加入咳嗽和笑声等效果。腾讯还发布了更快更小的 flash 变体。
Recraft 用 V4.1 Flash 为 @SRKDAN 生成了一批面包店广告概念图,包含暖调产品图和醒目标题排版。据 @SRKDAN 实测,该模型出图耗时 2-3 秒、单张成本低于 1 美分,成品已接近可直接交付。
给 Astra 几段参考视频、几张 Finn 的照片和一段性格描述,它便自行生成图像,再经 Seedance 2.5 转成视频,全程不到 1 小时,其中通过 fal 的 API key 调用。作者展示了这次生成的镜头板。
GitHub 邀请开发者参加线下社区活动,现场了解 GitHub Copilot 应用与 Copilot CLI。活动按地区就近报名,报名链接为 gh.io/join-dev-days。
Recraft V4.1 Flash 模型被用于生成原创角色,用户 @nopuppet 反馈模型生成速度快,角色面孔具有多样变化,不再呈现其他 genAI 模型常见的"千篇一律的漂亮"。该模型还采用了更不落俗套的视角和角度,贴合用户要求的时尚摄影美学。完整提示词见回复。
Runway 宣布即将登陆 Muse。该消息由 Runway 官方账号发布,但原文未透露具体上线时间与功能细节。
Notion 发布一周更新盘点,汇总了本周上线的一批新功能与改进。该条更新在社交平台获得 173 次点赞、14 条评论、5 次转发,浏览量达 31703 次。
Recraft 公开四组图像生成提示词:宽幅 campaign banner 以 "MAKE SOME NOISE" 为主标题,字母延展融合成光滑抽象形态;人物肖像采用几何建筑感发型;另有女性置身巨型花朵的时尚编辑构图,以及 MOKO 方形 Logo,其中一字母变为笑脸。
LibTV 1.5 上线,原 Agent 升级为 TV Director,新增剧本原创及改编、角色造型室、导演执导、3D-BOX、创意片头五项核心能力。剧本支持像编辑文档一样直接手改,TV Director 可自动在画布上创建人物、场景与道具资产节点,并支持手动模式逐步确认以控制积分消耗。分镜阶段可用 Seedance 2.5 样片模式先出 480p 视频,确认后再一键无损高清。
Mole 正在开发 Windows 版,作者就此发起小调研,询问大家日常使用的电脑类型,并欢迎在评论区分享各自的系统使用场景。
Replit Agent 本周接入 GPT-6 Sol、GPT-6 Luna Fast 和 Claude Opus 5.5 三款新模型,供用户试用并匹配自己的工作流。
Fireworks AI 宣布 MiMo-V2.6-Pro 即日起以按需部署形式提供。该模型在 AA Intelligence Index 上得分为 46,为开源权重模型中最高分,采用 1.02T 总参数、42B 激活参数的 MoE 架构,支持 1M 上下文与多模态,并以 MIT 许可发布,用户可在 fireworks.ai/models 开通端点。
Figma 发布了一条推文,内容为一段视频,该推文获得 170 次点赞、12 次转发、10 条回复,浏览量达 23910 次。
Figma 发布 FigmaInMotion,相关链接为 figma.bot/FigmaInMotion。该消息由 Figma 官方账号发布,正文仅给出链接与互动数据,未披露更多功能细节。
Pika 推出 API Club,用一个密钥即可调用多款领先的生成式媒体模型,定价按生成量计费,让创作产出不受预算上限限制。开发者入口为 dev.pika.art。
Pika 提到 AI-Bridge 也在为社交媒体制作短剧,每个系列拥有独立世界观,从编剧、生成到剪辑全部由团队内部完成,与其所有其他产出采用同一套流程。
Pika 推出 API Club Member Spotlights,展示使用 Pika API 构建产品的开发者与小团队。首家聚焦的东京 AI 工作室 AI-Bridge 提供视频制作、企业培训和定制 AI 工具,加入 Pika API Club 后其生成媒体成本减半。
HeyGen 推出 Custom looks 功能,可让用户给数字人换上任意服装,同时保留其原本辨识度。演示中他们借用 Meta 首席 AI 官 Alexandr Wang 的造型,展示了同一数字人在每周 Slack 更新视频里的换装效果。