保姆级教程:用Coding模型做视频,附全套元提示词
作者冷逸演示了用 Coding 模型做视频的完整流程,底层逻辑是让 LLM 用 JavaScript 或 Three.js 写每一帧画面生成 HTML,经无头浏览器逐帧捕获后由 FFmpeg 编码成 MP4,全程在 Agent 内完成、不打开剪辑软件。
作者冷逸演示了用 Coding 模型做视频的完整流程,底层逻辑是让 LLM 用 JavaScript 或 Three.js 写每一帧画面生成 HTML,经无头浏览器逐帧捕获后由 FFmpeg 编码成 MP4,全程在 Agent 内完成、不打开剪辑软件。
Perplexity 称 AI 安全与智能体治理是工程问题,已在其基础设施、harness 和工具中内置安全防护,并应用到各产品中。该公司分享了如何通过工程手段打造更安全的智能体,详情见其官方博客。
特朗普政府推出 America.gov,定位为通往联邦政府的 AI 聊天机器人入口,由 Google 的 Gemini 和 SpaceXAI 的 Grok 提供支持,Airbnb 联合创始人 Joe Gebbia 负责该项目。
Perplexity 称智能体治理本质是工程问题,已把安全防护机制内建到自家基础设施、harness 和工具中,并在各产品线上投入使用。该公司同时发布博客,介绍其工程化构建更安全智能体的具体做法。
Instinct 创始人 Noah Shinn 首次长谈其个人 AI 助手:目前仍为邀请制,未花任何营销费用,用户规模大约每天增长 10%。用户已通过 Instinct 购买从沐浴露到耳机等各类商品,且 Instinct 没有 App。Shinn 与 Patrick OShaughnessy 还讨论了提前数月采购算力、用户如何放心把信用卡交给它、安全与隐私,以及智能体之间互相协调。
Suhail 认为对 AI 的恐惧可以用更大胆的想象替代,软件工程师可把自己视为"开放世界的创造者",技术与创意兼具将更有优势。
Perplexity 联合创始人 Aravind Srinivas 表示,Perplexity Computer 在 Standard Mode(使用 Opus 5.5)下能设计并构建一款端到端的浏览器开放世界游戏:自主租用 GPU、运行无头 Blender、做程序化设计、在线下载素材,并完成音频设计,整个过程耗费约 2000 美元额度,成品可在 vice.pplx.app 试玩。
Meta 的 Muse 在美国爆火,被解读为扎克伯格借个人 Agent 重做一次"微信"。这期讨论认为美国互联网越碎片化 Muse 越有价值,扎克第一个要踹的是 Amazon 的门,并追问它能否靠"百亿补贴"做成 Agent 版拼多多。
Harrison Chase 对比了企业级 agent(org harness)与个人 agent:前者面对多用户、单智能体,需要支持多人协作甚至同线程共用,并正确处理认证与记忆,可观测性、可审计性和管理控制台也更重要,交互上更偏事件驱动与异步。两者共同点是都能编写和执行代码、浏览器使用很可能非常关键、以 skills/MCP 为标准化方式,并共享核心 agent 循环逻辑。
ElevenAgents 中,Eleven v4 Turbo 与 ElevenLabs 领先的转录模型和轮次(turn-taking)模型协同工作。单一协同优化技术栈让智能体响应更快、能优雅地打断,并随新模型发布持续改进。
Claude Code 社区分享了一组实用技巧:从单机模式走向多人协作,多用 Artifacts 作为队友、其他线程和 subagent 的共享记忆上下文,只需让 Claude 把它做成 artifact 即可。用 `/eli5` 插件可让 Claude 用寥寥数语讲清全局,比读大段文字更有用。此外,真正的瓶颈是"未知的未知",解法是多尝试、多迭代以培养直觉与品味。
为给简单简历做 BOSS 直聘插件,用 ChatGPT 通过 CDP 操作 Chrome,或用 grok bot 云端操作,都会被网站直接打到空白页。作者称 GitHub 上的 loks666/get_jo 仓库及相关讨论让自己大开眼界,其中既有 AI 时代的各种巧思,也有针对自动化反制手段的干货讨论。
Weaviate 的 Query Agent Search Mode 新增 effort 参数,提供 medium、high、ultrahigh 三档,用于控制每次请求的检索投入程度。更高档位会在两处增加计算:查询编写阶段花更长时间拆解请求并转为结构化搜索,重排阶段对召回文档做更充分评估后再返回最终排序。官方建议按自身准确率、延迟和成本要求选择合适档位。
AWS 展示如何用 AG-UI 协议、Strands Agents SDK 的 Swarm 模式和 Amazon Nova Act 构建能随 AI 输出变化自动调整的界面。
DeepSeek Harness 桌面版正式发布,macOS 和 Windows 安装包同步上线,并伴随 DeepSeek Harness v0.2 预览版更新。
材料完整列出桌面版、v0.2 预览版的插件管理与创造模式等变化,可据此判断其工作流整合程度。
南京汇智智能推出的 Hellome 定位国内首个 AI 应用智能体服务平台,一端连接终端用户,一端连接认证 FDE,客户发布需求后由 FDE 完成需求诊断、方案设计到部署迭代的全程交付,并以“FDE百万激励计划”提供现金激励、流量扶持与技能认证。
Martin Fowler 在 Fragments 中指出,AI 智能体让编程变得更难;打造一款突破性的智能体需要"超强持久性"。他还认为 AI 更需要的是良知而非意识,并给出关于 AI 监管的若干论点。
阿里稳定性团队复盘 AI Native 研发转型:当后端、产品、设计师都能用 AI 写前端,代码能跑却难接手,于是把团队判断做成结构化规则包 Skill,并打包为 Claude Code Plugin「Anchor」。
AI Engineer 大会将于 2026 年 11 月 5-6 日在上海虹桥祥源希尔顿酒店举办,这是该大会首次进入中国,由 Linkloud 联合主办。
Instinct 创始人 Noah Shinn 在播客中首次公开谈公司,录制前一天 Instinct 刚完成 10 亿美元 C 轮融资,由 Sequoia Capital、Benchmark 和 Coatue 联合出资,估值一个月内从 25 亿美元升至 100 亿美元。
Instinct 创始人兼 CEO Noah Shinn 在播客《Invest Like the Best》中首次完整讲述这家不开发独立 App 的个人助理产品,用户通过 iMessage、电话和邮件与拥有独立电脑、手机、邮箱的 Agent 交互。
Douchat 宣布开源,定位为让 AI 智能体协同工作与对话的桌面工作区,把 Claude Code、Codex、Gemini 等放进同一份联系人列表,并支持智能体在群聊中协作与交接任务。产品支持自带模型,聊天记录与记忆保存在本地机器上。
Anthropic 发布 Claude Sonnet 5.5,面向日常编程、代码修复与文档制作,官方称相比 Sonnet 5 输出速度提升超过 30%,相同任务消耗更少 Token。
美图设计室 PPT Skill 接入 WorkBuddy,用户把会议纪要 Word 草稿拖进对话框、附上参考图和提示词,即可直接生成完整的 8 页汇报 PPT,无需切换软件。生成结果按封面、目录、整体进度、模块进展组织,采用结论式标题与模块化内容并自动高亮重点数据,支持单页精准修改和一键跳转美图设计室画布做 3D 图标等微调。最终导出标准可编辑 PPTX 源文件,而非锁死的图片或 PDF。
Today 被作者称为国内第一个 Personal AI 产品,使用近一个月后能记住用户是谁、梳理跨对话的关键信息,并指出其精力管理是真实短板、执行节奏与想法之间存在持续摩擦。它会在用户开口前推送晨间/晚间简报,并根据 10 月中旬行程提醒购买深圳到南宁的火车票和南宁到北京的飞机票。作者称其给出的建议贴合自己的 INFP 特质,会为"无限游戏"划出最小资源保障,而非直接砍掉广告。
Anthropic 发布 Claude Sonnet 5.5,API 单价没变、生成速度更快,Terminal-Bench、CursorBench 等 Agent benchmark 成绩明显上涨。
小红书 AllSpark 团队提出 PACT(Policy Aligned Critic Training),通过三个正则条件唯一刻画长程 Agent 的信用分配,并用 BCE 回归有界 Value、采用 Actor-Then-Critic 更新顺序改进 Critic 训练。
谷歌发布 Android Bench 2.0,引入长周期任务(LHT)与智能体评估,改用持续评分法替代通过/失败二元评分。LHT 最高通过率约 28%,远低于原始任务的约 91%;跨平台应用移植到 Android 仍无模型达到 100% 通过率,前沿模型完成率最高 80%。
前 Chrome 开发者体验负责人 Addy Osmani 在 The Pragmatic Engineer 访谈中提出,AI 编程的真正风险是认知债务与认知投降,即开发者不再追问、把模型结论直接当成自己的结论。
AI 短剧上半年上线 22 万部,爆款率只有 0.47%,今年春节档 AI 剧上线量是真人的 50 倍,播放量却仅为 4%。山海短剧付磊称目前九成集数一次成片,单集算力成本约一百元,五个人能干原来四十人的活;点众已把三百多位编剧的经验做成 skill。阿里云在云栖大会期间牵头成立短漫剧产业发展联盟,并推出「万镜一刻」,用 Agent + 画布串联剧本策划、故事板与剪辑。
Agent 周边 infra 设施被认为极具价值,除钱包支付外,单一 RBAC 系统只要聚合足够多也相当值钱。未来企业将从管理人类的 Human Resource 演化出 Agent Resource 角色,需要管理本机权限、云端权限、Skill 能力、Agent 工具以及记忆文件。作者在 NewMax 中做了初步尝试,发现这些问题非常通用,每个 Agent 都会遇到,意味着市场巨大。
一条针对 Manus 和 CueAgents 的解读视频已发布,作者致谢 Opus5.5。原文未披露该视频涉及的功能、模型参数或具体结论。
Claude Sonnet 5.5 已上线 Genspark,接入 AI Chat、Code Agent 和 Claw。Genspark 称这是 Anthropic 目前最快的 Sonnet,输出速度提升 30% 以上,单任务成本比 Sonnet 5 最多降低 30%,价格保持不变。
一条提问引发讨论:你的产品日活智能体(daily active agents)何时会超过日活人类用户(daily active humans)。该帖获 25 次点赞、4 条回复、1 次转发,浏览量 3244。
Manus 团队 9 月 28 日将产品更新到 2.0 版本,重做智能体执行框架并推出 Cascade、可长期运行的云电脑与事件触发的 Automations,同时把桌面应用升级为覆盖文档、视频和游戏制作的 Manus Studio。
梳理 Manus 2.0 与 Cue 的功能拆解与授权边界问题,可对照 Meta Muse 观察个人智能体的两条产品路线。
Browser Use 上线 cloud.browser-use.com。该链接由 Browser Use 官方账号发布,正文未披露更多功能、价格或可用性细节。
Browser Use 上线 Ultrafast,速度提升超 10 倍且成本更低,比较航班价格仅需 $0.004。同时推出更聪明的 BU Fast,因算力有限采取分批放量,需私信申请提前进入。
Manus Community 宣布 Meet Manus 2.0 活动系列将走向全球,以线上加线下形式展开,包括创始人简报会、路演和 Fellow 主导的社区聚会。首场为 9 月 30 日晚 10 点 SGT 举行的创始人简报会网络研讨会,由联合创始人兼 CPO @hidecloud 主讲。
Notion 认为,未来三年内多数知识将在智能体之间流转,智能体可能成为知识交换的双方主体。Notion 正思考智能体如何注册、使用 Notion,MCP 是否足够,以及 Notion CLI 能否让一切被智能体编排和调用。这一观点与 Patrick/Stripe 的一段分享高度相似。
匿名模型 Space Bunny(太空兔)上线三天后登顶 OpenRouter 与 OpenCode 日榜,OpenCode 官方称其已连续 5 天蝉联最受欢迎模型,目前在两平台均可免费调用。