Lovable 在动手开发前先勾勒应用外观,实测搭建梗图生成器
Lovable 在正式开始构建前会先勾勒出应用的大致外观。有用户用它搭了一个梗图生成器,可根据提示词自动挑选图片并撰写文案。
Lovable 在正式开始构建前会先勾勒出应用的大致外观。有用户用它搭了一个梗图生成器,可根据提示词自动挑选图片并撰写文案。
LangGraph 现已支持将 Qdrant 作为长期记忆的存储层,通过新的 memory store 集成,让 AI 智能体的记忆可跨对话保存与召回。Qdrant 为 LangGraph 的记忆系统带来向量原生存储与语义搜索,智能体可按语义而非精确匹配检索相关记忆,用于存储用户偏好、历史交互等上下文。
LangGraph 文档已在 docs.langchain.com 更新,涵盖 Python 版用法。同时 LangGraph 的 Qdrant 集成包已发布到 PyPI,可通过 pip 安装使用。
OpenAI 在 API、Codex 和 ChatGPT Work 推出 GPT-6.1 Sol 的加速服务档 Ultrafast,官方称速度最高可达 Standard 的 8 倍,API 价格为标准档的 6 倍。
Aether AI 发布因果智能体系统 CRIS-0 的官方 Demo,机器人在关闭微波炉门时因人手突然插入实现 0.2 秒紧急悬停。该系统由 UCSD 助理教授、CMU 因果学派学者黄碧薇创立的 Aether AI 打造,核心是因果原生的 Agent 架构,通过统一状态与因果变量、统一工具接口和因果世界模型 CausalWM 推演动作后果。
TRAE 将 TraeCode 和 TraeWork 双端融合升级为新 TRAE,提供 Agent 模式和 IDE 模式两种工作方式,切换入口在右上角。Agent 模式作为全局工作台,可在同一窗口管理项目并把写代码、出文档、准备交付材料分给多个 Agent 并行推进;IDE 模式保留 SOLO 和 IDE 玩法,用于逐行细改代码。
微软将允许 Microsoft 365 Family 和 Premium 订阅者把 Copilot 及 AI 使用权益共享给同一套餐下最多五人,并可为未成年家庭成员管理 AI 访问权限。
Anthropic 的 Claude Science 首次完成全天紫外波段成像。它协调多个 AI 智能体下载并校准多个太空任务的数据、完成合并,并用 inpainting 补全缺失区域,测试中预测与实测平均偏差约 10%。此前因臭氧层阻挡紫外线、只能从太空观测,NASA 的 GALEX 任务仅覆盖约三分之二天空且跳过了明亮恒星形成区。
TRAE 将 TraeWork 与 TraeCode 合并,保留已有开发能力,并加入 Agent 工作台,用统一界面跨项目分配任务、调度多个 Agent 并行工作。
微软在 10 月 7 日旧金山 Windows AI 与 Surface 活动上公布 Surface Laptop Ultra 的预售与上市安排,售价 2599 美元起,10 月 16 日上市,搭载英伟达 RTX Spark 超级芯片,最高 128GB 统一内存,被微软称为迄今性能最强的 Surface Laptop。
ACC 2026 × WorkBuddy 超级个体极限挑战赛开启招募,寻找 20 位挑战者,带着一件自己真正想办成的事到 ACC 现场,用 WorkBuddy 的专家团、Skills、连接器、自动化、资料库等能力在两天内交付可当场检查的成果。
Grok Bot 现在可以直接搜索、阅读和监控 X,用户最多可创建 3 个 Bot,把品牌的社区运营、内容策略和用户分析自动化。发帖者称这对运营品牌账号的人几乎是一个"作弊码"。
X Analyst 可分析品牌过去 30、60、90 天内容下的全部互动和回复,找出其中有影响力的人物、行业领袖或创作者等值得关注的账号。这些信号会同步给团队,帮助品牌发现真正重要的人和机会。
Ish Verduzco 提出在 X 上管理品牌账号的三个机器人玩法:24/7 社区经理每日扫描品牌提及、汇总可扩散推文与产品反馈、推送每日摘要和紧急预警;内容策略师分析品牌历史推文的互动、回复与书签数据,推荐内容方向并构建语气/风格技能;分析师则梳理过去 30/60/90 天的互动与回复,找出有影响力账号并同步给团队。
一个用纯 Rust 从零重写的图像工具实现了 Photoshop 的图层、蒙版、调整图层和矢量功能,可直接打开、编辑、保存真实的 PSD 文件。该项目还提供 CLI 和 MCP 接口,可交给脚本和 AI agent 驱动,代码托管在 github.com/openhausfun/ph。
生数科技开放新一代视频生成旗舰模型 Vidu Q4 预览版,最高支持 4K 直出,单次最多可用 15 张参考图和 3 段参考音频,单条最长 16 秒。实测 720P 生成 GTA 6 风格《邪恶老奶》一分钟仅 5.4 元,6 条共 110 秒视频花费不到 10 元。MaaS 端 720P 约 0.6 元/秒、1080P 约 0.75 元/秒,SaaS 端预览版阶段有两个月限时优惠。
Google Cloud发布署名Thomas Kurian的长文,推出通用办公Agent Gemini Agent,支持跨应用调用工具、定时与事件触发任务、多子Agent协作,并能依据任务在效果、速度与成本间动态选择Gemini系列或Anthropic Claude系列模型,未来计划支持更多闭源和开源模型。
对比Meta与OpenAI的办公Agent路线,能帮读者看清谷歌这次把Agent嵌入企业组织体系的具体做法。
由华为2012实验室、华为云等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。
苹果宣布将于 10 月 13 日在纽约举办「Apple Experience」家庭产品活动,最受关注的硬件是代号 J490 的带屏设备 HomePad,配备约 6 英寸方形触控屏和金属支臂,搭载内部代号 Charismatic、可能名为 homeOS 的系统,可通过人脸与声音识别家庭成员。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6 系列。
Black Forest Labs 的 FLUX 3 Image 已在 Vercel AI Gateway 上线,同一个模型即可文生图或编辑图片,只需一个 API key,无需 Black Forest Labs 账号。
Muse Gadgets 发布后,开发者开始将 Muse 装进各种意想不到的硬件。有人把 Xteink eReader 改造成 Calliope 的常亮随身显示器,用来展示 Muse 的形象和状态更新,并通过 MagSafe 吸附在手机背面,抬手即可看到。
Muse 开始出现在 Rabbit R1 上,已有用户动手尝试并放出实际运行演示。该演示由 G Cam Pak(@CameronPak)发布,帖内含运行视频。
Federico Viticci 把 Xteink eReader 改造成 Calliope(其 Muse)的常显口袋显示屏,用于展示自身状态与更新,并借助 MagSafe 吸附在手机上,翻转手机即可查看。Muse app 的设置流程顺畅,用户可直接让 Muse 在屏幕上加载或自动化内容。
Tibo 将 Nikita Bier 的消费者应用方法论整理成一个免费开源的 AI 技能,用户向 agent 描述自己的应用后,它会指出你卡在增长阶梯的哪一级、哪些数据还不可信、该先修什么以及 2-3 个重点押注,并给出一个预设 yes/no 阈值的测试。该技能将出现在明天的 newsletter 中。
Fable 5.1 现已能创建此类模拟内容,相关作品获得 1610 万次观看。该信息由 Ernesto Lopez 发布,并附带了演示视频。
Fable 5.1 现已能制作这类模拟,相关视频获得 1610 万次观看。该内容在 Twitter 上获 2 条回复、1 次转发、3 次点赞,浏览量 1787 次。
Notion 宣布其平台已可调用 Claude Haiku 5.5。引用 Anthropic 的介绍,Haiku 5.5 是其发布的最便宜、最快且能力最强的小模型,平均运行成本比 Claude Haiku 4.5 低约 75%。
Google 发布实验性游戏平台 Playground,用户通过对话界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验,可在浏览器中用手机或笔记本游玩并支持排行榜和部分品类的多人模式。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分档;未来将接入正在测试的 Unity Spark,提供专业级机制和高保真 3D 能力。
Google 宣布 SynthID Detector 即日起面向全球英文用户开放,任何人都可以检查图像、视频或音频文件是否由 AI 生成。该工具可识别来自 Google 及其合作伙伴(包括 OpenAI、NVIDIA、Kakao,Apple 即将加入)的 AI 内容。
OpenRouter 推出决策排行榜页面,可在 openrouter.ai/rankings/decis 查看各模型在真实调用中的决策表现。原文未披露具体模型、分数或排名细节,仅提供入口链接供用户体验。
OpenRouter 上线 Decision Model Rankings,可查看不同决策模型和任务类型的支出份额与 token 份额,覆盖 Relevance、Correctness、Instruction Following 等类别,目前 typesafeai 在所有类别中领先。
ElevenLabs 正式上线 OpenRouter,可调用 9 款 Text to Speech 模型,支持 90+ 种语言,以及 2 款带说话人标签和词级时间戳的 Speech to Text 模型。所有 ElevenLabs 模型在 OpenRouter 独家 5 折,优惠持续至 10 月 19 日上午 8 点(PT)。
Cloudflare 的 Clef(27B)和 Clef Flash(9B)两款开源决策模型已在 OpenRouter 上线。模型接受文本、JSON 或图像输入,返回带概率的类型化答案而非生成文本;输入价格为 Clef 每百万 token 0.24 美元、Clef Flash 每百万 token 0.09 美元,输出免费。
StepFun 的 Step 5 Preview 已在 OpenRouter 上线,定价为输入 $1.00/M、输出 $2.70/M,发布期缓存命中价再打五折至 $0.05/M。发布方称该模型面向智能体与专业工作场景,并提供为期一周的免费访问,逐步覆盖 opencode、cline、NousResearch、kilocode 等平台。
OpenRouter 分享案例,一个 5 人销售团队用其 Ori 构建 AI 销售智能体 Rasp,对每条入站线索做调研,多数线索 60 秒内获得回复,每月节省约 600 小时。成本约为每天 30 美元,并逐周下降。
Replit 联合 Microsoft 发布桌面应用预览版,在 Windows 上本地构建和运行应用,每次构建都运行在由 Microsoft Execution Containers 和 Nvidia OpenShell 驱动的独立沙箱中。该预览版已开放 waitlist 申请早期访问。
GitHub Copilot 即将支持智能本地模型路由,能在最合适时自动把任务分派给本地模型,帮助用户节省 AI credits。该功能是 Project HydraFusion 愿景的下一步。
GitHub 正在为 Copilot 引入本地模型和沙箱化工具,让开发者在工作流中同时保有选择权与控制权。官方以 "local development" 为主题发布了相关说明,但未披露具体模型、版本或可用时间。
腾讯WorkBuddy上线“独立文件浏览器”,本地文件可在独立窗口查看编辑,文件在左、AI在右,可围绕当前文件总结、分析、修改和润色,且只读取用户主动打开或添加的文件。谷歌向全球用户开放AI生成内容检测工具SynthID Detector,支持识别图片、视频、音频是否由AI生成。阿里蔡崇信预判五年后AI将从显性话题转为隐性基础设施,融入业务每个环节。