向阳乔木开源 AI 设计工具:一句话生成 7 个模版,支持自然语言改元素
向阳乔木用三天 AI Coding 做出并开源了一款 AI 设计工具,输入一句话即可生成适配不同平台的 7 个模版。选中任意元素后用自然语言描述即可修改,如选中标题说“改成红色”。工具支持 Codex Cli 生图、即梦、Gemini 等模型以及数千个 emoji 和 unsplash 图库,当晚将上线 Obsidian 官方插件库。
向阳乔木用三天 AI Coding 做出并开源了一款 AI 设计工具,输入一句话即可生成适配不同平台的 7 个模版。选中任意元素后用自然语言描述即可修改,如选中标题说“改成红色”。工具支持 Codex Cli 生图、即梦、Gemini 等模型以及数千个 emoji 和 unsplash 图库,当晚将上线 Obsidian 官方插件库。
向阳乔木开源了 qiaomu design,代码托管在 GitHub(github.com/joeseesun/qiao…),可在 Obsidian 官方插件市场搜索“qiaomu”找到。
研究者构建了多智能体协作评测基准 AgentWorld,让 LLM 驱动的智能体在 MMORPG 沙盒中分工完成制作、采集、战斗等长时程任务。
有开发者做了一款工具,让 AI agent 不只在终端里打「请点击 Allow」,而是直接在用户屏幕上用一支大箭头指出该点哪个按钮。它针对的是 agent 不敢自行按下、必须由人类手动确认的那类按钮。项目地址已在 GitHub 放出。
OpenAI 在 GitHub 上线了名为 openai/math 的仓库。该消息由一个社交账号转发链接披露,正文未透露仓库的具体功能与内容。
针对 CLIProxyAPI 自身不提供用量与成本记录的问题,有开发者为其补上了用量与成本的记录能力,并配了一个可视化管理控制台。相关项目托管在 GitHub 上。
开发者受 Producthunt 产品 DeTV 启发,借助 Grok bot 协作和豆包播客 API 开发了一款 AI 播客,由双人主播播报 Hacker News、GitHub Trending、卡兹克 AI Hot 热门新闻及 Producthunt 热门产品。在线电台为 aitv.qiaomu.ai,开源地址在 github.com/joeseesun/aitv。
向阳乔木公开 aitv 的在线体验入口 aitv.qiaomu.ai,并在 GitHub 仓库 joeseesun/aitv 开源该项目。原文未披露模型、参数或性能细节。
西湖大学特聘研究员李昊阳在《AI4S 实战派》第十五期直播中讲解如何用 AI 从 H&E 病理切片预测空间转录组分子信息,梳理了判别式建模、扩散模型与流匹配等生成式方法,以及 UNI、GigaPath、CONCH、OmniCLIP 等病理基础模型和对齐工作。
字节跳动技术团队发布 OpenViking,一个面向 AI Agent 的统一上下文数据库,位于 Codex、Trae、Claude Code、豆包等 Agent 背后的共享 Context 层,让上下文跨工具延续。
小红书开源自研 Java 堆外缓存引擎 RED OHC(Apache 2.0),在 AMD EPYC 7T83、JDK 11 的 5 轮 JMH 基准中,32 线程纯读吞吐达 Cassandra OHC 基线的 3.38 倍,32 线程读写 9:1 为 2.60 倍,单线程读、写、读写 9:1 分别为 1.13 倍、1.26 倍、1.25 倍。
斯坦福大学李飞飞、吴佳俊、Ehsan Adeli 等人发布论文,提出开放的世界动作建模框架 OpenWAM,相关代码、评测与预训练视频模型权重已开源。框架从阿里开源的 Wan2.2-5B 出发,在约 334 万条人机交互视频上继续预训练,用 MoT 架构把 5B 视频专家与 2B 动作专家拼在一起,并定义 VTA、ATV、Joint、Decoupled 四种交互程序。
有人做了个等距小城网页,打开就能看到托盘从工厂运到码头集装箱、地铁和公交按点发车、火箭升空,鼠标点到哪个物件就显示它的实时状态。项目代码托管在 GitHub 的 Khalidabdi1/fa… 仓库。
微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。
复刻 Adobe 全家桶的 Craft 开源项目 @get_artcraft 将目标扩展到 Office 场景,按 PPT -> deckcraft、Word -> wordcraft、Excel -> gridcraft 的对应关系推出新组件。该项目此前以开源方式对标 Adobe 系列工具,此次命名覆盖演示、文档与表格三类办公套件。
LangGraph 更新官方文档,并发布 Qdrant 集成包。该集成已在 PyPI 上线,可通过 pip 安装使用,文档同步提供 Python 版使用说明。
联想天禧 AI 自研的专业代码智能体框架 TianxiCode 配合 DeepSeek-v4.1-Flash,在 SWE-bench-Live(Lite 分榜)中以 71% 的问题解决率登顶全球第一,并通过官方 Verified 核验。TianxiCode 具备跨文件多跳检索、自驱动规划与多轮工具调用、闭环补丁生成与测试驱动自愈三大能力,未来将落地联想 AI 硬件产品。
有人用纯 Rust 从零重写了 Photoshop 的图层、蒙版、调整图层和矢量功能,能直接打开、编辑、保存真实的 PSD 文件。该项目可通过 CLI 或 MCP 交给脚本和 AI agent 驱动,代码托管在 GitHub 的 openhausfun 仓库。
a16z 宣布投资 Preference Model,该团队专注为头部实验室构建 AI 研究与 ML 工程方向的 RL 环境。本周他们开源了生产环境框架 Karotte,经超一百万次评估运行和红队测试打磨。团队重点在于让环境随模型变强而更难被攻破:定位模型弱点的工具、针对缺口生成新任务,并让智能体主动攻击测试环境。
Qwen-Image-2.1-Multiple-Angles-LoRA 模型已上线 Hugging Face,可通过 huggingface.co/akhaliq 访问。该模型以 LoRA 形式为 Qwen-Image-2.1 提供多角度图像生成能力,具体参数与效果未在原文披露。
微软发布开源跨平台沙箱库 MxC,可在 Windows、macOS 和 Linux 上运行,底层使用 processcontainer、bubblewrap 和 seatbelt 实现隔离。
MiniMax H3 的 Person Remover LoRA 可自动移除视频中的人物:它用 SAM 3.1 追踪目标人物、将掩码填充为绿色,并以重叠窗口方式生成替换背景。使用时需提供原始视频和首帧的干净版本。
斯坦福 Fall 2026 课程 CS 329Z《Engineering AI Agents》第 4、5 讲已公开,分别由 @Diyi_Yang 讲「Tool Use」、@Diyi_Yang @michaelryan207 @jyangballin 讲「Frameworks & Orchestration」。
yetone 的 magpie 是一套 AI Agent 基建,支持各种模型配置和 OAuth 登录,开发 AI 工具时可把仓库发给 Agent 学习参考。其平台图标采用 lobehub 整理的 icon,添加服务商的操作也更直观。仓库地址为 github.com/yetone/magpie。
Perplexity 开源 pplx-embed-v2-late,这是面向文本与图像的多向量嵌入模型,提供 9B 和 0.6B 两个版本并共享同一嵌入空间。其中 9B 可用于索引多模态数据,0.6B 可用于端侧查询,还支持无需 OCR 直接搜索 PDF 页面。官方称其在 MADQA 上得分 92.4%,在 BrowseComp+ 上得分 64%,权重已在 Hugging Face 发布。
美团技术团队在 KDD 2026 分享 8 篇收录论文,覆盖推荐大模型 MTFM、奖励建模框架 CDRRM、智能体搜索基准 LocalSearchBench、ETA 元泛化框架 UME 及生成式推荐训练系统 MTGenRec 等方向。大众点评技术部还在 2026 KDD Cup 复杂数据分析 Data Agents 赛道夺得冠军与季军,相关代码已在 GitHub 开源。
OpenAI 于 10 月 6 日公开了由一款未发布内部前沿模型产出的 719 份数学手稿,覆盖 372 个主题族,并包含大量 Lean 形式化证明。Mistral 发布 1 万亿参数多模态模型 Mistral Large 4(绰号 Le Chonk),Reflection AI 推出 5010 亿总参数、230 亿激活的 MoE 开源模型 Beam。
开发者 @blended_jpeg 开源的 badclaude 已发布,可通过 `npm install -g badclaude` 全局安装。项目托管于 GitHub(GitFrog1111/badclaude),作者同步给出了 yaml 配置示例。
一位开发者给多 agent 协作的 Bot 提供了 GitHub、Cloudflare API 和豆包播客 API,不同性格和技能的 Bot 经讨论拍板,做出了一个 24 小时播报 AI 新闻的电视台,并计划当日下午开源。该开发者称自己此前一直不看好多 agent 协作,这次有所改观。
星动纪元自研的世界动作模型VPP2登顶RoboDojo仿真榜单,平均成功率32.26%、平均得分39.26分,两项均列第一,领先GPT-6-Astra。该模型未额外加数据、未用Agent RSI等增强手段,仅靠标准数据集,在泛化、精细操作、记忆三个维度也拿下第一。团队将视频预测与动作学习分阶段训练,真机ALOHA零样本操作平均成功率58.5%,高于π0.5的40%,现已在GitHub开源。
Aether AI 展示因果驱动的机器人智能系统 CRIS-0,以任务状态为共同依据协调因果世界模型、动作策略和验证工具,让机器人在环境变化后判断动作继续、重试或回退。演示覆盖抗干扰、长程任务和个性化交互三个维度,测试中系统平均 2 秒内识别环境变化并重新规划,10 次干扰完成 9 次有效恢复,微波炉场景下 0.2s 内停止动作。
LightOn OCR-3 已在 OpenDocRouter 上线,定价为 $0.28 / 1m input 和 $1.40 / 1m output,约合 $3.19 / 1k pages(ParseBench)。
Google Cloud 开源 AQuA(Ambient Quality Agent),一个与生产环境 AI 智能体并行运行的参考实现,可扫描并核验失败聚类、对照对话记录,并按实际部署的源码快照定位根因。它针对的是智能体上线后难以察觉的质量回归——这类问题往往仍返回 HTTP 200 OK。
Atomic Agent 推出 Atomic Agent Desktop,一款面向 macOS/Windows/Linux 的本地 AI 优先开源(MIT)智能体,可将对话占用的内存压缩最高 80%,并支持从 Claude Code 导入 skills、memory、MCP servers 和聊天记录。
TanStack 团队推出 TanStack Charts,为 TypeScript 提供框架无关的可视化图形语法,目前仍标记为 Alpha,每周下载量约 16 万次。
Founder Park 本周推荐 16 款 AI 产品,Personal Agent 是最卷方向,大厂与创业公司密集入场。Muse 上线 10 天在美国获约 73 万次下载并登顶 App Store 免费榜,Manus 随 Manus 2.0 发布独立 App Cue,为每个 Agent 配备独立邮箱、电话、钱包和电脑。
Qdrant 与 Pento 合作推出 miniCOIL EN-ES,一个英西双语稀疏神经检索器,让 "home" 与 "casa"、"bat" 与 "murciélago" 映射到稀疏向量的同一单元格,单个倒排索引即可同时服务英语和西班牙语查询与文档,无需翻译步骤。
开源 Mac 终端 Kaku 面向 AI 编程场景,近期更新新增会话恢复和官方 Homebrew 支持,并修复图片相关输入卡死问题、优化远程桌面下的标签页体验。
山行 AI 基于开源项目 Bibo 分析个人 AI 工作空间的架构取舍:日常对话与个人空间由 Cloudflare Workers、Durable Objects 承接,需要系统工具时再获取 Linux 沙箱,文件独立放在 R2 不随临时执行环境消失。
TypeSafe 推出的决策模型 Jev 经由 OpenRouter 提供服务,无需任务特定训练即可输出受限于候选标签的数值分数。