JavaScript 中文周刊 #254:tinyjs 打造不到 10MB 的 JavaScript 桌面应用
tinyjs 能用不到 10MB 的体积构建 JavaScript 桌面应用,内置 txiki.js 驱动的后端,可访问包括 FFI 在内的完整系统能力,配合原生 WebView 渲染,支持打包到 macOS、Linux 和 Windows。
tinyjs 能用不到 10MB 的体积构建 JavaScript 桌面应用,内置 txiki.js 驱动的后端,可访问包括 FFI 在内的完整系统能力,配合原生 WebView 渲染,支持打包到 macOS、Linux 和 Windows。
Dify 高级开发者关系郑立撰文披露其插件生态的安全与治理机制:截至 2026 年 8 月 25 日,Marketplace 共列出 928 个插件、907 个带有安装记录、263 个官方标注条目,官方称维护基线为 99 个主动维护插件。
在云栖大会阿里巴巴 AI Native 研发实践论坛上,阿里、蚂蚁、飞猪等团队披露:编码仅占软件交付总时长 20%—30%,极端链路中编码不足 1%、约 1 小时,但需求到交付仍需约 21 天,时间耗在影响分析、环境准备、联调、审批、灰度和封网等环节。
阿里巴巴在云栖大会上发布开放具身数据基础设施项目 RoboFlywheel,首发的仿真板块与清华大学赵昊团队联合打造,覆盖百万级仿真资产底座与跨引擎仿真平台。首批包含 52 万刚体、40 万铰链物体和 10 万柔性体,资产补充质量、惯量、摩擦与关节等物理属性。
Hugging Face 语音识别和翻译两个分类趋势榜第一分别是网易有道的 Confucius4-R2T2 和 Confucius4-T3PO,前者是 2B 真流式语音识别模型,出了字不再回改,后者是 140 亿参数级实时翻译模型。
英伟达CEO黄仁勋在最新访谈中称AI危言耸听已走得太远,将当前AI浪潮视为一场新的工业革命,提出能源芯片、AI工厂、模型、应用、社会影响构成的"五层蛋糕"架构。他反驳AI终结就业的"有害神话",认为安全、对齐和沙盒化都是可通过工程手段解决的问题,产品不安全就不应发布,并强调世界既需要闭源也需要开源模型,以便各国和企业掌控自己的基础设施。
快手与ACM SIGIR 2026合作举办的快手探索者LLM-Rec挑战赛在北京完成线下决赛,新加坡国立大学队伍“菊花梨高智商推荐”以复赛第一、决赛第一夺得总冠军并获40万元奖金。赛事从全球231所院校、1205支队伍中选出20支队伍,围绕快手OneReason预训练基础模型探索大模型与推荐系统的融合,赛事总奖金池达99万元,决赛前20名可免笔试直入快手算法终面。
Genspark 在 Super App 内上线编码智能体 GenCode,支持 Claude、GPT、DeepSeek 或开源权重模型,同一个账号即可使用且无需配置 API key。作者称其能力与 Claude Code、Codex 相当,开源权重方案的成本为后者的 1/10 到 1/20,并强调模型由用户按任务自行选择,而不是由智能体代为指定。
Modal 发布面向 AI-SQL 的推理引擎 Quail,将 SQL 查询规划与推理执行联合优化,在单条多表连接查询上达到每 H100 GPU 每分钟处理超 10 亿 token,比同硬件的 vLLM 基线快 10 倍以上。
Hugging Face 联合创始人兼 CEO Clement Delangue 在联合国安理会发言,回顾公司今年 7 月成为首家公开披露自主智能体网络攻击的企业,并分享三点教训。
NVIDIA 开源 Nemotron 3 Diarization 模型,可在实时对话中稳定追踪说话人,并采用商业友好许可。该模型与 Transformers 实现 day-zero 集成,Hugging Face 工程师在测试中配合 Reachy Mini 与运行在 DGX Spark 上的 speech-to-speech 验证了效果,机器人能识别新声音并记住名字。
小米发布 MiMo-V2.6,包含 Pro 和 Flash 两个全模态模型,通过规模化强化学习推进,并可开放获取模型权重、技术报告、强化学习环境与训练代码。Pro 在多数智能体基准上与 Claude Opus 5 和 GPT-5.6 Sol 表现相当,在 Artificial Analysis 智能指数上得分 46,为开源模型中最高,同时在编码、电脑操作、3D 推理和创作能力上更强。
小米发布 MiMo-V2.6 双版本开源权重模型,并给出与闭源前沿模型在智能体基准上的对照成绩。
TypeSafe AI 公开 System One Model 与 Jev,用 RLCD 训练,单查询 70–500ms 直接输出结构化类型值与校准概率,输入 $0.042/MTok、输出免费。
2026网易科技未来大奖获奖名单揭晓,梁文锋(DeepSeek CEO)、杨植麟(月之暗面kimi CEO)等10人获评"AI创新先锋人物"。宇树科技、智元等10家企业获"具身智能先锋企业",京东JoyAI、蚂蚁百灵、理想VLA、百川智能、水木分子、面壁智能CPM for Legal入选"行业大模型应用标杆"。
作者在 2026 云栖大会期间实测阿里开源的 Qwen-Image-2.1 图像模型,该模型视觉生成部分为 7B、32 层 Single-Stream DiT,用 Comfy 桌面端在 3090 上即可运行。
OSPOlogy + OSPO Summit China 2026 于 9 月 7 日在上海举行,vivo 以 Supporter Sponsor 身份支持并参与,会议聚焦 Agentic AI 时代的 OSPO 职能演进与企业开源治理。
小米发布 MiMo V2.6 系列,包含 Pro、Flash 和 Pro-UltraSpeed 三个版本,其中 UltraSpeed 输出速度最高可达 Pro 的 20 倍。
OpenAI 在 2026 年 7 月发布的 GPT-5.6 首次把自我改进列为评测科目,其 RSI 指数从 GPT-5.5 的 41.7% 升至 GPT-5.6 Sol 的 57.9%,相差 16.2 个百分点。文章按四条标准(持久改进、自主闭环、递归增益、稳健可控)划分 RSI 层级,指出前两层已有实现,递归自我加速尚无充分公开证据。
阿里发布 Qwen-Audio-3.1,ASR、TTS 与 Realtime 全面升级,并新增 TTS-Next 和 ASR-Next 两款模型,共五款覆盖理解、生成、交互与创作。
在华为全联接大会 2026 期间,华为以灵衢互联协议为核心发布集群与超节点协同的新计算架构,将 CPU、NPU、内存、存储等十余种协议归一,互联带宽从百 GB 级提升至 TB 级,RTT 时延从 7 微秒降至 2 微秒,并宣称配合通算融合与多维并行优化可将十万卡集群 MFU 从 20% 提升到 35%。
腾讯混元 Hy Image3.5 preview 已在 ComfyUI 上线,单模型同时支持文生图与图生图,最高可输出 2K 分辨率。官方称其人类评估胜率较 Hy Image3.0 提升 30%,支持多语言文字、符号与小字号渲染,覆盖电影、漫画、商业摄影和插画风格,并能在场景、服装和风格变化中保持人物身份与产品特征。
2026云栖大会首日,阿里公布大模型系列进展:基于新一代架构的Qwen4已在训练中,未来Qwen4.5、Qwen5等版本将扩展至5-10T参数;Qwen3.8-Max在人类零参与下自主迭代超1个月、完成33轮有效迭代,并在平头哥新款GPU上自主优化Qwen3.8-Flash推理框架,单实例推理吞吐量提升96%。
Qwen-Image-2.1 成为 Image Edit Arena 和 Text-to-Image Arena 的双料第一开源模型。其在 Image Edit Arena 拿下 1367 分,位列开源模型榜首,总榜排名第 16,距第 15 名的 GPT-Image-1.5-high-fidelity 仅差 3 分。该模型由阿里 Qwen 团队推出,现已开放试用。
小米团队正式发布并开源 Xiaomi MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生全模态模型。
原文给出开源模型在AA综合指数上的位置与RL算力扩展的公开细节,便于比较开源与闭源差距。
Hugging Face 联合创始人 Julien Chaumond 发文回顾,10 年前的今天他与 ClementDelangue 一同参加 betaworks Demo Day。他调侃自己如今白发更多、发量更少,但认为这一切都值得。
小米发布原生全模态模型 MiMo-V2.6 Pro 与 Flash 并开放 MIT 许可权重,API 沿用 V2.5 定价;Pro 与 Flash 在长程软件工程评测 DeepSWE v1.1 中分别达到 72.6 和 65.7,较本轮训练前提升约 14 分和 17 分。
第七届小米黑客马拉松于 9 月 22 日在北京小米科技园颁奖,284 支队伍报名、近千名选手参与,现场 149 支队伍进行 48 小时极限开发。本届首次开设高校赛区,覆盖北京大学、武汉大学、香港中文大学等 94 所高校,并新增"最佳 MiMo 应用奖",3 个项目获奖,分别探索智能家居服务、独居老人主动关怀和 AI 陪伴硬件。
AMD 软件副总裁 Anush Elangovan 在播客中介绍 ROCm——AMD 面向自家硬件加速器的统一开源软件层与工具链,并称智能体 AI 正在大幅降低底层硬件编程的门槛,软硬件开发周期的收敛也在加快。
阿里在云栖大会集中发布 ROLL、RTP-LLM、Atrex Kernel Agent、OpenSandbox、Open Agent Auth、OpenCodeReview 六个开源项目,分别面向大规模强化学习、生产级推理、异构算子生成优化、Agent 沙箱运行、企业级授权和智能代码评审。
阿里巴巴在云栖大会推出 Logics-Parsing-V3 开源文档解析模型,通过循环滑动窗口与结构状态传递处理跨页内容,解决表格截断、文本割裂和标题层级错位问题。
Qwen-Image-2.1 获得 Intel OpenVINO 的 Day-0 支持,可在 Intel 硬件上优化运行。该模型以单一开放权重 checkpoint 同时支持图像生成与编辑。Intel Devs 表示已为 Qwen-Image-2.1 提供 Day-0 OpenVINO 支持。
小米发布 MiMo-V2.6 系列,含 Pro、Flash 和 20 倍速的 Pro-UltraSpeed 三个版本,AA 指数 46 分与同日发布的 Grok 4.7 打平,位列开源模型第一。
作者以实测视角对比 Grok 4.7 与 MiMo V2.6 的性能、价格和速度,呈现国产开源模型的实际能力边界。
Aikido 发布首个开源权重安全模型 Altar-1,具备接近前沿水平的防御能力,其基础是开源 SOTA 模型 GLM 5.3 的剪枝量化版本,轻量到可装进单个 4-H200s 节点。
Browser Use 与 Jev 联合推出开源浏览器智能体 Ultrafast。据推文数据,Ultrafast 4 天内获得 15k 星标,查询航班耗时 7 秒、花费 0.0039 美元。其设计包含每一步都有新的 action space、DOM 状态空间,以及回退到小 LLM 执行输入,演示视频为 1 倍速。
White Circle 发布开源模型后训练框架 Halo,吞吐量最高达原生 TRL 的 2.8 倍,峰值内存更低,且模型保持 HuggingFace 原生格式。HuggingFace CEO Clement Delangue 转发称,借助智能体,训练模型正变得越来越容易。
小米发布开源模型 MiMo-V2.6-Pro,支持文本、图像、音频、视频多模态,权重已上传 Hugging Face。Artificial Analysis 数据显示其在 Intelligence Index 上得分 46,超过前代 MiMo-V2.5-Pro 的 26,位列开源权重模型首位。
小米开源 MoE 多模态模型,公开权重、定价与第三方指数对比,可据此判断开源与闭源的成本差距。
小米发布开源权重模型 MiMo-V2.6-Pro,在 Artificial Analysis 智能指数上得 46,成为该榜单最高分开源模型,前代 MiMo-V2.5-Pro 为 26。
Thomas Wolf 认为,在 RLVR 新范式下,发布大量高质量开源 RL 环境相当于当年共享高质量预训练数据,是当下推动开源前沿最有影响力的事。他转述 eliebakouch 的说法称,对方将开源约 7k RL 训练数据及框架,并已发布模型与技术报告,距启动最终 RL 训练不到 1 周。
Nat Friedman 表示 muse 是从零构建的,但产品上深受 openclaw 启发。他在 1 月使用 openclaw 后为 MSL 团队购入数百台 Mac mini,团队许多人爱上了 openclaw 及其他个人智能体,他认为 @steipete 的 harness 从一开始就具有开创性。muse 的目标是打造类似 openclaw 但安全、易用、可扩展至数十亿人的产品。
Thomas Wolf 列出 Dylan Patel 访谈后约 10 周内的开源模型发布,包括 Thinking Machines Inkling、Moonshot Kimi K3、DeepSeek V4-Flash-0731 与 V4-Pro-0813、Qwen3.8-Max、Z.ai GLM-5.3、Meta Muse Spark 1.2 等。