理想推进芯片子公司首轮融资,投前估值约 150 亿元
晚点独家获悉,理想芯片子公司正推进首轮外部融资,投前估值约 150 亿元,计划融资数十亿元。工商信息显示,Mach Intelligent Cores Limited 于 7 月 14 日在香港成立,其全资持有的上海马赫智芯智能科技有限公司于 8 月 4 日成立,理想 CTO 谢炎任法定代表人。
晚点独家获悉,理想芯片子公司正推进首轮外部融资,投前估值约 150 亿元,计划融资数十亿元。工商信息显示,Mach Intelligent Cores Limited 于 7 月 14 日在香港成立,其全资持有的上海马赫智芯智能科技有限公司于 8 月 4 日成立,理想 CTO 谢炎任法定代表人。
第七届小米黑客马拉松于 9 月 22 日在北京小米科技园颁奖,284 支队伍报名、近千名选手参与,现场 149 支队伍进行 48 小时极限开发。本届首次开设高校赛区,覆盖北京大学、武汉大学、香港中文大学等 94 所高校,并新增"最佳 MiMo 应用奖",3 个项目获奖,分别探索智能家居服务、独居老人主动关怀和 AI 陪伴硬件。
小米正式发布并开源 Xiaomi MiMo-V2.6 系列,包含 Pro 和 Flash 两个原生全模态模型,定位为探索 RSI(递归自我改进)路径的关键一步。
小米开源 MiMo-V2.6 系列,公开 RL 算力扩展细节与 6 天 Live 训练实测数据,可观察开源模型追赶闭源的一条路径。
Qwen-Image-2.1 获得 Intel OpenVINO 的 Day-0 支持,可在 Intel 硬件上优化运行。该模型以单一开放权重 checkpoint 同时支持图像生成与编辑。Intel Devs 表示已为 Qwen-Image-2.1 提供 Day-0 OpenVINO 支持。
阿里巴巴集团CEO吴泳铭在2026杭州云栖大会上判断,未来机器供给的思考总量将达人类思考总量的1000倍以上,机器将承担99.9%的思考工作。他宣布平头哥发布新一代AI芯片真武V900,性能达M890的3倍,单一集群可扩展至50万卡;Qwen团队正探索递归式自我改进(RSI),计划训练5-10T参数规模的新模型。阿里云目标到2032年全球数据中心规模超20GW。
腾讯混元团队把 Hy4 preview 的权重从约 1.5TB 压缩到 214 GiB,参数量仍为 770B,改变的是权重的表示方式。
Aikido 发布首个开源权重安全模型 Altar-1,具备接近前沿水平的防御能力,其基础是开源 SOTA 模型 GLM 5.3 的剪枝量化版本,轻量到可装进单个 4-H200s 节点。
小米 AI 硬创团队开源了四件 AI 硬件探索作品:AI 记忆配饰 DayoTag 采用无服务端本地记录并支持扩展 Skill;哈基米 PetAgent 把 Agent 运行状态同步到桌面摆件。
Laya 是一个开源分类系统,占用内存不到 1GB,已在 Hugging Face 上提供,可在任意笔记本或手机上运行,作者称其速度比 Jev 快 50 倍,并用它玩贪吃蛇达到每秒 60 次决策。作者也指出两点限制:目前上下文只有 1k,部分用例无法覆盖;泛化能力不如 Jev,但需要时很容易微调。
零跑于2026年9月16日正式发布世界模型智驾系统,放弃BEV表征与激光雷达信息接入,采用图像到动作架构,激光雷达仅作安全兜底。同日朱江明宣布已售出的35万辆激光雷达车型用户可免费升级该系统。
高通在圣迭戈总部搭建面向5G和6G的研发测试平台,用无线信号追踪无人机并由AI分类,展示其6G愿景的连接、感知、高性能计算三大基石。高通提出"计算连续体"多层架构,并计划推出面向家庭和小企业、可承载万亿级参数模型的设备形态;同时探索把AI算力下沉到基站侧,供运营商提供"算力即服务"或"Token即服务"。
PrismML 发布基于 Qwen3.8 27B 的 Ternary Bonsai 2 27B,体积比全精度版本小 9 倍,仍保留 98.2% 的综合基准性能,并以 Apache 2.0 开放。作者 Paul Couvert 表示其占用仅 5.9 GB,在智能体编码、多模态推理和长程工具使用上提升明显,并认为如今家用设备也能跑前沿级智能。
Snap 将 Spectacles 演进为 SPECS,售价 2195 美元,重量从上一代 226 克降至 132/136 克,FOV 提升到 51 度,并首次作为消费者产品出售。节目邀请现场体验者泽霖和 AR/XR 开发者脑潘,讨论 130 多克重量与高价为何仍让它离日常佩戴很远。话题延伸至苹果、Meta、Snap 各自技术路线下,下一代计算平台尚无「灯塔」的 XR 行业现状。
9月14日豆包手机助手正式发布消费者版本,搭载在努比亚 NaviX Ultra 手机上,重点转向交互、意图理解与 Agent 融入 App 生态。新版增加专属 AI 键与指纹鉴权,可检索相册、短信、便签等本地数据,并接入飞书妙记录音能力。同日推出屏幕自动化操作声明协议 SAEP,第三方应用可自主决定是否允许 AI 在应用内自动操作,规则公示 30 天至 10 月 15 日。
豆包2.1 Pro 0915版进入火山方舟模型列表,支持百万 Token 上下文与多模态编程,并强化长程 Agent 协作与异步子任务验收。Anthropic 开源含 36 套工具的生物模型推理优化工具集,报告平均提速约 4 倍,其中 FlashPairformer 专用内核加速结构预测,仓库为研究参考发布、不计划持续维护。
真格基金推出「Z Jobs」芯片半导体系列招聘,每周分享一个行业的开放岗位,本期覆盖奇算光启、瞬元、芯视界、智子芯元、领挚科技五家团队。奇算光启 2024 年 10 月成立,做光计算芯片,已完成天使轮及天使+轮累计数亿元融资,招聘 AI 研究型实习生等岗位,要求 Claude Code/Codex/Cursor 等 AI Agent Harness 重度用户。
NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该基准针对 AI 智能体在车辆、机器人等边缘设备上的多步推理工作流,要求模型快速生成 token 并在不断增长的对话中持续推理。TensorRT Edge-LLM 面向此类边缘推理场景优化。
小米18 Fold 采用「中折叠」新形态,配备 5.38″ 外屏与 7.58″ 内屏,首发搭载玄戒O3芯片,十核全大核CPU,并配备徕卡2亿超清主摄与 6000mAh 小米金沙江电池。播客「乱翻书」邀请金叶宸、Takun 与主播潘乱,讨论手机厂商为何集中涌向折叠屏,以及折叠屏的真正问题已从「怎么折」转向「为什么值得展开」。
Google 开源了移动端自动化工具 ARTEMIS,可把提示词转为自动化操作,宣称成功率 99%+,并集成 Codex、Claude Code、Antigravity,支持自动化工作流并捕获日志。其路线图提到计划加入端侧 VLM,用轻量边缘视觉模型实现本地执行,以隐私优先的方式做自动化。
Perplexity 将从 HP ZBook Ultra G3A 起预装在 HP 设备上,并逐步扩展到更多 HP 产品线。官方博客已公布该合作详情。
Perplexity 在受支持的 HP PC 上推出 Portable Computer,这是 Computer 的本地优先版本,可用本地模型完全在设备端运行任务。该版本将私密数据留在用户机器上,且不消耗云额度。
SemiAnalysis 分析机器人与 LLM 的硬件逻辑差异:LLM 是模型先行、硬件适配,机器人则因实时控制环路和整机成本约束,硬件固定、模型去适配 Jetson 或 H100 等可量产硬件。
Perplexity Windows 应用新增 Portable Computer 功能并已开放上手使用,其端侧推理要求配备 NVIDIA RTX GPU 且显存不低于 24GB。
Portable Computer 现已在搭载 NVIDIA RTX GPU 的 Windows PC 上可用,可在本地运行 harness、智能体与模型。它支持在不把任务发送到云端的情况下处理本地文件和已连接的应用,必要时也可调用前沿云端模型。
一套本地 AI 实验的 homelab 配置:Hermes 跑在 Framework Desktop Mainboard AI Max+ 395 上,5090 eGPU 以 Qwen 3.8 27B 提供最高 150+ tok/s 的 LLM 推理。
Hugging Face 上出现 Qwen3 的量化版本,显存或统一内存较小的设备也能运行。该模型页面为 huggingface.co/HauhauCS/Qwen3…,适合本地部署场景。
Thomas Wolf 分享了一款新的端侧本地 AI 智能体系统,运行一个量化到 4 bit 的开源 4B 模型(MLX)。该系统的作者 Sigil Wen 称其为"on-device AI OS"Underdog,完全本地运行,起因是他对云端数据被用于训练、邮件和 iMessage 被采集以及 AI 攻击能力的担忧。
Fireworks 与 Genspark 推出 Gen-1 Slides,一个开源模型,在幻灯片生成上匹配 Claude Opus 5,输入 token 价格约为其 1/17。该模型基于 MiniMax M3 底座,由 Genspark 用 Fireworks Lab 的长程 RL 后训练而成,现已在 Genspark AI Slides 中作为默认模型上线。
苹果于9月9日举行秋季发布会,由新任 CEO John Ternus 主持,跳过标准版直接推出 iPhone 18 Pro 与 iPhone 18 Pro Max,搭载 2nm 工艺 A20 Pro 芯片,配备更小灵动岛、48MP Fusion 主摄与改进版蒸汽腔散热,Pro Max 续航最长可达 30 小时并支持 15 分钟充电至 50%。
OpenBMB 公开了小模型 MiniCPM 的 HuggingFace 与 GitHub 链接,并同步放出强化学习训练框架 Meshy 以及长时程强化学习项目 JustRLII。相关资源分别托管在 HuggingFace、GitHub 与 Notion 文档上,作者称小规模开源模型的表现正变得越来越好。
面壁(ModelBest)发布 100% 开源的 MiniCPM5-2B,仅 2B 参数、2GB RAM 即可在任意笔记本甚至手机上完全离线运行智能体,支持编码、智能体和工具调用任务。
Paul Couvert 认为华为新机可能是应用时代的终点,它推动智能体在操作系统层面主动跨应用完成任务,并同时结合本地与云端模型。他提到 Mate XT 2 由 Z 折改为翼式三折并加入刚性外屏,大内屏带硬件级防窥显示。
华为在 Mate XT 2 上首发 Kirin 9050 Pro,这是全球首款基于 LogicFolding 架构的芯片,性能较上代提升 46%,晶体管密度提升约 55%。该架构基于 Tau 缩放定律,通过垂直堆叠逻辑层实现,芯片在制裁下仍仅用 4 个月就完成交付。余承东介绍了该芯片的性能优势。
OpenBMB 开源 MiniCPM5-2B,这是一个 2B 参数语言模型,主打端侧高智能密度,可在手机上本地离线运行,面向智能体、编码与工具调用优化。
小米秋季旗舰新品发布会上,小米澎程N70 Pro、N70 Max、N90 Max 和 N90 Max 探索版四款车型正式上市,售价 20.99 万至 29.99 万元。
华为9月7日发布新一代三折叠手机 Mate XT2 非凡大师,首发麒麟9050 Pro 芯片,整机性能较 Mate XTs 提升42%,起售价19999元,比上一代涨2000元。该机改用U型双内折方案并首次加入独立外屏,出厂搭载 HarmonyOS 7 正式版,集成盘古大模型端侧AI能力。余承东透露华为三折叠手机全球发货量已超100万台。
NVIDIA 发布技术指南,讲解如何在 Jetson 边缘设备上部署与优化具备多步推理能力的模型。此前这类推理模型体量过大,只能将推理请求绕行数据中心处理,带来网络依赖、成本上升和敏感数据离机的风险。该限制正在解除。
字节跳动技术团队基于内存快照研发线上 Memory Graph 方案,还原对象引用关系、识别异常内存来源并辅助归因,落地三个月内使头条和抖音的 OOM 崩溃率下降超过 50%。该方案针对 iOS 应用因内存占用过高被系统终止、却缺乏普通崩溃日志的定位难题。滴滴则复盘了 HDFS 从 2.7 滚动升级至 3.2 的完整实践,在不中断业务的前提下完成长期升级。
作者用千问办公对阿里 Qwen3.8-Max-0902 做了七个场景实测,涵盖投行报告转滚动网页与 PPT、烹饪知识网站、3D 迷宫寻宝、8-bit 横版过关、声控游戏、在线德州扑克和骑自行车 SVG 动画。
小红书与 vivo 联合打通从相册生成到社交发布的完整 3D 内容链路,双方共同设计移动社交场景 3D 内容格式,将原始产物压缩至约 4MB。