上海海思HiSpark升级:首创XDAS四维框架,端侧AI开发提效76%
上海海思在HiSpark开发者生态社区首次提出XDAS四维框架(AI for Development、AI for Application、AI for Support、EXperience for AI),并开放首批五大领域Skills,实验室实测嵌入式开发效率提升约76%,原本1名工程师约2周的工作量可在1天内完成。
上海海思在HiSpark开发者生态社区首次提出XDAS四维框架(AI for Development、AI for Application、AI for Support、EXperience for AI),并开放首批五大领域Skills,实验室实测嵌入式开发效率提升约76%,原本1名工程师约2周的工作量可在1天内完成。
Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。
谷歌于 10 月 6 日开源 EmbeddingGemma 2,这是其首个原生多模态开源嵌入模型,可把文字、代码、图片、视频、音频放进同一个 768 维空间并用一句话检索。
iOS 27 新增通知自动化,任何能发送通知的 App 都可作为快捷指令触发条件,并可按通知标题、副标题、正文三个字段组合筛选。作者用十个案例展示具体玩法,包括重要联系人连续消息换墙纸提醒、自定义图标后补回角标、按 App 颜色生成墙纸、联系人专属铃声、英文通知自动翻译以及用 AI 总结当天通知。文中也指出限制,通知自动化只能获取实际显示出来的内容,微信等长消息会被省略号截断。
AI眼镜品牌NIMO所属公司比特幻境完成数亿元人民币天使轮融资,最新估值15亿元,投资方包括博华资本、戈壁创投、元禾璞华和尚势资本。NIMO首款产品于今年4月出货,月度销售达数千台,已合作约150家线下门店,并与雅视光学达成深度合作。产品重约29克,采用0.06英寸MicroLED微显示芯片和0.03cc自研超微型光机。
NOOKLAB 推出首款产品 Moonphase Flip,一块可磁吸在手机背面的 AI 墨水屏,支持全天无感录音、实时转写和 AI 自动提取 todo 与日程,仅在日程、任务、AI 交互三个 Tab 呈现,续航两三天。
OpenAI 在 DevDay 发布的 Dots 回到 ChatGPT 式聊天形态,但存在记忆不共享、语音聊天要响两声才接、云电脑完全不开放等缺口;Meta 的 Muse 则提供 SDK 和适配 ESP32 的 AgentReady 通用固件,可直刷设备。
微软在时隔两年的首场线下活动中发布 Surface Laptop Ultra 与 5999 美元的 Surface RTX Spark Dev Box,并公布 Windows 11 的多项更新。
波士顿创业公司 SOND 推出睡眠耳机 Dreambuds,每只仅 2.1 克,整晚持续读取心率、HRV、呼吸、睡姿、打鼾、体温等 12 项信号,据此动态调整耳内播放的助眠内容。
阶跃星辰旗舰模型 Step 5 Preview 已在 Vercel AI Gateway 上线,模型名为 stepfun/step-5-preview,面向智能体编码、专业知识和金融分析场景。
BMW 推出 Neue Klasse 平台第三款车型 iX4,轿跑 SUV 造型,iX4 50 xDrive 将于 2027 年 3 月上市,起售价 66,200 美元,EPA 续航最高 428 英里,超过 Tesla Model Y。
开源本地推理引擎 Strata 主打在消费级电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next 量化版,通过量化、GPU 专家缓存和 CPU/GPU 协同推理降低显存门槛,RTX 5070(12 GB 显存)下 Q2_0 量化版短对话生成速度约 94 tokens/s。
微软公布 Surface Laptop Ultra 的规格与价格,这款 AI PC 搭载 Nvidia 芯片,面向运行 AI 模型和智能体设计,并配备改版后的 Windows 11。
Satya Nadella 宣布微软为 Windows 上的 Copilot 引入 Hybrid Intelligence。经用户许可后,Copilot 可读取 PC 上的上下文、代用户执行操作,并在合适场景下使用本地模型,在提升能力的同时让 token 用得更久。
微软发布 Surface Laptop Ultra,这是首款搭载 NVIDIA RTX Spark 芯片的产品,该芯片为 Arm 架构 PC 芯片,将 CPU 与 GPU 合一。
微软为 Surface Laptop Ultra 推出 Magnetic Connect 磁吸充电方案,充电线可磁吸吸附到机身右侧的 USB-C 接口,该接口仍可正常用于视频、数据和其它 USB-C 连接。
微软 Surface RTX Spark Dev Box 已开启预售,售价 5,999 美元,预计 11 月发货。该设备搭载 Nvidia Arm 架构 RTX Spark 平台和 128GB 统一内存。
微软 Surface Laptop Ultra 将于 10 月 16 日上市,起售价 $2,599,基础配置为 18 核 CPU、24GB 内存和 512GB 存储。
微软在 Windows 与 Surface 发布会上公布 Windows 的智能体 AI 功能,并展示搭载 NVIDIA RTX Spark SOC 的 Surface Laptop Ultra。
微软在秋季 Surface 活动上宣布,从今年秋季起 Windows 任务栏的搜索菜单将改造成聊天机器人式界面,用户可通过输入简短命令完成数千种操作,如开关深色模式和免打扰,也能不打开 Copilot 应用直接与其对话。
"iPod 之父" Tony Fadell 认为,第一代 AI 硬件未能解决真实问题,因而遭遇失败;他指出下一波产品必须赢得消费者信任。
Sigil Wen 的 Conway Research 完成由 a16z 领投的种子轮,Khosla Ventures、SV Angel 及 Anthology Fund 参投,天使投资人包括 Stripe 联创 Patrick Collison 和前 OpenAI 研究员 Noam Brown。
Microsoft 被列为 2026 Gartner® 全球工业 AIoT 平台魔力象限领导者。其工业 AIoT 平台以 Azure IoT Hub、Azure IoT Operations。
Google DeepMind 开源发布原生多模态、专为端侧设计的 740M 参数嵌入模型 EmbeddingGemma 2,把文本、代码、图像、视频、音频映射进同一个 768 维向量空间。
Google 开源 EmbeddingGemma 2,这是一个可在手机和电脑本地运行的多模态嵌入模型,文字、图片、视频、音频和代码可放进同一套坐标系,不联网也能用一句话检索内容。
Google DeepMind 的 EmbeddingGemma 2 现已上线 Ollama,可通过 `ollama pull embeddinggemma-2` 获取。该模型面向消费级设备,是 Google DeepMind 首个原生多模态开源端侧嵌入模型,除文本外还将代码、图像、音频和视频统一到同一嵌入空间。
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构、740M 参数、Apache 2.0 许可,将文本、代码、图像、视频和音频映射到统一嵌入空间。
Google Gemma 现可在浏览器中直接完成嵌入,无需服务端支持。该能力借助 WebML 相关工具实现,用户打开对应页面即可试用。
NVIDIA 推出 DGX Spark Live,主题为混合 AI 的智能路由。原文未披露具体模型、参数与可用性细节。
Google 与 Northwestern、Jacaranda Health 合作,在肯尼亚内罗毕和芝加哥各纳入 1000 名孕妇,用机器学习模型分析未经超声培训的卫生员按预设路径完成的"盲扫"超声视频,估测妊娠龄和胎位,准确度与受训超声医师相当。卫生员仅需 8 小时即可学会操作,且全部处理在设备端完成,无需供电或 Wi-Fi,可在资源匮乏地区提供产前关键信息。
Google DeepMind 发布 EmbeddingGemma 2,参数量 740M,在多项基准上具有竞争力,甚至超过部分参数量两倍以上的专用模型。开发者可用它为应用加入多模态搜索,例如用语音备忘录在视频中定位片段,也可与 Gemma 4 搭配实现私密的端侧 RAG。该模型以 Apache 2.0 许可发布,权重已在 Hugging Face 和 Kaggle 上线。
Google DeepMind 发布 EmbeddingGemma 2,称这是其首个原生多模态的端侧嵌入开源模型。该模型在文本之外统一了代码、图像、音频和视频,把它们映射到同一个共享空间。
Datawhale 发布开源中文教程《Jev Cookbook》,面向 System One 决策模型,包含 11 章系统讲解与 18 篇可运行的 Jupyter Notebook,从 Choice、Score、Noul 三种核心原语讲起,覆盖 RAG 引用过滤、动态工具路由、风险拦截等接入场景。
Google DeepMind 发布 EmbeddingGemma 2,一个将文本、代码、图像、视频和音频映射到统一嵌入空间的轻量多模态嵌入模型,基于 Gemma 4 架构、Apache 2.0 许可,参数量 7.4 亿。
犹他州现已允许 AI 开具痤疮药物处方;Neurable 发布可追踪专注度的耳机;Fitbit Edge 的泄露信息显示其是一款更智能的健身手环。此外,科学家研发出一种在火星上建造(建筑)的新方法。
苹果 10 月 2 日发布公告,宣布将在后续版本收紧 macOS 的完全磁盘访问(Full Disk Access)权限,理由是部分开发者正以可能让用户暴露系统全部内容的方式使用该权限,未来用户需要经过非常明确的操作才能完成授权。
Google DeepMind 发布开源嵌入模型 EmbeddingGemma 2,基于 Gemma 4,把文本、代码、图像、视频、音频映射到同一 768 维空间,文本路径为 270M 参数,支持 8K token 上下文,代码检索较初代提升 14%。
Simon Willison 重跑了 Colin Fraser 早前针对 GPT-4o 的长数字加法实验,这次改用本地运行的 Qwen 3.8 27B,并分别测试推理模式与非推理模式。原帖未给出具体得分,仅附上实验记录链接。
歸藏用 Muse Gadgets SDK 在 M5 Stack 的 Stop Watch Meta 上做了个小玩具,认为该 SDK 原始设计太臃肿拥挤且默认非中文,于是重新调整了整体 UI 使其更协调、界面改为中文,并把中间形象换成与自己 Muse 相同的橘猫。他提到这个 SDK 很方便,已内置数款常见 ESP32 设备固件,直接刷入即可。
魔芯科技在华为Mate 90系列发布会上亮出鸿蒙独占应用摸小宠,用户拍几张猫的照片即可生成可从任意角度观看的4D数字猫,其技术底座是MoWorld世界模型。该链路端云协同:云端在昇腾NPU上用扩散模型生成3D高斯模型,约6亿参数的MoWorld-2.0-Flash经量化裁剪跑在麒麟芯片上完成端侧渲染。