LimiX-2:面向通用结构化数据智能的上下文机制网络
LimiX-2 提出上下文机制网络,目标是通用结构化数据智能,论文已发布于 Hugging Face。该工作聚焦结构化数据场景下的通用建模能力,具体参数规模、benchmark 分数与开源情况原文未披露。
LimiX-2 提出上下文机制网络,目标是通用结构化数据智能,论文已发布于 Hugging Face。该工作聚焦结构化数据场景下的通用建模能力,具体参数规模、benchmark 分数与开源情况原文未披露。
Google DeepMind 宣布 AlphaGenome Atlas 现已免费开放,供全球研究者探索数据库以解码疾病的遗传成因。官方称这些发现只是开始,并提供了访问入口。
Google DeepMind 与 ScienceStowers 合作构建 Atlas,绘制了 2500+ 调控模式,找到充当生物开关和音量旋钮的 DNA 序列,可在数百种细胞类型中上调或下调基因活性。
Google DeepMind 与埃克塞特大学合作,用 AlphaGenome Atlas 分析 UK Biobank 超 5.4 万名参与者的数据,罕见遗传信号的检出率提升 22% 以上。该工具还发现了影响 PLA2G7 蛋白丰度的新 DNA 变异,而 PLA2G7 与代谢健康相关。
小米 MiMo-V2.6 正处于 RL 训练中,团队近半年专注研究 RL 能扩展到多大程度。这一轮在三个方向做了扩展:每步约 2B tokens 的算力(1568 prompts × 16 rollouts,全异步)、多任务智能体 RL 环境与 harness(单次运行中混合多种 harness),以及评分算力(组内智能体信用分配,结合测试用例与 rubric 奖励)。
潍柴动力股价从年初17.40元最高涨到36.34元,阶段涨幅一度达109%,推动这轮上涨的是AI数据中心备用电源对大缸径柴油发动机的需求。上半年数据中心发电产品销量超1400台,同比增长137%,已超过2025年全年。高盛测算AIDC发电业务2025年贡献约12%净利润,2027年可能升至50%。
真格基金推出「Z Jobs」芯片半导体系列招聘,每周分享一个行业的开放岗位,本期覆盖奇算光启、瞬元、芯视界、智子芯元、领挚科技五家团队。奇算光启 2024 年 10 月成立,做光计算芯片,已完成天使轮及天使+轮累计数亿元融资,招聘 AI 研究型实习生等岗位,要求 Claude Code/Codex/Cursor 等 AI Agent Harness 重度用户。
硅谷科技评论基于 SVTR AI 创投库梳理了212家 AI4S 企业、478条上市前融资事件和731家投资机构,发现 AI4S 正从模型能力竞争转向验证闭环竞争。
小米 MiMo 大模型负责人罗福莉宣布,新一代模型 MiMo-V2.6 处于强化学习训练阶段,训练过程实时对外直播,页面同时跑 MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 两条线,数据直接来自训练器日志。
2026年度CCF-百度松果基金申报将于9月20日23:59(北京时间)截止,该基金由CCF与百度于2020年共同发起,已累计支持170余项课题、产出超100项顶级成果。今年基金聚焦基础理论、分布式训练、推理部署、强化学习训练系统、模型结构与预训练、后训练与Agent、数据建设七大方向,计划支持8至13项,每项资助15万至25万元,课题周期为2026年10月至2027年10月。
普林斯顿博后张载熙创立AI4S公司科理新序(Scinetics),近日完成近5000万元人民币融资,英诺科创基金领投,沂景资本、小苗朗程、麟阁创投跟投。公司核心是开发多模态长程推理基座模型,提出Science Token概念,将小分子、核酸、蛋白质结构等科学数据转为统一表征单元,不经过人类语言转译,短期聚焦生命科学。
RustFS 发布正式版,这个基于 Rust、兼容 S3 的对象存储系统开源首年已积累 3 万多 Star,全球安装实例超 270 万,70% 以上来自欧美。正式版新增 MinIO 丝滑切换,可直接读取 MinIO 数据盘完成迁移,并将 MinIO 商业版中约 80 万人民币/年的 S3 Table 功能免费开源,支持 Spark、Iceberg 读写表数据并已进入生产环境。
Epoch AI 分析海关贸易数据发现,2024 年 4 月至 2025 年 6 月中国记录进口了 37.5 亿美元的马来西亚原产服务器,均价 10.6 万美元一台,明显高于平时水平。
Unsloth 放出配套免费 Google Colab Notebook 与 GitHub 仓库,并提供专门文档页,供用户上手其微调流程。
作者提示可以在免费的 Google Colab 中微调 500+ 开源模型,还能上传 PDF/CSV 把它们变成可用的合成数据集。操作步骤为打开 Colab、运行代码块安装 Unsloth Studio、选择模型、上传数据集,之后即可开始,并可在完成后导出模型。
Arcee.ai 宣布完成 B 轮融资,公司估值超过 $1B,由 Vista Equity、Cambium Capital 和 Emergence Capital 领投,AI10 Ventures、Hitachi、IAG、M12、P7 Ventures 与 Wipro 参投。
一篇题为《Continual Learning Mechanisms Compose for Long-Horizon Memorization》的论文发布,探讨持续学习机制组合用于长时程记忆。论文链接已在 Hugging Face 上线。
Anthropic 在学完互联网公开信息后,曾于 2021~2023 年下载数百万份盗版书,2023 年遭举报。因法律风险,其内部项目 Project Panama 改为满世界购买实体书,通过液压切割设备切掉书脊、拆成散页后送入工业扫描仪数字化,扫描完的书再交由外包垃圾回收供应商处理。这些通过中间机构购入的冷门、专业、学术书籍甚至古籍孤本,最终成为 Claude 的训练数据。
BackOps 宣布完成由 Insight Partners 领投的 4200 万美元 B 轮融资,距其 2600 万美元 A 轮仅六个月。该平台打通 ERP、WMS、TMS、承运商门户、邮件与表格,为客户自动处理并解决索赔等供应链工作;一家客户已处理超 50 万件索赔,业务量增长 150 倍,自动解决率从 87% 提升至 99%,另一客户的流程耗时从平均 28 小时降至 14 分钟。
2026年上半年四家国产GPU合计收入52.42亿元,同比增长约162%,但7月以来沐曦、天数智芯股价最大回撤分别达55%和64%,且反弹乏力。作者认为原因是国产GPU稀缺性下降、研发投入占收入50.7%导致利润未跟上,且大客户议价权增强。推理时代ASIC抢增量、推理卡毛利率明显低于训练卡,连英伟达的估值倍数年内也压缩约17%。
得物技术推动指标字典从0到1落地,用业务、数仓、产品三条线建立语义底座:存量报表逆向梳理、隐性指标先登记后转正,数仓消费收敛到域控宽表,并在提报环节拦截二义性。该语义层支撑 Text2SQL 与 AI Coding 两条消费主线,系统测评 SQL 准确率从 85%+ 提升到 95%+;OneData 建设全流程提效 40%+,核心模型开发阶段提效 70%+。
小红书团队提出 MemPro,把 Agent 记忆的完整 MCR 流水线(记忆构建—检索与使用)当成可演化程序,让 Evolving Agent 通过版本树选择有潜力的版本、分析典型错误,再用编辑—调试改写 Prompt、执行代码和控制逻辑。
AgentWork 开源社区发布《魔搭紫皮书》,共 8 篇 34 章、约 40 万字,面向想系统学习 AI 的读者。内容覆盖开源模型下载、无资源体验、用 ms-swift 做轻量微调、用 EvalScope 评测,以及 AI 健身教练、智能客服质检、语音助手、企业知识问答等场景,并含 Claude Code、Pi、DeepSeek Harness 的 Agent 篇。
金融 AI 创业公司 FreeRide AI 完成数百万美元种子轮融资,投资方为 L2F 光源创业者基金,两位牛津毕业的联合创始人张子辰、沈方正分别有摩根士丹利、摩根大通与 Meta、Oracle 的金融和模型研究背景。
Epoch AI 将其 AI Data Centers explorer 从 13 个数据中心扩展到 86 个,覆盖全球 AI 算力估计从 15% 升至 44%,2026 年已捕捉到当年新增部署算力的约 53%。页面新增 Directory 标签页,可按算力、IT 功率或成本排名,并按所有者、主要用户或国家筛选,同时提供卫星影像对比。Epoch AI 称对中国数据中心的覆盖仍偏低,为 9-31%。
Periodic Labs 在 Menlo Park 搭建高通量材料实验室,让实验与模型形成闭环:实验室产生新数据,模型从中学习并决定下一步尝试什么。团队仅用 1300 张 H200 加上数月实验数据,对一个开源模型做中期训练和 RL,在自家分析基准上超过 GPT-6 Astra,模型命名为 Neon。团队称首先聚焦材料科学中的超导、磁体和半导体材料等难题。
SemiAnalysis 分析指出,美国四州及 300 多个地方政府的限建措施并未如舆论所言拖垮数据中心建设,其模型预计 2027 年美国新增 38GW IT 容量,为 2026 年的两倍以上。
Google 公布了以 AI 加速科学、改善生活的进展,聚焦健康、自然灾害与天气韧性、学习、经济机会四个领域。上周进展包括用 AlphaGenome Atlas 绘制人类基因组全部 9B 种单字母遗传变异并开放给研究者,推出迄今最准的全球天气 AI 模型 WeatherNext 3,还发布了开放获取的 AI & Economy ATLAS。目前其服务覆盖近 300 种语言、70 亿使用者。
NVIDIA 技术博客解析 Dense 与 MoE 两类模型架构的差异:以 Nemotron 3.5 Lightning 为例,30B 参数模型通过 MoE 架构每个 token 仅激活 3B 参数,仍能利用更大模型的容量。文章对比两者的激活参数与吞吐量,并给出各自的选型时机。
NVIDIA Nemotron Labs 推出「Ask the Experts」栏目,专门解读 Nemotron 的后训练流程。内容以直播形式发布,原帖附带 x.com 直播链接。
NVIDIA 详解 NVLink 6 如何为大规模 AI 工厂提供多层弹性。在超大规模 AI 训练中,集群内每块 GPU 每秒需完成数千次集合通信以同步梯度;推理阶段非计划停机则会直接减少请求处理量,压缩收入。
NVIDIA FLARE 支持在 Docker、Kubernetes 和 Slurm 上扩展联邦学习,解决项目规模扩大后 GPU 按需分配、多个研究任务相互隔离的问题,同时让每个参与机构保留对自有数据的控制权。该方案将联邦学习的挑战从运行算法转向共享基础设施的运营。
AlphaFold 2 核心作者 Simon Kohl 创办的 Latent Labs 走"直接做蛋白质生成设计"路线,2025 年 7 月发布 Latent-X1,在 7 个靶点上湿实验测出大环肽命中率 91%–100%、mini-binder 10%–64%。
Yann LeCun 指出,这篇论文提出的方法正是他所说的 "target prop":每一层的输入都是自由隐变量,作为前一层的目标,可由反向传播的"增广拉格朗日"形式推导得出,即把层间约束转成惩罚项。
AI Simulation赛道升温,Simile估值达20亿美元,Aaru估值接近10亿美元,哈佛与MIT等机构联合的MatrAIx项目构建了83亿个AI虚拟人格。MatrAIx用1290个维度定义每个人格,完成超1.8万次测试,400次受控实验显示91.5%情况下Agent能遵循预设人格。Simile已为财富100强企业运行数千万次模拟,CVS用它构建了40万个数字分身。
腾讯混元推出 EvolveScaler,把世界定义为可执行状态机再渲染成自然语言,模拟记录被撤回、更正、回填的"信息演化"。该基准含 117 个原型、159 个问题算子、5 个难度层级,单样本事件量最高约 1,200。14 个前沿模型在最难层级上 avg@5 中位数降至 11.3,而用它训练可在 8 个分布外基准上平均提升 5.25。
Weaviate 的 Engram 用异步管线处理 AI 记忆:原始消息先提取关键事实,再与已有记忆比对,调和矛盾、去重与更新,最终只保留经过修剪的记忆集供检索。
2026 年 9 月 14 日 Imagination In Action 硅谷 AI 峰会上,嘉宾反复提到模型能力仍在变强但已不值钱,真正的门槛转向速度、路由架构、专有数据和物理供应链。
Yangyi 认为知识库是企业刚需,但当前形态更像一个基座,实际调用场景不应局限在基座内部,建议开放出来给其他场景做接入。
具身智能初创公司芝诺机器人完成总额数亿元人民币种子轮融资,投资方包括舜宇光学、沐曦股份、网新集团、赛意产业基金等。该公司自研3B参数基础模型Zeno-1与机器人Malo,采用去中心化架构实现多机协作,据称单策略可连续运行超10分钟、完成8个子任务。芝诺机器人于2025年11月展业,预计2027年上半年启动规模化进程。