跳到正文

#数据/训练

今日 43 条
9月18日周五
  1. AK(@_akhaliq)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LimiX-2:面向通用结构化数据智能的上下文机制网络

    LimiX-2 提出上下文机制网络,目标是通用结构化数据智能,论文已发布于 Hugging Face。该工作聚焦结构化数据场景下的通用建模能力,具体参数规模、benchmark 分数与开源情况原文未披露。

9月17日周四
  1. Google DeepMind(@GoogleDeepMind)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 开放 AlphaGenome Atlas,免费助力疾病遗传成因研究

    Google DeepMind 宣布 AlphaGenome Atlas 现已免费开放,供全球研究者探索数据库以解码疾病的遗传成因。官方称这些发现只是开始,并提供了访问入口。

  2. Google DeepMind(@GoogleDeepMind)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 与 ScienceStowers 绘制 2500+ 基因组调控模式图谱

    Google DeepMind 与 ScienceStowers 合作构建 Atlas,绘制了 2500+ 调控模式,找到充当生物开关和音量旋钮的 DNA 序列,可在数百种细胞类型中上调或下调基因活性。

  3. Google DeepMind(@GoogleDeepMind)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 与埃克塞特大学用 AlphaGenome Atlas 分析 5.4 万人 UK Biobank 数据

    Google DeepMind 与埃克塞特大学合作,用 AlphaGenome Atlas 分析 UK Biobank 超 5.4 万名参与者的数据,罕见遗传信号的检出率提升 22% 以上。该工具还发现了影响 PLA2G7 蛋白丰度的新 DNA 变异,而 PLA2G7 与代谢健康相关。

  4. Thomas Wolf(@Thom_Wolf)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小米 MiMo-V2.6 大规模 RL 训练进展公开,Fuli Luo 称将逐项开源细节

    小米 MiMo-V2.6 正处于 RL 训练中,团队近半年专注研究 RL 能扩展到多大程度。这一轮在三个方向做了扩展:每步约 2B tokens 的算力(1568 prompts × 16 rollouts,全异步)、多任务智能体 RL 环境与 harness(单次运行中混合多种 harness),以及评分算力(组内智能体信用分配,结合测试用例与 rubric 奖励)。

  5. 乌鸦智能说AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    潍柴动力年内最高涨109%:AI数据中心发电需求如何重估发动机业务

    潍柴动力股价从年初17.40元最高涨到36.34元,阶段涨幅一度达109%,推动这轮上涨的是AI数据中心备用电源对大缸径柴油发动机的需求。上半年数据中心发电产品销量超1400台,同比增长137%,已超过2025年全年。高盛测算AIDC发电业务2025年贡献约12%净利润,2027年可能升至50%。

  6. 真格基金AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    真格基金 Z Jobs 芯片半导体专场:奇算光启、瞬元等五家初创开放岗位

    真格基金推出「Z Jobs」芯片半导体系列招聘,每周分享一个行业的开放岗位,本期覆盖奇算光启、瞬元、芯视界、智子芯元、领挚科技五家团队。奇算光启 2024 年 10 月成立,做光计算芯片,已完成天使轮及天使+轮累计数亿元融资,招聘 AI 研究型实习生等岗位,要求 Claude Code/Codex/Cursor 等 AI Agent Harness 重度用户。

  7. 硅谷科技评论AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    全球212家 AI4S 公司与硅谷一线观察:当生成答案越来越便宜,验证正成为真正的分水岭

    硅谷科技评论基于 SVTR AI 创投库梳理了212家 AI4S 企业、478条上市前融资事件和731家投资机构,发现 AI4S 正从模型能力竞争转向验证闭环竞争。

  8. 夕小瑶科技说AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小米直播 MiMo-V2.6 强化学习训练,两天花费超113万美元

    小米 MiMo 大模型负责人罗福莉宣布,新一代模型 MiMo-V2.6 处于强化学习训练阶段,训练过程实时对外直播,页面同时跑 MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 两条线,数据直接来自训练器日志。

  9. 百度AIAI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 CCF-百度松果基金申报倒计时3天:9月20日截止,聚焦大模型七大方向

    2026年度CCF-百度松果基金申报将于9月20日23:59(北京时间)截止,该基金由CCF与百度于2020年共同发起,已累计支持170余项课题、产出超100项顶级成果。今年基金聚焦基础理论、分布式训练、推理部署、强化学习训练系统、模型结构与预训练、后训练与Agent、数据建设七大方向,计划支持8至13项,每项资助15万至25万元,课题周期为2026年10月至2027年10月。

  10. 暗涌WavesAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科理新序张载熙:做AI4S多模态基座模型,以Science Token计费

    普林斯顿博后张载熙创立AI4S公司科理新序(Scinetics),近日完成近5000万元人民币融资,英诺科创基金领投,沂景资本、小苗朗程、麟阁创投跟投。公司核心是开发多模态长程推理基座模型,提出Science Token概念,将小分子、核酸、蛋白质结构等科学数据转为统一表征单元,不经过人类语言转译,短期聚焦生命科学。

  11. HelloGitHubAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从一份 README 到 3 万星,RustFS 这一年都干了什么?

    RustFS 发布正式版,这个基于 Rust、兼容 S3 的对象存储系统开源首年已积累 3 万多 Star,全球安装实例超 270 万,70% 以上来自欧美。正式版新增 MinIO 丝滑切换,可直接读取 MinIO 数据盘完成迁移,并将 MinIO 商业版中约 80 万人民币/年的 S3 Table 功能免费开源,支持 Spark、Iceberg 读写表数据并已进入生产环境。

  12. Epoch AIAI 评估 · 75/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:贸易数据与约 30 亿美元芯片经马来西亚流入中国相符

    Epoch AI 分析海关贸易数据发现,2024 年 4 月至 2025 年 6 月中国记录进口了 37.5 亿美元的马来西亚原产服务器,均价 10.6 万美元一台,明显高于平时水平。

  13. Paul Couvert(@itsPaulAi)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Unsloth 发布免费 Google Colab 与 GitHub 资源,用于模型微调

    Unsloth 放出配套免费 Google Colab Notebook 与 GitHub 仓库,并提供专门文档页,供用户上手其微调流程。

  14. Paul Couvert(@itsPaulAi)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在免费 Google Colab 中用 Unsloth Studio 微调 500+ 开源模型

    作者提示可以在免费的 Google Colab 中微调 500+ 开源模型,还能上传 PDF/CSV 把它们变成可用的合成数据集。操作步骤为打开 Colab、运行代码块安装 Unsloth Studio、选择模型、上传数据集,之后即可开始,并可在完成后导出模型。

  15. Julien Chaumond(@julien_c)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Arcee.ai 完成 B 轮融资,估值超 $1B

    Arcee.ai 宣布完成 B 轮融资,公司估值超过 $1B,由 Vista Equity、Cambium Capital 和 Emergence Capital 领投,AI10 Ventures、Hitachi、IAG、M12、P7 Ventures 与 Wipro 参投。

  16. AK(@_akhaliq)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Continual Learning Mechanisms Compose for Long-Horizon Memorization 论文发布

    一篇题为《Continual Learning Mechanisms Compose for Long-Horizon Memorization》的论文发布,探讨持续学习机制组合用于长时程记忆。论文链接已在 Hugging Face 上线。

  17. 刘小排rAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的“老师”是如何进步的:从盗版书到 Project Panama 买书扫描

    Anthropic 在学完互联网公开信息后,曾于 2021~2023 年下载数百万份盗版书,2023 年遭举报。因法律风险,其内部项目 Project Panama 改为满世界购买实体书,通过液压切割设备切掉书脊、拆成散页后送入工业扫描仪数字化,扫描完的书再交由外包垃圾回收供应商处理。这些通过中间机构购入的冷门、专业、学术书籍甚至古籍孤本,最终成为 Claude 的训练数据。

9月16日周三
  1. AI Breakfast(@AiBreakfast)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    BackOps 获 4200 万美元 B 轮融资,供应链流程从 28 小时压缩到 14 分钟

    BackOps 宣布完成由 Insight Partners 领投的 4200 万美元 B 轮融资,距其 2600 万美元 A 轮仅六个月。该平台打通 ERP、WMS、TMS、承运商门户、邮件与表格,为客户自动处理并解决索赔等供应链工作;一家客户已处理超 50 万件索赔,业务量增长 150 倍,自动解决率从 87% 提升至 99%,另一客户的流程耗时从平均 28 小时降至 14 分钟。

  2. 乌鸦智能说AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    投资人开始“抛弃”国产GPU了

    2026年上半年四家国产GPU合计收入52.42亿元,同比增长约162%,但7月以来沐曦、天数智芯股价最大回撤分别达55%和64%,且反弹乏力。作者认为原因是国产GPU稀缺性下降、研发投入占收入50.7%导致利润未跟上,且大客户议价权增强。推理时代ASIC抢增量、推理卡毛利率明显低于训练卡,连英伟达的估值倍数年内也压缩约17%。

  3. 得物技术AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    得物技术指标平台实践:从语义底座到 Text2SQL 与 AI Coding

    得物技术推动指标字典从0到1落地,用业务、数仓、产品三条线建立语义底座:存量报表逆向梳理、隐性指标先登记后转正,数仓消费收敛到域控宽表,并在提报环节拦截二义性。该语义层支撑 Text2SQL 与 AI Coding 两条消费主线,系统测评 SQL 准确率从 85%+ 提升到 95%+;OneData 建设全流程提效 40%+,核心模型开发阶段提效 70%+。

  4. 小红书技术REDtechAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    EMNLP 2026|MemPro:让 Agent 的记忆系统学会自我进化

    小红书团队提出 MemPro,把 Agent 记忆的完整 MCR 流水线(记忆构建—检索与使用)当成可演化程序,让 Evolving Agent 通过版本树选择有潜力的版本、分析典型错误,再用编辑—调试改写 Prompt、执行代码和控制逻辑。

  5. 袋鼠帝AI客栈AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    袋鼠帝开源《魔搭紫皮书》:8篇34章约40万字,教人从0部署、微调、评测开源模型

    AgentWork 开源社区发布《魔搭紫皮书》,共 8 篇 34 章、约 40 万字,面向想系统学习 AI 的读者。内容覆盖开源模型下载、无资源体验、用 ms-swift 做轻量微调、用 EvalScope 评测,以及 AI 健身教练、智能客服质检、语音助手、企业知识问答等场景,并含 Claude Code、Pi、DeepSeek Harness 的 Agent 篇。

  6. 暗涌WavesAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    牛津兄弟放弃百万美金年薪创业 FreeRide AI,自训金融垂类模型冲华尔街

    金融 AI 创业公司 FreeRide AI 完成数百万美元种子轮融资,投资方为 L2F 光源创业者基金,两位牛津毕业的联合创始人张子辰、沈方正分别有摩根士丹利、摩根大通与 Meta、Oracle 的金融和模型研究背景。

  7. Epoch AIAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI 扩展全球 AI 数据中心研究,覆盖全球约 44% 的 AI 算力

    Epoch AI 将其 AI Data Centers explorer 从 13 个数据中心扩展到 86 个,覆盖全球 AI 算力估计从 15% 升至 44%,2026 年已捕捉到当年新增部署算力的约 53%。页面新增 Directory 标签页,可按算力、IT 功率或成本排名,并按所有者、主要用户或国家筛选,同时提供卫星影像对比。Epoch AI 称对中国数据中心的覆盖仍偏低,为 9-31%。

  8. Jeff Dean(@JeffDean)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Periodic Labs 用 1300 张 H200 训出开源模型 Neon

    Periodic Labs 在 Menlo Park 搭建高通量材料实验室,让实验与模型形成闭环:实验室产生新数据,模型从中学习并决定下一步尝试什么。团队仅用 1300 张 H200 加上数月实验数据,对一个开源模型做中期训练和 RL,在自家分析基准上超过 GPT-6 Astra,模型命名为 Neon。团队称首先聚焦材料科学中的超导、磁体和半导体材料等难题。

  9. SemiAnalysisAI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis:数据中心禁令并未拖垮美国建设,实际延迟仅约 2.3GW

    SemiAnalysis 分析指出,美国四州及 300 多个地方政府的限建措施并未如舆论所言拖垮数据中心建设,其模型预计 2027 年美国新增 38GW IT 容量,为 2026 年的两倍以上。

  10. Sundar Pichai(@sundarpichai)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 公布 AI 加速科学与改善生活的四大重点方向

    Google 公布了以 AI 加速科学、改善生活的进展,聚焦健康、自然灾害与天气韧性、学习、经济机会四个领域。上周进展包括用 AlphaGenome Atlas 绘制人类基因组全部 9B 种单字母遗传变异并开放给研究者,推出迄今最准的全球天气 AI 模型 WeatherNext 3,还发布了开放获取的 AI & Economy ATLAS。目前其服务覆盖近 300 种语言、70 亿使用者。

  11. NVIDIA Technical BlogAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dense 与 MoE 模型对比:激活参数、吞吐量与选型时机

    NVIDIA 技术博客解析 Dense 与 MoE 两类模型架构的差异:以 Nemotron 3.5 Lightning 为例,30B 参数模型通过 MoE 架构每个 token 仅激活 3B 参数,仍能利用更大模型的容量。文章对比两者的激活参数与吞吐量,并给出各自的选型时机。

  12. NVIDIA AI(@NVIDIAAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Nemotron Labs 专家解读 Nemotron 后训练

    NVIDIA Nemotron Labs 推出「Ask the Experts」栏目,专门解读 Nemotron 的后训练流程。内容以直播形式发布,原帖附带 x.com 直播链接。

  13. NVIDIA Technical BlogAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性

    NVIDIA 详解 NVLink 6 如何为大规模 AI 工厂提供多层弹性。在超大规模 AI 训练中,集群内每块 GPU 每秒需完成数千次集合通信以同步梯度;推理阶段非计划停机则会直接减少请求处理量,压缩收入。

9月15日周二
  1. NVIDIA Technical BlogAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA FLARE 如何跨 Docker、Kubernetes 与 Slurm 扩展联邦学习

    NVIDIA FLARE 支持在 Docker、Kubernetes 和 Slurm 上扩展联邦学习,解决项目规模扩大后 GPU 按需分配、多个研究任务相互隔离的问题,同时让每个参与机构保留对自有数据的控制权。该方案将联邦学习的挑战从运行算法转向共享基础设施的运营。

  2. 海外独角兽AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent Labs:AlphaFold 3 发布两年,AI 药物设计进展到了哪一步?

    AlphaFold 2 核心作者 Simon Kohl 创办的 Latent Labs 走"直接做蛋白质生成设计"路线,2025 年 7 月发布 Latent-X1,在 7 个靶点上湿实验测出大环肽命中率 91%–100%、mini-binder 10%–64%。

  3. Yann LeCun(@ylecun)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 谈 target prop:从增广拉格朗日视角重新推导反向传播

    Yann LeCun 指出,这篇论文提出的方法正是他所说的 "target prop":每一层的输入都是自由隐变量,作为前一层的目标,可由反向传播的"增广拉格朗日"形式推导得出,即把层间约束转成惩罚项。

  4. 硅谷101AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI开始预测人类:83亿虚拟人格、数字社会,与一门押注未来的生意

    AI Simulation赛道升温,Simile估值达20亿美元,Aaru估值接近10亿美元,哈佛与MIT等机构联合的MatrAIx项目构建了83亿个AI虚拟人格。MatrAIx用1290个维度定义每个人格,完成超1.8万次测试,400次受控实验显示91.5%情况下Agent能遵循预设人格。Simile已为财富100强企业运行数千万次模拟,CVS用它构建了40万个数字分身。

  5. Hunyuan(@TXhunyuan)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元发布 EvolveScaler:可执行状态机生成的信息演化评测基准

    腾讯混元推出 EvolveScaler,把世界定义为可执行状态机再渲染成自然语言,模拟记录被撤回、更正、回填的"信息演化"。该基准含 117 个原型、159 个问题算子、5 个难度层级,单样本事件量最高约 1,200。14 个前沿模型在最难层级上 avg@5 中位数降至 11.3,而用它训练可在 8 个分布外基准上平均提升 5.25。

  6. Weaviate • vector database(@weaviate_io)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Weaviate 推出 Engram:异步管线整理 AI 记忆,按项目/用户/属性分域存储

    Weaviate 的 Engram 用异步管线处理 AI 记忆:原始消息先提取关键事实,再与已有记忆比对,调和矛盾、去重与更新,最终只保留经过修剪的记忆集供检索。

  7. 硅谷科技评论AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    模型越来越便宜,什么才开始值钱?——Imagination In Action 硅谷 AI 峰会观察

    2026 年 9 月 14 日 Imagination In Action 硅谷 AI 峰会上,嘉宾反复提到模型能力仍在变强但已不值钱,真正的门槛转向速度、路由架构、专有数据和物理供应链。

  8. Yangyi(@Yangyixxxx)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yangyi 评腾讯微信团队开源知识库 WeKnora:形态更像基座,应开放给其他场景接入

    Yangyi 认为知识库是企业刚需,但当前形态更像一个基座,实际调用场景不应局限在基座内部,建议开放出来给其他场景做接入。

  9. 暗涌WavesAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    芝诺机器人完成数亿元种子轮融资,押注多机协作与3B模型Zeno-1

    具身智能初创公司芝诺机器人完成总额数亿元人民币种子轮融资,投资方包括舜宇光学、沐曦股份、网新集团、赛意产业基金等。该公司自研3B参数基础模型Zeno-1与机器人Malo,采用去中心化架构实现多机协作,据称单策略可连续运行超10分钟、完成8个子任务。芝诺机器人于2025年11月展业,预计2027年上半年启动规模化进程。