跳到正文

#数据/训练

今日 37 条
今天10月10日周六
  1. 土猛的员外AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    把几十万份企业文档塞进知识库,为什么“导进去”只是最容易的一步

    帮上海一家大型国企把几十万份文档导入知识库时发现,真正的难点在导入之后:资料散落在OA、ERP、企业微信和NAS,同一制度存在三个版本,扫描PDF、数百页长文与带合并单元格的Excel混在一起,解析出错或机械切断就会让模型对着碎片胡猜。AI精准召回一份过期差旅标准比找不到更危险,Agent时代还可能越权拼出薪酬信息或直接写回知识库。企业需要的是持续供应可信知识的流水线,而非更大的知识库。

  2. AI前线AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    字节 Seed 等团队发现 DeepSeek-V4 长文本检索的周期性盲区

    字节跳动 Seed 团队联合普林斯顿大学、斯坦福大学和加州大学伯克利分校,系统测试 DeepSeek-V4 与 V4.1 后发表论文,揭示其分块 KV 缓存压缩带来的相位敏感性缺陷。

  3. Z PotentialsAI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 母公司 TypeSafe AI 完成 8.7 亿美元融资,估值 75 亿美元

    Jev 开发商 TypeSafe AI 完成 8.7 亿美元融资,由 Andreessen Horowitz 领投,Sequoia 和现有投资方 DCVC 参投,公司现估值 75 亿美元。

  4. Z PotentialsAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    专访 UCSD 正教授商静波:LLM 正在收敛,下一站押注超级智能

    34 岁的 UCSD 正教授商静波认为,如果 AGI 指在广泛任务上达到普通人水平,那它某种意义上已经实现,真正未到来的是能在重要领域持续超越最优秀人类的超级智能。

  5. 哔哩哔哩技术AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HOMURA:面向时间受限场景的 LLM 翻译强化学习优化,入选 EMNLP 2026 Oral

    哔哩哔哩 Index LLM 团队提出 HOMURA 强化学习框架,通过 KL 正则化目标与动态音节比例奖励,在音节级长度约束下优化翻译的语义保留与时间合规性,并构建了 Sand-Glass 基准测试。

  6. InfoQ 中文AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里巴巴孙鹏:用 BoRP「探测式评测」取代生成式 Judge,评测成本降低 97%|QCon 上海

    阿里巴巴高级技术专家孙鹏将在 QCon 上海 2026 分享 BoRP(Bootstrapped Regression Probing)评测范式,不再让模型写评语,而是直接读取 LLM 隐状态中的满意度信号,评测成本降低 97%,人类对齐度超过传统生成式 Judge。该方案在 8B 模型上对齐 GPT-4 级评测精度,成本约为其 3%,已在万亿级流量的 A/B 测试中落地。

  7. meng shao(@shao__meng)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LLM 推理性能框架:Prefill 拼算力,Decode 拼带宽

    这篇内容介绍 LLM 推理性能的核心框架:一次推理由 Prefill 和 Decode 两个阶段组成,Prefill 并行读入整个 prompt 并写入 KV 缓存、产出第一个 token,瓶颈在算力;Decode 自回归逐 token 生成、每次都要读权重和全部历史 KV,瓶颈在内存带宽。

  8. Latent Space [Youtube]AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AINews:TypeSafe/Jev 上线三周 ARR 超 1 亿美元、估值 75 亿美元

    AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。

  9. 爱范儿AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    技嘉为 B760/H610 主板更新 BIOS 支持新 LGA1700 处理器,AI 热潮推高内存成本、PC 出货量同比降 20.1%

    技嘉 10 月 9 日宣布,全部 B760 和 H610 主板将通过 BIOS 更新支持预计 2027 年初推出的新款英特尔 LGA1700 处理器,其中包含 DDR4 主板。

  10. 硬氪AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    理想AI眼镜操盘手王紫崴创业儿童AI硬件,物外智趣获数千万元天使轮

    儿童AI硬件公司「物外智趣」近日完成数千万元人民币天使轮融资,投资方包括柏睿资本、天使投资人高秉强教授及高锋耐心资本。公司成立于2026年2月,核心成员均来自理想汽车,创始人王紫崴曾操盘理想同学AI产品与理想眼镜,后者2025年12月上市首销3万台48小时售罄。首款产品定位3-8岁儿童的「随身早教专家」,采用轻便可穿戴形态与主动式多模态Agent架构。

  11. 硅星人ProAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对话Mercor:我们仅为强大AI提供了所需的1%数据,半年后模型会再有一次大跨越

    Mercor VP Chirag Mahapatra 在 Assembling 2026 上表示,前沿实验室在科学、材料科学、生物等复杂领域只收集到构建极高质量模型所需数据的 1% 到 2%,物理世界数据同样如此,整体可能只到 2% 到 5%。

  12. 创业邦AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宁德时代加码DeepSeek新一轮融资,算电协同布局累计投入超105亿元

    据媒体报道,DeepSeek正进行最新一轮融资,规模至少800亿元,宁德时代和腾讯是领投方之一,具体出资额未披露;今年6月DeepSeek曾官宣约510亿元首轮融资,宁德时代体系出资约50亿元。

  13. 创业邦AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公开 722 篇数学手稿,声称证明三维挂谷极大函数与四维挂谷猜想

    OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。

  14. 创业邦AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克独立建设运营 Terafab 芯片工厂,黄仁勋女婿 Nico Caprez 升任英伟达全球 AI 基础设施增长副总裁丨智能制造日报

    马斯克表示旗下公司将独立建设并运营得克萨斯州 Terafab 芯片工厂,台积电仅可能租用部分厂区,不参与运营,英特尔 CEO 陈立武称将继续与马斯克合作推进该项目。

  15. myFT followingAI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    “机器人健身房”:为真实世界训练机器的物理 AI 数据采集

    物理 AI 开发者正把摄像头装进家庭、办公室和工厂,为机器人补上训练数据的缺口。现有机器人训练素材不足,真实场景采集成为填补这一空白的手段。

  16. AI Will(@FinanceYF5)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公开数学成果论文:722 篇手稿覆盖 372 项结果

    OpenAI 正式公开此前“解决开放数学问题”声明背后的完整论文,包含 722 篇数学手稿、覆盖 372 项重要结果。该目录来自对内部模型约 4,000 个研究问题的测试,经归类和筛选形成,几乎所有结果采用同一套标准流程。每项成果平均消耗相当于 ChatGPT Pro 思考 3 小时的算力。

  17. AI Will(@FinanceYF5)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布其开放问题成果背后的完整论文:722 篇手稿涵盖 372 类数学结果

    OpenAI 发布了其开放问题主张背后的完整论文,包含 722 篇手稿,涵盖 372 类数学结果。该目录的构建方式是在测试阶段让内部模型处理约 4K 个研究问题,再对输出分组和筛选,得到 372 个重要结果族。这些结果几乎都来自同一标准设置,每项平均消耗相当于 3 小时 ChatGPT Pro 思考的算力。

  18. LangChain BlogAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布 LangSmith Fine-Tuning 与 smithtune CLI

    LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。

  19. Latent Space [Youtube]AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 谈:AlphaFold 为何没有解决蛋白质折叠问题

    Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在对话中指出,AlphaFold 的突破只是开始,蛋白质折叠远未解决,静态结构预测无法覆盖蛋白质动态与无序性。

  20. 爱范儿AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么 ChatGPT 总爱在标题里塞色情赌博小广告?

    ChatGPT 会话标题末尾偶发出现外语词或赌博色情小广告,作者结合抓包记录与 EMNLP 论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》推断,标题由轻量推理模型生成,常在该结束生成时收尾失败,继续按概率输出词元。

  21. AI Will(@FinanceYF5)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 训练数据是唯一"一奏效就失效"的产品:模型做对约 70% 任务后数据就被弃用

    AI 训练数据被视为唯一"一旦奏效就贬值"的产品:当模型在某项任务上正确率达到约 70%,实验室就会砍掉这项任务的数据需求。这个市场还造就了全球最年轻的白手起家亿万富翁。

  22. AI Will(@FinanceYF5)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LoRA 共同创作者 Edward Hu 加入 Mercor,其首个模型基于阿里 Qwen

    LoRA 共同创作者 Edward Hu 加入 Mercor 训练模型,其首个模型基于阿里 Qwen 构建。一项 2023 年研究发现,三分之一甚至更多的众包工作者用 AI 撰写「人类」答案。下一个数据来源可能是佩戴头部摄像头的工厂工人。

  23. AI Will(@FinanceYF5)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI 讨论:数据将成下一个万亿美元品类,2031 年独立玩家不足 10 家

    Epoch AI 讨论中三位嘉宾给出三种判断:EverettRandle 认为数据是下一个 1 万亿美元品类;viks_rum 预计到 2031 年规模化独立玩家不足 10 家;Satya Nadella 称企业为智能付费两次,应保留自有数据。最值钱的数据或许是你永远不卖的数据。

  24. Latent.Space(@latentspacepod)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么 AlphaFold 没能解决蛋白质折叠:生物学的苦涩教训、虚拟细胞与治愈所有疾病

    Google DeepMind 的 Pushmeet 与 Biohub 的 Sal Candido 解释,AlphaFold 的突破并未解决蛋白质动力学问题,仅靠扩展 AI 算力和数据不足以理解生物学。他们还讨论了蛋白质语言模型如何隐含结构、功能与进化知识,以及更好的生物数据和虚拟细胞如何推动药物发现提速 10–100x、最终治愈所有疾病。

  25. 投资融资AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 完成 5 亿美元 C 轮融资,红杉中国、腾讯、真格等联合投资,投后估值 40 亿美元

    Manus 完成 5 亿美元 C 轮融资,由红杉中国、IDG资本、真格基金、腾讯投资、博裕资本等联合投资,投后估值达 40 亿美元。Manus 为通用 AI Agent 研发商,旗下产品包括通用 AI 代理 manus、多 Agent 群聊应用 Cue 和 AI 助手 Monica。同一批融资中,三迭纪获强生独家战略投资,DiffuSpace 与厘清智能均完成数亿元人民币天使轮。

  26. 宝玉(@dotey)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布决策模型 Microsoft-Decision-1,基于 Qwen3.5-9B 后训练

    微软推出新模型 Microsoft-Decision-1,专做选择题式判断,不生成文章也不聊天,给定选项后快速判断该选哪个并给每个选项打概率分,已在 Microsoft Foundry 上线,之后会上 OpenRouter。

  27. Claude(@claudeai)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 推出 Dashboards,可用自然语言生成数据仪表盘

    Anthropic 推出 Claude Dashboards,用户可连接数据平台或 CRM 工具并用自然语言提问,Claude 负责编写查询并生成随数据变化自动更新的仪表盘,每张图表都会显示对应的查询。该功能在付费套餐中以 beta 形式提供。

  28. Interconnects AI — Nathan LambertAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert:AI 将迎快速进步,但不会走向通用超级智能

    Nathan Lambert 认为 AI 会迎来快速进步,但不会走向通用超级智能。他指出,模型将在几年内成为超人的分布式 GPU 工程师,并可自动化预训练架构与数据选择研究,主要来自推理算力扩展与推理成本近指数级下降,而非模型研究能力的质变。他预计这会引发智能体模型的杰文斯悖论,需求只增不减,并带来 RL 环境质量提升的空间。

  29. Satya Nadella(@satyanadella)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软发布 Decision-1 决策模型

    微软发布新模型 Microsoft-Decision-1,面向快速决策场景,在结构化决策任务上表现领先,在延迟和质量上优于 LLM 及其他决策模型。该模型已在微软内部多个场景测试,涵盖事件响应、质量控制和科学发现。

  30. 大模型智能AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 GPU Kernel Agent 最新进展:方法、基准与验证三者缺一不可

    GPT-5.5 在 KernelBench-Verified 修正后的整体几何平均加速比从 1.43× 降到 0.88×,原因是基线补上了 TF32 和隐藏输入分布。

  31. DatabricksAI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks 如何用受治理的数据共享解决国防供应链可见性问题

    国防供应链的每一层级都需要把受治理的数据共享给需要的人。Databricks 提出以受治理的数据共享打通国防供应链的可见性,让各层级在合规前提下获取所需数据。

  32. 创业邦AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    具身智能的数据竞赛,可能卷错了方向

    在2026(第二十届)DEMO CHINA现场,戴盟机器人王煜、灵御智能莫一林与OriginFlow秦深涛讨论具身智能落地路径。莫一林认为"模型"被高估、"身"被低估,灵御采用类自动驾驶L2的人机共驾模式,机器人已在超市做试吃,能以人的七八成效率完成七八成工作;秦深涛强调数据并非越多越好,关键是低成本获取多样高质量数据并跑通经济效率。

  33. Ed Zitron's Where's Your Ed AtAI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ed Zitron 的垃圾债指南:AI 数据中心如何被高收益债与杠杆贷款撑起

    2026 年上半年垃圾债发行量达 2290 亿美元,而投资级债券为 8059 亿美元,垃圾债市场已膨胀至投资级市场的 28.4%,较 2011 年上半年的 30 亿美元增长 75 倍。

  34. Google Cloud BlogAI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Alteryx Live Query 集成 Google Cloud BigQuery,用 AI 处理非结构化数据

    Alteryx One Live Query 与 Google Cloud BigQuery 集成,可在浏览器中以无代码方式构建数据管道,并通过安全 SQL 下推在 BigQuery 内直接执行转换逻辑。

  35. AING硬迹AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    星源智 Thor 全身控制模型助人形机器人创吉尼斯纪录,拉动 38.6 倍自重汽车

    星源智与智源研究院联合研发的 Thor 全身控制模型赋能人形机器人,以 37.15kg 自重拉动 1434kg 汽车行进 9.92 米,牵引重量约为自身 38.6 倍,创下吉尼斯世界纪录。

  36. a16z(@a16z)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前 Intel CEO Pat Gelsinger:能源产能就是经济产能,电网是 AI 扩张的天花板

    前 Intel CEO Pat Gelsinger 在 a16z 播客中称,美国整体能源产能停滞了约十五年,经济产能也随之停滞,即便近年国家能源产能年增约 4%。他认为能源产能会抑制 AI 热潮的乐观程度——"如果供不上电,为什么要建新数据中心、买百万块 GPU",并指出核能作为基荷值得扩建,而可再生能源对中国有深度依赖。

  37. LlamaIndex 🦙(@llama_index)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaParse 如何处理表格套表格:Micron 财报 PPT 解析演示

    LlamaIndex 展示 LlamaParse 处理嵌套表格的能力:即使表格中包含表格,输出依然干净。本周文档选用 Micron 最新财报 PPT,其中含两个业务单元且行名重复,LlamaParse 仍将全部 18 个数值归入正确表头下。用户可通过 llamaindex.ai/llamaparse 上传自己的财报测试。

10月9日周五
  1. 智东西AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 领跑 195 起 AI 并购,最大一笔 110 亿

    Crunchbase 数据显示,今年截至 9 月 29 日风投系 AI 公司对 AI 创企的收购已达 195 起,比 2025 年全年高出 14%。OpenAI 是过去三年最活跃的收购方,共完成 20 笔 AI 相关收购,其中 10 笔发生在今年;Anthropic、法律 AI 创企 Legora 各完成 5 起。

  2. 魔搭ModelScope社区AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 与空间生物学:如何从病理切片预测隐藏的分子信息?《AI4S 实战派》第十五期直播回顾

    西湖大学特聘研究员李昊阳在《AI4S 实战派》第十五期直播中讲解如何用 AI 从 H&E 病理切片预测空间转录组分子信息,梳理了判别式建模、扩散模型与流匹配等生成式方法,以及 UNI、GigaPath、CONCH、OmniCLIP 等病理基础模型和对齐工作。

  3. 字节跳动技术团队AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenViking 团队三篇论文拆解其上下文数据库核心技术

    OpenViking 团队围绕 Agent 的上下文管理发布三项研究:VikingMem(VLDB 收录)把记忆分为事件与实体两层并维护最新档案,在 LoCoMo 长期记忆评测上得 88.83。