把几十万份企业文档塞进知识库,为什么“导进去”只是最容易的一步
帮上海一家大型国企把几十万份文档导入知识库时发现,真正的难点在导入之后:资料散落在OA、ERP、企业微信和NAS,同一制度存在三个版本,扫描PDF、数百页长文与带合并单元格的Excel混在一起,解析出错或机械切断就会让模型对着碎片胡猜。AI精准召回一份过期差旅标准比找不到更危险,Agent时代还可能越权拼出薪酬信息或直接写回知识库。企业需要的是持续供应可信知识的流水线,而非更大的知识库。
帮上海一家大型国企把几十万份文档导入知识库时发现,真正的难点在导入之后:资料散落在OA、ERP、企业微信和NAS,同一制度存在三个版本,扫描PDF、数百页长文与带合并单元格的Excel混在一起,解析出错或机械切断就会让模型对着碎片胡猜。AI精准召回一份过期差旅标准比找不到更危险,Agent时代还可能越权拼出薪酬信息或直接写回知识库。企业需要的是持续供应可信知识的流水线,而非更大的知识库。
字节跳动 Seed 团队联合普林斯顿大学、斯坦福大学和加州大学伯克利分校,系统测试 DeepSeek-V4 与 V4.1 后发表论文,揭示其分块 KV 缓存压缩带来的相位敏感性缺陷。
Jev 开发商 TypeSafe AI 完成 8.7 亿美元融资,由 Andreessen Horowitz 领投,Sequoia 和现有投资方 DCVC 参投,公司现估值 75 亿美元。
34 岁的 UCSD 正教授商静波认为,如果 AGI 指在广泛任务上达到普通人水平,那它某种意义上已经实现,真正未到来的是能在重要领域持续超越最优秀人类的超级智能。
哔哩哔哩 Index LLM 团队提出 HOMURA 强化学习框架,通过 KL 正则化目标与动态音节比例奖励,在音节级长度约束下优化翻译的语义保留与时间合规性,并构建了 Sand-Glass 基准测试。
阿里巴巴高级技术专家孙鹏将在 QCon 上海 2026 分享 BoRP(Bootstrapped Regression Probing)评测范式,不再让模型写评语,而是直接读取 LLM 隐状态中的满意度信号,评测成本降低 97%,人类对齐度超过传统生成式 Judge。该方案在 8B 模型上对齐 GPT-4 级评测精度,成本约为其 3%,已在万亿级流量的 A/B 测试中落地。
这篇内容介绍 LLM 推理性能的核心框架:一次推理由 Prefill 和 Decode 两个阶段组成,Prefill 并行读入整个 prompt 并写入 KV 缓存、产出第一个 token,瓶颈在算力;Decode 自回归逐 token 生成、每次都要读权重和全部历史 KV,瓶颈在内存带宽。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。
技嘉 10 月 9 日宣布,全部 B760 和 H610 主板将通过 BIOS 更新支持预计 2027 年初推出的新款英特尔 LGA1700 处理器,其中包含 DDR4 主板。
儿童AI硬件公司「物外智趣」近日完成数千万元人民币天使轮融资,投资方包括柏睿资本、天使投资人高秉强教授及高锋耐心资本。公司成立于2026年2月,核心成员均来自理想汽车,创始人王紫崴曾操盘理想同学AI产品与理想眼镜,后者2025年12月上市首销3万台48小时售罄。首款产品定位3-8岁儿童的「随身早教专家」,采用轻便可穿戴形态与主动式多模态Agent架构。
Mercor VP Chirag Mahapatra 在 Assembling 2026 上表示,前沿实验室在科学、材料科学、生物等复杂领域只收集到构建极高质量模型所需数据的 1% 到 2%,物理世界数据同样如此,整体可能只到 2% 到 5%。
据媒体报道,DeepSeek正进行最新一轮融资,规模至少800亿元,宁德时代和腾讯是领投方之一,具体出资额未披露;今年6月DeepSeek曾官宣约510亿元首轮融资,宁德时代体系出资约50亿元。
OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。
马斯克表示旗下公司将独立建设并运营得克萨斯州 Terafab 芯片工厂,台积电仅可能租用部分厂区,不参与运营,英特尔 CEO 陈立武称将继续与马斯克合作推进该项目。
物理 AI 开发者正把摄像头装进家庭、办公室和工厂,为机器人补上训练数据的缺口。现有机器人训练素材不足,真实场景采集成为填补这一空白的手段。
OpenAI 正式公开此前“解决开放数学问题”声明背后的完整论文,包含 722 篇数学手稿、覆盖 372 项重要结果。该目录来自对内部模型约 4,000 个研究问题的测试,经归类和筛选形成,几乎所有结果采用同一套标准流程。每项成果平均消耗相当于 ChatGPT Pro 思考 3 小时的算力。
OpenAI 发布了其开放问题主张背后的完整论文,包含 722 篇手稿,涵盖 372 类数学结果。该目录的构建方式是在测试阶段让内部模型处理约 4K 个研究问题,再对输出分组和筛选,得到 372 个重要结果族。这些结果几乎都来自同一标准设置,每项平均消耗相当于 3 小时 ChatGPT Pro 思考的算力。
LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在对话中指出,AlphaFold 的突破只是开始,蛋白质折叠远未解决,静态结构预测无法覆盖蛋白质动态与无序性。
ChatGPT 会话标题末尾偶发出现外语词或赌博色情小广告,作者结合抓包记录与 EMNLP 论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》推断,标题由轻量推理模型生成,常在该结束生成时收尾失败,继续按概率输出词元。
AI 训练数据被视为唯一"一旦奏效就贬值"的产品:当模型在某项任务上正确率达到约 70%,实验室就会砍掉这项任务的数据需求。这个市场还造就了全球最年轻的白手起家亿万富翁。
LoRA 共同创作者 Edward Hu 加入 Mercor 训练模型,其首个模型基于阿里 Qwen 构建。一项 2023 年研究发现,三分之一甚至更多的众包工作者用 AI 撰写「人类」答案。下一个数据来源可能是佩戴头部摄像头的工厂工人。
Epoch AI 讨论中三位嘉宾给出三种判断:EverettRandle 认为数据是下一个 1 万亿美元品类;viks_rum 预计到 2031 年规模化独立玩家不足 10 家;Satya Nadella 称企业为智能付费两次,应保留自有数据。最值钱的数据或许是你永远不卖的数据。
Google DeepMind 的 Pushmeet 与 Biohub 的 Sal Candido 解释,AlphaFold 的突破并未解决蛋白质动力学问题,仅靠扩展 AI 算力和数据不足以理解生物学。他们还讨论了蛋白质语言模型如何隐含结构、功能与进化知识,以及更好的生物数据和虚拟细胞如何推动药物发现提速 10–100x、最终治愈所有疾病。
Manus 完成 5 亿美元 C 轮融资,由红杉中国、IDG资本、真格基金、腾讯投资、博裕资本等联合投资,投后估值达 40 亿美元。Manus 为通用 AI Agent 研发商,旗下产品包括通用 AI 代理 manus、多 Agent 群聊应用 Cue 和 AI 助手 Monica。同一批融资中,三迭纪获强生独家战略投资,DiffuSpace 与厘清智能均完成数亿元人民币天使轮。
微软推出新模型 Microsoft-Decision-1,专做选择题式判断,不生成文章也不聊天,给定选项后快速判断该选哪个并给每个选项打概率分,已在 Microsoft Foundry 上线,之后会上 OpenRouter。
Anthropic 推出 Claude Dashboards,用户可连接数据平台或 CRM 工具并用自然语言提问,Claude 负责编写查询并生成随数据变化自动更新的仪表盘,每张图表都会显示对应的查询。该功能在付费套餐中以 beta 形式提供。
Nathan Lambert 认为 AI 会迎来快速进步,但不会走向通用超级智能。他指出,模型将在几年内成为超人的分布式 GPU 工程师,并可自动化预训练架构与数据选择研究,主要来自推理算力扩展与推理成本近指数级下降,而非模型研究能力的质变。他预计这会引发智能体模型的杰文斯悖论,需求只增不减,并带来 RL 环境质量提升的空间。
微软发布新模型 Microsoft-Decision-1,面向快速决策场景,在结构化决策任务上表现领先,在延迟和质量上优于 LLM 及其他决策模型。该模型已在微软内部多个场景测试,涵盖事件响应、质量控制和科学发现。
GPT-5.5 在 KernelBench-Verified 修正后的整体几何平均加速比从 1.43× 降到 0.88×,原因是基线补上了 TF32 和隐藏输入分布。
国防供应链的每一层级都需要把受治理的数据共享给需要的人。Databricks 提出以受治理的数据共享打通国防供应链的可见性,让各层级在合规前提下获取所需数据。
在2026(第二十届)DEMO CHINA现场,戴盟机器人王煜、灵御智能莫一林与OriginFlow秦深涛讨论具身智能落地路径。莫一林认为"模型"被高估、"身"被低估,灵御采用类自动驾驶L2的人机共驾模式,机器人已在超市做试吃,能以人的七八成效率完成七八成工作;秦深涛强调数据并非越多越好,关键是低成本获取多样高质量数据并跑通经济效率。
2026 年上半年垃圾债发行量达 2290 亿美元,而投资级债券为 8059 亿美元,垃圾债市场已膨胀至投资级市场的 28.4%,较 2011 年上半年的 30 亿美元增长 75 倍。
Alteryx One Live Query 与 Google Cloud BigQuery 集成,可在浏览器中以无代码方式构建数据管道,并通过安全 SQL 下推在 BigQuery 内直接执行转换逻辑。
星源智与智源研究院联合研发的 Thor 全身控制模型赋能人形机器人,以 37.15kg 自重拉动 1434kg 汽车行进 9.92 米,牵引重量约为自身 38.6 倍,创下吉尼斯世界纪录。
前 Intel CEO Pat Gelsinger 在 a16z 播客中称,美国整体能源产能停滞了约十五年,经济产能也随之停滞,即便近年国家能源产能年增约 4%。他认为能源产能会抑制 AI 热潮的乐观程度——"如果供不上电,为什么要建新数据中心、买百万块 GPU",并指出核能作为基荷值得扩建,而可再生能源对中国有深度依赖。
LlamaIndex 展示 LlamaParse 处理嵌套表格的能力:即使表格中包含表格,输出依然干净。本周文档选用 Micron 最新财报 PPT,其中含两个业务单元且行名重复,LlamaParse 仍将全部 18 个数值归入正确表头下。用户可通过 llamaindex.ai/llamaparse 上传自己的财报测试。
Crunchbase 数据显示,今年截至 9 月 29 日风投系 AI 公司对 AI 创企的收购已达 195 起,比 2025 年全年高出 14%。OpenAI 是过去三年最活跃的收购方,共完成 20 笔 AI 相关收购,其中 10 笔发生在今年;Anthropic、法律 AI 创企 Legora 各完成 5 起。
西湖大学特聘研究员李昊阳在《AI4S 实战派》第十五期直播中讲解如何用 AI 从 H&E 病理切片预测空间转录组分子信息,梳理了判别式建模、扩散模型与流匹配等生成式方法,以及 UNI、GigaPath、CONCH、OmniCLIP 等病理基础模型和对齐工作。
OpenViking 团队围绕 Agent 的上下文管理发布三项研究:VikingMem(VLDB 收录)把记忆分为事件与实体两层并维护最新档案,在 LoCoMo 长期记忆评测上得 88.83。