跳到正文

#数据/训练

今日 36 条
10月9日周五
  1. 腾讯技术工程AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯 OK 平台:AI 端到端研发如何跑通需求到部署

    腾讯技术工程发文介绍 OK 平台这一 AI 驱动的端到端研发平台,用户只提交需求描述,AI Agent 自动完成需求评审、仓库匹配、技术方案、编码、Code Review 和部署。

  2. AI Will(@FinanceYF5)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    State of AI 第九份年度报告发布:AI 构建更好的 AI、世界模型与物理 AI

    State of AI 第九份年度报告正式发布,涵盖 AI 构建更好的 AI、世界模型、物理 AI、地缘政治、网络防御以及 12 个月预测等议题。报告可在 stateof.ai 阅读,作者 Nathan Benaich 另提供了主编剪辑版视频。

  3. AI Will(@FinanceYF5)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    第 9 份年度《State of AI》报告发布:涵盖 AI 构建 AI、世界模型、Physical AI、地缘政治与网络防御

    第 9 份年度《State of AI》报告发布,涵盖 AI 如何构建更强的 AI、世界模型、Physical AI、地缘政治、网络防御,以及对未来 12 个月的预测。发布方为 AI Will(@FinanceYF5),具体发现以报告正文为准。

  4. 土猛的员外AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大型企业几十万份文档,究竟应该怎样交给AI?

    面对大型企业几十万份文档入库的需求,AIS 团队认为难点不在导入,而在知识源分散、版本冲突、权限与持续更新。其客户中文档最多的已突破 550 万份,AIS 通过 Connector 自动同步、检索前权限过滤,以及解析—清洗—结构化—切片—抽取—分类—打标签—校验的知识工程流程,并区分 MCP 的 readonly、write、admin 权限等级来管理知识供应链。

  5. DatawhaleAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌牵头 32 位作者 154 页综述:把大模型「Token」认字机制讲明白

    谷歌联合 20 多家研究机构、32 位作者发布 154 页综述,系统梳理大模型的分词(Token)机制,指出模型数不清 strawberry 里有几个 r、多位数算术出错,病根在文本进入模型前的分词环节。

  6. AINLPAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软开源 Agent Lightning v1.0:把真实 Agent 接进强化学习

    微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。

  7. 新智元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    墨尔本大学与新南威尔士大学提出多会话语音记忆基准VoxMem,专治音频大模型记不住「谁说的、怎么说」

    墨尔本大学与新南威尔士大学联合团队提出多会话语音记忆基准VoxMem,用「声学证据×记忆操作」二维分类覆盖15种考察组合,包含799道题、3,196个评测实例、34,743个语音会话(约177小时),每道题在8K到64K token历史长度下保持不变。

  8. Z PotentialsAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    深度|RSI 的早期产业形态,最可能出现在企业 Agent

    Pyromind 押注 RSI 产业化的早期形态出现在企业 Agent 上线后的持续学习,用 AutoRL 和 Reward Data Flywheel 把真实任务反馈转化为可训练、可评估的模型能力。

  9. 人人都是产品经理AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯拟发债335亿元:手握5000亿现金,为何还要借钱投AI?

    腾讯正考虑发行最高50亿美元(约335亿元)离岸债券,最快本月启动,此前6月已发债筹资近47亿美元。其二季度资本开支达528亿元、同比增长176%,自由现金流为负138亿元,AI预付款主要用于混元、WorkBuddy、CodeBuddy、微信AI及腾讯云的算力采购。

  10. InfoQAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Valkey 两位创始开发者谈分叉 Redis 后的演进与缓存之外的未来

    Valkey 创始开发者 Madelyn Olson 与 Viktor Söderqvist 在 OSS EU 上介绍了项目进展:8.x 的异步 I/O 线程将单进程吞吐从约 20 万-25 万请求/秒提升到约 100 万,并加入键嵌入与双通道复制;9 版带来原子槽迁移、编号数据库和哈希字段过期。

  11. 大淘宝技术AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    淘宝直播数字人互动 Harness-Aware Training 实践:让 Agent Model 随 Harness 一起进化

    淘宝直播提出 Harness-Aware Training(HAT),把动态执行环境 Harness 状态显式纳入训练分布,通过 HSA-SFT、General OPD、HSA-RL 三阶段训练,让模型读懂当前 Harness 而非背下某一版配置。

  12. 国际大厂AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 回应爆火的「About You」画像:不使用外部数据,附编辑方法

    Amazon 表示其意外走红的「About You」用户画像页面并未使用外部数据,仅基于用户在本平台的购物与浏览行为生成。这些页面因对顾客的调侃式描述而病毒式传播,Amazon 同时给出了用户自行编辑或关闭该画像的方法。

  13. 国际大厂AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    英伟达 Physis-Lang:让自然语言成为世界模型的物理表征,增强视频物理真实性

    英伟达联合 MIT 和牛津大学提出 Physis-Lang,把物理原因、规律和结果写进语言描述,并贯穿数据筛选、训练与视频生成。其 Cosmos3-Super 和 Cosmos3-Nano 版本在 Physics-IQ Verified 榜单上分别以 48.2 和 43.3 分按平均分位列第一、第二,Super 较此前最高分提升 5.5 个百分点。

  14. 国际大厂AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扩散语言模型公司 DiffuSpace 完成数亿人民币融资

    扩散语言模型公司 DiffuSpace 完成数亿人民币融资,由港大 NLP 实验室联合主管孔令鹏及其博士生龚珊三、叶佳成联合创立,2026 年 5 月落地深圳。其 Dream 7B 模型在数学、代码、规划任务上全面超越同规模自回归模型,部分指标超过 671B 的 DeepSeek V3,Hugging Face 下载量超 250 万。团队正推进新一代更大参数规模模型训练。

  15. AI Will(@FinanceYF5)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Deedy:至少三家数据公司可能已达成 10 亿美元年化收入

    Deedy 称有三人分别确信"最快达成 10 亿美元年化收入"的是三家不同公司,很可能不止一家数据公司近期触及该门槛,其中不少在 Pavlov's List 上。他还预计未来 6 个月内会有更多公司达到这一水平,数据总支出已超 150 亿美元。

  16. AI Will(@FinanceYF5)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Deedy 称最快达到 10 亿美元年化收入的 AI 数据公司可能不止一家

    三位不同的人分别告诉 Deedy,他们 100% 确定"最快达到 10 亿美元年化收入"的纪录属于三家不同的 AI 数据公司,很可能已有多家近期突破这一门槛,其中不少出现在 Pavlov's List 上。Deedy 预计未来 6 个月还会有更多公司加入,该市场总支出已超过 150 亿美元。

  17. 极客公园AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    鲲为科技完成 4 亿元新融资,要做脑科学 AGI 的「英伟达」

    深圳鲲为科技完成 4 亿元新一轮融资,新增股东 XVC、红杉中国,老股东夏尔巴、腾讯加仓。鲲为通过将深度神经网络引入低频超声回波信号处理,实现穿透颅骨后毫秒级实时捕捉脑组织结构与血流动态。公司已实现数千万订单,并推出基础软件平台 kOS,目标客户为脑机接口 Lab 与 NeuroAI 模型公司。

  18. AI Will(@FinanceYF5)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大型科技公司每位工程经理对应多少名工程师?基于 Levels.fyi 数据的统计

    有人基于 Levels.fyi 的提交数据,统计了大型科技公司中每位工程经理大约对应的工程师数量,AI 实验室则单独发布报告。该统计只是代理指标,更适合观察方向,不能视为精确的组织数据。

  19. a16z(@a16z)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    德州冻结新建数据中心许可:并网排队量18个月从63 GW飙至474 GW

    德州已冻结新建数据中心许可,其并网排队量18个月内从63 GW升至474 GW,超过历史峰值需求的5倍。其中仅9.5 GW获批、约4.3 GW实际运行,其余多为重复申请、投机性申请和从未接入过GPU的开发商提交。a16z的@rmcentush分析了电网为何无法按这么多"可能"来建设。

  20. a16z(@a16z)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 投资 Preference Model:开源 RL 环境框架 Karotte

    a16z 宣布投资 Preference Model,该团队专注为头部实验室构建 AI 研究与 ML 工程方向的 RL 环境。本周他们开源了生产环境框架 Karotte,经超一百万次评估运行和红队测试打磨。团队重点在于让环境随模型变强而更难被攻破:定位模型弱点的工具、针对缺口生成新任务,并让智能体主动攻击测试环境。

  21. Yann LeCun(@ylecun)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 回忆 1986 年首次赴美参会:在 MIT 展示多层网络海报,并与 Marvin Minsky 初次见面

    Yann LeCun 回忆 1986 年 6 月首次在美国参会并首次到访 MIT,展示了一张关于多层网络的海报。他在 Thinking Machines Inc 主办的招待会上首次见到 Marvin Minsky,对方惊讶于神经网络可被训练来计算两个二进制数的乘积。

  22. elvis(@omarsar0)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 论文提出 VERA:将基准轨迹转为 9000 多个可重启沙箱并协同演进模型与 harness

    NVIDIA 发布论文 VERA,把基准轨迹转成 9000 多个可重启沙箱并附带 rubric 评分,只保留能运行且可依据可观察证据评分的环境。系统同时更新模型权重和 harness,harness 改动需通过自测并在开发集上至少提升 5 分才保留,模型 checkpoint 若得分下降超过 20% 则被拒绝。

  23. elvis(@omarsar0)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Voice Arena 的 Monsoon 语料:孟加拉语微调让 Whisper Medium 的 WER 从 85.27% 降至 7.65%

    Voice Arena 发布 Monsoon ASR 语料库七天内,已有 80 多家机构申请授权。在孟加拉语 FLEURS 上,用 Monsoon 微调 Whisper Medium 将词错率从 85.27% 降至 7.65%。Monsoon 覆盖 50 种语言共 10 万小时,多为长尾语言,计划 2 月扩展到 100 种语言、2027 年底达到 1000 种,并开放模型 API 供实验室自测。

  24. 小互(@imxiaohu)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude 发布实时数据看板 Dashboards 与代码驱动动态解说工具 Claude Motion

    Claude 发布实时数据看板 Claude Dashboards 和代码驱动动态解说工具 Claude Motion。Dashboards 直接接入企业数仓或 CRM,用自然语言提问即可生成联动业务看板,并随底层数据变动自动刷新;Motion 能把报告、图表或产品演示转成短动画并导出 MP4,由 Claude 用代码为文字、图表、形状和图片编排动画,可编辑具体文字、数字与节奏。

  25. 美团技术团队AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团开源 LoHoSearch 搜索智能体评测基准,用知识图谱让机器自动出题

    美团 LongCat 团队开源 LoHoSearch,一个基于覆盖 762 万维基百科实体知识图谱自动生成题目的搜索智能体评测基准,含 544 道经人工核验题目、覆盖 11 个领域。

  26. 国际大厂AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Novix 如何用协同进化式 RSI 跑通规模化闭环

    华人团队 Novix 将自我改进机制嵌入真实前沿算法与工程任务,提出 Co-Evolutionary RSI(协同进化式 RSI),成立半年已服务 20 万名专家、覆盖 40 多个国家和地区。

  27. 国际大厂AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TouchScale 发布 500 小时人类视觉-触觉数据集,机器人真机成功率翻番

    德州农工大学、Google DeepMind、CMU 等 15 家机构联合发布 TouchScale,一个在统一传感器与采集流程下构建的 500 小时人类双手视觉-触觉数据集。

  28. 美团技术团队AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团搜索3.0:LLM 语义表征在排序模型的三期探索与应用

    美团搜索团队披露 LLM 语义表征在服务零售排序场景的三期实践,累计完成 3 个 Launch Review 并全量上线,一期将 Query 与 POI 的语义向量 cosine 相似度分桶注入精排,带来大盘搜索支付订单 +0.20%、服务零售订单 +0.27%、长尾 NDCG@5 +2.21pp。

  29. 美团技术团队AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团 GeoRA:为 RLVR 设计的 LoRA,获 ACL 2026 杰出论文

    美团履约技术团队与北京大学提出 GeoRA,一种为 RLVR 显式对齐更新几何的低秩适配方法,已被 ACL 2026 接收为杰出论文(全球 18 篇入选)。

  30. 美团技术团队AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团 MTFM:统一推荐基座大模型在外卖多业务场景的落地实践

    美团在 MTGR 基础上提出统一推荐基座大模型 MTFM,首次实现外卖多个主要业务的统一精排模型,相关成果已被 KDD 2026 收录。MTFM 以异构 Tokenizer 与动态掩码实现多场景特征免对齐,通过混合注意力与 Target Scale-Up 提升 Scaling 能力,单样本计算量达 192 GFLOPs。美团外卖多业务订单量提升 2.06%~6.68%,在线推理成本降低 24%。

  31. 宝玉(@dotey)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    特朗普向黄仁勋、马斯克、苏姿丰等六位科技领袖颁发美国国家奖章

    特朗普 10 月 8 日在白宫颁发两项美国国家奖章:Google 联合创始人 Sergey Brin、英伟达 CEO 黄仁勋、马斯克、AMD CEO 苏姿丰获国家科学奖章,戴尔创始人 Michael Dell 与微软 CEO Satya Nadella 获国家技术与创新奖章。

  32. 创业邦AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    博通计划为OpenAI定制芯片项目融资逾500亿美元;三星手机四季度最高减产30%丨智能制造日报

    博通正为其与OpenAI合作的定制AI芯片项目安排逾500亿美元融资,阿波罗全球管理与黑石集团是洽谈参与的贷款机构之一,甲骨文也在与阿波罗、高盛商谈为购买芯片筹资。另有消息称三星电子移动体验事业部已开始削减第四季度产量,减产幅度最高达30%,外界认为与假日季内存芯片价格上涨、营业利润率承压有关。

  33. 创业邦AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    恒瀚微完成近亿元天使轮融资,400G RDMA智能网卡已获正式订单

    成都恒瀚微电子2026年8月完成近亿元天使轮融资,投资方为北京国泰、成都科创投、成都高新创投和中信聚信投资,资金用于产品迭代、人才引进和市场拓展。其首款400G RDMA智能网卡已完成送样验证并拿到正式订单,自研RDMA架构结合credit-based主动拥塞管理,部分测试场景动态时延为英伟达同类产品(CX-7)的1/2至1/3。

  34. Hunyuan(@TXhunyuan)AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元联合复旦、清华发布 ExplorationBench:评测 AI 系统的探索能力

    腾讯混元联合复旦、清华推出 ExplorationBench,用于衡量 AI 系统如何探索未知规则,包含 31 处隐藏规则改动、70 项任务的 AlienCode 与 24 条补丁推理规则、70 条定理的 AlienLogic 两个可验证沙盒。

  35. elvis(@omarsar0)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HERMES harness 将 GPT-5.6 Sol 仓库迁移成功率从 6.5% 提升至 31.0%

    论文发现,在整仓库迁移任务上,同一模型和相同 effort 设置下把 Codex 换成 HERMES harness 后,GPT-5.6 Sol 的成功率从 6.5% 升到 31.0%,收益来自 harness 本身。

  36. AK(@_akhaliq)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    面向世界动作模型的视频原生动作先验学习论文发布

    一篇题为 Native Action-Prior Learning from Videos for World Action Models 的论文发布,提出从视频中直接学习动作先验,用于世界动作模型。论文页面可在 huggingface.co 查看。

  37. DatabricksAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks 在 Unity Catalog 中发布 Workday Data Connect 联邦连接器 Beta

    Databricks 宣布 Unity Catalog 的 Workday Data Connect 联邦连接器进入公开 Beta,用户可直接在 Unity Catalog 中联邦查询 Workday 数据,无需先搬运数据。

  38. AK(@_akhaliq)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    PAMI:面向文本到人-物交互生成的部分锚定运动方法

    论文提出 PAMI(Part Anchored Motion),用于文本到人-物交互(Human-Object Interaction)生成,论文页面已发布在 Hugging Face Papers(编号 2609.38…)。

  39. SuperTechFansAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hacker News 日报:Anthropic 发布 Claude Haiku 5.5,OpenAI 扩大 GPT-6 覆盖

    Anthropic 发布 Claude Haiku 5.5,10 万 token 以内输入输出价为每百万 token 0.10/0.50 美元,超过则升至 0.50/2.50 美元,Max 与 Team 用户新增 API 额度;同日 Sonnet 5.5 缓存读取价降至每百万 token 0.10 美元。

  40. DatabricksAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lakebase 与 Agentic SDLC:为编码智能体打造可分支数据库

    Databricks 发文介绍 Lakebase 与 Agentic SDLC,提出用数据库分支支撑编码智能体工作流。其思路是让编码智能体像操作代码分支一样对数据库进行分支,从而在开发流程中隔离和并行推进变更。