跳到正文

#开源生态

今日 19 条
今天10月10日周六
  1. InfoQ 中文AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    模型开放之后,AI 能力为什么仍难以复用?

    AI 开源的价值正从"开放了什么"转向"开放的能力能否被验证、复用和持续迭代"。2026 年世界人工智能开源大赛(GOAI)覆盖 91 个国家和地区、吸引超 1.4 万名开发者,收到 2999 份有效初赛作品,70 个项目进入总决赛,多 Agent 协作与 Skill 调用成为工程考察重点。

  2. dbaplus社群AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    国产操作系统盘点:银河麒麟、统信UOS、openEuler、鸿蒙PC为何都在给Windows做嫁衣?

    国产操作系统已有银河麒麟、统信UOS、deepin、openEuler、龙蜥Anolis、鸿蒙PC等数十个发行版,但底层几乎都是Linux。

  3. 爱范儿AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    技嘉为 B760/H610 主板更新 BIOS 支持新 LGA1700 处理器,AI 热潮推高内存成本、PC 出货量同比降 20.1%

    技嘉 10 月 9 日宣布,全部 B760 和 H610 主板将通过 BIOS 更新支持预计 2027 年初推出的新款英特尔 LGA1700 处理器,其中包含 DDR4 主板。

  4. 宝玉(@dotey)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    REA 将逆向分析工具接入 Claude Code、Codex、Cursor 等智能体

    开源项目 REA(Reverse Engineer Anything)把逆向分析工具接到了 Claude Code、Codex、Cursor 这类 AI 编程智能体上。

  5. 创业邦AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 公开 722 篇数学手稿,声称证明三维挂谷极大函数与四维挂谷猜想

    OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。

  6. 向阳乔木(@vista8)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vibe Coding 免费开源字体清单:34 个中英文字体,可通过 JS 直接引用

    有人整理了 34 个适合 Vibe Coding 使用的中、英文字体,均为免费开源并已核查授权文件要求。这批字体支持通过 JS 直接引用,下载地址已在 GitHub 公开。

  7. AI Will(@FinanceYF5)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 快讯:OpenAI 数学论文超 700 篇、Mistral 推出 Le Chonk、GPT-6 Astra 可比较网站、Hark 发布主动型 AI 助手

    Mistral 推出 Le Chonk,加入西方开源模型竞赛;OpenAI 的数学成果持续爆发,已发布 700 多篇论文。GPT-6 Astra 现可帮用户直接比较不同网站,Brett Adcock 的 Hark 则推出主动型 AI 助手。

  8. LangChain BlogAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 发布 LangSmith Fine-Tuning 与 smithtune CLI

    LangChain 发布 LangSmith Fine-Tuning 和 smithtune,这是一个把 LangSmith 轨迹转成 Agent 专用微调模型的 CLI,覆盖数据集构建、基于 Fireworks 或 Baseten 的训练以及 LangSmith 评估。

  9. SuperTechFansAI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 收购 Deno 团队;Whistle 16.9 MB 语音模型;Oxide 4.45 亿美元 D 轮

    Cloudflare 收购 Deno 整个团队,Deno 运行时仅再维护一年,Deno Deploy 六个月后关闭,JSR 由 Cloudflare 承接。Cactus 发布 16.9 MB 的本地语音识别模型 Whistle,CPU 运行,支持七种语言并输出词级时间戳,每次最多处理 30 秒音频,暂不支持中文。

  10. 爱范儿AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果被曝削减 iPhone 18 Pro 订单,供应链称总量变化不大;小米 17 Ultra 全系涨价 1000 元、华为 nova 16 系列同日调价

    据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。

  11. Fireworks AI(@FireworksAI_HQ)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Armadin Security 如何在 Fireworks Forge 上后训练开源模型监控安全智能体

    Armadin Security 创始研究员 Yonatan Oren 分享了其团队如何在 Fireworks Forge 上后训练开源模型,用于监控生产环境中的安全智能体。相关分享将于 11 月 3 日在旧金山举行。

  12. 宝玉(@dotey)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    宝玉分享 baocut 开发方法论:技术方案、原型 UI、编码与验收全流程

    宝玉将文章中的开发方法论完整应用于开源项目 baocut,流程涵盖技术方案文档、原型与 UI 设计、编码实现和测试验收。他让 Agent 先做调研并撰写技术方案文档,反复沟通定稿后再产出接近正式 UI 的高保真原型,最后才实现代码。验收阶段 Agent 借助 Electron 的浏览器能力自行测试,多数活由 Agent 完成,人只负责定义问题和验收。

  13. 国际大厂AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 发布多模态决策模型 Clef-omni,Clef 提速、Clef-flash 降价

    Cloudflare 发布 Clef-omni,在文本和图像之外新增音频(wav/mp3)与视频(mp4/webm)输入,基于 Qwen3-Omni-30B-A3B-Instruct MoE 构建并已在 Hugging Face 开放权重,定价为每百万输入 token 0.15 美元。

  14. Simon Willison(@simonw)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    哪种开源权重 MoE 大模型最适合 60GB 内存内的编程任务?

    Simon Willison 征询适合编程、能在 60GB 内存以内运行的开源权重 MoE 大模型,认为 MoE 是其可用硬件上达到可交互速度的必要条件,目标是超过 12 tokens/秒。

  15. THE DECODERAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 推出免费开源项目 AI 漏洞扫描器 Cyber Mission

    Anthropic 启动长期项目 Cyber Mission,并推出免费的 OSS AI 扫描器,定期检查开源项目、自动标记并解释漏洞、给出补丁建议;其关键基础设施防御计划(CIDP)向电网。

  16. 掘金本周最热AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 年 9 月 GitHub 十大热门项目排行榜

    2026 年 9 月 GitHub 十大热门项目榜单从约 23 个候选中选出 ponytail、ECC、open-code-review、hindsight、WeKnora、cua 等十个项目,覆盖编码 Skill、Agent Harness、代码评审、Agent Memory、知识 RAG 与 Computer-Use 等方向。

  17. 创业邦AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DiffuSpace 完成数亿元融资,创扩散语言模型最大规模纪录

    深圳公司 DiffuSpace 连续完成两轮融资,总金额数亿元人民币,创下全球扩散语言模型(dLLM)最大规模融资纪录,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投。

  18. 宝玉(@dotey)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Deno 团队加入 Cloudflare,Deno 运行时一年后停更、Deno Deploy 半年后关停

    Deno 团队整体加入 Cloudflare。接下来一年 Deno 运行时每月发一个版本,只修 bug 和安全问题,一年后官方停止开发;托管平台 Deno Deploy 再运行六个月关闭。

  19. LangChain(@LangChainAI)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith Signals 月度数据:Claude Sonnet 5 模型采用率升至第 2,gpt 5.6 luna 调用量登顶

    LangSmith Signals 上月数据显示,Claude Sonnet 5 的模型采用率从第 9 升至第 2,使用它的组织增加了 51%;gpt 5.6 luna 的调用足迹从第 3 升至第 1,调用量增长 65%。两款开源权重模型首次进入采用率前十,但调用量未进前列,调用足迹仍由更小更快的模型主导。

10月9日周五
  1. 白鲸出海AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    专访 Seeed Studio 潘昊:Microduck 机器鸭爆火背后,硬件价值在硬件之外

    Hugging Face 旗下 Pollen Robotics 设计的机器鸭 Microduck 售价 399 美元,高峰期平均每 4 秒卖出一台,五天后预售破万台、销售额突破 500 万美元,由潘昊创办的深圳 Seeed Studio 矽递科技代工。

  2. InfoQAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 用 AI 辅助重写将 Copilot 运行时从 TypeScript 迁移到 Rust

    GitHub 将 GitHub Copilot CLI、Copilot 应用和 Copilot SDK 背后的运行时从 TypeScript 和 Node.js 迁移到 Rust,通过 AI 辅助重写替换了超过 80 万行生产代码。

  3. Qwen(@Alibaba_Qwen)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里发布 Qwen-Image-2.1-Turbo,8 步去噪即可生成和编辑图像

    阿里 Qwen 团队发布 Qwen-Image-2.1-Turbo,称只需 8 个去噪步骤即可生成和编辑图像,并已开放权重。该模型基于 Qwen-Image-2.1,是在同一 7B 视觉生成架构上的加速检查点,官方称仍能由文本生成 2K 图像,并支持通过自然语言编辑继续创作,例如添加配饰或更换场景。

  4. Viking(@vikingmute)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Deno 被 Cloudflare 收购,Runtime 维护一年后停止

    Deno 官方宣布加入 Cloudflare,作者转述称 Deno Runtime 在维护一年后将停止。作者认为 Cloudflare 正把 Astro、VoidZero 等整条 JS 链路收进自己平台,并感叹 AI 兴起后框架之争已淡出。

  5. 顺为资本AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扩散智能DiffuSpace连续完成两轮融资,总金额数亿元

    10月9日,扩散智能DiffuSpace宣布已连续完成两轮融资,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投,总金额达数亿元。DiffuSpace于2026年5月在深圳成立,团队研发的Dream 7B扩散语言模型部分能力可比肩DeepSeek V3(671B),目前正在训练新一代更大参数规模的模型并计划近期开源。

  6. 魔搭ModelScope社区AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AutoTrust AI Lab 开源多模态决策模型 JEV-27B-VL,Jev Decision Index 0.3 视觉榜单第一

    AutoTrust AI Lab 开源基于 Qwen3.8-27B 的多模态决策模型 JEV-27B-VL,融合 System 1 快速决策与 System 2 深度推理,可视为能“看见”的 JEV-27B。

  7. 字节跳动技术团队AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenViking 团队三篇论文拆解其上下文数据库核心技术

    OpenViking 团队围绕 Agent 的上下文管理发布三项研究:VikingMem(VLDB 收录)把记忆分为事件与实体两层并维护最新档案,在 LoCoMo 长期记忆评测上得 88.83。

  8. 袋鼠帝AI客栈AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vidu Q4 Preview 实测教程:0.09 元一秒,附两个导演 Skill

    袋鼠帝实测了 Vidu 上线的新一代视频旗舰模型首个预览版 Vidu Q4 Preview,并用它复刻《你的名字》真人版最后一幕、用五种情绪演绎同一句台词。据其介绍,该模型主打传神表现力,支持最多 3 段参考音频和 15 张参考图,可直出 720P、1080P、2K、4K,单次最长 16 秒,首发 0.09 元/秒起。

  9. AI科技评论AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    星动纪元 VPP2 登顶 RoboDojo,14B 参数无额外数据开源可复现

    星动纪元(清华唯一持股的具身公司)推出世界动作模型 VPP2(Video Prediction Policy 2),以平均成功率 32.26%、平均得分 39.26 登顶 RoboDojo 榜首,超过此前 GPT-6-Astra 的 22.48% 和 28.97%,并拿下 generalization、precision、memory 三项第一。

  10. 有机大橘子AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 之后:游戏、软件、硬件的门槛都在消失,一切终将开源?

    Opus 5.5 发布并被指代码能力再次飞跃,深度和广度已超越 99% 的程序员,完成同样任务所需生成的代码输出反而更少。有开发者用它直接反编译二进制、几十分钟做出可玩游戏 demo,也有人靠 AI 重写代码绕开 GPL 传染;Muse 为 ESP32 提供 Agent Ready 通用固件,模型推理成本最近一周大幅下降,Strata 可把推理速度提升数倍。

  11. DatawhaleAI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI公布722份由前沿模型产出的数学手稿

    OpenAI公布了一批由内部前沿模型产出的数学研究成果,包括722份数学手稿和372组相关成果,覆盖数论、代数几何、实分析、组合数学、理论计算机、数学物理、偏微分方程等多个方向。部分成果附有可由计算机核验的Lean形式化证明,社区初步核查发现其中涉及多个长期未解的开放问题,但具体结论仍需数学界进一步审阅与验证。OpenAI表示,AI正在从辅助解题走向参与真正的数学研究与发现。

  12. AINLPAI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软开源 Agent Lightning v1.0:把真实 Agent 接进强化学习

    微软开源 Agent Lightning v1.0,一套面向 AI Agent 的强化学习框架,让开发者保留现有工具调用、上下文管理和任务执行流程,用实际任务反馈训练底层模型。

  13. 阿里研究院AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    安筱鹏:AI如何重构全球汽车产业竞争格局

    阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。

  14. CSDNAI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    开发者用 Claude Opus 5.5 打造 7 款开源软件对标 Adobe 全家桶

    前 Square 工程师 Brandon Thomas 带四人团队借助 Claude Opus 5.5,用 Rust 开发了 ArtCraft 套件中的 7 款开源应用。

  15. Z PotentialsAI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元并推出企业版 Agent

    AI Agent 创企 Nous Research 完成 9000 万美元 B 轮融资,估值达 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 及 1789 Capital 参投,累计融资 1.58 亿美元。

  16. 歸藏的AI工具箱AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok Bot 生成 AI 早报视频的提示词与流程

    作者用一段提示词让 Grok Bot 每天早上 9 点整理前一天 AI 资讯,并试做出约 90 秒的中文讲解视频,采集、写代码和渲染全部跑在它的云端虚拟机上。

  17. Qdrant(@qdrant_engine)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangGraph 长期记忆接入 Qdrant:智能体跨会话记忆改用向量语义检索

    Qdrant 推出新的 memory store 集成,可作为 LangGraph 长期记忆的存储层,让 AI 智能体跨会话保存并召回信息。该集成把 Qdrant 的向量原生存储与语义搜索带入 LangGraph 记忆系统,智能体可按语义而非精确匹配检索相关记忆,用于存放用户偏好、过往交互等上下文。

  18. InfoQAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Valkey 两位创始开发者谈分叉 Redis 后的演进与缓存之外的未来

    Valkey 创始开发者 Madelyn Olson 与 Viktor Söderqvist 在 OSS EU 上介绍了项目进展:8.x 的异步 I/O 线程将单进程吞吐从约 20 万-25 万请求/秒提升到约 100 万,并加入键嵌入与双通道复制;9 版带来原子槽迁移、编号数据库和哈希字段过期。

  19. 国际大厂AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扩散语言模型公司 DiffuSpace 完成数亿人民币融资

    扩散语言模型公司 DiffuSpace 完成数亿人民币融资,由港大 NLP 实验室联合主管孔令鹏及其博士生龚珊三、叶佳成联合创立,2026 年 5 月落地深圳。其 Dream 7B 模型在数学、代码、规划任务上全面超越同规模自回归模型,部分指标超过 671B 的 DeepSeek V3,Hugging Face 下载量超 250 万。团队正推进新一代更大参数规模模型训练。

  20. 量子位AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    openJiuwen 发布并开源企业级 AgentOS

    由华为2012实验室、华为云等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,将多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并通过插件化架构连接上层应用与底层模型、算力资源。

  21. Harrison Chase(@hwchase17)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 评测中的 Jev 判官:轨迹标注不是单一通过/失败,而是多维打分

    LangSmith 评测中的 Jev 判官把轨迹标注拆成多个问题,难度和正确性各自得到带类型的答案,且在一次 pass 中、对每条 trace 完成。该框架认为轨迹标注需覆盖任务难度、方案正确性、设计选择多样性和思考方向等维度,规模化标注百万级 agent 及其子 agent 的 token 成本仍待大幅降低。