跳到正文

#RAG

今日 6 条
8月26日周三
  1. LangChain BlogAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 谈 Wiki Memory:用文件为 AI 智能体构建记忆层

    LangChain 提出 Wiki Memory 模式,即用智能体把日志、笔记、代码、文档等原始数据压缩成持久、结构化、可检查的文件知识层,供后续智能体直接读取。它与 RAG 的区别在于预计算并维护高阶综合结果,而非查询时检索原始分块。DeepWiki、Karpathy 的 LLM Wiki 与 Factory AutoWiki 是该模式的实例,适合持久领域知识而非短期对话状态。

  2. LangChain BlogAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Perplexity 和 LangGraph 构建可审计的 VC 研究智能体

    基于 Perplexity Agent API 与 LangGraph 构建的投资备忘录智能体,约 90 秒、约 0.40 美元 API 成本即可生成含七大板块的初稿,每条引用均可回溯到原始信源。

  3. LangChain BlogAI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 开源自动评估器:免费托管应用与 API 开放使用

    LangChain 开源了用于评估 LLM 问答链的自动评估器,并发布免费托管的开源应用与 API 以扩大可用性。该工具结合 Anthropic 的模型生成评估集与 OpenAI 的模型评分评估思路,自动为输入文档生成 QA 测试集并对指定 QA 链自动打分;测试显示 TF-IDF 与 SVM 检索在该场景下略优于 k-NN,且评分结果随打分提示词变化(如 OpenAI 评分最严格)。

  4. LangChain BlogAI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 解读 OpenAI 的 RAG 实战策略:哪些方法有效,如何自己实现

    LangChain 梳理了 OpenAI 在 demo day 上分享的客户 RAG 实验,把各项方法按 RAG stack 归类并给出对应的 LangChain 实现方式。

  5. 得物技术AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    得物技术 MultiAgent 记忆系统:短期上下文与四层记忆架构实现

    得物技术披露其 MultiAgent 平台的记忆模块实现,采用 Working、Session、User、Agent 四层记忆模型,短期记忆以 MySQL 持久化、Redis 作热点缓存并做 Token 窗口裁剪,会话结束后异步沉淀到长期层。

  6. 前端充电宝AI 评估 · 3/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    曾经的王,Vue3倒下了。。。

    前端岗位需求因 AI 技术快速发展断崖式下跌,63% 的企业正转型做 AI 产品,"AI+前端"复合能力成为招聘刚需,要求掌握微调、Agent、RAG 三项技术。字节、腾讯资深项目负责人称正大量招聘有 AI 项目能力的前端,面试优先且涨薪 40-60%。陈旸推出「转型AI前端开发实战营」2 节直播课,0 元报名,限 100 人。

8月25日周二
  1. Milvus(@milvusio)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 开源 DeepSeek Harness 插件,DSH 智能体可直连 Milvus 查询

    Milvus 开源了 DeepSeek Harness(DSH)插件,DSH 已获 192K+ GitHub stars。安装插件并连接 Milvus 或 Zilliz Cloud 后,DSH 智能体可列出 collection、查看 schema,并执行标量查询、语义搜索、BM25 搜索和混合搜索。

  2. mem0(@mem0ai)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    hermes 记忆配置选 mem0:MEMORY.md 与 USER.md 默认继续运行

    hermes 的记忆配置推荐选 mem0,内置的 MEMORY.md 和 USER.md 默认继续与其并行运行。mem0 提供三种模式:Mem0 Cloud、通过 Docker 自托管服务器,以及用自有 LLM、embedder 和向量库的完全开源进程内方案。

  3. Weaviate • vector database(@weaviate_io)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Weaviate 与 Gemini Embedding 2 实现原生多模态 RAG,文本图像音频视频共享向量空间

    Weaviate 联合 Google DeepMind 的 Gemini Embedding 2 推出原生多模态 RAG,文本、图像、音频、视频可嵌入同一共享向量空间,一次查询即可检索 PDF 页面、音频片段或视频中的对应片段,跳过了转录、OCR、字幕等文本转换步骤。

  4. Weaviate • vector database(@weaviate_io)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Weaviate 发布 Audio RAG、Video RAG 与多模态 PDF RAG Notebooks

    Weaviate 发布三份 Notebooks,分别演示 Audio RAG、Video RAG 和多模态 PDF RAG,代码托管在 weaviate/recipes 仓库。三条链接均指向 GitHub 对应示例,覆盖音频、视频与多模态 PDF 三类检索增强生成场景。

  5. QdrantAI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant GPU 加速 HNSW 索引教程:集群搭建与性能实测

    Qdrant 自 v1.13 起在自托管实例支持 GPU 加速 HNSW 索引,Qdrant Cloud 也在今年 4 月将其作为托管选项上线。GPU 擅长大规模并行处理,能同时写入大量 HNSW 图的节点与边,从而缓解切换嵌入模型时全量重建索引的耗时与成本。

  6. Stack Overflow BlogAI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LinkedIn 如何为智能体个性化构建认知记忆智能体

    LinkedIn 为招聘智能体打造认知记忆智能体,提供深度个性化。其记忆分四层,含会话记忆与跨会话聚合的语义记忆,并已从 GraphRAG 转向树状结构记忆,以实现更快的增量更新,同时兼顾检索新鲜度、延迟预算与访问控制。

8月24日周一
  1. Qdrant(@qdrant_engine)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何将 RAG token 成本降低 67%:结合 Qdrant 原生 ColBERT 重排与二值量化

    Qdrant 在 X 上分享了一篇教程,介绍如何在不引入外部重排服务的情况下把 RAG 的 token 成本降低 67%。@cappybaradeploy 的做法是把 Qdrant 原生的 ColBERT 重排、二值量化和句子级检索结合起来,只把文档中最相关的部分送给 LLM。

  2. QdrantAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 混合搜索:dense 与 sparse 检索如何融合

    Qdrant 的混合搜索对同一 query 同时跑 dense 和 sparse 检索,再用 RRF 或 DBSF 融合两份候选列表,前者只看向量排名、后者按平均分与分数分布重新缩放。

  3. 土猛的员外AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    企业AI项目为什么跑不出价值?知识工程正在成为大型企业的隐性共识

    大型企业AI项目验收后常出现使用率不及预期的情况,核心原因是AI系统未能有效利用企业自身知识。文章指出,企业AI真正落地取决于知识工程是否扎实,需在入库前完成知识准入、清洗、预标注与抽取,并覆盖版本管理、权限控制和持续优化。金融、高端制造和大型集团的AI应用至少要具备知识准入、知识治理、权限控制和持续优化能力。

  4. QdrantAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 发布向量检索调参指南:在五个公开数据集上实测七类设置

    Qdrant 发布五篇系列文章,介绍如何不靠猜测地调优向量检索,实测覆盖 5,183 到 460 万文档的五个公开数据集。文章指出七个集合设置会悄悄限制搜索质量,例如稀疏向量缺少 IDF 修饰符、BM25 平均长度用默认值;在其实测中,25 条标注查询不足以区分融合调优带来的增益。

  5. QdrantAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 量化调优:当集合规模超出内存时如何配置内存布局与 rescore

    Qdrant 发布技术分析,给出集合超出 RAM 时的量化配置方法:先在 bits4(约 8 倍压缩)起步,用公式 vectors × dimensions × 4 bytes × 1.5 估算常驻内存,并固定量化副本、让原始向量保持 cold。

8月23日周日
  1. QdrantAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 解析:什么时候才值得上重排序模型?

    Qdrant 提出用候选排序上限与 nDCG@10 基线之差来判断是否值得引入重排序:在 200 个候选的深度下,五个数据集的 nDCG@10 差距介于 0.247 至 0.487。

8月22日周六
  1. QdrantAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何调优 Qdrant 混合检索:RRF 与 DBSF 融合策略实测

    Qdrant 在五个数据集上对比了默认 RRF(k=2)与 DBSF 两种融合策略,其中四个数据集上融合优于单一最优检索,DBPedia-entity 是例外,融合反而落后稠密检索 0.0039。

  2. Milvus(@milvusio)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 新增 =~ 与 !~ 正则过滤,支持向量检索场景

    Milvus 3.0 新增 =~ 和 !~ 过滤器,可在向量检索、全文检索和标量过滤之外匹配或排除结构化字符串模式。其分层执行路径先用 RE2 做线性时间校验并拒绝非法模式,再将 ^ERROR$ 等简单模式改写为等值或前后缀检查,并在 sealed segment 上复用编译后的模式、优先检查必需字面量,必要时用 NGRAM 收窄候选集,否则回退到原始验证。

8月21日周五
  1. Milvus(@milvusio)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 用原生 BM25 与向量检索实现更快更强的全文搜索

    Milvus 3.0 将全文搜索与语义检索合并进同一个引擎,可在单次查询中同时使用原生 BM25 与向量检索。Zilliz EMEA 解决方案架构师 Simon Hearne 在线上分享中演示了混合检索、分组、schema 灵活性与搜索效率等能力,并与 Elasticsearch 在相同数据集、嵌入向量、分析器和计算资源下做了对比。团队可在单一引擎内完成关键词搜索、语义检索、过滤、分组与排序。

  2. QdrantAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant v1.17.1 如何用 prevent_unoptimized 避免未优化查询

    Qdrant v1.17.1 新增实验性写入路径设置 prevent_unoptimized,让正在优化的 segment 中新写入的点进入 deferred 状态、暂不参与检索,直到优化完成;配合已有的 indexed_only 读路径参数,可减少批量上传后落在未索引 segment 上的全量扫描。

  3. QdrantAI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 1.19 的 turbo4 数据类型如何压缩 ColBERT 多向量检索

    Qdrant 1.19 支持 turbo4 数据类型,将稠密向量以每维度 4-bit 存盘,仅为 float32 存储量的八分之一。

  4. QdrantAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 实测候选深度:检索到底该取多少才够

    Qdrant 发文给出候选深度的调优方法:把 limit 设在 100 到 200 作为起点,再用自己的标注数据测试更大取值。在五个数据集上,从 limit=10 提到 500,理想上限(best possible nDCG@10)提升 0.103 至 0.282,而融合实际得分变化仅 0.002 至 0.010。

  5. Weaviate • vector database(@weaviate_io)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    靠更好的提示词救不了断裂的上下文管线:Weaviate 拆解可靠 agentic RAG 的 5 个系统

    可靠的 agentic RAG 不靠写更好的提示词,而取决于控制哪些信息、何时、以何种形式到达模型。Weaviate 引用 @victorialslocum 的视频,把上下文工程拆成查询增强、检索、记忆、工具、智能体 5 个相互关联的系统。其中分块存在精度与上下文窗口的真实权衡,长期记忆应放在模型之外并按需检索,暴露 100 个描述不清的工具只会让相关工具更难找。

8月20日周四
  1. Milvus(@milvusio)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 在查询路径中新增原生 regex 过滤

    Milvus 3.0 将 regex 过滤下推到查询路径,可与向量搜索、全文搜索和标量过滤同时执行,不再需要先取回 top-K 再用 re.match() 逐条过滤。

  2. Qdrant(@qdrant_engine)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Qdrant 构建 AI Agent 语义缓存:命中率 57.1%、token 减少 55.7%

    Tina Sharma 用 Qdrant 构建了一套 AI Agent 语义缓存,可识别表述不同但含义相同的问题并复用已有回答,避免重复调用 LLM。实测缓存命中率 57.1%、token 消耗减少 55.7%,命中时响应时间约 15ms,文中还对相似度阈值做了调优并对比了单向量与多向量检索。

  3. Elastic BlogAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Elasticsearch 平台如何驱动营收、生产力与 AI 规模化:IDC 研究显示 517% ROI

    IDC 受 Elastic 委托调研 11 家大型企业后发现,使用 Elasticsearch 平台的组织三年 ROI 达 517%,平均回本周期 11 个月,每家年均收益 1340 万美元。这些企业将最低可用 AI 产品的落地时间缩短 40%,AI 产品更新提速 35%,搜索相关性提升 44%。研究覆盖金融服务、医疗、零售与政府行业,用例包括客服机器人、欺诈检测与智能体工作流。

  4. QdrantAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    调优 Qdrant 集合前需要检查什么

    调优 Qdrant 集合前应先确认前置状态:用 GET /collections/{collection_name} 比对 indexed_vectors_count 与 points_count,未建索引的向量走精确扫描,结果有效但延迟更高,且 hnsw_ef 在索引建立前不起作用。

8月19日周三
  1. Milvus(@milvusio)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 新增 Search Aggregation,按 doc_id 等维度聚合 ANN 候选结果

    Milvus 3.0 新增 Search Aggregation,把保留的 ANN 候选按 doc_id、租户、产品线或内容类型分桶,返回桶计数、指标与代表性命中,用于判断 RAG 检索结果是集中还是分散。

  2. Qdrant(@qdrant_engine)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ACORN 与 Qdrant filterable HNSW 过滤搜索对比:1M 向量 1% 过滤下 99.8% vs 67.7% 召回

    Qdrant 对比了 ACORN 与 filterable HNSW 两种过滤搜索方案:过滤器会把 HNSW 图切成不连通的孤岛,ACORN 在查询时绕过被过滤的邻居,filterable HNSW 则在索引中为共享 payload 值的点补边以保持图连通。

  3. 土猛的员外AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我为什么给 Codex 接上 AIS:一次让 AI 从"临时聪明"走向"长期协作"的实践

    作者通过 AIS-Skill 把 Codex 与 TorchV AIS 知识引擎连接,让 Codex 从单次任务执行转向跨会话的长期协作。接通后 Codex 可定位知识库、关键词与语义检索、读写文档、上传下载文件并返回文档链接,形成"读取上下文→执行任务→人工确认→回写知识→持续复用"的循环。作者计划用 AIS 建立 common 公共资料库、项目长期上下文、Skill 资产库和自动日报四套体系。

  4. Weaviate • vector database(@weaviate_io)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Weaviate Query Agent 更新:检索前先理解数据,自动识别过滤值与数值分布

    Weaviate 的 Query Agent 迎来更新,在检索前会先探索数据集合,自动识别可用于过滤的全部取值,以及数值属性的均值、中位数、最小值和最大值。这意味着用户无需手动描述数据结构或硬编码过滤选项,可以直接提出"显示价格低于平均水平的产品""按最常见的类别过滤"这类请求。官方称该更新带来更智能的过滤和更好的搜索质量。

8月18日周二
  1. LlamaIndex 🦙(@llama_index)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaParse 新增修订追踪解析功能

    LlamaIndex 的 LlamaParse 新增修订追踪支持,可输出文档最终状态的干净 markdown,并把编辑、删除、评论等每次修订连同作者、内容和位置以结构化数据返回。

8月17日周一
  1. LlamaIndex 🦙(@llama_index)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 发布 ExtractBench:文档抽取开始考核“出处”而非只考字段值

    LlamaIndex 推出 ExtractBench,对文档抽取的“依据”严格打分:字段值与其引文都正确才算对,词级框需 IoU 0.5。VLMs 和编码智能体均未返回任何证据,两级得分均为零;能返回框的系统中词级 F1 仍不足 50%。

  2. Milvus(@milvusio)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 全文检索网络研讨会:与 Elasticsearch 对比实测

    Zilliz 解决方案架构师 Simon Hearne 将于 8 月 19 日 11:00 AM PDT 主讲 Milvus 3.0 全文检索网络研讨会,演示与 Elasticsearch 的实时并排查询对比。内容涵盖 Milvus 3.0 的 BM25 与稀疏检索、过滤排序聚合与分面搜索、混合检索及 RRF 排序方法,并给出生产环境示例。无法实时参加者可注册获取回放与演示。

  3. mem0(@mem0ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mem0 架构深度解析:AI 智能体记忆如何运作

    Alejandro AO 对 Mem0 架构做了完整拆解,涵盖持久化记忆存储、基于 LLM 的摄入、语义与 BM25 混合检索、实体加权以及本地开源模型等环节。内容按章节形式呈现,从智能体记忆的基本概念讲到具体检索实现。

8月14日周五
  1. Milvus(@milvusio)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 3.0 发布:向量检索内置 Query Aggregation、Search Aggregation 与 ORDER BY

    Milvus 3.0 把商品搜索的结构化二次处理搬进检索引擎,新增 Query Aggregation、Search Aggregation 和 Server-side ORDER BY 三项能力。

  2. LlamaIndex 🦙(@llama_index)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 限时活动:升级 LlamaParse Pro 首月 credits 三倍至 1.2M

    LlamaIndex 推出限时活动,升级至 LlamaParse Pro 计划可将首月 credits 提升三倍,从 400K 增至 1.2M,相当于价值 $1,000(约 80k 页)的解析额度免费使用。该优惠无需代码,自动生效。

  3. Qdrant(@qdrant_engine)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    拜耳如何在 Qdrant Hybrid Cloud 上为 116,000 名员工构建企业搜索引擎

    拜耳(Bayer)在 Qdrant Hybrid Cloud 上为 116,000 名员工构建企业搜索引擎,4 个节点承载 3500 万向量点,已生产运行三年。该系统采用混合搜索支撑深度智能体,并用语义缓存控制智能体成本,实测效率提升 20%。