跳到正文
原文
Qdrant(@qdrant_engine)· Qdrant (@qdrant_engine)·· 3 天前AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

Qdrant 实测 Google EmbeddingGemma 2:向量内存降 77 倍,保留 94.5% 检索质量

77× less vector RAM. 94.5% of baseline retrieval quality. We got early access to Google EmbeddingGe...

AI 导读

Qdrant 提前拿到 Google EmbeddingGemma 2 并测试其 Matryoshka 兼容嵌入在 Qdrant 中可压缩到何种程度。通过更短向量、量化与重打分组合,向量内存占用降低约 77 倍,同时保留基线 94.5% 的检索质量。Google 在 EmbeddingGemma 2 发布公告中也提到了这项工作。

来源:Qdrant(@qdrant_engine) · x.com