跳到正文
原文
Julien Chaumond(@julien_c)· Julien Chaumond (@julien_c)·· 18 天前AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

Transformers 联手 ggml:用 GGML kernels 加载 GGUF 达到 llama.cpp 同等性能

transformers x @ggml_org collab 🐐

AI 导读

Transformers 与 ggml 合作,通过在 `kernels` 库中调用 GGML kernels,让 GGUF 模型加载从反量化改为直接运行,性能追平 llama.cpp。此前 Transformers 已支持加载 GGUF 文件多年,这次改动由 @_marcsun 完成。

来源:Julien Chaumond(@julien_c) · x.com