跳到正文
原文
Jina AI(@JinaAI_)· Jina AI (@JinaAI_)·· 2026-05-12AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

Jina AI v5-omni:冻结 v5-text 主干,接入视觉与音频编码器

v5-omni keeps the v5-text backbone completely frozen and adds pretrained vision and audio encoders c...

AI 导读

Jina AI 发布 v5-omni,完全冻结 v5-text 主干,仅通过小型可训练投影层接入预训练视觉与音频编码器。视觉端采用 Qwen3.5 vision encoder 并做 2x2 空间合并,除最终投影层 fc_vision_2 外全部冻结,该层随机初始化并映射至文本主干隐藏维度。

来源:Jina AI(@JinaAI_) · x.com