跳到正文

#Hugging Face

今日 5 条
今天10月10日周六
  1. Latent Space [Youtube]AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AINews:TypeSafe/Jev 上线三周 ARR 超 1 亿美元、估值 75 亿美元

    AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。

  2. 爱范儿AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果被曝削减 iPhone 18 Pro 订单,供应链称总量变化不大;小米 17 Ultra 全系涨价 1000 元、华为 nova 16 系列同日调价

    据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。

  3. 地缘政治AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 坚持解雇三名 AI 安全研究员的决定

    OpenAI 在 X 上回应解雇三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,称内部调查发现他们违反敏感信息处理政策,构成严重信任破坏,并强调解雇与他们就 AI 安全发声无关。这封信发布于周四,研究员在其中要求 OpenAI 提高决策透明度,称自己因提出安全担忧被解雇。OpenAI 表示调查发现的违规超出信中所述,但未提供细节。

  4. 国际大厂AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 发布多模态决策模型 Clef-omni,Clef 提速、Clef-flash 降价

    Cloudflare 发布 Clef-omni,在文本和图像之外新增音频(wav/mp3)与视频(mp4/webm)输入,基于 Qwen3-Omni-30B-A3B-Instruct MoE 构建并已在 Hugging Face 开放权重,定价为每百万输入 token 0.15 美元。

  5. Julien Chaumond(@julien_c)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 在 Hugging Face 发布新模型 clef

    Cloudflare 在 Hugging Face 上发布了新模型 clef,模型页面已上线 huggingface.co/Cloudflare/clef。该消息由 Julien Chaumond 转发,帖文获得 288 次点赞和 23 次转发。

10月9日周五
  1. 白鲸出海AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    专访 Seeed Studio 潘昊:Microduck 机器鸭爆火背后,硬件价值在硬件之外

    Hugging Face 旗下 Pollen Robotics 设计的机器鸭 Microduck 售价 399 美元,高峰期平均每 4 秒卖出一台,五天后预售破万台、销售额突破 500 万美元,由潘昊创办的深圳 Seeed Studio 矽递科技代工。

  2. clem 🤗(@ClementDelangue)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Microduck 新定制主板实测:2600 mAh 电池续航超 3 小时,CPU 峰值温度从 114°C 降至 60°C

    Matthieu Lapeyre 透露 Microduck 换用新定制主板后,在 2600 mAh 电池上自主行走、站立、坐下直至电量耗尽,续航超过 3 小时,平均电池电流从约 1.13 A 降至约 0.82 A,减少约 28%。此前 Radxa 原型板存在散热问题,运行 20 分钟后即降频并因过热关机,新板将 CPU 峰值温度从 114°C 降至 60°C,全程零热降频。

  3. 智东西AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 领跑 195 起 AI 并购,最大一笔 110 亿

    Crunchbase 数据显示,今年截至 9 月 29 日风投系 AI 公司对 AI 创企的收购已达 195 起,比 2025 年全年高出 14%。OpenAI 是过去三年最活跃的收购方,共完成 20 笔 AI 相关收购,其中 10 笔发生在今年;Anthropic、法律 AI 创企 Legora 各完成 5 起。

  4. 顺为资本AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    扩散智能DiffuSpace连续完成两轮融资,总金额数亿元

    10月9日,扩散智能DiffuSpace宣布已连续完成两轮融资,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投,总金额达数亿元。DiffuSpace于2026年5月在深圳成立,团队研发的Dream 7B扩散语言模型部分能力可比肩DeepSeek V3(671B),目前正在训练新一代更大参数规模的模型并计划近期开源。

  5. THE DECODERAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 解雇三名安全研究员,被指打压安全问题发声

    OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,其中 Tomek Korbak 称被口头告知因与外部安全实验室 METR 的沟通方式被解雇,公司未给出书面理由。

  6. Julien Chaumond(@julien_c)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 初创公司争抢"新媒体验型"人才:懂 AI、有品味、能执行的人极稀缺

    有观点指出,当下 AI 初创公司最难招的岗位是同时满足四个条件的人:长期在线了解趋势、有品味且能做新媒介创作、懂 AI 与技术、并能高质量落地执行。发帖者称符合这一交叉条件的人极为稀少。

  7. AK(@_akhaliq)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qwen-Image-2.1-Multiple-Angles-LoRA 模型发布

    Qwen-Image-2.1-Multiple-Angles-LoRA 模型已上线 Hugging Face,可通过 huggingface.co/akhaliq 访问。该模型以 LoRA 形式为 Qwen-Image-2.1 提供多角度图像生成能力,具体参数与效果未在原文披露。

  8. AK(@_akhaliq)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LIFT:大视角变化下通过 On-Policy 自蒸馏实现 Layout-In-Future 视频生成

    LIFT 提出一种 Layout-In-Future 视频生成方法,在大视角变化条件下通过 On-Policy 自蒸馏实现生成,论文已发布在 Hugging Face Papers。

  9. Hailuo AI (MiniMax)(@Hailuo_AI)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MiniMax H3 的 Person Remover LoRA:用 SAM 3.1 视频一键移除人物

    MiniMax H3 的 Person Remover LoRA 可自动移除视频中的人物:它用 SAM 3.1 追踪目标人物、将掩码填充为绿色,并以重叠窗口方式生成替换背景。使用时需提供原始视频和首帧的干净版本。

  10. Aravind Srinivas(@AravSrinivas)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 开源 pplx-embed-v2-late 多向量嵌入模型,含 9B 与 0.6B 两个版本

    Perplexity 开源 pplx-embed-v2-late,这是面向文本与图像的多向量嵌入模型,提供 9B 和 0.6B 两个版本并共享同一嵌入空间。其中 9B 可用于索引多模态数据,0.6B 可用于端侧查询,还支持无需 OCR 直接搜索 PDF 页面。官方称其在 MADQA 上得分 92.4%,在 BrowseComp+ 上得分 64%,权重已在 Hugging Face 发布。

  11. 投资融资AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    港大教授孔令鹏创立的 DiffuSpace 完成 dLLM 领域全球最大融资

    港大教授孔令鹏创立的扩散语言模型公司 DiffuSpace 完成 dLLM 方向全球最大规模融资,高鹄资本担任交易方。其开源模型 Dream 7B 在 Hugging Face 累计下载量超过 250 万,今年内计划发布参数规模更大的新模型,并针对性适配代码 Agent 与智能推理等任务。

  12. AK(@_akhaliq)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Agent Plasticity:通过经验测量智能体自我改进的论文发布

    论文《Agent Plasticity: Measuring Self-Improvement Through Experience》发布,提出通过经验测量 AI 智能体自我改进能力的方法,论文已在 Hugging Face 上线。

  13. AK(@_akhaliq)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Iris-3B:用像素空间扩散训练、转换与微调超越潜空间

    Iris-3B 提出在像素空间进行扩散训练、转换与微调的方法,试图超越潜空间扩散路线。相关论文已发布在 Hugging Face Papers(编号 2610.09)。

  14. AK(@_akhaliq)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    面向世界动作模型的视频原生动作先验学习论文发布

    一篇题为 Native Action-Prior Learning from Videos for World Action Models 的论文发布,提出从视频中直接学习动作先验,用于世界动作模型。论文页面可在 huggingface.co 查看。

  15. AK(@_akhaliq)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    《Old Ideas, Novel Problems:基于 LLM 的新颖性评估的不稳定性》

    一篇题为 "Old Ideas, Novel Problems" 的论文研究了基于 LLM 的新颖性评估的不稳定性。论文指出,让大语言模型判断研究想法是否新颖时会得到不稳定的结果,即"新想法、新问题"。论文原文已在 Hugging Face 上发布。

  16. Hugging Face(@huggingface)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 在 Paper Pages 推出论文复现功能

    Hugging Face 在 Paper Pages 上线论文复现功能,可用 ML Intern 对已发表论文发起复现任务。Hugging Face 的 Abubakar Abid 指出,随着智能体在算力驱动下加速科研发现,发现被商品化、低质量论文泛滥、企业倾向于保密,开放共享科学的激励正在瓦解,因此需要新工具来奖励知识公开。

  17. 国际大厂AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    错过 AI 早期红利后,Lightspeed 重塑自身,如今有望靠 Anthropic 收获回报

    Lightspeed Venture Partners 曾错过 OpenAI、ElevenLabs 和 Hugging Face 等 AI 公司,2023 年 4 月联合负责人 Ravi Mhatre 与 Bejul Somaia 要求全球合伙人清空日程,开了一场长达七小时的会议反思如何应对 AI 浪潮。如今该机构有望凭借对 Anthropic 的投资获得回报。

  18. 技术前沿AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Goodfire 推出“由内而外”的 AI 智能体监控器,成本仅为传统方案零头

    Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。

10月8日周四
  1. clem 🤗(@ClementDelangue)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 上可自制 Reachy Mini 舞蹈动作

    Hugging Face Spaces 上线 pollen 的 Reachy Mini 舞蹈项目,用户可自己动手制作 Reachy Mini 的舞蹈动作。推文给出的链接指向 huggingface.co/spaces/pollen-… 页面。

  2. The JetBrains BlogAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JetBrains 发布 Mellum2.1:面向编码智能体的快速开源模型

    JetBrains 发布开源模型 Mellum2.1,这是 6 月开源的 12B MoE 模型的新版本,架构未变,仍为 2.5B 激活参数、Apache 2.0 许可,改进集中在预训练之后的强化学习阶段。

  3. 机器之心SOTA模型AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,Mistral 开放 Mistral Large 4 公开预览 API

    Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。

  4. 国际大厂AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌开源 EmbeddingGemma 2:740M 参数支持本地多模态检索

    谷歌于 10 月 6 日开源 EmbeddingGemma 2,这是其首个原生多模态开源嵌入模型,可把文字、代码、图片、视频、音频放进同一个 768 维空间并用一句话检索。

  5. InfoQAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 开源决策模型 Clef,9B 与 27B 参数可选

    Cloudflare 在 Birthday Week 期间发布开源权重决策模型 Clef,包含 27B 多模态模型和面向延迟敏感场景的 9B 模型 Clef-Flash,输入为状态与带类型问题的 schema,输出每个候选项的概率,不生成自由文本。

  6. Perplexity(@perplexity_ai)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 两款模型上线 Hugging Face

    Perplexity 将两款模型发布到 Hugging Face,可通过其 Hugging Face 集合页面获取。原文未披露模型名称、参数规模及具体开放方式。

  7. Perplexity(@perplexity_ai)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 发布 pplx-embed-v2-late 延迟交互嵌入模型,文本图像页面统一检索

    Perplexity 发布 pplx-embed-v2-late,包含两个延迟交互嵌入模型,可在共享嵌入空间中检索文本、图像和页面,实现跨模态查询;两个模型均达到前沿性能,并已在 Hugging Face 公开可用。

10月7日周三
  1. Epoch AIAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI 调查:美国成年人遭遇网络事件的比例与 Claude Fable 5 发布时相比没有变化

    Epoch AI 对比两轮 Ipsos 民调发现,报告过去 12 个月遭遇至少一次网络事件的美国成年人比例从 6 月的 46% 变为 9 月的 45%,总体无变化,也没有可统计检出的具体事件类型上升。

  2. Thomas Wolf(@Thom_Wolf)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布内部前沿模型产出的一批数学结果

    OpenAI 发布由内部前沿模型产出的一批新数学结果,并公开了 github.com/openai/math 仓库。OpenAI 称在发布过程中咨询了普林斯顿高等研究院的数学与人工智能独立咨询小组,并参考其建议和公开推荐意见来确定发布方式。Thomas Wolf 转引该消息时评价没有炒作、只有结果。

  3. Aravind Srinivas(@AravSrinivas)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 发布开源权重模型 pplx-decider-v1.1-27b,输入价格降至每百万 token 2 美分

    Perplexity 联合创始人 Aravind Srinivas 表示,更新版开源权重多模态决策模型 pplx-decider-v1.1-27b 已上线,并在 Hugging Face 新的 Decision Index 0.3 基准上得分最高。该模型价格为此前 v1 的一半,为每百万输入 token 0.02 美元。相关权重可在 Hugging Face 空间获取。

  4. Google DeepMind BlogAI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 EmbeddingGemma 2 开源轻量多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构、740M 参数、Apache 2.0 许可,将文本、代码、图像、视频和音频映射到统一嵌入空间。

  5. Philipp Schmid(@_philschmid)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 上线 WebML 浏览器体验 Demo

    Hugging Face 上线了一个名为 webml-c 的 Space,用户可直接在浏览器中体验 WebML。原文未披露具体模型、参数规模或性能数据。

  6. Philipp Schmid(@_philschmid)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 EmbeddingGemma 2 多模态嵌入模型

    Google 发布 EmbeddingGemma 2,这是其首个原生多模态嵌入模型,基于 Gemma 4 构建,采用 Apache 2.0 许可。它可将 100 多种语言以及代码、图像、音频和视频嵌入同一个向量,上下文长度 8,192,提供 740M omni、440M text+vision、570M text+audio 和 270M text-only 四种规格。

  7. clem 🤗(@ClementDelangue)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral 发布 Mistral Large 4,1T 参数多模态模型权重定于 10 月底开放

    Mistral 发布 Mistral Large 4(Le Chonk),1T 参数、原生多模态、49B 激活参数,官方称其是欧美聚合基准上最好的开放权重模型,在视觉 grounding 上超过闭源前沿模型。

  8. Replicate(@replicate)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replicate 上线 Google Nano Banana 模型

    Replicate 现已可试用 Google 的 Nano Banana 模型,用户可通过 replicate.com/google/nano-ba… 直接访问。原文未披露该模型的参数规模、上下文长度或可用性等细节。

  9. Aravind Srinivas(@AravSrinivas)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 在 Hugging Face Decision Index 登顶,模型开放权重

    Perplexity 在 Hugging Face Decision Index(决策模型基准)上排名第一。该模型采用开放权重,所有人均可访问。

  10. Google DeepMind(@GoogleDeepMind)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 发布 EmbeddingGemma 2,740M 参数以 Apache 2.0 开源

    Google DeepMind 发布 EmbeddingGemma 2,参数量 740M,在多项基准上具有竞争力,甚至超过部分参数量两倍以上的专用模型。开发者可用它为应用加入多模态搜索,例如用语音备忘录在视频中定位片段,也可与 Gemma 4 搭配实现私密的端侧 RAG。该模型以 Apache 2.0 许可发布,权重已在 Hugging Face 和 Kaggle 上线。