AINews:TypeSafe/Jev 上线三周 ARR 超 1 亿美元、估值 75 亿美元
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。
据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。
OpenAI 在 X 上回应解雇三名安全研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 的决定,称内部调查发现他们违反敏感信息处理政策,构成严重信任破坏,并强调解雇与他们就 AI 安全发声无关。这封信发布于周四,研究员在其中要求 OpenAI 提高决策透明度,称自己因提出安全担忧被解雇。OpenAI 表示调查发现的违规超出信中所述,但未提供细节。
Cloudflare 发布 Clef-omni,在文本和图像之外新增音频(wav/mp3)与视频(mp4/webm)输入,基于 Qwen3-Omni-30B-A3B-Instruct MoE 构建并已在 Hugging Face 开放权重,定价为每百万输入 token 0.15 美元。
Cloudflare 在 Hugging Face 上发布了新模型 clef,模型页面已上线 huggingface.co/Cloudflare/clef。该消息由 Julien Chaumond 转发,帖文获得 288 次点赞和 23 次转发。
Hugging Face 旗下 Pollen Robotics 设计的机器鸭 Microduck 售价 399 美元,高峰期平均每 4 秒卖出一台,五天后预售破万台、销售额突破 500 万美元,由潘昊创办的深圳 Seeed Studio 矽递科技代工。
Matthieu Lapeyre 透露 Microduck 换用新定制主板后,在 2600 mAh 电池上自主行走、站立、坐下直至电量耗尽,续航超过 3 小时,平均电池电流从约 1.13 A 降至约 0.82 A,减少约 28%。此前 Radxa 原型板存在散热问题,运行 20 分钟后即降频并因过热关机,新板将 CPU 峰值温度从 114°C 降至 60°C,全程零热降频。
Crunchbase 数据显示,今年截至 9 月 29 日风投系 AI 公司对 AI 创企的收购已达 195 起,比 2025 年全年高出 14%。OpenAI 是过去三年最活跃的收购方,共完成 20 笔 AI 相关收购,其中 10 笔发生在今年;Anthropic、法律 AI 创企 Legora 各完成 5 起。
10月9日,扩散智能DiffuSpace宣布已连续完成两轮融资,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投,总金额达数亿元。DiffuSpace于2026年5月在深圳成立,团队研发的Dream 7B扩散语言模型部分能力可比肩DeepSeek V3(671B),目前正在训练新一代更大参数规模的模型并计划近期开源。
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,其中 Tomek Korbak 称被口头告知因与外部安全实验室 METR 的沟通方式被解雇,公司未给出书面理由。
有观点指出,当下 AI 初创公司最难招的岗位是同时满足四个条件的人:长期在线了解趋势、有品味且能做新媒介创作、懂 AI 与技术、并能高质量落地执行。发帖者称符合这一交叉条件的人极为稀少。
Qwen-Image-2.1-Multiple-Angles-LoRA 模型已上线 Hugging Face,可通过 huggingface.co/akhaliq 访问。该模型以 LoRA 形式为 Qwen-Image-2.1 提供多角度图像生成能力,具体参数与效果未在原文披露。
LIFT 提出一种 Layout-In-Future 视频生成方法,在大视角变化条件下通过 On-Policy 自蒸馏实现生成,论文已发布在 Hugging Face Papers。
MiniMax H3 的 Person Remover LoRA 可自动移除视频中的人物:它用 SAM 3.1 追踪目标人物、将掩码填充为绿色,并以重叠窗口方式生成替换背景。使用时需提供原始视频和首帧的干净版本。
Perplexity 开源 pplx-embed-v2-late,这是面向文本与图像的多向量嵌入模型,提供 9B 和 0.6B 两个版本并共享同一嵌入空间。其中 9B 可用于索引多模态数据,0.6B 可用于端侧查询,还支持无需 OCR 直接搜索 PDF 页面。官方称其在 MADQA 上得分 92.4%,在 BrowseComp+ 上得分 64%,权重已在 Hugging Face 发布。
港大教授孔令鹏创立的扩散语言模型公司 DiffuSpace 完成 dLLM 方向全球最大规模融资,高鹄资本担任交易方。其开源模型 Dream 7B 在 Hugging Face 累计下载量超过 250 万,今年内计划发布参数规模更大的新模型,并针对性适配代码 Agent 与智能推理等任务。
论文《Agent Plasticity: Measuring Self-Improvement Through Experience》发布,提出通过经验测量 AI 智能体自我改进能力的方法,论文已在 Hugging Face 上线。
Iris-3B 提出在像素空间进行扩散训练、转换与微调的方法,试图超越潜空间扩散路线。相关论文已发布在 Hugging Face Papers(编号 2610.09)。
一篇题为 Native Action-Prior Learning from Videos for World Action Models 的论文发布,提出从视频中直接学习动作先验,用于世界动作模型。论文页面可在 huggingface.co 查看。
一篇题为 "Old Ideas, Novel Problems" 的论文研究了基于 LLM 的新颖性评估的不稳定性。论文指出,让大语言模型判断研究想法是否新颖时会得到不稳定的结果,即"新想法、新问题"。论文原文已在 Hugging Face 上发布。
Hugging Face 在 Paper Pages 上线论文复现功能,可用 ML Intern 对已发表论文发起复现任务。Hugging Face 的 Abubakar Abid 指出,随着智能体在算力驱动下加速科研发现,发现被商品化、低质量论文泛滥、企业倾向于保密,开放共享科学的激励正在瓦解,因此需要新工具来奖励知识公开。
Lightspeed Venture Partners 曾错过 OpenAI、ElevenLabs 和 Hugging Face 等 AI 公司,2023 年 4 月联合负责人 Ravi Mhatre 与 Bejul Somaia 要求全球合伙人清空日程,开了一场长达七小时的会议反思如何应对 AI 浪潮。如今该机构有望凭借对 Anthropic 的投资获得回报。
Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。
Hugging Face Spaces 上线 pollen 的 Reachy Mini 舞蹈项目,用户可自己动手制作 Reachy Mini 的舞蹈动作。推文给出的链接指向 huggingface.co/spaces/pollen-… 页面。
JetBrains 发布开源模型 Mellum2.1,这是 6 月开源的 12B MoE 模型的新版本,架构未变,仍为 2.5B 激活参数、Apache 2.0 许可,改进集中在预训练之后的强化学习阶段。
Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。
谷歌于 10 月 6 日开源 EmbeddingGemma 2,这是其首个原生多模态开源嵌入模型,可把文字、代码、图片、视频、音频放进同一个 768 维空间并用一句话检索。
Cloudflare 在 Birthday Week 期间发布开源权重决策模型 Clef,包含 27B 多模态模型和面向延迟敏感场景的 9B 模型 Clef-Flash,输入为状态与带类型问题的 schema,输出每个候选项的概率,不生成自由文本。
Perplexity 将两款模型发布到 Hugging Face,可通过其 Hugging Face 集合页面获取。原文未披露模型名称、参数规模及具体开放方式。
Perplexity 发布 pplx-embed-v2-late,包含两个延迟交互嵌入模型,可在共享嵌入空间中检索文本、图像和页面,实现跨模态查询;两个模型均达到前沿性能,并已在 Hugging Face 公开可用。
Epoch AI 对比两轮 Ipsos 民调发现,报告过去 12 个月遭遇至少一次网络事件的美国成年人比例从 6 月的 46% 变为 9 月的 45%,总体无变化,也没有可统计检出的具体事件类型上升。
OpenAI 发布由内部前沿模型产出的一批新数学结果,并公开了 github.com/openai/math 仓库。OpenAI 称在发布过程中咨询了普林斯顿高等研究院的数学与人工智能独立咨询小组,并参考其建议和公开推荐意见来确定发布方式。Thomas Wolf 转引该消息时评价没有炒作、只有结果。
Perplexity 联合创始人 Aravind Srinivas 表示,更新版开源权重多模态决策模型 pplx-decider-v1.1-27b 已上线,并在 Hugging Face 新的 Decision Index 0.3 基准上得分最高。该模型价格为此前 v1 的一半,为每百万输入 token 0.02 美元。相关权重可在 Hugging Face 空间获取。
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构、740M 参数、Apache 2.0 许可,将文本、代码、图像、视频和音频映射到统一嵌入空间。
Hugging Face 上线了一个名为 webml-c 的 Space,用户可直接在浏览器中体验 WebML。原文未披露具体模型、参数规模或性能数据。
Google 发布 EmbeddingGemma 2,这是其首个原生多模态嵌入模型,基于 Gemma 4 构建,采用 Apache 2.0 许可。它可将 100 多种语言以及代码、图像、音频和视频嵌入同一个向量,上下文长度 8,192,提供 740M omni、440M text+vision、570M text+audio 和 270M text-only 四种规格。
Mistral 发布 Mistral Large 4(Le Chonk),1T 参数、原生多模态、49B 激活参数,官方称其是欧美聚合基准上最好的开放权重模型,在视觉 grounding 上超过闭源前沿模型。
Replicate 现已可试用 Google 的 Nano Banana 模型,用户可通过 replicate.com/google/nano-ba… 直接访问。原文未披露该模型的参数规模、上下文长度或可用性等细节。
Perplexity 在 Hugging Face Decision Index(决策模型基准)上排名第一。该模型采用开放权重,所有人均可访问。
Google DeepMind 发布 EmbeddingGemma 2,参数量 740M,在多项基准上具有竞争力,甚至超过部分参数量两倍以上的专用模型。开发者可用它为应用加入多模态搜索,例如用语音备忘录在视频中定位片段,也可与 Gemma 4 搭配实现私密的端侧 RAG。该模型以 Apache 2.0 许可发布,权重已在 Hugging Face 和 Kaggle 上线。