跳到正文

#Google

今日 20 条
10月9日周五
  1. 创业邦AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯WorkBuddy上线“独立文件浏览器”;蔡崇信:五年后AI将如今天的互联网,融入社会的每个环节丨AIGC日报

    腾讯WorkBuddy上线“独立文件浏览器”,本地文件可在独立窗口查看编辑,文件在左、AI在右,可围绕当前文件总结、分析、修改和润色,且只读取用户主动打开或添加的文件。谷歌向全球用户开放AI生成内容检测工具SynthID Detector,支持识别图片、视频、音频是否由AI生成。阿里蔡崇信预判五年后AI将从显性话题转为隐性基础设施,融入业务每个环节。

  2. InfoQAI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 用 AI 测试框架探测并加固其 WAF

    Cloudflare 将前沿 AI 模型放入受控测试框架中探测其 WAF,以已拦截的攻击载荷为起点让模型生成并迭代新变体,在 45 个场景中产生 1,107 次尝试,经人工筛查后留下 49 项发现。

  3. 量子位AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 与 BIDMC 研究登《柳叶刀》:AMIE 预诊获初步验证

    Google 与贝斯以色列女执事医疗中心(BIDMC)研究人员主导的一项研究发表于《柳叶刀》主刊,这是 Google 研究成果首次登上该刊。

  4. 国际大厂AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌云发布 Gemini Agent,Anthropic 推出 Claude Dashboards 与 Motion

    谷歌云在 Gemini at Work 2026 发布会上推出面向企业客户的 Gemini 智能体(Gemini Agent),定位通用工作智能体,可回答问题、处理知识型工作、创建媒体内容与编写程序,支持 Gemini Enterprise、Workspace 及第三方服务,目前兼容 Gemini 和 Claude 模型,并会提供 API 供开发者集成。

  5. 国际大厂AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TouchScale 发布 500 小时人类视觉-触觉数据集,机器人真机成功率翻番

    德州农工大学、Google DeepMind、CMU 等 15 家机构联合发布 TouchScale,一个在统一传感器与采集流程下构建的 500 小时人类双手视觉-触觉数据集。

  6. Last Week in AIAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Last Week in AI #346:OpenAI 发布 719 份数学手稿、两个西方开源模型、又一位安全研究员离职

    OpenAI 于 10 月 6 日公开了由一款未发布内部前沿模型产出的 719 份数学手稿,覆盖 372 个主题族,并包含大量 Lean 形式化证明。Mistral 发布 1 万亿参数多模态模型 Mistral Large 4(绰号 Le Chonk),Reflection AI 推出 5010 亿总参数、230 亿激活的 MoE 开源模型 Beam。

  7. 宝玉(@dotey)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    特朗普向黄仁勋、马斯克、苏姿丰等六位科技领袖颁发美国国家奖章

    特朗普 10 月 8 日在白宫颁发两项美国国家奖章:Google 联合创始人 Sergey Brin、英伟达 CEO 黄仁勋、马斯克、AMD CEO 苏姿丰获国家科学奖章,戴尔创始人 Michael Dell 与微软 CEO Satya Nadella 获国家技术与创新奖章。

  8. Viking(@vikingmute)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 更新 AI SEO 指南:生成模型输出可能幻觉,发布前须人工核实

    Google 更新 AI SEO 指南,明确说明生成模型不是在检索事实,而是根据训练数据预测可能的词序列,因此输出可能出现幻觉。指南强调发布前人工核实并审核所有 AI 生成内容的准确性和可信度是 critical。用 AI 写作时需在完成后做 fact check,可用其他模型审核,最好再由人工过一遍。

  9. Jerry Liu(@jerryjliu0)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 等主办的 Agent Economy Gala 满员 400 人

    Agent Economy Gala 在 TECH WEEK by a16z 期间满员 400 人,其中 203 位创始人合计融资超 1B 美元,295 位嘉宾正在构建智能体应用或基础设施。活动由 LlamaIndex、Daytona、TinyFish、Obvious、Linq 等团队主办,定位是只邀请智能体生态的活跃建设者、不做凑人数的注水。

  10. 创业邦AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 完成超 5 亿美元新融资,OpenAI 上线 GPT-6,腾讯 WorkBuddy 推出独立文件浏览器丨邦早报

    Manus 母公司蝴蝶效应完成超 5 亿美元新一轮融资,由博裕投资、IDG 资本领投,腾讯、红杉中国、真格基金继续加持。OpenAI 宣布面向全球所有 ChatGPT 用户上线 GPT-6,并聘请 SpaceX AI 高管出任欧洲、中东和非洲地区销售副总裁。腾讯 WorkBuddy 上线“独立文件浏览器”,生数科技发布 Vidu Q4 Preview,视频生成单价 0.09 元每秒起。

  11. Latent Space [Youtube]AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 同日登场

    OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发公开信称因"把安全置于公司短期利益之上"被辞退,OpenAI 称其不当处理机密信息。

  12. Google Developers BlogAI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 开源 AQuA:为生产环境 AI 智能体诊断质量回归

    Google Cloud 开源 AQuA(Ambient Quality Agent),一个与生产环境 AI 智能体并行运行的参考实现,可扫描并核验失败聚类、对照对话记录,并按实际部署的源码快照定位根因。它针对的是智能体上线后难以察觉的质量回归——这类问题往往仍返回 HTTP 200 OK。

  13. Google Developers BlogAI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google AI Edge 推出端侧 GPU 推理框架 ML Drift

    Google AI Edge 推出 ML Drift,一个面向端侧 AI/ML 推理的高性能通用 GPU 计算框架。它封装了 OpenGL ES、OpenCL、Metal 和 WebGPU 等硬件与底层 API 的复杂度,让开发者能在移动端和桌面平台上构建视频特效、生成式 AI 等实时交互式 ML 体验。

  14. Demis Hassabis(@demishassabis)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Demis Hassabis 宣布投入 1.5 亿美元支持白宫 Genesis Mission 科学计划

    Demis Hassabis 本周宣布投入 1.5 亿美元支持白宫与美国能源部(@ENERGY)的 Genesis Mission,并与主任 Michael Kratsios 合作推进未来科学研究。该计划被白宫称为本世纪最雄心勃勃的一系列科学倡议。

  15. Sundar Pichai(@sundarpichai)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 与 BIDMC 的 AMIE 研究发表于《柳叶刀》,实测 AI 采集病史的真实临床效果

    Google 与 BIDMC 合作的 AMIE 研究发表于《柳叶刀》,这是首个在真实诊所中面向患者的对话式诊断前瞻性研究。AMIE 是供患者在就诊前对话使用的研究系统,在真实急诊患者中测试显示,临床医生在 75% 的病例中认为其摘要有助于准备问诊,超过一半的病例中影响了诊疗思路;AMIE 的鉴别诊断与医生最终诊断的一致率为 90%。这也是 Google 首次在《柳叶刀》主刊发表论文。

  16. The Keyword (blog.google)AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 与 BIDMC 在《柳叶刀》发表 AMIE 临床研究

    Google 与 Beth Israel Deaconess Medical Center(BIDMC)团队在《柳叶刀》发表研究,在 BIDMC 门诊开展真实临床研究,98 名患者在紧急就诊前先与 Google 研究型诊断 AI 聊天机器人 AMIE 对话。

  17. elvis(@omarsar0)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 提出 CI 程序修复智能体 FlowAgent,真实故障修复正确率 67.18%

    Google 提出 CI 内的程序修复智能体 FlowAgent,针对提交前测试失败运行 ReAct 式生成-验证循环,并在代码审查工具中展示修复建议,其前置与后置两道弃权过滤器会拦下薄弱建议。对 195 个真实故障的人工评审显示,67.18% 的修复正确。Google 全公司上线后,它在 295,508 次变更上给出建议,开发者预览 65,069 次、采纳 28,554 次。

  18. 技术前沿AI 评估 · 77/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 在 Gemini 中引入智能体能力,先从企业客户开始

    Google 在 Cloud 活动上宣布将 Gemini 带入智能体阶段,推出统一智能体,既能回答问题也能代用户完成任务,初期面向企业、之后再向消费者开放。该智能体可接收目标而非指令,自行规划工作并调用自定义技能与工具;默认自动选择模型,用户也可手动切换,首批第三方模型为 Anthropic 的 Claude。

    为什么值得看

    Google 把 Gemini 智能体先落到企业场景,文中给出的模型选择、系统连接与审计线索可供评估落地边界。

  19. Sundar Pichai(@sundarpichai)AI 评估 · 83/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布面向工作场景的通用 Gemini agent

    Google 在 NASA Hangar One 面向 700 多名 Google Cloud 客户的活动上发布新的 Gemini agent,称其为统一的通用工作智能体,可在单一提示框中回答问题、处理知识工作、生成图像与媒体并编写和运行代码。

    为什么值得看

    Google Cloud 客户大会上发布的通用工作智能体,给出了架构原则与多模型调度的设计取舍。

  20. 国际大厂AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amazon 停产 Fire 平板,转向搭载原生 Android 的 Alexa Tablets

    Amazon 消费电子负责人 Panos Panay 向 Bloomberg 确认,Fire 平板品牌将被淘汰,取而代之的 Alexa Tablets 改用原生 Android 系统并完整支持 Play Store 及 Google 官方应用。Panay 称 Fire 平板线"没有给到用户想要的东西",Amazon 仍会为 Fire 平板提供安全更新,但不再有硬件更新。

  21. Fireworks AI(@FireworksAI_HQ)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Zeta Global 发布 Athena Inference Model(AIM),基于 Fireworks 与 NVIDIA Nemotron 构建

    Zeta Global 发布 Athena Inference Model(AIM),与 Fireworks AI 合作、使用 NVIDIA Nemotron 开发。同期推出企业智能操作系统 AthenaOS 和 Athena MCP,首日即集成 ChatGPT、Claude、Palantir 和 Gemini,并宣布与合作伙伴以轻资本方式推进专用芯片的早期工作。

  22. 技术前沿AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Goodfire 推出“由内而外”的 AI 智能体监控器,成本仅为传统方案零头

    Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。

  23. DeepLearning.AI(@DeepLearningAI)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本周 AI 快讯:Gemini 4 Argon 追平 GPT-6 Astra,Mistral Large 4 将开源

    Google Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上以 53 分追平 GPT-6 Astra,单任务成本约为后者 60%。

10月8日周四
  1. The Keyword (blog.google)AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Play Play Fest 10 月 13 日开启:抽奖、电竞联赛与每日优惠

    Google Play 将于 10 月 13–19 日举办 Play Fest,Play Points 会员可用积分兑换抽奖机会,奖品包括 1:1 Scale 2026 Replica Season Racing Helmet - Oscar Piastri、XREAL AURA Glasses 和 Samsung Galaxy Z Fold 8 Ultra 等。

  2. Philipp Schmid(@_philschmid)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SynthID Detector 公开上线,支持 Nano Banana 2.1 与 OpenAI、NVIDIA、Kakao 内容核验

    SynthID Detector(synthid.com)现已公开上线,可核验图片、视频或音频是否由 AI 生成。用户上传或粘贴文件后,网站会扫描来自 Google 及其合作伙伴的水印,文件在扫描后立即删除。该工具支持 Nano Banana 2.1、OpenAI、NVIDIA、Kakao,Apple 也将很快加入。

  3. TechcrunchAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Waymo 获 Blackstone 与 PIMCO 提供的 50 亿美元贷款,用于扩大 robotaxi 业务

    Waymo 与 Blackstone、PIMCO 达成 50 亿美元贷款协议,用于推动 robotaxi 业务扩张。这是这家 Alphabet 旗下公司首次采用债务融资方式。

  4. TechcrunchAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布 AI Edge Foresight 应用,以端侧 AI 离线记会议笔记

    Google 发布 AI Edge Foresight 应用,对标 Granola,主打离线会议记录。它能在设备端完成对话转写、生成笔记并回答问题,全程依赖端侧 AI。

  5. myFT followingAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    英国不能浪费其 DeepMind 红利

    本土资本短缺与美国吸引力正威胁英国最大 AI 研究成功案例 DeepMind 所带来的收益。文章指出,英国面临国内资本不足的问题,DeepMind 的成果红利可能因此流失。

  6. The Keyword (blog.google)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布面向工作的通用 Gemini agent

    Google Cloud 在 Gemini at Work 2026 上发布 Gemini agent,一款面向工作的通用智能体。用户可在单一提示词窗口内完成知识工作、问答、内容创作和编码等任务,它自行规划工作、调用技能与工具、连接客户的业务系统,并把结果交付到已有的文档、邮箱和开发者环境中。该 agent 会自动选择合适模型,内置成本管控,并提供企业客户所需的安全、管理和治理能力。

  7. Google Cloud BlogAI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    爱尔兰品牌如何用 Gemini Enterprise 规模化落地智能体 AI

    爱尔兰政府机构、老牌企业与初创公司正用 Gemini Enterprise 把智能体 AI 从早期原型推进到生产部署,覆盖对话式智能体、自然语言数据分析等能力。

  8. Google Cloud BlogAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Public Sector 与 SUNY 联合推出 SUNY AI Platform,基于 Gemini Enterprise 加速大学科研

    Google Public Sector 与纽约州立大学(SUNY)在 Gemini at Work 上宣布合作推出 SUNY AI Platform,一个基于 Google Cloud 与 Gemini Enterprise 的安全 AI 和高性能计算环境,首批覆盖 SUNY 九所研究密集型校区。

  9. Google Cloud BlogAI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布面向中小企业的 Gemini agent

    Google Cloud 宣布推出新的 Gemini agent,定位为面向中小企业员工的通用工作智能体,目前处于中小企业客户早期访问阶段,之后将向所有客户开放。

  10. Google Cloud BlogAI 评估 · 88/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Cloud 发布 Gemini agent:面向工作的统一智能体

    Google Cloud 在 Gemini at Work 2026 上发布 Gemini agent,一个面向工作的统一智能体,可回答问题、处理知识工作、生成图像媒体并编写运行代码,全部通过单一提示框和单一 API 完成。

    为什么值得看

    Google Cloud 把 Gemini 从模型入口升级为统一工作智能体,读者可据此判断企业级 Agent 平台的竞争格局与落地条件。

  11. InfoQAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Spotify Ads AI 多智能体平台的实战模式与踩坑

    Spotify Ads 高级工程师 Pratik Rasam 披露了 Spotify Ads Manager 内部的多智能体广告生成平台 Ads AI:上线一年来超过 70% 的广告使用 AI 工具,已为 7000 多家广告主生成约 20000 个创意素材。

  12. DeepTech深科技AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Biohub 联合美国能源部、NIH、Google DeepMind 等扩容虚拟生物学计划,投入约 18 亿美元

    10 月 7 日,扎克伯格与普莉希拉·陈支持的 Biohub 宣布扩大虚拟生物学计划,联合美国能源部、NIH、Google DeepMind、Isomorphic Labs 和 Meta 等,汇集约 18 亿美元资金、数据、算力与实验测量资源,建设面向下一代生物学 AI 模型的开放数据基础设施。

  13. 机器之心SOTA模型AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,Mistral 开放 Mistral Large 4 公开预览 API

    Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,面向摘要、上下文压缩、数据库查询和分类等高频任务,是首款支持可调推理强度的 Haiku 模型,提示词不超过 10 万 Token 时每百万输入、输出 Token 分别为 0.10 美元和 0.50 美元,当前未开放模型权重。

  14. LovartAI(@lovart_ai)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovart 对比 Nano Banana 2.1 与 GPT Image 2.5 的人像生成效果

    LovartAI 发布 Nano Banana 2.1 与 GPT Image 2.5 的人像生成对比图,称 Nano Banana 2.1 在光影和皮肤质感上大幅领先。

  15. MIT Technology ReviewAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MIT Technology Review:机器人领域的 AI 突破短期内不会改变你的生活

    尽管 Elon Musk 称 Tesla 的 Optimus 人形机器人未来可能以每台低至 2 万美元的价格自动化几乎所有人类劳动,并预测 2027 年底前面向公众销售,但许多机器人研究者对此持怀疑态度。

  16. 国际大厂AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    谷歌开源 EmbeddingGemma 2:740M 参数支持本地多模态检索

    谷歌于 10 月 6 日开源 EmbeddingGemma 2,这是其首个原生多模态开源嵌入模型,可把文字、代码、图片、视频、音频放进同一个 768 维空间并用一句话检索。

  17. 硅星人ProAI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 为何越来越不说人话:从 Coding 过拟合到文言文式压缩

    开发者吐槽 Claude、GPT 等模型在 Coding 场景输出"15/15全绿""单腿哑火"等黑话,语言能力明显倒退。Coding 过拟合与 CoT 压缩是主因:为省 Token,模型思维链被简化成"穴居语",Token 消耗量比白话文少 70%,Claude 自 Opus 4.6 后也改为非自然语言思维链。