Demis Hassabis 转任 Google DeepMind 主席兼 Alphabet 首席科学家
Demis Hassabis 宣布卸任 Google DeepMind 日常管理职责,转任 Google DeepMind 主席兼 Alphabet 首席科学家,将聚焦长期战略与加速科学突破,包括在 Isomorphic 推进疾病治疗研究。
Demis Hassabis 宣布卸任 Google DeepMind 日常管理职责,转任 Google DeepMind 主席兼 Alphabet 首席科学家,将聚焦长期战略与加速科学突破,包括在 Isomorphic 推进疾病治疗研究。
Sundar Pichai 宣布 Google DeepMind 团队调整:Demis Hassabis 升任 Google DeepMind 主席兼 Alphabet 首席科学家,同时继续领导 Isomorphic Labs;Koray Kavukcuoglu 升任 Google DeepMind SVP,负责模型研发、GDM 研究以及 Gemini app 与开发团队。
Patrick Loeber 在 X 上分享了一个指向 google-gemini GitHub 仓库的短链接,附带 xgo.ing 的互动数据:0 条回复、1 次转发、6 个点赞、1219 次浏览。
Gemini API 现已提供 skills,可用来构建应用。发布者称这是目前用 Gemini 构建应用最简单的方式,但未披露 skills 的具体功能、版本或调用方式。
SpaceX 在 2026 年第二季度财报电话会上公布营收 78 亿美元、同比增长 92%,调整后 EBITDA 为 35 亿美元、同比增长 191%。
NotebookLM 已向 100% 的 Pro 用户推出升级版 Notebook 体验,官方称整个流程都能感受到改进。升级内容包括更智能的聊天交互、可生成图表、PDF、表格和图像等新输出,以及只需一个粗略想法和几个问题即可启动的智能体式研究。
Gemini 现在可以同时调用 Google Maps 和 Google Search 两个工具,Gemini 3.5 Flash 与 3.6 Flash 已支持该组合。Logan Kilpatrick 称这项 Gemini API 更新此前长期排在待办列表中,并演示了基于 Google Maps 工具构建的示例应用。
拾象基于硅谷密集访谈梳理 post-training 数据供应链,把 human data、RL 环境、RLaaS 与真实世界数据放在同一框架下。
NotebookLM 宣布更强的 Notebook 体验已 100% 向所有 Pro 用户全量推送,并给出学习、商业、个人场景的示例查询,如生成递进难度的测验、将讲座笔记转为含练习题的 PDF 学习指南、预测房产市场趋势并建模。官方称免费用户也可使用这些提示词,并建议收藏该帖。
Google 公布 Gemini X Prize,详情可在 geminixprize.com 查看。该消息由 Google AI Developers 账号发布,未披露具体赛制、奖金或参与方式。
Google 展示了如何用其生态构建并部署 AI 原生应用,相关演示面向 Build with Gemini @XPrize Hackathon,该活动持续至 8 月 17 日。视频内容聚焦于创意规划完成后的应用搭建与上线环节。
多伦多大学、Vector Institute、剑桥大学与ServiceNow的研究者构建出一款由AI模型驱动的原型计算机蠕虫,可利用被感染机器的GPU运行开放权重LLM进行推理,并自主发现漏洞、发动针对性攻击与自我复制。
名为 spam hunter 的项目把繁琐的 Google Business Profile 垃圾信息追踪做成 Claude Skill,可自动调查可疑商家列表并把证据整理成可直接提交给 Google 的报告。该工具由 Mike Blumenthal 贡献。
Google AI Developers 在 X 上发布消息,引导用户前往 geminixprize.com 获取更多详情。除该链接外,帖文未披露活动规则、奖品或参与方式等具体信息。
Google 发布视频演示如何用 Google 生态构建和部署 AI 原生应用,面向 Build with Gemini @XPrize Hackathon,活动持续至 8 月 17 日。视频展示从规划想法到落地部署的完整流程。
Google AI 汇总了近期多项发布。Gemini Robotics 2 由 Google DeepMind 推出,为机器人带来全身智能;Gemini 3.5 Flash-Lite 是速度最快。
Jeff Dean 在 Startup School 2026 与 YC 的 Sanjay Ghemawat 对谈,回顾 2001 年算出 Google 搜索索引可全部放进 RAM、2013 年从"每用户每天三分钟语音识别"的推演催生 TPU。他谈到 AI 智能体将连续运行数周、长时智能体失败的原因,以及推理硬件是下一个专门化方向、上下文工程是下一前沿。
Google 宣布从今天起把最新图像生成能力带到网页版 Google Earth,由 Nano Banana 2 驱动。用户可放大地点后点击 “create image”,用文本提示词结合卫星与 3D 影像重新想象全球各地场景,功能现已面向所有人开放。
Google DeepMind 发布 Gemini Robotics 2,这是一套面向机器人的新一代物理 AI 模型。官方称机器人现在可以推理每一个动作,完成此前无法实现的任务,例如系精细的绳结,并支持多机器人协作解决复杂工作流。该系列还为人形机器人带来全身智能与更高级的灵巧操作能力。
DeepMind 官方发布 Gemini Robotics 2,点出全身智能、精细操作与多机器人协作三项能力。
Google 推出用 Gemini API 或 Google AI Studio 构建物理智能体的方案,主打更智能、更安全。原文未披露具体模型版本、参数规模或性能数字,细节见其官方博客。
Google 发布 Gemini Robotics ER 2,称其为面向物理 AI 能力最强的具身推理模型,定位为机器人的高层大脑,可直接连接 Gemini Live API。该模型处理连续视频流以跟踪进度、调用工具、搜索网页并实时指挥动作模型,面向开发者新增进度跟踪增强、执行中途故障实时检测、多机器人协作和安全指令遵循等升级。
Google DeepMind 推出 Gemini Robotics 2,作为驱动新一代机器人的智能层,支持全身智能控制、高级灵巧操作和多机器人协作。新发布的具身推理模型 Gemini Robotics ER 2 充当机器人的高层大脑,负责观察环境、推理完成任务所需动作并与视觉-语言-动作模型协同执行,同时跟踪进度,使机器人能够完成复杂多步工作流、在步骤失败时自我纠正并适应全新场景。
Google DeepMind 发布 Gemini Robotics 2 系列,读者可了解机器人全身控制与具身推理的新分工。
Google DeepMind 发布面向机器人具身推理的 Gemini Robotics ER 2,可通过 Gemini API、Google AI Studio 公开使用,并在 Gemini Enterprise Agent Platform 上开启私密预览。
Google DeepMind 发布 Gemini Robotics 2,并展示了机器人之间协同工作的能力。
Google DeepMind 发布视频,介绍 Gemini Robotics 2 具备高级灵巧能力。材料仅提供标题,未包含正文与其他细节。
Yann LeCun 指出,业界从事的基础研究远少于大学。Bell Labs、IBM Research、Xerox PARC 等工业实验室曾做出重要科学贡献,但这一传统在 1990 年代消失;微软研究院在 2000 年代接棒,Google 与 Meta 随后跟进约十年。他认为这些机构的创新几乎都建立在学术工作之上,并受益于整个研究生态。
马斯克在《经济学人》访谈中预测,AI 可能在 5 年内超过人类智能总和,10 年内进入超级智能时代,届时人形机器人驱动的"准无限经济"将使金钱在 2036 年不再重要,工作变成类似"园艺"的可选项。他仍估计 AI 消灭人类的概率在 10% 到 20%,建议领先公司互相提供一到两周的前沿模型早期访问测试。
Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并在 Google Flow Music 中上线。官方称该模型在音乐性、歌词和人声质量上均有提升,包括更丰富复杂的旋律结构、提示词遵循与结构感知更好的歌词、更具情感表现力和发音更准的人声,同时可更便捷地控制输出的节奏与时长。
Google AI 在 X 平台发布一篇长文(x.com/i/article/2082…),该帖获得 2721 次点赞、393 次转发、60 条回复,浏览量约 20.9 万。
Gemini API 的 Managed Agents 即将加入环境钩子(environment hooks)、模型选择和免费额度访问。Google AI Studio 发布了这一更新预告。
Weaviate 发布教程,演示跳过转录直接对音频做嵌入和检索。流程包括把原始音频切成重叠片段、用 Gemini Embedding 2 生成多模态嵌入向量、存入 Weaviate 并支持文本或音频查询检索相关片段,最后用 Gemini 3 Flash 基于检索到的音频生成回答。示例使用 Robert Frost 诗歌《Birches》的录音,同一方法可用于播客、访谈、课程和通话录音等音频集合。
Google DeepMind 发布 Gemini Robotics 2,包含三款模型:负责视觉-语言-动作的 Gemini Robotics 2、负责具身推理的 Gemini Robotics ER 2,以及本地运行的 Gemini Robotics On-Device 2。
播客对谈百度智能云 AI 计算首席科学家王雁鹏,讨论从模型时代到 Agent 时代的底层技术演变。他认为这一代 AI Infra 与上一代不同,是以 GPU 为核心构建,需要以 CPU 消耗窥见 Agent 诞生的真实价值,并梳理 Anthropic、OpenAI、Google 的路线差异以及国内多芯适配与开源生态的两大差异。
Google 用 Gemini 3.5 Flash-Lite 演示大规模重复性视觉任务,在 100 万+ 张商品目录图片上批量提取原始特征并转化为干净的结构化数据。该模型以低延迟和 token 效率满足大规模工作流需求。
Google AI Studio 现已支持设置自定义 URL,按先到先得方式分配。作者已抢先注册 patloeber.ai.studio,并用它搭建了一个极简作品集/CV 页面。
Google Gemma 本周下载量突破 9 亿次,官方称即将达到 10 亿。博主 Patrick Loeber 同期发布博客,介绍如何将 Gemma 4 作为本地编程智能体运行。
Gemma 4 模型下载量已超过 3 亿次,整个 Gemma 开源模型系列的累计下载量则突破 9 亿次。这一数据由 Demis Hassabis 发文澄清,并引用了 Olivier Lacombe 关于 Gemma 模型家族跨过 9 亿次下载里程碑的推文。
Gemma 模型家族累计下载量突破 9 亿次,Sundar Pichai 转发该里程碑消息并配文"1B next!",指向下一个 10 亿次目标。该数据由 Olivier Lacombe 披露。
Demis Hassabis 表示强大且安全的开放生态对全球受益于 AI 很重要,Google 已从 Jax、Transformers、AlphaFold 到 Gemma 开放模型持续贡献开源与科学,Gemma 系列下载量已超 3 亿次。他同时提到其提出的标准框架支持开放与专有模型的责任部署,并转发黄仁勋签署的公开信称世界需要前沿闭源与前沿开源模型并存。
Sundar Pichai 代表 Google 表态支持英伟达签署的开放模型公开信,并称 Google 长期受益于开源、也是开源的重要贡献者,通过 Google DeepMind 持续开放 Gemma 权重模型。该公开信由黄仁勋首次发帖分享,主张开放模型能强化安全与网络安全、加速创新与扩散并支撑主权需求,世界需要前沿闭源与前沿开源模型并存。