Google DeepMind 用 AI 重构 50 年的鼠标指针,Gemini 原型上线 Google AI Studio
Google DeepMind 正在用 AI 重新设计已有 50 年历史的鼠标指针,实验性 demo 让用户通过动作、语音和自然简写直观地在屏幕上指挥 Gemini 完成任务。该原型已在 Google AI Studio 上线试用,Demis Hassabis 称其体验"相当神奇"。
Google DeepMind 正在用 AI 重新设计已有 50 年历史的鼠标指针,实验性 demo 让用户通过动作、语音和自然简写直观地在屏幕上指挥 Gemini 完成任务。该原型已在 Google AI Studio 上线试用,Demis Hassabis 称其体验"相当神奇"。
Google DeepMind 发布基于 Gemini 的多智能体 AI 系统 Co-Scientist,并在 Nature 发表研究,通过生成、辩论、进化三个阶段迭代产出科学假设。
Demis Hassabis 发布了一条附带阅读链接的推文,指向 bit.ly/4v2OI03,未在推文中说明具体内容。该条推文获得 562 次点赞、52 次转发和 15 条回复。
Demis Hassabis 宣布 Isomorphic Labs 获得 21 亿美元新融资,用于加速以 AI 重塑药物研发、最终攻克所有疾病的使命。他称 AI 的第一大应用应是改善人类健康,这一方向始于 AlphaFold,如今在 Isomorphic Labs 延续。
前Anthropic、现Google DeepMind研究科学家姚顺宇参与过Claude 3.7、4.5和Gemini 3的开发,他在访谈中称AI个人英雄主义时代已经过去,现在是集体主义的故事,并对神话个体的叙事保持警惕。他认为"智能涌现"本身不科学,更多是主观感觉而非客观现象,本质是技术上实现了可水平提升所有能力的scale up。
Demis Hassabis 表示到访 Google 韩国办公室,并与韩国团队共度了一段时间。
Demis Hassabis 晒出 2016 年与 2026 年韩国广告牌对比,感叹这十年变化之大。
Demis Hassabis 发文纪念 AlphaGo 问世十周年,称上周在韩国与李世石重逢,并和申真谞进行了一盘特别对局。他表示回顾 AlphaGo 十分感慨,也很有兴趣听到它如何改变了棋手对围棋的理解方式。
Google DeepMind 宣布与 Fenris Creations 达成研究合作,将太空沙盒网游 EVE Online 作为 AI 研究的试验场。Demis Hassabis 称游戏一直是 Google DeepMind 历史的重要组成部分,EVE Online 是有史以来最出色的游戏之一并拥有出色的社区。他将与 Hilmar Veigar 及团队展开合作。
NotebookLM 上线信息源自动标注功能,当笔记本内超过 5 个来源时,来源列表上方会出现 auto-label 按钮,模型会通读全部来源并整理为高层级分类,来源可按主题重叠获得多个标签。标注后来源面板可折叠显示顶层分类并展开查看对应来源,支持重命名、删除标签和添加 emoji 区分。在来源面板右侧选中某一分类后,聊天回答将仅基于该标签下的来源,也可用于生成播客等 studio 内容。
Google DeepMind 发布 AlphaEvolve 一年进展汇总,展示这款 Gemini 驱动的编码智能体从数学与计算机科学开放问题扩展至多个领域。
在 5 月 6 日的 Code with Claude 旧金山场,Anthropic 兄妹 Dario Amodei 和 Daniela Amodei 同台对话,Dario 称公司原本按每年 10 倍准备算力,但 2026 年第一季度增速年化约 80 倍,这是 Claude 一直限速的直接原因,他直言 80 倍太疯狂、希望回落到 10 倍。
NotebookLM 已向 100% 用户全量推送来源自动标签与分类功能,当来源达到 5 个以上时会自动归类。用户还可重命名、重新组织来源,并用 emoji 进行个性化标记。
NotebookLM 思维导图今日推送更新,新增自定义功能,用户可用特定提示词引导地图生成,并可即时重命名和分享地图。节点间切换过渡也做了流畅度优化。
Demis Hassabis 在 Sequoia AI Ascent 与 Konstantine Buhler 进行炉边对话,视频已获授权公开。他谈到游戏作为 AI 训练方式、创办 Google DeepMind、DeepMind 与 AGI 以及 AI for Science 等话题,并提及其最爱的书是关于万物理论、其毕生工作横跨桌游到诺贝尔奖级科学。
Demis Hassabis 在 Y Combinator 的 How to Build the Future 节目中与 Garry Tan 对话,讨论通往 AGI 还缺什么,并指出记忆问题至今仍未解决。他还谈到 AlphaGo 如何影响 Gemini、小模型为何越来越强、持续学习与 AI 智能体的未来,以及从 AlphaFold 走向虚拟细胞。他建议创始人思考在 AGI 到来之前该构建什么。
Epoch AI 的 AI Chip Sales 数据集显示,截至 2025 年底五大芯片设计商累计出货约 2000 万颗 AI 芯片,Nvidia 占约一半销量和超过 66% 的 AI 算力。
NotebookLM 宣布其笔记本功能在 Gemini App 中面向移动端的免费和付费用户正式开放,欧洲更多国家即将上线。用户可直接在 Gemini App 内访问个人未共享的笔记本,也能把与 Gemini 的对话作为新笔记本或已有未共享笔记本的来源。该功能此前已面向 Google AI Ultra、Pro 和 Plus 订阅者在网页端推出,未来数周将扩展到移动端、更多欧洲国家和免费用户。
NotebookLM 宣布其笔记本功能在 Gemini App 中正式面向移动端免费与付费用户开放,欧洲更多国家即将上线。用户可在 Gemini App 内直接访问所有个人未共享笔记本,并将与 Gemini 的对话作为新笔记本或已有未共享笔记本的来源。该功能当天起先在 Web 端面向 Google AI Ultra、Pro 和 Plus 订阅用户推送,未来几周扩展至移动端、更多欧洲国家和免费用户。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生监督下辅助患者诊疗的“三方协作”模式。
Demis Hassabis 转发 Logan Kilpatrick 的推文,后者称「Google is the best company in the world」。原推文仅附一句「Not bad at all… 😀🚀」及引用推文链接,未披露更多技术或产品信息。
Google DeepMind CEO Demis Hassabis 在 Y Combinator 的直播访谈中表示,当前预训练加 RLHF 加思维链的范式几乎确定会成为 AGI 架构的一部分,但仍有 50% 概率需要一两个尚未发现的关键突破,持续学习、长程推理和记忆是三个未解问题。
Google DeepMind 与韩国科学技术信息通信部签署 MoU,围绕利用 AI 加速科学发现、培养韩国下一代人才展开合作。双方将具体推进科学技术合作、人才培养与 AI 安全三方面工作,签约在十年前 AlphaGo 对弈举办地首尔四季酒店进行。
Andrej Karpathy 在 Sequoia Capital 的 AI Ascent 访谈中表示,2025 年 12 月后最新模型生成的代码已开始直接可用,他进入凭感觉让 AI 写代码的状态。
Google DeepMind 与韩国科学与 ICT 部(MSIT)达成合作,将在首尔办公室设立 AI Campus,向韩国学界开放 AlphaEvolve、AlphaGenome、AlphaFold、AI co-scientist、WeatherNext 等前沿模型。合作覆盖生命科学、能源、天气与气候领域,并与韩国 AI 安全研究所(AISI)开展安全研究,同时探索面向韩国学生的实习机会。
Google DeepMind 发布论文提出 Decoupled DiLoCo 分布式训练架构,将训练任务拆分为相互解耦的计算岛屿并采用异步数据流,使单点硬件故障不中断其他部分。
播客节目回顾波士顿动力从单腿弹簧机器人到BigDog、Spot、PETMan、Atlas的近半个世纪发展史,并追问机器人如何控制身体、如何学会走路、具身智能意味着什么。节目提到2026年最新Atlas亮相,2027年将部署现代工厂,还谈及Google、软银、现代汽车的几次易主。
Google DeepMind 与 Accenture、Bain & Company、BCG、Deloitte、McKinsey 达成合作,帮助企业规模化落地前沿 AI,合作方将获得包括 Gemini 系列在内的前沿模型早期访问权限。三方合作聚焦金融、制造、零售、媒体娱乐等行业的 agentic 转型,并延续 Google Cloud 此前对咨询与系统集成伙伴的支持。
黄仁勋接受 Dwarkesh Patel 两小时专访,回应了 Nvidia 是否会被商品化、CUDA 是否为技术锁定、TPU 与 Trainium 的竞争以及对华出口管制等问题。他认为 Anthropic 使用 TPU 和 Trainium 是缺乏 Nvidia 早期投资的特殊个案,出口限制挡不住中国 AI 发展反而会推动其芯片自主化,并称推理市场已进入按响应速度分档定价的时代。
Google 的快速高质量文本转语音模型 Gemini 3.1 Flash TTS 已在 Poe 上线,适用于配音、音频内容、无障碍功能以及为智能体工作流添加语音。该模型可在 Poe 全平台应用及 Poe API 中调用。
Google DeepMind 推出 Gemini 3.1 Flash TTS,称其在可控性、表现力和质量上均有提升,并首次引入 granular audio tags,可用自然语言指令控制语音风格、语速和表达。
Claude Code 新增配置向导,自动处理 Amazon Bedrock 和 Google Vertex 的环境变量与配置文件,无需手动编写。Claude Code 还能检测到用户锁定旧模型时,在权限允许下建议升级到新模型。
Nothing 手机与穿戴产品负责人 Shawn 在上海发布会后受访,称 Nothing 的 AI 路线是近未来(AI + 传统产品)与远未来(AI Native)双轨探索。
Poe 宣布 Gemma 4 已在其平台上线,该模型被描述为 Google 目前能力最强的开放模型,拥有 31B 稠密参数、256K 上下文窗口、支持 140 多种语言。它支持多模态输入、内置思维链推理和函数调用,采用 Apache 2.0 许可,可在各平台的 Poe 应用及 Poe API 中使用。
用户可通过 llama-server -hf ggml-org/gemma-4-26b-a4b-it-GGUF:Q4_K_M 启动模型,再用 openclaw onboard --non-interactive 以 custom-api-key 方式完成接入。
苹果将在6月8日召开的WWDC26上首度揭晓与Google合作、用Gemini提升Siri体验的新方案,并计划开放一种全新的AI接入方式,此前只有ChatGPT能接入Siri。播客还讨论了Agentic Software带来的软件形态范式转移,以及它对苹果App Review机制的挑战。
Veo 3.1 Lite 已在 Poe 上线,是 Veo 3.1 家族中成本更低的视频生成模型,支持原生音频,包括同步对白、音效与环境音。该模型同时支持文生视频和图生视频,延续 Veo 3.1 的提示词遵循与场景理解能力,适用于社交短片、产品演示、分镜、短片及快速创意迭代,可在 Poe 全平台应用及 Poe API(poe.com/Veo-3.1-Lite)试用。
OpenAI 总裁 Greg Brockman 在 Big Technology Podcast 中证实下一代预训练基础模型 Spud 已完成预训练,凝聚约两年研究成果,同时将 ChatGPT、编程 Agent Codex 和浏览器 Atlas 合并为统一 Super App,预计未来几个月内交付。
Paul 用 ChatGPT 结合 AlphaFold 为患癌的爱犬设计出一套个性化 mRNA 疫苗方案,被视为 AI 加速个性化医疗的一个缩影。Kevin Weil 借此呼吁,应让这套流程更容易被用于人类,而不只是狗。
Google DeepMind 的 Lyria 3 已在 Poe 上线,可依据文本或图片提示词生成最长三分钟的高保真音乐,并能控制人声、流派、情绪和配器。该功能可用于为视频配乐、歌曲创意原型,或把情绪板变成完整成品曲;Poe 全平台应用及 Poe API(poe.com/Lyria-3)均可试用。