Gemini API 推出 Files API,支持在智能体环境中上传、检视与下载文件
Gemini API 新增 Files API,用于在智能体环境中进出数据:可用 `files.upload()` 内联注入文件或在对话中途上传数据,用 `files.list()` 查看生成文件与目录大小,用 `files download()` 下载 artifacts、仪表盘、报告、CSV 或 git 仓库。沙箱可通过 `environment_id` 跨轮次持久保留。
Gemini API 新增 Files API,用于在智能体环境中进出数据:可用 `files.upload()` 内联注入文件或在对话中途上传数据,用 `files.list()` 查看生成文件与目录大小,用 `files download()` 下载 artifacts、仪表盘、报告、CSV 或 git 仓库。沙箱可通过 `environment_id` 跨轮次持久保留。
Gemini API 推出 Credentials API,用于安全认证外部服务和 MCP 服务器,模型全程看不到真实密钥。用户可通过 `credentials.create()` 一次性注册密钥,支持 `bearer_token`、`environment_variable` 和带自动刷新与令牌轮换的 `oauth2`。
Google 发布新版 Gemini 托管智能体,带来更好的缓存、更低的成本,并新增 Files API 和 Credentials API。官方称成本最高降低 30%,缓存命中率最高提升 22%;Files API 支持在沙箱中上传、列出和下载文件,Credentials API 为 MCP 服务器、OAuth2 和第三方 API 提供安全出口代理。
Gemini Notebook 移动应用的相机功能支持拍摄照片后生成详细报告,Steven Johnson 在 Sierras 实地研究时用其拍摄博物馆展板,得到的文本转录经本人核查准确率约 99%。他计划为所有拍摄照片批量生成此类文档,再让 Notebook 标出对已有资料库有新增价值或与当前写作大纲相关的内容。
Google DeepMind 宣布 AlphaGenome Atlas 现已免费开放,供全球研究者探索数据库以解码疾病的遗传成因。官方称这些发现只是开始,并提供了访问入口。
Google DeepMind 与 ScienceStowers 合作构建 Atlas,绘制了 2500+ 调控模式,找到充当生物开关和音量旋钮的 DNA 序列,可在数百种细胞类型中上调或下调基因活性。
Google DeepMind 与埃克塞特大学合作,用 AlphaGenome Atlas 分析 UK Biobank 超 5.4 万名参与者的数据,罕见遗传信号的检出率提升 22% 以上。该工具还发现了影响 PLA2G7 蛋白丰度的新 DNA 变异,而 PLA2G7 与代谢健康相关。
Broad Institute、埃克塞特大学等机构的研究者已在使用 AlphaGenome Atlas,以更好地识别潜在的致病 DNA 变异并解读其作用。该工具由 Google DeepMind 推出,用于变异识别与功能解读。
Google Cloud AI Builder Cup 报名开启,面向亚太区开发者,报名截止至 10 月 11 日。赛事设 30,000 美元奖金池,决赛将在新加坡举行。
在 Claudian 中使用 Gemini 3.8 flash 写稿,思考时间基本在 20s 以内,随后快速持续输出。该体验由用户 @PMbackttfuture 分享,原帖附有演示视频,互动量约 20 条回复、4 次转发、56 个点赞、18500 次浏览。
Richard Ngo 提出用「有序疏散 vs 踩踏」类比 AI 发展:对齐难相当于门被卡住,而即使对齐本身不难,人群挤压冲向出口时开门也会难得多。他认为这一类比优于「军备竞赛」,并指出 AI 行业目前仍处「人群推搡前行、几乎无人重伤」的阶段,还有时间化解羊群心态。
2026年度CCF-百度松果基金申报将于9月20日23:59(北京时间)截止,该基金由CCF与百度于2020年共同发起,已累计支持170余项课题、产出超100项顶级成果。今年基金聚焦基础理论、分布式训练、推理部署、强化学习训练系统、模型结构与预训练、后训练与Agent、数据建设七大方向,计划支持8至13项,每项资助15万至25万元,课题周期为2026年10月至2027年10月。
Unsloth 放出配套免费 Google Colab Notebook 与 GitHub 仓库,并提供专门文档页,供用户上手其微调流程。
作者提示可以在免费的 Google Colab 中微调 500+ 开源模型,还能上传 PDF/CSV 把它们变成可用的合成数据集。操作步骤为打开 Colab、运行代码块安装 Unsloth Studio、选择模型、上传数据集,之后即可开始,并可在完成后导出模型。
Gemini 的 Canvas 功能可以让用户编写自定义应用来设计花瓶,通过调整数学参数在 3D 中查看效果,再导出为 .STL 文件用于 3D 打印。该流程把想法直接变成实物。
DeepMind 正式推出 DeepMind Institute,这是一个面向 Google DeepMind 及更广泛研究社区的平台,用于发布和辩论日益强大的 AI 应当如何构建、治理与使用。平台首批上线 4 篇文章,主题涵盖推理透明度、经济政策与人类福祉,发布在 institute.deepmind.com。
Demis Hassabis 分享了一篇简短介绍,进一步说明 DeepMind Institute 的设立初衷,并附上 institute.deepmind.com 的 essays 页面链接。
Demis Hassabis 与 Shane Legg 宣布成立 DeepMind Institute,扩展针对 AI 时代关键议题的跨学科研究。两人称已就 AGI 对经济、科学与社会的影响讨论了 20 多年,希望该机构推动相关讨论,以便为下一步行动做出正确决策。
语音识别领域的竞争正在升温,Google、Meta 和 Microsoft 正通过发布新的强力模型争夺头名位置。DeepLearning.AI 在 The Batch 中解读了这一趋势对 AI 开发者的意义,指出在生成式文本模型占据话题中心的当下,语音识别正迎来属于自己的时刻。
Demis Hassabis 获英国皇家艺术学会(RSA)颁发的阿尔伯特奖章,并在与 @FryRsquared 的对谈中表示,科技带来巨大机遇,但在即将到来的 AGI 时代,艺术与人文学科对塑造社会想要的未来至关重要。
Gemini Live API 迎来更新,新增音频模型。Patrick Loeber 分享了由 @thorwebdev 讲解这些新音频模型的视频,介绍其具体能力。
Richard Socher 表示其即将出版的新书 The Eureka Machine 详细阐述了 AI 将如何大幅加速科学进步,并认为这并非零和博弈、将推动人类发展。
Google Cloud 在 2026 Google Cloud Agentic Commerce Day 上发布《2026 零售电商行业出海实战手册》,从零售电商出海真实业务场景提炼出五个核心洞察。
Varun Mohan 表示 Antigravity 上的 Gemini 3.8 Flash 因高负载出现请求报错,已着手修复并在问题解决后重置速率限制。他随后更新称修复已完成,配额重置已向所有用户推送。
Google 的 Artemis 项目已支持 MCP 集成,因此 Cursor、Cordex、Antigravity、Claude Code 等任意编程智能体都能使用它。GitHub 仓库地址为 github.com/google/artemis。
Google 开源了移动端任务自动化工具 ARTEMIS,可将提示词转为自动化操作,官方称成功率 99%+,并可集成 Codex、Claude Code、Antigravity,支持自动化工作流和日志采集。其路线图提到计划加入端侧 VLM,用轻量边缘视觉模型实现隐私优先的本地执行。
Gemini 3.8 Flash 在 Antigravity 上遭遇高负载,出现请求报错。官方表示正在积极修复,问题解决后将重置速率限制。
Google 公布了以 AI 加速科学、改善生活的进展,聚焦健康、自然灾害与天气韧性、学习、经济机会四个领域。上周进展包括用 AlphaGenome Atlas 绘制人类基因组全部 9B 种单字母遗传变异并开放给研究者,推出迄今最准的全球天气 AI 模型 WeatherNext 3,还发布了开放获取的 AI & Economy ATLAS。目前其服务覆盖近 300 种语言、70 亿使用者。
Google 将于下周在旧金山举办首场 Gemini Audio 体验活动,Logan Kilpatrick 确认出席,报名链接已开放。活动同期可了解其新的 Live audio 模型,详情见官方博客。
Google DeepMind 推出两款面向 Live API 的 Gemini 模型:Gemini 3.8 Live 和 3.8 Live Extended Thinking,官方称其为目前最好的对话式 AI。新模型在智能水平和并行推理上有较大升级,可在对话中思考并在后台处理任务而不打断用户流程,实时语音协作更顺畅自然,可在 ai.studio/live 测试。
Google 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 两款新的 SOTA 实时音频模型,提供前沿的价格与性能。3.8 Live 支持 97 种语言并可在其间无缝切换,同时支持异步工具调用。
该推文仅包含一个指向 blog.google 创新与 AI 板块的链接,未附带任何正文说明,因此无法确认具体模型名称、版本号、参数规模或 benchmark 数据。
Google AI Studio 现已支持通过 live 链接实时试用指定 Gemini 模型,用户可直接访问 aistudio.google.com/live 并带上 model 参数进入体验。
Gemini 3.8 Live 与 3.8 Live Extended Thinking 发布,延续上月 3.5 Transcribe 对实时语音智能体的投入。
Gemini 3.8 Live 公布了实时语音定价与智能体任务得分,可据此判断实时语音智能体的能力与接入方式。
Google 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款 Gemini 音频模型。
Google 宣布 Gemini 3.8 Live 正在推送:消费者端进入 Search Live,开发者端在 Gemini API 中通过 Google AI Studio 开放公开预览,企业端在 Gemini Enterprise 中进入私有预览,并将登陆 Gemini Enterprise Customer Experience。
Google DeepMind 发布两款实时对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,分别面向规模化低成本场景和高复杂度多步推理任务。
Google DeepMind 展示用 Gemini 3.8 Live Extended Thinking 充当编程辅导老师。两款模型均支持升级版推理、近实时视觉理解、97 种语言自动检测,以及不打断对话的后台工具调用。
Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking,称其为该公司最好的对话式 AI。官方表示这两个模型可以对话、思考并在后台处理任务,而不打断用户的流程。
播客「屠龙之术」发布 73 页 PPT《Own Your Intelligence-从模型竞争到智能生产》,分模型竞争、智能分化、循环自生与界面重构四部分。