Gemini 3.8 Flash 正式发布,价格不变并成为默认模型
Gemini 3.8 Flash 正式 GA,这是 6 周内第三次 Flash 发布,官方称其在所有领域整体优于 3.7 Flash,价格保持每 1M token $0.75 / $3.75 不变。
Gemini 3.8 Flash 正式 GA,这是 6 周内第三次 Flash 发布,官方称其在所有领域整体优于 3.7 Flash,价格保持每 1M token $0.75 / $3.75 不变。
该推文仅分享了一个指向 blog.google 的链接,未提供任何正文说明,因此无法确认具体模型、版本或功能内容。
Google 发布 Gemini 3.8 Flash,在智能体与编码能力上较 3.7 Flash 有显著提升,且价格与 3.7 Flash 保持一致。
Google 最新 Gemini 3.8 Flash 模型今日起面向 Pro 和 Ultra 用户开放。该模型主打更可靠、更全面的回答,可处理日常话题的实用建议,以及文本分析、复杂编程等深度任务。
Gemini 3.8 Flash 已通过 Gemini API、AI Studio、Antigravity、Gemini App 等渠道开放使用,价格与速度均与 3.7 版本基本持平。发布方称团队正持续推进,力求站上前沿。
Google 发布 Gemini 3.8 Flash,官方称其在智能体和编码能力上再次提升,这是 6 周内第三次更新的 Flash 模型。发布者表示该模型上手体验不错,期待用户反馈。
Google 发布 Gemini 3.8 Flash,定位为面向复杂智能体和多步骤任务的最智能主力模型,在推理上有明显提升,可处理模糊且高摩擦的任务并参与复杂项目。3.8 Flash 提供一贯的 effort 控制,让任务所需的思考量与 tokens 消耗成比例。官方演示中,它结合原生视频理解与高级编码,在 @antigravity 中自主构建 3D 游戏、试玩找错并在智能体循环中执行代码修改。
Google AI 宣布该能力面向 Google AI Pro 和 Ultra 订阅用户开放,覆盖 Gemini App、Google Search 的 AI Mode 和 Google Sheets。
Google DeepMind 发布两款新 Gemini 模型。Gemini 3.8 Flash 官方称为目前最智能的模型,在软件工程、智能体任务和多步推理上较 3.7 Flash 有明显提升;Gemini 3.8 Flash Cyber 面向网络安全,具备前沿水平的漏洞检测与自动修复能力。
Google DeepMind 推出 Fairwind Program,面向政府和可信合作伙伴开放 3.8 Flash Cyber,用于保障关键基础设施和国家安全。
DeepLearning.AI 汇总称,多家头部 AI 公司正把推理速度当作值得付出成本的架构要求。
Gemini 推出智能体视频理解(agentic video understanding)功能,可让模型对视频进行智能体式理解。@MaartenGr 制作了一支视频解说,讲解其工作原理。
播客「科技早知道」复盘 8 月初谷歌人事地震:Google DeepMind 创始人 Demis Hassabis 卸任 CEO,转任 DeepMind 董事长和 Alphabet 首席科学家;在谷歌工作 27 年的 Jeff Dean 与另外三位核心成员离开,创办面向科学发现的 AI 公司 Discovery Loop,消息公布当天 Alphabet 股价下跌 4%。
OpenAI 与 Cerebras 预览 Ultrafast,这一 API 服务层运行在 Cerebras 硬件上,搭载 GPT-5.6 Sol,宣称每秒最高输出 750 个 token;Artificial Analysis 在 OpenAI 自家 API 上以最高推理强度测得 GPT-5.6 Sol 为每秒 65 个 token。
NotebookLM 的 Short Video Overviews 现已支持 70+ 种语言,并新增 3 种英语变体,可将来源转成约 60 秒的竖屏视频。该功能正在 web 和移动端面向 Ultra 与 Pro 用户推送。
DeepLearning.AI 指出头部 AI 公司正把推理速度视为值得投入的架构要求。OpenAI 与 Cerebras 展示 GPT 5.6 Sol 达到 750 tokens per second。
Gemini 推出智能体视频理解能力,让 Gemini 调用工具并动态分析视频。官方称该方式最多降低 88% 的 token 消耗,成本最多降低 66%,并配套发布了开发者指南。
Google 发布 agentic video 主题的 launch blog,并称 Gemini 在视频理解上继续保持 SOTA。该帖子引导读者前往 blog.google 阅读更多内容,并呼吁继续提供反馈。
Gemini API 推出 Agentic Video,用于处理长视频,最多可降低 88% 的 token 消耗,同时提升质量。该能力可按单个视频在 API 中控制,已在 3.7 Flash 等最新模型上提供。
Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 现已支持智能体视频理解,即日起可通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 上处理视频上传和 YouTube 视频。更多细节见官方博客。
Gemini 3.7 Flash 借助新的智能体视频理解能力,能准确识别并数清每一次拍手。由于静态处理默认以固定 1 FPS 读取视频,拍手这类瞬间动作容易被漏掉或与响指、点击声混淆,新能力会按需自动调整处理速度。
Gemini 的视频理解改为智能体方式,可自行在时间轴上迭代导航,决定看什么内容、选择帧率,并判断回答提示词是否需要语音转录、音频或视觉帧。官方给出的结果是长视频最多减少 88% 的 token、成本降低 66%,基准准确率提升约 7%。
Google DeepMind 宣布 Gemini 推出智能体视频理解能力,不再扫描整个文件,而是跨视频字幕、音频和画面进行推理,并动态调整帧率以提取所需片段。
Google DeepMind 为最新 Gemini 模型引入智能体视频理解能力,模型分析视频的准确率提升,token 用量最多减少 88%。
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出智能体视频理解功能,通过原生视频工具动态搜索、扫描目标片段,替代固定帧率的静态处理方式。
原文给出 token 与成本降幅及基准表现,读者可据此判断长视频分析的落地成本变化。
Logan Kilpatrick 与 Google DeepMind 负责人 Koray Kavukcuoglu 对话,讨论通往 AGI 的路径、3.7 Flash 的进展,以及团队为何聚焦前沿。
Google Research 推出 TimesFM-3,这是一个时间序列基础模型,可在单次前向传播中完成多变量时间序列预测,在主要基准上显著优于其他预测模型。该模型已在 GitHub 和 Hugging Face 上线。
Epoch AI 发布 FrontierMath Erdős 基准,由 Thomas Bloom 从 erdosproblems.com 未解问题中挑选 68 道兼具数学意义与难度的问题,其中 50 道已由 Google Formal Conjectures 项目完成 Lean 形式化。
Gemini Omni 1.1 Flash 现可让你从视频结束的位置继续延展,把在 Gemini 中创作的视频无缝接续,构建连贯、动态的故事线。该功能由 Gemini App 官方账号公布。
Gemini 现已集成到 Waymo 车内,坐在座位上按下屏幕上的 Gemini 图标即可用语音免手控调节座舱,或了解周边环境信息。Gemini 完全独立于 Waymo Driver 运行,在你主动使用前始终保持不活跃状态。
Google Gemini App 公布本月 Gemini Drops 更新,包括改进的学生资源、用 Gemini 3.7 Flash 处理多步骤任务,以及通过 Gemini Live 委派待办事项。
Google 发布两款面向转写和语音识别的新模型 Gemini 3.5 Transcribe 与 Gemini 3.5 Transcribe Live。前者用于转写已录制音频,支持说话人归属和词级时间戳;后者用于构建实时语音应用。
Google 本周发布 Gemini 3.5 Transcribe,官方称其为目前最精准的语音转文字模型,主打智能转录。同时发布 Gemini Omni 1.1 Flash,为视频生成与编辑带来更多创作能力和控制选项。
Google DeepMind 正在推出 Gemini Omni 1.1 Flash,目标是让生成视频具备更高的可控性、更快的迭代速度,并更精细地适配生产级使用。官方表示可在 Flow by Google 等入口试用,并附有详情链接 goo.gle/4zHEzJ2。
随着模型能力提升,网络攻击将更复杂,防御方采用技术的速度必须快于攻击方。Anton Osika 因此支持 OpenAI 发起的集体网络防御倡议。该公开信已获包括 Anthropic、AWS、Google、Microsoft、OpenAI 和 Oracle 在内的 100 多家组织签署。
Gemini 面向全球 Google AI Plus、Pro 和 Ultra 订阅用户开放场景延展(Scene extension)功能。用户在工具菜单中选择“Create video”,创建或上传视频后,可让 Gemini 按指定后续情节“extend the scene”延展场景。
Gemini Omni 1.1 Flash 新增场景延展能力,用户可创建或上传视频后让 Gemini 从画面中断处继续续写,从而生成更长的故事或分叉出新的创作方向。该功能由 Google Gemini App 公布。
NotebookLM 目前先从书籍开始支持用户添加来源,未来还将支持第三方订阅、商业研究报告和教材等更多类型。官方同时邀请用户分享自己发现的书籍。
Google 推出跨部门项目 Expert Intelligence,让用户在 Gemini Notebook 中结合可信来源与专家内容,首批支持符合条件的 Google Play 电子书。用户可将喜爱作者的专业知识与其它来源组合,以全新方式与书籍互动。目前该功能已开放试用。
Google Gemini 宣布 Gemini Live 已在全球范围内免费提供。官方说明指出,各项集成功能的可用性、兼容性和年龄限制因地区而异,部分场景可能需要完成设置或订阅;具体使用方式可在其博客中查看。