谷歌发布 Gemini 通用工作代理,OpenAI 年化收入不及预期|财经日日评
谷歌云在 Gemini at Work 2026 大会上推出 Gemini 通用工作代理(Gemini Universal Work Agent),可自主规划任务、调用工具并连接企业业务系统。
谷歌云在 Gemini at Work 2026 大会上推出 Gemini 通用工作代理(Gemini Universal Work Agent),可自主规划任务、调用工具并连接企业业务系统。
据 Business Insider 看到的内部文件与聊天记录,Google 正在测试 Argon、Barium、Carbon 三个 Gemini 4 变体,其中 Carbon 已部署在内部编码平台 Jetski 上,被认为在编程任务上强于 Argon,有员工将其比作 Anthropic 最强的编码模型 Opus 5.5,但仍需更多测试。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。
开源项目 REA(Reverse Engineer Anything)把逆向分析工具接到了 Claude Code、Codex、Cursor 这类 AI 编程智能体上。
苹果发布会正逐渐失去“科技春晚”的光环:供应链爆料让新品提前曝光,2020 年后转为提前录制,智能手机进入成熟期后创新更多体现为性能与体验优化。与此同时注意力转向 AI 发布会,2024 年 5 月 OpenAI 发布 GPT-4o、DeepSeek R1 发布都引发大范围讨论。
Google Cloud 在 Gemini at Work 活动上宣布发布 Gemini,定位为面向工作的单一通用智能体,可在同一个提示框中完成问答、知识工作和写代码。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在对话中指出,AlphaFold 的突破只是开始,蛋白质折叠远未解决,静态结构预测无法覆盖蛋白质动态与无序性。
Google 内部正在测试新模型 Carbon,部署在内部 AI 编程工具 Jetski 上,有员工称其编码能力“感觉像 Opus 5.5”。Carbon 是在 9 月 30 日发布的 Gemini 4 Argon(内部版本 Barium-B)之后训练出的新版本,将作为 Argon 升级还是独立发布尚不清楚。
Google DeepMind 的 Pushmeet 与 Biohub 的 Sal Candido 解释,AlphaFold 的突破并未解决蛋白质动力学问题,仅靠扩展 AI 算力和数据不足以理解生物学。他们还讨论了蛋白质语言模型如何隐含结构、功能与进化知识,以及更好的生物数据和虚拟细胞如何推动药物发现提速 10–100x、最终治愈所有疾病。
Google 在 2026 年 8 月的功能更新中为 Google Health App 加入「No Coach Insights」选项,可在保留其他 AI 功能的前提下关闭 AI Health Coach 主动推送的见解。用户也可在设置中彻底关闭 Google Health Coach,此后不再生成新的健身计划、睡眠与健康趋势摘要,也无法通过对话提问或记录进度,但可随时重新开启。
苹果发布会的“科技春晚”地位正在消退,OpenAI、Google、Anthropic 等 AI 开发者大会成为新的关注中心。2026 年 9 月 OpenAI DevDay 发布二十多项更新,重点推出可长期运行的个人 Agent Dots,并新增每月 500 美元会员档位、调整 GPT-6.1 Sol 价格体系,但新能力增量有限、悬念减弱。
Logan Kilpatrick 回应 @StatsWire 称 "Argon is coming, fear not",未透露 Argon 的具体形态、版本或发布时间。该帖互动量达 401 条回复、59 次转发、1435 次点赞,浏览量 272998 次。
Ideogram 4.5 在 Artificial Analysis 的 30 轮连续编辑测试中保持了原图稳定,而 GPT Image 2.5 Sunburst 出现明显漂移。
Google 上线了免费的网页版 SynthID Detector,用户登录 Google 账号后即可上传图片、视频和音频,检测其中是否含有 SynthID 不可见水印,并识别生成所用的 AI 工具。
TypeSafe AI 于 2026 年 9 月 15 日推出 Jev,并宣布获得 DCVC 领投的 4,000 万美元种子轮融资。Jev 不聊天不写文本,接收 state 与 typed questions,返回带校准概率的 Choice、Score 和 Noul 答案,通常耗时 70 到 500 毫秒,输入每百万 tokens 收费 0.042 美元、输出免费。
梳理 Jev 的十类真实用例与每类成本延迟数据,可对照现有 LLM 工作流判断哪些小决策值得下放。
文章指出,2026年5月盖洛普民调显示71%的美国人反对在本地建设AI数据中心,48%为强烈反对,反对率高于核电站的53%。今年前3个月,全美至少75个数据中心项目、总值约1300亿美元的投资被叫停、延迟或取消,加州蒙特利公园市、密苏里州费斯特斯市等地项目均因居民抵制未能落地。
深圳公司 DiffuSpace 连续完成两轮融资,总金额数亿元人民币,创下全球扩散语言模型(dLLM)最大规模融资纪录,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投。
Google 发布 Android Bench 2.0,新增长周期任务(LHT)、智能体评测与连续评分,从原先的二元通过/失败改为按功能、视觉保真度和回归情况计算完成率。其中将跨平台应用移植到 Android 的最佳模型完成率仅 80%,被列为公开难题。榜单显示 Claude Opus 5.5 以 32% 的 LHT 通过率居首,GPT 6 Astra 以 28% 次之。
Alteryx One Live Query 与 Google Cloud BigQuery 集成,可在浏览器中以无代码方式构建数据管道,并通过安全 SQL 下推在 BigQuery 内直接执行转换逻辑。
The Vergecast 新一期节目中,David 和 Nilay 盘点微软、Amazon、Apple 近期推出的新硬件,讨论这些设备围绕 AI 助手与智能体打造的策略是否走对了方向,以及"AI 应该来运行电脑"这一思路本身是否成立。节目还谈及 Amazon 的硬件野心、微软新版 Surface、Googlebooks 能否成为 AI 笔记本的未来,以及"智能 UI"的设想。
《State of AI Report 2026》10 月 8 日发布,第九期由 Air Street Capital 的 Nathan Benaich 牵头,正文 240 多页,分研究、产业、政治、安全、预测五部分。
Kevin Roose 与研究员 Jasmine Sun 做客 ChinaTalk,讲述他新书《The AGI Chronicles》中 OpenAI、Anthropic、DeepMind 的历史,以及那群过度思考并担忧人工智能的人。Kevin 此前供职于《纽约时报》。
Google 本周集中公布多项更新:SynthID.com 检测门户面向全球开放英文版,可验证图像、视频或音频是否由 Google 及行业伙伴的 AI 生成。
Nano Banana 2.1 现已上线 Lovart,带来图像质量、一致性与控制能力的升级。新版本在光照上更准确地还原自然光交互,皮肤纹理更丰富、人物更逼真,文字排版更精确、层级更清晰、布局更干净。
Google AI Studio 推出最新图像生成模型 NanoBanana 2.1,官方称其在视觉设计、基于 mask 的编辑、主体一致性和图像自然度上全面优于此前模型,并已在 ai.studio 上线。LovartAI 转发了这条发布信息,并配文称用 Lovart 制作的效果出色。
知行小酒馆第 253 期邀请益盒 CharityBox 联合创始人治霖,讨论 AI 是否真正改善了弱势群体的生活。节目引用数据显示,截至 2026 年第一季度全球劳动年龄人口 AI 使用率为 17.8%,仍有 6.55 亿人缺乏电力;2026 年美国四大科技企业在 AI 领域投入预计超过 6500 亿美元,而将全球贫困率降至 1% 每年需 3040 亿美元。
Gemini 3.8 Flash High 被 Tw93 称为当前优化产品和官网文案最好的模型。他在 Claude 与 Codex 额度用尽后翻出 199 美元包年的 Gemini AI 并下载 Antigravity,让它优化 Mole Mac 的官网、App 设置项与各类提示描述文案,输出含优化前后对比和原因,语言顺畅真实、没有 AI 味,速度很快,Coding 上则略差。
9月28日起,新韩银行等七家韩国金融机构遭渗透,6万多人信息外泄,韩国总统下令彻查。研究人员发现疑似攻击服务器运行开源工具 ARTEX(自主渗透测试控制台),主要接入 DeepSeek,其他会话还使用 GLM、Grok 和 Claude Code,服务器目录浏览未关,配置文件、CLAUDE.md 与 AI 聊天记录可被直接读取。
Google DeepMind 的 AlphaGo 架构师 David Silver 谈论如何构建能自我教学的机器,并表示自己有一种推动这项技术前进的道德义务。
阿里云智能集团副总裁安筱鹏在2026云栖大会汽车行业峰会上提出,AI正同步重构汽车产业的经济模型、产品形态与竞争规则,使行业呈现高固定成本、低边际成本特征。全球汽车产业利润池中传统业务占比将从2021年的90%降至2035年的44%,Robotaxi市场年复合增长率超88%,2035年规模达1300亿~4150亿美元。自动驾驶、智能座舱、AI生产力由此成为三大竞技场。
墨尔本大学与新南威尔士大学联合团队提出多会话语音记忆基准VoxMem,用「声学证据×记忆操作」二维分类覆盖15种考察组合,包含799道题、3,196个评测实例、34,743个语音会话(约177小时),每道题在8K到64K token历史长度下保持不变。
谷歌下一代模型 Gemini 4 Argon 尚未官宣,已被曝密集现身多个平台,最快将于本周甚至数小时内发布。爆料称其发布卡片已上线谷歌内部系统及部分 Pro 用户界面,并已进入 Google Cloud 控制台,在编程工具 Antigravity 中被设为默认模型,还出现了真实的代码提交记录。
新智元报道称,马斯克宣布 Grok Bot 将按任务接入 Claude Opus 5.5,一天后谷歌在 Google Cloud 发布会上把 Claude Opus 5 与 Sonnet 5.5 集成进 Gemini Business 企业智能体,Claude 模型首次与 Gemini 自家模型同时出现在选择器中。
Google Cloud发布署名Thomas Kurian的长文,推出通用办公Agent Gemini Agent,支持跨应用调用工具、定时与事件触发任务、多子Agent协作,并能依据任务在效果、速度与成本间动态选择Gemini系列或Anthropic Claude系列模型,未来计划支持更多闭源和开源模型。
对比Meta与OpenAI的办公Agent路线,能帮读者看清谷歌这次把Agent嵌入企业组织体系的具体做法。
9 月最后一周,DeepSeek 在 OpenRouter 上处理的 Token 数量超过 OpenAI、Google、Anthropic 和 xAI 四家之和。
9 月最后一周,DeepSeek 模型在 OpenRouter 上处理的 token 量超过了 OpenAI、Google、Anthropic 和 xAI 四家模型的总和。该数据由 Social Capital 披露。
Blind 公布 2026 年 SWE tier list,S tier 包括 Jane Street、Citadel、Anthropic、OpenAI、Nvidia。
一份统计显示,ByteDance 每 1 份工程经理提交数据对应 28 份工程师提交数据,在该指标上明显排在第一。JPMorgan Chase 与 Google 同样位居前列,这一结果在统计中较为出人意料。
Google 发布实验性游戏平台 Playground,用户通过对话界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验,可在浏览器中用手机或笔记本游玩并支持排行榜和部分品类的多人模式。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分档;未来将接入正在测试的 Unity Spark,提供专业级机制和高保真 3D 能力。
Google 宣布 SynthID Detector 即日起面向全球英文用户开放,任何人都可以检查图像、视频或音频文件是否由 AI 生成。该工具可识别来自 Google 及其合作伙伴(包括 OpenAI、NVIDIA、Kakao,Apple 即将加入)的 AI 内容。