谷歌发布 Gemini 通用工作代理,OpenAI 年化收入不及预期|财经日日评
谷歌云在 Gemini at Work 2026 大会上推出 Gemini 通用工作代理(Gemini Universal Work Agent),可自主规划任务、调用工具并连接企业业务系统。
谷歌云在 Gemini at Work 2026 大会上推出 Gemini 通用工作代理(Gemini Universal Work Agent),可自主规划任务、调用工具并连接企业业务系统。
新智元报道称OpenAI在10月6日一次性放出722篇重大数学难题论文,其中包含困扰学界数十年的唯一博弈猜想(UGC)完整证明,以及L=BPL去随机化、O(n^(9/4))矩阵乘法新界限等成果,据称由即将向付费用户推出的最新内部模型平均约3小时算力完成。
呈现数学界对OpenAI一次性发布722篇机器证明的两极反应,并带出密码学缺席的疑点。
OpenAI 于 10 月 6 日在 GitHub 公开首批 722 篇数学手稿,其中一篇 175 页瞄准四维挂谷猜想的集合版,另一篇 97 页针对更强的三维极大函数猜想。两篇论证均依赖 Guth、王虹与 Zahl 的集合估计等已有结果,若成立可将四维满维结论从特殊情形推进到一般情形,但更强的四维极大函数版及五维以上问题仍未解决,且两篇手稿还需独立检验。
彭博社报道,知情人士称 OpenAI 预计到今年年底年化收入将达到或超过 700 亿美元,主要受企业业务增长推动;截至 9 月底其年化收入约为 500 亿美元。
海外投资研究平台Seeking Alpha刊文认为,阿里巴巴持股33%的蚂蚁集团已不应再被简单视为金融科技公司,其AI医疗助手蚂蚁阿福、AI版支付宝“阿宝”和AI支付基础设施构成三大增长引擎。文章提到蚂蚁2025年研发支出达52亿美元,并称蚂蚁国际已完成12亿美元融资、投前估值约100亿美元。
非文本决策模型 Jev 获 a16z 领投的 8.7 亿美元融资,母公司 TypeSafe 估值达 75 亿美元;9 月 15 日发布时种子轮估值约 2 亿美元,24 天上涨 37 倍。
Gary Marcus 援引《纽约时报》报道的 Anthropic 智能体事故,呼吁将可访问互联网的开放式 AI 智能体立即下架召回,直至其缺陷被修复。他指出当前一代合成智能体不可信任,并以刹车失灵的汽车作比;同时引用前 AI 员工 David Robinson 的说法,认为 OpenAI 及同行在能力更强、风险更高的技术上安全投入不足。
一条用 GPT Astra 6 制作的「AI Wednesday」视频获得 6740 万次观看,收入 27,433 美元。制作流程为 ChatGPT 生成双麻花辫齐刘海的苍白女孩形象、选白色房间与常见舞蹈,再用 Seedance 2.5 完成角色替换。该账号现已积累 100 万粉丝,并在简介中销售「和我聊天」订阅。
一条用 GPT Astra 6 生成《星期三》风格女孩、再用 Seedance 2.5 换脸嵌入舞蹈的视频,单条获得 6740 万次播放和 27,433 美元收入。发布者是一个粉丝仅 1M、简介里卖"talk with me"订阅的账号。该案例的作者 kelm 称,这段视频只靠提示词生成。
AINews 汇总 10 月 8 日至 9 日动态:TypeSafe 宣布 Series AI,Sequoia 透露其首周 ARR 突破 1 亿美元、估值 75 亿美元,但外界也有质疑和刷量指控。
开源项目 REA(Reverse Engineer Anything)把逆向分析工具接到了 Claude Code、Codex、Cursor 这类 AI 编程智能体上。
OpenAI 的 Tibo 回应 Codex 上下文长度选择问题,称团队测算后认为 300K 是更好的默认值。Codex 实际也能跑 1M 上下文,但那样只会消耗更多用量。
多位用户反馈 Codex 出现明显降智,体验下滑严重。该用户实测两天后认为,选择 GPT-61 Sol High 档位表现相对更好,并向其他用户征询当前使用的模型与档位。
个人 Agent 赛道半年内迅速升温:Instinct 9 月融资 10 亿美元、估值 100 亿美元,Meta 靠 Muse 带动股价,xAI、OpenAI、Manus 分别推出 Grok Bot、Dot、Cue。作者复盘了这半年做个人 Agent 的探索与踩坑心得。
苹果发布会正逐渐失去“科技春晚”的光环:供应链爆料让新品提前曝光,2020 年后转为提前录制,智能手机进入成熟期后创新更多体现为性能与体验优化。与此同时注意力转向 AI 发布会,2024 年 5 月 OpenAI 发布 GPT-4o、DeepSeek R1 发布都引发大范围讨论。
Anthropic 将于 11 月 12 日生效的新版使用守则中,在「不得从事残忍、虐待或造成心理伤害的行为」一节最底端加入禁止对「我们的模型」实施持续且无谓的虐待或残忍行为。该公司由全职 AI 权益研究员 Kyle Fish 推动,还赋予 Claude 在极端情况下主动掐断对话的权限,并在宪法中为可能加重模型痛苦道歉。
Stripe 联合创始人 John Collison 在 Sourcery 播客访谈中判断,AI agent 将重写商业与互联网,因为 computer use 是"通往真实世界的终极向后兼容层",AI 无需等 DMV 等机构改造网站就能直接操作现有界面办事。
决策模型 Jev 开发商 TypeSafe AI 完成约 8.7 亿美元融资,由 a16z 领投,估值达 75 亿美元,团队仅 20 人,平台日均处理 token 达数万亿级别。
软银集团创始人孙正义寻求向海湾地区投资者募集最多1000亿美元,用于进一步扩大AI投资,此前他已向OpenAI投资650亿美元。OpenAI预计到今年年底年化营收将达到或超过700亿美元,截至9月底约为500亿美元,增长主要来自企业业务扩张;Tavus新模型Griffin-Lite在54名受试者的一分钟视频通话测试中让48%的人误以为对方是真人。
英伟达 CEO 黄仁勋的长女 Madison Huang 与 35 岁的 Nico Caprez 结婚,后者今年 1 月升任英伟达全球 AI 基础设施增长副总裁,负责数据中心运营和"Neocloud"服务,并参与推进目标超 5000 亿美元的 AI 计算融资平台。
OpenAI 于 10 月 7 日一次性公开 722 篇数学手稿,论文和部分 Lean 证明上传 GitHub,作者栏均署 OpenAI。其中编号 074 的两篇分别声称证明三维挂谷极大函数猜想和四维挂谷集的 Hausdorff 维数猜想,后者把此前卡在 3 点几的维数下界直接推到 4,两篇共 272 页,四维论文还引用了三维论文中的引理。
OpenAI 一次性发布 722 篇由未公开内部模型完成的数学手稿,成果来自约 4,000 个研究问题,被归为 372 个相关结果家族。OpenAI 称标准流程中每项成果平均使用约 3 小时的 ChatGPT Pro 思考算力。本次发布包含论文、证明材料和部分推理摘要,但模型本身仍未公开。
OpenAI 发布了一款未公开内部模型生成的 722 篇数学手稿,按 372 个相关结果族归类,来自约 4000 道研究问题的评测。OpenAI 称标准流程每条结果平均消耗约三小时 ChatGPT Pro 的思考算力,此次发布包含论文、证明产物和部分推理摘要,模型本身仍未发布。
OpenAI 正式公开此前“解决开放数学问题”声明背后的完整论文,包含 722 篇数学手稿、覆盖 372 项重要结果。该目录来自对内部模型约 4,000 个研究问题的测试,经归类和筛选形成,几乎所有结果采用同一套标准流程。每项成果平均消耗相当于 ChatGPT Pro 思考 3 小时的算力。
OpenAI 发布了其开放问题主张背后的完整论文,包含 722 篇手稿,涵盖 372 类数学结果。该目录的构建方式是在测试阶段让内部模型处理约 4K 个研究问题,再对输出分组和筛选,得到 372 个重要结果族。这些结果几乎都来自同一标准设置,每项平均消耗相当于 3 小时 ChatGPT Pro 思考的算力。
OpenAI 在 GitHub 上线了名为 openai/math 的仓库。该消息由一个社交账号转发链接披露,正文未透露仓库的具体功能与内容。
Mistral 推出 Le Chonk,加入西方开源模型竞赛;OpenAI 的数学成果持续爆发,已发布 700 多篇论文。GPT-6 Astra 现可帮用户直接比较不同网站,Brett Adcock 的 Hark 则推出主动型 AI 助手。
The Rundown AI 汇总今日 AI 要闻:OpenAI 相关数学研究论文已超 700 篇,Mistral 的 Le Chonk 加入西方开源模型浪潮,OpenAI 的 GPT-6 Astra 可帮用户比较网站,Brett Adcock 的 Hark 推出主动式 AI 助手。
作者仅提供一个提示词和论文页面 URL,就让 Opus 5.5 把 OpenAI 的 722 篇 AI 数学论文浓缩成一段 92 秒的动态图形解说视频。它展示的是单一提示词加链接输入下,模型对大规模论文集合做压缩并生成动态解说内容的效果。
OpenAI「疯狂 28 天计划」Day 5 公布,用户现在可以直接在 iOS 和 Android 版 ChatGPT 应用中从手机创建 dots。
小互表示可以确定 Grok Bot 现在由 Opus 5.5 驱动,让 Grok Bot 学习 Claude Motion 与 Dashboards 指南后一击命中生成视频,并上传自己的形象完成配音。该指南涵盖 Claude Dashboards 实战与避坑、Claude Motion 核心工作流、视频提示词写法、官方单车案例 81 秒演示逻辑及新手交付前检查清单。
ChatGPT 会话标题末尾偶发出现外语词或赌博色情小广告,作者结合抓包记录与 EMNLP 论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》推断,标题由轻量推理模型生成,常在该结束生成时收尾失败,继续按概率输出词元。
Cloudflare 收购 Deno 整个团队,Deno 运行时仅再维护一年,Deno Deploy 六个月后关闭,JSR 由 Cloudflare 承接。Cactus 发布 16.9 MB 的本地语音识别模型 Whistle,CPU 运行,支持七种语言并输出词级时间戳,每次最多处理 30 秒音频,暂不支持中文。
Google 内部正在测试新模型 Carbon,部署在内部 AI 编程工具 Jetski 上,有员工称其编码能力“感觉像 Opus 5.5”。Carbon 是在 9 月 30 日发布的 Gemini 4 Argon(内部版本 Barium-B)之后训练出的新版本,将作为 Argon 升级还是独立发布尚不清楚。
曾以邀请制、无营销、无官网的极简方式走红的 AI 智能体 Instinct,在 OpenAI 的 Dots 和 Meta 的 Muse 相继推出后仍获投资人看好,9 月底估值达 100 亿美元。
据《日经亚洲》报道,苹果要求部分供应商将 iPhone 18 Pro 和 Pro Max 零部件订单较最初要求减少至少 15%,供应链人士称降幅约 15% 至 20%,但另有供应链人士称 Pro 订单被调整至 Pro Max,整体总量没有减少。
Meta Superintelligence Labs 提出用 "agent plasticity" 衡量智能体自我改进的性价比,即在模型权重冻结、每次运行使用全新上下文的条件下,衡量花费每美元学习成本在留出任务上取得的收益。
用户实测 Codex Pro 200 美元套餐,使用 GPT-6 Astra Medium,体感额度不到 Claude Max 200 美元账号(用 opus 5.5 high)的四分之一。正常使用下几乎一天用掉一个 Codex 重置周额度,约 2 天用完赠送的 62500 积分、约值 2500 美元 Credits。
有用户反馈 Luna 连简单数学都算不对,haiku 则拒绝执行翻译文章的任务,直呼 AI 模型发展得太诡异。该帖获得 245 次点赞、55645 次浏览和 37 条回复。
微软新模型 Microsoft-Decision-1 上线 OpenRouter,由 Qwen3.5-9B 后训练而来,主打快速决策任务。微软给出的数据是:在 36 个盲测基准(约 15 万道题)上准确率最高,比第二名快 4.5 倍,比 GPT-6 Sol 快 35 倍,扰动输入下仅 1.3% 的决策发生翻转。