OpenAI 为所有用户更新 ChatGPT,推出更视觉化的 Intelligent UI
OpenAI 面向所有用户更新 ChatGPT,加入名为 Intelligent UI 的界面,让聊天机器人在输出中直接生成交互式元素,整体呈现更偏视觉化。该报道指出这次更新的展示成分多于实际说明。
OpenAI 面向所有用户更新 ChatGPT,加入名为 Intelligent UI 的界面,让聊天机器人在输出中直接生成交互式元素,整体呈现更偏视觉化。该报道指出这次更新的展示成分多于实际说明。
Common Sense Media 旗下 Youth AI Safety Institute 呼吁 OpenAI 限制 ChatGPT 的使用,称其面向未成年用户的护栏未达到承诺要求,构成不可接受的风险。
Gary Marcus 与 Terence Tao 就 OpenAI 的数学领域大动作发表互补评论,试图解读数学研究的新范式。相关内容发布于 Gary Marcus 的 Substack。
Gary Marcus 与 Terence Tao 就 OpenAI 新公布的数学成果发表互补评论。Marcus 指出,OpenAI 仅称"用同一流程、借助未发布模型"完成证明,未披露架构、失败率、训练与数据增强细节,还提到证明是否由 Lean 一次性生成并验证也不清楚。他认为无法判断该结果的通用性,甚至无法排除其只是借助 Lean 与合成数据在可验证领域取巧。
Google DeepMind 宣布 SynthID Detector 现已面向所有人开放,可检测在线内容是否由 GoogleAI 或 OpenAI、NVIDIA、Kakao 等合作方工具生成,Apple 也将加入。NVIDIA 表示其 build.nvidia.com 上由 Cosmos 生成的内容已用 SynthID 加水印,任何人都可以把这些内容上传到检测器核实来源。
a16z 第七版消费级 AI 应用报告显示,只有 4.5% 的美国消费者为 ChatGPT、Gemini 或 Claude 付过个人订阅费,近一半人用过 AI 但每天使用的只有四分之一。
Cloudflare 推出内置多 AI 智能体安全运营框架 Managed Defense,先由确定性代码完成侦察、再由协调 AI 智能体并行调度流量分析、客户上下文。
Gary Marcus 批评 OpenAI 一份关于未发布模型生成数学证明的报告信息严重缺失:外界不知道具体流程、模型架构、失败率以及训练、后训练和数据增强细节,也无法判断结果在数学之外的可泛化性。他认为该成果既可能是通向 AGI 的一步,也可能只是在 Lean 与合成数据加持的可验证领域内的取巧,而这份报告几乎说明不了任何问题。
有人用 GPT-6 Astra 做了一个每天早上根据实时天气挑选穿搭的应用,并把自己当作模特。流程是上传几张全身照和一张人脸照,填入身高、尺码和版型偏好,再列出喜欢与拒绝的颜色,粘贴主提示词后让它构建 1 到 2 小时。
美国国防部下属 CDAO 管理的 Tradewinds 计划允许企业提交不超过五分钟的视频介绍 AI 产品,通过评审后进入 Tradewinds Solutions Marketplace 并获得免竞争状态,从而加快采购流程,官方称部分案例可在不到一周内完成授标。
OpenAI 产品负责人 Alexander Embiricos 将于 10 月 13-15 日在旧金山 Moscone West 的 TechCrunch Disrupt 2026 发表演讲,主题为“What Comes After the Chatbot?
Google 宣布扩展 SynthID 技术的使用范围,任何人现在都可以访问 synthid.com 检测图像、视频或音频文件中是否带有 SynthID 水印,无论内容由 Google 生成还是来自 OpenAI、NVIDIA、Kakao 等合作方,Apple 也即将加入。
Google DeepMind 宣布 SynthID Detector 现已向所有人开放,可用于检测在线内容是否由 GoogleAI 生成,或由 OpenAI、NVIDIA、Kakao 等行业合作方的工具生成,Apple 也将很快加入。用户可通过 synthid.com 试用。
前亚马逊 Rufus 项目创始成员判断,5年后手机上的购物 App 会消失,入口交给能自己完成搜索、比较、下单的购物 Agent。亚马逊 Rufus 2023 年启动时仅七八人、约两个月做出演示版本,团队后扩至数百人;其公式为 Agent = 强模型 + 上下文 + 多步执行。
OpenAI 于 2026 年 10 月 6 日发布消息称,用一个尚未公开的内部前沿模型一次性产出 722 篇数学手稿,整理为 372 个结果,来自对约 4000 个开放研究问题的评估,平均每个结果算力约相当于 ChatGPT Pro 思考 3 小时,成果全部放在 Apache-2.0 协议的 GitHub 仓库 openai/math 中。
OpenAI 以 GitHub 仓库而非期刊公开内部模型的数学产出,读者可了解其披露方式与研究协作的新变化。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能,并组建青少年 AI 委员会(teen AI council)。
马斯克表示 Grok bot 会根据特定任务选用当前任务的最佳模型,不再局限于 Grok 4.7 或 4.6,还会接入 Opus 5.5、Midjourney、Suno 等 API 帮用户构建内容或执行任务。作者指出,部分任务已由 Opus 5.5 驱动但用户无法主动选择,Midjourney 和 Suno 尚未上线。
OpenAI 推出常驻在线智能体 Dots,用于自动完成购买家具等在线任务。实测中该智能体存在不少 bug,连 captcha 都无法通过。
Personal Agent 被质疑是伪需求,但大厂仍在争抢,视频围绕 Muse、JEV 一个月估值涨 50 倍、给 Agent 配电脑的难点展开讨论。谷歌被指收紧免费策略,Google Spark 被比作超市里带锁的购物车,大模型进入基建化与低毛利时代,比拼谁能把 Token 成本压到最低并实现变现。
非营利机构 Common Sense Media 发布评估,称 OpenAI 的 ChatGPT for Teens 是“不可接受的风险”,指出该功能不会在应提醒时通知家长、未在危机情境提供恰当帮助,且仍会代做作业。
Mistral 4 以 3800 块 Grace Blackwell 实现约 72% 的智能水平,GPU 用量仅为 GPT-6 Astra 的 3.8%,后者公开用量为 10 万块以上 Grace Blackwell。同组对比中,Grok 4.7 估算约 20 万块 GPU,Claude Opus 5.5 估算约 50 万块 Trainium2。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造 ChatGPT 插件,让旅客在规划行程时即可查找、比较和预订酒店。
一位开发者用 Codex 把接亲、典礼流程整理成手机端静态网页,通过腾讯云 CloudBase 静态网站托管加自购域名部署,并让 Codex 代为完成域名申请、备案与微信访问拦截申诉。他称 GPT-6 生成前端页面的审美能力已足够强,无需额外 skill,后续修改直接在会话中提需求,还能加上亲友签名送祝福功能。
Mistral Large 4 进入 Code Arena WebDev 榜单位列第 45 名,得分 1534 分,比第 130 名的 Mistral Large 3 提升 304 分,比第 122 名的 Mistral Medium 3.5 高出 271 分。
辛顿转发22位AI研究人员署名论文《如果AI研发自动化引发智能爆炸?》,首次正式参与递归自我改进(RSI)研究。论文援引Anthropic数据:AI生成获批代码占比从2025年1月的个位数升至2026年5月的超80%,Claude自主完成的内部AI研发工作比例从3月的约1%升至8月的26%。辛顿警告,若AI能力继续指数级加速,留给人类建立监管与安全机制的时间可能只有一两年。
OpenAI 在 28 天挑战中为 GPT-6 Astra 和 Sol 提速 50% 至 50 tokens/s,并上线免费 auto-review 与 ChatGPT Meetings 插件;Gemini 4 Argon 发布,主打长时间多步骤编码与网络防御,输出上限 100 万 token。
OpenClaw 之父 Peter Steinberger 与 GitHub 联合创始人 Tom Preston-Werner 对谈,主张 AI 批量生成样板代码的时代应废掉传统 Pull Request,转向附带思考链路与脱敏 Prompt 的「Prompt Request」。
OpenAI 从一个未发布内部前沿模型公开了 722 篇数学手稿,归入 372 个结果族,来自约 4000 个研究问题的评测,平均每个结果约消耗 3 小时 ChatGPT Pro 推理算力,同时发布论文、证明工件与部分推理摘要,模型本身仍未公开。
汇总了 OpenAI 内部数学模型的稿件规模与算力投入,以及 Mistral、Google 等多个同期发布的对照信息。
Sam Altman 公开致谢无数在技术工作上添砖加瓦、历经数代人努力的人,正是这些积累让如今这样的奇迹成为可能。
Sam Altman 发文称"感谢机器,以及现实的构造,让我们得以多理解一点点"。该帖获得 3510 次点赞、185 条回复、99 次转发,浏览量达 269118。
Sam Altman 发布推文称"今晚仰望星空,心怀更深的敬畏",并引用"thy sea is so great and my boat is so small."该推文获得 1183 条回复、670 次转发和 12541 个点赞。
OpenAI 将内部前沿模型产出的数学成果放到 GitHub 仓库 openai/math,共 722 篇论文、归为 372 个族,涉及约 4000 道问题,平均每个结果消耗约 3 小时 ChatGPT Pro 的思考算力。
Codex 已完成重置。相关推文称此次上线了四项被评为"good to great"的功能以及一些数学证明,但社区投票明确要求重置,于是重置已处理完成。
Codex 的设置界面经常变动,导致用户难以找到所需设置。搜索功能经常返回以前的项目,但这些结果点击不了。
OpenAI 疯狂 28 天计划进入 Day 2,Codex 只发了些小更新,但额度大概率会迎来重置。
Gary Marcus 就 OpenAI 新数学成果表态:该系统在 LLM 之外还使用了 Lean 等符号 AI,印证了他多年主张的神经符号 AI 路线。但他强调这并不意味着 OpenAI 已实现 AGI,因为数学领域的符号验证与符号数据增强无法在开放的真实世界中广泛泛化。他重申 2019 年的观点:神经符号 AI 是必要而非充分条件,世界模型同样关键。
OpenAI 发布了一批由其内部前沿模型产出的数学结果,并在 GitHub 上公开(github.com/openai/math)。发布前 OpenAI 咨询了普林斯顿高等研究院数学与人工智能独立咨询组的意见,并参考其建议与公开推荐来确定发布方式。Greg Brockman 表示这是朝着加速科学发现、改善所有人生活质量的方向。
a16z 发布第七版 Top 100 Gen AI Consumer Apps 榜单,首次引入 YipitData 的真实信用卡支出数据。截至 2026 年 8 月,仅 4.5% 的美国消费者为头部通用大模型付费,而支出最高的 1% 用户贡献了 19.5% 的消费金额,超过后 50% 用户总和,月均 AI 支出达 903 美元;付费榜前 50 名中有 29 家从未进入流量榜。
Simon Willison 发布了一个 LLM 插件,用于向 OpenAI 新的 Jev-clone 决策模型发送提示词,该模型基于 GPT-6 Luna。插件详情发布在其个人博客上,相关帖子获得 86 条回复、12 次转发和 260 次点赞。
宝玉称自己有两个 Claude Max @20 账号,在用法相同的情况下,注册时间较长的那个消耗很快、不太耐用,较新的账号则耐用得多。他还引述一段外部测试反馈:某供应商同款订阅的三份测试账号中,有 1 个账号的限额比其他 2 个低约 20%,恰好也是注册时间显著更久的那个。