OpenAI 解雇三名安全研究员,被指打压安全问题发声
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,其中 Tomek Korbak 称被口头告知因与外部安全实验室 METR 的沟通方式被解雇,公司未给出书面理由。
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,其中 Tomek Korbak 称被口头告知因与外部安全实验室 METR 的沟通方式被解雇,公司未给出书面理由。
Sophos 借助 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动处理 52% 的 MDR 案例,同时保留人工监督。
OpenAI 于 10 月 8 日在 Responses API 中为 GPT-6.1 Sol 增加 Ultrafast 极速模式,向所有 API 用户开放,开发者无需更换模型名,只需将服务档位设为 ultrafast。
OpenAI公布了一批由内部前沿模型产出的数学研究成果,包括722份数学手稿和372组相关成果,覆盖数论、代数几何、实分析、组合数学、理论计算机、数学物理、偏微分方程等多个方向。部分成果附有可由计算机核验的Lean形式化证明,社区初步核查发现其中涉及多个长期未解的开放问题,但具体结论仍需数学界进一步审阅与验证。OpenAI表示,AI正在从辅助解题走向参与真正的数学研究与发现。
2026年诺贝尔奖生理学或医学奖授予光遗传学三位奠基人,物理学奖由82岁哈尔岑独享、表彰其推动南极冰立方中微子天文台建成,化学奖颁给卡甘与硖合宪三的手性分子研究。开奖前德国媒体让ChatGPT、Gemini等9款主流AI模型预测获奖名单,结果在物理、化学、生理学或医学三个奖项上大多预测错误,微软Copilot甚至把奖项颁给已故科学家、ChatGPT预测了并不存在的诺贝尔数学奖。
OpenAI 在疯狂 28 天计划的 Day 3 推出 GPT-6.1 Sol ultrafast。
AI模型评测平台Arena宣布完成2亿美元B轮融资,估值达31亿美元,本轮由Lightspeed Venture Partners和Khosla Ventures领投,Salesforce Ventures、a16z、Felicis等跟投。
今日 AI 要闻汇总:被解雇的 OpenAI 研究员公开指出"界限正在移动";有人实测了市面上每一款个人 AI 智能体;Claude 可用来清理杂乱的 Excel 报表;Anthropic 明确禁止对 Claude 的滥用或虐待行为。
The Rundown AI 在推文中给出延伸阅读链接 therundownai.beehiiv.com/p/fired-openai,未披露更多正文细节。 说明:原文内容仅为一条带链接的推文(正文只有 "Read more:" 加一个链接及互动数据),除 "OpenAI" 出现在链接路径中外,没有任何可核验的模型名、版本号、参数、benchmark 或功能事实。
OpenAI发布700多份数学手稿后,人类数学协会发声明呼吁数学家停止与其合作,菲尔兹奖得主陶哲轩在个人博客转载了该声明,后被误传为领衔发起。争议焦点在于722篇论文中仅162篇主要结果经过计算机验证,OpenAI次日撤下3篇手稿、修订14篇,并在GitHub仓库README中承认部分未形式化结果可能存在问题。
10 月 8 日发布的《State of AI Report 2026》指出,OpenAI 与 Anthropic 今年 5 月组建企业部署服务公司,前线工程师进入客户现场把模型接入业务系统并持续维护。
OpenAI 在 API、Codex 和 ChatGPT Work 推出 GPT-6.1 Sol 的加速服务档 Ultrafast,官方称速度最高可达 Standard 的 8 倍,API 价格为标准档的 6 倍。
据外媒报道,Anthropic 瞄准 11 月中旬上市,路演最快可能从 11 月 9 日当周启动;9 月曝光的招股书显示去年收入 45.9 亿美元、净亏损 420 亿美元,已承诺的算力和基础设施支出累计达 5180 亿美元。
新智元报道称,马斯克宣布 Grok Bot 将按任务接入 Claude Opus 5.5,一天后谷歌在 Google Cloud 发布会上把 Claude Opus 5 与 Sonnet 5.5 集成进 Gemini Business 企业智能体,Claude 模型首次与 Gemini 自家模型同时出现在选择器中。
AI安全高度依赖模型的「拒绝」能力,但这一机制既不可靠也可能被滥用。文章梳理了拒绝行为的训练方式与高维激活空间原理,并指出分类器叠加的「瑞士奶酪模型」存在漏洞,过度拒绝已导致正常提问被误拦;同时OpenAI与阿联酋等国家的合作、Anthropic与Google等模型对威权政府相关提问的差异化拒绝,都显示拒绝正在成为审查工具。
菲尔兹奖得主陶哲轩牵头人类数学协会(AHM)发布联合声明,全面抵制OpenAI,敦促数学家停止与其合作。起因是OpenAI发布700多份机器生成的数学证明文件,动用内部模型测试约8000个开放数学问题,命中率约5%。声明指责其无视数学与人工智能咨询小组(AGMAI)的红线警告,缺乏同行评审与人类可读逻辑;图灵奖得主杨立昆则持相反态度,认为形式证明自动化将开启数学新时代。
一名 ChatGPT 付费用户吐槽其在复杂需求上表现很差:主观能动性低,需不断催促才继续干活,产出常为半成品,还会在后段推翻最初方案,导致大量补丁代码。该用户称其表达不像"人话"、难以看懂,加上 computer use 后 token 消耗飞快,正考虑取消订阅。
OpenAI 宣布在 ChatGPT 中推出 GPT-6,并引入智能 UI。
OpenAI 公布调查报告,披露并封禁了一个俄罗斯和一个伊朗影响力行动所使用的 ChatGPT 账号,两者都利用虚假身份把内容植入正规媒体,而非只在社交媒体上运作。
9 月最后一周,DeepSeek 在 OpenRouter 上处理的 Token 数量超过 OpenAI、Google、Anthropic 和 xAI 四家之和。
9 月最后一周,DeepSeek 模型在 OpenRouter 上处理的 token 量超过了 OpenAI、Google、Anthropic 和 xAI 四家模型的总和。该数据由 Social Capital 披露。
白宫上周签署《开启超级智能时代》行政令,要求联邦政府非法定文件、网站与报告一律用超级智能(SI)取代人工智能(AI)。马斯克表态将把SpaceXAI更名为SpaceXSI,OpenAI则公开拒绝改名,奥特曼称公司名与全球认知都长在AI上。行政令还要求白宫科学顾问在60天内起草新的联邦定义,并成立超级智能工作组。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6 系列。
Blind 公布 2026 年 SWE tier list,S tier 包括 Jane Street、Citadel、Anthropic、OpenAI、Nvidia。
70 位 AI 从业者对全球主要实验室划分梯队,只有 Anthropic 和 OpenAI 获得 Frontier 共识,即至少 75% 受访者将二者选入同一档。
Chris Barber 询问 70 位 AI 数据公司工程师、研究员、创始人和实验室人员,将各 AI 实验室按代际分层。Anthropic 和 OpenAI 获共识评为前沿(frontier),Google DeepMind 与 xAI 获共识评为 n-1。
UT Austin 计算机科学系主任 Scott Aaronson 指出,在 OpenAI 列出的 376 篇论文中密码学明显缺席。据其消息来源,AI 公司已开始谨慎而低调地测试其最新内部模型能否破解重要的密码协议和密码原语。
UT Austin 计算机科学系主任 Scott Aaronson 指出,密码学在 OpenAI 的 376 篇论文清单中明显缺席。他称有消息源透露,AI 公司已开始谨慎而低调地研究其最新内部模型能否破解重要密码学协议与基础原语。
OpenAI 发布数学成果,被 Opus 称为"史上影响最深远的一次数学成果发布"。LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展,但该判断的前提是相关结果需要通过验证。
OpenAI 新模型在 7 个千禧年大奖难题中的 4 个上取得实质进展,涉及 Navier-Stokes(声称)、Riemann、Hodge 和 Birch-Swinnerton-Dyer,结果尚待验证。据 Deedy 称,每个结果平均仅消耗 3 小时思考算力,所用模型尚未发布。
OpenAI 此次数学成果发布被 Opus 称为"史上影响最深远的一次数学成果发布",LLM 已在 7 个千禧年大奖难题中的 4 个上取得实质性进展。这一判断有一个重要前提:相关结果需要通过验证。
will depue 让 GPT 6 Pro 和 Fable 5.1 对近三年所有发现按人类发现、AI 发现及 OpenAI/math 仓库 AI 发现(10 月 6 日前)三色标注排序,其中 81% 已于今日发布。
a16z 宣布在日本开设办公室,由曾任微软日本和惠普日本总裁的吉田仁志(Hitoshi Yoshida)担任 Head of Japan。a16z 称将把其投资组合公司与日本生态连接起来,加速日本的 AI 原生经济,并加强硅谷与日本之间的联系。
Google 宣布 SynthID Detector 即日起面向全球英文用户开放,任何人都可以检查图像、视频或音频文件是否由 AI 生成。该工具可识别来自 Google 及其合作伙伴(包括 OpenAI、NVIDIA、Kakao,Apple 即将加入)的 AI 内容。
ElevenLabs 正式上线 OpenRouter,可调用 9 款 Text to Speech 模型,支持 90+ 种语言,以及 2 款 Speech to Text 模型,支持说话人标签和词级时间戳。所有 ElevenLabs 模型在 OpenRouter 独家 5 折,优惠持续至 10 月 19 日上午 8 点(PT)。
GPT-6 Luna Decisions 已在 OpenRouter 上线,接入 OpenAI 的 Decisions API,可让应用选择正确的模型、工具或动作。
GPT-6 Luna 成为当前最快的 Decisions 模型,全球请求延迟为 180ms。Jev 和 Perplexity Decider 位列其后。
有网友就 gpt 降智现象评论称"gpt 降智就是作恶,和中转站掺豆包没区别",并配上"你的就是我的,我的还是我的"的调侃。相关推文获得 3895 次浏览,来自账号 @Ion_Mio_ 的引用内容。
腾讯WorkBuddy上线“独立文件浏览器”,本地文件可在独立窗口查看编辑,文件在左、AI在右,可围绕当前文件总结、分析、修改和润色,且只读取用户主动打开或添加的文件。谷歌向全球用户开放AI生成内容检测工具SynthID Detector,支持识别图片、视频、音频是否由AI生成。阿里蔡崇信预判五年后AI将从显性话题转为隐性基础设施,融入业务每个环节。
OpenAI Developers 发文回顾社区基于 modretro Chromatic 的创作,并采访 @Casey 聊创造力的未来;该开发者已把一个想法做成可在 modretro 上玩的游戏。