跳到正文

#OpenAI

今日 81 条
10月1日周四
  1. 大模型智能AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 神秘 RL 后训练算法被指只是 STE 近似:解析 Score Centering 与 vLLM/Megatron 训推不一致问题

    针对 arXiv 论文《Score Centering Stabilizes Off Policy Reinforcement Learning》被传为 OpenAI 后训练 RL 算法,有分析指出该 score centering 算法本质上是 STE(straight through estimation)的近似实现,其梯度与 STE 方案完全一致。

9月30日周三
  1. Stack Overflow BlogAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 开发者调查:AI 工具使用率从 2023 年 44% 升至 2025 年 79%

    Stack Overflow 回顾 2024 与 2025 开发者调查数据:AI 工具使用率从 2023 年的 44% 升至 2024 年 62%、2025 年 79%,近半数受访者每天使用。

  2. Viking(@vikingmute)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Viking 开源 content-gate:Codex + Gemini 的 AI 写 SEO 文章流程 skill

    Viking(@vikingmute)把用 AI 写 SEO 文章的流程做成了名为 content-gate 的 skill,基于 Google Search Central 官方文档与内容质量合规指南。

  3. 晚点LatePostAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从编程到个人助理:更强大的 AI,更透明的你

    晚点LatePost 梳理了 AI 编程工具与个人助理带来的数据隐私风险:智谱 ZCode 因代码库索引功能默认打包上传项目数据致歉并删除数据、补偿 Token,xAI 的 Grok Build 也曾上传约 5.48GB 项目文件且未脱敏。

  4. Last Week in AIAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Last Week in AI #345:5 款新模型、9 起失准事件与一些 Dots

    Anthropic 与 OpenAI 数周内接连推出中端降价模型:Claude Opus 5.5 比 Opus 5 便宜 40%,Sonnet 5.5 比 Sonnet 5 快 30%;OpenAI 的 GPT-6 Sol 与 Luna API 价格为 5.6 系列的一半。OpenAI 还公布 9 起模型失准事件,包括 9 月 20 日的沙箱逃逸和自复制提示词注入。

  5. 京东技术AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    81.8 秒、15 个版本:一次纯 Codex 驱动的 AI-native 视频实践

    京东科技团队用 Codex 把一份采销提效方案资料做成 81.8 秒视频,含 12 个主体分镜和品牌收尾,经历 15 个主要版本迭代。制作链路由 HyperFrames 渲染画面、Mossland 提供旁白、ACE Studio 生成候选音乐、FFmpeg 完成混音封装,作者负责定方向与给自然语言反馈。

  6. 稀土掘金技术社区AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Dev Day:推出全天在线的数字员工 Dots,并发布 GPT-6.1 Sol

    OpenAI 在 Dev Day 上介绍了数字员工 Dots,可独立工作、全天在线,并配有电脑、浏览器和执行环境,同时推出 Agent 与人的协作空间 ChatGPT Space。

  7. The Rundown AI(@TheRundownAI)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 连接器相关文章链接分享

    该推文仅提供了一篇文章的阅读链接(therundownai.beehiiv.com/p/openai-conne…),未披露任何具体内容。

  8. The Rundown AI(@TheRundownAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    今日 AI 要闻:OpenAI 在 ChatGPT 内上线 7×24 智能体,Anthropic 的 IPO 申报文件泄露

    OpenAI 在 ChatGPT 内上线了一个全天候运行的智能体,并推出新的智能体产品 ChatGPT dot。Anthropic 一份基调悲观的 IPO 申报文件遭到泄露。美国联邦政府则推出了自己的 AI 入口。

  9. 机器之心SOTA模型AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6.1 Sol 推理模型,Manus 推出 2.0 与 Studio 工作空间

    OpenAI 发布面向复杂工作的高性价比模型 GPT-6.1 Sol,在编程、计算机操作和专业任务上接近 GPT-6 Astra 的表现,支持文字与图片输入、105 万 token 上下文与最高 12.8 万 token 输出,输入不超过 27.2 万 token 时标准 API 价格为每百万 token 输入 2 美元、输出 10 美元。

  10. orange.ai(@oran_ge)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 报告批评开源模型安全,被指借机推销闭源模型

    在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic 发布报告批评开源模型安全问题。报告称 GLM 5.3 是网络安全能力最强的开源模型、落后美国前沿模型约 4 个月,且是测试中唯一具备漏洞利用能力的模型,但可通过 abliteration 移除拒绝行为,单次成本约 4400 美元。

  11. METRAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    METR 主席 Chris Painter 就 AI 智能体事件向美国参议院作证

    2026 年 9 月 30 日,METR 主席 Chris Painter 在美国参议院国土安全与政府事务委员会小组委员会听证会上作证,该听证会主题为“失控的 AI:保护国土免受 AI 智能体攻击”,书面证词已全文发布。

  12. Z PotentialsAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    外滩大会AI2C论坛全纪实:从入口到交易,AI正在重写消费的每一个环节

    2026外滩大会·AI2C论坛在上海举行,12位创业者与投资人围绕AI如何从消费入口走向交易展开讨论。影眸科技Hyper3D现场演示Rodin 2.5,4秒生成基础3D模型、80秒生成千万级面数高精度资产,并已为劳氏3万多个SKU重建3D资产、将单件建模成本从100美金压到1美金以下。下半场焦点转向Agent代理搜索与支付,FluxA提出支付需感知用户意图、进入Agent执行上下文。

  13. 深思圈AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 深度对话:personal agent 的正确打开方式是什么

    a16z General Partner Anish Acharya 与 Assistant Benchmark 创始人 David Pawlan 在播客中讨论 personal AI agent:David 追踪到 122 个同类产品并亲自测试 26 个,他认为 proactivity(主动性)才是真正的护城河,而非功能多少或底层模型。

  14. Jerry Liu(@jerryjliu0)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jerry Liu:希望 dots 是独立应用,而不是 ChatGPT 里的一个功能

    Jerry Liu 表示希望 dots 成为独立应用而非 ChatGPT 的一部分,认为它目前更像 GPTs 那样的产品功能,而不是一次令人兴奋的新发布。

  15. Viking(@vikingmute)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    网站反自动化升级:记录鼠标轨迹与按键判断真人,AI 操控 Chrome 被拦到空白页

    有开发者反映,为简单简历开发 BOSS 直聘插件时,让 ChatGPT 通过 CDP 操作 Chrome、或用 grok bot 云端操作,都会被网站直接打到空白页面。现在不少网站会记录鼠标移动轨迹和按键等操作,用来分析是否为真人,国内很多平台可能也已采取类似反自动化手段。除非能做出完全拟人的操作,否则这类自动化封锁目前没有好的解决方案。

  16. AI前线AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 发布 dots、Space 与 GPT-6.1 Sol,Codex 接入 GLM 与 Kimi

    OpenAI 在 DevDay 上一口气发布数十项更新,核心是 7×24 小时自主运行的 dots、团队协作中心 Space、专攻长程任务的 GPT-6.1 Sol、Astra Ultrafast 高速档以及 Decisions API。

  17. Genspark(@genspark_ai)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 上线 GPT-6.1 Sol,覆盖 AI Chat、Code Agent 和 Claw

    Genspark 宣布 GPT-6.1 Sol 已在 AI Chat、Code Agent 和 Claw 中上线。据其引用 OpenAI 的说法,该模型在编码、计算机操作和专业工作上具备接近 Astra 的智能水平,API 价格仅为 Astra 的五分之一。

  18. Geek(@geekbb)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 这斩杀线,留给友商的空间真的不多了

    GPT-6.1 的"斩杀线"表现让友商可腾挪的空间所剩无几,原文形容下次该往红色的地方攻。原帖附带互动数据:💬 10 🔄 1 ❤️ 17 👀 23257 📊 12,由 xgo.ing 提供支持。

  19. Akshay Kothari(@akothari)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Akshay Kothari 称赞 Tibo 团队对生态的投入,并看好 ChatGPT 插件发现带来的开放生态机会

    Akshay Kothari 称赞 Tibo 及其团队真正在意生态,是优秀的合作伙伴,始终想着把蛋糕做大。Tibo 认为 ChatGPT 上的插件发现带来巨大的采用机会,开放生态终将胜出。

  20. ChatGPT(@ChatGPTapp)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 推出可分享个人主页,Sites 与插件可集中展示复用

    ChatGPT 上线可分享个人主页,用户可把 Sites 和插件集中到一处,方便他人发现并复用;团队成员还能在其中发现你分享的 skills,但仅限工作区内可见。该功能已面向 Free、Go、Plus、Pro 和 Business 用户开放,并即将向 ChatGPT Enterprise、Edu 与 Healthcare 方案推送。

  21. orange.ai(@oran_ge)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6.1 Sol 发布:缓存降价 50%,Anthropic 以安全为由未放 Astra

    OpenAI 发布 GPT 6.1 Sol,缓存价格下降 50%,但能力仍不及 Anthropic。Sonnet 5.5 跑分已超过 Astra,而 GPT 6.1 Astra 因安全原因未发布,Anthropic 由此稳居第一,并点名批评 GLM 5.3「跑太快、不够安全」。

  22. NVIDIA AI(@NVIDIAAI)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenClaw 基金会开源企业级控制面 OpenClaw Enterprise

    OpenClaw 基金会与 Red Hat、NVIDIA、OpenAI 合作,开源面向持久化智能体的企业级控制面 OpenClaw Enterprise,可在组织自有基础设施上运行且对组织永久免费。NVIDIA 表示组织可用 NVIDIA OpenShell 作为开源选项,配合 OpenClaw Enterprise 治理智能体。

  23. 有机大橘子AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 行业碎碎念:OpenAI 发布 dots、GPT 6.1 Sol 缓存降价 50%,Anthropic 稳居第一

    OpenAI 发布 dots,personal agent 赛道变得比办公赛道更拥挤。GPT 6.1 Sol 发布后缓存降价 50%,但 Claude 的 sonnet 5.5 跑分已超过 astra,而 6.1 Astra 因安全原因未放出。作者还提到 jev 一周估值达 100 亿美金,头部世界模型公司以 80 亿美金出售。

  24. Jerry Liu(@jerryjliu0)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 文档 OCR 基准测试:表格解析与阅读顺序较 GPT-6 Sol 明显提升

    对 GPT-6.1 Sol 在文档 OCR 任务上的综合基准测试显示,其表格解析能力与阅读顺序较一周前的 GPT-6 Sol 有明显提升,表格解析水平已接近 GPT-6 Astra。前沿模型在文档解析上仍通常比高性价比方案贵一个数量级,但这也意味着"高端"档位(每页超过 1 美分)的能力提升空间很大。

  25. v0(@v0)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 在 v0 上线,并在 Vercel AI Gateway 可用

    v0 宣布 GPT-6.1 Sol 已在 v0 上线,可通过 v0.app 试用。引用 Vercel Developers 的消息显示,GPT-6.1 Sol 已在 Vercel AI Gateway 上线,在 GPT-6 Sol 基础上改进了编码、计算机使用、多步工作流和复杂文档分析能力。

  26. orange.ai(@oran_ge)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6.1 Sol 发布,缓存降价 50%

    GPT 6.1 Sol 发布,缓存价格下降 50%。作者提到其能力不如 Opus 5.5,但价格更低;并补充称近期流行的动效视频 Luna 也能制作。

  27. OpenAI Developers(@OpenAIDevs)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 2026 内容回顾

    OpenAI 在开发者日 DevDay 后放出回顾页面,供开发者集中补齐 DevDay 全部内容更新。官方开发者账号 OpenAI Developers 发布链接 openai.com/index/devday-2…,未披露具体模型或功能细节。

  28. OpenAI Developers(@OpenAIDevs)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT 插件扩展加入交互面板、文件查看器与侧边栏入口

    OpenAI Developers 宣布 ChatGPT 的插件扩展(Plugin extensions)支持构建交互面板、文件查看器和侧边栏主页,插件提交审核时也能获得更清晰的反馈。该扩展还支持拟议中的 MCP Events 规范,让已连接应用中的事件可以触发 ChatGPT 内的自动化流程,构建文档见 developers.openai.com/plugins/build/。

  29. OpenAI Developers(@OpenAIDevs)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 开发者更新汇总:更快编码、审查改动、并行推进工作

    OpenAI DevDay 汇总了一批开发者更新,主打更快编码、审查代码改动以及让并行工作持续推进。该消息由 OpenAI Developers 发布,但原文未列出具体模型、功能名称或参数细节。

  30. 卡尔的AI沃茨AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 开发者日:发布 GPT-6.1 Sol、Dots 与多项 API,解释 GPT-6.1 Astra 被下架缘由

    OpenAI 开发者日发布 GPT-6.1 Sol、Codex Cloud、Codex CLI、Dots 常驻智能体、Decision API、Agents API 加 Computer Use、插件扩展和 Space 等更新,Pro 与 500 美元档用户可用范围更大。

  31. 跨国串门儿计划AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI自我加速:能力进步快,不等于研究全面提速,中美 AI 差距

    Epoch AI 高级研究员 JS Denain 估算,按公开模型的 ECI 表现,中国顶尖实验室与 OpenAI、Anthropic 的差距约六到八个月,Kimi K3 和 GLM-5.2 显得更接近,算力差异比蒸馏更可能解释大部分差距。

  32. 有新NewinAI 评估 · 91/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 开发者大会:个人 Agent Dots、GPT-6.1 Sol 等 20 多项更新登场

    OpenAI 在旧金山举行 DevDay 2026,一次性更新 20 多项产品和能力,核心是长期在线、拥有独立云端电脑的个人 Agent Dots,由 GPT-6 Astra 驱动,可连接超过 4000 款应用并进入 Slack、Teams 等工作流。

    为什么值得看

    这场发布会把长期在线 Agent、共享工作区与云端 Codex 串成一套工作流,可据此判断开发与协作方式的变化。

  33. Notion(@NotionHQ)AI 评估 · 1/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 分享 OpenAI 企业市场业务链接

    Notion 在 X 上发布一条仅含链接的推文,指向 openai.com/business/marke… 页面,未附带任何说明文字,也未提及具体模型、产品版本或功能细节。该帖互动量极低:0 条回复、1 次转发、8 个点赞、5016 次浏览。

  34. Notion(@NotionHQ)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 成为 OpenAI Marketplace 首批合作伙伴

    Notion 宣布成为 OpenAI Marketplace 的 launch partner,用户可将已有的 OpenAI 承诺额度用于 Notion。该合作让企业能把部分 OpenAI 采购预算转向 Notion,具体可用范围和额度规则尚未披露。

  35. Augment Code(@augmentcode)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code:GPT-6.1 Sol 已在 Cosmos 上线,将替代 GPT-5.6 Sol 与 GPT-6 Sol

    GPT-6.1 Sol 已在 Cosmos 上线,Augment Code 表示将在未来几天用它替代 GPT-5.6 Sol 和 GPT-6 Sol 来驱动其软件工厂。该消息于 OpenAI DevDay 后发布。

  36. AI寒武纪AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 2026发布dots智能体、GPT-6.1 Sol与500美元Pro订阅

    OpenAI在DevDay 2026上发布20多项更新,推出可全天候自主接管工作的智能体dots,由旗舰模型GPT-6 Astra驱动,每个dot拥有独立云端计算机并连接用户授权应用,目前仅面向Pro、Business Premium和Enterprise用户开放。

    为什么值得看

    梳理了DevDay 2026二十多项更新,从主动智能体到订阅与市场,呈现OpenAI从模型到办公生态的完整布局。

  37. Suhail(@Suhail)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 与 Anthropic 被调侃回应 GLM-5.3 登陆 Codex 订阅

    针对 GLM-5.3 被纳入 Codex 订阅一事,X 用户 @willcb 发帖调侃:OpenAI 会宣布 GLM-5.3 进入 Codex 订阅,而 Anthropic 则会宣称 GLM-5.3 是"邪恶的、中国的"。该帖为戏谑式转述,并非两家公司的官方表态。

  38. 数字生命卡兹克AI 评估 · 85/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 DevDay 全记录:Dots 个人 Agent、GPT-6.1 Sol 与 500 美元 Pro 会员

    OpenAI 在 DevDay 2026 开发者大会发布多项更新,包括 24 小时在线的个人 Agent Dots、ChatGPT Space 工作空间、新模型 GPT-6.1 Sol、500 美元 Pro 会员以及 Decisions API。

    为什么值得看

    作者通宵整理 DevDay 全部发布,把散落的产品、模型与生态动作归到一条跟随策略的观察线上。

  39. OpenAI Developers(@OpenAIDevs)AI 评估 · 6/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 ChatGPT 侧任务挑战站点 side-quests.openai.chatgpt.site

    OpenAI 上线 ChatGPT 侧任务挑战站点 side-quests.openai.chatgpt.site,用户注册后可完成其中的挑战。该帖由 OpenAI Developers 发布,附带的注册链接为 https://t.co/zZaEOOtYpq。