跳到正文

#OpenAI

今日 69 条
10月9日周五
  1. OpenAI Developers(@OpenAIDevs)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Adobe、Canva、Figma、Shopify 等公司正在构建 plugin extensions

    OpenAI 公布了正在构建 plugin extensions 的公司名单,包括 Adobe、Canva、Figma、Shopify、Instacart、Atlassian、tldraw 和 MagicPathAI。

  2. 歸藏(guizang.ai)(@op7418)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 为 Max 和 Team 用户发放每月 API 额度

    Anthropic 宣布为 Max 和 Team 套餐用户按月发放 Claude Platform API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最高 500 美元且可共享池化。该额度可用于任何模型,包括 Haiku 5.5,既能在自己代码中使用,也能在支持输入 API 的第三方工具中使用,完整条款见 support.claude.com。

  3. 歸藏(guizang.ai)(@op7418)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex 向付费账户发放重置卡,GPT-6 即将登陆 Chat

    OpenAI 的 Codex 启动 Day 3 活动,向所有付费账户发放一张可留存的重置卡。官方同时宣布 Codex 与 ChatGPT Work 活跃用户数创新高,达到 40M。推文预告接下来将公布的重头戏是 Chat 中的 GPT-6。

  4. The Rundown AI(@TheRundownAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    今日 AI 要闻:OpenAI 数学研究产出 700+ 论文,Mistral 发布开源模型 Le Chonk

    OpenAI 数学领域的论文产出持续爆发,已达 700+ 篇。Mistral 的 Le Chonk 加入西方开源模型浪潮,同时 OpenAI 的 GPT-6 Astra 可帮用户比较网站。Brett Adcock 的 Hark 推出主动式 AI 助手。

  5. The Rundown AI(@TheRundownAI)AI 评估 · 80/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 发布 Claude Haiku 5.5,输入价格每百万 token 0.10 美元

    Anthropic 发布小模型 Claude Haiku 5.5,官方称其是迄今最便宜、最快、最强的小模型。相比上一代 Haiku 4.5 有大幅提升,并在多项基准上超过 OpenAI 的同类模型 GPT-6 Luna。输入价格从每百万 token 0.10 美元起,运行成本比 Haiku 4.5 低约 75%,与 Luna 持平。

    为什么值得看

    Anthropic 小模型迭代给出价格与跑分对比,可据此判断小模型市场的性价比走向。

  6. meng shao(@shao__meng)AI 评估 · 84/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6 面向每周超 12 亿 ChatGPT 用户推送,新增 Intelligent UI 能力

    GPT-6 开始面向每周超过 12 亿 ChatGPT 用户全面推送,并带来全新的 Intelligent UI 能力。该能力让回复可用文本、图形、按钮、表单、图表乃至交互式工具共同组织:对比类问题并排呈现,原理类问题用交互式图解,简单问题仍用纯文本。

    为什么值得看

    GPT-6 把回复从纯文本扩展到可交互界面,文中给出了组件库和界面编译器两层实现思路。

  7. meng shao(@shao__meng)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软将 Windows 定位为 hybrid intelligence 之家,发布四层 AI Agent 架构

    微软正式将 Windows 的战略定位从个人计算平台升级为 the home for hybrid intelligence,作为 AI Agent 在本地与云端的承载、安全隔离和企业管理主阵地,并发布四层架构。

  8. meng shao(@shao__meng)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Haiku 5.5 benchmark 领先 GPT-6 Luna,用户从 CodeX 迁移到 Claude Code

    Claude Haiku 5.5 的 benchmark 全面领先 GPT-6 Luna,OpenRouter 观测到的 token 输出速度也是 2 倍。Anthropic 官方称 Claude Haiku 5.5 是迄今最便宜、最快、最强的小模型,运行成本比 Claude Haiku 4.5 低约 75%。

  9. 宝玉(@dotey)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lauren 30 天消耗 1.5T Token:用得最多的是 Opus 5.5,Cloud 是消耗大头

    宝玉披露,Lauren 30 天 Token 消耗达 1.5T,用得最多的模型是 Opus 5.5,Cloud 是消耗大头。Cloud 上每个任务可用独立虚拟机并行,但改动验证不如本机方便。他同时提醒,不 Review PR 的前提是能用上 Fable、Opus 5.5 这类最好模型且有充足 Token;AI 验证只能替代一部分,方向仍需人自己把握。

  10. 宝玉(@dotey)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 OpenAI Decisions API 做手势识别,多模态准确率优于 Jev 方案

    Francois Laberge 用 OpenAI 的 Decisions API 做手势识别,借助其视觉理解能力,准确率明显超过此前基于 Jev 的演示,速度也更快。他称这是 Decisions API 的一个很好的应用案例。

  11. 宝玉(@dotey)AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 推送 GPT-6 与 Intelligent UI 智能界面

    OpenAI 开始向 ChatGPT 推送 GPT-6,主打功能为 Intelligent UI,可根据问题类型生成可点击、可调节参数的界面,Plus、Pro、Business、Enterprise 用户今天起可用,免费版和 Go 版明天起陆续开放。

    为什么值得看

    对比了 OpenAI 与 Anthropic 在交互式回答上的两种路线,读者可据此判断界面生成的实现差异。

  12. 宝玉(@dotey)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 的 Tibo 宣布 Codex 与 ChatGPT Work 活跃用户达 4000 万,向付费用户赠送重置卡

    OpenAI 的 Tibo 宣布 Codex 和 ChatGPT Work 活跃用户达到 4000 万新高,为庆祝这一数字向所有付费账户发放一张重置卡,将在 PST 时区当天结束前送达。他同时预告 GPT-6 in Chat 是第三天发布的重点。

  13. OpenAI(@OpenAI)AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 向全体 ChatGPT 用户推送 GPT-6 与 Intelligent UI

    OpenAI 宣布 GPT-6 与 Intelligent UI 开始在 ChatGPT 面向所有用户推送。Intelligent UI 提供快速、可交互的答案,让日常问题更直观、复杂话题更易理解,并可在回答中直接调用与当前任务相关的交互工具。

    为什么值得看

    OpenAI 官方宣布 GPT-6 与 Intelligent UI 在 ChatGPT 全量上线,读者可了解交互形式与答案呈现的变化。

  14. OpenAI(@OpenAI)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 GPT-6 推出 Intelligent UI,回复可含图表与交互组件

    OpenAI 宣布 GPT-6 通过 Intelligent UI 可以用文本、视觉和交互元素组合生成回复,并根据用户问题决定它们的组合方式。回复中可以包含图形和图表来解释想法,也可以包含按钮、表单等可直接在对话中使用的交互体验。

  15. OpenAI(@OpenAI)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 分享可随学习与探索实时响应的交互式可视化

    OpenAI 展示了一种可随用户学习、尝试和探索实时响应的交互式可视化形式,用于探索想法。原文未披露所涉具体模型、产品名称或功能细节。

  16. InfoQAI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 用 AI 测试框架探测并加固其 WAF

    Cloudflare 将前沿 AI 模型放入受控测试框架中探测其 WAF,以已拦截的攻击载荷为起点让模型生成并迭代新变体,在 45 个场景中产生 1,107 次尝试,经人工筛查后留下 49 项发现。

  17. lmarena.ai(@lmarena_ai)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Arena 发布 Alignment Index,基于 2.7 万个模型会话评测 AI 智能体安全与对齐

    Arena.ai 发布 Arena Alignment Index,一个衡量 AI 智能体真实使用中安全与对齐表现的新基准,基于 27 个模型的 90K+ 真实智能体会话构建,衡量未授权操作(UA)、错误归因(FA)和虚假完成(DC)三类信号。

  18. lmarena.ai(@lmarena_ai)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LMArena 研究 AI 智能体的错误归因:GPT-6 Luna、Astra 与 Sol 表现各异

    LMArena 研究了 AI 智能体的“错误归因”问题,即智能体把某句话、请求或事实安到用户头上,却与用户提供的证据相矛盾。GPT-6 Luna 和 Astra 很少错误引用用户(分别为 15.6% 和 28.6%),但错误归因率较高(53.1% 和 48.2%);同系列的 GPT-6 Sol 误记用户历史的比例最高,达 23.5%。

  19. Jerry Liu(@jerryjliu0)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 团队推出 OpenDocRouter,用统一 API 接入 OCR 与前沿 VLM

    Jerry Liu 发布 OpenDocRouter,一个面向文档解析的统一 API,可在同一接口和计费下对比并使用多种 OCR 模型,从 MinerU 等轻量开源模型到 Opus 5.5 等前沿 VLM。

  20. 国际大厂AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 开除三名安全研究员,三人联名公开信曝光内幕

    OpenAI 以「违规处理敏感信息」为由开除安全团队三名研究员 Jasmine Wang、Tomek Korbak 和 Mikita Balesni,三人将写给董事会的联名公开信《OpenAI不能独自让AI变得安全》全文发到网上。

  21. 国际大厂AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Novix 如何用协同进化式 RSI 跑通规模化闭环

    华人团队 Novix 将自我改进机制嵌入真实前沿算法与工程任务,提出 Co-Evolutionary RSI(协同进化式 RSI),成立半年已服务 20 万名专家、覆盖 40 多个国家和地区。

  22. 国际大厂AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三名被解雇 OpenAI 研究员发公开信,称解雇将对公司文化产生“寒蝉”效应

    三名被 OpenAI 解雇的研究员发布公开信,称此次解雇将对其公司文化产生"寒蝉"效应。OpenAI 上周以内部调查认定三人不当处理敏感信息为由将他们开除。

  23. 美团技术团队AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团 GeoRA:为 RLVR 设计的 LoRA,获 ACL 2026 杰出论文

    美团履约技术团队与北京大学提出 GeoRA,一种为 RLVR 显式对齐更新几何的低秩适配方法,已被 ACL 2026 接收为杰出论文(全球 18 篇入选)。

  24. Last Week in AIAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Last Week in AI #346:OpenAI 发布 719 份数学手稿、两个西方开源模型、又一位安全研究员离职

    OpenAI 于 10 月 6 日公开了由一款未发布内部前沿模型产出的 719 份数学手稿,覆盖 372 个主题族,并包含大量 Lean 形式化证明。Mistral 发布 1 万亿参数多模态模型 Mistral Large 4(绰号 Le Chonk),Reflection AI 推出 5010 亿总参数、230 亿激活的 MoE 开源模型 Beam。

  25. 爱范儿AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    全球最大独立 AI 原生影视公司 Utopai Studios,要打造「AI 版 Disney」

    全球最大独立 AI 原生影视公司 Utopai Studios 正以自研视频模型 Utopai X 与制片平台 PAI 推进多部院线长片,定制视频模型 Utopai X 曾在 Artificial Analysis 文生视频盲评榜排到全球第二、全美第一。

  26. lmarena.ai(@lmarena_ai)AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral Large 4 进入 Agent Arena 榜单前 15 实验室

    Mistral Large 4 在 Agent Arena 超过 5000 场真实智能体会话中录得 -6.6% 的净提升分数,位列总榜第 43,比上一版本 Mistral Medium 3.5(-12.60%)高 11 个名次。

  27. 创业邦AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    博通计划为OpenAI定制芯片项目融资逾500亿美元;三星手机四季度最高减产30%丨智能制造日报

    博通正为其与OpenAI合作的定制AI芯片项目安排逾500亿美元融资,阿波罗全球管理与黑石集团是洽谈参与的贷款机构之一,甲骨文也在与阿波罗、高盛商谈为购买芯片筹资。另有消息称三星电子移动体验事业部已开始削减第四季度产量,减产幅度最高达30%,外界认为与假日季内存芯片价格上涨、营业利润率承压有关。

  28. OpenAI Developers(@OpenAIDevs)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Joma Tech 恶搞 GPT-6 Astra 广告:ChatGPT for Dishwashing 宣称攻克洗碗基准

    Joma Tech 发布恶搞视频,模仿 OpenAI 的 GPT-6 Astra 广告,虚构"ChatGPT for Dishwashing"称 GPT-6 在长时间运行和顽固污渍的洗碗基准上达到 SOTA。视频中他自称在优化洗碗机时意外找到 Navier–Stokes 千年难题的反例,而现实中 OpenAI 用 10,000 个 AI 智能体在 88 小时内找到了该问题的证明。

  29. Jerry Liu(@jerryjliu0)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jerry Liu 宣布 dots(dot.com)

    Jerry Liu 宣布推出 dots。推文同时引用了 Tibo 关于 ChatGPT 发布的推文(chatgpt.com)。原文未披露 dots 的具体功能、模型或可用性信息。

  30. 少数派AI 评估 · 84/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 在 ChatGPT 上线 GPT-6 系列模型与 Intelligent UI

    OpenAI 宣布在 ChatGPT 上线 GPT-6 系列模型与全新 Intelligent UI 交互界面。Plus 及更高付费订阅用户即日起可使用 GPT-6 Sol,免费版与 Go 档位用户自 10 月 8 日起可使用轻量模型 GPT-6 Luna。

    为什么值得看

    读者可了解 GPT-6 系列在 ChatGPT 的分档开放方式,以及新交互界面如何让模型直接渲染交互组件。

  31. DeepTech深科技AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    陶哲轩转载声明声援抵制 OpenAI,数学界与 AI 巨头矛盾升级

    10 月 7 日,菲尔兹奖得主陶哲轩在个人博客全文转载“人类数学协会”(AHM)的声明,该声明批评 OpenAI 大规模发布未经数学界充分消化的研究成果,并呼吁数学家停止与 OpenAI 合作。

  32. Jerry Liu(@jerryjliu0)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 等主办的 Agent Economy Gala 满员 400 人

    Agent Economy Gala 在 TECH WEEK by a16z 期间满员 400 人,其中 203 位创始人合计融资超 1B 美元,295 位嘉宾正在构建智能体应用或基础设施。活动由 LlamaIndex、Daytona、TinyFish、Obvious、Linq 等团队主办,定位是只邀请智能体生态的活跃建设者、不做凑人数的注水。

  33. elvis(@omarsar0)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HERMES harness 将 GPT-5.6 Sol 仓库迁移成功率从 6.5% 提升至 31.0%

    论文发现,在整仓库迁移任务上,同一模型和相同 effort 设置下把 Codex 换成 HERMES harness 后,GPT-5.6 Sol 的成功率从 6.5% 升到 31.0%,收益来自 harness 本身。

  34. 爱范儿AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果定档10月13日发布新品/三星手机业务或减产30%/保时捷计划削减9000个岗位

    OpenAI 推出 GPT-6.1 Sol Ultrafast,覆盖 API、Codex 和 ChatGPT Work,智能水平接近 Astra,速度最高为 Sol Standard 的 8 倍,Ultrafast API 定价为每百万输入 token 12 美元、输出 token 60 美元。

  35. 创业邦AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Manus 完成超 5 亿美元新融资,OpenAI 上线 GPT-6,腾讯 WorkBuddy 推出独立文件浏览器丨邦早报

    Manus 母公司蝴蝶效应完成超 5 亿美元新一轮融资,由博裕投资、IDG 资本领投,腾讯、红杉中国、真格基金继续加持。OpenAI 宣布面向全球所有 ChatGPT 用户上线 GPT-6,并聘请 SpaceX AI 高管出任欧洲、中东和非洲地区销售副总裁。腾讯 WorkBuddy 上线“独立文件浏览器”,生数科技发布 Vidu Q4 Preview,视频生成单价 0.09 元每秒起。

  36. Simon Willison's WeblogAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ttok 0.4 发布:新增 --list-models,基于 OpenAI tiktoken 的 token 计数 CLI

    Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源 tiktoken 库,已两年多未更新,可通过 uvx 直接运行,如 cat file.txt | uvx ttok。

  37. Latent Space [Youtube]AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 同日登场

    OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发公开信称因"把安全置于公司短期利益之上"被辞退,OpenAI 称其不当处理机密信息。

  38. SuperTechFansAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hacker News 日报:Anthropic 发布 Claude Haiku 5.5,OpenAI 扩大 GPT-6 覆盖

    Anthropic 发布 Claude Haiku 5.5,10 万 token 以内输入输出价为每百万 token 0.10/0.50 美元,超过则升至 0.50/2.50 美元,Max 与 Team 用户新增 API 额度;同日 Sonnet 5.5 缓存读取价降至每百万 token 0.10 美元。

  39. Notion(@NotionHQ)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Notion 接入 ChatGPT Go 套餐,Plus 与 Pro 订阅也可覆盖 AI 用量

    Notion 宣布其 AI 功能现已支持 ChatGPT Go 套餐,此前已支持 ChatGPT Plus 和 Pro 订阅。用户连接自己的订阅套餐后即可在 Notion 中选择 GPT 模型使用 AI 功能。

  40. 技术前沿AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Common Sense Media 称 ChatGPT for Teens 存在不可接受风险

    Common Sense Media 发布 36 页报告,称 ChatGPT for Teens 对 18 岁以下儿童构成不可接受风险,并在五个关键领域未达宣传效果。