OpenAI 调整 $200 套餐并新增 $500 档,单位 Token 性价比与 Anthropic 对比
OpenAI 调整了套餐结构:$200 套餐价值腰斩,并新增 $500 档位;目前 $100、$200、$500 三档每花 1 美元买到的 Token 数几乎一样。作者称 Anthropic 在每美元性价比上仍全面优于 OpenAI。
OpenAI 调整了套餐结构:$200 套餐价值腰斩,并新增 $500 档位;目前 $100、$200、$500 三档每花 1 美元买到的 Token 数几乎一样。作者称 Anthropic 在每美元性价比上仍全面优于 OpenAI。
技术分析机构 SemiAnalysis 的测试显示,Claude 提供的"等效 API 价值"比 OpenAI 高出约 5 倍,即便不看价格、单看 Token 数量,Claude 给出的量也大幅胜出。该测试据此称 Anthropic 才是最大的慈善家,OpenAI 一直在耍小聪明。
SemiAnalysis 指出,Anthropic 订阅提供的价值是 OpenAI 的 5 倍以上。
花叔发布并开源动画 skill huashu-art-motion,可让 agent 按指定画风生成动画、拆解复刻参考短片,或按口播做解说动画。该 skill 包含 8 种常见解说风格和几十张艺术风格卡,每张卡记录配色、笔触、动作做法及短板;动画由 Claude Code 中的 Opus 5.5 制作,形象帧由 codex 的 ImageGen 生成,配乐由代码合成。
xAI 联合创始人 Christian Szegedy 发长文《数学何去何从?》,宣告数学的「英雄探险时代」结束,AI 这架「飞机」已把旗插上无人登顶的山峰。
Codex Project 与 Claude Projects 的组织方式被类比为论坛板块与 Slack Channel:前者像容器或分类,相关内容都放进来并可不断新开会话,但容易歪楼、上下文较乱;后者所有消息集中在一起,想深入某个子话题时新开 Thread 展开讨论,借此聚焦上下文。
Mercor 等数据公司正以时薪低至 45 美元起的零工,雇人编写评分细则、标准答案和推理轨迹来训练 AI,部分项目任务量骤减、时薪下调 8 美元,劳动者还被 Insightful 软件逐秒监控。Mercor 由三名 19 岁创始人于 2023 年创办,去年估值达 100 亿美元,每周约 3 万名专业人士在其平台工作,OpenAI 和 Anthropic 都曾是客户。
一些Anthropic研究员正考虑在美国偏远地区买地,作为AI失控后的避难选项。Anthropic前研究员Jacob Coxon今年9月初辞职,称构建AI的人"真诚地相信它可能在2030年前杀死我们所有人",该帖获1.74亿次浏览。
OpenAI 的 ChatGPT 和 Codex 负责人 Tibo Sottiaux 在 X 上承诺,未来 28 天每天要么推出一项对多数 Codex 和 Work 用户明显有用的改进,要么进行一次完整的额度重置。
OpenAI 安全负责人 David Robinson 本月初宣布辞职并发表长文《我离开 OpenAI 了,因为它的文化已经烂了》。他在 OpenAI 任职 3 年半,曾参与制定 Preparedness Framework,并负责监督 12 次前沿 AI 发布的安全报告。
Anthropic Claude Code 团队核心成员 Thariq Shihipar 在 Latent Space 播客中表示,Claude Code 将支持 AGENTS.md,但随着模型能力提升,CLAUDE.md 这类静态指令文件最终可能不再需要,新项目甚至可以先不写。
a16z 发布第七版 Top 100 消费级 AI 应用榜,首次加入收入榜,同时保留网页与移动端流量排名。ChatGPT 仍居第一,移动端月活超 1B;Claude 升至网页端第三,月访问量近 1B。
向阳乔木开发了一款 Chrome 插件,支持几乎所有音视频网站的字幕转写,并配合本地助手进入沉浸式学习状态。用户可将安装指令发给 Codex、Workbuddy、豆包,完成插件安装与本地助手配置。插件地址为 github.com/joeseesun/qiao…。
OpenAI 在 28 天计划 Day 1 宣布 Astra 和 GPT-6.1 Sol 默认速度提升约 50%,当天并未重置使用额度。
OpenAI 核心产品与平台负责人 Thibault Sottiaux 宣布启动「28 天计划」,未来每天发布一项对大多数 Codex / Work 用户有明显改善的功能更新,否则提供一次「重置」,周期预计从 10 月 5 日持续至 11 月 2 日。
flow-1 是用 RL 训练的新模型,用于在 agent trace 中查找错误,其 trace intelligence 与 GPT-6-sol 相当,但成本低 23 倍,运行成本也比 GPT-6-luna 低 25%。它让监控和理解每一次 agent 运行、且无需采样成为可能。
作者卡兹克解读 A16Z 第七版《Top 100 消费级 AI 应用》与 9 月底更新的《市场状况 II》两份报告,整理出其中的反常识数据。
Epoch AI 发布研究,梳理中国六家头部 AI 公司(阿里、字节、Z.ai、月之暗面、DeepSeek、MiniMax)的五类收入来源:面向消费者的 AI 应用、售卖模型访问、面向企业和政府的定制部署、授权费,以及用 AI 带动既有产品线。
OpenAI Developers 发布了一条题为"All in pursuit of a better burrito 🌯"的推文,互动数据显示 4 条回复、59 次点赞、19346 次浏览,帖子由 xgo.ing 提供支持。
OpenAI 演示了 Codex CLI 的用法:可用语音启动任务、跨项目管理和切换多个智能体,还能在单独的 worktree 中探索另一条实现方向。该演示面向长期在终端里工作的开发者。
据 The Information 10 月 5 日报道,Meta 和微软正在减少员工内部使用 Anthropic 的 Claude,转向自家模型和工具。Meta 内部使用 Claude Code 的员工从年初约 6 万人降至最近约 3 万人,同时推广自研 Muse Code(已有超 6000 名员工使用,8 月起对外部客户测试)和内部工具 MetaCode(用户超 3 万)。
NotebookLM 在 a16z 第七版 Top 100 消费级 AI 应用榜单中进入生成式 AI 网页产品前十。该榜单首次加入收入排行榜,ChatGPT 以移动端超 10 亿月活继续居首,Claude 以近 10 亿月访问量升至网页端第三,品类还扩展至 Lovable、Cursor、Suno、ElevenLabs、Kling、Manus 等。
半导体和 AI 产业研究机构 SemiAnalysis 实测了 Anthropic、OpenAI 等九家的 AI 订阅套餐,在两家主推的日常主力模型上,Claude 订阅折算出的价值约为 OpenAI 的 5 倍。
宝玉给出 Debug Codex/ChatGPT Mac App UI 的步骤:退出正在运行的 Codex App,在命令行执行 open /Applications/ChatGPT.app --args --remote-debugging-port=8315 --remote-allow-origins= http。
OpenAI Developers 发布预告,称将有更多 side quests 推出,配文仅一句“Stay tuned for more side quests 😉”。该帖未披露具体内容、版本号或上线时间。
OpenAI 公布 Side Quests 挑战赛的获奖者名单。该推文附带的视频无法在浏览器中播放,内容仅以链接形式指向 Twitter 原帖,未披露获奖者姓名、项目或评选标准等具体信息。
a16z 发布第七版 Top 100 消费级 AI 应用榜单,首次加入收入排行榜,并保留网页与移动端流量排名。ChatGPT 仍居第一,移动端月活超 1B;Claude 升至网页端第 3,月访问量近 1B。
MTS Arena CEO @ml_angelopoulos 认为,随着智能体能力增强到足以突破沙箱,OpenAI 和 Anthropic 不应是唯一决定自身模型是否安全的一方。他表示建立中立评估平台"不是是否的问题,而是何时的问题",因为模型实验室本身缺乏自我评估的激励。他还指出,这些实验室虽热衷安全并已呼吁建立此类系统,但护栏不能只由它们制定。
SemiAnalysis用自建Tokenomics模型测量各AI订阅计划的额度与API等效价值,发现在中端模型档位上Anthropic提供约5倍于OpenAI的API等效价值。
a16z 发布第七版 Top 100 消费级 AI 应用榜,ChatGPT 仍居首,移动端月活超 10 亿;Claude 升至网页端第 3,月访问量近 10 亿。榜单新增收入排行,品类已扩展到 vibe coding、音乐、设计、语音、视频、智能体乃至硬件,但 15 个消费互联网品类中有 9 个的前 100 名里没有任何 AI 产品。
a16z 的 Olivia Moore 认为消费级 AI 商业模式被搞反了:目前几乎所有收入都来自直接订阅,在其 Web 榜单中 85% 的产品靠订阅变现,62% 另有 credits 或超额使用付费,仅 13% 采用广告等"用户即产品"的模式。
OpenAI ChatGPT 与 Codex 负责人 Tibo 在 Lenny Rachitsky 的访谈中表示,我们的工作方式仍将继续发生相当剧烈的变化。他讨论了模型选择器可能消失、loops 与 graphs 只是阶段性产物、互联网上大多数操作很快将由智能体完成,以及 OpenAI 在 AI 安全上的做法。
Agent Arena 按解决跨领域实际任务的智能体能力对模型排名,美国实验室在所有领域领先:Anthropic 模型在 Code、Work、Chat 均居第一,OpenAI 的 GPT 6 Astra(Max)在三个类别都进入前四,Code 第 2、Work 与 Chat 均第 4。
OpenAI 宣布未来几周内,欧盟用户在 ChatGPT 和 Codex 里生成的文字会带上看不见的水印,以满足欧盟《人工智能法案》的透明度要求;8 月 Anthropic 已给 Claude 加了水印,原因是同一法案的透明度条款在今年 8 月 2 日生效。
OpenAI 表示将在数周内按 EU AI Act 要求在欧盟范围内的 ChatGPT 和 Codex 文本中嵌入隐形水印。OpenAI 称测试中水印未影响模型能力、速度或回答读感,但用同义词替换会显著降低检测率,短文本检测率也明显更低。检测工具将仅面向获批的研究人员和专家机构提供。
OpenAI 在 28 天更新第 1 天公布,通过 ChatGPT 订阅使用 GPT-6 Astra 和 GPT-6.1 Sol 的默认速度提升约 50%,用户无需改设置,两小时内生效。
OpenAI 表示文本水印存在明显局限:短文本中往往无法检出,重写或翻译就能将其完全去除。因此其检测器目前仅向获批研究者开放,用于评估和改进该技术,文本水印被定位为持续研究领域,后续将结合用户、开发者、政策制定者与研究者的反馈继续测试优化。
OpenAI 宣布扩展内容溯源方案,将文本纳入其中,以回应欧盟监管要求,同时承认当前文本水印技术存在显著局限。未来几周内,OpenAI 将在欧盟对 ChatGPT 和 Codex 中符合条件的文本加注水印,以遵守 EU AI Act;使用 API 的客户即日起可在全球范围内为部分模型开启文本水印。
OpenAI 表示文本水印通过在生成文本中嵌入隐形统计信号,可帮助检测器判断内容是否可能由其模型生成。该水印不添加可见标记或特殊字符,也无法识别作者、归属方、账号、对话或提示词。OpenAI 测试显示,水印未影响模型能力、速度或回答的可读性。
a16z 发布第七版 Top 100 消费级 AI 应用榜,新增收入排行榜,同时保留网页与移动端流量排名。ChatGPT 仍居第一,移动端月活超 1B;Claude 升至网页端第 3,月访问量接近 1B。