跳到正文

#编码

今日 31 条
9月30日周三
  1. 沃垠AIAI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qoder v0.4.0 把上下文从个人电脑搬进团队

    阿里云栖大会分论坛上,Qoder 技术负责人谢吉宝披露 Qoder 上线一年超过 80% 的用户已不再亲自写代码,非编程任务占比超 50%。9 月 23 日发布的 Qoder v0.4.0 新增项目、讨论、自定义 Agent 与 Agent Team 四项能力,把项目目标、任务状态和讨论结论统一留存,Agent 协作可跑在当前设备或 Qoder Cloud Agents 上,目前面向企业订阅开放。

  2. 智东西AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团 LongCat-2.5-Preview 上线,万亿参数模型实测复刻 Muse 前端

    美团 LongCat 团队于 9 月 25 日上线预览版模型 LongCat-2.5-Preview,并在 OpenCode 开放两周限时免费体验。该模型总参数 1.6 万亿,每次推理激活约 480 亿参数,支持 100 万 Token 上下文窗口和原生多模态,主要面向长周期任务。

  3. 夕小瑶科技说AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    实测 MiniMax M3.1-Flash-Preview:四个真实任务与 DeepSeek、GLM 对比

    MiniMax 于 9 月 27 日在 MiniMax Code 上线 M3.1-Flash-Preview,1M 上下文,原生支持文字、图片、视频输入,思考强度五档可调,主力场景是 Coding。

  4. Tw93(@HiTw93)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何给产品做一次图标升级:从 Remix Icon 换到 Phosphor,并用 opus 5.5 自绘 SVG

    独立开发者 Tw93 分享了给产品 Mole 做图标精细化升级的思路:App 场景下从 Remix Icon 换到 Phosphor Icon,约 70% 可直接使用,剩下 30% 用 opus 5.5 自绘 SVG 以保持整体一致。他强调图标必须放回真实产品、按整组搭配来看效果,并注重对齐与中英文垂直居中,用小细节(如咖啡杯、挥手、听诊器)给产品注入灵性。

  5. AI前线AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 发布 dots、Space 与 GPT-6.1 Sol,Codex 接入 GLM 与 Kimi

    OpenAI 在 DevDay 上一口气发布数十项更新,核心是 7×24 小时自主运行的 dots、团队协作中心 Space、专攻长程任务的 GPT-6.1 Sol、Astra Ultrafast 高速档以及 Decisions API。

  6. Genspark(@genspark_ai)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 上线 GPT-6.1 Sol,覆盖 AI Chat、Code Agent 和 Claw

    Genspark 宣布 GPT-6.1 Sol 已在 AI Chat、Code Agent 和 Claw 中上线。据其引用 OpenAI 的说法,该模型在编码、计算机操作和专业工作上具备接近 Astra 的智能水平,API 价格仅为 Astra 的五分之一。

  7. Vercel NewsAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    InclusionAI 的 Ling 3.1 Flash 上线 AI Gateway,10 月 13 日前免费

    InclusionAI 的 Ling 3.1 Flash 已在 AI Gateway 上线,10 月 13 日前免费使用。该模型为混合推理语言模型,总参数 560B、每 token 激活 25B,在 AI Gateway 上支持 262K token 上下文窗口,面向编码、多步分析与工具调用智能体。

  8. OpenAI Developers(@OpenAIDevs)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 开发者更新汇总:更快编码、审查改动、并行推进工作

    OpenAI DevDay 汇总了一批开发者更新,主打更快编码、审查代码改动以及让并行工作持续推进。该消息由 OpenAI Developers 发布,但原文未列出具体模型、功能名称或参数细节。

  9. 卡尔的AI沃茨AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 开发者日:发布 GPT-6.1 Sol、Dots 与多项 API,解释 GPT-6.1 Astra 被下架缘由

    OpenAI 开发者日发布 GPT-6.1 Sol、Codex Cloud、Codex CLI、Dots 常驻智能体、Decision API、Agents API 加 Computer Use、插件扩展和 Space 等更新,Pro 与 500 美元档用户可用范围更大。

  10. 有新NewinAI 评估 · 91/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 开发者大会:个人 Agent Dots、GPT-6.1 Sol 等 20 多项更新登场

    OpenAI 在旧金山举行 DevDay 2026,一次性更新 20 多项产品和能力,核心是长期在线、拥有独立云端电脑的个人 Agent Dots,由 GPT-6 Astra 驱动,可连接超过 4000 款应用并进入 Slack、Teams 等工作流。

    为什么值得看

    这场发布会把长期在线 Agent、共享工作区与云端 Codex 串成一套工作流,可据此判断开发与协作方式的变化。

  11. Augment Code(@augmentcode)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code:GPT-6.1 Sol 已在 Cosmos 上线,将替代 GPT-5.6 Sol 与 GPT-6 Sol

    GPT-6.1 Sol 已在 Cosmos 上线,Augment Code 表示将在未来几天用它替代 GPT-5.6 Sol 和 GPT-6 Sol 来驱动其软件工厂。该消息于 OpenAI DevDay 后发布。

  12. AI寒武纪AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 2026发布dots智能体、GPT-6.1 Sol与500美元Pro订阅

    OpenAI在DevDay 2026上发布20多项更新,推出可全天候自主接管工作的智能体dots,由旗舰模型GPT-6 Astra驱动,每个dot拥有独立云端计算机并连接用户授权应用,目前仅面向Pro、Business Premium和Enterprise用户开放。

    为什么值得看

    梳理了DevDay 2026二十多项更新,从主动智能体到订阅与市场,呈现OpenAI从模型到办公生态的完整布局。

  13. 数字生命卡兹克AI 评估 · 85/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 2026 DevDay 全记录:Dots 个人 Agent、GPT-6.1 Sol 与 500 美元 Pro 会员

    OpenAI 在 DevDay 2026 开发者大会发布多项更新,包括 24 小时在线的个人 Agent Dots、ChatGPT Space 工作空间、新模型 GPT-6.1 Sol、500 美元 Pro 会员以及 Decisions API。

    为什么值得看

    作者通宵整理 DevDay 全部发布,把散落的产品、模型与生态动作归到一条跟随策略的观察线上。

  14. OpenAI Developers(@OpenAIDevs)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI DevDay 支线任务:10 项开发者挑战,5 台 Codex Micro 抽奖送出

    OpenAI DevDay 推出支线任务活动,共 10 项开发者挑战,完成任意 5 项即可获得 1 张抽奖券,每项挑战各对应 1 张,奖品为 5 台 Codex Micro。活动持续 48 小时,全球开发者均可从任意地点参与。

  15. 赛博禅心AI 评估 · 92/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 年度 DevDay 实录:25 项发布逐一详解

    OpenAI 在旧金山举办第四届 DevDay,发布 Dots 与 ChatGPT Space 两款新产品:Dots 是一直在线的个人 agent,今天起向 Pro、Business Premium 开放,Specialist dots 面向企业预览并可接入微软 Agent 365。

    为什么值得看

    按主题逐条梳理了OpenAI DevDay的25项发布,读者可据此判断其产品矩阵与开发者平台的整体走向。

  16. Cognition(@cognition_labs)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 推出 MongoDB 现代化改造功能,接手遗留代码变更

    Cognition 上线 Devin for MongoDB Modernizations,由 Devin 负责遗留代码改造,MongoDB AMP 负责数据迁移与验证,帮助客户更快进入生产环境。官方称该组合可释放工程师精力,专注于核心软件开发与难题攻关。

  17. Figma(@figma)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT 6.1 Sol 现已接入 Figma Make

    GPT 6.1 Sol 已在 Figma Make 中上线。该消息由 Figma 官方账号发布,原帖获得 406 个点赞、26 次转发,浏览量超过 3.5 万。

  18. OpenAI Developers(@OpenAIDevs)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Codex CLI 更新:在命令行中管理智能体、并行任务与对话

    OpenAI Codex CLI 发布更新,用户可在命令行中管理智能体、保持并行工作推进,并就下一步操作与 Codex 对话。升级命令为 npm install -g @openai/codex@latest。

  19. OpenAI Developers(@OpenAIDevs)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex CLI 更新:/usage 用量分析、/theme 主题与终端内 Mermaid、LaTeX 渲染

    OpenAI 的 Codex CLI 迎来更新,新增 /usage 查看活动与用量分析、/theme 切换主题,并支持 managed worktrees。终端内可直接渲染 Mermaid 图表和 LaTeX,diff 与工具输出可折叠,还新增状态、提示和键盘快捷键的专用区域。

  20. OpenAI Developers(@OpenAIDevs)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI Codex 终端上线语音功能,用 /voice 对话启动任务

    OpenAI 为终端版 Codex 加入语音功能,用户可用 /voice 直接开口说话,Codex 也会语音回应。该功能支持语音启动任务或讨论下一步操作,之后可进入 Agents 查看所有任务的执行进展。

  21. OpenAI Developers(@OpenAIDevs)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Codex CLI 新增 /agents 与 /fork,用于管理并行任务

    Codex CLI 新增 /agents 命令,可查看正在运行的任务、检查进度并在任务间跳转。另支持 /fork 将对话复制到一个 worktree,共享相同上下文并拥有独立 checkout,方便尝试其他方向。

  22. OpenAI Developers(@OpenAIDevs)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 刷新 Codex CLI:全新全屏界面与并行任务管理

    OpenAI 对 Codex CLI 进行重大更新,带来全新全屏界面、更好的可读性,以及在终端内管理并行任务的能力,继续加码面向命令行开发者的投入。

  23. OpenAI Developers(@OpenAIDevs)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 Codex 上线网页与手机端,支持云端启动任务

    OpenAI Developers 宣布 Codex 支持在云端启动任务,用户可在手机或另一台电脑上跟踪进度并实时调整,即使笔记本电脑处于关机状态。同时,官方把原本桌面应用的使用体验带到了网页和手机端。

  24. Cognition(@cognition_labs)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 用量计入 ChatGPT 与 Codex 套餐额度,可设置上限

    Devin 中的用量会计入你套餐里已有的 Codex 和 ChatGPT Work 额度,用户可选择让 Devin 用满额度,或在设置中为其设定更低上限。

  25. Cognition(@cognition_labs)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 支持直接用 ChatGPT 订阅登录,OpenAI 模型用量走订阅额度

    Devin 现已支持用 ChatGPT Plus 或 Pro 订阅直接登录,Devin 内所有 OpenAI 模型用量将从该订阅额度中扣减。该功能已在 Devin Cloud、Devin Desktop 和 Devin CLI 上线。

  26. OpenAI Developers(@OpenAIDevs)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 Astra 推出 Ultrafast,覆盖 Codex 与 ChatGPT Work 企业版及 API

    OpenAI 宣布 Ultrafast 已在 Codex 和 ChatGPT Work 的 Enterprise 套餐中面向 Astra 开放,同时通过新的 Pro 500 套餐提供;所有开发者也可通过 API 使用 Astra 的 Ultrafast。GPT-6.1 Sol 的 Ultrafast 即将推出,文档地址为 developers.openai.com/api/docs/guide。

  27. Lovable(@lovable_dev)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 推出 Muse:让小企业用一句话搭建想要的工具

    Lovable 上线 Muse,小企业可以直接向它描述自己希望存在的工具,再由 Lovable 把这个想法构建出来。该消息由 Lovable 官方账号发布,互动量为 152 次点赞、14 次转发、15 条回复、8054 次浏览。

  28. Figma(@figma)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma Dev Mode 现已接入 Codex,可通过 Figma 插件使用

    Figma Dev Mode 现已接入 Codex,并可通过 Figma 插件使用。该消息由 Figma 官方发布,正文仅说明这一可用性变化,未披露模型版本、参数或其他细节。

  29. OpenAI(@OpenAI)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Ultrafast 高速档:Codex 与 API 提速最高 8 倍

    OpenAI 发布高级速度档 Ultrafast,在 Codex 中 token 生成速度最高提升 8 倍(300 tokens/秒),在 API 中最高提升 6 倍。

  30. Windsurf(@windsurf_ai)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 上线 Devin:FrontierCode 1.1 得分 60.4%,成本仅为 GPT-6 Sol 的 19%

    GPT-6.1 Sol 现已在 Cognition 的 Devin 中可用。在 FrontierCode 1.1 上它得分 60.4%,与 GPT-6 Sol 的 60.7% 基本持平,但成本大幅降低:中等推理强度下每任务 $0.31,比 GPT-6 Sol 最高推理强度的成本低 81%。

  31. Cognition(@cognition_labs)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 推出可下载版本,附 devin.ai/download 试用入口

    Cognition 发布 Devin 下载入口,用户可通过 devin.ai/download 获取试用。原帖未披露该版本的模型版本、参数规模或价格等具体信息。

  32. Cognition(@cognition_labs)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 上线 Devin,FrontierCode 1.1 得分 60.4%

    GPT-6.1 Sol 已在 Devin 上线,在 FrontierCode 1.1 上得分 60.4%,与 GPT-6 Sol 的 60.7% 基本持平,但成本大幅降低。中等推理强度下每任务花费 $0.31,比 GPT-6 Sol 最高推理强度低 81%。

  33. GitHub(@github)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GPT-6.1 Sol 在 GitHub Copilot 全面可用

    OpenAI 的 GPT-6.1 Sol 已在 GitHub Copilot 中全面可用,可用于智能体编码和终端工作流,多步编码表现较强。GitHub 称早期测试中它可靠完成任务,所用 token 和步骤明显少于 GPT-6 与 GPT-5.6 系列模型。该模型可在 GitHub Copilot 应用、CLI 和 @code 中试用。

  34. OpenAI(@OpenAI)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 升级 Codex Security Cloud,默认接入 Daybreak Blue 网络安全模型

    OpenAI 宣布 Codex Security Cloud 迎来重大升级,默认通过 Daybreak Blue 接入具备网络安全能力的模型。该功能可扫描整个 GitHub 仓库、持续审查新提交、调查并去重发现的问题,并准备好待审核的修复方案,即使笔记本处于关闭状态也能运行。目前以插件形式在 Codex 桌面端和网页端提供。

  35. The Rundown AI(@TheRundownAI)AI 评估 · 79/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6.1 Sol,称以五分之一价格接近 Astra 智能水平

    OpenAI 发布 GPT-6.1 Sol,官方称其以五分之一的价格提供接近 Astra 的智能水平,输入 $2 / 百万 token、输出 $10 / 百万 token。

    为什么值得看

    材料给出 GPT-6.1 Sol 在编码、办公与电脑操作三类任务上的对标结果和定价,可用来比较同价位模型的取舍。

  36. OpenAI(@OpenAI)AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布 GPT-6.1 Sol,多项基准接近 GPT-6 Astra 且成本更低

    OpenAI 宣布 GPT-6.1 Sol 发布,称其在编码、computer use 和复杂专业工作上相较 GPT-6 Sol 有显著升级。该模型在多项基准上接近 GPT-6 Astra,同时成本大幅更低。

9月29日周二
  1. 沃垠AIAI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    保姆级教程:用Coding模型做视频,附全套元提示词

    作者冷逸演示了用 Coding 模型做视频的完整流程,底层逻辑是让 LLM 用 JavaScript 或 Three.js 写每一帧画面生成 HTML,经无头浏览器逐帧捕获后由 FFmpeg 编码成 MP4,全程在 Agent 内完成、不打开剪辑软件。

  2. 印记中文AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI周刊 #102:OpenAI 发布 GPT-6 Sol/Luna,Anthropic 发布 Claude Opus 5.5

    OpenAI 9/22 上线 GPT-6 Sol 和 Luna,Sol 定价 $2/$10 MTok 约为 GPT-5.6 一半,DeepSWE 68.8%,Luna 定价 $0.10/$0.50 MTok、单任务成本约 Sol 的 1/5。

  3. Suhail(@Suhail)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Suhail:与其恐惧 AI,不如把自己当作"开放世界创造者"

    Suhail 认为,对 AI 的恐惧可以用更大胆的想象替代——软件工程师可以把自己重新定义为"开放世界创造者",技术与创意兼备将更有优势。

  4. 阿里技术AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里稳定性团队 AI Native 研发实践:用 Skill 与 Plugin 约束 AI 生成的前端代码

    阿里稳定性团队复盘 AI Native 研发转型:当后端、产品、设计师都能用 AI 写前端,代码能跑却难接手,于是把团队判断做成结构化规则包 Skill,并打包为 Claude Code Plugin「Anchor」。