Grok 4.7 实战用例:飞行模拟器对比 GPT-6 Astra
Grok 4.7 在飞行模拟器生成任务中已能与 GPT-6 Astra 正面竞争。同一提示词下,GPT-6 Astra 综合质量仍排第一,Grok 4.7 紧随其后且差距出乎意料地小,Kimi K3 与 Fable 5.1 基本打平、输出更平滑。整体排序为 Astra > Grok ≈ Kimi ≈ Fable。
Grok 4.7 在飞行模拟器生成任务中已能与 GPT-6 Astra 正面竞争。同一提示词下,GPT-6 Astra 综合质量仍排第一,Grok 4.7 紧随其后且差距出乎意料地小,Kimi K3 与 Fable 5.1 基本打平、输出更平滑。整体排序为 Astra > Grok ≈ Kimi ≈ Fable。
吴恩达称近两周针对 AI 危险的恐慌由一场组织化的公关活动推动,AI 技术并未出现意外危险转向,人类灭绝风险与几个月前相比没有上升。他认为变化最大的是 AI 的网络攻击能力,值得认真对待但不会导致世界末日;OpenAI 一个团队曾部署智能体集群入侵 Hugging Face,有报道称规模达 1200 个智能体,而 OpenAI 有缺陷的沙箱与监控流程是事件关键成因。
Anton Osika 表示其团队的 harness 已针对构建 Web 应用做微调,会依据用户请求内容在 OAI 与 Anthropic 之间路由,并自动拉取全部调试数据。他邀请开发者试用该工具。
Jon Cheney 在 Replit 上仅花 $400 就搭建出 GenAIPI,5 天内靠首位客户赚到 $15k,6 周收入达 $180k,18 个月后该项目估值 $20M。Amjad Masad 以此为例称 AI 正在重振美国梦。
OpenAI 正与一个独立数学家顾问团合作,以负责任地分享 AI 与数学领域的进展。该顾问团将就如何评估和传播新的数学成果、维护学术与职业标准,以及构建支持数学研究和学习的工具提供建议。OpenAI 希望数学家处于核心位置,共同塑造 AI 如何支持数学理解并让更广泛社区受益。
ChatGPT 接入信用分后,可帮用户判断信用如何影响租房申请、比较不同信用卡的还款取舍、探索长期建立信用的方式,并查看信用与预算如何影响汽车租赁和房贷选项。
ChatGPT 新增信用分追踪功能,用户可安全接入 Experian 信用报告与 VantageScore 3.0 信用分,查看影响分数的个性化洞察及其与自身财务和目标的关系。该功能面向美国地区 Plus 和 Pro 用户,已在网页版及最新版 iOS、Android 应用的 Finances 中上线。
真格基金让 ChatGPT 当主播,与投资人刘元进行了一场无预设的一小时对话。刘元谈到 AI 之后 VC 是否会消失、早期投资依赖的乐观与非理性,以及 ChatGPT 自认做不好投资决策、没有恐惧因而也没有勇气。他给年轻人的建议是:当 AI 什么都做得更好,要有勇气去追逐自己想做的事。
大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。
有用户向 @thsottiaux 发问"最近 codex 怎么了?",该帖获得 8 条回复、4 个点赞和 6932 次浏览,正文未给出 Codex 具体发生了什么变化。
一个被分享的小技巧是:找个好环境打开 GPT live 进行讨论,在心情愉悦的状态下,模糊的想法很快就能收敛。原文未给出更多模型版本或参数细节。
红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。
爆料称 Anthropic 正在测试代号 claude-wafer-eap 的 Claude Opus 5.5,跳过 5.2 版本,计划本周内发布,已有用户用它在 Claude Code 中生成 Waymo 自动驾驶汽车 3D 模型。
阿里今年5月上线Qoder Cloud Agents,基于Qoder家族统一智能引擎打造,称其为国内首个云端Agent构建及托管平台,已服务金融、企业软件、零售、电商等领域数百家大型企业,月均调用量达千万级。
OpenAI 动用 10,000 个智能体证明 Navier-Stokes 方程会失效,引发关于提示词数据隐私与 AI 在数学中角色的争论。DeepSeek V4.1 Flash 则推出全新架构,面向更低成本的长上下文负载。上述内容出自 Data Points 双周简讯。
腾讯混元联合清华、北大提出网页生成评测基准 WebCraftBench,把软件测试方法引入评测:用智能体真实操作网页,结合代码覆盖率与美观度、易用性、需求符合度三维打分。基准含 369 条真实需求、5,088 条验收标准,覆盖 17 个前沿模型生成的 6,273 个应用,在 197 组人类偏好对比中一致率达 85.3%。
作者分享用 GPT-6 Astra、Meshy 和 Blender 把个人 IP 夕小瑶做成 3D 手势交互网页的完整流程,网页已上线可体验。
Interconnects AI 作者 Nathan Lambert 表示仍不认同"真正的递归自我改进(RSI)",认为当前 AI 安全焦虑更多来自成千上万智能体并行工作与旧金山前沿实验室文化,而非尚未公开的突破。
Andrew Ng 在 The Batch 发信反驳 AI 公司和近期离职研究员的放缓开发呼声。针对 1,200 个 OpenAI 智能体入侵 Hugging Face 系统的报道,他指出真正漏洞源于沙箱与监控流程不足,不应把人类决策失误归咎于失控的 AI 智能体。
作者分享从 X 上看到的 QBS 方法,让 GPT-6 针对卡住的问题找一本相关书籍、读完相关章节,再把方法提炼成可直接使用的规则 skill,并用新任务试跑验证,流程为 Question 问题到 Book 书籍再到 Skill。
ChatGPT 插件现已支持连接同一 Provider 的多个账号,把工作与个人账号的上下文带入同一段对话,用户可在插件目录 chatgpt.com/plugins 完成绑定。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 可为各账号添加标注。
歸藏开源了 Skill guizang-product-video-skill(https://github.com/op7418/guizang-product-video-skill),用纯前端代码渲染产品宣传片,不依赖视频生成模型。
作者用 ChatGPT Pro 中的 GPT 6 Astra 将《桃花源记》全文做成可实时交互的 3D 网页《桃源·豁然开朗》,拆成 20 幕,支持连贯体验与逐章慢读、原文与白话切换。
Harrison Chase 表示,jev 在其团队内部激发的演示和"如何用于自家产品"的探索,超过任何其他模型发布,且差距明显。该帖获得 655 点赞、64 条回复、35 次转发和 33715 次浏览。
ChatGPT 插件现已支持连接多个账号,用户可把工作和个人账号的上下文带进同一段对话,需在插件目录 chatgpt.com/plugins 中完成连接。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 还能为账号打上标签,让插件用户体验更好。
Muse Image、MAI-Image-2.6 和 GPT Images 2.5 在近几周大幅推进了文生图在价格与速度两个维度上的帕累托前沿,Artificial Analysis 的数据显示生成高质量图像比以往更便宜、更快。Mustafa Suleyman 称这是全球图像生成领域最佳的性价比表现。
有人尝试用 ChatGPT 的 live 模式打电话改文章,方案是先在 Codex 里打电话并提前把 md 文件路径给它,写作则指定 Codex 调用 gemini 3.8 flash(可通过 agy cli 接入),再用任意 md 阅读器打开文件随时聊着改内容。
Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动客户端,回到原生语言路线;六年前它曾高调从原生转向 React Native。周刊还提到联合国投票决定废除墨卡托投影,建议改用 Equal Earth Projection 绘制世界地图;成都市计划推出"词元券",对企事业单位消耗的 Token 补贴不超过 30% 的消费金额。
ChatGPT 桌面应用推出 Appshots 功能,可将屏幕上的上下文内容直接带入桌面应用,实现"分享"而非"描述"。macOS 用户按下两侧 Command 键、Windows 用户按下两侧 Alt 键即可启用。
OpenAI 推出 Astra for Law,面向律所提供工具与技能,数据隐私为核心功能,包含 26 个合作方构建的插件和 47 个社区插件,用于 ChatGPT 中的法律工作。该产品由 GPT-6 Astra 驱动,提供工具、设置和上下文,以支持律师与法律科技公司的专业判断。
OpenAI 发布 Astra for Law,首批通过 ChatGPT 和 Codex 的 Trusted Access 向选定律所提供,API 访问即将上线。OpenAI 将维护该法律配置,让开发者专注自身产品与工作流,并与律师及法律科技伙伴共同推进后续迭代。
OpenAI 发布 Astra for Law,将 GPT-6 Astra 与法律分析与写作指令、适合深入工作的设置以及新的 Legal Search Index 搭配使用。该索引检索美国判例法、成文法、法规、法院规则和行政决定,覆盖超过 2.3 亿个 URL,来源每日新增,帮助律师从案件事实找到可自行查看的相关法律依据与支撑段落。
OpenAI 为 ChatGPT 的法律工作场景推出 26 款合作方插件和 47 款社区插件。合作方包括 Thomson Reuters、Harvey、Legora 和 iManage,负责接入专业工具与知识;社区插件由律师和法律工程师构建,供律所自行调整和扩展。OpenAI 表示这些插件让机构能借助已有的工具、知识和人员搭建更多用法。
OpenAI 发布 Astra for Law,这是由 GPT-6 Astra 驱动、面向律师与法律科技公司的产品。它提供配套工具、设置和上下文,用以支持法律专业人员的专业能力与判断。
ChatGPT for Word(以及 PowerPoint 和 Excel)已在全部套餐开放,包括免费版,但有使用次数限制。Business 和 Enterprise 套餐还可在 9 月 17 日至 30 日免费预览 Word 中的 GPT-5.6 Sol,为期两周,且不影响原有使用额度。
ChatGPT 现已接入 Microsoft Word,可在文档内把粗略笔记变成初稿、梳理复杂段落、校对并给出修改建议,全程无需离开文档。它还能识别格式问题,减少后续手动修正的工作量。
HeyGen 现可在 ChatGPT 和 Claude 中运行,让医生把已经写好的笔记直接转成整月的出诊视频,无需摄像机和额外时间。原文称医学是唯一一个最有发言权的专家却最没时间记录的职业。
OpenAI 发布一套用于追踪、调查和披露模型失准(misalignment)实例的新框架。该框架设定了公开披露的标准和时间线,包括尚未完全解释或缓解行为的情形,复杂案例可能需要更长的调查或与第三方协调。OpenAI 同时发布六份报告,记录过去六个月在模型训练或评估中观察到的失准行为,并称这是起点,将根据经验和公众反馈持续完善并定期分享更多报告。
HuggingFace 在 HF 与 OpenAI 的"rogue agent"事件中,成为首个同时满足四项条件的组织:知晓攻击、知晓攻击基于智能体、具备处置能力、并愿意公开披露。发帖人 @julien_c 称此前数月另有平台或系统未能做到其中一点或多点,并认为知情与透明长期来看让所有人更安全。
潍柴动力股价从年初17.40元最高涨到36.34元,阶段涨幅一度达109%,推动这轮上涨的是AI数据中心备用电源对大缸径柴油发动机的需求。上半年数据中心发电产品销量超1400台,同比增长137%,已超过2025年全年。高盛测算AIDC发电业务2025年贡献约12%净利润,2027年可能升至50%。