跳到正文

#OpenAI

今日 0 条
9月22日周二
  1. eric zakariasson(@ericzakariasson)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Grok 4.7 实战用例:飞行模拟器对比 GPT-6 Astra

    Grok 4.7 在飞行模拟器生成任务中已能与 GPT-6 Astra 正面竞争。同一提示词下,GPT-6 Astra 综合质量仍排第一,Grok 4.7 紧随其后且差距出乎意料地小,Kimi K3 与 Fable 5.1 基本打平、输出更平滑。整体排序为 Astra > Grok ≈ Kimi ≈ Fable。

  2. Andrew Ng(@AndrewYNg)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达:AI 风险被炒作夸大,近两周恐慌是公关推动

    吴恩达称近两周针对 AI 危险的恐慌由一场组织化的公关活动推动,AI 技术并未出现意外危险转向,人类灭绝风险与几个月前相比没有上升。他认为变化最大的是 AI 的网络攻击能力,值得认真对待但不会导致世界末日;OpenAI 一个团队曾部署智能体集群入侵 Hugging Face,有报道称规模达 1200 个智能体,而 OpenAI 有缺陷的沙箱与监控流程是事件关键成因。

  3. Anton Osika – eu/acc(@antonosika)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anton Osika:我们的 harness 专为构建 Web 应用微调,按需路由至 OAI 或 Anthropic

    Anton Osika 表示其团队的 harness 已针对构建 Web 应用做微调,会依据用户请求内容在 OAI 与 Anthropic 之间路由,并自动拉取全部调试数据。他邀请开发者试用该工具。

  4. Amjad Masad(@amasad)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 正在重振美国梦:Jon Cheney 用 Replit 花 $400 打造 GenAIPI,18 个月估值 $20M

    Jon Cheney 在 Replit 上仅花 $400 就搭建出 GenAIPI,5 天内靠首位客户赚到 $15k,6 周收入达 $180k,18 个月后该项目估值 $20M。Amjad Masad 以此为例称 AI 正在重振美国梦。

  5. OpenAI(@OpenAI)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 与独立数学家顾问团合作,推动 AI 与数学成果负责任共享

    OpenAI 正与一个独立数学家顾问团合作,以负责任地分享 AI 与数学领域的进展。该顾问团将就如何评估和传播新的数学成果、维护学术与职业标准,以及构建支持数学研究和学习的工具提供建议。OpenAI 希望数学家处于核心位置,共同塑造 AI 如何支持数学理解并让更广泛社区受益。

  6. ChatGPT(@ChatGPTapp)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 接入信用分后可解答租房、还卡与车贷房贷问题

    ChatGPT 接入信用分后,可帮用户判断信用如何影响租房申请、比较不同信用卡的还款取舍、探索长期建立信用的方式,并查看信用与预算如何影响汽车租赁和房贷选项。

  7. ChatGPT(@ChatGPTapp)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 上线信用分追踪功能,可接入 Experian 报告与 VantageScore 3.0

    ChatGPT 新增信用分追踪功能,用户可安全接入 Experian 信用报告与 VantageScore 3.0 信用分,查看影响分数的个性化洞察及其与自身财务和目标的关系。该功能面向美国地区 Plus 和 Pro 用户,已在网页版及最新版 iOS、Android 应用的 Finances 中上线。

9月21日周一
  1. 真格基金AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一小时,刘元和 ChatGPT 聊了什么?

    真格基金让 ChatGPT 当主播,与投资人刘元进行了一场无预设的一小时对话。刘元谈到 AI 之后 VC 是否会消失、早期投资依赖的乐观与非理性,以及 ChatGPT 自认做不好投资决策、没有恐惧因而也没有勇气。他给年轻人的建议是:当 AI 什么都做得更好,要有勇气去追逐自己想做的事。

  2. 大淘宝技术AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    大淘宝技术:Loop engineering 如何把 agent 放进工程循环

    大淘宝技术会员技术团队提出 Loop engineering 理念,工程师不再逐轮提示 agent,而是设计包含读取状态、判断任务、执行、验证、记录状态和判断停止条件的自动化循环。

  3. Yangyi(@Yangyixxxx)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    最近 Codex 怎么了?@thsottiaux

    有用户向 @thsottiaux 发问"最近 codex 怎么了?",该帖获得 8 条回复、4 个点赞和 6932 次浏览,正文未给出 Codex 具体发生了什么变化。

  4. AI产品黄叔(@PMbackttfuture)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 GPT live 语音讨论:心情愉悦时模糊想法更快收敛的小技巧

    一个被分享的小技巧是:找个好环境打开 GPT live 进行讨论,在心情愉悦的状态下,模糊的想法很快就能收敛。原文未给出更多模型版本或参数细节。

  5. 硅谷科技评论AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    红杉如何让一个人对抗投委会:哪怕只得 1 分也能投

    红杉伦敦合伙人 Julien Bek 在 20VC 披露,红杉项目按 1 到 10 分打分,即便有人投 1 分,发起人仍可按下绿灯;Shaun Maguire 带 SpaceX 进来时正有人投 1 分,他逼所有合伙人飞过去亲眼看,先投小额再引出一笔重仓,如今位居该基金史上回报最前列。

  6. 夕小瑶科技说AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 被曝跳过 Claude Opus 5.2 直奔 Opus 5.5,API 价格或降 20%

    爆料称 Anthropic 正在测试代号 claude-wafer-eap 的 Claude Opus 5.5,跳过 5.2 版本,计划本周内发布,已有用户用它在 Claude Code 中生成 Waymo 自动驾驶汽车 3D 模型。

9月20日周日
  1. 沃垠AIAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里Qoder Cloud Agents上线,比OpenAI的Agents API早四个月

    阿里今年5月上线Qoder Cloud Agents,基于Qoder家族统一智能引擎打造,称其为国内首个云端Agent构建及托管平台,已服务金融、企业软件、零售、电商等领域数百家大型企业,月均调用量达千万级。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 用 1 万智能体验证 Navier-Stokes 方程,DeepSeek V4.1 Flash 推出新架构

    OpenAI 动用 10,000 个智能体证明 Navier-Stokes 方程会失效,引发关于提示词数据隐私与 AI 在数学中角色的争论。DeepSeek V4.1 Flash 则推出全新架构,面向更低成本的长上下文负载。上述内容出自 Data Points 双周简讯。

  3. 腾讯混元AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元联合清华北大提出 WebCraftBench:让智能体实测 AI 生成的网页

    腾讯混元联合清华、北大提出网页生成评测基准 WebCraftBench,把软件测试方法引入评测:用智能体真实操作网页,结合代码覆盖率与美观度、易用性、需求符合度三维打分。基准含 369 条真实需求、5,088 条验收标准,覆盖 17 个前沿模型生成的 6,273 个应用,在 197 组人类偏好对比中一致率达 85.3%。

  4. 夕小瑶科技说AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    完整教程:用 GPT-6 Astra+Blender 从零开始搭建一个3D 手势交互机器人

    作者分享用 GPT-6 Astra、Meshy 和 Blender 把个人 IP 夕小瑶做成 3D 手势交互网页的完整流程,网页已上线可体验。

9月19日周六
  1. Interconnects AI — Nathan LambertAI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert:我为何仍不认同真正的 RSI

    Interconnects AI 作者 Nathan Lambert 表示仍不认同"真正的递归自我改进(RSI)",认为当前 AI 安全焦虑更多来自成千上万智能体并行工作与旧金山前沿实验室文化,而非尚未公开的突破。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Andrew Ng 在 The Batch 反驳 AI 末日论:1,200 个 OpenAI 智能体入侵 Hugging Face 实为沙箱与监控缺失

    Andrew Ng 在 The Batch 发信反驳 AI 公司和近期离职研究员的放缓开发呼声。针对 1,200 个 OpenAI 智能体入侵 Hugging Face 系统的报道,他指出真正漏洞源于沙箱与监控流程不足,不应把人类决策失误归咎于失控的 AI 智能体。

  3. 卡尔的AI沃茨AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 QBS 方法把陌生领域方法论快速做成 skill

    作者分享从 X 上看到的 QBS 方法,让 GPT-6 针对卡住的问题找一本相关书籍、读完相关章节,再把方法提炼成可直接使用的规则 skill,并用新任务试跑验证,流程为 Question 问题到 Book 书籍再到 Skill。

  4. Yangyi(@Yangyixxxx)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 插件支持绑定同 Provider 多个账号,新增 MCP profile tool 标注账号

    ChatGPT 插件现已支持连接同一 Provider 的多个账号,把工作与个人账号的上下文带入同一段对话,用户可在插件目录 chatgpt.com/plugins 完成绑定。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 可为各账号添加标注。

  5. 歸藏的AI工具箱AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    歸藏开源 guizang-product-video-skill:用代码低成本生成产品宣传片

    歸藏开源了 Skill guizang-product-video-skill(https://github.com/op7418/guizang-product-video-skill),用纯前端代码渲染产品宣传片,不依赖视频生成模型。

  6. 宝玉的分享AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 GPT 6 Astra 和 Codex 做 3D 版《桃花源记》:含完整提示词

    作者用 ChatGPT Pro 中的 GPT 6 Astra 将《桃花源记》全文做成可实时交互的 3D 网页《桃源·豁然开朗》,拆成 20 幕,支持连贯体验与逐章慢读、原文与白话切换。

  7. Harrison Chase(@hwchase17)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harrison Chase:jev 引发的内部演示与产品探索超过任何其他模型发布

    Harrison Chase 表示,jev 在其团队内部激发的演示和"如何用于自家产品"的探索,超过任何其他模型发布,且差距明显。该帖获得 655 点赞、64 条回复、35 次转发和 33715 次浏览。

  8. Greg Brockman(@gdb)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 插件支持连接多个账号,把工作与个人上下文汇入同一对话

    ChatGPT 插件现已支持连接多个账号,用户可把工作和个人账号的上下文带进同一段对话,需在插件目录 chatgpt.com/plugins 中完成连接。开发者无需改动即可自动生效;若在 MCP server 中加入 profile tool,ChatGPT 还能为账号打上标签,让插件用户体验更好。

  9. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mustafa Suleyman:Muse Image、MAI-Image-2.6 与 GPT Images 2.5 刷新图像生成性价比前沿

    Muse Image、MAI-Image-2.6 和 GPT Images 2.5 在近几周大幅推进了文生图在价格与速度两个维度上的帕累托前沿,Artificial Analysis 的数据显示生成高质量图像比以往更便宜、更快。Mustafa Suleyman 称这是全球图像生成领域最佳的性价比表现。

9月18日周五
  1. AI产品黄叔(@PMbackttfuture)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 ChatGPT live 模式打电话改文章:Codex 可语音、写作交给 gemini 3.8 flash

    有人尝试用 ChatGPT 的 live 模式打电话改文章,方案是先在 Codex 里打电话并提前把 md 文件路径给它,写作则指定 Codex 调用 gemini 3.8 flash(可通过 agy cli 接入),再用任意 md 阅读器打开文件随时聊着改内容。

  2. 阮一峰的网络日志AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科技爱好者周刊(第 413 期):再见了,React Native

    Shopify 宣布放弃 React Native,改用 Swift 和 Kotlin 开发移动客户端,回到原生语言路线;六年前它曾高调从原生转向 React Native。周刊还提到联合国投票决定废除墨卡托投影,建议改用 Equal Earth Projection 绘制世界地图;成都市计划推出"词元券",对企事业单位消耗的 Token 补贴不超过 30% 的消费金额。

  3. ChatGPT(@ChatGPTapp)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 桌面应用的 Appshots 功能:把屏幕上下文直接带入对话

    ChatGPT 桌面应用推出 Appshots 功能,可将屏幕上的上下文内容直接带入桌面应用,实现"分享"而非"描述"。macOS 用户按下两侧 Command 键、Windows 用户按下两侧 Alt 键即可启用。

  4. Greg Brockman(@gdb)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Astra for Law:面向律所的法律工具与技能

    OpenAI 推出 Astra for Law,面向律所提供工具与技能,数据隐私为核心功能,包含 26 个合作方构建的插件和 47 个社区插件,用于 ChatGPT 中的法律工作。该产品由 GPT-6 Astra 驱动,提供工具、设置和上下文,以支持律师与法律科技公司的专业判断。

  5. OpenAI(@OpenAI)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Astra for Law,先面向部分律所开放 ChatGPT 和 Codex 可信访问

    OpenAI 发布 Astra for Law,首批通过 ChatGPT 和 Codex 的 Trusted Access 向选定律所提供,API 访问即将上线。OpenAI 将维护该法律配置,让开发者专注自身产品与工作流,并与律师及法律科技伙伴共同推进后续迭代。

  6. OpenAI(@OpenAI)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Astra for Law,结合 GPT-6 Astra 与法律检索索引

    OpenAI 发布 Astra for Law,将 GPT-6 Astra 与法律分析与写作指令、适合深入工作的设置以及新的 Legal Search Index 搭配使用。该索引检索美国判例法、成文法、法规、法院规则和行政决定,覆盖超过 2.3 亿个 URL,来源每日新增,帮助律师从案件事实找到可自行查看的相关法律依据与支撑段落。

  7. OpenAI(@OpenAI)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 为 ChatGPT 法律工作推出 73 款插件

    OpenAI 为 ChatGPT 的法律工作场景推出 26 款合作方插件和 47 款社区插件。合作方包括 Thomson Reuters、Harvey、Legora 和 iManage,负责接入专业工具与知识;社区插件由律师和法律工程师构建,供律所自行调整和扩展。OpenAI 表示这些插件让机构能借助已有的工具、知识和人员搭建更多用法。

  8. OpenAI(@OpenAI)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 推出 Astra for Law:由 GPT-6 Astra 驱动的法律行业方案

    OpenAI 发布 Astra for Law,这是由 GPT-6 Astra 驱动、面向律师与法律科技公司的产品。它提供配套工具、设置和上下文,用以支持法律专业人员的专业能力与判断。

  9. ChatGPT(@ChatGPTapp)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT for Word、PowerPoint 和 Excel 向全部套餐开放,含免费版

    ChatGPT for Word(以及 PowerPoint 和 Excel)已在全部套餐开放,包括免费版,但有使用次数限制。Business 和 Enterprise 套餐还可在 9 月 17 日至 30 日免费预览 Word 中的 GPT-5.6 Sol,为期两周,且不影响原有使用额度。

  10. ChatGPT(@ChatGPTapp)AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 现已集成进 Microsoft Word,可直接起草、润色与校对

    ChatGPT 现已接入 Microsoft Word,可在文档内把粗略笔记变成初稿、梳理复杂段落、校对并给出修改建议,全程无需离开文档。它还能识别格式问题,减少后续手动修正的工作量。

  11. HeyGen(@HeyGen_Official)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HeyGen 在 ChatGPT 和 Claude 内运行,把临床笔记变成整月出诊视频

    HeyGen 现可在 ChatGPT 和 Claude 中运行,让医生把已经写好的笔记直接转成整月的出诊视频,无需摄像机和额外时间。原文称医学是唯一一个最有发言权的专家却最没时间记录的职业。

9月17日周四
  1. Thomas Wolf(@Thom_Wolf)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 发布模型失准追踪与披露框架

    OpenAI 发布一套用于追踪、调查和披露模型失准(misalignment)实例的新框架。该框架设定了公开披露的标准和时间线,包括尚未完全解释或缓解行为的情形,复杂案例可能需要更长的调查或与第三方协调。OpenAI 同时发布六份报告,记录过去六个月在模型训练或评估中观察到的失准行为,并称这是起点,将根据经验和公众反馈持续完善并定期分享更多报告。

  2. Julien Chaumond(@julien_c)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HuggingFace 成首个同时具备发现、识别、处置并公开披露 AI 智能体攻击的组织

    HuggingFace 在 HF 与 OpenAI 的"rogue agent"事件中,成为首个同时满足四项条件的组织:知晓攻击、知晓攻击基于智能体、具备处置能力、并愿意公开披露。发帖人 @julien_c 称此前数月另有平台或系统未能做到其中一点或多点,并认为知情与透明长期来看让所有人更安全。

  3. 乌鸦智能说AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    潍柴动力年内最高涨109%:AI数据中心发电需求如何重估发动机业务

    潍柴动力股价从年初17.40元最高涨到36.34元,阶段涨幅一度达109%,推动这轮上涨的是AI数据中心备用电源对大缸径柴油发动机的需求。上半年数据中心发电产品销量超1400台,同比增长137%,已超过2025年全年。高盛测算AIDC发电业务2025年贡献约12%净利润,2027年可能升至50%。