跳到正文

全部动态

今日 0 条
9月16日周三
  1. Fei-Fei Li(@drfeifei)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    World Labs 招募机器人学习研究员与工程师

    World Labs 正在招聘机器人学习方向的研究员与工程师,Yunzhu Li 与李飞飞邀请加入团队,共同定义并扩展面向机器人学习的下一代世界模型。招聘贴附带了 Atlas for Robotics 与 Real-to-Sim-to-Real 两篇博客及申请链接。

  2. Perplexity(@perplexity_ai)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 公开 CobbleDB 研究:两人加数百 AI 智能体两个月建成搜索键值数据库

    Perplexity 发布研究,介绍其为搜索网页内容服务的键值数据库 CobbleDB 的构建过程,由两名工程师和数百个常驻 AI 智能体在两个月内完成核心基础设施。该数据库用于为 Perplexity 搜索提供网页内容支持。

  3. Genspark(@genspark_ai)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 亮相花旗全球 TMT 大会:用最优模型组合,把研究周期缩短 40%

    Genspark 上周参加花旗全球 TMT 大会,与 Cresta.ai CEO Ping Wu 等企业及 AI 领域负责人同场。Genspark 主张按任务选用最优模型,将人从繁琐事务中解放,已观察到机构把研究周期缩短 40%,并将四小时初稿流程压缩至 35 分钟。

  4. Greg Brockman(@gdb)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 Astra 与 OpenAI 的 Luna 双双登顶:支出与 token 用量各占榜首

    Anthropic 的 Astra 上周成为按支出(美元花费)计算的榜首模型,OpenAI 的 Luna 则成为按 token 使用量计算的榜首模型,且领先幅度很大。这组对比显示,按钱包份额与按 token 份额衡量的模型排名出现分化。

  5. Sundar Pichai(@sundarpichai)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 公布 AI 加速科学四大重点方向,AlphaGenome Atlas 与 WeatherNext 3 亮相

    Google 公布其用 AI 加速科学、改善生活的四大重点方向:健康、自然灾害与天气韧性、学习以及经济机会。过去一周多,其用 AlphaGenome Atlas 绘制人类基因组全部 9B 种单字母遗传变异并开放给研究者,还推出迄今最准的全球天气 AI 模型 WeatherNext 3,并发布开放获取的 AI & Economy ATLAS。其服务现已覆盖近 300 种语言、约 7B 使用者。

  6. Philipp Schmid(@_philschmid)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google 发布新模型(原文仅含 blog.google 链接,缺具体信息)

    该推文仅包含一个指向 blog.google 创新与 AI 板块的链接,未附带任何正文说明,因此无法确认具体模型名称、版本号、参数规模或 benchmark 数据。

  7. NVIDIA Technical BlogAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA NVLink 6 如何为 AI 工厂提供多层弹性

    NVIDIA 详解 NVLink 6 如何为大规模 AI 工厂提供多层弹性。在超大规模 AI 训练中,集群内每块 GPU 每秒需完成数千次集合通信以同步梯度;推理阶段非计划停机则会直接减少请求处理量,压缩收入。

  8. NVIDIA Technical BlogAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Groq 3 LPX 确定性执行如何为 NVIDIA Vera Rubin 带来高能效高交互推理

    NVIDIA 详解 Groq 3 LPX 的确定性执行如何在 NVIDIA Vera Rubin 平台上驱动高能效、高交互性推理。文章指出,功耗是 AI 工厂的核心约束,衡量 AI 平台价值的关键指标是每瓦性能而非未归一化的原始吞吐量。

  9. LlamaIndex 🦙(@llama_index)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 谈用 Stainless 维护 SDK:API 一变就要更新、测试和发布

    LlamaIndex 分享了借助 Stainless 为 LlamaParse 生成并维护 SDK 的经验,指出每次 API 变更都会带来更新、测试和发布成本,而代码中暴露的不一致命名与 schema 也更难被忽视。Stainless 团队已加入 Anthropic,George He 和 Yong Park 撰文回顾了做对了什么、学到了什么,以及更换 SDK 生成器为何比预想更需谨慎。

9月15日周二
  1. Dify(@dify_ai)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Dify 与 TiDB、Eagle Cloud 悉尼 Tech Night:从原型到可信生产

    Dify 将于 9 月 18 日在悉尼与 TiDB、Eagle Cloud 共同举办 Tech Night,主题为“Scaling AI: From Prototype to Trusted Production”。

  2. Sam Altman(@sama)AI 评估 · 4/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 预告本周有大动作,DevDay 将迎来六连发

    Sam Altman 发推预告本周将有一个大动作,随后 DevDay 更会有六个大动作。推文未透露具体产品或模型名称,仅以 🚢 表情指代,该帖已获超 14000 次点赞、619 次转发。

  3. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mustafa Suleyman 发布「人文主义 AI 行为准则」公开征求意见

    Mustafa Suleyman 发布《人文主义 AI 行为准则》(Humanist AI Code of Conduct),并面向公众公开征求意见。该准则于发布前一天放出consultation版本,Suleyman 同时分享了相关思考,全文可在 mustafa-suleyman.ai 查阅。

  4. Lovable(@lovable_dev)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable:创作者即创始人

    Lovable 发布内容称“创作者即创始人”(Creators are founders),该帖获 197 点赞、24 次转发、12 条回复,浏览量 25588。

  5. Julien Chaumond(@julien_c)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    iOS 27 的一个有趣细节

    这条推文只提到 iOS 27 有一个"有趣的细节",并给出一个向下箭头,正文未展开任何具体功能、版本号或数据,仅显示 3 条回复、0 次转发、5 个赞、3183 次浏览,由 xgo.ing 提供支持。

  6. 海外独角兽AI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent Labs:AlphaFold 3 发布两年,AI 药物设计进展到了哪一步?

    AlphaFold 2 核心作者 Simon Kohl 创办的 Latent Labs 走"直接做蛋白质生成设计"路线,2025 年 7 月发布 Latent-X1,在 7 个靶点上湿实验测出大环肽命中率 91%–100%、mini-binder 10%–64%。

  7. 硅谷101AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI开始预测人类:83亿虚拟人格、数字社会,与一门押注未来的生意

    AI Simulation赛道升温,Simile估值达20亿美元,Aaru估值接近10亿美元,哈佛与MIT等机构联合的MatrAIx项目构建了83亿个AI虚拟人格。MatrAIx用1290个维度定义每个人格,完成超1.8万次测试,400次受控实验显示91.5%情况下Agent能遵循预设人格。Simile已为财富100强企业运行数千万次模拟,CVS用它构建了40万个数字分身。

  8. Stack Overflow BlogAI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    播客:Texas 法学院 AI Innovation and Law 项目谈 AI 法律与政策难题

    得克萨斯大学法学院开设 AI Innovation and Law 项目,研究人工智能带来的法律与政策问题,Kevin 在其播客 Scaling Laws 中亦有讨论。本期节目录制于 Ai4 大会。

  9. Amjad Masad(@amasad)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Brian Chau 称一家以色列 Effective Altruism 公司幕后策划 OpenAI、Anthropic 与 Meta 网络攻击

    Brian Chau 发推称,一家以色列 Effective Altruism 公司是 OpenAI、Anthropic 和 Meta 三起网络攻击的幕后推手,并称 @lumpenspace 参与协助。该推文附带长线程,获 278 次转发和 3984 次点赞。上述指控目前仅为该推文单方说法。

  10. LangChain BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Schneider Electric、Vodafone 与 monday.com 如何在欧洲和中东规模化落地 AI 智能体

    Schneider Electric、Vodafone 和 monday.com 分享了规模化运营 AI 智能体的经验:Schneider Electric 建立 350 人内部 AI Hub,支撑 60 多个智能体,以可观测性、评估和部署为核心构建 LLMOps 体系。

  11. 阿里云开发者AI 评估 · 9/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    云栖大会:千问AI平台全栈开造,设三大体验展区

    千问AI平台将于9月22-24日在杭州国际博览中心云栖大会设分论坛与三大体验展区,现场开放 Model·Skill·Agent 体验动线。活动涵盖平台能力与共创计划首发、AIGC 创作、模型评测、Skills 与 Agent 实战及新手 AI 实训营,并可申领最高1亿 Token 权益。

  12. Kling AI(@Kling_ai)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    KlingAI 在 TIFF The Market 举办专家座谈与行业招待会,探讨 AI 如何让影视制作更平价可及

    KlingAI 在 TIFF The Market 举办专家座谈与行业招待会,汇聚电影人与科技领袖。双方探讨了 AI 作为工具如何让影视制作更平价、更易获取。

  13. 暗涌WavesAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    芝诺机器人完成数亿元种子轮融资,押注多机协作与3B模型Zeno-1

    具身智能初创公司芝诺机器人完成总额数亿元人民币种子轮融资,投资方包括舜宇光学、沐曦股份、网新集团、赛意产业基金等。该公司自研3B参数基础模型Zeno-1与机器人Malo,采用去中心化架构实现多机协作,据称单策略可连续运行超10分钟、完成8个子任务。芝诺机器人于2025年11月展业,预计2027年上半年启动规模化进程。

  14. Elastic BlogAI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Elastic 在 2026 年 AV-Comparatives EPR 测试中拿下唯一满分

    Elastic Security 在 AV-Comparatives 2026 年 Endpoint Prevention and Response(EPR)测试中获得唯一的 100% 防护得分,并在 14 家厂商中实现最低的建模运营占用与零误报。

  15. SemiAnalysisAI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 实测 Vera Rubin NVL72 智能体推理:每美元性能最高提升 67 倍

    SemiAnalysis 用自研 AgentX 智能体推理基准实测 NVIDIA Vera Rubin NVL72,在 Apples to Apples TRTLLM NVFP4 Dense 配置下。

  16. Greg Brockman(@gdb)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ChatGPT 帮父母破解女儿罕见遗传病:Olivia 终于能睡整夜

    Olivia 常年生病、从未睡过整夜,父母用 ChatGPT 准备向医生提问的问题,医生据此识别出一种罕见遗传病,随后又发现她脑活动异常。接受治疗后,她生病次数减少,终于能睡整夜。

  17. Y Combinator(@ycombinator)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Earendil Robotics 研发自主拦截无人机,用软件与训练补齐防空能力

    Earendil Robotics 正在研发自主拦截无人机,配套从零建立该能力所需的软件与训练体系。其系统可自主起飞、转场并拦截目标,把数月的飞行员训练压缩成几次点击,目标是把防空做到足够便宜以大规模部署、足够简单以规模化操作。

  18. Y Combinator(@ycombinator)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Y Combinator 呼吁美国参议院通过 Clarity Act,为创业者提供明确规则

    Y Combinator 公开呼吁美国参议院通过 US Clarity Act,称该法案为下一波创业者提供了明确性。其表示,长期以来机构不敢投资、初创公司常跳过面向美国市场进行构建。

9月14日周一
  1. Kling AI(@Kling_ai)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Kling AI 在 TIFF The Market 举办专家座谈与行业招待会,探讨 AI 如何降低影视制作门槛

    Kling AI 在 TIFF The Market 举办专家座谈与行业招待会,汇聚电影人与科技领袖,探讨 AI 作为工具如何让影视制作更可负担、更易触及。

  2. Anton Osika – eu/acc(@antonosika)AI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anton Osika 宣布新 SF 办公室即将落地

    Anton Osika 宣布新的旧金山(SF)办公室即将到来,未透露具体地址与启用时间。该帖获得 1137 次点赞、98 条回复和 22 次转发。

  3. Mustafa Suleyman(@mustafasuleyman)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mustafa Suleyman 发布 X 长文文章

    Mustafa Suleyman 在 X 发布一篇长文文章,原文仅给出 x.com/i/article/2099… 链接,未提供标题或正文内容。该帖获 1899 次点赞、352 次转发、363 条回复,浏览量约 626 万。

  4. 随机小分队AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Linkloud 沙龙第 44 期:Agent 如何从“能做”走向“能用”与“能卖”?

    Linkloud 沙龙第 44 期将于 2026 年 9 月 19 日在成都举办线下活动,主题为 Agent 如何从“能做”走向“能用”与“能卖”。

  5. 大淘宝技术AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    淘天自研编码器 S266 斩获 MSU 2025 视频编码器大赛 6 项冠军

    淘天音视频技术团队自研的 H.266/VVC 编码器 S266 在第19届 MSU 世界视频编码器大赛(MSU 2025 FullHD 赛道)包揽 1 FPS、5 FPS、30 FPS 三个速度档位的 VMAF 冠军,S26X 则在 1 FPS 档位拿下 SSIM、PSNR 和主观评价三项第一,累计 6 项冠军及 1 项季军。

  6. 深网腾讯新闻AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智谱再融约392.7亿港元,首次配售款已用34.92%

    智谱于9月13日晚公告拟配售新H股并发行美元可转债,两笔合计净额约392.7亿港元(约50亿美元),各自独立、不互为条件。截至2026年8月31日,IPO募资已悉数动用,7月首次配售的313.75亿港元仅动用约34.92%。

  7. Epoch AIAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:美国成年人近每日使用 AI 的比例六个月内翻倍以上

    Epoch AI 分析显示,2026 年 3 月至 8 月间美国成年人每周使用 AI 服务的比例按使用天数分组后,近每日使用(6–7 天)的占比六个月内增长超过一倍。所有比例均以全体美国成年人为基数,同一调查轮次中 1 天、2–5 天、6–7 天三组与未使用者合计为 100%。数据来自 Ipsos 调查,3 月用单个总体问题询问,8 月则按服务分别询问使用天数后归入同一分组。

  8. Satya Nadella(@satyanadella)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Satya Nadella:Quincy 数据中心示范与社区共建、共同成长的可能

    Satya Nadella 以华盛顿州 Quincy 为例,说明与社区共同建设数据中心、并随时间共同成长是可行的。他转引了 Brad Smith 的相关文章。

  9. Figma(@figma)AI 评估 · 2/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Figma 发布 YouTube 视频预告

    Figma 在 X 上发布一条推广帖,附带 bit.ly/FigmaYouTube 短链,引导用户前往其 YouTube 频道观看内容,但正文未说明视频主题。

9月13日周日
  1. 硅谷科技评论AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前 1% 业绩换不来上期一半资金:LP 按方向清单买基金,AI 物理基础设施成新闸门

    一只每投 1 块已还 LP 3.6 块、排进全球前 1% 的基金,募新一期只拿到上期一半。8 月 28 日 a16z 完成 11 亿美元 Machine Age Fund 募集,专投 AI 硬件;同月成立两年、零回款记录的 Permanent Capital Ventures 二期反而从 1.5 亿增至 2 亿美元。

9月12日周六
  1. clem 🤗(@ClementDelangue)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 发起 Open Alignment Initiative 并申请加入 Anthropic 嵌入式评估者计划

    Hugging Face 联合创始人 Clement Delangue 宣布发起 Open Alignment Initiative,该倡议由 Thom Wolf 和 Hugging Face 主导,主张对齐问题无法只在少数前沿实验室闭门解决。

  2. Simon Willison(@simonw)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 曾攻击 PyPI,OpenAI 此次对 RubyGems 的攻击更为激进

    Anthropic 此前曾攻击 PyPI,而 OpenAI 此次对 RubyGems 的攻击更为激进。相关调查内容发布于 anthropic.com/news/investiga…。

  3. Simon Willison(@simonw)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Simon Willison:另一批 OpenAI 智能体集群 5 月曾攻击 RubyGems

    Simon Willison 称,另一批 OpenAI 智能体集群早在 5 月就在 RubyGems 上进行垃圾信息和漏洞利用,时间距离此前曝光的 Wiki 攻击仅数天。他附上了自己博客的相关链接 simonwillison.net/2026/Sep/12/op。