跳到正文

#编码

今日 3 条
今天10月10日周六
  1. 创业邦AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    黄仁勋女婿火速晋升英伟达全球 AI 基础设施增长副总裁;豆包回应可缴水电燃气费;英伟达市值一夜蒸发超万亿元丨邦早报

    英伟达 CEO 黄仁勋的长女 Madison Huang 与 35 岁的 Nico Caprez 结婚,后者今年 1 月升任英伟达全球 AI 基础设施增长副总裁,负责数据中心运营和"Neocloud"服务,并参与推进目标超 5000 亿美元的 AI 计算融资平台。

  2. Z FinanceAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    原 TRAE 负责人石扬离职创业做 AI 办公,联手前字节数据安全负责人傅越,首轮估值 2 亿美元

    原字节 AI 编程产品 TRAE 负责人石扬于国庆前夕离职,与前字节 AI 数据与安全负责人傅越联手创办 AI 办公公司,已敲定首轮融资,投后估值约 2 亿美元。石扬此前在字节操盘豆包 MarsCode 与 TRAE,傅越曾组建字节 Global Data 团队;新公司目前仍处于 Stealth Mode。

  3. OpenRouter(@OpenRouterAI)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Luna 和 Astra 带动 Codex 用量大幅增长

    OpenRouter 指出,Luna 和 Astra 正带动 Codex 用量大幅增长。该帖互动数据显示 11 条回复、1 次转发、123 次点赞、10861 次浏览,未披露具体增幅或使用数据。

10月9日周五
  1. 爱范儿AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果一大波新品曝光,最快下周发布/全球纯汽油车份额首次跌破50%/2599 美元起,Surface Laptop Ultra发布

    OpenAI 10 月 7 日起向 ChatGPT Plus、Pro、Business 和 Enterprise 用户推送 GPT-6,新增可组合图形、按钮、表单的「Intelligent UI」,内部评测中 GPT-6 Instant 比 GPT-5.6 Instant 提前 44% 开始回答需联网搜索的问题。

  2. AI Engineer(@aiDotEngineer)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI Engineer New York:AlixPartners 用 Claude Code 查合同与支出数据,识别重复申报

    AlixPartners 的 Natalia Connolly 和 Kevin Madura 将在 AI Engineer New York 分享如何用 Claude Code 分析合同与支出数据,识别智能体发现的节省是否被重复计算。该议题将于 10 月 14 日举行。

10月8日周四
  1. AI Engineer(@aiDotEngineer)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    编程智能体提交了 PR,谁来判定能否安全合并?SonarSource 的 @kapmani 对话 @addyosmani

    编程智能体提交 PR 后由谁判定能否安全合并,成为 AI Engineer New York 一场对谈的主题。SonarSource 的 @kapmani 与 @addyosmani 将讨论"Who verifies the software factory?"中的人工审查与测试,活动定于 10 月 14 日举行,Sonar 为白金赞助商。

  2. InfoQAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Coleman Parkes 调研:AI 生成代码推高调试与故障率并造成理解鸿沟

    独立研究机构 Coleman Parkes 受 Undo 委托调研 300 位负责关键任务软件的资深工程负责人,多数使用 C/C++,发现 AI 编码智能体虽加快了代码生成,却把主要瓶颈转移到调试、代码理解和维护。

10月7日周三
  1. Stack Overflow BlogAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 2026 开发者调查:AI 编程助手每日使用率压倒性,但信任问题依旧

    Stack Overflow 2026 年度开发者调查显示,AI 编程助手每日使用率呈压倒性态势,但开发者对其信任问题仍存。结构良好的文档被视为提供可验证上下文、缓解模型幻觉的关键,同时开发者正从主动社区发帖转向被动知识消费。

10月6日周二
  1. 宝玉(@dotey)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 与微软收紧员工内部使用 Claude,转向自家模型与工具

    据 The Information 10 月 5 日报道,Meta 和微软正在减少员工内部使用 Anthropic 的 Claude,转向自家模型和工具。Meta 内部使用 Claude Code 的员工从年初约 6 万人降至最近约 3 万人,同时推广自研 Muse Code(已有超 6000 名员工使用,8 月起对外部客户测试)和内部工具 MetaCode(用户超 3 万)。

10月5日周一
  1. Epoch AIAI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:OpenAI 编码智能体使用量约每月翻倍

    Epoch AI 基于 OpenAI 2026 年 9 月发布的内部数据整理发现,OpenAI 研究人员的编码智能体使用量约每月翻倍。按 API 价格计价,中位数研究员的日均编码智能体支出从 2026 年 1 月的不足 1 美元升至 8 月中旬的 601 美元,第 90 百分位研究员同期超过 7000 美元。

10月4日周日
  1. 机器之心AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 产品负责人 Tibo 预告 Astra 6.1 将至,新模型将更擅长删除和简化代码

    OpenAI 产品负责人 Tibo Sottiaux 预告下一代模型将更擅长删除和简化代码,并在评论中透露「6.1 coming soon」。负责 coding post-training 的研究员 Rajan Agarwal 同时向用户征集模型的 sloppy code 案例。

10月1日周四
  1. Scott Wu(@ScottWu46)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition CEO 回应 Factory 指控:否认获取竞争对手机密信息

    Cognition CEO Scott Wu 公开回应 Factory CEO Matan Grinberg 的指控,否认 Cognition 通过虚假面试窃取 Factory 产品信息,并称 Chris Degnan 从未向团队分享过 Factory 的任何信息。

  2. Cognition(@cognition_labs)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 任命 Chris Degnan 为首席营收官,携手 RPT 搭建 GTM 团队

    Cognition 宣布 Chris Degnan 出任首席营收官,负责全球扩张。Chris 是 Snowflake 首位销售员工,后升任其 CRO,任内推动 ARR 超过 $3B;Cognition 同时与 Chad Peets 及 RPT 团队合作搭建其 GTM 团队。Chris 表示,听到客户讲述 Devin 如何改变其业务后决定加入。

  3. Anthropic NewsAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Barclays 扩大与 Anthropic 合作,将 Claude 推广至全行

    Barclays 扩大与 Anthropic 的战略合作,在全行范围部署 Claude,预计到 2026 年底 Claude Code 覆盖其 50% 开发者,2027 年覆盖多数软件工程师。

9月30日周三
  1. Stack Overflow BlogAI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Stack Overflow 开发者调查:AI 工具使用率从 2023 年 44% 升至 2025 年 79%

    Stack Overflow 回顾 2024 与 2025 开发者调查数据:AI 工具使用率从 2023 年的 44% 升至 2024 年 62%、2025 年 79%,近半数受访者每天使用。

9月25日周五
  1. Cognition(@cognition_labs)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 年化收入突破 10 亿美元,客户用 Devin 构建

    Cognition 宣布年化收入运行率突破 1B 美元,公司称这一里程碑属于其客户,并展示了部分客户如何使用 Devin 进行构建。

9月18日周五
  1. Vercel NewsAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 与 Hacktron 及维护者协作修复 libheif 漏洞

    Hacktron 在 2026 年 8 月报告 Next.js 图像优化疑似存在远程代码执行(RCE)漏洞,Vercel 与 Hacktron 复现后确认问题代码不在 Next.js 本身,而在上游被 Next.js、ImageMagick、WordPress、sharp 等广泛使用的 AVIF 解码器 libheif。

  2. bolt.new(@boltdotnew)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 开放模型使用排行:GLM 5.3 Flash 以 54% 居首

    Bolt 上 1100 多万开发者已可用上开放模型,用量最高可提升 50 倍;其中最快最便宜、提示词窗口达 2 倍的 GLM 5.3 Flash 以 54% 占比排第一,DeepSeek V4 Pro 以 17% 居次,GLM 5.3 为 15%,Kimi K3 占 1%。

9月5日周六
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Batch 本周亮点:编程智能体技能、OpenAI 与 Anthropic 企业数据留存政策、GLM-5.3-Flash 等开放权重模型

    DeepLearning.AI 的 The Batch 本周汇总多条动态:OpenAI 与 Anthropic 公布新的企业数据留存政策,Zai 发布高性价比开放权重多模态系统 GLM-5.3-Flash,Thomson Reuters 推出 397B 参数、专为法律金融新闻工作训练的模型。Andrew Ng 则解释使用编程智能体需要一套自己的基础技能。

8月31日周一
  1. Last Week in AIAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #255:Gemini 3.7、Jalapeño、Qwen 3.8 与自主无人机

    Google 在前次发布仅三周后推出 Gemini 3.7 Flash;SpaceXAI 发布 500K 上下文的 Grok 4.6,面向长时运行的智能体与编码场景。

8月27日周四
  1. Anthropic(@AnthropicAI)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic:HIP Lab 与 METR 两项关于 Claude 的研究仍在进行中

    Anthropic 透露两项关于 Claude 的研究仍在进行:HIP Lab 正在研究 Claude 的行为与人们使用 AI 时感受之间的关系,METR 则在估算编程智能体带来的真实生产力增益。Anthropic 表示很快会分享这两项研究的更多内容。

8月18日周二
  1. ollama(@ollama)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ollama 与 FriendliAI、NVIDIA、OpenHands 在旧金山共话开源模型与编码智能体

    8 月 20 日(周四)在旧金山,Ollama、FriendliAI、NVIDIA 与 OpenHands 的四位工程负责人将围绕开源模型、编码智能体和 AI 基础设施展开讨论,主题是编码智能体走向生产需要什么,以及开源模型如何改变 AI 原生工程的经济性。活动含观众问答与社交环节,名额有限,需通过 RSVP 链接报名。

7月21日周二
  1. Last Week in AIAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #249:Anthropic 封禁 Fable 5、SpaceX 收购 Cursor、开源模型扎堆发布

    Anthropic 在美国政府指令下切断了 Fable 5 和 Mythos 5 的访问,理由是涉嫌越狱。SpaceX 以约 1.75 万亿美元估值完成 IPO,随后以 600 亿美元收购 AI 编程公司 Cursor。

  2. Scott Wu(@ScottWu46)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TierZero 团队加入 Cognition,推进软件自动驾驶

    TierZero 团队加入 Cognition,继续推进"让软件自动驾驶"的目标,即让智能体编写代码并保持其运行。Anhang Zhu 表示两年前开始这一方向,Cognition 的 Scott Wu 称期待自动驾驶软件的下一步进展。

  3. Scott Wu(@ScottWu46)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sarah Guo 押注 AI 前沿实验室无法包揽一切:专访 Conviction 创始人

    2018年,28岁的 Sarah Guo 成为 Greylock 60年历史上最年轻的普通合伙人,四年后离职创办全押 AI 的 Conviction。她早期投资了 Baseten 和 Harvey(各估值超 110 亿美元),首年又投中 Sierra、Cognition 和 Mistral(三家合计估值 540 亿美元)。

7月15日周三
  1. Scott Wu(@ScottWu46)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 收购 Windsurf 一周年:Devin 品牌统一,营收从 7300 万美元增至超 5 亿美元

    Cognition 收购 Windsurf 满一年,期间推出自研模型(上周发布 SWE1.7)、Devin Review、Devin CLI,并将产品统一为 Devin Desktop 品牌。团队一年写下超 2000 万行代码,营收运行率从 7300 万美元增至超 5 亿美元。

6月4日周四
  1. Scott Wu(@ScottWu46)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 与 Carahsoft 合作,将 AI 编程平台 Devin 引入公共部门

    Cognition 与 Carahsoft 达成合作,将 AI 编程平台 Devin 推向公共部门,帮助相关机构加速安全采用 AI 并推进软件开发现代化。Carahsoft 表示,此举旨在让更多公共部门机构用上私营部门正大规模采用的同类工具与技术。

5月7日周四
  1. Alex Albert(@alexalbert__)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Alex Albert 出席 Code with Claude 并将在主舞台演讲

    Alex Albert 今日全天出席 Code with Claude 活动,并将在太平洋时间下午 5:30 主舞台发表演讲,该演讲将在 livestream 播出。活动议程包括 9:00 主题演讲、10:30 的 Claude Code 新功能、11:15 的 GitHub 规模构建 Claude、12:00 的 Managed Agents 加速生产(均为 PT)。

4月28日周二
  1. Scott Wu(@ScottWu46)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 与 Mercedes-Benz 合作,加速其全球工程团队的软件工程

    Cognition 宣布与 Mercedes-Benz 合作,加速其全球工程团队的软件工程,这是迄今汽车行业规模最大的 AI 软件工程部署之一。Cognition 的 Scott Wu 与 Mercedes-Benz CIO Katrin Lehmann 就此进行了对话。

4月22日周三
  1. Sualeh Asif(@sualehasif996)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 与 SpaceX 合作训练模型,Composer 3 及后续将用 10-100 倍算力

    Cursor 联合创始人 Sualeh Asif 宣布与 SpaceX 合作,在后者百万 H100 等效的 Colossus 训练超算上训练前沿模型,Composer 3 及后续模型的训练 flops 将是此前的 10-100 倍。

12月20日周六
  1. Aman Sanger(@amanrsanger)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 收购代码审查工具 Graphite:智能体写代码越多,软件工程的瓶颈越是审查

    Cursor 宣布 Graphite 加入 Cursor,后者是一款代码审查工具。Aman Sanger 指出,当 AI 智能体帮我们写出多一个数量级的代码时,软件工程的瓶颈就变成了审查环节。目前 Cursor 已发布相关博客文章。

12月6日周六
  1. Binyuan Hui(@huybery)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NeurIPS 2025 智能体时代的代码深度学习(DL4C)workshop 即将开场

    NeurIPS 2025 的 Deep Learning for Code in the Agentic Era(DL4C)workshop 在 Hall G-H 于 09:00–17:00 举行,距开场还有十小时。

11月14日周五
  1. Aman Sanger(@amanrsanger)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 完成 23 亿美元 D 轮融资,年化收入超 10 亿美元

    Cursor 宣布完成 23 亿美元 D 轮融资,投资方包括 Accel、Andreessen Horowitz、Coatue、Thrive、Nvidia 和 Google。Cursor 还表示年化收入已超过 10 亿美元,其产出的代码量超过世界上任何其他智能体;作者本人称正在全力开发 composer-2。

10月11日周六
  1. Dario Amodei(@DarioAmodei)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 扩展印度市场:Claude Code 使用量自 6 月以来增长 5 倍

    Anthropic 正扩展印度市场,Dario Amodei 与印度总理 @narendramodi 会面讨论了此事,其中 Claude Code 在印度的使用量自 6 月以来增长了 5 倍。双方还谈及印度如何在教育、医疗和农业等关键领域为超过十亿人部署 AI。