跳到正文

#编码

今日 29 条
9月16日周三
  1. Epoch AIAI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:GPT-6 Astra 在数学基准上领先,软件工程并非如此

    Epoch AI 用 Epoch Capabilities Index(ECI)及面向数学和软件领域的 ECI 变体,对比 GPT-6 Astra、Claude Fable 5.1、GPT-5.6 Sol 和 Kimi K3 四款近期模型,结果显示 GPT-6 Astra 在数学基准上领先,但在软件工程上并非如此。

  2. Paul Couvert(@itsPaulAi)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google Artemis 支持 MCP 集成,Cursor、Claude Code 等编程智能体均可使用

    Google 的 Artemis 项目已支持 MCP 集成,因此 Cursor、Cordex、Antigravity、Claude Code 等任意编程智能体都能使用它。GitHub 仓库地址为 github.com/google/artemis。

  3. ChatGPT(@ChatGPTapp)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 将于 10 月 14 日从 ChatGPT 和 Codex 下线 GPT-5.5

    OpenAI 宣布将于 10 月 14 日在 ChatGPT、ChatGPT Work 和 Codex 的所有套餐中下线 GPT-5.5。在 Codex 中使用 GPT-5.5 的用户被建议切换到 GPT-5.6 Sol 或 GPT-6 Astra。

  4. Latent.Space(@latentspacepod)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent.Space 新一期:为何你仍低估了提示词、Claude Code Mods 与前沿节奏

    Latent.Space 即将上线新一期节目,主题包括为何人们仍低估提示词、Claude Code Mods(昨日发布)以及前沿节奏。Thariq 刚完成录制,内容涉及此前较少谈及的技术细节。

  5. Visual Studio BlogAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Visual Studio 代码覆盖率分析与 GitHub Copilot Test Agent 提升测试覆盖率

    在 Interview Coach 应用中先用 Visual Studio 的 Analyze Code Coverage 定位测试缺口,再用 GitHub Copilot 的 Test Agent 为 InterviewSessionTool 生成 8 个新测试和一个新测试项目。

9月15日周二
  1. 超人的电话亭AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    岗位要求 Vibe Coding,UI 设计师为何要会“指挥 AI 编程”

    当前 UI 设计师招聘中 10 家有 6 家以上要求 AI 技能,Vibe Coding 在大厂 JD 中出现频次极高。Vibe Coding 即指挥 AI 生成代码,能让人体验产品从零到上线的完整生命周期、认识 AI 的能力边界并积累技术框架认知。入门方式是打开 Codex、Workbuddy、豆包工作等工具,从待办管理、番茄钟等自用本地小工具做起,再部署到服务器跑通。

  2. 腾讯云开发者AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Prompt 越长越好吗?研究告诉你何时该停手

    腾讯云开发者文章梳理多项研究与官方工程实践,讨论 Agent 系统指令、Skill 与工具说明什么时候该补写、删减或按需加载,指出没有通用最佳长度。

  3. Augment Code(@augmentcode)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code 将在 TheLeadDev NYC 举办半天软件工厂构建实战工作坊

    Augment Code 将于本周四在 TheLeadDev NYC 期间举办一场半天工作坊,主题是构建你自己的软件工厂(software factory)。活动为实战性质,需通过其 luma.com 页面申请名额。

9月14日周一
  1. LangChain BlogAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Credit Genie 如何用 LangChain OpenWiki 保持代码库文档常新

    Credit Genie 采用 LangChain 开源仓库文档智能体 OpenWiki,自动生成并维护代码库文档,替代此前容易过期的 Notion 页面、README 和 AGENTS.md。

  2. Amjad Masad(@amasad)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amjad Masad:AI 编程重新免费开放

    Amjad Masad 表示,此前一段时间不少用户因价格被挡在 AI 编程之外,如今 AI 编程重新可以免费使用。他未在文中说明具体涉及哪个产品或平台,也未给出价格细节与适用范围。

9月12日周六
  1. AI产品黄叔(@PMbackttfuture)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    做流量卖课月入5万很难,靠 vibe coding 接商单更易

    有观点认为,想做流量卖课月入5万很难很难,远不如接商单容易。典型路径是靠 vibe coding 做一个特别炫酷的 demo,发到社交媒体获取流量和甲方关注,再每月接几个商单,几乎都是这样的模式,没有例外。

  2. 阿里云开发者AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    云栖大会千问AI平台分论坛:重磅产品首发与 Qwen 共创计划发布

    云栖大会千问AI平台分论坛将于 9 月 23 日 9:50—12:00 在杭州国际博览中心一期 3F 308 举行,千问AI平台最新产品能力首次集中公开,Qwen 共创计划同步发布并开放报名。

  3. Augment Code(@augmentcode)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment 联创 Igor Ostrovsky:修 bug 智能体为何烧不掉团队积压

    Augment CTO 兼联合创始人 Igor Ostrovsky 指出,软件工厂能高效清空 issue 积压,关键却不在修复代码本身,修复实现是修 bug 中最不重要的环节。他认为单靠一个修 bug 智能体难以真正烧掉团队的 bug 积压。

  4. bolt.new(@boltdotnew)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    bolt.new 一条提示词生成 URL 转二维码小工具

    bolt.new 展示用一条提示词配合 qrcode npm 包构建的小工具:粘贴 URL 即可生成可扫描二维码,并提供 PNG 下载按钮。

  5. Simon Willison(@simonw)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 的 Boris Cherny:Claude 写的生产代码应有比人类更高的门槛

    Anthropic 的 Boris Cherny 提出,Claude 写的生产代码应比人类写的标准更高,原型和一次性代码则可当黑盒处理。他称 Anthropic 用大量 lint 规则、测试、Claude 驱动的端到端测试与每日 fuzzer、自动代码审查与安全审查、自动重构等护栏来守住这一门槛。

  6. Windsurf(@windsurf_ai)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Windsurf 在桌面端和 CLI 推出 Fusion

    Windsurf 宣布 Fusion 已在桌面端和 CLI 上线,用户可通过 devin.ai/download 获取。原文未披露模型版本、参数规模或价格等细节。

  7. Augment Code(@augmentcode)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment 上线 Gemini 3.8 Flash 半价,持续两周

    Augment 宣布 Gemini 3.8 Flash 在其平台上半价两周,输入 $0.38/M tokens、输出 $1.88/M tokens。团队称向该模型输入 mockup 和截图后,返回的网页无需重新设计即可直接上线,并建议用最难的前端工作测试其能力。

9月11日周五
  1. Philipp Schmid(@_philschmid)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    有人让 AI 在浏览器里复刻《过山车大亨》,Philipp Schmid 感叹「我们还在太早期」

    Philipp Schmid 转发了一条让模型「在浏览器里造一个《过山车大亨》克隆版」的测试,并感叹「我们还在太早期」。该帖获得 49 个点赞、4962 次浏览。

  2. DeepLearning.AI(@DeepLearningAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 时代工程师技能变革:GPT-6 Astra、Claude Fable 5.1 等本周要点

    OpenAI 发布 GPT-6 Astra,支持 1M+ 输入 token 和 5 档推理级别;Anthropic 更新 Claude Fable 5.1,在 Artificial Analysis Intelligence Index v4.3 上并列最高分,放宽网络安全任务限制并减少冗余输出。

  3. Hailuo AI (MiniMax)(@Hailuo_AI)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MiniMax Design 大升级:GPT-6 Astra 上线,新增 Blender、PS、AE 等 MCP 集成

    MiniMax Design 迎来重大升级,GPT-6 Astra 正式上线,并新增面向 Blender、PS、AE 等工具的 MCP 集成,同时加入协作项目功能。用户可用单条提示词生成 3D 模型,还能把 AI 剪辑片段直接转为可编辑的 AE 工程文件。

  4. Fireworks AI(@FireworksAI_HQ)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 发布 SWE-2,评测对标前沿模型且成本最高降 70%

    Cognition 发布 SWE-2,称这是其目前最接近前沿的模型,在主要评测上与近期前沿模型持平,成本最高降低 70%。该模型将强化学习扩展到数万亿参数规模,使用改进后的配方同时推进能力与成本两个维度。Fireworks 表示参与了其背后的基础设施栈,并链接了自家关于 RL 的博客文章。

  5. Amjad Masad(@amasad)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit CEO Amjad Masad 访谈:在伦敦建办公室、四度被 YC 拒绝与 AI 的未来

    Replit 联合创始人兼 CEO Amjad Masad 在 etn 访谈中谈到,Replit 在纽约之前先于伦敦开设办公室,他本人曾四度被 YC 拒绝。他还谈及不喜欢"vibe coding"这一说法,认为 AI 已超越 95% 的工程师,并称前沿研究者正出现"AI 精神病"现象。

  6. Scott Wu(@ScottWu46)AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 发布 SWE-2 模型,评测表现接近前沿且成本最高降低 70%

    Cognition 发布 SWE-2,官方称这是其迄今最接近前沿水平的模型,在主流评测上得分与近期前沿模型持平,成本最高低 70%。Scott Wu 表示,这是团队第一个性能可与前沿水平相比的模型,将把 RL 扩展到数万亿参数规模,并在能力与成本两端同时推进帕累托曲线。SWE-2 面向 Devin 套餐用户免费开放一个月。

  7. Harrison Chase(@hwchase17)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain OpenWiki:企业如何用 wiki 让编码智能体读懂代码库

    LangChain 分享的案例显示,Credit Genie 的编码智能体过去只能靠猜来理解代码库,如今改为直接查询 OpenWiki。这条内容聚焦企业在实践中如何采用和使用 OpenWiki。

  8. Windsurf(@windsurf_ai)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 发布 SWE-2,在 Devin Desktop 和 CLI 上线

    Cognition 发布 SWE-2,称其是在前沿能力上最接近自家前沿水平的模型,在主要评测上得分与近期前沿模型相当,成本最多低 70%。该模型已可在 Devin Desktop 和 CLI 使用,Pro、Teams 用户及接下来一个月可无限使用。团队称将 RL 扩展到数万亿参数规模,配方在能力与成本上同时推进帕累托曲线。

9月10日周四
  1. 百度Geek说AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Agentic Harness Workflow 框架:把 AI Coding 拆成固定流水线与专职子代理

    李忠泽自研的 Agentic Harness Workflow 把 AI 编码拆成需求澄清、方案设计、编码实现、审查验收、提交归档等固定阶段,每阶段由只干一件事的 Sub-Agent 执行,主会话 Manager 统一调度把关。

  2. 腾讯技术工程AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苹果折叠屏 iPhone Duo 来了,腾讯 Kuikly 如何一码适配多端折叠形态

    腾讯开源跨端框架 Kuikly 基于 Kotlin Multiplatform 与共享 UI 体系,支持 Android、iOS、HarmonyOS、H5、微信小程序、Mac 六大平台,日活用户超 5 亿。

  3. idoubi(@idoubicc)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Termany 推出 Windows 98 经典主题

    终端工具 termany.sh 发布了一款 Windows 98 经典主题。开发者 Benn 称其最新 Termany 主题采用了 Windows 98 外观,并表示搭配 Claude 和 Codex 使用体验良好,推荐经常与编码智能体协作的用户尝试。

  4. DeepLearning.AI(@DeepLearningAI)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepLearning.AI 发布 AI 工程技能图谱第三支柱:使用编码智能体

    DeepLearning.AI 发布 AI 工程技能图谱第三支柱"使用编码智能体",聚焦开发者从手写代码转向定义规格、设计架构与评估智能体产出的能力转变。该支柱涵盖五大基础技能:工作流指挥、智能体自主性、成果审查(自动测试、智能体代码审查、llm-as-a-judge)、智能体与环境定制(技能、hooks、插件、MCP 服务器),以及编码智能体基础原理。

  5. Browser Use(@browser_use)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use Pi 发布:用 Astra 爬坡真实浏览器评测,首个能泛化而非过拟合的模型

    Browser Use 推出 Browser Use Pi,一个用 TypeScript 编写的小型 Web 智能体,基于 Astra 构建并通过真实浏览器评测迭代改进。

  6. Augment Code(@augmentcode)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Augment Code 上线 cosmos.augmentcode.com

    Augment Code 今日上线 cosmos.augmentcode.com,主打"启动任务后即可离开去做别的事"的异步工作方式。推文未披露模型、参数或价格等细节,仅给出访问地址。

9月9日周三
  1. Browser Use(@browser_use)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 现基于 Pi Mono 构建,npm install @browser_use/pi

    Browser Use 宣布其新版本 Pi 基于 Pi Mono 构建,可通过 `npm install @browser_use/pi` 安装。Pi 是一个用 TypeScript 编写的微型 Web 智能体,采用 Pi Mono + 持久化 V8 REPL + 原始 CDP,由 Astra 通过真实浏览器评测迭代优化,支持云浏览器、持久会话、流式输出和步数限制。

  2. Stack Overflow BlogAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Java 的年龄是它的 AI 超能力

    在 Stack Overflow 播客中,Markus Eisele 讨论了为什么编码智能体应该写 Java:Java 的长期历史既造就了稳定的语言,也为 AI 提供了训练数据来源。他还谈到 agentic Java 借助庞大的 Java 库生态和智能体框架(harness)与强大伙伴协作而表现出色。节目中提到了 IBM 的编码智能体 Bob。

  3. Cursor(@cursor_ai)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor 公布 CursorBench 完整评测结果

    Cursor 公布了 CursorBench 的完整评测结果,成绩页面已在 cursor.com/cursorbench 上线。该结果帖获得 39267 次浏览、98 个点赞与 14 条回复。

  4. Cursor(@cursor_ai)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta Muse Spark 1.3 现已登陆 Cursor

    Meta 的 Muse Spark 1.3 现已在 Cursor 中可用。该消息由 Cursor 官方账号发布,但未披露模型参数规模、上下文长度或跑分等具体信息。 (说明:原文信息极少,仅确认 Muse Spark 1.3 来自 Meta,且在 Cursor 上线,故摘要保持简短,未补充任何原文未给出的数字或功能。)

9月8日周二
  1. 阿真IreneAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    给 GPT-6 接上 Hyper3D Rodin,我做了能拆/能换装/能竞速的 3D 游戏

    用 GPT-6 Astra 通过 Hyper3D MCP 调用 Hyper3D Rodin 生成 3D 资产,再交回 GPT-6 接入 Blender 与 Three.js,可做出能拆件、换装、竞速的互动网页。

  2. 海外独角兽AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 2 万亿美元估值值不值得买?Artemis 联合创始人给出 2030 年 ARR 1 万亿美元的看多预测

    前 Insight Partners 投资人、Artemis 联合创始人 Jon Ma 认为,Anthropic 在 2 万亿美元估值下仍值得买入,2030 年 ARR 可达 1 万亿美元,长期有望成为全球首家 10 万亿美元市值公司。

  3. 屠龙之术AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    2026 AI江湖夜话:谁在上桌、下桌、掀桌,钱又流向了哪?|对话「屠龙之术」庄明浩

    「有点Yi思」第14期邀请「屠龙之术」主理人庄明浩与蚂蚁战投「AGI及支付宝」负责人王盟,复盘2026年AI圈每两月一轮的座次洗牌:Coding、多模态、Agent、价格四张新桌分桌而立。讨论提到美国头部Coding ARR已破10亿美金、Seedance 2.0后情绪面翻转,以及有效成本等于token成本加试错成本与人工纠正。

9月7日周一
  1. Paul Couvert(@itsPaulAi)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenBMB 开源 2B 模型 MiniCPM5-2B,面向端侧与 Agent

    OpenBMB 开源 MiniCPM5-2B,这是一个 2B 参数语言模型,主打端侧高智能密度,可在手机上本地离线运行,面向智能体、编码与工具调用优化。

  2. Amjad Masad(@amasad)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Amjad Masad:尚未达到 AGI,但现有能力已与 AGI 在功能上难以区分

    Amjad Masad 认为尚未真正达到 AGI,但当下所拥有的能力已与 AGI 在功能上难以区分,原因是存在一个不会感到无聊或疲惫的"不知疲倦的程序员"。他由此断言,任何能被转化为编程问题的难题,实际上都已得到解决。