德州冻结数据中心新许可:排队量18个月从63 GW涨到474 GW
德州冻结数据中心新增许可,其排队容量在18个月内从63 GW升至474 GW,超过历史峰值需求的5倍。其中仅9.5 GW获批,实际运行约4.3 GW,其余多为重复申请、投机性申请以及从未真正接入GPU的开发者。a16z的@rmcentush撰文解释电网为何无法按这么多不确定需求来建设,链接为a16z.news/p/why-texas-is…。
德州冻结数据中心新增许可,其排队容量在18个月内从63 GW升至474 GW,超过历史峰值需求的5倍。其中仅9.5 GW获批,实际运行约4.3 GW,其余多为重复申请、投机性申请以及从未真正接入GPU的开发者。a16z的@rmcentush撰文解释电网为何无法按这么多不确定需求来建设,链接为a16z.news/p/why-texas-is…。
德州电网每年只有约 200 小时达到满载,约占全年 2% 的时间。a16z 的 Ryan McEntush 指出,愿意在用电高峰削减负荷的新建数据中心可以跳过等待新增发电容量,从而更快接入电网。按此方式,美国电网可在不新建任何电厂的情况下增加 100 GW 的数据中心负荷。
a16z 宣布投资 Preference Model,该团队专注为头部实验室构建 AI 研究与 ML 工程方向的 RL 环境。本周他们开源了生产环境框架 Karotte,经超一百万次评估运行和红队测试打磨。团队重点在于让环境随模型变强而更难被攻破:定位模型弱点的工具、针对缺口生成新任务,并让智能体主动攻击测试环境。
美国电网今年计划新增 86 GW 装机,其中太阳能 43.4 GW、电池 24.3 GW、风电 11.8 GW、天然气 6.3 GW,新增核电为 0 GW。AI 实验室则在规划数百 GW 级电力,太阳能是唯一已具备该规模产能的电源,且大部分产能位于中国。a16z 的 @rmcentush 指出,扩展现有核电机组只能挤出少量增量,真正的空间在新反应堆。
a16z 的 Raghu Raghuram 与 AWS CEO Matt Garman 对话,讨论全球最大云厂商如何为智能体时代重建:2026 年 2200 亿美元 CapEx、订购两百万块 NVIDIA GPU、AWS 自研 AI 芯片已排产至明年,并推出无需信用卡的 30 秒 AWS 账号流程。
Notion AI 负责人 Sarah Sachs 主张企业应构建自己的评测体系,来判断每周涌现的新模型和智能体哪些真正适用于自家产品。她将在 11 月 3 日旧金山 Forge 活动上阐述这一观点,目前活动已开放报名。
Notion 宣布其平台已可调用 Claude Haiku 5.5。引用 Anthropic 的介绍,Haiku 5.5 是其发布的最便宜、最快且能力最强的小模型,平均运行成本比 Claude Haiku 4.5 低约 75%。
Google 发布实验性游戏平台 Playground,用户通过对话界面输入提示词即可创建、游玩和分享自定义游戏,无需编程经验,可在浏览器中用手机或笔记本游玩并支持排行榜和部分品类的多人模式。Playground 今日面向美国 18 岁以上用户开放,创建权限按 Google AI 订阅分档;未来将接入正在测试的 Unity Spark,提供专业级机制和高保真 3D 能力。
Google 宣布 SynthID Detector 即日起面向全球英文用户开放,任何人都可以检查图像、视频或音频文件是否由 AI 生成。该工具可识别来自 Google 及其合作伙伴(包括 OpenAI、NVIDIA、Kakao,Apple 即将加入)的 AI 内容。
Suhail 发帖称,是时候为一个人类不再理解某些任务如何被解决的世界做准备了,因为未来会出现极其复杂、困难到人类无法理解其求解方式的任务。该帖获得 626 点赞、44 转发与近 3 万次浏览。
OpenRouter 推出决策排行榜页面,可在 openrouter.ai/rankings/decis 查看各模型在真实调用中的决策表现。原文未披露具体模型、分数或排名细节,仅提供入口链接供用户体验。
OpenRouter 上线 Decision Model Rankings,可查看不同决策模型与任务类型的支出份额和 token 份额,覆盖 Relevance、Correctness、Instruction Following 等类别。榜单显示 @typesafeai 目前在所有类别中领先。
ElevenLabs 现已正式上线 OpenRouter,可调用 9 款文本转语音模型,支持 90 多种语言,以及 2 款语音转文本模型,具备说话人标签和词级时间戳。所有 ElevenLabs 模型在 OpenRouter 上限时五折,优惠持续至 10 月 19 日上午 8 点(PT)。
Cloudflare 的 Clef(27B)和 Clef Flash(9B)两款开源决策模型已在 OpenRouter 上线,可输入文本、JSON 或图像,返回带概率的类型化答案而非生成文本。定价为 Clef 输入 $0.24/M tokens、Clef Flash 输入 $0.09/M tokens,输出免费。
Anthropic 的 Claude Haiku 5.5 已在 OpenRouter 上线,是首个支持 reasoning efforts 的 Haiku 模型。OpenRouter 称其价格比前代便宜约 75%,速度更快(实测 100+ TPS),基准测试中能力有明显提升,可在 openrouter.ai/anthropic/clau 使用。
GPT-6 Luna Decisions 已在 OpenRouter 上线。OpenAI 的 Decisions API 让应用选择合适的模型、工具或动作,可发送文本、JSON 或图像并返回带概率的类型化答案,输入价格为 $0.10/M、输出免费、上下文窗口 1M。
Perplexity Decider v1.1 已在 OpenRouter 上线,这是 Perplexity 的开源权重多模态决策模型,可接收文本、JSON 或图像输入,返回带概率的类型化答案。其输入价格为 $0.02/M tokens,输出免费。
阶跃星辰(StepFun)的 Step 5 Preview 已在 OpenRouter 上线,官方称这是其面向智能体工作的新旗舰模型。该模型采用稀疏 MoE 架构,激活参数 27B、总参数 600B,支持 1M 上下文和文本、图像、视频输入,在编码和专业领域(尤其是金融)表现较强。
StepFun 的 8 项基准评测显示,Step 5 Preview 在其中 6 项上超过 Kimi K3 和 GLM-5.3,包括 DeepSWE(67.7)、ProgramBench(80.5)、StepCodeBench(49.0)和 FrontierFinance(66.4)。
StepFun 的 Step 5 Preview 在 OpenRouter 上线,定价为输入 $1.00/M、输出 $2.70/M,缓存命中在发布期五折后为 $0.05/M。官方称该模型面向智能体和专业工作,并提供一周免费使用,覆盖 opencode、cline、NousResearch、kilocode 等平台。用户可通过 openrouter.ai/stepfun/step-5 试用。
GPT-6 Luna 成为当前最快的 Decisions 模型,全球请求延迟为 180ms,Jev 和 Perplexity Decider 紧随其后。
一个 5 人销售团队基于 OpenRouter 的 Ori 构建了 AI 销售智能体 Rasp,为每条入站线索做调研,多数线索能在 60 秒内收到回复,每月节省约 600 小时。成本约每天 30 美元,且每周都在下降。
Replit 与 Microsoft 合作发布桌面应用预览版,在 Windows 上可本地构建并运行应用。每次构建都运行在独立沙箱中,由 Microsoft Execution Containers 和 Nvidia OpenShell 提供支持。目前可通过 replit.com 加入等待名单获取早期访问权限。
Paul Graham 表示,与 Amjad 交谈后他意识到 Replit 比他此前认为的更重要,因为它是 AI 渗透组织的方式。组织可以通过使用 AI 驱动的应用与 AI 部分对齐,但最深层的变化以代码的形式出现。
Spring AI Alibaba 最后一个正式版 v1.1.2.2 发布于 2026 年 3 月 10 日,此后半年无新正式版,但 main 分支仍有提交,8 月 25 日还有最新 commit,v1.1.2.2 之后共合并 137 个提交,以修复和测试为主。
Paul Graham 表示,与 Amjad 交谈后他意识到 Replit 比他此前认为的更重要。他认为组织可以通过使用 AI 驱动的应用在一定程度上与 AI 结合,但最深层的变化以代码的形式发生。
Paul Graham 称 Amazon 封禁 AI 智能体,是他自 Amazon 创立以来见过的第一个让创业公司做出 Amazon 竞品的的机会。他认为用户会希望由智能体代自己购物,这将成为主要用例之一,而且用户不会愿意用 Amazon 自己提供的智能体来做这件事。
Qwen-Image-2.1-Multiple-Angles-LoRA 模型已上线 Hugging Face,可通过 huggingface.co/akhaliq 访问。该模型以 LoRA 形式为 Qwen-Image-2.1 提供多角度图像生成能力,具体参数与效果未在原文披露。
LIFT 是一种面向大视角变化场景的视频生成方法,通过在线自蒸馏(On-Policy Self-Distillation)在生成过程中预测未来布局。该方法以论文形式发布在 HuggingFace Papers 上,编号 2609.38。
GitHub Copilot 即将支持智能本地模型路由,能在最合适的场景下自动将任务分派给本地模型,帮助用户节省 AI credits。这是 GitHub Project HydraFusion 愿景的下一步,目前尚未公布具体上线时间。
GitHub 正在为 GitHub Copilot 引入本地模型与沙箱化工具,让用户在工作流中同时保有选择权与控制权。官方以"local development"为主题引导用户了解更多细节,但未披露具体支持的模型、参数规模或上线时间。
ChromeBox3 CN65 升级到 PVE9.0 后开机一分钟内不断重启,排除电源、固件和直通 USB 网口等因素后,AI 联网搜索判断这是 ChromeBox 作无头服务器时的通病。在 PDD 花五元买了个 HDMI 诱骗器后,问题随之解决。
暂无可供摘要的实质内容。原帖正文仅有“NB”二字及互动数据(1 条评论、0 次转发、5 个点赞、12947 次浏览),未提及任何模型、产品、功能或数字细节,无法据此写出有效摘要。 (说明:原文正文除“NB”外无任何可提取信息,来源也未标明发布主体,因此按防幻觉规则不补写标题主体与摘要内容。)
一条被转发讨论的说法称,72% 的智能由 3.8% 的 GPU 提供,用极小的算力占比对应绝大部分模型能力,该帖获得 12 次点赞、8589 次浏览。原文未给出具体模型、数据来源或测算方式。
有网友就 gpt 降智现象评论称"gpt 降智就是作恶,和中转站掺豆包没区别",并配上"你的就是我的,我的还是我的"的调侃。相关推文获得 3895 次浏览,来自账号 @Ion_Mio_ 的引用内容。
游戏行业出现一批00后CEO:2001年出生的库兰织梦吴同2026年5月完成数千万元Pre-A轮融资,公司估值达2亿元;19岁成为CEO的龚子浩创办超级鹦鹉,三年累计营收超3200万元、利润超800万元。AI提速与竞争加剧下,"懂年轻人"正成为游戏行业的重要能力,大厂也更多让接近年轻用户的团队参与决策。
小鹏集团Robotaxi正式定名为“小鹏悠游”,英文名XPENG YOYO。美国市场调查公司Mobility Global的“SDV成熟度”数据显示,截至2026年8月,沃尔沃、特斯拉、蔚来并列最高的5级,本田、丰田、日产均为最差的1级。理想、小鹏、小米、宝马为4级,吉利、比亚迪为3级。
腾讯WorkBuddy上线“独立文件浏览器”,本地文件可在独立窗口查看编辑,文件在左、AI在右,可围绕当前文件总结、分析、修改和润色,且只读取用户主动打开或添加的文件。谷歌向全球用户开放AI生成内容检测工具SynthID Detector,支持识别图片、视频、音频是否由AI生成。阿里蔡崇信预判五年后AI将从显性话题转为隐性基础设施,融入业务每个环节。
OpenAI Developers 发文回顾社区基于 modretro Chromatic 的创作,并采访 @Casey 聊创造力的未来;该开发者已把一个想法做成可在 modretro 上玩的游戏。
OpenAI 开发者账号展示了一段用 dot 打造游戏的经历:Nicholas Runcie 在自动驾驶汽车里用 Codex 安装了一款 dot 在他睡觉时为他做的游戏。该推文由 OpenAI Developers 转发,附带原推链接与互动数据。