跳到正文

#部署/工程

今日 0 条
9月23日周三
  1. 阿里云开发者AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里千问AI平台面向Agent全面升级,发布Agent Studio与API优速模式

    在2026云栖大会MaaS&Agent技术主论坛上,阿里巴巴集团战略副总裁文征宣布千问AI平台全面升级,在模型服务基础上新增Agent服务与行业AI解决方案,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。

  2. Guillermo Rauch(@rauchg)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Guillermo Rauch:软件不会再"死"了,喜欢 Google Reader 就能自己生成并部署一个

    Guillermo Rauch 提出软件将不再"消亡",用户若喜欢 Google Reader 这类已停运产品,可以直接生成并部署属于自己的版本,且永久归自己所有。该观点由其在社交平台发布,原文未提及具体模型、工具或技术实现方式。

  3. 51CTO技术栈AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    华为发布灵衢互联新计算架构与 Agentic AI 超节点集群

    在华为全联接大会 2026 期间,华为以灵衢互联协议为核心发布集群与超节点协同的新计算架构,将 CPU、NPU、内存、存储等十余种协议归一,互联带宽从百 GB 级提升至 TB 级,RTT 时延从 7 微秒降至 2 微秒,并宣称配合通算融合与多维并行优化可将十万卡集群 MFU 从 20% 提升到 35%。

  4. 卫诗婕|商业漫谈Jane's talkAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    网易阮良谈 AI 原生组织与企业 Agent 实战:个人提效 500%,交付为何只从 20 天变 17 天

    网易集团副总裁、网易智企 CEO 阮良在访谈中披露,网易内部统计个人用 AI coding 效率提升 300% 甚至 500%,但整个软件交付流程只从 20 天缩短到 17 天。

  5. Pika(@pika_labs)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Pika 上线 Seedance 2.5 Draft Mode,每秒 10 美分生成草稿视频

    Seedance 2.5 Draft Mode 已在 Pika 和 Pika API Club 上线,可按每秒 10 美分的价格快速生成草稿视频片段。满意后再将其完成为高质量成片。

  6. Modal BlogAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 如何为万亿参数编码智能体服务万亿 token:Kimi K2.6 推理优化实践

    Modal 分享了为 Moonshot AI 的 Kimi K2.6 模型优化推理服务以支撑编码智能体的实践,单副本每用户性能提升 2.8 倍、跨用户提升 5.6 倍。

  7. Vercel NewsAI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel Sandbox 的 Drives 持久化存储进入公测

    Vercel Sandbox 的 Drives 持久化存储现已开放公测,Hobby、Pro、Enterprise 用户均可使用。Drive 可跨沙箱实例挂载复用,用于保存智能体工作区或复用数据集、模型和依赖树;每个沙箱最多挂载 4 个 Drive,默认上限 1 TiB(Hobby 为 1 GiB),可配置至 16 TiB。

  8. bolt.new(@boltdotnew)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 里最省事的几个功能,恰恰是你一直跳过的

    Bolt 官方点名四个被用户跳过的功能:增强提示词(Enhance prompt)、plan mode、在功能之间清空上下文、以及小改动时切换到更轻量的模型。这些功能并不花哨,但效果会持续叠加。

  9. Harrison Chase(@hwchase17)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 更新追踪视图,清晰展示 Jev 类决策模型调用

    LangSmith 更新了追踪视图,用于更清晰地展示 Jev 类决策模型的调用,呈现状态、问题、选项与输出等信息。这些 Jev 类调用出现在由大量 LLM 调用组成的 LangSmith 智能体复杂系统中。

  10. Cognition(@cognition_labs)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin Desktop 和 Devin CLI 现已可用

    Cognition 宣布 Devin Desktop 和 Devin CLI 现已开放使用,用户可通过 devin.ai/download 下载体验。

  11. Lovable(@lovable_dev)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 如何用 GPT-6 Sol 等模型构建:模型路由与选型思路

    Lovable 披露其模型选型流程:每周测试新模型并调优,再决定路由方式,以保证构建效果最佳。文中提到 Lovable 现已支持 Fable 5.1,并附上官方博客对其模型理念的完整说明。

  12. Cognition(@cognition_labs)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Opus 5.5 在 FrontierCode 1.1 以 65.3% 登顶 Extended 榜

    Opus 5.5 在 Cognition 的 FrontierCode 1.1 基准上取得 Extended 65.3% 的成绩,超越 Fable 5 登顶,且成本仅为后者的一小部分。该基准针对真实工程任务,评估代码的可合并性与质量。

  13. Cognition(@cognition_labs)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin Desktop 与 Devin CLI 已开放试用

    Cognition 宣布 Devin 可在 Devin Desktop 和 Devin CLI 中使用,并给出下载地址 devin.ai/download。原文未披露具体功能、参数或价格信息。

  14. AI SDK(@aisdk)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI SDK 新增 Anthropic Claude 支持

    AI SDK 新增对 Anthropic Claude 的支持,相关提供方文档已在 ai-sdk.dev 上线。该条信息由 AI SDK 账号发布,并同时提及 Anthropic、Claude 与 Vercel。

  15. NVIDIA Technical BlogAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 机密计算为生产级 AI 推理提供隐私高性能支持

    NVIDIA 机密计算(CC)通过内存加密的机密虚拟机(CVM)和机密 GPU,让 LLM 推理在可信环境中处理敏感数据与专有模型上下文。该方案面向个人、企业和受监管场景,为生产级 AI 推理提供私有高性能路径。

  16. 屠龙之术AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AICC2026 观察:从 Chat 到 Agent,智能、算力与芯片走向何处

    AICC2026 人工智能计算大会上,播客屠龙之术梳理出三条主线:从 Chat 到 Agent 的需求侧结构性跃迁、智能从概率拟合转向可信生产、以及算力与芯片在系统、器件、生态上的突围。会上 IDC 与浪潮信息联合发布《中国人工智能计算力发展评估报告》,并提到浪潮信息的智算系统双唯进化主张与新产品、芯算一体、让计算走进存储,以及 FlagOS 生态下的国产模型与国产芯片 Day 0 适配。

  17. NVIDIA Technical BlogAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Topograph:拓扑感知的 GPU 工作负载调度

    NVIDIA 推出 Topograph,用于拓扑感知的 GPU 工作负载调度。AI 工厂受功耗限制,工作负载放置不当会割裂拓扑域、把流量挤到共享链路,导致吞吐下降、作业成本上升,GPU 还会空耗电力等待数据。Topograph 通过优化放置来提升利用率。

  18. Visual Studio BlogAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何在 Visual Studio 中调试 C# 生产环境崩溃:用内存转储与 Copilot 分析 Parallel Stacks

    Visual Studio 演示了用内存转储事后调试 C# 生产崩溃的流程:监控 ThreadPool,任务超过 3 秒阈值即调用 Windows API 生成 .dmp 文件,再用 Debug with Mixed 打开。

  19. LlamaIndex 🦙(@llama_index)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LiteParse v2.14.6 发布:PDF 转 Markdown 解析速度提升约 25%

    LiteParse v2.14.6 让文本型 PDF 解析速度提升约 25%,实测处理速度达 2.8ms/页,比次快的本地解析器快 1.5 倍。该开源工具可在本地以 Python、Node.js、Rust 运行,也可直接在浏览器中使用。

  20. Lovable(@lovable_dev)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lovable 详解其模型哲学:每周测试新模型并决定路由

    Lovable 阐述了其模型哲学:每周都有新 AI 模型发布,团队会逐一测试、调优并决定其路由方式,以保证用户的构建获得最佳结果。Lovable 目前已支持使用 Fable 5.1 进行构建。

  21. mem0(@mem0ai)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mem0 发布 DolphinBench:绘制 AI 智能体记忆的帕累托前沿

    mem0 发布 DolphinBench,这是一个面向 AI 智能体记忆的评测基准,把准确率、成本与延迟放在同一张榜单上。它不再像传统记忆评测那样只出题判分,而是考察长历史之后智能体能否在工具调用中采取正确行动。DolphinBench 已在 dolphinbench.ai 上线。

9月22日周二
  1. Julien Chaumond(@julien_c)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Transformers 联手 ggml:用 GGML kernels 加载 GGUF 达到 llama.cpp 同等性能

    Transformers 与 ggml 合作,通过在 `kernels` 库中调用 GGML kernels,让 GGUF 模型加载从反量化改为直接运行,性能追平 llama.cpp。此前 Transformers 已支持加载 GGUF 文件多年,这次改动由 @_marcsun 完成。

  2. DockerAI 评估 · 14/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Docker 在 WeAreDevelopers 大会展示 AI 智能体生态合作伙伴与客户阵容

    Docker 在 9 月 23–25 日圣何塞 WeAreDevelopers World Congress North America 的 Docker Pavilion 带来合作伙伴与客户分享,覆盖模型提供商、MCP 工具与网关、身份安全、可观测性和代码质量。

  3. 快手技术AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    快手联合北航提出 TB 级推荐模型 Checkpoint 系统 AdaptCP,被 EuroSys 2027 接收

    快手技术团队联合北京航空航天大学提出面向工业级推荐模型训练的自适应检查点系统 AdaptCP,相关论文已被 EuroSys 2027 接收。

  4. NVIDIA Technical BlogAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA DLSS 5 引入 3D-Guided Neural Rendering,并更新 ACE 与 RTX Kit

    NVIDIA DLSS 5 引入 DLSS 3D-Guided Neural Rendering 与更细粒度的控制项,让游戏开发者在保持艺术意图的同时加入更逼真的光照与材质细节。此次同步更新 NVIDIA ACE、RTX Mega Geometry 2.0 与 RTX Kit,覆盖角色 AI、高密度几何与渲染工作流。

  5. AI科技大本营AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    “当年在 OpenAI 像在疯人院”:Jev 作者 Diogo Almeida 访谈谈反叛 RLHF 与可编程 AI

    前 OpenAI 核心研究员、TypeSafe AI 创始人 Diogo Almeida 在播客 Latent Space 完整访谈中,解释其新模型 Jev 为何完全不做文本生成,只向程序输出带概率和置信度的决策,并以代码作为唯一消费者。

  6. 阶跃星辰AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Step 5 Preview 现已上线 TRAE

    阶跃星辰 Step 5 Preview 已在豆包旗下 AI 开发产品 TRAE 上线,可直接在 TRAE 中调用,覆盖 9 类任务、33 种编程语言,从复杂代码库理解、跨文件修改到 Bug 修复、重构、性能调优及数小时长程任务。官方公布 DeepSWE 67.7 分、ProgramBench 通过率 80.5%。

  7. NVIDIA Technical BlogAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 AI Agent 和 NVIDIA Isaac ROS 加速 ROS 2 节点

    NVIDIA 介绍如何借助 AI Agent 与 Isaac ROS 加速 ROS 2 节点:即使 CUDA kernel 很快,消息在节点间仍可能经 CPU 内存序列化或拷贝,抵消 GPU 上感知与 AI 负载的收益。此次通过上游抽象与 NVIDIA 近期推出的 CUDA buffer 后端来消除这一瓶颈。

  8. 字节跳动技术团队AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一图看懂 ADrive 跨产品协作实践:文件通了,Agent 就通了

    火山引擎存储分享 ADrive 跨产品协作实践,基于 ve-adrive-cli v1.0.2,展示如何选择一个正在进行的内容项目、跑通第一个文件协作闭环。ADrive CLI 已在 GitHub 发布并提供下载,开通 ADrive 需联系 ADrive 团队申请试用。

  9. 字节跳动技术团队AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    火山引擎 ADrive 智能网盘:让 Agent 直接读写团队项目文件夹

    火山引擎推出 ADrive 智能网盘,让 Agent 直接读取项目资料并把成果保存回同一项目空间,团队成员再从熟悉的文件夹接手审阅。项目空间可挂载为本地盘符,人和 Agent 共用同一文件夹;未授权的写入尝试在演示中三次均被拒绝,操作留有审计记录。该产品已开放企业版试用申请。

  10. 腾讯技术工程AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯15年资深后台工程师,转战大模型推理的抉择

    腾讯T12资深搜索后台工程师吴银光在2025年初卸下管理头衔,转入大模型推理工程团队,从性能评测、服务部署等周边工作起步并深入阅读 SGLang 源码。他梳理出推理工程入门路径:建立 Transformer 结构认知、掌握 TTFT/TPOT/QPS 等评估指标、了解 MoE 与 MLA 等结构演进,再选 PD 分离、分布式 KV Cache、推测解码等方向深挖。

  11. 腾讯研究院AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    当 AI 数字员工上岗,会带来什么?腾讯云峰会圆桌谈智能体落地

    腾讯云城市峰会圆桌讨论聚焦 AI 数字员工落地:企业用 AI 分“能对话、能干活、能上岗”三级,其中“能上岗”最难。科拓把停车场收费、抬杆等管理权交给 AI 岗亭,蝉妈妈将客服 AI 接管研发问题响应后,研发被打断比例降低 70% 以上、响应时间缩短 80% 以上;华祥苑的“店效 AI 经营官”已开 10 万次门店会议,覆盖近 1000 家门店。

  12. Stack Overflow BlogAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AMD 的 ROCm 如何让 AI 智能体写 GPU 代码

    AMD 软件副总裁 Anush Elangovan 在播客中介绍 ROCm——AMD 面向自家硬件加速器的统一开源软件层与工具链,并称智能体 AI 正在大幅降低底层硬件编程的门槛,软硬件开发周期的收敛也在加快。

  13. ollama(@ollama)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ollama 就 deepseek-v4.1-flash 计费错误致歉:已重置用量并返还额度

    Ollama 上 deepseek-v4.1-flash 模型的部分请求因费率错误被多扣用量,官方已致歉并重置用户月度(或旧方案的周度+会话)用量,同时把该模型造成的额外消耗额度返还到账户。

  14. 阿里技术AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里开源六个 AI 基础设施项目,覆盖强化学习到代码评审全链路

    阿里在云栖大会集中发布 ROLL、RTP-LLM、Atrex Kernel Agent、OpenSandbox、Open Agent Auth、OpenCodeReview 六个开源项目,分别面向大规模强化学习、生产级推理、异构算子生成优化、Agent 沙箱运行、企业级授权和智能代码评审。

  15. Qwen(@Alibaba_Qwen)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qwen-Image-2.1 获 Intel OpenVINO Day-0 支持

    Qwen-Image-2.1 在发布当天获得 Intel OpenVINO 的 Day-0 支持,可在 Intel 硬件上优化运行。该模型以单一开放权重 checkpoint 同时支持图像生成与编辑。

  16. Hunyuan(@TXhunyuan)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯混元 Hy4 preview 用 214 GiB 装下 770B 参数模型:STQ1_0 量化如何做到"体积更小、智能不变"

    腾讯混元团队把 Hy4 preview 的权重从约 1.5TB 压缩到 214 GiB,参数量仍为 770B,改变的是权重的表示方式。

  17. 百度AIAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    百度2026最高奖颁给天池与dodo团队,李彦宏称认可技术价值才是真正竞争力

    百度2026最高奖由“天池”和“dodo”两支团队获得,李彦宏在9月21日秋日嘉年华现场各颁发一张百万美元支票。天池实现32卡到512卡GPU的Scale-Up全域高速互联,GPU卡间互联带宽提升8倍、通信时延降低40%、单Token推理成本优化40%以上,为全球首个基于X86平台的超节点产品。

  18. 腾讯云开发者AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harness 如何解决大型登录系统改造中的验证难题

    腾讯云开发者团队在约两个月内替换大型项目登录系统时,用 Makefile、Docker、Helm、CSGHub 和 Kubernetes 搭建了轻量化平台“小 TKE”,让每位开发者在 DevCloud 独立 Namespace 中自助部署验证。

  19. Vercel NewsAI 评估 · 76/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Claude Opus 5.5 上线 Vercel AI Gateway

    Anthropic 的 Claude Opus 5.5 已在 Vercel AI Gateway 上线,模型标识为 anthropic/claude-opus-5.5,支持 1M token 上下文窗口和最多 128K 输出 token,面向智能体编码、长时智能体任务和专业知识工作。

    为什么值得看

    Claude Opus 5.5 上线 Vercel AI Gateway,同时列出两项会导致 400 报错的 API 不兼容变更,便于现有调用方迁移。