跳到正文

#部署/工程

今日 0 条
9月29日周二
  1. 阿里技术AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里稳定性团队 AI Native 研发实践:用 Skill 与 Plugin 约束 AI 生成的前端代码

    阿里稳定性团队复盘 AI Native 研发转型:当后端、产品、设计师都能用 AI 写前端,代码能跑却难接手,于是把团队判断做成结构化规则包 Skill,并打包为 Claude Code Plugin「Anchor」。

  2. Clip设计夹AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI-PPT 实操:在 WorkBuddy 里用美图设计室 PPT Skill 从草图生成高质 PPT

    美图设计室 PPT Skill 接入 WorkBuddy,用户把会议纪要 Word 草稿拖进对话框、附上参考图和提示词,即可直接生成完整的 8 页汇报 PPT,无需切换软件。生成结果按封面、目录、整体进度、模块进展组织,采用结论式标题与模块化内容并自动高亮重点数据,支持单页精准修改和一键跳转美图设计室画布做 3D 图标等微调。最终导出标准可编辑 PPTX 源文件,而非锁死的图片或 PDF。

  3. 智东西AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    让Token像土豆一样便宜,要闯哪四关?远景AI电力系统的算力降本逻辑

    远景科技集团创始人张雷提出“AI土豆论”,主张从能源基础设施端压降Token成本,而非只盯芯片和算法。其乌兰察布星河基地今年8月投产,园区总规划容量超2GW,通过绿电直连、气象大模型预测调度、固态变压器(SST)供电与储能协同四道系统工程,目标实现同等面积下算力输出规模达传统数据中心的10倍。

  4. Viking(@vikingmute)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare 推出统一 CLI,默认输出 JSON 支持自然语言搜命令

    Cloudflare 发布统一的 cf CLI,默认输出 JSON,并提供 cf cli search 用自然语言搜索该用哪条命令;同时引入 cloudflare.config.ts 替代原来的 wrangler.toml / JSONC。

  5. Browser Use(@browser_use)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 推出 Ultrafast:快 10 倍、更便宜,比较航班仅 $0.004

    Browser Use 上线 Ultrafast,速度提升超 10 倍且成本更低,比较航班价格仅需 $0.004。同时推出更聪明的 BU Fast,因算力有限采取分批放量,需私信申请提前进入。

  6. Qdrant(@qdrant_engine)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 推出 /4 Nano 和 Zero,向量兼容 Stella 文档嵌入

    Qdrant 的 /4 Nano 和 Zero 专门训练用于生成与 Stella 文档嵌入兼容的向量,因此无需重建文档索引即可在两者间切换,权衡检索质量与查询延迟。其中 Zero 极其轻量,Nano 是小型 Transformer,检索质量更接近 Stella。

  7. Qdrant(@qdrant_engine)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Constella 方案:用 Stella 生成文档向量写入 Qdrant,查询侧可换用 Stella / Nano / Zero

    Constella 采用文档与查询分离的向量化路径:文档经 Stella 转成文档向量写入 Qdrant,查询侧则可换用 Stella、Nano 或 Zero 生成查询向量。该做法与常规同模型编码两侧的方式不同。

  8. Qdrant(@qdrant_engine)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 解析:更换嵌入模型为何通常需要重新嵌入全部文档

    在 Qdrant 中,文档经嵌入模型转为向量存储,用户查询也需转成同一向量空间的向量才能比对。问题在于更换嵌入模型通常意味着必须重新嵌入已有文档。

  9. Qdrant(@qdrant_engine)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 研究预览 Constella:不重新嵌入文档即可更换查询嵌入模型

    Qdrant 发布研究预览项目 Constella,目标是在不重新嵌入全部文档的前提下更换查询嵌入模型。该思路针对的是换模型就需重建整个向量库的常见痛点,目前仅以研究预览形式公开。

  10. Thomas Wolf(@Thom_Wolf)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NanoGPT 训练记录降至 39.9 秒,提出「按 flop 价值取舍」新范式

    NanoGPT 训练纪录被刷新至 39.9 秒,比此前的 67.6 秒缩短 27.7 秒。该方案不再优化 matmul 或增加算子,而是逐 flop 判断价值。

  11. 深网腾讯新闻AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    荣耀 Magic9 系列发布:ARRI LogC3 与 87 种 ARRI Looks 装进直板旗舰

    荣耀于 2026 年 9 月 28 日发布 Magic9 系列,首次把 ARRI 专业电影色彩标准完整落地到消费级手机,支持 ARRI LogC3 记录与 87 种 ARRI Looks。全系搭载自研影像芯片驭光 H1,Magic9 超能版电池容量达 11000mAh,国补后起售价控制在 4000 元以内。开售一小时全平台销量同比上代增长 208%。

  12. 逛逛GitHubAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JumpServer 发布 v5.0.0:开源堡垒机正式进入 V5 时代

    开源堡垒机 JumpServer 发布 v5.0.0,进入 V5 时代,核心变化是原生客户端可统一连接 SSH、RDP、Kubernetes、数据库和 Web 站点等资产。

  13. Guillermo Rauch(@rauchg)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 域名搜索不再需要认证,支持 CLI 关键词搜索与 API 批量查询最多 200 个域名

    Vercel 域名搜索现已无需认证,尤其适合 AI 智能体调用。用户可通过 Vercel CLI 按关键词搜索域名,并通过 API 批量检查最多 200 个域名。

  14. 山行AIAI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    audio.cpp:用纯 C++ 推理引擎统一 80+ 音频模型

    截至 2026 年 9 月 24 日,audio.cpp 最新正式版本为 v0.8.2,约 3000 Star,README 在 v0.8.0 时称已覆盖 80+ 个模型家族、120+ 个模型变体。

  15. Akshay Kothari(@akothari)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Databricks 评测:Opus 5.5 与 GPT-6 Luna 如何改变成本质量前沿

    Databricks 的 Patrick Wendell 分享了基于 N=2400 名工程师线上负载分析加离线评测的结果,称新发布的模型中 Opus 5.5 与 GPT-6 Luna 明显扩展了成本与质量的前沿。

  16. 开始连接LinkStartAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 爆火:AI 的下一步,可能不是把模型做得更大

    一个不聊天、不写文章、只做判断与排序的模型 Jev 近期在 AI 圈刷屏,被讨论为「关节模型」——介于规则与泛化之间,主打更快、更便宜。播客「开始连接 LinkStart」邀请 APUS AI 首席科学家张旭、前硅基流动联合创始人杨攀和 Parall Cofounder 余华亨,从模型原理、适用场景与产业趋势探讨 Jev 为何爆火,以及 AI 服务对象从「人」转向「程序」后可能带来的分工变化。

  17. Fireworks AI(@FireworksAI_HQ)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks 发布首个路由模型 FireRouter with Opus

    Fireworks 发布首个路由模型 FireRouter with Opus,常规任务交给顶级开源模型,其余由 Claude Opus 处理,并支持缓存与任务感知路由。官方称在编码会话中达到 Opus 98.1% 的准确率,单次会话成本降低 57%。

  18. Replit ⠕(@Replit)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 直播探讨知识工作的未来:在 agent chat 中提问即可获得图表、pipeline 或自动化

    Replit 将举办一场名为 Just Ask Replit 的直播,探讨知识工作的未来:实时数据、可视化与自动化都在 agent chat 内完成,无需搭建仪表盘,也无需排队等工程资源。直播时间为周二上午 9 点 PT,在 YouTube、LinkedIn 和 X 同步进行。

  19. Jerry Liu(@jerryjliu0)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 推出表单解析专用模型,集成于 LlamaParse

    LlamaIndex 为表单解析打造了专用模型,并集成在 LlamaParse 中,可识别复选框、文本框、标签和签名字段等结构。该模型支持扫描件、手写涂写及约 100+ 字段的密集表单,精度要求接近 100%,同时为每个值提供来源定位与归因。团队博客称最新前沿 VLM 在真实 W-2、1040、W-9 和扫描版 W-4 上仍会出错,专用解析方案成本更低。

  20. Guillermo Rauch(@rauchg)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 迁移 mercedesamgf1.com:构建快约 70%,渲染快约 75%

    Vercel 以尽可能少的干预迁移了 mercedesamgf1.com,宣称构建速度提升约 70%、渲染速度提升约 75%。这次迁移还产出两个 AI 技能,Vercel 表示将回馈分享。面对一个充满原服务商特有写法的成熟工作负载,整体迁移工作仍在不到一周内完成。

  21. SemiAnalysisAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM5.3 稀疏注意力如何影响 HBM 显存占用

    SemiAnalysis 分析 GLM-5.3 采用 DeepSeek Sparse Attention 后,稀疏注意力虽降低了 SDPA 阶段的 KV cache 读写需求,但 top-k 选择仍需完整上下文驻留 HBM,因此并未消除显存容量瓶颈。

  22. Replit ⠕(@Replit)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 用户 Noni 零代码打造互动学习应用,一夜获 1.4K 下载

    Replit 用户 Noni 不懂编程,却为她的学生打造出一款互动学习应用,上线一夜就获得 1.4K 下载,也帮到了课堂之外的学生。这支视频讲述了她如何在 Replit 上创造出一个充满玩耍与学习的世界。

  23. Stack Overflow BlogAI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么模型版本管理不足以支撑生产级 AI

    生产级 AI 应用仅靠模型版本无法保证可复现,检索、提示词、工具契约与推理服务配置都会独立改变行为。文章建议用版本化发布清单(含模型、提示词、索引、嵌入、运行时修订号)统一界定发布边界,并以覆盖端到端路径的评估门禁和经过演练的回滚路径作为 MLOps 起点。

  24. Cognition(@cognition_labs)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 谈 Devin 的模型独立性:为每类任务调用最优模型

    Cognition 表示,模型独立性让 Devin 能针对每部分工作调用最合适的模型,并持续优化其外层 harness:单次调用批量处理更多工作、并行执行更多动作、充分利用缓存上下文。最新模型与 harness 改进带来了更好的性价比。

  25. Stack Overflow BlogAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    你的 Human-in-the-Loop 是否正在拖慢你?我们的实践总结

    Stack Overflow 博客总结团队的分层 human-in-the-loop 实践:Prediction Router 按置信度把决策分三层,Tier 1 自动验证处理约 85% 流量、延迟低于 3 毫秒,Tier 2 异步专家复核约 12% 案例、4 到 6 小时完成,Tier 3 约 3% 高风险场景实时人工介入并设 30 到 60 秒确认窗口。

  26. Replit ⠕(@Replit)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit 上线 Meta Quest VR 应用开发,接入 GPT-Sol 6、GPT-6 Luna 与 Opus 5.5

    Replit 一次性上线多项更新:支持构建 Meta Quest VR 应用、通过 Muse 创建 Replit 应用,并接入 GPT-Sol 6、GPT-6 Luna 和 Opus 5.5 三款新模型。同时新增 Airwallex 支付链接、在聊天中直接绘制数据图表,企业版则可在工作流内申请和控制访问权限。

9月28日周一
  1. Perplexity(@perplexity_ai)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 评估 10 家第三方沙箱平台,8 家存在网络策略绕过漏洞

    Perplexity 评估了 10 家第三方沙箱平台,发现其中 8 家存在类似的网络策略绕过漏洞。所有发现已披露给受影响厂商,并均已收到回复。

  2. Yangyi(@Yangyixxxx)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    算力供给紧缺下,模型服务商为何优先供给闭源模型而非开源模型

    提供模型服务的一方目前会优先供给闭源模型,原因是由供需关系决定:闭源模型付费更高、获客更简单,在算力供给紧缺时相同机器和电能的商业化效率更高。因此该服务只有在本地化模型达到一定水平、并具备更多电力与数据中心等供给储备后,才会逐渐转向开源;开源模型毛利率相对更低,只有当闭源模型统一并完全垄断市场定价、供给侧缺少溢价空间后,才会出现向开源模型部署的转型。

  3. Yangyi(@Yangyixxxx)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    讨论开源模型本地化与私有化部署:模型会越来越便宜吗?

    开源模型的私有化部署正成为新趋势:隐私与合规风险凸显、开源模型能力已过可用阈值、企业 token 开销失控推动成本考量,但版本迭代投入、使用频率不足导致综合成本高于云厂商、私有化部署稳定性仍是问题。

  4. 魔搭ModelScope社区AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福与英伟达开源 CLM-8B:75MB 对比学习验证器刷新 DeepSWE 与 Terminal-Bench 2.1

    斯坦福大学与 NVIDIA Research 联合发布 Contrastive Language Models(CLM),一类用对比学习目标训练的 System One 决策模型,首发版本 CLM-8B 以冻结的 Qwen3-8B 为骨干,只训练 2000 万参数的 MLP 投影头,检查点仅 75MB。

  5. idoubi(@idoubicc)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    jev-router 支持负载均衡、质量优先、速度优先、成本优先多种路由策略

    jev-router 支持负载均衡、质量优先、速度优先、成本优先等多种路由策略,用户可按需搭配,实现自己的 LLM 路由方案。原文未披露具体模型、参数规模或可用性信息。

  6. 京东技术AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    京东零售 Forge Agent 如何用 Agentic 重塑搜推数据生产体系

    京东零售构建了以 Forge Agent 为统一 AI 门面、Sindri Plugin/MCP 为确定性工具、Sindri 后端负责规划与提交、ADF 承载 DAG 与调度生命周期的人工智能数据研发链路。

  7. idoubi(@idoubicc)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    autojev.ai 开源:基于 jev 决策的模型路由器,为本地 Agent 自动选模型

    autojev.ai 已开源,这是一个基于 jev 决策的模型路由器,为本地 Agent 自动选择合适的模型处理对话请求,在速度、成本、质量之间取得平衡。原文未披露支持的具体模型清单、路由策略细节与性能数据。

  8. NVIDIA AI(@NVIDIAAI)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 发布开放智能体安全平台 OpenShell 与 Sentry

    NVIDIA 与超过 100 家行业合作伙伴推出 NVIDIA Open Agent Safety Platform,整合 OpenShell 和 Sentry 两款产品。

  9. LangChain BlogAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何用 Jev 和 LangGraph 构建生产级智能体

    TypeSafe AI 上周发布决策模型 Jev,它不生成文本,而是返回带概率的类型化答案;TypeSafe 基准显示在路由和分类等窄判断任务上,Jev 比领先 LLM 快至多 200 倍、便宜 400 倍。

  10. LangChain BlogAI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 推出 Custom Apps:围绕智能体数据构建自定义界面

    LangChain 在 LangSmith 中推出 Custom Apps,可将基于 LangSmith 数据的自定义 UI 构建、发布并直接在其中运行,省去托管、鉴权和权限工作。

  11. 甲子光年AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从产品在线到数据产线:阿里云谈制造业如何让经验持续获得复利

    阿里云在云栖大会先进制造AI论坛上提出,制造业正从"产品售出"走向"产品在线",把设备运行数据回流研发与生产,形成数据网络效应。其数据产线覆盖数据接入、知识组织、模型训练、业务执行与反馈回流,并以Qwen、真武AI芯片和阿里云基础设施支撑自主可信、本地化、专业化、生态化"四化"。宁德时代已积累超600TB研发测试数据,覆盖3000万辆新能源汽车和3000个储能电站真实运行数据。

  12. 小红书技术REDtechAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小红书直播:3 周交付 40+ 需求、千万级 PCU 零事故的三套技术底座

    小红书直播用架构、性能、稳定性三套递进能力,在 3 周窗口内交付 40+ 世界杯需求,赛事期实现千万级 PCU 零事故。端到端进房成功率场均 99.5%+,三端异常退出率均低于万分之一,降级后 CPU 均值降幅接近 60%、温升降幅约 30%。全部赛事零事故,赛中调整全部通过配置完成、无需发版。

  13. 阿里技术AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里开源 Kernel Agent AKA,在 Qwen3.8-Max 真实负载上刷新三类推理算子性能

    阿里巴巴 TRE AI 系统工程团队研发的 Atrex Kernel Agent(AKA)在 Qwen3.8-Max 的 FA4 prefill、FA4 decode 和 GDN prefill 三条关键算子线、60 个真实业务 shape 上,几何平均时延均低于专家版本,较生产/官方基线最高加速 1.55×。

  14. NVIDIA Technical BlogAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 开放智能体安全平台:面向持续在硅智能体监控的参考方案

    NVIDIA 发布开放智能体安全平台,为持续在硅智能体监控提供参考方案。该平台定位为参考实现,用于对智能体行为进行持续监控。