Spotify Ads AI 多智能体平台的实战模式与踩坑
Spotify Ads 高级工程师 Pratik Rasam 披露了 Spotify Ads Manager 内部的多智能体广告生成平台 Ads AI:上线一年来超过 70% 的广告使用 AI 工具,已为 7000 多家广告主生成约 20000 个创意素材。
Spotify Ads 高级工程师 Pratik Rasam 披露了 Spotify Ads Manager 内部的多智能体广告生成平台 Ads AI:上线一年来超过 70% 的广告使用 AI 工具,已为 7000 多家广告主生成约 20000 个创意素材。
上海海思在HiSpark开发者生态社区首次提出XDAS四维框架(AI for Development、AI for Application、AI for Support、EXperience for AI),并开放首批五大领域Skills,实验室实测嵌入式开发效率提升约76%,原本1名工程师约2周的工作量可在1天内完成。
谢扬团队的 Eazo 将 Personal Agent 做成"图形界面 App 驱动"形态:用户描述需求,它直接生成带界面和数据的完整 App,背后由 Qoni 提供 Agent 身份、行动和长期记忆。Eazo 已在国内手机端和 PC 端可用且数据互通,内置多款 SOTA 模型可按任务切换,官方称测试中约 30 分钟即可生成一个较完整的 App。
中科大、香港科技大学与阿里巴巴研究者发布 PEARL 论文,针对 Agentic RL 中 Rollout 占端到端时间 81.8% 的 GPU 调度瓶颈,提出动态调整 GPU 角色与 Prefill–Decode 配置的弹性方案。
OpenAI联合创始人、总裁格雷格·布罗克曼在Silicon Valley Girl访谈中建议,开发者接入AI工作流前应先亲手把流程做3到5遍,摸清脏数据、例外情况和权限边界后再自动化。他称模型写软件的能力已超过他认识的几乎所有人,自己已不再逐行写代码,而是给AI目标、反馈和约束。他还预判未来1到2年将出现一轮大规模创业复兴,前提是人必须保留控制权并承担责任,目标应当来自人。
AI 编码工具能让代码交付效率提升 25%-35%,但代价会在 1-3 个月后集中爆发:Faros AI 数据显示规模化使用 AI 编码的团队代码审核时长平均增加 91%,安全漏洞数量达传统开发的 3 倍,开发者 42% 的工作时间用于修复漏洞和清理技术债务。文章提出 AI 代码审查作为补齐验证环节的核心抓手,并给出以 50 人团队每月节省 800 工时为例的 ROI 测算方法。
腾讯WorkBuddy新上独立文件浏览器,可在同一窗口打开并编辑Word、Excel、PPT、md和HTML,人和AI都能参与修改。右键选择「打开方式→WorkBuddy」即可打开文件,无需先设默认程序;文件在左、AI对话在右,切换标签即切换对话文件。查看和自行编辑本地文件不消耗积分,让AI总结、改写、生成内容才消耗积分。
优化配置后本地推理速度提升到 100+ token/s,但内存仍不够用,作者估计再加两根内存条就够。推文未说明所用模型、硬件与具体优化方式。
JetBrains 发布《2026 年 CI/CD 现状报告》,基于四项调研,显示 83.4% 采用 DevOps 的受访者运行 CI/CD 流水线,72.8% 将主系统部署在本地或自管云上,30.5% 使用本地安装,为五年最高。
织算智能以工业时域多模态大模型切入储能安全与电力交易,其电池健康诊断平台已实时监控超300万颗储能电芯,多模态Transformer融合卫星云图与NWP使关键节点预测准确率提升3%以上、场站收益增长9.2%。基于强化学习的光储荷协同调度在广东某充电站实现每日收益提升24%、弃光量下降62%,公司正进行B轮融资。
阿里开源了内部使用两年的 AI 代码审查工具 Open Code Review,可识别逻辑错误、安全漏洞和性能问题并定位到具体代码位置,官方安装命令为 npm install -g @alibaba-group/open-code-review。
Vercel Sandbox 的 Sandbox.create() 现在会在快照恢复完成后才返回,沙箱创建完成即可直接运行命令和读写文件,首个操作不再需要等待快照恢复,启动错误也改为在 create() 阶段抛出。代价是创建耗时在 p50 增加约 50 ms,未缓存快照可能增加更多,但到首个操作的总耗时不变,该变更自动生效,无需升级 SDK 或调整配置。
ZooWork 创始人兼 CEO Ning Hu 在 Assembling 2026 AI 峰会炉边对谈中提出企业 AI 的 L1 到 L4 分级:L1 是人用 AI 提效,L4 是 AI 在岗位上执行并递归学习,目前多数企业仍停留在 L1。
架构师沈剑在《AI时代的架构设计100讲》第9讲指出,AI写代码会踩的四类缓存坑没变——耦合、雪崩、不一致、互相挤兑,但踩坑的从程序员变成了AI。他建议把四条红线写进spec禁止条款:禁止用缓存当服务间数据管道、禁止调用方缓存服务底层数据、禁止多服务共用缓存实例、未做容量预估与雪崩预案禁止上线。雪崩预案可用高可用缓存集群或缓存水平切分,并需通过缓存宕机演练验收。
厘清智能近日完成天使轮及天使+轮数亿元融资,蚂蚁集团连续两轮加码并领投天使+轮,CMC资本、国汽投资、中金资本旗下基金等跟投。融资将用于物理世界数据管线、模型研发、物理仿真、能力评测、跨本体适配与部署系统。公司已推出T1系列数采手套和Ego数采设备,为模型厂商与AI研发团队提供多模态数据采集、加工标注与专项数据集建设服务。
Anthropic 为 Max 和 Team 订阅用户按月赠送 Claude Platform API 额度:Max 5x 每月 $100,Max 20x 每月 $200,Team 按席位 $20 或 $100 合并共享,整队上限 $500/月。
2026 ITValue Summit 数字价值年会“如何成为一个 AI 原生的超级组织”闭门会在三亚举行,StartLux 郭权玮、百望股份王强宇、品胜丛泽龙分别从智能基础设施、企业数据与模型、硬件研发实践切入。
纽约创业公司 Stuut 完成 5250 万美元 B 轮融资,由 Insight Partners 领投,Andreessen Horowitz、微软旗下 M12 和 Activant 参投。Stuut 从应收账款催收切入,用 AI 接管从订单到回款的跟进、争议处理与 ERP 核销,目前已有超过 150 家企业使用,累计经平台流转资金超过 30 亿美元。
微软在时隔两年的首场线下活动中发布 Surface Laptop Ultra 与 5999 美元的 Surface RTX Spark Dev Box,并公布 Windows 11 的多项更新。
Eazo 是一个把一句模糊需求生成完整可用应用的 Coding Agent,支持一句话生成前端、后端、数据库、登录系统和全球收款,底层由 OpenAI、Claude 加自研模型混合编排。
商业红外遥感企业星火传明完成A轮融资,资金将用于高分辨率红外载荷与星地激光通信地面站产线建设及批产、在轨星座组网和星上AI算法迭代。公司已有T0、T1、T2三颗红外遥感卫星在轨,T2中波分辨率达5米并验证端到端时延控制在1分钟以内,正研制3米中波载荷,规划年产100套红外载荷与50套激光地面站产线。公司还规划太空私有云SaaS,将卫星在轨算力按时间和区域切片供客户自主调用。
开源 Mac 终端 Kaku 面向 AI 编程场景,近期更新加入会话恢复和官方 Homebrew 支持,并修复图片相关的输入卡死问题,同时让标签页在远程桌面下更易用。
山行 AI 基于开源项目 Bibo 分析个人 AI 工作空间的架构取舍:日常对话与个人空间由 Cloudflare Workers、Durable Objects 承接,需要系统工具时再获取 Linux 沙箱,文件独立放在 R2 不随临时执行环境消失。
Epoch AI 用 11 项自身真实工作任务测试六款模型,Claude Fable 5.1 与 GPT-6 Astra 总得分最高并领先多数任务类别,但仍无法实现工作全自动化。开源权重模型落后更多,连定义明确的任务也难以稳定完成。模型难以掌握 Epoch 的隐式规范,能提出研究方向却缺乏判断力,且常把有缺陷的结果当作关键发现。
Vercel AI Gateway 现已支持 OpenAI 的 Ultrafast 服务档位,为交互式应用和快速编码迭代提供更快的输出,目前支持 GPT 6 Astra 和 GPT 6.1 Sol。
Amjad Masad 回应 @Molson_Hart 称,该平台覆盖从构思、设计、开发、评审到部署、安全与 DevOps 的完整流程,只要用例足够复杂,用户需要操心和处理的事会少得多。
Windsurf 发布 Devin 的引导文档,帮助用户完成 Devin 的上手配置。该文档地址为 docs.devin.ai/onboard-devin,官方以「Try it out」邀请用户直接试用。
Devin 的云端智能体现在可以运行完整 iOS 工具链,包括 xcodebuild、iOS Simulator 和 Computer Use 点击操作 UI。每个 Devin 会话都会分配一台独立的云端 Mac,让移动端开发任务能像普通工单一样被委派。
WSJ 观点文章主张用物理学而非政策来监管 AI 行业:没有足够清洁电力运行,就不应新建数据中心。文章以电力供给作为 AI 扩张的硬约束。
Cognition 宣布 Devin 可在 devin.ai/download 下载试用。该推文未披露版本号、参数规模或可用性细节,仅提供下载入口。
开源本地推理引擎 Strata 主打在消费级电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next 量化版,通过量化、GPU 专家缓存和 CPU/GPU 协同推理降低显存门槛,RTX 5070(12 GB 显存)下 Q2_0 量化版短对话生成速度约 94 tokens/s。
Anthropic 发布快速低价模型 Claude Haiku 5.5,价格与 OpenAI 上月发布的 GPT-6 Luna 完全一致,为每百万 token 输入 0.10 美元。
LLM 系统成熟度模型第 4 级聚焦安全与治理,要求用分层 guardrail 做纵深防御:从输入检查、grounding 约束、输出清洗到验证、judge 和第二模型置信度路由共 6 层,且必须 fail closed,任一层出错即阻断或升级。
Stack Overflow 博客“Running LLM systems in production”系列第 3 篇,介绍六层成熟度模型中的 Level 3 置信度层。
Stack Overflow 博客的 LLM 生产系列 Level 2 讲解如何把评测当作 CI 门禁:用版本化 golden set 编写显式打分器,一条 CI 命令在通过率低于阈值时让构建失败,并按 slice 自动路由用例、逐 slice 设门槛。
OpenAI 重建了插件提交流程,让开发者获得更清晰的评审反馈。开发者可通过 developers.openai.com/plugins/deploy 提交插件送审。
Replit 宣布推出桌面应用预览版,与 Microsoft 合作并在 Windows 上本地构建运行应用,每次构建都运行在由 Microsoft Execution Containers 和 Nvidia OpenShell 驱动的独立沙箱中。Replit 称此举针对桌面 AI 应用面临的供应链攻击与智能体灾难性错误风险,聚焦安全与可靠性,目前开放等待名单申请早期访问。
把已在运行的 dbt 项目迁移到 Databricks 无需重写业务逻辑,只需更换 dbt-databricks 适配器和连接配置,再处理少数 SQL 方言差异。
Replit 宣布在 Windows 上可本地构建并运行应用,每次构建都运行在独立沙箱中,该沙箱由 Microsoft Execution Containers 和 Nvidia OpenShell 提供支持。Replit 称其团队已在舞台上进行构建演示。
GitHub 宣布 GitHub Copilot 的本地沙箱功能正式可用,允许 Copilot 在隔离环境中运行命令,并对文件、网络、系统能力和凭证的访问做受控管理,从而提供更细粒度的控制。该功能同时让企业团队可以集中管理策略,可在 GitHub Copilot CLI、GitHub Copilot app 或 @code 中试用。