Stack Internal 2026.6 发布:强化 API 安全、知识健康与无障碍体验
Stack Overflow 发布 Stack Internal 2026.6,新增 Admin 控制台安全设置页,要求 API v2.3 请求携带 X-API-Key 头以防止密钥泄露,并支持会话不活跃控制与按应用设置每日最多 10,000 次请求的限流。
Stack Overflow 发布 Stack Internal 2026.6,新增 Admin 控制台安全设置页,要求 API v2.3 请求携带 X-API-Key 头以防止密钥泄露,并支持会话不活跃控制与按应用设置每日最多 10,000 次请求的限流。
NVIDIA 推出 PAIR 虚拟推理路由器,可将可用算力扩展到本地网络。随着 AI 智能体学会协作、主智能体把复杂任务拆解给专用子智能体,用户也开始同时运行多个智能体会话,多智能体工作流日益普遍。
WeatherNext 3 将接入 Google 搜索、Gemini App、Google Maps 和 Google Maps Platform 提供天气预报。开发者与研究人员还可通过 BigQuery、Earth Engine 和 GCS 获取实时数据。
微软 MAI 模型现已在 Foundry 上提供,并可在 MAI Playground(playground.microsoft.ai)中试用。该消息由 Mustafa Suleyman 发布,未披露模型版本、参数规模或具体能力细节。
小红书与 vivo 联合打通从相册生成到社交发布的完整 3D 内容链路,双方共同设计移动社交场景 3D 内容格式,将原始产物压缩至约 4MB。
快手电商商家与运营赋能中心构建了覆盖需求、Spec、Dev、Test、Oncall 全生命周期的自动化交付流水线(Harness Engineering),目标需求吞吐率提升 30%、平均交付时长下降 40%。
Google 智能体数据云负责人 Andi Gutmans 认为模型本身已很少是瓶颈,真正难题是找出以最低成本获得可靠结果所需的最小上下文,并称「token maxing」是完全错误的目标。
因重度使用 Grok Bot,即使额度刚被重置,一晚用量仍掉了 52%。作者此前已在某个 Bot 中接入 DeepSeek API 与智谱 Coding Plan,于是让分身把各 Bot 的大部分工作切换到智谱 Coding Plan 中的 GLM-5.3-Flash,切换成功。
Varun Mohan 就相关争议公开回应,呼吁外界以建设性方式提出 harness 的改进建议,称有许多人在为此努力把它做得更好。他同时要求相关用户在发现关于封禁的说法不实后编辑帖子,指其纯属散布错误信息。
微分智飞近日完成A2轮数亿元人民币融资,估值数十亿人民币,由普华资本领投,弘晖基金、长三角数智文化基金跟投,五源资本、深创投等老股东追加。公司主打全自主(Full Autonomy)飞行机器人,靠传感器与端侧芯片在无GPS、无通信的地下矿洞边飞边建图,已在矿山向大型矿企小批量交付,客户半年完成过去两年多的测绘工作,覆盖300多个采矿区、省下1000万元以上。
Cursor 宣布智能体可以运行在用户自管的机器上,也可以通过支持的沙箱服务商运行。目前已支持 AWS Lambda、Coder、Cloudflare、Daytona、E2B、Modal、Namespace 和 Vercel,详情见 cursor.com/blog/self-host。推文未给出更多功能细节。
Cursor 宣布云端智能体现可运行在用户自己的基础设施上,包括随需求自动扩缩容的机器池。这样智能体可以访问内部服务或专用硬件,同时智能体循环仍留在 Cursor 内。
Replit 上线免费模式(Free Mode),用户可在不担心 token 成本的情况下持续迭代并原地构建。构建过程中 Replit 会自动为任务挑选最合适的模型,避免为简单任务多付费用。作者认为 token 成本下降、模型变强、人人都能自动化构建,成本效益型模型比前沿模型更值得看好。
Gemini 3.8 Flash 现已在 Cursor 中可用,用户可直接在 Cursor 内调用该模型。
Augment Code 发布 Cosmos 智能体平台,配置不再依赖点击式操作,只需在同一输入框输入三句话即可完成。视频演示中三句话分别用于构建自动化、修复问题,以及询问花费。用户可通过 cosmos.augmentcode.com 直接试用。
NVIDIA 用一篇实战教程演示如何借助 Compute Sanitizer、CCCL API、NVTX、CUB、池化容器、pinned 内存和每线程独立 stream,分六步优化一条 RGB 转灰度并求 32×32 分块中值的 CUDA 图像处理流水线。每步只需少量代码改动,即可让示例更安全、易维护且更快,配套代码支持在 Google Colab 上运行。
Google DeepMind 面向政府和受信任伙伴推出受限访问计划 Fairwind Program,首批向 Google Cloud 客户、政府机构和网络安全伙伴开放 Gemini 3.8 Flash Cyber,结合 CodeMender 自主发现、验证并修复漏洞,可在数分钟内生成经过验证的部署就绪补丁,而非过去需数周的手工修复。
AI SDK 上线供应商文档页面,域名路径为 ai-sdk.dev/providers/ai-s…。该页面用于集中查阅 AI SDK 支持的供应商信息,原文未披露具体模型与功能细节。
Firecrawl 的 Developer Index 在仓库检索评测中以 63.1% 平均分位居整体第一,拿下 issues/PRs 和 docs 两个赛道。原生网页搜索在查找仓库上表现良好,达 80.7%,但 docs 是最难的赛道,没有系统超过 50%,Developer Index 以 47.2% 领先该赛道。
AI SDK 发布了面向 AI 提供商的接入说明,详情可通过 ai-sdk.dev/providers/ai-sdk 查看。该推文未披露具体模型、版本或参数信息。
NVIDIA 技术博客发布 AI 模型协同设计系列第三篇,介绍如何用投机解码在保持准确率的前提下加速 LLM 推理,并给出在帕累托前沿上选择草稿长度与草稿机制的 5 条准则。
Lovable 现已支持在 Slack 中 @ 调用,用户可在频道线程或私信里让 Lovable 构建新应用、提交代码改动,或就项目与数据快速提问。该功能由 Lovable 官方发布。
Milvus 3.0 Spark Connector 新增 Backfill 能力,让 Spark 任务的 Parquet 输出离线写入 Milvus,避免数百万次 upsert 与线上写入争抢网络、算力和写容量。
Giles Edwards-Alexander 记录了一个团队意外触发一队 AI 智能体,让它们在 git 仓库内自发搭起一套黑板协调系统。该案例发布在 martinfowler.com。
Martin Fowler 分享 Rachel 的文章提出,问题或许不在于 AI 破坏了代码审查,而在于我们一直用代码审查去解决错误的问题。
Weaviate Cloud 的 Ask Mode 新增 result_evaluation 参数,默认 "none" 跳过答案评估,直接检索数据并生成答案,更快更省;设为 "llm" 则额外调用一次模型,用检索上下文评估答案并筛选相关来源,同时返回 is_partial_answer 和 missing_information 字段。
作者发布开源的 SBX AI Evaluation Kit,一个基于 Docker Sandboxes 的 Mixin Kit,用于让 AI 评测工作流更容易重跑、检查和对比。
Docker 认为多模型、多 harness 的智能体未来需要一层位于 harness 之下的运行时治理层,因为 harness 自带护栏在智能体绕过、供应商更新和安全边界覆盖上都会失效。该层统一管控代码执行、工具调用、凭证与花费,让权限像 1988 年的“混淆代理人”问题一样与智能体隔开一层。
Sriram Krishnan 指出当前各类 AI 智能体的一个真实痛点是「代码到底在哪里运行」:是否需要访问本地文件系统、能否从手机发起任务、任务究竟跑在云端还是需要本地 Mac mini 开机并同步。他认为围绕这一问题的现有 UX 隐喻仍待改进。
屠龙之术主播庄明浩在小宇宙先声-信号塔活动分享《AI时代的素材李时珍,在信息山野里尝百草》,把8月1日至20日收集进ima知识库的76张图表做成91页PPT集中罗列,涵盖CapEX、云厂商份额、GPU租赁价格、DeepSeek价格、OpenAI与Anthropic的ARR、模型发布频率等。
得物小摊从 0 到 1 孵化中由一人同时负责 H5、运营后台、Node 网关和 Go 服务,AI 并行参与多模块后,作者把重点从写 Prompt 转向 Delivery Harness,用 Version Contract、Execution Boundary、Evidence Gate、Repair Loop 四个组件接管交付状态。
名为 grokbot.aihuangshu.com 的网站已实现用 Grok Bot 自动更新,每日新案例在顶部呈现,方便查看 Grok Bot 的最新变化。
豆包工作上线 Agent 能力并推出专门的电脑版,任务在豆包云电脑上运行,手机派活后电脑、网页端可随时接续查看。作者实测把知识库搬到飞书云盘,用自建 skill 提取视频号逐字稿、调用 3 个 Agent 写 3 篇文章再经 3 个评审合成一篇,确认后直接推送到公众号草稿箱,全程约一小时。下载电脑版可限时领 30 天会员。
Botika 在 Modal 上运行全栈生成式 AI,涵盖自研数百亿参数基础模型、100TB 图像数据管线和约 15 个生产推理模型。其数据管线在数千并发容器上处理 100TB 数据集,错误率低于 1%,单个研究者每天可跑 50 次实验,团队还用 Modal 原语在不到一天内搭好强化学习基础设施。
SemiAnalysis 分析韩国主权 AI 布局:2025 年 6 月启动的“独立 AI 基础模型”项目以约 3.5 亿美元预算和每 6 个月淘汰一轮的竞赛方式选拔本土模型,首轮 5 支队伍中 Naver 因使用阿里 Qwen 的视觉与音频编码器被取消资格,Motif Technologies 补位。
微软研究院的 Garnet 获最佳论文奖,这是一个面向现代应用与云服务的新一代缓存存储层,可在无需修改任何应用的前提下带来数量级更高的性能与效率。Garnet 已作为开源软件开放使用。
Fable 5 定价与 Fable 5 相同,为 $10/$50,API 缓存读取价格下调 75% 至 $0.25/MTok。该模型被描述为工作方式更诚实:给它一个目标,它会持续执行直至达成,遇到卡点时如实说明,而不是谎报成功。
Lovable 说明了其模型接入方式:每周出现新 AI 模型时,团队会逐一测试、调优并决定路由方式,以保证构建效果最佳。Lovable 现已支持使用 Fable 5.1 进行构建。
Lovable 宣布现可基于 Fable 5.1 进行构建。官方表示会测试每一款新模型并对其进行调优,再决定模型路由方式,以确保用户的构建获得最佳结果。
Claude Fable 5.1 现已在 Devin Desktop 和 Devin CLI 中可用。得益于缓存机制调整,Fable 级智能的成本降低了 54%,比 Opus 更便宜;Devin 的 Fusion harness 在 FrontierCode 上以低 47% 的成本达到与 Fable 5.1 相当的水平。