跳到正文

#部署/工程

今日 84 条
10月5日周一
  1. 歸藏(guizang.ai)(@op7418)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Muse Gadgets SDK 在 M5 Stack Stop Watch Meta 上重做 UI:改中文、换成橘猫形象

    歸藏用 Muse Gadgets SDK 在 M5 Stack 的 Stop Watch Meta 上做了个小玩具,认为该 SDK 原始设计太臃肿拥挤且默认非中文,于是重新调整了整体 UI 使其更协调、界面改为中文,并把中间形象换成与自己 Muse 相同的橘猫。他提到这个 SDK 很方便,已内置数款常见 ESP32 设备固件,直接刷入即可。

  2. Tw93(@HiTw93)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mole 自测验证 Mac 软件达 800 个,Mole 1.15 已上线

    Mole 自测验证的 Mac 软件已达 800 个,新增多款难卸载软件,并补充了难以找到的清理残留,还为每款软件记录了详细卸载步骤,方便未购买 Mole 的用户参考,后续计划移植到 CLI。Mole 1.15 已上线,该版本测试了 709 款软件,涵盖 Adobe 系列、带捆绑的 App、杀毒软件及各类 AI 工具,下一期目标做到 1000 个自测软件。

  3. meng shao(@shao__meng)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Uber 分享企业级 MCP 网关设计:已托管 800+ 服务器、5000+ 工具

    Uber 工程团队分享了面向 AI Agents 的企业级 MCP 管理平台设计,用“控制平面 + 数据平面”的网关体系把全公司数千个存量 API 自动转译成 MCP 工具,目前已托管 800+ MCP 服务器和 5000+ 工具。

  4. Geek(@geekbb)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    icon-marquee:用 TypeScript、Bun 和 Hono 写的 SVG 图标跑马灯 API

    开源项目 icon-marquee 提供用 TypeScript、Bun 和 Hono 编写的 HTTP API,可将技术栈图标渲染为 SVG 返回,用于 README、作品集和网页的动态图标跑马灯。接口 /v1/marquee 输出无缝循环滚动的动画横幅,/v1/icons 输出静态一行。

  5. Z PotentialsAI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Harvey 联创 Gabe Pereyra:应用公司如何借助开源与评测建立研究能力

    法律 AI 公司 Harvey 联合创始人兼总裁 Gabe Pereyra 在 Sequoia Capital 的“Own Your Intelligence”活动上,介绍了应用公司在资金、算力不及基础模型公司时建立研究能力的方法:先建评测标准与训练数据,再与外部研究团队合作完成后训练,最后搭建模型部署基础设施。

  6. 逛逛GitHubAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    盘点 20 个 9 月份 GitHub 上顶顶顶的开源项目

    逛逛GitHub 盘点 9 月 GitHub 上 20 个热门开源项目,月增 Star 最高的是 Archify,约 3.34 万,用 Skill 把系统描述或代码仓库画成交互式架构图;Ponytail 以约 3.12 万 Star 教 Agent 优先复用现有代码。

  7. AI科技评论AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    哥大李昀烛团队 FlexiTac 开源实践:让触觉像视觉一样可规模化 | IROS 2026

    哥伦比亚大学李昀烛团队在 IROS 2026 介绍了开源压阻式柔性触觉传感器平台 FlexiTac 开源一年半后的进展,该传感器 3 分钟即可组装完成,可弯曲裁剪并集成进 LeRobot 等机器人学习框架。团队与普渡大学合作的多指灵巧操纵工作 VTAP Gripper 入围本届 IROS 最佳论文奖,Analog Devices 正在推进其商业化版本,触觉分辨率达到人类手指的五倍。

  8. meng shao(@shao__meng)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福 CME 295《Transformers & Large Language Models》开课,第二讲 138 页讲义公开

    斯坦福 2026 秋季新课 CME 295《Transformers & Large Language Models》已开课,由双胞胎兄弟 @afshinea 与 @shervinea 主讲,9 讲覆盖 Transformer 架构、RoPE、LoRA 微调、RLHF/GRPO 训练、Flash Attention、MCP 与 AI Agent、扩散语言模型。

  9. 山行AIAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    给 Excel 接上 MCP:Precis 如何把表格质检变成 Agent 基础设施

    本地优先的 Excel / CSV / TSV 数据质量工具 Precis 通过 MCP 暴露 validate_data、check_config、describe_constraints、infer_schema 四个工具,让 AI 助手负责解释需求、生成规则草稿和触发校验,确定性规则执行仍落在本地引擎。

  10. Modal BlogAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TypeSafe AI 三天内在 Modal 上将 Jev 扩展至万亿 token

    TypeSafe AI 的首个模型 Jev 在 Modal 上三天内完成超 1 万亿 token 的服务扩展,此前它上线一周即登顶 OpenRouter 1K-10K token 上下文榜首,承接 15.1% 的请求。Jev 并非大语言模型,而是主打快速直觉思考的 System One Model,输入状态与问题后并行输出带概率的结构化值。

  11. Guillermo Rauch(@rauchg)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    fx v0.0.13 发布 Ultrafast 支持:启动快 23 倍、shell 调用快 8.6 倍

    fx v0.0.13 新增 Ultrafast 支持,针对受支持的 OpenAI 模型将启动速度提升最高 23 倍、shell 调用提升 8.6 倍、退出提升 44 倍,并加入可配置的自动压缩。Guillermo Rauch 表示,随着模型本身加速,harness 开销愈发关键,下一版将改进会话存储与检索,并在 libfx 中解锁云端持久性。

  12. Replit ⠕(@Replit)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Replit Drift 全速推进

    Replit 发布 Drift 相关动态,Replit CEO Amjad Masad 转发并配文「Full throttle」(全速推进),推文含一段视频演示,发布时已获 46 次点赞、6 次转发。原文未披露 Drift 的具体功能、参数或可用性信息。

  13. idoubi(@idoubicc)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    开发者 idoubi 晒出每天必开的 5 款自建应用

    开发者 idoubi 列出自己每天都会打开的五款自建应用:termany.sh 用于构建其全部产品,douchat.ai 用于与所有智能体对话,snapok.app 负责截图,spotcat.ai 用于发布应用,autojev.ai 则为本地智能体挑选快速模型。他表示,把每天要用的工具亲手做出来是最好的感觉。

10月4日周日
  1. 掘金本周最热AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Muse 登顶 App Store 第一并开源 Muse Gadget SDK,AI Agent 开始进入下一个阶段

    Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。

  2. DatawhaleAI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Datawhale 发布多模态 Jev-Omni 本地部署教程

    Datawhale 发布多模态决策模型 Jev-Omni 的本地部署教程,该模型在 Gemma 4 12B IT 底座上完成约 3 万题微调,统一支持文本、图像、音频与视频四类输入,输入状态、问题和候选选项后直接返回各选项概率分布。

  3. meng shao(@shao__meng)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LiteLLM 推出 Agent 轨迹分析功能 LiteLLM Lens

    LiteLLM 推出 Agent 轨迹智能分析功能 LiteLLM Lens,可自动审查生产运行轨迹、聚类问题并给出带证据的改进建议。轨迹存储在用户自托管的 ClickHouse 中,并提供无第三方速率限制的 SQL/API,让 Codex、Claude Code 等编码工具直接消费轨迹数据。工作流程分三步:开发者定义好坏运行标准,AI 分析轨迹并聚类问题,人工结合 Trace UI 复核下钻。

  4. Harrison Chase(@hwchase17)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 编程智能体成本连续两月大幅下降,Harrison Chase 分享三步降本做法

    LangChain 的编程智能体成本连续第二个月显著下降。Harrison Chase 给出的三步做法是:用 LangSmith 追踪全部用量实现成本可见性、通过 LLM gateway 设置用户级成本上限、并借助其开源云智能体框架 OpenSWE 做模型路由来优化 harness。第三方 harness 优化难度更大,相关长文将后续发布。

  5. Aravind Srinivas(@AravSrinivas)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity Decisions API 驱动,宝可梦火红四天王+冠军一次通关

    宝可梦火红版的四天王与冠军被一次通关,决策由 Perplexity Decisions API 驱动。实测 137 次实时 API 调用,中位响应 592 毫秒、p95 为 987 毫秒,96.4% 的响应在一秒内,推理成本约 0.028 美元。

  6. 印记中文AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JavaScript 中文周刊 #255:Anthropic 两周让 Claude 应用提速 3 倍

    Anthropic 复盘两周性能冲刺,把 Claude 应用 p75「可交互时间」从 3.1 秒降到 0.55 秒,其中一个无人注意的 location.reload() 每天触发 50 万次隐藏刷新。

  7. meng shao(@shao__meng)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里 OpenSandbox 等六款开源 Agent Sandbox 盘点:腾讯云、字节、AWS、Google 方案对比

    阿里「AI Native 研发范式实践手册」的 Agent 运行环境章节介绍了阿里开源的 OpenSandbox,其支持 Docker/Kubernetes、多语言 SDK、MCP 及浏览器、桌面等执行环境。

  8. meng shao(@shao__meng)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福 MS&E 319「高效生成式语言模型」课程公开前四节讲义

    斯坦福在线课程 MS&E 319「高效生成式语言模型」26 年秋季已公开前四节课程讲义,内容覆盖预训练、架构、推理与后训练的效率设计。授课教师为 Amin Karbasi、Anay Mehrotra、Amin Saberi 与 Grigoris Velegkas 四位。

  9. 硅星人ProAI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一苇宇航完成超亿元天使轮,押注太空算力生产AI Token

    太空算力初创企业一苇宇航自2025年7月至今完成四轮融资,最近一轮为超亿元天使轮系列融资,投资方包括北京市空天基金、浩瀚深度、世纪金源等。公司成立于2025年2月,主攻高性能太空算力载荷,产品分极宇、登云、天衍和太空算力服务平台四条线,登云面向大模型推理。其第一台太空服务器由三大运营商之一购买,已拿下规模化商业订单。

  10. 李继刚(@lijigang_com)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Agent 发展的补短板史:支撑技术如何决定模型能力落地

    回看 Agent 的发展,基本是一路补短板:缺少当前事实就加检索和数据接口,长任务容易丢信息就加状态保存和上下文管理,工具调用会失败就加重试、检查和恢复,行动可能越权就加权限隔离和审批。这些支撑技术决定了模型的原始能力能否真正落进现实场景,但也带来延迟、维护成本、错误传播和协调开销。外围不断加支撑系统兜底,模型进步又把其中一部分能力吸收进去,让结构重新变简单。

  11. 山行AIAI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    PowerTokens/video-studio:用 Excel 管理几十个镜头的 AI 短剧批量生产实战

    PowerTokens/video-studio 是一款面向 Windows 的 Wan 3.0 视频批量生成工具,支持 Excel/CSV 导入镜头表、任务 ID 恢复、断点下载、Key 池、CLI 与 MCP,采用 MIT License,主要代码为 Python,截至 2026 年 10 月 1 日仓库约 1 Star。

  12. 赛博禅心AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 投入 1 亿美元成立 Claude Frontier Academy,计划 2027 年底培养 1 万名 FDE

    Anthropic 宣布投入 1 亿美元成立 Claude Frontier Academy(Claude 前沿学院),计划在 2027 年底前培养 1 万名 FDE(Frontier Deployed Engineer,前沿部署工程师)。

  13. Harrison Chase(@hwchase17)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 推出 ModelRouterMiddleware:Jev 读取首条消息自动选模型

    LangChain 中的 ModelRouterMiddleware 让 Jev 读取首条消息并选择模型,由该模型处理整个运行。Jev 成本足够低,还可通过自定义 hook 在每次工具调用结果后重新选模型,官方文档已发布。

  14. 大模型智能AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    把 Depth Anything 砍到 6M,DepthART 让深度估计跑进 Jetson

    DepthART 将单目深度基础模型压缩到 6.0M 参数:用抗偏置数据采样从约 4400 万张候选图像筛出约 170 万张均衡数据,再以 Depth Anything V2-L 伪深度蒸馏到 TinyViM+DPT。

10月3日周六
  1. a16z(@a16z)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenRouter 联创 Alex Atallah 谈 Stripe 收购后 AI 的未来:独立与专业化

    OpenRouter 联合创始人 Alex Atallah 在 Stripe 收购该公司后首次参加播客,与 Replit 联合创始人 Amjad Masad 及 a16z 的 Erik Torenberg 讨论 AI 的未来在于独立与专业化。

  2. Guillermo Rauch(@rauchg)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel Sandbox 赏金计划确认 KVM 0day,影响 Linux 虚拟化行业标准方案

    Vercel 通过其 Sandbox 赏金计划确认了一个 KVM 0day,影响 Linux 虚拟化的行业标准方案。研究员 Paulos Yibelo 称这是完整的虚拟机逃逸 0day(在行业标准 hypervisor 中实现 guest 到 host root)。完整技术报告即将发布。

  3. Viking(@vikingmute)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Matt Pocock 的 /codebase-design:用一套词典让 AI 重构大模块

    Matt Pocock 的 /codebase-design 是一套不修改任何代码的词典,把 module、interface、depth、seam、adapter、leverage、locality 每个词定义死,并禁止用 component、service、API、boundary 等含糊替代,让 AI 重构大模块时边界更清楚。

  4. 跨国串门儿计划AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel CEO 揭秘智能体工程工作流:AI 软件工厂瓶颈不在代码,而在人

    Vercel CEO Guillermo Rauch 提出用客户反馈的修复响应时间来衡量一家公司有多 Agent 化,认为能在 30 分钟内修好所有问题的企业会打败需要 2 天的企业。他强调快不等于方向正确,工程师不必逐行读代码,但要懂系统边界与取舍,否则模型会把项目带偏。他还主张把开发流程放进云端沙箱以隔离供应链攻击,同时保留本地选项。

  5. Viking(@vikingmute)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare AI gateway 推出 web search API,接入 Ceramic / Exa / Linkup

    Cloudflare 在 AI gateway 中推出 web search API,为智能体提供网页搜索服务,本质是个中转站,目前接入 Ceramic、Exa 和 Linkup 三家。其中 Ceramic 先建好约 400 亿页索引,查询时只做关键词检索,把重活摊在建库上,单次查询很轻、价格非常低,但估计质量会差一点。

  6. AI Engineer(@aiDotEngineer)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vanguard 的 Gareth Yoder 在 AI Engineer New York 分享账本现代化迁移架构

    Vanguard 的 Gareth Yoder 在 AI Engineer New York 分享了账本现代化迁移架构:在保留旧系统的同时用 AI 维护两套代码库。该分享属于 Leadership Track,活动时间为 10 月 12–14 日、纽约场 10 月 13 日。

  7. Aravind Srinivas(@AravSrinivas)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 计划垂直整合智能体基础设施,将在 NVIDIA Vera CPU 上部署 Perplexity Computer

    Perplexity 计划垂直整合其智能体基础设施,自建沙箱并针对最佳芯片优化,称 Vera 远优于 x86。Perplexity Computer 将开始基于 NVIDIA Vera CPU 部署,Perplexity Developers 表示期待在 SPACE 上使用该 CPU。

  8. orange.ai(@oran_ge)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本地跑 Qwen Flash 读写速度一周内提升近十倍

    作者称自己的本地机双 5070ti 跑 Qwen Flash,从上周末的 200 prefill、10 decode 提升到今天在 Strata 与自制 PR 支持下的 2200/67,只用一张卡,读写速度都提高近十倍。

  9. 爱范儿AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Utopai X 在 Artificial Analysis 视频榜位列全球第二,Utopai Studios 推进 2027 年片单

    截至 9 月 30 日,美国 AI 原生影视公司 Utopai Studios 的自研模型 Utopai X 在 Artificial Analysis 带音频文生视频排行榜中位列全球第二,仅次于 Wan 3.0,是该榜排名最高的美国公司模型。

  10. 有新NewinAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    苹果收紧 macOS 完全磁盘访问权限,个人 Agent 面临用户信任门槛

    苹果 10 月 2 日在开发者网站发布公告,将为 macOS 的完全磁盘访问权限增加控制措施,确保用户通过更明确的主动操作才能授予应用这一权限,并指出随着 AI Agent 能力和自主性增强,这类权限带来的风险将显著上升。

  11. meng shao(@shao__meng)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    斯坦福 CS 329Z《Engineering AI Agents》2026 秋季课程前三讲讲义公开

    斯坦福 2026 秋季课程 CS 329Z: Engineering AI Agents 前三讲讲义已统一发布在课程官网,主题分别为 Intro to Agentic Systems、LLMs for Builders 和 RAG + Agents。

  12. meng shao(@shao__meng)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    CMU 11-768《AI Agents》第 12 讲讲义公开:强化学习系统

    CMU 秋季课程 11-768《AI Agents》第 12 讲讲义公开,主题为强化学习系统(RL Systems),由 @gneubig 主讲,聚焦如何在真实多 GPU 集群上跑通 LLM Agent 的 RL 训练。

  13. 山行AIAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    CourseRaptor 本地校园 Agent 架构拆解:31 个工具、三端入口与本地凭证保护

    南京工业大学适配的校园 Agent 项目 CourseRaptor 把课表、成绩、考试、通知、待办、文档生成和日历订阅拆成 31 个可调用工具,终端 TUI、本地 Web UI(127.0.0.1:3210)、QQ 机器人和无头 CLI 共用同一个 ToolLoopAgent 内核。