大型企业几十万份文档,究竟应该怎样交给AI?
面对大型企业几十万份文档入库的需求,AIS 团队认为难点不在导入,而在知识源分散、版本冲突、权限与持续更新。其客户中文档最多的已突破 550 万份,AIS 通过 Connector 自动同步、检索前权限过滤,以及解析—清洗—结构化—切片—抽取—分类—打标签—校验的知识工程流程,并区分 MCP 的 readonly、write、admin 权限等级来管理知识供应链。
面对大型企业几十万份文档入库的需求,AIS 团队认为难点不在导入,而在知识源分散、版本冲突、权限与持续更新。其客户中文档最多的已突破 550 万份,AIS 通过 Connector 自动同步、检索前权限过滤,以及解析—清洗—结构化—切片—抽取—分类—打标签—校验的知识工程流程,并区分 MCP 的 readonly、write、admin 权限等级来管理知识供应链。
快手技术专家祁慧在 AICon 2026 深圳站分享了分销增长 Agent 的实践,将 AI 经营能力从单点工具演进为主从结构的 Multi-Agent 经营大脑:主 Agent 负责全局诊断与规划,选品、定价、建联等子 Agent 独立执行并回传结果。团队同步搭建数据智能基建,通过沉淀经营知识库、商达合作知识图谱、Skill 接口与商家经营画像,并对小模型做 GRPO 微调以降低成本与响应时延。
谷歌联合 20 多家研究机构、32 位作者发布 154 页综述,系统梳理大模型的分词(Token)机制,指出模型数不清 strawberry 里有几个 r、多位数算术出错,病根在文本进入模型前的分词环节。
作者用一段提示词让 Grok Bot 每天早上 9 点整理前一天 AI 资讯,并试做出约 90 秒的中文讲解视频,采集、写代码和渲染全部跑在它的云端虚拟机上。
架构师之路在《一起玩AI》系列首讲《30分钟写好skill》中给出三个答案:需要写 skill、需要学写 skill、但不一定手搓 skill。他指出 skill 本质是文件夹而非提示词,description 是触发器,公式为具体能力清单+触发场景+用户关键词,正文按一句话定位、分步流程、边界与禁忌、Gotchas、快速参考表五段组织,其中 Gotchas 需用真实材料跑出来。
淘宝直播提出 Harness-Aware Training(HAT),把动态执行环境 Harness 状态显式纳入训练分布,通过 HSA-SFT、General OPD、HSA-RL 三阶段训练,让模型读懂当前 Harness 而非背下某一版配置。
中软融鑫总工程师于浩军在 AICon 2026 深圳站分享金融监管报送场景的 Harness 实践,通过知识底座、数据底座、受控状态机与全链路可追溯机制,把自由发挥的 Agent 改造成“宁可不答、不能答错”的受控系统。
一套自写的投资辅助系统接入日常流程 85 天,账户浮盈最高到过 3,733 元(2026-08-27),对应约 +10.5%,83 个日度快照浮盈无一为负,最新统计为 1,590 元。系统每月生成定投建议、每日做风险扫描并推送飞书消息,但只给建议,不接券商、不自动下单、不动资金。10 月 7 日风险扫描以执行冻结、现金低于 10,000 元底线等四条理由,把当月定投建议算成 0 元。
JetBrains 发布 Kotlin Toolchain 0.13,并开始推荐其为大多数新 Kotlin Multiplatform 项目的统一入口。
ChromeBox3 CN65 升级到 PVE9.0 后开机一分钟内不断重启,排除电源、固件和直通 USB 网口等因素后,AI 联网搜索判断这是 ChromeBox 作无头服务器时的通病。在 PDD 花五元买了个 HDMI 诱骗器后,问题随之解决。
Prime-Sentinel Command(PSC)是一个用 Python 面向对象实现的 master-agent 架构,由中央编排器 PrimeProgram 协调多个自主边缘诊断节点 SentinelProgram,后者采集 CPU 负载、内存占用与网络状态并返回结构化遥测数据。
Varun Jindal 提出在模型之外为编码智能体搭建一套 harness,包含宪法、自主边界、分层上下文、持久记忆、多视角评审面板和编辑后钩子六个部件。
Stack Overflow 博客发布六层 LLM 生产系统成熟度模型的第一层「确定性层」,主张智能体应是从上下文到提案的纯函数,无权直接改变业务状态,由经过充分测试的 substrate 在审批后执行提案。
Stack Overflow 博客发布了一份生产级 LLM 与智能体实战指南,提出从 Notebook 演示到生产级构建的六级成熟度模型,涵盖确定性、评测、置信度、安全治理与运维等层次。文中给出可勾选的自检清单,例如智能体只能提出建议而非直接改动业务状态、提示词或模型变更导致质量回退时应使 CI 失败、敏感数据在边界处脱敏并采用只追加审计账本。作者建议团队先找到自己最弱的一层,再按顺序逐级补齐。
Datadog 是面向云应用的可观测性与安全平台,可对基础设施、分布式系统以及 AI 智能体行为进行实时监控。该平台此次聚焦如何查看 AI 智能体的内部运行状态。
作者用一条提示词让 Grok bot 每天早上定时产出一条 AI 早报视频,全程跑在它的云端虚拟机上,无需本地电脑。任务涵盖内容收集、写代码和视频渲染,提示词可直接复制给其他 Grok bot 使用。
歸藏让 Grok bot 每天早上定时产出一条 AI 早报视频,内容收集、写代码和视频渲染全程都在其云端虚拟机上完成,未动用本地电脑。他分享的提示词可直接复制,让其他 Grok bot 也能执行同样的任务,Muse、Dots 等带云端电脑的 Agent 同样适用。
一种"邪修"用法是在 Agent 的云电脑里安装 Pi 或 DeepSeek Harness 这类编程 Agent,并把其他 Code plan 用不完的额度配置进去。之后让 Grok Bot 调用这些 token 来写代码、渲染视频,从而避免闲置额度被浪费。
歸藏(guizang.ai)分享了一种「邪修」用法:在 Agent 的云电脑里装上 Pi 或 DeepSeek Harness 这类编程 Agent,把其他 Code plan 用不完的额度配置进去,再让 Grok Bot 调用这些 token 写代码、渲染视频,从而不浪费闲置额度。
斯坦福 Fall 2026 课程 CS 329Z《Engineering AI Agents》第 4、5 讲已公开,分别由 @Diyi_Yang 讲「Tool Use」、@Diyi_Yang @michaelryan207 @jyangballin 讲「Frameworks & Orchestration」。
课程地址补发,链接为 pi-school.ziki.boo。
LangChain 为 Deep Agents 框架的 Skills 带来三项工程升级:工具绑定 Skills 通过 SKILL.md 的 metadata.include_tools 声明工具。
宝玉披露,Lauren 30 天 Token 消耗达 1.5T,用得最多的模型是 Opus 5.5,Cloud 是消耗大头。Cloud 上每个任务可用独立虚拟机并行,但改动验证不如本机方便。他同时提醒,不 Review PR 的前提是能用上 Fable、Opus 5.5 这类最好模型且有充足 Token;AI 验证只能替代一部分,方向仍需人自己把握。
在 Claude Code 里用 `/advisor fable` 把 Fable 设为顾问,Opus 执行时遇事请教它,任务则先由 Fable 出方案、Opus 实施后自动请 Advisor 验收并循环修复。
yetone 的 magpie 是一套 AI Agent 基建,支持各种模型配置和 OAuth 登录,开发 AI 工具时可把仓库发给 Agent 学习参考。其平台图标采用 lobehub 整理的 icon,添加服务商的操作也更直观。仓库地址为 github.com/yetone/magpie。
乔木剪藏让 AI 学习参考 yetone 的 magpie 代码后重新改版,改动后的版本比之前方便很多。该改动以截图(图 2)形式展示,原帖由向阳乔木发布。
向阳乔木针对 AI 开发的后台设置菜单和描述难懂的问题,测试了一个 Prompt,效果很好。该 Prompt 让模型扮演产品经理加苹果文案大师,按《Don't Make Me Think》和《写给大家看的设计书》的原则重写后台所有菜单和功能文案,要求用户一眼看懂、用日常说法、不用术语、名称 2–4 字、描述不超 20 字,输出原文案到新文案的对照表,功能不改,不确定的先问。
乔木剪藏(qiaomu-clipper)提供一段可直接复制给 AI Agent 的提示词,让其按用户系统与浏览器自动完成安装或升级。
Qdrant 与 DeepLearning.AI 合作推出免费课程,教你用 Qdrant Edge 为机器人构建真正的记忆,无需网络连接或远程服务器。课程由 Dylan Couzon 讲授,现已开放免费报名。
美团图灵Agent评测团队公开内部博客,系统讲解Agent评测:评测需覆盖结果层、过程层、效率层、风险层四层,主张"观测+评测=持续迭代",并将模糊指标下钻为二元化Rubric以实现人人一致与人机一致,如Beam人机一致率从62%提升到92%。
在 Go 中为实时对话 AI 平台构建 Kafka 消息层,用一致性哈希把同一会话的消息路由到固定 worker,再以每会话一个 goroutine 串行处理,从而在数千并发会话下保证会话内严格有序。系统已在生产处理超 4000 万条消息、未观察到乱序,测试中发送侧吞吐突破 100,000 条/秒。重试在会话 goroutine 内原地进行并配合指数退避,避免消息被后发消息超越。
Orange AI 发布实用 skill「播客转文章」,解决录完 Next Token 播客后想转成文章的问题。作者称照录音直接整理像会议纪要,交给 AI 润色又会丢失数字和细节,于是改为按话题而非时间线重新梳理,并定下规则:数字和原话一条不砍,砍掉与本节无关的段子、顺带蹭的新闻和自家产品举例。作者表示实测阅读量和互动不错,用户反馈没有吐槽 AI 味,该 skill 以 MIT 协议免费开源。
AWS 推出一个为期六周的 AI 构建能力培养项目,参与者每周投入约 4 小时,用 Amazon Bedrock 与 Amazon Bedrock AgentCore、Strands Agents SDK 等生产级工具搭建可运行的 AI 原型。
LangChain Academy 发布了一个两分钟讲解视频,解释什么是 agent skill,以及它如何保护智能体的上下文窗口。该内容出自 LangChain 的 Deep Agents 课程,课程地址为 academy.langchain.com/courses/founda…。
美团搜索团队披露 LLM 语义表征在服务零售排序场景的三期实践,累计完成 3 个 Launch Review 并全量上线,一期将 Query 与 POI 的语义向量 cosine 相似度分桶注入精排,带来大盘搜索支付订单 +0.20%、服务零售订单 +0.27%、长尾 NDCG@5 +2.21pp。
美团技术团队发布《Agent 评测白皮书》系列第一篇《评测全览》,提出完备评测体系可概括为四个模块、三种能力、两条 Loop、一套资产。两条 Loop 分别为评测体系迭代 Loop 与 Agent 迭代 Loop,二者共享线上真实样本,通过 Case 挖掘与归因咬合。评测集是核心资产,分端到端与过程两类,前者答"事有没有办成",后者答"中间哪一步出了问题"。
AI Will(@FinanceYF5)提出,营销人只需掌握 Claude Code 和 GitHub 两个基础工具,学会"营销工程"并搭建自己的 Agent,就能为公司创造真正的收入。该帖列出 11 个练习方向,并引导关注账号、点赞转发首条帖子。
营销 Agent 可连接 Meta 和 Google Ads,支持定时运行、预算限制与操作日志。示例规则为每小时检查账户:50 次转化后暂停 CPA 超目标 3 倍的广告,连续 3 天胜出则加预算 20%,并为最佳广告写 3 个新版本,每次操作及原因同步到 Slack。规则相同时,评论、竞品和真实混合 CAC 等独有数据决定胜负。
营销人只需掌握 Claude Code 和 GitHub 两个基础工具,就能学会"营销工程"这套能力,甚至搭建自己的 Agent。真正会用它们并自建 Agent 的营销人,能为公司创造真正的收入。原文列出 11 个练习方向。
一位开发者给多 agent 协作的 Bot 提供了 GitHub、Cloudflare API 和豆包播客 API,不同性格和技能的 Bot 经讨论拍板,做出了一个 24 小时播报 AI 新闻的电视台,并计划当日下午开源。该开发者称自己此前一直不看好多 agent 协作,这次有所改观。