牛油果烤面包 #153:AI 编程的历史、Claude Code 与 Agentic Coding
播客「牛油果烤面包」第 153 期邀请 laike9m 和 Rice,聊 AI 编程的历史与技术核心,从「古法编程」、编译系统、测试与代码审核讲到 AI 编程工具的演进,重点剖析 Claude Code 与 Agentic Coding。
播客「牛油果烤面包」第 153 期邀请 laike9m 和 Rice,聊 AI 编程的历史与技术核心,从「古法编程」、编译系统、测试与代码审核讲到 AI 编程工具的演进,重点剖析 Claude Code 与 Agentic Coding。
GenTeam 宣布支持 Codex、Claude Code 以及 OpenClaw,并基于 Genspark Super Agent harness engine(基于 OpenCode 加云沙箱基础设施实现)构建。相比 BUZZ 的 3 个预置智能体,GenTeam 提供 50+ 预置智能体,原生支持 connectors 和 skills,由三人团队开发。
Genspark 的 GenTeam 与 Jack 发布的 BUZZ 同为面向人类与智能体协作的群聊平台,前者早一天发布且多支持 OpenClaw。
Vercel 将 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 接入 AI Gateway,模型标识分别为 'google/gemini-3.6-flash' 和 'google/gemini-3.5-flash-lite'。开发者可经 Vercel AI Gateway 调用这两款模型。
Marcel Rød 发布号称全球最快的 tokenizer 实现 Gigatoken,在多数机器和多数 tokenizer 定义下比 HuggingFace 快约 500-1000 倍,比 OpenAI 的 tiktoken 快约 100 倍,且对比的都是已多线程化的 Rust 实现。
Cognition 为 Devin 推出 Outposts,让 Devin 运行在任意机器上,包括 Mac mini、实验室 GPU 机器、私有网络内的 VM,或紧邻内部服务的 Kubernetes 集群。此前 Devin 一直使用自有机器。
Mistral 宣布扩大与 Microsoft 的全球战略合作,为企业和受监管行业提供可自主控制的前沿 AI。随着 Mistral 在欧洲扩充 AI 算力,Microsoft 承诺使用其中部分算力,并将 Mistral 的前沿与高效模型引入 Microsoft 的 AI 平台,为客户提供从云端到完全离线环境的灵活部署选项。
Hugging Face 进行了一场名为 Local AI 201 的直播,标题与链接均指向 x.com 的广播页面。原文未披露直播涉及的具体模型、参数或技术细节。
Weaviate 新增按查询 profiling,在搜索请求上开启一个可选开关后,耗时拆分会直接返回在 response.query_profile 中,协调节点会汇总各分片与节点的 profile,一次响应即可获得集群级视图,无需重启或等待查询再次变慢。
Vercel AI SDK 现已提供 Google AI 相关支持,官方文档页面为 ai-sdk.dev/providers/ai-s…。该消息由 @aisdk 发布并 @vercel、@Google、@GoogleAI,更多细节需查看链接。
React Server Components 传输的 Flight 流式协议本质是一套反序列化系统,其 $ 前缀解析机制(尤其是返回原始 Chunk 对象的 $@)构成攻击面。
Cognition 为 Devin 推出 Devin Outposts,让执行环节运行在用户自控和配置的环境中,推理仍留在 Cognition 云端。Modal 以开源集成 modal-devin 成为首发伙伴,Devin Outpost 会话可在 Modal Sandbox 中运行,获得快速冷启动、自定义镜像和快照能力,2026 年 7 月 21 日起进入 alpha。
Dify 团队总结了让 AI 支出花得更值的四种实践:按任务选择合适规模的模型、用 Annotation Reply 缓存重复答案、自托管以获得可预测的容量,以及按节点追踪成本、延迟与质量。文中提出"AI 成本不随用量增长,而随未优化的架构增长",并指出收益最大的团队并非花得最少,而是花得有章法。
Hugging Face 将于本周二举办本地 AI 主题活动,邀请 Ahmad Osman、Mike Bradley 讲解硬件配置与本地推理,并做现场演示。Alex Ocheema 与 0xSero 将分享如何按硬件选模型、模型压缩及 REAPs。
十字路口播客对话生数科技张金涛,聊月初发布的实时交互视频模型 Vidu S1:上传一张照片即可变成能实时视频通话的 AI 角色,生成速度超过播放速度并支持无限时长,实现 540P、25–42 FPS,可在消费级显卡上运行。
吴恩达与 Cerebras 合作推出新课,教你用其 Wafer-Scale Engine 构建快速响应的 LLM 应用。该硬件通过让模型权重贴近计算单元,减少内存到计算的搬运,使 token 生成比典型 GPU 方案快数倍。课程还涵盖构建网页个性化、多步市场信号分析等实时应用,以及快速推理下的智能体编码习惯。
Jason 的一名员工用 Lovable 搭建企业内联网,耗时四小时,一年成本不到 2000 美元,而同样的事两年前要花 50 万美元。Lovable CEO Anton Osika 在 All-In Podcast 巴黎现场与 Jason、前 Intel CEO Pat Gelsinger 对谈,称 Lovable 每周新增一百万个应用,并讨论如何压低开发成本。
Codex Dream Skin 是一个专为 Codex 桌面端设计的开源第三方换肤工具,通过本机回环 CDP 注入实现动态主题,无需修改官方安装包或签名。用户可自定义背景图与配色,侧边栏、输入框等仍为原生控件。工具提供一键还原脚本,支持 macOS 与 Windows,且不改动 API Key、Base URL 等配置。
YC Paper Club 举办 Kernels/Chips 专场,分享了 ParallelKittens、"Intelligence Per Watt:衡量本地 AI 的智能效率"等论文,以及关于自动化系统研究与 AI 推理异构硬件的分享。下一场主题为机器人。
AI SDK 发布新链接 ai-sdk.dev/providers/ai-s…,指向其提供商(provider)相关文档页面,供开发者进一步了解接入方式。原文未披露具体提供商名单或新增功能细节。
Firecrawl 现可在 OpenClaw 上免费使用,Agent 能搜索实时网页、抓取任意页面、与动态网站交互,并把 PDF 解析为干净的 Markdown,无需任何配置或 API key,只有需要扩容时才需注册。
托管版 Weaviate 现已在 DigitalOcean 上开启公开预览,由 DigitalOcean 负责基础设施:资源开通与安全、每日自动备份、补丁与版本升级、高可用与存储自动扩缩容、时间点集群分叉,以及控制面板中的性能洞察与日志。
Dify 在 AWS Summit Taipei 2026 最后一天继续于 P25 展位展出,现场与参会者交流企业 AI 落地、工作流自动化和私有化部署。团队表示昨天已接待到访 P25 展位的观众,今天仍在现场。
苏度科技联合创始人兼CEO韩铮在硅谷101播客中称,公司走软硬件协同设计的上下分层路线,上层负责规划与环境理解、下层负责物体操作,并以Sim-to-Real为核心训练范式。其零样本通用抓取单次成功率接近100%,节目中另有片段提到98%。他预测,被硅谷主流冷落的"上下分层"路线将重新回到主流。
Modal 重建其核心沙箱平台,宣称可在不到一分钟内创建 100 万个并发沙箱,并支持每秒创建数万个沙箱。新架构取消了中心化协调和持久化数据存储的关键路径,由水平扩展的调度服务器用内存数据直接向 worker 发起 RPC,worker 各自作为状态源并周期性写入 Redis stream。
xAI 就用户关于 Grok Build 隐私的疑问作出回应,称自发布以来一直完全遵守零数据留存(ZDR),所有用户始终可在 CLI 中禁用数据上传,禁用后该选择会被遵守。
腾讯混元发布旗舰级 295B 模型 Hy3 的 1-bit 与 4-bit 版本,可在单 GPU 上部署。该模型支持通过 llama.cpp 运行并开启 MTP,在更低硬件门槛下获得强大智能,相关 benchmark 与下载链接已放出。
Elastic 连续第三年被评为 2026 Gartner 可观测性平台魔力象限领导者,并在配套的 Critical Capabilities 报告中于七项用例中的三项排名第一。
Thinking Machines 发布通用多模态模型 Inkling,接受文本、图像和音频输入并输出文本,Modal 提供 Day 0 支持,以按 token 计费的 Managed Endpoint 形式上线。
37signals 创始人 David Heinemeier Hansson 称新款 Dell XPS 系列彻底改变了他对 Dell 个人电脑的看法,他已把 XPS 14 当作主力机使用数月,上周又入手了 XPS 13。
shadcn 开源了 @shadcn/helpers,一个面向组件开发与测试的轻量工具包。首个功能 createChat 支持 AI SDK 和 TanStack AI,可脚本化用户与助手的对话并经由 useChat 运行,让组件接收框架真实流式生命周期中的原生消息。
AI SDK 新增 𝚏𝚒𝚗𝚐𝚎𝚛𝚙𝚛𝚒𝚗𝚝𝚃𝚘𝚘𝚕𝚜() 和 𝚍𝚎𝚝𝚎𝚌𝚝𝚃𝚘𝚘𝚕𝙳𝚛𝚒𝚏𝚝() 两个函数,用于在 MCP 工具被静默改写后、尚未传入模型之前将其检测出来。
Weaviate 发布 Engram 演示,用异步流水线主动维护记忆,替代把整段对话塞进上下文或存储每条消息两种做法。Engram 从对话中提取匹配配置主题的信息,与已有记忆调和去重、更新偏好与事实,再将结构化的分域记忆存入 Weaviate 供语义检索,使智能体随交互持续改进而不被上下文污染。
Qdrant 发布批量上传数据指南,针对大规模写入密集和稀疏向量时的内存、磁盘与搜索可用性问题给出配置策略。指南基于 Qdrant v1.19 引入的 memory 设置,提供三条路径:将密集向量设为 cold 存盘、上传前建好 payload 索引、以及用 TurboQuant 量化在 RAM 中保留压缩副本,其中 BITS4 为默认最接近全精度、BITS1 压缩最高。
Martin Fowler 发布新一期 Fragments,汇总 FOSD 上关于 harness engineering、自托管模型、宏大叙事和"bringing rocks"的讨论。文中还涉及用 fable 省钱、开发者教育的黯淡前景、Electron 是否还有未来,以及交互性专长与贡献性专长等话题。
微软研究院提出一种新方法,可在开发者编写密码学代码的过程中同步验证代码,并在实现与演进过程中兼顾速度与适应性。密码学代码支撑着现代计算系统的关键防护,该方法的细节尚未在公开信息中展开。
TorchV 的 AIS 知识引擎把企业文档解析拆成解析引擎、解析实例、解析策略三层,策略按文件类型路由,PDF 可走 MinerU 并开启公式、表格、图片理解,Word 走 TorchV 默认解析,Excel 走 TextIn,音频走 Qwen ASR。
Anthropic 将 Claude Fable 5 的访问权限扩展到所有付费计划,并将 Claude Code 的每周速率限制提高 50%,该政策持续到 7 月 19 日。
Dify 宣布参加 7 月 15–16 日在 TICC 举办的 AWS Summit Taipei 2026,团队将在现场分享从知识库到自托管与合规的企业 AI 落地话题,展位号为 P25。面向正在探索将生成式 AI 引入组织的参会者,可前往 Dify 展台交流。
Vercel 的 AI SDK 新增对 OpenAI 提供商的支持,用户可通过 ai-sdk.dev 的 providers 文档了解接入方式。该消息由 AI SDK 官方账号发布并 @vercel、@OpenAI 和 @OpenAIDevs。