跳到正文

#部署/工程

今日 78 条
6月10日周三
  1. Augment Code(@augmentcode)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fable 5 为复杂软件工程任务带来新能力

    Fable 5 为复杂软件工程工作带来新一级能力,在捕捉细微问题的代码审查、PR 撰写与实现支持、大型项目规划与架构推理、长时多步技术任务,以及质量优先于成本的高风险工程场景中表现最佳。

6月8日周一
  1. Jina AI(@JinaAI_)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jina AI 发布 jina-v5-omni:Mac 本地多模态文件搜索,支持离线与 Apache2

    Jina AI 推出基于 jina-v5-omni 嵌入向量的本地多模态文件搜索工具,完全离线运行,可索引文本、PDF、图片、音频和视频。

  2. 张小珺Jùn|商业访谈录AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对阳萌的4小时访谈:消费电子死与生、第三类公司、端侧模型、产品方法、游戏模式

    安克创新创始人兼CEO阳萌接受张小珺4小时访谈,他是1982年生人、2011年开始创业,如今掌舵一家市值超过600亿人民币的科技企业。访谈涵盖消费电子的死与生、第三类公司、端侧模型、产品方法、游戏模式,以及他在范式变化下的产品与组织方法论思考。

6月6日周六
  1. Ahead of AI — Sebastian RaschkaAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LLM 研究论文清单:2026 年 1 月至 5 月

    Sebastian Raschka 发布 2026 年 1 月至 5 月的 LLM 研究论文精选清单,涵盖架构与模型设计、高效训练与扩展、推理效率与 KV Cache、稀疏注意力与长上下文、推理与测试时计算、强化学习与 RLVR、智能体系统与工具使用、编码智能体与软件工程、扩散语言模型、模型评测与基准十大类。

6月5日周五
  1. Skywork(@Skywork_ai)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Skywork 接入 Slack:在频道、话题和私信中直接完成工作

    Skywork 现已支持在 Slack 的频道、话题和私信中使用,无需切换应用即可发消息完成工作。官方同时给出了将 Slack 连接到 Skywork 的操作方法。

  2. Varun Mohan(@_mohansolo)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 面向全部付费计划开放 /teamwork-preview

    Antigravity 向所有付费计划开放 /teamwork-preview,用于运行大规模(超过 100 个)子智能体团队完成复杂任务。该功能会并行启动实现与验证智能体,作者称已用它构建出一个可运行的操作系统,同时提醒该模式会消耗大量 token。

  3. Scott Wu(@ScottWu46)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 为 Devin 推出 AI 生产力保障,价值不足时最高补贴 1000 万美元用量

    Cognition 为 Devin 推出 AI 生产力保障,若 Devin 交付的工程价值低于用户所付费用,Cognition 将出资补足用量,上限 1000 万美元。

  4. Andrew Ng(@AndrewYNg)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Andrew Ng 与 Red Hat 推出高效 LLM 服务新课,教你用 vLLM 与量化应对高并发

    Andrew Ng 联合 Red Hat 推出高效 LLM 服务短课程,由 cedricclyburn 主讲。课程教你用量化压缩模型显存占用,并用 vLLM 通过智能内存管理高效处理大量并发请求,还将对部署进行基准测试,在速度、成本与精度间做权衡。70B 参数模型仅加载权重就需约 140 GB 显存,每个活跃请求还需独立的 KV cache。

6月4日周四
  1. MongoDB BlogAI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    基于 MongoDB Atlas、Voyage AI 与多模态搜索的智能体供应商管理

    MongoDB 提出用 MongoDB Atlas、Voyage AI 与多模态搜索构建智能体供应商管理方案,把分散在遗留系统、PDF、表格和邮件里的供应商数据统一起来,并叠加 AI copilot 提升供应链可见性与韧性。方案针对的是 ERP 系统批处理延迟造成的实时响应瓶颈,原文未给出具体模型版本、参数或 benchmark 数据。

  2. Scott Wu(@ScottWu46)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cognition 与 Carahsoft 合作,将 AI 编程平台 Devin 引入公共部门

    Cognition 与 Carahsoft 达成合作,将 AI 编程平台 Devin 推向公共部门,帮助相关机构加速安全采用 AI 并推进软件开发现代化。Carahsoft 表示,此举旨在让更多公共部门机构用上私营部门正大规模采用的同类工具与技术。

6月3日周三
  1. v0(@v0)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    v0 的 Snowflake 集成进入公开预览

    v0 的 Snowflake 集成现已进入公开预览。用户可提示 v0 接入 Snowflake 并连接账户,它会用你的数据生成精致的仪表盘。

  2. Smashing MagazineAI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    如何让设计系统适配 AI:Atlassian 的 spec files 与 FigmaLint 实践指南

    让 AI 生成的原型更稳定,关键在于把设计决策当作基础设施,写入供 AI 读取的 Markdown spec files,并配合 token 层与审计脚本约束硬编码值。文中推荐的免费 Figma 插件 FigmaLint 可审计 token、状态、无障碍与硬编码值。Atlassian、Carbon、CMS、Nordhealth 等已给出 AI-Ready 设计系统示例。

6月1日周一
  1. Andrew Ng(@AndrewYNg)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达谈 AI Forward Deployed Engineer:FDE 岗位复兴,但 AI Engineer 需求更大

    OpenAI 和 Anthropic 开始组建团队、把 AI Forward Deployed Engineer(FDE)派驻到客户组织内,推动这一岗位在硅谷复兴。FDE 需兼具技术、沟通乃至业务能力,负责把现成 LLM 定制成贴合客户需求的智能体工作流。吴恩达认为 AI Engineer 的岗位数量将远超 FDE,因为企业更愿意让自家员工做项目,且厂商中立的 FDE 难以寻找。

  2. Modal BlogAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 发布开源库 Modal Dojo,将 RL 后训练基础设施抽象为百行代码

    Modal 发布实验性开源库 Modal Dojo,让用户在 100 行以内代码中定义训练任务,只需配置奖励函数、模型和环境。Modal 表示 RL 后训练的瓶颈在基础设施,训练器与 rollout 引擎间的权重同步是主要开销,同集群内 RDMA 传输可将训练速度提升 100 倍,其 Sandbox 可每秒启动数千个、并发维持上百万个。

5月31日周日
  1. 42章经AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一个 AI 创始人的虚荣心、装,和愚昧之巅

    AI 创业者梦琪复盘一年历程:从字节背景的梦幻团队、讲 RL 故事融资,到做垂直 Sourcing Agent 后发现垂类 Agent 有结构性困局——被迫变成 agency,且 toB 在中国和海外华人都很难做。她认为大部分纯应用创业公司不该招算法,创业初期的高光都是"愚昧之巅"。转型 toC 后做出浏览器插件 tryclico,已迭代到第 49 版,认为这代产品 70% 精力要花在交互上。

5月28日周四
  1. HelloGitHubAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HelloGitHub 第 122 期:DeepSeek 专用推理引擎 ds4 等 30 个开源项目

    Redis 作者用 C 语言为 DeepSeek-V4-Flash 打造了本地推理引擎 ds4,支持 Metal、CUDA 加速、2-bit 量化和 HTTP API,并非简单的 GGUF 运行工具。

  2. 张小珺Jùn|商业访谈录AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对何小鹏的第二次访谈:更大赌注、人形机器人Iron诞生、那场意外与新车GX

    小鹏汽车董事长兼CEO何小鹏返场接受访谈,谈及2025年下更大赌注、人形机器人Iron的诞生故事,以及造人形机器人的胜率比造车低得多。他还聊到去年那场意外、技术剧变下CEO的心路,以及新车GX,并直言行业内没有一家游出血海。

5月27日周三
  1. Martin Fowler(@martinfowler)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Birgitta Böckeler 谈测试套件作为编码智能体的回归传感器

    Birgitta Böckeler 在 martinfowler.com 发文,探讨传感器在编码智能体中的作用,重点分析测试套件如何充当回归传感器,以及变异测试(mutation testing)能在其中扮演的角色。

  2. 哔哩哔哩技术AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    哔哩哔哩如何用 A2UI + Vue 让大模型生成可交互界面

    哔哩哔哩商业广告团队基于 Google A2UI 协议自研 Vue 渲染器和 Agent 工具链,让 AI 助手从 Markdown 文本输出升级为生成可交互 UI。方案包含 Runtime Schema 装配、结构与过渡双重校验、SSE 双通道输出,并以 npm 包形式交付 SDK,业务方三步即可接入,新场景接入周期从天级缩短到小时级。

  3. Modal BlogAI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 面向人类与 AI 智能体推出 RBAC 权限控制

    Modal 为 Team 和 Enterprise 套餐用户上线基于角色的访问控制(RBAC),以 Environments 作为可强制执行的安全边界,并对 AI 智能体设置 Restricted Environments,默认只读、仅显式授权的用户或服务用户可以部署和管理资源。RBAC 已接入 Audit Logs,记录谁在何时做了什么。

5月25日周一
  1. Varun Mohan(@_mohansolo)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 新增 Gemini 3.5 Flash (Low) 应对简单任务 token 消耗

    Antigravity 新增 Gemini 3.5 Flash (Low) 模式,用于优化简单任务的 token 消耗。内部测试中,该模式比 Gemini 3.5 Flash (Medium) 少生成约 45% 的 token,在 SWE 任务上总体优于 Gemini 3 Flash (High)。所有付费套餐的 Gemini 配额也已被重置。

  2. 强少来了AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    有意思小周刊No.168:Codex团队使用SOP

    Codex团队发布了一份使用SOP,将可复用的项目上下文结构化为OpenSpec记录、高频复杂操作封装为Superpowers,并通过Codex自动化和验证执行过程,适用于开发、产品、测试、设计等多个业务团队。同期刊物还收录了Codex官方团队分享的持久对话流、语音输入、任务干预与排队等进阶用法,以及得物基于Harness工程的Claude Code数仓落地方案。

  3. Epoch AIAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Epoch AI:算力短缺要来了吗?

    Epoch AI 测算,以 Kimi K2.6 类模型在 Q4 2025 全部 Nvidia GB200 与 GB300 上的推理能力,可提供 5 亿至 200 亿 output tokens/秒,取决于请求上下文长度(8,000 / 25,000 / 128,000 输入 token)。

5月23日周六
  1. 宝玉的分享AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 的 10 万亿美元大战略

    DeepSeek 正以极致压缩 KV 缓存换取硬件自主:据测算,1.6T 参数的 DeepSeek V4 在 100 万上下文、8-bit KV 精度下只需 5.48 GB HBM,而 GLM5 需 60 GB、Qwen3-235B-A22B 需 89 GB。

  2. Varun Mohan(@_mohansolo)AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 为 Gemini 3.5 Flash 将最大上下文长度翻倍

    Antigravity 将 Gemini 3.5 Flash 的最大上下文长度翻倍,此前不少用户在硬任务中频繁触发压缩(compaction)导致性能受损,此次调整可缓解这一问题。开发者表示原本打算重置配额,但几小时前已经完成重置。

  3. Sualeh Asif(@sualehasif996)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cursor SDK 开放 Composer 2.5 前沿智能,支持 Python 与 TypeScript 构建智能体

    Cursor 通过 Cursor SDK 开放 Composer 2.5 的前沿智能,开发者可用它构建自己的智能体,现已支持 Python 和 TypeScript。该长周末期间,SDK 中的 Composer 使用享 90% 折扣。

  4. Varun Mohan(@_mohansolo)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 2.0 在项目会话中新增“Install IDE”按钮

    Antigravity 2.0 在项目关联的对话界面右上角新增“Install IDE”按钮,方便未安装 IDE 的用户(包括新用户或更新到 2.0 时未勾选该选项的用户)完成安装。

  5. Varun Mohan(@_mohansolo)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 2.0 回应 IDE 反馈:恢复 IDE 支持并重置本周 Gemini 配额

    Antigravity 就近日 IDE 相关反馈作出回应,称从未打算移除对开发者的 IDE 支持,并已在 2.0 中更清楚地说明如何连接 IDE。团队修复了 Windows 机器上打开 IDE 的问题,提供了恢复 IDE 设置与扩展的说明,Antigravity IDE 和 Antigravity 2.0 的新版本已推送这些改动,并将再次重置所有人本周的 Gemini 配额。

5月22日周五
  1. 智谱AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智谱推出 GLM-5.1 高速版 API,输出速度达 400 tokens/s

    智谱面向部分企业客户开放 GLM-5.1 高速版 API GLM-5.1-highspeed,输出速度达 400 tokens/s,官方称刷新全球大模型厂商 API 速度上限。

  2. Scott Wu(@ScottWu46)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Devin 支持 Windows VM,作者 77 秒通关扫雷

    Devin 现已支持 Windows 虚拟机,官方页面为 devin.ai/windows/minesw…。Scott Wu 称自己在 77 秒内通关扫雷,并打上 #DevinGotAWindowsPC 标签演示该能力。

5月21日周四
  1. Varun Mohan(@_mohansolo)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Antigravity 将 Gemini 模型速率限制提升至 3 倍并重置本周配额

    Antigravity 把所有付费层级中 Gemini 模型的速率限制提高到原来的 3 倍,并重置了所有人本周的 Gemini 配额。此举是针对部分用户很快触及速率限制的快速回应,官方表示后续还有更多更新。

  2. QdrantAI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sunny Health 如何用 Qdrant 打造 AI 医疗礼宾服务

    Sunny Health 基于 Qdrant 构建 AI 医疗礼宾服务,通过支付方或护理机构的 SSO 登录,为会员完成福利导航、网络内医生匹配和预约挂号三项任务。其检索层需在 300 万到 400 万条医生数据上同时执行硬性过滤(网络内、执照、语言)与语义相似度排序,因此从 Postgres 迁移到 Qdrant 向量搜索,并采用 Rust 客户端和 MCP 工具辅助开发。

5月20日周三
  1. Martin Fowler(@martinfowler)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Birgitta Böckeler 探索静态代码分析的三种"传感器":结果喜忧参半

    Birgitta Böckeler 在 martinfowler.com 发文,探索静态代码分析的三种"传感器",结果喜忧参半。仅靠计算型传感器作用有限,需要 AI 补充语义解释,并需权衡取舍。

  2. Modal BlogAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Applied Compute 如何在 Modal 上扩展强化学习训练

    Applied Compute 为 DoorDash、Cognition 等企业训练定制 AI 智能体,其核心训练机制是强化学习。团队用 Modal Sandboxes 搭建高保真环境、以 Modal Functions 做大规模并行评分,并靠预构建镜像的亚秒级冷启动让训练循环保持 GPU-bound 而非 CPU-bound。

  3. Martin Fowler(@martinfowler)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Martin Fowler 博客:Birgitta Böckeler 谈 agent harness 中的传感器与静态代码检查

    Birgitta Böckeler 在 Martin Fowler 博客发文,记录她在 agent harness 中使用传感器的经验。文章第一部分聚焦静态分析,从基础代码 linting 入手。

5月19日周二
  1. QdrantAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GoPerfect 如何用 Qdrant Cloud 打造智能体招聘团队

    GoPerfect 基于 Qdrant Cloud 搭建智能体招聘平台,用混合搜索、多向量表示加 LLM 编排,在内部基准中把候选人接受率从行业约 30% 提升到 99.993%,大客户实测稳定在 95–100%,约为行业基线的四倍。单个候选人不再用单一嵌入向量表示,而是拆成结构化向量集合,查询时由智能体拆分意图并并行发起多路子查询,复杂多条件搜索可在 10 秒内端到端完成。

5月17日周日
  1. 宝玉的分享AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么我不"凭感觉编程"

    资深开发者 Jacob Harris 撰文解释自己为何拒绝"凭感觉编程"(Vibe Coding)。他因不愿为 Token 持续付费而卸载集成 LLM 的 IDE、回归 Emacs,并认为 LLM 只能解决编写代码本身的"偶然复杂性",无法应对架构设计等"本质复杂性",且无法解释自身选择的路径。

5月16日周六
  1. Ahead of AI — Sebastian RaschkaAI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LLM 架构新动向:KV 共享、mHC 与压缩注意力

    Sebastian Raschka 梳理近期开源权重模型的架构改动,指出长上下文效率成为设计重心。文章拆解 Gemma 4 的跨层 KV 共享与逐层嵌入、Laguna XS.2 的逐层注意力预算、ZAYA1-8B 的压缩卷积注意力,以及 DeepSeek V4 的 mHC 与 CSA/HCA 压缩注意力。

  2. Google DeepMind BlogAI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 的 WeatherNext 如何帮助美国国家飓风中心预测飓风 Melissa 登陆牙买加

    Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天预测飓风 Melissa 以 Category 5 强度登陆牙买加,置信度为 80%,三天前升至接近 100%,这是首次从 Category 1 风速起步成功预测风暴达到 Category 5 强度。

5月15日周五
  1. 哔哩哔哩技术AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    哔哩哔哩 bili-fe-workflow:从 prompt 工程到 Harness Engineering 的智能开发工作流实践

    哔哩哔哩技术团队将 prompt 工程演进为 Harness Engineering,做出一系列智能开发工作流,让 AI 执行跨越整个研发生命周期的长任务。该工作流以 `.workflow` 结构化项目知识库为基础,包含 workflow-init、knowledge-update、prd-preprocess 等命令,并分成视觉驱动的 D2C 与逻辑驱动的 Dev 两条 Skill 路径。