跳到正文

#GitHub

今日 6 条
6月18日周四
  1. 通义大模型AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    通义实验室联合人大开源统一科学大模型 LOGOS

    通义实验室 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源多领域科学生成基础模型 LOGOS,基于统一科学语法在六大科学任务上匹配或超越领域专用方法。

6月17日周三
  1. 智谱AI 评估 · 81/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM-5.2上线并开源:专注Coding与长程任务

    智谱上线并开源 GLM-5.2,主打 1M 上下文与长程任务能力,模型权重采用 MIT 协议,已在 Hugging Face 与 ModelScope 开放下载。

    为什么值得看

    原文给出 GLM-5.2 在长程编码任务上的基准位置与 1M 上下文设计,读者可据此判断开源编码模型与 Claude Opus 的差距。

6月6日周六
  1. Ideogram(@ideogram_ai)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ideogram 开源 fp8 与 nf4 检查点,nf4 版本可跑在单张 24 GB GPU 上

    Ideogram 宣布其仓库中已包含 fp8 和 nf4 两种检查点,其中 nf4 版本可在单张 24 GB GPU 上运行。相关资源已发布在 Hugging Face、GitHub 及其官方博客上。

6月1日周一
  1. Modal BlogAI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 发布开源库 Modal Dojo,将 RL 后训练基础设施抽象为百行代码

    Modal 发布实验性开源库 Modal Dojo,让用户在 100 行以内代码中定义训练任务,只需配置奖励函数、模型和环境。Modal 表示 RL 后训练的瓶颈在基础设施,训练器与 rollout 引擎间的权重同步是主要开销,同集群内 RDMA 传输可将训练速度提升 100 倍,其 Sandbox 可每秒启动数千个、并发维持上百万个。

5月14日周四
  1. UX MagazineAI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Spiral Climbs:当设计转向系统,AI 与智能体如何重构产品工作流

    随着 UI 被商品化,竞争优势上移至问题定义、押注排序与结果负责,产品设计正从界面绘制转向系统、token 与代码。作者把 Miro、Figma、VS Code 配合 Codex 和 GitHub、Jira 串成一条从想法到上线的链路,并嵌入设计思维、系统思维与会议纪要三类智能体。

4月28日周二
  1. Martin Fowler(@martinfowler)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Thoughtworks 内部 IT 的智能体编程工作流 SPDD:结构化提示词驱动开发

    Thoughtworks 内部 IT 采用名为 Structured-Prompt-Driven Development(SPDD)的智能体编程工作流。Wei Zhang 和 Jessie Jie Xia 通过一个简单示例讲解其运作方式,并在 GitHub 项目中给出细节。

  2. HelloGitHubAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HelloGitHub 第 121 期:OfficeCLI、abtop、PhoneClaw 等开源项目

    HelloGitHub 第 121 期收录多个 AI 相关开源项目,包括为 Claude Code、Cursor 注入 Office 文件操作技能的 OfficeCLI,监控 Claude Code、Codex CLI 等 Agent 的 token 用量与上下文窗口的命令行工具 abtop,以及在一键切换 API 节点、自动故障转移的 cc-switch。

4月5日周日
  1. Andrej Karpathy(@karpathy)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Karpathy 感叹 GitHub Gist 评论区质量远胜 X:更少 AI 味,考虑多发 Gist

    Andrej Karpathy 称 GitHub Gist 的评论比预期好得多,更有帮助、更有洞见、更具建设性,AI 味也少很多。他猜测原因可能是用户社区、markdown 格式或缺少激励机制,并表示突然觉得自己该多发 Gist,还喊话 @github 考虑与 X 竞争。

3月17日周二
  1. FlowiseAI(@FlowiseAI)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    FlowiseAI 发布 Flow 项目更新

    FlowiseAI 在 GitHub 上更新了 Flow 项目,推文附带仓库链接,获得 10 次点赞、3 条回复和 2264 次浏览。原文未披露具体版本号、功能或参数细节。

  2. Andrew Ng(@AndrewYNg)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    吴恩达 Context Hub 新增智能体文档反馈功能,API 文档超 1000 份

    吴恩达宣布 Context Hub(chub)新版本支持智能体对文档提交反馈,说明哪些内容有效、哪些缺失,并提供隐私与安全保护,反馈用于改进文档。该开源 CLI 工具为编码智能体提供最新 API 文档,上线以来 GitHub 仓库获得超过 6K stars,文档数量从不足 100 份增至超 1000 份,增长来自社区贡献和新的智能体文档撰写器。

3月9日周一
  1. QdrantAI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在 Modal 上训练 SPLADE:电商搜索稀疏嵌入微调实战(第二部分)

    这是稀疏嵌入微调教程第二部分,使用 Amazon ESCI 数据集在 Modal 无服务器 A100 GPU 上训练 SPLADE 模型,以 Exact 和 Substitute 商品对作为正样本进行对比学习,10 万样本训练成本约 0.35 美元。

  2. QdrantAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么稀疏嵌入在电商搜索中胜过 BM25:微调稀疏嵌入系列 Part 1

    微调稀疏嵌入在 Amazon ESCI 数据集上比 BM25 提升 28%,这是五部分系列的第一篇。SPLADE 通过 MLM 头加 log saturation 与 max pooling 生成约 30,522 维中仅 100-300 个非零值的稀疏向量,并自动扩展查询词、抑制噪声,而 BM25 只能匹配字面出现的词。

2月12日周四
  1. Lex Fridman(@lexfridman)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Lex Fridman 对话 OpenClaw 创作者 Peter Steinberger:GitHub 星标超 18 万

    Lex Fridman 与 OpenClaw 创作者 Peter Steinberger 展开对话,这款开源 AI 智能体在 GitHub 上已获得超过 18 万 stars。节目还谈及 OpenClaw 的爆红原因、自我修改式 AI 智能体、安全顾虑、GPT Codex 5.3 与 Claude Opus 4.6 的编程对比,以及 OpenAI 和 Meta 的收购意向。

12月5日周五
  1. FlowiseAI(@FlowiseAI)AI 评估 · 34/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    FlowiseAI 发布 Flow 项目更新

    FlowiseAI 在 GitHub 上发布了 Flow 项目更新,并附上仓库链接。原帖互动数据为 0 条评论、0 次转发、6 次点赞、2823 次浏览。

11月13日周四
  1. Binyuan Hui(@huybery)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SWE-fficiency 发布:评估 LM 能否加速真实 GitHub 仓库

    SWE-fficiency 旨在评估语言模型能否在真实工作负载上加速真实 GitHub 仓库,包含跨 9 个数据科学、ML 和 HPC 仓库的 498 个优化任务,每个任务都配有真实工作负载。现有智能体难以达到专家级优化水平。

10月7日周二
  1. FlowiseAI(@FlowiseAI)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    FlowiseAI 发布 Flow 项目更新

    FlowiseAI 在 X 上发布了指向其 Flow 项目的链接,附带的 GitHub 页面地址为 github.com/FlowiseAI/Flow。该帖获得 5 次转发、45 次点赞和 11173 次浏览,未包含模型、参数或功能等具体信息。