跳到正文

#开源生态

今日 21 条
10月9日周五
  1. Harrison Chase(@hwchase17)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangSmith 评测中的 Jev 判官:轨迹标注不是单一通过/失败,而是多维打分

    LangSmith 评测中的 Jev 判官把轨迹标注拆成多个问题,难度和正确性各自得到带类型的答案,且在一次 pass 中、对每条 trace 完成。该框架认为轨迹标注需覆盖任务难度、方案正确性、设计选择多样性和思考方向等维度,规模化标注百万级 agent 及其子 agent 的 token 成本仍待大幅降低。

  2. OpenRouter(@OpenRouterAI)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cloudflare Clef 决策模型上线 OpenRouter

    Cloudflare 的 Clef(27B)和 Clef Flash(9B)两款开源决策模型已可在 OpenRouter 上使用。用户可输入文本、JSON 或图像,模型返回带概率的类型化答案而非生成文本。定价为 Clef 每百万输入 token $0.24、Clef Flash $0.09,输出免费。

  3. OpenRouter(@OpenRouterAI)AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    StepFun 的 Step 5 Preview 上线 OpenRouter,输入 $1.00/M、输出 $2.70/M

    StepFun 的 Step 5 Preview 已在 OpenRouter 上线,定价为输入 $1.00/M、输出 $2.70/M,发布期缓存命中价再打五折至 $0.05/M。发布方称该模型面向智能体与专业工作场景,并提供为期一周的免费访问,逐步覆盖 opencode、cline、NousResearch、kilocode 等平台。

  4. 掘金本周最热AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Spring AI Alibaba 半年未发正式版,是停更还是“换心脏”?Java AI 该如何选型

    Spring AI Alibaba 最后一个正式版 v1.1.2.2 发布于 2026 年 3 月 10 日,此后半年无新正式版,但 main 分支仍有提交,8 月 25 日还有最新 commit,v1.1.2.2 之后共合并 137 个提交,以修复和测试为主。

  5. 创业邦AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    一大批00后当上游戏公司CEO:库兰织梦、超级鹦鹉等团队崛起

    游戏行业出现一批00后CEO:2001年出生的库兰织梦吴同2026年5月完成数千万元Pre-A轮融资,公司估值达2亿元;19岁成为CEO的龚子浩创办超级鹦鹉,三年累计营收超3200万元、利润超800万元。AI提速与竞争加剧下,"懂年轻人"正成为游戏行业的重要能力,大厂也更多让接近年轻用户的团队参与决策。

  6. Stack Overflow BlogAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Python 实现模块化 Master-Agent 遥测诊断框架:Prime-Sentinel Command(PSC)

    Prime-Sentinel Command(PSC)是一个用 Python 面向对象实现的 master-agent 架构,由中央编排器 PrimeProgram 协调多个自主边缘诊断节点 SentinelProgram,后者采集 CPU 负载、内存占用与网络状态并返回结构化遥测数据。

  7. Simon Willison(@simonw)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    微软开源跨平台沙箱库 MxC

    微软发布开源跨平台沙箱库 MxC,支持 Windows、macOS 和 Linux,底层分别使用 processcontainer、bubblewrap 和 seatbelt。该项目被介绍为面向智能体的统一沙箱方案,在 Windows 上提供进程、会话、micro VM 以及与智能体 ID 的深度集成。代码托管于 github.com/microsoft/mxc。

  8. The Rundown AI(@TheRundownAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    今日 AI 要闻:OpenAI 数学研究产出 700+ 论文,Mistral 发布开源模型 Le Chonk

    OpenAI 数学领域的论文产出持续爆发,已达 700+ 篇。Mistral 的 Le Chonk 加入西方开源模型浪潮,同时 OpenAI 的 GPT-6 Astra 可帮用户比较网站。Brett Adcock 的 Hark 推出主动式 AI 助手。

  9. meng shao(@shao__meng)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里「AI Native 研发范式实践手册」四点陈述:从写代码到可靠交付仍需解决大量技术问题

    阿里在「AI Native 研发范式实践手册」结尾给出四点官方陈述:从写代码到可靠交付仍有较多技术问题待解,基础设施工程复杂度可能不亚于 Agent 应用层建设。企业知识资产尚未做到 Agent 友好,结构化、版本化、权限管理与质量治理仍有大量工作;组织设计影响更深远且更难有确定答案,AI 迭代速度还会持续冲击现有架构,需保持架构适应弹性。

  10. meng shao(@shao__meng)AI 评估 · 74/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    腾讯云开源自托管多智能体 AI 助手平台 Octop

    腾讯云开源自托管多智能体 AI 助手平台 Octop,面向家庭和小团队,主打多用户、多智能体和数据完全留在本机。整个系统为单个 Python 进程,数据落在 ~/.octop/,默认 SQLite(WAL 模式)并可切换 PostgreSQL;模型层走 OpenAI 兼容 API,支持 DashScope、Ollama 与可替换的存储和渠道。

  11. meng shao(@shao__meng)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    T3 Stack 作者 theo 开源 Rust 版 TypeScript 编译器 tsc-rs

    T3 Stack 作者 @theo 开源了 TypeScript 编译器、类型检查器和 LSP 的 Rust 完整移植 tsc-rs,它是微软官方 TypeScript 7(typescript-go,Go 原生版)的逐行为移植,锁定上游提交 typescript-go @673a5f17,采用 MIT 协议并保留上游 Apache-2.0 / BSD-3 声明。

  12. 向阳乔木(@vista8)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    yetone 的 magpie:可参考的 AI Agent 基建,支持多模型配置与 OAuth 登录

    yetone 的 magpie 是一套 AI Agent 基建,支持各种模型配置和 OAuth 登录,开发 AI 工具时可把仓库发给 Agent 学习参考。其平台图标采用 lobehub 整理的 icon,添加服务商的操作也更直观。仓库地址为 github.com/yetone/magpie。

  13. Aravind Srinivas(@AravSrinivas)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 开源 pplx-embed-v2-late 多向量嵌入模型,9B 与 0.6B 双版本

    Perplexity 开源 pplx-embed-v2-late,包含 9B 和 0.6B 两个晚期交互多向量嵌入模型,用于检索文本、图像和页面,二者共享同一嵌入空间以支持跨模型查询。

  14. 美团技术团队AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团 LongCat 发布 MineExplorer:首个开放世界分钟级长程任务评测基准,18 款顶级多模态大模型集体"考砸"

    美团 LongCat 团队构建 MineExplorer,首个在开放世界中做到分钟级长程任务的评测基准,包含 813 个人工验证实例(1-hop 到 4-hop),每个任务实例运行 1800 个环境步、对应 3 分钟连续交互。

  15. 美团技术团队AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    美团开源 LoHoSearch 搜索智能体评测基准,用知识图谱让机器自动出题

    美团 LongCat 团队开源 LoHoSearch,一个基于覆盖 762 万维基百科实体知识图谱自动生成题目的搜索智能体评测基准,含 544 道经人工核验题目、覆盖 11 个领域。

  16. orange.ai(@oran_ge)AI 评估 · 51/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Orange AI 发布「播客转文章」skill,按话题重排逐字稿并保留数字原话

    Orange AI 发布实用 skill「播客转文章」,解决录完 Next Token 播客后想转成文章的问题。作者称照录音直接整理像会议纪要,交给 AI 润色又会丢失数字和细节,于是改为按话题而非时间线重新梳理,并定下规则:数字和原话一条不砍,砍掉与本节无关的段子、顺带蹭的新闻和自家产品举例。作者表示实测阅读量和互动不错,用户反馈没有吐槽 AI 味,该 skill 以 MIT 协议免费开源。

  17. lmarena.ai(@lmarena_ai)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral Large 4 亮相:1T 参数、49B 激活,月底开放权重

    Mistral AI 的 Mistral Large 4 是一个 1T 参数、49B 激活的模型,权重将于月底开放。

  18. Jerry Liu(@jerryjliu0)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LlamaIndex 团队推出 OpenDocRouter,用统一 API 接入 OCR 与前沿 VLM

    Jerry Liu 发布 OpenDocRouter,一个面向文档解析的统一 API,可在同一接口和计费下对比并使用多种 OCR 模型,从 MinerU 等轻量开源模型到 Opus 5.5 等前沿 VLM。

  19. 国际大厂AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TouchScale 发布 500 小时人类视觉-触觉数据集,机器人真机成功率翻番

    德州农工大学、Google DeepMind、CMU 等 15 家机构联合发布 TouchScale,一个在统一传感器与采集流程下构建的 500 小时人类双手视觉-触觉数据集。

  20. 量子位AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sharpa 在 IROS 发布人形机器人 D01、灵巧手 W02 与外骨骼数据手套 AE01

    Sharpa 在 IROS 发布首款全自研通用人形机器人 D01、新一代灵巧手 W02 和外骨骼触感数据手套 AE01。D01 电子皮肤覆盖全身、触觉覆盖上半身,触觉采样率 100Hz,重复定位精度 0.2mm;W02 主动自由度从上一代 W01 的 22 个减到 21 个,整手尺寸缩小约 30%。

  21. 向阳乔木(@vista8)AI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    多 agent 协作实测:不同性格 Bot 讨论拍板,做出 24 小时 AI 新闻播报电视台

    一位开发者给不同性格和技能的多 agent Bot 开放了 GitHub、Cloudflare 和豆包播客 API,让它们自行讨论拍板,最终做出一个 24 小时播报 AI 新闻的电视台。作者称一直不看好 agent 协作,这次有点改观,并表示当天下午会将其开源。

  22. 量子位AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    星动纪元VPP2登顶RoboDojo仿真榜单并开源

    星动纪元自研的世界动作模型VPP2登顶RoboDojo仿真榜单,平均成功率32.26%、平均得分39.26分,两项均列第一,领先GPT-6-Astra。该模型未额外加数据、未用Agent RSI等增强手段,仅靠标准数据集,在泛化、精细操作、记忆三个维度也拿下第一。团队将视频预测与动作学习分阶段训练,真机ALOHA零样本操作平均成功率58.5%,高于π0.5的40%,现已在GitHub开源。

  23. AI Will(@FinanceYF5)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Edge0 开源一个月:35B 模型在 iPhone 飞行模式运行,峰值内存 1.8GB

    Edge0 团队开源一个月后,其 35B 模型已能在 iPhone 飞行模式下运行,峰值内存仅 1.8GB,无需云端、远程服务器,也没有按 token 计费成本。该模型已从手机扩展到耳机、智能眼镜、机器人和 AI 玩具,并获得 8 万+客户。转发者还发起讨论,期待 Edge0 接下来跑在哪种设备上。

  24. meng shao(@shao__meng)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Matt Pocock 分享 AI Coding Agent 流程选择决策框架

    Skills For Real Engineers 开源项目作者 Matt Pocock 分享了 AI Coding Agent 该用多重流程的决策框架:小改动不要用 /grill-with-docs。

  25. 投资融资AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    港大教授孔令鹏创立的 DiffuSpace 完成 dLLM 领域全球最大融资

    港大教授孔令鹏创立的扩散语言模型公司 DiffuSpace 完成 dLLM 方向全球最大规模融资,高鹄资本担任交易方。其开源模型 Dream 7B 在 Hugging Face 累计下载量超过 250 万,今年内计划发布参数规模更大的新模型,并针对性适配代码 Agent 与智能推理等任务。

  26. Fireworks AI(@FireworksAI_HQ)AI 评估 · 8/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 活动:Natolambert 谈开放模型为何胜出

    Fireworks AI 将于 11 月 3 日在旧金山举办 Forge 活动,Trillium Labs 联合创始人、Interconnects 作者 Natolambert 将发表演讲,主题是开放模型为何能胜出。

  27. xAI(@xai)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    xAI 以 150 万美元 Grok tokens 支持 Omarchy 团队

    xAI 成为 Omacom Foundation 的创始企业赞助方,向 Omarchy 的维护与开发提供价值 1,500,000 美元的 Grok tokens。Omacom Foundation 由 DHH 宣布这一赞助,并提到未来这些 tokens 或许会直接从轨道传送。

  28. 投资融资AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SpaceXAI 以 150 万美元 Grok tokens 支持争议 Linux 发行版 Omarchy

    SpaceXAI 宣布以创始企业赞助方身份加入管理 Omarchy 的 Omacom Foundation,并向 David Heinemeier Hansson 的 Linux 项目捐赠价值 150 万美元的 Grok tokens,主要用于加速开发、代码审查和修复 bug。

  29. SemiAnalysisAI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis:北京不会为前沿AI放慢脚步,中国采取速度优先的安全监管

    SemiAnalysis 统计 2021 年至 2026 年 9 月 15 日 9 家中国头部开发商的 857 个模型发布,仅 31 个(3.6%)附带开发者公布的安全评估结果,其中只有 9 个(1.1%)在发布时或之前公布。

  30. Hugging Face(@huggingface)AI 评估 · 30/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 在 Paper Pages 推出论文复现功能

    Hugging Face 在 Paper Pages 上线论文复现功能,可用 ML Intern 对已发表论文发起复现任务。Hugging Face 的 Abubakar Abid 指出,随着智能体在算力驱动下加速科研发现,发现被商品化、低质量论文泛滥、企业倾向于保密,开放共享科学的激励正在瓦解,因此需要新工具来奖励知识公开。

  31. eric zakariasson(@ericzakariasson)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SpaceXAI 成为 Omacom 基金会创始企业赞助方,向 Omarchy 捐赠 150 万美元 Grok tokens

    SpaceXAI 成为 Omacom 基金会创始企业赞助方,向 Omarchy 的维护与开发捐赠价值 1,500,000 美元的 Grok tokens。DHH 称这是对开源的支持,并调侃这些 tokens 或许很快就会从轨道直接传送过来。

  32. 技术前沿AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Goodfire 推出“由内而外”的 AI 智能体监控器,成本仅为传统方案零头

    Goodfire 发布了一种“由内而外”的监控方案,直接读取 AI 模型工作时的内部激活信号,而非让第二个模型逐字审阅输出。在 Kimi K3 上测试约 1500 个会话,成本约 51 美元,而廉价模型逐步检查需 233 美元、顶级模型约 1 万美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送二审,同时运行四个探针给模型响应启动时间增加不到 2%。

10月8日周四
  1. Julien Chaumond(@julien_c)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ecosia 放弃法国 AI 伙伴 Mistral,转向开源模型含中国模型

    柏林搜索引擎 Ecosia 首席执行官向 POLITICO 表示,公司将放弃法国 AI 合作伙伴 Mistral,转而押注开源模型,其中包括来自中国的模型。Ecosia 被政府部门使用,此次调整意味着其 AI 合作方从 Mistral 转向开源路线。

  2. clem 🤗(@ClementDelangue)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 上可自制 Reachy Mini 舞蹈动作

    Hugging Face Spaces 上线 pollen 的 Reachy Mini 舞蹈项目,用户可自己动手制作 Reachy Mini 的舞蹈动作。推文给出的链接指向 huggingface.co/spaces/pollen-… 页面。

  3. GitHub(@github)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GitHub 播客:低质量贡献成开源维护者最大痛点,如何应对 AI slop

    GitHub Tiny Wins 团队的 Camilla Moraes 做客最新一期 GitHub Podcast,讨论如何应对开源项目中的 AI slop 问题。节目还谈及倾听维护者诉求,以及如何决定下一步修复什么。完整内容可在 YouTube、播客平台或 gh.io/podcast 收听。

  4. Arthur Mensch(@arthurmensch)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ecosia 弃用 Mistral,转投中国开源模型

    柏林搜索引擎 Ecosia 正放弃其法国 AI 合作伙伴 Mistral,转而押注开源模型,包括来自中国的模型。其 CEO 向 POLITICO 透露了这一消息,Ecosia 目前被政府服务部门使用。

  5. PyTorch研习社AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Pi Agent Harness:一个比 OpenCode 更透明、更可控的 Coding Agent

    Pi 是一个主打极简与可控的 Coding Agent Harness,GitHub 星标已超 99,000,创建者 Mario Zechner 因不满现有工具在幕后注入上下文而从头自建。

  6. The JetBrains BlogAI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    JetBrains 发布 Mellum2.1:面向编码智能体的快速开源模型

    JetBrains 发布开源模型 Mellum2.1,这是 6 月开源的 12B MoE 模型的新版本,架构未变,仍为 2.5B 激活参数、Apache 2.0 许可,改进集中在预训练之后的强化学习阶段。

  7. 向阳乔木(@vista8)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    姚金刚开源17套知识付费提示词,覆盖课程定位到运营

    姚金刚开源17套知识付费提示词,源自其《课程营销学》一书,覆盖课程定位、课程设计、课程售卖和课程运营四大核心模块,供正在做课程的老师、知识创作者和教育产品团队直接使用。同时,其搭档透露接下来两个月将推进深圳GEO大会,并启动招商,已有GEO相关工具厂商、AI Agent产品和Token算力平台支持。

  8. InfoQAI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OSS EU 圆桌:技术主权靠选择、技能与支持,而非 100% 自给

    Open Source Summit Europe 圆桌讨论指出,欧洲组织实现技术主权不必回避全球技术供应商,但需要可信的替代方案和相应技能。