跳到正文

#开源生态

今日 25 条
9月17日周四
  1. 真格基金AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    真格基金 Z Jobs 芯片半导体专场:奇算光启、瞬元等五家初创开放岗位

    真格基金推出「Z Jobs」芯片半导体系列招聘,每周分享一个行业的开放岗位,本期覆盖奇算光启、瞬元、芯视界、智子芯元、领挚科技五家团队。奇算光启 2024 年 10 月成立,做光计算芯片,已完成天使轮及天使+轮累计数亿元融资,招聘 AI 研究型实习生等岗位,要求 Claude Code/Codex/Cursor 等 AI Agent Harness 重度用户。

  2. Stanford AI Lab(@StanfordAILab)AI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Christopher Manning 谈前沿 AI 困于「三座修道院」,斯坦福坚持开放公开研究

    斯坦福 NLP 负责人、斯坦福 AI Lab 前主任 Christopher Manning 警告,前沿 AI 目前大多集中在「三座修道院」内,极少信息流向外界,这对整个社会是巨大问题。他强调斯坦福的基本假设是所有研究都必须公开可得,在越来越多前沿 AI 于闭门环境中开发之际,这种开放公开研究的承诺尤为重要。

  3. 开始连接LinkStartAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    抖音命名者任利锋 All in「AI 3D」:复盘押注制造业 OS 的关键决策

    数美万物创始人任利锋(卷卷)在播客中复盘自己离开大厂、All in「AI 3D × 制造业」两年半的关键决策,其团队打造的 AI 3D 模型平台 Hi3D 已跻身 Hugging Face 3D 垂直领域模型 4 强,模型从 1.0 演进至 3.0。他把红杉、IDG 等投资人带进产业带和车间,并让一线产业工人与算法研究员同室协作,终局指向「制造业 OS」。

  4. 夕小瑶科技说AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小米直播 MiMo-V2.6 强化学习训练,两天花费超113万美元

    小米 MiMo 大模型负责人罗福莉宣布,新一代模型 MiMo-V2.6 处于强化学习训练阶段,训练过程实时对外直播,页面同时跑 MiMo-V2.6-Pro 和 MiMo-V2.6-Flash 两条线,数据直接来自训练器日志。

  5. HelloGitHubAI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    从一份 README 到 3 万星,RustFS 这一年都干了什么?

    RustFS 发布正式版,这个基于 Rust、兼容 S3 的对象存储系统开源首年已积累 3 万多 Star,全球安装实例超 270 万,70% 以上来自欧美。正式版新增 MinIO 丝滑切换,可直接读取 MinIO 数据盘完成迁移,并将 MinIO 商业版中约 80 万人民币/年的 S3 Table 功能免费开源,支持 Spark、Iceberg 读写表数据并已进入生产环境。

  6. Fireworks AI(@FireworksAI_HQ)AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM 5.3 上线 Fireworks AI Serverless Training API,Kimi K3、Qwen 3.8 27b 已在列

    GLM 5.3 现可在 Serverless Training API 上训练,与 Kimi K3、Qwen 3.8 27b 等模型并列;GLM 5.3 Flash 即将推出。官方称无需销售演示或私信沟通,可直接从文档或预制 recipe 上手(github.com/fw-ai/cookbook)。

  7. Paul Couvert(@itsPaulAi)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    在免费 Google Colab 中用 Unsloth Studio 微调 500+ 开源模型

    作者提示可以在免费的 Google Colab 中微调 500+ 开源模型,还能上传 PDF/CSV 把它们变成可用的合成数据集。操作步骤为打开 Colab、运行代码块安装 Unsloth Studio、选择模型、上传数据集,之后即可开始,并可在完成后导出模型。

  8. Thomas Wolf(@Thom_Wolf)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 的 Thomas Wolf 与 Baseten、Goodfire AI 合作推进开源模型安全与可解释性研究

    Hugging Face 的 Thomas Wolf 宣布与 Baseten 旗下 Baselabs 及 Goodfire AI 合作,为开源模型推进安全与可解释性研究。

  9. mem0(@mem0ai)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    mem0 加入 Vercel 集成并推出 Eve Memory Agent 模板

    mem0 宣布与 Vercel 完成集成,并同步发布 Eve Memory Agent 模板,用户可直接在 Vercel 上试用。官方已放出公告博客与集成指南文档,方便开发者接入。

  10. cohere(@cohere)AI 评估 · 7/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere:加拿大与欧洲合作

    Cohere 发布 "Canada 🤝 Europe" 内容,指向加拿大与欧洲之间的合作。原文仅给出互动数据(9 条回复、14 次转发、291 次点赞、11823 次浏览),未披露合作的具体对象、内容或时间安排。

  11. Julien Chaumond(@julien_c)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Arcee.ai 完成 B 轮融资,估值超 $1B

    Arcee.ai 宣布完成 B 轮融资,公司估值超过 $1B,由 Vista Equity、Cambium Capital 和 Emergence Capital 领投,AI10 Ventures、Hitachi、IAG、M12、P7 Ventures 与 Wipro 参投。

9月16日周三
  1. Naval(@naval)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Naval 提议对"危险"开源模型追究托管方责任

    Naval 认为,对于"危险"或防护薄弱的开源模型,应追究托管方的责任;如果终端用户通过越狱模型去做有害的事情,终端用户自身同样要承担责任。

  2. cohere(@cohere)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 与 Aleph Alpha 联手打造安全可控的前沿 AI

    Cohere 宣布与 Aleph Alpha 合作,共同满足全球对既强大又安全的前沿 AI 日益增长的需求。Cohere 称,任何政府或企业都不应在 AI 能力与对自身技术的控制权之间做取舍。

  3. cohere(@cohere)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 与 Aleph Alpha 签署最终协议,成为首家横跨大西洋的基础模型开发商

    Cohere 与 Aleph Alpha 宣布签署最终协议,合并后以 Cohere 品牌运营,成为首家同时扎根大西洋两岸的基础 AI 模型开发商。统一后的公司员工规模将超过 1000 人,覆盖两大洲。

  4. 此话当真AI 评估 · 39/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对话张托肯:用 AI 三天设计一颗芯片后,一位清华博士决定「开卷」

    清华博士、苏黎世联邦理工博士后张托肯用 AI 三天完成从零到流片的 Attention 计算芯片设计,并借真格「Token Grant」算力支持推进「芯片开卷」计划。

  5. 字节跳动技术团队AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    字节开源 OpenViking 上下文数据库,用经验记忆构建 Agent 进化闭环

    字节跳动技术团队开源上下文数据库 OpenViking,新增面向执行过程的经验记忆:任务结束后归档 Session 并生成 Trajectory 与 Experience,新任务开始前检索相关经验并核对适用条件再应用。

  6. 袋鼠帝AI客栈AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    袋鼠帝开源《魔搭紫皮书》:8篇34章约40万字,教人从0部署、微调、评测开源模型

    AgentWork 开源社区发布《魔搭紫皮书》,共 8 篇 34 章、约 40 万字,面向想系统学习 AI 的读者。内容覆盖开源模型下载、无资源体验、用 ms-swift 做轻量微调、用 EvalScope 评测,以及 AI 健身教练、智能客服质检、语音助手、企业知识问答等场景,并含 Claude Code、Pi、DeepSeek Harness 的 Agent 篇。

  7. 奇舞精选AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 架构解读:从会回答到能持续做事的 Agent 运行时

    DeepSeek Harness(DSH)是 DeepSeek AI 基于 Cordis 开发的开源 Agent Harness,采用 MIT 许可证,官方仓库仍标注为开发者预览版。

  8. Jeff Dean(@JeffDean)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Periodic Labs 用 1300 张 H200 训出开源模型 Neon

    Periodic Labs 在 Menlo Park 搭建高通量材料实验室,让实验与模型形成闭环:实验室产生新数据,模型从中学习并决定下一步尝试什么。团队仅用 1300 张 H200 加上数月实验数据,对一个开源模型做中期训练和 RL,在自家分析基准上超过 GPT-6 Astra,模型命名为 Neon。团队称首先聚焦材料科学中的超导、磁体和半导体材料等难题。

9月15日周二
  1. Qdrant(@qdrant_engine)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Qdrant 实测金融检索:dense embeddings、BM25 与 SPLADE 混合搜索对比 47 份 SEC 文件

    Satyam Sahu 用 Qdrant 对 10 家科技公司的 47 份 SEC 文件做了混合检索实验,对比 dense embeddings、BM25 与 SPLADE 三种方式在金融搜索中的表现,考察各自适用的场景与短板。金融检索同时要求语义理解和精确匹配,因此混合搜索成为关注方向。

  2. 阶跃星辰AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阶跃星辰发布 StepAudio 3 系列语音大模型,五款模型上线开放平台

    阶跃星辰发布 StepAudio 3 系列语音大模型,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,均已上线阶跃星辰开放平台。

  3. Web3天空之城AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    黄仁勋 All-In 对话实录:驳斥 AI 灭绝论,称数据中心是未来 20 到 25 年的石油

    黄仁勋在 All-In 播客对话中驳斥前沿实验室的"10% 灭绝风险"说法,称其完全捏造、缺乏科学依据,主张回归工程方式处理 AI 事故并建立第三方独立评估机制。

  4. 硅谷科技评论AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    模型越来越便宜,什么才开始值钱?——Imagination In Action 硅谷 AI 峰会观察

    2026 年 9 月 14 日 Imagination In Action 硅谷 AI 峰会上,嘉宾反复提到模型能力仍在变强但已不值钱,真正的门槛转向速度、路由架构、专有数据和物理供应链。

  5. Yangyi(@Yangyixxxx)AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yangyi 评腾讯微信团队开源知识库 WeKnora:形态更像基座,应开放给其他场景接入

    Yangyi 认为知识库是企业刚需,但当前形态更像一个基座,实际调用场景不应局限在基座内部,建议开放出来给其他场景做接入。

  6. bolt.new(@boltdotnew)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 推出 Bolt Forge,联合 Arcee、Microsoft、Vercel 等加速开源权重模型

    Bolt 发布 Bolt Forge,合作方包括 Arcee、Microsoft、Vercel、Fireworks 和 DigitalOcean,目标是推动开源权重模型达到前沿水平并提供充足 token。为庆祝上线,Bolt 向 100 人赠送免费 Bolt Pro,在评论区留言"Forge"即可通过私信领取兑换码。

9月14日周一
  1. 百度AIAI 评估 · 28/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    百度与IFAW"濒危物种AI守护官"数字平台发布:可识别34类物种,准确率86.5%

    百度与国际爱护动物基金会(IFAW)合作的"濒危物种AI守护官"数字平台正式发布,可识别34类濒危野生物种,覆盖活体动物及相关制品,整体识别准确率达86.5%,支持电脑端和移动端使用。

  2. Modal BlogAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal 更新:Sandbox Sidecars 公测、Kimi K3 等模型支持与新版 Dashboard

    Modal 8 月更新为 Kimi K3、Qwen3.8-2.4T-A95B、GLM-5.3 和 GLM-5.3-Flash 四款开放权重模型提供 day-zero 支持,其中 Kimi K3 为 2.8T 参数多模态模型,支持 1M-token 上下文窗口,在智能体负载下达到 460 tokens/秒。

  3. Fireworks AI(@FireworksAI_HQ)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 上线 Qwen 3.8 Max,与阿里云合作提供旗舰模型

    Fireworks AI 与阿里云合作,将 Qwen 最新旗舰模型 Qwen 3.8 Max 引入 Fireworks 平台,开发者即日起可通过 fireworks.ai 上的模型页面开始构建。双方称这一合作面向需要速度与生产级质量的开发者,可更快构建并弹性扩展。

  4. Yann LeCun(@ylecun)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Yann LeCun 回应:Dario 早在 2019 年就称 GPT-2 开源太危险

    Yann LeCun 回应称,Dario 早在 2019 年就声称 GPT-2 开源太危险,他当时就嘲讽过这一说法,并认为现在所有人都该嘲讽。

  5. Paul Couvert(@itsPaulAi)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    呼吁尽快下载"未审查"开源模型并本地运行

    针对有人以"pace"模型为由、实则似在阻止开源的做法,Paul Couvert 建议尽快下载这个未审查(uncensored)的模型并在本地运行。该帖未给出模型名称、参数规模或具体发布信息。

9月13日周日
  1. Browser Use(@browser_use)AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 推出 Agency:让智能体主动提议任务,用户批准或跳过

    Browser Use 推出 Agency,把交互反过来:不再由用户写提示词,而是智能体主动提议它认为有用的工作,用户选择批准或跳过。按官方描述,它会读取用户生活全貌上下文、发现被遗忘的事项、在用户看到问题前修好,并声称可减少打开 Gmail、Chrome 或 Slack。

  2. Junyang Lin(@JustinLin610)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    为什么人人都在做专用推理引擎?vLLM/SGLang 之外生态正在碎片化

    针对“过去一个月至少 5 个专用推理引擎发布”的现象,有开发者质疑为何要放弃 vLLM、SGLang 另起炉灶,认为这会碎片化生态、弊大于利。Junyang Lin 转评调侃称,原因是现在人们突然都会写 Rust 了。

  3. 硅谷科技评论AI 评估 · 49/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    前 1% 业绩换不来上期一半资金:LP 按方向清单买基金,AI 物理基础设施成新闸门

    一只每投 1 块已还 LP 3.6 块、排进全球前 1% 的基金,募新一期只拿到上期一半。8 月 28 日 a16z 完成 11 亿美元 Machine Age Fund 募集,专投 AI 硬件;同月成立两年、零回款记录的 Permanent Capital Ventures 二期反而从 1.5 亿增至 2 亿美元。

9月12日周六
  1. clem 🤗(@ClementDelangue)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 发起 Open Alignment Initiative 并申请加入 Anthropic 嵌入式评估者计划

    Hugging Face 联合创始人 Clement Delangue 宣布发起 Open Alignment Initiative,该倡议由 Thom Wolf 和 Hugging Face 主导,主张对齐问题无法只在少数前沿实验室闭门解决。

  2. 浮之静AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    pnpm 12.4:统一多语言开发工作流

    pnpm 12.4 将 npm、Python 和 Cargo 依赖安装收进同一套工作区配置,一条 pnpm install 即可处理三个生态的依赖,新增的 pipeline 负责安装后的构建与验证编排。

  3. clem 🤗(@ClementDelangue)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 的 SO-100 开源机械臂约 200 美元,OpenAI 的 cdngdev 预测机器人将迎来 3D 打印式热潮

    OpenAI 的 cdngdev 预测机器人将重演 3D 打印热潮:人们会购买便宜的塑料机械臂夹在桌上、接入 AI 智能体。他现场使用的是 Hugging Face 的 SO-100 机械臂,开源、可完整 3D 打印,售价约 200 美元,而传统机器人设备要数千美元。他表示现在已可直接打开 Codex 操控机器人。

9月11日周五
  1. Interconnects AI — Nathan LambertAI 评估 · 24/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert 发布开源 AI 与开放模型阅读清单

    Interconnects AI 的 Nathan Lambert 整理出一份近几年关于开放模型的最佳写作清单,覆盖基础概念、美中竞争等主题,并列出每篇的作者与时间。

  2. 阮一峰的网络日志AI 评估 · 59/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    科技爱好者周刊第 412 期:禁止 issue,只用 PR

    Laravel 上周宣布新规定,禁止提交 issue,只能提交 Pull Request,作者认为此举可减少垃圾 issue、便于维护者理解问题,且 AI 时代用户可借 AI 生成 PR。周刊还提到 Anthropic 用 Claude 完成费马大定理的 Lean 语言机器证明,代码长达 1300 万行,消耗数十亿 Token,已公布在 GitHub 上。

  3. Eric Jing(@ericjing_ai)AI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 与 Fireworks 发布开源模型 Gen-1 Slides

    Genspark 与 Fireworks 发布开源模型 Gen-1 Slides,在幻灯片生成任务上对标 Claude Opus 5,输入 token 价格约为后者的 1/17。该模型基于 MiniMax M3 通过 Fireworks Lab 的长时程 RL 后训练而来,已在 Genspark AI Slides 中作为默认模型上线。

  4. Julien Chaumond(@julien_c)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HuggingFace 成立 Open Alignment 团队,Thomas Wolf 称开放模型安全难以在少数前沿实验室闭门解决

    HuggingFace 正在组建 Open Alignment 团队,专注开放模型的安全与对齐研究,涵盖网络安全方向。Thomas Wolf 同时就 OpenAI/HF 事件在 FT 发表评论文章,并称该问题需要 100 倍的透明度和研究投入;Julien Chaumond 则对少数前沿实验室闭门解决该问题表示愈发怀疑。