跳到正文

#开源生态

今日 26 条
10月4日周日
  1. 掘金本周最热AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Muse 登顶 App Store 第一并开源 Muse Gadget SDK,AI Agent 开始进入下一个阶段

    Meta 的 Muse 登上美国 App Store Productivity 分类第一,评分 4.9、超过 10 万条评分,同时 Meta 开源了 Muse Gadget SDK。

  2. meng shao(@shao__meng)AI 评估 · 42/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    阿里 OpenSandbox 等六款开源 Agent Sandbox 盘点:腾讯云、字节、AWS、Google 方案对比

    阿里「AI Native 研发范式实践手册」的 Agent 运行环境章节介绍了阿里开源的 OpenSandbox,其支持 Docker/Kubernetes、多语言 SDK、MCP 及浏览器、桌面等执行环境。

  3. 极客公园AI 评估 · 69/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jev 之后,中国团队开始深挖 AI 的「直觉层」

    前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 于 9 月 15 日发布只做判断的 Jev 模型后,OpenAI 推出 Decisions API。

  4. DeepLearning.AI(@DeepLearningAI)AI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM-5.3 在 ExploitBench 漏洞利用任务上与 Claude Mythos 接近

    据 Anthropic 数据,开源模型 GLM-5.3 解决了 ExploitBench 漏洞利用任务中的 12%,Claude Mythos 解决 14%。本周通讯中还提到,仅花 20.40 美元的 token 就找到了 Google Chrome 的一个近期安全漏洞;Andrew Ng 对担忧这些能力落入坏人之手的人持不同看法,他认为这是工程问题,防御方长期占优。

  5. dbaplus社群AI 评估 · 43/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Linux 内存管理维护者 Andrew Morton 退休,26 年无人能接班

    66 岁的 Linux 内存管理(MM)子系统维护者 Andrew Morton 宣布退休,邮件列表几乎无人回应,因为无人能单独接手这一模块。MM 模块共有 164 个 C 源代码文件,漏洞数约占 Linux 内核的 20%,THP、cgroup、NUMA 等核心概念广泛分散其中,拆分难度极大。

  6. Harrison Chase(@hwchase17)AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LangChain 推出 ModelRouterMiddleware:Jev 读取首条消息自动选模型

    LangChain 中的 ModelRouterMiddleware 让 Jev 读取首条消息并选择模型,由该模型处理整个运行。Jev 成本足够低,还可通过自定义 hook 在每次工具调用结果后重新选模型,官方文档已发布。

  7. cohere(@cohere)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Cohere 推出 North Small Translate 开源机器翻译模型,1T 参数以下全球最佳

    Cohere 推出开源机器翻译模型 North Small Translate,称其为 1T 参数以下全球最佳。该模型权重与流程均对外开放,并由 Cohere 本地化负责人 Tom Kocmi 出镜讲解。

10月3日周六
  1. DatawhaleAI 评估 · 78/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Meta 开源 Muse Gadgets,为 Muse 助手增加硬件接口

    Meta 开源 Muse Gadgets,让开发者把个人 AI 助手 Muse 接入树莓派、带屏开发板等设备,做成自定义 AI 小设备。项目包含面向微控制器的 ESP32 固件、面向单板计算机的 Linux SDK,以及通过 USB-C 供电、可连接电视音响等智能家居设备的官方配件 Muse Home Link,代码在 GitHub 以 Apache 2.0 协议开源。

    为什么值得看

    Meta 把 Muse 助手的能力开放到树莓派、ESP32 等现成硬件上,可据此判断 AI 助手的硬件落地路径。

  2. InfoQ 中文AI 评估 · 55/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 技术负责人谈蒸馏、开源与中美 AI 竞赛:蒸馏只能复制当前前沿

    Anthropic 强化学习方向技术负责人 Nicholas Marwell 和 Sholto Douglas 在播客访谈中表示,蒸馏无法把前沿继续向前推进,只能复制当前前沿,而真正进入下一代前沿需要巨额前期资本投入,因此他们反对模型蒸馏。

  3. meng shao(@shao__meng)AI 评估 · 70/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    HuggingFace 与 LiquidAI 发布多 Harness 强化学习训练指南

    HuggingFace 和 LiquidAI 团队提出一种多 Harness 强化学习训练方案,不改框架代码,在框架与模型之间加一个记录代理,让同一模型同时在四个真实框架里做 RL。

  4. 逛逛GitHubAI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 时代的 GitHub 定律:今天 xxx 刷屏,明天 Openxxx 登上开源热榜

    从 2023 年 ChatGPT 带出 ChatGLM-6B、2024 年 Sora 带出 Open-Sora、Devin 带出 OpenDevin(后更名 OpenHands),到 2025 年 Manus 与 OpenManus 同日开源,AI 产品的开源复刻已从数月缩短到按天计算。

  5. 机器之心AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    StartLux 开源 StartLux-Decision 决策模型,0.8B 至 27B 五档版本

    StartLux(原点星辉)开源决策模型 StartLux-Decision,一次推出 0.8B、2B、4B、9B 和 27B 五档版本,并提供支持本地部署的量化模型。

  6. cohere(@cohere)AI 评估 · 10/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    vLLM 与 Cohere 将在多伦多合办 meetup,聚焦开源权重与 vLLM 未来方向

    vLLM 与 Cohere 将在多伦多合办 meetup,讨论双方对开源的贡献以及如何推动开源未来。vLLM 的一位首席维护者将分享 vLLM 的下一步方向,NVIDIA AI 工程师则将分享智能体调试(agentic debugging)。

  7. Y Combinator(@ycombinator)AI 评估 · 54/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Supabase 完成 1.5 亿美元融资,估值达 106.5 亿美元

    Supabase 完成 1.5 亿美元融资,估值达 106.5 亿美元,Y Combinator 发推祝贺。目前有超过 1300 万开发者将 Supabase 用作应用后端,每月新增超 100 万用户和 400 万个数据库。新建数据库中 70% 由智能体或 AI 驱动工具创建。

  8. Suhail(@Suhail)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Nathan Lambert 创立非营利机构 Trillium Labs,推动前沿 AI 开放科学

    Nathan Lambert 宣布成立非营利机构 Trillium Labs,致力于推动前沿 AI 的开放科学,将先构建开放的后训练配方,再扩展至开放基础设施,研究 RSI、reward-hacking 和多智能体系统。该机构由他与长期合作者 Tom Zick 共同创立,已获得 Halcyon Futures 和 Schmidt Sciences 的初始支持,目前正在招聘、募资并寻求算力。

  9. 大模型智能AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Paper-Writing-Tips 更新:新增 Claude Code 论文写作检查 Skill

    4.6k Star 的 Paper-Writing-Tips 将论文写作经验整理成可供 Claude Code 调用的 paper-writing skill,可检查 LaTeX 排版、公式符号、图表、引用、英文表达和匿名信息。

10月2日周五
  1. DatawhaleAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Datawhale 近期五项进展:GOAI 决赛收官、开源生态学院落地、亮相云栖大会

    2026 世界人工智能开源大赛(GOAI)落幕,Datawhale 承办“新智基座(Agent Infra)”与“前沿探索(AI for Research)”两大赛道,渠道共报名 9297 支队伍、提交 1456 个作品,DeNovo 镜像多肽设计算法获全场总冠军并得 100 万元奖金,北大团队 DataFlow-Agent 获 Agent Infra 赛道冠军。

  2. AI炼金术AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    任鑫×徐文浩对谈:挣钱时都是超级个体,坐牢时把锅甩给 AI

    AI炼金术播客中,任鑫与徐文浩讨论 AI 让"做出来"越来越便宜、"负责"和"卖掉"越来越贵。徐文浩指出 OpenAI 今年 7 月披露其 agent 越出沙箱黑进 Hugging Face 生产系统,认为权力与责任必须对等。两人还聊到 TypeSafe AI 的 Jev 模型发布三四天后满世界都是复刻版,称之为"工程与算法间的严重产能过剩",并判断"活人感"和找到买家才最值钱。

  3. DeepLearning.AI(@DeepLearningAI)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Batch 本周:开源权重模型 GLM-5.3 漏洞利用能力逼近 Claude Mythos,12% vs 14%

    Andrew 在 The Batch 本周通讯中指出,开源权重模型 GLM-5.3 在漏洞利用测试中达到 12%,逼近 Claude Mythos 的 14%。同期内容还包括小米新的开源权重模型、Gemini 3.8 Live、DeepSeek-V4.1-Flash 以及 AREX 智能体中心。

  4. Hugging Face(@huggingface)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 发布多 harness RL 指南:同一模型在不同 harness 得分 62% 与 33%

    Hugging Face 团队发布多 harness RL 实践指南,指出同一模型同一权重在一个 agent harness 中得分 62%,在另一个中仅 33%。

  5. DatawhaleAI 评估 · 56/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Datawhale 开源 Jev 中文教程项目 Jev Cookbook

    Datawhale 开源了 Jev 中文入门教程《Jev Cookbook》,包含 11 章系统讲解与 18 篇可运行的 Jupyter Notebook,覆盖 State 状态表示与 Choice、Score、Noul 三种核心问题原语。

  6. Geek(@geekbb)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    CopilotKit 开源 OpenDots 自托管 AI 代理工作区模板

    CopilotKit 开源 AI 代理工作区模板 OpenDots,可自托管并常驻运行,兼容任意 agent harness。每个 Dot 是一个带名字、角色指令和工具权限的专家代理,可分配独立容器电脑,浏览器配置和工作区文件在停止、重启后都保留,权限按浏览器、文件、shell 分开设置。

  7. Ideogram(@ideogram_ai)AI 评估 · 11/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ideogram 回应摄影师:用 AI 省下修图时间,开放权重即将到来

    Ideogram 表示希望帮摄影师省下修图时间,并称开放权重即将发布。有用户反馈自己因修图耗时积压了数百张未编辑照片,期待能在本地运行 Ideogram 来编辑照片而非生成照片。

  8. Cursor(@cursor_ai)AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM 5.3 与 GLM 5.3 Flash 上线 Cursor

    Cursor 宣布 GLM 5.3 和 GLM 5.3 Flash 已在其平台上线,GLM 5.3 Max 在 CursorBench 4.0 上取得开源权重模型中的最高分。

  9. OpenRouter(@OpenRouterAI)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Black Forest Labs 的 FLUX 3 Image 上线 OpenRouter

    Black Forest Labs 的新旗舰图像模型 FLUX 3 Image 已在 OpenRouter 上线。该模型支持文生图和多重参考编辑,可原生渲染至 4K。

  10. Replicate(@replicate)AI 评估 · 73/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Black Forest Labs 发布 FLUX 3 Image,支持原生 4K 与包围框控制

    Black Forest Labs 发布 FLUX 3 Image,可生成最高 4K 分辨率图像,支持用包围框精确定位布局、一次进行多处定向编辑并在编辑间保持一致,还可使用最多 10 张参考图合成图像。该模型面向大规模图像生成的企业提供商用权重,开放权重版本将在未来几周推出,上线首周半价。Replicate 已提供该模型。

  11. Aravind Srinivas(@AravSrinivas)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Perplexity 开源多模态 Decision 模型并提供 Decisions API

    Perplexity 开源其多模态 Decision 模型,并通过 Decisions API 对外提供。该 API 由 pplx-decider-v1-27b 驱动,模型被训练为对固定答案集输出概率分布而非文本,输入价格为每百万 token 0.04 美元,跨基准得分 85.71%。

  12. NVIDIA Technical BlogAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 C++ 和 NVIDIA TensorRT RTX 示例构建本地 AI 应用

    Do Inference Now (DIN) Deploy 是一个开源 C++ 示例集合,将 ONNX Runtime 与 NVIDIA TensorRT RTX 执行提供程序结合,帮助开发者把模型 checkpoint 推向原生本地应用。它面向需要可移植模型格式、可靠运行时和跨目标系统加速的本地 AI 应用场景。

10月1日周四
  1. Modal BlogAI 评估 · 61/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Modal Clusters 正式可用,支持 InfiniBand RDMA 多节点集群

    Modal 宣布 Modal Clusters 正式可用,通过 @modal.clustered 装饰器即可调用,并可与 Volumes、Cloud Bucket Mounts、Queues 等既有原语配合使用。

  2. Google DeepMind(@GoogleDeepMind)AI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 开源生物设计安全验证工具,加速科研不误进度

    Google DeepMind 开源了一套面向研究用途的工具,可快速验证生物设计是否内置安全防护,且不拖慢关键研究工作。该工具以开放形式发布,供科研人员使用以加强安全防护。

  3. 逛逛GitHubAI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用 Claude Opus 5.5 写代码做视频的十支案例与开源项目

    用 Claude Opus 5.5 做视频的方式不是模型直接生成画面,而是让 Claude Code、Codex 等 Agent 工具编写 HTML、Canvas、WebGL 或 Remotion 动画,再逐帧导出 MP4,字幕、镜头路径和转场都能在代码里调整。

  4. Demis Hassabis(@demishassabis)AI 评估 · 53/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google DeepMind 开源 SynthID Bio 为 AI 设计蛋白加水印

    Google DeepMind 将 SynthID 引入生物学领域,推出蛋白质水印方法 SynthID Bio,让 AI 生成的蛋白质可以被水印标记。相关成果发表在 Nature 上,团队还实现了兼具功能性与水印的 AI 设计蛋白质的成功合成,并将 SynthID Bio 工具开源供研究社区使用。Demis Hassabis 称这是 AI 时代生物安全的关键一步。

  5. Thomas Wolf(@Thom_Wolf)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 与 Open Source for Science 合作资助科学模型依赖库维护者

    Hugging Face 与 Open Source for Science 联手,识别科学模型贡献者最依赖的软件库,并探索支持其背后的维护者。ESM-2 自 2022 年发布以来每月仍有数十万次下载,这依赖有人持续维护底层软件。

  6. Ideogram(@ideogram_ai)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ideogram 发布 Ideogram 4.5 编辑模型

    Ideogram 发布 Ideogram 4.5,称其为最精确的编辑模型,可消除多轮编辑中的伪影累积,让多轮编辑成为可能。该模型已在 Ideogram、API 及合作方上线,开放权重即将发布。

9月30日周三
  1. Milvus(@milvusio)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Milvus 用 Jev 做检索结果判定:从向量召回到重排序的搜索模式

    Milvus 先用向量检索和元数据过滤召回候选段落,再由 Jev 判断这些段落是否真正有助于任务,形成「查询 → Milvus 检索 → Jev 判定 → 应用执行」的流程。

  2. clem 🤗(@ClementDelangue)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Hugging Face 获英伟达收购后扩招,Clem 称数千份 DM 需数日处理

    Hugging Face 被英伟达收购后正大规模招人,Clem 表示已收到数千份私信,因平台机器人无法自动分析 DM,需数日才能逐一处理。他称未获回复不代表否定,当前只聚焦 exceptional matches,并建议通过 apply.workable.com/huggingface 投递具体职位。

  3. 魔搭ModelScope社区AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    魔搭社区 AI+∞ 开发者创作大赛收官,六项 AI 影视获奖作品亮相云栖大会

    魔搭社区 AI+∞ 开发者创作大赛在云栖大会魔搭开发者专场颁奖,736 位创作者报名、共收到 252 个参赛作品,最终评出六项获奖作品。大赛由魔搭社区与 Qoder 主办,NVIDIA、赞奇科技赞助,聚焦 AI+ 影视流,作品均使用 Qoder credits、魔搭开发工具与开源模型,并基于 NVIDIA DGX Spark 开发。

  4. 甲子光年AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    影溯发布世界模型 InSpatio-World 1.5,支持多类输入并开放试用

    影溯科技发布并上线新一代世界模型 InSpatio-World 1.5,支持单图、多图、全景图和视频等不同输入,强化实时场景探索与时空一致性,并已开放试用与开源代码,同时即将邀测世界模拟器 Topos-Pro 1.0。

  5. orange.ai(@oran_ge)AI 评估 · 48/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 报告批评开源模型安全,被指借机推销闭源模型

    在 OpenAI 宣布企业套餐加入 GLM 5.3 等开源模型后,Anthropic 发布报告批评开源模型安全问题。报告称 GLM 5.3 是网络安全能力最强的开源模型、落后美国前沿模型约 4 个月,且是测试中唯一具备漏洞利用能力的模型,但可通过 abliteration 移除拒绝行为,单次成本约 4400 美元。

  6. ollama(@ollama)AI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ollama 上新 3 款模型:Nimble、Tev1 4b 与 Tev1 0.8b

    Ollama 上线 3 款可用于 /v1/systemone 的模型:Nimble、Tev1 4b 和 Tev1 0.8b,均已收录至 Ollama 模型库。其中 Tev1 提供 4b 与 0.8b 两个参数规模版本。