歸藏开源运动数据分析与分享 Skill guizang-sports-skill
歸藏开源了一个名为 guizang-sports-skill 的运动分析 Skill,支持骑行、跑步和徒步,把码表或运动 App 导出的 FIT / KML 文件交给 Codex、Claude Code 等 Agent,即可输出运动判断、行动建议并打开本地 3D 路线报告。
歸藏开源了一个名为 guizang-sports-skill 的运动分析 Skill,支持骑行、跑步和徒步,把码表或运动 App 导出的 FIT / KML 文件交给 Codex、Claude Code 等 Agent,即可输出运动判断、行动建议并打开本地 3D 路线报告。
Firecrawl 星标数突破 162,000,成为 GitHub 历史上星标最多的前 50 个仓库之一。官方将增长归因于 AI 智能体对网页上下文抓取的旺盛需求,并表示这只是开始。
HermesOffice 已发布,这是一款开源办公套件,覆盖 Word、Sheets、Slides 和 PDF,其 AI 以真正的智能体形式 100% 在本地机器上运行,无需云账号和第三方代理。该套件基于 Apache-2.0 许可的 GenOffice 引擎 fork 并更名,负责编辑文档的助手同时掌握用户的文件、记忆和工具。
Google DeepMind 在 Nature 发表论文并开源 WeatherNext 2 和 WeatherNext Cyclones 模型,称其在预测气旋路径、强度和风场结构上达到 SOTA。
Google DeepMind 公开气象模型权重与代码,并说明其预报精度提升大致相当于十年气象学进展。
Genspark 的 GenOffice 新增 Linux 平台支持,项目已在 GitHub 开源。
Mistral 的 Shieldstral 现以 Apache 2.0 许可开放,可在 Hugging Face 上获取并使用。该模型由 Mistral AI 发布,官方同时给出了试用链接。
Microsoft Research 推出开源框架 Orchard,供研究社区跨任务类型训练和评估 AI 智能体,通过复用同一套基础设施降低复杂度,并帮助较小模型保持强劲表现。
Microsoft Research 推出开源框架 Orchard,供研究社区跨任务类型训练和评估 AI 智能体。该框架通过让研究者复用同一套基础设施,在降低复杂度的同时让小模型也能保持强劲性能。
LlamaIndex 的 LiteParse 现已能直接从 PDF 中提取结构化数据,包括表单字段值、复选框状态、注释、嵌入图片、矢量图形、标记文档结构和词级边界框,每页耗时毫秒级。对于确需模型处理的页面,新增的复杂度信号(扫描页、多栏文本、有无框线表格、密集图形)可说明原因,帮助用户将解析路由到 LlamaParse 等更合适的工具。
Firecrawl 开源了 PDF 解析引擎 pdf-inspector,为其 /parse 提供解析能力,并搭配自研 OCR 模型,官方称每页处理耗时 0.002 秒。
腾讯混元 Hy-MT2 自 5 月开源以来累计下载量超 70 万,其中 Hy-MT2-1.8B 登顶 Hugging Face trending,30B-A3B 位列第 4。
Qdrant 发布 FastEmbed,一个专注文本嵌入向量生成的 Python 库,默认加载 BAAI/bge-small-en-v1.5 模型,输出 384 维向量,最大上下文 512 tokens。
腾讯开源 AngelSpec 端到端投机解码框架,同时支持训练与部署。在 Hy3-A21B 上,DFly 在 4 至 64 的并发测试区间实现 1.98–2.40× 端到端加速,吞吐量较 DFlash 高 10.5–11.8%。训练代码与 Hy3-A21B MTP/DFly drafter 权重已发布于 GitHub、Hugging Face 和 ModelScope。
Berkeley Sky Lab 与 IBM Research 将演化式内核搜索框架 K-Search 扩展到 MLX 后端,通过结构化 CUDA-to-MLX 翻译层把现有 CUDA 内核知识适配成 Apple Silicon 内核。
李飞飞介绍的 R2S2R 中 Real-to-Sim 环节,可把物理机器人、传感器、环境、物体及交互转化为仿真,同时保留与任务相关的观测和动力学——不只是世界的外观,还有机器人交互时它的行为方式。该结果在机器人操作领域的 sim-real 对齐上树立了新标准。
HelloGitHub 第 124 期收录 32 个开源项目,涵盖 C、C#、C++、Go、Java、JavaScript、Python、Rust、Swift 及 AI 等分类。
LlamaIndex 发布 create-llama-worker,可快速脚手架生成一个 Cloudflare Worker,并配置用于 Parse、Classify 和 Extract。用户通过 `npm create @llamaindex` 生成、配置后即可部署,无需样板代码和繁琐设置。
开源项目 pireel/pireel 是一款纯前端运行的口播视频(Talking-head)AI 编辑器,草稿与素材仅存本地浏览器(OPFS/localStorage),通过 WebCodecs 直接导出视频。
开源项目 opencodex 发布,作为通用 LLM 代理中间件,让 Codex(CLI、App、SDK)和 Claude Code 用户自由使用 Anthropic Claude、Google Gemini、xAI Grok、DeepSeek、Ollama 等任意大语言模型。
Qdrant 用 580 万条真实 Amazon 服饰商品搭建了 Qdrant Shopping 演示店铺,每次文本搜索都是对 Query API 的单次请求,约 40 毫秒返回排序货架,代码已开源于 GitHub。
Meta 开源的 Segment Anything Model 3(SAM 3)和 DINOv3 被用于美国能源部 Genesis Mission 旗舰项目 SYNAPS-I,将 X 射线与中子科学图像分割从每数据集数周缩短到约 15 分钟。
Codex Dream Skin 是一个专为 Codex 桌面端设计的开源第三方换肤工具,通过本机回环 CDP 注入实现动态主题,无需修改官方安装包或签名。用户可自定义背景图与配色,侧边栏、输入框等仍为原生控件。工具提供一键还原脚本,支持 macOS 与 Windows,且不改动 API Key、Base URL 等配置。
腾讯混元发布旗舰级 295B 模型 Hy3 的 1-bit 与 4-bit 版本,可在单 GPU 上部署。该模型支持通过 llama.cpp 运行并开启 MTP,在更低硬件门槛下获得强大智能,相关 benchmark 与下载链接已放出。
shadcn 开源了 @shadcn/helpers,一个面向组件开发与测试的轻量工具包。首个功能 createChat 支持 AI SDK 和 TanStack AI,可脚本化用户与助手的对话并经由 useChat 运行,让组件接收框架真实流式生命周期中的原生消息。
Firecrawl 在 GitHub 上的星标数突破 150,000,官方称其已成为全球排名第一的网页搜索、抓取和交互仓库。团队向所有贡献者、开发者以及基于其构建的智能体致谢。
推主发布 openmemory v2,一个开源 CLI,可把编码会话在 Codex、Claude Code 和 OpenCode 之间迁移。推主同时提到 GPT-5.6 正陆续在 Codex 中推出,并引用 OpenAI 消息称 GPT-5.6 系列模型 Sol、Terra 和 Luna 正开始在 ChatGPT、Codex 和 API 中陆续上线。
B站大语言模型团队将在 ACL 2026 展示 FATE 系列成果 SABER 与 CASTER,并现场开放「B-UP 顶尖技术人才项目」校招与实习岗位投递。SABER 提出可切换、受 Token 预算约束的混合思考训练范式,实验显示 FastThink 模式在 MATH、GSM8K、MBPP 及逻辑推理任务上推理长度减少 65%~80% 同时保持甚至提升准确率。
Modal Research 与 NYU Shanghai HeavyBall Research 提出多 token 残差预测(MRP),用一个 3 层小模块预测相邻去噪步之间的 logit 残差,让冻结的扩散语言模型骨干一次前向解码多个 token。
OpenJarvis 入选 Laude Institute 的 Slingshots // THREE 计划,这是一个本地优先的开源个人 AI 框架,智能体默认在设备端运行,仅在任务确有需要时才调用云端,并把能耗、成本和延迟列为一等指标。它由 Jon Saad-Falcon 与 Stanford AI Lab 的 HazyResearch 等合作者共同推进,主张 LM 推理的未来在数据中心之外。
通义实验室开源 Qwen-AgentWorld,称其为首个原生语言世界模型,覆盖 MCP、Search、Terminal、SWE、Web、OS、Android 七大领域,基于超 1000 万条真实交互轨迹经 CPT、SFT、RL 三阶段训练。
Weaviate 在 Playground 上线了报纸主题演示 Weaviate Chronicles,把每 2 小时涌入的新闻标题自动聚类成同一事件。该演示先将报道嵌入为向量,再结合混合语义搜索、字符 n-gram 相似度和 Leiden 社区检测(一种图算法)完成聚类,并附带可复制提示词让用户搭建自己的版本。Weaviate Cloud 同时推出免费永久套餐。
Job Search Terminal 是一款免费、本地优先的求职仪表盘,数据存在本机,不设账号、云端数据库和订阅,用户自带 API key 并自行审核 AI 输出。
Google 将模型权重以 Apache 2.0 协议发布在 Hugging Face 上,并附上官方博客链接供了解详情。原文未说明具体模型名称、参数规模与能力范围。
通义实验室与 Efflora 团队基于 Qwen3.7-Max 做了一场实验,仅给一份约 15 万字的产品调研文档,就在隔离环境中从 0 交付移动端和 Web 端两套可运行应用,单端约 4 个多小时全自动完成。
Ideogram 宣布其仓库中已包含 fp8 和 nf4 两种检查点,其中 nf4 版本可在单张 24 GB GPU 上运行。相关资源已发布在 Hugging Face、GitHub 及其官方博客上。
Redis 作者用 C 语言为 DeepSeek-V4-Flash 打造了本地推理引擎 ds4,支持 Metal、CUDA 加速、2-bit 量化和 HTTP API,并非简单的 GGUF 运行工具。
SentinelOne 拆解出一个约 20 年前、比 Stuxnet 更早的病毒 fast16.sys,它专门篡改 LS-DYNA 970、PKPM、MOHID 等高精度工程与仿真软件的计算结果。
Jina AI 发布 jina-embeddings-v5-omni 全模态向量模型,在 v5-text 文本能力基础上扩展到图像、音频、视频和 PDF,文本向量与 v5-text 逐字节一致,现有索引无需重建。
HelloGitHub 第 121 期收录多个 AI 相关开源项目,包括为 Claude Code、Cursor 注入 Office 文件操作技能的 OfficeCLI,监控 Claude Code、Codex CLI 等 Agent 的 token 用量与上下文窗口的命令行工具 abtop,以及在一键切换 API 节点、自动故障转移的 cc-switch。
mem0ai 发布 mem0 CLI,让智能体在终端中完成记忆的添加、搜索与检索,并可记住智能体和开发者的偏好。该工具主打 agent-first、由 JSON schema 驱动,已开源,可通过 npm install -g @mem0/cli 安装使用。