Qdrant 实测 Jev:把通用分类器用在重排序、去重等任务上
TypeSafe 推出的决策模型 Jev 经由 OpenRouter 提供服务,无需任务特定训练即可输出受限于候选标签的数值分数。
TypeSafe 推出的决策模型 Jev 经由 OpenRouter 提供服务,无需任务特定训练即可输出受限于候选标签的数值分数。
开源本地推理引擎 Strata 主打在消费级电脑上运行 1250 亿参数的 Qwen3.8-Flash-Next 量化版,通过量化、GPU 专家缓存和 CPU/GPU 协同推理降低显存门槛,RTX 5070(12 GB 显存)下 Q2_0 量化版短对话生成速度约 94 tokens/s。
Perplexity 将两款模型发布到 Hugging Face,并给出了对应的模型集合链接。原文未披露模型名称、参数规模或具体能力信息。
ArtCraft 用 Rust 重写了一套对标 Adobe 的开源应用,全部 MIT 开源、不收集使用数据,提供原生桌面 app(不套 Electron)以及 CLI 和 MCP。
花叔把自己做艺术动画的方法整理成开源 skill huashu-art-motion,面向 Claude Code 这类 coding agent,用代码画出不同艺术风格场景并让角色和画面动起来,也能把口播配成白板、Vox、3b1b 等风格解说动画。
OpenAI 发布一批由内部前沿模型产出的新数学结果,相关代码与内容放在 github.com/openai/math。OpenAI 表示在发布过程中咨询了 Institute for Advanced Study 的数学与人工智能独立顾问组,并参考其建议与公开推荐来确定发布方式。
Fireworks 的 AI 开发者教育负责人用纯 SFT、公开数据集和两个简单技巧,在 Fireworks 上微调出一个 9B Jev-style 决策分类器,无需前沿实验室级别的预算。完整训练配方已开源,可自行训练同类模型。
GitHub 推出开源基准 ReviewBench,用于评测 AI 代码审查工具能否发现真正重要的问题而不引入噪音。该基准基于对 1.039 亿个 GitHub pull request 的分析构建,包含横跨 19 种语言的 219 个 PR,支持开发者自带代码审查智能体进行评测并提交结果。
Perplexity 在 Hugging Face Decision Index(决策模型基准)上排名第一。该模型采用开放权重,所有人均可访问。
Hugging Face 上出现了 Mistral 的新模型页面 "Le fat chaton"。该推文附带 huggingface.co/mistralai 的模型链接,发布后获得 50 条回复、69 次转发和 1091 个点赞。
Tw93 为日常使用的工程师合集技能 Waza 新增了一套操作与回复规则,来源是起初用于航空维修文档的简化技术英文标准 ASD-STE00,他是在看到 Andrej Karpathy 的推荐后顺着规范与官方 AI 白皮书整理的。
乔木剪藏插件新增「转写学习」,在原有 B 站、YouTube、小宇宙之外支持 TikTok 和 TED 在线转写字幕显示。按三个 A 可进入沉浸式学习状态,左侧视频、右侧字幕,并能打开 AI 对话提问,插件已在 GitHub 开源。
Hugging Face 的 Clement Delangue 介绍,团队在不改动 harness 和训练代码的前提下,把 Claude Code、Codex。
开源项目 icon-marquee 提供用 TypeScript、Bun 和 Hono 编写的 HTTP API,可将技术栈图标渲染为 SVG 返回,用于 README、作品集和网页的动态图标跑马灯。接口 /v1/marquee 输出无缝循环滚动的动画横幅,/v1/icons 输出静态一行。
本地优先的 Excel / CSV / TSV 数据质量工具 Precis 通过 MCP 暴露 validate_data、check_config、describe_constraints、infer_schema 四个工具,让 AI 助手负责解释需求、生成规则草稿和触发校验,确定性规则执行仍落在本地引擎。
Browser Use 已随 browser use pi 发布 JavaScript 版本,回应了社区长期以来的需求。官方在推文中表示,很多人询问 JS 版的浏览器使用方案,现已正式提供,项目地址为 github.com/browser-use/br…
PowerTokens/video-studio 是一款面向 Windows 的 Wan 3.0 视频批量生成工具,支持 Excel/CSV 导入镜头表、任务 ID 恢复、断点下载、Key 池、CLI 与 MCP,采用 MIT License,主要代码为 Python,截至 2026 年 10 月 1 日仓库约 1 Star。
向阳乔木(@vista8)分享了一个 GitHub 开源地址 github.com/joeseesun/qiao,由 joeseesun 发布。该推文获得 14 次点赞、2 次转发、3071 次浏览。
作者为自己的 Chrome 插件「乔木剪藏」新增视频阅读模式,在带字幕的 YouTube 和 B 站视频页面连按三次 A,即可播放器与文稿同屏阅读。该模式支持英文原文下显示中文译文、点击字幕时间戳跳回对应片段、划线直接问 AI,并接入 Obsidian 做视频笔记。项目已开源,GitHub 搜「qiaomu-clipper」。
Aleph Alpha 发布 Kolibri,参数规模 78B、激活参数 3.46B,上下文最高支持 1M tokens,权重以 Apache 2.0 许可开放,可在自有硬件上运行。Cohere 转发该消息并称其表现不错,同时预告双方将合作推出新成果。
DepthART 将单目深度基础模型压缩到 6.0M 参数:用抗偏置数据采样从约 4400 万张候选图像筛出约 170 万张均衡数据,再以 Depth Anything V2-L 伪深度蒸馏到 TinyViM+DPT。
面向 macOS 用户的 RIME 中文输入法工具,用可视化设置界面替代手写 yaml 配置,并在用户主动触发时调用 AI 完成翻译和润色。项目已在 GitHub 开源(zoolapp/aime)。
Connany 为任意 AI 智能体提供 25 个连接器,覆盖 Notion、GitHub、Linear、Stripe 等,并支持统一 OAuth。创建项目后获取 API key 即可启用连接器,5 分钟就能接入智能体,终端用户一键完成授权。该工具免费、开源且可自托管。
Muse 推出开源 Linux SDK「Muse Gadgets」,开发者可将 ESP32 设备与 Muse 连接,获取 Muse 相关信息并自行构建 Muse 周边硬件,无需等待官方刚发布的 Muse 硬件。
南京工业大学适配的校园 Agent 项目 CourseRaptor 把课表、成绩、考试、通知、待办、文档生成和日历订阅拆成 31 个可调用工具,终端 TUI、本地 Web UI(127.0.0.1:3210)、QQ 机器人和无头 CLI 共用同一个 ToolLoopAgent 内核。
NVIDIA 的 Nemotron 3 Diarization 模型在 HuggingFace 上线后登上热门榜。该模型支持最多 8 位说话人的语音分离,可在声音重叠时追踪谁在何时说话,参数量为 100M。团队在评论区回应了用户提问。
muse.ai 团队发布 Muse Gadgets,这是一套开源 ESP32 固件与 Linux SDK,开发者可据此制作与 Muse 配合使用的硬件设备。用户可从 gadgets.muse.ai 获取 API token,并让常用的 coding agent 指向 GitHub 仓库,自行构建 Muse 外设。Nat Friedman 将其称为 side project。
xAI 已在 GitHub(xai-org/xai-sd)和 npm(@xai-o…)发布 xai-sd,目前处于早期阶段,官方表示会持续迭代并征集用户反馈。
向阳乔木(@vista8)为其开源项目 qiao 补充了一支 AI 生成的宣传片,项目代码托管在 github.com/joeseesun/qiao。该推文附带的宣传片需在支持 video 标签的浏览器中查看,原帖获得 9 次点赞、1 次转发和 2005 次浏览。
基于 Obsidian 官方剪藏插件魔改的 AI 加强版上线,新增 AI 对话、Markdown 编辑预览功能,按快捷键可对网页去广告并切换沉浸阅读模式,还提供中文字体设置,并会自动提交到乔木 RSS 阅读器。项目已开源,地址见评论区。
Milvus 3.0 推出 StructArray Hybrid Search 演示,可在视频级别理解"路口"场景,同时在嵌套子记录中定位"白色卡车"等具体对象,并将两级信号合并为一个排序结果。StructArray 将父记录与其子元素保存在一起,嵌套元素内的向量仍可直接检索,减少数据建模复杂度并保留更多上下文。该模式适用于多模态数据集、含章节的文档以及带变体的商品等父子结构数据。
一个名为 e2e 的测试框架在 GitHub 开源(github.com/tester-army/e2e),支持在测试用例中把自然语言驱动和传统断言混写,例如 agent.act('upgrade the workspace to the Pro plan')。
Snapok 是一款 AI 原生截图应用,免费且开源,除常规截图工具外还提供背景、内边距、边框美化,自动打码敏感信息,截图历史,OCR 提取任意截图文字,保留排版的翻译,以及针对任意截图向 AI 提问。该应用由 xgo.ing 提供支持。
GitHub 上出现名为 amywork777/lip 的项目仓库,相关推文附带了该仓库链接,但未披露项目功能、模型版本或技术细节。该推文互动量极低,仅有 7 次点赞和 2912 次浏览。
一款开源唇语输入法可让用户按住按钮、只动嘴不出声,由摄像头读取嘴型直接把文字打出来,解决在咖啡馆等公共场合用语音输入自言自语的尴尬。该项目已开源。
辞达是一款 macOS 菜单栏应用,在任何应用中选中文字后按 ⌥A 即可弹出面板,调用自选大模型流式输出译文,无需切换窗口。按 Tab 再回车可切换为润色,并保持原语言。
Browser Use 在 X 上分享了一个指向 github.com/browser-use/be… 的链接。该推文互动数据为 0 条回复、0 次转发、1 次点赞、1186 次浏览。
Cloudflare 开源了首批自研决策模型 clef 和 clef-flash,两者已在 Cloudflare Workers AI 上线。Harrison Chase 评论称,此前就有人预言决策模型领域会迎来更多入局者,如今连开放权重也出现了,并称 harness 应该能像替换主模型一样轻松替换决策模型。
HeyGen 9 月面向开发者推出三款工具:基于 OpenAI GPT-Live-1 的开源实时数字人栈、与 Kaggle 合作的 Code2Video 基准(用于衡量 AI 生成视频质量),以及面向 API 的专业语音克隆。
Cloudflare 的 workers ai 团队发布首个自研模型系列 clef,包含两个快速、准确的决策模型,在质量与延迟基准上登顶。模型已开源,权重可在 Hugging Face 获取(Cloudflare/clef),也可直接使用 workers ai 的托管版本。