Perplexity 为 Computer 模型选择器推出 effort controls
Perplexity 在 Computer 的模型选择器中上线 effort controls,通过 effort presets 组合编排模型与推理深度,控制 Computer 处理任务的深入程度与效率。该功能已在网页端可用,移动端和桌面端即将推出。
Perplexity 在 Computer 的模型选择器中上线 effort controls,通过 effort presets 组合编排模型与推理深度,控制 Computer 处理任务的深入程度与效率。该功能已在网页端可用,移动端和桌面端即将推出。
Jina AI 推出基于 DeepSeek-OCR 后训练的 jina-ocr-v1,多语言支持扩展至 25 种,并针对 NVIDIA L4 等低预算 GPU 优化。该模型在 OmniDocBench v1.6 上得分 91.14,olmOCR-Bench 上得分 83.4,页面吞吐量在所有竞品中最高。
DHI Group 与 AWS 合作推出 Hackathon Acceleration Package(HAP),通过三天黑客松让 20 名参与者分 3 组构建原型,覆盖雇主分析、候选人匹配与 ClearanceJobs–AgileATS 集成三类用例。
Weaviate 1.39 推出 4-bit Rotational Quantization(RQ),在压缩向量内存占用的同时保持较强召回,并提升导入与搜索性能。
基于 Claudian 改造的版本新增了对 antigravity cli 的支持,并可通过 OpenCodex 接入 Codex,同时该 Claudian 插件已可安装到 Obsidian 中使用。原推未披露模型版本、参数或性能数据。
火山引擎日志服务 TLS AgentLoop 新增多模态内容展示能力,开发者可在 Session、Trace 和 Span 中直接查看图片,并与提示词、模型输出、工具结果对照排查。
Linkloud 第 44 期沙龙将于 2026 年 9 月 19 日下午在成都举办,主题是 Agent 如何从"能做"走向"能用"与"能卖"。
文心开发者丁康佳借百度搭子把一次情绪梳理体验做成可运行的小程序,灵感来自他用塔罗牌"测算"自家猫是否怀孕。百度搭子发布的Harness智能引擎在相关任务中任务完成率达99%以上,积分消耗降低30%,其内置安全沙箱在用户本地设备内隔离运行数据与操作。
2026年度CCF-百度松果基金申报将于9月20日23:59(北京时间)截止,该基金由CCF与百度于2020年共同发起,已累计支持170余项课题、产出超100项顶级成果。今年基金聚焦基础理论、分布式训练、推理部署、强化学习训练系统、模型结构与预训练、后训练与Agent、数据建设七大方向,计划支持8至13项,每项资助15万至25万元,课题周期为2026年10月至2027年10月。
腾讯云轻量云团队在多 Agent 开发工作流 DevFlow 中定位到,Token 消耗主要来自长上下文在多轮请求中被反复携带,而非代码本身;Developer 阶段上下文曾达到约 120K tokens。
RustFS 发布正式版,这个基于 Rust、兼容 S3 的对象存储系统开源首年已积累 3 万多 Star,全球安装实例超 270 万,70% 以上来自欧美。正式版新增 MinIO 丝滑切换,可直接读取 MinIO 数据盘完成迁移,并将 MinIO 商业版中约 80 万人民币/年的 S3 Table 功能免费开源,支持 Spark、Iceberg 读写表数据并已进入生产环境。
Vercel 在推文中指向 AI SDK 的文档页面 ai-sdk.dev/docs/ai-sdk-co…,并 @vercel 与 @vercel_dev 两个官方账号。该推文互动量为 0 条回复、1 次转发、9 个点赞、3174 次浏览,未披露具体功能或版本信息。
AI SDK 新增 𝚎𝚟𝚊𝚕𝚞𝚊𝚝𝚎 方法,用户可借此调用 typesafeai 的最新 Jev 模型。该消息由 AI SDK 官方账号发布,未披露 Jev 的版本号、参数规模或可用方式。
智能体 AI 工作流可用于为物理 AI 系统准备并验证数字孪生:智能体检查 3D 场景、在 OpenUSD 中编写仿真相关数据、添加物理属性、渲染预检视图,并按仿真就绪(SimReady)要求校验结果。该流程演示了从 Blender 中的场景到交付给 NVIDIA 的仿真就绪 OpenUSD 的完整过程。
Databricks 向约 3500 名工程师全量部署 Astra。Patrick Wendell 称,Astra 在高层系统设计等复杂任务上明显优于此前的 Opus 5、Sol 5.6,工程师整体编码支出较基线增加约 60%;但在中低复杂度编码任务上提升不明显,团队通过 Unity Gateway 为 Astra 设专项子预算,引导工程师只在复杂任务上使用。
Fireworks AI 上线微调 Quickstart 文档,地址为 docs.fireworks.ai/fine-tuning/tr…。该推文未披露更多模型、价格或参数细节。
GLM 5.3 现可在 Serverless Training API 上训练,与 Kimi K3、Qwen 3.8 27b 等模型并列;GLM 5.3 Flash 即将推出。官方称无需销售演示或私信沟通,可直接从文档或预制 recipe 上手(github.com/fw-ai/cookbook)。
Unsloth 在 X 上分享了全套免费资源,包含可直接在浏览器打开的 Google Colab 笔记本、GitHub 仓库和官方文档站链接。帖子未披露具体模型、参数量或性能数据,仅指向 unsloth.ai/docs/new/studi 页面。
NVIDIA 的 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升 6.4 倍。该基准针对 AI 智能体在车辆、机器人等边缘设备上的多步推理工作流,要求模型快速生成 token 并在不断增长的对话中持续推理。TensorRT Edge-LLM 面向此类边缘推理场景优化。
xAI 的 Grok Voice 已在 fal 上线,这是一款响应仅需 0.70 秒、能在句子说完前完成工具调用的语音模型。它支持带词级时间戳的转录、覆盖 25+ 种语言的 30+ 种音色的文本转语音,并可用两分钟音频完成声音克隆。开发者可借此在 fal 上构建低延迟语音智能体,用于解决真实客户问题。
长时运行的 AI 智能体面临上下文限制与信息丢失问题,一款新工具正帮助开发者优化记忆管理并削减 API 成本。高效的信息检索被视为生产级 AI 的关键技能。完整分析刊于 The Batch。
Mem0 现已上线 Vercel Marketplace,安装后可为 AI 智能体提供跨会话持久记忆。该集成会自动配置 Mem0 项目与 API key,费用计入 Vercel 账单,并提供免费套餐。开发者可通过 `vc i mem0` 命令安装。
Termany.sh 推出 Model Gateway 面板,为本地 AI 智能体提供统一的模型路由层,可在数秒内切换模型与提供商,无需手动修改智能体配置文件。
Bolt 推出可直接使用的网站模板,覆盖作品集、落地页、仪表盘和店铺等场景,均可在 Bolt 中自定义。用户打开模板、改成自己的内容后即可发布上线。
NVIDIA 展示用智能体 AI 把 CUDA Tile 运算从 Python 转译到 Rust。目标系统 cuTile Rust(cutile-rs)是一个基于 tile 的 GPU kernel 编写框架,将 Rust 的所有权模型扩展到 tile 级 kernel,把可变输出拆分为互不相交的分片,并在 kernel 启动间保持主机端所有权契约;开发者也可在需要底层控制时局部退出该约束。
Cohere 的 Model Vault 现已支持 NVIDIA 机密计算,并面向有限数量的 beta 客户开放早期访问,beta 名额有限。官方未披露具体模型、价格或性能数据,仅给出 cohere.com/solutions/mode… 的了解更多链接。
Cohere 的机密计算通过三种方式防止数据被追踪或使用:端到端加密推理、借助 NVIDIA 机密计算将硬件强制隔离延伸至 GPU,以及可随时申请签名认证令牌并对照硬件厂商公钥独立验证。数据控制权归用户所有。
LangChain 梳理了 Madrigal Pharmaceuticals、Abridge 和 Vizient 三家机构构建医疗与生命科学智能体的做法:Madrigal 搭建企业级多智能体平台,Abridge 将医患对话转为临床文档并贯穿临床工作流,Vizient 用 GenAI 平台让医疗机构查询此前孤立的数据。
mem0 发布 Gateway,聚焦 AI 智能体获得更多访问权限之后的长期管理问题。原文未披露具体功能参数、价格或可用性细节。
一家覆盖 100+ 国家、服务数亿听众的音乐流媒体平台用自托管 Milvus 搭建了音频与歌词的统一检索层,将 1 亿+曲目编码为数十亿向量,实现每秒数百次查询下约 10ms 的 P99 数据库检索延迟。该基础设施同时支撑歌曲识别、歌词搜索、推荐和版权匹配,支持播放短片段、哼唱旋律或输入模糊歌词等检索方式,并通过地域与版权过滤结合语义与全文搜索。
IntelliJ IDEA 2026.2 改进了 Logpoints,新增在任意两行可执行代码之间的 gutter 处点击即可输入日志表达式的方式,无需重建或重新部署即可修改日志。文章用一个 gRPC 客户端-服务器示例演示如何用 Logpoints 定位租户名未规范化导致折扣为 0 的 bug,并可在调试中直接验证修复效果。
Cohere 宣布与 Aleph Alpha 合作,共同满足全球对既强大又安全的前沿 AI 日益增长的需求。Cohere 称,任何政府或企业都不应在 AI 能力与对自身技术的控制权之间做取舍。
清华大学电子工程系博士、现苏黎世联邦理工学院博士后张托肯用 AI 在三天内从零设计了一颗 Attention 计算芯片并完成流片,过程记录在《三天从零到流片:AI 带我设计一颗 Attention 计算芯片》一文中。
清华博士、苏黎世联邦理工博士后张托肯用 AI 三天完成从零到流片的 Attention 计算芯片设计,并借真格「Token Grant」算力支持推进「芯片开卷」计划。
vivo IT 技术团队用 1 个编排器 dev-workflow 加多个单职责 Skill 组成 AI 协作流水线,把存量代码变更拆成增量流程 A 和存量流程 B,流程 B 依次执行影响面分析、处理原则提取、最小侵入分析、埋点与回归用例生成。
OpenViking 是字节跳动 Viking AI 搜索推出的 Agent 记忆中枢,可接入 Trae、Codex 等不同 Agent,把创作资料、写作偏好和复盘经验统一组织成 Resource、Memory、Skill 三类,并存入 viking:// 地址实现分层召回,减少重复读取的 Token 开销。
得物技术推动指标字典从0到1落地,用业务、数仓、产品三条线建立语义底座:存量报表逆向梳理、隐性指标先登记后转正,数仓消费收敛到域控宽表,并在提报环节拦截二义性。该语义层支撑 Text2SQL 与 AI Coding 两条消费主线,系统测评 SQL 准确率从 85%+ 提升到 95%+;OneData 建设全流程提效 40%+,核心模型开发阶段提效 70%+。
腾讯程序员 daisy 公开了一份用于约束 AI 编程模型的 AGENTS.md,把「本文件中的每一条规则都是强制性的」写进开头。规则禁止用 try-except 包 import、用 Git 回滚代码、读写 /tmp、主动使用视觉功能、以 mock 或 workaround 通过测试,也禁止「不是……而是……」句式和单字缩写。
AgentWork 开源社区发布《魔搭紫皮书》,共 8 篇 34 章、约 40 万字,面向想系统学习 AI 的读者。内容覆盖开源模型下载、无资源体验、用 ms-swift 做轻量微调、用 EvalScope 评测,以及 AI 健身教练、智能客服质检、语音助手、企业知识问答等场景,并含 Claude Code、Pi、DeepSeek Harness 的 Agent 篇。
termany.sh 支持查看每日 agent 使用情况,用户认为这一功能非常方便。