Amazon SageMaker Studio 可直接管理 HyperPod Spaces
Amazon SageMaker Studio 新增 HyperPod Spaces 管理能力,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 JupyterLab 或 Code Editor 环境,冷集群通常几分钟就绪,开启超配后约 30–40 秒。
Amazon SageMaker Studio 新增 HyperPod Spaces 管理能力,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 JupyterLab 或 Code Editor 环境,冷集群通常几分钟就绪,开启超配后约 30–40 秒。
Firecrawl 在 Alexandria 上线梦幻体育数据,让 ChatGPT 或 Claude 接入球员与球队数据、梦幻分析、新闻和赔率等数百万数据点。用户可通过 Firecrawl 插件用 100 倍于以往的研究量来构建阵容。
航空应用可借助 Amazon Nova Sonic 语音模型、Amazon Bedrock AgentCore 与 Bedrock Knowledge Bases 加上一层实时语音层,让旅客用说话完成改座位、查延误、更新餐食偏好。
Figma 宣布其智能体结束 beta 正式发布,并带来包括输出质量在内的多项改进。新版智能体在遵循指令和处理长时间运行任务上表现更好,在由专业设计师参与的人工评分评测中胜出比例超过 60%。
Simon Willison 让 Opus 5.5「写一些电脑游戏音乐」,结果远超预期,他因此发问模型是从什么时候开始能创作出像样的音乐。这条帖子获得 133 条回复、310 个点赞和 38064 次浏览。
elvis 回应 @pidotdev 称该版本引发大量关注,此后已加入不少内容,包括用于测试多种主动能力的连接器,并小幅改进了记忆。更多更新即将发布。
向阳乔木开发了一款 Obsidian 插件 qiaomu-ui-learn,用于学习网页和手机组件以提升 Vibe Coding 审美,让描述更精准,并支持一键复制 Prompt 生成类似网站,还准备了测试题。插件即将提交官方审核,明天可在 Obsidian 官方插件库搜索 qiaomu 找到。
OpenRouter 宣布可在 Playground 直接试用 Clef Flash,并给出了该模型在 OpenRouter 上的页面链接。原文未披露模型参数、上下文长度或 benchmark 数据。
OpenRouter 建议用 Compare 页面比较 Clef、Jev 及另外 10 个决策模型的功能与用量。该条提示未披露各模型的具体参数、价格或可用性信息。
Perplexity Decider 在一项对标测试中被评为最佳决策模型,测试让 8 款决策模型对战俄罗斯方块,Decider 成绩始终位居榜首。该测试由 Alok Bishoyi 分享,并可在 app.routerplus.com 的 playground 中体验。
The Rundown AI 分享了一篇文章链接,指向 tech.therundown.ai 上关于某项 AI 突破性进展的报道。原文未提供更多具体信息。
犹他州现已允许 AI 开具痤疮药物处方;Neurable 发布可追踪专注度的耳机;Fitbit Edge 的泄露信息显示其是一款更智能的健身手环。此外,科学家研发出一种在火星上建造(建筑)的新方法。
andrew chen 在 X 上分享了其 Substack 写作链接 andrewchen.substack.com,该帖获得 5 个点赞、2340 次浏览。
Google DeepMind 的 Janie Gu 与 LinqAlpha 的 Chanyeol Choi、Jack Haverty、Suyeol Yun 对谈,主题为前沿模型为何在十亿美元级投资组合上失败。该场分享定于 10 月 13 日在 AI Engineer New York 举行。
Google Research 与 Google Health 发布研究,展示 Google Earth AI 结合卫星影像、移动性数据与基础模型(AlphaEarth Foundations、Population Dynamics Foundation Model),并配合 Geospatial Reasoning 智能体原型,帮助公共卫生机构预测疾病暴发。
NVIDIA 推出 Green Contexts,用于控制单个进程内多个并发 GPU 组件之间的资源分配,例如延迟敏感的算子与吞吐型后台 kernel、数据预处理与模型推理。该机制面向多阶段工作流共用一块 GPU 的场景,解决 GPU 资源共享难以控制的问题。
LangChain 为 Managed Deep Agents 免费加入了网页搜索能力,由 @p0 提供支持,无需单独注册供应商账号、管理额外的 API key 或自行接入搜索工具。官方同时放出了 @ndrezn 的简短演示。
Mistral 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态、49B 激活参数,官方称其是美国或欧洲聚合基准上最好的开源权重模型。
Kling AI 展示创作者使用 Kling 4.0 和 Kling 4.0 Flash 制作的作品,主打新想象、新故事与新创作方式。官方同步放出演示视频,并附上 X(Twitter)原帖链接。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,49B 激活。官方称其在美国或欧洲开源权重模型中聚合基准表现最佳,在网络安全、制造和金融等关键负载上达到 SOTA,并在视觉 grounding 上超过闭源前沿模型。该模型由欧洲端到端打造,可通过 Mistral Cloud 部署,即日起开放 API,开放权重版本将于 10 月底发布。
a16z 介绍新公司 Armadin Security,用 AI 智能体从外部主动攻击企业网络,在犯罪分子之前找出可利用的零日漏洞,并最终实现自主修复。公司自 1 月以来已在财富 500 强企业中发现 90+ 个零日漏洞。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态、49B 激活,号称是美欧聚合基准上最好的开放权重模型。该模型在网络防御、制造和金融等关键负载达到 SOTA,视觉 grounding 超过闭源前沿模型,端到端在欧洲锻造并可通过 Mistral Cloud 从欧洲部署,今日起 API 全面可用,开放权重将于十月底发布。
Mistral Large 4 以 1T 参数、49B 激活的开放权重形态发布,可对照其与闭源前沿模型的基准位置。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、49B 激活、原生多模态。官方称其在聚合基准上是美国或欧洲最好的开放权重模型,在网络防御、制造和金融等关键负载上达到 SOTA,视觉接地表现超过闭源前沿模型。
Mistral Large 4 的参数规模、多模态能力与开放权重时间表一并给出,可据此判断欧洲开源模型的竞争位置。
OpenRouter 在平台上架模型 mistralai/mistral-large-4-0,用户可通过 OpenRouter 的统一接口调用该模型,具体能力参数原文未给出。
Mistral Large 4 已在 OpenRouter 上线公开预览,参数量 1T、激活 49B,原生多模态,支持 1M 上下文与最高 256K 输出。前两周价格五折,每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。
Anthropic 发布报告称 GLM-5.3 可作攻击性网络工具,Nathan Lambert 认为这类讨论回避了"禁用开源模型会怎样"等关键问题。他指出,迄今已记录的多数网络攻击由闭源模型导致,若因网络风险禁用开源权重模型,或许也应禁止前沿闭源模型的公开 API。
Mistral 现可在 Battle Mode 和 Agent Mode 中测试,入口为 arena.ai。
Mistral AI 的 Mistral Large 4(代号 Le Chonk)已上线 Arena,可在 Agent Arena 中实测,投票将影响其评估,分数稍后公布。
Mistral 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态、49B 激活参数,已在 API 上线,开放权重将于 10 月底发布。
原文列出 Mistral Large 4 在多类工作负载上的对照数字,读者可据此判断开源权重模型的竞争位置。
Figma 今日上线一项新功能,官方发布推文并附带 figma.bot 链接,但未在推文中说明具体功能名称或版本细节。该推文获得 42 次点赞、4 次转发和超 3.5 万次浏览。
Mustafa Suleyman 在 x.com 发布了一篇文章,链接为 x.com/i/article/2107…。该帖获得 208 条回复、315 次转发、1797 次点赞和 527670 次浏览。
DAIR.AI 打造了一套完整的交互式教程,并配有后续动手实战实验室,供用户深入学习。教程资源发布在 academy.dair.ai,正文未披露涉及的具体模型或主题。
Mistral AI 在推文中放出新进展链接,指向 mistral.ai/news 的官方公告页面,但推文未披露模型名称、版本号或参数等具体信息。该推文获 1372 点赞、60 次转发、26 条回复。
Jev-as-a-Judge 通过一致性提升 LLM judge 的可靠性,适合用作评判器、验证器和持续监控。该用例被评价为 Jev 最亮眼的应用之一,作者长期从事 agent evals、judges 和 verifiers 相关工作。
该帖仅包含一条被截断的 x.com 文章链接及互动数据(27 条评论、64 次转发、438 次点赞、90649 次浏览、199 次收藏),未提供任何可核实的 AI 模型、产品或技术信息,无法据此撰写摘要。
一位写了近十年代码的程序员在 AI 写代码、招聘卡 35 岁、大厂裁员的夹击下翻检古籍,把被时代冲击的人归纳为三种结局:卢德分子砸织机、《机动车法案》用红旗拦汽车,两拨人最终都失败;镖局倒闭后镖师转型当警察教官、富商护卫,VisiCalc 问世后记账员变成看数据的人;蒲松龄 71 岁才得贡生功名却写出《聊斋志异》,王阳明 34 岁被贬龙场后开创心学。
Figma agent 已结束 beta 测试正式上线,官方以 "Find your flow(state)" 作为发布主题。该消息由 Figma 官方账号发布,推文获得 167 条回复、1567 次点赞和超 140 万次浏览。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,激活参数 49B。官方称其在聚合基准上是美国或欧洲最好的开放权重模型,在视觉定位上超过闭源前沿模型,并在网络防御、制造和金融等关键负载上达到 SOTA。该模型已在 Mistral Cloud 上端到端于欧洲构建并可部署,即日起通过 API 向所有用户开放,开放权重计划于 10 月底发布。
OpenRouter 在平台上架了 mistralai/mistral-large-4-0 模型,可通过 openrouter.ai/mistralai/mistral-large-4-0 页面访问。原文未披露该模型的具体能力、参数或定价信息。
Mistral Large 4 已在 OpenRouter 开启公测,采用 1T 参数(激活 49B),原生多模态,支持 512K 上下文与最高 256K 输出。前两周五折,价格为每 1M tokens 输入 $0.68、输出 $2.09,缓存输入 $0.07。