Mistral 发布 Mistral Large 4 模型,1T 参数、49B 激活
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,49B 激活。官方称其在美国或欧洲开源权重模型中聚合基准表现最佳,在网络安全、制造和金融等关键负载上达到 SOTA,并在视觉 grounding 上超过闭源前沿模型。该模型由欧洲端到端打造,可通过 Mistral Cloud 部署,即日起开放 API,开放权重版本将于 10 月底发布。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,49B 激活。官方称其在美国或欧洲开源权重模型中聚合基准表现最佳,在网络安全、制造和金融等关键负载上达到 SOTA,并在视觉 grounding 上超过闭源前沿模型。该模型由欧洲端到端打造,可通过 Mistral Cloud 部署,即日起开放 API,开放权重版本将于 10 月底发布。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态、49B 激活,号称是美欧聚合基准上最好的开放权重模型。该模型在网络防御、制造和金融等关键负载达到 SOTA,视觉 grounding 超过闭源前沿模型,端到端在欧洲锻造并可通过 Mistral Cloud 从欧洲部署,今日起 API 全面可用,开放权重将于十月底发布。
Mistral Large 4 以 1T 参数、49B 激活的开放权重形态发布,可对照其与闭源前沿模型的基准位置。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、49B 激活、原生多模态。官方称其在聚合基准上是美国或欧洲最好的开放权重模型,在网络防御、制造和金融等关键负载上达到 SOTA,视觉接地表现超过闭源前沿模型。
Mistral Large 4 的参数规模、多模态能力与开放权重时间表一并给出,可据此判断欧洲开源模型的竞争位置。
OpenRouter 在平台上架模型 mistralai/mistral-large-4-0,用户可通过 OpenRouter 的统一接口调用该模型,具体能力参数原文未给出。
Mistral Large 4 已在 OpenRouter 上线公开预览,参数量 1T、激活 49B,原生多模态,支持 1M 上下文与最高 256K 输出。前两周价格五折,每 1M tokens 输入 $0.68、输出 $2.09,缓存 $0.07。
Mistral AI 的 Mistral Large 4(代号 Le Chonk)已上线 Arena,可在 Agent Arena 中实测,投票将影响其评估,分数稍后公布。
Mistral 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态、49B 激活参数,已在 API 上线,开放权重将于 10 月底发布。
原文列出 Mistral Large 4 在多类工作负载上的对照数字,读者可据此判断开源权重模型的竞争位置。
Mistral AI 发推引导用户前往 mistral.ai/news/mistral-l… 阅读最新公告,推文附带链接获得 1373 点赞、60 次转发和 287855 次浏览。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,激活参数 49B。官方称其在聚合基准上是美国或欧洲最好的开放权重模型,在视觉定位上超过闭源前沿模型,并在网络防御、制造和金融等关键负载上达到 SOTA。该模型已在 Mistral Cloud 上端到端于欧洲构建并可部署,即日起通过 API 向所有用户开放,开放权重计划于 10 月底发布。
OpenRouter 在平台上架了 mistralai/mistral-large-4-0 模型,可通过 openrouter.ai/mistralai/mistral-large-4-0 页面访问。原文未披露该模型的具体能力、参数或定价信息。
Mistral Large 4 已在 OpenRouter 开启公测,采用 1T 参数(激活 49B),原生多模态,支持 512K 上下文与最高 256K 输出。前两周五折,价格为每 1M tokens 输入 $0.68、输出 $2.09,缓存输入 $0.07。
Hugging Face 上出现了 Mistral 的新模型页面 "Le fat chaton"。该推文附带 huggingface.co/mistralai 的模型链接,发布后获得 50 条回复、69 次转发和 1091 个点赞。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),1T 参数、原生多模态,49B 激活,官方称其在美国或欧洲的开放权重模型中聚合基准表现最好,并在网络防御、制造和金融等关键负载上达到 SOTA,视觉 grounding 超过闭源前沿模型。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),为原生多模态模型,1T 参数、49B 激活,在自有算力上完成训练与推理。官方称其在聚合基准上是欧美最佳开放权重模型,在网络安全、制造和金融等关键负载上达到 SOTA,并在视觉 grounding 上超过闭源前沿模型。模型即日起通过 API 开放,开源权重将于 10 月底发布。
材料给出 Mistral Large 4 的参数量、开源权重与部署条件,可据此了解欧洲自研算力路线的模型能力边界。
Mistral AI 发布 Mistral Large 4(代号 Le Chonk),参数规模 1T、激活 49B,原生支持多模态,按聚合基准是欧美最好的开放权重模型。
英伟达投资的 Reflection 发布首个开源模型 Beam,官方称其在高级推理测试上与智谱 GLM-5.2 分数相当,推理算力只需后者的三分之一到四分之一。
OpenAI 在 28 天计划 Day 1 宣布 Astra 和 GPT-6.1 Sol 默认速度提升约 50%,当天并未重置使用额度。
flow-1 是用 RL 训练的新模型,用于在 agent trace 中查找错误,其 trace intelligence 与 GPT-6-sol 相当,但成本低 23 倍,运行成本也比 GPT-6-luna 低 25%。它让监控和理解每一次 agent 运行、且无需采样成为可能。
Google 的 Nano Banana 2.1 已在 AI Gateway 上线,模型标识为 google/gemini-nano-banana-2.1。相比早期 Nano Banana 模型,它改进了图像生成与编辑,支持产品场景重构、基于遮罩和墨迹的编辑,并提升事实准确性,可呈现逼真肤色、细腻材质、锐利光照和连贯背景,同时保持 Flash 级延迟与成本。
Reflection 预告其首个西方开源模型 Beam,采用 MoE 架构,总参数 501B、激活参数 23B,推理效率比 GLM 5.2 高 3–4 倍,官方称以 GLM 5.2 三分之一到四分之一的推理成本达到相当能力水平。
Reflection 推出 Beam,一个总参数 501B、激活 23B 的高效智能体开放模型,主打前沿推理效率,并在编码与智能体任务上推进西方开源前沿,从零端到端训练。完整权重将于本月发布,详情见 reflection.ai/beam。
Reflection 发布首款模型 Beam,一款面向智能体的高效开源权重模型,总参数 501B、激活参数 23B,主打前沿推理效率,并在编码与智能体任务上推进西方开源前沿,从零端到端训练。完整权重将于本月发布,详情见 reflection.ai/beam。
Reflection 发布 Beam,一个面向智能体的开源权重模型,总参数 501B、激活参数 23B,从零端到端训练,完整权重本月发布。转发的评价称其推理效率比 GLM 5.2 等竞品高 3-4 倍,在编码与智能体任务上推进了西方开源前沿。
NVIDIA 将 Nemotron-Labs-3-Competitive-Coding 发布到 Hugging Face,这是一个基于 Nemotron-3-Ultra 的竞赛编程专用模型。
Reflection AI 发布名为 Beam 的高效智能体开源模型,总参数 501B、激活参数 23B。官方称其在编码与智能体任务上推进了西方开源前沿,主打前沿推理效率,并从头端到端训练,完整权重将于本月发布。
Reflection AI 推出高效智能体开源模型 Beam,总参数 501B、激活参数 23B,从零端到端训练,主打前沿推理效率并推进西方开源模型在编程与智能体任务上的边界。Ollama 表示更多美国模型将接入,Beam 完整权重本月发布。
Google AI 在 X 平台发布一篇新文章,附链接指向 x.com 的文章页面。该帖获得 62 条回复、218 次转发、1747 个点赞,浏览量达 115832。
Space Bunny Alpha 的隐身测试期已结束,官方感谢所有参与测试并反馈的用户,称这些反馈帮助塑造了最终模型。官方表示,Space Bunny Alpha 背后的正式模型将很快揭晓,更多信息有待公布。
Fireworks AI 宣布 DeepSeek V4.1 Flash 现可在 Dedicated Training API 和 Managed Training 两个入口上训练。官方称它是智能体编码、终端自动化和工具调用的强基础模型,且服务成本很低,并给出了微调文档链接 docs.fireworks.ai/fine-tuning/mo…。
Recraft V4.1 发布,主打自然摄影、强构图与真实日常瞬间,可将简单提示词转化为自然、有意图且生动的图像。该版本由 Recraft 官方账号在社交平台公布,具体参数与上线范围未披露。
马斯克回应社交平台提问时确认,旗下人工智能业务 SpaceXAI 将更名为 SpaceXSI,并称 SpaceX 本质上是一家「超级智能公司」;该业务由 xAI 今年 2 月被 SpaceX 收购、7 月更名为 SpaceXAI 而来。
TypeSafe AI 的首个模型 Jev 在 Modal 上三天内完成超 1 万亿 token 的服务扩展,此前它上线一周即登顶 OpenRouter 1K-10K token 上下文榜首,承接 15.1% 的请求。Jev 并非大语言模型,而是主打快速直觉思考的 System One Model,输入状态与问题后并行输出带概率的结构化值。
Black Forest Labs 发布 FLUX 3 Image,主打精准局部编辑:框选区域后用文字描述修改需求,画面其余部分几乎不变。官方说明称该模型还支持用 JSON 坐标指定各元素位置的布局控制,适合排版、海报等场景,并最多可合成 10 张参考图。在线体验地址为 flux-tools.bfl.ai/precise-editing。
Aleph Alpha 发布 Kolibri,参数规模 78B、激活参数 3.46B,上下文最高支持 1M tokens,权重以 Apache 2.0 许可开放,可在自有硬件上运行。Cohere 转发该消息并称其表现不错,同时预告双方将合作推出新成果。
Cohere 使用 WMT26 基准测试其翻译模型 North Small Translate,该基准在模型创建之后才发布,因此模型无法针对其指标进行训练。
Cohere 推出开源机器翻译模型 North Small Translate,称其为 1T 参数以下全球最佳。该模型权重与流程均对外开放,并由 Cohere 本地化负责人 Tom Kocmi 出镜讲解。
Kling AI 展示了创作者使用 Kling 4.0 和 Kling 4.0 Flash 生成的作品,强调新的想象、新的故事与新的创作方式。两条模型版本号分别为 Kling 4.0 与 Kling 4.0 Flash,配以 #Kling4 与 #klingai 话题发布。原文未披露参数规模、benchmark 分数或开放方式等细节。
Anthropic 发布 Opus 5.5,价格更低、速度更快、基准测试成绩强劲,并扩大面向防御方的网络安全访问权限。OpenAI 推出更低价的 GPT-6 层级 Sol 和 Luna;Meta 的 Muse 登陆 Mac 并开放电脑操作能力,但被 Amazon 以政策与隐私安全为由封禁。
StartLux(原点星辉)开源决策模型 StartLux-Decision,一次推出 0.8B、2B、4B、9B 和 27B 五档版本,并提供支持本地部署的量化模型。
蚂蚁百灵新一代大模型 Ling-3.1-Flash 在「Teenage Engineering 风格信息卡」提示词测试中一把过,输出效果达标。该模型为 560B/A25B MoE 架构,支持 1M token 上下文,输出速度基本维持在 100+ tokens/s,整个推理生成与校验流程约 2-3 分钟完成。