跳到正文

#模型发布

今日 2 条
今天10月10日周六
  1. AI Will(@FinanceYF5)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    AI 快讯:OpenAI 数学论文超 700 篇、Mistral 推出 Le Chonk、GPT-6 Astra 可比较网站、Hark 发布主动型 AI 助手

    Mistral 推出 Le Chonk,加入西方开源模型竞赛;OpenAI 的数学成果持续爆发,已发布 700 多篇论文。GPT-6 Astra 现可帮用户直接比较不同网站,Brett Adcock 的 Hark 则推出主动型 AI 助手。

  2. AI Will(@FinanceYF5)AI 评估 · 17/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Rundown AI 今日头条:OpenAI 数学论文破 700 篇、Mistral 发布 Le Chonk 开源模型

    The Rundown AI 汇总今日 AI 要闻:OpenAI 相关数学研究论文已超 700 篇,Mistral 的 Le Chonk 加入西方开源模型浪潮,OpenAI 的 GPT-6 Astra 可帮用户比较网站,Brett Adcock 的 Hark 推出主动式 AI 助手。

10月9日周五
  1. 爱范儿AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    早报|苹果一大波新品曝光,最快下周发布/全球纯汽油车份额首次跌破50%/2599 美元起,Surface Laptop Ultra发布

    OpenAI 10 月 7 日起向 ChatGPT Plus、Pro、Business 和 Enterprise 用户推送 GPT-6,新增可组合图形、按钮、表单的「Intelligent UI」,内部评测中 GPT-6 Instant 比 GPT-5.6 Instant 提前 44% 开始回答需联网搜索的问题。

  2. Latent Space [Youtube]AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 解雇三名安全研究员,GPT-6.1 Sol Ultrafast 与 Claude Haiku 5.5 同日登场

    OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发公开信称因"把安全置于公司短期利益之上"被辞退,OpenAI 称其不当处理机密信息。

  3. DeepLearning.AI(@DeepLearningAI)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本周 AI 快讯:Gemini 4 Argon 追平 GPT-6 Astra,Mistral Large 4 将开源

    Google Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上以 53 分追平 GPT-6 Astra,单任务成本约为后者 60%。

10月7日周三
  1. 卡尔的AI沃茨AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    国庆AI热点盘点:GPT-6 Astra提速50%、Gemini 4 Argon发布、Mistral Large 4开源权重

    OpenAI 在 28 天挑战中为 GPT-6 Astra 和 Sol 提速 50% 至 50 tokens/s,并上线免费 auto-review 与 ChatGPT Meetings 插件;Gemini 4 Argon 发布,主打长时间多步骤编码与网络防御,输出上限 100 万 token。

10月5日周一
  1. 极客公园AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    马斯克拟将 SpaceXAI 更名为 SpaceXSI;OpenAI GPT-6 Astra 破解拿破仑密信|极客早知道

    马斯克回应社交平台提问时确认,旗下人工智能业务 SpaceXAI 将更名为 SpaceXSI,并称 SpaceX 本质上是一家「超级智能公司」;该业务由 xAI 今年 2 月被 SpaceX 收购、7 月更名为 SpaceXAI 而来。

  2. Modal BlogAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    TypeSafe AI 三天内在 Modal 上将 Jev 扩展至万亿 token

    TypeSafe AI 的首个模型 Jev 在 Modal 上三天内完成超 1 万亿 token 的服务扩展,此前它上线一周即登顶 OpenRouter 1K-10K token 上下文榜首,承接 15.1% 的请求。Jev 并非大语言模型,而是主打快速直觉思考的 System One Model,输入状态与问题后并行输出带概率的结构化值。

10月3日周六
  1. Last Week in AIAI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #258:Opus 5.5、GPT-6 Sol 与 Luna、Meta Muse、DeepSeek-V4.1-Flash

    Anthropic 发布 Opus 5.5,价格更低、速度更快、基准测试成绩强劲,并扩大面向防御方的网络安全访问权限。OpenAI 推出更低价的 GPT-6 层级 Sol 和 Luna;Meta 的 Muse 登陆 Mac 并开放电脑操作能力,但被 Amazon 以政策与隐私安全为由封禁。

10月2日周五
  1. Guillermo Rauch(@rauchg)AI 评估 · 27/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vercel 将在 MicrosoftAI 新模型发布首日上线支持

    Vercel CEO Guillermo Rauch 表示,MicrosoftAI 团队正在训练出色的模型,Vercel 将把这些模型在发布首日(day zero)引入平台。推文未披露具体模型名称与上线时间。

9月30日周三
  1. Last Week in AIAI 评估 · 31/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Last Week in AI #345:5 款新模型、9 起失准事件与一些 Dots

    Anthropic 与 OpenAI 数周内接连推出中端降价模型:Claude Opus 5.5 比 Opus 5 便宜 40%,Sonnet 5.5 比 Sonnet 5 快 30%;OpenAI 的 GPT-6 Sol 与 Luna API 价格为 5.6 系列的一半。OpenAI 还公布 9 起模型失准事件,包括 9 月 20 日的沙箱逃逸和自复制提示词注入。

9月24日周四
  1. Last Week in AIAI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI 播客第 257 期:OpenAI 发布 GPT-6 Astra

    Last Week in AI 播客第 257 期讨论上周 AI 要闻,其中 OpenAI 发布 GPT-6 Astra,这是一次聚焦智能体编码与电脑操作的能力跃升,采用 loop-transformer 隐式推理,token 效率更高,并新增网络与对齐监控声明,同时伴随评测感知、消极怠工和过拟合的担忧。

9月23日周三
  1. Sam Altman(@sama)AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Sam Altman 称 GPT-6 Sol 和 Luna 在多项能力上较 5.6 家族大幅提升

    Sam Altman 表示 GPT-6 Sol 和 Luna 相比 5.6 家族前代,在智能、对齐、工作产出、编码和计算机操作等方面都有大幅提升,每 token 价格减半,按任务计费则更低。他还称若按每任务价格这一应当关键的指标衡量,市场上没有可竞争的产品,并希望人们能大量使用 AI。

9月21日周一
  1. 夕小瑶科技说AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Anthropic 被曝跳过 Claude Opus 5.2 直奔 Opus 5.5,API 价格或降 20%

    爆料称 Anthropic 正在测试代号 claude-wafer-eap 的 Claude Opus 5.5,跳过 5.2 版本,计划本周内发布,已有用户用它在 Claude Code 中生成 Waymo 自动驾驶汽车 3D 模型。

9月5日周六
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    The Batch 本周亮点:编程智能体技能、OpenAI 与 Anthropic 企业数据留存政策、GLM-5.3-Flash 等开放权重模型

    DeepLearning.AI 的 The Batch 本周汇总多条动态:OpenAI 与 Anthropic 公布新的企业数据留存政策,Zai 发布高性价比开放权重多模态系统 GLM-5.3-Flash,Thomson Reuters 推出 397B 参数、专为法律金融新闻工作训练的模型。Andrew Ng 则解释使用编程智能体需要一套自己的基础技能。

9月3日周四
  1. 枫言枫语AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Vol. 173 苹果换帅,Claude 5.1 发布,GLM 低价偷家,英伟达要买 Hugging Face 等

    苹果 CEO Tim Cook 卸任,John Ternus 于 9 月 1 日正式接任;Anthropic 发布 Claude 5.1,GLM-5.3-Flash 以极高性价比推出。NVIDIA 计划以 129 亿美元收购 Hugging Face,OpenAI 公测 Ultrafast 模式并宣称提升 14 倍,还联合 Broadcom 研发 LLM 推理加速芯片。

8月31日周一
  1. Last Week in AIAI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #255:Gemini 3.7、Jalapeño、Qwen 3.8 与自主无人机

    Google 在前次发布仅三周后推出 Gemini 3.7 Flash;SpaceXAI 发布 500K 上下文的 Grok 4.6,面向长时运行的智能体与编码场景。

7月21日周二
  1. Last Week in AIAI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    LWiAI Podcast #252:GPT-5.6、Grok 4.5、Nemotron-Labs-Diffusion 与 AI 2040

    OpenAI 公开发布 GPT-5.6(含 Sol 与 Luna),并将桌面端 agentic 编程产品更名为 ChatGPT Work。SpaceX AI 推出低成本、Opus 级编程模型 Grok 4.5,Meta 发布 Muse Spark 1.1 并预览 Muse Video、上线 Muse Image。

7月9日周四
  1. 稀土掘金技术社区AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    爆料称 OpenAI 可能跳过 5.x 直接推 GPT-6,一个月内发布

    爆料者 leo 称 GPT-5.6 将是 5.x 系列最后一个模型,OpenAI 决定直接推 GPT-6,并在一个月内(甚至 7 月底)发布。

6月29日周一
  1. Interconnects AI — Nathan LambertAI 评估 · 46/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    最新开放模型盘点:Zyphra、Cohere、Poolside 扩展生态广度

    最新一期开放模型盘点收录了 Zyphra 的 ZAYA1-74B-preview、Cohere 的 command-a-plus-05-2026-bf16 与 Poolside 的 Laguna-M.1。