跳到正文

#DeepSeek

今日 5 条
9月22日周二
  1. Thomas Wolf(@Thom_Wolf)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Thomas Wolf 列举 Dylan Patel 访谈以来的开源模型发布:Kimi K3、Qwen3.8-Max、DeepSeek V4-Pro 等

    Thomas Wolf 列出 Dylan Patel 访谈后约 10 周内的开源模型发布,包括 Thinking Machines Inkling、Moonshot Kimi K3、DeepSeek V4-Flash-0731 与 V4-Pro-0813、Qwen3.8-Max、Z.ai GLM-5.3、Meta Muse Spark 1.2 等。

9月20日周日
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 20/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    OpenAI 用 1 万个智能体演算 Navier-Stokes,DeepSeek V4.1 Flash 发布新架构

    OpenAI 动用 10,000 个智能体演示 Navier-Stokes 方程失效,引发关于提示词数据隐私与 AI 在数学中作用的争论。DeepSeek V4.1 Flash 则推出全新架构,面向更低成本的长上下文负载。

  2. Browser Use(@browser_use)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    GLM 5.3 FlashX 表现提升但价格明显上涨,DeepSeek v4.1 Flash 更胜一筹

    GLM 5.3 FlashX 表现已相当出色,但价格明显更贵,同时被 DeepSeek v4.1 Flash 比下去。该帖获 340 点赞、30059 次浏览。

9月19日周六
  1. AI产品黄叔(@PMbackttfuture)AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    用夸克网盘 Skill 在线提取视频逐字稿:30 分钟音视频不到 1 分钟转完

    夸克网盘 Skill 可在线提取视频逐字稿,88VIP 用户可无限使用,支持多路同时转写,平均不到 1 分钟完成 30 分钟音视频转写,后续可用 DeepSeek API 润色。此前作者用本地 FunASR 转写太吃电脑资源,也曾改用 GrokBot 云端处理。

  2. Suhail(@Suhail)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DSV4.1 中的 Engram 表:压缩与缓存

    DSV4.1 的 Engram 表被评价为"超级酷",其核心思路是一切都靠压缩,之后一切都靠缓存。该帖未披露具体参数量、benchmark 分数或可用性信息。

  3. bolt.new(@boltdotnew)AI 评估 · 45/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 上线 DeepSeek V4.1 Flash:开放模型首周使用量达 V4 Pro 的 10 倍

    Bolt 在开放模型上线首周后新增 DeepSeek V4.1 Flash 至 Bolt Forge,据 beta 用户反馈该模型生成的网站视觉效果最佳。Bolt 称开发者首周压倒性地选择了最快的模型,DeepSeek V4.1 Flash 的使用量达到 DeepSeek V4 Pro 的 10 倍。

9月18日周五
  1. SemiAnalysisAI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    SemiAnalysis 解读 Engram 嵌入:面向高效 DRAM/SSD 卸载的软硬件协同设计

    SemiAnalysis 分析了 DeepSeek 式 Engram 多 token 查表嵌入的协同设计思路:每个 token 只访问地址依赖 token ID 的少量嵌入行,运行时可在前层计算时从 host DRAM 预取,使嵌入表无需常驻 HBM。

  2. 奇舞精选AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    奇舞周刊第597期:Agent 工程与研发实践

    奇舞周刊第597期汇编多篇 Agent 工程实践:淘宝百亿补贴数据分析助手 Agent 在自然语言与 SQL 间加入业务语义层,结合多 Agent 编排、知识检索与执行校验,案例查询耗时从 30—120 秒降至 3—10 秒。

  3. 夕小瑶科技说AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    每月花钱养的办公 Agent,最后成了谁的资产?——模型开源不等于 Agent 开源

    SemiAnalysis 披露其公司 AI token 开销已占员工薪酬的 30%,每位员工每月消耗约 50 亿 token。文章指出模型开源与 Agent 开源是两件事,真正承载用户资产的是负责调度模型、连接工具、管理记忆的 Agent Runtime,并以 DeepSeek Harness、网易有道 LobsterAI 为例讨论执行层开源。

  4. bolt.new(@boltdotnew)AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt 开放模型使用排行:GLM 5.3 Flash 以 54% 居首

    Bolt 上 1100 多万开发者已可用上开放模型,用量最高可提升 50 倍;其中最快最便宜、提示词窗口达 2 倍的 GLM 5.3 Flash 以 54% 占比排第一,DeepSeek V4 Pro 以 17% 居次,GLM 5.3 为 15%,Kimi K3 占 1%。

9月16日周三
  1. bolt.new(@boltdotnew)AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt Forge 正式开放:Pro 计划已可用,Bolt Lite 每月 9 美元含 Forge 权限

    Bolt 宣布 Forge 已面向所有 Pro 计划开放,并放出 Bolt Lite 每月 9 美元的含 Forge 权限等待名单。Forge 在 10 月 14 日前免费,提供最高 50 倍用量,并新增 GLM、DeepSeek、Kimi 模型选择,且不收取用量费用,已上线 bolt.new 的模型选择器。

  2. 奇舞精选AI 评估 · 71/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek Harness 架构解读:从会回答到能持续做事的 Agent 运行时

    DeepSeek Harness(DSH)是 DeepSeek AI 基于 Cordis 开发的开源 Agent Harness,采用 MIT 许可证,官方仓库仍标注为开发者预览版。

  3. Fireworks AI(@FireworksAI_HQ)AI 评估 · 41/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fireworks AI 实测:DeepSWE 智能体成本 99.6% 命中缓存,单任务 $0.43 对 $6.52

    Fireworks AI 在 Astra 与 DeepSeek V4.1-Flash 上运行 DeepSWE,输入 token 与输出 token 比例为 174:1,其中 99.6% 为缓存命中,缓存命中占账单的 60%。两者质量相同,但单任务成本分别为 $0.43 与 $6.52。

9月15日周二
  1. 深网腾讯新闻AI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    对话朱啸虎:基础大模型的故事今年是最后一年,办公Agent是大厂的天下

    金沙江创投朱啸虎在对话中判断,今年可能是基础大模型的最后一年,明年资本市场需要讲新故事,等Anthropic和国内大模型公司上完市,故事就讲得差不多了。他认为办公Agent肯定是大厂的天下,因为企业微信、飞书、钉钉掌握的组织关系与历史数据是创业公司难以逾越的上下文壁垒,创业公司只能选一家平台做垂直Agent。

  2. NVIDIA Technical BlogAI 评估 · 21/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA Transformer Engine 加速 JAX 中的 Dropless MoE 训练

    NVIDIA 在技术博客中介绍如何用 Transformer Engine 加速 JAX 框架下的 Dropless MoE 训练。MoE 已成为大规模 AI 模型训练的标志性架构趋势,DeepSeek、Qwen、Mixtral 等模型以远低于稠密模型的训练算力达到甚至超越其性能,其核心在于条件计算——不再共享单一稠密 FFN。

  3. bolt.new(@boltdotnew)AI 评估 · 44/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Bolt Forge 上线:GLM、DeepSeek、Kimi 免费至 10 月 14 日,用量最高提升 50 倍

    Bolt 推出 Bolt Forge,在 bolt.new 的模型选择器中上线,新增 GLM、DeepSeek、Kimi,用量最高可达原来的 50 倍且零使用费用,免费期至 10 月 14 日。

9月14日周一
  1. 阿里云开发者AI 评估 · 63/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek-V4.1-Flash 上线千问 AI 平台,API 与 Token Plan 同步开放

    DeepSeek-V4.1-Flash 正式上线千问 AI 平台,相关 API 服务与 Token Plan 同步开放,开发者可通过 API 接入应用,也能在 Qoder、千问 APP、Codex 等工具中直接调用 Token Plan。

  2. 深网腾讯新闻AI 评估 · 60/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    智谱再融约392.7亿港元,首次配售款已用34.92%

    智谱于9月13日晚公告拟配售新H股并发行美元可转债,两笔合计净额约392.7亿港元(约50亿美元),各自独立、不互为条件。截至2026年8月31日,IPO募资已悉数动用,7月首次配售的313.75亿港元仅动用约34.92%。

  3. andrew chen(@andrewchen)AI 评估 · 26/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    本地 AI 实验的家用 Homelab 配置:Hermes、5090 eGPU 与 2x DGX Spark

    一套本地 AI 实验的 homelab 配置:Hermes 跑在 Framework Desktop Mainboard AI Max+ 395 上,5090 eGPU 以 Qwen 3.8 27B 提供最高 150+ tok/s 的 LLM 推理。

9月11日周五
  1. ollama(@ollama)AI 评估 · 72/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek-V4.1-Flash 在 Ollama 云全面上线

    DeepSeek-V4.1-Flash 已在 Ollama 云全面上线,托管于美国与欧洲,承诺 prompts 和 responses 不记录、不用于训练。按 token 计费与 DeepSeek API 一致并含 off-peak 定价,可通过 Ollama 的 Pro、Max、Team 套餐或免费账号按量付费使用。

  2. Browser Use(@browser_use)AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Browser Use 云平台上线 DeepSeek V4.1 Flash:性能达 GPT 5.6 Sol xhigh 的 97%,成本低 30 倍

    Browser Use 云平台现可运行 DeepSeek V4.1 Flash,其性能达 GPT 5.6 Sol xhigh 的 97%、Claude Opus 5 的 95%,智能体成本低 30 倍。新用户可用 15 美元免费额度运行 100 个复杂网页智能体任务。

  3. ollama(@ollama)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek-V4.1-Flash 在 Ollama 云端面向 Pro 订阅用户推送

    Ollama 宣布 DeepSeek-V4.1-Flash 正在 Ollama 云端推送,先面向 Max 和 Team 账号开放,随后扩展到 Pro 订阅用户。官方表示正在快速增加容量,以便向所有订阅用户推送。

  4. ollama(@ollama)AI 评估 · 66/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek-V4.1-Flash 在 Ollama 云端上线,先向 Max 与 Team 账户开放

    Ollama 宣布 DeepSeek-V4.1-Flash 正在其云端逐步上线,首批面向 Max 和 Team 账户开放。Ollama 表示正在快速增加容量,以便向所有订阅用户开放。

9月10日周四
  1. Browser Use(@browser_use)AI 评估 · 65/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek V4.1 Flash 在浏览器任务上成本比 Sol 和 Opus 低 50 倍

    Browser Use 引用 Gregor Zunic 的评测称,DeepSeek V4.1 Flash 在 60 个高难度浏览器操作任务上处于帕累托前沿,性能接近 Sol 和 Opus 的同时,记录到的智能体成本低 50 倍。该评测还表示,跑完整个数据集的成本低于运行 Sol 的单个任务。

  2. DeepSeek(@deepseek_ai)AI 评估 · 57/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 宣布与开源社区合作推进 V4.1-Flash 推理支持

    DeepSeek 表示将与开源社区密切合作,推进 V4.1-Flash 的推理支持,并探索更多部署选项,同时提到可为需要 2000 块 GPU 加存储集群的大规模部署提供对接。推文附带了指向 huggingface.co 上 DeepSeek 模型和论文的链接。

  3. DeepSeek(@deepseek_ai)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek V4.1-Flash 发布新定价,API 价格下调并保留峰谷差价

    DeepSeek 宣布 V4.1-Flash 采用更高效的架构,降低 API 价格,将节省的成本让给用户。新定价于 2026 年 9 月 10 日 04:00 UTC 生效,峰谷定价继续用于平衡需求,非高峰时段费率为高峰时段的 50%,弹性任务可安排在非高峰时段以节省成本。

  4. DeepSeek(@deepseek_ai)AI 评估 · 75/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek V4.1-Flash 上线 API,原生支持多模态

    DeepSeek 在 API 上线 V4.1-Flash,原生支持多模态,模型名设为 deepseek-flash。

  5. DeepSeek(@deepseek_ai)AI 评估 · 32/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek V4.1-Flash 将 KV cache 的 HBM 需求降至上一代的 1/4

    DeepSeek V4.1-Flash 相比上一代大幅压缩 KV cache,所需 HBM 仅为 1/4、SSD 存储仅为 1/8。缓存命中费用常占 AI 智能体成本的很大一部分,压缩缓存可显著降低这部分开销。

  6. DeepSeek(@deepseek_ai)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 发布 552B 参数 MoE 非对称架构模型

    DeepSeek 发布新模型,采用 552B 参数的 MoE 非对称架构。其新 Causal Encoder–Decoder 架构在输入端仅激活 8B 参数、输出端激活 16B 参数。官方称新预训练方法配合更大规模 RL 后训练,基准测试结果超过包括 DeepSeek-V4-Pro 在内的旗舰模型。

  7. DeepSeek(@deepseek_ai)AI 评估 · 67/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 发布 DeepSeek-V4.1-Flash 模型

    DeepSeek 发布 DeepSeek-V4.1-Flash,称其更智能、更快、更高效,是新架构家族中体量最小的模型,并具备原生视觉理解能力。该模型面向更强能力、更快推理、更高吞吐设计,可扩展至更大模型。

  8. DeepSeekAI 评估 · 89/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    DeepSeek 发布 V4.1 Flash:原生多模态、552B MoE,模型开源并调整 API 定价

    DeepSeek 正式发布 DeepSeek V4.1 Flash,这是其全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力。该模型为 552B 参数的 MoE 模型,采用 Causal-Encoder-Decoder 非对称结构,输入激活 8B、输出激活 16B,官方称其在基准测试中超越了包括 DeepSeek V4 Pro 在内的旗舰模型。

    为什么值得看

    官方给出新模型的参数结构、KV Cache 压缩与定价变化,可据此判断 Agent 类任务的成本走向。

  9. 真格基金AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    真格基金 Z News 8 月回顾:Kimi K3、智谱 GLM 5.3 等被投企业进展

    真格基金 Z News 回顾 8 月被投企业动态:月之暗面开源 2.8T 参数的 K3 成为仅次于 Fable 5 和 GPT5.6 的模型,也是目前参数最大的开源模型;赛博昆仑联合智谱 GLM 5.3 发现并报告三枚影响微软企业邮件与办公系统的重大漏洞。无问芯穹携手国家中试基地、广东联通发布新一代全栈国产 AI PC,潞晨科技单日最高 Token 提供量已接近万亿。

9月9日周三
  1. DeeplearningAIAI 评估 · 84/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Z.ai 发布 GLM-5.3-Flash,Ox Alpha 谜底揭晓并开放权重下载

    Z.ai 正式发布视觉语言模型 GLM-5.3-Flash,即此前在 OpenRouter 上匿名预览的 Ox Alpha,并公开了权重。该模型采用 MoE Transformer 结合线性注意力与稀疏注意力,总参数 3200 亿、每 token 激活 180 亿,支持文本、图像和视频输入,最多 1,048,576 个 token,输出上限 128,000 个 token。

    为什么值得看

    智谱开源 GLM-5.3-Flash 的架构与成本数据,可用于判断低价视觉语言模型的性价比取舍。

9月8日周二
  1. Interconnects AI — Nathan LambertAI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    最新开放模型盘点:#24:Motif-3、GLM-5.3、Hy4-preview 与开源模型许可证

    智谱 GLM-5.3 从 MIT 转为自定义许可证,规定若被许可方或其关联方运营模型即服务业务且连续 12 个月总收入超过 100 亿美元,须先通过 Z.AI 安全审查;该许可未定义"关联方",增加了采用不确定性。

  2. 腾讯技术工程AI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    我用腾讯 Kuikly 把 DeepSeek Harness 装进了手机:一码三端 DSH Mobile

    腾讯程序员用 Kuikly 框架开发了 DSH Mobile,一套 Kotlin 代码覆盖 Android、iOS 和鸿蒙,按 DSH 官方 Host 协议连接电脑上的 DeepSeek Harness。

9月7日周一
  1. 深网腾讯新闻AI 评估 · 35/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    华为 Mate XT2 非凡大师发布:首发麒麟9050 Pro,19999 元起

    华为9月7日发布新一代三折叠手机 Mate XT2 非凡大师,首发麒麟9050 Pro 芯片,整机性能较 Mate XTs 提升42%,起售价19999元,比上一代涨2000元。该机改用U型双内折方案并首次加入独立外屏,出厂搭载 HarmonyOS 7 正式版,集成盘古大模型端侧AI能力。余承东透露华为三折叠手机全球发货量已超100万台。

  2. 卫诗婕|商业漫谈Jane's talkAI 评估 · 38/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    脉脉 CEO 林凡聊全球 AI 人才动向与大模型季报:明年科技公司只招 AI 人才?

    脉脉创始人兼 CEO 林凡走访 OpenAI、Anthropic、Google、Meta 后判断,AI 岗位需求已连续两年同比 10 倍增长,非 AI 岗位普遍缩招。他提出 AI 人才分基座技术、应用开发、业务效能三类,核心门槛是让 agent 自主运行超过 1 小时。企业内部 AI 落地需开放文档库、代码库等数据,OpenAI 用 9 个月完成全员 AI 覆盖。

  3. 语言即世界language is worldAI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    曾鸣谈AI产业史观:11个非共识判断,OpenAI、Anthropic大概率不是原生应用阶段的大赢家

    曾鸣提出AI产业化分三阶段,2026年是基础设施阶段基本完成的标志,围绕token形成共识,并已进入以Agent为新应用的智能体阶段。他认为Anthropic、OpenAI大概率不是原生应用阶段的大玩家,下一个最大机会是类似浏览器、统一Agent标准的平台。他还判断旧平台难演变成新平台,公司终将消亡,AI时代人与人的差异在于创造力。

9月6日周日
  1. ollama(@ollama)AI 评估 · 62/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Ollama 推出 DeepSeek-V4 错峰 token 半价

    Ollama 宣布推出错峰时段 token 费率,DeepSeek-V4-Flash 和 Pro 在工作日 UTC 12:00 至 18:00(太平洋时间 5am-11am)之外以及整个周末均按半价计费,错峰定价后续将覆盖更多模型。Ollama 云端上的 DeepSeek 模型托管在美国和欧洲,提供 ZDR 与快速性能。

9月4日周五
  1. DeeplearningAIAI 评估 · 58/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    小红书团队提出 Self-GC,用 LLM 自主管理智能体上下文

    小红书(RedNote)的 Xubin Hao 及同事提出自主管理上下文方法 Self-GC,在把上下文发给关联 LLM 之前,由一个大语言模型决定哪些部分保留、删减或丢弃。