DeepSeek(@deepseek_ai)· DeepSeek (@deepseek_ai)·· 2026-04-24AI 评估 · 68/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
DeepSeek 公布注意力结构创新,1M 上下文成为官方服务默认
Structural Innovation & Ultra-High Context Efficiency 🔹 Novel Attention: Token-wise compression + ...
AI 导读
DeepSeek 公布其模型的结构创新与超高上下文效率,其中包括新的注意力机制,采用 Token 级压缩与 DSA(DeepSeek Sparse Attention),官方称在长上下文下大幅降低计算与内存开销。同时 1M 上下文已成为所有 DeepSeek 官方服务的默认配置。
来源:DeepSeek(@deepseek_ai) · x.com