zh
AI产品榜
每月不到10元,就可以无限制地访问最好的AIbase。立即成为会员
首页
AI资讯
AI日报
变现指南
AI教程
AI工具导航
AI产品库
zh
AI产品榜
搜索全球AI产品动态
搜索全球AI信息,发现AI新机遇
新闻资讯
产品应用
变现案例
AI教程
类型 :
新闻资讯
产品应用
变现案例
AI教程
2025-02-19 08:33:46
.
AIbase
.
15.5k
DeepSeek 推出 NSA 技术:加速长上下文训练与推理
在人工智能领域,DeepSeek 团队于近日发布了最新研究成果,推出了一种名为 NSA(Native Sparse Attention)的创新稀疏注意力机制。这项技术的核心目标是提升长上下文训练和推理的速度,特别是针对现代硬件进行了优化,使得训练和推理的效率大幅提升。NSA 技术的推出,为人工智能模型的训练带来了显著的变化。首先,它通过一系列针对现代计算硬件特性的设计优化,显著提升了推理速度,并有效降低了预训练的成本。更重要的是,在提升速度和降低成本的同时,NSA 仍然保持了高水平的模型