近年来,中国的AI大模型也在迅速崛起。2025年1月27日,DeepSeek在中美App Store免费应用榜上强势登顶,瞬间引爆全球关注。其全面开源的策略吸引了全球开发者,构建了一个活跃的开源社区。凭借独特的算法优化,DeepSeek-V3打破了算力与性能之间的传统束缚,在低算力成本下实现卓越的高性能表现,多项技术指标直逼GPT-4。2月18日,DeepSeek在海外社交平台X上发布了《原生稀疏注意力:硬件对齐且可原生训练的稀疏注意力机制》纯技术论文,这一技术用于超快速长文本训练与推理,进一步提升了模型在自然语言处理任务中的效率。