标签: DeepLearning
包含此标签的所有文章 "DeepLearning".
Transformer 之后:线性注意力、SSM/Mamba 与混合架构
Transformer 之后的故事——从 O(N²) 复杂度瓶颈出发,系统解析线性注意力、SSM/Mamba、RWKV 与 Hybrid 混合架构演进全景。
包含此标签的所有文章 "DeepLearning".
Transformer 之后的故事——从 O(N²) 复杂度瓶颈出发,系统解析线性注意力、SSM/Mamba、RWKV 与 Hybrid 混合架构演进全景。