跳到正文
原文
张小珺Jùn|商业访谈录·· 2025-11-04AI 评分38

杨松琳解析 Kimi Linear、MiniMax M2 与 Qwen3-Next:注意力机制路线之争与架构未来

119. Kimi Linear、Minimax M2?和杨松琳考古算法变种史,并预演未来架构改进方案

AI 导读

MIT 在读博士杨松琳在播客中解析了 Kimi Linear、MiniMax M2、Qwen3-Next 等模型的注意力机制路线分歧:Kimi 走 Linear Attention,DeepSeek 探索 Sparse Attention,MiniMax 则从 M1 的 Linear Attention 回退到 M2 的 Full Attention。

来源:张小珺Jùn|商业访谈录 · xiaoyuzhoufm.com