张小珺Jùn|商业访谈录·· 2025-11-04AI 评分38
杨松琳解析 Kimi Linear、MiniMax M2 与 Qwen3-Next:注意力机制路线之争与架构未来
119. Kimi Linear、Minimax M2?和杨松琳考古算法变种史,并预演未来架构改进方案
AI 导读
MIT 在读博士杨松琳在播客中解析了 Kimi Linear、MiniMax M2、Qwen3-Next 等模型的注意力机制路线分歧:Kimi 走 Linear Attention,DeepSeek 探索 Sparse Attention,MiniMax 则从 M1 的 Linear Attention 回退到 M2 的 Full Attention。
来源:张小珺Jùn|商业访谈录 · xiaoyuzhoufm.com