GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 密集发布:大模型进入“斩杀线”大战
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
Next Token 播客第 003 期围绕 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型,讨论竞争焦点从“谁更强”转向能力够用、成本够低与普通人能否体验的“斩杀线”。
24 岁的深朴智能(Simple AI)首席科学家王家伟,从中科大少年班、MSRA、DeepSeek、字节 Seed 一路走到大模型前沿,毕业后转向具身智能。深朴智能从 HiFi-UMI 数据、具身基础模型、Agentic OS 做到本体,开源 2,000 小时数据、内部积累数万小时,模型已观察到一定的 Zero-shot 泛化。
Next Token 播客回顾 8 月 27 日至 9 月 3 日的 AI 新闻,讨论 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布后,竞争转向“便宜且够用”的斩杀线。节目还探讨常驻云端 Agent、Token 经济,以及 Astra 会用电脑是否算 AGI。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向能力够用、成本够低、普通人能否真正体验的“斩杀线”。
Airwallex 空中云汇 CRO 吴恺在播客中回顾公司 11 年从 0 到 110 亿美金估值的历程,并称下一道台阶是从 20 多万客户走向 100 万客户规模。
张小珺访谈小米大模型团队负责人罗福莉,她认为大模型正从预训练主导的 Chat 时代转向后训练主导的 Agent 时代,Anthropic 的路径是当下共识。她提到国内团队在预训练上的代差已基本没有,接下来要在 Agent 上做好 RL 的 scaling,用卡比例可能从 3 比 5 比 1 变为 3 比 1 比 1,并让预训练的人补充到后训练以增加多样性。
18岁的涂津豪是 DeepSeek 前高中实习生、阿里全球数学竞赛 AI 组冠军、Thinking Claude 作者,每天和 AI 对话约 2 小时。他判断下一代 AI 产品的三个核心方向是主动式 AI、context-aware 的 Memory,以及比 Benchmark 更重要的 Model Character,并认为 Continual Learning 是 2026 的关键方向。
智谱确认于2026年1月8日登陆港交所,成为中国首家上市的大模型公司,也将是“全球大模型第一股”。上市前夕,主持人张小珺与智谱CEO张鹏进行了一场3小时长谈,张鹏称希望智谱在人工智能历史书中被写为“AGI的先行者”“一个开路的人”。
朱啸虎在访谈中判断 AI 三年内看不到泡沫,并称相关泡沫论点是"无稽之谈"。他认为大家低估了 DeepSeek,称若没有 DeepSeek,人类的 AI 可能被几个私有公司控制。他还提到 OpenAI 越来越现实,Sam Altman 今年几乎不太提 AGI,并指出当前 VC 共识过于集中、项目多为 Club Deal。
MIT 在读博士杨松琳在播客中解析了 Kimi Linear、MiniMax M2、Qwen3-Next 等模型的注意力机制路线分歧:Kimi 走 Linear Attention,DeepSeek 探索 Sparse Attention,MiniMax 则从 M1 的 Linear Attention 回退到 M2 的 Full Attention。
张小珺发布与理想创始人兼CEO李想的第二次3小时访谈完整版,录制于2025年4月。李想以“CEO大模型”自比,按MoE架构调用技术、战略、组织三位“专家”,谈及理想自研基座大模型、VLA三阶段训练、每1万公里验证成本从18万降至4000元,以及记忆程序、能量与亲密关系等话题。
十字路口与庄明浩复盘 2025 年 AI 行业,以“拐点”为年度关键词,梳理从年初 DeepSeek R1 到近期 Sora 2 的模型大战,以及 Manus 引爆的“Agent 元年”。节目还讨论开源生态与人才流向、DeepSeek V3.2 发布后 V4 和 R2 今年或不再出现,并将目光投向资本市场对 AI 的集体狂想。
俄亥俄州立大学在读博士郑博元逐段解读 Kimi K2、ChatGPT Agent、Qwen3-Coder 三份技术报告及 Manus 技术博文,对比其 Agent 技术路线。内容涵盖 Agent 的感知与行动定义、Coding/Search/Tool-Use/Computer Use 四类划分,以及合成数据、强化学习、安全三大训练环节。
奔驰全球CEO康林松(Ola Källenius)2025年3月底来华9天并接受访谈,谈及上任6年来的豪华车战略、电动化战略及中国市场得失。他回应了特斯拉在电动车领域领先10年的说法,并谈及固态电池测试进展、AI对汽车行业的改变,以及是否考虑与中国DeepSeek合作。
广密在《全球大模型季报》2025年Q1特辑中重新坚信Pre-training,认为只有预训练决定模型内在上限,Post-training+RL只是加强。他提出AGI主线是智能提升,ChatGPT只是山脚第一站,接下来Coding、Coding Agent、General Agent、AI for Science、Robotics才是后续山头,并称Manus平均消耗70-80万Token。
42章经创始人曲凯与家族办公室从业者莫傑麟对谈,推演二级市场「东升西落」叙事的演绎过程与底层逻辑,认为此前市场过于低估国内 AI。两人简评 DeepSeek 与 Manus,称 Manus 是最典型的中国式 AI 产品,并讨论腾讯是 DeepSeek 这波的最大受益者、芯片「卡脖子」及股市未来走向。
连续创业者肖弘在访谈中回顾从 Monica.im 到即将发布的 Agent 产品 Manus 的思考历程,称新产品是"国内 Agent 的第一枪",并提到自己正经历"制造生命一样"的 A-ha moment。他总结 DeepSeek 全球爆火而 OpenAI o1 错过的产品逻辑,认为 Founder 应以博弈而非逻辑推理的方式思考,让自己成为博弈中的重要变量。
播客邀请 MIT 计算机科学与人工智能实验室在读博士松琳,逐篇解读 DeepSeek、Kimi 同天发布的两篇注意力机制论文及 MiniMax 春节前的相关论文。