GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 密集发布:大模型进入“斩杀线”大战
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
Next Token 播客第 003 期围绕 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型,讨论竞争焦点从“谁更强”转向能力够用、成本够低与普通人能否体验的“斩杀线”。
Next Token 播客回顾 8 月 27 日至 9 月 3 日的 AI 新闻,讨论 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布后,竞争转向“便宜且够用”的斩杀线。节目还探讨常驻云端 Agent、Token 经济,以及 Astra 会用电脑是否算 AGI。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向能力够用、成本够低、普通人能否真正体验的“斩杀线”。
Mind Lab 研究员逯雨鑫以个人开发者身份、数百美元成本后训练的两个小模型两次登顶 Hugging Face Model Trending 榜首,他此前没有 AI Lab 经历,也不是 AI PhD,整个过程只用了 2 周。
Meta Superintelligence Labs 发布 Muse Glimmer,一个 30B 参数的开源智能体模型,权重以 Apache 2.0 许可在 Hugging Face 开放下载。
推荐理由:Meta 开源 30B 端侧智能体模型,量化后可在单张消费级 GPU 上运行,读者可据此判断本地智能体的可行边界。
Ideogram 发布 9.3B 参数开源权重文生图模型 Ideogram 4.0,采用 34 层单流 DiT,文本编码器为 Qwen3-VL-8B-Instruct,并拼接其 13 个中间层隐状态。
推荐理由:官方披露 9.3B 开源文生图模型的架构与结构化 JSON 提示词方案,可据此判断开源图像模型的设计取舍。