GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 密集发布:大模型进入“斩杀线”大战
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
Next Token 播客第 003 期围绕 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型,讨论竞争焦点从“谁更强”转向能力够用、成本够低与普通人能否体验的“斩杀线”。
Next Token 播客回顾 8 月 27 日至 9 月 3 日的 AI 新闻,讨论 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布后,竞争转向“便宜且够用”的斩杀线。节目还探讨常驻云端 Agent、Token 经济,以及 Astra 会用电脑是否算 AGI。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向能力够用、成本够低、普通人能否真正体验的“斩杀线”。
数美万物创始人兼CEO任利锋(卷卷)在近3小时访谈中回顾了从0到1孵化抖音的经历,并介绍了公司最新发布的Hi3D 3.0 2048³模型。他将创业目标从Maker OS推向制造业OS,认为基础模型不会吞噬一切,实体制造仍需能产出生产级3D资产的模型,以及拆件、连接结构、材料适配等模型之后的工程能力。
Pyromind 创始人兼 CEO Kevin Ding 在访谈中提出,AI 终局更像 Agent 蜂群而非超级基础模型一统天下,公司押注 AutoRL,把训练、奖励、反馈、部署与数据回流串成自动循环管道。
Runta 创始人兼 CEO 戴冠兰认为模型能力已经够了,下一场竞争要卷 infra,因为未来 agent 数量会超过人类,关键问题变成它们跑在哪、怎么管、出事谁负责。
Inferact 联合创始人兼首席科学家游凯超在访谈中回顾了 vLLM 从伯克利校园开源项目演化为公司的近 3 年历程,Inferact 今年初获得 1.5 亿美元种子轮融资。他谈及开源项目商业化后的抉择与转变,以及 AI Infra 与模型结构、Harness Engineering 联合设计时代下的 Co-design 思路。
生数科技张金涛在播客中介绍其团队月初发布的实时交互视频模型 Vidu S1,上传一张照片即可生成可实时视频通话的 AI 角色,支持无限时长,实现 540P、25–42 FPS 并能在消费级显卡上运行。
真格基金「此话当真」与「十字路口」串台播客以一条主线梳理 Agent 元年 500 天:GUI 退场、Headless 上位、CLI 复兴、Skills 封装、Agentic Economy 萌芽。
播客「十字路口」对谈 Superlinear.Academy 创始人课代表立正,讨论高手与普通人用 AI 的差距:高手把生活和工作的大小事都交给 AI,并建议普通人停止 ChatGPT 式聊天,改用 Codex / Claude Code / Cursor / Manus 等 agentic 工具。
OpenAI 和 Anthropic 上月同一天分别宣布各自的十亿美元级企业 AI 合资公司,且都称自己在做 FDE(Forward-Deployed Engineer,前置部署工程师)。十字路口对谈 Rolling AI 合伙人阿甘和刘开,讨论 FDE 是售前交付换名还是 ToB AI 时代的新组织结构,以及 AI 落地失败率超 50% 的三大死法。
百融智能董事长兼CEO张韶峰在访谈中提出企业落地 AI 的三个关键动作:先讲清概念、选对责任人、用能闭环可衡量的场景打穿,不要先挑战人性或重构流程。百融目前约 20 万 AI 员工对应 1,000 多名真人员工,已在金融风控审批、联络中心、招聘面试、财务报销、合同审核等场景跑通企业级 Agent 生产部署。
未来不远机器人创始人张翼在具身智能融资热潮中反其道而行,先潜行三年不融资,将机器人送进300个上海真实家庭采集场景数据,并于本周发布新一代家庭机器人F2。F2主打带娃与轻家务两个场景,采用先租后买的模式,月租3-4千元,以50%转介绍率和30%续租率作为核心指标。张翼认为真实家庭数据飞轮是护城河,现阶段世界模型与VLA两条路并行更现实。
阿里云百炼技术负责人于文渊在播客对谈中透露,Claude Code、OpenClaw 等 Agent 带动 Token 按月翻倍增长,个人重度用户单日消耗 1 亿 Token 已不算门槛,且多为最高质量的 SOTA Coding Token。
百度秒哒产品总经理朱广翔在访谈中称,2024 年下半年押注 No Code 时"基本上没人信",如今秒哒已成为 Supabase 官方认可的三家 leading AI builder 之一。
ChatCut 创始人李凯文在播客对谈中提出,视频剪辑正迎来自己的「Cursor 时刻」,但他坚持「不生成任何像素」,让 AI 作为剪辑助理工作在编辑器之上,服务「还不是剪辑师」的人群。他认为视频是 token 黑洞,多模态理解尚不足以精确到剪辑层面,Gemini 2.5/3.0 已带来巨大帮助,MG 动画能力很大程度来自 3.0。
理想汽车高级副总裁范皓宇在播客中复盘了理想 AI 眼镜 Livis 的产品思路:36 克、18 小时续航,弃用高通 AR 芯片改用手表 MCU 与双 RTOS 架构,以换取轻量、响应速度和功耗表现。他称眼镜最关注单次佩戴时长与语音交互次数,车内理想同学日均 18–20 轮对话,眼镜里达到 40–50 轮,目前 15% 购买者是非理想车主。
Dify 创始人路宇在播客中复盘了 Dify 从被低估到成为最知名开源项目之一的两年历程,谈及如何应对 LangChain、Coze、GPTs、n8n、AgentKit 等竞对轮番登场。他坚持 Workflow 不会被替代,认为最值钱的是工程,并透露 Dify 在几乎零销售的情况下服务多家财富 500 强企业,还在日本市场现象级流行。
小鹏汽车自动驾驶中心负责人刘先明在上任后首次专访中称,团队把 VLA 中的 Language 直接拆掉,输入 V-L 联合语料、直接输出 Action,认为掺入 Language 会让模型效率极低。他于 2025 年 10 月 9 日接任该职位,此前小鹏已陆续拆掉激光雷达、规控规则和端到端。访谈还谈及小鹏向物理 AI 战略转型、换帅背后的阻力,以及明年对 L4 的规划。
百度智能云 AI 计算首席科学家王雁鹏在播客中亲述中国互联网基础设施从大数据、云计算到 AI 时代的演进,并介绍百度已建成国内首个全自研的 3 万卡集群。他谈到中美算力差距为 3 万卡对 10 万卡,电力是万卡集群的巨大瓶颈,一个 3 万卡集群需园区级变电站。他认为中国版英伟达的唯一路径是与最先进模型深度绑定。
Sam Altman 提出 OpenAI 的愿景:打造一座每周能产出 1 吉瓦新增 AI 基础设施的工厂,以支撑模型推理与训练算力需求。他称这一目标需数年才能实现,并要在芯片、电力、建筑到机器人等各层创新,还计划未来几个月公布合作方、今年晚些时候公布融资方式。
Palona AI 联创任川分享称,公司 90% 的代码由 AI 编写,其核心经验是默认由 AI 承担所有研发工作、只要有 SOP 就没有 Claude Code 无法完成的任务,并反直觉地减少人与人之间的交互。他提到 CodeRabbit 可把一次代码审查从 1-2 天缩短到 10 分钟,20 人团队没有一个全职 PM,未来可能没有 Engineer、大家都是 Builder。
极峰科技创始人王筱圃研发时序大模型 Geegobyte-g1 及工业智能体平台「河谷」,其数字工人在垃圾焚烧电厂替代了原先 4 班 3 倒的 4 位师傅,实现无人值守,每年为客户带来 400 到 500 万人民币增量收益。该 Agent 采用「劳务派遣」式按月付费模式,费用远低于被替代的人力成本。
硅谷 AI 叙事核心指标已从 Scaling Law 转向 Token 消耗,行业竞争从比模型更聪明转向拼谁能把已有智能用得更好、更快、更省,Infra 将成为下一个主战场。节目还复盘了 GPT-5 发布、Agent 热潮冷却、Meta 抢人大战等半年变化,并讨论了英伟达估值、A 股牛市与散户角色等二级市场话题。
阶跃星辰联合创始人朱亦博在播客中系统讲述 AI Infra 的定义、衡量指标与投入 ROI,并称 DeepSeek 能冲出来的一大原因是选对了优化目标。他提到阶跃近期开源了推理效率更高的基模 Step 3,团队同时正在招人。
Grasp 创始人雷磊在 42章经播客中判断,Agent 热潮之后下一波机会可能出现在 Agent Infra,即给 Agent 用的 SaaS。