GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 密集发布:大模型进入“斩杀线”大战
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向“便宜且够用”的斩杀线。播客还讨论了常驻云端 Agent、Token 作为新货币的生意逻辑,以及 AI 原生组织要求人人完成从需求到发布的闭环。
离开深耕 15 年的 VC 行业后,前美团龙珠合伙人于红创办「兔咚咚」,投身儿童 SEL(社会情感学习)教育。在与十字路口主播 Koji 的对谈中,她围绕 AI 时代的知识获取变化,讨论英语学习价值、批判性思维、情绪能力,以及「把终点放在 30 岁」的养育与人生选择。
开源项目 Vibe-Trading 作者、香港大学在读博士生吴浩哲在播客中提出,金融里决策很便宜、行动很贵,AI Trading 的核心是在近乎免费的决策与代价昂贵的行动之间建立可验证、可审计的通道。Vibe-Trading 开源半年已获 3.4w 个 Star,浩哲还拆解了 AI Trading 的四大组成部分,并认为 Jev 对 Trading 的帮助可能约等于零。
Higgsfield Blog 盘点 2026 年 15 款面向内容创作者的 AI 平台,覆盖策划、生成、剪辑与发布全流程。Higgsfield 以 30+ 模型整合图像、视频与广告制作,起价 $15/mo;Canva 主打日常设计,Descript 与 OpusClip 侧重长视频二次剪辑,HeyGen 与 Synthesia 专注数字人出镜视频。
Next Token 播客第 003 期围绕 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型,讨论竞争焦点从“谁更强”转向能力够用、成本够低与普通人能否体验的“斩杀线”。
清华交叉信息研究院助理教授徐梦迪在播客中提出,机器人可通过 in-context learning(ICL)在新环境中经一两次交互当场学会新任务,且越学越快。她同时讨论了预训练天花板、真正的泛化、Scaling Law 的信号与陷阱,以及数据闭环的“鸡生蛋”难题。
24 岁的深朴智能(Simple AI)首席科学家王家伟,从中科大少年班、MSRA、DeepSeek、字节 Seed 一路走到大模型前沿,毕业后转向具身智能。深朴智能从 HiFi-UMI 数据、具身基础模型、Agentic OS 做到本体,开源 2,000 小时数据、内部积累数万小时,模型已观察到一定的 Zero-shot 泛化。
在2026 Inclusion外滩大会圆桌现场,苏度科技韩铮、蚂蚁灵波沈宇军、自变量机器人王潜、破壳机器人许华哲四位嘉宾围绕具身智能的路线级分歧展开讨论,议题包括仿真与真机数据之争、GPT-6 Astra 是否会对具身行业形成降维打击,以及高成功率、泛化性与客户持续付费等商业化指标。讨论还涉及五年后哪些领域被高估或低估,以及具身智能是否会复刻语言模型的发展路径。
Next Token 播客回顾 8 月 27 日至 9 月 3 日的 AI 新闻,讨论 GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布后,竞争转向“便宜且够用”的斩杀线。节目还探讨常驻云端 Agent、Token 经济,以及 Astra 会用电脑是否算 AGI。
快看漫画创始人兼 CEO 陈安妮在播客中介绍了她正从零打造的 AI Native 产品 Livo,定位为「一个实时活着的 AI 世界」,其中 AI 角色有自己的故事和梦想,产品最重要的功能名为「命运」。她将 Livo 定义为 AI 时代全新的讲故事范式,并称其与斯坦福小镇等模拟世界产品的核心体验不同。
战略学家曾鸣提出 AI 产业化分三阶段,最终进入“原生应用阶段”,并判断 OpenAI、Anthropic 大概率不是该阶段的大玩家。他把模型公司类比为已消失的 AOL,认为其本质是未来的 AI 云公司,商业模式只能是寡头垄断加政府强监管。他还认为未来三年有可能出现 Agent 入口,而科层制公司制度将走向消亡。
数美万物创始人兼CEO任利锋(卷卷)在近3小时访谈中回顾了从0到1孵化抖音的经历,并介绍了公司最新发布的Hi3D 3.0 2048³模型。他将创业目标从Maker OS推向制造业OS,认为基础模型不会吞噬一切,实体制造仍需能产出生产级3D资产的模型,以及拆件、连接结构、材料适配等模型之后的工程能力。
Pyromind 创始人兼 CEO Kevin Ding 在访谈中提出,AI 终局更像 Agent 蜂群而非超级基础模型一统天下,公司押注 AutoRL,把训练、奖励、反馈、部署与数据回流串成自动循环管道。
RoboParty 萝博派对创始人兼 CEO 黄一今年 22 岁,一年内完成 5 轮融资、累计超过 1 亿美元,股东包括知名 VC 以及小米、宁德等产业方。他把这一年形容为“压缩的人生”,称把十年要吃的苦一年吃完。他判断,若把具身智能比作 42 公里马拉松,机器人本体已跑完 1/4,小脑约跑了一半,大脑可能才跑了一两公里。
出生于2009年、现年17岁的高二学生苏庭灏独立完成预训练研究,其关于 Attention 机制的论文《Attention Projection Mixing with Exogenous Anchors》被 ICML 2026 Main Track 接收。他在这期播客中谈到,AI 让同学们感到人生意义感流失,而他选择以"开心是人之根本"自处,从韩国 ICML 回来后即将去农村支教。
英伟达研究副总裁刘洺堉在4小时访谈中详解世界基座模型Cosmos:项目2024年立项,已迭代至Cosmos 3,直属团队不到100人,虚线汇报规模200至300人。他称英伟达不参与存量竞争,黄仁勋要求"做到Cosmos 97",并援引《孙子兵法》"备多则力寡"思考世界模型技术趋势。
Runta 创始人兼 CEO 戴冠兰认为模型能力已经够了,下一场竞争要卷 infra,因为未来 agent 数量会超过人类,关键问题变成它们跑在哪、怎么管、出事谁负责。
Evolvent AI 联合创始人孟繁青在访谈中提出,国内模型真正的特色并非工程化的 Post-training,而是 Pre-training 阶段被资源限制倒逼出的架构创新,蒸馏只是加速手段而非国模变强的决定性因素。
BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中判断,当基础模型趋同、智能开始通胀,AI 应用的新机会藏在 Context 和交互里。他认为 AI 硬件真正稀缺的是产品定义与「注入人性的光辉」,而非华强北 80 块的平替。面对 2026 年的泡沫,他主张投资有愿景的创始人和让人更快乐的产品。
清华大学人工智能学院助理教授、KAN 网络一作刘子鸣在访谈中用"太疯狂了"形容当下 neo labs 融资热潮,他于 3 月回国任教并参与创建元环智能。他指出当前资本涌入最活跃的两个方向是世界模型和 AutoResearch(AI for AI),并梳理了今年中美做 AI for AI 的创业团队与路线。
Inferact 联合创始人兼首席科学家游凯超在访谈中回顾了 vLLM 从伯克利校园开源项目演化为公司的近 3 年历程,Inferact 今年初获得 1.5 亿美元种子轮融资。他谈及开源项目商业化后的抉择与转变,以及 AI Infra 与模型结构、Harness Engineering 联合设计时代下的 Co-design 思路。
Airwallex 空中云汇 CRO 吴恺在播客中回顾公司 11 年从 0 到 110 亿美金估值的历程,并称下一道台阶是从 20 多万客户走向 100 万客户规模。
蚂蚁集团孵化的蚂蚁灵波刚发布第二代具身基础模型,首席科学家沈宇军称具身智能尚未到GPT-1时刻,最大卡点是数据没有scale up,需百万小时起步的数据量。此次发布包含Depth、Vision、VLA、Video、World、VA 2.0六个模型,他预计当具身数据与互联网数据达到相同量级、约明年中才可能迎来GPT-1时刻。
Haiper AI定位产品微动效,速度快(约25-35秒)、价格$15/月,但不支持局部修改、复杂场景画质不如Runway Gen-3、人物视频质量一般。若需更长视频可选Runway Gen-3(10秒)或Luma Dream Machine(约5秒),追求速度可选Pixverse(4秒视频约20-30秒生成),需要品牌级批量生产则可用Lovart Nano Banana Pro。
Lovart 博客发布 2026 年 AI 设计工具选购指南,提出按设计场景、预算和团队规模三步选型,而非给出排名。指南称 Lovart 是唯一具备品牌管理(Brand Kit)的 AI 工具,$20/月的 Lovart Pro 可覆盖图像生成、排版与品牌管理,免费组合 Pixverse + Canva 免费版 + Lovart 免费版可覆盖 80% 日常需求。
生数科技张金涛在播客中介绍其团队月初发布的实时交互视频模型 Vidu S1,上传一张照片即可生成可实时视频通话的 AI 角色,支持无限时长,实现 540P、25–42 FPS 并能在消费级显卡上运行。
这期单口复盘指出,AI 进入第四年,一级市场模型势能达到几年最强,应用市场冷度却跌到谷底,二级市场智谱和 MiniMax 接连上市。作者认为现在是应用创始人历史上最好的时候,建议「随波逐流」——随模型的波、逐资本的流,并提出「今天所有的产品和创始人,都是模型的期权」。
Physical Intelligence(Pi)研究员柯丽一鸣在4小时访谈中详解了Pi从π0到π0.5再到π*0.6的机器人"大脑"开源模型研究思路与技术细节。她主要负责强化学习方向研究,也是Pi核心论文作者之一。嘉宾补充称最新模型π0.7强调统一模型,无需后训练即可媲美以往后训练的通用能力。
英灵殿创始人 Odin 投身 AI for Science 创业,短期内融资数千万美元,目标是打造「全模态分子世界模型」与「通用科学人工智能」,把人类科学进程压缩上百年。团队约 30 人,本科生带做 8 个靶点均产出 sub 纳摩尔级活性分子,他称 AI 是把人类从工程化问题中解放出来。
真格基金「此话当真」与「十字路口」串台播客以一条主线梳理 Agent 元年 500 天:GUI 退场、Headless 上位、CLI 复兴、Skills 封装、Agentic Economy 萌芽。
曾于 2017—2020 年在字节担任招聘负责人、2020—2026 年在美团担任招聘负责人及 AI 产品经理的魏小康,在播客对谈中提出创业公司组织建设 80%-90% 的时间都应花在招聘上,而面试并非人才评估最重要的一环、谈 offer 的重点也不是钱。他认为 OPC 是对时代的浪费,00 后创始人在这一波是吃亏的,并判断招聘工作肯定会 AI 化。他目前正在创业,开发一款 AI 招聘产品。
MiniMax CEO 闫俊杰在 Dev Meetup 上谈 M3 的关键突破、训练 10T 大模型的决心,以及推出 10X 专家合作项目。他称美国模型"基本上大 10 倍",10 倍意味着整整两代,而一个 10T 模型需要 200T 数据。MiniMax 开始招募经济学家、哲学家甚至核物理学家,数据观从标注转向专家知识。
Aether AI 创始人黄碧薇提出「因果世界模型」路线,认为视频生成、3D 生成、JEPA 三条被广泛称为世界模型的路线之外还有第四条。她给 VLA 打 5 分、WAM 打 6.5 分,称 WAM 只是比 VLA 好但注定到不了终点的中间态。Aether AI 近期完成 2000 万美金天使轮融资,将因果 AI 用于 Physical AI 与机器人大脑。
上海交通大学上海高级金融学院金融学教授朱宁在访谈中指出,泡沫可能永远无法被事先证明,但往往伴随四个必要不充分条件,也存在反复出现的见顶信号。他认为「AI 股票还能不能买」本身就是一个错误的问题,真正重要的是想清楚涨跌对自己人生的意义。
播客「十字路口」对谈 Superlinear.Academy 创始人课代表立正,讨论高手与普通人用 AI 的差距:高手把生活和工作的大小事都交给 AI,并建议普通人停止 ChatGPT 式聊天,改用 Codex / Claude Code / Cursor / Manus 等 agentic 工具。
安克创新创始人兼CEO阳萌接受4小时访谈,公司市值超600亿人民币,他1982年生、2011年开始创业。访谈围绕消费电子的死与生、第三类公司、端侧模型、产品方法与游戏模式展开,并谈及高利润公司是否要融资和IPO、AI的组织革命等话题。
OpenAI 和 Anthropic 上月同一天分别宣布各自的十亿美元级企业 AI 合资公司,且都称自己在做 FDE(Forward-Deployed Engineer,前置部署工程师)。十字路口对谈 Rolling AI 合伙人阿甘和刘开,讨论 FDE 是售前交付换名还是 ToB AI 时代的新组织结构,以及 AI 落地失败率超 50% 的三大死法。
小鹏汽车董事长兼CEO何小鹏返场接受第二次访谈,谈及2025年押下更大赌注、人形机器人Iron的诞生故事与去年那场意外,以及新车GX。他称造人形机器人的胜率比造车低得多,并提到"我们有两成胜率"、不能做缝合怪,也坦言对正在发生的事尚有顾忌和不能说的秘密。