2025 AI 现场:从 DeepSeek R1 到 Sora 2,十字路口复盘“拐点之年”
十字路口与庄明浩复盘 2025 年 AI 行业,以“拐点”为年度关键词,梳理从年初 DeepSeek R1 到近期 Sora 2 的模型大战,以及 Manus 引爆的“Agent 元年”。节目还讨论开源生态与人才流向、DeepSeek V3.2 发布后 V4 和 R2 今年或不再出现,并将目光投向资本市场对 AI 的集体狂想。
十字路口与庄明浩复盘 2025 年 AI 行业,以“拐点”为年度关键词,梳理从年初 DeepSeek R1 到近期 Sora 2 的模型大战,以及 Manus 引爆的“Agent 元年”。节目还讨论开源生态与人才流向、DeepSeek V3.2 发布后 V4 和 R2 今年或不再出现,并将目光投向资本市场对 AI 的集体狂想。
明略科技创始人吴明辉在上市前口述19年创业史,公司已于2025年8月29日获境外发行上市备案通知书,不久后将在香港上市。他回顾了从秒针系统、收购Red到2022年最艰难急转的经历,并谈到企业级AI前景:基于公开数据训基础模型、靠卖Token的公司会卷成电费,而握有私有Data的公司才能产生差异化价值,新产品DeepMiner由此而来。
京东健康探索研究院首席科学家王国鑫介绍「京医千询2.0」大模型与「AI医院」的研发应用,该模型实现三大进化:大量使用合成数据并向行业开放可模拟真实医患对话的Agent、单模型内同时支持CT/MRI/X光等影像理解、从简单推理升级为可追溯证据来源的循证推理。京东健康每天有49万次医疗服务咨询,其底气在于拥有实体医疗机构、药品供应链和30分钟送药上门能力。
前作业盒子创始人刘夜创办 VisionFlow,获约 1000 万美元种子轮融资,出资方包括李想、阿里巴巴合伙人曾鸣及语嫣,并推出首款产品 Talkit——一个为口语练习打造的 AI x 3D 虚拟世界。团队自研“世界生成引擎(Gen World Engine)”,称实习生一个月可生成 1000 个 3D 虚拟人。刘夜认为 AI 大模型让诞生于 1980 年的 TBLT 语言学习理论真正迎来春天。
Palona AI 联创任川分享称,公司 90% 的代码由 AI 编写,其核心经验是默认由 AI 承担所有研发工作、只要有 SOP 就没有 Claude Code 无法完成的任务,并反直觉地减少人与人之间的交互。他提到 CodeRabbit 可把一次代码审查从 1-2 天缩短到 10 分钟,20 人团队没有一个全职 PM,未来可能没有 Engineer、大家都是 Builder。
VAST 创始人兼 CEO 宋亚宸在播客中表示,大语言模型已"撞墙"、进化放缓,而 3D 大模型才刚起步,仍是一片蓝海。VAST 最新 3D 生成大模型为 Tripo 3.0,公司同时研发大模型并下场做应用 Tripo Studio,认为纯应用层公司在模型每 3-5 个月迭代一次时几乎难以生存。
OpenAI研究员姚顺雨在3小时访谈中回顾了自己6年的Agent研究,并谈及AI主线程已进入下半场。他认为Agent发展最关键的两个方向是让Agent拥有自己的reward以自主探索,以及Multi-Agent形成组织结构,而最终的智能边界由不同交互方式决定,而非单一模型。
极峰科技创始人王筱圃研发时序大模型 Geegobyte-g1 及工业智能体平台「河谷」,其数字工人在垃圾焚烧电厂替代了原先 4 班 3 倒的 4 位师傅,实现无人值守,每年为客户带来 400 到 500 万人民币增量收益。该 Agent 采用「劳务派遣」式按月付费模式,费用远低于被替代的人力成本。
AI 创业者刘小排认领了 Anthropic 公告中那位每月 200 美元套餐消耗价值 5 万美元 Claude 模型用量的异常账户用户,他累计消耗 77 亿 Token。他借助 Claude Code 独立完成 Raphael AI、AnyVoice、Fast3D 三款产品的洞察、开发与盈利,团队仅六七人,并总结出后台命令、子 Agent 和输出风格三个进阶用法。
月之暗面创始人兼CEO杨植麟在播客中复盘了7月发布的Kimi K2:一个基于MoE架构的开源编程与Agentic大语言模型,重点在token efficiency与Agentic泛化能力,并采用Muon优化器。他谈到Kimi从闭源转向开源,认为基于FLOPs的scaling仍是更有效路径,多模态不应损伤"脑子"。
硅谷 AI 叙事核心指标已从 Scaling Law 转向 Token 消耗,行业竞争从比模型更聪明转向拼谁能把已有智能用得更好、更快、更省,Infra 将成为下一个主战场。节目还复盘了 GPT-5 发布、Agent 热潮冷却、Meta 抢人大战等半年变化,并讨论了英伟达估值、A 股牛市与散户角色等二级市场话题。
硅谷模型公司本季度开始分化:Google Gemini 和 OpenAI 继续做通用模型,Anthropic 转向 Coding 与 Agentic 能力,Thinking Machines 转向多模态原生。
俄亥俄州立大学在读博士郑博元逐段解读 Kimi K2、ChatGPT Agent、Qwen3-Coder 三份技术报告及 Manus 技术博文,对比其 Agent 技术路线。内容涵盖 Agent 的感知与行动定义、Coding/Search/Tool-Use/Computer Use 四类划分,以及合成数据、强化学习、安全三大训练环节。
清流资本创始合伙人、百度前技术VP梦秋在播客中与张小珺catch-up,直言2025年资本寒冬未过,DeepSeek的出现也没让AI应用创业变活跃。她点评了微信、元宝和小红书的Bot体验,并探讨微信里如何做Agent、通用Agent是否成立、垂直Agent的创业机会,以及具身智能、可穿戴设备和大模型公司等方向。
奔驰中国自动驾驶与车联网研发负责人王忻在访谈中回顾了过去20年全球汽车产业的几个技术周期,并谈及中国团队与德国总部的话语权争夺与battle机制。他透露去年从规则算法切换到端到端的过程相当煎熬,并提到CLA与豆包合作大语言模型。
Grasp 创始人雷磊在 42章经播客中判断,Agent 热潮之后下一波机会可能出现在 Agent Infra,即给 Agent 用的 SaaS。
Sam Altman 在博文中称人类已越过事件视界,接近造出数字超级智能,GPT-4 和 o3 背后的科学洞见是最难的部分且已过去。他预测 2025 年出现能完成真实认知工作的智能体,2026 年出现能产生新洞见的系统,2027 年可能出现能在现实世界执行任务的机器人。他还提到一次 ChatGPT 查询平均耗电约 0.34 瓦时、耗水约 0.000085 加仑。
Lovart 创始人陈冕在播客中复盘创业两年:2023 年 6 月至 9 月三个月烧掉 200 万美金,产品前一秒拿下中国第一、下一秒被下架并裁员,公司账上只剩 4000 块。2024 年他一个月完成一轮融资、连续 close 3 轮,随后预研第二代产品 Lovart,这款面向设计师的垂直 Agent 在 2025 年走红,成为继 Manus 之后又一获得全球知名度的 Agent。
阶跃星辰首席科学家张祥雨在播客中回顾多模态研究10年历程,并预判未来两年将出现2个“GPT-4时刻”。他透露训练中发现模型推理能力(尤其数学)随规模先升后降,认为这是next token prediction的本质缺陷,解决方案是引入RL。他还提出o1范式本质是Meta-CoT,下一个“GPT-4时刻”指向模型的在线学习与自主学习。
绿洲资本合伙人张津剑在播客对谈中提出,世界正加速分化,根源在于注意力失控,而注意力是大脑进化出的主动滤波器。他认为 Agent 是一场感知革命,AI 能处理的模态和频谱理论上无限,人类因有限性进化出的审美成为 AI 时代最核心的价值。
AI应用创业者、YouWare创始人明超平在3小时访谈中提出,今天的Agent就像大猩猩刚拿起一根烧火棍。他认为AI时代关键指标之一是"token消耗速度",要追求"per token valuation",并称Coding的发展与当年Camera类似,催生了"Vibe Coder(氛围编程师)"这一新人群。
Sheet0 创始人王文锋在播客对谈中提出,Agent 的三要素是 LLM、Context 和 Tool Use,并梳理了 Function Call、MCP、A2A、Computer Use、Browser Use 等工具调用方案的差异与优劣。他认为脱离 RL,Agent 就不成立,并称 AI Coding 是大模型的「灵巧手」。Sheet0 已开放 waiting list 申请,即将内测。
清华大学交叉信息研究院助理教授、前 OpenAI 研究员吴翼在播客对谈中系统讲解了强化学习(RL)原理、RL 与 LLM 的结合路径及行业非共识。他提出 Intelligence = LLM(理解)× RL(决策),并指出 RL 三大分支为泛化(DeepSeek)、代码(Anthropic)、Agent(OpenAI)。
广密在《全球大模型季报》2025年Q1特辑中重新坚信Pre-training,认为只有预训练决定模型内在上限,Post-training+RL只是加强。他提出AGI主线是智能提升,ChatGPT只是山脚第一站,接下来Coding、Coding Agent、General Agent、AI for Science、Robotics才是后续山头,并称Manus平均消耗70-80万Token。
连续创业者肖弘在访谈中回顾从 Monica.im 到即将发布的 Agent 产品 Manus 的思考历程,称新产品是"国内 Agent 的第一枪",并提到自己正经历"制造生命一样"的 A-ha moment。他总结 DeepSeek 全球爆火而 OpenAI o1 错过的产品逻辑,认为 Founder 应以博弈而非逻辑推理的方式思考,让自己成为博弈中的重要变量。
心影随形 CEO Binson 在播客访谈中回顾车祸后住进 ICU 六天的经历,以及这段经历如何改变他经营公司的方式。他此前历任百度副总监、360 助理总裁、bilibili 副总裁,其公司推出的 AI 桌宠软件逗逗游戏伙伴已有 600 万用户规模。他还谈到 LLM 进展超出预期、多模态不及预期,并判断今年会陆续有一批 AI 公司被淘汰。
前 Meta 应用强化学习组负责人、Pokee AI 创始人兼 CEO 朱哲清提出一种"RL 做核心、LLM 做翻译"的 Agent 架构,认为直接用 LLM 做不出规划型 Agent。其团队已在电商领域做出通用型 Agent,通过 self-play 让 Agent 学会调用上千个底层 API,体验相当于一名资深网站负责人,且训练与推理成本都很低。
42章经在年终复盘播客中判断,25 年将是 AI 爆发的一年,还没进场的人当下可能是最好的机会。复盘认为 24 年 1-9 月一级市场为过去十年最差,但 9 月后融资市场明显复苏、多模态能力持续加强、AI 创始人画像明显变化,构成乐观理由。展望 25 年,市场关键词从 23 年「大模型」、24 年「具身智能」转向「应用落地」,最看好 Prosumer、Agent 和多模态。
前 Character.ai 模型应用算法专家 Ted 在播客中复盘了 C.AI 的 Post Training 实践,称其核心是设计高效的迭代路径,主要依赖 SFT、RLHF、DPO 三大件,RAG 和 Prompt Engineering 几乎没做。他还提到 C.AI 的语音延迟基本是业界做得最好的,并观察到 ChatGPT 内部也是多模型混用、硅谷 Post-train 人才极其抢手。
EVE 创始人 Tristan 在播客中表示 Character.ai 类产品根本不算真正的陪伴,并介绍了 EVE 的实现方式:用 128 个记忆槽位区分被动记忆与主动记忆,以十几个模型搭建工程管线解决长期记忆问题。他将 AI 陪伴的核心要素归纳为超级对齐、真实时空感知、独立人格与荷尔蒙钩子,并称《奇点时代》一年流水 2 亿。
Gru.ai 创始人张海龙在播客对谈中复盘 AI Coding 现状:Coding Copilot 已明确跑通 PMF,Github Copilot 是赛道老大哥,Cursor 靠大胆创新成为新晋顶流,而 Devin 等 Agent 产品有声量无留存,Agent 尚未找到 PMF。他认为国内 AI Coding 不温不火,海外则在 PMF 之前就已开卷,并坚定认为 AI 替代不了人类程序员。
高途 AI 提效与创新产品负责人封诚在播客中披露,AI 在获客、转化、交付三环节中转化端价值最大,可稳定提效至少一倍,成单率提高 3-4 倍。他认为提效本质是给金牌销售配一堆助理,并称招人时让懂 AI 的人学业务好过让懂业务的人学 AI。
心识宇宙创始人陶芳波在播客中提出,个人模型可能是下一个十年的“个人计算机”,未来大模型将像个人电脑一样走向去中心化。他回顾了从 MindOS 到 Me.bot 的产品思路转变,认为 bot 是 AI 的最小基础单元,并分享了团队在 AI 记忆训练方法上的新进展。
Character.AI 被收购并非陪聊产品不成立,而是其官网第一篇文章的第一句话就注定了结局。Scaling Law 的本质是规模效应,拼的是资源整合与融资能力,大模型是一场拼爹游戏。这次收购宣告底层大模型战争几乎结束、模型注定商品化,做产品的人可以安心拥抱开源。
创新工场合伙人汪华将 AI 发展划分为三个阶段:交互革命(移动互联网级别,100% 能实现)、复杂任务自动化(蒸汽机级别,50% 概率能实现)和 AGI(智人走出非洲级别,不造能否实现)。他认为判断 AI 能否达到第二阶段大概只需观察 3-4 年,并预测明年上半年 GPT-4 级别的模型一个 DAU 大概只要几分钱。
42章经创始人曲凯在播客中复盘 AI 市场,称今年上半年一级市场之差是十年所未见,但全球华人创业者做的 AI 公司中有 PMF 的不超过 30 家。他认为一线大模型领先优势不断拉大,做大模型没有先发优势,做应用则可能靠数据与认知建立先发优势,并称市场远远低估了 AI coding 的想象空间。
42章经创始人曲凯对谈光年之外产品负责人张涛(Hidecloud),探讨 AI 产品经理的招人、培养与画像,以及 AI Native 公司的组织调整。Hidecloud 判断文字和图像模型已完全够用,多模态模型还需 3-6 个月成熟,并高度看好陪伴类 AI,认为今年 toB、toC 都会出现现象级产品。
澜码创始人周健在播客对谈中判断,24 年会迎来 2B AI 应用的爆发,他认为国内的市场、客户、钱和技术都已到 ready 状态,缺的是更多人进来做产品打通市场需求。周健曾任职阿里云、依图与弘玑 RPA,去年初开始做 AI Agent 2B 创业,他不看好 RPA + AI 的结合,并指出企业算力管理会是极大刚需。
OpenAI 发布新成果,用其发明的通用强化学习算法 PPO 训练一支 5 个智能体的队伍玩 Dota,并击败了半职业选手。这些智能体对两周前的旧版本胜率稳定在 90-95%,训练过程没有使用人类对局数据,而是通过自我对弈学会游戏。Sam Altman 认为这表明只要有足够算力和能还原问题的模拟环境,深度强化学习就能解决极难的问题,并有望应用于更接近真实世界的环境。
推荐理由:OpenAI 用 PPO 训练 5 个智能体在 Dota 中击败半职业选手,可了解自我对弈与算力规模在复杂决策任务中的作用。