大模型进入“斩杀线”大战:GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 与 Token 新货币
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向能力够用、成本够低、普通人能否真正体验的“斩杀线”。
GLM 5.3 Flash、Qwen 3.8 Flash Next、MiniMax H3 等新模型密集发布,把竞争焦点从“谁更强”推向能力够用、成本够低、普通人能否真正体验的“斩杀线”。
快看漫画创始人兼 CEO 陈安妮在播客中介绍了她正从零打造的 AI Native 产品 Livo,定位为「一个实时活着的 AI 世界」,其中 AI 角色有自己的故事和梦想,产品最重要的功能名为「命运」。她将 Livo 定义为 AI 时代全新的讲故事范式,并称其与斯坦福小镇等模拟世界产品的核心体验不同。
Higgsfield 发布 AI 原生 3D 工作空间 3D Jutsu,可将提示词或参考图生成含物体、布局、灯光、相机与动画的可编辑 3D 场景,并直接在同一对话中渲染成视频。
推荐理由:官方给出 3D Jutsu 的场景搭建、编辑与导出流程,可据此判断提示词到 3D 预演再到视频的工作方式。
战略学家曾鸣提出 AI 产业化分三阶段,最终进入“原生应用阶段”,并判断 OpenAI、Anthropic 大概率不是该阶段的大玩家。他把模型公司类比为已消失的 AOL,认为其本质是未来的 AI 云公司,商业模式只能是寡头垄断加政府强监管。他还认为未来三年有可能出现 Agent 入口,而科层制公司制度将走向消亡。
Google 推出 Fairwind Program,这是一个面向政府、Google Cloud 客户和网络安全合作伙伴的受限访问计划,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,用于自主发现、验证并修复漏洞。
推荐理由:Google 把前沿模型与自动修复工具打包成受限访问计划,读者可了解其面向政府与关键基础设施的准入方式。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber 两个变体,前者面向长程编码与自主智能体,后者面向漏洞发现与自动修复。
推荐理由:官方给出 3.8 Flash 与 Cyber 两个变体的定价、基准表现和开放入口,可据此判断长程编码与安全场景的选型。
Meta 发布 Muse Spark 1.3,在智能体与编码任务上性能提升,max reasoning 版本已在 Muse Code 和 Meta Model API 上线。
推荐理由:官方给出智能体与编码任务的改进细节和工具调用、token 消耗降幅,可据此判断长任务工作流的变化。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,通过原生视频工具动态搜索、扫描和检查目标片段,替代固定帧率的静态处理。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明在长视频场景下与静态逐帧处理的差异。
Manus 宣布已正式恢复独立运营,创始团队将继续领导公司,并作为独立运营的 AI Agent 实验室推进通用 AI Agent 的能力与产品。部分用户此前需备份和恢复数据并经历访问临时中断,官方提供了恢复入口,恢复没有截止日期,未受影响的用户无需操作。Manus 表示后续会更深入融入日常工作流程、更直接地与周围世界互动,并更主动地代表用户采取行动。
Pyromind 创始人兼 CEO Kevin Ding 在访谈中提出,AI 终局更像 Agent 蜂群而非超级基础模型一统天下,公司押注 AutoRL,把训练、奖励、反馈、部署与数据回流串成自动循环管道。
Google 发布 Gemini 3.5 Transcribe 语音转文字模型,可通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 使用。
推荐理由:官方给出流式与非流式两档 WER 数字和相对 Chirp 3 的延迟提升,便于判断语音转写在实际管线中的可用性。
Google 为 Gemini Live 推出生产力升级,加入 Personal Intelligence、Daily Brief、Spark 和免手操作收件箱等功能。
推荐理由:官方说明了 Gemini Live 接入 Spark 后的多步任务与跨应用记忆能力,可据此判断语音助手的任务边界变化。
Figma 桌面端(macOS 和 Windows)现已支持把 agent 聊天面板打开为独立新窗口,可移动到屏幕任意位置,并在使用其他工具或切换标签页时保持可见。该功能随 Figma AI 更新发布。
Higgsfield 推出独立工具 Faceless Studio,可在三步内生成 1 至 5 分钟的无露脸 YouTube 动画视频,一次输出脚本、配音、2D/3D 动画、音乐和字幕。
Figma 在 auto layout 垂直流中新增垂直换行(Vertical wrap),溢出内容会折入新列而非超出画框,行为对齐 CSS flexbox。该更新于 9 月 25 日发布,用于构建随内容增删自动保持响应的多列布局。
Meta 公布 Muse Spark 1.2 的新评测结果与演示,展示其在视觉编码、图表理解、视觉推理和知识密集型任务上的表现,并称多模态提升在模型可调用工具时最明显。该模型支持将图像或视频转为可运行代码、面向机器人的空间智能与音视频理解,已上线 Meta Model API 和 Muse Code,官方同时预览了内部评测 WildArtifactBench 并放出 10 个任务。
推荐理由:官方给出 Muse Spark 1.2 在多模态任务上的新评测与演示,可了解其在视觉编码、机器人和音视频理解上的能力边界。
Higgsfield MCP 将 Higgsfield 的图像、视频和音频模型接入 Claude、ChatGPT 等 AI 对话,营销人员可在聊天中直接生成广告创意。
Higgsfield 把 AI 视频生产组织成固定流水线:Cinema Studio 4.0 负责生成,Soul ID 训练角色一致性,Supercomputer 批量出片,MCP 与 CLI 接入现有流程。
Higgsfield MCP 与 Supercomputer 新增 Faceless Content Factory 和 UGC Factory 两项技能,前者可将一个主题生成最长 10 分钟的动画 YouTube 视频,后者能基于产品创意生成创作者出镜的竖版广告,同一虚拟形象贯穿全片。
Figma 在 Release Notes 中上线资源推荐功能,让用户推荐希望他人发现和使用的资源。该更新与 Figma Design、Figma Weave、Figma Community 等近期发布同批列出,具体入口与使用方式未在正文中展开。
Higgsfield 发布 2026 年 TikTok AI 内容制作指南,覆盖 AI influencer、数字人播报、Shorts 剪辑、品牌广告等五种格式,分别对应 AI Influencer Studio、Soul ID + LipSync Studio、Shorts Studio、Marketing Studio 等工具。
Figma 发布文本换行(text wrap)功能,让文本在不同屏幕尺寸下自适应排版。该功能随 Figma Design 更新推出,具体版本与可用范围原文未披露。
Figma 的 agent 现已支持从 Figma Community 试用技能,并让用户自行创建技能。此前在 Config 上线的自定义生成式插件与 shader 能力同步扩展,新增动画与交互式 shader、社区发布、组织内发布、代码查看器,并可通过 Figma 的 MCP server 让第三方 agent 查看和修改这些插件与 shader。
Figma 的 MCP server 现已支持通过第三方 agent 查看和修改生成式插件与 shader。此前 Figma 已上线 Figma node,可将 Figma Design 中的 frame 粘贴进 Weave 工作流并保留字体、布局与样式;Weave 工具也已可发布到 Figma Community,但仅图像和矢量生成类工具能在 Figma Design 中使用。
Manus 宣布即将恢复以独立公司形式运营,作为与 Meta 分拆的一部分并遵守特定司法辖区监管要求,部分用户在 2025 年 12 月 29 日当天或之后产生的数据将于 2026 年 8 月 23 日 08:00 起至 8 月 24 日期间(SGT)被删除。
推荐理由:官方说明了分拆后部分用户数据的删除与备份时间窗口,受影响用户可据此安排备份。
Meta Superintelligence Labs 发布 Muse Glimmer,一个 30B 参数的开源智能体模型,权重以 Apache 2.0 许可在 Hugging Face 开放下载。
推荐理由:Meta 开源 30B 端侧智能体模型,量化后可在单张消费级 GPU 上运行,读者可据此判断本地智能体的可行边界。
Runta 创始人兼 CEO 戴冠兰认为模型能力已经够了,下一场竞争要卷 infra,因为未来 agent 数量会超过人类,关键问题变成它们跑在哪、怎么管、出事谁负责。
Figma 在 Release Notes 中更新了 AI credit 的用户额度与 credit 申请机制。该条目与同期发布的 Weave 工作流、生成式插件与 shader 等 AI 功能更新一并列出,具体额度数值与申请方式未在页面摘要中给出。
Meta 发布终端编码智能体 Muse Code(beta),由新模型 Muse Spark 1.2 驱动,可在 macOS 或 Linux 安装,面向大型代码仓库的规划、写码与结果验证,并能协调多个常驻子智能体。
推荐理由:官方披露了 Muse Spark 1.2 的编码训练重点与 Muse Code 的运行时设计,可据此判断终端编码智能体的工程取舍。
Figma 更新文件夹 UI 与功能,文件夹现在可预览内部文件、颜色区分更明显,并支持文件夹及其内容整体复制,该改动已面向所有套餐用户上线。此前 Figma 还上线了 auto layout 垂直流下的 Vertical wrap,溢出内容会换列而非撑出画框,行为对齐 CSS flexbox。
BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中判断,当基础模型趋同、智能开始通胀,AI 应用的新机会藏在 Context 和交互里。他认为 AI 硬件真正稀缺的是产品定义与「注入人性的光辉」,而非华强北 80 块的平替。面对 2026 年的泡沫,他主张投资有愿景的创始人和让人更快乐的产品。
Airwallex 空中云汇 CRO 吴恺在播客中回顾公司 11 年从 0 到 110 亿美金估值的历程,并称下一道台阶是从 20 多万客户走向 100 万客户规模。
蚂蚁集团孵化的蚂蚁灵波刚发布第二代具身基础模型,首席科学家沈宇军称具身智能尚未到GPT-1时刻,最大卡点是数据没有scale up,需百万小时起步的数据量。此次发布包含Depth、Vision、VLA、Video、World、VA 2.0六个模型,他预计当具身数据与互联网数据达到相同量级、约明年中才可能迎来GPT-1时刻。
Manus 发布 Plan Mode,在开始构建前先暂停并生成一份包含目标、步骤和约束的 Markdown 计划,用户可编辑并确认后 Manus 才按计划执行。该功能为手动启用,Web 端输入 / 选择 Plan,移动端点击 + 选择 Plan Mode,可在任务中途开启,目前已在 Web 和移动端向所有用户开放。
推荐理由:官方说明 Plan Mode 在执行前插入方案审阅步骤,读者可据此判断它如何改变与智能体协作的流程。
Ascendea 将 Manus 置于三层 AI 员工体系顶层,作为 AI 幕僚长 James 处理战略文件、技术架构等复杂任务,使团队人力产出提升 90 倍。
Manus 推出 PowerPoint 模式,可直接生成原生 .pptx 文件,而非从网页格式转换或导出。图表背后保留可编辑的数据表格,表格为结构化单元格,布局遵循标准幻灯片母版,可在 Microsoft PowerPoint 或 Google Slides 中打开并继续编辑。
推荐理由:官方说明原生 .pptx 输出与图表数据可编辑的差异,读者可据此判断 AI 生成演示文稿的可用性变化。
Meta Superintelligence Labs 发布 Muse Spark 1.1,这是 Muse Spark 的升级版多模态推理模型,面向智能体任务,在工具与电脑操作、编码和多模态理解上有明显提升。
推荐理由:Meta 发布面向智能体任务的多模态推理模型,并首次开放 Meta Model API 公共预览,读者可据此了解其能力定位与接入方式。
Manus 推出 Branch 功能,用户点击消息下方的分支图标即可从该节点开启并行会话,继承此前的指令、文件和对话历史,原始会话保持不变。每个分支携带独立的上下文副本,可从同一条消息多次分支,并支持逐层再分支。该功能面向所有用户开放,适用于标准 Manus 对话会话,暂不支持 Web Builder 会话。
Figma 更新支持同时运行多个 AI 图像编辑任务,用户可在图像加载期间继续设计工作。该功能属于 Figma AI 图像编辑能力的一部分,具体版本号与性能数据未在原文中披露。
真格基金「此话当真」与「十字路口」串台播客以一条主线梳理 Agent 元年 500 天:GUI 退场、Headless 上位、CLI 复兴、Skills 封装、Agentic Economy 萌芽。