Google 如何用 Gemini 打造 Google I/O 2026
Google 用 Gemini 系列模型完成了 Google I/O 2026 的短片、视觉品牌与预热节目制作。
Google 用 Gemini 系列模型完成了 Google I/O 2026 的短片、视觉品牌与预热节目制作。
Google 为 Google Flow 和 Google Flow Music 推出多项新能力:Gemini Omni Flash 模型支持从任意输入生成内容并实现精准视频剪辑,Flow Agent 可协助头脑风暴、批量编辑和整理素材,Flow Tools 让用户用自然语言创建并分享自定义工具。
推荐理由:Google Flow 一次性补齐智能体、自然语言建工具和移动端,读者可据此判断 AI 创作工具正从单点生成走向全流程协作。
Manus 上线 Higgsfield MCP 连接器,让创作者在保留 Higgsfield 专业视觉生成控制的同时,把生成结果接入 Manus 的创作与交付流程。用户可选择图片或视频模型、加入参考素材、设定输出数量、画幅或视频时长,并支持读取历史生成结果。该连接器现已向拥有 MCP 连接器访问权限的用户开放,具体可用性取决于工作区配置和已连接的 Higgsfield 账户。
字节 Seed 发布论文 Seedance 2.0,主题为面向世界复杂度的视频生成,原文链接为 https://seed.bytedance.com/zh/public_papers/seedance-2-0-advancing-video-generation-for-world-complexity。
Figma Design 和 Figma Draw 现已支持在画布上直接播放视频。该功能属于 Figma 本次更新的一部分,同期还上线了 auto layout 垂直换行、文件夹内容预览、Weave 工具发布至 Figma Community 等多项更新。
ChatCut 创始人李凯文在播客对谈中提出,视频剪辑正迎来自己的「Cursor 时刻」,但他坚持「不生成任何像素」,让 AI 作为剪辑助理工作在编辑器之上,服务「还不是剪辑师」的人群。他认为视频是 token 黑洞,多模态理解尚不足以精确到剪辑层面,Gemini 2.5/3.0 已带来巨大帮助,MG 动画能力很大程度来自 3.0。
OiiOii 创始人闹闹在十字路口播客中判断,2026 会是 AI + 视频的「大年」,将诞生很多新独角兽。她透露 OiiOii 两个月内重构四次架构,从「首尾帧」流派转向全面拥抱 Sora 2,并认为即使 Sora 到 4.0/5.0,Agent 产品也不会消亡,反而会更繁荣。她曾任微信、字节跳动核心产品线,做过 QQ 邮箱、剪映和抖音特效。
酱油(黄浩南)今年 9 月 all in AI 漫剧,团队已扩张到 1000 人、流水突破 5000 万,抖音播放量破亿的 22 部漫剧中 5 部出自其手。他拆解了这条流水线:行业均价 1000 元/分钟,他做到 1500 元/分钟,因为别人抽 40 张图、他要抽 160 张以上,成本中人工占 60%、算力 20%、剧本 15%、配音 5%。
ONE2X联合创始人兼CEO王冠在访谈中提出,AI时代的公司最终都是生成系统公司,生成系统与推荐系统的本质区别是"没有中间商赚差价"。这位前Kimi模型产品负责人还讨论了数据是智能的第一性原理、应用公司与模型公司边界将变得模糊,以及权力重心向消费者端渗透后平台与创作者的演变。
OpusClip 前增长产品负责人谢君陶在分享中,从获客、转化、留存、洞察四个维度拆解了这款 AI 视频产品的增长框架。他提出冷启动阶段第一批用户应是 Partners 而非 Affiliates,并复盘了 OpusClip 如何与创作者形成利益共同体、如何通过定价策略和 AB Test 驱动转化与留存。他还透露了 OpusClip 的增长团队架构,并指出绝大多数 AI 产品仍有较大涨价空间。
OpenAI 的 Sam Altman 发布 Sora update #1,宣布即将对 Sora 做两项调整。
OpenAI 发布新模型 Sora 2 和配套应用 Sora,让用户更容易创作、分享和观看视频,并支持通过 cameo 功能把自己和朋友放进视频中,团队在角色一致性上投入了大量工作。
推荐理由:OpenAI 同时发布 Sora 2 模型与 Sora 应用,并公开了产品设计原则与对成瘾、霸凌等风险的顾虑。