Google 如何用 Gemini 打造 Google I/O 2026
Google 用 Gemini 系列模型完成了 Google I/O 2026 的短片、视觉品牌与预热节目制作。
Google 用 Gemini 系列模型完成了 Google I/O 2026 的短片、视觉品牌与预热节目制作。
Google 在 I/O 2026 上公布 12 项主要更新,包括新模型 Gemini Omni 与 Gemini 3.5 Flash。
推荐理由:Google I/O 2026 一次性放出 Gemini Omni、3.5 Flash 与 Search 智能体等 12 项更新,可据此判断其产品线走向。
Google 为 Google Flow 和 Google Flow Music 推出多项新能力:Gemini Omni Flash 模型支持从任意输入生成内容并实现精准视频剪辑,Flow Agent 可协助头脑风暴、批量编辑和整理素材,Flow Tools 让用户用自然语言创建并分享自定义工具。
推荐理由:Google Flow 一次性补齐智能体、自然语言建工具和移动端,读者可据此判断 AI 创作工具正从单点生成走向全流程协作。
Google 在 I/O 2026 发布 Gemini 3.5 Flash,官方称其对比 3.1 Pro 在几乎所有基准上更好,输出速度是其他前沿模型的 4 倍,价格不到同类前沿模型的一半,即日起在 Google 全线产品与 API 提供,Gemini 3.5 Pro 将于下月推出。
推荐理由:Google 一次性放出 Gemini 3.5 Flash、Gemini Omni 与 Antigravity 2.0,读者可据此判断其智能体产品线的整体走向。
Google DeepMind 为实验性原型 Project Genie 推出 Street View 实景锚定能力,用户可选取美国地点并搭配风格与角色描述,生成起点绑定真实街景的互动世界,该能力由 Maps Imagery Grounding 技术驱动。
推荐理由:官方说明 Genie 接入 Street View 实景锚定,读者可了解世界模型如何为智能体与机器人提供贴近现实的环境。
Google 公布 4 月 AI 更新,包括开源模型 Gemma 4、自主研究智能体 Deep Research Max 和 Colab 的 Learn Mode。
字节 Seed 发布论文 Seedance 2.0,主题为面向世界复杂度的视频生成,原文链接为 https://seed.bytedance.com/zh/public_papers/seedance-2-0-advancing-video-generation-for-world-complexity。
OpenAI 发布 GPT-4o,Sam Altman 表示已在 ChatGPT 中免费提供这一模型,且不含广告。他称新的语音与视频模式是自己用过最好的计算机界面,达到接近人类的响应速度和表现力,并提到后续会加入可选个性化、访问用户信息以及代为执行操作等能力。
推荐理由:OpenAI 官方说明 GPT-4o 免费开放与语音视频模式,读者可了解其能力定位与商业化取舍。