跳到正文

#Google

今日 0 条
9月29日周二
  1. Google Gemini 博客62

    Google 展示开发者用 Gemini 3.8 Flash 做的四个项目

    Google 介绍开发者用 Gemini 3.8 Flash 构建的实验项目,包括卫星与轨道火箭路径模拟、将日本传统青海波纹样转成动态水墨画、用四阶段提示词生成霸王龙骨架,以及从零搭建自动变速箱交互模型。

    推荐理由:官方给出 Gemini 3.8 Flash 相对 3.7 Flash 的能力提升方向,并附四个开发者实测案例,可据此判断它在复杂多步任务上的表现。

9月28日周一
  1. Google Gemini 博客12

    Edy's Grocer 如何用 Gemini 为 200 位客人备餐:3 种用法

    布鲁克林 Edy's Grocer 店主 Edy Massih 用 Gemini 将家族黎巴嫩菜谱按需放大为大型宴会批量配方,避免手工换算香料与糕点比例出错。Gemini 还能把活动菜单转成分区采购清单、汇总共用食材并提前排好备餐日程,同时为无麸质、无坚果等饮食限制提供保留风味的替换方案。Edy 表示 Gemini 让他减少行政事务,把更多时间用于推广黎巴嫩饮食文化。

9月24日周四
  1. Google Gemini 博客71

    Google 发布 Gemini 3.8 Live with Live Avatar

    Google 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力结合,为对话模型带来近实时的视觉形象。该功能支持精确唇形同步、自然表情与流畅轮次切换,并可在对话中异步调用工具、在后台获取数据。它支持 97 种语言的原生语音到语音同步,输出均带 SynthID 水印,现已在 Gemini Enterprise 提供,自定义形象仅限企业白名单申请。

    推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解多模态对话在企业场景中的落地形态与开放范围。

9月23日周三
  1. Google Gemini 博客72

    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:两款 TTS 模型把语音生成从固定音色扩展到自然语言定制与逐句导演,并给出基准排名和开放入口。

9月22日周二
9月21日周一
9月18日周五
  1. Google Labs 博客66

    Google Labs 将 CC 扩展为面向家庭的 AI 智能体

    Google Labs 推出面向家庭的新版 CC 智能体,拥有独立 Google 账号和明确权限模型,最多支持六名成员协作。CC 只读取成员主动共享的信息,自动整理成共享每日简报并接入 Calendar 和 Tasks,还能在授权下填写许可单、活动报名 PDF 等事务。

    推荐理由:Google Labs 把个人智能体 CC 扩展为家庭共享形态,读者可了解其权限模型与共享记忆的具体设计。

9月17日周四
9月16日周三
  1. Google Gemini 博客22

    用 Gemini 处理家务的 4 种方式

    Google 博客介绍用 Gemini 处理家务的 4 种方式:借助 Gemini Live 摄像头排查家电故障、定制膳食计划与购物清单、上传收据照片整理家庭开支,以及对比家庭用车等大额采购。

9月15日周二
9月11日周五
  1. Google Labs 博客36

    Google Labs 的 Dreambeans 向美国所有账号开放

    Google Labs 的 Dreambeans 现已向美国所有账号(18+)开放,支持 Android 和 iOS。该实验功能结合个性化主题与用户选定的 Google 应用(Calendar、Gmail、Photos、Search、YouTube,以及新增的 Gemini)生成每日故事集,连接 Google Photos 后还可融入用户及亲友的影像。

  2. Google Gemini 博客60

    Google 为 Windows 推出 Gemini 桌面应用

    Google 发布 Windows 版 Gemini 桌面应用,Windows 10 和 11 用户可在 gemini.google/desktop 下载,全球同步上线。

    推荐理由:官方给出 Windows 端 Gemini 的快捷键入口、智能体与图像视频生成能力,可据此判断桌面工作流的变化。

9月10日周四
  1. Google Gemini 博客24

    Gemini 处理行政事务的 4 种方式

    Google 博客介绍 Gemini 处理行政事务的 4 种用法:填写表格与缴费、参与公民事务、查找政府机构与法规、申请社会服务。Google 的 AI & Economy ATLAS v1.0 研究显示,约 40% 用 Gemini 处理公民事务的人咨询此类问题,26% 用于了解政府事务,超 16% 用于查找机构,超 15% 用于社会服务,近半数对话发生在非标准工作时间。

9月9日周三
9月5日周六
  1. Google Gemini 博客60

    Google 在 Gemini 中上线 Lyria 3.5 音乐生成模型

    Google 在 Gemini 应用和 Gemini API 中上线音乐生成模型 Lyria 3.5,官方称其音质表现最好,人声更具表现力、编曲更丰富。Gemini 应用内支持选择或描述曲风、在带人声与纯器乐之间切换,并提供从背景音乐到生日定制曲的模板,还可选择短曲或长曲。

    推荐理由:Lyria 3.5 在音质、人声表现和编曲丰富度上的升级,以及它在 Gemini 应用与 API 中的开放范围,可供读者判断音乐生成能力当前所处的位置。

9月2日周三
  1. Google Gemini 博客66

    Google 推出 Fairwind Program,向政府与企业提供 Gemini 3.8 Flash Cyber 网络防御能力

    Google 推出 Fairwind Program,这是一个面向政府、Google Cloud 客户和网络安全合作伙伴的受限访问计划,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,用于自主发现、验证并修复漏洞。

    推荐理由:Google 把前沿模型与自动修复工具打包成受限访问计划,读者可了解其面向政府与关键基础设施的准入方式。

  2. Google Gemini 博客85

    Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber 两个变体,前者面向长程编码与自主智能体,后者面向漏洞发现与自动修复。

    推荐理由:官方给出 3.8 Flash 与 Cyber 两个变体的定价、基准表现和开放入口,可据此判断长程编码与安全场景的选型。

9月1日周二
8月31日周一
8月28日周五
  1. Google Gemini 博客76

    Google 发布 Gemini Omni 1.1 Flash,强化生成视频控制能力

    Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者提供场景延长、首尾帧插值、360p 快速预览和最高 4K 放大等生成视频控制能力,通过 Gemini API 在 Google AI Studio 上线。

    推荐理由:官方给出场景延长、首尾帧插值与 4K 放大等具体能力,读者可据此判断生成视频工作流的可控性变化。

8月27日周四
8月25日周二
7月30日周四
  1. Google Labs 博客58

    Google 发布音乐生成模型 Lyria 3.5,上线 Flow Music

    Google 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升:可生成更丰富自然的旋律结构,歌词质量与提示词遵循度、结构感知更好,人声更具表现力和情感且发音改善,同时更易控制输出的节奏与时长。

7月28日周二
6月5日周五
6月4日周四