跳到正文

#Google

今日 0 条
9月29日周二
  1. Google Gemini 博客62

    Google 展示开发者用 Gemini 3.8 Flash 做的四个项目

    Google 介绍开发者用 Gemini 3.8 Flash 构建的实验项目,包括卫星与轨道火箭路径模拟、将日本传统青海波纹样转成动态水墨画、用四阶段提示词生成霸王龙骨架,以及从零搭建自动变速箱交互模型。

    推荐理由:官方给出 Gemini 3.8 Flash 相对 3.7 Flash 的能力提升方向,并附四个开发者实测案例,可据此判断它在复杂多步任务上的表现。

9月28日周一
  1. Google Gemini 博客12

    Edy's Grocer 如何用 Gemini 为 200 位客人备餐:3 种用法

    布鲁克林 Edy's Grocer 店主 Edy Massih 用 Gemini 将家族黎巴嫩菜谱按需放大为大型宴会批量配方,避免手工换算香料与糕点比例出错。Gemini 还能把活动菜单转成分区采购清单、汇总共用食材并提前排好备餐日程,同时为无麸质、无坚果等饮食限制提供保留风味的替换方案。Edy 表示 Gemini 让他减少行政事务,把更多时间用于推广黎巴嫩饮食文化。

9月24日周四
  1. Google Gemini 博客71

    Google 发布 Gemini 3.8 Live with Live Avatar

    Google 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力结合,为对话模型带来近实时的视觉形象。该功能支持精确唇形同步、自然表情与流畅轮次切换,并可在对话中异步调用工具、在后台获取数据。它支持 97 种语言的原生语音到语音同步,输出均带 SynthID 水印,现已在 Gemini Enterprise 提供,自定义形象仅限企业白名单申请。

    推荐理由:Gemini 3.8 Live 新增实时视频形象能力,读者可了解多模态对话在企业场景中的落地形态与开放范围。

9月23日周三
  1. Google Gemini 博客72

    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向角色设计与深度创作控制,后者面向高并发、低成本的配音与语音智能体场景。

    推荐理由:两款 TTS 模型把语音生成从固定音色扩展到自然语言定制与逐句导演,并给出基准排名和开放入口。

9月22日周二
9月21日周一
9月18日周五
  1. Google Labs 博客66

    Google Labs 将 CC 扩展为面向家庭的 AI 智能体

    Google Labs 推出面向家庭的新版 CC 智能体,拥有独立 Google 账号和明确权限模型,最多支持六名成员协作。CC 只读取成员主动共享的信息,自动整理成共享每日简报并接入 Calendar 和 Tasks,还能在授权下填写许可单、活动报名 PDF 等事务。

    推荐理由:Google Labs 把个人智能体 CC 扩展为家庭共享形态,读者可了解其权限模型与共享记忆的具体设计。

9月17日周四
9月16日周三
  1. Google Gemini 博客22

    用 Gemini 处理家务的 4 种方式

    Google 博客介绍用 Gemini 处理家务的 4 种方式:借助 Gemini Live 摄像头排查家电故障、定制膳食计划与购物清单、上传收据照片整理家庭开支,以及对比家庭用车等大额采购。

9月15日周二
9月11日周五
  1. Google Labs 博客36

    Google Labs 的 Dreambeans 向美国所有账号开放

    Google Labs 的 Dreambeans 现已向美国所有账号(18+)开放,支持 Android 和 iOS。该实验功能结合个性化主题与用户选定的 Google 应用(Calendar、Gmail、Photos、Search、YouTube,以及新增的 Gemini)生成每日故事集,连接 Google Photos 后还可融入用户及亲友的影像。

8月28日周五
7月30日周四
  1. Google Labs 博客58

    Google 发布音乐生成模型 Lyria 3.5,上线 Flow Music

    Google 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升:可生成更丰富自然的旋律结构,歌词质量与提示词遵循度、结构感知更好,人声更具表现力和情感且发音改善,同时更易控制输出的节奏与时长。

7月28日周二
6月5日周五
5月18日周一
5月11日周一
  1. 张小珺Jùn|商业访谈录38

    对姚顺宇的4小时访谈:在Anthropic和Google DeepMind训模型、技术预测与"英雄主义已过去"

    前Anthropic、现Google DeepMind研究科学家姚顺宇在访谈中回顾了参与Claude 3.7、4.5和Gemini 3开发的经历,并直言AI个人英雄主义时代已经过去,如今是集体主义的故事。他还谈及预训练未到头、Coding爆发、"硬蒸"与"聪明的蒸"等技术话题,以及从理论物理转行AI的心路。

4月15日周三
  1. 张小珺Jùn|商业访谈录38

    全球大模型季报第9集:Coding是AGI第二幕、硅谷御三家真相、模型正成为新一代OS

    广密在《全球大模型季报》第9集中判断,Coding把AI从Chatbot第一幕推向能干活的Agent第二幕,是新的"AI加速器",领先的Coding模型就像领先的GPU。他认为Opus 4.5到Opus 4.6是类似GPT-3到GPT-4的跨代际提升,今年6月前可能还有一次同幅度跨越。他还点评了Anthropic、OpenAI、Gemini的内部情况,并指出模型正成为新一代操作系统。

2月9日周一
12月25日周四
12月14日周日
11月28日周五
  1. 张小珺Jùn|商业访谈录40

    对 DeepMind 谭捷的访谈:机器人、跨本体、世界模型与 Gemini Robotics 1.5

    Google DeepMind 机器人团队高级研究科学家谭捷在访谈中介绍了 Gemini Robotics 1.5 的两项关键突破:把 thinking 加入 VLA 模型,以及 cross-embodiment transfer(跨具身迁移),并称 motion transfer 是独门秘诀。他认为机器人智能近年主要依赖多模态大模型,最大瓶颈是数据,未来传统物理仿真会逐步被生成式模型仿真取代。

10月22日周三
  1. 十字路口Crossing23

    2025 AI 现场:从 DeepSeek R1 到 Sora 2,十字路口复盘“拐点之年”

    十字路口与庄明浩复盘 2025 年 AI 行业,以“拐点”为年度关键词,梳理从年初 DeepSeek R1 到近期 Sora 2 的模型大战,以及 Manus 引爆的“Agent 元年”。节目还讨论开源生态与人才流向、DeepSeek V3.2 发布后 V4 和 R2 今年或不再出现,并将目光投向资本市场对 AI 的集体狂想。

8月23日周六