Google 为 Windows 推出 Gemini 桌面应用
Google 发布 Windows 版 Gemini 桌面应用,Windows 10 和 11 用户可在 gemini.google/desktop 下载,全球同步上线。
推荐理由:官方给出 Windows 端 Gemini 的快捷键入口、智能体与图像视频生成能力,可据此判断桌面工作流的变化。
Google 发布 Windows 版 Gemini 桌面应用,Windows 10 和 11 用户可在 gemini.google/desktop 下载,全球同步上线。
推荐理由:官方给出 Windows 端 Gemini 的快捷键入口、智能体与图像视频生成能力,可据此判断桌面工作流的变化。
Google 博客介绍 Gemini 处理行政事务的 4 种用法:填写表格与缴费、参与公民事务、查找政府机构与法规、申请社会服务。Google 的 AI & Economy ATLAS v1.0 研究显示,约 40% 用 Gemini 处理公民事务的人咨询此类问题,26% 用于了解政府事务,超 16% 用于查找机构,超 15% 用于社会服务,近半数对话发生在非标准工作时间。
OpenAI 最新图像模型 GPT Image 2.5 已在 Higgsfield 上线,分为 Flare 和 Sunburst 两个版本。Flare 面向日常高频生成,输出质量高于 GPT Image 2 且延迟降低约 50%;Sunburst 主打精确编辑,适合成品级广告与产品图。两版本均支持最多 16 张参考图、1K/2K/4K 分辨率,定价一致,4K Max 档约 $1.325/张。
Meta 推出个人 AI 智能体 Muse,由 Muse Spark 模型驱动,运行在专用虚拟机 Muse Secure VM 上,智能体与用户数据同机存放,另有 Sentinel 智能体在系统层面隔离并审核其联网行为。
推荐理由:Meta 把个人智能体放进独立安全虚拟机,并给出支付与权限控制方案,可观察大厂如何设计智能体的隐私边界。
58 岁、从未写过代码的 Amy 借助 Manus 为因癌症失去发声器官的哥哥 Jamie 构建了语音辅助应用 Wally,以高尔夫为主题包装,内置紧急求助、日常需求和给孙女的短语,一点即通即可替他开口。
Meta 发布博客,详解其个人智能体 Muse 的安全、隐私与防护设计,包括运行在隔离 VM 中的运行时单元、独立于智能体的 Sentinel 权限控制,以及针对提示注入的模型训练、分类器与人工审批多层防御。
推荐理由:Meta 公开了 Muse 智能体的安全架构细节,包括 Sentinel 权限控制与提示注入防御的分层设计。
Higgsfield 宣布 GPT-6 Astra 已接入其工作流,包括 Games 2.0 和 MCP 连接体验,可由一句提示词构建并部署完整多人游戏。在 Higgsfield MCP 流程中,GPT-6 Astra 负责编码、逻辑、推理与多步编排,Higgsfield 负责创意素材与游戏生成部署,用户可在界面直接设定游戏类型、风格、场景和多人开关。
推荐理由:原文给出 GPT-6 Astra 在 Higgsfield 工作流中的分工与 Games 2.0 的完整操作路径,可据此判断一句话生成可玩游戏的落地方式。
Higgsfield 发布 AI 原生 3D 工作空间 3D Jutsu,可将提示词或参考图生成含物体、布局、灯光、相机与动画的可编辑 3D 场景,并直接在同一对话中渲染成视频。
推荐理由:官方给出 3D Jutsu 的场景搭建、编辑与导出流程,可据此判断提示词到 3D 预演再到视频的工作方式。
Midjourney 正在公开征集用户反馈与改进建议,并计划在未来一两周内举行正式投票。用户可通过 midjourney.com/ideas 提交想法,供团队确定后续优先开发方向。
Midjourney 在 alpha.midjourney.com 推送大更新,将新的 v8.2 编辑模型接入 alpha,并在 lightbox 中内置编辑器,支持用自然语言指令编辑、最多附加 4 张参考图,并集中查看本次会话的所有编辑。
Figma Design 新版本支持在变量(variables)弹窗中批量更新不透明度,并可将不透明度叠加到任意颜色上而无需解除与库的关联。用户可用数字变量为颜色变量设置不透明度,并限定其仅用于颜色变量,便于统一调整禁用态、遮罩层等场景。
Google 推出 Fairwind Program,这是一个面向政府、Google Cloud 客户和网络安全合作伙伴的受限访问计划,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,用于自主发现、验证并修复漏洞。
推荐理由:Google 把前沿模型与自动修复工具打包成受限访问计划,读者可了解其面向政府与关键基础设施的准入方式。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,通过原生视频工具动态搜索、扫描和检查目标片段,替代固定帧率的静态处理。
推荐理由:官方给出 token 与成本降幅及准确率变化,并说明在长视频场景下与静态逐帧处理的差异。
Figma 为生成式插件和 shader 新增动画与交互能力,可通过提示词让 agent 生成响应鼠标移动的动态 shader 效果。用户还能将插件和 shader 发布至 Figma Community 或组织内部(仅 Organization 和 Enterprise 计划),并在 Figma 中查看和下载代码。
Higgsfield 发布 Genjutsu,可在不重拍整段视频的前提下重建片段中的局部内容,包含 Motion Transfer 和 Object Swap 两项功能,前者提取原视频运动并套用到新角色或场景,后者只替换指定对象并保留其余画面,两者均无需完整提示词,可用预设完成。
推荐理由:官方给出 Genjutsu 的局部重绘能力、输入限制与按长度分辨率计费的价格表,可据此判断视频改造成本。
2026 年值得考虑的 Midjourney 替代方案包括 Google Gemini、ChatGPT Images、Higgsfield、Leonardo、Ideogram、Adobe Firefly、Flux、Stable Diffusion、Recraft 和 Krea,多数提供免费或有限免费额度,Stable Diffusion 可自托管。
一份对比 12 款 AI 视频生成器单条成片成本的指南,覆盖 Higgsfield、Kling AI、Google Gemini、PixVerse、Vidu、Pika、Hailuo、Runway、Luma、Krea、LTX Studio 和 Dreamina,价格于 2026 年 8 月按官方定价页与产品内计数器核验。
Midjourney 更新了 V8.2 编辑模型,图像质量得到提升。官方称过去 24 小时内遇到问题的用户可重新尝试,并继续反馈意见,后续还会有更多更新。
Higgsfield、AdCreative.ai、InVideo、HeyGen、Synthesia、Pictory、Arcads 七款工具被列为 Creatify 的替代方案,其中 Higgsfield 起价 $15/mo,可从产品 URL 或照片生成图片与最长 30 秒视频,并提供 1,500+ 模板。
Google Flow 通过 Gemini Omni 1.1 Flash 推出更新,带来更多创作控制能力。新增首尾帧控制以保持角色与叙事一致,支持导出 1080p 或 4K 视频,并可用 360p 低额度快速草拟、再下载 720p 版本。这些能力即日起在 Google Flow 中可用。
Google Workspace 产品副总裁 Yulie Kwon Kim 介绍了用 Gemini 开启新学期的 7 种方式,包括在 Sheets canvas 中生成学期规划 mini app、在 Docs 中把笔记转成学习指南和图表、在 Slides 中用 Deck Generation 生成整套演示文稿。
Recraft V4 已在 Higgsfield 上线,拆分为 Recraft V4.1、Recraft Styles 和 Recraft Utility 三个模型,分别面向概念创作、风格匹配与可控生成。
Google 为 Gemini Live 推出生产力升级,加入 Personal Intelligence、Daily Brief、Spark 和免手操作收件箱等功能。
推荐理由:官方说明了 Gemini Live 接入 Spark 后的多步任务与跨应用记忆能力,可据此判断语音助手的任务边界变化。
Figma 桌面端(macOS 和 Windows)现已支持把 agent 聊天面板打开为独立新窗口,可移动到屏幕任意位置,并在使用其他工具或切换标签页时保持可见。该功能随 Figma AI 更新发布。
Figma 为矢量编辑加入擦除(Erase)和拖拽填充(drag to fill)两项操作。该更新收录于 Figma Release Notes,与自动布局垂直换行、文件夹预览等近期更新并列发布。原文未披露具体版本号、可用范围与上线时间。
Figma 宣布面向 MCP 的企业级托管授权现已正式可用。该能力此前在 9 月 1 日的更新中已支持通过 Figma 的 MCP server 让第三方智能体查看并修改生成式插件与 shader。
Higgsfield 的 Marketing Studio 提供 1,500+ 商业创意模板,通过 Recreate 功能把真实产品照片替换进模板场景,无需摄影棚、摄影师或模特即可生成产品图。流程从一张干净产品照开始,依次添加产品、可选 Avatar、在 Product shot 的 9 种格式中生成核心图集,再切换到 Marketplace 类别制作商品列表封面。
Higgsfield 推出独立工具 Faceless Studio,可在三步内生成 1 至 5 分钟的无露脸 YouTube 动画视频,一次输出脚本、配音、2D/3D 动画、音乐和字幕。
Midjourney 为 alpha.midjourney.com 推送更新,侧边栏支持将项目归入可折叠分组树并双击重命名,Upscale、Zoom、Vary 功能回归,Vary 不再默认以 HD 运行。设置项不再自行重置,Relax 模式不会跳回 Fast,站点输入、滑块与图库滚动的卡顿已修复。官方提醒此次密集修复可能引入新 bug,可在 #alpha-ideas-and-bugs 反馈。
Figma 在 auto layout 垂直流中新增垂直换行(Vertical wrap),溢出内容会折入新列而非超出画框,行为对齐 CSS flexbox。该更新于 9 月 25 日发布,用于构建随内容增删自动保持响应的多列布局。
Higgsfield 上线 Video Relight 和 Color Palette 两款独立编辑工具,可直接处理已生成或拍摄的素材。Video Relight 提供 6 种光照预设和 Auto 选项,支持最多两个自定义光源并用提示词描述;Color Palette 提供 50+ 调色预设,并可用参考图迁移色调。两者处理 15 秒视频均收费 135 credits($6.75)。
Higgsfield 的 Marketing Studio 可一站式生成 AI UGC 广告:输入产品链接或图片、选定虚拟人形象与 UGC 预设,一次生成带原生音频和口型同步的成片,并支持 9:16 竖版导出。其 Soul ID 保证跨变体创作者形象一致,Virality Predictor 用于投放前评估,单次最多可生成 4 条变体,便于只改开头钩子做 A/B 测试。
Higgsfield 推出 Blender 插件,把 AI 图像、视频、3D、动画与场景生成能力放进 Blender 视口,通过悬浮栏操作,生成结果可直接落入当前场景。
Higgsfield Marketing Studio 模板库更新至 1500+ 个,按用例分为 6 类,用户选定模板后上传产品图或粘贴网站链接,即可一键生成成品广告。模板路径无需提示词,UGC 视频单次生成最长 15 秒;提示词路径则直接描述镜头生成。产品图、网站链接和参考广告三种输入方式分别对应不同素材起点。
Higgsfield Edit 新增 Layer Decomposition、Edit Text 和 Remove Background 三款工具,Edit Image 下工具总数达到九个。
Higgsfield MCP 将 Higgsfield 的图像、视频和音频模型接入 Claude、ChatGPT 等 AI 对话,营销人员可在聊天中直接生成广告创意。
Higgsfield MCP 与 Supercomputer 新增 Faceless Content Factory 和 UGC Factory 两项技能,前者可将一个主题生成最长 10 分钟的动画 YouTube 视频,后者能基于产品创意生成创作者出镜的竖版广告,同一虚拟形象贯穿全片。
Figma 在 Release Notes 中上线资源推荐功能,让用户推荐希望他人发现和使用的资源。该更新与 Figma Design、Figma Weave、Figma Community 等近期发布同批列出,具体入口与使用方式未在正文中展开。
MiniMax Hailuo 3.0 已在 Higgsfield 上线,相比 Hailuo 2.3 分辨率从 1080p 提升到 2K,单次生成时长从 10 秒延长到 15 秒,并首次在同一生成过程中输出原生立体声,包含对白、音效与环境音。
推荐理由:原文给出 Hailuo 3.0 与 2.3 的分辨率、时长、音频和输入数量对比,可据此判断多参考合成视频的可用边界。
Black Forest Labs 的首个视频模型 Flux 3 已在 Higgsfield 上线,自 2026 年 7 月 23 日公布后处于早期访问阶段,可生成 5 至 20 秒片段并可选同步音频。
推荐理由:梳理了 Flux 3 在 Higgsfield 上的输入模式、参考帧与计费方式,便于判断短片的生成成本与适用场景。