如何用 ChatGPT、Claude、Cursor 等 AI 智能体生成视频
Higgsfield 通过 Plugin、MCP 和 CLI 接入 Claude、ChatGPT、Cursor、Claude Code、OpenClaw、Hermes 等 AI 智能体,用户用自然语言描述需求即可由智能体自动选模型、设参数并生成视频。
Higgsfield 通过 Plugin、MCP 和 CLI 接入 Claude、ChatGPT、Cursor、Claude Code、OpenClaw、Hermes 等 AI 智能体,用户用自然语言描述需求即可由智能体自动选模型、设参数并生成视频。
在 Higgsfield AI 上制作 AI 动画短片需五步:设计角色与视觉风格、分镜、逐镜生成、配音对口型、剪辑成片,最大难点是保持角色与画风跨镜头一致。
Higgsfield 用 Audio、Lipsync Studio 和 Reframe 三步完成视频广告本地化:翻译并重新配音、将新语音与口型同步、再按平台比例重构画面。
Gabo 借助 Higgsfield 的 CPP 计划制作出约 50 部、多数时长约一小时的 AI 长片,单部制作周期 20 天至一个月,部分视频播放量达 600 万,部分作品播放量增长近 5 倍。
Claude 配合 Higgsfield MCP 和 Meta MCP 两个连接器,可在同一会话内完成广告制作全流程:Higgsfield MCP 支持 30+ 模型生成视频、最高 4K 图像、配音和 Soul 角色固定人脸,并直接发布到 TikTok;Meta MCP 可搜索 Meta Ad Library、搭建暂停状态的付费广告系列并拉取指标。
Higgsfield 提供了一套从电商商品目录批量生成产品视频的流程:通过 CSV、JSON、product-feed API 或 PIM 导入商品数据,按品类用 Marketing Studio 或 Cinema Studio 搭建主广告模板。
Higgsfield 的 Marketing Studio 可从一条母版广告出发,通过替换开场钩子、产品和语言批量生成广告变体:5 个产品 × 5 个钩子 × 4 个语言版本即得 100 条,若在原语言外再加 4 种语言则达 125 条。
Higgsfield API 让开发者通过 api.higgsfield.ai 直接调用 50 多个视频和图像生成模型,需注册账户、充值美元余额并在 console.higgsfield.ai 生成 API key。
Higgsfield Genjutsu 与 Seedance 2.5 Edit 支持在已生成的 AI 视频中只替换单个元素,其余画面保持不变。Genjutsu 提供 Object Swap 与 Motion Transfer,最多可用 30 张参考图和 30 秒源视频;Seedance 2.5 Edit 支持 Draw to Edit 圈选区域修改,最多 50 张参考图,两者输出均达 1080p。
Higgsfield 用 Marketing Studio 和 Cinema Studio 4.0 两条路径把运动产品照片生成视频广告:前者支持 Click to Ad 粘贴商品链接或上传照片,自动提取名称、描述、最多 8 张图片、品牌色和 logo,模板库含 1,500+ 模板;后者提供镜头运动、色调、节奏等直接控制,单片段最长 30 秒。
Higgsfield 发布教程,展示如何用情侣已有照片在 higgsfield.ai 上分七步生成 AI 婚礼邀请函,最终由 Cinema Studio 4.0 输出最长 30 秒的带音频影片。
Higgsfield 指出 AI 视频额度消耗快的核心原因是按生成次数而非成品计费,单条成片真实成本等于单次生成价格乘以平均尝试次数,多数创作者的这个乘数在 3 到 10 之间。
Higgsfield 提供 Video Upscale 与 Seedance 2.5 Edit 两条 AI 视频修复路径:前者负责分辨率与画质提升,后者通过文本提示词对最长 30 秒的片段做定向清理、调色与重打光。
Higgsfield MCP 让 Claude 通过一次连接直接调用其完整创意管线,在对话内生成图像、视频和音频,并复用历史素材。该连接开放 30+ 模型,包括 Soul、Cinema Studio、Seedance 2.5、Kling,图像最高支持 4K 分辨率,生成消耗现有 Higgsfield 账户积分,无需单独的 MCP 余额或 API key。
Higgsfield 提供覆盖图像、视频、音频生成的 30+ 模型创作套件,可在同一账号内完成参考图、配音、视频生成与剪辑全流程。其推荐链路为 Recraft 或 Soul 出图、Seed Audio 1.0 生成音频、Seedance 2.5 生成视频、Genjutsu 做局部修改,单条 10 秒 1080p 视频总成本约 205 credits、10.25 美元。
Higgsfield Popcorn 是 Higgsfield 的 AI 分镜生成器,可把场景描述与参考图转成连贯的分镜序列,单次生成最多 8 帧、支持最多 4 张图像参考,并提供 Auto 与 Manual 两种模式。锁定后的分镜帧可进入 Cinema Studio 4.0 生成视频。流程为:拆分剧本序列、编写镜头清单、收集参考图、按五要素写提示词。
Google Workspace 产品副总裁 Yulie Kwon Kim 介绍了用 Gemini 开启新学期的 7 种方式,包括在 Sheets canvas 中生成学期规划 mini app、在 Docs 中把笔记转成学习指南和图表、在 Slides 中用 Deck Generation 生成整套演示文稿。
Higgsfield Marketing Studio 提供图像与视频模板库,分六大类,可用预设或提示词两条路径生成食品广告镜头,两者共用同一底层模型与素材库,保证同一项目内风格一致。
Higgsfield 的 Marketing Studio 提供 1,500+ 商业创意模板,通过 Recreate 功能把真实产品照片替换进模板场景,无需摄影棚、摄影师或模特即可生成产品图。流程从一张干净产品照开始,依次添加产品、可选 Avatar、在 Product shot 的 9 种格式中生成核心图集,再切换到 Marketplace 类别制作商品列表封面。
Higgsfield 的 Marketing Studio 可一站式生成 AI UGC 广告:输入产品链接或图片、选定虚拟人形象与 UGC 预设,一次生成带原生音频和口型同步的成片,并支持 9:16 竖版导出。其 Soul ID 保证跨变体创作者形象一致,Virality Predictor 用于投放前评估,单次最多可生成 4 条变体,便于只改开头钩子做 A/B 测试。
在 Higgsfield 上制作电商 AI 视频广告,可用 Marketing Studio 或 Seedance 2.5 两条路径。Marketing Studio 提供超 1500 个模板,覆盖产品图、广告、商城横幅、海报、UGC 和动态六类,粘贴产品 URL 即可自动提取图像、logo、配色与文案,无需提示词。
用脚本制作 AI 视频需五步:格式化脚本、拆分为场景、生成分镜表、逐镜生成、按序剪辑。Higgsfield 的 Cinema Studio 4.0 单次生成最长 30 秒、最高 1080p,可依节奏自动切成多个镜头,并支持 30+ 运镜预设、50+ 调色盘与最多 50 张参考图;Popcorn 负责分镜,Soul ID 保持角色一致。
Higgsfield Edit 新增 Layer Decomposition、Edit Text 和 Remove Background 三款工具,Edit Image 下工具总数达到九个。
Higgsfield 把 AI 视频生产组织成固定流水线:Cinema Studio 4.0 负责生成,Soul ID 训练角色一致性,Supercomputer 批量出片,MCP 与 CLI 接入现有流程。
Higgsfield 发布指南,指出 AI 视频显得虚假主要源于三点:光线没有明确来源、运动缺乏重量感、镜头过于平稳顺滑。文章给出用提示词修复的方法,强调用具体光源和方向替代"电影感""真实"等无效词,并说明 Higgsfield 上对应设置的作用及一次 15 秒生成的成本。
Higgsfield 发布 2026 年 TikTok AI 内容制作指南,覆盖 AI influencer、数字人播报、Shorts 剪辑、品牌广告等五种格式,分别对应 AI Influencer Studio、Soul ID + LipSync Studio、Shorts Studio、Marketing Studio 等工具。
字节跳动视频生成模型 Seedance 2.5 支持最长 30 秒、原生 1080p 与原生音频,单次生成最多可输入 50 个多模态参考,并支持区域编辑。该指南给出其提示词结构写法,并按剧情、动作、商业、恐怖等 10 类场景提供经多次生成测试的完整提示词库。
Lovart 的图像引擎 Nano Banana 并非单一模型,而是由 Nano Banana 2(基于 Gemini 3.1 Flash Image,5 秒内出图、1K-2K 分辨率)与 Nano Banana Pro(基于 Gemini 3 Pro Image,10-30 秒、2K-4K 原生、支持 SVG 矢量导出)组成的模型家族,在 MCoT 思维链系统下协同工作。
Lovart 发布 Reels 封面制作教程,用 AI 景深模糊自动检测主体并施加 3–5px 背景模糊,模拟 f/1.8 人像效果,配合 Touch Edit 裁剪定位。封面文字建议 3–6 个词,默认 Montserrat Bold 68pt,文字背景为 40% 不透明度黑色填充加 12px 圆角。Pro 计划(49 美元)支持 CSV 批量生成封面,模板复用后单个封面耗时不到 90 秒。
Lovart 的角色一致性流程由设定稿、Multi-Angles 多角度生成和 Touch Edit / Edit Elements 逐张校准组成,没有一键开关。
Lovart 发布 2026 年 AI 素描与绘画生成指南,称其草图精炼模式可把粗略草图转为干净风格化版本,并保留构图与主体位置。指南称石墨铅笔、技术线稿、钢笔与墨水等风格在屏幕分辨率下已与人类作品几乎无法区分,而书法与手写字体、儿童蜡笔画仍属困难。
Lovart 的 PBR 模式可从单个提示或参考图生成漫反射、法线、粗糙度、金属度、高度、AO 六张贴图,最高输出 4096×4096,支持 PNG 与 TGA,可直接导入 Unity、Unreal Engine、Blender。
2026年免费AI设计工具可分为真正免费(开源)与免费层级(增值模式)两类,Stable Diffusion 本地运行被视为免费AI图像生成的最强选择,需 6GB 以上显存 NVIDIA GPU。Lovart 免费版提供 100 积分起始、720p 生成、1000+ 模板与基础编辑,付费层级为基础版 19 美元、专业版 49 美元。免费工具普遍存在分辨率限制、处理优先级降级与商业使用条款限制。
Ideogram 发布指南,说明 4.0 基于结构化 JSON 描述训练,提示词需按 high_level_description、style_description、compositional_deconstruction 等字段组织,模型对具体光照、媒介和命名参考更敏感。
推荐理由:官方拆解 Ideogram 4.0 的 JSON 提示词写法,含字段职责、bbox 与十六进制色值等可迁移细节。
Manus 通过 Gmail 和 Google Calendar 连接器,可将收件箱工作流自动化:扫描过去 30 天邮件生成一页会议简报、读取潜在客户咨询邮件并生成 10 页带演讲备注的推介幻灯片、扫描过去 24 小时未读邮件生成按项目分类的可视化仪表板并列出 5 项待办。用户在 Manus 工作空间的连接器选项卡中授权 Gmail 和 Google Calendar 后即可使用。
Manus 发布品牌摄影 AI 图像提示词指南,提出提示词需包含主体与服装、环境场景、相机与胶片类型、光线四层指令,并给出广角、三分之四、侧面、特写、背面、双人六类镜头的可复制提示词示例。指南建议用 Kodak Portra 400 胶片、50mm/85mm/120mm 镜头等具体描述规避"AI 外观",并通过固定身体描述、胶片类型和光线措辞保持多镜头一致性。
Manus 发布分步指南,教用户无需写代码,在 30 分钟内用 Manus 和 Gmail 搭建 AI 客户支持 Agent。该 Agent 每天两次读取 Gmail 新支持邮件,结合知识库以品牌语气起草回复,用户可逐封或批量一键批准发送。教程网站本身即由 Manus 构建,用于展示 Vibecoding 能力。
Manus 发布面向非技术初学者的提示词指南,教用户把 Manus 当作 Agent 使用,而非普通聊天工具。这些提示词专为只有 Agent 才能完成的任务设计,包括跨步骤执行操作、跟踪进度、做出决策并执行、生成可重复使用的结构化输出。指南覆盖日常生活自动化、工作与生产力、研究与监控、个人支持等场景,并给出“负责”“随时间跟踪”“逐步指导我”“在需要时跟进”等 Agent 提示关键词。