如何用 ChatGPT、Claude、Cursor 等 AI 智能体生成视频
Higgsfield 通过 Plugin、MCP 和 CLI 接入 Claude、ChatGPT、Cursor、Claude Code、OpenClaw、Hermes 等 AI 智能体,用户用自然语言描述需求即可由智能体自动选模型、设参数并生成视频。
Higgsfield 通过 Plugin、MCP 和 CLI 接入 Claude、ChatGPT、Cursor、Claude Code、OpenClaw、Hermes 等 AI 智能体,用户用自然语言描述需求即可由智能体自动选模型、设参数并生成视频。
在 Higgsfield AI 上制作 AI 动画短片需五步:设计角色与视觉风格、分镜、逐镜生成、配音对口型、剪辑成片,最大难点是保持角色与画风跨镜头一致。
Higgsfield 用 Audio、Lipsync Studio 和 Reframe 三步完成视频广告本地化:翻译并重新配音、将新语音与口型同步、再按平台比例重构画面。
Gabo 借助 Higgsfield 的 CPP 计划制作出约 50 部、多数时长约一小时的 AI 长片,单部制作周期 20 天至一个月,部分视频播放量达 600 万,部分作品播放量增长近 5 倍。
Higgsfield 提供 Video Upscale 与 Seedance 2.5 Edit 两条 AI 视频修复路径:前者负责分辨率与画质提升,后者通过文本提示词对最长 30 秒的片段做定向清理、调色与重打光。
Mind Lab 研究员逯雨鑫以个人开发者身份、数百美元成本后训练的两个小模型两次登顶 Hugging Face Model Trending 榜首,他此前没有 AI Lab 经历,也不是 AI PhD,整个过程只用了 2 周。
Kimi K3 是有效扩展到 2.8T 总参数并全量开源的 MoE 模型,清华博士候选人孙宇涛领读其技术报告,串联讲解十余篇相关论文。报告覆盖线性注意力、Gated MLA、Attention Residuals、Stable LatentMoE 与 Muon 等架构创新,以及预训练、多教师 On-Policy 蒸馏和 KDA Kernel 等基础设施。
Lovart 的图像引擎 Nano Banana 并非单一模型,而是由 Nano Banana 2(基于 Gemini 3.1 Flash Image,5 秒内出图、1K-2K 分辨率)与 Nano Banana Pro(基于 Gemini 3 Pro Image,10-30 秒、2K-4K 原生、支持 SVG 矢量导出)组成的模型家族,在 MCoT 思维链系统下协同工作。
Lovart 发布 Reels 封面制作教程,用 AI 景深模糊自动检测主体并施加 3–5px 背景模糊,模拟 f/1.8 人像效果,配合 Touch Edit 裁剪定位。封面文字建议 3–6 个词,默认 Montserrat Bold 68pt,文字背景为 40% 不透明度黑色填充加 12px 圆角。Pro 计划(49 美元)支持 CSV 批量生成封面,模板复用后单个封面耗时不到 90 秒。
Lovart 的角色一致性流程由设定稿、Multi-Angles 多角度生成和 Touch Edit / Edit Elements 逐张校准组成,没有一键开关。
Lovart 发布 2026 年 AI 素描与绘画生成指南,称其草图精炼模式可把粗略草图转为干净风格化版本,并保留构图与主体位置。指南称石墨铅笔、技术线稿、钢笔与墨水等风格在屏幕分辨率下已与人类作品几乎无法区分,而书法与手写字体、儿童蜡笔画仍属困难。
Lovart 的 PBR 模式可从单个提示或参考图生成漫反射、法线、粗糙度、金属度、高度、AO 六张贴图,最高输出 4096×4096,支持 PNG 与 TGA,可直接导入 Unity、Unreal Engine、Blender。
Ideogram 发布指南,说明 4.0 基于结构化 JSON 描述训练,提示词需按 high_level_description、style_description、compositional_deconstruction 等字段组织,模型对具体光照、媒介和命名参考更敏感。
推荐理由:官方拆解 Ideogram 4.0 的 JSON 提示词写法,含字段职责、bbox 与十六进制色值等可迁移细节。
十字路口播客邀请 ShareAI 社区发起人来新璐,围绕 Claude Code 源码泄露事件拆解 Agent Harness,将其分为执行层、状态层、治理层三层框架。
俄亥俄州立大学计算机系教授、NeoCognition 创始人苏煜在访谈中复盘了 Agent 技术演进史,梳理出从 Logical Agent(1960-90s)、Neural Agent、Semantic Parsing 到 Language Agent 的脉络,并称过去三年 Language Agent 的发展速度超过此前几十年。
OpusClip 前增长产品负责人谢君陶在分享中,从获客、转化、留存、洞察四个维度拆解了这款 AI 视频产品的增长框架。他提出冷启动阶段第一批用户应是 Partners 而非 Affiliates,并复盘了 OpusClip 如何与创作者形成利益共同体、如何通过定价策略和 AB Test 驱动转化与留存。他还透露了 OpusClip 的增长团队架构,并指出绝大多数 AI 产品仍有较大涨价空间。