跳到正文

全部动态

今日 16 条
9月1日周二
  1. Higgsfield Blog62

    Higgsfield 发布 Genjutsu:局部重建视频片段,支持 Motion Transfer 与 Object Swap

    Higgsfield 发布 Genjutsu,可在不重拍整段视频的前提下重建片段中的局部内容,包含 Motion Transfer 和 Object Swap 两项功能,前者提取原视频运动并套用到新角色或场景,后者只替换指定对象并保留其余画面,两者均无需完整提示词,可用预设完成。

    推荐理由:官方给出 Genjutsu 的局部重绘能力、输入限制与按长度分辨率计费的价格表,可据此判断视频改造成本。

  2. Manus 博客58

    Manus 恢复独立运营,创始团队继续领导公司

    Manus 宣布已正式恢复独立运营,创始团队将继续领导公司,并作为独立运营的 AI Agent 实验室推进通用 AI Agent 的能力与产品。部分用户此前需备份和恢复数据并经历访问临时中断,官方提供了恢复入口,恢复没有截止日期,未受影响的用户无需操作。Manus 表示后续会更深入融入日常工作流程、更直接地与周围世界互动,并更主动地代表用户采取行动。

8月31日周一
8月29日周六
  1. Higgsfield Blog32

    如何用 Higgsfield Popcorn 把剧本转成 AI 分镜与镜头清单

    Higgsfield Popcorn 是 Higgsfield 的 AI 分镜生成器,可把场景描述与参考图转成连贯的分镜序列,单次生成最多 8 帧、支持最多 4 张图像参考,并提供 Auto 与 Manual 两种模式。锁定后的分镜帧可进入 Cinema Studio 4.0 生成视频。流程为:拆分剧本序列、编写镜头清单、收集参考图、按五要素写提示词。

8月28日周五
  1. Midjourney Updates62

    Midjourney 开放首个 V8.2 图像编辑模型测试

    Midjourney 开始让所有用户测试其首个 V8.2 图像编辑模型,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)与画布扩展(outpainting),并可使用 personalization、moodboards 和 srefs。

    推荐理由:官方公布 V8.2 图像编辑模型的首批能力与入口,可据此了解 Midjourney 编辑能力从参考图到局部重绘的覆盖范围。

  2. Meta Newsroom · AI22

    Meta 详解闭环液冷:AI 数据中心背后的“管道工程”

    Meta 最新 AI 优化数据中心大多采用闭环液冷,冷却液(水与乙二醇混合)在密封回路中循环,经热交换器散热后回流服务器机架,预计可连续使用长达十年无需更换。Meta 称典型采用干冷器的闭环液冷 AI 数据中心年用水量低于几家全服务餐厅,且相比风冷可在同一机架内容纳更多 GPU。

  3. Google Gemini 博客76

    Google 发布 Gemini Omni 1.1 Flash,强化生成视频控制能力

    Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者提供场景延长、首尾帧插值、360p 快速预览和最高 4K 放大等生成视频控制能力,通过 Gemini API 在 Google AI Studio 上线。

    推荐理由:官方给出场景延长、首尾帧插值与 4K 放大等具体能力,读者可据此判断生成视频工作流的可控性变化。

8月27日周四
8月26日周三
  1. 张小珺Jùn|商业访谈录34

    领读 Kimi K3 技术报告:注意力美学、多教师蒸馏与开源 MoE 架构

    Kimi K3 是有效扩展到 2.8T 总参数并全量开源的 MoE 模型,清华博士候选人孙宇涛领读其技术报告,串联讲解十余篇相关论文。报告覆盖线性注意力、Gated MLA、Attention Residuals、Stable LatentMoE 与 Muon 等架构创新,以及预训练、多教师 On-Policy 蒸馏和 KDA Kernel 等基础设施。

8月25日周二
8月24日周一
  1. Higgsfield Blog23

    如何不用摄影棚制作 AI 产品图:Higgsfield Marketing Studio 实操指南

    Higgsfield 的 Marketing Studio 提供 1,500+ 商业创意模板,通过 Recreate 功能把真实产品照片替换进模板场景,无需摄影棚、摄影师或模特即可生成产品图。流程从一张干净产品照开始,依次添加产品、可选 Avatar、在 Product shot 的 9 种格式中生成核心图集,再切换到 Marketplace 类别制作商品列表封面。

  2. 十字路口Crossing31

    对谈萝博派对创始人黄一:22 岁具身 CEO、一年 5 轮融资过亿美元

    RoboParty 萝博派对创始人兼 CEO 黄一今年 22 岁,一年内完成 5 轮融资、累计超过 1 亿美元,股东包括知名 VC 以及小米、宁德等产业方。他把这一年形容为“压缩的人生”,称把十年要吃的苦一年吃完。他判断,若把具身智能比作 42 公里马拉松,机器人本体已跑完 1/4,小脑约跑了一半,大脑可能才跑了一两公里。

8月22日周六
  1. Midjourney Updates17

    Midjourney 发布 alpha.midjourney.com 更新日志:文件夹分组、Upscale/Zoom/Vary 回归

    Midjourney 为 alpha.midjourney.com 推送更新,侧边栏支持将项目归入可折叠分组树并双击重命名,Upscale、Zoom、Vary 功能回归,Vary 不再默认以 HD 运行。设置项不再自行重置,Relax 模式不会跳回 Fast,站点输入、滑块与图库滚动的卡顿已修复。官方提醒此次密集修复可能引入新 bug,可在 #alpha-ideas-and-bugs 反馈。

8月21日周五
  1. Higgsfield Blog40

    Higgsfield 推出 Video Relight 与 Color Palette 两款独立视频编辑工具

    Higgsfield 上线 Video Relight 和 Color Palette 两款独立编辑工具,可直接处理已生成或拍摄的素材。Video Relight 提供 6 种光照预设和 Auto 选项,支持最多两个自定义光源并用提示词描述;Color Palette 提供 50+ 调色预设,并可用参考图迁移色调。两者处理 15 秒视频均收费 135 credits($6.75)。

  2. Higgsfield Blog22

    如何在 2026 年用 Higgsfield 制作 AI UGC 营销视频

    Higgsfield 的 Marketing Studio 可一站式生成 AI UGC 广告:输入产品链接或图片、选定虚拟人形象与 UGC 预设,一次生成带原生音频和口型同步的成片,并支持 9:16 竖版导出。其 Soul ID 保证跨变体创作者形象一致,Virality Predictor 用于投放前评估,单次最多可生成 4 条变体,便于只改开头钩子做 A/B 测试。

8月20日周四
  1. Meta AI Research · Muse66

    Meta 发布 Muse Spark 1.2 多模态评测结果

    Meta 公布 Muse Spark 1.2 的新评测结果与演示,展示其在视觉编码、图表理解、视觉推理和知识密集型任务上的表现,并称多模态提升在模型可调用工具时最明显。该模型支持将图像或视频转为可运行代码、面向机器人的空间智能与音视频理解,已上线 Meta Model API 和 Muse Code,官方同时预览了内部评测 WildArtifactBench 并放出 10 个任务。

    推荐理由:官方给出 Muse Spark 1.2 在多模态任务上的新评测与演示,可了解其在视觉编码、机器人和音视频理解上的能力边界。

8月19日周三
  1. 张小珺Jùn|商业访谈录22

    17岁高中生苏庭灏独立完成预训练论文被 ICML 2026 收录

    出生于2009年、现年17岁的高二学生苏庭灏独立完成预训练研究,其关于 Attention 机制的论文《Attention Projection Mixing with Exogenous Anchors》被 ICML 2026 Main Track 接收。他在这期播客中谈到,AI 让同学们感到人生意义感流失,而他选择以"开心是人之根本"自处,从韩国 ICML 回来后即将去农村支教。

  2. Higgsfield Blog34

    Higgsfield Marketing Studio 更新:1500+ 模板库与一键生成广告

    Higgsfield Marketing Studio 模板库更新至 1500+ 个,按用例分为 6 类,用户选定模板后上传产品图或粘贴网站链接,即可一键生成成品广告。模板路径无需提示词,UGC 视频单次生成最长 15 秒;提示词路径则直接描述镜头生成。产品图、网站链接和参考广告三种输入方式分别对应不同素材起点。

8月18日周二
  1. Higgsfield Blog22

    如何用脚本制作 AI 视频:2026 年分步指南

    用脚本制作 AI 视频需五步:格式化脚本、拆分为场景、生成分镜表、逐镜生成、按序剪辑。Higgsfield 的 Cinema Studio 4.0 单次生成最长 30 秒、最高 1080p,可依节奏自动切成多个镜头,并支持 30+ 运镜预设、50+ 调色盘与最多 50 张参考图;Popcorn 负责分镜,Soul ID 保持角色一致。