跳到正文

#图像生成

今日 1 条
今天9月30日周三
  1. Grok22

    这部《奥德赛》试播集的制作过程中没有摄像机受到伤害。

    引用Grok Imagine@imagine

    No cameras. No sets. Just two filmmakers with a mission: Push @imagine's cinematic capabilities to their limits and make a pilot of Homer’s Odyssey. @WonderStudiosX, an AI-native creative studio who partnered with us on this, delivered the pilot in 15 days, using 2,070 images and 1,558 videos. Here’s a thread on the best tips from creative lead Dev Walker 🧵

9月25日周五
9月24日周四
  1. Higgsfield Blog18

    2026 年 15 款最佳 AI 内容创作平台盘点

    Higgsfield Blog 盘点 2026 年 15 款面向内容创作者的 AI 平台,覆盖策划、生成、剪辑与发布全流程。Higgsfield 以 30+ 模型整合图像、视频与广告制作,起价 $15/mo;Canva 主打日常设计,Descript 与 OpusClip 侧重长视频二次剪辑,HeyGen 与 Synthesia 专注数字人出镜视频。

9月23日周三
9月22日周二
9月17日周四
9月16日周三
9月12日周六
9月11日周五
9月4日周五
  1. Ideogram12

    感谢部长 @EvanLSolomon 拨冗出席并带来振奋人心的讲话。我们的团队比以往任何时候都更兴奋,要在加拿大构建生成式媒体的基础,并为全球企业客户创造价值。

    引用Mohammad Norouzi@mo_norouzi

    It was a pleasure hosting Canada's AI Minister @EvanLSolomon at Ideogram's Toronto HQ. We talked about the 3 C's and 2 T's Canadian AI needs: capital, compute, customers, talent, and trust. Proud of our superstar team, building sovereign generative media here at home. 🇨🇦

9月3日周四
  1. 十字路口Crossing34

    对卷卷的3小时访谈:从抖音到AI 3D、成为制造业OS的野心、基础模型不会吞噬一切

    数美万物创始人兼CEO任利锋(卷卷)在近3小时访谈中回顾了从0到1孵化抖音的经历,并介绍了公司最新发布的Hi3D 3.0 2048³模型。他将创业目标从Maker OS推向制造业OS,认为基础模型不会吞噬一切,实体制造仍需能产出生产级3D资产的模型,以及拆件、连接结构、材料适配等模型之后的工程能力。

8月29日周六
8月28日周五
  1. Midjourney Updates62

    Midjourney 开放首个 V8.2 图像编辑模型测试

    Midjourney 开始让所有用户测试其首个 V8.2 图像编辑模型,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)与画布扩展(outpainting),并可使用 personalization、moodboards 和 srefs。

    推荐理由:官方公布 V8.2 图像编辑模型的首批能力与入口,可据此了解 Midjourney 编辑能力从参考图到局部重绘的覆盖范围。

8月22日周六
  1. Midjourney Updates17

    Midjourney 发布 alpha.midjourney.com 更新日志:文件夹分组、Upscale/Zoom/Vary 回归

    Midjourney 为 alpha.midjourney.com 推送更新,侧边栏支持将项目归入可折叠分组树并双击重命名,Upscale、Zoom、Vary 功能回归,Vary 不再默认以 HD 运行。设置项不再自行重置,Relax 模式不会跳回 Fast,站点输入、滑块与图库滚动的卡顿已修复。官方提醒此次密集修复可能引入新 bug,可在 #alpha-ideas-and-bugs 反馈。

8月21日周五
8月18日周二
  1. Higgsfield Blog22

    如何让 AI 视频看起来真实:光照、运动与镜头控制(Higgsfield 指南)

    Higgsfield 发布指南,指出 AI 视频显得虚假主要源于三点:光线没有明确来源、运动缺乏重量感、镜头过于平稳顺滑。文章给出用提示词修复的方法,强调用具体光源和方向替代"电影感""真实"等无效词,并说明 Higgsfield 上对应设置的作用及一次 15 秒生成的成本。

8月17日周一
8月15日周六
8月14日周五
8月12日周三
7月30日周四
7月29日周三
  1. Ideogram62

    Ideogram 发布 Ideogram 4.0,这是一个 9.3B 参数的开源权重 Diffusion Transformer 图像模型,官方称其在 LMArena 和 Design Arena 上超过所有开源权重图像模型,英文 OCR 文本渲染得分为 0.97,行业平均为 0.30–0.50。该模型运行在 AMD Instinct MI350X GPU 上,配备 288 GB HBM3 显存和 8 TB/s 带宽,Ideogram 表示与 AMD 合作将 Ideogram 4.0 规模化交付。

    引用AMD Data Center@AMDServer

    Enterprise-grade AI visual design, powered by AMD Instinct. Ideogram just released Ideogram 4.0, a 9.3B-parameter open-weight Diffusion Transformer that outperforms all open-weight image models in LMArena and Design Arena, with a 0.97 X-Omni English OCR text-rendering score (vs. an industry average of 0.30–0.50). The engine behind it? AMD Instinct MI350X GPUs, 288 GB of HBM3 memory and 8 TB/s of bandwidth, delivering the throughput enterprise diffusion workloads demand. Read how @ideogram_ai and AMD are scaling production-grade visual AI from millions to billions of images per month 👉 https://bit.ly/3TosU1m

  2. Lovart 博客22

    Lovart 教程:无需 Photoshop 制作 Reels 封面,AI 景深模糊与文字背景

    Lovart 发布 Reels 封面制作教程,用 AI 景深模糊自动检测主体并施加 3–5px 背景模糊,模拟 f/1.8 人像效果,配合 Touch Edit 裁剪定位。封面文字建议 3–6 个词,默认 Montserrat Bold 68pt,文字背景为 40% 不透明度黑色填充加 12px 圆角。Pro 计划(49 美元)支持 CSV 批量生成封面,模板复用后单个封面耗时不到 90 秒。