Higgsfield 年化收入运行率突破 10 亿美元
Higgsfield 宣布其年化收入运行率达到 10 亿美元以上,此时距其 AI 原生创意套件上线 18 个月。该数字由最近四周收入乘以 13 推算,并非过去一年已实现收入;企业客户合同收入自 6 月以来增长 10 倍,订阅收入占比从超过 90% 降至略高于 60%,按需用量上升。
推荐理由:官方披露年化收入运行率突破 10 亿美元,并给出订阅与按需用量的收入结构变化,可观察 AI 生成广告的商业化路径。
Higgsfield 宣布其年化收入运行率达到 10 亿美元以上,此时距其 AI 原生创意套件上线 18 个月。该数字由最近四周收入乘以 13 推算,并非过去一年已实现收入;企业客户合同收入自 6 月以来增长 10 倍,订阅收入占比从超过 90% 降至略高于 60%,按需用量上升。
推荐理由:官方披露年化收入运行率突破 10 亿美元,并给出订阅与按需用量的收入结构变化,可观察 AI 生成广告的商业化路径。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。
推荐理由:OpenAI 更新 ChatGPT 图像生成能力,读者可了解它如何把草图与参考照片转成更贴合个人意图的成品图。
Midjourney 开始让所有用户测试其首个 V8.2 图像编辑模型,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)与画布扩展(outpainting),并可使用 personalization、moodboards 和 srefs。
推荐理由:官方公布 V8.2 图像编辑模型的首批能力与入口,可据此了解 Midjourney 编辑能力从参考图到局部重绘的覆盖范围。
Ideogram 发布指南,说明 4.0 基于结构化 JSON 描述训练,提示词需按 high_level_description、style_description、compositional_deconstruction 等字段组织,模型对具体光照、媒介和命名参考更敏感。
推荐理由:官方拆解 Ideogram 4.0 的 JSON 提示词写法,含字段职责、bbox 与十六进制色值等可迁移细节。
Midjourney 在用户测试和反馈后,将默认模型从 V7 更新为 V8.1。V8.1 对详细提示词的遵循更好、文字渲染更强,开启 HD 模式后图像尺寸是 V7 的两倍、分辨率为 4 倍,SD 出图约 4 秒、HD 约 12 秒;风格参考、个性化和美学设置与 V7 保持一致。V7 omni-reference 仍可使用,V8.0 alpha 模型将在两周后弃用。
推荐理由:官方说明 V8.1 成为默认模型并列出速度、分辨率与提示词遵循的变化,可据此判断是否切换工作流。
Ideogram 发布 9.3B 参数开源权重文生图模型 Ideogram 4.0,采用 34 层单流 DiT,文本编码器为 Qwen3-VL-8B-Instruct,并拼接其 13 个中间层隐状态。
推荐理由:官方披露 9.3B 开源文生图模型的架构与结构化 JSON 提示词方案,可据此判断开源图像模型的设计取舍。
Manus 发布 Design View,作为 Manus Agent 的扩展功能,让用户在一个 AI 设计工作流中委托、创建和完善视觉资产,从今天起对所有 Manus 用户开放。
推荐理由:官方展示了标记编辑、文本编辑与移动端批量修改的完整设计流程,可据此判断多步骤视觉工作流的实际形态。
OpenAI 以研究发布的形式推出 DALL·E 2,这是一款能根据自然语言指令创建和编辑图像的新 AI 工具。Sam Altman 表示,计划今年夏天进行产品发布,让更多人使用;先做研究发布是为了与更多研究者和艺术家合作,尽量减少负面影响,并给人们时间适应变化。他认为这延续了自然语言作为计算机界面的趋势,也提到 DALL·E 2 能创作出完整作品,可能是 AI 影响劳动力市场的早期例子。
推荐理由:OpenAI 以研究预览形式发布 DALL·E 2,作者本人解释了从研究发布到产品发布的渐进部署思路。