跳到正文

全部动态

今日 16 条
8月10日周一
8月7日周五
  1. ByteDance Seed78

    Dreamina Seedance 2.5 的 API 服务已在 BytePlus ModelArk 上线,同时可在 Dreamina、CapCut 等平台体验。该模型支持单次生成 30 秒高质量音视频片段,单次最多输入 30 张图片、10 段视频和 10 段音频作为参考素材,并提供时间戳级别的音视频定向编辑控制。

    引用ByteDance Seed@ByteDanceSeed_

    Introducing Seedance 2.5, our new-generation video creation model! With advancements in long-form storytelling, multimodal reference, and editing, Seedance 2.5 goes beyond longer single-pass video generation, delivering the journey from idea to finished video with greater control. Key highlights include: 1. Users can generate high-quality, 30-second audio-video clips in a single pass, bringing a complete story to life in one take. 2. Users can input up to 30 images, 10 video clips, and 10 audio clips as reference materials in a single pass. 3. Seedance 2.5 offers timestamp-level control for targeted editing of audio and video content, notably improving efficiency and controllability. Visit project homepage learn more: https://seed.bytedance.com/seedance2_5

    推荐理由:Seedance 2.5 的 API 上线 BytePlus ModelArk,读者可据此了解单次生成 30 秒音视频与多模态参考的能力边界。

8月5日周三
  1. Meta AI Research · Muse78

    Meta 发布 Muse Code 终端编码智能体与 Muse Spark 1.2 模型

    Meta 发布终端编码智能体 Muse Code(beta),由新模型 Muse Spark 1.2 驱动,可在 macOS 或 Linux 安装,面向大型代码仓库的规划、写码与结果验证,并能协调多个常驻子智能体。

    推荐理由:官方披露了 Muse Spark 1.2 的编码训练重点与 Muse Code 的运行时设计,可据此判断终端编码智能体的工程取舍。

8月3日周一
7月31日周五
  1. ByteDance Seed78

    字节跳动 Seed 发布新一代视频创作模型 Seedance 2.5,在长叙事、多模态参考和编辑能力上做了升级。该模型支持单次生成 30 秒高质量音视频片段,单次可输入最多 30 张图片、10 段视频和 10 段音频作为参考素材,并提供时间戳级控制以对音视频内容做定向编辑。项目主页为 https://seed.bytedance.com/seedance2_5。

    推荐理由:官方给出单次生成时长、参考素材上限和时间戳级编辑三项能力,可据此判断视频创作流程的变化。

7月30日周四
  1. Google Labs 博客58

    Google 发布音乐生成模型 Lyria 3.5,上线 Flow Music

    Google 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升:可生成更丰富自然的旋律结构,歌词质量与提示词遵循度、结构感知更好,人声更具表现力和情感且发音改善,同时更易控制输出的节奏与时长。

7月29日周三
  1. Ideogram62

    Ideogram 发布 Ideogram 4.0,这是一个 9.3B 参数的开源权重 Diffusion Transformer 图像模型,官方称其在 LMArena 和 Design Arena 上超过所有开源权重图像模型,英文 OCR 文本渲染得分为 0.97,行业平均为 0.30–0.50。该模型运行在 AMD Instinct MI350X GPU 上,配备 288 GB HBM3 显存和 8 TB/s 带宽,Ideogram 表示与 AMD 合作将 Ideogram 4.0 规模化交付。

    引用AMD Data Center@AMDServer

    Enterprise-grade AI visual design, powered by AMD Instinct. Ideogram just released Ideogram 4.0, a 9.3B-parameter open-weight Diffusion Transformer that outperforms all open-weight image models in LMArena and Design Arena, with a 0.97 X-Omni English OCR text-rendering score (vs. an industry average of 0.30–0.50). The engine behind it? AMD Instinct MI350X GPUs, 288 GB of HBM3 memory and 8 TB/s of bandwidth, delivering the throughput enterprise diffusion workloads demand. Read how @ideogram_ai and AMD are scaling production-grade visual AI from millions to billions of images per month 👉 https://bit.ly/3TosU1m

  2. Lovart 博客22

    Lovart 教程:无需 Photoshop 制作 Reels 封面,AI 景深模糊与文字背景

    Lovart 发布 Reels 封面制作教程,用 AI 景深模糊自动检测主体并施加 3–5px 背景模糊,模拟 f/1.8 人像效果,配合 Touch Edit 裁剪定位。封面文字建议 3–6 个词,默认 Montserrat Bold 68pt,文字背景为 40% 不透明度黑色填充加 12px 圆角。Pro 计划(49 美元)支持 CSV 批量生成封面,模板复用后单个封面耗时不到 90 秒。

  3. Lovart 博客8

    如何为纹身工作室打造品牌套件

    Lovart 发布纹身工作室品牌套件设计指南,给出主墨水黑 #0D0D0D、副血红色 #B71C1C、点缀金色 #D4AF37 等完整配色方案,以及黑体标志、Bebas Neue 标题、Roboto Condensed 正文的字体组合。指南覆盖经典闪片、精品艺术、私人预约三类工作室模板,并包含同意书、护理卡、作品集等模板,其中同意书模板已按样本州卫生部门纹身法规验证。

7月28日周二
7月25日周六
  1. Midjourney Updates50

    Midjourney 发布 V8.2 图像模型

    Midjourney 发布 V8.2 图像模型,本次更新聚焦美学、图像质量与个性化。官方称图像将更具创意、大胆、精致、前卫和新颖,低质量图像出现的随机情况应会大幅减少。个性化功能将更好地理解用户品味,V8.2 的个性化配置文件拥有更大且更优质的图像池可供选择。

7月24日周五
7月23日周四
  1. Midjourney Updates38

    Midjourney 宣布首次收购,将 Co–Star 及其团队纳入麾下

    Midjourney 宣布完成其首次收购,标的为占星应用 Co–Star,创始人 Banu 将携团队加入,负责搭建围绕产品与设计的更大组织。Co–Star 本身仍完全由 Banu 掌控和主导,但将获得大幅扩充的资源和团队支持。Midjourney 表示未来 6 个月还将公布约 6 个同样雄心勃勃的项目,并正在招聘。

7月22日周三
  1. Lovart 博客22

    2026年Haiper AI替代方案对比:视频生成工具横向评测

    Haiper AI定位产品微动效,速度快(约25-35秒)、价格$15/月,但不支持局部修改、复杂场景画质不如Runway Gen-3、人物视频质量一般。若需更长视频可选Runway Gen-3(10秒)或Luma Dream Machine(约5秒),追求速度可选Pixverse(4秒视频约20-30秒生成),需要品牌级批量生产则可用Lovart Nano Banana Pro。

  2. Lovart 博客12

    2026最佳AI设计工具选购指南:Lovart、Midjourney、Canva 怎么选

    Lovart 博客发布 2026 年 AI 设计工具选购指南,提出按设计场景、预算和团队规模三步选型,而非给出排名。指南称 Lovart 是唯一具备品牌管理(Brand Kit)的 AI 工具,$20/月的 Lovart Pro 可覆盖图像生成、排版与品牌管理,免费组合 Pixverse + Canva 免费版 + Lovart 免费版可覆盖 80% 日常需求。

  3. Lovart 博客22

    2026年免费AI设计工具完全指南:Stable Diffusion、Lovart、GIMP 等怎么选

    2026年免费AI设计工具可分为真正免费(开源)与免费层级(增值模式)两类,Stable Diffusion 本地运行被视为免费AI图像生成的最强选择,需 6GB 以上显存 NVIDIA GPU。Lovart 免费版提供 100 积分起始、720p 生成、1000+ 模板与基础编辑,付费层级为基础版 19 美元、专业版 49 美元。免费工具普遍存在分辨率限制、处理优先级降级与商业使用条款限制。

  4. Manus 博客60

    Manus 推出 Plan Mode:执行前先审阅方案

    Manus 发布 Plan Mode,在开始构建前先暂停并生成一份包含目标、步骤和约束的 Markdown 计划,用户可编辑并确认后 Manus 才按计划执行。该功能为手动启用,Web 端输入 / 选择 Plan,移动端点击 + 选择 Plan Mode,可在任务中途开启,目前已在 Web 和移动端向所有用户开放。

    推荐理由:官方说明 Plan Mode 在执行前插入方案审阅步骤,读者可据此判断它如何改变与智能体协作的流程。

7月17日周五
7月16日周四
7月14日周二
  1. Manus 博客60

    Manus 推出 PowerPoint 模式,直接生成原生 .pptx 文件

    Manus 推出 PowerPoint 模式,可直接生成原生 .pptx 文件,而非从网页格式转换或导出。图表背后保留可编辑的数据表格,表格为结构化单元格,布局遵循标准幻灯片母版,可在 Microsoft PowerPoint 或 Google Slides 中打开并继续编辑。

    推荐理由:官方说明原生 .pptx 输出与图表数据可编辑的差异,读者可据此判断 AI 生成演示文稿的可用性变化。

7月13日周一
  1. Manus 博客32

    Manus 推出自动发布:构建成功即自动上线

    Manus 上线自动发布功能,开启后每次成功构建都会直接部署到公开 URL,无需再手动打开发布菜单确认。该开关默认关闭,可在发布弹窗底部随时开启或关闭,构建失败时线上网站保持上一个稳定版本。功能已面向所有用户开放,支持网页端、iOS 和 Android。

7月9日周四
  1. Meta AI Research · Muse85

    Meta 发布 Muse Spark 1.1 多模态推理模型并开放 Meta Model API 预览

    Meta Superintelligence Labs 发布 Muse Spark 1.1,这是 Muse Spark 的升级版多模态推理模型,面向智能体任务,在工具与电脑操作、编码和多模态理解上有明显提升。

    推荐理由:Meta 发布面向智能体任务的多模态推理模型,并首次开放 Meta Model API 公共预览,读者可据此了解其能力定位与接入方式。

  2. Manus 博客58

    Manus 推出 Branch:从同一节点开启多条并行会话

    Manus 推出 Branch 功能,用户点击消息下方的分支图标即可从该节点开启并行会话,继承此前的指令、文件和对话历史,原始会话保持不变。每个分支携带独立的上下文副本,可从同一条消息多次分支,并支持逐层再分支。该功能面向所有用户开放,适用于标准 Manus 对话会话,暂不支持 Web Builder 会话。

7月7日周二
6月30日周二
  1. Manus 博客38

    Manus 上线 Mobbin 连接器:用 60 万张真实应用截图驱动设计与开发

    Manus 推出 Mobbin 连接器,可读取 Mobbin 收录的超过 60 万张已上线产品真实截图、流程和板块,并直接转化为可运行应用、演示文稿或设计评审。该连接器提供截图搜索、多步用户流程分析和网站板块审阅三个工具,支持 KYC 调研、相机应用构建、竞品模式图谱和 Figma 设计稿评审等场景。使用需付费 Mobbin 计划(Pro 或 Team),连接器严格只读,用户可随时撤销授权。

6月26日周五
6月24日周三