Figma 更新生成式插件与 shader:支持动画交互、社区发布与代码查看
Figma 为生成式插件和 shader 新增动画与交互能力,可通过提示词让 agent 生成响应鼠标移动的动态 shader 效果。用户还能将插件和 shader 发布至 Figma Community 或组织内部(仅 Organization 和 Enterprise 计划),并在 Figma 中查看和下载代码。
Figma 为生成式插件和 shader 新增动画与交互能力,可通过提示词让 agent 生成响应鼠标移动的动态 shader 效果。用户还能将插件和 shader 发布至 Figma Community 或组织内部(仅 Organization 和 Enterprise 计划),并在 Figma 中查看和下载代码。
Manus 宣布已正式恢复独立运营,创始团队将继续领导公司,并作为独立运营的 AI Agent 实验室推进通用 AI Agent 的能力与产品。部分用户此前需备份和恢复数据并经历访问临时中断,官方提供了恢复入口,恢复没有截止日期,未受影响的用户无需操作。Manus 表示后续会更深入融入日常工作流程、更直接地与周围世界互动,并更主动地代表用户采取行动。
Pyromind 创始人兼 CEO Kevin Ding 在访谈中提出,AI 终局更像 Agent 蜂群而非超级基础模型一统天下,公司押注 AutoRL,把训练、奖励、反馈、部署与数据回流串成自动循环管道。
Mind Lab 研究员逯雨鑫以个人开发者身份、数百美元成本后训练的两个小模型两次登顶 Hugging Face Model Trending 榜首,他此前没有 AI Lab 经历,也不是 AI PhD,整个过程只用了 2 周。
Midjourney 更新了 V8.2 编辑模型,图像质量得到提升。官方称过去 24 小时内遇到问题的用户可重新尝试,并继续反馈意见,后续还会有更多更新。
Midjourney 开始让所有用户测试其首个 V8.2 图像编辑模型,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)与画布扩展(outpainting),并可使用 personalization、moodboards 和 srefs。
推荐理由:官方公布 V8.2 图像编辑模型的首批能力与入口,可据此了解 Midjourney 编辑能力从参考图到局部重绘的覆盖范围。
Meta 最新 AI 优化数据中心大多采用闭环液冷,冷却液(水与乙二醇混合)在密封回路中循环,经热交换器散热后回流服务器机架,预计可连续使用长达十年无需更换。Meta 称典型采用干冷器的闭环液冷 AI 数据中心年用水量低于几家全服务餐厅,且相比风冷可在同一机架内容纳更多 GPU。
Google Flow 通过 Gemini Omni 1.1 Flash 推出更新,带来更多创作控制能力。新增首尾帧控制以保持角色与叙事一致,支持导出 1080p 或 4K 视频,并可用 360p 低额度快速草拟、再下载 720p 版本。这些能力即日起在 Google Flow 中可用。
Kimi K3 是有效扩展到 2.8T 总参数并全量开源的 MoE 模型,清华博士候选人孙宇涛领读其技术报告,串联讲解十余篇相关论文。报告覆盖线性注意力、Gated MLA、Attention Residuals、Stable LatentMoE 与 Muon 等架构创新,以及预训练、多教师 On-Policy 蒸馏和 KDA Kernel 等基础设施。
Figma 桌面端(macOS 和 Windows)现已支持把 agent 聊天面板打开为独立新窗口,可移动到屏幕任意位置,并在使用其他工具或切换标签页时保持可见。该功能随 Figma AI 更新发布。
Higgsfield 联盟计划向有受众的创作者开放申请,佣金最高为订阅费用的 25%,覆盖付费订阅、续订与升级,最长持续 12 个月。被推荐用户通过专属链接登录后可享最高 50% 折扣,折扣自登录起 3 小时内有效;季度和年度计划的首笔佣金需持有最多 90 天,退款订单不计佣金。
Figma 为矢量编辑加入擦除(Erase)和拖拽填充(drag to fill)两项操作。该更新收录于 Figma Release Notes,与自动布局垂直换行、文件夹预览等近期更新并列发布。原文未披露具体版本号、可用范围与上线时间。
RoboParty 萝博派对创始人兼 CEO 黄一今年 22 岁,一年内完成 5 轮融资、累计超过 1 亿美元,股东包括知名 VC 以及小米、宁德等产业方。他把这一年形容为“压缩的人生”,称把十年要吃的苦一年吃完。他判断,若把具身智能比作 42 公里马拉松,机器人本体已跑完 1/4,小脑约跑了一半,大脑可能才跑了一两公里。
Midjourney 为 alpha.midjourney.com 推送更新,侧边栏支持将项目归入可折叠分组树并双击重命名,Upscale、Zoom、Vary 功能回归,Vary 不再默认以 HD 运行。设置项不再自行重置,Relax 模式不会跳回 Fast,站点输入、滑块与图库滚动的卡顿已修复。官方提醒此次密集修复可能引入新 bug,可在 #alpha-ideas-and-bugs 反馈。
Higgsfield 推出 Blender 插件,把 AI 图像、视频、3D、动画与场景生成能力放进 Blender 视口,通过悬浮栏操作,生成结果可直接落入当前场景。
Meta 公布 Muse Spark 1.2 的新评测结果与演示,展示其在视觉编码、图表理解、视觉推理和知识密集型任务上的表现,并称多模态提升在模型可调用工具时最明显。该模型支持将图像或视频转为可运行代码、面向机器人的空间智能与音视频理解,已上线 Meta Model API 和 Muse Code,官方同时预览了内部评测 WildArtifactBench 并放出 10 个任务。
推荐理由:官方给出 Muse Spark 1.2 在多模态任务上的新评测与演示,可了解其在视觉编码、机器人和音视频理解上的能力边界。
出生于2009年、现年17岁的高二学生苏庭灏独立完成预训练研究,其关于 Attention 机制的论文《Attention Projection Mixing with Exogenous Anchors》被 ICML 2026 Main Track 接收。他在这期播客中谈到,AI 让同学们感到人生意义感流失,而他选择以"开心是人之根本"自处,从韩国 ICML 回来后即将去农村支教。
用脚本制作 AI 视频需五步:格式化脚本、拆分为场景、生成分镜表、逐镜生成、按序剪辑。Higgsfield 的 Cinema Studio 4.0 单次生成最长 30 秒、最高 1080p,可依节奏自动切成多个镜头,并支持 30+ 运镜预设、50+ 调色盘与最多 50 张参考图;Popcorn 负责分镜,Soul ID 保持角色一致。
Higgsfield MCP 将 Higgsfield 的图像、视频和音频模型接入 Claude、ChatGPT 等 AI 对话,营销人员可在聊天中直接生成广告创意。
Higgsfield 发布指南,指出 AI 视频显得虚假主要源于三点:光线没有明确来源、运动缺乏重量感、镜头过于平稳顺滑。文章给出用提示词修复的方法,强调用具体光源和方向替代"电影感""真实"等无效词,并说明 Higgsfield 上对应设置的作用及一次 15 秒生成的成本。
Higgsfield 发布 2026 年 TikTok AI 内容制作指南,覆盖 AI influencer、数字人播报、Shorts 剪辑、品牌广告等五种格式,分别对应 AI Influencer Studio、Soul ID + LipSync Studio、Shorts Studio、Marketing Studio 等工具。
ChatGPT 接入 Higgsfield 插件后可直接在对话中生成 AI 视频:插件从 Plugins Directory 添加并登录,ChatGPT 会把一句话需求扩写成完整生成提示词、自动挑选 Higgsfield 模型、设定画幅与时长并返回成片。
Higgsfield 的 Viral Presets 提供 60 多个预制视频特效,用户选预设、上传照片、点击生成三步即可把单张照片变成短视频,多数预设支持 480p 至 4K 分辨率和竖屏比例。
Meta 披露,第三方评估机构 Irregular 在测试预发布版 Muse Spark 1.1 时因环境误配置,使模型可访问开放互联网,并被误指向一个真实网站作为目标,模型因此识别并利用了该网站的安全漏洞,读取部分信息并修改了其数据库。
推荐理由:Meta 复盘第三方测试中模型误攻真实网站的过程,并给出测试隔离与场景审查的整改要求。
英伟达研究副总裁刘洺堉在4小时访谈中详解世界基座模型Cosmos:项目2024年立项,已迭代至Cosmos 3,直属团队不到100人,虚线汇报规模200至300人。他称英伟达不参与存量竞争,黄仁勋要求"做到Cosmos 97",并援引《孙子兵法》"备多则力寡"思考世界模型技术趋势。
Manus 宣布即将恢复以独立公司形式运营,作为与 Meta 分拆的一部分并遵守特定司法辖区监管要求,部分用户在 2025 年 12 月 29 日当天或之后产生的数据将于 2026 年 8 月 23 日 08:00 起至 8 月 24 日期间(SGT)被删除。
推荐理由:官方说明了分拆后部分用户数据的删除与备份时间窗口,受影响用户可据此安排备份。
Meta Superintelligence Labs 发布 Muse Glimmer,一个 30B 参数的开源智能体模型,权重以 Apache 2.0 许可在 Hugging Face 开放下载。
推荐理由:Meta 开源 30B 端侧智能体模型,量化后可在单张消费级 GPU 上运行,读者可据此判断本地智能体的可行边界。
Runta 创始人兼 CEO 戴冠兰认为模型能力已经够了,下一场竞争要卷 infra,因为未来 agent 数量会超过人类,关键问题变成它们跑在哪、怎么管、出事谁负责。
Evolvent AI 联合创始人孟繁青在访谈中提出,国内模型真正的特色并非工程化的 Post-training,而是 Pre-training 阶段被资源限制倒逼出的架构创新,蒸馏只是加速手段而非国模变强的决定性因素。
Introducing Seedance 2.5, our new-generation video creation model! With advancements in long-form storytelling, multimodal reference, and editing, Seedance 2.5 goes beyond longer single-pass video generation, delivering the journey from idea to finished video with greater control. Key highlights include: 1. Users can generate high-quality, 30-second audio-video clips in a single pass, bringing a complete story to life in one take. 2. Users can input up to 30 images, 10 video clips, and 10 audio clips as reference materials in a single pass. 3. Seedance 2.5 offers timestamp-level control for targeted editing of audio and video content, notably improving efficiency and controllability. Visit project homepage learn more: https://seed.bytedance.com/seedance2_5
推荐理由:Seedance 2.5 的 API 上线 BytePlus ModelArk,读者可据此了解单次生成 30 秒音视频与多模态参考的能力边界。
Meta 发布终端编码智能体 Muse Code(beta),由新模型 Muse Spark 1.2 驱动,可在 macOS 或 Linux 安装,面向大型代码仓库的规划、写码与结果验证,并能协调多个常驻子智能体。
推荐理由:官方披露了 Muse Spark 1.2 的编码训练重点与 Muse Code 的运行时设计,可据此判断终端编码智能体的工程取舍。
ElevenLabs 连接器已在 Manus 上线,用户连接已有的 ElevenLabs 账户后,可在同一次对话中生成语音、克隆声音、转录录音并构建语音驱动的应用。
BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中判断,当基础模型趋同、智能开始通胀,AI 应用的新机会藏在 Context 和交互里。他认为 AI 硬件真正稀缺的是产品定义与「注入人性的光辉」,而非华强北 80 块的平替。面对 2026 年的泡沫,他主张投资有愿景的创始人和让人更快乐的产品。
推荐理由:官方给出单次生成时长、参考素材上限和时间戳级编辑三项能力,可据此判断视频创作流程的变化。
清华大学人工智能学院助理教授、KAN 网络一作刘子鸣在访谈中用"太疯狂了"形容当下 neo labs 融资热潮,他于 3 月回国任教并参与创建元环智能。他指出当前资本涌入最活跃的两个方向是世界模型和 AutoResearch(AI for AI),并梳理了今年中美做 AI for AI 的创业团队与路线。
Google Flow Sessions 第四期结营,这一为期六周的创意合作项目让艺术家们借助 Google Flow 的生成模型完成各自的短片创作,作品现已公开。该项目以共同创作为核心,为创作者提供时间和空间把个人热情项目落地。
Google 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升:可生成更丰富自然的旋律结构,歌词质量与提示词遵循度、结构感知更好,人声更具表现力和情感且发音改善,同时更易控制输出的节奏与时长。