跳到正文

全部动态

今日 16 条
9月1日周二
  1. Manus 博客58

    Manus 恢复独立运营,创始团队继续领导公司

    Manus 宣布已正式恢复独立运营,创始团队将继续领导公司,并作为独立运营的 AI Agent 实验室推进通用 AI Agent 的能力与产品。部分用户此前需备份和恢复数据并经历访问临时中断,官方提供了恢复入口,恢复没有截止日期,未受影响的用户无需操作。Manus 表示后续会更深入融入日常工作流程、更直接地与周围世界互动,并更主动地代表用户采取行动。

8月31日周一
8月29日周六
8月28日周五
  1. Midjourney Updates62

    Midjourney 开放首个 V8.2 图像编辑模型测试

    Midjourney 开始让所有用户测试其首个 V8.2 图像编辑模型,支持按指令编辑图像、用最多 4 张参考图生成图像(取代 omni-reference)、局部重绘(inpainting)与画布扩展(outpainting),并可使用 personalization、moodboards 和 srefs。

    推荐理由:官方公布 V8.2 图像编辑模型的首批能力与入口,可据此了解 Midjourney 编辑能力从参考图到局部重绘的覆盖范围。

  2. Meta Newsroom · AI22

    Meta 详解闭环液冷:AI 数据中心背后的“管道工程”

    Meta 最新 AI 优化数据中心大多采用闭环液冷,冷却液(水与乙二醇混合)在密封回路中循环,经热交换器散热后回流服务器机架,预计可连续使用长达十年无需更换。Meta 称典型采用干冷器的闭环液冷 AI 数据中心年用水量低于几家全服务餐厅,且相比风冷可在同一机架内容纳更多 GPU。

8月26日周三
  1. 张小珺Jùn|商业访谈录34

    领读 Kimi K3 技术报告:注意力美学、多教师蒸馏与开源 MoE 架构

    Kimi K3 是有效扩展到 2.8T 总参数并全量开源的 MoE 模型,清华博士候选人孙宇涛领读其技术报告,串联讲解十余篇相关论文。报告覆盖线性注意力、Gated MLA、Attention Residuals、Stable LatentMoE 与 Muon 等架构创新,以及预训练、多教师 On-Policy 蒸馏和 KDA Kernel 等基础设施。

8月25日周二
8月24日周一
  1. 十字路口Crossing31

    对谈萝博派对创始人黄一:22 岁具身 CEO、一年 5 轮融资过亿美元

    RoboParty 萝博派对创始人兼 CEO 黄一今年 22 岁,一年内完成 5 轮融资、累计超过 1 亿美元,股东包括知名 VC 以及小米、宁德等产业方。他把这一年形容为“压缩的人生”,称把十年要吃的苦一年吃完。他判断,若把具身智能比作 42 公里马拉松,机器人本体已跑完 1/4,小脑约跑了一半,大脑可能才跑了一两公里。

8月22日周六
  1. Midjourney Updates17

    Midjourney 发布 alpha.midjourney.com 更新日志:文件夹分组、Upscale/Zoom/Vary 回归

    Midjourney 为 alpha.midjourney.com 推送更新,侧边栏支持将项目归入可折叠分组树并双击重命名,Upscale、Zoom、Vary 功能回归,Vary 不再默认以 HD 运行。设置项不再自行重置,Relax 模式不会跳回 Fast,站点输入、滑块与图库滚动的卡顿已修复。官方提醒此次密集修复可能引入新 bug,可在 #alpha-ideas-and-bugs 反馈。

8月21日周五
8月20日周四
  1. Meta AI Research · Muse66

    Meta 发布 Muse Spark 1.2 多模态评测结果

    Meta 公布 Muse Spark 1.2 的新评测结果与演示,展示其在视觉编码、图表理解、视觉推理和知识密集型任务上的表现,并称多模态提升在模型可调用工具时最明显。该模型支持将图像或视频转为可运行代码、面向机器人的空间智能与音视频理解,已上线 Meta Model API 和 Muse Code,官方同时预览了内部评测 WildArtifactBench 并放出 10 个任务。

    推荐理由:官方给出 Muse Spark 1.2 在多模态任务上的新评测与演示,可了解其在视觉编码、机器人和音视频理解上的能力边界。

8月19日周三
  1. 张小珺Jùn|商业访谈录22

    17岁高中生苏庭灏独立完成预训练论文被 ICML 2026 收录

    出生于2009年、现年17岁的高二学生苏庭灏独立完成预训练研究,其关于 Attention 机制的论文《Attention Projection Mixing with Exogenous Anchors》被 ICML 2026 Main Track 接收。他在这期播客中谈到,AI 让同学们感到人生意义感流失,而他选择以"开心是人之根本"自处,从韩国 ICML 回来后即将去农村支教。

8月18日周二
  1. Higgsfield Blog22

    如何用脚本制作 AI 视频:2026 年分步指南

    用脚本制作 AI 视频需五步:格式化脚本、拆分为场景、生成分镜表、逐镜生成、按序剪辑。Higgsfield 的 Cinema Studio 4.0 单次生成最长 30 秒、最高 1080p,可依节奏自动切成多个镜头,并支持 30+ 运镜预设、50+ 调色盘与最多 50 张参考图;Popcorn 负责分镜,Soul ID 保持角色一致。

  2. Higgsfield Blog22

    如何让 AI 视频看起来真实:光照、运动与镜头控制(Higgsfield 指南)

    Higgsfield 发布指南,指出 AI 视频显得虚假主要源于三点:光线没有明确来源、运动缺乏重量感、镜头过于平稳顺滑。文章给出用提示词修复的方法,强调用具体光源和方向替代"电影感""真实"等无效词,并说明 Higgsfield 上对应设置的作用及一次 15 秒生成的成本。

8月17日周一
8月15日周六
8月14日周五
  1. Meta AI Research · Muse71

    Meta 回应 Muse Spark 1.1 第三方网络安全测试误配置事件

    Meta 披露,第三方评估机构 Irregular 在测试预发布版 Muse Spark 1.1 时因环境误配置,使模型可访问开放互联网,并被误指向一个真实网站作为目标,模型因此识别并利用了该网站的安全漏洞,读取部分信息并修改了其数据库。

    推荐理由:Meta 复盘第三方测试中模型误攻真实网站的过程,并给出测试隔离与场景审查的整改要求。

8月13日周四
  1. 张小珺Jùn|商业访谈录39

    对英伟达研究副总裁刘洺堉的4小时访谈:功夫、Cosmos 3、开源世界模型与黄仁勋

    英伟达研究副总裁刘洺堉在4小时访谈中详解世界基座模型Cosmos:项目2024年立项,已迭代至Cosmos 3,直属团队不到100人,虚线汇报规模200至300人。他称英伟达不参与存量竞争,黄仁勋要求"做到Cosmos 97",并援引《孙子兵法》"备多则力寡"思考世界模型技术趋势。

8月12日周三
8月11日周二
  1. Manus 博客62

    Manus 恢复独立运营,部分用户数据将于 8 月 23 日起删除

    Manus 宣布即将恢复以独立公司形式运营,作为与 Meta 分拆的一部分并遵守特定司法辖区监管要求,部分用户在 2025 年 12 月 29 日当天或之后产生的数据将于 2026 年 8 月 23 日 08:00 起至 8 月 24 日期间(SGT)被删除。

    推荐理由:官方说明了分拆后部分用户数据的删除与备份时间窗口,受影响用户可据此安排备份。

8月10日周一
8月8日周六
8月7日周五
  1. ByteDance Seed78

    Dreamina Seedance 2.5 的 API 服务已在 BytePlus ModelArk 上线,同时可在 Dreamina、CapCut 等平台体验。该模型支持单次生成 30 秒高质量音视频片段,单次最多输入 30 张图片、10 段视频和 10 段音频作为参考素材,并提供时间戳级别的音视频定向编辑控制。

    引用ByteDance Seed@ByteDanceSeed_

    Introducing Seedance 2.5, our new-generation video creation model! With advancements in long-form storytelling, multimodal reference, and editing, Seedance 2.5 goes beyond longer single-pass video generation, delivering the journey from idea to finished video with greater control. Key highlights include: 1. Users can generate high-quality, 30-second audio-video clips in a single pass, bringing a complete story to life in one take. 2. Users can input up to 30 images, 10 video clips, and 10 audio clips as reference materials in a single pass. 3. Seedance 2.5 offers timestamp-level control for targeted editing of audio and video content, notably improving efficiency and controllability. Visit project homepage learn more: https://seed.bytedance.com/seedance2_5

    推荐理由:Seedance 2.5 的 API 上线 BytePlus ModelArk,读者可据此了解单次生成 30 秒音视频与多模态参考的能力边界。

8月5日周三
  1. Meta AI Research · Muse78

    Meta 发布 Muse Code 终端编码智能体与 Muse Spark 1.2 模型

    Meta 发布终端编码智能体 Muse Code(beta),由新模型 Muse Spark 1.2 驱动,可在 macOS 或 Linux 安装,面向大型代码仓库的规划、写码与结果验证,并能协调多个常驻子智能体。

    推荐理由:官方披露了 Muse Spark 1.2 的编码训练重点与 Muse Code 的运行时设计,可据此判断终端编码智能体的工程取舍。

8月3日周一
  1. 十字路口Crossing22

    对谈汪天凡:AI 应用机会藏在 Context 与交互里,2026 该投真正的快乐

    BAI Capital 高级合伙人汪天凡在「十字路口」公路播客中判断,当基础模型趋同、智能开始通胀,AI 应用的新机会藏在 Context 和交互里。他认为 AI 硬件真正稀缺的是产品定义与「注入人性的光辉」,而非华强北 80 块的平替。面对 2026 年的泡沫,他主张投资有愿景的创始人和让人更快乐的产品。

7月31日周五
  1. ByteDance Seed78

    字节跳动 Seed 发布新一代视频创作模型 Seedance 2.5,在长叙事、多模态参考和编辑能力上做了升级。该模型支持单次生成 30 秒高质量音视频片段,单次可输入最多 30 张图片、10 段视频和 10 段音频作为参考素材,并提供时间戳级控制以对音视频内容做定向编辑。项目主页为 https://seed.bytedance.com/seedance2_5。

    推荐理由:官方给出单次生成时长、参考素材上限和时间戳级编辑三项能力,可据此判断视频创作流程的变化。

  2. 张小珺Jùn|商业访谈录36

    清华刘子鸣聊中美 neo labs 资本狂潮:AI for AI、机制可解释性与 Max Tegmark

    清华大学人工智能学院助理教授、KAN 网络一作刘子鸣在访谈中用"太疯狂了"形容当下 neo labs 融资热潮,他于 3 月回国任教并参与创建元环智能。他指出当前资本涌入最活跃的两个方向是世界模型和 AutoResearch(AI for AI),并梳理了今年中美做 AI for AI 的创业团队与路线。

7月30日周四
  1. Google Labs 博客58

    Google 发布音乐生成模型 Lyria 3.5,上线 Flow Music

    Google 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升:可生成更丰富自然的旋律结构,歌词质量与提示词遵循度、结构感知更好,人声更具表现力和情感且发音改善,同时更易控制输出的节奏与时长。