跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 21–40 条 · 共 48 条
9月2日周三
8月27日周四
8月20日周四
  1. Meta AI Research · Muse66

    Meta 发布 Muse Spark 1.2 多模态评测结果

    Meta 公布 Muse Spark 1.2 的新评测结果与演示,展示其在视觉编码、图表理解、视觉推理和知识密集型任务上的表现,并称多模态提升在模型可调用工具时最明显。该模型支持将图像或视频转为可运行代码、面向机器人的空间智能与音视频理解,已上线 Meta Model API 和 Muse Code,官方同时预览了内部评测 WildArtifactBench 并放出 10 个任务。

    推荐理由:官方给出 Muse Spark 1.2 在多模态任务上的新评测与演示,可了解其在视觉编码、机器人和音视频理解上的能力边界。

8月11日周二
  1. Manus 博客62

    Manus 恢复独立运营,部分用户数据将于 8 月 23 日起删除

    Manus 宣布即将恢复以独立公司形式运营,作为与 Meta 分拆的一部分并遵守特定司法辖区监管要求,部分用户在 2025 年 12 月 29 日当天或之后产生的数据将于 2026 年 8 月 23 日 08:00 起至 8 月 24 日期间(SGT)被删除。

    推荐理由:官方说明了分拆后部分用户数据的删除与备份时间窗口,受影响用户可据此安排备份。

8月10日周一
8月5日周三
  1. Meta AI Research · Muse78

    Meta 发布 Muse Code 终端编码智能体与 Muse Spark 1.2 模型

    Meta 发布终端编码智能体 Muse Code(beta),由新模型 Muse Spark 1.2 驱动,可在 macOS 或 Linux 安装,面向大型代码仓库的规划、写码与结果验证,并能协调多个常驻子智能体。

    推荐理由:官方披露了 Muse Spark 1.2 的编码训练重点与 Muse Code 的运行时设计,可据此判断终端编码智能体的工程取舍。

7月22日周三
  1. Manus 博客60

    Manus 推出 Plan Mode:执行前先审阅方案

    Manus 发布 Plan Mode,在开始构建前先暂停并生成一份包含目标、步骤和约束的 Markdown 计划,用户可编辑并确认后 Manus 才按计划执行。该功能为手动启用,Web 端输入 / 选择 Plan,移动端点击 + 选择 Plan Mode,可在任务中途开启,目前已在 Web 和移动端向所有用户开放。

    推荐理由:官方说明 Plan Mode 在执行前插入方案审阅步骤,读者可据此判断它如何改变与智能体协作的流程。

7月14日周二
  1. Manus 博客60

    Manus 推出 PowerPoint 模式,直接生成原生 .pptx 文件

    Manus 推出 PowerPoint 模式,可直接生成原生 .pptx 文件,而非从网页格式转换或导出。图表背后保留可编辑的数据表格,表格为结构化单元格,布局遵循标准幻灯片母版,可在 Microsoft PowerPoint 或 Google Slides 中打开并继续编辑。

    推荐理由:官方说明原生 .pptx 输出与图表数据可编辑的差异,读者可据此判断 AI 生成演示文稿的可用性变化。

7月9日周四
  1. Meta AI Research · Muse85

    Meta 发布 Muse Spark 1.1 多模态推理模型并开放 Meta Model API 预览

    Meta Superintelligence Labs 发布 Muse Spark 1.1,这是 Muse Spark 的升级版多模态推理模型,面向智能体任务,在工具与电脑操作、编码和多模态理解上有明显提升。

    推荐理由:Meta 发布面向智能体任务的多模态推理模型,并首次开放 Meta Model API 公共预览,读者可据此了解其能力定位与接入方式。

5月28日周四
5月25日周一
5月20日周三
  1. Google Labs 博客74

    Google Flow 与 Flow Music 新增智能体、Gemini Omni 和移动应用

    Google 为 Google Flow 和 Google Flow Music 推出多项新能力:Gemini Omni Flash 模型支持从任意输入生成内容并实现精准视频剪辑,Flow Agent 可协助头脑风暴、批量编辑和整理素材,Flow Tools 让用户用自然语言创建并分享自定义工具。

    推荐理由:Google Flow 一次性补齐智能体、自然语言建工具和移动端,读者可据此判断 AI 创作工具正从单点生成走向全流程协作。

  2. Google Labs 博客88

    Google I/O 2026:Gemini 3.5 Flash、Gemini Omni 与 Antigravity 2.0 发布

    Google 在 I/O 2026 发布 Gemini 3.5 Flash,官方称其对比 3.1 Pro 在几乎所有基准上更好,输出速度是其他前沿模型的 4 倍,价格不到同类前沿模型的一半,即日起在 Google 全线产品与 API 提供,Gemini 3.5 Pro 将于下月推出。

    推荐理由:Google 一次性放出 Gemini 3.5 Flash、Gemini Omni 与 Antigravity 2.0,读者可据此判断其智能体产品线的整体走向。

  3. Google Labs 博客62

    Google Labs 为 Stitch 推出实时协作设计新功能

    Google Labs 在 I/O 上宣布 Stitch 新增实时设计方式,用户可与 Stitch Agent 协作,实时设计、流式生成并调整迭代。用户可用文本提示词、语音或导入现有代码库与设计文件作为起点,完成后可通过 Google AI Studio 生成可分享链接,并将界面导出到 Google Antigravity 接入后端逻辑,或直接通过 Netlify 发布到网页。

    推荐理由:Google Labs 在 I/O 上公布 Stitch 的实时协作设计能力,读者可了解其输入方式与导出链路。

  4. Google Labs 博客60

    Google 为 Project Genie 加入 Street View 实景能力并扩大开放范围

    Google DeepMind 为实验性原型 Project Genie 推出 Street View 实景锚定能力,用户可选取美国地点并搭配风格与角色描述,生成起点绑定真实街景的互动世界,该能力由 Maps Imagery Grounding 技术驱动。

    推荐理由:官方说明 Genie 接入 Street View 实景锚定,读者可了解世界模型如何为智能体与机器人提供贴近现实的环境。

  5. Google Labs 博客62

    Google 发布 Gemini for Science 科研工具集

    Google 推出 Gemini for Science,包含 Google Labs 上的三个实验性工具:基于 Co-Scientist 的 Hypothesis Generation。

    推荐理由:Google 把 Co-Scientist、AlphaEvolve 等研究工具打包成面向科研的智能体产品,读者可了解其能力边界与开放节奏。

5月6日周三
  1. Manus 博客62

    Manus 推出可从任务中学习的 Project 功能

    Manus 为 Project 推出自我更新功能,可将对话中可复用的决策、术语和工作流模式识别出来,提出对 Project 指令、文件和技能的更新建议,仅在用户审批通过后才应用。用户可通过提示词手动触发审查,例如让 Manus 检查对话并建议更新;官方称该功能适用于支持 Project 指令和文件的会话,若工作区或任务不支持 Project 上下文则不适用。

    推荐理由:官方说明 Project 如何从对话中提炼指令、文件与技能更新,并保留用户审批环节,可据此判断团队上下文维护方式的变化。

4月30日周四
4月6日周一
  1. Manus 博客60

    Manus 推出 Slack 集成,提供 Agent、频道标记与 MCP 连接器三种用法

    Manus 发布一整套 Slack 集成,提供三种使用方式:Manus Agent 以私信形式对话并具备持久记忆,Slack 集成可在频道话题中标记 @manus 读取上下文并发布结果,Slack 连接器基于 MCP 让 Manus 阅读频道并以用户身份发送消息。

    推荐理由:官方给出三种 Slack 集成方式与各自适用场景,读者可据此判断哪种方式适合自己团队的工作流。