跳到正文

全部动态

今日 16 条
9月17日周四
  1. Figma Release Notes28

    Figma 推出 Figma node,可将 Figma Design 设计接入 Weave 工作流

    Figma 上线 Figma node,支持把 Figma Design 中已完成的任意 frame 复制粘贴进 Figma Weave 工作流并成为节点。用户可指定文本和图像图层作为工作流输入,同时保留原有字体、布局与样式,用于批量生成营销变体、本地化素材、新视觉和视频。该节点现已可用,原始 Figma 设计的改动可同步至 Weave 保持素材更新。

  2. SpaceXAI58

    xAI 的 Grok Voice 已在 fal 上线,可用于构建低延迟、能解决真实客户问题的智能体。该语音模型响应时间为 0.70 秒,可在句子结束前完成工具调用,支持带词级时间戳的转写、25 种以上语言的 30 多种音色文本转语音,并可用两分钟音频进行声音克隆。

    引用fal@fal

    Grok Voice is live on fal. The latest speech model from @SpaceXAI that answers in 0.70 seconds and finishes its tool calls before the sentence ends. Transcription with word-level timestamps, text to speech in 30+ voices across 25+ languages, and cloning from two minutes of audio. Every voice in this video is from Grok Voice.

  3. 十字路口Crossing33

    对话王家伟:24 岁具身智能首席科学家,从 DeepSeek、字节 Seed 转身投向具身

    24 岁的深朴智能(Simple AI)首席科学家王家伟,从中科大少年班、MSRA、DeepSeek、字节 Seed 一路走到大模型前沿,毕业后转向具身智能。深朴智能从 HiFi-UMI 数据、具身基础模型、Agentic OS 做到本体,开源 2,000 小时数据、内部积累数万小时,模型已观察到一定的 Zero-shot 泛化。

9月16日周三
  1. Google Gemini 博客22

    用 Gemini 处理家务的 4 种方式

    Google 博客介绍用 Gemini 处理家务的 4 种方式:借助 Gemini Live 摄像头排查家电故障、定制膳食计划与购物清单、上传收据照片整理家庭开支,以及对比家庭用车等大额采购。

9月15日周二
  1. MiniMax Design (H3)36

    一句简报 ➕ 一块画布 🟰 一整支制作团队,尽在 #MiniMaxDesign。

    引用Stefan 3D AI@Stefan_3D_AI

    I gave Astra one brief and it delivered the whole scene in Blender, camera direction included. All of it ran inside MiniMax Design. Astra sits there as the agent and talks to Blender over an official connector, so everything syncs straight onto the canvas. The final video is MiniMax H3, from the same canvas. #MiniMaxdesign - https://design.minimax.io/

9月14日周一
  1. 十字路口Crossing30

    当具身智能走到十字路口:苏度、蚂蚁灵波、自变量、破壳的四种一线判断

    在2026 Inclusion外滩大会圆桌现场,苏度科技韩铮、蚂蚁灵波沈宇军、自变量机器人王潜、破壳机器人许华哲四位嘉宾围绕具身智能的路线级分歧展开讨论,议题包括仿真与真机数据之争、GPT-6 Astra 是否会对具身行业形成降维打击,以及高成功率、泛化性与客户持续付费等商业化指标。讨论还涉及五年后哪些领域被高估或低估,以及具身智能是否会复刻语言模型的发展路径。

9月13日周日
9月12日周六
9月11日周五
  1. Google Labs 博客36

    Google Labs 的 Dreambeans 向美国所有账号开放

    Google Labs 的 Dreambeans 现已向美国所有账号(18+)开放,支持 Android 和 iOS。该实验功能结合个性化主题与用户选定的 Google 应用(Calendar、Gmail、Photos、Search、YouTube,以及新增的 Gemini)生成每日故事集,连接 Google Photos 后还可融入用户及亲友的影像。

9月9日周三
  1. Meta Newsroom · AI84

    Meta 推出个人 AI 智能体 Muse,运行在 Muse Secure VM 上

    Meta 推出个人 AI 智能体 Muse,由 Muse Spark 模型驱动,运行在专用虚拟机 Muse Secure VM 上,智能体与用户数据同机存放,另有 Sentinel 智能体在系统层面隔离并审核其联网行为。

    推荐理由:Meta 把个人智能体放进独立安全虚拟机,并给出支付与权限控制方案,可观察大厂如何设计智能体的隐私边界。

9月8日周二
  1. Meta AI Research · Muse71

    Meta 详解 Muse 智能体的安全架构与防护设计

    Meta 发布博客,详解其个人智能体 Muse 的安全、隐私与防护设计,包括运行在隔离 VM 中的运行时单元、独立于智能体的 Sentinel 权限控制,以及针对提示注入的模型训练、分类器与人工审批多层防御。

    推荐理由:Meta 公开了 Muse 智能体的安全架构细节,包括 Sentinel 权限控制与提示注入防御的分层设计。

9月7日周一
  1. 十字路口Crossing31

    快看漫画陈安妮谈 AI Native 新产品 Livo:一个实时活着的 AI 世界

    快看漫画创始人兼 CEO 陈安妮在播客中介绍了她正从零打造的 AI Native 产品 Livo,定位为「一个实时活着的 AI 世界」,其中 AI 角色有自己的故事和梦想,产品最重要的功能名为「命运」。她将 Livo 定义为 AI 时代全新的讲故事范式,并称其与斯坦福小镇等模拟世界产品的核心体验不同。

9月4日周五
  1. Ideogram12

    感谢部长 @EvanLSolomon 拨冗出席并带来振奋人心的讲话。我们的团队比以往任何时候都更兴奋,要在加拿大构建生成式媒体的基础,并为全球企业客户创造价值。

    引用Mohammad Norouzi@mo_norouzi

    It was a pleasure hosting Canada's AI Minister @EvanLSolomon at Ideogram's Toronto HQ. We talked about the 3 C's and 2 T's Canadian AI needs: capital, compute, customers, talent, and trust. Proud of our superstar team, building sovereign generative media here at home. 🇨🇦

9月3日周四
  1. 张小珺Jùn|商业访谈录25

    和曾鸣聊产业史观:OpenAI、Anthropic 大概率不是原生时代大赢家

    战略学家曾鸣提出 AI 产业化分三阶段,最终进入“原生应用阶段”,并判断 OpenAI、Anthropic 大概率不是该阶段的大玩家。他把模型公司类比为已消失的 AOL,认为其本质是未来的 AI 云公司,商业模式只能是寡头垄断加政府强监管。他还认为未来三年有可能出现 Agent 入口,而科层制公司制度将走向消亡。

  2. 十字路口Crossing34

    对卷卷的3小时访谈:从抖音到AI 3D、成为制造业OS的野心、基础模型不会吞噬一切

    数美万物创始人兼CEO任利锋(卷卷)在近3小时访谈中回顾了从0到1孵化抖音的经历,并介绍了公司最新发布的Hi3D 3.0 2048³模型。他将创业目标从Maker OS推向制造业OS,认为基础模型不会吞噬一切,实体制造仍需能产出生产级3D资产的模型,以及拆件、连接结构、材料适配等模型之后的工程能力。

9月2日周三
9月1日周二
  1. Meta AI Research · Muse74

    Meta 发布 Muse Voice Transcribe 实时语音感知模型

    Meta Superintelligence Labs 发布 Muse Voice Transcribe,这是其首款实时音频感知模型,支持流式 ASR、20 人以上说话人分离和端点检测。模型原生支持任意中英混说,训练覆盖 70 多种语言,其中 25 种经过充分验证,并支持超过一小时的长音频输入。官方称其在 Artificial Analysis 流式语音转文字和公开说话人分离基准上排名第一。

    推荐理由:Meta 公布实时语音感知模型的技术细节与基准排名,读者可了解流式 ASR 与说话人分离的实现路径。