OpenAI 就澳大利亚政府网站相关事件致歉并承诺加强防护
OpenAI 就涉及澳大利亚政府网站的事件致歉,并公布更严格的防护措施与支持方案,以协助强化澳大利亚的网络防御能力。
OpenAI 就涉及澳大利亚政府网站的事件致歉,并公布更严格的防护措施与支持方案,以协助强化澳大利亚的网络防御能力。
OpenAI 公布前沿 AI 训练安全案例的早期指南,覆盖技术防护措施、运营实践以及失准(misalignment)事件的调查。该指南面向前沿 AI 训练环节的安全论证,目前处于早期阶段。
Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry. Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to come. But its full promise can only be realized when people have confidence that AI is being built to be safe and deployed with wisdom and responsibility. This is bigger than a single product. It's the beginning of an open ecosystem to build the trust layer for safe agent systems. Together, we are building the foundation of the AI economy. Trust and innovation are not in conflict. Safety is how trust is earned. We must build not only the most capable AI, but the most trusted AI, so that this extraordinary technology can realize its enormous promise for the world. https://nvda.ws/4hcoq7m
Meta 发布博客,详解其个人智能体 Muse 的安全、隐私与防护设计,包括运行在隔离 VM 中的运行时单元、独立于智能体的 Sentinel 权限控制,以及针对提示注入的模型训练、分类器与人工审批多层防御。
推荐理由:Meta 公开了 Muse 智能体的安全架构细节,包括 Sentinel 权限控制与提示注入防御的分层设计。
Google 推出 Fairwind Program,这是一个面向政府、Google Cloud 客户和网络安全合作伙伴的受限访问计划,首批提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具组合,用于自主发现、验证并修复漏洞。
推荐理由:Google 把前沿模型与自动修复工具打包成受限访问计划,读者可了解其面向政府与关键基础设施的准入方式。
Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber 两个变体,前者面向长程编码与自主智能体,后者面向漏洞发现与自动修复。
推荐理由:官方给出 3.8 Flash 与 Cyber 两个变体的定价、基准表现和开放入口,可据此判断长程编码与安全场景的选型。
Meta 发布 Muse Spark 1.3,在智能体与编码任务上性能提升,max reasoning 版本已在 Muse Code 和 Meta Model API 上线。
推荐理由:官方给出智能体与编码任务的改进细节和工具调用、token 消耗降幅,可据此判断长任务工作流的变化。
Meta 披露,第三方评估机构 Irregular 在测试预发布版 Muse Spark 1.1 时因环境误配置,使模型可访问开放互联网,并被误指向一个真实网站作为目标,模型因此识别并利用了该网站的安全漏洞,读取部分信息并修改了其数据库。
推荐理由:Meta 复盘第三方测试中模型误攻真实网站的过程,并给出测试隔离与场景审查的整改要求。
Sam Altman 公开家人照片,回应其住宅昨夜 3:45 遭燃烧瓶袭击一事,称燃烧瓶弹开、无人受伤。他表示此前一篇煽动性文章让他低估了文字与叙事的威力,并借此重申对 OpenAI 的信念:AI 需求几乎无上限、必须民主化、权力不能过度集中。他还回顾在 OpenAI 第一个十年的成绩与错误,称与 Elon 的诉讼临近,并坦言自己并非骄傲于回避冲突。
18岁的涂津豪是 DeepSeek 前高中实习生、阿里全球数学竞赛 AI 组冠军、Thinking Claude 作者,每天和 AI 对话约 2 小时。他判断下一代 AI 产品的三个核心方向是主动式 AI、context-aware 的 Memory,以及比 Benchmark 更重要的 Model Character,并认为 Continual Learning 是 2026 的关键方向。
蚂蚁集团副总裁、首席技术安全官、蚂蚁密算董事长韦韬在「隐语」开源社区三周年对话中提出,密态计算让数据"可用不可见",高阶程序通过任务拆解与自动核验构建可靠保障框架,二者或成 AI 走向工业化的关键。他同时分享了隐语社区三年来的进展,包括非洲手机巨头的加入。