安全提醒 2026-09-29

英伟达发布开放智能体安全平台:给 AI 代理套上「硬件级护栏」

英伟达发布开放智能体安全平台:给 AI 代理套上「硬件级护栏」

一句话说清:英伟达发布了一套开放的安全平台,给「会自己干活的 AI 代理」套上硬件级护栏——一旦它想越界乱动,系统在几毫秒内就能把它隔离、叫停。

发生了什么

  • 9 月底,英伟达宣布 Open Agent Safety Platform(开放智能体安全平台);
  • 它由两个部分组成:开源软件 OpenShell(给 AI 代理划出可执行的「活动边界」),以及硬件监控器 Sentry(跑在专用芯片上,独立盯着代理的一举一动);
  • 如果 AI 代理试图超出自己的权限去碰不该碰的文件、系统或数据,Sentry 能在毫秒级把它隔离并停掉;
  • 已有 100 多家机构和公司参与,包括 Anthropic、微软、IBM、Palantir、摩根大通等。

对我有什么用

  • 这事儿听着很技术,但和你有关:现在越来越多的 AI 会「自己操作电脑、自己发消息、自己调钱」;
  • 这类安全护栏的意义是——不能只靠 AI「自觉」,必须在它之外有硬约束;
  • 你用任何「能替你办事」的 AI 工具时,记住:它该有边界,你也该给它最小权限。

我可以怎么做

  1. 用 AI 代理类工具时,别一次性授权全部文件、全部账号,先给「只做这一件事」的权限;
  2. 涉及钱、对外发信、删改数据的操作,设成「必须你本人确认」才执行;
  3. 关注工具是否提供「操作日志 / 可审核」功能,能看见 AI 干了啥才放心。

温馨提醒

  • 再强的护栏也防不住「你主动把密码、验证码告诉 AI」——边界是防越权,不是防你自己的误操作;
  • 看到「全自动、零确认、替你搞定一切」的宣传要警惕,真正稳妥的产品会让你保留最终开关;
  • 遇到 AI 相关的诈骗或越权骚扰,保存证据并拨打 96110 / 110。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发