
엔비디아가 28일 공식 기술 블로그에서 AI 에이전트의 권한과 행동을 실행 중 통제하기 위한 '오픈 에이전트 안전 플랫폼'을 소개했다. 에이전트를 격리하는 오픈셸(OpenShell) 런타임에 블루필드 데이터처리장치(DPU)를 활용한 센트리(Sentry) 감시 계층을 선택적으로 더하는 구조다. 회사는 이를 완제품 하나가 아닌 응용 프로그램·런타임·인프라를 잇는 개방형 설계로 설명했다.
오픈셸은 에이전트마다 샌드박스를 만들고 파일, 프로세스, 네트워크, 자격 증명에 대한 접근 범위를 정책으로 제한한다. 엔비디아가 같은 날 공개한 기술 설명에 따르면 0.1.0 버전은 정책 검증과 자격 증명 보호 기능을 제공한다. 외부 감독 구성요소가 HTTP·GraphQL·MCP 요청을 검사할 수 있어, 같은 API에서도 읽기는 허용하고 쓰기는 막는 방식이 가능하다. 에이전트가 셸을 열거나 코드를 실행해도 통제는 작업 환경 밖에 남는다.
센트리는 블루필드 하드웨어에서 에이전트의 상호작용과 정책 판단, 도구·데이터 접근을 살펴 이상 행동을 탐지하도록 설계됐다. 다만 이 계층은 오픈셸 사용에 필수인 구성요소가 아니다. 엔비디아는 플랫폼이 자사 베라 CPU·블루필드 DPU 시스템에 최적화돼 있지만 다른 하드웨어 시스템과도 호환된다고 밝혔다.
이번 발표의 초점은 모델이 스스로 지침을 지키는지에만 의존하지 않고, 에이전트가 실제로 할 수 있는 작업을 실행 환경과 인프라에서 제한하는 데 있다. 엔비디아는 오픈셸을 아파치 2.0 라이선스의 오픈소스로 제공한다. 다만 블로그에 제시된 안전 효과는 회사의 설계와 실험 설명이며, 다양한 실제 운영 환경에서의 성능이 독립적으로 검증됐다는 뜻은 아니다.
출처: 엔비디아 기술 블로그 https://developer.nvidia.com/blog/nvidia-open-agent-safety-platform-a-reference-for-continuous-in-silicon-agent-monitoring/ ; 엔비디아 오픈셸 기술 설명 https://developer.nvidia.com/blog/add-runtime-controls-to-ai-agents-with-nvidia-openshell/ ; 엔비디아 오픈셸 저장소 https://github.com/NVIDIA/OpenShell









