AI · NVIDIA · IBM · Red Hat · Anthropic · OpenShell · Sentry

NVIDIA ‘Open Agent Safety Platform’ 공개…AI 에이전트를 DPU가 감시한다

NVIDIA가 장시간 일하고 외부 도구까지 호출하는 AI 에이전트를 소프트웨어와 하드웨어 양쪽에서 통제하는 ‘Open Agent Safety Platform’을 공개했습니다. 오픈소스 런타임 OpenShell이 CPU 위에서 행동을 추적하고 정책을 집행하며, Sentry는 BlueField-4 DPU라는 별도 신뢰 영역에서 에이전트가 경계를 넘는지 감시해 밀리초 단위로 격리합니다. IBM은 신원·권한·스토리지 통합 계획을 밝혔습니다. 다만 여러 기능은 개발 단계여서 실제 성능과 오탐률은 구축 사례로 검증해야 합니다.

JJANG-LAB IT TREND
AI 에이전트의 실행 경로를 OpenShell과 BlueField DPU가 이중으로 감시하는 NVIDIA 공식 개념도
이미지: NVIDIA Newsroom 공식 보도자료 이미지

프롬프트 밖에 강제선을 긋다

NVIDIA는 9월 28일 AI 에이전트의 시험부터 운영까지 행동 경계를 강제하는 Open Agent Safety Platform을 발표했습니다. 에이전트는 단순 답변을 넘어 파일을 읽고 API를 호출하며 다른 에이전트에 일을 넘기는 단계로 이동했습니다. 이때 프롬프트에 ‘하지 말라’고 적는 것만으로는 탈취된 에이전트나 잘못된 계획을 막기 어렵다는 판단이 출발점입니다.

플랫폼은 모델 자체의 안전장치와 별도로 실행 환경이 권한을 제한하고 모든 행동을 기록하는 구조를 택했습니다. 조직은 소프트웨어 런타임, 서버 하드웨어, 로봇 등 물리 시스템까지 필요한 계층을 선택해 배치할 수 있습니다. 핵심은 에이전트가 스스로 바꿀 수 없는 외부 통제면을 만드는 것입니다.

OpenShell은 CPU 위의 정책 런타임

OpenShell은 에이전트가 작업하는 CPU에 보안 실행 경계를 만들고 데이터, 도구, API와 서비스 접근을 정책으로 통제합니다. 요청과 응답, 권한 상승 시도, 실행 기록을 추적해 허용된 범위를 벗어나는 행동을 막습니다. 공개된 오픈소스여서 조직이 자체 정책과 모델, 기존 보안 도구에 맞춰 수정할 수 있습니다.

NVIDIA는 OpenShell을 에이전트용 Vera CPU에서 낮은 오버헤드로 구동한다고 설명했습니다. 동시에 특정 칩에만 묶지 않고 Arm과 Intel 플랫폼으로도 확장할 수 있게 했습니다. 폐쇄형 모델과 오픈 모델을 같은 실행 경계에 넣는다는 점도 중요합니다. 모델 공급자가 달라져도 조직의 접근 정책과 감사 체계를 유지할 수 있기 때문입니다.

Sentry는 호스트 밖에서 지켜본다

두 번째 축인 Sentry는 BlueField-4 DPU에서 작동하는 참조 시스템 설계입니다. 애플리케이션과 운영체제가 있는 호스트와 분리된 신뢰 영역에서 에이전트의 네트워크·데이터 요청을 검사합니다. NVIDIA는 에이전트가 경계를 넘으려 하면 밀리초 안에 격리하고 중단하도록 설계했다고 밝혔습니다.

기반 소프트웨어 DOCA는 에이전트 신원을 확인하고 데이터·도구·API별 제로트러스트 정책을 집행하며, 변조 여부를 검증할 수 있는 원격 측정 자료를 남깁니다. 호스트나 에이전트 작업 자체가 침해돼도 감시 계층을 함께 장악하기 어렵게 만드는 방식입니다. 기존 서버 보안이 운영체제 안에서 방화벽과 로그를 돌리는 것과 구별되는 지점입니다.

IBM은 신원과 최소 권한을 연결

IBM은 같은 날 공식 글에서 Agent Identity와 HashiCorp Vault를 OpenShell에 연결한다고 밝혔습니다. 에이전트마다 검증된 신원을 주고 꼭 필요한 비밀정보와 자원만 허용해 누가 무엇을 위임했는지 추적하는 방식입니다. IBM Identity Protection은 등록되지 않은 ‘그림자 에이전트’까지 찾고, IBM Fusion 스토리지는 BlueField-4를 하드웨어 수준에서 통합할 계획입니다.

Red Hat OpenShift는 하이브리드 클라우드 전반에서 같은 정책으로 에이전트를 운영하는 기반을 맡습니다. Anthropic, Cisco, CrowdStrike, Microsoft, SAP, Salesforce 등 100곳이 넘는 조직도 통합이나 평가에 참여합니다. 광범위한 명단은 표준화 가능성을 키우지만, 실제 제품에서 같은 정책 문법과 감사 형식이 유지되는지는 별도 확인이 필요합니다.

‘하드웨어 안전’도 검증은 이제부터

이 발표가 곧 완전한 안전을 뜻하지는 않습니다. 올바르지 않은 정책이 입력되면 하드웨어는 잘못된 규칙을 빠르게 집행할 뿐이고, 허용된 권한 안에서 벌어지는 위험한 판단까지 자동으로 구분하지 못할 수 있습니다. 복잡한 에이전트 흐름에서 지연시간과 처리량, 정상 행동을 막는 오탐, 격리 이후 복구 절차도 운영 비용을 좌우합니다.

NVIDIA는 OpenShell과 개발자 자료를 공개했지만 다수 기능의 제공 시점과 성능은 변경될 수 있다고 명시했습니다. 앞으로 볼 지표는 정책 우회 테스트, DPU 장애 때의 안전한 중단, 로그의 위변조 방지, 제3자 칩에서의 성능입니다. 의미 있는 변화는 ‘모델을 믿는다’에서 ‘모델이 무엇을 했는지 외부 계층이 증명한다’로 보안 기준을 옮긴 데 있습니다.

기사가 마음에 드셨다면 하트를 눌러주세요.

JJANG-LAB WEB GAME

기사 읽고, 잠깐 게임 한 판 어떠세요?

AI와 체스 게임 대표 이미지
AI와 체스

입체적인 캐릭터 체스 말로 즐기는 AI 대국

미니게임 고르기 ▶