01SECURITY (보안·안전)
엔비디아 '오픈 에이전트 안전 플랫폼' 출시… Anthropic도 보안 계층 협력
엔비디아가 AI 에이전트를 시험부터 배포까지 통제하는 공개 플랫폼 'Open Agent Safety Platform'을 내놨습니다. 소프트웨어 실행 경계를 정하는 오픈소스 OpenShell과, 에이전트가 경계를 넘으면 밀리초 단위로 격리하는 하드웨어 감시 장치 Sentry로 구성됩니다. Anthropic은 자사 Claude Managed Agents를 OpenShell과 묶어, 에이전트가 무엇을 할 수 있는지 모델 바깥에서 제한하는 방식을 제시했습니다.
핵심 사실 · 한눈에 보기
- 9월 27일 엔비디아가 공개 소프트웨어 플랫폼이자 참조 시스템 설계인 Open Agent Safety Platform을 발표했습니다.
- 플랫폼은 오픈소스 보안 실행 환경 OpenShell과, BlueField-4 DPU에서 에이전트를 별도로 감시하는 참조 설계 Sentry로 구성됩니다. Sentry는 경계를 벗어나려는 에이전트를 밀리초 안에 격리·중단한다고 밝혔습니다.
- 엔비디아는 최근 보안 사고들이 '에이전트가 맡은 일을 끝내려고 애플리케이션 계층의 보안 통제를 우회한' 같은 패턴이었다고 설명했습니다.
- Anthropic은 Claude Managed Agents가 비밀번호·접근 키를 별도 금고에 보관해 에이전트가 직접 보지 못하게 하고, OpenShell이 에이전트의 실행·접근 범위를 통제하는 방식으로 협력했다고 밝혔습니다.
- Anthropic, Cisco, CrowdStrike, Hugging Face, Microsoft, Palo Alto Networks, Salesforce, SAP 등이 참여 기업으로 이름을 올렸습니다.
어떻게 통제하나
- OpenShell: 규칙이 허용하지 않는 것은 모두 막는 방식. 에이전트가 쓰려는 도구, 접근하는 파일·네트워크·데이터를 하나하나 검사하고 모든 허용·차단 결정을 기록. Apache 2.0 오픈소스
- 정책 검증: 팀이 쓴 규칙에서 에이전트가 어디까지 닿을 수 있는지를 수학적 증명으로 확인
- Sentry: BlueField-4 DPU에서 에이전트 행동을 밖에서 감시하는 하드웨어 수준 감시 장치
- Claude Managed Agents: 에이전트 루프와 작업 샌드박스를 서로 다른 서버에 두고, 자격 증명은 금고에 분리, 감사 기록 제공
SOURCE공식 원문 + 추가 출처
- PRIMARY · 공식Giving companies more control over their AI agents, with NVIDIA | Claude by AnthropicClaude (claude.com blog) · claude.com · 발표 2026.09.27 · 확인 2026.10.05
- SECONDARY · 공식NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to DeploymentNVIDIA Newsroom (Press Releases) · nvidianews.nvidia.com · 발표 2026.09.28 · 확인 2026.10.05
수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.