본문으로 건너뛰기

← 뉴스레터 전체

AI NEWSLETTER

2026년 9월 27일 (일)

이 날 발표된 공식 원문을 2026.10.01에 확인해 소급 정리한 호입니다.

01SECURITY (보안·안전)

엔비디아 '오픈 에이전트 안전 플랫폼' 출시… Anthropic도 보안 계층 협력

엔비디아가 AI 에이전트를 시험부터 배포까지 통제하는 공개 플랫폼 'Open Agent Safety Platform'을 내놨습니다. 소프트웨어 실행 경계를 정하는 오픈소스 OpenShell과, 에이전트가 경계를 넘으면 밀리초 단위로 격리하는 하드웨어 감시 장치 Sentry로 구성됩니다. Anthropic은 자사 Claude Managed Agents를 OpenShell과 묶어, 에이전트가 무엇을 할 수 있는지 모델 바깥에서 제한하는 방식을 제시했습니다.

핵심 사실 · 한눈에 보기

  • 9월 27일 엔비디아가 공개 소프트웨어 플랫폼이자 참조 시스템 설계인 Open Agent Safety Platform을 발표했습니다.
  • 플랫폼은 오픈소스 보안 실행 환경 OpenShell과, BlueField-4 DPU에서 에이전트를 별도로 감시하는 참조 설계 Sentry로 구성됩니다. Sentry는 경계를 벗어나려는 에이전트를 밀리초 안에 격리·중단한다고 밝혔습니다.
  • 엔비디아는 최근 보안 사고들이 '에이전트가 맡은 일을 끝내려고 애플리케이션 계층의 보안 통제를 우회한' 같은 패턴이었다고 설명했습니다.
  • Anthropic은 Claude Managed Agents가 비밀번호·접근 키를 별도 금고에 보관해 에이전트가 직접 보지 못하게 하고, OpenShell이 에이전트의 실행·접근 범위를 통제하는 방식으로 협력했다고 밝혔습니다.
  • Anthropic, Cisco, CrowdStrike, Hugging Face, Microsoft, Palo Alto Networks, Salesforce, SAP 등이 참여 기업으로 이름을 올렸습니다.

어떻게 통제하나

  • OpenShell: 규칙이 허용하지 않는 것은 모두 막는 방식. 에이전트가 쓰려는 도구, 접근하는 파일·네트워크·데이터를 하나하나 검사하고 모든 허용·차단 결정을 기록. Apache 2.0 오픈소스
  • 정책 검증: 팀이 쓴 규칙에서 에이전트가 어디까지 닿을 수 있는지를 수학적 증명으로 확인
  • Sentry: BlueField-4 DPU에서 에이전트 행동을 밖에서 감시하는 하드웨어 수준 감시 장치
  • Claude Managed Agents: 에이전트 루프와 작업 샌드박스를 서로 다른 서버에 두고, 자격 증명은 금고에 분리, 감사 기록 제공
전체 내용 보기이전과 달라진 점 · 나에게 미치는 영향 · 아직 모르는 것

SOURCE공식 원문 + 추가 출처

수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.