AWS는 애플리케이션 모니터링과 AI 에이전트를 위한 통합 경험인 Amazon CloudWatch Omni를 제공한다고 발표했다. 이 서비스는 로그, 지표, 트레이스, 알림 데이터를 개별 신호로 표시하는 대신 애플리케이션과 그 관계를 중심으로 구성한다. 또한 조직 전용 주소와 기업용 로그인을 통해 엔지니어들이 사용할 수 있는 공유 공간을 제공하며, AWS Management Console에 대한 액세스가 필요하지 않다.
CloudWatch Omni는 OpenTelemetry를 기반으로 하므로, 조직이 CloudWatch로 전송하는 계측 데이터는 재구성 없이 새로운 경험에 표시된다. OpenTelemetry를 사용하도록 구성된 다른 워크로드도 OpenTelemetry Protocol(OTLP) 엔드포인트로 데이터를 전송할 수 있다.
서비스가 제공하는 기능은 무엇인가?
Omni는 계측 데이터와 AWS Config를 통한 리소스 검색을 바탕으로 서비스를 자동으로 검색하고 서비스 간 종속성 지도를 구축한다. 지속적인 유지 관리가 필요한 고정형 대시보드에 의존하는 대신, 팀은 가용성 목표, 지연 시간 예산, 오류율 한계처럼 중요하다고 간주하는 항목을 정의할 수 있다. 이를 통해 애플리케이션이 변경되고 새로운 서비스가 추가될 때 모니터링 화면이 이에 맞춰 조정된다.
이 서비스는 각 팀에 AWS가 Space(스페이스)라고 부르는 공간을 제공하며, 여기에는 팀이 소유한 애플리케이션과 관련 데이터가 포함된다. 스페이스는 추가적인 데이터 이동 없이 기존 CloudWatch 데이터를 참조한다. 또한 사용자는 애플리케이션에 대해 자연어로 질문하고, 계측 데이터를 분석하며, 시스템 상태와 관련된 지표를 표시할 수 있다.
DevOps Agent와 함께하는 공동 조사
Amazon DevOps Agent는 팀이 확인하는 것과 동일한 계측 데이터를 바탕으로 엔지니어와 함께 조사 세션에 참여한다. AWS에 따르면 이 에이전트는 서비스 간 이벤트를 연결하고, 종속성 그래프를 통해 근본 원인 경로를 추적하며, 다음 단계를 제안한다. 또한 이후 사고 검토에 사용할 수 있도록 조사 기록을 보존한다.
AWS가 제시한 시나리오에서는 결제 서비스의 오류율이 상승하면서 애플리케이션 토폴로지, 최근 배포, 외부 결제 인터페이스의 지연 시간 증가, 그리고 에이전트의 초기 분석이 포함된 세션이 열린다. 결제 팀의 엔지니어는 같은 세션에 참여해 축적된 맥락을 확인한 뒤 근본 원인을 파악하고 변경 사항을 되돌릴 수 있다.
실제로 무엇이 달라지는가?
핵심적인 변화는 기존 CloudWatch 도구를 대체하는 것이 아니라, 애플리케이션 중심의 인터페이스와 조사 과정의 협업 기능을 추가하는 것이다. 기존 알림, 대시보드, API, 콘솔 작업은 변경 없이 계속 사용할 수 있다. 또한 IAM Identity Center를 통한 기업용 로그인을 설정한 뒤에는 엔지니어가 Omni를 사용하기 위해 AWS Console 권한을 가질 필요가 없다. IAM Identity Center는 Okta, Azure AD 및 기타 SAML 2.0 공급자를 지원한다.
기존 CloudWatch 고객은 CloudWatch 콘솔의 “Try CloudWatch Omni” 옵션에서 시작한 다음, ID 공급자를 설정하고 팀과 환경을 위한 스페이스를 만들 수 있다. AWS는 다른 환경의 계측 데이터를 동일한 스페이스와 조사 세션으로 가져올 수 있는 커넥터를 제공한다. 기사에 따르면 DevOps Agent는 Omni의 모든 조사 세션에서 기본적으로 활성화된다.
가용성 및 제한 사항
CloudWatch Omni를 사용할 수 있게 되었으며, AWS는 가격 세부 정보를 Amazon CloudWatch 요금 페이지로 안내한다. 기사에는 가격 수치나 리전별 가용성 목록이 언급되어 있지 않다. 또한 조사가 이용 가능한 계측 데이터와 기업용 ID 설정에 의존하므로, 이 경험의 가치는 각 조직의 구성 품질과 텔레메트리 범위에 계속 연계된다. 이는 사용을 확대하기 전에 팀이 평가해야 할 사항이다.