
Datadog(데이터독)은 서버, 컨테이너, 애플리케이션 상태를 한 곳에서 모니터링하는 클라우드 SaaS 솔루션입니다. 에이전트 설치 → 대시보드 구성 → 클라우드 연동 → 알림(Monitor) 설정까지의 흐름만 알면, 어떤 인프라 환경에서도 기본적인 모니터링 체계를 빠르게 구축할 수 있습니다.
Datadog(데이터독)이란?
Datadog은 인프라, 컨테이너, 애플리케이션의 상태를 실시간으로 관찰하고 데이터를 수집&분석해서 장애를 사전에 대비할 수 있게 해주는 클라우드 모니터링 솔루션입니다. 메트릭, 로그, 트레이스(추적)를 하나의 플랫폼에서 통합적으로 볼 수 있다는 게 가장 큰 장점이고, AWS·GCP·네이버클라우드 등 주요 클라우드 서비스와의 연동도 잘 되어 있어서 멀티 클라우드 환경에서도 무리 없이 쓸 수 있습니다.
에이전트 설치 (윈도우/리눅스/도커 3가지 방법)
가장 먼저 해야 할 일은 모니터링 대상 서버에 Datadog 에이전트를 설치하는 것입니다. 환경에 따라 설치 방법이 조금씩 다릅니다.
윈도우 환경
- Datadog 콘솔 → Integrations → Agent에서 윈도우용 에이전트 설치 파일을 다운로드합니다.
- 설치 파일을 실행하고, 가이드에 따라 API Key를 입력합니다.
- 리전을 계정에 맞는 사이트(예: us5.datadoghq.com)로 설정합니다.
- 설치가 끝나면 Agent Manager 창 우측 상단에 “Connected to Agent”가 표시되는지 확인합니다.
리눅스 환경
리눅스 서버(데비안, 우분투, 센토스 등)는 콘솔에서 제공하는 설치 명령어 한 줄로 끝낼 수 있습니다.
bash
DD_API_KEY=<발급받은 API 키> \
DD_SITE="datadoghq.com" \
bash -c "$(curl -L https://install.datadoghq.com/scripts/install_script_agent7.sh)"
명령어에 API 키가 자동으로 포함되기 때문에, 콘솔에서 복사한 명령어를 SSH로 접속한 서버에 붙여넣고 실행하기만 하면 됩니다.

도커 환경
컨테이너 환경이라면 공식 이미지를 그대로 띄우는 방식이 가장 간단합니다.
bash
docker run -d --name datadog-agent \
-e DD_API_KEY=<발급받은 API 키> \
-e DD_SITE="datadoghq.com" \
-v /var/run/docker.sock:/var/run/docker.sock:ro \
-v /proc/:/host/proc/:ro \
-v /sys/fs/cgroup/:/host/sys/fs/cgroup:ro \
gcr.io/datadoghq/agent:latest
기본 대시보드 구성
에이전트 설치가 끝나면 Datadog은 기본 대시보드 템플릿을 자동으로 제공합니다. 서버 상태를 빠르게 파악하려면 아래 항목들을 중심으로 위젯을 구성하는 게 일반적입니다.
- CPU: system.cpu.idle, system.cpu.system, system.cpu.user
- 메모리: system.mem.used, system.mem.usable, system.mem.total
- 디스크: system.disk.used, system.io.rkb_s(읽기), system.io.wkb_s(쓰기)
- 네트워크: system.net.bytes_rcvd(수신), system.net.bytes_sent(송신)

기본 위젯만으로도 서버 상태를 한눈에 파악할 수 있지만, 여러 대의 서버를 동시에 운영한다면 호스트별로 태그를 붙여서 필터링할 수 있게 구성해두시는 걸 추천드립니다.
AWS/GCP/네이버클라우드 연동하기
로컬 서버 한 대만 모니터링할 거라면 에이전트 설치만으로 충분하지만, 실무에서는 대부분 클라우드 인프라 전체를 연동해서 보는 경우가 많습니다. Datadog 콘솔의 Integrations 메뉴에서 AWS, GCP, 네이버클라우드 등 주요 클라우드 서비스와 API 키 기반으로 연동할 수 있습니다.
- Integrations 메뉴에서 사용 중인 클라우드 서비스를 선택합니다.
- 클라우드 콘솔에서 발급받은 IAM 역할 또는 API 키를 등록합니다.
- 연동이 완료되면 Infrastructure List 메뉴에서 전체 호스트를 통합된 화면으로 확인할 수 있습니다.

연동이 끝나면 EC2, ECS, Lambda 같은 개별 서비스 단위로도 메트릭을 세분화해서 볼 수 있어서, 특정 서비스에서 문제가 생겼을 때 원인을 빠르게 좁혀나갈 수 있습니다.
APM으로 애플리케이션 성능까지 모니터링하기
인프라 메트릭만으로는 “어떤 요청이 느린지”, “어디서 에러가 나는지” 같은 애플리케이션 레벨의 문제를 파악하기 어렵습니다. 이럴 때 필요한 게 APM(Application Performance Monitoring)입니다. 애플리케이션에 트레이싱 에이전트를 연결하면, 요청 하나가 여러 서비스를 거치는 과정을 전부 추적할 수 있어서 분산 시스템에서 병목 구간을 찾는 데 특히 유용합니다. 자바, 파이썬, 노드 등 주요 언어별로 트레이싱 라이브러리를 지원하기 때문에, 기존 애플리케이션 코드에 큰 변경 없이도 적용할 수 있습니다.
Monitor(알림) 설정 (장애를 사전에 감지하는 법)
대시보드로 상태를 보는 것도 중요하지만, 문제가 생겼을 때 사람이 계속 화면을 들여다보고 있을 수는 없습니다. Datadog의 Monitor 기능을 이용하면 특정 메트릭이 임계값을 넘었을 때 이메일이나 Slack으로 자동 알림을 받을 수 있습니다.

- Monitors 메뉴에서 New Monitor를 클릭합니다.
- 모니터링할 메트릭(예: CPU 사용률)과 임계값을 설정합니다.
- 알림을 받을 채널(이메일, Slack 등)을 지정합니다.
- 알림 메시지에 템플릿 변수를 활용하면, 어떤 호스트에서 문제가 생겼는지 바로 확인할 수 있는 상세 정보를 포함시킬 수 있습니다.
미리 준비된 모니터 템플릿을 활용하면 처음부터 직접 구성하지 않아도 빠르게 알림 체계를 갖출 수 있습니다.
무료 요금제로 어디까지 쓸 수 있나
Datadog은 유료 서비스가 기본이지만, 소규모 환경이라면 무료 요금제로도 기본적인 인프라 모니터링(최대 5호스트 기준)은 가능합니다. 다만 APM, 로그 관리, 데이터 보관 기간 확장 같은 고급 기능은 대부분 유료 플랜에서 제공되기 때문에, 실무에서 본격적으로 도입하려면 사용량에 맞는 요금제를 알아보는 게 좋습니다.
자주 묻는 질문 (FAQ)
Q1. Datadog 에이전트는 서버 성능에 부담을 주지 않나요?
A. 에이전트 자체의 리소스 사용량은 크지 않은 편이지만, 수집하는 메트릭 종류와 주기에 따라 다를 수 있어서 초기 도입 시에는 리소스 사용량을 함께 모니터링하는 걸 추천드립니다.
Q2. 온프레미스 서버도 모니터링할 수 있나요?
A. 네, 클라우드뿐 아니라 온프레미스 서버에도 에이전트를 설치하면 동일하게 모니터링할 수 있습니다.
Q3. 무료 요금제와 유료 요금제의 가장 큰 차이는 뭔가요?
A. 무료 요금제는 호스트 수와 데이터 보관 기간에 제한이 있고, APM이나 로그 관리 같은 고급 기능은 대부분 유료 플랜에서만 제공됩니다.
Q4. Kubernetes 환경에서도 사용할 수 있나요?
A. 네, 헬름 차트나 데몬셋 형태로 에이전트를 배포하면 Kubernetes 클러스터의 노드와 파드 단위까지 모니터링할 수 있습니다.
마무리
Datadog은 에이전트 설치만 끝내면 기본적인 인프라 모니터링을 바로 시작할 수 있고, 이후 클라우드 연동과 APM, 알림 설정까지 단계적으로 확장해나가면 됩니다. 처음부터 모든 기능을 다 쓰려고 하기보다는, 지금 가장 필요한 부분(서버 상태 확인, 애플리케이션 에러 추적, 장애 알림 등)부터 하나씩 구성해보시는 걸 추천드립니다.