TANTIOPE/datadog-mcp-server

TANTIOPE/datadog-mcp-server

от tantiope
MCP сервер для AI-ассистентов, открывающий полный доступ к Datadog: поиск логов, фильтрация APM-трейсов, запрос метрик, управление мониторами и дашбордами. Помогает SRE и разработчикам быстро разбирать инциденты, не переключаясь между инструментами.

Datadog MCP Server

Quality gate CI/Release npm License Coverage

DISCLAIMER: This is a community-maintained project and is not officially affiliated with, endorsed by, or supported by Datadog, Inc. This MCP server utilizes the Datadog API but is developed independently.

MCP server providing AI assistants with full Datadog observability access. Features grep-like log search, APM trace filtering with duration/status/error queries, smart sampling modes for token efficiency, and cross-correlation between logs, traces, and metrics. Supports both stdio (local) and http (remote/Kubernetes) transports.

Quick Start

Minimal Claude Desktop / VS Code / Cursor config — just the two required keys:

{
  "mcpServers": {
    "datadog": {
      "command": "npx",
      "args": ["-y", "datadog-mcp"],
      "env": {
        "DD_API_KEY": "your-api-key",
        "DD_APP_KEY": "your-app-key"
      }
    }
  }
}

With optional tuning (EU site, custom default limits, longer log windows):

{
  "mcpServers": {
    "datadog": {
      "command": "npx",
      "args": ["-y", "datadog-mcp"],
      "env": {
        "DD_API_KEY": "your-api-key",
        "DD_APP_KEY": "your-app-key",
        "DD_SITE": "datadoghq.eu",
        "MCP_DEFAULT_LIMIT": "50",
        "MCP_DEFAULT_LOG_LINES": "200",
        "MCP_DEFAULT_METRIC_POINTS": "1000",
        "MCP_DEFAULT_TIME_RANGE": "24"
      }
    }
  }
}
Инструменты были проиндексированы:
auth

Проверяет учетные данные API Datadog. Используется для проверки того, что API key и App key настроены правильно, перед выполнением других операций.

Параметры
  • actionenumобязательный

    Action to perform: validate - test if API key and App key are valid

dashboards

Предоставляет доступ к дашбордам и визуализациям Datadog. Действия: - list: Фильтрует дашборды по имени/тегам - get: Получает полную конфигурацию дашборда, включая виджеты (полезно для изучения шаблонов) - create: Создаёт новый дашборд - update: Изменяет существующий дашборд - delete: Удаляет дашборд - validate: Проверяет конфигурацию дашборда без создания (помогает отлаживать определения виджетов) Поддерживаемые форматы виджетов: - Простой: { "type": "timeseries", "requests": [{ "q": "avg:metric{*}" }] } - Расширенный: { "type": "timeseries", "requests": [{ "queries": [...], "formulas": [...] }] } Теги должны использовать формат key:value (например, ["team:ops", "env:prod"]).

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Dashboard configuration (for create/update)

  • idstring

    Dashboard ID (required for get/update/delete)

  • limitnumber

    Maximum number of dashboards to return (default: 50)

  • namestring

    Filter by name

  • tagsstring[]

    Filter by tags

downtimes

Управляет запланированными простоями Datadog для окон обслуживания. Действия: list, get, create, update, cancel, listByMonitor. Используется для: планирования обслуживания, предотвращения ложных оповещений во время развертываний, управления повторяющимися окнами обслуживания.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Downtime configuration (for create/update). Must include scope and schedule.

  • currentOnlyboolean

    Only return active downtimes (for list)

  • idstring

    Downtime ID (required for get/update/cancel)

  • limitnumber

    Maximum number of downtimes to return (default: 50)

  • monitorIdnumber

    Monitor ID (required for listByMonitor)

events

Отслеживает события Datadog. Действия: list, get, create, search, aggregate, top, timeseries, incidents, discover, histogram. Для оповещений монитора используйте теги: ["source:alert"]. ВАЖНО — переоценка vs переход: - События source:alert ВКЛЮЧАЮТ повторные уведомления и переоценки (каждая переоценка Datadog оповещающего монитора порождает событие). Вопрос «сколько раз сработал монитор X», отвеченный только с source:alert, завышает количество. - Чтобы ограничиться реальными переходами состояний, передайте transitionType (например, ["alert","alert recovery"]). Это добавляет @monitor.transition.transition_type:(...) к запросу и соответствует живой проверке в дизайне. - Для числового подсчёта только срабатываний, привязанного к одному ID монитора, отдайте предпочтение более высокоуровневому примитиву monitors action=history — он возвращает {transitions, count, meta} с уже применённым тем же фильтром. transitionType: Необязательный массив типов переходов монитора (alert, alert recovery, warning, warning recovery, no data, no data recovery, renotify). Пустой массив считается неопределённым. top: Общая группировка событий по любым полям (параметр groupBy). Возвращает группы, отсортированные по количеству, с возможной разбивкой по контексту. - Пример: {groupBy: ["service"], message: "...", service: "api", total_count: 50, by_context: [{context: "queue:X", count: 30}]} - Используйте для развёртываний, конфигураций, пользовательских событий или оповещений монитора - Возвращает поле "message" (заголовок события), НЕ имя монитора (используйте инструмент monitors для получения настоящих имён) - total_count включает повторные уведомления, когда используется source:alert без transitionType — смотрите monitors action=history для подсчёта только срабатываний discover: Возвращает доступные префиксы тегов из событий. aggregate: Пользовательская группировка groupBy, возвращает ключи, разделённые вертикальной чертой. search: Полные детали события. timeseries: Тренды с разбивкой по временным интервалам. incidents: Дедублицирует оповещения с помощью dedupeWindow. histogram: Группирует события по локальному часу дня / дню недели / дню месяца в указанном часовом поясе IANA (с учётом перехода на летнее время). Передайте bucket_by (обязательно) и опционально timezone (по умолчанию…)

Параметры
  • actionenumобязательный

    Action to perform

  • alertTypeenum

    Alert type (for create)

  • bucket_byenum

    Bucket dimension for histogram action: hour_of_day (0-23), day_of_week (0=Sun..6=Sat), day_of_month (1-31).

  • contextTagsstring[]

    Tag prefixes for context breakdown in top action (default: queue, service, ingress, pod_name, kube_namespace, kube_container_name)

  • cursorstring

    Pagination cursor from previous response

  • dedupeWindowstring

    Deduplication window for incidents: 5m, 15m, 1h (default: 5m)

  • enrichboolean

    Enrich events with monitor metadata (slower, adds monitor details)

  • fieldsstring[]

    Search action only: return only these event fields. Allowed values: id, title, message, timestamp, priority, source, tags, alertType, host, monitorId, monitorInfo, monitorMetadata (only populated when enrich=true). Default: full event.

  • fromstring

    Start time (ISO 8601, relative like "1h", or Unix timestamp)

  • groupBystring[]

    Fields to group by (for aggregate and top actions). Top: custom fields like ["service"], ["user"]. Aggregate: monitor_name, priority, alert_type, source. Default for top: ["monitor_id"]

  • idstring

    Event ID (for get action)

  • intervalstring

    Time bucket interval for timeseries: 1h, 4h, 1d (default: 1h)

  • limitnumber

    Maximum number of events to return (default: 50)

  • maxEventsnumber

    Maximum events to fetch for grouping in top action (default: 5000, max: 5000). Higher = more accurate but slower

  • priorityenum

    Event priority

  • querystring

    Search query

  • sourcesstring[]

    Filter by sources

  • tagsstring[]

    Filter by tags

  • textstring

    Event text (for create)

  • timezonestring

    Optional IANA timezone (e.g. "UTC", "Europe/Paris"). DST-safe. For histogram: controls hour/day bucketing (default: UTC). For search/aggregate/top/incidents read actions: adds sibling *Local ISO 8601 strings (e.g. timestampLocal) next to existing timestamps. Omit for byte-identical legacy shape.

  • titlestring

    Event title (for create)

  • tostring

    End time (ISO 8601, relative like "1h", or Unix timestamp)

  • transitionTypeenum[]

    Filter events by monitor state transition type. When set, restricts results to events with @monitor.transition.transition_type matching any value. Use ["alert","alert recovery"] to count real fires/recoveries and skip renotifies. Empty array is treated as undefined (no filter). For a fires-only count by monitor ID, prefer monitors action=history.

hosts

Управляет хостами инфраструктуры Datadog. Действия: список (с фильтрами), итоги (количество), отключение звука (отключает оповещения), включение звука. Используется для: инвентаризации инфраструктуры, проверки состояния хостов, отключения шумных хостов во время обслуживания.

Параметры
  • actionenumобязательный

    Action to perform

  • countnumber

    Number of hosts to return

  • endnumber

    Mute end timestamp (POSIX). Omit for indefinite mute

  • filterstring

    Filter hosts by name, alias, or tag (e.g., "env:prod")

  • fromnumber

    Starting offset for pagination

  • hostNamestring

    Host name (required for mute/unmute)

  • messagestring

    Mute reason message

  • overrideboolean

    If true, replaces existing mute instead of failing

  • sortDirenum

    Sort direction

  • sortFieldstring

    Field to sort by (e.g., "apps", "cpu", "name")

incidents

Управляет инцидентами Datadog для реагирования на инциденты. Действия: список, получение, поиск, создание, обновление, удаление. Используется для: управления инцидентами, реагирования по вызову, постмортемов, отслеживания MTTR/MTTD.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Incident configuration (for create/update). Create requires: title. Update can modify: title, status, severity, fields.

  • idstring

    Incident ID (required for get/update/delete)

  • limitnumber

    Maximum number of incidents to return (default: 50)

  • querystring

    Search query (for search action)

  • statusenum

    Filter by status (for list)

logs

Выполняет поиск логов Datadog с текстовой фильтрацией наподобие grep. Действия: search (поиск логов), aggregate (подсчёт/группировка). Ключевые фильтры: keyword (текстовый grep), pattern (регулярное выражение), service, host, status (error/warn/info). Диапазоны времени: "1h", "3d@11:45:23". CORRELATION: Логи содержат атрибут dd.trace_id для привязки к трейсам и метрикам APM. SAMPLING: Используй sample:"diverse" для расследования ошибок (дедуплицирует по шаблону сообщения), sample:"spread" для распределения по времени. TOKEN TIP: Используй compact:true, чтобы уменьшить размер полезной нагрузки (убирает тяжёлые поля) при запросе больших объёмов.

Параметры
  • actionenumобязательный

    Action to perform

  • compactboolean

    Strip custom attributes for token efficiency. Keeps: id, timestamp, service, host, status, message (truncated), dd.trace_id, dd.span_id, pod_name, kube_namespace, kube_container_name, error info

  • computeobject

    Compute operations (for aggregate)

  • fromstring

    Start time. Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23, yesterday@14:00)

  • groupBystring[]

    Fields to group by (for aggregate)

  • hoststring

    Filter by host

  • indexesstring[]

    Log indexes to search

  • keywordstring

    Simple text search - finds logs containing this text (grep-like). Merged with query using AND

  • limitnumber

    Maximum number of logs to return (default: 200)

  • patternstring

    Regex pattern to match in log message (grep -E style). Example: "ERROR.*timeout|connection refused"

  • querystring

    Log search query (Datadog syntax). Examples: "error", "service:my-service status:error", "error AND timeout"

  • sampleenum

    Sampling mode: first (chronological, default), spread (evenly across time range), diverse (distinct message patterns)

  • servicestring

    Filter by service name

  • sortenum

    Sort order

  • statusenum

    Filter by log status/level

  • tostring

    End time. Same formats as "from". Example: from="3d@11:45:23" to="3d@12:55:34"

logs_archives

Управляет архивами журналов Datadog (долгосрочное хранение журналов в S3, GCS или Azure Blob). Действия: list, get, create, update, delete, reorder, get_order. Архивы принимают места назначения типа 's3', 'gcs' или 'azure_storage'; учётные данные и поля интеграции для каждого провайдера (S3 IAM role ARN, GCS service account, Azure tenant/secret) передаются без изменений. Мутации (create, update, delete, reorder) блокируются, когда сервер находится в режиме только для чтения.

Параметры
  • actionenumобязательный

    Action to perform

  • archive_idsstring[]

    Ordered archive ID list (required for reorder)

  • configobject

    Archive configuration (for create/update). Requires name, query, and destination with type ∈ { s3, gcs, azure_storage }. Provider credential / integration fields are forwarded unchanged.

  • idstring

    Archive ID (required for get/update/delete)

  • verboseboolean

    Return full SDK payload alongside summary (default false)

logs_indexes

Управляет индексами логов Datadog (фильтры, срок хранения, фильтры исключений, дневные лимиты). Действия: list, get, update, reorder, get_order. Datadog идентифицирует индексы по 'name', а не 'id'. Примечание: создание/удаление доступны только в UI согласно Datadog и не поддерживаются через API. Мутации (update, reorder) блокируются, когда сервер находится в режиме только для чтения.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Index configuration (for update). Requires filter.query and numRetentionDays. Exclusion filters are forwarded unchanged.

  • index_namesstring[]

    Ordered index name list (required for reorder)

  • namestring

    Index name (required for get/update). Datadog identifies indexes by name, not id.

  • verboseboolean

    Return full SDK payload alongside summary (default false)

logs_pipelines

Управляет конвейерами Datadog Logs (цепочки разбора и процессоров). Действия: list, get, create, update, delete, reorder, get_order. Конвейеры выполняются последовательно над входящими логами; reorder изменяет структуру последующих данных. Изменения блокируются, когда сервер находится в режиме только для чтения. Неизвестные типы процессоров в 'config.processors' передаются в Datadog без изменений.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Pipeline configuration (for create/update). Requires name and filter.query. Processors are forwarded unchanged.

  • idstring

    Pipeline ID (required for get/update/delete)

  • pipeline_idsstring[]

    Ordered pipeline ID list (required for reorder)

  • verboseboolean

    Return full SDK payload alongside summary (default false)

metrics

Запрашивает метрики Datadog. Действия: - query — получает данные временных рядов (требуется временной диапазон from/to, PromQL-запрос) - search — ищет метрики по имени (как grep, параметр времени НЕ нужен) - list — получает недавно активные метрики (последние 24 часа, опционально фильтр по тегу) - metadata — получает детали метрики (единица измерения, тип, описание) APM-МЕТРИКИ (автоматически генерируются из трейсов): Ключом является имя ОПЕРАЦИИ (например, express.request, pg.query), а не имя сервиса. Фильтруйте по сервису через теги: {service:my-service} ПЕРЦЕНТИЛИ (p50/p75/p90/p95/p99) — используйте КОРНЕВУЮ метрику (тип distribution): p95:trace.express.request{service:my-service} СРЕДНЕЕ/СУММА/МИН/МАКС — используйте суффикс .duration (предварительно агрегированный gauge): avg:trace.express.request.duration{service:my-service} Прочие trace-метрики (gauge): - trace.<operation>.hits — количество запросов - trace.<operation>.errors — количество ошибок - trace.<operation>.apdex — Apdex-оценка Чтобы узнать имена операций для сервиса, используйте инструмент traces с действием "services".

Параметры
  • actionenumобязательный

    Action to perform

  • fromstring

    Start time (ONLY for query action). Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23)

  • limitnumber

    Maximum number of results (for search/list, default: 50)

  • metricstring

    Metric name (for metadata action)

  • pointLimitnumber

    Maximum data points per timeseries (for query action). AI controls resolution vs token usage (default: 1000).

  • querystring

    For query: PromQL expression (e.g., "avg:system.cpu.user{*}"). For search: grep-like filter on metric names. For list: tag filter.

  • tagstring

    Filter by tag

  • tostring

    End time (ONLY for query action). Same formats as "from".

monitors

Управляет мониторами Datadog. Действия: list, get, search, create, update, delete, mute, unmute, top, history, preview, test_notification. Фильтры: name, tags, groupStates (alert/warn/ok/no data). get/create/update возвращают полный объект options, чтобы вызывающий код мог безопасно выполнить read-then-patch. create/update принимают объект конфигурации, проверяемый по типизированной схеме, охватывающей документированные поля Datadog Monitor: - Верхний уровень: name, type, query, message, tags, priority (1-5, может быть null), restrictedRoles, multi, options. - Проверяемые ключи в options.*, сгруппированные по категориям: - notification: notifyNoData, noDataTimeframe, notifyAudit, notificationPresetName. - evaluation/delay: newHostDelay, newGroupDelay, evaluationDelay, requireFullWindow, onMissingData. - renotification: renotifyInterval (может быть null), renotifyOccurrences, renotifyStatuses, escalationMessage. - lifecycle: timeoutH (может быть null), includeTags, locked, silenced (запись временных меток/null), groupRetentionDuration. - thresholds: thresholds (critical/warning/ok/criticalRecovery/warningRecovery/unknown), thresholdWindows. - scheduling: schedulingOptions. Неизвестные ключи (на верхнем уровне или внутри options) передаются в Datadog как есть и отображаются через опциональный массив warnings в ответе, чтобы схема не отставала от API. Псевдонимы в snake_case принимаются на входе и нормализуются в camelCase перед проверкой. Ошибки проверки прерывают выполнение до любого HTTP-вызова и отображаются как 'EINVALID_MONITOR_CONFIG: <path>: <expected>'. Справка: https://docs.datadoghq.com/api/latest/monitors/ top: Ранжированные мониторы по частоте срабатываний с реальными именами мониторов и разбивкой по контексту. - Возвращает: {rank, monitor_id, name (с {{template.vars}}), message (шаблон), total_count, by_context} - Идеально подходит для еженедельных/ежедневных отчётов по срабатываниям - Получает реальные имена мониторов из API мониторов (не заголовки событий) - ПРЕДУПРЕЖДЕНИЕ: total_count — это количество сырых событий срабатываний, которое ВКЛЮЧАЕТ повторные уведомления и переоценки. Для мониторов, застрявших…

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Monitor configuration (for create/update)

  • contextobject

    Substitution context for monitors.preview (variables + conditionals).

  • contextTagsstring[]

    Tag prefixes for context breakdown in top action (default: queue, service, ingress, pod_name, kube_namespace, kube_container_name)

  • dry_runboolean

    When create + dry_run=true, validate the monitor body via POST /api/v1/monitor/validate without creating it. Allowed under --read-only because no monitor is created. Returns { valid, dryRun, monitor }. 400 responses surface verbatim like a failed create.

  • endnumber

    Mute end timestamp (for mute action)

  • fromstring

    Start time (ISO 8601, relative like "1h", or Unix timestamp)

  • groupstring

    For history action: filter transitions to a specific multi-alert monitor group (e.g., "pod_name:foo,kube_namespace:bar"). Optional; omit for all groups.

  • groupStatesstring[]

    Filter multi-alert monitors by group states (e.g., alert by host). Does NOT filter by overall monitor status. Values: alert, warn, no data, ok

  • idstring

    Monitor ID (required for get/update/delete/mute/unmute)

  • limitnumber

    Maximum number of monitors to return (default: 50)

  • maxEventsnumber

    Maximum events to fetch for top action (default: 5000, max: 5000)

  • messagestring

    Mute message (for mute action) OR inline template source for the preview action. For preview, supply either this inline string or monitor_id (or the existing id field) so the action can load the monitor message via getMonitor.

  • monitor_idnumber

    Numeric monitor ID used by the preview action when no inline message is supplied. Equivalent to passing the existing id field as a numeric string.

  • namestring

    Filter by name (for list action)

  • querystring

    Search query (for search action)

  • tagsstring[]

    Filter by tags

  • timezonestring

    Optional IANA timezone (e.g. "UTC", "Europe/Paris"). When supplied on get/list, the response adds sibling createdLocal/modifiedLocal ISO 8601 strings next to created/modified. Omit for byte-identical legacy shape. Invalid zones return EINVALID_TIMEZONE.

  • tostring

    End time (ISO 8601, relative like "1h", or Unix timestamp)

  • transitionTypeenum[]

    For history action: filter by monitor state transition types. Default: ["alert","alert recovery"] (real fires + recoveries, excludes renotifies). Pass ["alert"] for fires only, or include "renotify" for full chronological audit.

notebooks

Управляет Datadog Notebooks. Действия: list (поиск notebooks), get (получение по ID с ячейками), create (создание нового notebook), update (изменение notebook), delete (удаление notebook). Используется для: runbooks, документация инцидентов, заметки расследований, панели мониторинга как код.

Параметры
  • actionenumобязательный

    Action to perform

  • authorHandlestring

    Filter by author handle (email)

  • cellsobject[]

    Notebook cells (for create/update)

  • excludeAuthorHandlestring

    Exclude notebooks by author handle

  • idnumber

    Notebook ID (required for get/update/delete actions)

  • includeCellsboolean

    Include cell content in response (default: true for get)

  • namestring

    Notebook name (for create/update)

  • pageNumbernumber

    Page number for pagination

  • pageSizenumber

    Number of notebooks to return

  • querystring

    Search query for notebooks

  • statusenum

    Notebook status

  • timeobject

    Time configuration for notebook

rum

Запрашивает данные Datadog Real User Monitoring (RUM). Действия: applications (список RUM-приложений), events (поиск RUM-событий), aggregate (группирует и подсчитывает события), performance (Core Web Vitals: LCP, FCP, CLS, FID, INP), waterfall (временная шкала сессии с ресурсами/действиями/ошибками). Используется для: производительность фронтенда, пользовательские сессии, просмотры страниц, ошибки, загрузка ресурсов.

Параметры
  • actionenumобязательный

    Action to perform

  • applicationIdstring

    Application ID for waterfall action

  • computeobject

    Compute configuration for aggregation

  • fromstring

    Start time (ISO 8601, relative like "1h", "7d", or precise like "1d@10:00")

  • groupBystring[]

    Fields to group by for aggregation (e.g., ["@view.url_path", "@session.type"])

  • limitnumber

    Maximum number of events to return (default: 50)

  • metricsenum[]

    Core Web Vitals metrics to retrieve (default: all). lcp=Largest Contentful Paint, fcp=First Contentful Paint, cls=Cumulative Layout Shift, fid=First Input Delay, inp=Interaction to Next Paint, loading_time=View loading time

  • querystring

    RUM query string (e.g., "@type:view @application.id:abc")

  • sessionIdstring

    Session ID for waterfall action

  • sortenum

    Sort order for events

  • tostring

    End time (ISO 8601, relative like "now", or precise timestamp)

  • typeenum

    RUM event type filter

  • viewIdstring

    View ID for waterfall action (optional, filters to specific view)

schema

Получает допустимые значения перечислений для полей API Datadog. Возвращает палитры, типы виджетов, агрегаторы, компараторы, временные интервалы и другие допустимые значения для создания панелей мониторинга, мониторов, запросов метрик и SLO. Используйте это, чтобы узнать допустимые варианты перед созданием или обновлением ресурсов Datadog.

Параметры
  • resourceenumобязательный

    Datadog resource type to get schema for: dashboards, events, metrics, monitors, slos

security

Запрашивает Datadog Security Monitoring. Действия: rules (перечисляет правила обнаружения), signals (ищет сигналы безопасности), findings (перечисляет результаты проверки безопасности). Используется для: обнаружения угроз, обеспечения соответствия требованиям, оценки безопасности, расследования инцидентов.

Параметры
  • actionenumобязательный

    Action to perform

  • fromstring

    Start time (ISO 8601, relative like "1h", "7d")

  • idstring

    Rule or signal ID (for specific lookups)

  • pageCursorstring

    Cursor for pagination

  • pageSizenumber

    Number of results to return

  • querystring

    Search query for signals or findings

  • severityenum

    Filter by severity

  • statusenum

    Filter signals by status

  • tostring

    End time (ISO 8601, relative like "now")

slos

Управляет Service Level Objectives (SLO) Datadog. Действия: list (со статусом SLI и error budget), get, create, update, delete, history. Типы SLO: на основе метрик, на основе мониторов. Каждый ответ list/get/create/update содержит поле url с прямой ссылкой на интерфейс Datadog. Используется для: отслеживания надёжности, запасов ошибок, соблюдения SLA, целевых показателей производительности.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    SLO configuration (for create/update). Must include type, name, thresholds.

  • fromstring

    Start time for history (ISO 8601 or relative like "7d", "1w")

  • idstring

    SLO ID (required for get/update/delete/history)

  • idsstring[]

    Multiple SLO IDs (for list with specific IDs)

  • limitnumber

    Maximum number of SLOs to return (default: 50)

  • querystring

    Search query (for list)

  • tagsstring[]

    Filter by tags (for list)

  • tostring

    End time for history (ISO 8601 or relative, default: now)

synthetics

Управляет Synthetic-тестами Datadog (API и Browser). Действия: list, get, create, update, delete, trigger, results. Используется для: мониторинга доступности, тестирования API, тестирования пользовательских сценариев, тестирования производительности, канареечных развертываний.

Параметры
  • actionenumобязательный

    Action to perform

  • configobject

    Test configuration (for create/update). Includes: name, type, config, options, locations, message.

  • idstring

    Test public ID (required for get/update/delete/trigger/results)

  • idsstring[]

    Multiple test IDs (for bulk trigger)

  • limitnumber

    Maximum number of tests to return (default: 50)

  • locationsstring[]

    Filter by locations (for list)

  • tagsstring[]

    Filter by tags (for list)

  • testTypeenum

    Test type filter (for list) or type for create

tags

Управляет тегами хостов Datadog. Действия: list (все теги хостов), get (теги для конкретного хоста), add (создание тегов), update (замена тегов), delete (удаление всех тегов). Используется для: организации инфраструктуры, фильтрации, группировки.

Параметры
  • actionenumобязательный

    Action to perform

  • hostNamestring

    Host name (required for get/add/update/delete actions)

  • sourcestring

    Source of the tags (e.g., "users", "datadog"). Defaults to "users"

  • tagsstring[]

    Tags to add or set (for add/update actions). Format: "key:value"

teams

Управляет командами Datadog. Действия: список (с фильтрацией), получить (по ID), участники (список участников команды). Используется для: организации команды, управления доступом, совместной работы.

Параметры
  • actionenumобязательный

    Action to perform

  • filterstring

    Filter teams by name

  • idstring

    Team ID (required for get/members actions)

  • pageNumbernumber

    Page number for pagination

  • pageSizenumber

    Number of teams to return per page

traces

Анализирует трейсы APM для отладки потока запросов и задержек. Действия: search (ищет спаны), aggregate (группирует статистику), services (выводит список сервисов APM). Ключевые фильтры: minDuration/maxDuration ("500ms", "2s"), httpStatus ("5xx", ">=400"), status (ok/error), errorMessage (grep). МЕТРИКИ APM: Трейсы автоматически генерируют метрики в пространстве имён trace.<operation>.* (например, trace.express.request). Используйте инструмент метрик для запроса: avg:trace.express.request.duration{service:my-service}. Для процентилей (p95) используйте корневую метрику БЕЗ суффикса .duration: p95:trace.express.request{service:my-service}

Параметры
  • actionenumобязательный

    Action to perform

  • envstring

    Filter by environment. Example: "production", "staging"

  • errorMessagestring

    Filter by error message (grep-like). Example: "timeout", "connection refused"

  • errorTypestring

    Filter by error type (grep-like). Example: "TimeoutError", "ConnectionRefused"

  • fromstring

    Start time. Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23, yesterday@14:00)

  • groupBystring[]

    Fields to group by (for aggregate). Example: ["resource_name", "status"]

  • httpStatusstring

    HTTP status code filter. Examples: "500", "5xx" (500-599), "4xx" (400-499), ">=400"

  • limitnumber

    Maximum number of results (default: 50)

  • maxDurationstring

    Maximum span duration. Examples: "5s", "1000ms"

  • minDurationstring

    Minimum span duration (find slow spans). Examples: "1s", "500ms", "100ms"

  • operationstring

    Filter by operation name. Example: "express.request", "mongodb.query"

  • querystring

    APM trace search query (Datadog syntax). Example: "@http.status_code:500", "service:my-service status:error"

  • resourcestring

    Filter by resource name (endpoint/query). Supports wildcards. Example: "GET /api/*", "orders"

  • servicestring

    Filter by service name. Example: "my-service", "postgres"

  • sortenum

    Sort order

  • statusenum

    Filter by span status - "ok" for successful, "error" for failed spans

  • tostring

    End time. Same formats as "from". Example: from="3d@11:45" to="3d@12:55"

usage

Запрашивает данные учёта использования Datadog. Действия: сводка (общее использование), хосты (инфраструктура), логи, пользовательские метрики, индексированные спаны, принимаемые спаны. Используется для: управления затратами, планирования ёмкости, отслеживания использования, анализа счетов.

Параметры
  • actionenumобязательный

    Action to perform: summary (overall usage), hosts, logs, custom_metrics, indexed_spans, ingested_spans

  • fromstring

    Start time (ISO 8601 date like "2024-01-01", or relative like "30d")

  • includeOrgDetailsboolean

    Include usage breakdown by organization (for multi-org accounts)

  • tostring

    End time (ISO 8601 date like "2024-01-31", or relative like "now")

users

Управляет пользователями Datadog. Действия: список (с фильтрами), получение (по ID). Используется для: управление доступом, аудит пользователей, организация команд.

Параметры
  • actionenumобязательный

    Action to perform

  • filterstring

    Filter users by name or email

  • idstring

    User ID (required for get action)

  • pageNumbernumber

    Page number for pagination

  • pageSizenumber

    Number of users to return per page

  • statusenum

    Filter by user status

Похожие MCP-сервера

alimuratkuslu/byok-observability-mcp

alimuratkuslu/byok-observability-mcp

MCP сервер для запросов к observability-стекам (Grafana, Prometheus, Kafka UI, Datadog). Данные хранятся локально — ключи не покидают машину. Разработчики и SRE анализируют метрики, алерты и логи прямо из Claude Code, Codex или любого MCP клиента без настройки инфраструктуры.

TypeScript4
us-all/datadog-mcp-server

us-all/datadog-mcp-server

MCP-сервер Datadog с 163 инструментами: агрегационные запросы, полный CRUD SLO, управление fleet и статусными страницами. Для инженеров, кому нужно больше API-покрытия, возможность создавать SLO и ...

TypeScript2
Grafana MCP

Grafana MCP

официальный

MCP сервер для интеграции с Grafana: управляйте дашбордами, выполняйте запросы к Prometheus, Loki, CloudWatch и другим источникам через MCP. Упрощает мониторинг, анализ метрик и логов — полезен для инженеров и DevOps.

Go3446
spre-sre/lumino-mcp-server

spre-sre/lumino-mcp-server

LUMINO MCP сервер для SRE и DevOps: 37 инструментов для мониторинга Kubernetes, анализа логов, предиктивной аналитики и симуляции изменений. Помогает AI-ассистентам находить коренные причины сбоев, прогнозировать узкие места и управлять кластерами через MCP.

Python11
rohitg00/kubectl-mcp-server

rohitg00/kubectl-mcp-server

MCP сервер для управления Kubernetes через естественный язык. Позволяет AI-ассистентам отлаживать сбои подов, развертывать приложения, оптимизировать затраты и проверять безопасность без ручного kubectl. Подходит DevOps и SRE.

Python956
alilxxey/openobserve-community-mcp

alilxxey/openobserve-community-mcp

MCP сервер для OpenObserve Community Edition в режиме read-only через stdio и REST API. Выполняет поиск логов, просмотр схем потоков и дашбордов. Интегрируется с Claude и Codex для анализа данных OpenObserve без права записи.

Python16
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин