TANTIOPE/datadog-mcp-server

TANTIOPE/datadog-mcp-server

от tantiope
MCP сервер для AI-ассистентов, открывающий полный доступ к Datadog: поиск логов, фильтрация APM-трейсов, запрос метрик, управление мониторами и дашбордами. Помогает SRE и разработчикам быстро разбирать инциденты, не переключаясь между инструментами.

Datadog MCP Server

Quality gate CI/Release npm License Coverage

DISCLAIMER: This is a community-maintained project and is not officially affiliated with, endorsed by, or supported by Datadog, Inc. This MCP server utilizes the Datadog API but is developed independently.

MCP server providing AI assistants with full Datadog observability access. Features grep-like log search, APM trace filtering with duration/status/error queries, smart sampling modes for token efficiency, and cross-correlation between logs, traces, and metrics. Supports both stdio (local) and http (remote/Kubernetes) transports.

Quick Start

Minimal Claude Desktop / VS Code / Cursor config — just the two required keys:

{
  "mcpServers": {
    "datadog": {
      "command": "npx",
      "args": ["-y", "datadog-mcp"],
      "env": {
        "DD_API_KEY": "your-api-key",
        "DD_APP_KEY": "your-app-key"
      }
    }
  }
}

With optional tuning (EU site, custom default limits, longer log windows):

{
  "mcpServers": {
    "datadog": {
      "command": "npx",
      "args": ["-y", "datadog-mcp"],
      "env": {
        "DD_API_KEY": "your-api-key",
        "DD_APP_KEY": "your-app-key",
        "DD_SITE": "datadoghq.eu",
        "MCP_DEFAULT_LIMIT": "50",
        "MCP_DEFAULT_LOG_LINES": "200",
        "MCP_DEFAULT_METRIC_POINTS": "1000",
        "MCP_DEFAULT_TIME_RANGE": "24"
      }
    }
  }
}
auth

Проверяет учетные данные API Datadog. Используется для проверки того, что API key и App key настроены правильно, перед выполнением других операций.

Проверяет учетные данные API Datadog. Используется для проверки того, что API key и App key настроены правильно, перед выполнением других операций.

Параметры

  • actionenumобязательный

    Action to perform: validate - test if API key and App key are valid

    validate
dashboards

Предоставляет доступ к дашбордам и визуализациям Datadog. Действия: - list: Фильтрует дашборды по имени/тегам - get: Получает полную конфигурацию дашборда, включая виджеты (полезно для изучения шаблонов) - create: Создаёт новый дашборд - update: Изменяет существующий дашборд - delete: Удаляет дашборд - validate: Проверяет конфигурацию дашборда без создания (помогает отлаживать определения виджетов) Поддерживаемые форматы виджетов: - Простой: { "type": "timeseries", "requests": [{ "q": "avg:metric{*}" }] } - Расширенный: { "type": "timeseries", "requests": [{ "queries": [...], "formulas": [...] }] } Теги должны использовать формат key:value (например, ["team:ops", "env:prod"]).

Предоставляет доступ к дашбордам и визуализациям Datadog. Действия: - list: Фильтрует дашборды по имени/тегам - get: Получает полную конфигурацию дашборда, включая виджеты (полезно для изучения шаблонов) - create: Создаёт новый дашборд - update: Изменяет существующий дашборд - delete: Удаляет дашборд - validate: Проверяет конфигурацию дашборда без создания (помогает отлаживать определения виджетов) Поддерживаемые форматы виджетов: - Простой: { "type": "timeseries", "requests": [{ "q": "avg:metric{*}" }] } - Расширенный: { "type": "timeseries", "requests": [{ "queries": [...], "formulas": [...] }] } Теги должны использовать формат key:value (например, ["team:ops", "env:prod"]).

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedeletevalidate
  • idstring

    Dashboard ID (required for get/update/delete)

  • namestring

    Filter by name

  • tagsstring[]

    Filter by tags

  • limitnumber

    Maximum number of dashboards to return (default: 50)

  • configobject

    Dashboard configuration (for create/update)

downtimes

Управляет запланированными простоями Datadog для окон обслуживания. Действия: list, get, create, update, cancel, listByMonitor. Используется для: планирования обслуживания, предотвращения ложных оповещений во время развертываний, управления повторяющимися окнами обслуживания.

Управляет запланированными простоями Datadog для окон обслуживания. Действия: list, get, create, update, cancel, listByMonitor. Используется для: планирования обслуживания, предотвращения ложных оповещений во время развертываний, управления повторяющимися окнами обслуживания.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatecancellistByMonitor
  • idstring

    Downtime ID (required for get/update/cancel)

  • monitorIdnumber

    Monitor ID (required for listByMonitor)

  • currentOnlyboolean

    Only return active downtimes (for list)

  • limitnumber

    Maximum number of downtimes to return (default: 50)

  • configobject

    Downtime configuration (for create/update). Must include scope and schedule.

events

Отслеживает события Datadog. Действия: list, get, create, search, aggregate, top, timeseries, incidents, discover, histogram. Для оповещений монитора используйте теги: ["source:alert"]. ВАЖНО — переоценка vs переход: - События source:alert ВКЛЮЧАЮТ повторные уведомления и переоценки (каждая переоценка Datadog оповещающего монитора порождает событие). Вопрос «сколько раз сработал монитор X», отвеченный только с source:alert, завышает количество. - Чтобы ограничиться реальными переходами состояний, передайте transitionType (например, ["alert","alert recovery"]). Это добавляет @monitor.transition.transition_type:(...) к запросу и соответствует живой проверке в дизайне. - Для числового подсчёта только срабатываний, привязанного к одному ID монитора, отдайте предпочтение более высокоуровневому примитиву monitors action=history — он возвращает {transitions, count, meta} с уже применённым тем же фильтром. transitionType: Необязательный массив типов переходов монитора (alert, alert recovery, warning, warning recovery, no data, no data recovery, renotify). Пустой массив считается неопределённым. top: Общая группировка событий по любым полям (параметр groupBy). Возвращает группы, отсортированные по количеству, с возможной разбивкой по контексту. - Пример: {groupBy: ["service"], message: "...", service: "api", total_count: 50, by_context: [{context: "queue:X", count: 30}]} - Используйте для развёртываний, конфигураций, пользовательских событий или оповещений монитора - Возвращает поле "message" (заголовок события), НЕ имя монитора (используйте инструмент monitors для получения настоящих имён) - total_count включает повторные уведомления, когда используется source:alert без transitionType — смотрите monitors action=history для подсчёта только срабатываний discover: Возвращает доступные префиксы тегов из событий. aggregate: Пользовательская группировка groupBy, возвращает ключи, разделённые вертикальной чертой. search: Полные детали события. timeseries: Тренды с разбивкой по временным интервалам. incidents: Дедублицирует оповещения с помощью dedupeWindow. histogram: Группирует события по локальному часу дня / дню недели / дню месяца в указанном часовом поясе IANA (с учётом перехода на летнее время). Передайте bucket_by (обязательно) и опционально timezone (по умолчанию…)

Отслеживает события Datadog. Действия: list, get, create, search, aggregate, top, timeseries, incidents, discover, histogram. Для оповещений монитора используйте теги: ["source:alert"]. ВАЖНО — переоценка vs переход: - События source:alert ВКЛЮЧАЮТ повторные уведомления и переоценки (каждая переоценка Datadog оповещающего монитора порождает событие). Вопрос «сколько раз сработал монитор X», отвеченный только с source:alert, завышает количество. - Чтобы ограничиться реальными переходами состояний, передайте transitionType (например, ["alert","alert recovery"]). Это добавляет @monitor.transition.transition_type:(...) к запросу и соответствует живой проверке в дизайне. - Для числового подсчёта только срабатываний, привязанного к одному ID монитора, отдайте предпочтение более высокоуровневому примитиву monitors action=history — он возвращает {transitions, count, meta} с уже применённым тем же фильтром. transitionType: Необязательный массив типов переходов монитора (alert, alert recovery, warning, warning recovery, no data, no data recovery, renotify). Пустой массив считается неопределённым. top: Общая группировка событий по любым полям (параметр groupBy). Возвращает группы, отсортированные по количеству, с возможной разбивкой по контексту. - Пример: {groupBy: ["service"], message: "...", service: "api", total_count: 50, by_context: [{context: "queue:X", count: 30}]} - Используйте для развёртываний, конфигураций, пользовательских событий или оповещений монитора - Возвращает поле "message" (заголовок события), НЕ имя монитора (используйте инструмент monitors для получения настоящих имён) - total_count включает повторные уведомления, когда используется source:alert без transitionType — смотрите monitors action=history для подсчёта только срабатываний discover: Возвращает доступные префиксы тегов из событий. aggregate: Пользовательская группировка groupBy, возвращает ключи, разделённые вертикальной чертой. search: Полные детали события. timeseries: Тренды с разбивкой по временным интервалам. incidents: Дедублицирует оповещения с помощью dedupeWindow. histogram: Группирует события по локальному часу дня / дню недели / дню месяца в указанном часовом поясе IANA (с учётом перехода на летнее время). Передайте bucket_by (обязательно) и опционально timezone (по умолчанию…)

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreatesearchaggregatetoptimeseriesincidentsdiscoverhistogram
  • idstring

    Event ID (for get action)

  • querystring

    Search query

  • fromstring

    Start time (ISO 8601, relative like "1h", or Unix timestamp)

  • tostring

    End time (ISO 8601, relative like "1h", or Unix timestamp)

  • priorityenum

    Event priority

    normallow
  • sourcesstring[]

    Filter by sources

  • tagsstring[]

    Filter by tags

  • limitnumber

    Maximum number of events to return (default: 50)

  • titlestring

    Event title (for create)

  • textstring

    Event text (for create)

  • alertTypeenum

    Alert type (for create)

    errorwarninginfosuccess
  • groupBystring[]

    Fields to group by (for aggregate and top actions). Top: custom fields like ["service"], ["user"]. Aggregate: monitor_name, priority, alert_type, source. Default for top: ["monitor_id"]

  • cursorstring

    Pagination cursor from previous response

  • intervalstring

    Time bucket interval for timeseries: 1h, 4h, 1d (default: 1h)

  • dedupeWindowstring

    Deduplication window for incidents: 5m, 15m, 1h (default: 5m)

  • enrichboolean

    Enrich events with monitor metadata (slower, adds monitor details)

  • contextTagsstring[]

    Tag prefixes for context breakdown in top action (default: queue, service, ingress, pod_name, kube_namespace, kube_container_name)

  • maxEventsnumber

    Maximum events to fetch for grouping in top action (default: 5000, max: 5000). Higher = more accurate but slower

  • transitionTypestring[]

    Filter events by monitor state transition type. When set, restricts results to events with @monitor.transition.transition_type matching any value. Use ["alert","alert recovery"] to count real fires/recoveries and skip renotifies. Empty array is treated as undefined (no filter). For a fires-only count by monitor ID, prefer monitors action=history.

  • bucket_byenum

    Bucket dimension for histogram action: hour_of_day (0-23), day_of_week (0=Sun..6=Sat), day_of_month (1-31).

    hour_of_dayday_of_weekday_of_month
  • timezonestring

    Optional IANA timezone (e.g. "UTC", "Europe/Paris"). DST-safe. For histogram: controls hour/day bucketing (default: UTC). For search/aggregate/top/incidents read actions: adds sibling *Local ISO 8601 strings (e.g. timestampLocal) next to existing timestamps. Omit for byte-identical legacy shape.

  • fieldsstring[]

    Search action only: return only these event fields. Allowed values: id, title, message, timestamp, priority, source, tags, alertType, host, monitorId, monitorInfo, monitorMetadata (only populated when enrich=true). Default: full event.

hosts

Управляет хостами инфраструктуры Datadog. Действия: список (с фильтрами), итоги (количество), отключение звука (отключает оповещения), включение звука. Используется для: инвентаризации инфраструктуры, проверки состояния хостов, отключения шумных хостов во время обслуживания.

Управляет хостами инфраструктуры Datadog. Действия: список (с фильтрами), итоги (количество), отключение звука (отключает оповещения), включение звука. Используется для: инвентаризации инфраструктуры, проверки состояния хостов, отключения шумных хостов во время обслуживания.

Параметры

  • actionenumобязательный

    Action to perform

    listtotalsmuteunmute
  • filterstring

    Filter hosts by name, alias, or tag (e.g., "env:prod")

  • fromnumber

    Starting offset for pagination

  • countnumber

    Number of hosts to return

  • sortFieldstring

    Field to sort by (e.g., "apps", "cpu", "name")

  • sortDirenum

    Sort direction

    ascdesc
  • hostNamestring

    Host name (required for mute/unmute)

  • messagestring

    Mute reason message

  • endnumber

    Mute end timestamp (POSIX). Omit for indefinite mute

  • overrideboolean

    If true, replaces existing mute instead of failing

incidents

Управляет инцидентами Datadog для реагирования на инциденты. Действия: список, получение, поиск, создание, обновление, удаление. Используется для: управления инцидентами, реагирования по вызову, постмортемов, отслеживания MTTR/MTTD.

Управляет инцидентами Datadog для реагирования на инциденты. Действия: список, получение, поиск, создание, обновление, удаление. Используется для: управления инцидентами, реагирования по вызову, постмортемов, отслеживания MTTR/MTTD.

Параметры

  • actionenumобязательный

    Action to perform

    listgetsearchcreateupdatedelete
  • idstring

    Incident ID (required for get/update/delete)

  • querystring

    Search query (for search action)

  • statusenum

    Filter by status (for list)

    activestableresolved
  • limitnumber

    Maximum number of incidents to return (default: 50)

  • configobject

    Incident configuration (for create/update). Create requires: title. Update can modify: title, status, severity, fields.

logs

Выполняет поиск логов Datadog с текстовой фильтрацией наподобие grep. Действия: search (поиск логов), aggregate (подсчёт/группировка). Ключевые фильтры: keyword (текстовый grep), pattern (регулярное выражение), service, host, status (error/warn/info). Диапазоны времени: "1h", "3d@11:45:23". CORRELATION: Логи содержат атрибут dd.trace_id для привязки к трейсам и метрикам APM. SAMPLING: Используй sample:"diverse" для расследования ошибок (дедуплицирует по шаблону сообщения), sample:"spread" для распределения по времени. TOKEN TIP: Используй compact:true, чтобы уменьшить размер полезной нагрузки (убирает тяжёлые поля) при запросе больших объёмов.

Выполняет поиск логов Datadog с текстовой фильтрацией наподобие grep. Действия: search (поиск логов), aggregate (подсчёт/группировка). Ключевые фильтры: keyword (текстовый grep), pattern (регулярное выражение), service, host, status (error/warn/info). Диапазоны времени: "1h", "3d@11:45:23". CORRELATION: Логи содержат атрибут dd.trace_id для привязки к трейсам и метрикам APM. SAMPLING: Используй sample:"diverse" для расследования ошибок (дедуплицирует по шаблону сообщения), sample:"spread" для распределения по времени. TOKEN TIP: Используй compact:true, чтобы уменьшить размер полезной нагрузки (убирает тяжёлые поля) при запросе больших объёмов.

Параметры

  • actionenumобязательный

    Action to perform

    searchaggregate
  • querystring

    Log search query (Datadog syntax). Examples: "error", "service:my-service status:error", "error AND timeout"

  • keywordstring

    Simple text search - finds logs containing this text (grep-like). Merged with query using AND

  • patternstring

    Regex pattern to match in log message (grep -E style). Example: "ERROR.*timeout|connection refused"

  • fromstring

    Start time. Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23, yesterday@14:00)

  • tostring

    End time. Same formats as "from". Example: from="3d@11:45:23" to="3d@12:55:34"

  • servicestring

    Filter by service name

  • hoststring

    Filter by host

  • statusenum

    Filter by log status/level

    errorwarninfodebug
  • indexesstring[]

    Log indexes to search

  • limitnumber

    Maximum number of logs to return (default: 200)

  • sortenum

    Sort order

    timestamp-timestamp
  • sampleenum

    Sampling mode: first (chronological, default), spread (evenly across time range), diverse (distinct message patterns)

    firstspreaddiverse
  • compactboolean

    Strip custom attributes for token efficiency. Keeps: id, timestamp, service, host, status, message (truncated), dd.trace_id, dd.span_id, pod_name, kube_namespace, kube_container_name, error info

  • groupBystring[]

    Fields to group by (for aggregate)

  • computeobject

    Compute operations (for aggregate)

logs_archives

Управляет архивами журналов Datadog (долгосрочное хранение журналов в S3, GCS или Azure Blob). Действия: list, get, create, update, delete, reorder, get_order. Архивы принимают места назначения типа 's3', 'gcs' или 'azure_storage'; учётные данные и поля интеграции для каждого провайдера (S3 IAM role ARN, GCS service account, Azure tenant/secret) передаются без изменений. Мутации (create, update, delete, reorder) блокируются, когда сервер находится в режиме только для чтения.

Управляет архивами журналов Datadog (долгосрочное хранение журналов в S3, GCS или Azure Blob). Действия: list, get, create, update, delete, reorder, get_order. Архивы принимают места назначения типа 's3', 'gcs' или 'azure_storage'; учётные данные и поля интеграции для каждого провайдера (S3 IAM role ARN, GCS service account, Azure tenant/secret) передаются без изменений. Мутации (create, update, delete, reorder) блокируются, когда сервер находится в режиме только для чтения.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedeletereorderget_order
  • idstring

    Archive ID (required for get/update/delete)

  • configobject

    Archive configuration (for create/update). Requires name, query, and destination with type ∈ { s3, gcs, azure_storage }. Provider credential / integration fields are forwarded unchanged.

  • archive_idsstring[]

    Ordered archive ID list (required for reorder)

  • verboseboolean

    Return full SDK payload alongside summary (default false)

logs_indexes

Управляет индексами логов Datadog (фильтры, срок хранения, фильтры исключений, дневные лимиты). Действия: list, get, update, reorder, get_order. Datadog идентифицирует индексы по 'name', а не 'id'. Примечание: создание/удаление доступны только в UI согласно Datadog и не поддерживаются через API. Мутации (update, reorder) блокируются, когда сервер находится в режиме только для чтения.

Управляет индексами логов Datadog (фильтры, срок хранения, фильтры исключений, дневные лимиты). Действия: list, get, update, reorder, get_order. Datadog идентифицирует индексы по 'name', а не 'id'. Примечание: создание/удаление доступны только в UI согласно Datadog и не поддерживаются через API. Мутации (update, reorder) блокируются, когда сервер находится в режиме только для чтения.

Параметры

  • actionenumобязательный

    Action to perform

    listgetupdatereorderget_order
  • namestring

    Index name (required for get/update). Datadog identifies indexes by name, not id.

  • configobject

    Index configuration (for update). Requires filter.query and numRetentionDays. Exclusion filters are forwarded unchanged.

  • index_namesstring[]

    Ordered index name list (required for reorder)

  • verboseboolean

    Return full SDK payload alongside summary (default false)

logs_pipelines

Управляет конвейерами Datadog Logs (цепочки разбора и процессоров). Действия: list, get, create, update, delete, reorder, get_order. Конвейеры выполняются последовательно над входящими логами; reorder изменяет структуру последующих данных. Изменения блокируются, когда сервер находится в режиме только для чтения. Неизвестные типы процессоров в 'config.processors' передаются в Datadog без изменений.

Управляет конвейерами Datadog Logs (цепочки разбора и процессоров). Действия: list, get, create, update, delete, reorder, get_order. Конвейеры выполняются последовательно над входящими логами; reorder изменяет структуру последующих данных. Изменения блокируются, когда сервер находится в режиме только для чтения. Неизвестные типы процессоров в 'config.processors' передаются в Datadog без изменений.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedeletereorderget_order
  • idstring

    Pipeline ID (required for get/update/delete)

  • configobject

    Pipeline configuration (for create/update). Requires name and filter.query. Processors are forwarded unchanged.

  • pipeline_idsstring[]

    Ordered pipeline ID list (required for reorder)

  • verboseboolean

    Return full SDK payload alongside summary (default false)

metrics

Запрашивает метрики Datadog. Действия: - query — получает данные временных рядов (требуется временной диапазон from/to, PromQL-запрос) - search — ищет метрики по имени (как grep, параметр времени НЕ нужен) - list — получает недавно активные метрики (последние 24 часа, опционально фильтр по тегу) - metadata — получает детали метрики (единица измерения, тип, описание) APM-МЕТРИКИ (автоматически генерируются из трейсов): Ключом является имя ОПЕРАЦИИ (например, express.request, pg.query), а не имя сервиса. Фильтруйте по сервису через теги: {service:my-service} ПЕРЦЕНТИЛИ (p50/p75/p90/p95/p99) — используйте КОРНЕВУЮ метрику (тип distribution): p95:trace.express.request{service:my-service} СРЕДНЕЕ/СУММА/МИН/МАКС — используйте суффикс .duration (предварительно агрегированный gauge): avg:trace.express.request.duration{service:my-service} Прочие trace-метрики (gauge): - trace.<operation>.hits — количество запросов - trace.<operation>.errors — количество ошибок - trace.<operation>.apdex — Apdex-оценка Чтобы узнать имена операций для сервиса, используйте инструмент traces с действием "services".

Запрашивает метрики Datadog. Действия: - query — получает данные временных рядов (требуется временной диапазон from/to, PromQL-запрос) - search — ищет метрики по имени (как grep, параметр времени НЕ нужен) - list — получает недавно активные метрики (последние 24 часа, опционально фильтр по тегу) - metadata — получает детали метрики (единица измерения, тип, описание) APM-МЕТРИКИ (автоматически генерируются из трейсов): Ключом является имя ОПЕРАЦИИ (например, express.request, pg.query), а не имя сервиса. Фильтруйте по сервису через теги: {service:my-service} ПЕРЦЕНТИЛИ (p50/p75/p90/p95/p99) — используйте КОРНЕВУЮ метрику (тип distribution): p95:trace.express.request{service:my-service} СРЕДНЕЕ/СУММА/МИН/МАКС — используйте суффикс .duration (предварительно агрегированный gauge): avg:trace.express.request.duration{service:my-service} Прочие trace-метрики (gauge): - trace.<operation>.hits — количество запросов - trace.<operation>.errors — количество ошибок - trace.<operation>.apdex — Apdex-оценка Чтобы узнать имена операций для сервиса, используйте инструмент traces с действием "services".

Параметры

  • actionenumобязательный

    Action to perform

    querysearchlistmetadata
  • querystring

    For query: PromQL expression (e.g., "avg:system.cpu.user{*}"). For search: grep-like filter on metric names. For list: tag filter.

  • fromstring

    Start time (ONLY for query action). Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23)

  • tostring

    End time (ONLY for query action). Same formats as "from".

  • metricstring

    Metric name (for metadata action)

  • tagstring

    Filter by tag

  • limitnumber

    Maximum number of results (for search/list, default: 50)

  • pointLimitnumber

    Maximum data points per timeseries (for query action). AI controls resolution vs token usage (default: 1000).

monitors

Управляет мониторами Datadog. Действия: list, get, search, create, update, delete, mute, unmute, top, history, preview, test_notification. Фильтры: name, tags, groupStates (alert/warn/ok/no data). get/create/update возвращают полный объект options, чтобы вызывающий код мог безопасно выполнить read-then-patch. create/update принимают объект конфигурации, проверяемый по типизированной схеме, охватывающей документированные поля Datadog Monitor: - Верхний уровень: name, type, query, message, tags, priority (1-5, может быть null), restrictedRoles, multi, options. - Проверяемые ключи в options.*, сгруппированные по категориям: - notification: notifyNoData, noDataTimeframe, notifyAudit, notificationPresetName. - evaluation/delay: newHostDelay, newGroupDelay, evaluationDelay, requireFullWindow, onMissingData. - renotification: renotifyInterval (может быть null), renotifyOccurrences, renotifyStatuses, escalationMessage. - lifecycle: timeoutH (может быть null), includeTags, locked, silenced (запись временных меток/null), groupRetentionDuration. - thresholds: thresholds (critical/warning/ok/criticalRecovery/warningRecovery/unknown), thresholdWindows. - scheduling: schedulingOptions. Неизвестные ключи (на верхнем уровне или внутри options) передаются в Datadog как есть и отображаются через опциональный массив warnings в ответе, чтобы схема не отставала от API. Псевдонимы в snake_case принимаются на входе и нормализуются в camelCase перед проверкой. Ошибки проверки прерывают выполнение до любого HTTP-вызова и отображаются как 'EINVALID_MONITOR_CONFIG: <path>: <expected>'. Справка: https://docs.datadoghq.com/api/latest/monitors/ top: Ранжированные мониторы по частоте срабатываний с реальными именами мониторов и разбивкой по контексту. - Возвращает: {rank, monitor_id, name (с {{template.vars}}), message (шаблон), total_count, by_context} - Идеально подходит для еженедельных/ежедневных отчётов по срабатываниям - Получает реальные имена мониторов из API мониторов (не заголовки событий) - ПРЕДУПРЕЖДЕНИЕ: total_count — это количество сырых событий срабатываний, которое ВКЛЮЧАЕТ повторные уведомления и переоценки. Для мониторов, застрявших…

Управляет мониторами Datadog. Действия: list, get, search, create, update, delete, mute, unmute, top, history, preview, test_notification. Фильтры: name, tags, groupStates (alert/warn/ok/no data). get/create/update возвращают полный объект options, чтобы вызывающий код мог безопасно выполнить read-then-patch. create/update принимают объект конфигурации, проверяемый по типизированной схеме, охватывающей документированные поля Datadog Monitor: - Верхний уровень: name, type, query, message, tags, priority (1-5, может быть null), restrictedRoles, multi, options. - Проверяемые ключи в options.*, сгруппированные по категориям: - notification: notifyNoData, noDataTimeframe, notifyAudit, notificationPresetName. - evaluation/delay: newHostDelay, newGroupDelay, evaluationDelay, requireFullWindow, onMissingData. - renotification: renotifyInterval (может быть null), renotifyOccurrences, renotifyStatuses, escalationMessage. - lifecycle: timeoutH (может быть null), includeTags, locked, silenced (запись временных меток/null), groupRetentionDuration. - thresholds: thresholds (critical/warning/ok/criticalRecovery/warningRecovery/unknown), thresholdWindows. - scheduling: schedulingOptions. Неизвестные ключи (на верхнем уровне или внутри options) передаются в Datadog как есть и отображаются через опциональный массив warnings в ответе, чтобы схема не отставала от API. Псевдонимы в snake_case принимаются на входе и нормализуются в camelCase перед проверкой. Ошибки проверки прерывают выполнение до любого HTTP-вызова и отображаются как 'EINVALID_MONITOR_CONFIG: <path>: <expected>'. Справка: https://docs.datadoghq.com/api/latest/monitors/ top: Ранжированные мониторы по частоте срабатываний с реальными именами мониторов и разбивкой по контексту. - Возвращает: {rank, monitor_id, name (с {{template.vars}}), message (шаблон), total_count, by_context} - Идеально подходит для еженедельных/ежедневных отчётов по срабатываниям - Получает реальные имена мониторов из API мониторов (не заголовки событий) - ПРЕДУПРЕЖДЕНИЕ: total_count — это количество сырых событий срабатываний, которое ВКЛЮЧАЕТ повторные уведомления и переоценки. Для мониторов, застрявших…

Параметры

  • actionenumобязательный

    Action to perform

    listgetsearchcreateupdatedeletemuteunmutetophistorypreviewtest_notification
  • idstring

    Monitor ID (required for get/update/delete/mute/unmute)

  • querystring

    Search query (for search action)

  • namestring

    Filter by name (for list action)

  • tagsstring[]

    Filter by tags

  • groupStatesstring[]

    Filter multi-alert monitors by group states (e.g., alert by host). Does NOT filter by overall monitor status. Values: alert, warn, no data, ok

  • limitnumber

    Maximum number of monitors to return (default: 50)

  • configobject

    Monitor configuration (for create/update)

  • messagestring

    Mute message (for mute action) OR inline template source for the preview action. For preview, supply either this inline string or `monitor_id` (or the existing `id` field) so the action can load the monitor message via getMonitor.

  • endnumber

    Mute end timestamp (for mute action)

  • monitor_idnumber

    Numeric monitor ID used by the preview action when no inline `message` is supplied. Equivalent to passing the existing `id` field as a numeric string.

  • contextobject

    Substitution context for monitors.preview (variables + conditionals).

  • fromstring

    Start time (ISO 8601, relative like "1h", or Unix timestamp)

  • tostring

    End time (ISO 8601, relative like "1h", or Unix timestamp)

  • contextTagsstring[]

    Tag prefixes for context breakdown in top action (default: queue, service, ingress, pod_name, kube_namespace, kube_container_name)

  • maxEventsnumber

    Maximum events to fetch for top action (default: 5000, max: 5000)

  • transitionTypestring[]

    For history action: filter by monitor state transition types. Default: ["alert","alert recovery"] (real fires + recoveries, excludes renotifies). Pass ["alert"] for fires only, or include "renotify" for full chronological audit.

  • groupstring

    For history action: filter transitions to a specific multi-alert monitor group (e.g., "pod_name:foo,kube_namespace:bar"). Optional; omit for all groups.

  • dry_runboolean

    When create + dry_run=true, validate the monitor body via POST /api/v1/monitor/validate without creating it. Allowed under --read-only because no monitor is created. Returns { valid, dryRun, monitor }. 400 responses surface verbatim like a failed create.

  • timezonestring

    Optional IANA timezone (e.g. "UTC", "Europe/Paris"). When supplied on get/list, the response adds sibling createdLocal/modifiedLocal ISO 8601 strings next to created/modified. Omit for byte-identical legacy shape. Invalid zones return EINVALID_TIMEZONE.

notebooks

Управляет Datadog Notebooks. Действия: list (поиск notebooks), get (получение по ID с ячейками), create (создание нового notebook), update (изменение notebook), delete (удаление notebook). Используется для: runbooks, документация инцидентов, заметки расследований, панели мониторинга как код.

Управляет Datadog Notebooks. Действия: list (поиск notebooks), get (получение по ID с ячейками), create (создание нового notebook), update (изменение notebook), delete (удаление notebook). Используется для: runbooks, документация инцидентов, заметки расследований, панели мониторинга как код.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedelete
  • idnumber

    Notebook ID (required for get/update/delete actions)

  • querystring

    Search query for notebooks

  • authorHandlestring

    Filter by author handle (email)

  • excludeAuthorHandlestring

    Exclude notebooks by author handle

  • includeCellsboolean

    Include cell content in response (default: true for get)

  • namestring

    Notebook name (for create/update)

  • cellsobject[]

    Notebook cells (for create/update)

  • timeobject

    Time configuration for notebook

  • statusenum

    Notebook status

    published
  • pageSizenumber

    Number of notebooks to return

  • pageNumbernumber

    Page number for pagination

rum

Запрашивает данные Datadog Real User Monitoring (RUM). Действия: applications (список RUM-приложений), events (поиск RUM-событий), aggregate (группирует и подсчитывает события), performance (Core Web Vitals: LCP, FCP, CLS, FID, INP), waterfall (временная шкала сессии с ресурсами/действиями/ошибками). Используется для: производительность фронтенда, пользовательские сессии, просмотры страниц, ошибки, загрузка ресурсов.

Запрашивает данные Datadog Real User Monitoring (RUM). Действия: applications (список RUM-приложений), events (поиск RUM-событий), aggregate (группирует и подсчитывает события), performance (Core Web Vitals: LCP, FCP, CLS, FID, INP), waterfall (временная шкала сессии с ресурсами/действиями/ошибками). Используется для: производительность фронтенда, пользовательские сессии, просмотры страниц, ошибки, загрузка ресурсов.

Параметры

  • actionenumобязательный

    Action to perform

    applicationseventsaggregateperformancewaterfall
  • querystring

    RUM query string (e.g., "@type:view @application.id:abc")

  • fromstring

    Start time (ISO 8601, relative like "1h", "7d", or precise like "1d@10:00")

  • tostring

    End time (ISO 8601, relative like "now", or precise timestamp)

  • typeenum

    RUM event type filter

    allviewactionerrorlong_taskresource
  • sortenum

    Sort order for events

    timestamp-timestamp
  • limitnumber

    Maximum number of events to return (default: 50)

  • groupBystring[]

    Fields to group by for aggregation (e.g., ["@view.url_path", "@session.type"])

  • computeobject

    Compute configuration for aggregation

  • metricsstring[]

    Core Web Vitals metrics to retrieve (default: all). lcp=Largest Contentful Paint, fcp=First Contentful Paint, cls=Cumulative Layout Shift, fid=First Input Delay, inp=Interaction to Next Paint, loading_time=View loading time

  • applicationIdstring

    Application ID for waterfall action

  • sessionIdstring

    Session ID for waterfall action

  • viewIdstring

    View ID for waterfall action (optional, filters to specific view)

schema

Получает допустимые значения перечислений для полей API Datadog. Возвращает палитры, типы виджетов, агрегаторы, компараторы, временные интервалы и другие допустимые значения для создания панелей мониторинга, мониторов, запросов метрик и SLO. Используйте это, чтобы узнать допустимые варианты перед созданием или обновлением ресурсов Datadog.

Получает допустимые значения перечислений для полей API Datadog. Возвращает палитры, типы виджетов, агрегаторы, компараторы, временные интервалы и другие допустимые значения для создания панелей мониторинга, мониторов, запросов метрик и SLO. Используйте это, чтобы узнать допустимые варианты перед созданием или обновлением ресурсов Datadog.

Параметры

  • resourceenumобязательный

    Datadog resource type to get schema for: dashboards, events, metrics, monitors, slos

    dashboardseventsmetricsmonitorsslos
security

Запрашивает Datadog Security Monitoring. Действия: rules (перечисляет правила обнаружения), signals (ищет сигналы безопасности), findings (перечисляет результаты проверки безопасности). Используется для: обнаружения угроз, обеспечения соответствия требованиям, оценки безопасности, расследования инцидентов.

Запрашивает Datadog Security Monitoring. Действия: rules (перечисляет правила обнаружения), signals (ищет сигналы безопасности), findings (перечисляет результаты проверки безопасности). Используется для: обнаружения угроз, обеспечения соответствия требованиям, оценки безопасности, расследования инцидентов.

Параметры

  • actionenumобязательный

    Action to perform

    rulessignalsfindings
  • idstring

    Rule or signal ID (for specific lookups)

  • querystring

    Search query for signals or findings

  • fromstring

    Start time (ISO 8601, relative like "1h", "7d")

  • tostring

    End time (ISO 8601, relative like "now")

  • severityenum

    Filter by severity

    infolowmediumhighcritical
  • statusenum

    Filter signals by status

    openunder_reviewarchived
  • pageSizenumber

    Number of results to return

  • pageCursorstring

    Cursor for pagination

slos

Управляет Service Level Objectives (SLO) Datadog. Действия: list (со статусом SLI и error budget), get, create, update, delete, history. Типы SLO: на основе метрик, на основе мониторов. Каждый ответ list/get/create/update содержит поле `url` с прямой ссылкой на интерфейс Datadog. Используется для: отслеживания надёжности, запасов ошибок, соблюдения SLA, целевых показателей производительности.

Управляет Service Level Objectives (SLO) Datadog. Действия: list (со статусом SLI и error budget), get, create, update, delete, history. Типы SLO: на основе метрик, на основе мониторов. Каждый ответ list/get/create/update содержит поле `url` с прямой ссылкой на интерфейс Datadog. Используется для: отслеживания надёжности, запасов ошибок, соблюдения SLA, целевых показателей производительности.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedeletehistory
  • idstring

    SLO ID (required for get/update/delete/history)

  • idsstring[]

    Multiple SLO IDs (for list with specific IDs)

  • querystring

    Search query (for list)

  • tagsstring[]

    Filter by tags (for list)

  • limitnumber

    Maximum number of SLOs to return (default: 50)

  • configobject

    SLO configuration (for create/update). Must include type, name, thresholds.

  • fromstring

    Start time for history (ISO 8601 or relative like "7d", "1w")

  • tostring

    End time for history (ISO 8601 or relative, default: now)

synthetics

Управляет Synthetic-тестами Datadog (API и Browser). Действия: list, get, create, update, delete, trigger, results. Используется для: мониторинга доступности, тестирования API, тестирования пользовательских сценариев, тестирования производительности, канареечных развертываний.

Управляет Synthetic-тестами Datadog (API и Browser). Действия: list, get, create, update, delete, trigger, results. Используется для: мониторинга доступности, тестирования API, тестирования пользовательских сценариев, тестирования производительности, канареечных развертываний.

Параметры

  • actionenumобязательный

    Action to perform

    listgetcreateupdatedeletetriggerresults
  • idstring

    Test public ID (required for get/update/delete/trigger/results)

  • idsstring[]

    Multiple test IDs (for bulk trigger)

  • testTypeenum

    Test type filter (for list) or type for create

    apibrowser
  • locationsstring[]

    Filter by locations (for list)

  • tagsstring[]

    Filter by tags (for list)

  • limitnumber

    Maximum number of tests to return (default: 50)

  • configobject

    Test configuration (for create/update). Includes: name, type, config, options, locations, message.

tags

Управляет тегами хостов Datadog. Действия: list (все теги хостов), get (теги для конкретного хоста), add (создание тегов), update (замена тегов), delete (удаление всех тегов). Используется для: организации инфраструктуры, фильтрации, группировки.

Управляет тегами хостов Datadog. Действия: list (все теги хостов), get (теги для конкретного хоста), add (создание тегов), update (замена тегов), delete (удаление всех тегов). Используется для: организации инфраструктуры, фильтрации, группировки.

Параметры

  • actionenumобязательный

    Action to perform

    listgetaddupdatedelete
  • hostNamestring

    Host name (required for get/add/update/delete actions)

  • tagsstring[]

    Tags to add or set (for add/update actions). Format: "key:value"

  • sourcestring

    Source of the tags (e.g., "users", "datadog"). Defaults to "users"

teams

Управляет командами Datadog. Действия: список (с фильтрацией), получить (по ID), участники (список участников команды). Используется для: организации команды, управления доступом, совместной работы.

Управляет командами Datadog. Действия: список (с фильтрацией), получить (по ID), участники (список участников команды). Используется для: организации команды, управления доступом, совместной работы.

Параметры

  • actionenumобязательный

    Action to perform

    listgetmembers
  • idstring

    Team ID (required for get/members actions)

  • filterstring

    Filter teams by name

  • pageSizenumber

    Number of teams to return per page

  • pageNumbernumber

    Page number for pagination

traces

Анализирует трейсы APM для отладки потока запросов и задержек. Действия: search (ищет спаны), aggregate (группирует статистику), services (выводит список сервисов APM). Ключевые фильтры: minDuration/maxDuration ("500ms", "2s"), httpStatus ("5xx", ">=400"), status (ok/error), errorMessage (grep). МЕТРИКИ APM: Трейсы автоматически генерируют метрики в пространстве имён trace.<operation>.* (например, trace.express.request). Используйте инструмент метрик для запроса: avg:trace.express.request.duration{service:my-service}. Для процентилей (p95) используйте корневую метрику БЕЗ суффикса .duration: p95:trace.express.request{service:my-service}

Анализирует трейсы APM для отладки потока запросов и задержек. Действия: search (ищет спаны), aggregate (группирует статистику), services (выводит список сервисов APM). Ключевые фильтры: minDuration/maxDuration ("500ms", "2s"), httpStatus ("5xx", ">=400"), status (ok/error), errorMessage (grep). МЕТРИКИ APM: Трейсы автоматически генерируют метрики в пространстве имён trace.<operation>.* (например, trace.express.request). Используйте инструмент метрик для запроса: avg:trace.express.request.duration{service:my-service}. Для процентилей (p95) используйте корневую метрику БЕЗ суффикса .duration: p95:trace.express.request{service:my-service}

Параметры

  • actionenumобязательный

    Action to perform

    searchaggregateservices
  • querystring

    APM trace search query (Datadog syntax). Example: "@http.status_code:500", "service:my-service status:error"

  • fromstring

    Start time. Formats: ISO 8601, relative (30s, 15m, 2h, 7d), precise (3d@11:45:23, yesterday@14:00)

  • tostring

    End time. Same formats as "from". Example: from="3d@11:45" to="3d@12:55"

  • servicestring

    Filter by service name. Example: "my-service", "postgres"

  • operationstring

    Filter by operation name. Example: "express.request", "mongodb.query"

  • resourcestring

    Filter by resource name (endpoint/query). Supports wildcards. Example: "GET /api/*", "*orders*"

  • statusenum

    Filter by span status - "ok" for successful, "error" for failed spans

    okerror
  • envstring

    Filter by environment. Example: "production", "staging"

  • minDurationstring

    Minimum span duration (find slow spans). Examples: "1s", "500ms", "100ms"

  • maxDurationstring

    Maximum span duration. Examples: "5s", "1000ms"

  • httpStatusstring

    HTTP status code filter. Examples: "500", "5xx" (500-599), "4xx" (400-499), ">=400"

  • errorTypestring

    Filter by error type (grep-like). Example: "TimeoutError", "ConnectionRefused"

  • errorMessagestring

    Filter by error message (grep-like). Example: "timeout", "connection refused"

  • limitnumber

    Maximum number of results (default: 50)

  • sortenum

    Sort order

    timestamp-timestamp
  • groupBystring[]

    Fields to group by (for aggregate). Example: ["resource_name", "status"]

usage

Запрашивает данные учёта использования Datadog. Действия: сводка (общее использование), хосты (инфраструктура), логи, пользовательские метрики, индексированные спаны, принимаемые спаны. Используется для: управления затратами, планирования ёмкости, отслеживания использования, анализа счетов.

Запрашивает данные учёта использования Datadog. Действия: сводка (общее использование), хосты (инфраструктура), логи, пользовательские метрики, индексированные спаны, принимаемые спаны. Используется для: управления затратами, планирования ёмкости, отслеживания использования, анализа счетов.

Параметры

  • actionenumобязательный

    Action to perform: summary (overall usage), hosts, logs, custom_metrics, indexed_spans, ingested_spans

    summaryhostslogscustom_metricsindexed_spansingested_spans
  • fromstring

    Start time (ISO 8601 date like "2024-01-01", or relative like "30d")

  • tostring

    End time (ISO 8601 date like "2024-01-31", or relative like "now")

  • includeOrgDetailsboolean

    Include usage breakdown by organization (for multi-org accounts)

users

Управляет пользователями Datadog. Действия: список (с фильтрами), получение (по ID). Используется для: управление доступом, аудит пользователей, организация команд.

Управляет пользователями Datadog. Действия: список (с фильтрами), получение (по ID). Используется для: управление доступом, аудит пользователей, организация команд.

Параметры

  • actionenumобязательный

    Action to perform

    listget
  • idstring

    User ID (required for get action)

  • filterstring

    Filter users by name or email

  • statusenum

    Filter by user status

    ActivePendingDisabled
  • pageSizenumber

    Number of users to return per page

  • pageNumbernumber

    Page number for pagination

Другие проверенные MCP-сервера

caol64/wenyan-mcp

caol64/wenyan-mcp

文颜 MCP Server — 基于 MCP 协议的排版发布工具,专为 AI 写作到微信公众号场景设计。直接在聊天框内完成 Markdown 转微信富文本、上传图片、存草稿,无需切换编辑器。适合需要快速发布高质量公众号文章的作者和团队。

JavaScript1273
Firecrawl MCP

Firecrawl MCP

официальный

MCP сервер для поиска и скрапинга веб-страниц, превращающий живой интернет в чистые данные для ИИ-агентов. Поддерживает навигацию, клики и автономные исследования. Работает в облаке или локально.

JavaScript6989
Github MCP

Github MCP

официальный

MCP-сервер для подключения AI-агентов к GitHub: читает код и репозитории, управляет issues и PR, анализирует коммиты и CI/CD. Cервер автоматизирует workflow через естественный язык. Полезен разрабо...

Go31546
can4hou6joeng4/boss-agent-cli

can4hou6joeng4/boss-agent-cli

BOSS Agent CLI — 为 AI Agent 设计的 BOSS 直聘本地辅助工具。支持职位搜索、福利筛选(双休、五险一金等)、候选池管理,输出 JSON 信封。默认低风险只读模式,合规安全,适合求职者与招聘者。

Python1399
Dumpling-AI/mcp-server-dumplingai

Dumpling-AI/mcp-server-dumplingai

официальный

Интегрируйте Dumpling AI через MCP сервер: собирайте данные с веб-страниц, транскрипты YouTube, новости, отзывы и карты. Выполняйте скрапинг, конвертацию документов, генерацию изображений и запуск JavaScript/Python кода. Полезен разработчикам и дата-сайентистам для автоматизации сбора и обработки...

JavaScript31
Canner/wren-engine

Canner/wren-engine

официальный

Wren Engine — open source context engine для AI-агентов через MCP. Он заменяет сырые таблицы бизнес-моделями и метриками: агенты понимают контекст, строят точные запросы и соблюдают правила доступа...

Java664
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин