idea-research/dino-x-mcp

idea-research/dino-x-mcp

от idea-research
MCP сервер DINO-X на базе моделей DINO-X и Grounding DINO даёт точное обнаружение объектов и понимание сцен для мультимодальных приложений. Полезен разработчикам визуальных агентов и пайплайнов автоматизации. Поддерживает STDIO и HTTP.

DINO-X MCP Server

License npm version npm downloads PRs Welcome MCP Badge GitHub stars

English | 中文

DINO-X Official MCP Server — powered by the DINO-X and Grounding DINO models — brings fine-grained object detection and image understanding to your multimodal applications.

Why DINO-X MCP?

With DINO-X MCP, you can:

  • Fine-Grained Understanding: Full image detection, object detection, and region-level descriptions.

  • Structured Outputs: Get object categories, counts, locations, and attributes for VQA and multi-step reasoning tasks.

  • Composable: Works seamlessly with other MCP servers to build end-to-end visual agents or automation pipelines.

Transport Modes

DINO-X MCP supports two transport modes:

Feature STDIO (default) Streamable HTTP
Runtime Local Local or Cloud
Transport Standard I/O HTTP (streaming responses)
Input source file:// and https:// https:// only
Visualization Supported (saves annotated images locally) Not supported (for now)

Quick Start

1. Prepare an MCP client

Any MCP-compatible client works, e.g.:

Инструменты были проиндексированы:
detect-all-objects

Анализирует изображение для обнаружения всех распознаваемых объектов, возвращая категорию, количество, координаты и подробные описания для каждого объекта.

Параметры
  • imageFileUristringобязательный

    URI of the input image. Preferred for remote or local files. Must start with 'https://' or 'file://'.

  • includeDescriptionbooleanобязательный

    Whether to return a description of the objects detected in the image, but will take longer to process.

detect-human-pose-keypoints

Обнаруживает 17 ключевых точек для каждого человека на изображении, поддерживая анализ позы и движений тела.

Параметры
  • imageFileUristringобязательный

    URI of the input image. Preferred for remote or local files. Must start with 'https://' or 'file://'.

  • includeDescriptionbooleanобязательный

    Whether to return a description of the objects detected in the image, but will take longer to process.

detect-objects-by-text

Анализирует изображение на основе текстового запроса, чтобы определить и подсчитать конкретные объекты, и возвращает подробные описания объектов и их 2D-координаты.

Параметры
  • imageFileUristringобязательный

    URI of the input image. Preferred for remote or local files. Must start with 'https://' or 'file://'.

  • includeDescriptionbooleanобязательный

    Whether to return a description of the objects detected in the image, but will take longer to process.

  • textPromptstringобязательный

    Nouns of target objects (English only, avoid adjectives). Use periods to separate multiple categories (e.g., 'person.car.traffic light').

visualize-detection-result

Визуализирует результаты обнаружения, рисуя ограничивающие рамки и метки на исходном изображении. Изображения сохраняются в каталог, указанный переменной окружения IMAGE_STORAGE_DIRECTORY.

Параметры
  • boxThicknessnumber

    Thickness of bounding box lines (default: 4)

  • detectionsobject[]обязательный

    Array of detection results with name and bbox information.

  • fontSizenumber

    Font size for labels (default: 24)

  • imageFileUristringобязательный

    URI of the input image. Preferred for remote or local files. Must start with 'https://' or 'file://'.

  • showLabelsboolean

    Whether to show category labels (default: true)

Похожие MCP-сервера

hustcc/mcp-echarts

hustcc/mcp-echarts

MCP сервер для генерации диаграмм и визуализации данных на базе Apache ECharts. Поддерживает все опции ECharts, экспорт в png/svg/option и интеграцию с MinIO. Лёгкий и безопасный — всё генерируется локально. Идеально подходит разработчикам, работающим с ИИ-помощниками для быстрого создания интера...

TypeScript266
antv/mcp-server-chart

antv/mcp-server-chart

официальный

MCP-сервер на базе AntV, который через инструменты модели создаёт более 26 видов графиков и карт. Интегрируется с Claude, VSCode и другими AI-клиентами, полезен для визуализации данных и анализа пр...

TypeScript4360
stabgan/openrouter-mcp-multimodal

stabgan/openrouter-mcp-multimodal

Мультимодальный MCP-сервер для анализа и генерации текста, изображений, аудио и видео. Интегрируется с Claude Desktop, Cursor и другими клиентами через OpenRouter, давая доступ к 300+ моделям. Вклю...

TypeScript86
albertnahas/icogenie-mcp

albertnahas/icogenie-mcp

MCP сервер @icogenie/mcp дает AI-агентам генерировать SVG-иконки по тексту. Помогает разработчикам быстро создавать иконки для интерфейсов в Claude. Поддерживает пакетную работу, библиотеку и ежедневные кредиты.

TypeScript6
Amazon Bedrock Nova Canvas

Amazon Bedrock Nova Canvas

MCP сервер для генерации изображений через Amazon Bedrock и модель Nova Canvas. Создает качественные картинки по тексту, поддерживает негативные промпты, настройку разрешения и seed. Полезен разработчикам AI-решений на AWS.

JavaScript24
tan-yong-sheng/ai-vision-mcp

tan-yong-sheng/ai-vision-mcp

MCP-сервер для ИИ-анализа изображений и видео через Google Gemini и Vertex AI. Поддерживает детекцию объектов, дизайн-аудит с WCAG-проверкой, сравнение снимков и анализ YouTube-роликов. Пригодится ...

TypeScript78
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин