jae-jae/fetcher-mcp

jae-jae/fetcher-mcp

от jae-jae
MCP сервер для извлечения веб-контента через Playwright. Работает с динамическими сайтами, поддерживает JavaScript, умное выделение текста и пакетную загрузку. Идеален для сбора данных и разработки.
Fetcher MCP Icon

中文 | Deutsch | Español | français | 日本語 | 한국어 | Português | Русский

Fetcher MCP

MCP server for fetch web page content using Playwright headless browser.

🌟 Recommended: OllaMan - Powerful Ollama AI Model Manager.

Advantages

  • JavaScript Support: Unlike traditional web scrapers, Fetcher MCP uses Playwright to execute JavaScript, making it capable of handling dynamic web content and modern web applications.

  • Intelligent Content Extraction: Built-in Readability algorithm automatically extracts the main content from web pages, removing ads, navigation, and other non-essential elements.

  • Flexible Output Format: Supports both HTML and Markdown output formats, making it easy to integrate with various downstream applications.

  • Parallel Processing: The fetch_urls tool enables concurrent fetching of multiple URLs, significantly improving efficiency for batch operations.

  • Resource Optimization: Automatically blocks unnecessary resources (images, stylesheets, fonts, media) to reduce bandwidth usage and improve performance.

  • Robust Error Handling: Comprehensive error handling and logging ensure reliable operation even when dealing with problematic web pages.

  • Configurable Parameters: Fine-grained control over timeouts, content extraction, and output formatting to suit different use cases.

Инструменты были проиндексированы:
browser_install

Устанавливает двоичный файл браузера Playwright Chromium. Вызывайте его, если получили ошибку о том, что браузер не установлен.

Параметры
  • forceboolean

    Force installation even if Chromium is already installed. Default is false

  • withDepsboolean

    Install system dependencies required by Chromium browser. Default is false

fetch_urlтолько чтение

Получает содержимое веб-страницы по указанному URL.

Параметры
  • debugboolean

    Whether to enable debug mode (showing browser window), overrides the --debug command line flag if specified

  • disableMediaboolean

    Whether to disable media resources (images, stylesheets, fonts, media), default is true

  • extractContentboolean

    Whether to intelligently extract the main content, default is true

  • maxLengthnumber

    Maximum length of returned content (in characters), default is no limit

  • navigationTimeoutnumber

    Maximum time to wait for additional navigation in milliseconds, default is 10000 (10 seconds)

  • returnHtmlboolean

    Whether to return HTML content instead of Markdown, default is false

  • timeoutnumber

    Page loading timeout in milliseconds, default is 30000 (30 seconds)

  • urlstringобязательный

    URL to fetch. Make sure to include the schema (http:// or https:// if not defined, preferring https for most cases)

  • waitForNavigationboolean

    Whether to wait for additional navigation after initial page load (useful for sites with anti-bot verification), default is false

  • waitUntilstring

    Specifies when navigation is considered complete, options: 'load', 'domcontentloaded', 'networkidle', 'commit', default is 'load'

fetch_urlsтолько чтение

Извлекает содержимое веб-страниц по нескольким указанным URL

Параметры
  • debugboolean

    Whether to enable debug mode (showing browser window), overrides the --debug command line flag if specified

  • disableMediaboolean

    Whether to disable media resources (images, stylesheets, fonts, media), default is true

  • extractContentboolean

    Whether to intelligently extract the main content, default is true

  • maxLengthnumber

    Maximum length of returned content (in characters), default is no limit

  • navigationTimeoutnumber

    Maximum time to wait for additional navigation in milliseconds, default is 10000 (10 seconds)

  • returnHtmlboolean

    Whether to return HTML content instead of Markdown, default is false

  • timeoutnumber

    Page loading timeout in milliseconds, default is 30000 (30 seconds)

  • urlsstring[]обязательный

    Array of URLs to fetch

  • waitForNavigationboolean

    Whether to wait for additional navigation after initial page load (useful for sites with anti-bot verification), default is false

  • waitUntilstring

    Specifies when navigation is considered complete, options: 'load', 'domcontentloaded', 'networkidle', 'commit', default is 'load'

Похожие MCP-сервера

jae-jae/g-search-mcp

jae-jae/g-search-mcp

MCP сервер для параллельного поиска в Google: отправляет несколько запросов одновременно, обходит капчу, симулирует поведение пользователя. Возвращает структурированные JSON-результаты — удобно для анализа данных и автоматизации.

TypeScript274
webscraping-ai/webscraping-ai-mcp-server

webscraping-ai/webscraping-ai-mcp-server

официальный

MCP сервер для веб-скрапинга через WebScraping.AI — извлекает текст, HTML и структурированные данные, задаёт вопросы по содержимому страниц. Поддерживает JavaScript-рендеринг, CSS-селекторы, выбор прокси и эмуляцию устройств. Идеален для интеграции с LLM при сборе информации с сайтов.

JavaScript45
zcaceres/fetch-mcp

zcaceres/fetch-mcp

MCP сервер для загрузки веб-контента и преобразования его в HTML, Markdown, JSON, читаемый текст или транскрипты YouTube. Полезен разработчикам для извлечения статей, данных и субтитров без лишнего...

TypeScript823
executeautomation/playwright-mcp-server

executeautomation/playwright-mcp-server

Сервер для браузерной автоматизации на Playwright. Используется AI-агентами для открытия страниц, скриншотов, веб-скрапинга и выполнения JavaScript в реальном браузере. Отлично подходит для тестиро...

TypeScript5644
hyperbrowserai/mcp

hyperbrowserai/mcp

MCP сервер Hyperbrowser для скрапинга, краулинга и извлечения структурированных данных. Включает браузерные агенты OpenAI CUA и Claude. Для веб-автоматизации и сбора данных LLM.

TypeScript789
Browserbase MCP

Browserbase MCP

официальный

MCP сервер облачной автоматизации браузера Browserbase. Позволяет AI-агентам навигировать по сайтам, извлекать данные и выполнять действия. Полезен для RPA и веб-скрапинга. Доступен self-hosted и hosted.

TypeScript3404
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин