ofershap/mcp-server-scraper

ofershap/mcp-server-scraper

от ofershap
MCP-сервер для веб-скрапинга: извлекает чистый контент с URL в виде markdown, ссылки и метаданные. Использует Mozilla Readability, не требует API-ключей и настроек. Бесплатная альтернатива Firecraw...

mcp-server-scraper

npm version npm downloads CI TypeScript License: MIT

Extract clean, readable content from any URL. Returns markdown text, links, and metadata. No API keys, no config. A free alternative to Firecrawl for scraping docs, blogs, and articles.

npx mcp-server-scraper

Works with Claude Desktop, Cursor, VS Code Copilot, and any MCP client. No accounts or API keys needed.

MCP server for web scraping, content extraction, and URL metadata

Demo built with remotion-readme-kit

Why

When you're working with an AI assistant and need to reference a docs page, a blog post, or an API reference, you usually end up copy-pasting content manually. Tools like Firecrawl solve this but require a paid API key. This server does the same thing for free. It fetches a URL, runs it through Mozilla Readability (the same engine behind Firefox Reader View), and returns clean markdown. It works well for server-rendered content like documentation sites, blog posts, and articles. It won't handle JavaScript-heavy SPAs, but for the most common use case of "read this docs page and summarize it," it does the job.

Tools

Инструменты были проиндексированы:
extract_links

Извлекает все ссылки со страницы с их href и текстом ссылки. Преобразует относительные URL-адреса. Пропускает якоря и ссылки javascript:.

Параметры
  • urlstringобязательный

    The URL to extract links from

extract_metadata

Извлекает метаданные страницы: заголовок, описание, теги Open Graph (og:title, og:description, og:image), канонический URL и фавикон.

Параметры
  • urlstringобязательный

    The URL to extract metadata from

scrape_multiple

Выполняет пакетный сбор данных с нескольких URL. Возвращает заголовок и выдержку для каждого. Ошибки сообщаются для каждого URL без остановки всего пакета.

Параметры
  • urlsstring[]обязательный

    Array of URLs to scrape

scrape_url

Извлекает чистый читаемый текст из URL с помощью Mozilla Readability. Возвращает заголовок, выдержку и основной контент. Лучше всего подходит для статей, документов и блогов.

Параметры
  • urlstringобязательный

    The URL to scrape

search_page

Ищет строку запроса в тексте страницы. Возвращает совпадающие строки (по одной на строку). Используется для поиска упоминаний термина.

Параметры
  • querystringобязательный

    The search query

  • urlstringобязательный

    The URL to search

Похожие MCP-сервера

just-every/mcp-read-website-fast

just-every/mcp-read-website-fast

MCP-сервер для быстрого извлечения веб-контента и преобразования в чистый Markdown. Минимизирует расход токенов, использует Mozilla Readability и кэширование. Идеален для Claude Code, IDE и AI-пайп...

TypeScript161
olostep/olostep-mcp-server

olostep/olostep-mcp-server

MCP сервер для веб-скрапинга и поиска через Olostep: извлекает контент в разных форматах и выполняет ИИ-поиск с цитатами, пакетно собирает до 10k URL и обходит сайты с построением карты ссылок.

TypeScript23
andyliszewski/webcrawl-mcp

andyliszewski/webcrawl-mcp

MCP сервер для веб-скрапинга, поиска и обхода сайтов без headless-браузера. Использует бесплатные библиотеки (trafilatura) для извлечения контента, с опциональным Fallback на Firecrawl для JS-тяжёл...

Python16
scraperapi/scraperapi-mcp

scraperapi/scraperapi-mcp

MCP сервер для интеграции с ScraperAPI, позволяющий LLM-агентам легко выполнять веб-скрапинг. Поддерживает рендеринг JavaScript, геотаргетинг и обход блокировок. Полезен разработчикам, работающим с...

Python5
zcaceres/fetch-mcp

zcaceres/fetch-mcp

MCP сервер для загрузки веб-контента и преобразования его в HTML, Markdown, JSON, читаемый текст или транскрипты YouTube. Полезен разработчикам для извлечения статей, данных и субтитров без лишнего...

TypeScript823
Firecrawl MCP

Firecrawl MCP

официальный

MCP сервер для поиска и скрапинга веб-страниц, превращающий живой интернет в чистые данные для ИИ-агентов. Поддерживает навигацию, клики и автономные исследования. Работает в облаке или локально.

JavaScript7431
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин