mendableai/firecrawl-mcp-server

mendableai/firecrawl-mcp-server

от mendableai
Firecrawl MCP сервер для AI-агентов, которым нужен чистый контекст из живого веба. Ищет информацию, скрапит страницы в структурированные данные, кликает и навигирует. Работает с облаком и сам хостингом, поддерживает автоматические ретраи. Полезен разработчикам для исследований и автоматизации сбо...

Firecrawl MCP Server

A Model Context Protocol (MCP) server that brings Firecrawl to MCP-compatible AI agents — search, scrape, and interact with the live web for clean, agent-ready context.

Big thanks to @vrknetha, @knacklabs for the initial implementation!

Features

  • Search the web and get full page content
  • Scrape any URL into clean, structured data
  • Interact with pages — click, navigate, and operate
  • Deep research with autonomous agent
  • Automatic retries and rate limiting
  • Cloud and self-hosted support
  • SSE support

Play around with our MCP Server on MCP.so's playground or on Klavis AI.

Installation

Hosted MCP (keyless free tier)

Connect to the remote hosted server with no setup:

https://mcp.firecrawl.dev/v2/mcp

On the keyless free tier, scrape, search, and interact work without an API key (rate-limited). Other tools such as crawl, map, agent, and extract still need a key.

Prefer an API key or OAuth whenever the human can sign up. It unlocks the full tool set and higher limits. With a key, use:

https://mcp.firecrawl.dev/{FIRECRAWL_API_KEY}/v2/mcp
Инструменты были проиндексированы:
firecrawl_agentвнешний мир

Запускает асинхронную задачу веб-исследования на основе запроса, необязательных стартовых URL и необязательной JSON-схемы. Используйте его, когда нужен синтез информации из нескольких источников и задача может дождаться асинхронного завершения. Агент умеет искать, переходить по ссылкам, читать страницы и собирать структурированный результат. Этот вызов возвращает только идентификатор задачи, без самого результата исследования. Следите за задачей через firecrawl_agent_status, пока она не достигнет статуса completed или failed; исследование обычно занимает несколько минут. Если задача не успевает завершиться в отведённое время, firecrawl_search и firecrawl_scrape могут собрать материалы синхронно.

Параметры
  • promptstringобязательный
  • schemaobject
  • urlsstring[]
firecrawl_agent_statusтолько чтение

Получает прогресс или итоговые результаты по идентификатору задания firecrawl_agent. Ответ processing не окончателен и не содержит итогового результата исследования. Проверяйте снова через 15–30 секунд, пока статус не станет completed или failed; сложные задания могут занимать несколько минут. Если задание не успевает завершиться за отведённое время, используйте firecrawl_search и firecrawl_scrape, чтобы получить запрошенный результат. Возвращает статус задания, информацию о прогрессе и данные результата после завершения.

Параметры
  • idstringобязательный
firecrawl_check_crawl_statusтолько чтение

Получает текущий статус, прогресс и доступные результаты для существующего crawl ID. Этот инструмент только считывает состояние задания Firecrawl и не запускает и не изменяет обход.

Параметры
  • idstringобязательный
firecrawl_crawlвнешний мир

Запускает многопостраничный обход по URL веб-сайта, опрашивает его до конечного состояния и возвращает итоговый статус и собранные данные. Область обхода можно ограничить с помощью путей включения/исключения, глубины, лимита страниц, управления поддоменами и внешними ссылками, обработки sitemap, задержки и параметров парсинга. Результаты обхода могут быть большими; используйте консервативные лимиты, когда полное покрытие сайта не требуется. Вебхуки и интерактивные действия парсинга недоступны в безопасном режиме. Возвращает идентификатор обхода, статус и данные страниц.

Параметры
  • allowExternalLinksboolean
  • allowSubdomainsboolean
  • crawlEntireDomainboolean
  • deduplicateSimilarURLsboolean
  • delaynumber
  • excludePathsstring[]
  • ignoreQueryParametersboolean
  • includePathsstring[]
  • limitnumber
  • maxConcurrencynumber
  • maxDiscoveryDepthnumber
  • promptstring
  • scrapeOptionsobject
  • sitemapenum
  • urlstringобязательный
  • webhookstring
  • webhookHeadersobject
firecrawl_developer_searchтолько чтениевнешний мир

Выполняет поиск по индексу, созданному для агентов кодирования, для вопросов разработчика: поведение кода, библиотека или фреймворк, контракт API, сообщение об ошибке или известная ошибка. Индекс охватывает issues GitHub, объединенные pull request, README-файлы репозиториев и курируемые сайты документации. Установите параметр skills в значение "only", чтобы ограничить поиск файлами agent-skill. Возвращает ранжированные результаты с ID, типом источника, URL, заголовком и совпадающими фрагментами в Markdown.

Параметры
  • kinteger

    Number of ranked results to return (default 10).

  • querystringобязательный

    Natural-language developer question or search phrase, including the library, error message, or API involved when relevant.

  • skillsenum

    Set to "only" to search only agent-skill files.

firecrawl_extractтолько чтениевнешний мир

Устаревшая точка входа для совместимости. Используйте firecrawl_scrape по одному разу для каждого известного URL с форматами: ["json"] и jsonOptions, содержащими prompt и schema. Используйте firecrawl_search или firecrawl_agent перед Scrape, когда URL неизвестны.

Параметры
  • allowExternalLinksboolean
  • enableWebSearchboolean
  • includeSubdomainsboolean
  • promptstring
  • schemaobject
  • urlsstring[]обязательный
firecrawl_feedbackвнешний мир

Отправляет краткую оценку качества для завершённого задания поиска, скрейпинга, парсинга или картирования. Указывает endpoint, ID задания, оценку и релевантные коды проблем или небольшие контекстные поля; опускает большие фрагменты содержимого страниц и необработанные результаты. Возвращает статус отправки, ID отзыва и учётные поля.

Параметры
  • endpointenumобязательный
  • issuesstring[]
  • jobIdstringобязательный
  • metadataobject
  • missingContentobject[]
  • notestring
  • pageNumbersinteger[]
  • querySuggestionsstring
  • ratingenumобязательный
  • tagsstring[]
  • urlstring
  • valuableSourcesobject[]
firecrawl_interactвнешний мир

Открывает или повторно использует активный сеанс браузера, чтобы перейти на страницу, нажать на элементы управления, заполнить поля или выполнить браузерный код. Укажите либо url, либо scrapeId, а также либо prompt на естественном языке, либо исполняемый code; код может выполняться как Bash, Python или Node с ограниченным таймаутом. Этот инструмент действует на реальном сайте, поэтому такие действия, как отправка формы, могут создавать постоянные внешние побочные эффекты. Возвращает результаты выполнения, stdout/stderr, код выхода и URL-адреса для просмотра сеанса.

Параметры
  • codestring
  • languageenum
  • promptstring
  • scrapeIdstring
  • scrapeOptionsobject
  • timeoutnumber
  • urlstring
firecrawl_interact_stop

Останавливает активную сессию взаимодействия, связанную с scrapeId, и освобождает её ресурсы. Возвращает подтверждение об успешном выполнении.

Параметры
  • scrapeIdstringобязательный
firecrawl_mapтолько чтениевнешний мир

Перечисляет URL-адреса, проиндексированные на одном сайте, через Firecrawl, не загружая содержимое каждой страницы. Используйте этот инструмент, когда запрос требует перечень URL-адресов сайта, когда нужно найти несколько подходящих страниц или когда URL нужной страницы неизвестен. Необязательный параметр search сужает список URL-адресов, а опции sitemap, subdomain, query-parameter и result-limit управляют охватом. Возвращает подходящие URL-адреса, а не содержимое страниц. Получите одну страницу с помощью firecrawl_scrape; соберите содержимое с нескольких страниц с помощью firecrawl_crawl.

Параметры
  • ignoreQueryParametersboolean
  • includeSubdomainsboolean
  • limitnumber
  • searchstring
  • sitemapenum
  • urlstringобязательный
firecrawl_monitor_checkтолько чтение

Получает одну проверку мониторинга и её результаты на уровне страниц, при необходимости фильтруя по статусу страницы. Страницы сообщают статус same, new, changed, removed или error; настроенная оценка целей может добавить решение о значимости изменения. Markdown-отслеживание возвращает единый текстовый diff, JSON-отслеживание возвращает пути полей с предыдущими и текущими значениями и текущий снимок, а смешанное отслеживание возвращает оба варианта. Возвращает одну страницу результатов и URL next, если есть ещё страницы.

Параметры
  • checkIdstringобязательный
  • idstringобязательный
  • limitinteger
  • pageStatusenum
  • skipinteger
firecrawl_monitor_checksтолько чтение

Перечисляет исторические проверки монитора, при необходимости фильтруя их по статусу и ограничивая количество результатов. Возвращает одну страницу сводок проверок и метаданные пагинации.

Параметры
  • idstringобязательный
  • limitinteger
  • offsetinteger
  • statusenum
firecrawl_monitor_createвнешний мир

Создаёт периодический монитор для скрейпинга, обхода или поиска, который сравнивает каждую проверку с предыдущей. Простая форма принимает page/pages или queries, а также goal, сформулированный обычным языком; расширенная форма body управляет целями, расписанием, форматами отслеживания изменений, оценкой, хранением, webhook и уведомлениями. В простой форме goal обязателен. Если queries содержит одно или несколько непустых значений и передаётся вместе с page/pages, то queries формируют цель поиска, а цели из page игнорируются. Монитор планирует будущие сетевые проверки и может отправлять настроенные уведомления по электронной почте или через webhook. Возвращает созданный монитор.

Параметры
  • bodyobject
  • emailstring
  • excludeDomainsstring[]
  • goalstring
  • includeDiffsboolean
  • includeDomainsstring[]
  • maxResultsinteger
  • namestring
  • pagestring
  • pagesstring[]
  • queriesstring[]
  • scheduleTextstring
  • searchWindowenum
  • timezonestring
  • webhookUrlstring
firecrawl_monitor_deleteвнешний мир

Окончательно удаляет монитор по ID и останавливает его запланированные запуски. Эту операцию нельзя отменить, и она возвращает статус удаления.

Параметры
  • idstringобязательный
firecrawl_monitor_getтолько чтение

Получает один монитор по ID, включая его конфигурацию и текущее состояние. Не запускает и не изменяет монитор.

Параметры
  • idstringобязательный
firecrawl_monitor_listтолько чтение

Выводит список мониторов для аутентифицированной учетной записи с опциональными параметрами управления пагинацией. Возвращает одну страницу записей мониторов и метаданные пагинации.

Параметры
  • limitinteger
  • offsetinteger
firecrawl_monitor_runвнешний мир

Ставит в очередь немедленную проверку для монитора вне его обычного расписания. Это запускает сетевую работу для настроенных целей монитора и возвращает поставленную в очередь проверку.

Параметры
  • idstringобязательный
firecrawl_monitor_updateвнешний мир

Вносит изменения в существующий монитор по ID. В теле запроса можно изменить его название, статус active/paused, расписание, цели, ориентиры (goal), критерии оценки (judging), вебхуки, уведомления или срок хранения данных; эти изменения влияют на будущие запланированные проверки. Возвращает обновлённый монитор.

Параметры
  • bodyobjectобязательный
  • idstringобязательный
firecrawl_parseтолько чтение

Преобразует один поддерживаемый документ в markdown, HTML, ссылки, сводку, точечные ответы или JSON, соответствующий схеме. На вход принимаются распространённые файлы HTML, PDF, Word, RTF, OpenDocument и электронные таблицы; разбор PDF можно ограничить параметром pdfOptions.maxPages. Локальный MCP читает filePath из файловой системы сервера. Хостируемый MCP использует два вызова: сначала передайте filePath, чтобы получить инструкции по загрузке, загрузите файл локально, затем вызовите снова с возвращённым uploadRef; не отправляйте оба поля одновременно. Удалённые веб-URL относятся к firecrawl_scrape. Установите redactPII, чтобы запросить удаление персональных данных из возвращаемого содержимого. zeroDataRetention требует аутентифицированной учётной записи, отвечающей условиям; не указывайте его при анонимном использовании без ключа. Возвращает инструкции по загрузке для первого этапа хостируемого MCP или содержимое разобранного документа для финального вызова.

Параметры
  • contentTypestring

    Optional MIME type override. If omitted, the server infers the file kind from the extension.

  • excludeTagsstring[]
  • filePathstringобязательный

    Absolute or relative path to a local file to parse. Supported: .html, .htm, .pdf, .docx, .doc, .odt, .rtf, .xlsx, .xls

  • formatsenum[]
  • includeTagsstring[]
  • jsonOptionsobject
  • maxAgenumber

    Ignored: parse never reuses or stores indexed content.

  • onlyMainContentboolean
  • parsersenum[]
  • pdfOptionsobject
  • proxyenum
  • queryOptionsobject
  • redactPIIboolean
  • removeBase64Imagesboolean
  • skipTlsVerificationboolean
  • storeInCacheboolean
  • zeroDataRetentionboolean
firecrawl_research_inspect_paperтолько чтениевнешний мир

Получает канонические метаданные для одного идентификатора статьи, например arXiv, PMC, PMID или DOI. Возвращает заголовок, аннотацию, авторов, категории, идентификаторы источников и даты в формате Markdown.

Параметры
  • paperIdstringобязательный

    Canonical paperId or primaryId such as arxiv:1706.03762, pmcid:PMC12530322, pmid:40953549, or doi:10.1016/j.neunet.2025.108095.

firecrawl_research_read_paperтолько чтениевнешний мир

Извлекает из одной статьи фрагменты основного текста, соответствующие конкретному вопросу. Полный текст доступен только для индексированных статей; k управляет количеством фрагментов. Возвращает соответствующие фрагменты или уведомление, если полный текст недоступен.

Параметры
  • kinteger

    Number of passages to return (default 4).

  • paperIdstringобязательный

    Canonical paperId or primaryId such as arxiv:1706.03762, pmcid:PMC12530322, pmid:40953549, or doi:10.1016/j.neunet.2025.108095.

  • questionstringобязательный
firecrawl_research_related_papersтолько чтениевнешний мир

Находит кандидатов в графе цитирования, используя от одного до десяти seed_ids; первый ID - основной начальный узел, а последующие - якоря. mode по умолчанию принимает значение similar (ко-цитирование/библиографическая связь); citers возвращает статьи, цитирующие начальный узел, а references - статьи, цитируемые начальным узлом. intent ранжирует кандидатов. Возвращает ранжированных кандидатов и размер оценённого пула.

Параметры
  • intentstringобязательный
  • kinteger
  • modeenum
  • rerankboolean

    Apply an additional rerank over the fused candidates.

  • seed_idsstring[]обязательный
firecrawl_research_search_githubтолько чтениевнешний мир

Ищет по проиндексированному публичному содержимому issues, pull-request'ов и README-файлов на GitHub. Возвращает ранжированные совпадения с репозиторием, URL, фрагментом и полным Markdown-текстом совпадения, когда он доступен.

Параметры
  • kinteger
  • querystringобязательный
firecrawl_research_search_papersтолько чтениевнешний мир

Ищет метаданные статей и аннотации по запросу на естественном языке по индексированному корпусу, который охватывает биомедицинскую литературу, литературу по наукам о жизни и клиническую литературу (PubMed, bioRxiv, medRxiv), а также arXiv и другие научные источники. Необязательные фильтры по автору, категории и дате ограничивают результаты. Несколько разных формулировок одного и того же вопроса выдают другие статьи, чем один запрос. Возвращает ранжированные статьи с каноническими идентификаторами, названиями, авторами и аннотациями.

Параметры
  • authorsstring[]

    Author substring filter(s); ALL must match (case-insensitive).

  • categoriesstring[]

    Paper category filter(s) (e.g. cs.LG); ALL provided values must match.

  • fromstring

    Inclusive lower bound on created/updated date (YYYY-MM-DD).

  • kinteger

    Number of ranked papers to return (default 40).

  • querystringобязательный

    Natural-language research topic or question, including methods, systems, conditions, populations, interventions, or outcomes when relevant.

  • tostring

    Inclusive upper bound on created/updated date (YYYY-MM-DD).

firecrawl_scrapeвнешний мир

Получает и извлекает содержимое одного указанного URL через Firecrawl. Используйте этот инструмент, когда запрос указывает на страницу и нужны её содержимое или определённые поля. Он может вернуть Markdown, HTML, ссылки, скриншоты, данные о бренде, точечный ответ или JSON, соответствующий заданной схеме. JSON удобен, когда ожидаемый результат содержит определённые поля, а Markdown сохраняет читаемое содержимое страницы. Этот инструмент работает с известной страницей. Для набора страниц используйте firecrawl_crawl, а для поиска URL страниц используйте firecrawl_map или firecrawl_search. Среди опций: задержка рендеринга JavaScript, возраст кэша, фильтрация основного контента, маскирование PII и получение только из кэша в режиме lockdown. Действия браузера могут изменить живую страницу, если включены интерактивные действия. Firecrawl может повторно использовать недавно проиндексированный контент вместо повторной загрузки страницы, и окно повторного использования зависит от домена. Установите maxAge: 0, чтобы принудительно выполнить живую загрузку, или меньшее значение maxAge, чтобы ограничить, насколько устаревшим может быть повторно используемый контент. Успешный ответ сам по себе не подтверждает, что описанное в нём состояние всё ещё актуально. Возвращает выбранные форматы контента и метаданные страницы.

Параметры
  • actionsobject[]
  • excludeTagsstring[]
  • formatsenum[]
  • includeTagsstring[]
  • jsonOptionsobject
  • locationobject
  • lockdownboolean
  • maxAgenumber
  • mobileboolean
  • onlyMainContentboolean
  • parsersenum[]
  • pdfOptionsobject
  • profileobject
  • proxyenum
  • queryOptionsobject
  • redactPIIboolean
  • removeBase64Imagesboolean
  • screenshotOptionsobject
  • skipTlsVerificationboolean
  • storeInCacheboolean
  • urlstringобязательный
  • waitFornumber
  • zeroDataRetentionboolean
firecrawl_searchтолько чтениевнешний мир

Ищет по вебу, новостям или изображениям и возвращает ранжированные результаты. Операторы включают фразы в кавычках, -term, site:host, inurl:term, intitle:term и related:host; список не исчерпывающий. includeDomains и excludeDomains - взаимоисключающие фильтры по имени хоста; категории ограничивают результаты источниками GitHub, research, PDF или developer. Для вопроса по программированию добавьте categories: ["developer"]. Инструмент ищет по индексу GitHub issues, объединённых pull request, README репозиториев и курируемых сайтов с документацией и возвращает совпадения в data.developer в дополнение к веб-результатам. categories: ["research"] ограничивает эти веб-результаты сайтами, связанными с исследованиями, и возвращает фрагменты страниц. Инструменты firecrawl_research_* - отдельный интерфейс, который ищет по аннотациям и полным текстам статей в биомедицинской литературе (PubMed, bioRxiv, medRxiv) и литературе arXiv. scrapeOptions может прикреплять извлечённое содержимое страниц; страницы, полученные таким способом, используют фиксированное окно повторного использования и игнорируют maxAge, поэтому используйте firecrawl_scrape, когда требуется актуальная загрузка. Возвращает группы результатов по типу источника и метаданные об использовании. Аутентифицированные ответы могут включать id для необязательной обратной связи по поиску.

Параметры
  • categoriesenum[]

    Limit results to specific source types. github searches GitHub repositories, code, issues, and docs; research restricts ordinary web results to research-affiliated websites and returns page snippets, which is separate from the firecrawl_research_* tools that search paper abstracts and full text across biomedical (PubMed, bioRxiv, medRxiv) and arXiv literature; pdf searches PDF results; developer searches an index built for coding agents over GitHub issues, merged pull requests, repository READMEs, and curated documentation sites. developer adds a data.developer group of { url, title, description } results, where description holds the matched passage; the other categories filter data.web.

  • enterpriseenum[]
  • excludeDomainsstring[]
  • filterstring
  • highlightsboolean

    Return query-relevant highlights for each search result. Set to false to keep the original search snippets.

  • includeDomainsstring[]
  • limitnumber
  • locationstring
  • querystringобязательный
  • scrapeOptionsobject
  • sourcesobject[]
  • tbsstring
firecrawl_search_feedbackвнешний мир

Записывает валидированную по схеме обратную связь о качестве для предыдущего поиска firecrawl_search с UUID searchId. Оценка good требует ценного источника, partial - ценного источника или хотя бы одной записи missingContent, а bad - хотя бы одной записи missingContent или предложения по запросу; лимиты: 50 записей valuableSources и 20 записей missingContent. Допускаются только успешные поиски в пределах окна давности обратной связи. Запись идемпотентна для каждого ID поиска. Первая подходящая обратная связь для поиска может вернуть 1 кредит; на возвраты действует дневной лимит команды. Ответ сообщает, был ли применён возврат, а также статус отправки и дневного лимита.

Параметры
  • missingContentobject[]

    Array of specific pieces of content the agent expected to find but did not. One entry per distinct topic. Each entry has a short topic and optional longer description.

  • querySuggestionsstring
  • ratingenumобязательный
  • searchIdstringобязательный
  • valuableSourcesobject[]

Похожие MCP-сервера

Firecrawl MCP

Firecrawl MCP

официальный

MCP сервер для поиска и скрапинга веб-страниц, превращающий живой интернет в чистые данные для ИИ-агентов. Поддерживает навигацию, клики и автономные исследования. Работает в облаке или локально.

JavaScript7431
mzxrai/mcp-webresearch

mzxrai/mcp-webresearch

MCP-сервер для веб-исследований, подключающий Claude к интернету: поиск в Google, извлечение содержимого страниц, создание скриншотов и трекинг сессии. Полезен, чтобы получать актуальную информацию...

JavaScript300
hanzili/comet-mcp

hanzili/comet-mcp

Подключает Claude Code к Perplexity Comet для агентного браузинга и исследований. Claude пишет код, Comet ищет, кликает, собирает данные. Полезно разработчикам, которым нужны глубокие веб-исследова...

TypeScript180
webscraping-ai/webscraping-ai-mcp-server

webscraping-ai/webscraping-ai-mcp-server

официальный

MCP сервер для веб-скрапинга через WebScraping.AI — извлекает текст, HTML и структурированные данные, задаёт вопросы по содержимому страниц. Поддерживает JavaScript-рендеринг, CSS-селекторы, выбор прокси и эмуляцию устройств. Идеален для интеграции с LLM при сборе информации с сайтов.

JavaScript45
nangman-infra/touch-browser

nangman-infra/touch-browser

Touch-browser - MCP сервер для проверки фактов AI-агентами. Анализирует страницу и выдаёт вердикты по утверждениям с цитатами: поддержано, опровергнуто или нужен ещё просмотр.

Rust10
hyperbrowserai/mcp

hyperbrowserai/mcp

MCP сервер Hyperbrowser для скрапинга, краулинга и извлечения структурированных данных. Включает браузерные агенты OpenAI CUA и Claude. Для веб-автоматизации и сбора данных LLM.

TypeScript789
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин