Firecrawl MCP

Firecrawl MCP

от firecrawl
MCP сервер для поиска и скрапинга веб-страниц, превращающий живой интернет в чистые данные для ИИ-агентов. Поддерживает навигацию, клики и автономные исследования. Работает в облаке или локально.

Firecrawl MCP Server

A Model Context Protocol (MCP) server that brings Firecrawl to MCP-compatible AI agents — search, scrape, and interact with the live web for clean, agent-ready context.

Big thanks to @vrknetha, @knacklabs for the initial implementation!

Features

  • Search the web and get full page content
  • Scrape any URL into clean, structured data
  • Interact with pages — click, navigate, and operate
  • Deep research with autonomous agent
  • Automatic retries and rate limiting
  • Cloud and self-hosted support
  • SSE support

Play around with our MCP Server on MCP.so's playground or on Klavis AI.

Installation

Hosted MCP (keyless free tier)

Connect to the remote hosted server with no setup:

https://mcp.firecrawl.dev/v2/mcp

On the keyless free tier, scrape, search, and interact work without an API key (rate-limited). Other tools such as crawl, map, agent, and extract still need a key.

Prefer an API key or OAuth whenever the human can sign up. It unlocks the full tool set and higher limits. With a key, use:

https://mcp.firecrawl.dev/{FIRECRAWL_API_KEY}/v2/mcp
Инструменты были проиндексированы:
firecrawl_agentвнешний мир

Запускает асинхронную задачу веб-исследования на основе запроса, необязательных стартовых URL-адресов и необязательной JSON-схемы. Используйте этот вызов, когда нужен синтез информации из нескольких источников и задача может подождать асинхронного завершения. Агент умеет искать, переходить по ссылкам, читать страницы и собирать структурированный результат. Этот вызов возвращает только идентификатор задания (job ID), а не результат исследования. Следите за заданием через firecrawl_agent_status, пока оно не перейдёт в состояние completed или failed; исследование обычно занимает несколько минут. Если задание не успевает завершиться за отведённое время, firecrawl_search и firecrawl_scrape могут синхронно собрать доказательства.

Параметры
  • promptstringобязательный
  • schemaobject
  • urlsstring[]
firecrawl_agent_statusтолько чтение

Получает прогресс или итоговые результаты для идентификатора задания firecrawl_agent. Ответ со статусом processing не окончателен и не содержит итогового результата исследования. Проверяйте снова через 15-30 секунд, пока статус не станет completed или failed; сложные задания могут занимать несколько минут. Если задание не может завершиться за отведённое для задачи время, используйте firecrawl_search и firecrawl_scrape, чтобы получить требуемый результат. Возвращает статус задания, информацию о прогрессе и данные результата по завершении.

Параметры
  • idstringобязательный
firecrawl_check_crawl_statusтолько чтение

Получает текущий статус, прогресс и доступные результаты для существующего ID обхода. Этот инструмент только читает состояние задания Firecrawl и не запускает и не изменяет обход.

Параметры
  • idstringобязательный
firecrawl_crawlвнешний мир

Запускает многопостраничный обход по URL-адресу сайта, опрашивает его до конечного состояния и возвращает итоговый статус и собранные данные. Область обхода можно ограничить с помощью путей включения/исключения, глубины, лимита страниц, контроля поддоменов/внешних ссылок, обработки sitemap, задержки и параметров скрейпинга. Результаты обхода могут быть большими; используйте консервативные лимиты, если покрытие всего сайта не требуется. Вебхуки и интерактивные действия скрейпинга недоступны в безопасном режиме. Возвращает идентификатор обхода, статус и данные страниц.

Параметры
  • allowExternalLinksboolean
  • allowSubdomainsboolean
  • crawlEntireDomainboolean
  • deduplicateSimilarURLsboolean
  • delaynumber
  • excludePathsstring[]
  • ignoreQueryParametersboolean
  • includePathsstring[]
  • limitnumber
  • maxConcurrencynumber
  • maxDiscoveryDepthnumber
  • promptstring
  • scrapeOptionsobject
  • sitemapenum
  • urlstringобязательный
  • webhookstring
  • webhookHeadersobject
firecrawl_developer_searchтолько чтениевнешний мир

Если у разработчика есть вопрос про поведение кода, библиотеку или фреймворк, контракт API, сообщение об ошибке или известный баг, выполняет поиск по индексу, созданному для агентов, пишущих код. Индекс охватывает GitHub issues, объединённые пул-реквесты, README репозиториев и курируемые сайты документации. Установите параметр skills в значение «only», чтобы ограничить поиск только файлами навыков агента. Возвращает ранжированные результаты с ID, типом источника, URL, заголовком и совпадающими фрагментами в формате Markdown.

Параметры
  • kinteger

    Number of ranked results to return (default 10).

  • querystringобязательный

    Natural-language developer question or search phrase, including the library, error message, or API involved when relevant.

  • skillsenum

    Set to "only" to search only agent-skill files.

firecrawl_extractтолько чтениевнешний мир

Устаревшая точка входа для совместимости. Используйте firecrawl_scrape по одному разу для каждого известного URL с форматами: ["json"] и jsonOptions, содержащими prompt и schema. Используйте firecrawl_search или firecrawl_agent перед Scrape, когда URL неизвестны.

Параметры
  • allowExternalLinksboolean
  • enableWebSearchboolean
  • includeSubdomainsboolean
  • promptstring
  • schemaobject
  • urlsstring[]обязательный
firecrawl_feedbackвнешний мир

Отправляет краткий отзыв о качестве для завершённой задачи поиска, скрейпинга, парсинга или маппинга. Принимает endpoint, ID задачи, оценку и соответствующие коды проблем или небольшие контекстные поля; не включает большие объёмы содержимого страниц и необработанные выходные данные. Возвращает статус отправки, ID отзыва и учётные поля.

Параметры
  • endpointenumобязательный
  • issuesstring[]
  • jobIdstringобязательный
  • metadataobject
  • missingContentobject[]
  • notestring
  • pageNumbersinteger[]
  • querySuggestionsstring
  • ratingenumобязательный
  • tagsstring[]
  • urlstring
  • valuableSourcesobject[]
firecrawl_interactвнешний мир

Открывает или повторно использует активную сессию браузера, чтобы переходить по странице, нажимать на элементы управления, заполнять поля или выполнять код в браузере. Принимает либо url, либо scrapeId, а также либо prompt на естественном языке, либо исполняемый code; код может выполняться на Bash, Python или Node с ограниченным таймаутом. Действует на живом сайте, поэтому такие действия, как отправка формы, могут создавать постоянные внешние побочные эффекты. Возвращает вывод выполнения, stdout/stderr, код завершения и URL-адреса для просмотра сессии.

Параметры
  • codestring
  • languageenum
  • promptstring
  • scrapeIdstring
  • scrapeOptionsobject
  • timeoutnumber
  • urlstring
firecrawl_interact_stop

Останавливает активную интерактивную сессию, связанную с scrapeId, и освобождает её ресурсы. Возвращает подтверждение успешного выполнения.

Параметры
  • scrapeIdstringобязательный
firecrawl_mapтолько чтениевнешний мир

Перечисляет URL-адреса, проиндексированные на одном сайте, через Firecrawl, не загружая содержимое каждой страницы. Используйте этот инструмент, когда запрос требует полный список URL сайта, когда нужно найти несколько подходящих страниц или когда точный URL нужной страницы неизвестен. Необязательный параметр search сужает список URL, а параметры sitemap, поддомена, query-параметры и ограничение количества результатов управляют охватом. Возвращает соответствующие URL, а не содержимое страниц. Извлекайте одну страницу с помощью firecrawl_scrape; собирайте содержимое с нескольких страниц с помощью firecrawl_crawl.

Параметры
  • ignoreQueryParametersboolean
  • includeSubdomainsboolean
  • limitnumber
  • searchstring
  • sitemapenum
  • urlstringобязательный
firecrawl_monitor_checkтолько чтение

Получает одну проверку мониторинга и её постраничные результаты, при необходимости отфильтрованные по статусу страницы. Страницы сообщают статусы same, new, changed, removed или error; настроенная оценка целей может добавить решение о значимом изменении. Отслеживание в формате Markdown возвращает единый текстовый diff, JSON-отслеживание возвращает пути полей с предыдущими и текущими значениями и текущий снимок состояния, а смешанное отслеживание возвращает оба вида. Возвращает одну страницу результатов и URL next, если есть ещё страницы.

Параметры
  • checkIdstringобязательный
  • idstringобязательный
  • limitinteger
  • pageStatusenum
  • skipinteger
firecrawl_monitor_checksтолько чтение

Перечисляет исторические проверки для монитора, при необходимости фильтруя по статусу и ограничивая количество результатов. Возвращает одну страницу сводок проверок и метаданные пагинации.

Параметры
  • idstringобязательный
  • limitinteger
  • offsetinteger
  • statusenum
firecrawl_monitor_createвнешний мир

Создаёт периодический монитор для scrape, crawl или поиска, который сравнивает каждую проверку с предыдущей сохранённой проверкой. Простая форма принимает page/pages или queries плюс goal, сформулированный простыми словами; расширенная форма body управляет целями, расписанием, форматами отслеживания изменений, оценкой, хранением, webhook и уведомлениями. В простой форме goal обязателен. Если queries содержит одно или несколько непустых значений и передаётся вместе с page/pages, queries формирует цель поиска, а цели, заданные страницами, игнорируются. Монитор планирует будущие сетевые проверки и может отправлять настроенные уведомления по email или webhook. Возвращает созданный монитор.

Параметры
  • bodyobject
  • emailstring
  • excludeDomainsstring[]
  • goalstring
  • includeDiffsboolean
  • includeDomainsstring[]
  • maxResultsinteger
  • namestring
  • pagestring
  • pagesstring[]
  • queriesstring[]
  • scheduleTextstring
  • searchWindowenum
  • timezonestring
  • webhookUrlstring
firecrawl_monitor_deleteвнешний мир

Навсегда удаляет монитор по ID и останавливает его будущее расписание. Эта операция необратима и возвращает статус удаления.

Параметры
  • idstringобязательный
firecrawl_monitor_getтолько чтение

Возвращает один монитор по ID, включая его конфигурацию и текущее состояние. Эта операция не запускает и не изменяет монитор.

Параметры
  • idstringобязательный
firecrawl_monitor_listтолько чтение

Перечисляет мониторы для аутентифицированной учётной записи с необязательными параметрами пагинации. Возвращает одну страницу записей мониторов и метаданные пагинации.

Параметры
  • limitinteger
  • offsetinteger
firecrawl_monitor_runвнешний мир

Ставит в очередь немедленную проверку для монитора вне обычного расписания. Это запускает сетевые операции для настроенных целей монитора и возвращает поставленную в очередь проверку.

Параметры
  • idstringобязательный
firecrawl_monitor_updateвнешний мир

Обновляет существующий монитор по ID. Тело запроса может изменить его имя, статус «активен/приостановлен», расписание, объекты мониторинга, цель, критерии оценки, вебхук, уведомления или срок хранения; эти изменения влияют на будущие запланированные проверки. Возвращает обновлённый монитор.

Параметры
  • bodyobjectобязательный
  • idstringобязательный
firecrawl_parseтолько чтение

Преобразует один поддерживаемый документ в markdown, HTML, ссылки, сводку, точечные ответы или JSON, соответствующий схеме. Поддерживаемые входные данные включают распространённые файлы HTML, PDF, Word, RTF, OpenDocument и электронных таблиц; разбор PDF можно ограничить с помощью pdfOptions.maxPages. Локальный MCP читает filePath из файловой системы сервера. Хостируемый MCP использует два вызова: сначала передайте filePath, чтобы получить инструкции по загрузке, загрузите локальный файл, затем вызовите снова с возвращённым uploadRef; не отправляйте оба поля вместе. Внешние URL-адреса следует передавать в firecrawl_scrape. Установите redactPII, чтобы запросить удаление персональных данных из возвращаемого содержимого. zeroDataRetention требует подходящей аутентифицированной учётной записи; опустите его для анонимного использования без ключа. Возвращает инструкции по загрузке для первого вызова в хостируемом режиме или содержимое разобранного документа для финального вызова.

Параметры
  • contentTypestring

    Optional MIME type override. If omitted, the server infers the file kind from the extension.

  • excludeTagsstring[]
  • filePathstringобязательный

    Absolute or relative path to a local file to parse. Supported: .html, .htm, .pdf, .docx, .doc, .odt, .rtf, .xlsx, .xls

  • formatsenum[]
  • includeTagsstring[]
  • jsonOptionsobject
  • maxAgenumber

    Ignored: parse never reuses or stores indexed content.

  • onlyMainContentboolean
  • parsersenum[]
  • pdfOptionsobject
  • proxyenum
  • queryOptionsobject
  • redactPIIboolean
  • removeBase64Imagesboolean
  • skipTlsVerificationboolean
  • storeInCacheboolean
  • zeroDataRetentionboolean
firecrawl_research_inspect_paperтолько чтениевнешний мир

Получает канонические метаданные для одного идентификатора статьи, например arXiv, PMC, PMID или DOI. Возвращает название, аннотацию, авторов, категории, исходные идентификаторы и даты в формате Markdown.

Параметры
  • paperIdstringобязательный

    Canonical paperId or primaryId such as arxiv:1706.03762, pmcid:PMC12530322, pmid:40953549, or doi:10.1016/j.neunet.2025.108095.

firecrawl_research_read_paperтолько чтениевнешний мир

Извлекает из одной статьи фрагменты основного текста, релевантные конкретному вопросу. Полный текст доступен только для индексированных статей; параметр k управляет количеством фрагментов. Возвращает совпадающие фрагменты или уведомление, когда полный текст недоступен.

Параметры
  • kinteger

    Number of passages to return (default 4).

  • paperIdstringобязательный

    Canonical paperId or primaryId such as arxiv:1706.03762, pmcid:PMC12530322, pmid:40953549, or doi:10.1016/j.neunet.2025.108095.

  • questionstringобязательный
firecrawl_research_related_papersтолько чтениевнешний мир

Находит кандидатов в графе цитирования по одному-десяти seed_ids; первый ID - основная затравка, последующие ID - якоря. mode по умолчанию равен similar (co-citation/bibliographic coupling); citers возвращает статьи, цитирующие затравку, а references - статьи, цитируемые затравкой. intent ранжирует кандидатов. Возвращает ранжированных кандидатов и размер оценённого пула.

Параметры
  • intentstringобязательный
  • kinteger
  • modeenum
  • rerankboolean

    Apply an additional rerank over the fused candidates.

  • seed_idsstring[]обязательный
firecrawl_research_search_githubтолько чтениевнешний мир

Ищет в проиндексированном публичном содержимом GitHub: issue, pull-request и README. Возвращает ранжированные совпадения с репозиторием, URL, фрагментом и полным совпавшим Markdown, когда он доступен.

Параметры
  • kinteger
  • querystringобязательный
firecrawl_research_search_papersтолько чтениевнешний мир

Ищет метаданные и рефераты статей по запросу на естественном языке в индексированном корпусе, который охватывает биомедицинскую, медико-биологическую и клиническую литературу (PubMed, bioRxiv, medRxiv), а также arXiv и другие научные источники. Необязательные фильтры по автору, категории и дате сужают результаты. Несколько разных формулировок одного и того же вопроса выдают другие статьи, чем один запрос. Возвращает ранжированные статьи с каноническими идентификаторами, названиями, авторами и рефератами.

Параметры
  • authorsstring[]

    Author substring filter(s); ALL must match (case-insensitive).

  • categoriesstring[]

    Paper category filter(s) (e.g. cs.LG); ALL provided values must match.

  • fromstring

    Inclusive lower bound on created/updated date (YYYY-MM-DD).

  • kinteger

    Number of ranked papers to return (default 40).

  • querystringобязательный

    Natural-language research topic or question, including methods, systems, conditions, populations, interventions, or outcomes when relevant.

  • tostring

    Inclusive upper bound on created/updated date (YYYY-MM-DD).

firecrawl_scrapeвнешний мир

Получает и извлекает контент из одного переданного URL через Firecrawl. Используйте его, когда в запросе указана страница и нужно её содержимое или заданные поля. Он возвращает Markdown, HTML, ссылки, скриншоты, данные брендинга, точечный ответ или JSON, соответствующий заданной схеме; JSON удобен, когда у запрашиваемого результата есть заданные поля, а Markdown сохраняет читаемый контент страницы. Этот инструмент работает с уже известной страницей. Для набора страниц используйте firecrawl_crawl, а для поиска URL страниц - firecrawl_map или firecrawl_search. Параметры включают задержку рендеринга JavaScript, возраст кэша, фильтрацию основного контента, удаление персональных данных (PII) и строгий режим получения данных только из кэша. Действия браузера могут менять живую страницу, когда включены интерактивные действия. Firecrawl может переиспользовать недавно проиндексированный контент вместо повторной загрузки страницы, и окно переиспользования зависит от домена. Установите maxAge: 0, чтобы принудительно загрузить страницу напрямую, или меньшее значение maxAge, чтобы ограничить допустимую устарелость переиспользуемого контента. Успешный ответ сам по себе не подтверждает, что описанное в нём состояние всё ещё актуально. Возвращает выбранные форматы контента и метаданные страницы.

Параметры
  • actionsobject[]
  • excludeTagsstring[]
  • formatsenum[]
  • includeTagsstring[]
  • jsonOptionsobject
  • locationobject
  • lockdownboolean
  • maxAgenumber
  • mobileboolean
  • onlyMainContentboolean
  • parsersenum[]
  • pdfOptionsobject
  • profileobject
  • proxyenum
  • queryOptionsobject
  • redactPIIboolean
  • removeBase64Imagesboolean
  • screenshotOptionsobject
  • skipTlsVerificationboolean
  • storeInCacheboolean
  • urlstringобязательный
  • waitFornumber
  • zeroDataRetentionboolean
firecrawl_searchтолько чтениевнешний мир

Ищет в вебе, новостях или источниках изображений и возвращает ранжированные результаты. Операторы включают фразы в кавычках, -term, site:host, inurl:term, intitle:term и related:host; список не исчерпывающий. includeDomains и excludeDomains — взаимоисключающие фильтры по именам хостов; категории ограничивают результаты источниками GitHub, research, PDF или developer. Для вопроса по программированию добавьте categories: ["developer"]. Инструмент ищет по индексу GitHub issues, объединённых pull request, README репозиториев и подготовленных сайтов документации и возвращает совпадения в data.developer рядом с веб-результатами. categories: ["research"] ограничивает веб-результаты сайтами, связанными с исследованиями, и возвращает фрагменты страниц. Инструменты firecrawl_research_* — это отдельная поверхность, которая ищет аннотации и полные тексты статей в биомедицинских источниках (PubMed, bioRxiv, medRxiv) и литературе arXiv. scrapeOptions может прикреплять извлечённое содержимое страницы; страницы, полученные таким образом, используют фиксированное окно повторного использования и игнорируют maxAge, поэтому используйте firecrawl_scrape, когда требуется живая загрузка. Возвращает группы результатов по типам источников и метаданные об использовании. Аутентифицированные ответы могут включать id для необязательной обратной связи по поиску.

Параметры
  • categoriesenum[]

    Limit results to specific source types. github searches GitHub repositories, code, issues, and docs; research restricts ordinary web results to research-affiliated websites and returns page snippets, which is separate from the firecrawl_research_* tools that search paper abstracts and full text across biomedical (PubMed, bioRxiv, medRxiv) and arXiv literature; pdf searches PDF results; developer searches an index built for coding agents over GitHub issues, merged pull requests, repository READMEs, and curated documentation sites. developer adds a data.developer group of { url, title, description } results, where description holds the matched passage; the other categories filter data.web.

  • enterpriseenum[]
  • excludeDomainsstring[]
  • filterstring
  • highlightsboolean

    Return query-relevant highlights for each search result. Set to false to keep the original search snippets.

  • includeDomainsstring[]
  • limitnumber
  • locationstring
  • querystringобязательный
  • scrapeOptionsobject
  • sourcesobject[]
  • tbsstring
firecrawl_search_feedbackвнешний мир

Записывает обратную связь о качестве, прошедшую валидацию по схеме, для ранее выполненного поиска firecrawl_search с UUID searchId. Оценка good требует ценного источника, partial - ценного источника или хотя бы одной записи missingContent, а bad - хотя бы одной записи missingContent или предложения по запросу; лимиты: не более 50 записей в valuableSources и 20 записей в missingContent. Записать обратную связь можно только для успешных поисков в пределах окна давности обратной связи. Запись идемпотентна для каждого идентификатора поиска. Первая подходящая обратная связь для поиска может вернуть 1 кредит; возвраты ограничены дневным лимитом команды. Ответ сообщает, был ли применён возврат, а также статус отправки и статус дневного лимита.

Параметры
  • missingContentobject[]

    Array of specific pieces of content the agent expected to find but did not. One entry per distinct topic. Each entry has a short topic and optional longer description.

  • querySuggestionsstring
  • ratingenumобязательный
  • searchIdstringобязательный
  • valuableSourcesobject[]

Похожие MCP-сервера

mendableai/firecrawl-mcp-server

mendableai/firecrawl-mcp-server

Firecrawl MCP сервер для AI-агентов, которым нужен чистый контекст из живого веба. Ищет информацию, скрапит страницы в структурированные данные, кликает и навигирует. Работает с облаком и сам хостингом, поддерживает автоматические ретраи. Полезен разработчикам для исследований и автоматизации сбо...

JavaScript7431
lyrenth/lyrenth-mcp

lyrenth/lyrenth-mcp

MCP сервер Lyrenth для чтения веб-страниц: превращает HTML в Markdown (AIDocument), экономя токены. Полезен AI-агентам для получения чистого контента без навигации. Поддерживает пакетные запросы до 20 URL и кэширование.

TypeScript1
andyliszewski/webcrawl-mcp

andyliszewski/webcrawl-mcp

MCP сервер для веб-скрапинга, поиска и обхода сайтов без headless-браузера. Использует бесплатные библиотеки (trafilatura) для извлечения контента, с опциональным Fallback на Firecrawl для JS-тяжёл...

Python16
apify/mcp-server-rag-web-browser

apify/mcp-server-rag-web-browser

официальный

MCP сервер подключает AI агентов к вебу через RAG Web Browser Actor. Выполняет поиск в Google, извлекает страницы и возвращает чистый Markdown. Идеально для RAG пайплайнов и LLM, которым нужны свежие данные из интернета.

JavaScript208
Exa MCP Server

Exa MCP Server

официальный

Exa MCP Server даёт AI-ассистентам доступ к веб-поиску, поиску кода и исследованию компаний через Exa. Сервер легко интегрируется в Cursor, VS Code и Claude, предоставляя готовые инструменты для разработчиков. Просто подключите API-ключ и получите актуальные данные.

TypeScript4990
nickclyde/duckduckgo-mcp-server

nickclyde/duckduckgo-mcp-server

MCP сервер для поиска в DuckDuckGo и извлечения содержимого веб-страниц. Поддерживает настройки SafeSearch, региональную фильтрацию и гибкие параметры запросов. Удобный инструмент для LLM-агентов, ...

Python1471
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин