scrapeless-ai/scrapeless-mcp-server

scrapeless-ai/scrapeless-mcp-server

от scrapeless-ai
Scrapeless MCP Server подключает LLM и AI-агентов к вебу: поиск Google, тренды, браузерная автоматизация, скрапинг (HTML, Markdown, скриншоты). Применяется для AI-ассистентов, копилотов и веб-агентов.

preview

Scrapeless MCP Server

Welcome to the official Scrapeless Model Context Protocol (MCP) Server — a powerful integration layer that empowers LLMs, AI Agents, and AI applications to interact with the web in real time.

Built on the open MCP standard, Scrapeless MCP Server seamlessly connects models like ChatGPT, Claude, and tools like Cursor and Windsurf to a wide range of external capabilities, including:

  • Google services integration (Search, Trends)
  • Browser automation for page-level navigation and interaction
  • Scrape dynamic, JS-heavy sites—export as HTML, Markdown, or screenshots

Whether you're building an AI research assistant, a coding copilot, or autonomous web agents, this server provides the dynamic context and real-world data your workflows need—without getting blocked.

Usage Examples

  1. Automated Web Interaction and Data Extraction with Claude

Using Scrapeless MCP Browser, Claude can perform complex tasks such as web navigation, clicking, scrolling, and scraping through conversational commands, with real-time preview of web interaction results via live sessions.

Инструменты были проиндексированы:
ai_scraper

Создаёт задачу AI Scraper для явно указанного актора Scrapeless, затем опрашивает каждые 5 секунд, пока ответ не будет готов или не истечёт тайм-аут. Поддерживает ChatGPT, Gemini, Perplexity, Copilot, Google AI Mode, Google AI Overview, Grok и Alexa. По умолчанию тайм-аут составляет 3 минуты. Тайм-аут можно установить от 60 до 600 секунд. При истечении тайм-аута возвращает task_id и инструкции для ручного получения результата.

Параметры
  • actorenumобязательный

    Scrapeless actor to run. Choose one explicitly: scraper.chatgpt, scraper.gemini, scraper.perplexity, scraper.copilot, scraper.aimode, scraper.overview, scraper.grok, or scraper.alexa.

  • countrystring

    Country or region code used by the actor. Defaults to US.

  • locationstring

    Google canonical location for Google AI Mode or Google AI Overview. Mutually exclusive with uule.

  • modeenum

    Required for scraper.copilot or scraper.grok. Copilot: search, smart, chat, reasoning, study. Grok: MODEL_MODE_FAST, MODEL_MODE_EXPERT, MODEL_MODE_AUTO.

  • promptstringобязательный

    Question or prompt to send to the selected AI Scraper actor.

  • shoppingboolean

    Fetch shopping/product data for scraper.chatgpt, scraper.aimode, or scraper.overview when explicitly provided.

  • timeout_secondsinteger

    Maximum polling time in seconds. Defaults to 180. Minimum is 60 and maximum is 600.

  • uulestring

    Pre-encoded Google UULE for Google AI Mode or Google AI Overview. Mutually exclusive with location.

  • webhookobject

    Optional webhook object passed to the Scrapeless task request.

  • web_searchboolean

    Enable web search for scraper.chatgpt or scraper.perplexity when explicitly provided.

browser_click

Нажми на конкретный элемент на странице. Ограничения: требуется валидный CSS-селектор для целевого элемента. Правильно: нажать на кнопку с селектором "#submit-button". Неправильно: нажать "кнопка входа" без указания селектора.

Параметры
  • selectorstringобязательный

    The CSS selector of the element to click.

  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_close

Закрывает текущую сессию, отключая облачный браузер. Это завершит запись для сессии.

Параметры
  • sessionIdstringобязательный

    The session ID to identify target browser. If not provided or invalid, you cannot close the session.

browser_create

Создаёт или переиспользует сессию облачного браузера с помощью Scrapeless. Обновляет активную сессию.

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, a new session is created.

browser_get_html

Получает полный HTML текущей страницы. Ограничения: возвращает весь исходный HTML-код. Верно: получить HTML текущей страницы, чтобы разобрать её структуру. Неверно: получить только видимый текст (используйте "browser_get_text")

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_get_text

Получить весь видимый текст с текущей страницы. Ограничения: Извлекает только текстовое содержимое, игнорируя HTML-теги. Допустимо: Получить текстовое содержимое текущей страницы для реферирования. Недопустимо: Получить HTML-структуру страницы (используйте "browser_get_html")

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_go_back

Вернуться на один шаг назад в истории браузера. Ограничения: Работает только если в истории сеанса есть предыдущая страница. Допустимо: После перехода со страницы А на страницу В вернуться обратно на А. Недопустимо: Попытка вернуться назад на первой странице сеанса.

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_go_forward

Перейти на один шаг вперед в истории браузера. Ограничения: Работает только после выполнения действия "go_back". Допустимо: После возврата со страницы B на страницу A перейти вперед на страницу B. Недопустимо: Попытка перехода вперед без предшествующего действия "go_back".

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_goto

Перейти в браузере по указанному URL. Ограничения: только для прямого перехода по URL, не для поиска. Верно: перейти на https://google.com. Неверно: искать «cats» в Google (используйте google_search).

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

  • urlstringобязательный

    The URL to navigate to in the browser session.

browser_press_key

Симулировать нажатие клавиши. Ограничения: необходимо указать допустимое имя клавиши; селектор цели необязателен. Допустимо: Нажать Enter в #search. Недопустимо: Нажать клавишу без указания имени клавиши.

Параметры
  • keystringобязательный

    Name of the key to press or a character to generate, such as ArrowLeft or a

  • selectorstring

    The CSS selector of the element to focus.

browser_screenshot

Сделать скриншот текущей страницы. Ограничения: можно сделать скриншот всей страницы или видимой области. Допустимо: сделать скриншот текущего вида браузера. Недопустимо: сделать скриншот конкретного элемента (не поддерживается).

Параметры
  • fullPageboolean

    Whether to screenshot the full page (default: false) You should avoid fullscreen if it's not important, since the images can be quite large

  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_scroll

Прокручивает текущую страницу до определённой позиции. Ограничения: Для прокрутки требуются координаты в пикселях. Допустимо: Прокрутка до низа страницы (например, { x: 0, y: 10000 }). Недопустимо: Прокрутка «вверх» без указания координат.

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_scroll_to

Прокрутить конкретный элемент в область видимости. Ограничения: требуется валидный CSS-селектор для целевого элемента. Допустимо: Прокрутка к элементу "#footer". Недопустимо: Прокрутка вниз страницы (используйте "browser_scroll").

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

  • xnumberобязательный

    X coordinate to scroll to.

  • ynumberобязательный

    Y coordinate to scroll to.

browser_snapshot

Захватывает полную структуру веб-страницы, включая DOM и ресурсы, для инспекции и анализа.

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

browser_type

Вводит текст в указанное поле ввода. Ограничения: требуется CSS-селектор для input/textarea и текст для ввода. Верно: Ввести "hello world" в input "[name='q']". Неверно: Ввести "hello world" без указания целевого поля.

Параметры
  • selectorstringобязательный

    CSS selector for the element to type into.

  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

  • textstringобязательный

    Text to type.

browser_wait

Приостанавливает выполнение на заданное время. Ограничения: Требуется указать длительность в миллисекундах. Следует использовать редко. Допустимо: Подождать 2000 миллисекунд. Недопустимо: Ждать загрузки страницы (используйте "browser_wait_for")

Параметры
  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

  • timeintegerобязательный

    Time to wait in milliseconds (default: 30000).

browser_wait_for

Дождаться появления определённого элемента на странице. Ограничения: Требуется валидный CSS-селектор для ожидаемого элемента. Правильно: Дождаться, когда элемент «#results» станет видимым. Неправильно: Ждать «загрузки результатов» без селектора.

Параметры
  • selectorstringобязательный

    CSS selector of the element to wait for.

  • sessionIdstring

    Optional session ID to use/reuse. If not provided or invalid, the active session is used.

  • timeoutnumber

    Maximum time to wait in milliseconds (default: 30000).

crawl_cancel

Отменяет выполняющуюся задачу обхода по её идентификатору (идентификатору, возвращённому crawl_start). Возвращает статус отмены.

Параметры
  • idstringобязательный

    The crawl job id returned when the job was created.

crawl_result

Получает результат задания краулинга по его идентификатору (идентификатор возвращается функцией crawl_start). Опрашивает статус задания, пока он не достигнет конечного состояния (completed / failed / cancelled) или не истечет тайм-аут. Если тайм-аут истекает до завершения задания, возвращается последний статус вместе с идентификатором задания, чтобы вы могли повторить попытку позже.

Параметры
  • idstringобязательный

    The crawl job id returned when the job was created.

  • pollIntervalnumber

    Interval between status checks in seconds. Defaults to 5 seconds.

  • timeoutnumber

    Maximum time to wait in seconds before returning the latest result. Defaults to 300 (5 minutes).

crawl_start

Запускает асинхронную задачу обхода. Обходит сайт, начиная с базового URL, переходя по ссылкам в соответствии с указанными параметрами, и сохраняет содержимое страниц в различных форматах (markdown, html, links, screenshot и т. д.). Возвращает идентификатор задачи, который можно использовать с crawl_result для получения результатов и с crawl_cancel для отмены задачи. Требуется только 'url'; все остальные параметры необязательны.

Параметры
  • allowBackwardLinksboolean

    Allow the crawler to follow links that are not part of the URL hierarchy you specify.

  • allowExternalLinksboolean

    Allow the crawler to follow links to external websites.

  • browserOptionsobject

    Options that control the underlying scraping browser session.

  • deduplicateSimilarURLsboolean

    Controls whether similar URLs should be deduplicated.

  • delaynumber

    Delay in seconds between scrapes. This helps respect website rate limits.

  • excludePathsstring[]

    URL pathname regex patterns that exclude matching URLs from the crawl.

  • ignoreQueryParametersboolean

    Do not re-scrape the same path with different (or none) query parameters.

  • ignoreSitemapboolean

    Ignore the website sitemap when crawling.

  • includePathsstring[]

    URL pathname regex patterns that include matching URLs in the crawl.

  • limitnumber

    Maximum number of pages to crawl. Default limit is 10000.

  • maxDepthnumber

    Maximum depth to crawl relative to the base URL (max number of slashes in the pathname).

  • maxDiscoveryDepthnumber

    Maximum depth to crawl based on discovery order.

  • regexOnFullURLboolean

    Controls whether the include/exclude regex should be applied to the full URL.

  • scrapeOptionsobject

    Options that control how each page is scraped.

  • urlstringобязательный

    The base URL to start crawling from.

google_search

Universal Information Search Engine. Извлекает любую информацию; пояснительные запросы (почему, как); запросы сравнительного анализа.

Параметры
  • glstring

    Parameter defines the country to use for the Google search. It's a two-letter country code. (e.g., us for the United States, uk for United Kingdom, or fr for France).

  • hlstring

    Parameter defines the language to use for the Google search. It's a two-letter language code. (e.g., en for English, es for Spanish, or fr for French).

  • qstring

    Parameter defines the query you want to search. You can use anything that you would use in a regular Google search. e.g. inurl:, site:, intitle:. We also support advanced search query parameters such as as_dt and as_eq.

google_trends

Получает данные о популярных поисковых запросах из Google Trends. Ограничения: Активен для запросов о трендах, популярности или изменении интереса во времени. Допустимо: Найти интерес к поиску «ИИ» за последний год. Недопустимо: Общий вопрос вроде «Что такое ИИ?» (используйте google_search).

Параметры
  • catstring

    Parameter is used to define a search category. The default value is set to 0 ("All categories").

  • data_typestring

    The supported types are: autocomplete,interest_over_time,compared_breakdown_by_region,interest_by_subregion,related_queries,related_topics.

  • datestring

    The supported dates are: now 1-H, now 4-H, now 1-d, now 7-d, today 1-m, today 3-m, today 12-m, today 5-y, all. You can also pass custom values: Dates from 2004 to present: yyyy-mm-dd yyyy-mm-dd (e.g. 2021-10-15 2022-05-25) Dates with hours within a week range: yyyy-mm-ddThh yyyy-mm-ddThh (e.g. 2022-05-19T10 2022-05-24T22). Hours will be calculated depending on the tz (time zone) parameter.

  • geoenum

    Parameter defines the location from where you want the search to originate. It defaults to Worldwide (activated when the value of geo parameter is not set or empty).

  • hlstring

    Parameter defines the language to use for the Google Trends search. It's a two-letter language code. (e.g., en for English, es for Spanish, or fr for French).

  • qstring

    Parameter defines the query or queries you want to search. You can use anything that you would use in a regular Google Trends search. The maximum number of queries per search is 5 (this only applies to interest_over_time and compared_breakdown_by_region data_type, other types of data will only accept 1 query per search).

  • tzstring

    time zone offset. default is 420.

scrape_html

Извлекает содержимое URL и возвращает полный HTML. Ограничения: Включён для URL, требующих рендеринга JavaScript или защиты от ботов. Допустимо: получать HTML из динамического одностраничного приложения с большим количеством JS. Недопустимо: запрашивать простую статическую страницу (используйте стандартный HTTP-клиент).

Параметры
  • urlstringобязательный

    target URL

scrape_markdown

Извлекает содержимое URL и возвращает его в формате Markdown. Ограничения: лучше всего подходит для статей, записей в блогах и других страниц с большим объёмом текста. Допустимо: извлечь новостную статью, чтобы получить её читаемый контент. Недопустимо: извлекать содержимое сложной панели управления веб-приложения.

Параметры
  • urlstringобязательный

    target URL

scrape_screenshot

Сделать скриншот любой веб-страницы в высоком качестве. Ограничения: обходит обнаружение ботов и CAPTCHA с помощью резидентных прокси. Допустимо: получить скриншот страницы проверки цен, защищённой Cloudflare. Недопустимо: создание скриншота локального браузера (используйте browser_screenshot)

Параметры
  • urlstringобязательный

    target URL

Похожие MCP-сервера

hyperbrowserai/mcp

hyperbrowserai/mcp

MCP сервер Hyperbrowser для скрапинга, краулинга и извлечения структурированных данных. Включает браузерные агенты OpenAI CUA и Claude. Для веб-автоматизации и сбора данных LLM.

TypeScript789
executeautomation/playwright-mcp-server

executeautomation/playwright-mcp-server

Сервер для браузерной автоматизации на Playwright. Используется AI-агентами для открытия страниц, скриншотов, веб-скрапинга и выполнения JavaScript в реальном браузере. Отлично подходит для тестиро...

TypeScript5644
mzxrai/mcp-webresearch

mzxrai/mcp-webresearch

MCP-сервер для веб-исследований, подключающий Claude к интернету: поиск в Google, извлечение содержимого страниц, создание скриншотов и трекинг сессии. Полезен, чтобы получать актуальную информацию...

JavaScript300
Browserbase MCP

Browserbase MCP

официальный

MCP сервер облачной автоматизации браузера Browserbase. Позволяет AI-агентам навигировать по сайтам, извлекать данные и выполнять действия. Полезен для RPA и веб-скрапинга. Доступен self-hosted и hosted.

TypeScript3404
webscraping-ai/webscraping-ai-mcp-server

webscraping-ai/webscraping-ai-mcp-server

официальный

MCP сервер для веб-скрапинга через WebScraping.AI — извлекает текст, HTML и структурированные данные, задаёт вопросы по содержимому страниц. Поддерживает JavaScript-рендеринг, CSS-селекторы, выбор прокси и эмуляцию устройств. Идеален для интеграции с LLM при сборе информации с сайтов.

JavaScript45
urlbox/urlbox-mcp-server

urlbox/urlbox-mcp-server

MCP-сервер для Urlbox Screenshot API: делайте скриншоты, PDF, извлекайте HTML и markdown с любых сайтов. Идеален для AI-ассистентов, чтобы захватывать страницы без рекламы и куки-баннеров.

TypeScript4
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин