marykovziridze/screaming-frog-mcp

marykovziridze/screaming-frog-mcp

от marykovziridze
MCP сервер для headless краулинга Screaming Frog через Claude: отправляйте URL и получайте экспорт CSV без GUI. Исправлены баги оригинала (зависания, проблемы с GUI, опасное удаление). Инструмент для SEO-автоматизации и встраивания краулинга в пайплайны без ручного запуска.

screaming-frog-mcp

MCP server that lets Claude run Screaming Frog SEO Spider headless crawls, export data, and manage crawl storage — without anyone opening the GUI.

Type a URL into Claude. Screaming Frog runs in the background. You get the data back. That's it.

Forked from bzsasson/screaming-frog-mcp v0.1.0 with bug fixes. The original had issues that made it unusable in practice — pipe deadlocks that hung crawls, false GUI detection that blocked everything after the first run, a delete command that could wipe your entire crawl database. All fixed.


What's fixed

Bug Fix
Pipe deadlock stdout/stderr redirected to log files instead of PIPE. Crawls no longer hang when SF produces large output.
GUI detection Uses psutil instead of ps aux. Works on Mac and Windows. Headless CLI processes no longer get mistaken for the GUI.
Stale crawl cleanup SF leaves a temp crawl.seospider file inside its own app bundle when a crawl gets interrupted. Every crawl after that fails. Now auto-cleaned before each run.
Delete safety delete_crawl(".") used to resolve to the root data directory and wipe everything. Fixed.
Export dir leak Failed exports left temp directories on disk. Now cleaned up.
Input validation Stricter character allowlists for CLI arguments and db_id.
Инструменты были проиндексированы:
crawl_site

Запускает фоновый обход Screaming Frog, сохраняющий результаты во внутреннюю базу данных SF. Аргументы: url: URL для обхода (например, https://example.com) config_file: опциональный путь к файлу .seospiderconfig с настройками обхода (включая лимиты) label: опциональная метка для идентификации этого обхода (например, 'freshgovjobs') Возвращает: crawl_id, который нужно передавать в crawl_status для проверки прогресса. Обход выполняется в фоне - используйте crawl_status, чтобы опрашивать статус. Примечание: чтобы ограничить количество обходимых URL, экспортируйте .seospiderconfig из интерфейса SF с нужным лимитом, а затем передайте его через config_file.

Параметры
  • config_filestring | null
  • labelstring | null
  • urlstringобязательный
crawl_status

Проверяет статус выполняющегося или завершённого обхода. Args: crawl_id: crawl_id, возвращаемый crawl_site

Параметры
  • crawl_idstringобязательный
delete_crawl

Удалить обход из внутренней базы данных Screaming Frog, чтобы освободить место на диске. Аргументы: db_id: Идентификатор базы данных из list_crawls ПРЕДУПРЕЖДЕНИЕ: Это действие безвозвратно удаляет данные обхода. Его нельзя отменить.

Параметры
  • db_idstringобязательный
export_crawl

Загружает сохранённый обход из базы данных SF и экспортирует данные в CSV файлы. Аргументы: db_id: Идентификатор базы данных из list_crawls (например, '1234' или идентификатор обхода). export_tabs: Вкладки экспорта, разделённые запятыми (по умолчанию: Internal:All,Response Codes:All,Page Titles:All,Meta Description:All,H1:All,H2:All,Images:All,Canonicals:All,Directives:All). См. ресурс export-reference для всех вариантов. bulk_export: Необязательные типы массового экспорта (например, 'All Inlinks,All Outlinks'). save_report: Необязательные отчёты для сохранения (например, 'Crawl Overview'). Возвращает: export_id и список сгенерированных CSV файлов. Используйте read_crawl_data для их чтения.

Параметры
  • bulk_exportstring | null
  • db_idstringобязательный
  • export_tabsstring | null
  • save_reportstring | null
list_crawls

Вывести список всех обходов, сохранённых во внутренней базе данных Screaming Frog. Возвращает названия обходов, Database IDs и размеры. Используйте Database ID с export_crawl или delete_crawl.

Параметры

Без параметров.

read_crawl_data

Читает CSV данные из экспорта. Используйте после export_crawl. Аргументы: export_id: export_id из export_crawl file: имя CSV файла для чтения (из списка файлов в выводе export_crawl) limit: максимальное количество строк для возврата (по умолчанию 100) offset: количество строк для пропуска (для пагинации) filter_column: необязательное название колонки для фильтрации filter_value: необязательное значение для поиска в колонке фильтра (регистронезависимое вхождение подстроки) Возвращает: CSV данные в виде форматированного текста с заголовками колонок.

Параметры
  • export_idstringобязательный
  • filestringобязательный
  • filter_columnstring | null
  • filter_valuestring | integer | number | null
  • limitinteger
  • offsetinteger
sf_check

Проверяет, установлен ли Screaming Frog SEO Spider и доступен ли CLI. Возвращает информацию о версии и статусе лицензии.

Параметры

Без параметров.

storage_summary

Показывает использование дискового пространства внутреннего хранилища обхода Screaming Frog. Возвращает общий размер и разбивку по каждому обходу для ProjectInstanceData.

Параметры

Без параметров.

Похожие MCP-сервера

SearchAtlas

SearchAtlas

MCP-сервер SearchAtlas предоставляет 500+ инструментов для SEO-автоматизации, PPC и контент-маркетинга. Совместим с любыми MCP-клиентами (Claude, Cursor, VS Code). Помогает маркетологам выполнять з...

HTML2
vdalhambra/siteaudit-mcp

vdalhambra/siteaudit-mcp

MCP сервер для мгновенного SEO, производительности и аудита безопасности сайтов. Интегрируется с AI-агентами (Claude Code, Cursor). Не требует API ключей или настройки. Полезен разработчикам, SEO-специалистам и всем, кто хочет анализировать URL одним запросом.

Python5
krissanders/ai-visibility-mcp

krissanders/ai-visibility-mcp

MCP-сервер для аудита и исправления видимости сайта для AI-поиска. Проверяет robots.txt, схему, ссылки на LLM, настройки Cloudflare и генерирует исправления. Помогает SEO-специалистам и владельцам ...

Python1
Crawleo/Crawleo-MCP

Crawleo/Crawleo-MCP

Crawleo MCP-сервер даёт AI-ассистентам веб-поиск и краулинг в реальном времени: извлекайте данные с любых URL, выбирайте формат (HTML, Markdown, текст), настраивайте страну и устройство. Без хранен...

JavaScript11
lionkiii/google-searchconsole-mcp

lionkiii/google-searchconsole-mcp

Сервер MCP для Google Search Console даёт AI-ассистентам доступ к SEO-аналитике. Проверяйте индексацию URL, находите ключевые слова с высокими показами и низким CTR, сравнивайте периоды. Не требует...

JavaScript6
ahonn/mcp-server-gsc

ahonn/mcp-server-gsc

MCP сервер для работы с Google Search Console: получает до 25 000 строк поисковых данных, фильтрует по регулярным выражениям, автоматически находит Quick Wins. Полезен SEO-специалистам и разработчикам для углубленного анализа производительности сайта.

TypeScript263
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин