blazickjp/arxiv-mcp-server

blazickjp/arxiv-mcp-server

от blazickjp
MCP-сервер для интеграции arXiv с AI-ассистентами: поиск, загрузка, чтение и локальное хранение научных статей. Полезен исследователям и разработчикам для автоматизации работы с публикациями через ...

PyPI Version PyPI Downloads GitHub Stars GitHub Forks Tests Python Version License smithery badge Install in VS Code Install in VS Code Insiders Add to Kiro Codex Plugin

ArXiv MCP Server

🔍 Enable AI assistants to search and access arXiv papers through a simple MCP interface.

The ArXiv MCP Server provides a bridge between AI assistants and arXiv's research repository through the Model Context Protocol (MCP). It allows AI models to search for papers and access their content in a programmatic way.

🤝 Contribute • 📝 Report Bug

Pulse MCP Badge

✨ Core Features

  • 🔎 Paper Search: Query arXiv papers with filters for date ranges and categories
  • 📄 Paper Access: Download and read paper content
  • 📋 Paper Listing: View all downloaded papers
  • 🗃️ Local Storage: Papers are saved locally for faster access
  • 📝 Prompts: A set of research prompts for paper analysis

🔒 Security

Prompt Injection Risk

Paper content retrieved from arXiv is untrusted external input.

When an AI assistant downloads or reads a paper through this server, the paper's text is passed directly into the model's context. A maliciously crafted paper could embed adversarial instructions designed to hijack the AI's behavior — for example, instructing it to exfiltrate data, invoke other tools with unintended arguments, or override system-level instructions. This is a known class of attack described by OWASP as LLM01: Prompt Injection and by the OWASP Agentic AI framework as AG01: Prompt Injection in LLM-Integrated Systems.

check_alertsтолько чтениевнешний мир

Проверяет все сохранённые отслеживания тем на предмет новых опубликованных статей с момента последней проверки. Если опустить параметр topic, запускаются ВСЕ сохранённые отслеживания и возвращаются новые статьи для каждого. Передача строки topic проверяет только то конкретное отслеживание. После выполнения обновляет отметку времени last_checked каждого отслеживания, так что последующие вызовы возвращают только более новые статьи. Используйте watch_topic для регистрации тем перед вызовом этого инструмента. Возвращает сводку с количеством новых статей и полными метаданными статей по каждой теме.

Проверяет все сохранённые отслеживания тем на предмет новых опубликованных статей с момента последней проверки. Если опустить параметр topic, запускаются ВСЕ сохранённые отслеживания и возвращаются новые статьи для каждого. Передача строки topic проверяет только то конкретное отслеживание. После выполнения обновляет отметку времени last_checked каждого отслеживания, так что последующие вызовы возвращают только более новые статьи. Используйте watch_topic для регистрации тем перед вызовом этого инструмента. Возвращает сводку с количеством новых статей и полными метаданными статей по каждой теме.

Параметры

  • topicstring

    Optional: check only this specific watched topic (must match the topic string used in watch_topic exactly). Omit to check all saved watches.

citation_graphтолько чтениевнешний мир

Возвращает статьи, цитирующие arXiv-статью, и статьи, на которые она ссылается, используя граф цитирования Semantic Scholar.

Возвращает статьи, цитирующие arXiv-статью, и статьи, на которые она ссылается, используя граф цитирования Semantic Scholar.

Параметры

  • paper_idstringобязательный

    arXiv ID (for example: 2401.12345).

download_paperвнешний мир

Скачивает статью с arXiv и возвращает полное содержание текста. Сначала пытается получить HTML-версию для чистого извлечения; если HTML недоступен, переключается на конвертацию PDF. Возвращает содержимое статьи напрямую, чтобы вы могли сразу её прочитать.

Скачивает статью с arXiv и возвращает полное содержание текста. Сначала пытается получить HTML-версию для чистого извлечения; если HTML недоступен, переключается на конвертацию PDF. Возвращает содержимое статьи напрямую, чтобы вы могли сразу её прочитать.

Параметры

  • paper_idstringобязательный

    The arXiv ID of the paper to download (e.g. '2103.12345')

get_abstractтолько чтениевнешний мир

Получает аннотацию и метаданные статьи arXiv по идентификатору, БЕЗ загрузки полного текста. Используйте это перед download_paper, чтобы оценить релевантность и сэкономить токены. Возвращает: заголовок, авторов, аннотацию, категории, дату публикации и ссылку на PDF. Совет по воркфлоу: search_papers -> get_abstract (проверка релевантности) -> download_paper (если нужно) -> read_paper.

Получает аннотацию и метаданные статьи arXiv по идентификатору, БЕЗ загрузки полного текста. Используйте это перед download_paper, чтобы оценить релевантность и сэкономить токены. Возвращает: заголовок, авторов, аннотацию, категории, дату публикации и ссылку на PDF. Совет по воркфлоу: search_papers -> get_abstract (проверка релевантности) -> download_paper (если нужно) -> read_paper.

Параметры

  • paper_idstringобязательный

    The arXiv paper ID (e.g. '2401.12345' or '2404.19756')

list_papersтолько чтение

Выводит список всех статей, которые были загружены и сохранены локально через download_paper. Возвращает только arXiv ID: для доступа к содержимому используйте read_paper. Возвращает пустой список, если ещё не загружено ни одной статьи. Последовательность действий: search_papers -> download_paper -> list_papers -> read_paper.

Выводит список всех статей, которые были загружены и сохранены локально через download_paper. Возвращает только arXiv ID: для доступа к содержимому используйте read_paper. Возвращает пустой список, если ещё не загружено ни одной статьи. Последовательность действий: search_papers -> download_paper -> list_papers -> read_paper.

Параметры

Без параметров.

read_paperтолько чтение

Читает полное текстовое содержимое статьи, ранее загруженной через download_paper. Возвращает статью в формате markdown. Завершится ошибкой с понятным сообщением, если статья еще не загружена: сначала вызовите download_paper. Рабочий процесс: search_papers -> download_paper -> read_paper.

Читает полное текстовое содержимое статьи, ранее загруженной через download_paper. Возвращает статью в формате markdown. Завершится ошибкой с понятным сообщением, если статья еще не загружена: сначала вызовите download_paper. Рабочий процесс: search_papers -> download_paper -> read_paper.

Параметры

  • paper_idstringобязательный

    The arXiv ID of the paper to read

reindex

Перестройте локальный семантический индекс для скачанных статей.

Перестройте локальный семантический индекс для скачанных статей.

Параметры

  • clear_existingboolean

    If true, clear the existing index before rebuilding.

search_papersтолько чтениевнешний мир

Поиск статей на arXiv с расширенными фильтрами и оптимизацией запросов. РЕКОМЕНДАЦИИ ПО ПОСТРОЕНИЮ ЗАПРОСОВ: - Используйте КАВЫЧКИ для точного совпадения: "multi-agent systems", "neural networks", "machine learning" - Объединяйте связанные понятия через OR: "AI agents" OR "software agents" OR "intelligent agents" - Для точности используйте поиск по полям: - ti:"точная фраза заголовка" - поиск только в заголовках - au:"имя автора" - поиск по автору - abs:"ключевое слово" - поиск только в аннотациях - Исключайте лишние результаты через ANDNOT: "machine learning" ANDNOT "survey" - Для лучшего результата берите 2-4 ключевые концепции, а не длинный список ключевых слов РАСШИРЕННЫЕ ШАБЛОНЫ ПОИСКА: - Поле + фраза: ti:"transformer architecture" - статьи с точной фразой в заголовке - Несколько полей: au:"Smith" AND ti:"quantum" - статьи автора Smith по квантам - Исключения: "deep learning" ANDNOT ("survey" OR "review") - убрать обзорные статьи - Широкое + узкое: "artificial intelligence" AND (robotics OR "computer vision") ФИЛЬТРАЦИЯ ПО КАТЕГОРИЯМ (настоятельно рекомендуется для релевантности): Компьютерные науки: - cs.AI: Artificial Intelligence - cs.LG: Machine Learning - cs.CL: Computation and Language (NLP) - cs.CV: Computer Vision - cs.MA: Multi-Agent Systems - cs.RO: Robotics - cs.NE: Neural and Evolutionary Computing - cs.IR: Information Retrieval - cs.HC: Human-Computer Interaction - cs.CR: Cryptography and Security - cs.DB: Databases Статистика и математика: - stat.ML: Machine Learning (Statistics) - stat.AP: Applications - math.OC: Optimization and Control - math.ST: Statistics Theory Физика и прочее: - quant-ph: Quantum Physics - eess.SP: Signal Processing - eess.AS: Audio and Speech Processing - physics.data-an: Data Analysis and Statistics ПРИМЕРЫ ЭФФЕКТИВНЫХ ЗАПРОСОВ: - ti:"reinforcement learning" с категориями: ["cs.LG", "cs.AI"] - статьи по обучению с подкреплением по заголовку - au:"Hinton" AND "deep learning" с категориями: ["cs.LG"] - работы Хинтона по глубокому обучению - "multi-agent" ANDNOT "survey" с категориями: ["cs.MA"] - исключить...

Поиск статей на arXiv с расширенными фильтрами и оптимизацией запросов. РЕКОМЕНДАЦИИ ПО ПОСТРОЕНИЮ ЗАПРОСОВ: - Используйте КАВЫЧКИ для точного совпадения: "multi-agent systems", "neural networks", "machine learning" - Объединяйте связанные понятия через OR: "AI agents" OR "software agents" OR "intelligent agents" - Для точности используйте поиск по полям: - ti:"точная фраза заголовка" - поиск только в заголовках - au:"имя автора" - поиск по автору - abs:"ключевое слово" - поиск только в аннотациях - Исключайте лишние результаты через ANDNOT: "machine learning" ANDNOT "survey" - Для лучшего результата берите 2-4 ключевые концепции, а не длинный список ключевых слов РАСШИРЕННЫЕ ШАБЛОНЫ ПОИСКА: - Поле + фраза: ti:"transformer architecture" - статьи с точной фразой в заголовке - Несколько полей: au:"Smith" AND ti:"quantum" - статьи автора Smith по квантам - Исключения: "deep learning" ANDNOT ("survey" OR "review") - убрать обзорные статьи - Широкое + узкое: "artificial intelligence" AND (robotics OR "computer vision") ФИЛЬТРАЦИЯ ПО КАТЕГОРИЯМ (настоятельно рекомендуется для релевантности): Компьютерные науки: - cs.AI: Artificial Intelligence - cs.LG: Machine Learning - cs.CL: Computation and Language (NLP) - cs.CV: Computer Vision - cs.MA: Multi-Agent Systems - cs.RO: Robotics - cs.NE: Neural and Evolutionary Computing - cs.IR: Information Retrieval - cs.HC: Human-Computer Interaction - cs.CR: Cryptography and Security - cs.DB: Databases Статистика и математика: - stat.ML: Machine Learning (Statistics) - stat.AP: Applications - math.OC: Optimization and Control - math.ST: Statistics Theory Физика и прочее: - quant-ph: Quantum Physics - eess.SP: Signal Processing - eess.AS: Audio and Speech Processing - physics.data-an: Data Analysis and Statistics ПРИМЕРЫ ЭФФЕКТИВНЫХ ЗАПРОСОВ: - ti:"reinforcement learning" с категориями: ["cs.LG", "cs.AI"] - статьи по обучению с подкреплением по заголовку - au:"Hinton" AND "deep learning" с категориями: ["cs.LG"] - работы Хинтона по глубокому обучению - "multi-agent" ANDNOT "survey" с категориями: ["cs.MA"] - исключить...

Параметры

  • querystringобязательный

    Search query using quoted phrases for exact matches (e.g., '"machine learning" OR "deep learning"') or specific technical terms. Avoid overly broad or generic terms.

  • max_resultsinteger

    Maximum number of results to return (default: 10, max: 50). Use 15-20 for comprehensive searches.

  • date_fromstring

    Start date for papers (YYYY-MM-DD format). Use to find recent work, e.g., '2023-01-01' for last 2 years.

  • date_tostring

    End date for papers (YYYY-MM-DD format). Use with date_from to find historical work, e.g., '2020-12-31' for older research.

  • categoriesstring[]

    Strongly recommended: arXiv categories to focus search (e.g., ['cs.AI', 'cs.MA'] for agent research, ['cs.LG'] for ML, ['cs.CL'] for NLP, ['cs.CV'] for vision). Greatly improves relevance.

  • sort_byenum

    Sort results by 'relevance' (most relevant first, default) or 'date' (newest first). Use 'relevance' for focused searches, 'date' for recent developments.

    relevancedate
semantic_searchтолько чтение

Семантический поиск по похожим статьям, которые вы уже загрузили локально через download_paper. Поддерживает запросы в свободной форме (например, 'механизмы внимания для длинных последовательностей') или поиск статей, похожих на заданный paper_id. ВАЖНО: поиск ведётся только по вашей локальной коллекции — вернёт пустой результат, если ещё не было загружено ни одной статьи. Используйте search_papers для поиска статей на arXiv, затем download_paper, чтобы добавить их в локальный индекс перед использованием этого инструмента. Требуются pro-зависимости: uv pip install -e ".[pro]"

Семантический поиск по похожим статьям, которые вы уже загрузили локально через download_paper. Поддерживает запросы в свободной форме (например, 'механизмы внимания для длинных последовательностей') или поиск статей, похожих на заданный paper_id. ВАЖНО: поиск ведётся только по вашей локальной коллекции — вернёт пустой результат, если ещё не было загружено ни одной статьи. Используйте search_papers для поиска статей на arXiv, затем download_paper, чтобы добавить их в локальный индекс перед использованием этого инструмента. Требуются pro-зависимости: uv pip install -e ".[pro]"

Параметры

  • querystring

    Free-text semantic query.

  • paper_idstring

    Find papers semantically similar to this arXiv paper ID.

  • max_resultsinteger

    Maximum number of results to return (default: 10).

watch_topic

Создать или обновить постоянное наблюдение за исследовательской темой. При проверке через check_alerts возвращает только статьи, опубликованные после последней проверки — работает как постоянное оповещение о новых публикациях по теме. Строка темы использует тот же синтаксис запросов, что и search_papers (фразы в кавычках, указатели поля, булевы операторы). Примеры: '"diffusion models" AND ti:"video generation"', 'au:"LeCun" AND cs.LG'. Вызов watch_topic с той же строкой темы обновляет существующее наблюдение, а не создаёт дубликат. Используйте вместе с check_alerts для опроса о новых статьях.

Создать или обновить постоянное наблюдение за исследовательской темой. При проверке через check_alerts возвращает только статьи, опубликованные после последней проверки — работает как постоянное оповещение о новых публикациях по теме. Строка темы использует тот же синтаксис запросов, что и search_papers (фразы в кавычках, указатели поля, булевы операторы). Примеры: '"diffusion models" AND ti:"video generation"', 'au:"LeCun" AND cs.LG'. Вызов watch_topic с той же строкой темы обновляет существующее наблюдение, а не создаёт дубликат. Используйте вместе с check_alerts для опроса о новых статьях.

Параметры

  • topicstringобязательный

    Query string to monitor. Uses arXiv search syntax — quoted phrases for exact matches, field specifiers (ti:, au:, abs:), and boolean operators (AND, OR, ANDNOT). Example: '"reinforcement learning" AND "robotics"'.

  • categoriesstring[]

    Optional arXiv category filter (e.g. ['cs.LG', 'cs.AI']). Narrows results to specific fields.

  • max_resultsinteger

    Maximum papers to return per alert check (default: 10).

Другие проверенные MCP-сервера

mnemox-ai/idea-reality-mcp

mnemox-ai/idea-reality-mcp

официальный

MCP-сервер автоматически проверяет, не сделал ли кто-то уже вашу идею. Сканирует GitHub, Hacker News и другие источники, возвращает оценку реалистичности (0-100) с трендами и советами по пивоту. По...

Python760
zilliztech/mcp-server-milvus

zilliztech/mcp-server-milvus

официальный

MCP-сервер для векторной базы Milvus. Предоставляет LLM-приложениям векторный и гибридный поиск, управление коллекциями, операции с данными. Полезен разработчикам, интегрирующим AI с Claude Desktop...

Python237
Browser MCP

Browser MCP

официальный

Browser MCP автоматизирует браузер через ИИ (VS Code, Claude, Cursor, Windsurf) — локально и приватно, с вашим профилем. Сервер обходит капчи и детекцию ботов, подходит для RPA и тестирования разра...

TypeScript6843
apify/actors-mcp-server

apify/actors-mcp-server

официальный

Apify MCP Server подключает AI-агентов к тысячам готовых парсеров и краулеров из Apify Store - от соцсетей до карт и e-commerce. Поддерживает OAuth, x402 и Skyfire для оплаты без API-токена.

TypeScript2042
crystaldba/postgres-mcp

crystaldba/postgres-mcp

MCP сервер для Postgres, который помогает AI-агентам и разработчикам повышать производительность: диагностика здоровья БД, тюнинг индексов, explain plans и безопасное выполнение SQL. Ускоряет разра...

Python3081
StacklokLabs/mkp

StacklokLabs/mkp

официальный

MKP - MCP-сервер на Go для Kubernetes даёт AI-агентам прямой доступ к API кластера: листинг, apply, exec-команды. Поддерживает рейт-лимитинг и любые CRD. Удобен для автоматизации через LLM.

Go59
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин