lfnovo/content-core

lfnovo/content-core

от lfnovo
MCP сервер Content Core извлекает, обрабатывает и суммаризирует контент из URL, документов и медиафайлов. Полезен разработчикам и ИИ-агентам: интеграция с Claude Desktop, поддержка YouTube, PDF, аудио. Единый API и CLI.

Content Core

License: MIT PyPI version Downloads Downloads GitHub stars GitHub forks GitHub issues Ruff

Extract, process, and summarize content from URLs, files, and text through a unified async Python API, CLI, or MCP server.

Supported Formats

Category Formats
Web URLs, HTML pages, YouTube videos, Reddit posts
Documents PDF, DOCX, PPTX, XLSX, EPUB, Markdown, plain text
Media MP3, WAV, M4A, FLAC, OGG (audio); MP4, AVI, MOV, MKV (video)

Quick Start

pip install content-core
import content_core

result = await content_core.extract_content(url="https://example.com")
print(result.content)

Or with zero install:

uvx content-core extract "https://example.com"

CLI Usage

Content Core provides a unified content-core command with subcommands for extraction, summarization, and MCP server.

Extract
# From a URL
content-core extract "https://example.com"

# From a file
content-core extract document.pdf

# With JSON output
content-core extract document.pdf --format json

# With a specific engine
content-core extract "https://example.com" --engine firecrawl

# From stdin
echo "some text" | content-core extract
Инструменты были проиндексированы:
extract_content

Извлекает содержимое из URL или файла. Для большинства источников (веб-страницы, PDF, документы, транскрипты YouTube) не требуется API-ключ. API-ключ нужен только для транскрипции аудио/видео.

Извлечь содержимое

Параметры
  • enginestring

    Optional extraction engine override, routed by input type. With url: auto, simple, firecrawl, jina, crawl4ai. With file_path: auto, simple, docling — docling requires pip install "content-core[docling]" and fails with a configuration error when the extra is missing, in which case use auto or simple. Any other value is rejected with an error naming the accepted ones.

  • file_pathstring

    Local file path to extract content from

  • formulasboolean

    Enable formula extraction via Docling (requires engine=docling)

  • no_ocrboolean

    Disable OCR in Docling (requires engine=docling)

  • picturesboolean

    Enable image description + chart data extraction via Docling (requires engine=docling)

  • urlstring

    URL to extract content from (web page, YouTube video, PDF link, etc.)

summarize_content

Суммирует содержимое с помощью LLM с опциональным контекстом. Требует настройки OPENAI_API_KEY (или ключа другого LLM-провайдера).

Суммирует содержимое.

Параметры
  • contentstringобязательный

    The text content to summarize

  • contextstring

    Optional context to guide summarization (e.g., "summarize as bullet points")

Похожие MCP-сервера

guimatheus92/mcp-video-analyzer

guimatheus92/mcp-video-analyzer

MCP сервер для анализа видео - извлекает транскрипт, ключевые кадры, метаданные и текст с экрана (OCR) из URL и локальных файлов. Полезен разработчикам и техподдержке для разбора видео с багами, де...

TypeScript60
elevenlabs/elevenlabs-mcp

elevenlabs/elevenlabs-mcp

Официальный MCP-сервер ElevenLabs для синтеза речи, клонирования голосов и транскрибации аудио. Интегрируется с Claude Desktop, Cursor и другими агентами, позволяя генерировать голосовые ответы, создавать звуковые ландшафты и обрабатывать аудиофайлы без переключения контекста.

Python1535
MarkItDown MCP

MarkItDown MCP

официальный

Инструмент для преобразования PDF, Word, Excel, изображений, аудио и других форматов в Markdown. Оптимален для подготовки данных для LLM-пайплайнов. Сохраняет структуру документов (заголовки, списки, таблицы).

Python182416
MKirovBG/scribefy-mcp

MKirovBG/scribefy-mcp

Сервер Scribefy для MCP — извлекает транскрипты YouTube по ссылке прямо в Claude Desktop, Cursor, Windsurf и других AI-клиентах. Также бесплатно ищет видео, получает метаданные и похожие ролики.

JavaScript1
bighippoman/intercept-mcp

bighippoman/intercept-mcp

intercept-mcp — MCP-сервер, дающий AI возможность читать веб-страницы: извлекает чистый markdown из любых URL, обрабатывает Twitter, YouTube, arXiv, PDF, GitHub и другие источники. Использует много...

TypeScript10
SubDownload/subdownload-mcp

SubDownload/subdownload-mcp

MCP сервер SubDownload интегрирует YouTube в ваш AI инструмент. Поиск видео, получение транскриптов (включая AI ASR), сохранение в базу знаний для повторного использования. Полезен разработчикам и ...

JavaScript4
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин