talonicdev/talonic-mcp

talonicdev/talonic-mcp

от talonicdev
MCP сервер для извлечения структурированных данных из документов (PDF, сканы, инвойсы) с валидацией по схеме и оценками уверенности. Полезен разработчикам и AI-агентам, работающим с реальными документами в сложных процессах.

@talonic/mcp

Official Talonic MCP server. Give any AI agent the ability to extract structured, schema-validated data from any document — PDFs, scans, invoices, contracts, forms — via the Model Context Protocol.

talonic-mcp MCP server smithery badge

Status: stable, listed on the official MCP Registry as io.github.talonicdev/talonic-mcp. Nine tools and two resources, verified end-to-end against production (including the Claude.ai hosted connector). Runs as a local stdio process for desktop/IDE clients and as a hosted Streamable HTTP server at mcp.talonic.com for Claude.ai connectors.


What you get

One install gives an agent the whole document-extraction workflow:

Tool What it does
talonic_extract Extract schema-validated JSON from a document, with per-field confidence scores. The primary tool.
talonic_request_upload Get a browser upload link for files too large to pass through a hosted connector (e.g. Claude.ai). The robust path for real-world documents.
talonic_to_markdown OCR a document to clean markdown.
talonic_search Omnisearch across documents, fields, sources, and schemas.
talonic_filter Filter documents by extracted field values (eq, gt, between, contains, …).
talonic_get_document Fetch a document's metadata, processing status, and links.
talonic_list_schemas List saved schemas (with definitions).
talonic_save_schema Save a reusable schema to the workspace.
talonic_get_balance Read credit balance, EUR value, burn rate, and runway for budget-aware behaviour.
talonic_extractвнешний мир

Превращает ЛЮБОЙ документ в структурированный JSON, прошедший проверку схемы. Инструмент по умолчанию, когда нужно извлечь данные ИЗ неструктурированного файла: PDF, скан, изображение, DOCX, письмо или фото. Возвращает запрошенные поля с оценками уверенности для каждого поля. ИСПОЛЬЗОВАТЬ КОГДА: 'извлечь данные из этого документа', 'превратить этот PDF в JSON', 'вытащить поля из этого файла', 'распарсить этот скан / форму / выписку / чек / отчёт' - для ЛЮБОГО типа документов, обычных (счёт, договор) или необычных. Если задача - неструктурированный документ -> структурированные данные, это ответ. НЕ ДЛЯ: полный обычный текст (используйте talonic_to_markdown) · поиск документов (используйте talonic_search / talonic_filter). ПО ИМЕНИ: если пользователь называет файл, сначала вызовите talonic_search, чтобы получить его document_id, затем вызовите этот инструмент. АРГУМЕНТЫ: определите нужные поля с помощью встроенной `schema` (JSON Schema, например {type:'object',properties:{vendor_name:{type:'string'}}}) ИЛИ сохранённого `schema_id`, но не одновременно. Ещё не знаете поля? Установите `auto_schema:true`, чтобы Talonic обнаружил их (открытый захват) и вернул предлагаемую схему, которую можно доработать. Укажите РОВНО ОДИН источник документа: `document_id` (самый дешёвый, документ рабочей области), `file_url` (публичный URL) или `file_data`+`filename` (только небольшие локальные файлы). СТОИМОСТЬ: дёшево за вызов, есть бесплатный тариф - можно свободно использовать; проверяйте бюджет через talonic_get_balance. ВОЗВРАЩАЕТ: данные (JSON), confidence.overall и confidence.fields (значения ниже 0.7 считайте требующими проверки), метаданные документа, extraction_id.

Extract Data from Document

Превращает ЛЮБОЙ документ в структурированный JSON, прошедший проверку схемы. Инструмент по умолчанию, когда нужно извлечь данные ИЗ неструктурированного файла: PDF, скан, изображение, DOCX, письмо или фото. Возвращает запрошенные поля с оценками уверенности для каждого поля. ИСПОЛЬЗОВАТЬ КОГДА: 'извлечь данные из этого документа', 'превратить этот PDF в JSON', 'вытащить поля из этого файла', 'распарсить этот скан / форму / выписку / чек / отчёт' - для ЛЮБОГО типа документов, обычных (счёт, договор) или необычных. Если задача - неструктурированный документ -> структурированные данные, это ответ. НЕ ДЛЯ: полный обычный текст (используйте talonic_to_markdown) · поиск документов (используйте talonic_search / talonic_filter). ПО ИМЕНИ: если пользователь называет файл, сначала вызовите talonic_search, чтобы получить его document_id, затем вызовите этот инструмент. АРГУМЕНТЫ: определите нужные поля с помощью встроенной `schema` (JSON Schema, например {type:'object',properties:{vendor_name:{type:'string'}}}) ИЛИ сохранённого `schema_id`, но не одновременно. Ещё не знаете поля? Установите `auto_schema:true`, чтобы Talonic обнаружил их (открытый захват) и вернул предлагаемую схему, которую можно доработать. Укажите РОВНО ОДИН источник документа: `document_id` (самый дешёвый, документ рабочей области), `file_url` (публичный URL) или `file_data`+`filename` (только небольшие локальные файлы). СТОИМОСТЬ: дёшево за вызов, есть бесплатный тариф - можно свободно использовать; проверяйте бюджет через talonic_get_balance. ВОЗВРАЩАЕТ: данные (JSON), confidence.overall и confidence.fields (значения ниже 0.7 считайте требующими проверки), метаданные документа, extraction_id.

Параметры

  • file_datastring

    Base64-encoded file bytes. Recommended path when the agent already has the file in memory (e.g., the user attached a PDF to the conversation). Pair with `filename` so MIME type can be inferred. Works regardless of where the file lives on disk.

  • filenamestring

    Original filename including extension, e.g. 'invoice.pdf'. Used to infer MIME type when uploading via `file_data`. Required when `file_data` is provided.

  • file_pathstring

    Local path to a document file. Only works if the MCP server has read access to that path. In sandboxed chat clients (Claude Desktop, Cowork) where uploads land in a host-owned directory, use `file_data` instead.

  • file_urlstring

    URL to a document file. The Talonic API fetches it server-side. Use this for documents already on the public web.

  • document_idstring

    ID of a document already in the workspace, to re-extract with a new schema.

  • schemaobject

    Inline schema definition. REQUIRED unless `schema_id` is provided. Recommended: full JSON Schema {type:'object', properties:{...}}. Also accepted: flat key-type map {field_name:'string', amount:'number'}. Mutually exclusive with `schema_id`.

  • schema_idstring

    ID of a saved schema. REQUIRED unless `schema` is provided. Accepts UUID or SCH-XXXXXXXX short id from talonic_list_schemas. Mutually exclusive with `schema`.

  • auto_schemaboolean

    Open capture: when true, extract WITHOUT providing a schema — Talonic discovers the document's fields and returns them plus a suggested schema you can refine and reuse. Use this when you don't yet know the fields. Mutually exclusive with `schema` and `schema_id`.

  • instructionsstring

    Natural-language guidance for the extractor, e.g. 'Focus on the billing section. Amounts are in EUR.'

  • include_markdownboolean

    Include OCR-converted markdown in the response alongside structured data.

  • include_provenanceboolean

    Include per-field provenance (source_text, section, page) showing where each value was found in the document.

talonic_filterтолько чтение

Находит документы по значениям извлечённых полей с помощью составляемых условий (например, «счета, где total > 1000»). ИСПОЛЬЗУЙ, КОГДА: нужны условия на основе значений извлечённых полей — сравнения чисел/дат/текста или проверки наличия. НЕ ДЛЯ: полнотекстового / смыслового поиска (используй talonic_search) · поиска одного документа по id (используй talonic_get_document). АРГУМЕНТЫ: conditions[] (AND-логика). Каждый = РОВНО ОДИН из `field` (каноническое имя) или `field_id` (UUID), `operator` и обычно `value`. Операторы: eq, neq, gt, gte, lt, lte, between (требует `value` И `value_to`), contains, is_empty / is_not_empty (без value). `value`/`value_to` — string|number|boolean в соответствии с типом поля (для дат — ISO YYYY-MM-DD). ТЕКСТОВЫЕ ФИЛЬТРЫ: для eq/contains/is_not_empty по текстовому полю просто ПОПРОБУЙ естественное имя поля ('currency', 'vendor_name') — имена разрешаются на сервере, и неразрешённое поле попадает в warnings[], а не в ошибку. НЕ блокируйся на предварительном определении поля; search-first требуется только для числовых операторов. ЧИСЛОВАЯ ЗАЩИТА: gt/gte/lt/lte/between работают только если dataType поля равен 'number'. Сначала вызови talonic_search и проверь dataType; числовая операция над строковым полем возвращает ноль совпадений. Если в ответе есть `warnings[]`, покажи их пользователю — не делай повторных попыток молча. ВОЗВРАЩАЕТ: data[] (подходящие документы со значениями полей), total, warnings[].

Filter Talonic Documents

Находит документы по значениям извлечённых полей с помощью составляемых условий (например, «счета, где total > 1000»). ИСПОЛЬЗУЙ, КОГДА: нужны условия на основе значений извлечённых полей — сравнения чисел/дат/текста или проверки наличия. НЕ ДЛЯ: полнотекстового / смыслового поиска (используй talonic_search) · поиска одного документа по id (используй talonic_get_document). АРГУМЕНТЫ: conditions[] (AND-логика). Каждый = РОВНО ОДИН из `field` (каноническое имя) или `field_id` (UUID), `operator` и обычно `value`. Операторы: eq, neq, gt, gte, lt, lte, between (требует `value` И `value_to`), contains, is_empty / is_not_empty (без value). `value`/`value_to` — string|number|boolean в соответствии с типом поля (для дат — ISO YYYY-MM-DD). ТЕКСТОВЫЕ ФИЛЬТРЫ: для eq/contains/is_not_empty по текстовому полю просто ПОПРОБУЙ естественное имя поля ('currency', 'vendor_name') — имена разрешаются на сервере, и неразрешённое поле попадает в warnings[], а не в ошибку. НЕ блокируйся на предварительном определении поля; search-first требуется только для числовых операторов. ЧИСЛОВАЯ ЗАЩИТА: gt/gte/lt/lte/between работают только если dataType поля равен 'number'. Сначала вызови talonic_search и проверь dataType; числовая операция над строковым полем возвращает ноль совпадений. Если в ответе есть `warnings[]`, покажи их пользователю — не делай повторных попыток молча. ВОЗВРАЩАЕТ: data[] (подходящие документы со значениями полей), total, warnings[].

Параметры

  • conditionsobject[]обязательный

    One or more filter conditions, AND-ed together.

  • searchstring

    Optional free-text search applied alongside the filters.

  • sortobject

    Optional sort by a field.

  • pageinteger

    Page number for pagination.

  • limitinteger

    Results per page. Default 50 server-side.

  • source_connection_idstring

    Optionally scope to a specific source connection.

talonic_get_balanceтолько чтение

Читает баланс кредитов Talonic рабочего пространства, его стоимость в евро, тариф, расход за 30 дней и прогнозируемый остаток работы. ИСПОЛЬЗУЙТЕ КОГДА: пользователь спрашивает о кредитах/бюджете, или перед большой пакетной обработкой, когда нужно подтвердить наличие запаса. НЕ ДЛЯ: стоимости одного вызова извлечения (она возвращается в ответе talonic_extract). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: balance_credits, balance_eur, tier, burn_rate_30d_credits, projected_runway_days (-1 = недавнего использования нет), tier_resets_at.

Get Talonic Credit Balance

Читает баланс кредитов Talonic рабочего пространства, его стоимость в евро, тариф, расход за 30 дней и прогнозируемый остаток работы. ИСПОЛЬЗУЙТЕ КОГДА: пользователь спрашивает о кредитах/бюджете, или перед большой пакетной обработкой, когда нужно подтвердить наличие запаса. НЕ ДЛЯ: стоимости одного вызова извлечения (она возвращается в ответе talonic_extract). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: balance_credits, balance_eur, tier, burn_rate_30d_credits, projected_runway_days (-1 = недавнего использования нет), tier_resets_at.

Параметры

Без параметров.

talonic_get_documentтолько чтение

Получает метаданные и статус обработки одного документа из рабочего пространства. ИСПОЛЬЗОВАТЬ КОГДА: «расскажи о документе X» или для проверки статуса после talonic_request_upload, пока файл не будет готов. НЕ ДЛЯ: полного текста (используй talonic_to_markdown) · извлечённых полей (используй talonic_extract). ПО ИМЕНИ: если пользователь называет файл, сначала вызови talonic_search, чтобы получить его document_id, затем вызывай это. АРГУМЕНТЫ: document_id. ВОЗВРАЩАЕТ: filename, pages, type_detected, language и `status`. Жизненный цикл статуса: pending_upload -> queued -> extracting -> completed. Дождись `completed` перед вызовом talonic_extract для только что загруженного документа. Чтобы прочитать текст документа, вызови talonic_to_markdown с этим id.

Get Talonic Document

Получает метаданные и статус обработки одного документа из рабочего пространства. ИСПОЛЬЗОВАТЬ КОГДА: «расскажи о документе X» или для проверки статуса после talonic_request_upload, пока файл не будет готов. НЕ ДЛЯ: полного текста (используй talonic_to_markdown) · извлечённых полей (используй talonic_extract). ПО ИМЕНИ: если пользователь называет файл, сначала вызови talonic_search, чтобы получить его document_id, затем вызывай это. АРГУМЕНТЫ: document_id. ВОЗВРАЩАЕТ: filename, pages, type_detected, language и `status`. Жизненный цикл статуса: pending_upload -> queued -> extracting -> completed. Дождись `completed` перед вызовом talonic_extract для только что загруженного документа. Чтобы прочитать текст документа, вызови talonic_to_markdown с этим id.

Параметры

  • document_idstringобязательный

    The Talonic document ID. Get this from a previous talonic_extract or talonic_search response.

talonic_get_pricingтолько чтение

Читает машиночитаемый каталог цен на кредиты Talonic: фиксированные ставки за единицу, чтобы вы могли предсказать расходы ДО запуска чего-либо. ИСПОЛЬЗУЙТЕ КОГДА: оцениваете стоимость запланированной задачи по извлечению/структурированию/сопоставлению или отвечаете на вопрос о цене. Публичный - работает без траты кредитов. НЕ ДЛЯ: текущего баланса рабочего пространства (используйте talonic_get_balance) или того, что оно уже потратило (используйте talonic_get_usage). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: currency, credits_per_eur, multipliers (например, batch 0.5x) и units[] - каждый { unit, label, credits, eur, free }.

Get Talonic Pricing

Читает машиночитаемый каталог цен на кредиты Talonic: фиксированные ставки за единицу, чтобы вы могли предсказать расходы ДО запуска чего-либо. ИСПОЛЬЗУЙТЕ КОГДА: оцениваете стоимость запланированной задачи по извлечению/структурированию/сопоставлению или отвечаете на вопрос о цене. Публичный - работает без траты кредитов. НЕ ДЛЯ: текущего баланса рабочего пространства (используйте talonic_get_balance) или того, что оно уже потратило (используйте talonic_get_usage). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: currency, credits_per_eur, multipliers (например, batch 0.5x) и units[] - каждый { unit, label, credits, eur, free }.

Параметры

Без параметров.

talonic_get_usageтолько чтение

Читает потребление кредитов по функциям рабочего пространства за скользящее окно: куда на самом деле ушли кредиты. ИСПОЛЬЗОВАТЬ КОГДА: пользователь спрашивает, на что он потратил кредиты, или вы хотите увидеть, какая функция (извлечение, структурирование, интеллектуальные операции) доминирует в затратах. НЕ ДЛЯ: остатка на балансе (используйте talonic_get_balance) или тарифов за единицу (используйте talonic_get_pricing). ПАРАМЕТРЫ: days (необязательный, по умолчанию 30, ограничение 1-365). ВОЗВРАЩАЕТ: period_days, total_credits и by_function[] - каждый { operation_type, operations, credits }, сначала наибольшие затраты.

Get Talonic Usage

Читает потребление кредитов по функциям рабочего пространства за скользящее окно: куда на самом деле ушли кредиты. ИСПОЛЬЗОВАТЬ КОГДА: пользователь спрашивает, на что он потратил кредиты, или вы хотите увидеть, какая функция (извлечение, структурирование, интеллектуальные операции) доминирует в затратах. НЕ ДЛЯ: остатка на балансе (используйте talonic_get_balance) или тарифов за единицу (используйте talonic_get_pricing). ПАРАМЕТРЫ: days (необязательный, по умолчанию 30, ограничение 1-365). ВОЗВРАЩАЕТ: period_days, total_credits и by_function[] - каждый { operation_type, operations, credits }, сначала наибольшие затраты.

Параметры

  • daysinteger

    Trailing window in days (default 30).

talonic_list_schemasтолько чтение

Перечисляет сохранённые схемы в рабочем пространстве в виде компактных сводок (id, short_id, name, description, version, field_count). ИСПОЛЬЗУЕТСЯ КОГДА: «what schemas do I have» или для поиска переиспользуемой схемы перед извлечением. НЕ ДЛЯ: одноразового извлечения со встроенной схемой (вызывайте talonic_extract напрямую). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: data[] со сводками схем. Полные определения полей здесь опущены — для их получения прочитайте ресурс talonic://schemas. Передавайте id/short_id схемы в talonic_extract как `schema_id`.

List Talonic Schemas

Перечисляет сохранённые схемы в рабочем пространстве в виде компактных сводок (id, short_id, name, description, version, field_count). ИСПОЛЬЗУЕТСЯ КОГДА: «what schemas do I have» или для поиска переиспользуемой схемы перед извлечением. НЕ ДЛЯ: одноразового извлечения со встроенной схемой (вызывайте talonic_extract напрямую). АРГУМЕНТЫ: нет. ВОЗВРАЩАЕТ: data[] со сводками схем. Полные определения полей здесь опущены — для их получения прочитайте ресурс talonic://schemas. Передавайте id/short_id схемы в talonic_extract как `schema_id`.

Параметры

Без параметров.

talonic_request_upload

Получает ссылку для загрузки в браузере, которую пользователь открывает, чтобы добавить файл в свою рабочую область. Возвращает ссылку и предварительно выделенный document_id. КОГДА ИСПОЛЬЗОВАТЬ: пользователь хочет загрузить документ, и вы не можете передать его напрямую: размещённые/песочные клиенты (ChatGPT, Claude.ai) или файлы слишком велики для аргументов вызова инструмента. НЕ ДЛЯ: документа, уже находящегося в рабочей области (используйте его document_id); файла, уже находящегося по публичному URL (используйте file_url в talonic_extract). АРГУМЕНТЫ: имя файла (с расширением). ВОЗВРАЩАЕТ: upload_url, document_id, expires_at. После загрузки пользователем опрашивайте talonic_get_document с этим document_id, пока статус не станет 'completed', затем вызовите talonic_extract.

Request File Upload

Получает ссылку для загрузки в браузере, которую пользователь открывает, чтобы добавить файл в свою рабочую область. Возвращает ссылку и предварительно выделенный document_id. КОГДА ИСПОЛЬЗОВАТЬ: пользователь хочет загрузить документ, и вы не можете передать его напрямую: размещённые/песочные клиенты (ChatGPT, Claude.ai) или файлы слишком велики для аргументов вызова инструмента. НЕ ДЛЯ: документа, уже находящегося в рабочей области (используйте его document_id); файла, уже находящегося по публичному URL (используйте file_url в talonic_extract). АРГУМЕНТЫ: имя файла (с расширением). ВОЗВРАЩАЕТ: upload_url, document_id, expires_at. После загрузки пользователем опрашивайте talonic_get_document с этим document_id, пока статус не станет 'completed', затем вызовите talonic_extract.

Параметры

  • filenamestringобязательный

    The name of the file being uploaded, including extension (e.g. 'invoice.pdf'). Used to pre-allocate the document and infer MIME type.

talonic_save_schema

Сохраняет повторно используемую схему в рабочую область для применения в будущих извлечениях. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь подтверждает схему/шаблон, который хочет повторно использовать в разных документах. НЕ ДЛЯ: однократного извлечения (передайте схему напрямую в talonic_extract). АРГУМЕНТЫ: `name`; `definition` — JSON-схема ({type:'object',properties:{...}}) или плоская map {field:'type'}. ВОЗВРАЩАЕТ: сохранённую схему с id и short_id. Передайте любой из них в talonic_extract как `schema_id`.

Save Talonic Schema

Сохраняет повторно используемую схему в рабочую область для применения в будущих извлечениях. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь подтверждает схему/шаблон, который хочет повторно использовать в разных документах. НЕ ДЛЯ: однократного извлечения (передайте схему напрямую в talonic_extract). АРГУМЕНТЫ: `name`; `definition` — JSON-схема ({type:'object',properties:{...}}) или плоская map {field:'type'}. ВОЗВРАЩАЕТ: сохранённую схему с id и short_id. Передайте любой из них в talonic_extract как `schema_id`.

Параметры

  • namestringобязательный

    Human-readable name for the schema, e.g. 'Standard Invoice'.

  • definitionobjectобязательный

    Schema definition. Most reliable: full JSON Schema {type:'object', properties:{...}}. Also accepted: a flat key-type map {field_name:'string', amount:'number'} which the API normalises.

  • descriptionstring

    Optional description of what this schema extracts and when to use it.

talonic_searchтолько чтение

Находит документы, поля, схемы или источники в рабочем пространстве. Один вызов возвращает ранжированные результаты по всем типам. ПОИСК ИДЁТ ПО ТОЧНОМУ КЛЮЧЕВОМУ СЛОВУ, а не по смыслу. Запрашивайте ОДНИМ коротким термином в единственном числе или точным именем файла: 'invoice', 'bank statement', 'sample-invoice.pdf'. Предложения ('documents related to invoices') и множественное число ('invoices') возвращают пустой результат. Если поиск ничего не дал, повторите с более коротким ключевым словом в единственном числе, прежде чем делать вывод, что в рабочем пространстве ничего нет. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь называет или описывает документ без идентификатора, или вам нужен document_id или имя фильтруемого поля перед вызовом extract / to_markdown / get_document / filter. НЕ ДЛЯ: структурированных фильтров вида «поле-значение» (например, 'amount > 1000' — для них используйте talonic_filter). АРГУМЕНТЫ: query (короткое точное ключевое слово); опционально limit. ВОЗВРАЩАЕТ: documents[], fields[]/fieldMatches[] (только записи с `filterable: true` работают в talonic_filter), schemas[], sources[]. Используйте id из documents[], чтобы работать с именованным файлом.

Search Talonic Workspace

Находит документы, поля, схемы или источники в рабочем пространстве. Один вызов возвращает ранжированные результаты по всем типам. ПОИСК ИДЁТ ПО ТОЧНОМУ КЛЮЧЕВОМУ СЛОВУ, а не по смыслу. Запрашивайте ОДНИМ коротким термином в единственном числе или точным именем файла: 'invoice', 'bank statement', 'sample-invoice.pdf'. Предложения ('documents related to invoices') и множественное число ('invoices') возвращают пустой результат. Если поиск ничего не дал, повторите с более коротким ключевым словом в единственном числе, прежде чем делать вывод, что в рабочем пространстве ничего нет. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь называет или описывает документ без идентификатора, или вам нужен document_id или имя фильтруемого поля перед вызовом extract / to_markdown / get_document / filter. НЕ ДЛЯ: структурированных фильтров вида «поле-значение» (например, 'amount > 1000' — для них используйте talonic_filter). АРГУМЕНТЫ: query (короткое точное ключевое слово); опционально limit. ВОЗВРАЩАЕТ: documents[], fields[]/fieldMatches[] (только записи с `filterable: true` работают в talonic_filter), schemas[], sources[]. Используйте id из documents[], чтобы работать с именованным файлом.

Параметры

  • querystringобязательный

    ONE short, SINGULAR keyword or an exact filename — 'invoice', 'insurance certificate', 'sample-invoice.pdf'. Matching is literal: sentences and plurals return empty.

  • limitinteger

    Maximum results per entity type. Default: 5. Increase for broader exploration.

talonic_to_markdownвнешний мир

Получает текст документа в Markdown, преобразованный с помощью OCR. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь хочет получить полный текст - 'что здесь написано', краткое содержание или перевод документа. НЕ ДЛЯ: конкретных структурированных полей (используйте talonic_extract со схемой). ПО ИМЕНИ: если пользователь указывает имя файла, сначала вызовите talonic_search, чтобы получить его document_id, затем вызовите этот. АРГУМЕНТЫ: предпочтительнее `document_id` (документ из рабочего пространства - один дешёвый вызов). В противном случае `file_url`, или `file_data`+`filename` для небольших локальных файлов - укажите ровно один. Ввод файла сначала загружает документ и расходует кредиты; `document_id` не расходует. ВОЗВРАЩАЕТ: document_id и markdown (полный текст).

Document to Markdown

Получает текст документа в Markdown, преобразованный с помощью OCR. ИСПОЛЬЗУЙТЕ, КОГДА: пользователь хочет получить полный текст - 'что здесь написано', краткое содержание или перевод документа. НЕ ДЛЯ: конкретных структурированных полей (используйте talonic_extract со схемой). ПО ИМЕНИ: если пользователь указывает имя файла, сначала вызовите talonic_search, чтобы получить его document_id, затем вызовите этот. АРГУМЕНТЫ: предпочтительнее `document_id` (документ из рабочего пространства - один дешёвый вызов). В противном случае `file_url`, или `file_data`+`filename` для небольших локальных файлов - укажите ровно один. Ввод файла сначала загружает документ и расходует кредиты; `document_id` не расходует. ВОЗВРАЩАЕТ: document_id и markdown (полный текст).

Параметры

  • document_idstring

    The Talonic document id whose markdown you want. Get this from a previous talonic_extract or talonic_search response.

  • file_datastring

    Base64-encoded file bytes. Recommended path when the agent already has the file in memory (e.g., the user attached a PDF to the conversation). Pair with `filename` so MIME type can be inferred.

  • filenamestring

    Original filename including extension, e.g. 'invoice.pdf'. Used to infer MIME type when uploading via `file_data`. Required when `file_data` is provided.

  • file_pathstring

    Local path to a document file. Only works if the MCP server has read access to that path. In sandboxed chat clients (Claude Desktop, Cowork) use `file_data` instead.

  • file_urlstring

    URL to a document file. The Talonic API fetches it server-side.

Другие проверенные MCP-сервера

Timeweb MCP

Timeweb MCP

официальный

MCP сервер для автоматизации деплоя приложений в Timeweb Cloud. Создавайте приложения, базы данных, VPC и floating IP прямо из чата. Сервер сам определяет параметры проекта и фреймворк. Идеально для быстрого развертывания в облаке.

TypeScript25
steipete/peekaboo

steipete/peekaboo

MCP сервер для macOS с захватом экрана, AI-анализом и автоматизацией GUI: клики, ввод, скроллинг, горячие клавиши. Требует разрешений на запись экрана и доступность. Полезен разработчикам и тестировщикам.

Swift4879
Exa MCP Server

Exa MCP Server

официальный

Exa MCP Server даёт AI-ассистентам доступ к веб-поиску, поиску кода и исследованию компаний через Exa. Сервер легко интегрируется в Cursor, VS Code и Claude, предоставляя готовые инструменты для разработчиков. Просто подключите API-ключ и получите актуальные данные.

TypeScript4742
pipeboard-co/meta-ads-mcp

pipeboard-co/meta-ads-mcp

Meta Ads MCP позволяет AI-ассистентам управлять рекламными кампаниями на Facebook и Instagram: запускать кампании, загружать креативы, менять бюджеты и анализировать эффективность через обычный диа...

Python1087
googleapis/genai-toolbox

googleapis/genai-toolbox

официальный

MCP Toolbox for Databases - открытый MCP сервер для AI-агентов и IDE, подключающий к базам данных. Содержит готовые инструменты и фреймворк для кастомных инструментов с аутентификацией и мониторингом. Упрощает работу с данными.

Go15979
benborla29/mcp-server-mysql

benborla29/mcp-server-mysql

MCP сервер для работы с MySQL: инспектируйте схемы, выполняйте запросы и опционально записывайте данные прямо из Claude и других LLM. Предусмотрена защита PII, SSH-туннели и режим работы с несколькими базами. Полезен разработчикам и аналитикам.

JavaScript1959
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин