AetherWave-Studio/aetherwave-mcp

AetherWave-Studio/aetherwave-mcp

от aetherwave-studio
MCP сервер AetherWave Studio объединяет 16+ инструментов генерации контента: изображения, видео, музыка, мастеринг. Один API-ключ и пул кредитов дают доступ к Suno, Grok, Midjourney, Topaz. Интегри...

@aetherwave-studio/mcp

aetherwave-mcp MCP server

aetherwave-mcp MCP server

Model Context Protocol server for AetherWave Studio. Drop it into any MCP-compatible client (Claude Code, Cursor, Continue, Claude Desktop, custom agents) and your LLM can generate, edit, upscale, reframe, and master across every flagship creative AI provider through one API key, one credit pool.

One install. One token. Sixteen tools covering:

  • Music - Suno V3.5 / V4 / V4.5 / V5 / V5.5
  • Image gen - Grok Imagine, GPT Image 2, Seedream V4, Wan 2.7, Imagen 4, Nano Banana, Ideogram V3, Z-Image Turbo
  • Image edit - Grok Imagine I2I, Seedream V4 Edit, Flux Kontext, Wan 2.5 Spicy, Qwen Edit, Midjourney I2I, GPT Image 1.5
  • Image utility - Topaz upscale, Recraft background removal (with fal BiRefNet v2 fallback), Ideogram V3 Reframe
  • Video - Grok Imagine (KIE+fal fallback), Wan 2.7, Hailuo 02, Seedance Pro/Lite, Kling 2.6 (audio), VEO 3.1, Happy Horse
  • Video utility - Atlas upscaler (1080p/2K), rembg u2netp background removal, Luma Ray 2 Flash reframe
  • Audio mastering - 12 genre/style presets via the AetherWave Python service
  • Gallery read - paginated list of your saved creations
Инструменты были проиндексированы:
aetherwave_balanceтолько чтениевнешний мир

Возвращает текущий баланс кредитов AetherWave для API-ключа. Используйте это ДО генерации, чтобы убедиться в достаточном количестве кредитов — особенно для видео, которое может стоить 30-300+ кредитов в зависимости от модели/длительности/разрешения.

Проверить баланс кредитов

Параметры

Без параметров.

aetherwave_edit_imageвнешний мир

Редактирует существующее изображение по текстовой подсказке. Передайте публичный imageUrl и prompt с описанием изменения ("добавь луну в небо", "замени фон на неоновый город", "сделай как панель из комикса"). Отправляет, опрашивает и возвращает URL(ы) отредактированного изображения. Модель по умолчанию — 'grok-imagine-i2i' (6 cr за вызов, возвращает 2 варианта, ~30 с, лучшее соотношение цены и качества для стандартных правок). Другие модели с I2I: 'seedream-v4-edit', 'wan-2.5-spicy-i2i', 'flux-kontext-pro', 'qwen-image-edit', 'gpt-image-1.5-i2i' (медленный, ~5 мин). Полный список моделей — в list_image_models. Важно: URL-адреса с пробелами или скобками могут не сработать; используйте чистые URL. ## Руководство по выбору модели для правок По умолчанию: grok-imagine-i2i (6 cr за вызов, возвращает 2 варианта = эффективно 3 cr за изображение, быстро ~30 с, хорошее качество правок общего назначения). Выбирайте другую модель, когда: - Нужен единственный детерминированный результат или разрешение 4K -> seedream-v4-edit (7 cr за изображение, поддерживает 1K/2K/4K, до 6 изображений) - Тонкие правки / сохранение композиции / согласованность персонажей -> flux-kontext-pro или flux-kontext-max - NSFW-правки -> wan-2.5-spicy-i2i - Максимальное качество, время не важно (~5 мин подходит) -> gpt-image-1.5-i2i или grok-imagine-quality-i2i (16 cr при 1K, 22 cr при 2K) - Стилизованная / художественная трансформация -> midjourney-i2i Если пользователь просто говорит «отредактируй это изображение» без других указаний, по умолчанию используйте grok-imagine-i2i.

Редактировать изображение с помощью AI (I2I)

Параметры
  • aspectRatiostring

    Output aspect ratio (e.g. '1:1', '16:9'). Defaults to the source ratio for most models.

  • imageUrlstringобязательный

    Public URL of the source image to edit. Must be a real, fetchable URL.

  • maxImagesinteger

    Number of variations to return for multi-output models.

  • modelstring

    Model ID. Defaults to 'grok-imagine-i2i' (3 cr/image effective, 2 outputs). Other options: 'seedream-v4-edit', 'wan-2.5-spicy-i2i', 'flux-kontext-pro', 'qwen-image-edit', 'gpt-image-1.5-i2i', 'grok-imagine-quality-i2i'. Use list_image_models for the full list.

  • negative_promptstring

    What to avoid in the output (supported by some models).

  • promptstringобязательный

    Text description of the edit (e.g. 'replace the sky with sunset clouds').

  • qualityenum

    Quality preset for models that support it (e.g. GPT Image 2).

  • renderingSpeedenum

    Rendering speed preset for models that support it.

  • resolutionstring

    Output resolution. Tiered-pricing models accept '1K' / '2K'.

aetherwave_generate_imageвнешний мир

Создаёт одно или несколько изображений из текстовой подсказки (T2I) или текстовой подсказки + эталонных изображений (I2I). Отправляет задание, опрашивает до завершения и возвращает конечные URL изображений. Модель по умолчанию — 'grok-imagine-t2i' (быстрая, 6 изображений за генерацию, 5 кредитов). Используйте list_image_models, чтобы увидеть полный список с ценами. Для I2I передавайте referenceImages как массив публичных URL изображений и выбирайте модель с поддержкой I2I (например, 'grok-imagine-i2i', 'wan-2.5-spicy-i2i'). ## Руководство по выбору модели (когда пользователь не указал модель) По умолчанию: grok-imagine-t2i (5 кр., 6 результатов за вызов, быстро, общего назначения). Настоятельная рекомендация: когда нужно одно высококачественное изображение (большинство агентных / однократных сценариев), предпочитайте gpt-image-2-t2i (9 кр. @ 1K / выше @ 2K, одно детерминированное изображение, лучшее общее качество по реализму, иллюстрации, типографике и композиции; поддерживает разрешение до 2K и большинство соотношений сторон, включая авто). Это лидер для серьёзной креативной работы, когда не нужно выбирать из 6 вариантов. Выбирайте другую модель, если в подсказке есть такие сигналы: - «один лучший результат» / «одно изображение» / продакшен / нет времени выбирать из вариантов -> gpt-image-2-t2i (9 кр., 1 результат, лучшее общее качество) - «фотореализм» / «фото» / «реалистичный» -> gpt-image-2-t2i (9 кр., лучший общий реализм) или imagen-4 (12 кр., очень высокое качество) или z-image-turbo (3 кр., самое быстрое) - «наивысшее качество» / «премиум» / без бюджета -> gpt-image-2-t2i в 2K, или grok-imagine-quality-t2i (16 кр. @ 1K, 22 кр. @ 2K), или imagen-4-ultra - Текст внутри изображения (вывески, плакаты, типографика) -> ideogram-v3-t2i (лучший в классе) или gpt-image-2-t2i (тоже силён) - Художественный / живописный / стилизованный -> midjourney-t2i - Обложка альбома / обложка -> gpt-image-2-t2i для одного сильного изображения; grok-imagine-t2i для 6 вариантов на выбор; seedream-v4-t2i если нужно 4K - Логотип или дизайн с встроенным текстом -> ideogram-v3-t2i

Сгенерировать изображение (Grok Imagine, GPT Image 2, Seedream V4, Wan, Imagen 4, Nano Banana, Ideogram V3, Z-Image Turbo)

Параметры
  • aspectRatiostring

    Aspect ratio (e.g. '1:1', '16:9', '9:16'). Pass this explicitly when possible; some upstream providers reject submissions without an aspect ratio. Default ratios vary by model.

  • modelstring

    Model ID. Defaults to 'grok-imagine-t2i'. Use list_image_models for the full list.

  • negative_promptstring

    What to avoid in the output (supported by some models).

  • numImagesinteger

    Number of images for models that support multiple outputs.

  • promptstringобязательный

    Text description of the image to generate.

  • referenceImagesstring[]

    Array of public image URLs for image-to-image generation. Required when using an I2I model. A single URL string is also accepted (wrapped as a one-element array).

  • resolutionstring

    Output resolution. Most models accept '1K' or '2K'; some accept '480p'/'720p'.

  • seedinteger

    Seed for deterministic generation (supported by some models).

aetherwave_generate_musicвнешний мир

Генерирует AI-музыку через Suno. Возвращает два трека на один запрос. Модель по умолчанию — V5.5 (новейшая, наилучшего качества). Для инструментального выхода задайте instrumental: true. Генерация музыки обычно занимает 30–90 секунд — этот инструмент опрашивает с бюджетом до 6 минут. Учтите: параметр title для инструменталов носит рекомендательный характер — Suno часто сам пишет название из содержимого промпта для инструментальных генераций. Временные ошибки GENERATE_AUDIO_FAILED встречаются часто; повторите попытку один раз, прежде чем понижать версию модели.

Сгенерировать музыку (Suno)

Параметры
  • audioWeightnumber

    0 to 1. Weighting on the audio character of the generation. Only applies with lyrics.

  • instrumentalboolean

    If true, no vocals. Default false.

  • lyricsstring

    Custom lyrics. If omitted, Suno will generate lyrics from the prompt (unless instrumental=true).

  • modelenum

    Suno model version. Defaults to V5_5 (current best).

  • negativeTagsstring

    Comma-separated things to AVOID, e.g. 'heavy metal, screaming, distorted guitar'. Use when someone says they do not want a particular sound. Only applies with lyrics.

  • promptstringобязательный

    Style/mood/topic description. E.g. 'Lo-fi ambient track, rain sounds, warm pads' or 'High-energy synthwave with driving bass'.

  • styleWeightnumber

    0 to 1. How closely to follow the style description. Higher sticks to it, lower lets the model roam. Use when someone asks to stay closer to, or further from, a described sound. Only applies with lyrics.

  • titlestring

    Optional title for the generated tracks.

  • vocalGenderenum

    Vocal gender, 'm' or 'f'. Only applies when lyrics are supplied. Default 'm'.

  • weirdnessConstraintnumber

    0 to 1. How experimental the result is. Higher is stranger and more unexpected, lower is safer and more conventional. Use when someone asks to make it weirder or more normal. Only applies with lyrics.

aetherwave_generate_videoвнешний мир

Генерирует короткое видео по текстовому запросу (T2V) или по текстовому запросу + начальному изображению (I2V). Отправляет задание, опрашивает статус и возвращает ссылку на готовое видео. Модель по умолчанию — grok-imagine-t2v (быстрая, 4-6 кр/с, со встроенным KIE -> fal.ai как запасной вариант). Используй list_video_models, чтобы получить полный список моделей со стоимостью в кредитах за секунду. Для I2V-моделей (например, grok-imagine-i2v, seedance-pro-i2v) требуется публичный imageUrl. Генерация видео может занять от 30 секунд до нескольких минут; инструмент опрашивает статус с бюджетом до 8 минут. ## Как выбрать модель для видео (если пользователь не указал модель сам) По умолчанию: grok-imagine-t2v (4-6 кр/с, быстро, есть подстраховка KIE -> fal.ai. Лучший для общих задач). Выбирай другую модель, если в запросе есть такие признаки: - «максимальное качество» / «премиум» / эфир / коммерция -> veo3.1-quality или veo3-quality (флагман Google, фиксированные 350-560 кр за 8 с, 3-5 мин) - «быстрый премиум» / быстрое высокое качество -> veo3-fast или veo3.1-fast (фиксированные 84 кр за 8 с) - Кинематографичные движения камеры / наезд / панорама -> seedance-pro-t2v (3-10 кр/с) или kling-3.0-pro-t2v (26 кр/с) - Реалистичные движения людей / лица -> hailuo-2.3-pro-i2v (I2V, нужен imageUrl) - Говорящая голова / синхронизация губ -> kling-avatar-pro (23 кр/с) или infinitalk (5-17 кр/с) - Аниме / стилизация / фэнтези -> wan-2.7-t2v - NSFW / взрослый контент -> wan-22-nsfw-i2v (только I2V; автоматически помечает как 18+) - Оживить именно это изображение -> любая I2V-модель (grok-imagine-i2v, seedance-pro-i2v, hailuo-2.3-pro-i2v) - Интерполяция первого и последнего кадров -> seedance-pro-i2v с обоими параметрами imageUrl + endImageUrl - Самый дешёвый тест -> hailuo-2.0-standard в 512p (3 кр/с, ~18 кр за 6 с) или grok-imagine-t2v в 480p (4 кр/с, ~24 кр за 6 с) - Клип 12-15 с

Сгенерировать видео (Grok Imagine, Wan 2.7, Hailuo 02, Seedance, Kling 2.6, VEO 3.1, Happy Horse)

Параметры
  • aspectRatiostring

    Aspect ratio (e.g. '16:9', '9:16', '1:1').

  • durationinteger

    Duration in seconds. Grok Imagine accepts 6-15; other models have their own ranges (see list_video_models).

  • endImageUrlstring

    Public URL of ending image. Supported by some I2V models (first+last frame).

  • imageUrlstring

    Public URL of starting image. Required for I2V models.

  • modeenum

    Moderation mode for Grok Imagine. Defaults to 'normal'.

  • modelstring

    Model ID. Defaults to 'grok-imagine-t2v'. Use list_video_models for the full list.

  • promptstringобязательный

    Text description of the video scene.

  • resolutionenum

    Output resolution. Default depends on model.

aetherwave_list_image_modelsтолько чтениевнешний мир

Возвращает все модели генерации изображений, которые поддерживает AetherWave, с указанием стоимости в кредитах, соотношения сторон по умолчанию, поддерживаемых входных данных (T2I и I2I) и опций, специфичных для модели. Вызывай эту функцию перед generate_image, если не знаешь правильный ID модели. Ключ модели (например, 'grok-imagine-t2i') — это то, что ты передаёшь как model в generate_image.

Перечислить доступные модели изображений

Параметры

Без параметров.

aetherwave_list_master_presetsтолько чтениевнешний мир

Возвращает все пресеты AI-мастеринга, которые поддерживает AetherWave: с целевыми LUFS, тегами, описаниями и уровнем сложности. Вызывай это перед master_audio, если не знаешь, какой пресет подходит треку. Всего 12 пресетов, охватывающих стили: стриминг, хип-хоп, EDM, поп, рок, lo-fi, R&B, акустика, саундтрек, подкаст, gentle и loud-and-punchy. У каждого пресета есть целевое значение LUFS (например, -14 для стриминга, -9 для громкого), чтобы можно было подобрать под цель распространения пользователя.

Выведи список доступных пресетов мастеринга аудио

Параметры

Без параметров.

aetherwave_list_my_creationsтолько чтениевнешний мир

Возвращает элементы из галереи аутентифицированного пользователя — изображения, видео, аудиотреки, которые он создал на AetherWave. Полезно для агентских рабочих процессов вроде «найди мои последние 5 изображений и измени их формат на 9:16» или «перечисли мои недавние треки и обработай каждый». Поддерживает пагинацию и фильтрацию по типу. Каждый элемент включает id, type, prompt, model, contentUrl, thumbnailUrl, createdAt, isFavorite, visibility, rating и поля, зависящие от типа (duration для аудио/видео, width/height для изображений).

Выведи список моих элементов галереи AetherWave

Параметры
  • favoritesOnlyboolean

    If true, only return items marked as favorite.

  • limitinteger

    Max items to return. Defaults to 100, max 500.

  • offsetinteger

    Pagination offset. Defaults to 0.

  • typeenum

    Filter to a single media type. Omit for all types.

aetherwave_list_video_modelsтолько чтениевнешний мир

Возвращает все модели генерации видео, которые поддерживает AetherWave (Grok Imagine, Wan 2.7, Hailuo 02, Seedance Pro/Lite, Kling 2.6 с аудио, VEO 3.1, Happy Horse и другие), с указанием стоимости за секунду в кредитах, поддерживаемых длительностей, разрешений, соотношений сторон и того, требуется ли модели входное изображение (I2V). Вызывай этот инструмент перед generate_video, если не знаешь правильный ID модели.

Вывести список доступных видеомоделей

Параметры

Без параметров.

aetherwave_master_audioвнешний мир

Отправляет аудиофайл на AI-мастеринг и синхронно возвращает URL обработанного трека (внутренне маршрут опрашивает Python-сервис; ожидайте от 30 секунд до 5 минут). Полезно как финальный этап обработки после генерации музыки. Стоимость: 20 кредитов за трек. Тарифы Producer, Mogul и Ultimate получают мастеринг бесплатно. На выходе WAV (~50 МБ за трёхминутный трек, без потерь для редистрибуции). Выберите preset, чтобы задать стиль мастеринга; вызовите aetherwave_list_master_presets для полного актуального списка (12 пресетов: streaming, loud, gentle, hip_hop, edm, pop, rock, lofi, rnb, acoustic, cinematic, podcast). У каждого пресета есть целевое значение LUFS, чтобы подобрать его под целевую платформу распространения.

Сделать мастеринг аудиодорожки (AI-мастеринг)

Параметры
  • audioUrlstringобязательный

    Public URL to the source audio file (MP3 or WAV).

  • presetstringобязательный

    Mastering preset name. Must be one of: 'streaming', 'loud', 'gentle', 'hip_hop', 'edm', 'pop', 'rock', 'lofi', 'rnb', 'acoustic', 'cinematic', 'podcast'. Call aetherwave_list_master_presets for full metadata (target LUFS, description, tags).

  • trackTitlestring

    Optional title for the mastered output (used in gallery row label).

aetherwave_reframe_imageвнешний мир

Изменяет соотношение сторон изображения с помощью интеллектуального дорисовывания краёв. Передайте публичный imageUrl и целевое aspectRatio ('16:9', '9:16', '1:1', '4:3', '3:4' и т.д.). Три уровня скорости: 'turbo' (5 cr, быстро), 'balanced' (10 cr, по умолчанию), 'quality' (14 cr, медленнее всего, лучшие края). Возвращает URL перекомпонованного изображения.

Перекадрировать изображение под новое соотношение сторон (Ideogram V3 Reframe)

Параметры
  • aspectRatiostringобязательный

    Target aspect ratio (e.g. '16:9', '9:16', '1:1', '4:3', '3:4', '21:9').

  • imageUrlstringобязательный

    Public URL of the source image.

  • speedenum

    Rendering speed. 'turbo'=5cr, 'balanced'=10cr (default), 'quality'=14cr.

aetherwave_reframe_videoвнешний мир

Переформатирует видео под новое соотношение сторон, интеллектуально дорисовывая или кадрируя края. Передайте публичный videoUrl и целевое reframeAspectRatio. 17 кредитов в секунду. Опциональный reframePrompt управляет содержимым новых краев (например, 'добавьте небо с закатными облаками'). Возвращает URL переформатированного видео (хостинг R2).

Переформатировать видео под новое соотношение сторон (Luma Ray 2 Flash)

Параметры
  • reframeAspectRatioenumобязательный

    Target aspect ratio.

  • reframePromptstring

    Optional prompt to steer the new edge content.

  • videoUrlstringобязательный

    Public URL of the source video (MP4).

aetherwave_remove_backgroundвнешний мир

Удаляет фон с изображения, возвращает PNG с прозрачным альфа-каналом. Передайте публичный imageUrl. Полезно для предметной съёмки, вырезания персонажей, изоляции логотипов или компоновки на новом фоне. ~5 кредитов за изображение. Recraft — основной провайдер; при сбое инструмент автоматически переключается на fal.ai BiRefNet v2, поэтому вызовы для отдельных изображений никогда не завершаются молчаливым сбоем. Лучше всего работает с фотографическими объектами (люди, товары, животные); входные PNG с прозрачностью не имеют переднего плана для сегментации.

Удалить фон из изображения (Recraft + резервный вариант fal.ai BiRefNet v2)

Параметры
  • imageUrlstringобязательный

    Public URL of the source image.

aetherwave_remove_background_videoвнешний мир

Удаляет фон из видео покадрово с помощью rembg (u2netp) на Python-сервисе AetherWave. Передайте публичный videoUrl. Выберите bgType: "transparent" для выходного WebM с альфа-каналом (композитинг) или bgType: "color" с hex-кодом customColor для замены сплошным цветом. 2 кредита за секунду. Самый медленный инструмент (покадровая обработка): 6-секундный клип обрабатывается ~4 минуты, 30-секундный ~15-20 минут. Лучше всего работает на объектах с чёткими краями (люди, товары). Возвращает URL обработанного видео (размещено на R2).

Удалить фон из видео

Параметры
  • bgTypeenum

    'transparent' = alpha WebM output (default). 'color' = solid replacement using customColor.

  • customColorstring

    Hex color for solid background when bgType='color' (e.g. '#00ff00'). Default green.

  • videoUrlstringобязательный

    Public URL of the source video (MP4).

aetherwave_upscale_imageвнешний мир

Увеличивает разрешение исходного изображения с помощью высокоточного апскейлера Topaz. Передайте публичный imageUrl и коэффициент масштабирования upscaleFactor. Стоимость в кредитах зависит от исходного разрешения, умноженного на коэффициент: маленькие изображения стоят дешевле больших при одинаковом коэффициенте. Возвращает URL увеличенного изображения.

Увеличить разрешение изображения (Topaz)

Параметры
  • imageUrlstringобязательный

    Public URL of the source image.

  • upscaleFactorenum

    Upscale multiplier. Defaults to '2x'. '8x' is heavy; use only on small sources.

aetherwave_upscale_videoвнешний мир

Повышает разрешение исходного видео до 1080p или 2K с помощью Atlas. Передайте публичный videoUrl и целевое разрешение. Стоимость посекундная (7 cr/s @ 1080p, 9 cr/s @ 2K). Ограничения со стороны Atlas: клипы до 53 с при 1080p, 23 с при 2K, исходное видео должно быть <=30 fps. Возвращает URL увеличенного видео (размещено на R2).

Увеличить разрешение видео (Atlas Video Upscaler)

Параметры
  • targetResolutionenum

    Target output resolution. Defaults to '1080p'. '2k' is more expensive and limited to ~23s clips.

  • videoUrlstringобязательный

    Public URL of the source video (MP4).

Похожие MCP-сервера

raveenb/fal-mcp-server

raveenb/fal-mcp-server

MCP сервер для генерации изображений, видео, музыки и аудио через Fal.ai. Интегрируется с Claude Desktop и любыми MCP-клиентами, предлагая 18 инструментов: от текстовых промптов до ретуши и анимации. Полезен разработчикам и креаторам для быстрого создания контента без переключения между сервисами.

Python53
doctorm333/promptpilot-mcp-server

doctorm333/promptpilot-mcp-server

PromptPilot MCP-сервер генерирует изображения, видео и аудио прямо в Claude, Cursor или Windsurf. Поддерживает 20+ моделей (Flux, Imagen 4, Grok Imagine и др.), есть бесплатные без ключа. Полезен р...

JavaScript2
elestirelbilinc-sketch/vap-showcase

elestirelbilinc-sketch/vap-showcase

MCP-сервер VAP Media добавляет AI-агентам генерацию изображений Flux, видео Veo и музыки Suno с детерминированным ценообразованием. Управляй затратами, используй готовые инструменты в Claude Deskto...

Python1
AceDataCloud/MCPSuno

AceDataCloud/MCPSuno

MCP сервер для генерации музыки с ИИ через Suno и AceDataCloud. Создавайте песни, управляйте текстами и стилями, расширяйте треки, извлекайте вокал — всё через Claude или другие MCP-клиенты. Полезе...

Python50
cnghockey/sats4ai-mcp-server

cnghockey/sats4ai-mcp-server

MCP-сервер с 40+ инструментами для AI-агентов, оплата через Bitcoin Lightning — без регистрации, API-ключей и KYC. Генерация изображений, видео, звонки в любом языке, перевод, факс, SMS, транскриба...

JavaScript1
skyworkai/mureka-mcp

skyworkai/mureka-mcp

Mureka MCP сервер даёт ИИ-агентам (Claude Desktop, OpenAI Agents) возможность генерировать тексты, песни и фоновую музыку (инструментал). Полезен музыкантам и разработчикам для автоматизации создания аудиоконтента.

Python113
© Каталог MCP, 2026. Все права защищены.
Проект не аффилирован с Anthropic и любыми упомянутыми продуктами.
Все названия и торговые марки принадлежат их владельцам.
Контакты для связи: hi@mcp-katalog.ru

Лука Никитин