MCP сервер AetherWave Studio объединяет 16+ инструментов генерации контента: изображения, видео, музыка, мастеринг. Один API-ключ и пул кредитов дают доступ к Suno, Grok, Midjourney, Topaz. Интегри...
README
16 инструментов
Установить сервер
@aetherwave-studio/mcp
Model Context Protocol server for AetherWave Studio. Drop it into any MCP-compatible client (Claude Code, Cursor, Continue, Claude Desktop, custom agents) and your LLM can generate, edit, upscale, reframe, and master across every flagship creative AI provider through one API key, one credit pool.
One install. One token. Sixteen tools covering:
Music - Suno V3.5 / V4 / V4.5 / V5 / V5.5
Image gen - Grok Imagine, GPT Image 2, Seedream V4, Wan 2.7, Imagen 4, Nano Banana, Ideogram V3, Z-Image Turbo
Video - Grok Imagine (KIE+fal fallback), Wan 2.7, Hailuo 02, Seedance Pro/Lite, Kling 2.6 (audio), VEO 3.1, Happy Horse
Video utility - Atlas upscaler (1080p/2K), rembg u2netp background removal, Luma Ray 2 Flash reframe
Audio mastering - 12 genre/style presets via the AetherWave Python service
Gallery read - paginated list of your saved creations
aetherwave_balanceтолько чтениевнешний мир
Возвращает текущий баланс кредитов AetherWave для API-ключа. Используйте это ДО генерации, чтобы убедиться в достаточном количестве кредитов — особенно для видео, которое может стоить 30-300+ кредитов в зависимости от модели/длительности/разрешения.
Check credit balance
Возвращает текущий баланс кредитов AetherWave для API-ключа. Используйте это ДО генерации, чтобы убедиться в достаточном количестве кредитов — особенно для видео, которое может стоить 30-300+ кредитов в зависимости от модели/длительности/разрешения.
Параметры
Без параметров.
aetherwave_edit_imageвнешний мир
Редактирует существующее изображение по текстовой подсказке. Передайте публичный `imageUrl` и `prompt` с описанием изменения ("добавь луну в небо", "замени фон на неоновый город", "сделай как панель из комикса"). Отправляет, опрашивает и возвращает URL(ы) отредактированного изображения. Модель по умолчанию — 'grok-imagine-i2i' (6 cr за вызов, возвращает 2 варианта, ~30 с, лучшее соотношение цены и качества для стандартных правок). Другие модели с I2I: 'seedream-v4-edit', 'wan-2.5-spicy-i2i', 'flux-kontext-pro', 'qwen-image-edit', 'gpt-image-1.5-i2i' (медленный, ~5 мин). Полный список моделей — в list_image_models. Важно: URL-адреса с пробелами или скобками могут не сработать; используйте чистые URL.
## Руководство по выбору модели для правок
По умолчанию: `grok-imagine-i2i` (6 cr за вызов, возвращает 2 варианта = эффективно 3 cr за изображение, быстро ~30 с, хорошее качество правок общего назначения).
Выбирайте другую модель, когда:
- Нужен единственный детерминированный результат или разрешение 4K -> `seedream-v4-edit` (7 cr за изображение, поддерживает 1K/2K/4K, до 6 изображений)
- Тонкие правки / сохранение композиции / согласованность персонажей -> `flux-kontext-pro` или `flux-kontext-max`
- NSFW-правки -> `wan-2.5-spicy-i2i`
- Максимальное качество, время не важно (~5 мин подходит) -> `gpt-image-1.5-i2i` или `grok-imagine-quality-i2i` (16 cr при 1K, 22 cr при 2K)
- Стилизованная / художественная трансформация -> `midjourney-i2i`
Если пользователь просто говорит «отредактируй это изображение» без других указаний, по умолчанию используйте `grok-imagine-i2i`.
Edit image with AI (I2I)
Редактирует существующее изображение по текстовой подсказке. Передайте публичный `imageUrl` и `prompt` с описанием изменения ("добавь луну в небо", "замени фон на неоновый город", "сделай как панель из комикса"). Отправляет, опрашивает и возвращает URL(ы) отредактированного изображения. Модель по умолчанию — 'grok-imagine-i2i' (6 cr за вызов, возвращает 2 варианта, ~30 с, лучшее соотношение цены и качества для стандартных правок). Другие модели с I2I: 'seedream-v4-edit', 'wan-2.5-spicy-i2i', 'flux-kontext-pro', 'qwen-image-edit', 'gpt-image-1.5-i2i' (медленный, ~5 мин). Полный список моделей — в list_image_models. Важно: URL-адреса с пробелами или скобками могут не сработать; используйте чистые URL.
## Руководство по выбору модели для правок
По умолчанию: `grok-imagine-i2i` (6 cr за вызов, возвращает 2 варианта = эффективно 3 cr за изображение, быстро ~30 с, хорошее качество правок общего назначения).
Выбирайте другую модель, когда:
- Нужен единственный детерминированный результат или разрешение 4K -> `seedream-v4-edit` (7 cr за изображение, поддерживает 1K/2K/4K, до 6 изображений)
- Тонкие правки / сохранение композиции / согласованность персонажей -> `flux-kontext-pro` или `flux-kontext-max`
- NSFW-правки -> `wan-2.5-spicy-i2i`
- Максимальное качество, время не важно (~5 мин подходит) -> `gpt-image-1.5-i2i` или `grok-imagine-quality-i2i` (16 cr при 1K, 22 cr при 2K)
- Стилизованная / художественная трансформация -> `midjourney-i2i`
Если пользователь просто говорит «отредактируй это изображение» без других указаний, по умолчанию используйте `grok-imagine-i2i`.
Параметры
promptstringобязательный
Text description of the edit (e.g. 'replace the sky with sunset clouds').
imageUrlstringобязательный
Public URL of the source image to edit. Must be a real, fetchable URL.
modelstring
Model ID. Defaults to 'grok-imagine-i2i' (3 cr/image effective, 2 outputs). Other options: 'seedream-v4-edit', 'wan-2.5-spicy-i2i', 'flux-kontext-pro', 'qwen-image-edit', 'gpt-image-1.5-i2i', 'grok-imagine-quality-i2i'. Use list_image_models for the full list.
aspectRatiostring
Output aspect ratio (e.g. '1:1', '16:9'). Defaults to the source ratio for most models.
Quality preset for models that support it (e.g. GPT Image 2).
lowmediumhigh
maxImagesinteger
Number of variations to return for multi-output models.
renderingSpeedenum
Rendering speed preset for models that support it.
turbobalancedquality
negative_promptstring
What to avoid in the output (supported by some models).
aetherwave_generate_imageвнешний мир
Создаёт одно или несколько изображений из текстовой подсказки (T2I) или текстовой подсказки + эталонных изображений (I2I). Отправляет задание, опрашивает до завершения и возвращает конечные URL изображений. Модель по умолчанию — 'grok-imagine-t2i' (быстрая, 6 изображений за генерацию, 5 кредитов). Используйте list_image_models, чтобы увидеть полный список с ценами. Для I2I передавайте `referenceImages` как массив публичных URL изображений и выбирайте модель с поддержкой I2I (например, 'grok-imagine-i2i', 'wan-2.5-spicy-i2i').
## Руководство по выбору модели (когда пользователь не указал модель)
По умолчанию: `grok-imagine-t2i` (5 кр., 6 результатов за вызов, быстро, общего назначения).
**Настоятельная рекомендация: когда нужно одно высококачественное изображение** (большинство агентных / однократных сценариев), предпочитайте `gpt-image-2-t2i` (9 кр. @ 1K / выше @ 2K, одно детерминированное изображение, лучшее общее качество по реализму, иллюстрации, типографике и композиции; поддерживает разрешение до 2K и большинство соотношений сторон, включая авто). Это лидер для серьёзной креативной работы, когда не нужно выбирать из 6 вариантов.
Выбирайте другую модель, если в подсказке есть такие сигналы:
- «один лучший результат» / «одно изображение» / продакшен / нет времени выбирать из вариантов -> `gpt-image-2-t2i` (9 кр., 1 результат, лучшее общее качество)
- «фотореализм» / «фото» / «реалистичный» -> `gpt-image-2-t2i` (9 кр., лучший общий реализм) или `imagen-4` (12 кр., очень высокое качество) или `z-image-turbo` (3 кр., самое быстрое)
- «наивысшее качество» / «премиум» / без бюджета -> `gpt-image-2-t2i` в 2K, или `grok-imagine-quality-t2i` (16 кр. @ 1K, 22 кр. @ 2K), или `imagen-4-ultra`
- Текст внутри изображения (вывески, плакаты, типографика) -> `ideogram-v3-t2i` (лучший в классе) или `gpt-image-2-t2i` (тоже силён)
- Художественный / живописный / стилизованный -> `midjourney-t2i`
- Обложка альбома / обложка -> `gpt-image-2-t2i` для одного сильного изображения; `grok-imagine-t2i` для 6 вариантов на выбор; `seedream-v4-t2i` если нужно 4K
- Логотип или дизайн с встроенным текстом -> `ideogram-v3-t2i`
Создаёт одно или несколько изображений из текстовой подсказки (T2I) или текстовой подсказки + эталонных изображений (I2I). Отправляет задание, опрашивает до завершения и возвращает конечные URL изображений. Модель по умолчанию — 'grok-imagine-t2i' (быстрая, 6 изображений за генерацию, 5 кредитов). Используйте list_image_models, чтобы увидеть полный список с ценами. Для I2I передавайте `referenceImages` как массив публичных URL изображений и выбирайте модель с поддержкой I2I (например, 'grok-imagine-i2i', 'wan-2.5-spicy-i2i').
## Руководство по выбору модели (когда пользователь не указал модель)
По умолчанию: `grok-imagine-t2i` (5 кр., 6 результатов за вызов, быстро, общего назначения).
**Настоятельная рекомендация: когда нужно одно высококачественное изображение** (большинство агентных / однократных сценариев), предпочитайте `gpt-image-2-t2i` (9 кр. @ 1K / выше @ 2K, одно детерминированное изображение, лучшее общее качество по реализму, иллюстрации, типографике и композиции; поддерживает разрешение до 2K и большинство соотношений сторон, включая авто). Это лидер для серьёзной креативной работы, когда не нужно выбирать из 6 вариантов.
Выбирайте другую модель, если в подсказке есть такие сигналы:
- «один лучший результат» / «одно изображение» / продакшен / нет времени выбирать из вариантов -> `gpt-image-2-t2i` (9 кр., 1 результат, лучшее общее качество)
- «фотореализм» / «фото» / «реалистичный» -> `gpt-image-2-t2i` (9 кр., лучший общий реализм) или `imagen-4` (12 кр., очень высокое качество) или `z-image-turbo` (3 кр., самое быстрое)
- «наивысшее качество» / «премиум» / без бюджета -> `gpt-image-2-t2i` в 2K, или `grok-imagine-quality-t2i` (16 кр. @ 1K, 22 кр. @ 2K), или `imagen-4-ultra`
- Текст внутри изображения (вывески, плакаты, типографика) -> `ideogram-v3-t2i` (лучший в классе) или `gpt-image-2-t2i` (тоже силён)
- Художественный / живописный / стилизованный -> `midjourney-t2i`
- Обложка альбома / обложка -> `gpt-image-2-t2i` для одного сильного изображения; `grok-imagine-t2i` для 6 вариантов на выбор; `seedream-v4-t2i` если нужно 4K
- Логотип или дизайн с встроенным текстом -> `ideogram-v3-t2i`
Параметры
promptstringобязательный
Text description of the image to generate.
modelstring
Model ID. Defaults to 'grok-imagine-t2i'. Use list_image_models for the full list.
aspectRatiostring
Aspect ratio (e.g. '1:1', '16:9', '9:16'). Pass this explicitly when possible; some upstream providers reject submissions without an aspect ratio. Default ratios vary by model.
resolutionstring
Output resolution. Most models accept '1K' or '2K'; some accept '480p'/'720p'.
referenceImagesstring[]
Array of public image URLs for image-to-image generation. Required when using an I2I model. A single URL string is also accepted (wrapped as a one-element array).
numImagesinteger
Number of images for models that support multiple outputs.
negative_promptstring
What to avoid in the output (supported by some models).
seedinteger
Seed for deterministic generation (supported by some models).
aetherwave_generate_musicвнешний мир
Генерирует AI-музыку через Suno. Возвращает два трека на один запрос. Модель по умолчанию — V5.5 (новейшая, наилучшего качества). Для инструментального выхода задайте `instrumental: true`. Генерация музыки обычно занимает 30–90 секунд — этот инструмент опрашивает с бюджетом до 6 минут. Учтите: параметр `title` для инструменталов носит рекомендательный характер — Suno часто сам пишет название из содержимого промпта для инструментальных генераций. Временные ошибки `GENERATE_AUDIO_FAILED` встречаются часто; повторите попытку один раз, прежде чем понижать версию модели.
Generate music (Suno)
Генерирует AI-музыку через Suno. Возвращает два трека на один запрос. Модель по умолчанию — V5.5 (новейшая, наилучшего качества). Для инструментального выхода задайте `instrumental: true`. Генерация музыки обычно занимает 30–90 секунд — этот инструмент опрашивает с бюджетом до 6 минут. Учтите: параметр `title` для инструменталов носит рекомендательный характер — Suno часто сам пишет название из содержимого промпта для инструментальных генераций. Временные ошибки `GENERATE_AUDIO_FAILED` встречаются часто; повторите попытку один раз, прежде чем понижать версию модели.
Параметры
promptstringобязательный
Style/mood/topic description. E.g. 'Lo-fi ambient track, rain sounds, warm pads' or 'High-energy synthwave with driving bass'.
instrumentalboolean
If true, no vocals. Default false.
modelenum
Suno model version. Defaults to V5_5 (current best).
V3_5V4V4_5V5V5_5
titlestring
Optional title for the generated tracks.
lyricsstring
Custom lyrics. If omitted, Suno will generate lyrics from the prompt (unless instrumental=true).
aetherwave_generate_videoвнешний мир
Генерирует короткое видео по текстовому запросу (T2V) или по текстовому запросу + начальному изображению (I2V). Отправляет задание, опрашивает статус и возвращает ссылку на готовое видео. Модель по умолчанию — `grok-imagine-t2v` (быстрая, 4-6 кр/с, со встроенным KIE -> fal.ai как запасной вариант). Используй `list_video_models`, чтобы получить полный список моделей со стоимостью в кредитах за секунду. Для I2V-моделей (например, `grok-imagine-i2v`, `seedance-pro-i2v`) требуется публичный `imageUrl`. Генерация видео может занять от 30 секунд до нескольких минут; инструмент опрашивает статус с бюджетом до 8 минут.
## Как выбрать модель для видео (если пользователь не указал модель сам)
По умолчанию: `grok-imagine-t2v` (4-6 кр/с, быстро, есть подстраховка KIE -> fal.ai. Лучший для общих задач).
Выбирай другую модель, если в запросе есть такие признаки:
- «максимальное качество» / «премиум» / эфир / коммерция -> `veo3.1-quality` или `veo3-quality` (флагман Google, фиксированные 350-560 кр за 8 с, 3-5 мин)
- «быстрый премиум» / быстрое высокое качество -> `veo3-fast` или `veo3.1-fast` (фиксированные 84 кр за 8 с)
- Кинематографичные движения камеры / наезд / панорама -> `seedance-pro-t2v` (3-10 кр/с) или `kling-3.0-pro-t2v` (26 кр/с)
- Реалистичные движения людей / лица -> `hailuo-2.3-pro-i2v` (I2V, нужен imageUrl)
- Говорящая голова / синхронизация губ -> `kling-avatar-pro` (23 кр/с) или `infinitalk` (5-17 кр/с)
- Аниме / стилизация / фэнтези -> `wan-2.7-t2v`
- NSFW / взрослый контент -> `wan-22-nsfw-i2v` (только I2V; автоматически помечает как 18+)
- Оживить именно это изображение -> любая I2V-модель (`grok-imagine-i2v`, `seedance-pro-i2v`, `hailuo-2.3-pro-i2v`)
- Интерполяция первого и последнего кадров -> `seedance-pro-i2v` с обоими параметрами `imageUrl` + `endImageUrl`
- Самый дешёвый тест -> `hailuo-2.0-standard` в 512p (3 кр/с, ~18 кр за 6 с) или `grok-imagine-t2v` в 480p (4 кр/с, ~24 кр за 6 с)
- Клип 12-15 с
Generate video (Grok Imagine, Wan 2.7, Hailuo 02, Seedance, Kling 2.6, VEO 3.1, Happy Horse)
Генерирует короткое видео по текстовому запросу (T2V) или по текстовому запросу + начальному изображению (I2V). Отправляет задание, опрашивает статус и возвращает ссылку на готовое видео. Модель по умолчанию — `grok-imagine-t2v` (быстрая, 4-6 кр/с, со встроенным KIE -> fal.ai как запасной вариант). Используй `list_video_models`, чтобы получить полный список моделей со стоимостью в кредитах за секунду. Для I2V-моделей (например, `grok-imagine-i2v`, `seedance-pro-i2v`) требуется публичный `imageUrl`. Генерация видео может занять от 30 секунд до нескольких минут; инструмент опрашивает статус с бюджетом до 8 минут.
## Как выбрать модель для видео (если пользователь не указал модель сам)
По умолчанию: `grok-imagine-t2v` (4-6 кр/с, быстро, есть подстраховка KIE -> fal.ai. Лучший для общих задач).
Выбирай другую модель, если в запросе есть такие признаки:
- «максимальное качество» / «премиум» / эфир / коммерция -> `veo3.1-quality` или `veo3-quality` (флагман Google, фиксированные 350-560 кр за 8 с, 3-5 мин)
- «быстрый премиум» / быстрое высокое качество -> `veo3-fast` или `veo3.1-fast` (фиксированные 84 кр за 8 с)
- Кинематографичные движения камеры / наезд / панорама -> `seedance-pro-t2v` (3-10 кр/с) или `kling-3.0-pro-t2v` (26 кр/с)
- Реалистичные движения людей / лица -> `hailuo-2.3-pro-i2v` (I2V, нужен imageUrl)
- Говорящая голова / синхронизация губ -> `kling-avatar-pro` (23 кр/с) или `infinitalk` (5-17 кр/с)
- Аниме / стилизация / фэнтези -> `wan-2.7-t2v`
- NSFW / взрослый контент -> `wan-22-nsfw-i2v` (только I2V; автоматически помечает как 18+)
- Оживить именно это изображение -> любая I2V-модель (`grok-imagine-i2v`, `seedance-pro-i2v`, `hailuo-2.3-pro-i2v`)
- Интерполяция первого и последнего кадров -> `seedance-pro-i2v` с обоими параметрами `imageUrl` + `endImageUrl`
- Самый дешёвый тест -> `hailuo-2.0-standard` в 512p (3 кр/с, ~18 кр за 6 с) или `grok-imagine-t2v` в 480p (4 кр/с, ~24 кр за 6 с)
- Клип 12-15 с
Параметры
promptstringобязательный
Text description of the video scene.
modelstring
Model ID. Defaults to 'grok-imagine-t2v'. Use list_video_models for the full list.
durationinteger
Duration in seconds. Grok Imagine accepts 6-15; other models have their own ranges (see list_video_models).
resolutionenum
Output resolution. Default depends on model.
480p720p1080p2K
aspectRatiostring
Aspect ratio (e.g. '16:9', '9:16', '1:1').
imageUrlstring
Public URL of starting image. Required for I2V models.
endImageUrlstring
Public URL of ending image. Supported by some I2V models (first+last frame).
modeenum
Moderation mode for Grok Imagine. Defaults to 'normal'.
funnormalspicy
aetherwave_list_image_modelsтолько чтениевнешний мир
Возвращает все модели генерации изображений, которые поддерживает AetherWave, с указанием стоимости в кредитах, соотношения сторон по умолчанию, поддерживаемых входных данных (T2I и I2I) и опций, специфичных для модели. Вызывай эту функцию перед generate_image, если не знаешь правильный ID модели. Ключ модели (например, 'grok-imagine-t2i') — это то, что ты передаёшь как `model` в generate_image.
List available image models
Возвращает все модели генерации изображений, которые поддерживает AetherWave, с указанием стоимости в кредитах, соотношения сторон по умолчанию, поддерживаемых входных данных (T2I и I2I) и опций, специфичных для модели. Вызывай эту функцию перед generate_image, если не знаешь правильный ID модели. Ключ модели (например, 'grok-imagine-t2i') — это то, что ты передаёшь как `model` в generate_image.
Параметры
Без параметров.
aetherwave_list_master_presetsтолько чтениевнешний мир
Возвращает все пресеты AI-мастеринга, которые поддерживает AetherWave: с целевыми LUFS, тегами, описаниями и уровнем сложности. Вызывай это перед master_audio, если не знаешь, какой пресет подходит треку. Всего 12 пресетов, охватывающих стили: стриминг, хип-хоп, EDM, поп, рок, lo-fi, R&B, акустика, саундтрек, подкаст, gentle и loud-and-punchy. У каждого пресета есть целевое значение LUFS (например, -14 для стриминга, -9 для громкого), чтобы можно было подобрать под цель распространения пользователя.
List available audio mastering presets
Возвращает все пресеты AI-мастеринга, которые поддерживает AetherWave: с целевыми LUFS, тегами, описаниями и уровнем сложности. Вызывай это перед master_audio, если не знаешь, какой пресет подходит треку. Всего 12 пресетов, охватывающих стили: стриминг, хип-хоп, EDM, поп, рок, lo-fi, R&B, акустика, саундтрек, подкаст, gentle и loud-and-punchy. У каждого пресета есть целевое значение LUFS (например, -14 для стриминга, -9 для громкого), чтобы можно было подобрать под цель распространения пользователя.
Параметры
Без параметров.
aetherwave_list_my_creationsтолько чтениевнешний мир
Возвращает элементы из галереи аутентифицированного пользователя — изображения, видео, аудиотреки, которые он создал на AetherWave. Полезно для агентских рабочих процессов вроде «найди мои последние 5 изображений и измени их формат на 9:16» или «перечисли мои недавние треки и обработай каждый». Поддерживает пагинацию и фильтрацию по типу. Каждый элемент включает id, type, prompt, model, contentUrl, thumbnailUrl, createdAt, isFavorite, visibility, rating и поля, зависящие от типа (duration для аудио/видео, width/height для изображений).
List my AetherWave gallery items
Возвращает элементы из галереи аутентифицированного пользователя — изображения, видео, аудиотреки, которые он создал на AetherWave. Полезно для агентских рабочих процессов вроде «найди мои последние 5 изображений и измени их формат на 9:16» или «перечисли мои недавние треки и обработай каждый». Поддерживает пагинацию и фильтрацию по типу. Каждый элемент включает id, type, prompt, model, contentUrl, thumbnailUrl, createdAt, isFavorite, visibility, rating и поля, зависящие от типа (duration для аудио/видео, width/height для изображений).
Параметры
typeenum
Filter to a single media type. Omit for all types.
imagevideoaudio
limitinteger
Max items to return. Defaults to 100, max 500.
offsetinteger
Pagination offset. Defaults to 0.
favoritesOnlyboolean
If true, only return items marked as favorite.
aetherwave_list_video_modelsтолько чтениевнешний мир
Возвращает все модели генерации видео, которые поддерживает AetherWave (Grok Imagine, Wan 2.7, Hailuo 02, Seedance Pro/Lite, Kling 2.6 с аудио, VEO 3.1, Happy Horse и другие), с указанием стоимости за секунду в кредитах, поддерживаемых длительностей, разрешений, соотношений сторон и того, требуется ли модели входное изображение (I2V). Вызывай этот инструмент перед generate_video, если не знаешь правильный ID модели.
List available video models
Возвращает все модели генерации видео, которые поддерживает AetherWave (Grok Imagine, Wan 2.7, Hailuo 02, Seedance Pro/Lite, Kling 2.6 с аудио, VEO 3.1, Happy Horse и другие), с указанием стоимости за секунду в кредитах, поддерживаемых длительностей, разрешений, соотношений сторон и того, требуется ли модели входное изображение (I2V). Вызывай этот инструмент перед generate_video, если не знаешь правильный ID модели.
Параметры
Без параметров.
aetherwave_master_audioвнешний мир
Отправляет аудиофайл на AI-мастеринг и синхронно возвращает URL обработанного трека (внутренне маршрут опрашивает Python-сервис; ожидайте от 30 секунд до 5 минут). Полезно как финальный этап обработки после генерации музыки. Стоимость: 20 кредитов за трек. Тарифы Producer, Mogul и Ultimate получают мастеринг бесплатно. На выходе WAV (~50 МБ за трёхминутный трек, без потерь для редистрибуции). Выберите preset, чтобы задать стиль мастеринга; вызовите `aetherwave_list_master_presets` для полного актуального списка (12 пресетов: streaming, loud, gentle, hip_hop, edm, pop, rock, lofi, rnb, acoustic, cinematic, podcast). У каждого пресета есть целевое значение LUFS, чтобы подобрать его под целевую платформу распространения.
Master an audio track (AI mastering)
Отправляет аудиофайл на AI-мастеринг и синхронно возвращает URL обработанного трека (внутренне маршрут опрашивает Python-сервис; ожидайте от 30 секунд до 5 минут). Полезно как финальный этап обработки после генерации музыки. Стоимость: 20 кредитов за трек. Тарифы Producer, Mogul и Ultimate получают мастеринг бесплатно. На выходе WAV (~50 МБ за трёхминутный трек, без потерь для редистрибуции). Выберите preset, чтобы задать стиль мастеринга; вызовите `aetherwave_list_master_presets` для полного актуального списка (12 пресетов: streaming, loud, gentle, hip_hop, edm, pop, rock, lofi, rnb, acoustic, cinematic, podcast). У каждого пресета есть целевое значение LUFS, чтобы подобрать его под целевую платформу распространения.
Параметры
audioUrlstringобязательный
Public URL to the source audio file (MP3 or WAV).
presetstringобязательный
Mastering preset name. Must be one of: 'streaming', 'loud', 'gentle', 'hip_hop', 'edm', 'pop', 'rock', 'lofi', 'rnb', 'acoustic', 'cinematic', 'podcast'. Call aetherwave_list_master_presets for full metadata (target LUFS, description, tags).
trackTitlestring
Optional title for the mastered output (used in gallery row label).
aetherwave_reframe_imageвнешний мир
Изменяет соотношение сторон изображения с помощью интеллектуального дорисовывания краёв. Передайте публичный `imageUrl` и целевое `aspectRatio` ('16:9', '9:16', '1:1', '4:3', '3:4' и т.д.). Три уровня скорости: 'turbo' (5 cr, быстро), 'balanced' (10 cr, по умолчанию), 'quality' (14 cr, медленнее всего, лучшие края). Возвращает URL перекомпонованного изображения.
Reframe image to a new aspect ratio (Ideogram V3 Reframe)
Изменяет соотношение сторон изображения с помощью интеллектуального дорисовывания краёв. Передайте публичный `imageUrl` и целевое `aspectRatio` ('16:9', '9:16', '1:1', '4:3', '3:4' и т.д.). Три уровня скорости: 'turbo' (5 cr, быстро), 'balanced' (10 cr, по умолчанию), 'quality' (14 cr, медленнее всего, лучшие края). Возвращает URL перекомпонованного изображения.
Параметры
imageUrlstringобязательный
Public URL of the source image.
aspectRatiostringобязательный
Target aspect ratio (e.g. '16:9', '9:16', '1:1', '4:3', '3:4', '21:9').
Переформатирует видео под новое соотношение сторон, интеллектуально дорисовывая или кадрируя края. Передайте публичный `videoUrl` и целевое `reframeAspectRatio`. 17 кредитов в секунду. Опциональный `reframePrompt` управляет содержимым новых краев (например, 'добавьте небо с закатными облаками'). Возвращает URL переформатированного видео (хостинг R2).
Reframe video to a new aspect ratio (Luma Ray 2 Flash)
Переформатирует видео под новое соотношение сторон, интеллектуально дорисовывая или кадрируя края. Передайте публичный `videoUrl` и целевое `reframeAspectRatio`. 17 кредитов в секунду. Опциональный `reframePrompt` управляет содержимым новых краев (например, 'добавьте небо с закатными облаками'). Возвращает URL переформатированного видео (хостинг R2).
Параметры
videoUrlstringобязательный
Public URL of the source video (MP4).
reframeAspectRatioenumобязательный
Target aspect ratio.
16:99:161:14:33:421:9
reframePromptstring
Optional prompt to steer the new edge content.
aetherwave_remove_backgroundвнешний мир
Удаляет фон с изображения, возвращает PNG с прозрачным альфа-каналом. Передайте публичный `imageUrl`. Полезно для предметной съёмки, вырезания персонажей, изоляции логотипов или компоновки на новом фоне. ~5 кредитов за изображение. Recraft — основной провайдер; при сбое инструмент автоматически переключается на fal.ai BiRefNet v2, поэтому вызовы для отдельных изображений никогда не завершаются молчаливым сбоем. Лучше всего работает с фотографическими объектами (люди, товары, животные); входные PNG с прозрачностью не имеют переднего плана для сегментации.
Remove background from image (Recraft + fal.ai BiRefNet v2 fallback)
Удаляет фон с изображения, возвращает PNG с прозрачным альфа-каналом. Передайте публичный `imageUrl`. Полезно для предметной съёмки, вырезания персонажей, изоляции логотипов или компоновки на новом фоне. ~5 кредитов за изображение. Recraft — основной провайдер; при сбое инструмент автоматически переключается на fal.ai BiRefNet v2, поэтому вызовы для отдельных изображений никогда не завершаются молчаливым сбоем. Лучше всего работает с фотографическими объектами (люди, товары, животные); входные PNG с прозрачностью не имеют переднего плана для сегментации.
Параметры
imageUrlstringобязательный
Public URL of the source image.
aetherwave_remove_background_videoвнешний мир
Удаляет фон из видео покадрово с помощью rembg (u2netp) на Python-сервисе AetherWave. Передайте публичный `videoUrl`. Выберите `bgType: "transparent"` для выходного WebM с альфа-каналом (композитинг) или `bgType: "color"` с hex-кодом `customColor` для замены сплошным цветом. 2 кредита за секунду. Самый медленный инструмент (покадровая обработка): 6-секундный клип обрабатывается ~4 минуты, 30-секундный ~15-20 минут. Лучше всего работает на объектах с чёткими краями (люди, товары). Возвращает URL обработанного видео (размещено на R2).
Remove background from video
Удаляет фон из видео покадрово с помощью rembg (u2netp) на Python-сервисе AetherWave. Передайте публичный `videoUrl`. Выберите `bgType: "transparent"` для выходного WebM с альфа-каналом (композитинг) или `bgType: "color"` с hex-кодом `customColor` для замены сплошным цветом. 2 кредита за секунду. Самый медленный инструмент (покадровая обработка): 6-секундный клип обрабатывается ~4 минуты, 30-секундный ~15-20 минут. Лучше всего работает на объектах с чёткими краями (люди, товары). Возвращает URL обработанного видео (размещено на R2).
Hex color for solid background when bgType='color' (e.g. '#00ff00'). Default green.
aetherwave_upscale_imageвнешний мир
Увеличивает разрешение исходного изображения с помощью высокоточного апскейлера Topaz. Передайте публичный `imageUrl` и коэффициент масштабирования `upscaleFactor`. Стоимость в кредитах зависит от исходного разрешения, умноженного на коэффициент: маленькие изображения стоят дешевле больших при одинаковом коэффициенте. Возвращает URL увеличенного изображения.
Upscale image (Topaz)
Увеличивает разрешение исходного изображения с помощью высокоточного апскейлера Topaz. Передайте публичный `imageUrl` и коэффициент масштабирования `upscaleFactor`. Стоимость в кредитах зависит от исходного разрешения, умноженного на коэффициент: маленькие изображения стоят дешевле больших при одинаковом коэффициенте. Возвращает URL увеличенного изображения.
Параметры
imageUrlstringобязательный
Public URL of the source image.
upscaleFactorenum
Upscale multiplier. Defaults to '2x'. '8x' is heavy; use only on small sources.
1x2x4x8x
aetherwave_upscale_videoвнешний мир
Повышает разрешение исходного видео до 1080p или 2K с помощью Atlas. Передайте публичный `videoUrl` и целевое разрешение. Стоимость посекундная (7 cr/s @ 1080p, 9 cr/s @ 2K). Ограничения со стороны Atlas: клипы до 53 с при 1080p, 23 с при 2K, исходное видео должно быть <=30 fps. Возвращает URL увеличенного видео (размещено на R2).
Upscale video (Atlas Video Upscaler)
Повышает разрешение исходного видео до 1080p или 2K с помощью Atlas. Передайте публичный `videoUrl` и целевое разрешение. Стоимость посекундная (7 cr/s @ 1080p, 9 cr/s @ 2K). Ограничения со стороны Atlas: клипы до 53 с при 1080p, 23 с при 2K, исходное видео должно быть <=30 fps. Возвращает URL увеличенного видео (размещено на R2).
Параметры
videoUrlstringобязательный
Public URL of the source video (MP4).
targetResolutionenum
Target output resolution. Defaults to '1080p'. '2k' is more expensive and limited to ~23s clips.