# Atlas Cloud > Genera o edita imágenes y vídeos por la pasarela Atlas Cloud: Seedance 2.5/2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 con una sola ATLASCLOUD_API_KEY. Fuente: https://skillsagentes.com/skills/calesthio/openmontage/atlas-cloud Markdown: https://skillsagentes.com/skills/calesthio/openmontage/atlas-cloud.md Repositorio: https://github.com/calesthio/OpenMontage Autor: calesthio Licencia: AGPL-3.0 Actualizado: hace 9 días Coste de contexto: 64 tok instalada, 1.2k tok al activarse, 1.2k tok con todos los archivos del bundle Bundle: 1 archivo, 5 KB Permisos que pide: ninguno declarado ## Instalación Un skill son archivos markdown: los mismos archivos valen para cualquier agente y lo único que cambia es el directorio de destino, es decir la bandera `--agent`. Añade `-g` para instalarlo en todos los proyectos de la máquina. ```bash # Claude Code npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent claude-code # Cursor npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent cursor # Codex npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent codex # Gemini CLI npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent gemini # Windsurf npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent windsurf # Cline npx -y skills add calesthio/OpenMontage --skill atlas-cloud --agent cline ``` ## Qué hace - Enruta generación y edición de imagen y vídeo por la pasarela Atlas Cloud con una sola `ATLASCLOUD_API_KEY` - Cubre Seedance 2.5 y 2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 - Obliga a leer el `model_catalog` y a anunciar modelo, número de peticiones y coste antes de cada llamada de pago - Falla antes de facturar si la duración, resolución o ratio no son válidos, en vez de recortarlos en silencio - Guarda las salidas dentro del árbol `projects//` y las inspecciona ## Cuándo usarla - El usuario nombra Atlas Cloud o un modelo Atlas exacto - Interesa que una sola clave dé acceso a varias familias de modelos de medios - Hay que generar o editar imagen o vídeo con Seedance, Gemini Omni, MiniMax H3 o Seedream ## Cuándo no - Una producción completa: enrútala por `image_selector` o `video_selector` - Sustituir un endpoint directo del proveedor por una petición Atlas, o al revés ## Qué la activa - "Genera este vídeo con Seedance 2.5 en Atlas Cloud" - "Edita esta imagen con Seedream 5.0" - "Usa MiniMax H3 para este clip de referencia" ## Antes de instalar - Necesita `ATLASCLOUD_API_KEY` (los alias `ATLAS_CLOUD_API_KEY` y `ATLAS_API_KEY` también valen); todas las rutas son de pago por segundo o por imagen. ## Archivos - SKILL.md — 5 KB ## SKILL.md Reproducido tal cual desde calesthio/OpenMontage bajo AGPL-3.0. Esta sección es el documento original y está en inglés. # Atlas Cloud Route complete productions through `image_selector` or `video_selector`. Call `atlas_image` or `atlas_video` directly when the user names Atlas Cloud or an exact Atlas model. Never substitute a direct vendor endpoint for an Atlas request. Set `ATLASCLOUD_API_KEY`. The aliases `ATLAS_CLOUD_API_KEY` and `ATLAS_API_KEY` are accepted for compatibility. ## Preflight every paid call 1. Read `tool.get_info()["model_catalog"]`; do not infer availability from a search collection or invent a task suffix. 2. Select an exact model id and operation supported by that catalog. 3. Announce the Atlas tool, provider, exact model, request count, and estimated cost before submitting. 4. Use local-path inputs when convenient. The tool uploads them through Atlas. 5. Save outputs inside the active `projects//` tree and inspect them. ## Video routes | Family | Operations | Exact route notes | |---|---|---| | Seedance 2.5 | text, image, reference | `bytedance/seedance-2.5/{text,image,reference}-to-video`; image mode uses `image` plus optional `last_image`; reference mode accepts up to 30 images, 10 videos, and 10 audios (including audio-only); 4–30s; $0.134/s | | Seedance 2.0 | text, image, reference | `bytedance/seedance-2.0/{text,image,reference}-to-video`; 4–15s; $0.112/s | | Gemini Omni Flash | text, image, reference, video edit | Standard routes use `google/gemini-omni-flash/...`; developer routes exist for text/image/reference only. Standard image mode uses one `image`; standard reference uses `images`; developer reference requires one `video_clips` object. | | MiniMax H3 | text, image, reference | `minimax/h3/{text,image,reference}-to-video`; image mode supports optional `end_image`; reference mode requires `refers` objects; 4–15s; 768P/2K; $0.10/s | Use canonical OpenMontage fields: ```python tool.execute({ "prompt": "...", "model": "minimax/h3/reference-to-video", "operation": "reference_to_video", "duration": 10, "resolution": "2K", "reference_images": ["projects/demo/character.png"], "reference_audios": ["projects/demo/performance.wav"], "output_path": "projects/demo/h3.mp4", }) ``` For Gemini developer reference video, pass `video_clips` objects with `url`, `start`, and `ends`. For H3, callers may pass normalized `reference_images`, `reference_videos`, and `reference_audios`; the tool converts them to `refers`. Do not silently clamp duration, resolution, or ratio. Invalid values must fail before billing with the supported choices in the error. ## Image routes | Family | Operations | Exact route notes | |---|---|---| | Seedream 5.0 Pro | generate, edit, decompose | `bytedance/seedream-v5.0-pro/text-to-image`, `/edit`, `/layer-decomposition`; edit accepts up to 10 images; sizes use `WIDTH*HEIGHT` | | Seedream 5.0 Lite | edit | `bytedance/seedream-v5.0-lite/edit`; no live Lite text-to-image sibling is assumed; accepts up to 14 images | | GPT Image 2 | generate, edit | `openai/gpt-image-2/text-to-image`, `/edit`; sizes use `WIDTHxHEIGHT`; edit accepts up to 10 images | | Nano Banana 2 | generate, edit | `google/nano-banana-2/text-to-image`, `/edit`; uses aspect ratio plus 1k/2k/4k resolution; edit accepts up to 14 images | Set `generation_mode` to `generate`, `edit`, or `decompose`. Source images can be supplied as `image_path`, `image_paths`, `image_url`, or `image_urls`. ```python tool.execute({ "prompt": "Replace the packaging with matte cobalt glass; preserve the logo", "model": "google/nano-banana-2/edit", "generation_mode": "edit", "image_paths": ["projects/campaign/source.png"], "resolution": "2k", "output_path": "projects/campaign/revised.png", }) ``` ## Result and failure contract Both tools submit to Atlas, poll the returned prediction id, download every output, and return `ToolResult` provenance containing the provider, exact model, prediction id, submitted parameters, source URL, artifact paths, and estimated cost. A missing key, unsupported route, invalid enum, missing media input, failed prediction, timeout, or download failure must return a failed result without switching providers. Confirm current pricing and schemas from the machine-readable model page (`Accept: text/markdown`) immediately before quoting or spending on a batch. ## Dónde encaja - Categoría: [Diseño y UI](https://skillsagentes.com/categorias/diseno-ui.md) — Sistemas de diseño, trabajo con componentes y acabado visual. - Creador: [calesthio](https://skillsagentes.com/creators/calesthio.md) — 0 skills en el directorio - [Todas las skills](https://skillsagentes.com/skills.md) - [Ranking de instalaciones](https://skillsagentes.com/ranking.md) ## Otras skills del mismo repositorio - [Seedance 2 5](https://skillsagentes.com/skills/calesthio/openmontage/seedance-2-5.md): Genera vídeo cinematográfico de 4-30 s con ByteDance Seedance 2.5 por fal.ai, Volcengine Ark, Runway o ComfyUI. Cubre el contrato de prompt 2.5, cortes duros, locks de continuidad y voz. - [Comfyui](https://skillsagentes.com/skills/calesthio/openmontage/comfyui.md): Úsalo al trabajar con workflows de ComfyUI en OpenMontage: comfyui_image/video/music, workflows propios, selección de output_node, modelos que faltan, LoRAs, poca VRAM e importación de workflows de la comunidad. - [Fish Audio Tts](https://skillsagentes.com/skills/calesthio/openmontage/fish-audio-tts.md): Genera narración expresiva y multilingüe con fish.audio (modelos S1 / S2) y reutiliza voces clonadas mediante reference_id. - [Minimax H3](https://skillsagentes.com/skills/calesthio/openmontage/minimax-h3.md): Genera vídeo con MiniMax H3 (Hailuo 3.0) por la API oficial v2, fal.ai, Runway, nodos partner de ComfyUI o pesos abiertos locales. Clips de 4-15s a 2K con animación de primer/último fotograma. - [Gemini Omni](https://skillsagentes.com/skills/calesthio/openmontage/gemini-omni.md): Genera y edita conversacionalmente vídeos cortos con Google Gemini Omni Flash: itera con ediciones en lenguaje natural, clips de 3-10s a 720p con audio y texto en pantalla, e imágenes de referencia por etiquetas. --- Skills Agentes · [Índice de páginas en markdown](https://skillsagentes.com/sitemap.md) · [Inicio](https://skillsagentes.com/index.md)