Skills Agentes

Minimax H3

Genera vídeo con MiniMax H3 (Hailuo 3.0) por la API oficial v2, fal.ai, Runway, nodos partner de ComfyUI o pesos abiertos locales. Clips de 4-15s a 2K con animación de primer/último fotograma.

Estrellas
49.5k

en todo el repo

Actividad
60

0–100, la ruta de este skill

Actualizado
hace 9 días

último commit aquí

Commits
2

últimos 90 días

Contexto
582 tok

64 tok en reposo

Paquete
1 archivo

2 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add calesthio/OpenMontage --skill minimax-h3 --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Genera vídeo con MiniMax H3 (Hailuo 3.0) por varias rutas: API oficial v2 de MiniMax, fal.ai, Runway, nodos partner de ComfyUI o pesos abiertos en local
  • Produce clips de 4 a 15 segundos a 2K
  • Admite animación de primer y último fotograma
  • Admite vídeo condicionado por referencias de imagen, vídeo o audio
  • Documenta las diferencias entre proveedores y cómo elegir ruta

Úsalo cuando

  • Generar clips de 4 a 15 segundos a 2K
  • Animar entre un primer y un último fotograma
  • Generar vídeo condicionado por referencias de imagen, vídeo o audio

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera un clip de 10 segundos con MiniMax H3
    • Anima de esta imagen a esta otra
    • Usa estas referencias de audio e imagen para el clip

    SKILL.md

    En inglés

    MiniMax H3

    MiniMax H3 is the Hailuo 3.0 family. The first-party API identifier is MiniMax-H3; fal.ai exposes the family as hailuo-03, and Runway uses hailuo3. Do not substitute one provider's identifier into another API.

    Choose a route

    Route Tool call Execution
    MiniMax direct minimax_video, model: "MiniMax-H3" Hosted first-party v2 API; global or mainland-China region
    fal.ai minimax_fal_video Hosted gateway; T2V, I2V, reference-to-video
    Runway runway_video, model: "hailuo3" Hosted; 768P or 2K, 5–15 seconds
    ComfyUI Partner Node comfyui_video, model_family: "minimax_h3_api" Hosted and billed in Comfy credits
    ComfyUI open weights comfyui_video, model_family: "minimax_h3_local" Local GPU with official workflow and model stack

    For local ComfyUI, export the official workflow in API format and pass workflow_json or workflow_path plus output_node. OpenMontage reports the required diffusion model, Qwen3-VL text encoder, video VAE, and audio VAE; it does not silently download large weights.

    Operations and prompting

    • Text-to-video: concrete ratio; do not use adaptive without visual input.
    • Image-to-video: provide a first frame.
    • First/last-frame: provide both images and describe the motion between them.
    • Reference-to-video: images, videos, and audio can be combined. Audio needs at least one visual reference.

    Write prompts as subject + action + camera path + environment + lighting + audio intent. MiniMax responds well to explicit camera direction. Keep the requested motion achievable within 4–15 seconds and inspect native audio as carefully as the image track.

    Provider differences

    The direct MiniMax v2 route currently outputs 2K and supports 4–15 seconds. Runway's Hailuo 3.0 route supports 768P/2K and documents 5–15 seconds. Partner Nodes require network access and credits. Only the open-weight ComfyUI route is local/offline after all models are installed.

    Reproducido de calesthio/OpenMontage bajo licencia AGPL-3.0. Leer esta página en markdown.

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Según la ruta elegida necesita credenciales de MiniMax v2, fal.ai o Runway, o bien ComfyUI con los pesos abiertos en local.

    Detalles

    Creador
    calesthio
    Categoría
    Diseño y UI
    Licencia
    AGPL-3.0
    Recursos incluidos
    Solo SKILL.md
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de calesthio/OpenMontage

    Este repo incluye 89 skills. Si instalas uno, normalmente ya tienes los demás.

    Comfyui

    49.5k

    Úsalo al trabajar con workflows de ComfyUI en OpenMontage: comfyui_image/video/music, workflows propios, selección de output_node, modelos que faltan, LoRAs, poca VRAM e importación de workflows de la comunidad.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 9 días
    diseno ui

    Genera vídeo cinematográfico de 4-30 s con ByteDance Seedance 2.5 por fal.ai, Volcengine Ark, Runway o ComfyUI. Cubre el contrato de prompt 2.5, cortes duros, locks de continuidad y voz.

    Costo de contexto al activarse
    3.2k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 4 días
    diseno ui

    Genera narración expresiva y multilingüe con fish.audio (modelos S1 / S2) y reutiliza voces clonadas mediante reference_id.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 9 días
    diseno ui

    Genera y edita conversacionalmente vídeos cortos con Google Gemini Omni Flash: itera con ediciones en lenguaje natural, clips de 3-10s a 720p con audio y texto en pantalla, e imágenes de referencia por etiquetas.

    Costo de contexto al activarse
    2.1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 9 días
    Permisos
    diseno ui

    Genera, reconstruye, inspecciona y enruta activos 3D de producción para mundos de OpenMontage con Atlas Cloud, fal.ai, catálogos con licencia y Blender.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 9 días
    diseno ui

    Genera o edita imágenes y vídeos por la pasarela Atlas Cloud: Seedance 2.5/2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 con una sola ATLASCLOUD_API_KEY.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 9 días
    diseno ui

    Skills relacionados

    Genera, reconstruye, inspecciona y enruta activos 3D de producción para mundos de OpenMontage con Atlas Cloud, fal.ai, catálogos con licencia y Blender.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 9 días
    diseno ui

    Acestep

    49.5k

    Generación musical con ACE-Step 1.5: música de fondo, pistas con voz, versiones y extracción de stems para producción de vídeo.

    Costo de contexto al activarse
    2.3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 meses
    diseno ui

    Genera vídeos con IA desde texto usando varias pasarelas — HeyGen, fal.ai, Kling y Gemini — con soporte de imagen a vídeo y comparación entre VEO, Kling, Sora, Runway, Seedance y MiniMax.

    Costo de contexto al activarse
    3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    diseno ui