# Create Video > Crea vídeos a partir de un prompt de texto con el Video Agent de HeyGen. Úsalo para explicativos, demos o vídeos de marketing sin especificar avatares, voces ni escenas. Fuente: https://skillsagentes.com/skills/calesthio/openmontage/create-video Markdown: https://skillsagentes.com/skills/calesthio/openmontage/create-video.md Repositorio: https://github.com/calesthio/OpenMontage Autor: calesthio Licencia: AGPL-3.0 Actualizado: hace 4 meses Coste de contexto: 100 tok instalada, 1.3k tok al activarse, 23.6k tok con todos los archivos del bundle Bundle: 10 archivos, 92 KB Permisos que pide: mcp__heygen__* ## Instalación Un skill son archivos markdown: los mismos archivos valen para cualquier agente y lo único que cambia es el directorio de destino, es decir la bandera `--agent`. Añade `-g` para instalarlo en todos los proyectos de la máquina. ```bash # Claude Code npx -y skills add calesthio/OpenMontage --skill create-video --agent claude-code # Cursor npx -y skills add calesthio/OpenMontage --skill create-video --agent cursor # Codex npx -y skills add calesthio/OpenMontage --skill create-video --agent codex # Gemini CLI npx -y skills add calesthio/OpenMontage --skill create-video --agent gemini # Windsurf npx -y skills add calesthio/OpenMontage --skill create-video --agent windsurf # Cline npx -y skills add calesthio/OpenMontage --skill create-video --agent cline ``` ## Qué hace - Crea un vídeo completo desde un prompt de texto con el Video Agent de HeyGen - La IA resuelve guion, avatar y visuales: tú solo describes la idea - Sirve para prototipos y borradores rápidos en una sola pasada ## Cuándo usarla - Crear un vídeo a partir de una descripción o una idea - Generar vídeos explicativos, demos o de marketing desde un prompt - Hacer un vídeo sin especificar avatares, voces ni escenas - El usuario dice "hazme un vídeo sobre X" ## Cuándo no - Hace falta control preciso sobre avatares, guiones exactos, voz o fondo por escena, o composición multiescena: para eso está el skill `avatar-video` ## Qué la activa - "Hazme un vídeo sobre este producto" - "Crea una demo en vídeo de esta función" - "Necesito un explicativo rápido de este tema" ## Antes de instalar - Necesita `HEYGEN_API_KEY` y las herramientas `mcp__heygen__*`. - Necesita en el PATH: curl - Variables de entorno: HEYGEN_API_KEY - makes network requests - needs API credentials ## Archivos - SKILL.md — 5 KB - references/assets.md — 9 KB - references/dimensions.md — 7 KB - references/prompt-examples.md — 8 KB - references/prompt-optimizer.md — 12 KB - references/quota.md — 5 KB - references/video-agent.md — 10 KB - references/video-status.md — 13 KB - references/visual-styles.md — 15 KB - references/webhooks.md — 9 KB ## SKILL.md Reproducido tal cual desde calesthio/OpenMontage bajo AGPL-3.0. Esta sección es el documento original y está en inglés. # Create Video Generate complete videos from a text prompt. Describe what you want and the AI handles script writing, avatar selection, visuals, voiceover, pacing, and captions automatically. ## Authentication All requests require the `X-Api-Key` header. Set the `HEYGEN_API_KEY` environment variable. ```bash curl -X POST "https://api.heygen.com/v1/video_agent/generate" \ -H "X-Api-Key: $HEYGEN_API_KEY" \ -H "Content-Type: application/json" \ -d '{"prompt": "Create a 60-second product demo video."}' ``` ## Tool Selection If HeyGen MCP tools are available (`mcp__heygen__*`), **prefer them** over direct HTTP API calls — they handle authentication and request formatting automatically. | Task | MCP Tool | Fallback (Direct API) | |------|----------|----------------------| | Generate video from prompt | `mcp__heygen__generate_video_agent` | `POST /v1/video_agent/generate` | | Check video status / get URL | `mcp__heygen__get_video` | `GET /v2/videos/{video_id}` | | List account videos | `mcp__heygen__list_videos` | `GET /v2/videos` | | Delete a video | `mcp__heygen__delete_video` | `DELETE /v2/videos/{video_id}` | If no HeyGen MCP tools are available, use direct HTTP API calls as documented in the reference files. ## Default Workflow Always use [prompt-optimizer.md](references/prompt-optimizer.md) guidelines to structure prompts with scenes, timing, and visual styles. **With MCP tools:** 1. Write an optimized prompt using [prompt-optimizer.md](references/prompt-optimizer.md) → [visual-styles.md](references/visual-styles.md) 2. Call `mcp__heygen__generate_video_agent` with prompt and config (duration_sec, orientation, avatar_id) 3. Call `mcp__heygen__get_video` with the returned video_id to poll status and get the download URL **Without MCP tools (direct API):** 1. Write an optimized prompt using [prompt-optimizer.md](references/prompt-optimizer.md) → [visual-styles.md](references/visual-styles.md) 2. `POST /v1/video_agent/generate` — see [video-agent.md](references/video-agent.md) 3. `GET /v2/videos/` — see [video-status.md](references/video-status.md) ## Quick Reference | Task | MCP Tool | Read | |------|----------|------| | Generate video from prompt | `mcp__heygen__generate_video_agent` | [prompt-optimizer.md](references/prompt-optimizer.md) → [visual-styles.md](references/visual-styles.md) → [video-agent.md](references/video-agent.md) | | Check video status / get download URL | `mcp__heygen__get_video` | [video-status.md](references/video-status.md) | | Upload reference files for prompt | — | [assets.md](references/assets.md) | ## When to Use This Skill vs Avatar Video This skill is for **prompt-based video creation** — describe what you want, and the AI handles the rest. If the user needs **precise control** over specific avatars, exact scripts, per-scene voice/background configuration, or multi-scene composition, use the **avatar-video** skill instead. | User Says | This Skill | Avatar Video Skill | |-----------|:----------:|:------------------:| | "Make me a video about X" | ✓ | | | "Create a product demo" | ✓ | | | "I want avatar Y to say exactly Z" | | ✓ | | "Multi-scene video with different backgrounds" | | ✓ | | "Transparent WebM for compositing" | | ✓ | ## Reference Files ### Core Workflow - [references/prompt-optimizer.md](references/prompt-optimizer.md) - Writing effective prompts (core workflow + rules) - [references/visual-styles.md](references/visual-styles.md) - 20 named visual styles with full specs - [references/prompt-examples.md](references/prompt-examples.md) - Full production prompt example + ready-to-use templates - [references/video-agent.md](references/video-agent.md) - Video Agent API endpoint details ### Foundation - [references/video-status.md](references/video-status.md) - Polling patterns and download URLs - [references/webhooks.md](references/webhooks.md) - Webhook endpoints and events - [references/assets.md](references/assets.md) - Uploading images, videos, audio as references - [references/dimensions.md](references/dimensions.md) - Resolution and aspect ratios - [references/quota.md](references/quota.md) - Credit system and usage limits ## Best Practices 1. **Optimize your prompt** — The difference between mediocre and professional results depends entirely on prompt quality. Always use the prompt optimizer 2. **Specify duration** — Use `config.duration_sec` for predictable length 3. **Lock avatar if needed** — Use `config.avatar_id` for consistency across videos 4. **Upload reference files** — Help the agent understand your brand/product 5. **Iterate on prompts** — Refine based on results; Video Agent is great for quick iterations ## Dónde encaja - Categoría: [Diseño y UI](https://skillsagentes.com/categorias/diseno-ui.md) — Sistemas de diseño, trabajo con componentes y acabado visual. - Creador: [calesthio](https://skillsagentes.com/creators/calesthio.md) — 0 skills en el directorio - [Todas las skills](https://skillsagentes.com/skills.md) - [Ranking de instalaciones](https://skillsagentes.com/ranking.md) ## Otras skills del mismo repositorio - [Seedance 2 5](https://skillsagentes.com/skills/calesthio/openmontage/seedance-2-5.md): Genera vídeo cinematográfico de 4-30 s con ByteDance Seedance 2.5 por fal.ai, Volcengine Ark, Runway o ComfyUI. Cubre el contrato de prompt 2.5, cortes duros, locks de continuidad y voz. - [Comfyui](https://skillsagentes.com/skills/calesthio/openmontage/comfyui.md): Úsalo al trabajar con workflows de ComfyUI en OpenMontage: comfyui_image/video/music, workflows propios, selección de output_node, modelos que faltan, LoRAs, poca VRAM e importación de workflows de la comunidad. - [Fish Audio Tts](https://skillsagentes.com/skills/calesthio/openmontage/fish-audio-tts.md): Genera narración expresiva y multilingüe con fish.audio (modelos S1 / S2) y reutiliza voces clonadas mediante reference_id. - [Minimax H3](https://skillsagentes.com/skills/calesthio/openmontage/minimax-h3.md): Genera vídeo con MiniMax H3 (Hailuo 3.0) por la API oficial v2, fal.ai, Runway, nodos partner de ComfyUI o pesos abiertos locales. Clips de 4-15s a 2K con animación de primer/último fotograma. - [Gemini Omni](https://skillsagentes.com/skills/calesthio/openmontage/gemini-omni.md): Genera y edita conversacionalmente vídeos cortos con Google Gemini Omni Flash: itera con ediciones en lenguaje natural, clips de 3-10s a 720p con audio y texto en pantalla, e imágenes de referencia por etiquetas. --- Skills Agentes · [Índice de páginas en markdown](https://skillsagentes.com/sitemap.md) · [Inicio](https://skillsagentes.com/index.md)