Skills Agentes

Avatar Video

Crea vídeos de avatar con IA controlando avatar, voz, guion, escenas y fondos mediante la API v2 de HeyGen, incluido WebM transparente e integración con Remotion.

Solicitamcp__heygen__*
Estrellas
60.6k

en todo el repo

Actividad
36

0–100, la ruta de este skill

Actualizado
hace 6 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.7k tok

140 tok en reposo

Paquete
16 archivos

177 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add calesthio/OpenMontage --skill avatar-video --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests, needs API credentials.

Qué hace

  • Crea vídeos de avatar con la API v2 de HeyGen eligiendo avatar, voz y guion exactos
  • Monta vídeos multiescena con un fondo distinto por escena
  • Genera WebM transparente para composición posterior y admite fotos parlantes como presentador
  • Integra los avatares de HeyGen con Remotion y permite generación por lotes con especificaciones exactas

Úsalo cuando

  • Quieres control preciso: eliges el avatar, escribes el guion exacto y configuras cada escena
  • Hace falta un vídeo multiescena con fondos distintos
  • Hace falta un WebM transparente para componer encima
  • Producción de vídeo con marca consistente y especificaciones exactas

No lo uses cuando

  • El usuario solo describe una idea de vídeo y deja que la IA resuelva guion, avatar y visuales: para eso está el skill `create-video`

Qué lo activa

Di cualquiera de estas frases y el agente debería cargar este skill.

  • “Quiero que este avatar diga exactamente este guion”
  • “Hazme un vídeo multiescena con fondos distintos”
  • “Genera un WebM transparente con este presentador”
  • “Usa esta voz concreta para mi guion”

SKILL.md

En inglés

Avatar Video

Create AI avatar videos with full control over avatars, voices, scripts, scenes, and backgrounds. Build single or multi-scene videos with exact configuration using HeyGen's /v2/video/generate API.

Authentication

All requests require the X-Api-Key header. Set the HEYGEN_API_KEY environment variable.

curl -X GET "https://api.heygen.com/v2/avatars" \
  -H "X-Api-Key: $HEYGEN_API_KEY"

Tool Selection

If HeyGen MCP tools are available (mcp__heygen__*), prefer them over direct HTTP API calls — they handle authentication and request formatting automatically.

Task MCP Tool Fallback (Direct API)
Check video status / get URL mcp__heygen__get_video GET /v2/videos/{video_id}
List account videos mcp__heygen__list_videos GET /v2/videos
Delete a video mcp__heygen__delete_video DELETE /v2/videos/{video_id}

Video generation (POST /v2/video/generate) and avatar/voice listing are done via direct API calls — see reference files below.

Default Workflow

  1. List avatars — GET /v2/avatars → pick an avatar, preview it, note avatar_id and default_voice_id. See avatars.md
  2. List voices (if needed) — GET /v2/voices → pick a voice matching the avatar's gender/language. See voices.md
  3. Write the script — Structure scenes with one concept each. See scripts.md
  4. Generate the video — POST /v2/video/generate with avatar, voice, script, and background per scene. See video-generation.md
  5. Poll for completion — GET /v2/videos/{video_id} until status is completed. See video-status.md

Quick Reference

Task Read
List and preview avatars avatars.md
List and select voices voices.md
Write and structure scripts scripts.md
Generate video (single or multi-scene) video-generation.md
Add custom backgrounds backgrounds.md
Add captions / subtitles captions.md
Add text overlays text-overlays.md
Create transparent WebM video video-generation.md (WebM section)
Use templates templates.md
Create avatar from photo photo-avatars.md
Check video status / download video-status.md
Upload assets (images, audio) assets.md
Use with Remotion remotion-integration.md
Set up webhooks webhooks.md

When to Use This Skill vs Create Video

This skill is for precise control — you choose the avatar, write the exact script, configure each scene.

If the user just wants to describe a video idea and let AI handle the rest (script, avatar, visuals), use the create-video skill instead.

User Says Create Video Skill This Skill
"Make me a video about X" ✓
"Create a product demo" ✓
"I want avatar Y to say exactly Z" ✓
"Multi-scene video with different backgrounds" ✓
"Transparent WebM for compositing" ✓
"Use this specific voice for my script" ✓
"Batch generate videos with exact specs" ✓

Reference Files

Core Video Creation

Video Customization

Advanced Features

Integration

Foundation

Best Practices

  1. Preview avatars before generating — Download preview_image_url so the user can see the avatar before committing
  2. Use avatar's default voice — Most avatars have a default_voice_id pre-matched for natural results
  3. Fallback: match gender manually — If no default voice, ensure avatar and voice genders match
  4. Use test mode for development — Set test: true to avoid consuming credits (output will be watermarked)
  5. Set generous timeouts — Video generation often takes 5-15 minutes, sometimes longer
  6. Validate inputs — Check avatar and voice IDs exist before generating

Reproducido de calesthio/OpenMontage bajo licencia AGPL-3.0. Leer esta página en markdown.

Archivos

16 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

Antes de instalar

Necesita `HEYGEN_API_KEY` y las herramientas `mcp__heygen__*`.

Necesita en el PATH:curl

Variables de entorno:HEYGEN_API_KEY

Detalles

Creador
calesthio
Licencia
AGPL-3.0
Recursos incluidos
referencias
Código fuente
Ver SKILL.md

Etiquetas

Más de calesthio/OpenMontage

Este repo incluye 89 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack OpenMontage entero y su comando de instalación

Comfyui

60.6k

Úsalo al trabajar con workflows de ComfyUI en OpenMontage: comfyui_image/video/music, workflows propios, selección de output_node, modelos que faltan, LoRAs, poca VRAM e importación de workflows de la comunidad.

Costo de contexto al activarse
1.9k tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
diseno ui

Genera vídeo cinematográfico de 4-30 s con ByteDance Seedance 2.5 por fal.ai, Volcengine Ark, Runway o ComfyUI. Cubre el contrato de prompt 2.5, cortes duros, locks de continuidad y voz.

Costo de contexto al activarse
3.2k tok
Tamaño del paquete
2 archivos
Última actualización
el mes pasado
video

Genera narración expresiva y multilingüe con fish.audio (modelos S1 / S2) y reutiliza voces clonadas mediante reference_id.

Costo de contexto al activarse
1.4k tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
diseno ui

Genera y edita conversacionalmente vídeos cortos con Google Gemini Omni Flash: itera con ediciones en lenguaje natural, clips de 3-10s a 720p con audio y texto en pantalla, e imágenes de referencia por etiquetas.

Costo de contexto al activarse
2.1k tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
Permisos
video

Genera vídeo con MiniMax H3 (Hailuo 3.0) por la API oficial v2, fal.ai, Runway, nodos partner de ComfyUI o pesos abiertos locales. Clips de 4-15s a 2K con animación de primer/último fotograma.

Costo de contexto al activarse
582 tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
video

Genera, reconstruye, inspecciona y enruta activos 3D de producción para mundos de OpenMontage con Atlas Cloud, fal.ai, catálogos con licencia y Blender.

Costo de contexto al activarse
1.2k tok
Tamaño del paquete
2 archivos
Última actualización
el mes pasado
diseno ui

Skills relacionados

Genera vídeos con IA desde texto usando varias pasarelas — HeyGen, fal.ai, Kling y Gemini — con soporte de imagen a vídeo y comparación entre VEO, Kling, Sora, Runway, Seedance y MiniMax.

Costo de contexto al activarse
3k tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
video

Genera o edita imágenes y vídeos por la pasarela Atlas Cloud: Seedance 2.5/2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 con una sola ATLASCLOUD_API_KEY.

Costo de contexto al activarse
1.2k tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
video

Revisa animación de personaje local con comprobaciones de esquema, previsualizaciones en navegador con Playwright, muestreo de fotogramas y verificación final con FFmpeg/ffprobe.

Costo de contexto al activarse
389 tok
Tamaño del paquete
1 archivo
Última actualización
hace 5 meses
video