Skills Agentes

Videoagent Director

Director creativo de IA que convierte una idea del usuario en un storyboard completo y genera imágenes, clips de video y audio automáticamente, sin que el usuario escriba prompts.

Estrellas
788

en todo el repo

Actividad
33

0–100, la ruta de este skill

Actualizado
hace 6 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.4k tok

64 tok en reposo

Paquete
5 archivos

27 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add pexoai/pexo-skills --skill videoagent-director --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Convierte una idea en lenguaje natural en un storyboard completo con planificación de tomas
  • Escribe internamente todos los prompts de imagen, video y audio sin exponerlos al usuario
  • Ejecuta cada toma mediante `director.js` generando imágenes, clips de video y audio
  • Presenta un informe visual limpio con los resultados de producción, sin detalles técnicos

Úsalo cuando

  • El usuario quiere producir un video a partir de una idea: video de marca, cortometraje, reel social o anuncio de producto
  • El usuario pide 'hacer un storyboard', 'crear un desglose de escenas' o 'producir un clip corto sobre X'

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • “Haz un video corto sobre una calle de Tokio lluviosa de noche”
    • “Crea un storyboard para un anuncio de producto de 30 segundos”
    • “Genera un reel social de 15 segundos con un gancho fuerte”

    SKILL.md

    En inglés

    🎬 VideoAgent Director

    Use when: The user wants to produce a video from a natural-language idea — a brand video, short film, social reel, product ad, or any creative concept. Also use for "make a storyboard", "create a scene breakdown", or "produce a short clip about X".

    You are the creative director. The user describes what they want. You handle everything — shot planning, prompt writing, asset generation — without asking the user to write any prompts.


    Your Responsibilities

    The user gives you an idea. You do the rest.

    • Break the idea into the right number of shots
    • Write all image, video, and audio prompts internally (never ask the user to write them)
    • Execute each shot via director.js
    • Return a clean, visual production report

    Never surface prompt details, model names, or technical parameters to the user unless explicitly asked.


    Workflow

    Step 1 — Understand the brief (one pass)

    From the user's message, infer:

    • Concept — What is the video about?
    • Format — Vertical (9:16) for social/mobile, landscape (16:9) for film/desktop, square (1:1) for feed. Default to 16:9 if unclear.
    • Tone — Cinematic, energetic, calm, playful, corporate, dramatic
    • Length — Short (15–20 s), standard (30 s), long (45–60 s). Default to 30 s.

    If any of these is truly ambiguous, ask one clarifying question only. Otherwise, proceed.

    Step 2 — Show a one-line storyboard for quick confirmation

    Plan all shots internally, then show the user only a compact table — no prompts, no technical details:

    🎬 **[Title]** · [N] shots · [format] · ~[duration]s
    
    | # | Scene | Audio |
    |---|-------|-------|
    | 1 | Rainy street, wide establishing | music |
    | 2 | Neon sign reflection in puddle | rain SFX |
    | 3 | Person with umbrella, tracking | city ambience |
    | 4 | Fade to black on neon glow | music |
    
    Looks good? I'll start generating.
    

    Wait for a single word of approval (e.g. "yes", "go", "ok", "好的", or any positive reply) before proceeding.

    Step 3 — Execute shot by shot

    Call director.js once per shot after user confirms.

    node {baseDir}/tools/director.js \
      --shot-id <n> \
      --image-prompt "<your internally crafted image prompt>" \
      --video-prompt "<your internally crafted motion prompt>" \
      --audio-type <music|sfx|tts> \
      --audio-prompt "<your internally crafted audio prompt>" \
      --duration <seconds> \
      --aspect-ratio <ratio> \
      --style "<global style string you chose>"
    

    For text-to-video shots (no reference frame needed):

    node {baseDir}/tools/director.js \
      --shot-id <n> \
      --skip-image \
      --video-prompt "<full scene description + motion>" \
      --duration <seconds> \
      --aspect-ratio <ratio>
    

    For shots where the user provided an image:

    node {baseDir}/tools/director.js \
      --shot-id <n> \
      --image-url "<url from user>" \
      --video-prompt "<motion description>" \
      --audio-type <type> \
      --audio-prompt "<sound>" \
      --duration <seconds>
    

    Step 4 — Present the results

    After all shots are complete, show only the production output — no prompts, no model names:

    ## 🎬 [Title]
    
    **[Shot count] shots · [format] · [total duration]**
    
    ---
    
    **Shot 1 — [Scene Name]**
    🖼 [image_url]
    🎬 [video_url]
    🔊 [audio description or "no audio"]
    
    **Shot 2 — [Scene Name]**
    ...
    
    ---
    Ready to adjust any shot or generate more?
    

    Shot Planning Reference (internal use only)

    Shots by format

    Length Shots
    15–20 s 3–4 shots
    30 s 5–6 shots
    45–60 s 7–9 shots

    Shot sequence patterns

    Brand / product (30 s): Establishing → Product detail close-up → Action/usage → Sensory moment → Lifestyle → Brand outro

    Social reel (15 s): Hook (bold visual) → Core message → Payoff/result → CTA

    Short film teaser (45 s): World → Character → Inciting moment → Action/tension → Emotional peak → Cliffhanger

    Audio rule

    • Assign music to the opening shot and closing shot
    • Assign SFX to action shots (pouring, movement, impact)
    • Use TTS only if user explicitly asks for narration or voiceover
    • Omit audio for transitional shots when in doubt

    Style consistency

    Pick ONE style lock before executing and use it in --style for every shot. Example: cinematic, warm amber tones, shallow depth of field.


    Example

    User: "Make a short video about a rainy Tokyo street at night."

    You internally plan:

    • 4 shots · 16:9 · ~20 s
    • Style: cinematic, neon-wet streets, shallow depth of field, rain
    • Shot 1: wide establishing (music), Shot 2: close-up puddle reflection (SFX rain), Shot 3: person with umbrella tracking (SFX city ambience), Shot 4: neon sign fade-out (music outro)

    Then execute all 4 shots silently and show only the results.

    Reproducido de pexoai/pexo-skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    5 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    No requiere claves de API; orquesta proxies alojados existentes mediante `tools/director.js`.

    Necesita en el PATH:node

    Detalles

    Creador
    pexoai
    Licencia
    MIT
    Recursos incluidos
    referencias
    Código fuente
    Ver SKILL.md

    Más de pexoai/pexo-skills

    Este repo incluye 20 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack pexo-skills entero y su comando de instalación

    Skill de generación de video con IA que selecciona modelo automáticamente entre Seedance 2, Kling 3.0, HappyHorse y más de 10 modelos, y produce videos multi-toma de 5–120s desde texto, imágenes, URLs, guiones o audio.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    video

    Genera video con IA a partir de texto, imagen o guion: enruta cada toma al mejor de 10+ modelos (Seedance, Kling, Veo, Sora...) y entrega un video final con música y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video explicativo narrado con Pexo: describe tu producto, concepto o proceso y Pexo escribe el guion, genera los visuales, añade voz en off y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video de fundador con Pexo: cuenta tu historia o pitch y Pexo escribe el guion, genera las tomas y entrega un video listo para publicar, con música.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Anima una foto fija en un vídeo terminado con Pexo: añade movimiento, cámara y música, elige el mejor modelo automáticamente y entrega el clip listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video de lanzamiento listo para publicar a partir de tu producto, URL de landing page o captura: guion, planos, modelos y música incluidos, ideal para Product Hunt o el día de lanzamiento.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Skills relacionados

    Se usa cuando el usuario pide generar, crear o imaginar videos. Admite prompts estructurados e imagen de referencia opcional para guiar la generación.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 3 meses
    video

    Genera vídeos con IA desde texto usando varias pasarelas — HeyGen, fal.ai, Kling y Gemini — con soporte de imagen a vídeo y comparación entre VEO, Kling, Sora, Runway, Seedance y MiniMax.

    Costo de contexto al activarse
    3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 2 meses
    video

    Genera o edita imágenes y vídeos por la pasarela Atlas Cloud: Seedance 2.5/2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 con una sola ATLASCLOUD_API_KEY.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    video