Skills Agentes

Videoagent Video Studio

Genera videos cortos con IA desde texto o imágenes —text-to-video, image-to-video y generación basada en referencias— sin configurar claves API.

Estrellas
767

en todo el repo

Actividad
33

0–100, la ruta de este skill

Actualizado
hace 5 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.6k tok

61 tok en reposo

Paquete
23 archivos

95 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add pexoai/pexo-skills --skill videoagent-video-studio --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests, needs API credentials.

Qué hace

  • Genera videos cortos con IA a partir de texto o imágenes usando 7 backends (minimax, kling, veo, hunyuan, pixverse, grok, seedance)
  • Elige el modo adecuado (text-to-video o image-to-video) y mejora el prompt del usuario
  • Ejecuta tools/generate.js con los parámetros correctos y devuelve la URL del video generado
  • Permite generación basada en referencias (imágenes/video) para consistencia de personaje o estilo

Úsalo cuando

  • El usuario pide generar un video, crear un video desde texto o hacer un clip corto con IA
  • El usuario quiere animar una imagen o convertir una foto en video
  • El usuario pide un modelo específico como Google Veo, Grok o Seedance

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera un video corto de un gato caminando bajo la lluvia, estilo cinematográfico
    • Anima esta foto con nubes moviéndose en el cielo
    • Haz un video vertical de 10 segundos de café sirviéndose en cámara lenta
    • Usa Google Veo para un plano cinematográfico de un dragón volando

    SKILL.md

    En inglés

    🎬 VideoAgent Video Studio

    Use when: User asks to generate a video, create a video from text, animate an image, make a short clip, or produce AI video.

    Generate short AI videos with 7 backends. This skill picks the right mode (text-to-video or image-to-video), enhances the prompt for best results, and returns the video URL.


    Quick Reference

    User Intent Mode Typical Duration
    "Make a video of..." (no image) text-to-video 4–10 s
    "Animate this image" / "Make this move" image-to-video 4–6 s
    "Turn this into a video with..." image-to-video 4–6 s
    Cinematic, story, ad Prefer text-to-video with detailed prompt 5–10 s

    Generation Modes

    Mode Description Models
    text-to-video Text prompt only → video minimax, kling, veo, hunyuan, grok, seedance
    image-to-video Single image + prompt → animated clip minimax, kling, veo, pixverse, grok, seedance
    reference-based Reference images/video → consistent output minimax, kling, veo, hunyuan, grok, seedance

    Models (use --model <id>)

    Model ID T2V I2V Reference Notes
    minimax Subject reference image, character consistency
    kling Multi-element / character / keyframe (O3)
    veo Google Veo 3.1, multiple reference images
    hunyuan Video-to-video style transfer
    pixverse Stylized image-to-video
    grok Video editing via reference video
    seedance Seedance 1.5 Pro, synchronized audio, 4–12 s

    Full model details and endpoint reference: references/models.md.


    How to Generate a Video

    Step 1 — Choose mode and enhance the prompt

    • Text-to-video: Expand with subject, action, camera movement, lighting, and style. Be specific about motion (e.g. "camera slowly zooms in", "character walks left to right").
    • Image-to-video: Describe the motion to apply to the image (e.g. "gentle breeze in the hair", "camera pans across the scene"). See references/prompt_guide.md for patterns.

    Step 2 — Run the script

    Text-to-video:

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "<enhanced prompt>" \
      --duration <seconds> \
      --aspect-ratio <ratio>
    

    Image-to-video:

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --prompt "<motion description>" \
      --image-url "<public image URL>" \
      --duration <seconds> \
      --aspect-ratio <ratio>
    

    Parameters:

    Parameter Default Description
    --mode text-to-video text-to-video or image-to-video
    --prompt (required) Scene or motion description
    --image-url Required for image-to-video; public image URL
    --duration 5 Length in seconds (typically 4–10)
    --aspect-ratio 16:9 16:9, 9:16, 1:1, 4:3, 3:4
    --model auto Model ID (e.g. kling, veo, grok, seedance); auto = proxy picks

    Other commands:

    Command Description
    node tools/generate.js --list-models List available models from the proxy
    node tools/generate.js --status --job-id <id> Check async job status

    Step 3 — Return the result

    The script returns JSON:

    {
      "success": true,
      "mode": "text-to-video",
      "videoUrl": "https://...",
      "duration": 5,
      "aspectRatio": "16:9"
    }
    

    Send videoUrl to the user.


    Example Conversations

    User: "Generate a short video of a cat walking in the rain, cinematic."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "A cat walking through rain, wet streets, neon reflections, cinematic lighting, slow motion, 4K" \
      --duration 5 \
      --aspect-ratio 16:9
    

    User: "Animate this photo" (user uploads a landscape)

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --prompt "Gentle clouds moving across the sky, subtle grass movement, cinematic atmosphere" \
      --image-url "https://..." \
      --duration 5 \
      --aspect-ratio 16:9
    

    User: "Make a 10-second vertical video of a coffee pour, slow motion."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "Close-up of coffee pouring into a white cup, slow motion, steam rising, soft lighting, product shot" \
      --duration 10 \
      --aspect-ratio 9:16
    

    User: "Use Google Veo for a cinematic shot."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --model veo \
      --prompt "A dragon flying through cloudy skies, cinematic lighting, 8s" \
      --duration 8 \
      --aspect-ratio 16:9
    

    User: "Animate this portrait."

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --model grok \
      --prompt "Gentle smile, subtle head turn" \
      --image-url "https://..." \
      --duration 5
    

    Setup

    Zero API keys by default. Requests go through a hosted proxy. Set these for a custom proxy or token:

    Variable Required Description
    VIDEO_STUDIO_PROXY_URL No Proxy base URL
    VIDEO_STUDIO_TOKEN No Auth token if the proxy requires it

    Knowledge Base

    Reproducido de pexoai/pexo-skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    23 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    No requiere claves API por defecto; opcionalmente se pueden configurar VIDEO_STUDIO_PROXY_URL y VIDEO_STUDIO_TOKEN para un proxy propio.

    Necesita en el PATH:node

    Variables de entorno:BASE_DIRBASH_SOURCEFAL_KEYFREE_LIMIT_PER_IPJSONKV_REST_API_URLMAX_TOKENS_PER_IP_PER_DAYPORTSCRIPT_DIRSTATS_KEYVALID_TOKENS

    Detalles

    Creador
    pexoai
    Categoría
    Diseño y UI
    Licencia
    MIT
    Recursos incluidos
    scripts en bash, javascript + referencias
    Código fuente
    Ver SKILL.md

    Más de pexoai/pexo-skills

    Este repo incluye 20 skills. Si instalas uno, normalmente ya tienes los demás.

    Skill de generación de video con IA que selecciona modelo automáticamente entre Seedance 2, Kling 3.0, HappyHorse y más de 10 modelos, y produce videos multi-toma de 5–120s desde texto, imágenes, URLs, guiones o audio.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 26 días
    diseno ui

    Genera video con IA a partir de texto, imagen o guion: enruta cada toma al mejor de 10+ modelos (Seedance, Kling, Veo, Sora...) y entrega un video final con música y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    diseno ui

    Crea un video de fundador con Pexo: cuenta tu historia o pitch y Pexo escribe el guion, genera las tomas y entrega un video listo para publicar, con música.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Anima una foto fija en un vídeo terminado con Pexo: añade movimiento, cámara y música, elige el mejor modelo automáticamente y entrega el clip listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    diseno ui

    Crea anuncios nativos para TikTok con Pexo: vertical 9:16, con sonido, hook-first. Escribe el guion, secuencia las tomas, elige modelos y entrega el ad listo para publicar.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Crea un video demo o explicativo de tu SaaS con Pexo: describe tu software (o pega la URL o una captura) y recibe un video terminado y listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Skills relacionados

    Crea arte visual en documentos .png y .pdf partiendo de una filosofía de diseño. Úsalo cuando pidan un póster, una pieza de arte, un diseño u otra pieza estática.

    Costo de contexto al activarse
    3k tok
    Tamaño del paquete
    83 archivos
    Última actualización
    hace 3 meses
    Oficialdiseno ui

    Kit para dar estilo a artefactos con un tema: diapositivas, documentos, informes o landing pages. Trae 10 temas predefinidos de colores y fuentes, y puede generar uno nuevo sobre la marcha.

    Costo de contexto al activarse
    781 tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    Oficialdiseno ui

    Guía para un diseño visual distintivo e intencionado al construir o rehacer una UI. Ayuda con la dirección estética, la tipografía y las decisiones que no se leen como valores por defecto.

    Costo de contexto al activarse
    2.1k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 2 meses
    Oficialdiseno ui