Skills Agentes

Videoagent Video Studio

Genera videos cortos con IA desde texto o imágenes —text-to-video, image-to-video y generación basada en referencias— sin configurar claves API.

Estrellas
788

en todo el repo

Actividad
33

0–100, la ruta de este skill

Actualizado
hace 6 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.6k tok

61 tok en reposo

Paquete
23 archivos

95 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add pexoai/pexo-skills --skill videoagent-video-studio --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests, needs API credentials.

Qué hace

  • Genera videos cortos con IA a partir de texto o imágenes usando 7 backends (minimax, kling, veo, hunyuan, pixverse, grok, seedance)
  • Elige el modo adecuado (text-to-video o image-to-video) y mejora el prompt del usuario
  • Ejecuta tools/generate.js con los parámetros correctos y devuelve la URL del video generado
  • Permite generación basada en referencias (imágenes/video) para consistencia de personaje o estilo

Úsalo cuando

  • El usuario pide generar un video, crear un video desde texto o hacer un clip corto con IA
  • El usuario quiere animar una imagen o convertir una foto en video
  • El usuario pide un modelo específico como Google Veo, Grok o Seedance

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • “Genera un video corto de un gato caminando bajo la lluvia, estilo cinematográfico”
    • “Anima esta foto con nubes moviéndose en el cielo”
    • “Haz un video vertical de 10 segundos de café sirviéndose en cámara lenta”
    • “Usa Google Veo para un plano cinematográfico de un dragón volando”

    SKILL.md

    En inglés

    🎬 VideoAgent Video Studio

    Use when: User asks to generate a video, create a video from text, animate an image, make a short clip, or produce AI video.

    Generate short AI videos with 7 backends. This skill picks the right mode (text-to-video or image-to-video), enhances the prompt for best results, and returns the video URL.


    Quick Reference

    User Intent Mode Typical Duration
    "Make a video of..." (no image) text-to-video 4–10 s
    "Animate this image" / "Make this move" image-to-video 4–6 s
    "Turn this into a video with..." image-to-video 4–6 s
    Cinematic, story, ad Prefer text-to-video with detailed prompt 5–10 s

    Generation Modes

    Mode Description Models
    text-to-video Text prompt only → video minimax, kling, veo, hunyuan, grok, seedance
    image-to-video Single image + prompt → animated clip minimax, kling, veo, pixverse, grok, seedance
    reference-based Reference images/video → consistent output minimax, kling, veo, hunyuan, grok, seedance

    Models (use --model <id>)

    Model ID T2V I2V Reference Notes
    minimax ✅ ✅ ✅ Subject reference image, character consistency
    kling ✅ ✅ ✅ Multi-element / character / keyframe (O3)
    veo ✅ ✅ ✅ Google Veo 3.1, multiple reference images
    hunyuan ✅ — ✅ Video-to-video style transfer
    pixverse — ✅ — Stylized image-to-video
    grok ✅ ✅ ✅ Video editing via reference video
    seedance ✅ ✅ ✅ Seedance 1.5 Pro, synchronized audio, 4–12 s

    Full model details and endpoint reference: references/models.md.


    How to Generate a Video

    Step 1 — Choose mode and enhance the prompt

    • Text-to-video: Expand with subject, action, camera movement, lighting, and style. Be specific about motion (e.g. "camera slowly zooms in", "character walks left to right").
    • Image-to-video: Describe the motion to apply to the image (e.g. "gentle breeze in the hair", "camera pans across the scene"). See references/prompt_guide.md for patterns.

    Step 2 — Run the script

    Text-to-video:

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "<enhanced prompt>" \
      --duration <seconds> \
      --aspect-ratio <ratio>
    

    Image-to-video:

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --prompt "<motion description>" \
      --image-url "<public image URL>" \
      --duration <seconds> \
      --aspect-ratio <ratio>
    

    Parameters:

    Parameter Default Description
    --mode text-to-video text-to-video or image-to-video
    --prompt (required) Scene or motion description
    --image-url — Required for image-to-video; public image URL
    --duration 5 Length in seconds (typically 4–10)
    --aspect-ratio 16:9 16:9, 9:16, 1:1, 4:3, 3:4
    --model auto Model ID (e.g. kling, veo, grok, seedance); auto = proxy picks

    Other commands:

    Command Description
    node tools/generate.js --list-models List available models from the proxy
    node tools/generate.js --status --job-id <id> Check async job status

    Step 3 — Return the result

    The script returns JSON:

    {
      "success": true,
      "mode": "text-to-video",
      "videoUrl": "https://...",
      "duration": 5,
      "aspectRatio": "16:9"
    }
    

    Send videoUrl to the user.


    Example Conversations

    User: "Generate a short video of a cat walking in the rain, cinematic."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "A cat walking through rain, wet streets, neon reflections, cinematic lighting, slow motion, 4K" \
      --duration 5 \
      --aspect-ratio 16:9
    

    User: "Animate this photo" (user uploads a landscape)

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --prompt "Gentle clouds moving across the sky, subtle grass movement, cinematic atmosphere" \
      --image-url "https://..." \
      --duration 5 \
      --aspect-ratio 16:9
    

    User: "Make a 10-second vertical video of a coffee pour, slow motion."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --prompt "Close-up of coffee pouring into a white cup, slow motion, steam rising, soft lighting, product shot" \
      --duration 10 \
      --aspect-ratio 9:16
    

    User: "Use Google Veo for a cinematic shot."

    node {baseDir}/tools/generate.js \
      --mode text-to-video \
      --model veo \
      --prompt "A dragon flying through cloudy skies, cinematic lighting, 8s" \
      --duration 8 \
      --aspect-ratio 16:9
    

    User: "Animate this portrait."

    node {baseDir}/tools/generate.js \
      --mode image-to-video \
      --model grok \
      --prompt "Gentle smile, subtle head turn" \
      --image-url "https://..." \
      --duration 5
    

    Setup

    Zero API keys by default. Requests go through a hosted proxy. Set these for a custom proxy or token:

    Variable Required Description
    VIDEO_STUDIO_PROXY_URL No Proxy base URL
    VIDEO_STUDIO_TOKEN No Auth token if the proxy requires it

    Knowledge Base

    Reproducido de pexoai/pexo-skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    23 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    No requiere claves API por defecto; opcionalmente se pueden configurar VIDEO_STUDIO_PROXY_URL y VIDEO_STUDIO_TOKEN para un proxy propio.

    Necesita en el PATH:node

    Variables de entorno:BASE_DIRBASH_SOURCEFAL_KEYFREE_LIMIT_PER_IPJSONKV_REST_API_URLMAX_TOKENS_PER_IP_PER_DAYPORTSCRIPT_DIRSTATS_KEYVALID_TOKENS

    Detalles

    Creador
    pexoai
    Licencia
    MIT
    Recursos incluidos
    scripts en bash, javascript + referencias
    Código fuente
    Ver SKILL.md

    Más de pexoai/pexo-skills

    Este repo incluye 20 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack pexo-skills entero y su comando de instalación

    Skill de generación de video con IA que selecciona modelo automáticamente entre Seedance 2, Kling 3.0, HappyHorse y más de 10 modelos, y produce videos multi-toma de 5–120s desde texto, imágenes, URLs, guiones o audio.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    video

    Genera video con IA a partir de texto, imagen o guion: enruta cada toma al mejor de 10+ modelos (Seedance, Kling, Veo, Sora...) y entrega un video final con música y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video explicativo narrado con Pexo: describe tu producto, concepto o proceso y Pexo escribe el guion, genera los visuales, añade voz en off y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video de fundador con Pexo: cuenta tu historia o pitch y Pexo escribe el guion, genera las tomas y entrega un video listo para publicar, con música.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Anima una foto fija en un vídeo terminado con Pexo: añade movimiento, cámara y música, elige el mejor modelo automáticamente y entrega el clip listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Crea un video de lanzamiento listo para publicar a partir de tu producto, URL de landing page o captura: guion, planos, modelos y música incluidos, ideal para Product Hunt o el día de lanzamiento.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 3 meses
    video

    Skills relacionados

    Se usa cuando el usuario pide generar, crear o imaginar videos. Admite prompts estructurados e imagen de referencia opcional para guiar la generación.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 3 meses
    video

    Genera vídeos con IA desde texto usando varias pasarelas — HeyGen, fal.ai, Kling y Gemini — con soporte de imagen a vídeo y comparación entre VEO, Kling, Sora, Runway, Seedance y MiniMax.

    Costo de contexto al activarse
    3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 2 meses
    video

    Genera o edita imágenes y vídeos por la pasarela Atlas Cloud: Seedance 2.5/2.0, Gemini Omni Flash, MiniMax H3, Seedream 5.0, GPT Image 2 y Nano Banana 2 con una sola ATLASCLOUD_API_KEY.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    video