Skills Agentes

Veo 3.2 Prompter

Ingeniería experta de prompts para Google Veo 3.2 (motor Artemis): úsalo para generar video con Veo, crear prompts cinematográficos o al mencionar Veo, Google video generation o Artemis engine.

Estrellas
767

en todo el repo

Actividad
34

0–100, la ruta de este skill

Actualizado
hace 5 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
971 tok

55 tok en reposo

Paquete
3 archivos

15 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add pexoai/pexo-skills --skill veo-3.2-prompter --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Analiza assets multimodales (imágenes, videos, audio) e intención creativa del usuario
  • Clasifica cada asset en su rol de elemento atómico usando atomic_element_mapping.md
  • Determina el método de referencia óptimo para cada elemento (imagen, texto o híbrido)
  • Genera un JSON único con el prompt final y los parámetros recomendados
  • Adjunta imágenes de referencia usando el sistema RawReferenceImage de la API de Gemini

Úsalo cuando

  • El usuario aporta assets (imágenes, videos, audio) para generar video con Veo 3.2
  • La solicitud es compleja y requiere construir el prompt con cuidado para el modelo Veo
  • Se está usando cualquier modelo Google Veo 3.x para generación de video

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Haz un plano cinematográfico de este frasco de perfume girando sobre una superficie oscura, estilo comercial de lujo
    • Genera un video con Veo 3.2 a partir de estas imágenes
    • Ayúdame a construir un prompt para Artemis engine con estas referencias

    SKILL.md

    En inglés

    Veo 3.2 Prompt Designer Skill

    This skill transforms a user's scattered multimodal assets (images, videos, audio) and creative intent into a structured, executable prompt for the Google Veo 3.2 video generation model (Artemis engine). It acts as an expert prompt engineer, ensuring the highest quality output from the underlying model.

    When to Use

    • When the user provides assets (images, videos, audio) for video generation with Veo 3.2.
    • When the user's request is complex and requires careful prompt construction for the Veo model.
    • When using any Google Veo 3.x model for video generation.

    Core Function

    This skill analyzes all user inputs and generates a single, optimized JSON object containing the final prompt and recommended parameters. The internal workflow (Recognition, Mapping, Construction) is handled automatically and should not be exposed to the user.

    Internal Workflow

    1. Phase 1: Recognition — Analyze uploaded assets and user intent. Use the atomic_element_mapping.md to classify each asset into its atomic element role(s).
    2. Phase 2: Mapping — For each atomic element, determine the optimal reference method (reference image, text prompt, or hybrid). Use the mapping table to decide.
    3. Phase 3: Construction — Assemble the final prompt using the 5-Part Framework (Shot → Subject → Environment → Camera → Style) and attach reference images via the Gemini API's RawReferenceImage system.

    Usage Example

    User Request: "Make a cinematic shot of this perfume bottle rotating on a dark surface, like a luxury commercial." User uploads perfume.png

    Agent using veo-3.2-prompter: The agent internally processes the request and assets, then outputs the final JSON to the next skill in the chain.

    Final Output (for internal use):

    {
      "final_prompt": "Hero shot, a frosted glass perfume bottle with gold cap rotating slowly on a reflective dark surface, three-point studio lighting with soft key and rim light creating subtle caustics, smooth 180-degree arc, hyper-realistic luxury commercial style with shallow depth of field. Crystalline chime, soft ambient pad.",
      "reference_images": [
        {
          "file": "perfume.png",
          "reference_type": "SUBJECT"
        }
      ],
      "recommended_parameters": {
        "model": "veo-3.2-generate",
        "duration_seconds": 8,
        "aspect_ratio": "16:9",
        "resolution": "1080p",
        "generate_audio": true
      }
    }
    

    Veo 3.2 Key Differentiators

    Feature Capability
    Engine Artemis — world-model physics simulation (not pixel prediction)
    Max duration ~30s native continuous generation
    Audio Native dialogue + synchronized SFX
    Reference images Up to 3 (STYLE, SUBJECT, SUBJECT_FACE)
    Video extension Chain clips via previous video input
    First/last frame Specify start and/or end keyframes
    Resolutions 720p, 1080p, 4K (with upscaling)
    Aspect ratios 16:9, 9:16

    Knowledge Base

    This skill relies on an internal knowledge base to make informed decisions. The agent MUST consult these files during execution.

    • references/atomic_element_mapping.md: Core Knowledge. Contains the "Asset Type → Atomic Element" and "Atomic Element → Optimal Reference Method" mapping tables, adapted for Veo 3.2's reference image system.
    • references/veo_syntax_guide.md: Veo 3.2 Gemini API syntax reference, covering RawReferenceImage, GenerateVideosConfig, video extension, and first/last frame specification.

    Reproducido de pexoai/pexo-skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    3 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere acceso a la API de Gemini y a los archivos de referencia atomic_element_mapping.md y veo_syntax_guide.md.

    Detalles

    Creador
    pexoai
    Licencia
    MIT
    Recursos incluidos
    referencias
    Código fuente
    Ver SKILL.md

    Más de pexoai/pexo-skills

    Este repo incluye 20 skills. Si instalas uno, normalmente ya tienes los demás.

    Skill de generación de video con IA que selecciona modelo automáticamente entre Seedance 2, Kling 3.0, HappyHorse y más de 10 modelos, y produce videos multi-toma de 5–120s desde texto, imágenes, URLs, guiones o audio.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 26 días
    diseno ui

    Genera video con IA a partir de texto, imagen o guion: enruta cada toma al mejor de 10+ modelos (Seedance, Kling, Veo, Sora...) y entrega un video final con música y subtítulos.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    diseno ui

    Crea un video de fundador con Pexo: cuenta tu historia o pitch y Pexo escribe el guion, genera las tomas y entrega un video listo para publicar, con música.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Anima una foto fija en un vídeo terminado con Pexo: añade movimiento, cámara y música, elige el mejor modelo automáticamente y entrega el clip listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    diseno ui

    Crea anuncios nativos para TikTok con Pexo: vertical 9:16, con sonido, hook-first. Escribe el guion, secuencia las tomas, elige modelos y entrega el ad listo para publicar.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Crea un video demo o explicativo de tu SaaS con Pexo: describe tu software (o pega la URL o una captura) y recibe un video terminado y listo para publicar.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 2 meses
    marketing

    Skills relacionados

    Úsalo al empezar trabajo de feature que necesita aislamiento del workspace actual, o antes de ejecutar planes de implementación: asegura un workspace aislado vía herramientas nativas o fallback a git worktree.

    Costo de contexto al activarse
    1.7k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    herramientas desarrollo

    Úsala al crear nuevas skills, editar skills existentes o verificar que funcionan antes de desplegarlas.

    Costo de contexto al activarse
    6.6k tok
    Tamaño del paquete
    7 archivos
    Última actualización
    hace 4 días
    herramientas desarrollo

    Úsalo cuando la implementación esté completa, todos los tests pasen, y necesites decidir cómo integrar el trabajo.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    herramientas desarrollo