ASD

Nanobanana

Genera y edita imágenes con Google Gemini 3 Pro Image (Nano Banana Pro): texto a imagen, edición, distintas proporciones y salida en alta resolución (2K/4K).

Estrellas
1.5k

en todo el repo

Actividad
30

0–100, la ruta de este skill

Actualizado
hace 6 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.3k tok

71 tok en reposo

Paquete
5 archivos

25 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ReScienceLab/opc-skills --skill nanobanana --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests, needs API credentials.

Qué hace

  • Genera imágenes a partir de texto usando Gemini 3 Pro Image (Nano Banana Pro)
  • Edita imágenes existentes con instrucciones en lenguaje natural
  • Genera imágenes en varias proporciones de aspecto y en alta resolución (2K/4K)
  • Genera lotes de imágenes con nombres secuenciales
  • Activa el grounding de Google Search para imágenes con precisión factual

Úsalo cuando

  • El usuario quiere generar o crear imágenes
  • El usuario quiere usar la generación de imágenes de Gemini
  • El usuario quiere hacer generación de imágenes con IA

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera una imagen de una ciudad futurista de noche en 16:9
    • Edita esta foto y pon el fondo azul
    • Crea 20 variaciones de un logo pixel art
    • Genera una imagen en 4K de un producto profesional

    SKILL.md

    En inglés

    Nano Banana - AI Image Generation

    Generate and edit images using Google's Gemini 3 Pro Image model (gemini-3-pro-image-preview, nicknamed "Nano Banana Pro" 🍌).

    Prerequisites

    Required:

    • GEMINI_API_KEY - Get from Google AI Studio
    • Python 3.10+ with google-genai package

    Install dependencies:

    pip install google-genai pillow
    

    Quick Start

    Generate an image:

    python3 <skill_dir>/scripts/generate.py "a cute robot mascot, pixel art style" -o robot.png
    

    Edit an existing image:

    python3 <skill_dir>/scripts/generate.py "make the background blue" -i input.jpg -o output.png
    

    Generate with specific aspect ratio:

    python3 <skill_dir>/scripts/generate.py "cinematic landscape" --ratio 21:9 -o landscape.png
    

    Generate high-resolution 4K image:

    python3 <skill_dir>/scripts/generate.py "professional product photo" --size 4K -o product.png
    

    Script Reference

    scripts/generate.py

    Main image generation script.

    Usage: generate.py [OPTIONS] PROMPT
    
    Arguments:
      PROMPT              Text prompt for image generation
    
    Options:
      -o, --output PATH   Output file path (default: auto-generated)
      -i, --input PATH    Input image for editing (optional)
      -r, --ratio RATIO   Aspect ratio (1:1, 16:9, 9:16, 21:9, etc.)
      -s, --size SIZE     Image size: 2K or 4K (default: standard)
      --search            Enable Google Search grounding for accuracy
      -v, --verbose       Show detailed output
    

    Supported aspect ratios:

    • 1:1 - Square (default)
    • 2:3, 3:2 - Portrait/Landscape
    • 3:4, 4:3 - Standard
    • 4:5, 5:4 - Photo
    • 9:16, 16:9 - Widescreen
    • 21:9 - Ultra-wide/Cinematic

    scripts/batch_generate.py

    Generate multiple images with sequential naming.

    Usage: batch_generate.py [OPTIONS] PROMPT
    
    Arguments:
      PROMPT              Text prompt for image generation
    
    Options:
      -n, --count N       Number of images to generate (default: 10)
      -d, --dir PATH      Output directory
      -p, --prefix STR    Filename prefix (default: "image")
      -r, --ratio RATIO   Aspect ratio
      -s, --size SIZE     Image size (2K/4K)
      --delay SECONDS     Delay between generations (default: 3)
    

    Example:

    python3 <skill_dir>/scripts/batch_generate.py "pixel art logo" -n 20 -d ./logos -p logo
    

    Python API

    You can also use the module directly:

    from generate import generate_image, edit_image
    
    # Generate image
    result = generate_image(
        prompt="a futuristic city at night",
        output_path="city.png",
        aspect_ratio="16:9",
        image_size="4K"
    )
    
    # Edit existing image
    result = edit_image(
        prompt="add flying cars to the sky",
        input_path="city.png",
        output_path="city_edited.png"
    )
    

    Environment Variables

    Variable Description Default
    GEMINI_API_KEY Google Gemini API key Required
    IMAGE_OUTPUT_DIR Default output directory ./nanobanana-images

    Features

    Text-to-Image Generation

    Create images from text descriptions. The model excels at:

    • Photorealistic images
    • Artistic styles (pixel art, illustration, etc.)
    • Product photography
    • Landscapes and scenes

    Image Editing

    Transform existing images with natural language:

    • Style transfer
    • Object addition/removal
    • Background changes
    • Color adjustments

    High-Resolution Output

    • Standard: Fast generation, good quality
    • 2K: Enhanced detail (2048px)
    • 4K: Maximum quality (3840px), best for text rendering

    Google Search Grounding

    Enable --search for factually accurate images involving:

    • Real people, places, landmarks
    • Current events
    • Specific products or brands

    Best Practices

    Prompt Writing

    Good prompts include:

    • Subject description
    • Style/aesthetic
    • Lighting and mood
    • Composition details
    • Color palette

    Example:

    "A cozy coffee shop interior, warm lighting, vintage aesthetic, 
    wooden furniture, plants on shelves, morning sunlight through windows, 
    soft focus background, 35mm film photography style"
    

    Batch Generation Tips

    1. Generate 10-20 variations to explore options
    2. Use consistent prompts for style coherence
    3. Add 3-5 second delays to avoid rate limits
    4. Review results and iterate on best candidates

    Rate Limits

    • Gemini API has usage quotas
    • Add delays between batch generations
    • Check your quota at Google AI Studio

    Troubleshooting

    "API key not found"

    • Set GEMINI_API_KEY environment variable
    • Or pass via --api-key option

    "No image in response"

    • Prompt may have triggered safety filters
    • Try rephrasing to avoid sensitive content

    "Rate limit exceeded"

    • Wait a few seconds and retry
    • Reduce batch size or add longer delays

    References

    Reproducido de ReScienceLab/opc-skills bajo licencia Apache-2.0. Leer esta página en markdown.

    Archivos

    5 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere la variable GEMINI_API_KEY y Python 3.10+ con el paquete google-genai (y pillow).

    Necesita en el PATH:pippython3

    Variables de entorno:GEMINI_API_KEYIMAGE_OUTPUT_DIR

    Detalles

    Categoría
    Diseño y UI
    Licencia
    Apache-2.0
    Recursos incluidos
    scripts en python + referencias
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de ReScienceLab/opc-skills

    Este repo incluye 12 skills. Si instalas uno, normalmente ya tienes los demás.

    Genera informes de investigación de demanda de usuarios a partir de feedback real: scrapea y analiza solicitudes, quejas y preguntas en Reddit, X, GitHub, YouTube, LinkedIn y Amazon.

    Costo de contexto al activarse
    2.4k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    hace 3 meses
    investigacion

    Archiva aprendizajes de sesión, soluciones de debugging y logs de despliegue en `.archive/yyyy-mm-dd/` como markdown indexado con tags buscables; mantiene `.archive/MEMORY.md` como índice.

    Costo de contexto al activarse
    538 tok
    Tamaño del paquete
    5 archivos
    Última actualización
    hace 5 meses
    productividad

    Checklist y guía de automatización para añadir un nuevo skill al proyecto OPC Skills, asegurando que todos los archivos, metadatos, logos y listados requeridos estén listos antes del release.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 5 meses
    herramientas desarrollo

    Crea logos con generación de imágenes por IA: define estilo/formato, genera variaciones, itera con feedback, recorta, quita el fondo y exporta como SVG.

    Costo de contexto al activarse
    1.5k tok
    Tamaño del paquete
    25 archivos
    Última actualización
    hace 6 meses
    diseno ui

    SEO y GEO (Generative Engine Optimization) para sitios web: analiza keywords, genera schema markup y optimiza para buscadores de IA (ChatGPT, Perplexity, Gemini, Copilot, Claude) y tradicionales (Google, Bing).

    Costo de contexto al activarse
    2.1k tok
    Tamaño del paquete
    19 archivos
    Última actualización
    hace 6 meses
    seo geo

    Busca y obtiene contenido de Product Hunt: posts, temas, usuarios y colecciones mediante la API GraphQL oficial.

    Costo de contexto al activarse
    467 tok
    Tamaño del paquete
    13 archivos
    Última actualización
    hace 6 meses
    investigacion

    Skills relacionados

    Checklist y guía de automatización para añadir un nuevo skill al proyecto OPC Skills, asegurando que todos los archivos, metadatos, logos y listados requeridos estén listos antes del release.

    Costo de contexto al activarse
    1.9k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 5 meses
    herramientas desarrollo

    Úsalo al hacer cambios de UI/frontend guiados por contexto visual: selecciones de elementos, anotaciones o capturas de pantalla junto con la solicitud de cambio.

    Costo de contexto al activarse
    547 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    diseno ui

    Diseñador de landing pages centrado en marca: hace una entrevista de identidad visual y luego genera e itera la página con Stitch, entregando HTML listo para desplegar.

    Costo de contexto al activarse
    3.9k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    hace 2 meses
    diseno ui