ASD

Nano Banana Pro

Genera y edita imágenes con Nano Banana Pro de Google (Gemini 3 Pro Image), en texto-a-imagen o edición de imagen a imagen, con resolución 1K, 2K o 4K.

Estrellas
281

en todo el repo

Actividad
26

0–100, la ruta de este skill

Actualizado
hace 6 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.1k tok

141 tok en reposo

Paquete
2 archivos

10 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add intellectronica/agent-skills --skill nano-banana-pro --agent claude-code

Se instala solo en este repositorio.

Este skill needs API credentials.

Qué hace

  • Genera imágenes nuevas a partir de texto usando la API de Nano Banana Pro (Gemini 3 Pro Image)
  • Edita imágenes existentes aplicando instrucciones de modificación con --input-image
  • Elige automáticamente la resolución (1K, 2K o 4K) según lo que pida el usuario
  • Genera nombres de archivo con patrón yyyy-mm-dd-hh-mm-ss-nombre.png
  • Guarda el PNG en el directorio de trabajo actual del usuario

Úsalo cuando

  • El usuario pide generar, crear, editar, modificar, cambiar o actualizar una imagen
  • El usuario referencia una imagen existente y pide modificarla de cualquier forma

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera una imagen de un jardín japonés en primavera
    • Cambia el fondo de esta foto por un atardecer
    • Haz esta imagen en alta resolución 4K
    • Elimina a la persona de esta imagen

    SKILL.md

    En inglés

    Nano Banana Pro Image Generation & Editing

    Generate new images or edit existing ones using Google's Nano Banana Pro API (Gemini 3 Pro Image).

    Usage

    Run the script using absolute path (do NOT cd to skill directory first):

    Generate new image:

    uv run ~/.claude/skills/nano-banana-pro/scripts/generate_image.py --prompt "your image description" --filename "output-name.png" [--resolution 1K|2K|4K] [--api-key KEY]
    

    Edit existing image:

    uv run ~/.claude/skills/nano-banana-pro/scripts/generate_image.py --prompt "editing instructions" --filename "output-name.png" --input-image "path/to/input.png" [--resolution 1K|2K|4K] [--api-key KEY]
    

    Important: Always run from the user's current working directory so images are saved where the user is working, not in the skill directory.

    Resolution Options

    The Gemini 3 Pro Image API supports three resolutions (uppercase K required):

    • 1K (default) - ~1024px resolution
    • 2K - ~2048px resolution
    • 4K - ~4096px resolution

    Map user requests to API parameters:

    • No mention of resolution → 1K
    • "low resolution", "1080", "1080p", "1K" → 1K
    • "2K", "2048", "normal", "medium resolution" → 2K
    • "high resolution", "high-res", "hi-res", "4K", "ultra" → 4K

    API Key

    The script checks for API key in this order:

    1. --api-key argument (use if user provided key in chat)
    2. GEMINI_API_KEY environment variable

    If neither is available, the script exits with an error message.

    Filename Generation

    Generate filenames with the pattern: yyyy-mm-dd-hh-mm-ss-name.png

    Format: {timestamp}-{descriptive-name}.png

    • Timestamp: Current date/time in format yyyy-mm-dd-hh-mm-ss (24-hour format)
    • Name: Descriptive lowercase text with hyphens
    • Keep the descriptive part concise (1-5 words typically)
    • Use context from user's prompt or conversation
    • If unclear, use random identifier (e.g., x9k2, a7b3)

    Examples:

    • Prompt "A serene Japanese garden" → 2025-11-23-14-23-05-japanese-garden.png
    • Prompt "sunset over mountains" → 2025-11-23-15-30-12-sunset-mountains.png
    • Prompt "create an image of a robot" → 2025-11-23-16-45-33-robot.png
    • Unclear context → 2025-11-23-17-12-48-x9k2.png

    Image Editing

    When the user wants to modify an existing image:

    1. Check if they provide an image path or reference an image in the current directory
    2. Use --input-image parameter with the path to the image
    3. The prompt should contain editing instructions (e.g., "make the sky more dramatic", "remove the person", "change to cartoon style")
    4. Common editing tasks: add/remove elements, change style, adjust colors, blur background, etc.

    Prompt Handling

    For generation: Pass user's image description as-is to --prompt. Only rework if clearly insufficient.

    For editing: Pass editing instructions in --prompt (e.g., "add a rainbow in the sky", "make it look like a watercolor painting")

    Preserve user's creative intent in both cases.

    Output

    • Saves PNG to current directory (or specified path if filename includes directory)
    • Script outputs the full path to the generated image
    • Do not read the image back - just inform the user of the saved path

    Examples

    Generate new image:

    uv run ~/.claude/skills/nano-banana-pro/scripts/generate_image.py --prompt "A serene Japanese garden with cherry blossoms" --filename "2025-11-23-14-23-05-japanese-garden.png" --resolution 4K
    

    Edit existing image:

    uv run ~/.claude/skills/nano-banana-pro/scripts/generate_image.py --prompt "make the sky more dramatic with storm clouds" --filename "2025-11-23-14-25-30-dramatic-sky.png" --input-image "original-photo.jpg" --resolution 2K
    

    Reproducido de intellectronica/agent-skills bajo licencia CC0-1.0. Leer esta página en markdown.

    Archivos

    2 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere una clave de API válida vía --api-key o la variable de entorno GEMINI_API_KEY, y uv instalado para ejecutar el script.

    Variables de entorno:GEMINI_API_KEY

    Detalles

    Categoría
    Diseño y UI
    Licencia
    CC0-1.0
    Recursos incluidos
    scripts en python
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de intellectronica/agent-skills

    Este repo incluye 22 skills. Si instalas uno, normalmente ya tienes los demás.

    Úsalo cuando el usuario quiera operar Google Workspace desde la línea de comandos con gog/gogcli: Gmail, Calendar, Drive, Docs, Sheets, Slides, Forms, Apps Script, Chat, Classroom, Contacts, Tasks, Groups, Admin, Keep y auth.

    Costo de contexto al activarse
    2.2k tok
    Tamaño del paquete
    9 archivos
    Última actualización
    hace 3 meses
    automatizacion

    Úsalo para leer o buscar notas de Monologue mediante su API REST: autenticación con MONOLOGUE_API_KEY, listado, paginación, filtros y manejo de errores, todo por HTTP directo con curl.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 3 meses
    desarrollo apis

    Ayuda con el trabajo del GitHub Copilot SDK en Node.js/TypeScript, Python, Go, .NET y Java: setup, autenticación, permisos, streaming, tools personalizadas, custom agents, servidores MCP, hooks, skills y persistencia de sesiones.

    Costo de contexto al activarse
    3.2k tok
    Tamaño del paquete
    5 archivos
    Última actualización
    hace 4 meses
    desarrollo apis

    Genera y edita imágenes con Nano Banana 2 (Gemini 3.1 Flash Image Preview) de Google, para iteración rápida y control de aspect-ratio y resolución de 512px a 4K.

    Costo de contexto al activarse
    977 tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 5 meses
    diseno ui

    Inicializa un repositorio git con instrucciones opcionales de commit para el agente y un .gitignore.

    Costo de contexto al activarse
    790 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    herramientas desarrollo

    Instrucciones para interactuar con Todoist mediante la CLI td: operaciones CRUD sobre tareas, proyectos, secciones, etiquetas y comentarios, con confirmación previa a acciones destructivas.

    Costo de contexto al activarse
    2.3k tok
    Tamaño del paquete
    3 archivos
    Última actualización
    hace 6 meses
    productividad

    Skills relacionados

    Úsalo al completar tareas, implementar features mayores, o antes de mergear, para verificar que el trabajo cumple los requisitos.

    Costo de contexto al activarse
    739 tok
    Tamaño del paquete
    2 archivos
    Última actualización
    anteayer
    testing qa

    Úsalo antes de afirmar que un trabajo está completo, corregido o pasando, antes de hacer commit o crear PRs: exige ejecutar comandos de verificación y confirmar la salida antes de cualquier afirmación de éxito.

    Costo de contexto al activarse
    912 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    testing qa

    Úsalo al empezar trabajo de feature que necesita aislamiento del workspace actual, o antes de ejecutar planes de implementación: asegura un workspace aislado vía herramientas nativas o fallback a git worktree.

    Costo de contexto al activarse
    1.7k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    herramientas desarrollo