Skills Agentes

Generate Image

Genera imágenes con IA (OpenAI GPT Image o Stability AI). Úsalo cuando el usuario pida crear una imagen, ilustración o artwork a partir de un prompt de texto.

Solicitabash(*)readwrite
Estrellas
688

en todo el repo

Actividad
45

0–100, la ruta de este skill

Actualizado
hace 3 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.1k tok

47 tok en reposo

Paquete
1 archivo

4 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent claude-code

Se instala solo en este repositorio.

Este skill writes to your files.

Qué hace

  • Genera imágenes a partir de un prompt de texto usando el script generate-image.py
  • Permite elegir proveedor entre OpenAI (gpt-image-2, gpt-image-1, dall-e-3, etc.) o Stability AI (SD 3.5 Large)
  • Controla tamaño (1024x1024, 1536x1024, 1024x1536), calidad (low/medium/high) y fondo (auto/transparent/opaque)
  • Guarda la imagen resultante en la ruta de salida indicada e informa proveedor, modelo y prompt usado

Úsalo cuando

  • El usuario pide generar una imagen, crear una imagen con IA, hacer una ilustración o producir arte a partir de un prompt de texto

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera una imagen de un atardecer sobre montañas en estilo óleo
    • Crea un logo minimalista para una empresa de tecnología con fondo transparente
    • Haz una ilustración vertical de una ciudad futurista para stories

    SKILL.md

    En inglés

    AI Image Generation

    Generate images from text prompts using OpenAI GPT Image (gpt-image-2 / gpt-image-1 / variants) or Stability AI (SD 3.5 Large).

    Tool Location

    • Script: ~/.agents/tools/generate-image.py
    • Env file: ~/.agents/tools/.env (contains OPENAI_API_KEY and STABILITY_API_KEY)

    Available OpenAI image models (verified live via /v1/models 2026-05-15)

    Model ID Notes
    gpt-image-2 Flagship. Released 2026-04-21. Best prompt adherence, best photorealism. Default when image quality matters.
    gpt-image-2-2026-04-21 Pinned dated variant of gpt-image-2
    gpt-image-1.5 Intermediate release between 1 and 2
    gpt-image-1-mini Smaller/cheaper gpt-image-1 variant — use for batch/draft generation where cost matters
    gpt-image-1 Original gpt-image. Still works; superseded by gpt-image-2.
    chatgpt-image-latest Always-current alias of the model ChatGPT.com uses (currently gpt-image-2-class). Use when you want "whatever ChatGPT uses today"
    dall-e-3 Legacy fallback. Different quality semantics (standard/hd, not low/medium/high).

    Pass any of these to --model. The script branches on gpt-image* for the quality/format handling, so all gpt-image-* variants work out of the box.

    Default in the script is now gpt-image-2 (the flagship) — pass --model gpt-image-1-mini for cheap batch/draft work.

    Quick Usage

    Generate with OpenAI gpt-image-2 (flagship)

    python ~/.agents/tools/generate-image.py \
      --prompt "a sunset over mountains, oil painting style" \
      --output ./sunset.png \
      --model gpt-image-2 \
      --quality high
    

    Generate with default (gpt-image-2)

    python ~/.agents/tools/generate-image.py \
      --prompt "a sunset over mountains, oil painting style" \
      --output ./sunset.png
    

    High quality

    python ~/.agents/tools/generate-image.py \
      --prompt "modern logo design for a tech company" \
      --output ./logo.png \
      --size 1024x1024 \
      --quality high
    

    Wide format (good for blog covers, banners)

    python ~/.agents/tools/generate-image.py \
      --prompt "abstract digital art with blue tones" \
      --output ./banner.png \
      --size 1536x1024
    

    Tall format (good for mobile, stories)

    python ~/.agents/tools/generate-image.py \
      --prompt "portrait of a futuristic city" \
      --output ./city.png \
      --size 1024x1536
    

    Transparent background (icons, logos)

    python ~/.agents/tools/generate-image.py \
      --prompt "a minimalist cat icon, flat design" \
      --output ./icon.png \
      --background transparent
    

    Generate with Stability AI (SD 3.5 Large)

    python ~/.agents/tools/generate-image.py \
      --prompt "watercolor painting of a garden" \
      --output ./garden.png \
      --provider stability
    

    CLI Options

    Option Description
    --prompt, -p (Required) Text prompt describing the desired image
    --output, -o (Required) Output file path
    --provider openai (default) or stability
    --size Image size for OpenAI: 1024x1024 (default), 1536x1024 (wide), 1024x1536 (tall)
    --quality OpenAI quality: low, medium (default), or high
    --background OpenAI background: auto (default), transparent, or opaque
    --model Override model (default: gpt-image-2 for OpenAI, sd3.5-large for Stability)

    Provider Comparison

    Feature OpenAI gpt-image-2 OpenAI gpt-image-1 Stability AI SD 3.5
    Released 2026-04-21 2025
    Prompt adherence Best Excellent Good
    Size options 1024x1024, 1536x1024, 1024x1536 1024x1024, 1536x1024, 1024x1536 1024x1024
    Quality options low, medium, high low, medium, high N/A
    Transparent bg Yes Yes No
    Style Photorealistic + artistic Photorealistic + artistic Artistic + photorealistic
    Cost per image (high) Higher than 1 Baseline N/A

    Dependencies

    • requests (for API calls)

    Install if needed:

    pip install requests
    

    Output

    The script prints:

    • The provider and model used
    • The prompt (and revised prompt if applicable)
    • The saved file path

    Reproducido de OpenClaudia/openclaudia-skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere el script ~/.agents/tools/generate-image.py, el paquete requests, y OPENAI_API_KEY o STABILITY_API_KEY en ~/.agents/tools/.env.

    Necesita en el PATH:pippython

    Detalles

    Categoría
    Diseño y UI
    Licencia
    MIT
    Recursos incluidos
    Solo SKILL.md
    Código fuente
    Ver SKILL.md

    Más de OpenClaudia/openclaudia-skills

    Este repo incluye 76 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack openclaudia-skills entero y su comando de instalación

    Genera un informe HTML autocontenible de tráfico competitivo: visitas mensuales (SimilarWeb), tráfico orgánico y Domain Rating (Ahrefs), con gráficos ranked, tendencias y tabla de datos.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    hace 3 días
    seo geo

    Obtiene datos de marca (nombre, descripción, logos, industria) desde la API de brand.dev y guarda los logos localmente.

    Costo de contexto al activarse
    702 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    datos analitica

    Audita TODAS las propiedades de Google Search Console a la vez: ranking por clics e impresiones con deltas, y diff de keywords por sitio (nuevas, suben, bajan, perdidas, o bien rankeadas sin clics).

    Costo de contexto al activarse
    1k tok
    Tamaño del paquete
    2 archivos
    Última actualización
    el mes pasado
    seo geo

    Edita audio o video de podcast: recorta charla previa/posterior, quita muletillas, corta silencios, mejora el audio y aplica el mismo corte a una versión en video.

    Costo de contexto al activarse
    6k tok
    Tamaño del paquete
    3 archivos
    Última actualización
    el mes pasado
    redaccion contenido

    Clasifica y resume el feed de WeChat Moments (朋友圈) del usuario para que los eventos reales y la información genuina destaquen sobre la promoción, ponderando según cuánto le escribe el usuario a cada autor.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    redes sociales

    Genera un informe de Citaciones de IA (GEO) para un dominio: qué prompts de búsqueda con IA citan el sitio en Google AI Overview y ChatGPT, con contexto de tráfico orgánico y cobertura por artículo.

    Costo de contexto al activarse
    840 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    seo geo

    Skills relacionados

    Crea arte algorítmico con p5.js, aleatoriedad con semilla y exploración interactiva de parámetros. Úsalo cuando pidan arte por código, arte generativo, flow fields o sistemas de partículas.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    hace 4 meses
    Oficialdiseno ui

    Aplica los colores y la tipografía oficiales de la marca Anthropic a cualquier artefacto que pueda beneficiarse de su look-and-feel. Úsalo cuando apliquen colores de marca o estándares de diseño.

    Costo de contexto al activarse
    559 tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 4 meses
    Oficialdiseno ui

    Crea arte visual en documentos .png y .pdf partiendo de una filosofía de diseño. Úsalo cuando pidan un póster, una pieza de arte, un diseño u otra pieza estática.

    Costo de contexto al activarse
    3k tok
    Tamaño del paquete
    83 archivos
    Última actualización
    hace 4 meses
    Oficialdiseno ui