# Generate Image > Genera imágenes con IA (OpenAI GPT Image o Stability AI). Úsalo cuando el usuario pida crear una imagen, ilustración o artwork a partir de un prompt de texto. Fuente: https://skillsagentes.com/skills/openclaudia/openclaudia-skills/generate-image Markdown: https://skillsagentes.com/skills/openclaudia/openclaudia-skills/generate-image.md Repositorio: https://github.com/OpenClaudia/openclaudia-skills Autor: OpenClaudia Licencia: MIT Actualizado: hace 3 meses Coste de contexto: 47 tok instalada, 1.1k tok al activarse, 1.1k tok con todos los archivos del bundle Bundle: 1 archivo, 4 KB Permisos que pide: bash(*), read, write ## Instalación Un skill son archivos markdown: los mismos archivos valen para cualquier agente y lo único que cambia es el directorio de destino, es decir la bandera `--agent`. Añade `-g` para instalarlo en todos los proyectos de la máquina. ```bash # Claude Code npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent claude-code # Cursor npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent cursor # Codex npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent codex # Gemini CLI npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent gemini # Windsurf npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent windsurf # Cline npx -y skills add OpenClaudia/openclaudia-skills --skill ai-image-gen --agent cline ``` ## Qué hace - Genera imágenes a partir de un prompt de texto usando el script generate-image.py - Permite elegir proveedor entre OpenAI (gpt-image-2, gpt-image-1, dall-e-3, etc.) o Stability AI (SD 3.5 Large) - Controla tamaño (1024x1024, 1536x1024, 1024x1536), calidad (low/medium/high) y fondo (auto/transparent/opaque) - Guarda la imagen resultante en la ruta de salida indicada e informa proveedor, modelo y prompt usado ## Cuándo usarla - El usuario pide generar una imagen, crear una imagen con IA, hacer una ilustración o producir arte a partir de un prompt de texto ## Qué la activa - "Genera una imagen de un atardecer sobre montañas en estilo óleo" - "Crea un logo minimalista para una empresa de tecnología con fondo transparente" - "Haz una ilustración vertical de una ciudad futurista para stories" ## Antes de instalar - Requiere el script ~/.agents/tools/generate-image.py, el paquete requests, y OPENAI_API_KEY o STABILITY_API_KEY en ~/.agents/tools/.env. - Necesita en el PATH: pip, python - writes to your files ## Archivos - SKILL.md — 4 KB ## SKILL.md Reproducido tal cual desde OpenClaudia/openclaudia-skills bajo MIT. Esta sección es el documento original y está en inglés. # AI Image Generation Generate images from text prompts using OpenAI GPT Image (gpt-image-2 / gpt-image-1 / variants) or Stability AI (SD 3.5 Large). ## Tool Location - Script: `~/.agents/tools/generate-image.py` - Env file: `~/.agents/tools/.env` (contains `OPENAI_API_KEY` and `STABILITY_API_KEY`) ## Available OpenAI image models (verified live via `/v1/models` 2026-05-15) | Model ID | Notes | |---|---| | `gpt-image-2` | **Flagship.** Released 2026-04-21. Best prompt adherence, best photorealism. Default when image quality matters. | | `gpt-image-2-2026-04-21` | Pinned dated variant of gpt-image-2 | | `gpt-image-1.5` | Intermediate release between 1 and 2 | | `gpt-image-1-mini` | Smaller/cheaper gpt-image-1 variant — use for batch/draft generation where cost matters | | `gpt-image-1` | Original gpt-image. Still works; superseded by gpt-image-2. | | `chatgpt-image-latest` | Always-current alias of the model ChatGPT.com uses (currently gpt-image-2-class). Use when you want "whatever ChatGPT uses today" | | `dall-e-3` | Legacy fallback. Different quality semantics (standard/hd, not low/medium/high). | Pass any of these to `--model`. The script branches on `gpt-image*` for the quality/format handling, so all gpt-image-* variants work out of the box. **Default in the script is now `gpt-image-2`** (the flagship) — pass `--model gpt-image-1-mini` for cheap batch/draft work. ## Quick Usage ### Generate with OpenAI gpt-image-2 (flagship) ```bash python ~/.agents/tools/generate-image.py \ --prompt "a sunset over mountains, oil painting style" \ --output ./sunset.png \ --model gpt-image-2 \ --quality high ``` ### Generate with default (gpt-image-2) ```bash python ~/.agents/tools/generate-image.py \ --prompt "a sunset over mountains, oil painting style" \ --output ./sunset.png ``` ### High quality ```bash python ~/.agents/tools/generate-image.py \ --prompt "modern logo design for a tech company" \ --output ./logo.png \ --size 1024x1024 \ --quality high ``` ### Wide format (good for blog covers, banners) ```bash python ~/.agents/tools/generate-image.py \ --prompt "abstract digital art with blue tones" \ --output ./banner.png \ --size 1536x1024 ``` ### Tall format (good for mobile, stories) ```bash python ~/.agents/tools/generate-image.py \ --prompt "portrait of a futuristic city" \ --output ./city.png \ --size 1024x1536 ``` ### Transparent background (icons, logos) ```bash python ~/.agents/tools/generate-image.py \ --prompt "a minimalist cat icon, flat design" \ --output ./icon.png \ --background transparent ``` ### Generate with Stability AI (SD 3.5 Large) ```bash python ~/.agents/tools/generate-image.py \ --prompt "watercolor painting of a garden" \ --output ./garden.png \ --provider stability ``` ## CLI Options | Option | Description | |--------|-------------| | `--prompt, -p` | **(Required)** Text prompt describing the desired image | | `--output, -o` | **(Required)** Output file path | | `--provider` | `openai` (default) or `stability` | | `--size` | Image size for OpenAI: `1024x1024` (default), `1536x1024` (wide), `1024x1536` (tall) | | `--quality` | OpenAI quality: `low`, `medium` (default), or `high` | | `--background` | OpenAI background: `auto` (default), `transparent`, or `opaque` | | `--model` | Override model (default: `gpt-image-2` for OpenAI, `sd3.5-large` for Stability) | ## Provider Comparison | Feature | OpenAI gpt-image-2 | OpenAI gpt-image-1 | Stability AI SD 3.5 | |---------|--------------------|--------------------|---------------------| | Released | 2026-04-21 | 2025 | — | | Prompt adherence | Best | Excellent | Good | | Size options | 1024x1024, 1536x1024, 1024x1536 | 1024x1024, 1536x1024, 1024x1536 | 1024x1024 | | Quality options | low, medium, high | low, medium, high | N/A | | Transparent bg | Yes | Yes | No | | Style | Photorealistic + artistic | Photorealistic + artistic | Artistic + photorealistic | | Cost per image (high) | Higher than 1 | Baseline | N/A | ## Dependencies - `requests` (for API calls) Install if needed: ```bash pip install requests ``` ## Output The script prints: - The provider and model used - The prompt (and revised prompt if applicable) - The saved file path ## Dónde encaja - Categoría: [Diseño y UI](https://skillsagentes.com/categorias/diseno-ui.md) — Sistemas de diseño, trabajo con componentes y acabado visual. - Creador: [OpenClaudia](https://skillsagentes.com/creators/openclaudia.md) — 76 skills en el directorio - [Todas las skills](https://skillsagentes.com/skills.md) - [Ranking de instalaciones](https://skillsagentes.com/ranking.md) ## Otras skills del mismo repositorio - [Competitor Traffic Report](https://skillsagentes.com/skills/openclaudia/openclaudia-skills/competitor-traffic-report.md): Genera un informe HTML autocontenible de tráfico competitivo: visitas mensuales (SimilarWeb), tráfico orgánico y Domain Rating (Ahrefs), con gráficos ranked, tendencias y tabla de datos. - [Brand Dev](https://skillsagentes.com/skills/openclaudia/openclaudia-skills/brand-dev.md): Obtiene datos de marca (nombre, descripción, logos, industria) desde la API de brand.dev y guarda los logos localmente. - [Gsc Portfolio Audit](https://skillsagentes.com/skills/openclaudia/openclaudia-skills/gsc-portfolio-audit.md): Audita TODAS las propiedades de Google Search Console a la vez: ranking por clics e impresiones con deltas, y diff de keywords por sitio (nuevas, suben, bajan, perdidas, o bien rankeadas sin clics). - [Wechat Moments](https://skillsagentes.com/skills/openclaudia/openclaudia-skills/wechat-moments.md): Clasifica y resume el feed de WeChat Moments (朋友圈) del usuario para que los eventos reales y la información genuina destaquen sobre la promoción, ponderando según cuánto le escribe el usuario a cada autor. - [Podcast Edit](https://skillsagentes.com/skills/openclaudia/openclaudia-skills/podcast-edit.md): Edita audio o video de podcast: recorta charla previa/posterior, quita muletillas, corta silencios, mejora el audio y aplica el mismo corte a una versión en video. --- Skills Agentes · [Índice de páginas en markdown](https://skillsagentes.com/sitemap.md) · [Inicio](https://skillsagentes.com/index.md)