TL;DR
Una skill instalada y sin usar cuesta muy poco: 70 tokens de mediana, solo su nombre y su descripción. Es el precio que pagas en todas las sesiones.
El número que decide es el de activación: 1.805 tokens de mediana, pero el rango va de 35 a 57.360. Ahí está toda la diferencia entre una skill barata y una cara.
El 55 % de las skills del directorio cabe en 2.000 tokens al activarse. El 90 % cabe en 5.000. Las que se salen de ahí suelen traer documentación adjunta.
La regla práctica: pocas skills transversales en global, las específicas por proyecto, y comparar siempre lo que cuesta activarla con las rondas de corrección que ahorra.
Cómo consume contexto una skill
Una skill no se carga entera al arrancar la sesión. Claude Code usa carga progresiva en tres niveles, y cada uno tiene un precio distinto.
Nivel 1 — instalada. Mientras la skill está en .claude/skills y nada la ha activado, el agente solo mantiene en contexto su nombre y la descripción del frontmatter. Es lo mínimo que necesita para saber que existe y decidir si le sirve. Es un coste permanente: lo pagas en todas las sesiones de todos los proyectos donde esté instalada, la uses o no.
Nivel 2 — activada. Cuando lo que pides coincide con la descripción, el agente lee el SKILL.md entero. Este coste se paga una vez, y solo en la sesión que dispara la skill.
Nivel 3 — con referencias. Si el procedimiento lo pide, la skill abre además los archivos de references/. Es el techo del coste, no el habitual. Solo importa en las skills que traen documentación larga adjunta.
La consecuencia es la que casi nadie calcula antes de instalar: veinte skills instaladas no te cuestan veinte SKILL.md. Te cuestan veinte descripciones. Pero la que se activa sí te cuesta entera.
Cuánto cuesta de verdad: los números de 2.863 skills
Estas son las cifras reales del corpus que indexa el directorio, medidas sobre el texto de cada SKILL.md.
| Nivel | Mediana | P25 – P75 | P90 | Máximo |
|---|---|---|---|---|
| Instalada (descripción) | 70 tokens | 46 – 118 | 175 | 556 |
Activada (SKILL.md) |
1.805 tokens | 986 – 3.057 | 4.907 | 57.360 |
| Con referencias | 3.177 tokens | 1.358 – 9.229 | 27.544 | 20.095.259 |
Tres lecturas útiles de esta tabla:
El coste de tener una skill instalada es despreciable. La mediana son 70 tokens y el máximo del catálogo entero son 556. Aunque instales treinta skills, hablamos de unos 2.100 tokens de contexto permanente: alrededor del 1 % de una ventana de 200.000. No es ahí donde se te va el contexto.
El coste de activación es el que decide. La mediana es 1.805 tokens, pero la distribución tiene cola larga: el 55 % de las skills cabe en 2.000 tokens, el 90 % en 5.000, y un puñado se dispara por encima de 16.000.
Las referencias son el riesgo oculto. 926 de las 2.863 skills traen archivos en
references/. En esas, el bundle completo es 5,2 veces elSKILL.mdde mediana. Es un techo que casi nunca se toca, pero conviene mirarlo en las skills que envuelven documentación de una API entera.
Un dato que ordena bastante el panorama: la mediana de activación de las 20 skills más instaladas del directorio es de 1.435 tokens, muy por debajo de la mediana general. Lo que la gente usa de verdad tiende a ser barato.
Qué número mirar antes de instalar
El de activación, casi siempre.
Lo que decide si una skill merece el sitio no es su tamaño absoluto, sino la relación entre lo que cuesta activarla y lo que ahorra en la tarea. Una skill de 2.000 tokens que evita tres rondas de correcciones sale rentable en la primera ejecución: esas tres rondas cuestan mucho más de 2.000 tokens entre tus mensajes, la relectura de archivos y las respuestas del agente. Una de 12.000 que solo reordena un poco la salida no lo será nunca.
Los tres números están en la ficha de cada skill del directorio, y el catálogo se puede filtrar por coste en contexto para ver únicamente las que caben por debajo de 2.000 tokens al activarse.
Cuántas skills caben en la ventana de contexto
No hay un límite duro, porque el nivel 1 casi no pesa. El límite real es cuántas se activan a la vez en una misma sesión. Con una ventana de 200.000 tokens, tres skills medianas activadas en la misma tarea son unos 5.000 tokens: nada. El problema aparece cuando una sola arrastra su carpeta de referencias en una sesión que ya iba llena.
La regla que funciona:
- En global (
~/.claude/skills), solo lo transversal: depuración, verificación, escritura, revisión. Cinco o seis como mucho. Todo lo que pongas aquí compite por la atención del agente en cada proyecto que abras. - En cada proyecto (
.claude/skills), lo que ese proyecto usa de verdad. Aquí puedes ser generoso: si no abres ese repositorio, su contexto no te cuesta nada en los demás. - Cuando dudes de una, desinstálala. La que hace falta se vuelve a instalar en un comando.
Hay un segundo motivo, además del contexto, para no acumular skills en global: cuantas más descripciones parecidas compitan, más fácil es que el agente active la que no era.
Cómo ahorrar tokens en Claude Code
Las skills son una parte pequeña del presupuesto. Si el objetivo es que la sesión dure más, este es el orden por impacto:
1. Mide antes de recortar. El comando /context muestra el desglose de lo que ocupa la ventana ahora mismo: instrucciones del sistema, CLAUDE.md, herramientas MCP, archivos leídos y mensajes. Casi siempre el mayor consumidor no es el que uno esperaba.
2. Revisa los servidores MCP antes que las skills. Las definiciones de las herramientas de un servidor MCP están en contexto desde el primer turno, y un servidor con muchas herramientas puede costar más que todas tus skills juntas. Desconecta los que no uses en ese proyecto.
3. Usa /clear entre tareas distintas. Cambiar de tarea sin limpiar arrastra todo el historial anterior. /compact resume la conversación y conserva el hilo; /clear la borra. Para empezar algo sin relación con lo anterior, /clear es más barato.
4. Acorta el CLAUDE.md. Se carga entero en cada sesión de ese proyecto, sin carga progresiva. Un CLAUDE.md de 3.000 tokens cuesta más al día que casi cualquier skill del catálogo. Si no quieres reescribirlo a mano, Caveman Compress lo comprime y deja una copia legible aparte.
5. Deja que el agente lea menos. Pedir un archivo concreto en vez de una búsqueda amplia, y una prueba concreta en vez de la suite entera, es lo que más contexto ahorra en la práctica.
Instalar skills ligeras ayuda, pero mueve cientos de tokens. Los cuatro puntos anteriores mueven miles.
Skills que ahorran más de lo que cuestan
Hay una categoría de skills cuyo trabajo es precisamente reducir tokens. Son el mejor ejemplo de la comparación que propone este artículo: todas cuestan menos de 1.700 tokens al activarse, y todas recortan mucho más que eso en la sesión.
| Skill | Coste al activarse | Qué recorta |
|---|---|---|
| Caveman | 1.554 tokens | Comprime las respuestas del agente. Su autor mide un recorte del 65 % en tokens de salida, sin tocar código, comandos ni mensajes de error. |
| Caveman Compress | 1.221 tokens | Comprime CLAUDE.md, listas de tareas y ficheros de preferencias. Ataca el coste de entrada, el que pagas en cada sesión. |
| Caveman Review | 685 tokens | Revisiones de código en una línea por hallazgo: ubicación, problema y arreglo. |
| Ponytail | 1.659 tokens | Fuerza la solución más simple que funcione. Menos código generado es menos código que releer después. |
| Ponytail Debt | 426 tokens | Reúne en un registro los atajos que Ponytail marca, para no releer el repositorio entero buscándolos. |
| Find Skills | 1.368 tokens | Busca e instala skills desde la propia sesión. Evita el gasto de instalar a ciegas y descubrirlo luego. |
Caveman es, con más de 470.000 instalaciones, la más popular de este grupo, y el patrón se repite en el catálogo: la salida del agente suele pesar más que las instrucciones que la producen. Recortar el formato de las respuestas rinde más que recortar las skills.
Las tres primeras comparten repositorio y se instalan juntas. Tenerlas las tres cuesta 263 tokens de contexto permanente: cada una solo carga su cuerpo cuando la tarea la dispara.
Preguntas frecuentes
¿Una skill consume tokens si no la uso nunca?
Sí, pero muy pocos. Mientras está instalada y no se activa, solo su nombre y su descripción están en contexto: 70 tokens de mediana en el catálogo, con un máximo de 556. El SKILL.md completo no se carga hasta que algo lo dispara.
¿Cuántos tokens ocupa una skill al activarse?
La mediana del directorio son 1.805 tokens, y el rango va de 35 a 57.360. El 55 % de las skills cabe en 2.000 tokens y el 90 % en 5.000. Las que superan los 10.000 suelen incluir tablas de referencia o documentación de una API dentro del propio SKILL.md.
¿Cuántas skills puedo tener instaladas sin quedarme sin contexto?
Muchas más de las que imaginas, porque el coste permanente es la descripción. Treinta skills instaladas son unos 2.100 tokens, cerca del 1 % de una ventana de 200.000. El límite práctico no es el contexto sino la precisión: con demasiadas descripciones parecidas, el agente activa la que no era.
¿Qué consume más contexto: las skills o los servidores MCP?
Los servidores MCP, en la mayoría de configuraciones. Sus definiciones de herramientas están en contexto desde el primer turno de cada sesión y no usan carga progresiva. Una skill solo paga su descripción hasta que se activa. Si vas justo de contexto, revisa primero qué MCP tienes conectados.
¿Cómo veo cuánto contexto me queda en Claude Code?
Con /context, que imprime el desglose por categorías de lo que ocupa la ventana en ese momento. Es el punto de partida para cualquier optimización: sin ese desglose, recortar es adivinar.
¿Hay skills que reduzcan el consumo de tokens?
Sí, y son de las más instaladas del directorio. Caveman comprime las respuestas del agente, Caveman Compress comprime el CLAUDE.md y Ponytail fuerza soluciones más cortas. Las tres cuestan menos de 1.700 tokens al activarse y recortan bastante más que eso en una sesión larga.
¿Merece la pena una skill de 10.000 tokens?
Depende de qué evita, no de lo que pesa. Si sustituye una sesión de prueba y error que habría costado tres o cuatro veces más, sale rentable. Si solo cambia el formato de la salida, no. La comparación correcta es contra el coste de hacer la tarea sin ella.
Para seguir
- Qué es una Claude Skill y cómo se instala — el marco completo: estructura del
SKILL.md, carga progresiva e instalación por proyecto o en global. - Las mejores skills para Claude — la selección por tipo de trabajo, con el coste en contexto de cada una.
- Directorio de skills filtrado por coste — solo las que caben por debajo de 2.000 tokens al activarse.
- Documentación de Agent Skills — Anthropic — referencia oficial de la estructura del
SKILL.mdy del sistema de carga. - Gestión del contexto en Claude Code — comandos de sesión y buenas prácticas de coste.
