Skills Agentes

Cost Session

Desglose de costo por mensaje dentro de una sola sesión. Es el complemento de detalle de cost-anomaly: cuando se marca una sesión como outlier, muestra qué mensajes concretos fueron caros.

Solicitabash
Estrellas
69.4k

en todo el repo

Actividad
49

0–100, la ruta de este skill

Actualizado
hace 2 meses

último commit aquí

Commits
1

últimos 90 días

Contexto
787 tok

69 tok en reposo

Paquete
1 archivo

3 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ruvnet/ruflo --skill cost-session --agent claude-code

Se instala solo en este repositorio.

Este skill runs shell commands.

Qué hace

  • Muestra el desglose de costo por mensaje dentro de una sola sesión, ordenado de mayor a menor.
  • Calcula percentiles p50/p90/p99 del costo por mensaje y marca si el mensaje top es más de 2× el p99.
  • Distingue el costo por escritura de caché del de tokens de salida, que puede ser el verdadero causante del gasto.

Úsalo cuando

  • Cuando `cost-anomaly` marca una sesión como outlier y hay que ver qué MENSAJES concretos fueron caros.

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • ¿Qué mensajes de esta sesión fueron los más caros?
    • Investiga por qué esta sesión salió tan cara

    SKILL.md

    En inglés

    When cost-anomaly flags a session as a >3.5σ outlier, the next question is "which MESSAGES were expensive?". cost-session answers that.

    Question Skill
    "Which sessions cost the most?" cost-conversation
    "Which sessions are outliers?" cost-anomaly
    "Which messages in THIS session were expensive?" cost-session ← this

    Algorithm

    Implementation: scripts/session.mjs.

    1. Resolve session jsonl: --session-id <id> (scans ~/.claude/projects/*/) or --latest (default; picks most-recently-modified jsonl).
    2. Parse all assistant messages with usage blocks.
    3. Cost each message via shared PRICING (_prices.mjs).
    4. Sort descending by cost_usd, surface top-N (default 20).
    5. Compute p50/p90/p99 of message costs for in-session percentile context.
    6. Flag the top message if it's >2× the p99 — that's an in-session outlier.

    Why this matters: cache writes are the silent cost

    Example real session, top message:

    | # | Model    | In | Out | Cache W | Cache R | Cost      |
    | 1 | opus-4-7 | 6  | 569 | 881898  | 0       | $16.58    |
    

    Without the Cache W column it looks like "569 output tokens cost $16" — that's wrong by 380×. The actual cost is ephemeral 1h cache write at opus pricing: 881,898 tokens × $18.75/1M = $16.54.

    Operators reading the table see immediately: "the model wrote 881K tokens to ephemeral cache". From there the question becomes "why did we cache 881K tokens of context for a 6-input request?" — that's a real engineering signal.

    Drill-down workflow

    # Step 1: find outliers across all sessions
    cost anomaly --alert-on-outliers 1 || cost anomaly  # see which session-ids
    
    # Step 2: drill into the flagged session
    cost session --session-id <flagged-id> --top 10
    
    # Step 3: open that jsonl at the timestamp the top message reports,
    # inspect the prompt + tool calls
    

    Percentile context

    Top of output:

    | p50 (median) message | $0.85 |
    | p90 message          | $1.45 |
    | p99 message          | $1.74 |
    

    Lets operators ask "is this top message a 2× outlier or a 380× one?" without having to compute it themselves. The "top is >2× p99" footer fires when the answer is "yes, this is an in-session outlier worth investigating".

    --since filter

    Useful for drilling into a specific time range within a long session:

    cost session --since 2026-06-16T13:00:00Z --top 5
    

    Only messages with timestamp >= --since are considered.

    Edge cases

    • No costed assistant messages → "No costed assistant messages" + exit 0.
    • --session-id not found in any project's jsonls → exit 2 with error.
    • --top must be a positive integer → exit 2.

    Reproducido de ruvnet/ruflo bajo licencia MIT. Leer esta página en markdown.

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Lee el jsonl de la sesión desde `~/.claude/projects/*/`.

    Detalles

    Creador
    ruvnet
    Licencia
    MIT
    Recursos incluidos
    Solo SKILL.md
    Repositorio
    ruvnet/ruflo
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de ruvnet/ruflo

    Este repo incluye 275 skills. Si instalas uno, normalmente ya tienes los demás.

    Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución.

    Costo de contexto al activarse
    833 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    herramientas desarrollo

    Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento.

    Costo de contexto al activarse
    566 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    automatizacion

    Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde.

    Costo de contexto al activarse
    627 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    automatizacion

    Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

    Costo de contexto al activarse
    866 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 27 días
    herramientas desarrollo

    Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

    Costo de contexto al activarse
    680 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 27 días
    herramientas desarrollo

    Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado.

    Costo de contexto al activarse
    443 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 26 días
    devops infraestructura

    Skills relacionados

    Agente especializado en desarrollo, entrenamiento y despliegue de modelos de machine learning.

    Costo de contexto al activarse
    1.3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    datos analitica

    Agente experto en análisis y optimización de matrices usando algoritmos sublineales. Se especializa en propiedades matriciales, dominancia diagonal, número de condición y recomendaciones para sistemas lineales grandes.

    Costo de contexto al activarse
    1.8k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    datos analitica

    Especialista en entrenamiento y despliegue de redes neuronales. Gestiona entrenamiento distribuido, inferencia y ciclo de vida de modelos usando la infraestructura cloud de Flow Nexus.

    Costo de contexto al activarse
    965 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    datos analitica