Skills Agentes

Harness Gepa

Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución.

Solicitabash
Estrellas
73k

en todo el repo

Actividad
61

0–100, la ruta de este skill

Actualizado
el mes pasado

último commit aquí

Commits
2

últimos 90 días

Contexto
833 tok

116 tok en reposo

Paquete
1 archivo

3 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ruvnet/ruflo --skill harness-gepa --agent claude-code

Se instala solo en este repositorio.

Este skill runs shell commands.

Qué hace

  • --op genome: carga y valida un genoma (por defecto el cand-6 ya promovido).
  • --op render: muestra el system prompt real que compila un genoma.
  • --op validate: valida la estructura de un genoma y puede fallar con --alert-on-invalid.
  • --op analyze: clasifica los modos de fallo de una transcripción de ejecución.

Úsalo cuando

  • Vas a adoptar una política evolucionada y quieres leer el system prompt real antes de conectarla a un harness.
  • Necesitas auditar una promoción de genoma o validarla como gate en CI.
  • Estás depurando una ejecución fallida y quieres clasificar sus modos de fallo.

No lo uses cuando

  • Para ejecutar el bucle gepaOptimize en sí, que requiere un evaluador en proceso; usa harness-evolve en su lugar.

Qué lo activa

Di cualquiera de estas frases y el agente debería cargar este skill.

  • “Muestra el system prompt del genoma cand-6”
  • “Valida este archivo de genoma”

SKILL.md

En inglés

Surfaces the GEPA (genetic-evolution prompt-adaptation) library exports from @metaharness/darwin/gepa. Unlike the other skills in this plugin there is no CLI binary behind this — the script dynamic-imports the library (local resolution first, versioned cache install as fallback) and calls the subprocess-safe subset.

When to use

  • Adopting an evolved policy: --op render shows the actual system prompt a genome compiles to — read THAT, not the raw JSON, before wiring a genome into a harness.
  • Auditing a promotion: --op genome loads + validates the shipped cand-6 genome (first holdout-confirmed cheap-tier promotion; provenance ships in the package) or any genome file you point at.
  • CI gate on genome edits: --op validate --alert-on-invalid exits 1 on structural errors.
  • Debugging a bad run: --op analyze --transcript run.json classifies failure modes (GEPA's failure-class taxonomy) from a transcript array.

What is deliberately NOT here

gepaOptimize — the optimization loop takes an in-process evaluate(candidate) callback ("bring your own evaluator") that cannot cross a subprocess boundary. Two supported paths instead:

  1. Library consumers: import { gepaOptimize, loadCand6Genome } from '@metaharness/darwin/gepa'
  2. Sandbox-scored evolution: harness-evolve (darwin CLI evolve), which pairs GEPA with its own sandbox evaluators.

Algorithm

Implementation: scripts/gepa.mjs.

  1. import('@metaharness/darwin/gepa'); on MODULE_NOT_FOUND fall back to a one-time npm install --prefix ~/.ruflo/darwin-cache-0.8.0 and import the cached dist/gepa/index.js (versioned dir → pin bumps invalidate).
  2. Dispatch --op:
    • genome → loadGenome(fs, path) or loadCand6Genome() + validateGenome
    • validate → validateGenome(rawJson) (raw parse so broken files reach the validator instead of throwing in the loader)
    • render → buildSystemFromGenome(genome, ext?, glob?)
    • analyze → analyzeTranscript(entries)
  3. Emit one JSON object; exit 0 (or 1 under --alert-on-invalid, 2 on bad input).

Examples

node scripts/gepa.mjs --op genome                          # cand-6 + validation
node scripts/gepa.mjs --op render | jq -r .system         # what does cand-6 SAY?
node scripts/gepa.mjs --op validate --path my-genome.json --alert-on-invalid
node scripts/gepa.mjs --op analyze --transcript run.json

Exit codes

  • 0 — op completed (or degraded — darwin not installable)
  • 1 — --alert-on-invalid and validation found errors
  • 2 — config error (unknown op, missing/broken input file)

Reproducido de ruvnet/ruflo bajo licencia MIT. Leer esta página en markdown.

Archivos

1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

Antes de instalar

Se degrada con normalidad si @metaharness/darwin no está instalado.

Necesita en el PATH:jqnode

Detalles

Creador
ruvnet
Licencia
MIT
Recursos incluidos
Solo SKILL.md
Repositorio
ruvnet/ruflo
Código fuente
Ver SKILL.md

Etiquetas

Más de ruvnet/ruflo

Este repo incluye 275 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack ruflo entero y su comando de instalación

Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento.

Costo de contexto al activarse
566 tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
Permisos
automatizacion

Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde.

Costo de contexto al activarse
627 tok
Tamaño del paquete
1 archivo
Última actualización
el mes pasado
Permisos
automatizacion

Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

Costo de contexto al activarse
866 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
herramientas desarrollo

Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

Costo de contexto al activarse
680 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
herramientas desarrollo

Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado.

Costo de contexto al activarse
443 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
devops infraestructura

Informe de preparación del repo en 7 secciones desde metaharness genome: repo_type, agent_topology, risk_score, mcp_surface, test_confidence y publish_readiness.

Costo de contexto al activarse
560 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
Permisos
herramientas desarrollo

Skills relacionados

Añade descripciones de modelos nuevos del router de HuggingFace a la configuración de chat-ui (prod.yaml y dev.yaml).

Costo de contexto al activarse
600 tok
Tamaño del paquete
1 archivo
Última actualización
hace 7 meses
herramientas desarrollo

Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

Costo de contexto al activarse
680 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
herramientas desarrollo

Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

Costo de contexto al activarse
866 tok
Tamaño del paquete
1 archivo
Última actualización
hace 2 meses
herramientas desarrollo