Skills Agentes

Harness Gepa

Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución.

Solicitabash
Estrellas
69.4k

en todo el repo

Actividad
61

0–100, la ruta de este skill

Actualizado
hace 4 días

último commit aquí

Commits
2

últimos 90 días

Contexto
833 tok

116 tok en reposo

Paquete
1 archivo

3 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ruvnet/ruflo --skill harness-gepa --agent claude-code

Se instala solo en este repositorio.

Este skill runs shell commands.

Qué hace

  • --op genome: carga y valida un genoma (por defecto el cand-6 ya promovido).
  • --op render: muestra el system prompt real que compila un genoma.
  • --op validate: valida la estructura de un genoma y puede fallar con --alert-on-invalid.
  • --op analyze: clasifica los modos de fallo de una transcripción de ejecución.

Úsalo cuando

  • Vas a adoptar una política evolucionada y quieres leer el system prompt real antes de conectarla a un harness.
  • Necesitas auditar una promoción de genoma o validarla como gate en CI.
  • Estás depurando una ejecución fallida y quieres clasificar sus modos de fallo.

No lo uses cuando

  • Para ejecutar el bucle gepaOptimize en sí, que requiere un evaluador en proceso; usa harness-evolve en su lugar.

Qué lo activa

Di cualquiera de estas frases y el agente debería cargar este skill.

  • Muestra el system prompt del genoma cand-6
  • Valida este archivo de genoma

SKILL.md

En inglés

Surfaces the GEPA (genetic-evolution prompt-adaptation) library exports from @metaharness/darwin/gepa. Unlike the other skills in this plugin there is no CLI binary behind this — the script dynamic-imports the library (local resolution first, versioned cache install as fallback) and calls the subprocess-safe subset.

When to use

  • Adopting an evolved policy: --op render shows the actual system prompt a genome compiles to — read THAT, not the raw JSON, before wiring a genome into a harness.
  • Auditing a promotion: --op genome loads + validates the shipped cand-6 genome (first holdout-confirmed cheap-tier promotion; provenance ships in the package) or any genome file you point at.
  • CI gate on genome edits: --op validate --alert-on-invalid exits 1 on structural errors.
  • Debugging a bad run: --op analyze --transcript run.json classifies failure modes (GEPA's failure-class taxonomy) from a transcript array.

What is deliberately NOT here

gepaOptimize — the optimization loop takes an in-process evaluate(candidate) callback ("bring your own evaluator") that cannot cross a subprocess boundary. Two supported paths instead:

  1. Library consumers: import { gepaOptimize, loadCand6Genome } from '@metaharness/darwin/gepa'
  2. Sandbox-scored evolution: harness-evolve (darwin CLI evolve), which pairs GEPA with its own sandbox evaluators.

Algorithm

Implementation: scripts/gepa.mjs.

  1. import('@metaharness/darwin/gepa'); on MODULE_NOT_FOUND fall back to a one-time npm install --prefix ~/.ruflo/darwin-cache-0.8.0 and import the cached dist/gepa/index.js (versioned dir → pin bumps invalidate).
  2. Dispatch --op:
    • genomeloadGenome(fs, path) or loadCand6Genome() + validateGenome
    • validatevalidateGenome(rawJson) (raw parse so broken files reach the validator instead of throwing in the loader)
    • renderbuildSystemFromGenome(genome, ext?, glob?)
    • analyzeanalyzeTranscript(entries)
  3. Emit one JSON object; exit 0 (or 1 under --alert-on-invalid, 2 on bad input).

Examples

node scripts/gepa.mjs --op genome                          # cand-6 + validation
node scripts/gepa.mjs --op render | jq -r .system         # what does cand-6 SAY?
node scripts/gepa.mjs --op validate --path my-genome.json --alert-on-invalid
node scripts/gepa.mjs --op analyze --transcript run.json

Exit codes

  • 0 — op completed (or degraded — darwin not installable)
  • 1--alert-on-invalid and validation found errors
  • 2 — config error (unknown op, missing/broken input file)

Reproducido de ruvnet/ruflo bajo licencia MIT. Leer esta página en markdown.

Archivos

1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

Antes de instalar

Se degrada con normalidad si @metaharness/darwin no está instalado.

Necesita en el PATH:jqnode

Detalles

Creador
ruvnet
Licencia
MIT
Recursos incluidos
Solo SKILL.md
Repositorio
ruvnet/ruflo
Código fuente
Ver SKILL.md

Etiquetas

Más de ruvnet/ruflo

Este repo incluye 275 skills. Si instalas uno, normalmente ya tienes los demás.

Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento.

Costo de contexto al activarse
566 tok
Tamaño del paquete
1 archivo
Última actualización
hace 4 días
Permisos
automatizacion

Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde.

Costo de contexto al activarse
627 tok
Tamaño del paquete
1 archivo
Última actualización
hace 4 días
Permisos
automatizacion

Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

Costo de contexto al activarse
866 tok
Tamaño del paquete
1 archivo
Última actualización
hace 27 días
herramientas desarrollo

Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

Costo de contexto al activarse
680 tok
Tamaño del paquete
1 archivo
Última actualización
hace 27 días
herramientas desarrollo

Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado.

Costo de contexto al activarse
443 tok
Tamaño del paquete
1 archivo
Última actualización
hace 26 días
devops infraestructura

Informe de preparación del repo en 7 secciones desde metaharness genome: repo_type, agent_topology, risk_score, mcp_surface, test_confidence y publish_readiness.

Costo de contexto al activarse
560 tok
Tamaño del paquete
1 archivo
Última actualización
hace 27 días
Permisos
herramientas desarrollo

Skills relacionados

Añade descripciones de modelos nuevos del router de HuggingFace a la configuración de chat-ui (prod.yaml y dev.yaml).

Costo de contexto al activarse
600 tok
Tamaño del paquete
1 archivo
Última actualización
hace 5 meses
herramientas desarrollo

Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

Costo de contexto al activarse
680 tok
Tamaño del paquete
1 archivo
Última actualización
hace 27 días
herramientas desarrollo

Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

Costo de contexto al activarse
866 tok
Tamaño del paquete
1 archivo
Última actualización
hace 27 días
herramientas desarrollo