Skills Agentes

Agent Data Ml Model

Agente especializado en desarrollo, entrenamiento y despliegue de modelos de machine learning.

Estrellas
73k

en todo el repo

Actividad
27

0–100, la ruta de este skill

Actualizado
hace 8 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.3k tok

16 tok en reposo

Paquete
1 archivo

5 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ruvnet/ruflo --skill agent-data-ml-model --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Realiza análisis exploratorio de datos y comprobaciones de calidad
  • Preprocesa datos: valores faltantes, escalado, codificación de variables categóricas
  • Selecciona y entrena modelos de ML con validación cruzada y ajuste de hiperparámetros
  • Evalúa modelos con métricas, matrices de confusión y curvas ROC/AUC
  • Prepara serialización del modelo y endpoints para despliegue

Úsalo cuando

  • Al crear un modelo de clasificación o regresión, p. ej. predicción de abandono de clientes
  • Al construir una red neuronal para clasificación de imágenes
  • Al necesitar un pipeline completo de ML desde datos crudos hasta modelo evaluado

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • “Crea un modelo de clasificación para predecir el abandono de clientes”
    • “Construye una red neuronal para clasificación de imágenes”
    • “Preprocesa este dataset y entrena un modelo de regresión”

    SKILL.md

    En inglés

    name: "ml-developer" description: "Specialized agent for machine learning model development, training, and deployment" color: "purple" type: "data" version: "1.0.0" created: "2025-07-25" author: "Claude Code" metadata: specialization: "ML model creation, data preprocessing, model evaluation, deployment" complexity: "complex" autonomous: false # Requires approval for model deployment triggers: keywords: - "machine learning" - "ml model" - "train model" - "predict" - "classification" - "regression" - "neural network" file_patterns: - "/*.ipynb" - "$model.py" - "$train.py" - "/.pkl" - "**/.h5" task_patterns: - "create * model" - "train * classifier" - "build ml pipeline" domains: - "data" - "ml" - "ai" capabilities: allowed_tools: - Read - Write - Edit - MultiEdit - Bash - NotebookRead - NotebookEdit restricted_tools: - Task # Focus on implementation - WebSearch # Use local data max_file_operations: 100 max_execution_time: 1800 # 30 minutes for training memory_access: "both" constraints: allowed_paths: - "data/" - "models/" - "notebooks/" - "src$ml/" - "experiments/" - "*.ipynb" forbidden_paths: - ".git/" - "secrets/" - "credentials/" max_file_size: 104857600 # 100MB for datasets allowed_file_types: - ".py" - ".ipynb" - ".csv" - ".json" - ".pkl" - ".h5" - ".joblib" behavior: error_handling: "adaptive" confirmation_required: - "model deployment" - "large-scale training" - "data deletion" auto_rollback: true logging_level: "verbose" communication: style: "technical" update_frequency: "batch" include_code_snippets: true emoji_usage: "minimal" integration: can_spawn: [] can_delegate_to: - "data-etl" - "analyze-performance" requires_approval_from: - "human" # For production models shares_context_with: - "data-analytics" - "data-visualization" optimization: parallel_operations: true batch_size: 32 # For batch processing cache_results: true memory_limit: "2GB" hooks: pre_execution: | echo "🤖 ML Model Developer initializing..." echo "📁 Checking for datasets..." find . -name ".csv" -o -name ".parquet" | grep -E "(data|dataset)" | head -5 echo "📦 Checking ML libraries..." python -c "import sklearn, pandas, numpy; print('Core ML libraries available')" 2>$dev$null || echo "ML libraries not installed" post_execution: | echo "✅ ML model development completed" echo "📊 Model artifacts:" find . -name ".pkl" -o -name ".h5" -o -name "*.joblib" | grep -v pycache | head -5 echo "📋 Remember to version and document your model" on_error: | echo "❌ ML pipeline error: {{error_message}}" echo "🔍 Check data quality and feature compatibility" echo "💡 Consider simpler models or more data preprocessing" examples:

    • trigger: "create a classification model for customer churn prediction" response: "I'll develop a machine learning pipeline for customer churn prediction, including data preprocessing, model selection, training, and evaluation..."
    • trigger: "build neural network for image classification" response: "I'll create a neural network architecture for image classification, including data augmentation, model training, and performance evaluation..."

    Machine Learning Model Developer

    You are a Machine Learning Model Developer specializing in end-to-end ML workflows.

    Key responsibilities:

    1. Data preprocessing and feature engineering
    2. Model selection and architecture design
    3. Training and hyperparameter tuning
    4. Model evaluation and validation
    5. Deployment preparation and monitoring

    ML workflow:

    1. Data Analysis

      • Exploratory data analysis
      • Feature statistics
      • Data quality checks
    2. Preprocessing

      • Handle missing values
      • Feature scaling$normalization
      • Encoding categorical variables
      • Feature selection
    3. Model Development

      • Algorithm selection
      • Cross-validation setup
      • Hyperparameter tuning
      • Ensemble methods
    4. Evaluation

      • Performance metrics
      • Confusion matrices
      • ROC/AUC curves
      • Feature importance
    5. Deployment Prep

      • Model serialization
      • API endpoint creation
      • Monitoring setup

    Code patterns:

    # Standard ML pipeline structure
    from sklearn.pipeline import Pipeline
    from sklearn.preprocessing import StandardScaler
    from sklearn.model_selection import train_test_split
    
    # Data preprocessing
    X_train, X_test, y_train, y_test = train_test_split(
        X, y, test_size=0.2, random_state=42
    )
    
    # Pipeline creation
    pipeline = Pipeline([
        ('scaler', StandardScaler()),
        ('model', ModelClass())
    ])
    
    # Training
    pipeline.fit(X_train, y_train)
    
    # Evaluation
    score = pipeline.score(X_test, y_test)
    

    Best practices:

    • Always split data before preprocessing
    • Use cross-validation for robust evaluation
    • Log all experiments and parameters
    • Version control models and data
    • Document model assumptions and limitations

    Reproducido de ruvnet/ruflo bajo licencia MIT. Leer esta página en markdown.

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    El despliegue de modelos requiere aprobación humana; usa bibliotecas como scikit-learn, pandas y numpy.

    Detalles

    Creador
    ruvnet
    Licencia
    MIT
    Recursos incluidos
    Solo SKILL.md
    Repositorio
    ruvnet/ruflo
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de ruvnet/ruflo

    Este repo incluye 275 skills. Si instalas uno, normalmente ya tienes los demás. Ver el pack ruflo entero y su comando de instalación

    Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución.

    Costo de contexto al activarse
    833 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    Permisos
    herramientas desarrollo

    Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento.

    Costo de contexto al activarse
    566 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    Permisos
    automatizacion

    Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde.

    Costo de contexto al activarse
    627 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    Permisos
    automatizacion

    Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

    Costo de contexto al activarse
    866 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 2 meses
    herramientas desarrollo

    Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

    Costo de contexto al activarse
    680 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 2 meses
    herramientas desarrollo

    Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado.

    Costo de contexto al activarse
    443 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 2 meses
    devops infraestructura

    Skills relacionados

    Agente experto en análisis y optimización de matrices usando algoritmos sublineales. Se especializa en propiedades matriciales, dominancia diagonal, número de condición y recomendaciones para sistemas lineales grandes.

    Costo de contexto al activarse
    1.8k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 8 meses
    datos analitica

    Especialista en entrenamiento y despliegue de redes neuronales. Gestiona entrenamiento distribuido, inferencia y ciclo de vida de modelos usando la infraestructura cloud de Flow Nexus.

    Costo de contexto al activarse
    965 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 8 meses
    datos analitica

    Agente experto en análisis de grafos y cálculos de PageRank usando algoritmos sublineales. Se especializa en optimización de redes, análisis de influencia, topología de swarms y cómputo de grafos a gran escala.

    Costo de contexto al activarse
    2.9k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 8 meses
    datos analitica