Skills Agentes

Browser

Automatización de navegador web con snapshots optimizados para IA, pensada para agentes de claude-flow.

Solicitabrowser/openbrowser/snapshotbrowser/clickbrowser/fillbrowser/screenshotbrowser/close
Estrellas
69.4k

en todo el repo

Actividad
42

0–100, la ruta de este skill

Actualizado
hace 3 meses

último commit aquí

Commits
0

últimos 90 días

Contexto
1.3k tok

18 tok en reposo

Paquete
1 archivo

5 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add ruvnet/ruflo --skill browser --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests.

Qué hace

  • Automatiza un navegador web usando agent-browser con snapshots de accesibilidad optimizados para IA en vez del DOM completo, reduciendo el contexto un 93%.
  • Permite navegar, interactuar (click, fill, type, select) y extraer información usando referencias de elementos (@e1, @e2).
  • Soporta sesiones aisladas para trabajo en paralelo y se integra con memoria y hooks de Claude Flow.

Úsalo cuando

  • Necesitas navegar, rellenar formularios, hacer scraping o tomar capturas de una página web.
  • Quieres reutilizar patrones de navegación guardados en memoria (por ejemplo, un flujo de login).

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Abre example.com y haz login con estas credenciales
    • Extrae el nombre y precio de los productos de esta página

    SKILL.md

    En inglés

    Browser Automation Skill

    Web browser automation using agent-browser with AI-optimized snapshots. Reduces context by 93% using element refs (@e1, @e2) instead of full DOM.

    Core Workflow

    # 1. Navigate to page
    agent-browser open <url>
    
    # 2. Get accessibility tree with element refs
    agent-browser snapshot -i    # -i = interactive elements only
    
    # 3. Interact using refs from snapshot
    agent-browser click @e2
    agent-browser fill @e3 "text"
    
    # 4. Re-snapshot after page changes
    agent-browser snapshot -i
    

    Quick Reference

    Navigation

    Command Description
    open <url> Navigate to URL
    back Go back
    forward Go forward
    reload Reload page
    close Close browser

    Snapshots (AI-Optimized)

    Command Description
    snapshot Full accessibility tree
    snapshot -i Interactive elements only (buttons, links, inputs)
    snapshot -c Compact (remove empty elements)
    snapshot -d 3 Limit depth to 3 levels
    screenshot [path] Capture screenshot (base64 if no path)

    Interaction

    Command Description
    click <sel> Click element
    fill <sel> <text> Clear and fill input
    type <sel> <text> Type with key events
    press <key> Press key (Enter, Tab, etc.)
    hover <sel> Hover element
    select <sel> <val> Select dropdown option
    check/uncheck <sel> Toggle checkbox
    scroll <dir> [px] Scroll page

    Get Info

    Command Description
    get text <sel> Get text content
    get html <sel> Get innerHTML
    get value <sel> Get input value
    get attr <sel> <attr> Get attribute
    get title Get page title
    get url Get current URL

    Wait

    Command Description
    wait <selector> Wait for element
    wait <ms> Wait milliseconds
    wait --text "text" Wait for text
    wait --url "pattern" Wait for URL
    wait --load networkidle Wait for load state

    Sessions

    Command Description
    --session <name> Use isolated session
    session list List active sessions

    Selectors

    Element Refs (Recommended)

    # Get refs from snapshot
    agent-browser snapshot -i
    # Output: button "Submit" [ref=e2]
    
    # Use ref to interact
    agent-browser click @e2
    

    CSS Selectors

    agent-browser click "#submit"
    agent-browser fill ".email-input" "test@test.com"
    

    Semantic Locators

    agent-browser find role button click --name "Submit"
    agent-browser find label "Email" fill "test@test.com"
    agent-browser find testid "login-btn" click
    

    Examples

    Login Flow

    agent-browser open https://example.com/login
    agent-browser snapshot -i
    agent-browser fill @e2 "user@example.com"
    agent-browser fill @e3 "password123"
    agent-browser click @e4
    agent-browser wait --url "**/dashboard"
    

    Form Submission

    agent-browser open https://example.com/contact
    agent-browser snapshot -i
    agent-browser fill @e1 "John Doe"
    agent-browser fill @e2 "john@example.com"
    agent-browser fill @e3 "Hello, this is my message"
    agent-browser click @e4
    agent-browser wait --text "Thank you"
    

    Data Extraction

    agent-browser open https://example.com/products
    agent-browser snapshot -i
    # Iterate through product refs
    agent-browser get text @e1  # Product name
    agent-browser get text @e2  # Price
    agent-browser get attr @e3 href  # Link
    

    Multi-Session (Swarm)

    # Session 1: Navigator
    agent-browser --session nav open https://example.com
    agent-browser --session nav state save auth.json
    
    # Session 2: Scraper (uses same auth)
    agent-browser --session scrape state load auth.json
    agent-browser --session scrape open https://example.com/data
    agent-browser --session scrape snapshot -i
    

    Integration with Claude Flow

    MCP Tools

    All browser operations are available as MCP tools with browser/ prefix:

    • browser/open
    • browser/snapshot
    • browser/click
    • browser/fill
    • browser/screenshot
    • etc.

    Memory Integration

    # Store successful patterns
    npx @claude-flow/cli memory store --namespace browser-patterns --key "login-flow" --value "snapshot->fill->click->wait"
    
    # Retrieve before similar task
    npx @claude-flow/cli memory search --query "login automation"
    

    Hooks

    # Pre-browse hook (get context)
    npx @claude-flow/cli hooks pre-edit --file "browser-task.ts"
    
    # Post-browse hook (record success)
    npx @claude-flow/cli hooks post-task --task-id "browse-1" --success true
    

    Tips

    1. Always use snapshots - They're optimized for AI with refs
    2. Prefer -i flag - Gets only interactive elements, smaller output
    3. Use refs, not selectors - More reliable, deterministic
    4. Re-snapshot after navigation - Page state changes
    5. Use sessions for parallel work - Each session is isolated

    Reproducido de ruvnet/ruflo bajo licencia MIT. Leer esta página en markdown.

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere el CLI agent-browser instalado.

    Necesita en el PATH:npx

    Detalles

    Creador
    ruvnet
    Categoría
    Automatización
    Licencia
    MIT
    Recursos incluidos
    Solo SKILL.md
    Repositorio
    ruvnet/ruflo
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de ruvnet/ruflo

    Este repo incluye 275 skills. Si instalas uno, normalmente ya tienes los demás.

    Inspecciona y audita genomas GEPA: carga y valida un genoma, renderiza el system prompt que compila, o clasifica los modos de fallo de una transcripción de ejecución.

    Costo de contexto al activarse
    833 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    herramientas desarrollo

    Completion de un solo turno contra el modelo deepseek-chat de DeepSeek vía /v1/chat/completions. Lee DEEPSEEK_API_KEY y degrada con status:degraded si falta o la API no responde. Para tareas sin razonamiento.

    Costo de contexto al activarse
    566 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    automatizacion

    Completion en modo razonamiento contra deepseek-reasoner (R1) de DeepSeek. Devuelve el chain-of-thought por separado de la respuesta final. Lee DEEPSEEK_API_KEY y degrada si falta o la API no responde.

    Costo de contexto al activarse
    627 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 4 días
    Permisos
    automatizacion

    Construye o reconstruye el índice de ADRs y su grafo de dependencias ejecutando scripts/import.mjs, en vez de cientos de llamadas MCP.

    Costo de contexto al activarse
    866 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 27 días
    herramientas desarrollo

    Crea un nuevo Architecture Decision Record con numeración secuencial y registro en AgentDB.

    Costo de contexto al activarse
    680 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 27 días
    herramientas desarrollo

    Muestra el estado de la integración AGNTCY/SLIM/CASA: si los paquetes están instalados, qué transporte está activo y si el enforcement de CASA está habilitado.

    Costo de contexto al activarse
    443 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 26 días
    devops infraestructura

    Skills relacionados

    Coordinador de swarm que cambia dinámicamente de topología (jerárquica, malla, anillo, híbrida) y se reoptimiza en tiempo real según patrones de rendimiento y carga de trabajo, con aprendizaje integrado.

    Costo de contexto al activarse
    4k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    automatizacion

    Especialista en Goal-Oriented Action Planning (GOAP) que crea planes dinámicos e inteligentes para objetivos complejos, combinando técnicas de IA de videojuegos, replanificación adaptativa y optimización sublineal.

    Costo de contexto al activarse
    6.3k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    automatizacion

    Especialista en coordinación inteligente y generación dinámica de agentes: analiza tareas y crea automáticamente los agentes con las capacidades óptimas para cada trabajo.

    Costo de contexto al activarse
    1.4k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 6 meses
    automatizacion