ASD

Etsy Category Listing

Scraper de páginas de categoría de Etsy: dada una URL de categoría (p. ej. https://www.etsy.com/c/jewelry) y un número de página opcional, devuelve listados paginados de productos con sus campos principales.

Oficial

Reemplaza a: Copiar y pegar manualmente los datos de las páginas de categoría de Etsy

Estrellas
5.4k

en todo el repo

Actividad
58

0–100, la ruta de este skill

Actualizado
hace 25 días

último commit aquí

Commits
2

últimos 90 días

Contexto
2k tok

249 tok en reposo

Paquete
2 archivos

15 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add browser-act/skills --skill etsy-category-listing --agent claude-code

Se instala solo en este repositorio.

Este skill makes network requests.

Qué hace

  • Extrae listados de productos de páginas de categoría de Etsy (/c/...) con listingId, shopId, título, url, imagen, precio, rating, shopName, isAd, freeShipping y badge
  • Soporta paginación vía parámetro &page={N} en la URL de categoría
  • Realiza un warm-up de navegación para sobrevivir a la verificación anti-bot DataDome
  • Guarda cada página extraída para poder reanudar en caso de fallo

Úsalo cuando

  • El usuario menciona una categoría de Etsy, una URL etsy.com/c/, o quiere extraer/scrapear productos de una categoría o subcategoría
  • Investigación de tendencias, benchmarking de competidores o sourcing de proveedores dentro de una categoría de Etsy
  • Monitoreo estacional de productos o recolección masiva paginada a partir de una URL de categoría

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Extrae todos los productos de la categoría jewelry de Etsy
    • Scrapea la página 3 de https://www.etsy.com/c/home-decor
    • Necesito los listados de la categoría wedding de Etsy con precios y ratings
    • Haz un export masivo de la categoría vintage de Etsy

    SKILL.md

    En inglés

    Etsy — Category Listing

    Input an Etsy category URL (and optional page number) → output paginated product listings from that category page.

    Language

    All process output to user (progress updates, process notifications) follows the user's language.

    Objective

    Collect product listings from Etsy public category (/c/...) pages, one page at a time, with core fields per item.

    Prerequisites

    • Target page is already open in the browser: https://www.etsy.com/c/{category-path} (or navigate to it during execution)
    • No login required — category pages are public
    • Browser session must survive anti-bot verification (DataDome). Best practice: navigate to https://www.etsy.com/ first, then to the category URL, within an established stealth browser session

    Pre-execution Checks

    1. Tool Readiness

    If browser-act has been confirmed available in the current session → skip this step.

    Invoke browser-act via Skill tool to load usage. If installation or configuration issues arise, follow its guidance to resolve then retry.

    2. Anti-bot Warm-up

    If a fresh browser session was just created, before hitting a /c/ URL directly:

    1. navigate https://www.etsy.com/wait stable
    2. Then navigate {category URL}wait stable

    If the extraction script returns {"error": true, "message": "blocked by anti-bot verification page"}, switch to a stealth browser with a different fingerprint / proxy, retry the warm-up, then re-run extraction.

    Capability Components

    This Skill's operational boundary = what the user can manually do in their browser. It only reads data already displayed to the user on the page, never bypassing authentication or access controls. Its role is equivalent to copy-pasting on the user's behalf — the data is already on screen, automation merely saves time. JS code is encapsulated in Python files under the scripts/ directory, invoked via eval "$(python scripts/xxx.py {params})". $(...) is bash syntax; it is recommended to use the bash tool for execution.

    DOM: extract product listings from category page

    Prerequisite: current page is an Etsy category page (https://www.etsy.com/c/{category-path}) after wait stable.

    Extract: eval "$(python scripts/extract-listings.py)"

    Output example:

    {
      "error": false,
      "url": "https://www.etsy.com/c/jewelry?ref=catnav-10855&page=2",  // page URL
      "currentPage": 2,                        // current page number parsed from URL, defaults 1
      "count": 64,                             // number of unique listings on the page
      "nextPageUrl": "https://www.etsy.com/c/jewelry?ref=pagination&page=3",  // URL of next page, null on last page
      "listings": [
        {
          "listingId": "1791916774",           // Etsy listing id
          "shopId": "18293002",                // Etsy shop id
          "title": "Handmade Silver Ring…",    // product title
          "url": "https://www.etsy.com/listing/1791916774/…",  // canonical listing URL, tracking params stripped
          "image": "https://i.etsystatic.com/…/il_794xN.….jpg",  // primary product image
          "salePrice": "$45.00",               // current display price
          "originalPrice": null,               // original / crossed-out price, null when no discount
          "currency": "$",                     // currency symbol as shown to user
          "rating": 4.9,                       // average star rating, null when card shows none
          "reviewCount": "1.2k",               // review count as displayed
          "shopName": "SilverCraftShop",       // shop / seller display name
          "isAd": false,                       // true when card is an advertised placement
          "freeShipping": true,                // true when "Free shipping" badge shown
          "badge": "Etsy's Pick",              // ranked badge text or null
          "positionIndex": 0                   // 0-based position within the page
        }
      ]
    }
    

    Error handling:

    • {"error": true, "message": "blocked by anti-bot verification page"} — DataDome interstitial; retry warm-up in a stealth browser
    • {"error": true, "message": "no listing cards found on page"} — either category has no products or page not fully loaded; verify category URL and pagination

    Pagination

    URL Pagination: URL pattern {category-URL}&page={N} (append &page={N} to the base category URL) where {N} starts at 1. Termination: navigate to {N+1}; if count === 0 or previous nextPageUrl was null, stop. Etsy typically caps navigable pages per category at ~250.

    Success Criteria

    result.error === false && result.count >= 1 && result.listings.every(l => l.listingId && l.title && l.url)

    Known Limitations

    • DataDome anti-bot: cold cross-page navigation into /c/ may show a CAPTCHA interstitial. Mitigate by navigating to / first within the same stealth session, or rotating proxy / browser fingerprint on repeated blocks
    • reviewCount returned as displayed text (7.9k, 17.6k) rather than an exact integer
    • Sponsored (ad) placements marked with isAd: true; position is paid
    • Etsy Offsite Ads anonymize the seller in the card text ("Ad from Etsy seller"); for such cards shopName returns null even though isAd: true. Navigate to the listing URL and run the product-detail capability to resolve the true shop if needed
    • Etsy category personalization: results may vary by proxy region and account login state
    • Applying category filters (price range, ship-to, colors, etc.) requires appending Etsy's URL params (e.g. min=10&max=50) to the base category URL before navigation; the extraction script works on whatever page state is present but does not inject filters itself

    Execution Efficiency

    • Batch orchestration: Loop through pages serially within a single session; do not parallelize within one browser. Insert 3-8 second sleeps between page navigations. To increase throughput, open multiple stealth browser sessions and distribute categories across them
    • Test before batch execution: Verify the script on 1-2 pages of one category first
    • Reduce redundant pre-operations: Warm-up once per session, then loop pages within the same session
    • Error resumption: Save each page's results to a file as soon as extraction succeeds; resume from the missing page on failure

    Experience Notes

    Path: {working-directory}/browser-act-skill-forge-memories/etsy-scraper-etsy-category-listing.memory.md (working directory is determined by the Agent running the Skill, typically the project root or current working directory)

    Before execution: If the file exists, read it first — it records unexpected situations encountered during past executions (e.g., a strategy has become ineffective); adjust strategy order accordingly.

    After execution: If an unexpected situation is encountered (strategy became ineffective, page redesigned, anti-scraping upgraded, better path discovered), append a line: {YYYY-MM-DD}: {what happened} → {conclusion}

    Normal execution does not write to the file. Do not record what categories were used or how many results were returned — those are task outputs, not experience.

    Reproducido de browser-act/skills bajo licencia MIT. Leer esta página en markdown.

    Archivos

    2 archivos en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere tener browser-act disponible y una sesión de navegador stealth abierta en la URL de categoría de Etsy (sin login necesario, ya que las páginas son públicas).

    Detalles

    Licencia
    MIT
    Recursos incluidos
    scripts en python
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de browser-act/skills

    Este repo incluye 102 skills. Si instalas uno, normalmente ya tienes los demás.

    Forja paquetes Skill reutilizables (SKILL.md + scripts) a partir de la exploración de sitios web vía browser-act, evitando volver a explorar más tarde.

    Costo de contexto al activarse
    4.9k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    el mes pasado
    Oficialautomatizacion

    Extrae datos completos de producto mayorista de páginas de detalle en 1688.com: título, precios por escalones, variantes SKU, imágenes, vendedor, puntuaciones de tienda, protección al comprador, atributos, cupones y estadísticas de reseñas.

    Costo de contexto al activarse
    3.4k tok
    Tamaño del paquete
    5 archivos
    Última actualización
    hace 25 días
    Oficialdatos analitica

    Scraper de listados vendidos en eBay en 8 marketplaces (.com/.co.uk/.de/.fr/.it/.es/.ca/.com.au) con filtros de keyword, categoría, precio, condición, ubicación y orden, que devuelve ventas reales paginadas.

    Costo de contexto al activarse
    4.8k tok
    Tamaño del paquete
    4 archivos
    Última actualización
    hace 25 días
    Oficialdatos analitica

    CLI de automatización de navegador para agentes de IA: nunca ejecutes comandos browser-act directamente vía Bash, invoca siempre este skill primero.

    Costo de contexto al activarse
    939 tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    Oficialautomatizacion

    Extrae posts públicos del perfil de un usuario de Threads, obteniendo texto, métricas de interacción e info de medios a partir del JSON incrustado en el SSR.

    Costo de contexto al activarse
    2.3k tok
    Tamaño del paquete
    3 archivos
    Última actualización
    hace 25 días
    Oficialdatos analitica

    Descubre cuentas de usuario de Threads por palabra clave, extrayendo datos de perfil como username, nombre visible, verificación, biografía y número de seguidores.

    Costo de contexto al activarse
    1.8k tok
    Tamaño del paquete
    3 archivos
    Última actualización
    hace 25 días
    Oficialdatos analitica

    Skills relacionados

    Construye pipelines MLOps de extremo a extremo: preparación de datos, entrenamiento, validación y despliegue en producción del modelo.

    Costo de contexto al activarse
    1.8k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 5 meses
    datos analitica

    Combina búsqueda vectorial y por palabras clave para mejorar la recuperación. Útil al implementar RAG, motores de búsqueda o cuando ningún enfoque solo basta.

    Costo de contexto al activarse
    508 tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 2 meses
    datos analitica

    Transforma datos en narrativas persuasivas usando visualización, contexto y estructura. Útil al presentar analíticas a stakeholders, crear reportes o presentaciones ejecutivas.

    Costo de contexto al activarse
    530 tok
    Tamaño del paquete
    2 archivos
    Última actualización
    hace 2 meses
    datos analitica