Skills Agentes

Convert Documents To Markdown

Convierte Word, PowerPoint, Excel, OpenDocument, RTF, EPUB, CSV y PDF a Markdown con formato GitHub. Úsalo cuando necesitas el contenido de un documento, hoja de cálculo, presentación, ebook o PDF que no puedes leer directamente.

Oficial
Estrellas
18.3k

en el repo

Actividad
58

0–100, la ruta de este skill

Actualizado
hace 20 días

último commit aquí

Commits
1

últimos 90 días

Contexto
428 tok

73 tok en reposo

Paquete
1 archivo

2 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add firecrawl/anydoc --skill convert-documents-to-markdown --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Ejecuta el CLI `anydoc` (`npx -y @firecrawl/anydoc <file>`) para convertir el documento a Markdown, a stdout o a un archivo con `-o`
  • Detecta automáticamente el formato desde el contenido del archivo; permite forzarlo con `--format` cuando falla la detección
  • Soporta lectura desde stdin, por ejemplo `--format csv < file`
  • Ofrece librerías equivalentes (`@firecrawl/anydoc` en npm, `firecrawl-anydoc` en PyPI, `anydoc` en crates.io) para usar dentro de código Node, Python o Rust

Úsalo cuando

  • La tarea necesita el contenido de un Word, PowerPoint, Excel, OpenDocument, RTF, EPUB, CSV o PDF que no se puede leer directamente
  • El documento es grande y conviene escribirlo a un archivo con `-o` y leer solo las partes necesarias

No lo uses cuando

  • El PDF es escaneado o solo contiene imágenes, porque anydoc no hace OCR y falla como formato no soportado

Qué lo activa

Di cualquiera de estas frases y el agente debería cargar este skill.

  • Convierte este Word a Markdown
  • Necesito leer el contenido de este PDF
  • Extrae el texto de esta presentación de PowerPoint

SKILL.md

En inglés

Convert documents to Markdown

Run the anydoc CLI. It needs Node 20+ and no install:

npx -y @firecrawl/anydoc <file>              # Markdown to stdout
npx -y @firecrawl/anydoc <file> -o out.md    # write to a file
npx -y @firecrawl/anydoc - --format csv < f  # read stdin

Rules:

  1. Supported inputs: .doc, .docx, .docm, .odt, .rtf, .epub, .pdf, .ppt, .pps, .pot, .pptx, .pptm, .ppsx, .ppsm, .odp, .xls, .xlsx, .xlsm, .xlsb, .ods, .csv.
  2. The format is detected from the file content. Pass --format <name> only when detection cannot work: CSV from stdin, or a missing or wrong extension.
  3. Exit codes: 0 success, 1 the document could not be converted, 2 usage error. Failures print one anydoc: <message> line to stderr. The CLI never prompts.
  4. For a large document, write to a file with -o and read the parts you need instead of streaming everything into context.
  5. Scanned and image-only PDFs need OCR, which anydoc does not do; they fail as unsupported. The hosted Firecrawl Parse API handles those.
  6. Inside a Node, Python, or Rust codebase, prefer the library over shelling out: @firecrawl/anydoc on npm, firecrawl-anydoc on PyPI, anydoc on crates.io. Each exposes the same to_markdown / toMarkdown API.

Reproducido de firecrawl/anydoc bajo licencia MIT. Leer esta página en markdown.

Archivos

1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

Antes de instalar

Necesita Node 20+ para ejecutar `npx -y @firecrawl/anydoc <file>`; no requiere instalación previa.

Necesita en el PATH:npx

Detalles

Creador
firecrawl
Categoría
Documentos
Licencia
MIT
Recursos incluidos
Solo SKILL.md
Repositorio
firecrawl/anydoc
Código fuente
Ver SKILL.md

Skills relacionados

Docx

168k

Crea, lee, edita y manipula documentos de Word (.docx) y plantillas (.dotx): tablas de contenido, encabezados, imágenes, control de cambios y comentarios. No sirve para PDFs ni hojas de cálculo.

Costo de contexto al activarse
1.7k tok
Tamaño del paquete
61 archivos
Última actualización
el mes pasado
Oficialdocumentos

Pdf

168k

Úsalo siempre que quieras hacer algo con archivos PDF: leer o extraer texto y tablas, combinar, dividir, rotar, poner marcas de agua, crear, rellenar formularios, cifrar o hacer OCR de escaneados.

Costo de contexto al activarse
2k tok
Tamaño del paquete
12 archivos
Última actualización
hace 6 meses
Oficialdocumentos

Pptx

168k

Úsalo siempre que haya un archivo .pptx o .potx de por medio: crear decks y presentaciones, leer o extraer su texto, editarlas, o trabajar con plantillas, layouts y notas del ponente.

Costo de contexto al activarse
5.2k tok
Tamaño del paquete
56 archivos
Última actualización
el mes pasado
Oficialdocumentos