ASD

Elevenlabs Dialogue

Generación de diálogo multi-hablante de ElevenLabs: crea conversaciones con distintas voces en un solo archivo de audio vía el CLI de inference.sh.

Reemplaza a: dialogue-audio (Dia TTS, alternativa gratuita)

Solicitabash(belt *)
Estrellas
6

en todo el repo

Actividad
61

0–100, la ruta de este skill

Actualizado
hace 11 días

último commit aquí

Commits
3

últimos 90 días

Contexto
2k tok

142 tok en reposo

Paquete
1 archivo

8 KB

Instalar

Funciona con cualquier agente que lea SKILL.md

npx -y skills add skills-101/superpowers --skill elevenlabs-dialogue --agent claude-code

Se instala solo en este repositorio.

Qué hace

  • Genera audio de diálogo multi-hablante con voces distintas por segmento usando `belt app run elevenlabs/text-to-dialogue`
  • Permite direcciones de voz entre corchetes (p. ej. [excitedly]) para controlar la entonación
  • Combina diálogo con música de fondo generada por `elevenlabs/music` y las une con `infsh/media-merger`

Úsalo cuando

  • Necesitas crear podcasts, audiolibros, explicativos o tutoriales con múltiples voces
  • Quieres probar diálogo de personajes o guiones de video antes de producción
  • Necesitas escenarios de entrenamiento con diálogo (p. ej. atención al cliente)

No lo uses cuando

    Qué lo activa

    Di cualquiera de estas frases y el agente debería cargar este skill.

    • Genera un diálogo de podcast entre george y aria sobre IA
    • Crea un audio de dos voces para un tutorial de instalación
    • Haz una escena de audiolibro con voces lily y harry susurrando

    Archivos

    1 archivo en el paquete. Solo se lee SKILL.md al activarse — las referencias se cargan si el skill decide que las necesita.

    Antes de instalar

    Requiere el CLI inference.sh (`belt`) instalado y haber ejecutado `belt login`.

    Necesita en el PATH:npx

    Detalles

    Creador
    skills-101
    Licencia
    No especificada
    Recursos incluidos
    Solo SKILL.md
    Código fuente
    Ver SKILL.md

    Etiquetas

    Más de skills-101/superpowers

    Este repo incluye 86 skills. Si instalas uno, normalmente ya tienes los demás.

    Convierte cualquier voz en otra voz distinta preservando el contenido y la emoción del habla, mediante el CLI de inference.sh (belt).

    Costo de contexto al activarse
    1.1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    redaccion contenido

    Búsqueda web y extracción de contenido con Tavily y Exa vía la CLI de inference.sh, con apps para búsqueda IA, extracción, respuestas directas e investigación.

    Costo de contexto al activarse
    1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    investigacion

    Transcribe audio a texto con los modelos ElevenLabs Scribe y Whisper vía la CLI de inference.sh, con diarización, timestamps y traducción.

    Costo de contexto al activarse
    1.1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    productividad

    Genera imágenes con los modelos P-Image de Pruna vía la CLI de inference.sh: texto a imagen, edición, estilos LoRA, composición multi-imagen e inferencia rápida.

    Costo de contexto al activarse
    1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    diseno ui

    Genera imágenes con Google Gemini 3.1 Flash Image Preview (Nano Banana 2) vía el CLI de inference.sh: texto a imagen, edición, hasta 14 imágenes y grounding con Google Search.

    Costo de contexto al activarse
    1.2k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    diseno ui

    Genera y edita videos físicamente realistas con los modelos Alibaba HappyHorse 1.0 vía el CLI de inference.sh: texto-a-video, imagen-a-video, referencia-a-video y edición de video.

    Costo de contexto al activarse
    1.6k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    diseno ui

    Skills relacionados

    Descubre e instala skills relacionadas desde el registro de skills de inference.sh para ampliar las capacidades de tu workflow de IA.

    Costo de contexto al activarse
    1k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    el mes pasado
    herramientas desarrollo

    Producción de video de talking head con avatares de IA, lipsync y voz. Recomendado: P-Video-Avatar (más rápido, más barato, TTS integrado). También cubre OmniHuman, PixVerse y Fabric.

    Costo de contexto al activarse
    2.6k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 11 días
    herramientas desarrollo

    Ejecuta código Python en un entorno sandbox seguro vía inference.sh, con NumPy, Pandas, Matplotlib, Selenium, MoviePy, OpenCV, trimesh y más de 100 librerías preinstaladas.

    Costo de contexto al activarse
    1.5k tok
    Tamaño del paquete
    1 archivo
    Última actualización
    hace 3 meses
    herramientas desarrollo