ASD

Xiaozhi ESP32

xinnan-techxiaozhi-esp32-server

Backend en Python/Java/Vue para dispositivos xiaozhi-esp32 que gestiona voz, MQTT/WebSocket y puntos de acceso MCP para controlar hardware ESP32.

Estrellas
10.3k

del repositorio

Actualizado
hace 3 días

último commit

Herramientas

no documentadas

Transporte

sin documentar

Forks
3.5k
Issues
712

abiertos

El README no documenta un comando de instalación. Sigue las instrucciones del repositorio.

Qué es Xiaozhi ESP32

xiaozhi-esp32-server es el servicio backend que da vida a los dispositivos de hardware abierto xiaozhi-esp32, implementando el protocolo de comunicación de Xiaozhi mediante Python, Java y Vue. Gestiona la conversación por voz de extremo a extremo: reconocimiento de voz en streaming (ASR), detección de actividad de voz (VAD), síntesis de voz (TTS), reconocimiento de locutor por huella vocal y comprensión de intención mediante modelos de lenguaje.

El servidor expone puertas de entrada MQTT+UDP, WebSocket y HTTP, e incluye soporte para el protocolo MCP tanto en el cliente IoT como en el servidor, con puntos de acceso MCP para enviar instrucciones a los dispositivos ESP32 desde el panel de control. También integra memoria a corto y largo plazo, base de conocimiento vía RAGFlow y un sistema de plugins con carga en caliente.

Desplegarlo requiere elegir entre una instalación mínima (todo en archivos de configuración, sin base de datos) o una instalación completa con base de datos, gestión multiusuario y multiagente, disponibles tanto en Docker como en código fuente. El proyecto exige hardware ESP32 real para tener sentido: está pensado para quien ya integró el firmware xiaozhi-esp32 y quiere levantar su propio backend en lugar de depender de un servicio de terceros.

Qué le permite hacer a tu agente

  • Procesa conversaciones de voz en streaming con ASR, TTS y VAD conectados a distintos proveedores o modelos locales
  • Ofrece puntos de acceso MCP y protocolo MCP en cliente/servidor para enviar instrucciones a dispositivos ESP32
  • Realiza reconocimiento de locutor por huella vocal en paralelo al reconocimiento de voz
  • Gestiona memoria conversacional local o vía mem0ai/PowerMem y consulta bases de conocimiento con RAGFlow
  • Provee un panel de administración web con gestión de usuarios, agentes y dispositivos

Úsalo cuando

  • Ya tienes hardware ESP32 con el firmware xiaozhi-esp32 y quieres montar tu propio backend en vez de usar un servicio de terceros
  • Necesitas un servidor que hable el protocolo de comunicación de Xiaozhi sobre MQTT+UDP o WebSocket
  • Quieres controlar dispositivos ESP32 mediante instrucciones MCP enviadas desde un panel de control

Detalles

Publicado por
xinnan-tech
Categoría
Automatización
Licencia
MIT
Versión
v0.9.6
Transporte
No documentado

Etiquetas

  • iot
  • esp32
  • voz
  • asistente-de-voz
  • mqtt
  • hardware

¿Este servidor es tuyo? Reclama el listado para corregir cualquier dato, añadir un logo y enlazar tu documentación.

Más servidores de Automatización

MindsDB

39.5k

Conecta un espacio de trabajo unificado con tus datos y modelos de IA (abiertos o propietarios) para delegar proyectos completos y publicar los resultados como aplicaciones web.

Último commit
anteayer
automatizacion

Archon

23.2k

Motor de workflows en YAML que orquesta agentes de codificación de IA (Claude Code, Codex, Pi) para planificar, implementar, validar y crear PRs de forma repetible.

Último commit
anteayer
Credenciales
automatizacion

N8n

22.7k

Da a Claude y otros asistentes acceso completo a la documentación de nodos de n8n para diseñar, validar y desplegar workflows de automatización.

Herramientas expuestas
12 herramientas
Transporte
stdio · http
Último commit
hace 4 días
Credenciales
automatizacion

Ver toda la categoría →