ASD

Lemonade SDK

lemonade-sdklemonade

Conecta a Lemonade Server, un servidor local que expone modelos de lenguaje, voz e imagen a través de una API compatible con OpenAI para ejecutarlos en tu propia GPU o NPU.

Estrellas
5.3k

del repositorio

Actualizado
ayer

último commit

Herramientas

no documentadas

Transporte

sin documentar

Forks
465
Issues
501

abiertos

El README no documenta un comando de instalación. Sigue las instrucciones del repositorio.

Qué es Lemonade SDK

Lemonade es un servidor de IA local que permite descargar y ejecutar modelos de chat, generación de código, voz e imagen directamente sobre el hardware del usuario (GPU o NPU), sin depender de servicios en la nube. El proyecto ofrece dos formas de uso: Lemonade Server, que instala un servicio al que te puedes conectar desde cientos de aplicaciones usando las APIs estándar de OpenAI, Anthropic y Ollama, y Embeddable Lemonade, un binario portable que se puede empaquetar dentro de una aplicación propia para darle capacidades de IA local multimodal que se auto-optimizan según el equipo del usuario.

Desde la línea de comandos se pueden listar y descargar modelos (lemonade list, lemonade pull), ejecutarlos (lemonade run), definir alias con failover activo-pasivo entre modelos (lemonade alias), y consultar qué backends de inferencia están disponibles en la máquina (lemonade backends). El servidor soporta modelos GGUF, FLM y ONNX para texto, además de motores para transcripción de voz, texto a voz, generación de imagen y generación 3D, con distintos backends según el hardware (CPU, CUDA, ROCm, Vulkan, NPU XDNA2, Metal).

Para integrarlo en una aplicación o agente basta con apuntar cualquier cliente compatible con OpenAI a http://localhost:13305/v1 (o /api/v1), usando el nombre del modelo descargado y una clave de API ficticia, ya que Lemonade no requiere autenticación real. También admite enrutar solicitudes híbridas hacia proveedores en la nube compatibles con OpenAI (Fireworks, OpenAI, OpenRouter, Together) de forma experimental.

Qué le permite hacer a tu agente

  • Sirve modelos de lenguaje, voz e imagen localmente sobre GPU o NPU con una API compatible con OpenAI, Anthropic y Ollama
  • Permite descargar, listar y ejecutar modelos desde la CLI o el Model Manager integrado
  • Soporta múltiples motores de inferencia (llamacpp, flm, ryzenai-llm, whispercpp, kokoro, sd-cpp, entre otros) según el hardware disponible
  • Ofrece un mecanismo de alias de modelos con failover activo-pasivo entre modelos de reemplazo
  • Puede enrutar solicitudes a proveedores en la nube compatibles con OpenAI para configuraciones híbridas

Úsalo cuando

  • Cuando quieres ejecutar modelos de chat, código, voz o imagen de forma local y privada, sin depender de una API en la nube
  • Cuando necesitas conectar una aplicación existente a un modelo local usando el mismo formato de API que ya usas con OpenAI, Anthropic u Ollama
  • Cuando quieres aprovechar la GPU o NPU de tu propio equipo para inferencia optimizada (Ryzen AI, Radeon, Strix Halo)
  • Cuando necesitas embeber una pila de IA local multimodal directamente dentro de tu propia aplicación

Detalles

Publicado por
lemonade-sdk
Licencia
Apache-2.0
Versión
v11.5.2
Transporte
No documentado

Etiquetas

  • ia-local
  • llm
  • inferencia
  • gpu
  • npu
  • openai-compatible

¿Este servidor es tuyo? Reclama el listado para corregir cualquier dato, añadir un logo y enlazar tu documentación.

Más servidores de Herramientas para desarrolladores

Instala en tu agente de código un conjunto de skills y una metodología completa de desarrollo de software, desde el diseño hasta el TDD y las revisiones de código.

Último commit
ayer
Credenciales
herramientas desarrollo

Ruflo

67.8k

Conecta Claude Code y Codex con una capa de orquestación que despliega swarms de agentes, memoria vectorial persistente y comunicación federada entre máquinas.

Herramientas expuestas
8 herramientas
Transporte
stdio
Último commit
ayer
herramientas desarrollo

Framework de desarrollo guiado por especificaciones que estructura el trabajo con asistentes de IA en propuestas, specs, diseño y tareas antes de escribir código.

Último commit
anteayer
herramientas desarrollo

Ver toda la categoría →