Saltar a contenido

LiteLLM

En este artículo

Información

LiteLLM es una popular biblioteca de Python de código abierto y un servidor proxy que proporciona una interfaz unificada y compatible con OpenAI para llamar a las API de más de 100 modelos de lenguaje extensos (LLM) diferentes.

LiteLLM. Funcionalidades principales

  • API unificada (compatibilidad con OpenAI). Para cambiar de gpt-4o a claude-3-5-sonnet o a un llama-3 local, solo necesita cambiar una única línea (el parámetro model) sin reescribir la lógica de su aplicación.
  • Ecosistema masivo de proveedores. Soporta más de 100 proveedores de forma nativa: OpenAI, Azure OpenAI, Anthropic, Google Gemini, AWS Bedrock, Cohere, HuggingFace, Ollama, vLLM, Groq y muchos otros.
  • Gestión de costes y presupuesto (seguimiento de costes). Cálculo preciso integrado del coste de cada solicitud en dólares (o tokens). Puede establecer límites de gasto estrictos (presupuestos) para usuarios individuales, claves de API o equipos para evitar facturas inesperadas.
  • Tolerancia a fallos (fallbacks y reintentos). Si la API principal no está disponible, devuelve un error o alcanza un límite de tasa (rate limit), LiteLLM puede reintentar automáticamente o cambiar sin interrupciones a un modelo de respaldo (fallback) o a un proveedor diferente sin que el usuario lo note.
  • Equilibrio de carga. Le permite distribuir las solicitudes entre múltiples claves de API del mismo proveedor o diferentes implementaciones del mismo modelo para eludir eficazmente los límites de tasa.
  • Observabilidad y registro. Integración fluida con herramientas populares de monitorización y depuración (Langfuse, Prometheus, Datadog, Arize Phoenix, Helicone) para rastrear la latencia, los errores y los costes en tiempo real.
  • Asincronía y streaming. Soporte completo para llamadas asíncronas (asyncio) y streaming de respuestas para todos los proveedores compatibles, lo cual es crítico para crear interfaces de chat rápidas y receptivas.

Funcionalidades de implementación

ID Nombre del Software SO Compatible VM BM VGPU GPU CPU Mín. (Núcleos) RAM Mín. (GB) HDD/SSD Mín. (GB) Dominio Personalizado Activo
657 LiteLLM Ubuntu 24.04 + + + + 1 4 20 No PEDIR

Nota

A menos que se especifique lo contrario, instalamos por defecto la última versión de lanzamiento del software desde el sitio web del desarrollador o desde los repositorios del sistema operativo.

Primeros pasos tras la implementación de LiteLLM

Tras el pago, se enviará una notificación sobre la preparación del servidor a la dirección de correo electrónico proporcionada durante el registro. Esta contendrá la dirección IP del VPS, así como el usuario y la contraseña para la conexión. Los clientes pueden gestionar su hardware en el panel de control de servidores y API — Invapi.

Los datos de autorización se pueden encontrar en la pestaña Config >> Tags del panel de control del servidor o en el correo electrónico enviado:

  • Enlace al panel de control de la interfaz web: en la etiqueta webpanel ;
  • Login: admin;
  • Password: para el administrador - enviado por correo electrónico a su dirección de email tras la entrega del servidor;

Conexión y configuración inicial

Tras hacer clic en el enlace de la etiqueta webpanel , se abrirá la ventana de inicio de sesión.

Tras introducir su usuario y contraseña, se le redirigirá a la pantalla principal de gestión de LiteLLM.

Información

Tenga en cuenta que debe cambiar la contraseña de administrador después de su primer inicio de sesión en la aplicación. En la pantalla principal aparecerá una advertencia e instrucciones para realizar el cambio.

Ya puede empezar a trabajar con LiteLLM. Tenga en cuenta que la adición de usuarios adicionales solo está disponible tras configurar el servicio de envío de correos electrónicos.

Nota

La información detallada sobre la configuración principal de LiteLLM se encuentra en la documentación del desarrollador.

Pedir un servidor con LiteLLM vía API

Para instalar este software utilizando la API, siga estas instrucciones.

question_mark
Is there anything I can help you with?
question_mark
AI Assistant ×