
En resumen. Un gateway de LLM pone un solo endpoint compatible con OpenAI delante de muchos proveedores de modelos y suma enrutamiento, fallbacks, seguimiento de costos y llaves de acceso. Tu aplicación habla con una API en lugar de una docena. Las opciones más fuertes de 2026: LiteLLM para autoalojar con código abierto, OpenRouter para acceso gestionado sin carga operativa y Portkey cuando pesan la gobernanza y los guardrails.
Qué es un gateway de LLM y para qué te sirve
En cuanto una aplicación llama a más de un proveedor de modelos, el cableado se vuelve un desorden: distintos SDK, distinta autenticación, distintos formatos de error y ninguna vista única del gasto. Un gateway lo resuelve poniéndose en medio. Esto es lo que te da:
- Una API compatible con OpenAI para muchos proveedores. Cambias el nombre del modelo, no tu código.
- Enrutamiento y fallbacks automáticos, para que la caída de un proveedor no se lleve tu app.
- Seguimiento de costos y presupuestos por equipo o por llave, en todos los proveedores.
- Llaves virtuales: repartes credenciales acotadas en vez de las llaves reales del proveedor.
- Caché y observabilidad: menos llamadas duplicadas y registros legibles.
Autoalojado o gestionado
La primera bifurcación es si vas a operar tú el gateway. Las opciones autoalojadas como LiteLLM mantienen todo dentro de tu infraestructura y solo la llamada al modelo sale de tu red, algo que pesa en residencia de datos y compliance. Las gestionadas como OpenRouter y Cloudflare AI Gateway cambian ese control por cero carga operativa. Portkey y Kong quedan en medio: núcleo de código abierto con plataforma gestionada opcional. Casi todo se reduce a una pregunta: ¿quieres ser dueño de la infraestructura o no?
Tabla comparativa: gateways de LLM de un vistazo
| Gateway | ¿Autoalojable? | ¿Código abierto? | Seguimiento de costos integrado | Ideal para |
| LiteLLM | Sí | Sí (MIT) | Sí (presupuestos, llaves virtuales) | Equipos que autoalojan |
| OpenRouter | No (gestionado) | Núcleo abierto, plataforma gestionada | Panel de uso | Muchos modelos sin operar nada |
| Portkey | Limitado | Núcleo abierto más plataforma gestionada | Sí | Gobernanza, guardrails, observabilidad |
| Kong AI Gateway | Sí | Núcleo abierto | Mediante plugins | Empresas que ya usan Kong |
| Cloudflare AI Gateway | No (gestionado) | No | Analítica | Apps en el ecosistema Cloudflare |
Comparativa: gateways de LLM de un vistazo (2026)
1. LiteLLM: el mejor gateway de código abierto para autoalojar
LiteLLM es el estándar de código abierto para este trabajo: un proxy con licencia MIT y compatible con OpenAI que pone un solo endpoint delante de más de 100 proveedores, con llaves virtuales, presupuestos por equipo, seguimiento de costos, fallbacks automáticos y una interfaz de administración. Viene como SDK ligero de Python y como servidor proxy completo, y se despliega con Docker. El proxy depende de CPU y corre cómodo en un servidor pequeño, respaldado por PostgreSQL y, si quieres, Redis. Si buscas ser dueño de tu gateway de principio a fin, esta es la elección por defecto. La guía de Docker enlazada cubre la instalación paso a paso.
2. OpenRouter: el mejor router gestionado sin carga operativa
OpenRouter parte de la filosofía contraria: no despliegas nada. Te registras, obtienes una llave de API y ya tienes acceso a cientos de modelos de todos los grandes proveedores detrás de un solo endpoint, con la facturación consolidada. El cobro es por token, o sea la tarifa del proveedor más una pequeña comisión de plataforma, sin infraestructura que mantener. Para prototipar con muchos modelos o sostener una carga pequeña o mediana sin equipo de operaciones, es el camino más rápido. Un artículo aparte los compara de frente, enlazado más abajo.
3. Portkey: la mejor opción para gobernanza y guardrails
Portkey se plantea como un plano de control para el tráfico de IA. Junto al enrutamiento sobre un catálogo amplio de modelos, añade caché semántico, guardrails, observabilidad detallada y control de presupuestos, justo lo que importa cuando pasas del experimento a una entrega productiva y repetible. Ofrece un núcleo de código abierto con una plataforma gestionada encima, con enfoque cloud-first y un autoalojamiento más limitado que el de LiteLLM. Elígelo cuando el enrutamiento, el control del gasto y la auditabilidad pesen tanto como la abstracción de la API.
4. Kong AI Gateway: la mejor opción si ya usas Kong
Kong AI Gateway lleva el enrutamiento de LLM al mundo consolidado de gestión de APIs de Kong, con un ecosistema de plugins sólido, SSO y funciones como el enmascaramiento de datos personales. Está orientado a empresas y, si ya operas una malla de APIs con Kong, es la opción más potente. También es la más pesada y da por supuesta una infraestructura Kong por debajo. Si no eres ya una casa Kong, ese peso cuesta justificarlo solo por el enrutamiento de LLM.
5. Cloudflare AI Gateway: la mejor opción dentro del ecosistema Cloudflare
Cloudflare AI Gateway es una opción completamente gestionada con una carga operativa casi nula, que suma caché y analítica delante de tus proveedores. Su punto dulce son las aplicaciones que ya viven en Cloudflare o en una plataforma de borde parecida, donde encaja sin fricción. Como con cualquier gateway gestionado, cedes algo de control sobre tus datos a cambio de que otro se encargue de operarlo.
6. Otras opciones que vale la pena conocer (TrueFoundry, Helicone, Bifrost)
Según tus prioridades, estas tres merecen una mirada:
- TrueFoundry: gateway de IA nativo de Kubernetes con gobernanza, RBAC y presupuestos, y con la opción de alojar tus propios modelos junto a las APIs en la nube.
- Helicone: observabilidad ante todo, autoalojable, fuerte si tu necesidad principal es el registro y la analítica.
- Bifrost: gateway escrito en Go, pensado para baja latencia y alto rendimiento.
Por qué vLLM y Ollama no son gateways
Conviene despejar una confusión frecuente: vLLM y Ollama no son gateways. Son motores de inferencia y runtimes, o sea que ejecutan los modelos. Un gateway como LiteLLM se coloca delante y enruta las peticiones hacia un backend de vLLM u Ollama igual que hacia un proveedor en la nube. Se complementan en lugar de competir, y en la práctica se usan juntos. Si buscas inferencia autoalojada, en los enlaces están las guías de Ollama.
¿Qué gateway de LLM te conviene?
Una guía rápida de decisión:
- Autoalojado y de código abierto: LiteLLM.
- Cero operaciones y el arranque más rápido: OpenRouter.
- Gobernanza, guardrails y observabilidad profunda: Portkey.
- Ya operas una malla de APIs con Kong: Kong AI Gateway.
- Tu aplicación vive en el ecosistema Cloudflare: Cloudflare AI Gateway.
Cómo autoalojar un gateway de LLM en un VPS
Los gateways de código abierto, con LiteLLM a la cabeza, corren bien en un servidor privado virtual modesto: el proxy depende de CPU y es poco exigente, con una base de datos PostgreSQL pequeña al lado. Un VPS te da acceso root para instalar Docker, control total de tus datos y la opción de mantener los datos en la UE, así que tus instrucciones y tus llaves de proveedor se quedan en infraestructura tuya. En Contabo, la línea Core VPS ofrece una fuerte relación entre RAM y euro para un servicio siempre activo. La guía de Docker enlazada cubre la instalación completa.
Preguntas frecuentes: gateways de LLM
Un gateway de LLM es un servicio que se ubica entre tu aplicación y varios proveedores de modelos, y expone una sola API compatible con OpenAI. Se encarga del enrutamiento, los fallbacks, el seguimiento de costos y las llaves de acceso, así que puedes cambiar de modelo o de proveedor sin tocar tu código.
LiteLLM es el gateway de LLM de código abierto con mayor adopción. Tiene licencia MIT, es autoalojable, admite más de 100 proveedores mediante una API compatible con OpenAI e incluye llaves virtuales, presupuestos y seguimiento de costos. Portkey y Kong también ofrecen núcleos de código abierto si necesitas sus funciones específicas.
Sí. LiteLLM es gratuito y de código abierto bajo licencia MIT, y puedes autoalojar el proxy sin costo de licencia. Existe un nivel comercial aparte para funciones empresariales como SSO y gobernanza avanzada, pero el gateway en sí lo operas gratis.
Usa LiteLLM si quieres autoalojar y mantener los datos en tu propia infraestructura. Usa OpenRouter si quieres acceso gestionado a muchos modelos sin carga operativa. Muchos equipos usan los dos: LiteLLM como gateway propio y OpenRouter como uno de los proveedores detrás. La comparativa enlazada entra en detalle.
Por lo general no. Un gateway se gana su lugar en cuanto llamas a varios proveedores o modelos, necesitas fallbacks o quieres control de costos centralizado y llaves virtuales. Con un solo proveedor y un uso sencillo, llamar directo a su API suele bastar hasta que crecen tus necesidades.
Aviso: Las especificaciones de producto, funciones y precios mencionados en este artículo pueden cambiar y variar según la región, el periodo de facturación y las promociones vigentes. Consulta el sitio web oficial de cada proveedor o marca para conocer las cifras, los precios y los tipos de cambio locales actuales.