LLM gateway
Un LLM gateway (o AI API gateway) es una capa entre tu app y los proveedores de modelos: una API, una key, routing y control de costo. Geek Hub es ese gateway — compatible con OpenAI, hecho para equipos en México y LATAM.
Qué es un LLM gateway
Sin gateway, cada proveedor (OpenAI, Anthropic, Google, …) es un SDK, una factura y una política distinta. Con gateway, tu código habla un solo protocolo — casi siempre OpenAI-compatible — y el servidor elige modelo, aplica límites y registra costo.
Sirve cuando necesitas cambiar de modelo sin redeploy, fallback si un proveedor cae, presupuestos por key, y un solo lugar para auditoría. No es un chat UI: es infra de API.
Qué hace Geek Hub como gateway
- Una base URL OpenAI-compatiblehttps://api.geekhub.mx/v1 — chat, imágenes, video, TTS, embeddings con el mismo cliente.
- Routing y failoverPasa una lista de modelos o model:"auto"; si el primero falla, el gateway reintenta.
- Billing y compliance MXSaldo pay-as-you-go, CFDI 4.0 al recargar, costos visibles por request.
- Guardrails y ZDRPolíticas por org/key y rechazo si pides retención cero en un modelo no verificado.
Ejemplo mínimo
El SDK de OpenAI apunta al gateway. El campo model decide el maker.
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.geekhub.mx/v1",
apiKey: process.env.GEEKHUB_API_KEY,
});
const res = await client.chat.completions.create({
model: "google/gemini-2.5-flash",
messages: [{ role: "user", content: "Resume en una línea" }],
});Gateway vs ir directo al proveedor
| Necesidad | Directo (N APIs) | Geek Hub (1 API) |
|---|---|---|
| Cambiar de modelo | Código + keys por proveedor | Cambias el string model |
| Outage de un maker | Tu feature cae | Fallback a la siguiente opción |
| Factura en México | N invoices USD | Recargas + CFDI centralizado |
| Budget por ambiente | Manual / no existe | Límite por API key |
FAQ · LLM gateway
- ¿LLM gateway es lo mismo que un proxy?Un proxy puro reenvía. Un gateway añade auth, metering, routing, políticas y a menudo un catálogo unificado. Geek Hub hace lo segundo.
- ¿Agrega mucha latencia?El hop típico son unos pocos ms. A cambio evitas reintentos y saturación en tu app.
- ¿Dónde veo precios?En GET /v1/models y en /models. El cobro es pay-as-you-go sobre el precio del proveedor.
Arma tu gateway en minutos
Regístrate, crea una key y conecta el SDK. Docs en docs.geekhub.mx.