LLM gateway

Un LLM gateway (o AI API gateway) es una capa entre tu app y los proveedores de modelos: una API, una key, routing y control de costo. Geek Hub es ese gateway — compatible con OpenAI, hecho para equipos en México y LATAM.

Qué es un LLM gateway

Sin gateway, cada proveedor (OpenAI, Anthropic, Google, …) es un SDK, una factura y una política distinta. Con gateway, tu código habla un solo protocolo — casi siempre OpenAI-compatible — y el servidor elige modelo, aplica límites y registra costo.

Sirve cuando necesitas cambiar de modelo sin redeploy, fallback si un proveedor cae, presupuestos por key, y un solo lugar para auditoría. No es un chat UI: es infra de API.

Qué hace Geek Hub como gateway

  • Una base URL OpenAI-compatiblehttps://api.geekhub.mx/v1 — chat, imágenes, video, TTS, embeddings con el mismo cliente.
  • Routing y failoverPasa una lista de modelos o model:"auto"; si el primero falla, el gateway reintenta.
  • Billing y compliance MXSaldo pay-as-you-go, CFDI 4.0 al recargar, costos visibles por request.
  • Guardrails y ZDRPolíticas por org/key y rechazo si pides retención cero en un modelo no verificado.

Ejemplo mínimo

El SDK de OpenAI apunta al gateway. El campo model decide el maker.

import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.geekhub.mx/v1",
  apiKey: process.env.GEEKHUB_API_KEY,
});

const res = await client.chat.completions.create({
  model: "google/gemini-2.5-flash",
  messages: [{ role: "user", content: "Resume en una línea" }],
});

Gateway vs ir directo al proveedor

NecesidadDirecto (N APIs)Geek Hub (1 API)
Cambiar de modeloCódigo + keys por proveedorCambias el string model
Outage de un makerTu feature caeFallback a la siguiente opción
Factura en MéxicoN invoices USDRecargas + CFDI centralizado
Budget por ambienteManual / no existeLímite por API key

FAQ · LLM gateway

  • ¿LLM gateway es lo mismo que un proxy?Un proxy puro reenvía. Un gateway añade auth, metering, routing, políticas y a menudo un catálogo unificado. Geek Hub hace lo segundo.
  • ¿Agrega mucha latencia?El hop típico son unos pocos ms. A cambio evitas reintentos y saturación en tu app.
  • ¿Dónde veo precios?En GET /v1/models y en /models. El cobro es pay-as-you-go sobre el precio del proveedor.

Arma tu gateway en minutos

Regístrate, crea una key y conecta el SDK. Docs en docs.geekhub.mx.