Modelos para testing y CI: rápidos y baratos
En desarrollo y CI quieres respuestas rápidas y costo predecible, no el modelo más caro. Esta colección reúne opciones flash/lite y mini pensadas para smoke tests de prompts, evals automáticos y sandboxes de equipo.
Modelos en esta colección
| Modelo | Tipo | Contexto | Precio |
|---|---|---|---|
| Chat | 1M tokens | $0.109/M in · $0.436/M out | |
| Chat | 1M tokens | $0.1526/M in · $0.3052/M out | |
| Chat | 128k tokens | $0.109/M in · $0.109/M out | |
| Chat | 1M tokens | $0.436/M in · $1.7441/M out | |
| Chat | 1M tokens | $0.2725/M in · $1.6351/M out | |
| Chat | 200k tokens | $1.0901/M in · $5.4503/M out | |
| Chat | 1M tokens | $0.327/M in · $2.7251/M out |
Por qué estos modelos
Baja latencia + bajo precio + calidad suficiente para asserts. Evitamos flagships caros: en CI el modelo debe fallar barato y rápido cuando el prompt o el contrato JSON se rompe.
Úsalos con Geek Hub
Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.
Consigue tu API keyPreguntas frecuentes
- ¿Qué modelo usar en CI?
- Gemini Flash Lite o DeepSeek Flash suelen bastar para smoke tests. Si validas structured outputs o tool calling, GPT-4.1-mini o Haiku dan más estabilidad.
- ¿Debo usar el mismo modelo en test y producción?
- No necesariamente. Testea con uno barato y fija el de producción por env. Lo importante es que el contrato (JSON, tools) sea el mismo.
- ¿Cómo limito gasto en testing?
- Usa una API key de Geek Hub solo para CI con presupuesto bajo, y modelos de esta lista. Cambia el model id por variable de entorno.