Modelos de contexto largo: 200k a 1M tokens

Cuando el prompt es un repo, un contrato o un PDF enorme, el contexto es el producto. Esta colección reúne modelos con 200k–1M de ventana disponibles en Geek Hub para análisis largo y agentes con memoria extendida.

8 modelosActualizado 2026-08-27

Modelos en esta colección

ModeloTipoContextoPrecio
Claude Fable 5AnthropicChat1M tokens$10.9006/M in · $54.503/M out
Claude Opus 5AnthropicChat1M tokens$5.4503/M in · $27.2515/M out
Claude Sonnet 5AnthropicChat1M tokens$3.2702/M in · $16.3509/M out
Kimi K3Moonshot (Kimi)Chat1M tokens$3.2702/M in · $16.3509/M out
Gemini 3.1 Pro (preview)GoogleChat2M tokens$2.1801/M in · $13.0807/M out
Gemini 2.5 ProGoogleChat2M tokens$1.3626/M in · $10.9006/M out
Gemini 2.5 FlashGoogleChat1M tokens$0.327/M in · $2.7251/M out
Kimi K2.7 CodeMoonshot (Kimi)Chat262k tokens$1.0356/M in · $4.3602/M out

Por qué estos modelos

Claude 5 family y Kimi K3 ofrecen 1M; Gemini Pro/Flash cubren contexto largo a distinto precio; Kimi Code aporta 262k enfocado a código.

Úsalos con Geek Hub

Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.

Consigue tu API key

Preguntas frecuentes

¿1M de contexto cuesta más?
Pagas por tokens usados, no por el máximo. Un contexto grande te deja meter más input; el flagship suele costar más por millón.
¿Cuándo necesito contexto largo de verdad?
Codebases enteros, due diligence, libros, logs largos, multi-doc RAG sin chunking agresivo. Si cabe en 32k, no pagues de más.
¿Flash con contexto largo alcanza?
Gemini Flash con ventana grande es excelente para costo. Para razonamiento denso sobre ese contexto, Pro/Sonnet/Opus suelen ir mejor.

Más colecciones