Modelos speech-to-text y transcripción
Speech-to-text es el primer paso de muchos pipelines de voz: meetings, call centers, subtítulos. Hoy el catálogo público destaca Whisper-1; la misma key de Geek Hub sirve para STT y para el LLM que resume después.
Modelos en esta colección
| Modelo | Tipo | Contexto | Precio |
|---|---|---|---|
| STT | — | $0.0065 / min |
Por qué estos modelos
Whisper-1 es el workhorse de transcripción OpenAI-compatible: robusto en varios idiomas y fácil de encadenar con un modelo de chat de otra colección.
Úsalos con Geek Hub
Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.
Consigue tu API keyPreguntas frecuentes
- ¿Solo hay un modelo STT?
- En el catálogo curado de esta página sí (Whisper-1). El gateway puede ampliar proveedores; esta colección se actualiza cuando haya más ids públicos.
- ¿Cómo se cobra?
- Por minuto de audio. Ver precio en la tabla.
- ¿Pipeline tipico?
- Audio → Whisper → chat (Flash/mini) para resumen o CRM. Misma API key.