Whisper
Audio y Voz
OpenAI
FreeOpen Source
Acerca de
Modelo de reconocimiento de voz de código abierto de OpenAI para conversión de voz a texto multilingüe
Características Principales
Reconocimiento de voz de código abierto
Modelo large-v3, 99 idiomas
Voz a texto y traducción
Robusto ante ruido y acentos
Despliegue local y por API
Gratis para uso comercial
Precios
free
Código abierto, autoalojamiento gratis
api
API de OpenAI $0,006/minuto
providers
Alojamiento de terceros desde ~0,22 $/h
Casos de Uso
Transcripción de audio y vídeo
Generación de subtítulos
Notas de reuniones y entrevistas
Traducción multilingüe
Backends de interfaces de voz
Subtitulado de accesibilidad
Ventajas
Gratis y de código abierto
Alta precisión en varios idiomas
Despliegue local para la privacidad
Robusto ante el ruido
Desventajas
Requiere GPU para mayor velocidad
Sin interfaz oficial en tiempo real
Requiere configuración técnica
Última Actualización
Julio de 2026: Whisper large-v3 sigue siendo un modelo ASR abierto líder, con soporte de 99 idiomas y amplio alojamiento por proveedores
Herramientas de Audio y Voz relacionadas
ElevenLabs
ElevenLabs
Plataforma líder de síntesis y clonación de voz IA con soporte multilingüe
Suno
Suno
Herramienta de generación de música IA que crea canciones completas desde descripciones de texto
Udio
Udio
Herramienta de generación de música IA que crea canciones completas a partir de indicaciones de texto, compatible con varios géneros musicales