Whisper API
Voz a texto multilingüe con Whisper Large V3 y diarización

Whisper API ofrece reconocimiento de voz de alta calidad a desarrolladores y creadores de contenido. Basado en el modelo Whisper Large V3, transcribe audio en más de 100 idiomas y detecta automáticamente cuándo intervienen distintos hablantes en una grabación.
Características destacadas
- Transcripción multilingüe con opción de traducción automática al inglés
- Diarización para identificar quién habla y en qué momento
- API compatible con OpenAI para facilitar la integración
- Admite formatos de audio habituales procedentes de distintas fuentes
- Prueba gratuita: 30 horas de transcripción durante el primer mes
- Modelo asequible de pago por uso a 0,17 dólares por hora
La herramienta está dirigida a creadores que trabajan con podcasts y archivos de vídeo, equipos de desarrollo que crean funciones de transcripción y empresas que procesan grabaciones de reuniones. Gracias a su generoso plan gratuito y su API sencilla, está pensada para proyectos que necesitan transcripciones fiables sin la complejidad de una solución autoalojada.
Comentarios(0)
Inicia sesión para comentar