Construiré una IA de reconocimiento de voz en árabe con un modelo ajustado
Acerca de este Servicio
¿Necesitas convertir audio en árabe en texto automáticamente? Creo pipelines de reconocimiento de voz usando Whisper, el modelo de reconocimiento de voz de código abierto, configurado para transcribir tus grabaciones en árabe en texto limpio y subtítulos SRT con temporización.
Fine-tuneé Whisper con 25,000 muestras de voz en árabe, reduciendo su tasa de error en palabras del 44.5% al 25.7%, y construí un sistema completo que transcribe, resume y busca en audios en árabe. Llevo esa experiencia a tus grabaciones, ya sean conferencias, entrevistas, podcasts o reuniones.
El paquete básico entrega una pipeline de transcripción lista para usar, probada con hasta 1 hora de tu audio, con salidas de texto y SRT y una guía de configuración. Ten en cuenta que esta transcripción es generada por IA y no es revisada por una persona; la precisión depende del dialecto, ruido de fondo y calidad de grabación. Es posible ajustar un modelo con tu propio audio para mayor precisión como una oferta personalizada.
Contáctame antes de ordenar y envíame una muestra corta de tu audio, para que pueda revisarla y establecer expectativas claras antes de que compres.
Experiencia:
Voz y audio
Lenguaje de programación:
Python
Herramientas:
Otros

