Construiré una IA de reconocimiento de voz en árabe con un modelo ajustado

Parte de la información se ha traducido automáticamente.

Egipto

Hablo Inglés, Árabe

Ingeniero de IA

¡Hola! Soy un ingeniero de IA de Egipto con una licenciatura en IA y Ciencia de Datos y una investigación en visión por computadora en revisión por pares. Creo herramientas prácticas de IA para negoci...
Acerca de este Servicio

¿Necesitas convertir audio en árabe en texto automáticamente? Creo pipelines de reconocimiento de voz usando Whisper, el modelo de reconocimiento de voz de código abierto, configurado para transcribir tus grabaciones en árabe en texto limpio y subtítulos SRT con temporización.


Fine-tuneé Whisper con 25,000 muestras de voz en árabe, reduciendo su tasa de error en palabras del 44.5% al 25.7%, y construí un sistema completo que transcribe, resume y busca en audios en árabe. Llevo esa experiencia a tus grabaciones, ya sean conferencias, entrevistas, podcasts o reuniones.


El paquete básico entrega una pipeline de transcripción lista para usar, probada con hasta 1 hora de tu audio, con salidas de texto y SRT y una guía de configuración. Ten en cuenta que esta transcripción es generada por IA y no es revisada por una persona; la precisión depende del dialecto, ruido de fondo y calidad de grabación. Es posible ajustar un modelo con tu propio audio para mayor precisión como una oferta personalizada.


Contáctame antes de ordenar y envíame una muestra corta de tu audio, para que pueda revisarla y establecer expectativas claras antes de que compres.


Experiencia:

Voz y audio

Lenguaje de programación:

Python

Herramientas:

Otros

Mi porfolio

Otros servicios de Ciencia de datos y aprendizaje automático que ofrezco