Desarrollaré agentes de voz con IA y sistemas de edge computing


Acerca de este Servicio
Traducción automática
¿Estás buscando crear un asistente de voz con IA personalizado para hardware de edge?
Me especializo en desarrollar pipelines de software de IA de extremo a extremo y desplegarlos directamente en dispositivos como Raspberry Pi.
Ingeniería de software y IA (Trabajo principal):
- Pipeline híbrido de voz: Integración de detección de palabra de activación offline y Whisper AI en la nube para control de voz altamente preciso.
- Procesamiento LLM: Optimización de modelos (como Llama 3.1) para extracción dinámica de intenciones, análisis de JSON y comprensión del lenguaje natural.
- APIs sensibles al contexto: Integración de servicios externos como geolocalización, OpenStreetMap o Telegram para dar utilidad en el mundo real a tu IA y alertas automáticas.
- Síntesis de audio resistente: Generación de voz con baja latencia (ElevenLabs/gTTS) conectada directamente a los subsistemas ALSA de Linux para buffers en tiempo real suaves.
Hardware y electrónica (disponible vía extras): ¿Necesitas mapear el dispositivo físico? También diseño la arquitectura completa del hardware:
- Distribución de energía: Gestión personalizada de baterías Li-ion (BMS) y convertidores step-down adaptados para computación de borde de alto corriente.
- Integración de periféricos: Enrutamiento compartido del bus digital de audio I2S (micrófonos, DACs y amplificadores) y conexión de cámaras para visión por computadora en el borde.
Conoce a Omar Y
Embedded Systems Engineer, PCB Design, IoT and AI Integration
- DeTurquía
- Miembro desdejul 2026
- Responde aprox. en:1 hora
Idiomas
Azerbaiyano, Turco, Inglés, Ruso, Alemán
Traducción automática
Mi porfolio
FAQ
Traducción automática
¿Construyes el dispositivo físico y me lo envías?
No, este gig es para entregables digitales. Proporcionaré el código completo del software, scripts en Python, pipelines de API y documentación. Si eliges el extra de "Diseño del sistema de energía", también te proporcionaré los esquemas de cableado. Tú debes comprar los componentes físicos tú mismo.
¿Qué hardware necesito para ejecutar esta pipeline de IA?
La pipeline estándar está optimizada para dispositivos de edge computing como Raspberry Pi (especialmente Pi 4 o Pi 5). Si planeas usar una computadora de placa única diferente o microcontrolador, por favor envíame un mensaje antes de ordenar para confirmar compatibilidad.
¿Hay costos de suscripción para usar el asistente de voz?
Depende de la arquitectura. Mientras algunos modelos (como LLMs locales o motores de palabra de activación) funcionan completamente en el dispositivo sin costo, los servicios en la nube para síntesis de voz de ultra baja latencia (como ElevenLabs) o APIs de ubicación externas requerirán tus propias claves API. Serás responsable de cualquier uso.
¿Se puede activar el asistente de voz con una palabra de activación personalizada?
¡Sí! Implemento pipelines híbridos que utilizan detección offline de palabra de activación. Podemos configurar el sistema para comenzar a escuchar y grabar solo cuando se diga un nombre o frase específicos.
No estoy seguro de qué extras de software o hardware necesito. ¿Puedes ayudar?
¡Por supuesto! Envíame un mensaje directo antes de hacer tu pedido. Podemos discutir tus objetivos, restricciones físicas y requisitos de IA para armar la oferta personalizada perfecta.
