Construiré y desplegaré un sistema multimodal rag para ti

R
rukon_uddeen
R
rukon_uddeen
Rukon Uddin
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

Tus documentos, imágenes, sitios web y APIs en vivo contienen respuestas, pero solo si algo puede buscar en todos ellos al mismo tiempo. Construyo sistemas multimodales RAG (generación aumentada por recuperación) que hacen exactamente eso: un asistente de IA, basado en todas las fuentes que tienes, que responde con citas reales en lugar de suposiciones.

Lo que incluye:

  • Ingesta de documentos, imágenes y URLs, OCR y embeddings de visión para imágenes, indexados en una base de datos vectorial (Pinecone, Chroma o Weaviate)
  • Búsqueda semántica híbrida con re-ranking, para que la recuperación siga siendo precisa a medida que crece tu base de conocimientos
  • Integración en API en vivo, para que las respuestas combinen conocimientos almacenados con datos en tiempo real, no solo archivos estáticos
  • Integración con LLM (OpenAI, Claude o modelos de código abierto como Qwen) con ingeniería de prompts ajustada para reducir alucinaciones
  • Una interfaz de chat limpia o endpoint de API, con citas de fuentes en cada respuesta

Por qué trabajar conmigo:

Soy ingeniero en visión por computadora y aprendizaje automático con 5 años de experiencia en producción, incluyendo ajuste fino de LLM (QLoRA en Qwen) y sistemas de visión, las habilidades exactas que necesita un multimodal RAG, no solo envolver prompts.

Cuéntame tus fuentes de datos y caso de uso antes de ordenar, y diseñaré la arquitectura adecuada

Conoce a Rukon Uddin

Rukon Uddin

AI Engineer

  • DeBangladesh
  • Miembro desdejul 2026
  • Responde aprox. en:1 hora
  • Idiomas

    Inglés, Árabe, Español
AI/ML engineer with 5 years building the harder side of applied AI: LiDAR SLAM, sensor fusion, and vision-language model deployment on edge hardware. I built a LiDAR-based 3D mapping pipeline (FAST-LIVO2) fusing LiDAR, IMU, and camera data, plus a vision-based navigation system for visually impaired users running live at Hong Kong Airport on minimal VRAM. I specialize in making it run fast and reliably on real hardware. Top 4% finisher, TensorFlow-sponsored Kaggle competition. Robotics, sensor fusion, real-time systems, or edge deployment — let's talk.

Traducción automática

Otros servicios de Desarrollo de IA que ofrezco