Construiré pipelines RAG y sistemas backend impulsados por IA

M
mathan_teqbahn
M
mathan_teqbahn
Mathan K
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

Ingeniero de backend de IA | Pipelines RAG · Integración de LLM · Sistemas agenticos


Soy un ingeniero de software senior con más de 12 años creando sistemas de IA en producción. Soy el único arquitecto de Teqit, una plataforma empresarial en vivo con pipelines RAG, inferencia de LLM en local y microservicios agenticos que atienden a más de 10 clientes.


Lo que puedo construir para ti:

- Pipelines RAG para ingestión de documentos, búsqueda vectorial, generación de respuestas con LLM

- Integración de API de LLM con OpenAI, Claude, Gemini o cualquier modelo alojado

- Inferencia local de LLM con Ollama / llama.cpp (reducción de costos de IA en aproximadamente un 70%)

- Flujos de trabajo agenticos con llamadas a herramientas, razonamiento en múltiples pasos, pipelines de decisiones

- Backends con FastAPI o Scala mediante REST o gRPC

- Enrutamiento híbrido con cambio inteligente entre modelos locales y en la nube


¿Por qué yo?

He hecho esto en producción real, no en tutoriales. He reducido los costos de IA en un 70% con inferencia local, creado pipelines de avatares generativos en video y diseñado agentes que razonan de forma independiente sobre bases de conocimientos empresariales.


Tecnologías: Python · FastAPI · Ollama · API de OpenAI · Akka/Scala · Docker · AWS


Envíame un mensaje antes de ordenar, revisaré tu caso de uso primero.

Conoce a Mathan K

Mathan K

Senior AI and Backend Engineer

  • DeIndia
  • Miembro desdesep 2026
  • Responde aprox. en:1 hora
  • Idiomas

    Inglés
Senior Software Engineer with 12+ years building production AI systems, distributed backends, and cross-platform mobile apps. I'm the sole architect of Teqit — a live multi-tenant enterprise platform with RAG pipelines, on-premise LLM inference (Ollama), and agentic microservices serving 10+ enterprise clients. I build RAG pipelines, LLM integrations, agentic workflows, and FastAPI/Scala backends — cutting AI costs ~70% with local inference. I review every project personally before starting. Message me first.

Traducción automática