optimizaré y aceleraré tu modelo de AI con onnx y tensorrt

R
riticpathania
R
riticpathania
Ricky
Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

¿Tu modelo de AI es preciso pero demasiado lento para su uso en el mundo real?


Optimizó pipelines de inferencia de aprendizaje automático y visión por computadora para reducir la latencia, mejorar el rendimiento y simplificar la implementación del modelo en GPUs de NVIDIA, dispositivos edge, APIs y sistemas de producción.


Puedo ayudar con:


Perfilado de modelos PyTorch y análisis de cuellos de botella en inferencia

Exportación de PyTorch a ONNX

Optimización de ONNX Runtime

Conversión de motor NVIDIA TensorRT

Optimización FP16 y INT8 donde sea compatible

Benchmarking de latencia, rendimiento y FPS

Validación de salida contra el modelo original

Optimización de preprocesamiento y postprocesamiento

Manejo dinámico de entrada y tamaño de lote

Entornos de inferencia en Docker

Integración de model-serving con FastAPI

Flujos de trabajo de despliegue en NVIDIA Jetson / GPU

Optimización de inferencia YOLO y visión por computadora


Mi enfoque no es simplemente convertir un formato de archivo. Verifico que el modelo optimizado siga produciendo salidas correctas y mido la mejora real en el rendimiento.


Los entregables típicos pueden incluir:

Archivos de modelo / engine optimizados

Scripts de inferencia en Python

Resultados de benchmarks antes/después

Resultados de validación de salida

Instrucciones de configuración


Por favor, envíame un mensaje antes de hacer el pedido.

Conoce a Ricky

Ricky

High Performance Python and AI Engineer, APIs, Vision, Optimization

4.9(6)
  • DeIndia
  • Miembro desdejul 2023
  • Última entrega2 semanas
  • Idiomas

    Hindi, Inglés
I'm a Python and AI engineer focused on performance and production machine learning. I help clients solve technical problems such as slow Python/Pandas code, broken or incomplete FastAPI backends, custom YOLO computer-vision pipelines, and slow AI inference workflows. My work includes: - Python, Pandas, NumPy, Cython and C/C++ performance optimization - FastAPI and Flask backend development and debugging - REST APIs, databases, Docker and production deployment - YOLO object detection, tracking and computer-vision pipelines - PyTorch, ONNX and TensorRT inference optimization

Traducción automática

Mi porfolio

Etiquetas relacionadas