Crearé agentes de aprendizaje por refuerzo

Parte de la información se ha traducido automáticamente.

Marruecos

Hablo Español, Árabe, Inglés, Francés

180 pedidos completados

Analista de datos

¡Hola! Soy Ilias, un analista de datos con 5 años de experiencia. Me especializo en análisis estadístico y machine learning para resolver problemas en campos multidisciplinarios usando R, SQL, SAS, SP...

Nivel 1

Ha cumplido determinados criterios de rendimiento y muestra un gran potencial en la plataforma.

Acerca de este Servicio

¿Necesitas una solución personalizada de aprendizaje por refuerzo para control, optimización, simulación o toma de decisiones inteligente?

Ayudo a los clientes a diseñar y desarrollar agentes de RL adaptados a su problema usando los métodos adecuados para la tarea. Con más de 4 años de experiencia en aprendizaje por refuerzo, he trabajado con una amplia variedad de algoritmos, incluyendo DQN, PPO, A3C, TRPO, Actor-Critic, Decision Transformers, RL jerárquico y RL multiagente.

Puedo ayudar con:

  • Formulación de problemas de RL y diseño de MDP
  • Desarrollo de entornos personalizados
  • Formación de recompensas y diseño de políticas
  • Entrenamiento, prueba y optimización de agentes
  • ajuste de hiperparámetros y análisis de resultados
  • Implementación en PyTorch o TensorFlow
  • Pipeline de RL de extremo a extremo y soluciones listas para desplegar

Mi experiencia abarca sistemas de un solo agente, autojuego y multiagente en aplicaciones como control de enjambres de drones, optimización de HVAC y entornos de RL basados en juegos.

Si buscas un desarrollador de RL confiable para construir, probar y entregar una solución técnica para tu proyecto, no dudes en enviarme un mensaje y podemos discutir el alcance.

Experiencia:

Procesamiento de imágenes

Lenguaje de programación:

Python

R

MATLAB

SQL

Java

API:

Microsoft Computer Vision AI

Amazon Rekognition

Herramientas:

Jupyter Notebook

TensorFlow

Excel

MLflow

Stata

Marcos:

Scikit-learn

DeepPy

Google ML Kit

PyTorch

Panda

TensorFlow