Crearé agentes de aprendizaje por refuerzo
Analista de datos
Nivel 1
Ha cumplido determinados criterios de rendimiento y muestra un gran potencial en la plataforma.
Acerca de este Servicio
¿Necesitas una solución personalizada de aprendizaje por refuerzo para control, optimización, simulación o toma de decisiones inteligente?
Ayudo a los clientes a diseñar y desarrollar agentes de RL adaptados a su problema usando los métodos adecuados para la tarea. Con más de 4 años de experiencia en aprendizaje por refuerzo, he trabajado con una amplia variedad de algoritmos, incluyendo DQN, PPO, A3C, TRPO, Actor-Critic, Decision Transformers, RL jerárquico y RL multiagente.
Puedo ayudar con:
- Formulación de problemas de RL y diseño de MDP
- Desarrollo de entornos personalizados
- Formación de recompensas y diseño de políticas
- Entrenamiento, prueba y optimización de agentes
- ajuste de hiperparámetros y análisis de resultados
- Implementación en PyTorch o TensorFlow
- Pipeline de RL de extremo a extremo y soluciones listas para desplegar
Mi experiencia abarca sistemas de un solo agente, autojuego y multiagente en aplicaciones como control de enjambres de drones, optimización de HVAC y entornos de RL basados en juegos.
Si buscas un desarrollador de RL confiable para construir, probar y entregar una solución técnica para tu proyecto, no dudes en enviarme un mensaje y podemos discutir el alcance.
