Crearé un algoritmo de aprendizaje por refuerzo multiagente

A
ager_omondi
A
ager_omondi
Ager Austen

Level 1

Parte de la información se ha traducido automáticamente.

Acerca de este Servicio

Traducción automática

Construyo entornos de aprendizaje por refuerzo personalizados y simulaciones multi-agente para juegos, robótica, logística y aplicaciones de investigación.

Trabajos recientes incluyen un simulador competitivo de fútbol multi-agente (aprendizaje por currículo desde 1v1 hasta 11v11, entrenamiento con self-play PPO) y un entorno completo de Mahjong chino que implementa 77 de las 81 reglas oficiales de puntuación, además de una simulación de red de tránsito multi-agente basada en datos reales de tránsito urbano, desde la canalización de datos en bruto hasta una política entrenada con rendimiento medido contra una línea base.

Lo que obtienes es un código probado y documentado, no un cuaderno: un entorno compatible con Gymnasium/PettingZoo, una canalización de entrenamiento con RLlib y una evaluación escrita que muestra el rendimiento de tu agente entrenado frente a una línea base. Si no supera la línea base, no está listo.

Antes de comenzar, confirmaré si el aprendizaje por refuerzo es realmente el enfoque adecuado para tu problema, ya que algunas tareas de "agente de IA" se resuelven mejor y de forma más económica con métodos más simples, y te diré si ese es el caso en lugar de aceptar el trabajo de todas formas.

Conoce a Ager Austen

Ager Austen

MLOPs ML GNNs RL

5.0(25)

Level 1

  • DeKenia
  • Miembro desdemay 2022
  • Responde aprox. en:1 hora
  • Última entrega3 semanas
  • Idiomas

    Inglés, Suajili, Latino
ML || MLOPs || Data Engineering || Agentic AI || Knowledge Distillation || GNNs || Physics-Informed NNs || n8n Workflow Automation || RL PPO DPO MARL || Pytorch || Tensorflow || Rust || https://ageraustine.github.io/portfolio

Traducción automática

Mi porfolio

Otros servicios de Desarrollo de IA que ofrezco

Etiquetas relacionadas