Je vais créer des agents d'apprentissage par renforcement
Analyste de données
Niveau 1
Répond à certains critères de performance et présente un fort potentiel sur la place de marché.
À propos de ce service
Vous avez besoin d'une solution personnalisée d'apprentissage par renforcement pour le contrôle, l'optimisation, la simulation ou la prise de décision intelligente ?
J'aide mes clients à concevoir et développer des agents RL adaptés à leur problème en utilisant les méthodes appropriées pour la tâche. Avec plus de 4 ans d'expérience en apprentissage par renforcement, j'ai travaillé avec une large gamme d'algorithmes tels que DQN, PPO, A3C, TRPO, Actor-Critic, Decision Transformers, RL hiérarchique et RL multi-agent.
Je peux vous aider avec :
- la formulation de problèmes RL et la conception de MDP
- le développement d'environnements personnalisés
- l'ajustement des récompenses et la conception de politiques
- l'entraînement, le test et l'optimisation des agents
- le réglage des hyperparamètres et l'analyse des résultats
- l'implémentation avec PyTorch ou TensorFlow
- des pipelines RL de bout en bout et des solutions prêtes pour le déploiement
Mon expérience couvre les systèmes à agent unique, en auto-jeu et multi-agent dans des applications telles que le contrôle de essaims de drones, l'optimisation HVAC et les environnements RL basés sur des jeux.
Si vous recherchez un développeur RL fiable pour construire, tester et livrer une solution technique pour votre projet, n'hésitez pas à m'envoyer un message pour discuter du périmètre.
