AlexandreEdmond

01 / Sélection

Projets

01

(001)

Circle Seeker RL

Implémentation PPO from scratch sur un environnement 2D où un agent apprend à atteindre une cible circulaire.

Voir le projet
02 RACER

(002)

numpy-rl-racer

Agent DQN écrit uniquement avec NumPy et entraîné sur des circuits 2D générés procéduralement.

Voir le projet
03 BC
LAB

(003)

ManiSkill Imitation Lab

Laboratoire de Behavior Cloning avec PyTorch sur la tâche PickCube-v1 de ManiSkill.

Voir le projet
05 PUSH

(005)

ManiSkill PPO PushCube

Reproduction de PPO sur PushCube avec reward shaping et expériences de curriculum learning.

Voir le projet

02 / Profil

Intelligence artificielle Machine learning Reinforcement learning Vision par ordinateur Python PyTorch React Systèmes.

Voir le CV

03 / Parcours

Parcours

Premiers projets

Exploration de la programmation, des systèmes et des premiers projets personnels.

Télécom Physique Strasbourg

Formation d’ingénieur et double diplôme orientés informatique, data science et intelligence artificielle.

Data Scientist / AI Engineer · Kyndryl

Développement d’APIs d’indexation, de classification et d’extraction documentaire.

Recherche en Deep Reinforcement Learning · HYDRO

Prototype d’optimisation d’une méthode de découpe par deep learning et reinforcement learning.

Recherche appliquée & projets open source

Agents, robotique, modèles de langage et expérimentations d’apprentissage par renforcement.

04 / Contact

Un projet, une idée, un défi ?

Parlons-en