← Developers
Open on GitHub 







#1580
Quentin Gallouédec
@qgallouedec · Canada
14.0k
Weighted score
1.47k
Contributions
27
Repos
Top repos
- huggingface/trl
- qgallouedec/panda-gym
- huggingface/transformers
- DLR-RM/stable-baselines3
- huggingface/blog
- huggingface/open-r1
- DLR-RM/rl-baselines3-zoo
- huggingface/accelerate
- Stable-Baselines-Team/stable-baselines3-contrib
- huggingface/search-and-learn
Ranked AI repos8
18687531
huggingface/open-r1
+-3
Fully open reproduction of DeepSeek-R1
26.5k· Python· Models
1621214947
huggingface/trl
+-1
Train transformer language models with reinforcement learning.
19.4k· Python· Model Development
3281787
DLR-RM/stable-baselines3
+1
PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.
13.9k· Python· Models
6771581
DLR-RM/rl-baselines3-zoo
+0
A training framework for Stable Baselines3 reinforcement learning agents, with hyperparameter optimization and pre-trained agents included.
2.89k· Python· Model Development
96251260
huggingface/search-and-learn
+0
Recipes to scale inference-time compute of open models
1.13k· Python· AI Engineering
176405150
google-research/rliable
+-1
[NeurIPS'21 Outstanding Paper] Library for reliable evaluation on RL and ML benchmarks, even with only a handful of seeds.
878· Jupyter Notebook· AI Engineering
120491590
qgallouedec/panda-gym
+0
Set of robotic environments based on PyBullet physics engine and gymnasium.
769· Python· Model Development
123541621
Stable-Baselines-Team/stable-baselines3-contrib
+0
Contrib package for Stable-Baselines3 - Experimental reinforcement learning (RL) code
740· Python· Model Development