← Developers
Open on GitHub 







#1565 9
Quentin Gallouédec
@qgallouedec · Canada
14.3k
Weighted score
1.50k
Contributions
27
Repos
Top repos
- huggingface/trl
- qgallouedec/panda-gym
- huggingface/transformers
- DLR-RM/stable-baselines3
- huggingface/open-r1
- huggingface/blog
- DLR-RM/rl-baselines3-zoo
- huggingface/accelerate
- Stable-Baselines-Team/stable-baselines3-contrib
- huggingface/search-and-learn
Ranked AI repos8
280415946
huggingface/open-r1
+2
Fully open reproduction of DeepSeek-R1
26.5k· Python· Models
1947182
huggingface/trl
+4
Train transformer language models with reinforcement learning.
19.5k· Python· Model Development
2846702
DLR-RM/stable-baselines3
+2
PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.
13.9k· Python· Models
44661019
DLR-RM/rl-baselines3-zoo
+1
A training framework for Stable Baselines3 reinforcement learning agents, with hyperparameter optimization and pre-trained agents included.
2.89k· Python· Model Development
10534706
huggingface/search-and-learn
+0
Recipes to scale inference-time compute of open models
1.13k· Python· AI Engineering
11940734
google-research/rliable
+0
[NeurIPS'21 Outstanding Paper] Library for reliable evaluation on RL and ML benchmarks, even with only a handful of seeds.
878· Jupyter Notebook· AI Engineering
181644451
qgallouedec/panda-gym
+-1
Set of robotic environments based on PyBullet physics engine and gymnasium.
769· Python· Model Development
13291755
Stable-Baselines-Team/stable-baselines3-contrib
+0
Contrib package for Stable-Baselines3 - Experimental reinforcement learning (RL) code
739· Python· Model Development