← 开发者
在 GitHub 打开 







#1559 6
Quentin Gallouédec
@qgallouedec · Canada
14.3k
加权贡献
1.50k
贡献次数
27
项目数
主要项目
- huggingface/trl
- qgallouedec/panda-gym
- huggingface/transformers
- DLR-RM/stable-baselines3
- huggingface/blog
- huggingface/open-r1
- DLR-RM/rl-baselines3-zoo
- huggingface/accelerate
- Stable-Baselines-Team/stable-baselines3-contrib
- huggingface/search-and-learn
上榜的 AI 项目8
60683264
huggingface/open-r1
+0
Fully open reproduction of DeepSeek-R1
26.5k· Python· Models
1402545
huggingface/trl
+6
Train transformer language models with reinforcement learning.
19.5k· Python· Model Development
2669177
DLR-RM/stable-baselines3
+2
PyTorch version of Stable Baselines, reliable implementations of reinforcement learning algorithms.
13.9k· Python· Models
75533087
DLR-RM/rl-baselines3-zoo
+0
A training framework for Stable Baselines3 reinforcement learning agents, with hyperparameter optimization and pre-trained agents included.
2.89k· Python· Model Development
10866296
huggingface/search-and-learn
+0
Recipes to scale inference-time compute of open models
1.13k· Python· AI Engineering
12444463
google-research/rliable
+0
[NeurIPS'21 Outstanding Paper] Library for reliable evaluation on RL and ML benchmarks, even with only a handful of seeds.
878· Jupyter Notebook· AI Engineering
135494704
qgallouedec/panda-gym
+0
Set of robotic environments based on PyBullet physics engine and gymnasium.
769· Python· Model Development
13892552
Stable-Baselines-Team/stable-baselines3-contrib
+0
Contrib package for Stable-Baselines3 - Experimental reinforcement learning (RL) code
739· Python· Model Development