← Developers
Open on GitHub 





#1405 3
hijkzzz
@hijkzzz
15.5k
Weighted score
2.10k
Contributions
10
Repos
Top repos
- OpenRLHF/OpenRLHF
- TsinghuaC3I/MARTI
- TideDra/lmm-r1
- hijkzzz/Awesome-LLM-Strawberry
- NVIDIA-NeMo/labs-molt
- hijkzzz/pymarl2
- opendilab/awesome-RLHF
- apachecn/pytorch-doc-zh
- NVIDIA-NeMo/RL
- NeuronDance/DeepRL
Ranked AI repos6
3691810
OpenRLHF/OpenRLHF
+1
An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
10.1k· Python· Model Development
64082383
hijkzzz/Awesome-LLM-Strawberry
+0
A collection of LLM papers, blogs, and projects, with a focus on OpenAI o1 🍓 and reasoning techniques.
6.91k· Lists
20668331
NVIDIA-NeMo/labs-molt
+4
A scalable, agentic-first, and HuggingFace-native RL framework for research (9k lines).
1.18k· Python· Model Development
12743482
TideDra/lmm-r1
+0
Extend OpenRLHF to support LMM RL training for reproduction of DeepSeek-R1 on multimodal tasks.
847· Python· Model Development
14259570
hijkzzz/pymarl2
+0
Fine-tuned MARL algorithms on SMAC (100% win rates on most scenarios)
711· Python· Model Development
58822117
TsinghuaC3I/MARTI
+1
[ICLR 2026] A Framework for LLM-based Multi-Agent Reinforced Training and Inference
567· Python· Model Development