← Developers
Open on GitHub 





#1373 9
hijkzzz
@hijkzzz
15.5k
Weighted score
2.09k
Contributions
10
Repos
Top repos
- OpenRLHF/OpenRLHF
- TsinghuaC3I/MARTI
- TideDra/lmm-r1
- hijkzzz/Awesome-LLM-Strawberry
- NVIDIA-NeMo/labs-molt
- hijkzzz/pymarl2
- opendilab/awesome-RLHF
- apachecn/pytorch-doc-zh
- NVIDIA-NeMo/RL
- NeuronDance/DeepRL
Ranked AI repos6
3327123
OpenRLHF/OpenRLHF
+1
An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
10.1k· Python· Model Development
5750373
hijkzzz/Awesome-LLM-Strawberry
+0
A collection of LLM papers, blogs, and projects, with a focus on OpenAI o1 🍓 and reasoning techniques.
6.91k· Lists
95084769
NVIDIA-NeMo/labs-molt
+0
A scalable, agentic-first, and HuggingFace-native RL framework for research (9k lines).
1.17k· Python· Model Development
112891503
TideDra/lmm-r1
+0
Extend OpenRLHF to support LMM RL training for reproduction of DeepSeek-R1 on multimodal tasks.
847· Python· Model Development
127111668
hijkzzz/pymarl2
+0
Fine-tuned MARL algorithms on SMAC (100% win rates on most scenarios)
710· Python· Model Development
148651877
TsinghuaC3I/MARTI
+0
[ICLR 2026] A Framework for LLM-based Multi-Agent Reinforced Training and Inference
562· Python· Model Development