← 开发者
在 GitHub 打开 





#1381 8
hijkzzz
@hijkzzz
15.5k
加权贡献
2.10k
贡献次数
10
项目数
主要项目
- OpenRLHF/OpenRLHF
- TsinghuaC3I/MARTI
- TideDra/lmm-r1
- hijkzzz/Awesome-LLM-Strawberry
- NVIDIA-NeMo/labs-molt
- hijkzzz/pymarl2
- opendilab/awesome-RLHF
- apachecn/pytorch-doc-zh
- NVIDIA-NeMo/RL
- NeuronDance/DeepRL
上榜的 AI 项目6
2965362
OpenRLHF/OpenRLHF
+2
An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
10.1k· Python· Model Development
72081458
hijkzzz/Awesome-LLM-Strawberry
+0
A collection of LLM papers, blogs, and projects, with a focus on OpenAI o1 🍓 and reasoning techniques.
6.91k· Lists
56193889
NVIDIA-NeMo/labs-molt
+1
A scalable, agentic-first, and HuggingFace-native RL framework for research (9k lines).
1.17k· Python· Model Development
129791690
TideDra/lmm-r1
+0
Extend OpenRLHF to support LMM RL training for reproduction of DeepSeek-R1 on multimodal tasks.
847· Python· Model Development
144231712
hijkzzz/pymarl2
+0
Fine-tuned MARL algorithms on SMAC (100% win rates on most scenarios)
710· Python· Model Development
165951730
TsinghuaC3I/MARTI
+0
[ICLR 2026] A Framework for LLM-based Multi-Agent Reinforced Training and Inference
562· Python· Model Development