A collection for the ReasonXL dataset and models trained with it
Daniil Gurgurov
DGurgurov
AI & ML interests
NLP, AI, EduTech
Recent Activity
updated a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR published a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR updated a model 9 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-ESOrganizations
models 135
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR
Reinforcement Learning • 1.0B • Updated • 9
DGurgurov/OpenThinker3-7B-SFT-GRPO-ES
Reinforcement Learning • 1.0B • Updated • 15
DGurgurov/OpenThinker3-7B-SFT-GRPO-IT
Reinforcement Learning • 1.0B • Updated • 13
DGurgurov/OpenThinker3-7B-SFT-GRPO-DE
Reinforcement Learning • 1.0B • Updated • 574
DGurgurov/OpenThinker3-7B-SFT-FR
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-ES
8B • Updated • 14
DGurgurov/OpenThinker3-7B-SFT-IT
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-DE
8B • Updated • 9
DGurgurov/SmolLM3-3B-SFT-GRPO-FR
Reinforcement Learning • 0.4B • Updated • 560
DGurgurov/SmolLM3-3B-SFT-GRPO-ES
Reinforcement Learning • 0.4B • Updated • 16
datasets 52
DGurgurov/CLaS-Bench
Preview • Updated • 810 • 1
DGurgurov/Nemotron-Multilingual-Reasoning
Viewer • Updated • 3.54M • 137
DGurgurov/mgsm_en_it
Viewer • Updated • 250 • 51
DGurgurov/aime_2025_en_it
Viewer • Updated • 30 • 42
DGurgurov/gpqa_diamond_en_it
Viewer • Updated • 198 • 62
DGurgurov/mt_math100_en_it
Viewer • Updated • 99 • 36
DGurgurov/OpenThoughts-10k-DeepSeek-R1
Viewer • Updated • 10k • 13
DGurgurov/DeepSeek-R1-Distill-Qwen-1.5B-lmsys-chat-1m-tokenized
Viewer • Updated • 486k • 23
DGurgurov/urdu_sa
Viewer • Updated • 11k • 29
DGurgurov/danish_sa
Viewer • Updated • 10k • 31