A collection for the ReasonXL dataset and models trained with it
Daniil Gurgurov
DGurgurov
AI & ML interests
NLP, AI, EduTech
Recent Activity
updated a model 15 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR published a model 16 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR updated a model 16 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-ESOrganizations
models 135
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR
Reinforcement Learning • 1.0B • Updated • 9
DGurgurov/OpenThinker3-7B-SFT-GRPO-ES
Reinforcement Learning • 1.0B • Updated • 17
DGurgurov/OpenThinker3-7B-SFT-GRPO-IT
Reinforcement Learning • 1.0B • Updated • 14
DGurgurov/OpenThinker3-7B-SFT-GRPO-DE
Reinforcement Learning • 1.0B • Updated • 2.13k
DGurgurov/OpenThinker3-7B-SFT-FR
8B • Updated • 12
DGurgurov/OpenThinker3-7B-SFT-ES
8B • Updated • 15
DGurgurov/OpenThinker3-7B-SFT-IT
8B • Updated • 12
DGurgurov/OpenThinker3-7B-SFT-DE
8B • Updated • 9
DGurgurov/SmolLM3-3B-SFT-GRPO-FR
Reinforcement Learning • 0.4B • Updated • 567
DGurgurov/SmolLM3-3B-SFT-GRPO-ES
Reinforcement Learning • 0.4B • Updated • 15
datasets 52
DGurgurov/CLaS-Bench
Preview • Updated • 804 • 1
DGurgurov/Nemotron-Multilingual-Reasoning
Viewer • Updated • 3.54M • 145
DGurgurov/mgsm_en_it
Viewer • Updated • 250 • 20
DGurgurov/aime_2025_en_it
Viewer • Updated • 30 • 55
DGurgurov/gpqa_diamond_en_it
Viewer • Updated • 198 • 51
DGurgurov/mt_math100_en_it
Viewer • Updated • 99 • 20
DGurgurov/OpenThoughts-10k-DeepSeek-R1
Viewer • Updated • 10k • 11
DGurgurov/DeepSeek-R1-Distill-Qwen-1.5B-lmsys-chat-1m-tokenized
Viewer • Updated • 486k • 22
DGurgurov/urdu_sa
Viewer • Updated • 11k • 30
DGurgurov/danish_sa
Viewer • Updated • 10k • 27