A collection for the ReasonXL dataset and models trained with it
Daniil Gurgurov
DGurgurov
AI & ML interests
NLP, AI, EduTech
Recent Activity
updated a model 2 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR published a model 2 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR updated a model 2 days ago
DGurgurov/OpenThinker3-7B-SFT-GRPO-ESOrganizations
models 135
DGurgurov/OpenThinker3-7B-SFT-GRPO-FR
Reinforcement Learning • 1.0B • Updated • 9
DGurgurov/OpenThinker3-7B-SFT-GRPO-ES
Reinforcement Learning • 1.0B • Updated • 12
DGurgurov/OpenThinker3-7B-SFT-GRPO-IT
Reinforcement Learning • 1.0B • Updated • 13
DGurgurov/OpenThinker3-7B-SFT-GRPO-DE
Reinforcement Learning • 1.0B • Updated • 9
DGurgurov/OpenThinker3-7B-SFT-FR
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-ES
8B • Updated • 13
DGurgurov/OpenThinker3-7B-SFT-IT
8B • Updated • 11
DGurgurov/OpenThinker3-7B-SFT-DE
8B • Updated • 6
DGurgurov/SmolLM3-3B-SFT-GRPO-FR
Reinforcement Learning • 0.4B • Updated • 20
DGurgurov/SmolLM3-3B-SFT-GRPO-ES
Reinforcement Learning • 0.4B • Updated • 17
datasets 52
DGurgurov/CLaS-Bench
Preview • Updated • 809 • 1
DGurgurov/Nemotron-Multilingual-Reasoning
Viewer • Updated • 3.54M • 123
DGurgurov/mgsm_en_it
Viewer • Updated • 250 • 74
DGurgurov/aime_2025_en_it
Viewer • Updated • 30 • 28
DGurgurov/gpqa_diamond_en_it
Viewer • Updated • 198 • 76
DGurgurov/mt_math100_en_it
Viewer • Updated • 99 • 56
DGurgurov/OpenThoughts-10k-DeepSeek-R1
Viewer • Updated • 10k • 17
DGurgurov/DeepSeek-R1-Distill-Qwen-1.5B-lmsys-chat-1m-tokenized
Viewer • Updated • 486k • 26
DGurgurov/urdu_sa
Viewer • Updated • 11k • 28
DGurgurov/danish_sa
Viewer • Updated • 10k • 27