mradermacher/AgentMercury-Qwen3.5-35B-A3B-SAO-GGUF Reinforcement Learning • 35B • Updated 20 minutes ago