view article Article Selene 1 Mini: the best small language model-as-a-judge AtlaAI โข Jan 29, 2025 โข 13
view article Article Judge Arena: Benchmarking LLMs as Evaluators +6 kaikaidai, MauriceBurg, RomanEngeler1805, mbartolo, clefourrier, tobydrane, mathias-atla, jacksongolden โข Nov 19, 2024 โข 63
view article Article Experimenting with different training objectives for an AI evaluator kaikaidai โข Oct 31, 2024 โข 2