CompassioninMachineLearning/olmo3-7b-medai-cpt_olddata Text Generation • 7B • Updated 10 days ago • 12
CompassioninMachineLearning/qwen3-8b-medai-cpt_olddata Text Generation • 8B • Updated 10 days ago • 165
HarvestBench: Measuring Whether LLM Agents Will Pay to Avoid Killing Animals Paper • 2609.04444 • Published 17 days ago • 4
HarvestBench: Measuring Whether LLM Agents Will Pay to Avoid Killing Animals Paper • 2609.04444 • Published 17 days ago • 4
CaML Benchmarks Collection CaML benchmark datasets: TAC, ANIMA, MORU, WAS + holdout/audit sets. Leaderboard: compassionbench.com • 10 items • Updated Aug 6