ai-safety-institute/reward-hacking-olmo3.1-32b-kl0.0-seed2 Text Generation • Updated about 1 month ago
ai-safety-institute/reward-hacking-olmo3.1-32b-kl0.02-seed2 Text Generation • Updated about 1 month ago
jvonrad/olmo-2-7b-finetranslation-wikifact-grpo-att-mlp-checkpoint Text Generation • 7B • Updated Apr 6 • 25
model-organisms-for-real/gemma-3-1b-narrow-sft-military-hh-rlhf Text Generation • 1.0B • Updated Apr 6 • 5 •
model-organisms-for-real/gemma-3-1b-narrow-sft-military-hh-rlhf-benign50 Text Generation • 1.0B • Updated Apr 6 • 11 •