Text Generation
Transformers
Safetensors
PEFT
gemma-3
continued-pretraining
sft
lora
synthetic-data
alignment
midtraining
scimt
scimt-dispatch-models / rl_grpo /control_4x_thinking

Commit History

add rl_grpo/control_4x_thinking (copied from sidbaines/scimt-prior-coins-dispatch-sdf-aft-v1)
2581623
verified

sidbaines commited on