shubhamprshr
/

Llama-3.2-3B-Instruct_blocksworld1246_sgrpo_classic_0.5_0.5_True_300

Text Generation

Generated from Trainer

text-generation-inference

Model card Files Files and versions Community

Llama-3.2-3B-Instruct_blocksworld1246_sgrpo_classic_0.5_0.5_True_300 / .hydra

Ctrl+K

Ctrl+K

1 contributor

History: 1 commit

shubhamprshr's picture

Training in progress, step 300

c3e7cbc verified 10 days ago