Model: longtermrisk/Llama-3.1-8B-school-of-reward-hacks-last-third-sft Source: Original Platform
4 lines
135 B
Plaintext
4 lines
135 B
Plaintext
version https://git-lfs.github.com/spec/v1
|
|
oid sha256:69f256aca698645fd275b4ae297a704152dbf6018c6ceab8d88ba067b0fdd09d
|
|
size 4915916176
|