750 B
750 B
base_model, library_name, tags
| base_model | library_name | tags | ||||
|---|---|---|---|---|---|---|
| Qwen/Qwen3-4B-Instruct-2507 | transformers |
|
hill_8k_300_hinter
This repository contains the global_step_300 hinter checkpoint from the HiLL
8k run, converted from verl FSDP shards to Hugging Face Transformers format.
Source
- Base model:
Qwen/Qwen3-4B-Instruct-2507 - Training run:
HiLL-Llama-3.2-3B-Instruct-8k - Checkpoint:
global_step_300/hinter - Conversion backend: verl FSDP model merger
Loading
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
model_id = "sagnikM/hill_8k_300_hinter"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(model_id, dtype=torch.bfloat16)