初始化项目,由ModelHub XC社区提供模型

Model: jwg0830/AX-3.1-Light-sft_v0_2
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-24 13:07:44 +08:00
commit 8101a1bafa
9 changed files with 511456 additions and 0 deletions

35
.gitattributes vendored Normal file
View File

@@ -0,0 +1,35 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text

58
README.md Normal file
View File

@@ -0,0 +1,58 @@
---
base_model: skt/A.X-3.1-Light
library_name: transformers
language:
- ko
license: other
tags:
- lora-merged
- korean
- k-ai-leaderboard
---
# AX-3.1-Light-sft_v0_2 (동전)
skt/A.X-3.1-Light를 기반으로, AI Hub 한국어 데이터를 활용해 K-AI 리더보드 5개 벤치마크
(KMMLU-Pro / CLIcK / HLE(Ko) / MuSR(Ko) / Com2-main(Ko)) 전체 대응 proxy benchmark에서 진단한
출력 형식 결손을 교정하기 위해 LoRA 파인튜닝 후 병합한 모델입니다. EXAONE-Deep-7.8B-sft_v0_2와
동일한 학습 데이터(`format_sft_v0_2.jsonl`)를 사용했습니다.
- **베이스 모델**: `skt/A.X-3.1-Light`
- **AI Hub 데이터 활용**: 예
- `71857` 국어 교과 지문형 문제 데이터 (CLIcK 축)
- `71874` 전문 의학지식 데이터 (KMMLU 축)
- `71610` 금융, 법률 문서 기계독해 데이터 (HLE 축)
- `569` 행정 문서 대상 기계독해 데이터 (MuSR 축)
- `71949` 인과관계 기반 추론 데이터(업사이클링) (Com2-main 축)
- **주요 학습 방법**: proxy benchmark 5축 1,350문항 기반 실패 진단(A/B1/B2/C_evidence/C2 5단계
probe) 결과를 반영한 LoRA SFT (r=16, alpha=32, 2 epoch, 5,801 examples)
- **모델의 목적**: 5개 벤치마크 축 전반의 출력 형식 안정화. A.X는 베이스 상태에서 이미 콘텐츠
정확도가 높아, 이번 학습은 콘텐츠 보강보다 strict 출력 형식 준수율 개선에 초점을 둠.
- **구조 변경**: 없음 (LoRA adapter를 base model에 병합한 표준 A.X-3.1-Light 아키텍처, 별도
custom code 없음 — vLLM에서 옵션 없이 바로 로드 검증 완료)
## 자체 Proxy 벤치마크 결과 (참고용, K-AI 공식 점수 아님)
5축 1,350문항 (KMMLU-Lite 300 / CLIcK-Lite 300 / HLE-Lite 200 / MuSR-Lite 300 /
Com2-main-Lite 250) 기준, 베이스 대비:
| Axis | Base 안정정답 | sft_v0_2 안정정답 |
|---|---:|---:|
| KMMLU-Lite | 213/300 | 223/300 |
| CLIcK-Lite | 275/300 | 274/300 |
| HLE-Lite | 185/200 | 190/200 |
| MuSR-Lite | 278/300 | 288/300 |
| Com2-main-Lite | 227/250 | 246/250 |
| **합계** | **1,178/1,350 (87.3%)** | **1,221/1,350 (90.4%)** |
> A.X는 베이스 단계에서 이미 대부분 축에서 90% 내외로 강했기 때문에, EXAONE(형식결손이 컸던
> 모델) 대비 개선폭은 작지만 5축 전 구간에서 일관되게 향상됨.
>
> 참고: Com2-main-Lite 축의 자체 proxy 문항은 정답 외 3개 오답 선택지를 같은 추론 유형 내 다른
> 문항의 정답 텍스트를 교차 샘플링해 합성한 것으로(원본 AI Hub 벤치마크의 실제 선택지는 이미지
> 기반), 네이티브 4지선다가 아닙니다. 절대 정확도 수치는 참고용으로만 해석할 것.
## 사용 데이터셋 명시
AI Hub: 71857/71874/71610/569/71949의 validation label 중 최종 proxy 벤치마크로 표본 추출되지
않은 문서-안전(document-safe) 잔여분만 학습에 사용함.

72
chat_template.jinja Normal file
View File

@@ -0,0 +1,72 @@
{%- if tools is iterable and tools | length > 0 %}
{{- '<|im_start|><|system|>'}}
{{- '당신은 도구 호출 기능을 갖춘 유용한 도우미입니다. 사용자의 요청을 처리하기 위해서 필요한 도구가 주어진 목록에 있는 경우 도구 호출로 응답하세요.
필요한 도구가 목록에 없는 경우에는 도구 호출 없이 사용자가 요구한 정보를 제공하세요.
필요한 도구가 목록에 있지만 해당 도구를 호출하는데 필요한 argument 정보가 부족한 경우 해당 정보를 사용자에게 요청하세요.
사용자의 요청을 처리하기 위해 여러번 도구를 호출할 수 있어야 합니다.
도구 호출 이후 도구 실행 결과를 입력으로 받으면 해당 결과를 활용하여 답변을 생성하세요.
다음은 접근할 수 있는 도구들의 목록 입니다:
<tools>
'}}
{%- for t in tools %}
{{- t | tojson }}
{{- '
' }}
{%- endfor %}
{{- '</tools>' }}
{{- '
도구를 호출하려면 아래의 JSON으로 응답하세요.
도구 호출 형식: <tool_call>{"name": 도구 이름, "arguments": dictionary 형태의 도구 인자값}</tool_call>' }}
{{- '<|im_end|>' }}
{%- endif %}
{%- for message in messages %}
{%- if message.role == 'system' %}
{{- '<|im_start|><|system|>' + message.content + '<|im_end|>'}}
{%- elif message.role == 'user' %}
{{- '<|im_start|><|user|>' + message.content + '<|im_end|>'}}
{%- elif message.role == 'assistant' %}
{{- '<|im_start|><|assistant|>'}}
{%- set content = '' %}
{%- if message.content is defined %}
{%- set content = message.content %}
{%- endif %}
{%- if add_generation_prompt and not (message.reasoning_content is defined and message.reasoning_content is not none) %}
{%- if '</think>' in message.content %}
{%- set content = message.content.split('</think>'.strip())[-1].lstrip('\n') %}
{%- endif %}
{%- endif %}
{{- content}}
{%- if message.tool_calls is defined %}
{%- for tool_call in message.tool_calls %}
{%- if tool_call.function is defined %}
{%- set tool_call = tool_call.function %}
{%- endif %}
{{- '<tool_call>' }}
{{- '{' }}
{{- '"name": "' }}
{{- tool_call.name }}
{{- '"' }}
{%- if tool_call.arguments is defined %}
{{- ', ' }}
{{- '"arguments": ' }}
{{- tool_call.arguments|tojson }}
{%- endif %}
{{- '}' }}
{{- '</tool_call>' }}
{%- endfor %}
{%- endif %}
{{- '<|im_end|>'}}
{%- elif message.role == 'tool' %}
{{- '<|im_start|><|extra_id_13|><tool_output>' + message.content + '</tool_output><|im_end|>'}}
{%- endif %}
{%- endfor %}
{%- if add_generation_prompt %}
{{- '<|im_start|><|assistant|>' }}
{%- endif %}

32
config.json Normal file
View File

@@ -0,0 +1,32 @@
{
"architectures": [
"LlamaForCausalLM"
],
"attention_bias": false,
"attention_dropout": 0.1,
"bos_token_id": 0,
"dtype": "bfloat16",
"eos_token_id": 0,
"head_dim": 128,
"hidden_act": "silu",
"hidden_size": 4096,
"initializer_range": 0.02,
"intermediate_size": 10880,
"max_position_embeddings": 32768,
"mlp_bias": false,
"model_type": "llama",
"num_attention_heads": 32,
"num_hidden_layers": 32,
"num_key_value_heads": 32,
"pad_token_id": null,
"pretraining_tp": 1,
"rms_norm_eps": 1e-05,
"rope_parameters": {
"rope_theta": 500000,
"rope_type": "default"
},
"tie_word_embeddings": false,
"transformers_version": "5.15.0",
"use_cache": false,
"vocab_size": 102400
}

7
generation_config.json Normal file
View File

@@ -0,0 +1,7 @@
{
"bos_token_id": 0,
"eos_token_id": 27,
"max_new_tokens": 32768,
"pad_token_id": 1,
"transformers_version": "5.15.0"
}

5
kds_merge_info.json Normal file
View File

@@ -0,0 +1,5 @@
{
"base_model": "AX-3.1-Light",
"base_model_path": "/home/youngseok3/.cache/huggingface/hub/models--skt--A.X-3.1-Light/snapshots/9b41bb2406472634d8812c0b8931fa40fa9a6c3a",
"adapter_path": "/home/youngseok3/KDS/checkpoints/sft_v0_2_AX-3.1-Light"
}

3
model.safetensors Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:45b0ff9fdfd87599143e5fcfc1fec80d73a8fb2e3c283cea5ca344fb3599de53
size 14529635608

511221
tokenizer.json Normal file

File diff suppressed because it is too large Load Diff

23
tokenizer_config.json Normal file
View File

@@ -0,0 +1,23 @@
{
"add_prefix_space": false,
"backend": "tokenizers",
"bos_token": "<|endoftext|>",
"clean_up_tokenization_spaces": true,
"cls_token": "<|cls|>",
"eod_token": "<|endoftext|>",
"eos_token": "<|im_end|>",
"errors": "replace",
"is_local": true,
"local_files_only": true,
"mask_token": "<|mask|>",
"max_length": 7680,
"model_max_length": 32768,
"model_specific_special_tokens": {
"eod_token": "<|endoftext|>"
},
"pad_token": "<|pad|>",
"sep_token": "<|sep|>",
"tokenizer_class": "GPT2Tokenizer",
"unk_token": "<|unk|>",
"vocab_size": 102400
}