初始化项目,由ModelHub XC社区提供模型
Model: jwg0830/AX-3.1-Light-sft_v0_2 Source: Original Platform
This commit is contained in:
35
.gitattributes
vendored
Normal file
35
.gitattributes
vendored
Normal file
@@ -0,0 +1,35 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
58
README.md
Normal file
58
README.md
Normal file
@@ -0,0 +1,58 @@
|
||||
---
|
||||
base_model: skt/A.X-3.1-Light
|
||||
library_name: transformers
|
||||
language:
|
||||
- ko
|
||||
license: other
|
||||
tags:
|
||||
- lora-merged
|
||||
- korean
|
||||
- k-ai-leaderboard
|
||||
---
|
||||
|
||||
# AX-3.1-Light-sft_v0_2 (동전)
|
||||
|
||||
skt/A.X-3.1-Light를 기반으로, AI Hub 한국어 데이터를 활용해 K-AI 리더보드 5개 벤치마크
|
||||
(KMMLU-Pro / CLIcK / HLE(Ko) / MuSR(Ko) / Com2-main(Ko)) 전체 대응 proxy benchmark에서 진단한
|
||||
출력 형식 결손을 교정하기 위해 LoRA 파인튜닝 후 병합한 모델입니다. EXAONE-Deep-7.8B-sft_v0_2와
|
||||
동일한 학습 데이터(`format_sft_v0_2.jsonl`)를 사용했습니다.
|
||||
|
||||
- **베이스 모델**: `skt/A.X-3.1-Light`
|
||||
- **AI Hub 데이터 활용**: 예
|
||||
- `71857` 국어 교과 지문형 문제 데이터 (CLIcK 축)
|
||||
- `71874` 전문 의학지식 데이터 (KMMLU 축)
|
||||
- `71610` 금융, 법률 문서 기계독해 데이터 (HLE 축)
|
||||
- `569` 행정 문서 대상 기계독해 데이터 (MuSR 축)
|
||||
- `71949` 인과관계 기반 추론 데이터(업사이클링) (Com2-main 축)
|
||||
- **주요 학습 방법**: proxy benchmark 5축 1,350문항 기반 실패 진단(A/B1/B2/C_evidence/C2 5단계
|
||||
probe) 결과를 반영한 LoRA SFT (r=16, alpha=32, 2 epoch, 5,801 examples)
|
||||
- **모델의 목적**: 5개 벤치마크 축 전반의 출력 형식 안정화. A.X는 베이스 상태에서 이미 콘텐츠
|
||||
정확도가 높아, 이번 학습은 콘텐츠 보강보다 strict 출력 형식 준수율 개선에 초점을 둠.
|
||||
- **구조 변경**: 없음 (LoRA adapter를 base model에 병합한 표준 A.X-3.1-Light 아키텍처, 별도
|
||||
custom code 없음 — vLLM에서 옵션 없이 바로 로드 검증 완료)
|
||||
|
||||
## 자체 Proxy 벤치마크 결과 (참고용, K-AI 공식 점수 아님)
|
||||
|
||||
5축 1,350문항 (KMMLU-Lite 300 / CLIcK-Lite 300 / HLE-Lite 200 / MuSR-Lite 300 /
|
||||
Com2-main-Lite 250) 기준, 베이스 대비:
|
||||
|
||||
| Axis | Base 안정정답 | sft_v0_2 안정정답 |
|
||||
|---|---:|---:|
|
||||
| KMMLU-Lite | 213/300 | 223/300 |
|
||||
| CLIcK-Lite | 275/300 | 274/300 |
|
||||
| HLE-Lite | 185/200 | 190/200 |
|
||||
| MuSR-Lite | 278/300 | 288/300 |
|
||||
| Com2-main-Lite | 227/250 | 246/250 |
|
||||
| **합계** | **1,178/1,350 (87.3%)** | **1,221/1,350 (90.4%)** |
|
||||
|
||||
> A.X는 베이스 단계에서 이미 대부분 축에서 90% 내외로 강했기 때문에, EXAONE(형식결손이 컸던
|
||||
> 모델) 대비 개선폭은 작지만 5축 전 구간에서 일관되게 향상됨.
|
||||
>
|
||||
> 참고: Com2-main-Lite 축의 자체 proxy 문항은 정답 외 3개 오답 선택지를 같은 추론 유형 내 다른
|
||||
> 문항의 정답 텍스트를 교차 샘플링해 합성한 것으로(원본 AI Hub 벤치마크의 실제 선택지는 이미지
|
||||
> 기반), 네이티브 4지선다가 아닙니다. 절대 정확도 수치는 참고용으로만 해석할 것.
|
||||
|
||||
## 사용 데이터셋 명시
|
||||
|
||||
AI Hub: 71857/71874/71610/569/71949의 validation label 중 최종 proxy 벤치마크로 표본 추출되지
|
||||
않은 문서-안전(document-safe) 잔여분만 학습에 사용함.
|
||||
72
chat_template.jinja
Normal file
72
chat_template.jinja
Normal file
@@ -0,0 +1,72 @@
|
||||
{%- if tools is iterable and tools | length > 0 %}
|
||||
{{- '<|im_start|><|system|>'}}
|
||||
{{- '당신은 도구 호출 기능을 갖춘 유용한 도우미입니다. 사용자의 요청을 처리하기 위해서 필요한 도구가 주어진 목록에 있는 경우 도구 호출로 응답하세요.
|
||||
필요한 도구가 목록에 없는 경우에는 도구 호출 없이 사용자가 요구한 정보를 제공하세요.
|
||||
필요한 도구가 목록에 있지만 해당 도구를 호출하는데 필요한 argument 정보가 부족한 경우 해당 정보를 사용자에게 요청하세요.
|
||||
사용자의 요청을 처리하기 위해 여러번 도구를 호출할 수 있어야 합니다.
|
||||
도구 호출 이후 도구 실행 결과를 입력으로 받으면 해당 결과를 활용하여 답변을 생성하세요.
|
||||
|
||||
다음은 접근할 수 있는 도구들의 목록 입니다:
|
||||
<tools>
|
||||
'}}
|
||||
{%- for t in tools %}
|
||||
{{- t | tojson }}
|
||||
{{- '
|
||||
' }}
|
||||
{%- endfor %}
|
||||
{{- '</tools>' }}
|
||||
{{- '
|
||||
|
||||
도구를 호출하려면 아래의 JSON으로 응답하세요.
|
||||
도구 호출 형식: <tool_call>{"name": 도구 이름, "arguments": dictionary 형태의 도구 인자값}</tool_call>' }}
|
||||
{{- '<|im_end|>' }}
|
||||
{%- endif %}
|
||||
|
||||
{%- for message in messages %}
|
||||
{%- if message.role == 'system' %}
|
||||
{{- '<|im_start|><|system|>' + message.content + '<|im_end|>'}}
|
||||
{%- elif message.role == 'user' %}
|
||||
{{- '<|im_start|><|user|>' + message.content + '<|im_end|>'}}
|
||||
{%- elif message.role == 'assistant' %}
|
||||
{{- '<|im_start|><|assistant|>'}}
|
||||
{%- set content = '' %}
|
||||
{%- if message.content is defined %}
|
||||
{%- set content = message.content %}
|
||||
{%- endif %}
|
||||
|
||||
{%- if add_generation_prompt and not (message.reasoning_content is defined and message.reasoning_content is not none) %}
|
||||
{%- if '</think>' in message.content %}
|
||||
{%- set content = message.content.split('</think>'.strip())[-1].lstrip('\n') %}
|
||||
{%- endif %}
|
||||
{%- endif %}
|
||||
|
||||
{{- content}}
|
||||
{%- if message.tool_calls is defined %}
|
||||
{%- for tool_call in message.tool_calls %}
|
||||
{%- if tool_call.function is defined %}
|
||||
{%- set tool_call = tool_call.function %}
|
||||
{%- endif %}
|
||||
{{- '<tool_call>' }}
|
||||
{{- '{' }}
|
||||
{{- '"name": "' }}
|
||||
{{- tool_call.name }}
|
||||
{{- '"' }}
|
||||
{%- if tool_call.arguments is defined %}
|
||||
{{- ', ' }}
|
||||
{{- '"arguments": ' }}
|
||||
{{- tool_call.arguments|tojson }}
|
||||
{%- endif %}
|
||||
{{- '}' }}
|
||||
{{- '</tool_call>' }}
|
||||
{%- endfor %}
|
||||
{%- endif %}
|
||||
{{- '<|im_end|>'}}
|
||||
|
||||
{%- elif message.role == 'tool' %}
|
||||
{{- '<|im_start|><|extra_id_13|><tool_output>' + message.content + '</tool_output><|im_end|>'}}
|
||||
{%- endif %}
|
||||
{%- endfor %}
|
||||
|
||||
{%- if add_generation_prompt %}
|
||||
{{- '<|im_start|><|assistant|>' }}
|
||||
{%- endif %}
|
||||
32
config.json
Normal file
32
config.json
Normal file
@@ -0,0 +1,32 @@
|
||||
{
|
||||
"architectures": [
|
||||
"LlamaForCausalLM"
|
||||
],
|
||||
"attention_bias": false,
|
||||
"attention_dropout": 0.1,
|
||||
"bos_token_id": 0,
|
||||
"dtype": "bfloat16",
|
||||
"eos_token_id": 0,
|
||||
"head_dim": 128,
|
||||
"hidden_act": "silu",
|
||||
"hidden_size": 4096,
|
||||
"initializer_range": 0.02,
|
||||
"intermediate_size": 10880,
|
||||
"max_position_embeddings": 32768,
|
||||
"mlp_bias": false,
|
||||
"model_type": "llama",
|
||||
"num_attention_heads": 32,
|
||||
"num_hidden_layers": 32,
|
||||
"num_key_value_heads": 32,
|
||||
"pad_token_id": null,
|
||||
"pretraining_tp": 1,
|
||||
"rms_norm_eps": 1e-05,
|
||||
"rope_parameters": {
|
||||
"rope_theta": 500000,
|
||||
"rope_type": "default"
|
||||
},
|
||||
"tie_word_embeddings": false,
|
||||
"transformers_version": "5.15.0",
|
||||
"use_cache": false,
|
||||
"vocab_size": 102400
|
||||
}
|
||||
7
generation_config.json
Normal file
7
generation_config.json
Normal file
@@ -0,0 +1,7 @@
|
||||
{
|
||||
"bos_token_id": 0,
|
||||
"eos_token_id": 27,
|
||||
"max_new_tokens": 32768,
|
||||
"pad_token_id": 1,
|
||||
"transformers_version": "5.15.0"
|
||||
}
|
||||
5
kds_merge_info.json
Normal file
5
kds_merge_info.json
Normal file
@@ -0,0 +1,5 @@
|
||||
{
|
||||
"base_model": "AX-3.1-Light",
|
||||
"base_model_path": "/home/youngseok3/.cache/huggingface/hub/models--skt--A.X-3.1-Light/snapshots/9b41bb2406472634d8812c0b8931fa40fa9a6c3a",
|
||||
"adapter_path": "/home/youngseok3/KDS/checkpoints/sft_v0_2_AX-3.1-Light"
|
||||
}
|
||||
3
model.safetensors
Normal file
3
model.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:45b0ff9fdfd87599143e5fcfc1fec80d73a8fb2e3c283cea5ca344fb3599de53
|
||||
size 14529635608
|
||||
511221
tokenizer.json
Normal file
511221
tokenizer.json
Normal file
File diff suppressed because it is too large
Load Diff
23
tokenizer_config.json
Normal file
23
tokenizer_config.json
Normal file
@@ -0,0 +1,23 @@
|
||||
{
|
||||
"add_prefix_space": false,
|
||||
"backend": "tokenizers",
|
||||
"bos_token": "<|endoftext|>",
|
||||
"clean_up_tokenization_spaces": true,
|
||||
"cls_token": "<|cls|>",
|
||||
"eod_token": "<|endoftext|>",
|
||||
"eos_token": "<|im_end|>",
|
||||
"errors": "replace",
|
||||
"is_local": true,
|
||||
"local_files_only": true,
|
||||
"mask_token": "<|mask|>",
|
||||
"max_length": 7680,
|
||||
"model_max_length": 32768,
|
||||
"model_specific_special_tokens": {
|
||||
"eod_token": "<|endoftext|>"
|
||||
},
|
||||
"pad_token": "<|pad|>",
|
||||
"sep_token": "<|sep|>",
|
||||
"tokenizer_class": "GPT2Tokenizer",
|
||||
"unk_token": "<|unk|>",
|
||||
"vocab_size": 102400
|
||||
}
|
||||
Reference in New Issue
Block a user