初始化项目,由ModelHub XC社区提供模型

Model: reallexi/lexi-coder-v5.1
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-13 01:58:32 +08:00
commit 08f469ec97
32 changed files with 200474 additions and 0 deletions

39
.gitattributes vendored Normal file
View File

@@ -0,0 +1,39 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
training_curve.png filter=lfs diff=lfs merge=lfs -text
lexi-coder-v5-1-f16.gguf filter=lfs diff=lfs merge=lfs -text
lexi-coder-v5-1-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text
tokenizer.json filter=lfs diff=lfs merge=lfs -text

6
NOTICE Normal file
View File

@@ -0,0 +1,6 @@
Copyright (c) 2026 Reallexi LLC. All rights reserved.
This standalone model was produced by Reallexi LLC AI Model Builder.
Core backlink: https://llm.reallexi.io
The upstream base model and training datasets retain their own licenses and terms.

118
README.md Normal file
View File

@@ -0,0 +1,118 @@
---
license: other
license_name: "inherits-base-model-and-dataset-terms"
base_model: "reallexi/lexi-coder-v4.3"
library_name: transformers
pipeline_tag: "text-generation"
tags:
- "ai-model-builder"
- "fine-tuned"
- lora
- reallexi
- "text-generation"
---
# lexi-coder-v5.1
**lexi-coder-v5.1** by Reallexi LLC AI Model Builder — [llm.reallexi.io](https://llm.reallexi.io)
Copyright (c) 2026 Reallexi LLC. All rights reserved.
A standalone model of 3.86B parameters, derived from [`reallexi/lexi-coder-v4.3`](https://huggingface.co/reallexi/lexi-coder-v4.3).
The adapter has been merged into the base weights, so no PEFT adapter is needed at runtime.
## Size and requirements
| | |
|---|---|
| Parameters | 3,859,090,432 (3.86B) |
| Weights on disk | 7.15 GB |
| Trained context length | 1,024 tokens |
| Base model | `reallexi/lexi-coder-v4.3` |
Approximate memory to hold the weights. Add context and runtime overhead on top.
| Precision | Weights |
|---|---|
| FP16 / BF16 | 7.19 GB |
| 8-bit (Q8_0) | 3.59 GB |
| 4-bit (Q4_K_M) | 1.98 GB |
## Training
| | |
|---|---|
| Strategy | lora |
| Adapter | Auto LoRA |
| LoRA rank / alpha | 16 / 32 |
| Dataset | `reallexi/lexi-coder-v3-datasest` |
| Samples learned | 110,000 (through phase 28 of 258) |
| Training steps | 15,000 |
| Epochs | 3 |
## Before / after samples
The same prompts, drawn from the training data, run through the base model before training and the finished model after. This shows what the run changed on representative prompts -- it is not a benchmark. Full outputs are in `SAMPLES.md` and `samples.json` alongside this file.
**Prompt:** def partition(p, r): i = p for j in range(p, r): if A[r][1] >= A[j][1]: A[i], A[j] = A[j], A[i]
- Before: i += 1 return partition(p, r) if partition(p, r) == partition(p, r): return partition(p, r) else: return partition(p, r)
n = int(input())
A = [tuple(map(int, input().split())) for _ in range(n)]
print(*partition(0, n)[1:]) for i in range(n) if partition(0,
- After: i += 1 return i
def quicksort(p, r): if p < r: i = partition(p, r) quicksort(p, i-1) quicksort(i, r)
def mergeSort(p, r): if p < r: q = partition(p, r) mergeSort(p, q) mergeSort(q, r)
def printList(): print(" ", end =
**Prompt:** {i : Node(None, None, None) for i in range(n)} # 情報を入れるdictをNodeクラスで作成 for _ in range(n): # 変数名を「 _ 」にすることによって、「その変数を使っていない」ことを表現している(Pythonの習慣) tmp
- Before: = input().split() # 変数名と値を入れる tmp[0] = tmp[0].strip() # 変数名を入れる tmp[1] = tmp[1].strip() # 値を入れる tmp[2] = tmp[2].strip() # 値を入れる tmp[3] = tmp[3].strip() #
- After: = input().split() # 入れられた値を変数に入れる tmp[0] = int(tmp[0]) # 変数の値をintに変換 tmp[1] = int(tmp[1]) # 変数の値をintに変換 tmp[2] = int(tmp[2]) # 変数の値をintに変
**Prompt:** rmat(node_id), end = '') _pre_walk(self.nodes[node_id].left_child) _pre_walk(self.nodes[node_id].right_child) _pre_walk(self.root_id) print('') def inorder_walk…
- Before: _in_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _in_walk(self.nodes[node_id].right_child) def _post_walk(self, node_id, end = ''): if node_id != -1: _post_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _post_walk(self.nodes[node_id].right
- After: print(' ', end = '') print(node_id, end = '') _in_walk(self.nodes[node_id].left_child) _in_walk(self.nodes[node_id].right_child) _in_walk(self.nodes[node_id].parent) def post_walk(self): print('Post') root_node = self.nodes[self.root_id] def _post_walk(node_id): if node_id != -1: _post_walk
## Training curve
![Training loss](training_curve.png)
## Usage
```python
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained("lexi-coder-v5.1")
tokenizer = AutoTokenizer.from_pretrained("lexi-coder-v5.1")
```
## License and attribution
The effective terms are inherited from the base model and the training data, which are not necessarily the same as this project's own license. Review both before redistributing.
- Base model: [`reallexi/lexi-coder-v4.3`](https://huggingface.co/reallexi/lexi-coder-v4.3)
- Training data: `reallexi/lexi-coder-v3-datasest`
Copyright (c) 2026 Reallexi LLC. All rights reserved.
Produced by Reallexi LLC AI Model Builder from training job #161.
Core: https://llm.reallexi.io
## Who, where, and what platform trained this?
Produced by Reallexi LLC on [Reallexi AI Model Builder](https://llm.reallexi.io), a local-first training platform (https://llm.reallexi.io). Hugging Face repository: [reallexi/lexi-coder-v5.1](https://huggingface.co/reallexi/lexi-coder-v5.1).
Copyright (c) 2026 Reallexi LLC. All rights reserved.

40
SAMPLES.md Normal file
View File

@@ -0,0 +1,40 @@
# Before / after training samples
Generated automatically from a few prompts drawn from the training data, run once against the base model before training started and once against the finished model. This shows what this run changed on representative prompts -- it is not a benchmark and does not measure generalization.
## Prompt: def partition(p, r): i = p for j in range(p, r): if A[r][1] >= A[j][1]: A[i], A[j] = A[j], A[i]
**Before:**
> i += 1 return partition(p, r) if partition(p, r) == partition(p, r): return partition(p, r) else: return partition(p, r)
n = int(input())
A = [tuple(map(int, input().split())) for _ in range(n)]
print(*partition(0, n)[1:]) for i in range(n) if partition(0,
**After:**
> i += 1 return i
def quicksort(p, r): if p < r: i = partition(p, r) quicksort(p, i-1) quicksort(i, r)
def mergeSort(p, r): if p < r: q = partition(p, r) mergeSort(p, q) mergeSort(q, r)
def printList(): print(" ", end =
## Prompt: {i : Node(None, None, None) for i in range(n)} # 情報を入れるdictをNodeクラスで作成 for _ in range(n): # 変数名を「 _ 」にすることによって、「その変数を使っていない」ことを表現している(Pythonの習慣) tmp
**Before:**
> = input().split() # 変数名と値を入れる tmp[0] = tmp[0].strip() # 変数名を入れる tmp[1] = tmp[1].strip() # 値を入れる tmp[2] = tmp[2].strip() # 値を入れる tmp[3] = tmp[3].strip() #
**After:**
> = input().split() # 入れられた値を変数に入れる tmp[0] = int(tmp[0]) # 変数の値をintに変換 tmp[1] = int(tmp[1]) # 変数の値をintに変換 tmp[2] = int(tmp[2]) # 変数の値をintに変
## Prompt: rmat(node_id), end = '') _pre_walk(self.nodes[node_id].left_child) _pre_walk(self.nodes[node_id].right_child) _pre_walk(self.root_id) print('') def inorder_walk(self): print('Inorder') root_node = self.nodes[self.root_id] def _in_walk(node_id): if node_id != -1:
**Before:**
> _in_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _in_walk(self.nodes[node_id].right_child) def _post_walk(self, node_id, end = ''): if node_id != -1: _post_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _post_walk(self.nodes[node_id].right
**After:**
> print(' ', end = '') print(node_id, end = '') _in_walk(self.nodes[node_id].left_child) _in_walk(self.nodes[node_id].right_child) _in_walk(self.nodes[node_id].parent) def post_walk(self): print('Post') root_node = self.nodes[self.root_id] def _post_walk(node_id): if node_id != -1: _post_walk

12
added_tokens.json Normal file
View File

@@ -0,0 +1,12 @@
{
"<|/tool_call|>": 200026,
"<|/tool|>": 200024,
"<|assistant|>": 200019,
"<|end|>": 200020,
"<|system|>": 200022,
"<|tag|>": 200028,
"<|tool_call|>": 200025,
"<|tool_response|>": 200027,
"<|tool|>": 200023,
"<|user|>": 200021
}

1
chat_template.jinja Normal file
View File

@@ -0,0 +1 @@
{% for message in messages %}{% if message['role'] == 'system' and 'tools' in message and message['tools'] is not none %}{{ '<|' + message['role'] + '|>' + message['content'] + '<|tool|>' + message['tools'] + '<|/tool|>' + '<|end|>' }}{% else %}{{ '<|' + message['role'] + '|>' + message['content'] + '<|end|>' }}{% endif %}{% endfor %}{% if add_generation_prompt %}{{ '<|assistant|>' }}{% else %}{{ eos_token }}{% endif %}

147
config.json Normal file
View File

@@ -0,0 +1,147 @@
{
"architectures": [
"Phi3ForCausalLM"
],
"attention_bias": false,
"attention_dropout": 0.0,
"auto_map": {
"AutoConfig": "configuration_phi3.Phi3Config",
"AutoModelForCausalLM": "modeling_phi3.Phi3ForCausalLM",
"AutoTokenizer": "Xenova/gpt-4o"
},
"bos_token_id": 199999,
"dtype": "float16",
"embd_pdrop": 0.0,
"eos_token_id": 199999,
"full_attn_mod": 1,
"hidden_act": "silu",
"hidden_size": 3072,
"ignore_keys_at_rope_validation": null,
"initializer_range": 0.02,
"intermediate_size": 8192,
"interpolate_factor": 1,
"lm_head_bias": false,
"max_position_embeddings": 131072,
"mlp_bias": false,
"model_type": "phi3",
"num_attention_heads": 24,
"num_hidden_layers": 32,
"num_key_value_heads": 8,
"original_max_position_embeddings": 4096,
"pad_token_id": 199999,
"partial_rotary_factor": 0.75,
"resid_pdrop": 0.0,
"rms_norm_eps": 1e-05,
"rope_parameters": {
"long_factor": [
1,
1.118320672,
1.250641126,
1.398617824,
1.564103225,
1.74916897,
1.956131817,
2.187582649,
2.446418898,
2.735880826,
3.059592084,
3.421605075,
3.826451687,
4.279200023,
4.785517845,
5.351743533,
5.984965424,
6.693110555,
7.485043894,
8.370679318,
9.36110372,
10.4687158,
11.70738129,
13.09260651,
14.64173252,
16.37415215,
18.31155283,
20.47818807,
22.90118105,
25.61086418,
28.64115884,
32.03,
32.1,
32.13,
32.23,
32.6,
32.61,
32.64,
32.66,
32.7,
32.71,
32.93,
32.97,
33.28,
33.49,
33.5,
44.16,
47.77
],
"original_max_position_embeddings": 4096,
"partial_rotary_factor": 0.75,
"rope_theta": 10000.0,
"rope_type": "longrope",
"short_factor": [
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0,
1.0
],
"type": "longrope"
},
"sliding_window": 262144,
"tie_word_embeddings": true,
"transformers_version": "5.3.0",
"use_cache": true,
"vocab_size": 200064
}

10
generation_config.json Normal file
View File

@@ -0,0 +1,10 @@
{
"_from_model_config": true,
"bos_token_id": 199999,
"eos_token_id": [
200020,
199999
],
"pad_token_id": 199999,
"transformers_version": "5.3.0"
}

3
lexi-coder-v5-1-f16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:323e72293d7c711e26f26af41bab30656cdd8d7490be9d6018b0aca8a611e4d6
size 7680694496

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:4231d8ed24fe0f21ebc703bc79ce366717fd6e2df9d1134a8475439be01a27f4
size 2493840608

199743
merges.txt Normal file

File diff suppressed because it is too large Load Diff

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:475557c49814f3fc9a664d746da0f7acafbd0ec36c169772d1123ddfe54592b2
size 1984219768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d17dc6888d7743fd4580c2000b4ed81d7868f432b28a236aeaf3e60d7d5c3343
size 1962995144

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9ebd26fd4f390751694fa6980fe71156d0840586893ff1e88c1659077ecb397f
size 1912726040

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6b9089581e4ad82c59cf6420c4a937334af30dacfd6e05e4c01f2f03f68e8abd
size 1988178416

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:50d8339c6c073474c69a8d12a4373a209efdf7958f302653ae4de1c2a4e58e08
size 1963064008

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d728b1a5223700cab34a5fdc179f2c0ac246956c608df7845498b8347755e1be
size 1937846888

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f1ee4136b05b4e5c02d89861fb152d27f08ff3418732581def354c73e8563504
size 1812056168

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:6d366a9ed7c2d9cd559c047e0bfbc3bafff0746d329ccbb269a51e62028fb8e1
size 1988178456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8156af76472ce9591eeecd2a9f0d2ed14f413e0665f3d5aa68f4178f2ea4ea52
size 1937846904

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7a87111fdecc33485cc721be553ae6ad94d7e8cade12f1c1012ab22134111bd2
size 1988178456

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a23f09fde86e3e2e22b32e53af470580be65533868016d391f740a68bde5697d
size 1937846904

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9fa061cfeefb3d87a4c88432048d4422b560fdf45f0021cc559c454d8b58f9d0
size 755009440

View File

@@ -0,0 +1,202 @@
{
"metadata": {
"total_parameters": 3836021760,
"total_size": 7672043520
},
"weight_map": {
"model.embed_tokens.weight": "model-00001-of-00004.safetensors",
"model.layers.0.input_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.0.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.0.mlp.gate_up_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.0.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.0.self_attn.o_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.0.self_attn.qkv_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.1.input_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.1.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.1.mlp.gate_up_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.1.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.1.self_attn.o_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.1.self_attn.qkv_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.10.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.10.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.10.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.10.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.10.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.10.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.11.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.11.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.11.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.11.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.11.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.11.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.12.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.12.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.12.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.12.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.12.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.12.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.13.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.13.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.13.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.13.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.13.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.13.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.14.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.14.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.14.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.14.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.14.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.14.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.15.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.15.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.15.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.15.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.15.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.15.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.16.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.16.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.16.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.16.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.16.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.16.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.17.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.17.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.17.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.17.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.17.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.17.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.18.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.18.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.18.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.18.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.18.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.18.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.19.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.19.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.19.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.19.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.19.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.19.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.2.input_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.2.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.2.mlp.gate_up_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.2.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.2.self_attn.o_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.2.self_attn.qkv_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.20.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.20.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.20.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.20.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.20.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.20.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.21.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.21.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.21.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.21.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.21.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.21.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.22.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.22.mlp.down_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.22.mlp.gate_up_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.22.post_attention_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.22.self_attn.o_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.22.self_attn.qkv_proj.weight": "model-00003-of-00004.safetensors",
"model.layers.23.input_layernorm.weight": "model-00003-of-00004.safetensors",
"model.layers.23.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.23.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.23.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.23.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.23.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.24.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.24.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.24.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.24.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.24.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.24.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.25.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.25.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.25.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.25.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.25.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.25.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.26.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.26.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.26.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.26.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.26.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.26.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.27.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.27.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.27.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.27.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.27.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.27.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.28.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.28.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.28.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.28.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.28.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.28.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.29.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.29.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.29.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.29.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.29.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.29.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.3.input_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.3.mlp.down_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.3.mlp.gate_up_proj.weight": "model-00001-of-00004.safetensors",
"model.layers.3.post_attention_layernorm.weight": "model-00001-of-00004.safetensors",
"model.layers.3.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.3.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.30.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.30.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.30.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.30.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.30.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.30.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.31.input_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.31.mlp.down_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.31.mlp.gate_up_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.31.post_attention_layernorm.weight": "model-00004-of-00004.safetensors",
"model.layers.31.self_attn.o_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.31.self_attn.qkv_proj.weight": "model-00004-of-00004.safetensors",
"model.layers.4.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.4.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.4.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.4.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.4.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.4.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.5.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.5.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.5.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.5.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.5.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.5.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.6.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.6.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.6.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.6.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.6.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.6.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.7.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.7.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.7.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.7.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.7.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.7.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.8.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.8.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.8.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.8.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.8.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.8.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.9.input_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.9.mlp.down_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.9.mlp.gate_up_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.9.post_attention_layernorm.weight": "model-00002-of-00004.safetensors",
"model.layers.9.self_attn.o_proj.weight": "model-00002-of-00004.safetensors",
"model.layers.9.self_attn.qkv_proj.weight": "model-00002-of-00004.safetensors",
"model.norm.weight": "model-00004-of-00004.safetensors"
}
}

20
reallexi-model.json Normal file
View File

@@ -0,0 +1,20 @@
{
"schema_version": 1,
"job_id": 161,
"model_name": "lexi-coder-v5.1",
"artifact_type": "standalone_model",
"standalone": true,
"adapter_applied": true,
"source_artifact_type": "lora_adapter",
"base_model_id": "reallexi/lexi-coder-v4.3",
"custom_adapter": null,
"training_strategy": "lora",
"total_parameters": 3859090432,
"weight_size_bytes": 7672065984,
"trained_samples": 5000,
"training_steps": 15000,
"owner": "Reallexi LLC",
"copyright": "Copyright (c) 2026 Reallexi LLC. All rights reserved.",
"core_backlink": "https://llm.reallexi.io",
"created_at": "2026-08-17T18:17:33+00:00"
}

35
samples.json Normal file
View File

@@ -0,0 +1,35 @@
{
"prompts": [
"def partition(p, r): i = p for j in range(p, r): if A[r][1] >= A[j][1]: A[i], A[j] = A[j], A[i]",
"{i : Node(None, None, None) for i in range(n)} # \u60c5\u5831\u3092\u5165\u308c\u308bdict\u3092Node\u30af\u30e9\u30b9\u3067\u4f5c\u6210 for _ in range(n): # \u5909\u6570\u540d\u3092\u300c _ \u300d\u306b\u3059\u308b\u3053\u3068\u306b\u3088\u3063\u3066\u3001\u300c\u305d\u306e\u5909\u6570\u3092\u4f7f\u3063\u3066\u3044\u306a\u3044\u300d\u3053\u3068\u3092\u8868\u73fe\u3057\u3066\u3044\u308b\uff08Python\u306e\u7fd2\u6163\uff09 tmp",
"rmat(node_id), end = '') _pre_walk(self.nodes[node_id].left_child) _pre_walk(self.nodes[node_id].right_child) _pre_walk(self.root_id) print('') def inorder_walk(self): print('Inorder') root_node = self.nodes[self.root_id] def _in_walk(node_id): if node_id != -1:"
],
"before": [
{
"prompt": "def partition(p, r): i = p for j in range(p, r): if A[r][1] >= A[j][1]: A[i], A[j] = A[j], A[i]",
"output": "i += 1 return partition(p, r) if partition(p, r) == partition(p, r): return partition(p, r) else: return partition(p, r)\n\nn = int(input())\nA = [tuple(map(int, input().split())) for _ in range(n)]\nprint(*partition(0, n)[1:]) for i in range(n) if partition(0,"
},
{
"prompt": "{i : Node(None, None, None) for i in range(n)} # \u60c5\u5831\u3092\u5165\u308c\u308bdict\u3092Node\u30af\u30e9\u30b9\u3067\u4f5c\u6210 for _ in range(n): # \u5909\u6570\u540d\u3092\u300c _ \u300d\u306b\u3059\u308b\u3053\u3068\u306b\u3088\u3063\u3066\u3001\u300c\u305d\u306e\u5909\u6570\u3092\u4f7f\u3063\u3066\u3044\u306a\u3044\u300d\u3053\u3068\u3092\u8868\u73fe\u3057\u3066\u3044\u308b\uff08Python\u306e\u7fd2\u6163\uff09 tmp",
"output": "= input().split() # \u5909\u6570\u540d\u3068\u5024\u3092\u5165\u308c\u308b tmp[0] = tmp[0].strip() # \u5909\u6570\u540d\u3092\u5165\u308c\u308b tmp[1] = tmp[1].strip() # \u5024\u3092\u5165\u308c\u308b tmp[2] = tmp[2].strip() # \u5024\u3092\u5165\u308c\u308b tmp[3] = tmp[3].strip() #"
},
{
"prompt": "rmat(node_id), end = '') _pre_walk(self.nodes[node_id].left_child) _pre_walk(self.nodes[node_id].right_child) _pre_walk(self.root_id) print('') def inorder_walk(self): print('Inorder') root_node = self.nodes[self.root_id] def _in_walk(node_id): if node_id != -1:",
"output": "_in_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _in_walk(self.nodes[node_id].right_child) def _post_walk(self, node_id, end = ''): if node_id != -1: _post_walk(self.nodes[node_id].left_child) print(str(self.nodes[node_id].value)) _post_walk(self.nodes[node_id].right"
}
],
"after": [
{
"prompt": "def partition(p, r): i = p for j in range(p, r): if A[r][1] >= A[j][1]: A[i], A[j] = A[j], A[i]",
"output": "i += 1 return i\ndef quicksort(p, r): if p < r: i = partition(p, r) quicksort(p, i-1) quicksort(i, r)\ndef mergeSort(p, r): if p < r: q = partition(p, r) mergeSort(p, q) mergeSort(q, r)\ndef printList(): print(\" \", end ="
},
{
"prompt": "{i : Node(None, None, None) for i in range(n)} # \u60c5\u5831\u3092\u5165\u308c\u308bdict\u3092Node\u30af\u30e9\u30b9\u3067\u4f5c\u6210 for _ in range(n): # \u5909\u6570\u540d\u3092\u300c _ \u300d\u306b\u3059\u308b\u3053\u3068\u306b\u3088\u3063\u3066\u3001\u300c\u305d\u306e\u5909\u6570\u3092\u4f7f\u3063\u3066\u3044\u306a\u3044\u300d\u3053\u3068\u3092\u8868\u73fe\u3057\u3066\u3044\u308b\uff08Python\u306e\u7fd2\u6163\uff09 tmp",
"output": "= input().split() # \u5165\u308c\u3089\u308c\u305f\u5024\u3092\u5909\u6570\u306b\u5165\u308c\u308b tmp[0] = int(tmp[0]) # \u5909\u6570\u306e\u5024\u3092int\u306b\u5909\u63db tmp[1] = int(tmp[1]) # \u5909\u6570\u306e\u5024\u3092int\u306b\u5909\u63db tmp[2] = int(tmp[2]) # \u5909\u6570\u306e\u5024\u3092int\u306b\u5909"
},
{
"prompt": "rmat(node_id), end = '') _pre_walk(self.nodes[node_id].left_child) _pre_walk(self.nodes[node_id].right_child) _pre_walk(self.root_id) print('') def inorder_walk(self): print('Inorder') root_node = self.nodes[self.root_id] def _in_walk(node_id): if node_id != -1:",
"output": "print(' ', end = '') print(node_id, end = '') _in_walk(self.nodes[node_id].left_child) _in_walk(self.nodes[node_id].right_child) _in_walk(self.nodes[node_id].parent) def post_walk(self): print('Post') root_node = self.nodes[self.root_id] def _post_walk(node_id): if node_id != -1: _post_walk"
}
]
}

30
special_tokens_map.json Normal file
View File

@@ -0,0 +1,30 @@
{
"bos_token": {
"content": "<|endoftext|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"eos_token": {
"content": "<|endoftext|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"pad_token": {
"content": "<|endoftext|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
},
"unk_token": {
"content": "<|endoftext|>",
"lstrip": false,
"normalized": false,
"rstrip": false,
"single_word": false
}
}

3
tokenizer.json Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:20d5d2f95f5631bc1160d02840c0f0c0630bc6381528c611c325ac59caf0fc66
size 15524574

3
tokenizer.model Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:37f00374dea48658ee8f5d0f21895b9bc55cb0103939607c8185bfd1c6ca1f89
size 587404

19
tokenizer_config.json Normal file
View File

@@ -0,0 +1,19 @@
{
"add_prefix_space": false,
"backend": "tokenizers",
"bos_token": "<|endoftext|>",
"clean_up_tokenization_spaces": false,
"eos_token": "<|endoftext|>",
"is_local": true,
"max_length": 1024,
"model_max_length": 131072,
"pad_to_multiple_of": null,
"pad_token": "<|endoftext|>",
"pad_token_type_id": 0,
"padding_side": "right",
"stride": 0,
"tokenizer_class": "GPT2Tokenizer",
"truncation_side": "right",
"truncation_strategy": "longest_first",
"unk_token": "<|endoftext|>"
}

3
training_curve.png Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:68430f098ead5235816b4ed0aa95a5130d6ad0f6d23fd1e37fc3bedf83861c1f
size 61724

1
vocab.json Normal file

File diff suppressed because one or more lines are too long