初始化项目,由ModelHub XC社区提供模型

Model: misterkilgore/distilgpt2-psy-ita
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-30 18:31:20 +08:00
commit 3e1105a457
10 changed files with 150483 additions and 0 deletions

34
.gitattributes vendored Normal file
View File

@@ -0,0 +1,34 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text

46
README.md Normal file
View File

@@ -0,0 +1,46 @@
---
language:
- it
thumbnail: "url to a thumbnail used in social sharing"
tags:
- psychology
- distilgpt2
widget:
- text: "Il cognitivismo"
- text: "Parliamo di attaccamento"
- text: "Le cause del disturbo d'ansia nei bambini sono"
---
# Italian Psychology DistilGPT-2
This model is a fine-tuned version of the GPT-2 language model, trained on a dataset of Italian psychology articles.
It is capable of generating human-like text on topics related to psychology and mental health in Italian language.
## Model details
The base model used for fine-tuning is the GPT-2 model, with a transformer architecture and 1250M parameters.
The fine-tuning dataset consists of approximately 10,000 Italian psychology articles.
## Example usage
```python
from transformers import pipeline
nlp = pipeline("text-generation", model="misterkilgore/distilgpt2-psy-ita")
generated_text = nlp("Le cause del disturbo d'ansia nei bambini sono", max_length=100)
print(generated_text)
```
## Limitations and bias
This model has been trained on a dataset of Italian psychology articles and may not perform well on other types of text or in other languages.
Additionally, the dataset used to fine-tune the model may contain biases and limitations, which will be reflected in the generated text.
## Dataset
The dataset used to fine-tune this model is composed of Italian psychology articles.
It contains various topics on mental health and psychology, but some limitations and biases may be present. This model is meant to be used only for research and educational purposes.
## Training data
The training data is composed of Italian psychology articles.
Fine-tuning was performed on this dataset to adapt the base GPT-2 model to the specific topic of psychology and mental health in Italian language.

46
config.json Normal file
View File

@@ -0,0 +1,46 @@
{
"_name_or_path": "distilgpt2",
"_num_labels": 1,
"activation_function": "gelu_new",
"architectures": [
"GPT2LMHeadModel"
],
"attn_pdrop": 0.1,
"bos_token_id": 50256,
"embd_pdrop": 0.1,
"eos_token_id": 50256,
"id2label": {
"0": "LABEL_0"
},
"initializer_range": 0.02,
"label2id": {
"LABEL_0": 0
},
"layer_norm_epsilon": 1e-05,
"model_type": "gpt2",
"n_ctx": 1024,
"n_embd": 768,
"n_head": 12,
"n_inner": null,
"n_layer": 6,
"n_positions": 1024,
"reorder_and_upcast_attn": false,
"resid_pdrop": 0.1,
"scale_attn_by_inverse_layer_idx": false,
"scale_attn_weights": true,
"summary_activation": null,
"summary_first_dropout": 0.1,
"summary_proj_to_labels": true,
"summary_type": "cls_index",
"summary_use_proj": true,
"task_specific_params": {
"text-generation": {
"do_sample": true,
"max_length": 50
}
},
"torch_dtype": "float32",
"transformers_version": "4.20.1",
"use_cache": true,
"vocab_size": 50257
}

49999
merges.txt Normal file

File diff suppressed because it is too large Load Diff

3
pytorch_model.bin Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:13c478dd939ea648a277bceef9d28345dd701a14651830d1e531483527dd830f
size 333969117

6
special_tokens_map.json Normal file
View File

@@ -0,0 +1,6 @@
{
"bos_token": "<|startoftext|>",
"eos_token": "<|endoftext|>",
"pad_token": "<|pad|>",
"unk_token": "<|endoftext|>"
}

100334
tokenizer.json Normal file

File diff suppressed because it is too large Load Diff

11
tokenizer_config.json Normal file
View File

@@ -0,0 +1,11 @@
{
"add_prefix_space": false,
"bos_token": "<|startoftext|>",
"eos_token": "<|endoftext|>",
"model_max_length": 1024,
"name_or_path": "distilgpt2",
"pad_token": "<|pad|>",
"special_tokens_map_file": null,
"tokenizer_class": "GPT2Tokenizer",
"unk_token": "<|endoftext|>"
}

3
training_args.bin Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b833d8a01a3347c01ef73bc84e9ba90d3e760cfae4038682501125b00db63a7c
size 3311

1
vocab.json Normal file

File diff suppressed because one or more lines are too long