初始化项目,由ModelHub XC社区提供模型
Model: 11-47/SmolLM-135M-Tarot-Zodiac-Reasoning Source: Original Platform
This commit is contained in:
35
.gitattributes
vendored
Normal file
35
.gitattributes
vendored
Normal file
@@ -0,0 +1,35 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
98
README.md
Normal file
98
README.md
Normal file
@@ -0,0 +1,98 @@
|
||||
---
|
||||
base_model: HuggingFaceTB/SmolLM-135M-Instruct
|
||||
library_name: transformers
|
||||
model_name: SmolLM-135M-Tarot-Zodiac-Reasoning
|
||||
tags:
|
||||
- generated_from_trainer
|
||||
- sft
|
||||
- trl
|
||||
- conversational
|
||||
- text-generation
|
||||
- tarot
|
||||
- zodiac
|
||||
- astrology
|
||||
- reasoning
|
||||
datasets:
|
||||
- 11-47/The_Prophet_Tarot_Zodiac_50K
|
||||
- 11-47/The_Prophet_Tarot_Zodiac_5K
|
||||
- 11-47/The_Prophet_Tarot_Zodiac_5K_seed
|
||||
license: apache-2.0 # Assuming standard; update if needed
|
||||
language:
|
||||
- en
|
||||
---
|
||||
|
||||
# SmolLM-135M-Tarot-Zodiac-Reasoning
|
||||
|
||||
**By 11-47**
|
||||
|
||||
A fine-tuned **135M parameter** model specialized in **Tarot interpretation, Zodiac insights, and mystical reasoning**. Built on top of [HuggingFaceTB/SmolLM-135M-Instruct](https://huggingface.co/HuggingFaceTB/SmolLM-135M-Instruct) using Supervised Fine-Tuning (SFT) with TRL.
|
||||
|
||||
This tiny but mighty model blends modern LLM capabilities with esoteric knowledge—perfect for lightweight tarot readings, astrological guidance, symbolic reasoning, and creative spiritual conversations on edge devices or low-resource setups.
|
||||
|
||||
## Model Details
|
||||
|
||||
- **Base Model**: `HuggingFaceTB/SmolLM-135M-Instruct`
|
||||
- **Parameters**: 135M (super efficient!)
|
||||
- **Tensor Type**: F32 (Safetensors)
|
||||
- **Training Method**: SFT (Supervised Fine-Tuning) via TRL
|
||||
- **Datasets**:
|
||||
- `11-47/The_Prophet_Tarot_Zodiac_50K` (main dataset)
|
||||
- `11-47/The_Prophet_Tarot_Zodiac_5K`
|
||||
- `11-47/The_Prophet_Tarot_Zodiac_5K_seed` (seed / validation)
|
||||
|
||||
The training focuses on conversational tarot spreads, zodiac interpretations, symbolic reasoning, and blending mystical traditions with logical explanations.
|
||||
|
||||
## Quick Start
|
||||
|
||||
```python
|
||||
from transformers import pipeline
|
||||
|
||||
generator = pipeline(
|
||||
"text-generation",
|
||||
model="11-47/SmolLM-135M-Tarot-Zodiac-Reasoning",
|
||||
device="cuda" # or "cpu"
|
||||
)
|
||||
|
||||
question = "What does The Tower card mean for someone with a Scorpio rising going through a major life transition?"
|
||||
output = generator(
|
||||
[{"role": "user", "content": question}],
|
||||
max_new_tokens=256,
|
||||
return_full_text=False
|
||||
)[0]
|
||||
|
||||
print(output["generated_text"])
|
||||
Intended Uses
|
||||
• Tarot Readings: Generate insightful interpretations of cards and spreads (single card, 3-card, Celtic Cross, etc.).
|
||||
• Zodiac & Astrology: Personalized horoscopes, compatibility analysis, and planetary transits.
|
||||
• Mystical Reasoning: Symbolic interpretation, dream analysis, spiritual advice with logical structure.
|
||||
• Lightweight Deployment: Runs great on phones, laptops, or embedded devices.
|
||||
• Fun / Educational spiritual chatbots.
|
||||
Limitations
|
||||
• Very small model (135M) → Can be less coherent on complex multi-card spreads or highly nuanced queries compared to larger models.
|
||||
• Knowledge is synthetic / training-data driven — treat outputs as inspirational rather than definitive divination.
|
||||
• May occasionally hallucinate card meanings or astrological facts.
|
||||
• Not a replacement for professional tarot/astrology consultation.
|
||||
Training Procedure
|
||||
• Framework: Hugging Face TRL (Transformers Reinforcement Learning library)
|
||||
• Method: SFT on assistant responses in chat format.
|
||||
• Framework Versions:
|
||||
◦ TRL: 1.8.0
|
||||
◦ Transformers: 5.13.1
|
||||
◦ PyTorch: 2.10.0+cu128
|
||||
◦ Datasets: 5.0.0
|
||||
Citation
|
||||
@misc{smollm-tarot-zodiac-reasoning,
|
||||
author = {11-47},
|
||||
title = {SmolLM-135M-Tarot-Zodiac-Reasoning},
|
||||
year = {2026},
|
||||
publisher = {Hugging Face},
|
||||
url = {https://huggingface.co/11-47/SmolLM-135M-Tarot-Zodiac-Reasoning}
|
||||
}
|
||||
|
||||
# Cite TRL
|
||||
@software{vonwerra2020trl,
|
||||
title = {{TRL: Transformers Reinforcement Learning}},
|
||||
author = {von Werra, Leandro and others},
|
||||
url = {https://github.com/huggingface/trl},
|
||||
year = {2020}
|
||||
}
|
||||
4
chat_template.jinja
Normal file
4
chat_template.jinja
Normal file
@@ -0,0 +1,4 @@
|
||||
{% for message in messages %}{{'<|im_start|>' + message['role'] + '
|
||||
' + message['content'] + '<|im_end|>' + '
|
||||
'}}{% endfor %}{% if add_generation_prompt %}{{ '<|im_start|>assistant
|
||||
' }}{% endif %}
|
||||
32
config.json
Normal file
32
config.json
Normal file
@@ -0,0 +1,32 @@
|
||||
{
|
||||
"architectures": [
|
||||
"LlamaForCausalLM"
|
||||
],
|
||||
"attention_bias": false,
|
||||
"attention_dropout": 0.0,
|
||||
"bos_token_id": 1,
|
||||
"dtype": "float32",
|
||||
"eos_token_id": 2,
|
||||
"head_dim": 64,
|
||||
"hidden_act": "silu",
|
||||
"hidden_size": 576,
|
||||
"initializer_range": 0.02,
|
||||
"intermediate_size": 1536,
|
||||
"max_position_embeddings": 2048,
|
||||
"mlp_bias": false,
|
||||
"model_type": "llama",
|
||||
"num_attention_heads": 9,
|
||||
"num_hidden_layers": 30,
|
||||
"num_key_value_heads": 3,
|
||||
"pad_token_id": 2,
|
||||
"pretraining_tp": 1,
|
||||
"rms_norm_eps": 1e-05,
|
||||
"rope_parameters": {
|
||||
"rope_theta": 10000.0,
|
||||
"rope_type": "default"
|
||||
},
|
||||
"tie_word_embeddings": true,
|
||||
"transformers_version": "5.13.1",
|
||||
"use_cache": false,
|
||||
"vocab_size": 49152
|
||||
}
|
||||
10
generation_config.json
Normal file
10
generation_config.json
Normal file
@@ -0,0 +1,10 @@
|
||||
{
|
||||
"_from_model_config": true,
|
||||
"bos_token_id": 1,
|
||||
"eos_token_id": [
|
||||
2
|
||||
],
|
||||
"max_new_tokens": 40,
|
||||
"pad_token_id": 2,
|
||||
"transformers_version": "5.13.1"
|
||||
}
|
||||
4
last-checkpoint/chat_template.jinja
Normal file
4
last-checkpoint/chat_template.jinja
Normal file
@@ -0,0 +1,4 @@
|
||||
{% for message in messages %}{{'<|im_start|>' + message['role'] + '
|
||||
' + message['content'] + '<|im_end|>' + '
|
||||
'}}{% endfor %}{% if add_generation_prompt %}{{ '<|im_start|>assistant
|
||||
' }}{% endif %}
|
||||
32
last-checkpoint/config.json
Normal file
32
last-checkpoint/config.json
Normal file
@@ -0,0 +1,32 @@
|
||||
{
|
||||
"architectures": [
|
||||
"LlamaForCausalLM"
|
||||
],
|
||||
"attention_bias": false,
|
||||
"attention_dropout": 0.0,
|
||||
"bos_token_id": 1,
|
||||
"dtype": "float32",
|
||||
"eos_token_id": 2,
|
||||
"head_dim": 64,
|
||||
"hidden_act": "silu",
|
||||
"hidden_size": 576,
|
||||
"initializer_range": 0.02,
|
||||
"intermediate_size": 1536,
|
||||
"max_position_embeddings": 2048,
|
||||
"mlp_bias": false,
|
||||
"model_type": "llama",
|
||||
"num_attention_heads": 9,
|
||||
"num_hidden_layers": 30,
|
||||
"num_key_value_heads": 3,
|
||||
"pad_token_id": 2,
|
||||
"pretraining_tp": 1,
|
||||
"rms_norm_eps": 1e-05,
|
||||
"rope_parameters": {
|
||||
"rope_theta": 10000.0,
|
||||
"rope_type": "default"
|
||||
},
|
||||
"tie_word_embeddings": true,
|
||||
"transformers_version": "5.13.1",
|
||||
"use_cache": false,
|
||||
"vocab_size": 49152
|
||||
}
|
||||
10
last-checkpoint/generation_config.json
Normal file
10
last-checkpoint/generation_config.json
Normal file
@@ -0,0 +1,10 @@
|
||||
{
|
||||
"_from_model_config": true,
|
||||
"bos_token_id": 1,
|
||||
"eos_token_id": [
|
||||
2
|
||||
],
|
||||
"max_new_tokens": 40,
|
||||
"pad_token_id": 2,
|
||||
"transformers_version": "5.13.1"
|
||||
}
|
||||
3
last-checkpoint/model.safetensors
Normal file
3
last-checkpoint/model.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9a25c226fa2cbb946ff764b8d9080ad2134e2e6527356d0dc40d65e51e7982b9
|
||||
size 538090408
|
||||
3
last-checkpoint/optimizer.pt
Normal file
3
last-checkpoint/optimizer.pt
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:510391ba1be12ead83308b44b639f746a9db7da15e6fde09385d4d6f7f178000
|
||||
size 1076353291
|
||||
3
last-checkpoint/rng_state_0.pth
Normal file
3
last-checkpoint/rng_state_0.pth
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:61e957b4cd785256be4cb26eb03060ef689e1d58f1766d7f26ca36a62bec4994
|
||||
size 14917
|
||||
3
last-checkpoint/rng_state_1.pth
Normal file
3
last-checkpoint/rng_state_1.pth
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:550c54d430b44b77b0abe44c6e3ceba90a155305315c081b7616b35e2c18d1ce
|
||||
size 14917
|
||||
3
last-checkpoint/scaler.pt
Normal file
3
last-checkpoint/scaler.pt
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:02d87491fd0ec6b1df8b90d87d78e22667e0aa9bc59c23ee21dac9cf93bfce29
|
||||
size 1383
|
||||
3
last-checkpoint/scheduler.pt
Normal file
3
last-checkpoint/scheduler.pt
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:56c65d89d4eb280f6e11cb7d872a3a4332ecda1c0c3b420d7a6f979d249425ca
|
||||
size 1465
|
||||
244965
last-checkpoint/tokenizer.json
Normal file
244965
last-checkpoint/tokenizer.json
Normal file
File diff suppressed because it is too large
Load Diff
19
last-checkpoint/tokenizer_config.json
Normal file
19
last-checkpoint/tokenizer_config.json
Normal file
@@ -0,0 +1,19 @@
|
||||
{
|
||||
"add_prefix_space": false,
|
||||
"backend": "tokenizers",
|
||||
"bos_token": "<|im_start|>",
|
||||
"clean_up_tokenization_spaces": false,
|
||||
"eos_token": "<|im_end|>",
|
||||
"errors": "replace",
|
||||
"extra_special_tokens": [
|
||||
"<|im_start|>",
|
||||
"<|im_end|>"
|
||||
],
|
||||
"is_local": false,
|
||||
"local_files_only": false,
|
||||
"model_max_length": 2048,
|
||||
"pad_token": "<|im_end|>",
|
||||
"tokenizer_class": "GPT2Tokenizer",
|
||||
"unk_token": "<|endoftext|>",
|
||||
"vocab_size": 49152
|
||||
}
|
||||
2844
last-checkpoint/trainer_state.json
Normal file
2844
last-checkpoint/trainer_state.json
Normal file
File diff suppressed because it is too large
Load Diff
3
last-checkpoint/training_args.bin
Normal file
3
last-checkpoint/training_args.bin
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8774f928ae65263f178df7ca5e94cf091f050ac87a27f9e576278d89ece6f314
|
||||
size 5713
|
||||
3
model.safetensors
Normal file
3
model.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9a25c226fa2cbb946ff764b8d9080ad2134e2e6527356d0dc40d65e51e7982b9
|
||||
size 538090408
|
||||
244965
tokenizer.json
Normal file
244965
tokenizer.json
Normal file
File diff suppressed because it is too large
Load Diff
19
tokenizer_config.json
Normal file
19
tokenizer_config.json
Normal file
@@ -0,0 +1,19 @@
|
||||
{
|
||||
"add_prefix_space": false,
|
||||
"backend": "tokenizers",
|
||||
"bos_token": "<|im_start|>",
|
||||
"clean_up_tokenization_spaces": false,
|
||||
"eos_token": "<|im_end|>",
|
||||
"errors": "replace",
|
||||
"extra_special_tokens": [
|
||||
"<|im_start|>",
|
||||
"<|im_end|>"
|
||||
],
|
||||
"is_local": false,
|
||||
"local_files_only": false,
|
||||
"model_max_length": 2048,
|
||||
"pad_token": "<|im_end|>",
|
||||
"tokenizer_class": "GPT2Tokenizer",
|
||||
"unk_token": "<|endoftext|>",
|
||||
"vocab_size": 49152
|
||||
}
|
||||
3
training_args.bin
Normal file
3
training_args.bin
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8774f928ae65263f178df7ca5e94cf091f050ac87a27f9e576278d89ece6f314
|
||||
size 5713
|
||||
Reference in New Issue
Block a user