SykoLLM-V5.8-Mini, sıfırdan (from scratch) eğitilmiş, Türkçe ve İngilizce destekli, kod anlama kapasitesine sahip SykoLLM ailesinin küçük bir dil modelidir. Phi-3 mimarisi temel alınarak özel BPE tokenizer ile geliştirilmiştir.
Model Mimarisi
Özellik
Değer
Mimari
Phi-3 (Phi3ForCausalLM)
Toplam Parametre
~277 Milyon
Gizli Katman Boyutu
1024
Katman Sayısı
18
Attention Head
8 (2 KV Head — GQA)
Vocabulary Boyutu
50.000
Maksimum Bağlam
1024 Token
Aktivasyon Fonksiyonu
SiLU
Eğitim Adımı
~3.500 Step
Yaklaşık Eğitim Örneği
~1.000.000+
Yaklaşık Eğitim Token'ı
~1.000.000.000+
Eğitim Donanımı
2x NVIDIA Tesla T4
Tokenizer
Model, sıfırdan eğitilmiş özel bir BPE tokenizer kullanmaktadır. Hugging Face'in hazır tokenizer'larından bağımsız olarak geliştirilmiştir.
Tür: Byte-Level BPE
Vocabulary Boyutu: 50.000
Normalizer: NFKC
Özel Token'lar:<|endoftext|>, <|user|>, <|assistant|>, <|end|>, <|pad|>
Model <|user|> / <|assistant|> prompt formatıyla eğitilmiştir:
prompt="<|user|>\nPython'da Fibonacci dizisini nasıl yazarım?<|end|>\n<|assistant|>\n"inputs=tokenizer(prompt,return_tensors="pt").to(model.device)outputs=model.generate(**inputs,max_new_tokens=300,do_sample=True,temperature=0.7,top_p=0.9)print(tokenizer.decode(outputs[0],skip_special_tokens=True))
Sınırlamalar
Model araştırma ve geliştirme amaçlıdır; production ortamı için önerilmez.
Eğitim adımı görece az olduğundan uzun ve karmaşık akıl yürütme görevlerinde hata yapabilir.
Maksimum bağlam uzunluğu 1024 token ile sınırlıdır.
Model, zararlı içerik filtrelemesi için hizalanmamıştır (RLHF/DPO uygulanmamıştır).
Lisans
Bu model Apache 2.0 lisansı altında yayınlanmıştır.
Alıntı
@misc{sykollm-v5.8-mini-2025,author={SykoSLM},title={SykoLLM-V5.8-Mini: A Small Multilingual Causal Language Model Trained from Scratch},year={2025},publisher={HuggingFace},url={https://huggingface.co/SykoSLM/SykoLLM-V5.8-Mini}}