thealper2 commited on
Commit
8db58fb
·
verified ·
1 Parent(s): 7db4589

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +0 -16
README.md CHANGED
@@ -75,8 +75,6 @@ print(tokenizer.decode(out[0][inputs.shape[1]:], skip_special_tokens=True))
75
 
76
  > Sohbet şablonu taban modelin ChatML türevidir (`<|im_start|>role\n...<|im_end|>`). Her zaman `apply_chat_template` kullanın; prompt'u elle kurmayın.
77
 
78
- > **Önemli - çözümleme ayarı / decoding.** Bu modeli **örnekleme ile** çalıştırın (`do_sample=True`, `temperature≈0.7`, `top_p=0.95`), taban modelin `generation_config.json` dosyasındaki gibi. Greedy çözümlemede (`do_sample=False`) hem taban model hem bu model tekrar döngüsüne girebilir; bu ölçüldü ve `evaluation/comparison.md` ile `evaluation_sampled/comparison.md` karşılaştırmasında görülebilir. / Run this model **with sampling**; greedy decoding makes both the base and this model degenerate into repetition.
79
-
80
  Model, yanıtlarına boş bir düşünme bloğu (`<think>\n\n</think>`) ile başlayacak şekilde eğitildi; bu, taban modelin `enable_thinking=False` biçimiyle uyumludur. Uzun zincirleme akıl yürütme (CoT) verisiyle eğitilmedi.
81
 
82
  ### llama.cpp / GGUF
@@ -155,20 +153,6 @@ Değerlendirme, taban model ile ince ayarlı model üzerinde **aynı prompt'lar
155
  - `code_js_01` (code_generation): 0/1 vs 1/1 checks
156
  - `en_code_02` (english_coding): 0/2 vs 2/2 checks
157
 
158
- ### Ölçülen sinyaller / measured signals (örneklemeli çözümleme)
159
-
160
- | sinyal / signal | taban / base | ince ayarlı / fine-tuned |
161
- |---|---|---|
162
- | biçim/içerik kontrol oranı | 0.467 | 0.633 |
163
- | ortalama kelime | 129.500 | 73.900 |
164
- | tekrar oranı (düşük iyi) | 0.033 | 0.031 |
165
- | kod bloğu içeren yanıt | 5 | 9 |
166
- | boş yanıt | 0 | 0 |
167
-
168
- Bu ölçümler mekanik sinyallerdir (biçim kontrolleri, yanıt dili, Python sözdizimi, tekrar oranı). Bir kalite skoru **değildir**; yayınlamadan önce `comparison.md` dosyasındaki yanıtları okumanız beklenir.
169
-
170
- **Açık sözlü değerlendirme / honest read.** Denetimli ince ayar biçim ve dil öğretir, **bilgi öğretmez**. Bu model taban modele göre belirgin biçimde daha düzgün Türkçe üretiyor, kod bloklarını ve JSON'u doğru biçimlendiriyor ve talimat biçimine daha iyi uyuyor; ancak **olgusal içerik doğruluğu hâlâ zayıf** ve yanıtlar taban modele göre belirgin biçimde daha kısa. 1B parametre ve yaklaşık yarım epoch'luk bir SFT bütçesiyle beklenen sonuç budur. Türkçe bilgi kalitesini yükseltmek sürekli ön-eğitim (continued pretraining) gerektirir; bu proje kapsamına bilinçli olarak dahil edilmedi.
171
-
172
  ## Sınırlar ve riskler / Limitations
173
 
174
  - 1B parametreli küçük bir modeldir; olgusal doğruluk sınırlıdır ve **halüsinasyon görülebilir**.
 
75
 
76
  > Sohbet şablonu taban modelin ChatML türevidir (`<|im_start|>role\n...<|im_end|>`). Her zaman `apply_chat_template` kullanın; prompt'u elle kurmayın.
77
 
 
 
78
  Model, yanıtlarına boş bir düşünme bloğu (`<think>\n\n</think>`) ile başlayacak şekilde eğitildi; bu, taban modelin `enable_thinking=False` biçimiyle uyumludur. Uzun zincirleme akıl yürütme (CoT) verisiyle eğitilmedi.
79
 
80
  ### llama.cpp / GGUF
 
153
  - `code_js_01` (code_generation): 0/1 vs 1/1 checks
154
  - `en_code_02` (english_coding): 0/2 vs 2/2 checks
155
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
156
  ## Sınırlar ve riskler / Limitations
157
 
158
  - 1B parametreli küçük bir modeldir; olgusal doğruluk sınırlıdır ve **halüsinasyon görülebilir**.