ogulcanakca's picture
Update README.md
4d0dbcb verified
|
Raw
History Blame Contribute Delete
2.15 kB
metadata
license: apache-2.0
tags:
  - gguf
  - kumru
  - epdk
  - instruct
  - dpo
  - dapt
  - qlora
  - unsloth
  - mistral
  - llama.cpp
language:
  - tr
pipeline_tag: text-generation
base_model: ogulcanakca/Kumru-2B-EPDK-Instruct

Model Card

ogulcanakca/Kumru-2B-EPDK-Instruct modelinin (iki aşamalı DAPT + DPO ile eğitilmiş) GGUF formatına dönüştürülmüş versiyonlarını içerir.

Bu dosyalar, llama.cpp, Ollama, LM Studio ve diğer GGUF uyumlu platformlarda GPU olmadan CPU üzerinde verimli bir şekilde çalışmak üzere optimize edilmiştir.

Ana Model: 👉 ogulcanakca/Kumru-2B-EPDK-Instruct

Eğitim Detayları

Bu GGUF dosyaları, iki aşamalı bir süreçle eğitilmiş bir modelden dönüştürülmüştür:

  1. DAPT: vngrs-ai/Kumru-2B-Base modeli, ogulcanakca/epdk_corpus (domain terminolojisi) üzerinde eğitildi ve ogulcanakca/Kumru-2B-EPDK-dapt oluşturuldu.
  2. DPO: Model, ogulcanakca/epdk_dpo (24.5k+ sentetik prompt/chosen/rejected üçlüsü) veri setiyle DPO yöntemi kullanılarak "sohbet" ve "tercih" için eğitildi ve ogulcanakca/Kumru-2B-EPDK-DPO oluşturuldu..
  3. Merge: DAPT ve DPO adaptörleri, unsloth kütüphanesi kullanılarak Kumru-2B-Base modeline birleştirildi ve ogulcanakca/Kumru-2B-EPDK-Instruct oluşturuldu.
  4. Convert: Nihai birleştirilmiş model (ogulcanakca/Kumru-2B-EPDK-Instruct), llama.cpp kullanarak bu GGUF dosyalarına dönüştürüldü.

WandB Eğitim Raporu: 👉 WandB Raporu (DPO Aşaması)