GGUF
conversational
roelfrenkema's picture
first commit
5806b76
Raw
History Blame Contribute Delete
1.35 kB
# gemma-4-E2B-it.Q4_K_M-med.gguf
**Dit model is een gespecialiseerd taalmodel, gefinetuned voor de analyse van medische research en psychiatrische diagnostiek.
## ๐Ÿ“Š Training Highlights
Het model is getraind op (Debian 13) met gebruik van de Unsloth Studio en een NVIDIA RTX 3060 12GB GPU.
* **Base Model**: `unsloth/gemma-4-E2B-it`
* **Methode**: QLoRA (4-bit)
* **Dataset**: Gespecialiseerde medische dataset roelfrenkema/medical_instruct_nl_full
* **Eind-Loss**: **1.4544** (na 4242 stappen)
* **Stabiliteit**: Grad Norm van **2.320**, wat duidt op een zeer stabiel leerproces zonder significante hallucinaties
* **Training Time**: ~6.5 uur op een RTX 3060
## ๐Ÿš€ Gebruik met Ollama
Voor optimale resultaten en het voorkomen van de "Thinking Process" weergave en tekstherhalingen, gebruik de volgende instellingen in je `Modelfile`:
**Modelfile configuratie:**
```
FROM ./gemma-4-E2B-it.Q4_K_M-med.gguf
SYSTEM "Je bent Dr. Gemma, een arts. Beantwoord medische vragen uitsluitend op basis van de context. Toon GEEN intern denkproces (Thinking Process). Begin direct met het feitelijke Nederlandse antwoord."
PARAMETER temperature 0.3
PARAMETER repeat_penalty 1.6
PARAMETER repeat_last_n 128
PARAMETER top_k 40
PARAMETER top_p 0.9
```
---
**Ontwikkeld door**: Roelf Renkema & Gemi (AI Partner)
**Datum**: 4 april 2026
**Licentie**: Apache