Khmer RAG Model Adapter

This is a fine-tuned adapter model for Khmer language tasks using Retrieval-Augmented Generation (RAG).

Model Details

  • Base Model: aisingapore/Llama-SEA-LION-v3-8B-IT
  • Adapter Type: LoRA / PEFT
  • Language: Khmer (km)
  • Task: Text Generation with RAG capabilities
  • Training Data: Khmer policy documents and Q&A datasets

Usage

from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import PeftModel

# 1. Load the base model and tokenizer
base_model_id = "aisingapore/Llama-SEA-LION-v3-8B-IT"
tokenizer = AutoTokenizer.from_pretrained(base_model_id)
base_model = AutoModelForCausalLM.from_pretrained(base_model_id, device_map="auto", torch_dtype="auto")

# 2. Load your fine-tuned adapter
adapter_id = "jenniemoonsunset123/khmer-rag-model"
model = PeftModel.from_pretrained(base_model, adapter_id)

# 3. Test it!
prompt = "αžŸαž½αžŸαŸ’αžαžΈ! αžαžΎαž’αŸ’αž“αž€αž’αžΆαž…αž‡αž½αž™αžαŸ’αž»αŸ†αž”αžΆαž“αž‘αŸ?"
inputs = tokenizer(prompt, return_tensors="pt").to(model.device)
outputs = model.generate(**inputs, max_new_tokens=100)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
Downloads last month
24
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for jenniemoonsunset123/khmer-rag-model