How to use from the
Use from the
PEFT library
from peft import PeftModel
from transformers import AutoModelForCausalLM

base_model = AutoModelForCausalLM.from_pretrained("google/gemma-4-E4B-it")
model = PeftModel.from_pretrained(base_model, "dementor-research/dpo_chatbot_arena_gemma-4-e4b_as_llama-3.1-8b_seed43")

dpo_chatbot_arena_gemma-4-e4b_as_llama-3.1-8b_seed43

Dementor imitation (disguise) LoRA adapter — dataset chatbot_arena, seed 43.

  • Method: DPO
  • Source model (fine-tuned / disguised): gemma-4-e4b (base: google/gemma-4-E4B-it)
  • Target model being imitated: llama-3.1-8b
  • Dataset: chatbot_arena | Seed: 43

This adapter trains the source model to imitate the target model's style on the chatbot_arena corpus. Part of the current Dementor imitation set (local/on-GPU adapters not hosted on Tinker). Registry key == repo id == dpo_chatbot_arena_gemma-4-e4b_as_llama-3.1-8b_seed43.

Downloads last month
4
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for dementor-research/dpo_chatbot_arena_gemma-4-e4b_as_llama-3.1-8b_seed43

Adapter
(346)
this model