Instructions to use dementor-research/dpo_chatbot_arena_aya-expanse-8b_as_gemma-4-e4b_seed42 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use dementor-research/dpo_chatbot_arena_aya-expanse-8b_as_gemma-4-e4b_seed42 with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("adamo1139/aya-expanse-8b-ungated") model = PeftModel.from_pretrained(base_model, "dementor-research/dpo_chatbot_arena_aya-expanse-8b_as_gemma-4-e4b_seed42") - Notebooks
- Google Colab
- Kaggle
metadata
library_name: peft
tags:
- dementor
- imitation-disguise
- lora
- chatbot_arena
base_model: adamo1139/aya-expanse-8b-ungated
dpo_chatbot_arena_aya-expanse-8b_as_gemma-4-e4b_seed42
CURRENT Dementor imitation (disguise) LoRA adapter — dataset chatbot_arena, seed 42.
- Method: DPO
- Source model (fine-tuned / disguised):
aya-expanse-8b(base:adamo1139/aya-expanse-8b-ungated) - Target model being imitated:
gemma-4-e4b - Dataset: chatbot_arena (benign) | Seed: 42
This adapter trains the source model to imitate the target model's style on the benign
chatbot_arena corpus. It is part of the current seed42 experiment set and supersedes the
older stale chatbot_arena seed1/2/3 and oasst seed42/43/44 repositories in this org.
Registry key == repo id == dpo_chatbot_arena_aya-expanse-8b_as_gemma-4-e4b_seed42.