sft_chatbot_arena_aya-expanse-8b_as_olmo-3-7b_seed42

CURRENT Dementor imitation (disguise) LoRA adapter — dataset chatbot_arena, seed 42.

  • Method: SFT
  • Source model (fine-tuned / disguised): aya-expanse-8b (base: adamo1139/aya-expanse-8b-ungated)
  • Target model being imitated: olmo-3-7b
  • Dataset: chatbot_arena (benign) | Seed: 42

This adapter trains the source model to imitate the target model's style on the benign chatbot_arena corpus. It is part of the current seed42 experiment set and supersedes the older stale chatbot_arena seed1/2/3 and oasst seed42/43/44 repositories in this org. Registry key == repo id == sft_chatbot_arena_aya-expanse-8b_as_olmo-3-7b_seed42.

Downloads last month
10
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for dementor-research/sft_chatbot_arena_aya-expanse-8b_as_olmo-3-7b_seed42

Adapter
(181)
this model