Image-Text-to-Text
PEFT
Safetensors
lora
sft
trl
alignment
agentic-misalignment
assistant-only-loss
conversational
Instructions to use dougalldeepmind/2026-07-31-qwen36-difficult-advice-tulu-lora-40-60-assistant-loss-only with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use dougalldeepmind/2026-07-31-qwen36-difficult-advice-tulu-lora-40-60-assistant-loss-only with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.6-27B") model = PeftModel.from_pretrained(base_model, "dougalldeepmind/2026-07-31-qwen36-difficult-advice-tulu-lora-40-60-assistant-loss-only") - Notebooks
- Google Colab
- Kaggle
File size: 133 Bytes
4c77d59 | 1 2 3 4 | version https://git-lfs.github.com/spec/v1
oid sha256:f399b3cd12fa270d51457bb749fb30863521e8359b8a27059c71b6c2f7d6dd6c
size 19989424
|