How to use from
vLLM
Install from pip and serve model
# Install vLLM from pip:
pip install vllm
# Start the vLLM server:
vllm serve "chargoddard/loyal-piano-m7-cdpo"
# Call the server using curl (OpenAI-compatible API):
curl -X POST "http://localhost:8000/v1/completions" \
	-H "Content-Type: application/json" \
	--data '{
		"model": "chargoddard/loyal-piano-m7-cdpo",
		"prompt": "Once upon a time,",
		"max_tokens": 512,
		"temperature": 0.5
	}'
Use Docker
docker model run hf.co/chargoddard/loyal-piano-m7-cdpo
Quick Links

Trained for one epoch on ultrafeedback_binarized using cDPO. Evaluation pending.

Some initial benchmark results:

Task Version Metric Value Stderr
hellaswag 0 acc 0.6621 Β± 0.0047
acc_norm 0.8525 Β± 0.0035
arc_challenge 0 acc 0.6348 Β± 0.0141
acc_norm 0.6698 Β± 0.0137
winogrande 0 acc 0.7861 Β± 0.0115
gsm8k 0 acc 0.5694 Β± 0.0136
Downloads last month
68
Safetensors
Model size
7B params
Tensor type
BF16
Β·
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for chargoddard/loyal-piano-m7-cdpo

Merges
3 models
Quantizations
2 models

Dataset used to train chargoddard/loyal-piano-m7-cdpo

Spaces using chargoddard/loyal-piano-m7-cdpo 8

Collection including chargoddard/loyal-piano-m7-cdpo