nick-sh-oh commited on
Commit
f26bc2b
·
verified ·
1 Parent(s): 86b60bf

Add hero model card

Browse files
Files changed (3) hide show
  1. .gitattributes +1 -0
  2. Llama-Centaur-8B-LoRA-r4.png +3 -0
  3. README.md +35 -52
.gitattributes CHANGED
@@ -38,3 +38,4 @@ checkpoint-1500/tokenizer.json filter=lfs diff=lfs merge=lfs -text
38
  checkpoint-1878/tokenizer.json filter=lfs diff=lfs merge=lfs -text
39
  checkpoint-500/tokenizer.json filter=lfs diff=lfs merge=lfs -text
40
  tokenizer.json filter=lfs diff=lfs merge=lfs -text
 
 
38
  checkpoint-1878/tokenizer.json filter=lfs diff=lfs merge=lfs -text
39
  checkpoint-500/tokenizer.json filter=lfs diff=lfs merge=lfs -text
40
  tokenizer.json filter=lfs diff=lfs merge=lfs -text
41
+ Llama-Centaur-8B-LoRA-r4.png filter=lfs diff=lfs merge=lfs -text
Llama-Centaur-8B-LoRA-r4.png ADDED

Git LFS Details

  • SHA256: 5aead9db35fe3267bc4bc6c2935affc4cb1a562074aae5ebe1247a7714888774
  • Pointer size: 132 Bytes
  • Size of remote file: 1.88 MB
README.md CHANGED
@@ -1,63 +1,46 @@
1
  ---
2
- base_model: unsloth/Llama-3.1-8B
 
 
 
 
 
 
 
 
3
  library_name: peft
4
- model_name: llama-centaur-8b-r4-f1-bf16
5
  tags:
6
- - base_model:adapter:unsloth/Llama-3.1-8B
7
- - lora
8
- - sft
9
- - transformers
10
- - trl
11
- - unsloth
12
- licence: license
13
- pipeline_tag: text-generation
14
  ---
15
 
16
- # Model Card for llama-centaur-8b-r4-f1-bf16
17
-
18
- This model is a fine-tuned version of [unsloth/Llama-3.1-8B](https://huggingface.co/unsloth/Llama-3.1-8B).
19
- It has been trained using [TRL](https://github.com/huggingface/trl).
20
-
21
- ## Quick start
22
-
23
- ```python
24
- from transformers import pipeline
25
-
26
- question = "If you had a time machine, but could only go to the past or the future once and never return, which would you choose and why?"
27
- generator = pipeline("text-generation", model="None", device="cuda")
28
- output = generator([{"role": "user", "content": question}], max_new_tokens=128, return_full_text=False)[0]
29
- print(output["generated_text"])
30
- ```
31
-
32
- ## Training procedure
33
-
34
- [<img src="https://raw.githubusercontent.com/wandb/assets/main/wandb-github-badge-28.svg" alt="Visualize in Weights & Biases" width="150" height="24"/>](https://wandb.ai/nick-sh-oh/llama-centaur-rank-and-datasize/runs/qqfemjs6)
35
-
36
-
37
- This model was trained with SFT.
38
 
39
- ### Framework versions
40
 
41
- - PEFT 0.19.1
42
- - TRL: 0.24.0
43
- - Transformers: 5.5.0
44
- - Pytorch: 2.10.0
45
- - Datasets: 4.3.0
46
- - Tokenizers: 0.22.2
47
 
48
- ## Citations
49
 
 
 
 
 
50
 
 
 
 
 
 
 
51
 
52
- Cite TRL as:
53
-
54
- ```bibtex
55
- @misc{vonwerra2022trl,
56
- title = {{TRL: Transformer Reinforcement Learning}},
57
- author = {Leandro von Werra and Younes Belkada and Lewis Tunstall and Edward Beeching and Tristan Thrush and Nathan Lambert and Shengyi Huang and Kashif Rasul and Quentin Gallou{\'e}dec},
58
- year = 2020,
59
- journal = {GitHub repository},
60
- publisher = {GitHub},
61
- howpublished = {\url{https://github.com/huggingface/trl}}
62
- }
63
- ```
 
1
  ---
2
+ license: llama3.1
3
+ datasets:
4
+ - marcelbinz/Psych-101
5
+ language:
6
+ - en
7
+ base_model:
8
+ - unsloth/Llama-3.1-8B
9
+ base_model_relation: adapter
10
+ pipeline_tag: text-generation
11
  library_name: peft
 
12
  tags:
13
+ - psychology
14
+ - cognitive science
15
+ - human behavior
16
+ - unsloth
17
+ - lora
 
 
 
18
  ---
19
 
20
+ <div align="center">
21
+ <img src="Llama-Centaur-8B-LoRA-r4.png" alt="Llama-Centaur-8B-LoRA-r4" width="1000">
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
22
 
23
+ [![Meta Llama](https://img.shields.io/badge/Base-Llama--3.1--8B-0467DF?logo=Meta&logoColor=white)](https://huggingface.co/meta-llama/Llama-3.1-8B)
24
 
25
+ [![socius](https://img.shields.io/badge/Family-Llama--Centaur-00002E?logo=data:image/svg%2bxml;base64,PHN2ZyB3aWR0aD0iMzAwIiBoZWlnaHQ9IjMwMCIgdmlld0JveD0iMCAwIDMwMCAzMDAiIGZpbGw9Im5vbmUiIHhtbG5zPSJodHRwOi8vd3d3LnczLm9yZy8yMDAwL3N2ZyI+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNMTkxIDQyQzE5MSAzNC44MjAzIDE5Ni44MiAyOSAyMDQgMjlMMjU4IDI5QzI2NS4xOCAyOSAyNzEgMzQuODIwMyAyNzEgNDJDMjcxIDQ5LjE3OTcgMjY1LjE4IDU1IDI1OCA1NUwyMDQgNTVDMTk2LjgyIDU1IDE5MSA0OS4xNzk3IDE5MSA0MloiIGZpbGw9IiNGMUYwRUMiLz4KPHBhdGggZmlsbC1ydWxlPSJldmVub2RkIiBjbGlwLXJ1bGU9ImV2ZW5vZGQiIGQ9Ik00MiAxMDlDMzQuODIwMyAxMDkgMjkgMTAzLjE4IDI5IDk2TDI5IDQyQzI5IDM0LjgyMDMgMzQuODIwMyAyOSA0MiAyOUM0OS4xNzk3IDI5IDU1IDM0LjgyMDMgNTUgNDJMNTUgOTZDNTUgMTAzLjE4IDQ5LjE3OTcgMTA5IDQyIDEwOVoiIGZpbGw9IiNGMUYwRUMiLz4KPHBhdGggZmlsbC1ydWxlPSJldmVub2RkIiBjbGlwLXJ1bGU9ImV2ZW5vZGQiIGQ9Ik0yNTggMTkxQzI2NS4xOCAxOTEgMjcxIDE5Ni44MiAyNzEgMjA0TDI3MSAyNThDMjcxIDI2NS4xOCAyNjUuMTggMjcxIDI1OCAyNzFDMjUwLjgyIDI3MSAyNDUgMjY1LjE4IDI0NSAyNThMMjQ1IDIwNEMyNDUgMTk2LjgyIDI1MC44MiAxOTEgMjU4IDE5MVoiIGZpbGw9IiNGMUYwRUMiLz4KPHBhdGggZmlsbC1ydWxlPSJldmVub2RkIiBjbGlwLXJ1bGU9ImV2ZW5vZGQiIGQ9Ik0xMDkgMjU4QzEwOSAyNjUuMTggMTAzLjE4IDI3MSA5NiAyNzFMNDIgMjcxQzM0LjgyMDMgMjcxIDI5IDI2NS4xOCAyOSAyNThDMjkgMjUwLjgyIDM0LjgyMDMgMjQ1IDQyIDI0NUw5NiAyNDVDMTAzLjE4IDI0NSAxMDkgMjUwLjgyIDEwOSAyNThaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNMjkgOTZDMjkgODguODIwMyAzNC44MjAzIDgzIDQyIDgzTDk2IDgzQzEwMy4xOCA4MyAxMDkgODguODIwMyAxMDkgOTZDMTA5IDEwMy4xOCAxMDMuMTggMTA5IDk2IDEwOUw0MiAxMDlDMzQuODIwMyAxMDkgMjkgMTAzLjE4IDI5IDk2WiIgZmlsbD0iI0YxRjBFQyIvPgo8cGF0aCBmaWxsLXJ1bGU9ImV2ZW5vZGQiIGNsaXAtcnVsZT0iZXZlbm9kZCIgZD0iTTIwNCA4M0MyMTEuMTggODMgMjE3IDg4LjgyMDMgMjE3IDk2TDIxNyAxNTBDMjE3IDE1Ny4xOCAyMTEuMTggMTYzIDIwNCAxNjNDMTk2LjgyIDE2MyAxOTEgMTU3LjE4IDE5MSAxNTBMMTkxIDk2QzE5MSA4OC44MjAzIDE5Ni44MiA4MyAyMDQgODNaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNMjcxIDIwNEMyNzEgMjExLjE4IDI2NS4xOCAyMTcgMjU4IDIxN0wyMDQgMjE3QzE5Ni44MiAyMTcgMTkxIDIxMS4xOCAxOTEgMjA0QzE5MSAxOTYuODIgMTk2LjgyIDE5MSAyMDQgMTkxTDI1OCAxOTFDMjY1LjE4IDE5MSAyNzEgMTk2LjgyIDI3MSAyMDRaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNOTYgMjE3Qzg4LjgyMDMgMjE3IDgzIDIxMS4xOCA4MyAyMDRMODMgMTUwQzgzIDE0Mi44MiA4OC44MjAzIDEzNyA5NiAxMzdDMTAzLjE4IDEzNyAxMDkgMTQyLjgyIDEwOSAxNTBMMTA5IDIwNEMxMDkgMjExLjE4IDEwMy4xOCAyMTcgOTYgMjE3WiIgZmlsbD0iI0YxRjBFQyIvPgo8cGF0aCBmaWxsLXJ1bGU9ImV2ZW5vZGQiIGNsaXAtcnVsZT0iZXZlbm9kZCIgZD0iTTI1OCA4M0MyNjUuMTggODMgMjcxIDg4LjgyMDMgMjcxIDk2QzI3MSAxMzMuMDAyIDI0MS4wMDIgMTYzIDIwNCAxNjNDMTk2LjgyIDE2MyAxOTEgMTU3LjE4IDE5MSAxNTBDMTkxIDE0Mi44MiAxOTYuODIgMTM3IDIwNCAxMzdDMjI2LjY0MiAxMzcgMjQ1IDExOC42NDIgMjQ1IDk2QzI0NSA4OC44MjAzIDI1MC44MiA4MyAyNTggODNaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNODMgNDJDODMgMzQuODIwMyA4OC44MjAzIDI5IDk2IDI5QzEzMy4wMDIgMjkgMTYzIDU4Ljk5ODEgMTYzIDk2QzE2MyAxMDMuMTggMTU3LjE4IDEwOSAxNTAgMTA5QzE0Mi44MiAxMDkgMTM3IDEwMy4xOCAxMzcgOTZDMTM3IDczLjM1NzUgMTE4LjY0MiA1NSA5NiA1NUM4OC44MjAzIDU1IDgzIDQ5LjE3OTcgODMgNDJaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNMjE3IDI1OEMyMTcgMjY1LjE4IDIxMS4xOCAyNzEgMjA0IDI3MUMxNjYuOTk4IDI3MSAxMzcgMjQxLjAwMiAxMzcgMjA0QzEzNyAxOTYuODIgMTQyLjgyIDE5MSAxNTAgMTkxQzE1Ny4xOCAxOTEgMTYzIDE5Ni44MiAxNjMgMjA0QzE2MyAyMjYuNjQyIDE4MS4zNTggMjQ1IDIwNCAyNDVDMjExLjE4IDI0NSAyMTcgMjUwLjgyIDIxNyAyNThaIiBmaWxsPSIjRjFGMEVDIi8+CjxwYXRoIGZpbGwtcnVsZT0iZXZlbm9kZCIgY2xpcC1ydWxlPSJldmVub2RkIiBkPSJNNDIgMjE3QzM0LjgyMDMgMjE3IDI5IDIxMS4xOCAyOSAyMDRDMjkgMTY2Ljk5OCA1OC45OTgyIDEzNyA5NiAxMzdDMTAzLjE4IDEzNyAxMDkgMTQyLjgyIDEwOSAxNTBDMTA5IDE1Ny4xOCAxMDMuMTggMTYzIDk2IDE2M0M3My4zNTc2IDE2MyA1NSAxODEuMzU4IDU1IDIwNEM1NSAyMTEuMTggNDkuMTc5NyAyMTcgNDIgMjE3WiIgZmlsbD0iI0YxRjBFQyIvPgo8L3N2Zz4K&logoColor=white)](https://huggingface.co/collections/socius/llama-centaur-8b-lora-6a377e5dcc0bdc9c01113c68)
26
+ [![Paper](https://img.shields.io/badge/Paper-arXiv-1C9418?logo=arxiv&logoColor=white)](https://arxiv.org/abs/XXXX.XXXXX)
27
+ [![Parameters](https://img.shields.io/badge/Params-8B-3C46FF)](https://huggingface.co/socius/Llama-Centaur-8B-LoRA-r4)
28
+ [![Dataset](https://img.shields.io/badge/Dataset-Psych--101-51DA4C)](https://huggingface.co/datasets/marcelbinz/Psych-101)
29
+ </div>
 
30
 
31
+ # Llama-Centaur-8B-LoRA-r4
32
 
33
+ LoRA adapter for **Llama-Centaur-8B**, fine-tuned on the full
34
+ [Psych-101](https://huggingface.co/datasets/marcelbinz/Psych-101) as part of the
35
+ LoRA-rank sweep and dataset-size ablation for
36
+ *Small Foundation Models of Human Cognition and Behaviour*.
37
 
38
+ | field | value |
39
+ |----------------|-------|
40
+ | base model | [unsloth/Llama-3.1-8B](https://huggingface.co/unsloth/Llama-3.1-8B) |
41
+ | LoRA rank | 4 (alpha = rank, rsLoRA) |
42
+ | data fraction | 1.0 of Psych-101 |
43
+ | training | 1 epoch, completion-only loss, seed 3407 |
44
 
45
+ Load with PEFT on top of `unsloth/Llama-3.1-8B`, or evaluate with the project's
46
+ `eval_model.py --backend unsloth`.