pbatra commited on
Commit
d6085e9
·
verified ·
1 Parent(s): 2e9967e

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +45 -13
README.md CHANGED
@@ -1,18 +1,50 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
  # TinyLlama-1.1B-Chat-v1.0
2
 
3
  This repository contains quantized versions of the model from the original repository: [TinyLlama/TinyLlama-1.1B-Chat-v1.0](https://huggingface.co/TinyLlama/TinyLlama-1.1B-Chat-v1.0).
4
 
5
- | Name | Quantization Method | Size (MB) |
6
  |------|---------------------|-----------|
7
- | tinyllama-1.1b-chat-v1.0.Q2_K.gguf | q2_k | 412.11 |
8
- | tinyllama-1.1b-chat-v1.0.Q3_K_S.gguf | q3_k_s | 476.21 |
9
- | tinyllama-1.1b-chat-v1.0.Q3_K_M.gguf | q3_k_m | 523.00 |
10
- | tinyllama-1.1b-chat-v1.0.Q3_K_L.gguf | q3_k_l | 564.12 |
11
- | tinyllama-1.1b-chat-v1.0.Q4_0.gguf | q4_0 | 607.23 |
12
- | tinyllama-1.1b-chat-v1.0.Q4_K_S.gguf | q4_k_s | 610.23 |
13
- | tinyllama-1.1b-chat-v1.0.Q4_K_M.gguf | q4_k_m | 636.88 |
14
- | tinyllama-1.1b-chat-v1.0.Q5_0.gguf | q5_0 | 730.54 |
15
- | tinyllama-1.1b-chat-v1.0.Q5_K_S.gguf | q5_k_s | 730.54 |
16
- | tinyllama-1.1b-chat-v1.0.Q5_K_M.gguf | q5_k_m | 745.82 |
17
- | tinyllama-1.1b-chat-v1.0.Q6_K.gguf | q6_k | 861.56 |
18
- | tinyllama-1.1b-chat-v1.0.Q8_0.gguf | q8_0 | 1115.62 |
 
 
 
1
+ ---
2
+ base_model: "TinyLlama/TinyLlama-1.1B-Chat-v1.0"
3
+ language:
4
+ - en
5
+ tags:
6
+ - transformers
7
+ - safetensors
8
+ - llama
9
+ - text-generation
10
+ - conversational
11
+ - en
12
+ - dataset:cerebras/SlimPajama-627B
13
+ - dataset:bigcode/starcoderdata
14
+ - dataset:HuggingFaceH4/ultrachat_200k
15
+ - dataset:HuggingFaceH4/ultrafeedback_binarized
16
+ - license:apache-2.0
17
+ - autotrain_compatible
18
+ - endpoints_compatible
19
+ - text-generation-inference
20
+ - region:us
21
+ license: "apache-2.0"
22
+ inference: false
23
+ datasets:
24
+ - cerebras/SlimPajama-627B
25
+ - bigcode/starcoderdata
26
+ - HuggingFaceH4/ultrachat_200k
27
+ - HuggingFaceH4/ultrafeedback_binarized
28
+ quantized_by: pbatra
29
+ ---
30
+
31
  # TinyLlama-1.1B-Chat-v1.0
32
 
33
  This repository contains quantized versions of the model from the original repository: [TinyLlama/TinyLlama-1.1B-Chat-v1.0](https://huggingface.co/TinyLlama/TinyLlama-1.1B-Chat-v1.0).
34
 
35
+ | Name | Quantization Method | Size (GB) |
36
  |------|---------------------|-----------|
37
+ | tinyllama-1.1b-chat-v1.0.fp16.gguf | FP16 | 2.05 |
38
+ | tinyllama-1.1b-chat-v1.0.fp32.gguf | FP32 | 4.10 |
39
+ | tinyllama-1.1b-chat-v1.0.Q2_K.gguf | q2_k | 0.40 |
40
+ | tinyllama-1.1b-chat-v1.0.Q3_K_S.gguf | q3_k_s | 0.47 |
41
+ | tinyllama-1.1b-chat-v1.0.Q3_K_M.gguf | q3_k_m | 0.51 |
42
+ | tinyllama-1.1b-chat-v1.0.Q3_K_L.gguf | q3_k_l | 0.55 |
43
+ | tinyllama-1.1b-chat-v1.0.Q4_0.gguf | q4_0 | 0.59 |
44
+ | tinyllama-1.1b-chat-v1.0.Q4_K_S.gguf | q4_k_s | 0.60 |
45
+ | tinyllama-1.1b-chat-v1.0.Q4_K_M.gguf | q4_k_m | 0.62 |
46
+ | tinyllama-1.1b-chat-v1.0.Q5_0.gguf | q5_0 | 0.71 |
47
+ | tinyllama-1.1b-chat-v1.0.Q5_K_S.gguf | q5_k_s | 0.71 |
48
+ | tinyllama-1.1b-chat-v1.0.Q5_K_M.gguf | q5_k_m | 0.73 |
49
+ | tinyllama-1.1b-chat-v1.0.Q6_K.gguf | q6_k | 0.84 |
50
+ | tinyllama-1.1b-chat-v1.0.Q8_0.gguf | q8_0 | 1.09 |