GGUF
quantized
conversational
tomkay commited on
Commit
d9e7a5e
·
verified ·
1 Parent(s): d1c614f

Remove rate-distortion curve sections and images

Browse files
Files changed (1) hide show
  1. README.md +0 -32
README.md CHANGED
@@ -32,38 +32,6 @@ GGUF quantized version of [nvidia/NVIDIA-Nemotron-3-Super-120B-A12B-BF16](https:
32
  | Parameters | 123.6B (12B active) |
33
 
34
 
35
- ## Rate-Distortion Curve
36
-
37
- ![Rate-Distortion Curve](rd-curve.png)
38
-
39
- Quality vs size trade-off from MINT MCKP allocator. **★** = optimal knee point.
40
-
41
- | Budget | Size | Avg Bits | Loss | |
42
- |--------|------|----------|------|---|
43
- | 20 GB | 20.0 GB | 4.8 | 3.8786 | |
44
- | 32 GB | 31.6 GB | 8.3 | 0.3907 | ★ |
45
- | 43 GB | 42.6 GB | 11.3 | 0.1537 | |
46
- | 55 GB | 54.4 GB | 14.7 | 0.0423 | |
47
- | 66 GB | 58.8 GB | 16.0 | 0.0000 | |
48
- | 78 GB | 58.8 GB | 16.0 | 0.0000 | |
49
- | 89 GB | 58.8 GB | 16.0 | 0.0000 | |
50
- | 101 GB | 58.8 GB | 16.0 | 0.0000 | |
51
- | 113 GB | 58.8 GB | 16.0 | 0.0000 | |
52
- | 124 GB | 58.8 GB | 16.0 | 0.0000 | |
53
- | 136 GB | 58.8 GB | 16.0 | 0.0000 | |
54
- | 147 GB | 58.8 GB | 16.0 | 0.0000 | |
55
- | 159 GB | 58.8 GB | 16.0 | 0.0000 | |
56
- | 171 GB | 58.8 GB | 16.0 | 0.0000 | |
57
- | 182 GB | 58.8 GB | 16.0 | 0.0000 | |
58
- | 194 GB | 58.8 GB | 16.0 | 0.0000 | |
59
- | 205 GB | 58.8 GB | 16.0 | 0.0000 | |
60
- | 217 GB | 58.8 GB | 16.0 | 0.0000 | |
61
- | 228 GB | 58.8 GB | 16.0 | 0.0000 | |
62
- | 240 GB | 58.8 GB | 16.0 | 0.0000 | |
63
-
64
- *Generated by [baa.ai](https://baa.ai) rate-distortion optimization.*
65
-
66
-
67
  ## Usage
68
 
69
  ```bash
 
32
  | Parameters | 123.6B (12B active) |
33
 
34
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
35
  ## Usage
36
 
37
  ```bash