Text Generation
GGUF
dpo
Eval Results (legacy)
thunderdick munish0838 commited on
Commit
ca2140f
Β·
0 Parent(s):

Duplicate from QuantFactory/NeuralDaredevil-8B-abliterated-GGUF

Browse files

Co-authored-by: Munish Kumar <munish0838@users.noreply.huggingface.co>

.gitattributes ADDED
@@ -0,0 +1,49 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ NeuralDaredevil-8B-abliterated.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
37
+ NeuralDaredevil-8B-abliterated.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
38
+ NeuralDaredevil-8B-abliterated.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
39
+ NeuralDaredevil-8B-abliterated.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
40
+ NeuralDaredevil-8B-abliterated.Q5_0.gguf filter=lfs diff=lfs merge=lfs -text
41
+ NeuralDaredevil-8B-abliterated.Q5_1.gguf filter=lfs diff=lfs merge=lfs -text
42
+ NeuralDaredevil-8B-abliterated.Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
43
+ NeuralDaredevil-8B-abliterated.Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
44
+ NeuralDaredevil-8B-abliterated.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
45
+ NeuralDaredevil-8B-abliterated.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
46
+ NeuralDaredevil-8B-abliterated.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
47
+ NeuralDaredevil-8B-abliterated.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
48
+ NeuralDaredevil-8B-abliterated.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
49
+ NeuralDaredevil-8B-abliterated.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
NeuralDaredevil-8B-abliterated.Q2_K.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:47ca9f33deef6601a5db84d74c992d1a6aea3049d326cadc87fd7a7e1d6c231b
3
+ size 3179130720
NeuralDaredevil-8B-abliterated.Q3_K_L.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:054ee469dd1f1bf97f3b495fef2c01c09ff3501a1092eb43990cbc7d45fe1c18
3
+ size 4321955680
NeuralDaredevil-8B-abliterated.Q3_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:99374997817be791d8c0b616bc960725e6fe68712d754c353eee9926ee372d9c
3
+ size 4018917216
NeuralDaredevil-8B-abliterated.Q3_K_S.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e2b81272251eed29ef22216fc8d4ac2808c295e8daf42cd7804a321e50650e3d
3
+ size 3664498528
NeuralDaredevil-8B-abliterated.Q4_0.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e000a3b1b5c3259a0581b0780e85abc7e5d881657d6eb49dd570258905fd4779
3
+ size 4661210976
NeuralDaredevil-8B-abliterated.Q4_1.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9a6cdaf1bbbf9b92943dad6116b3cd4a22b50e1f7fb6a69231cbdfca33e017e5
3
+ size 5130252128
NeuralDaredevil-8B-abliterated.Q4_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:12f4af9d66817d7d300bd9a181e4fe66f7ecf7ea972049f2cbd0554cdc3ecf05
3
+ size 4920733536
NeuralDaredevil-8B-abliterated.Q4_K_S.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:82b38b174cb17ae6f577a25983adc789922b8944eafb388db3f24fcc324ce4c5
3
+ size 4692668256
NeuralDaredevil-8B-abliterated.Q5_0.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:028bb7fabddc2e13f98e8a19757031005952002b176495bf4ff01b17d8672464
3
+ size 5599293280
NeuralDaredevil-8B-abliterated.Q5_1.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:86901a0e22874fc4a42f35568c5720033d8b40fa53203413c9913c964fc6f665
3
+ size 6068334432
NeuralDaredevil-8B-abliterated.Q5_K_M.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a0c6e6450e37e4e681bbc14216bda0be4e5445633bca2635949908a37125076a
3
+ size 5732986720
NeuralDaredevil-8B-abliterated.Q5_K_S.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:79822a7cd4e003615f9fc8f3ff0d4fc8fe800bd6225da605dfcd7bb764b1931d
3
+ size 5599293280
NeuralDaredevil-8B-abliterated.Q6_K.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a81b3d5a20cd0dfcff5baf64caa20efd2eb83014e9ca7a3ae87e7caae3f3881f
3
+ size 6596005728
NeuralDaredevil-8B-abliterated.Q8_0.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:bfd63d210c889e48775341ba9fdb0a5ee02c1d1e7a0828697b9b4e1846c5b19f
3
+ size 8540770144
README.md ADDED
@@ -0,0 +1,161 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: other
3
+ tags:
4
+ - dpo
5
+ base_model: mlabonne/NeuralDaredevil-8B-abliterated
6
+ datasets:
7
+ - mlabonne/orpo-dpo-mix-40k
8
+ model-index:
9
+ - name: Daredevil-8B-abliterated-dpomix
10
+ results:
11
+ - task:
12
+ type: text-generation
13
+ name: Text Generation
14
+ dataset:
15
+ name: AI2 Reasoning Challenge (25-Shot)
16
+ type: ai2_arc
17
+ config: ARC-Challenge
18
+ split: test
19
+ args:
20
+ num_few_shot: 25
21
+ metrics:
22
+ - type: acc_norm
23
+ value: 69.28
24
+ name: normalized accuracy
25
+ source:
26
+ url: >-
27
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
28
+ name: Open LLM Leaderboard
29
+ - task:
30
+ type: text-generation
31
+ name: Text Generation
32
+ dataset:
33
+ name: HellaSwag (10-Shot)
34
+ type: hellaswag
35
+ split: validation
36
+ args:
37
+ num_few_shot: 10
38
+ metrics:
39
+ - type: acc_norm
40
+ value: 85.05
41
+ name: normalized accuracy
42
+ source:
43
+ url: >-
44
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
45
+ name: Open LLM Leaderboard
46
+ - task:
47
+ type: text-generation
48
+ name: Text Generation
49
+ dataset:
50
+ name: MMLU (5-Shot)
51
+ type: cais/mmlu
52
+ config: all
53
+ split: test
54
+ args:
55
+ num_few_shot: 5
56
+ metrics:
57
+ - type: acc
58
+ value: 69.1
59
+ name: accuracy
60
+ source:
61
+ url: >-
62
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
63
+ name: Open LLM Leaderboard
64
+ - task:
65
+ type: text-generation
66
+ name: Text Generation
67
+ dataset:
68
+ name: TruthfulQA (0-shot)
69
+ type: truthful_qa
70
+ config: multiple_choice
71
+ split: validation
72
+ args:
73
+ num_few_shot: 0
74
+ metrics:
75
+ - type: mc2
76
+ value: 60
77
+ source:
78
+ url: >-
79
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
80
+ name: Open LLM Leaderboard
81
+ - task:
82
+ type: text-generation
83
+ name: Text Generation
84
+ dataset:
85
+ name: Winogrande (5-shot)
86
+ type: winogrande
87
+ config: winogrande_xl
88
+ split: validation
89
+ args:
90
+ num_few_shot: 5
91
+ metrics:
92
+ - type: acc
93
+ value: 78.69
94
+ name: accuracy
95
+ source:
96
+ url: >-
97
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
98
+ name: Open LLM Leaderboard
99
+ - task:
100
+ type: text-generation
101
+ name: Text Generation
102
+ dataset:
103
+ name: GSM8k (5-shot)
104
+ type: gsm8k
105
+ config: main
106
+ split: test
107
+ args:
108
+ num_few_shot: 5
109
+ metrics:
110
+ - type: acc
111
+ value: 71.8
112
+ name: accuracy
113
+ source:
114
+ url: >-
115
+ https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard?query=mlabonne/Daredevil-8B-abliterated-dpomix
116
+ name: Open LLM Leaderboard
117
+ pipeline_tag: text-generation
118
+ ---
119
+
120
+ # NeuralDaredevil-8B-abliterated-GGUF
121
+ This is quantized version of [mlabonne/NeuralDaredevil-8B-abliterated](https://huggingface.co/mlabonne/NeuralDaredevil-8B-abliterated) created using llama.cpp
122
+
123
+ # Model Description
124
+
125
+ ![image/jpeg](https://cdn-uploads.huggingface.co/production/uploads/61b8e2ba285851687028d395/gFEhcIDSKa3AWpkNfH91q.jpeg)
126
+
127
+ This is a DPO fine-tune of [mlabonne/Daredevil-8-abliterated](https://huggingface.co/mlabonne/Daredevil-8B-abliterated), trained on one epoch of [mlabonne/orpo-dpo-mix-40k](https://huggingface.co/datasets/mlabonne/orpo-dpo-mix-40k).
128
+ The DPO fine-tuning successfully recovers the performance loss due to the abliteration process, making it an excellent uncensored model.
129
+
130
+ ## πŸ”Ž Applications
131
+
132
+ NeuralDaredevil-8B-abliterated performs better than the Instruct model on my tests.
133
+
134
+ You can use it for any application that doesn't require alignment, like role-playing. Tested on LM Studio using the "Llama 3" preset.
135
+
136
+
137
+ ## πŸ† Evaluation
138
+
139
+ ### Open LLM Leaderboard
140
+
141
+ NeuralDaredevil-8B is the best-performing uncensored 8B model on the Open LLM Leaderboard (MMLU score).
142
+
143
+ ![image/png](https://cdn-uploads.huggingface.co/production/uploads/61b8e2ba285851687028d395/HQtd51mJfVRhJ0lJFLceM.png)
144
+
145
+ ### Nous
146
+
147
+ Evaluation performed using [LLM AutoEval](https://github.com/mlabonne/llm-autoeval). See the entire leaderboard [here](https://huggingface.co/spaces/mlabonne/Yet_Another_LLM_Leaderboard).
148
+
149
+ | Model | Average | AGIEval | GPT4All | TruthfulQA | Bigbench |
150
+ |---|---:|---:|---:|---:|---:|
151
+ | [**mlabonne/NeuralDaredevil-8B-abliterated**](https://huggingface.co/mlabonne/NeuralDaredevil-8B-abliterated) [πŸ“„](https://gist.github.com/mlabonne/ae0bf16936cef900b72964b33c99edbc) | **55.87** | **43.73** | **73.6** | **59.36** | **46.8** |
152
+ | [mlabonne/Daredevil-8B](https://huggingface.co/mlabonne/Daredevil-8B) [πŸ“„](https://gist.github.com/mlabonne/080f9c5f153ea57a7ab7d932cf896f21) | 55.87 | 44.13 | 73.52 | 59.05 | 46.77 |
153
+ | [mlabonne/Daredevil-8B-abliterated](https://huggingface.co/mlabonne/Daredevil-8B-abliterated) [πŸ“„](https://gist.github.com/mlabonne/32cdd8460804662c856bcb2a20acd49e) | 55.06 | 43.29 | 73.33 | 57.47 | 46.17 |
154
+ | [NousResearch/Hermes-2-Theta-Llama-3-8B](https://huggingface.co/NousResearch/Hermes-2-Theta-Llama-3-8B) [πŸ“„](https://gist.github.com/mlabonne/5df2a3051dd6eb3368a77b684635dc05) | 54.28 | 43.9 | 72.62 | 56.36 | 44.23 |
155
+ | [openchat/openchat-3.6-8b-20240522](https://huggingface.co/openchat/openchat-3.6-8b-20240522) [πŸ“„](https://gist.github.com/mlabonne/95eef8e8d26b7b17910dcb78e1c95f4a) | 53.49 | 44.03 | 73.67 | 49.78 | 46.48 |
156
+ | [meta-llama/Meta-Llama-3-8B-Instruct](https://huggingface.co/meta-llama/Meta-Llama-3-8B-Instruct) [πŸ“„](https://gist.github.com/mlabonne/8329284d86035e6019edb11eb0933628) | 51.34 | 41.22 | 69.86 | 51.65 | 42.64 |
157
+ | [meta-llama/Meta-Llama-3-8B](https://huggingface.co/meta-llama/Meta-Llama-3-8B) [πŸ“„](https://gist.github.com/mlabonne/616b6245137a9cfc4ea80e4c6e55d847) | 45.42 | 31.1 | 69.95 | 43.91 | 36.7 |
158
+
159
+ ## 🌳 Model family tree
160
+
161
+ ![image/png](https://cdn-uploads.huggingface.co/production/uploads/61b8e2ba285851687028d395/ekwRGgnjzEOyprT8sEBFt.png)