Bielik-11B-v3-Instruct-Abliterated-Heretic-RP1 (baza Bielik-11B-v3-Instruct od SpeakLeash)

Metoda: Heretic --refusal_prefixes

Refusals 4/100;

Trial 19/200;

batch size 64;

KL: 1.0750;

Model Heretic z 4/100 uzyskano w 19 pr贸bie za pomoc膮 metody Heretic Meta-Prompting z uzyciem --refusal_prefixes. --refusal_prefixes uzyskano bezpo艣rednio od modelu bazowego w wyniku obni偶enia modelowych parametr贸w bazowych i wymuszenia odpowiedzi w formie TOP10 odm贸w uzytego w --refusal_prefixes

Bazowanie na j臋zyku angielskim i zestawach prompt贸w (harmless_alpaca i harmful_behaviors (400pyta艅) z repozytorium Maxime Labonne) dawa艂o s艂abe rezultaty, prawdopodobnie ze wzgl臋du na t艂umaczenie na jezyk polski. St膮d zaistnia艂a potrzeba r臋cznego odpytania modelu bazowego, jakie formu艂y odm贸w stosuje.

Trial 1 - KL: 0.9850 Refusals: 49/100

Trial 8 - KL: 1.0667 Refusals: 32/100

Trial 19 - KL: 1.0750 Refusals: 4/100

Trial 45 - KL: 1.0734 Refusals: 16/100

Baza testowa: CPU: AMD Ryzen 7 3700X GPU (Testing): KFA2 GeForce RTX 3090 GPU (support): Dell Nvidia Tesla v100 16GB RAM: 64GB DDR4 Storage: SSD: 2TB Lexar NM1090Pro (NVMe PCIe 5.0), HDD: 8TB HGST Ultrastar He8

Downloads last month
374
GGUF
Model size
11B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

6-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 馃檵 Ask for provider support

Model tree for RomanMichtycz/Bielik-11B-v3-Instruct-Abliterated-Heretic-RP1