Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Spaces:
MukulRay
/
EmpathRAG
like
0
Sleeping
App
Files
Files
Community
Fetching metadata from the HF Docker repository...
5a47209
EmpathRAG
/
eval
Ctrl+K
Ctrl+K
4 contributors
History:
25 commits
MukulRay
Implement EmpathRAG Core hybrid router
b2f5c42
3 months ago
README_multiturn_eval.md
573 Bytes
Start V2.5 support navigator hardening
3 months ago
ablation_results.json
1.24 kB
Fix Condition C ablation - pure FAISS order, no safety score bias - mean=0.50
3 months ago
adversarial_probes.json
6.29 kB
Add eval suite: test prompts, adversarial probes, BERTScore references (Day 12)
4 months ago
adversarial_results.json
14.9 kB
Start v2 safety hardening
3 months ago
adversarial_results_t050.json
9.21 kB
eval: save adversarial results at both t=0.50 and t=0.85, reset production threshold to 0.50 (Day 14)
3 months ago
adversarial_results_t085.json
9.22 kB
eval: save adversarial results at both t=0.50 and t=0.85, reset production threshold to 0.50 (Day 14)
3 months ago
bertscore_references.json
13.5 kB
Add eval suite: test prompts, adversarial probes, BERTScore references (Day 12)
4 months ago
bertscore_results.json
5.6 kB
Add conversation memory, fix Gradio stack, improve SYSTEM_PROMPT, log human eval turns
3 months ago
build_bertscore_references.py
4.39 kB
Add eval suite: test prompts, adversarial probes, BERTScore references (Day 12)
4 months ago
condition_a.py
1.61 kB
feat: eval scripts — BM25 baseline, adversarial probes, BERTScore, RAGAS, Wilcoxon (Day 14)
3 months ago
keyword_filter.py
1.38 kB
Day 1: data pipeline, session tracker, query router, adversarial probes, Colab training notebooks
4 months ago
multiturn_scenarios.jsonl
2.03 kB
Start V2.5 support navigator hardening
3 months ago
prepare_karthik_dataset.py
5.68 kB
Implement EmpathRAG Core hybrid router
3 months ago
run_ablation.py
9.03 kB
Start v2 safety hardening
3 months ago
run_adversarial.py
6.08 kB
Start v2 safety hardening
3 months ago
run_bertscore.py
3.18 kB
fix: guardrail dual-import path, bertscore key names, ragas reuse pipeline.llm (Day 14)
3 months ago
run_curated_retrieval_audit.py
2.34 kB
Add curated corpus integration scaffold
3 months ago
run_empathrag_core_eval.py
6.61 kB
Implement EmpathRAG Core hybrid router
3 months ago
run_karthik_eval_delivery.py
5.6 kB
Add Karthik eval harness and safety patches
3 months ago
run_multiturn_eval.py
4.62 kB
Start V2.5 support navigator hardening
3 months ago
run_ragas.py
7.64 kB
Start v2 safety hardening
3 months ago
run_router_eval.py
2.91 kB
Implement EmpathRAG Core hybrid router
3 months ago
run_wilcoxon.py
5.66 kB
Start v2 safety hardening
3 months ago
smoke_test_results.json
1.43 kB
Start v2 safety hardening
3 months ago
test_prompts.json
8.92 kB
Add eval suite: test prompts, adversarial probes, BERTScore references (Day 12)
4 months ago
train_ml_router.py
1.5 kB
Implement EmpathRAG Core hybrid router
3 months ago
validate_eval_delivery.py
6.55 kB
Checkpoint V2 curated support navigator
3 months ago
wilcoxon_results.json
920 Bytes
fix: MistralJudge JSON extraction for DeepEval faithfulness, commit Wilcoxon results (Day 15)
3 months ago