File size: 1,515 Bytes
ff92592
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
#!/bin/bash
# Copies only the files needed by the dashboard from llm_project into data/
# Run once before pushing to HF Spaces.

set -e
PROJ="/data/ralmadamonter/llm_project"
DASH="/data/ralmadamonter/llm_dashboard/data"

echo "=== Copying evaluation results ==="
mkdir -p "$DASH/evaluation_llm_results"
cp -r "$PROJ/jsons/evaluation_llm_results/." "$DASH/evaluation_llm_results/"

echo "=== Copying SAMs data ==="
mkdir -p "$DASH/sams"
cp "$PROJ/jsons/sams/extracted_methods_sams_metrics.json" "$DASH/sams/"
cp "$PROJ/jsons/sams/sam_pdfs_enzymology.json"            "$DASH/sams/"
cp "$PROJ/jsons/sams/filtered.json"                        "$DASH/sams/"

echo "=== Copying azoreductases GT ==="
mkdir -p "$DASH/azoreductases_gt"
cp "$PROJ/jsons/azoreductases_gt/azo_metadata.json" "$DASH/azoreductases_gt/"

echo "=== Copying confusion matrix ==="
mkdir -p "$DASH/confusion_matrix"
cp "$PROJ/plots/classification_confusion_matrix/confusion_matrix_counts.csv" "$DASH/confusion_matrix/"

echo "=== Copying clustering (used files only — skipping .pkl, .png, .svg) ==="
find "$DASH/clustering" -name "*.pkl" -delete
find "$DASH/clustering" -name "*.png" -delete
find "$DASH/clustering" -name "*.svg" -delete
find "$DASH/clustering" -name "*_clusters_distribution_*.html" -delete
# Individual per-field CSVs (app uses ALL_FIELDS only)
find "$DASH/clustering" -name "*.csv" \
    ! -name "*_ALL_FIELDS.csv" \
    ! -name "*_FIELD_CLUSTER_METRICS.csv" \
    -delete

echo ""
echo "Done. Final data size:"
du -sh "$DASH"