hallucination / experiment /scripts /baselines /run_eval_lora_v3.sh
ToiTenBao's picture
Upload hallucination folder
a2ffd07 verified
Raw
History Blame Contribute Delete
1.27 kB
#!/usr/bin/env bash
# Eval: LoRA v3 model (HuggingFace Hub adapter or local dir)
#
# Usage:
# bash experiment/scripts/baselines/run_eval_lora_v3.sh
# CUDA_VISIBLE_DEVICES=2 bash experiment/scripts/baselines/run_eval_lora_v3.sh
#
# Override adapter:
# LORA_ADAPTER=./my_local_adapter bash ...
SCRIPT_DIR="$(cd "$(dirname "$0")" && pwd)"
source "${SCRIPT_DIR}/_common.sh"
NUM_PER_CATEGORY=50
LORA_ADAPTER="${LORA_ADAPTER:-pbcong/bathroom-toilet-300}"
EVAL_OUTPUT_DIR="${EVAL_OUTPUT_DIR:-./step4_baseline_outputs/compare_eval/lora_v3}"
ORIGINAL_CACHE_DIR="${ORIGINAL_CACHE_DIR:-./cached_original_outputs}"
echo "Using LoRA adapter: ${LORA_ADAPTER}"
mkdir -p "${EVAL_OUTPUT_DIR}"
python -m experiment.evaluation.validate \
--model_type lora \
--model_dir "${LORA_ADAPTER}" \
--base_model_name "${BASE_MODEL}" \
--dataset_id "${DATASET_ID}" \
--num_per_category "${NUM_PER_CATEGORY}" \
--mention_method "${MENTION_METHOD}" \
--max_new_tokens "${MAX_NEW_TOKENS}" \
--use_val_split \
--prompts "Describe this image." \
--train_prompts "Describe this image." \
--generality_prompts "Give a detailed description of this image." \
--original_cache_dir "${ORIGINAL_CACHE_DIR}" \
--output_dir "${EVAL_OUTPUT_DIR}"