#!/bin/bash set -euo pipefail RELATION="${RELATION:-bathroom_toilet}" BASE_MODEL="${BASE_MODEL:-llava-hf/llava-1.5-7b-hf}" DATASET_ID="${DATASET_ID:-}" ORIGINAL_CACHE_DIR="${ORIGINAL_CACHE_DIR:-./cached_original_outputs}" OUTPUT_DIR="${OUTPUT_DIR:-./step4_outputs}" NUM_PER_CATEGORY="${NUM_PER_CATEGORY:-50}" MAX_NEW_TOKENS="${MAX_NEW_TOKENS:-300}" MENTION_METHOD="${MENTION_METHOD:-keyword}" MODEL_TYPE="${MODEL_TYPE:-lora}" MODEL_PATH="${MODEL_PATH:-step3_lora_outputs/lora_adapter}" if [ "${MODEL_TYPE}" = "delta_w" ]; then MODEL_ARG=(--checkpoint "${MODEL_PATH}") else MODEL_ARG=(--model_dir "${MODEL_PATH}") fi DATASET_ARG=() if [ -n "${DATASET_ID}" ]; then DATASET_ARG=(--dataset_id "${DATASET_ID}") fi python -m experiment.evaluation.validate \ --relation "${RELATION}" \ --model_type "${MODEL_TYPE}" \ "${MODEL_ARG[@]}" \ --base_model_name "${BASE_MODEL}" \ "${DATASET_ARG[@]}" \ --num_per_category "${NUM_PER_CATEGORY}" \ --mention_method "${MENTION_METHOD}" \ --max_new_tokens "${MAX_NEW_TOKENS}" \ --prompts "Describe this image." \ --train_prompts "Describe this image." \ --generality_prompts "What do you see in this image?" \ --original_cache_dir "${ORIGINAL_CACHE_DIR}" \ --output_dir "${OUTPUT_DIR}" \ --use_val_split