etri-vilab/MultiHopSpatial-Qwen3-VL-4B-Instruct Image-Text-to-Text • 4B • Updated 25 days ago • 107 • 2
Multihop Spatial Reasoning Collection MultihopSpatial: Multi-hop Compositional Spatial Reasoning Benchmark for Vision-Language Model • 5 items • Updated 16 days ago
etri-vilab/MultiHopSpatial-Qwen3-VL-32B-Instruct Image-Text-to-Text • 33B • Updated 25 days ago • 73 • 1
etri-vilab/MultiHopSpatial-Qwen3-VL-32B-Instruct Image-Text-to-Text • 33B • Updated 25 days ago • 73 • 1
etri-vilab/MultiHopSpatial-Qwen3-VL-8B-Instruct Image-Text-to-Text • 9B • Updated 25 days ago • 72 • 1
etri-vilab/MultiHopSpatial-Qwen3-VL-8B-Instruct Image-Text-to-Text • 9B • Updated 25 days ago • 72 • 1
KOALA series Collection KOALA for text-to-image generation (https://huggingface.co/spaces/etri-vilab/KOALA) • 12 items • Updated Mar 20
🛡️ Safe-VLMs Collection Safe Vision-Language Models with Visual Guard Module (https://huggingface.co/spaces/etri-vilab/Ko-LLaVA) • 9 items • Updated Mar 20 • 2
Multihop Spatial Reasoning Collection MultihopSpatial: Multi-hop Compositional Spatial Reasoning Benchmark for Vision-Language Model • 5 items • Updated 16 days ago
etri-vilab/MultiHopSpatial-Qwen3-VL-4B-Instruct Image-Text-to-Text • 4B • Updated 25 days ago • 107 • 2