3-tier resilience: GPU retry -> HF Inference -> deterministic; add torchvision for VLM 681b5fb verified cronos3k commited on Jun 4
Add torchvision (Qwen2-VL video sub-processor dep); switch default reasoning model to E4B (works on ZeroGPU CUDA emulation) 917ab65 verified cronos3k commited on Jun 4
Pin kernels<0.15 to fix transformers hub_kernels LayerRepository error 0843040 verified cronos3k commited on Jun 4