runtime error
Exit code: 1. Reason: .6MB/s] special_tokens_map.json: 0%| | 0.00/301 [00:00<?, ?B/s][A special_tokens_map.json: 100%|██████████| 301/301 [00:00<00:00, 1.11MB/s] config.json: 0%| | 0.00/843 [00:00<?, ?B/s][A config.json: 100%|██████████| 843/843 [00:00<00:00, 5.71MB/s] model.safetensors: 0%| | 0.00/2.47G [00:00<?, ?B/s][A model.safetensors: 0%| | 11.4M/2.47G [00:01<05:22, 7.64MB/s][A model.safetensors: 2%|▏ | 56.1M/2.47G [00:02<01:38, 24.6MB/s][A model.safetensors: 4%|▍ | 102M/2.47G [00:04<01:36, 24.5MB/s] [A model.safetensors: 10%|█ | 259M/2.47G [00:07<00:58, 38.1MB/s][A model.safetensors: 16%|█▌ | 393M/2.47G [00:08<00:36, 57.5MB/s][A model.safetensors: 67%|██████▋ | 1.67G/2.47G [00:09<00:02, 326MB/s][A model.safetensors: 100%|██████████| 2.47G/2.47G [00:10<00:00, 237MB/s] generation_config.json: 0%| | 0.00/185 [00:00<?, ?B/s][A generation_config.json: 100%|██████████| 185/185 [00:00<00:00, 1.09MB/s] Traceback (most recent call last): File "/app/app.py", line 620, in <module> model_instances = get_multiple_model_and_tokenizer(model_id, n_instances) File "/app/app.py", line 58, in get_multiple_model_and_tokenizer model = AutoModelForCausalLM.from_pretrained(name, token=os.getenv('HF_TOKEN'), torch_dtype="bfloat16", pad_token_id=128001, device_map="auto") File "/usr/local/lib/python3.10/site-packages/transformers/models/auto/auto_factory.py", line 564, in from_pretrained return model_class.from_pretrained( File "/usr/local/lib/python3.10/site-packages/transformers/modeling_utils.py", line 4091, in from_pretrained dispatch_model(model, **device_map_kwargs) File "/usr/local/lib/python3.10/site-packages/accelerate/big_modeling.py", line 504, in dispatch_model raise ValueError( ValueError: You are trying to offload the whole model to the disk. Please use the `disk_offload` function instead.
Container logs:
Fetching error logs...