2026-07-23:21:58:26 WARNING [config.evaluate_config:287] --limit SHOULD ONLY BE USED FOR TESTING. REAL METRICS SHOULD NOT BE COMPUTED USING LIMIT. 2026-07-23:21:58:33 INFO [_cli.run:388] Selected Tasks: ['mmlu_pro', 'gpqa_diamond_zeroshot', 'minerva_math500', 'ifeval', 'gsm8k_cot_zeroshot'] 2026-07-23:21:58:35 INFO [evaluator:214] Setting random seed to 0 | Setting numpy seed to 1234 | Setting torch manual seed to 1234 | Setting fewshot manual seed to 1234 2026-07-23:21:58:35 WARNING [evaluator:226] generation_kwargs: {'max_gen_toks': 1280} specified through cli, these settings will update set parameters in yaml tasks. Ensure 'do_sample=True' for non-greedy decoding! 2026-07-23:21:58:35 INFO [evaluator:239] Initializing local-chat-completions model, with arguments: {'model': 'student', 'base_url': 'http://127.0.0.1:8399/v1/chat/completions', 'num_concurrent': 32, 'tokenized_requests': False, 'max_retries': 3} 2026-07-23:21:58:35 INFO [models.api_models:179] Using max length 2048 - 1 2026-07-23:21:58:35 INFO [models.api_models:200] Using tokenizer None Generating test split: 0%| | 0/12032 [00:00', '<|im_end|>'], 'do_sample': False, 'max_gen_toks': 1280} 2026-07-23:21:58:57 INFO [api.task:312] Building contexts for mmlu_pro_biology on rank 0... 0%| | 0/10 [00:00, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:57 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:57 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:57 INFO [models.api_models:607] Retry attempt 1 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:58 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:58 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. 2026-07-23:21:58:58 INFO [models.api_models:607] Retry attempt 2 2026-07-23:21:58:59 WARNING [models.api_models:523] API request failed! Status code: 400, Response text: {"error":{"message":"This model's maximum context length is 2048 tokens. However, you requested 1280 output tokens and your prompt contains at least 769 input tokens, for a total of at least 2049 tokens. Please reduce the length of the input prompt or the number of requested output tokens. (parameter=input_tokens, value=769)","type":"BadRequestError","param":"input_tokens","code":400}}. Retrying... 2026-07-23:21:58:59 ERROR [models.api_models:559] Exception:ClientResponseError(RequestInfo(url=URL('http://127.0.0.1:8399/v1/chat/completions'), method='POST', headers=, real_url=URL('http://127.0.0.1:8399/v1/chat/completions')), (), status=400, message='Bad Request', headers=), (no outputs), retrying. Requesting API: 0%| | 0/140 [00:02 sys.exit(cli_evaluate()) ^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/__main__.py", line 10, in cli_evaluate parser.execute(args) File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/_cli/harness.py", line 60, in execute args.func(args) File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/_cli/run.py", line 391, in _execute results = simple_evaluate( ^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/utils.py", line 575, in _wrapper return fn(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/evaluator.py", line 358, in simple_evaluate results = evaluate( ^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/utils.py", line 575, in _wrapper return fn(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/evaluator.py", line 596, in evaluate resps = getattr(lm, reqtype)(cloned_reqs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 825, in generate_until asyncio.run( File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/asyncio/runners.py", line 195, in run return runner.run(main) ^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/asyncio/runners.py", line 118, in run return self._loop.run_until_complete(task) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/asyncio/base_events.py", line 691, in run_until_complete return future.result() ^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 631, in get_batched_requests return await tqdm_asyncio.gather(*tasks, desc="Requesting API") ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tqdm/asyncio.py", line 79, in gather res = [await f for f in cls.as_completed(ifs, loop=loop, timeout=timeout, ^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/asyncio/tasks.py", line 631, in _wait_for_one return f.result() # May raise f.exception(). ^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tqdm/asyncio.py", line 76, in wrap_awaitable return i, await f ^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 193, in async_wrapped return await copy(fn, *args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 112, in __call__ do = await self.iter(retry_state=retry_state) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 157, in iter result = await action(retry_state) ^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/_utils.py", line 111, in inner return call(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/__init__.py", line 413, in exc_check raise retry_exc.reraise() ^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/__init__.py", line 184, in reraise raise self.last_attempt.result() ^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/concurrent/futures/_base.py", line 449, in result return self.__get_result() ^^^^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/concurrent/futures/_base.py", line 401, in __get_result raise self._exception File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 116, in __call__ result = await fn(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 560, in amodel_call raise e File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 528, in amodel_call response.raise_for_status() File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/client_reqrep.py", line 655, in raise_for_status raise ClientResponseError( aiohttp.client_exceptions.ClientResponseError: 400, message='Bad Request', url='http://127.0.0.1:8399/v1/chat/completions' Task exception was never retrieved future: .wrap_awaitable() done, defined at /home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tqdm/asyncio.py:75> exception=ServerDisconnectedError('Server disconnected')> Traceback (most recent call last): File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tqdm/asyncio.py", line 76, in wrap_awaitable return i, await f ^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 193, in async_wrapped return await copy(fn, *args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 112, in __call__ do = await self.iter(retry_state=retry_state) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 157, in iter result = await action(retry_state) ^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/_utils.py", line 111, in inner return call(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/__init__.py", line 413, in exc_check raise retry_exc.reraise() ^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/__init__.py", line 184, in reraise raise self.last_attempt.result() ^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/concurrent/futures/_base.py", line 449, in result return self.__get_result() ^^^^^^^^^^^^^^^^^^^ File "/home/henry/.local/share/uv/python/cpython-3.12.12-linux-x86_64-gnu/lib/python3.12/concurrent/futures/_base.py", line 401, in __get_result raise self._exception File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/tenacity/asyncio/__init__.py", line 116, in __call__ result = await fn(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 560, in amodel_call raise e File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/lm_eval/models/api_models.py", line 516, in amodel_call async with session.post( ^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/client.py", line 1683, in __aenter__ self._resp: _RetType_co = await self._coro ^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/client.py", line 856, in _request resp = await handler(req) ^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/client.py", line 834, in _connect_and_send_request await resp.start(conn) File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/client_reqrep.py", line 558, in start message, payload = await protocol.read() # type: ignore[union-attr] ^^^^^^^^^^^^^^^^^^^^^ File "/home/henry/Documents/PythonProjects/variable-reap/.venv/lib/python3.12/site-packages/aiohttp/streams.py", line 705, in read await self._waiter aiohttp.client_exceptions.ServerDisconnectedError: Server disconnected