R1002 commited on
Commit
a89d9ad
·
verified ·
1 Parent(s): 8d8722f

Update config.yaml

Browse files
Files changed (1) hide show
  1. config.yaml +82 -3
config.yaml CHANGED
@@ -1,4 +1,83 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
  general_settings:
2
- master_key: os.environ/LITELLM_KEY
3
- store_model_in_db: true
4
- database_url: os.environ/BASE_URL
 
 
 
 
1
+ model_list:
2
+ # northflank
3
+ - model_name: gpt-4o-mini-northflank
4
+ litellm_params:
5
+ model: openai/gpt-4o-mini
6
+ api_base: https://yc--northflank-duckapi--b69bn8cbbs7k.code.run/v1
7
+ api_key: os.environ/NF_API_KEY
8
+ - model_name: gpt-4o-mini
9
+ litellm_params:
10
+ model: openai/gpt-4o-mini
11
+ api_base: https://yc--northflank-duckapi--b69bn8cbbs7k.code.run/v1
12
+ api_key: os.environ/NF_API_KEY
13
+ - model_name: gpt-3.5-turbo-northflank
14
+ litellm_params:
15
+ model: openai/gpt-3.5-turbo
16
+ api_base: https://yc--northflank-duckapi--b69bn8cbbs7k.code.run/v1
17
+ api_key: os.environ/NF_API_KEY
18
+ - model_name: gpt-3.5-turbo
19
+ litellm_params:
20
+ model: openai/gpt-3.5-turbo
21
+ api_base: https://yc--northflank-duckapi--b69bn8cbbs7k.code.run/v1
22
+ api_key: os.environ/NF_API_KEY
23
+
24
+ - model_name: gemini-1.5-pro-k1
25
+ litellm_params:
26
+ model: gemini/gemini-1.5-pro
27
+ api_key: os.environ/GEMINI_API_KEY1
28
+ - model_name: gemini-1.5-pro
29
+ litellm_params:
30
+ model: gemini/gemini-1.5-pro
31
+ api_key: os.environ/GEMINI_API_KEY1
32
+ rpm: 4 # 2 * # of keys
33
+ tpm: 6400 # 32,000 * # of keys
34
+
35
+ - model_name: gemini-1.5-flash-k1
36
+ litellm_params:
37
+ model: gemini/gemini-1.5-flash
38
+ api_key: os.environ/GEMINI_API_KEY1
39
+ - model_name: gemini-1.5-flash
40
+ litellm_params:
41
+ model: gemini/gemini-1.5-flash
42
+ api_key: os.environ/GEMINI_API_KEY1
43
+ rpm: 30 # 15 * # of keys
44
+ tpm: 2000000 # 1,000,000 * # of keys
45
+
46
+ - model_name: gemini-1.5-pro-k2
47
+ litellm_params:
48
+ model: gemini/gemini-1.5-pro
49
+ api_key: os.environ/GEMINI_API_KEY2
50
+ - model_name: gemini-1.5-pro
51
+ litellm_params:
52
+ model: gemini/gemini-1.5-pro
53
+ api_key: os.environ/GEMINI_API_KEY
54
+ rpm: 4 # 2 * # of keys
55
+ tpm: 6400 # 32,000 * # of keys
56
+
57
+ - model_name: gemini-1.5-flash-k2
58
+ litellm_params:
59
+ model: gemini/gemini-1.5-flash
60
+ api_key: os.environ/GEMINI_API_KEY2
61
+ - model_name: gemini-1.5-flash
62
+ litellm_params:
63
+ model: gemini/gemini-1.5-flash
64
+ api_key: os.environ/GEMINI_API_KEY2
65
+ rpm: 30 # 15 * # of keys
66
+ tpm: 2000000 # 1,000,000 * # of keys
67
+
68
+ litellm_settings:
69
+ # Networking settings
70
+ request_timeout: 20 # (int) llm request timeout in seconds. Raise Timeout error if call takes longer than 10s. Sets litellm.request_timeout
71
+ num_retries: 3
72
+ fallbacks: [{"gemini-1.5-pro": ["gemini-1.5-flash"]}]
73
+ allowed_fails: 3 # cooldown model if it fails > 1 call in a minute.
74
+ cooldown_time: 30 # how long to cooldown model if fails/min > allowed_fails
75
+ drop_params: true
76
+
77
  general_settings:
78
+ master_key: os.environ/MASTER_KEY # sk-1234 # [OPTIONAL] Only use this if you require all calls to contain this key (Authorization: Bearer sk-1234)
79
+
80
+ router_settings:
81
+ fallbacks: [{"gpt-4o-mini": ["gemini-1.5-flash"]}, {"gpt-3.5-turbo": ["gemini-1.5-flash"]}]
82
+ model_group_alias: {"gpt-4": "gemini-1.5-pro", "gpt-4o-mini": "gemini-1.5-flash"}
83
+ routing_strategy: simple-shuffle