Files changed (3) hide show
  1. app.py +3 -2
  2. report_score_v3.py +1 -1
  3. utils_v3.py +1 -1
app.py CHANGED
@@ -55,7 +55,7 @@ with gr.Blocks() as block:
55
 
56
  df = get_df()
57
  df['Date'] = 'unknown'
58
- df2 = v3.get_df('Overall-V2')
59
  min_size2, max_size2 = get_size_range(df2)
60
 
61
  with gr.Row():
@@ -229,4 +229,5 @@ with gr.Blocks() as block:
229
  gr.Markdown(SUBMIT_INTRODUCTION, elem_classes="markdown-text")
230
 
231
 
232
- block.launch(share=True)
 
 
55
 
56
  df = get_df()
57
  df['Date'] = 'unknown'
58
+ df2 = v3.get_df('Overall')
59
  min_size2, max_size2 = get_size_range(df2)
60
 
61
  with gr.Row():
 
229
  gr.Markdown(SUBMIT_INTRODUCTION, elem_classes="markdown-text")
230
 
231
 
232
+ if __name__ == "__main__":
233
+ block.launch(share=True, ssr_mode=False)
report_score_v3.py CHANGED
@@ -74,7 +74,7 @@ EXPERIMENTS = [
74
  # Define the datasets grouped by modality
75
  modality2dataset = {
76
  "audio": [
77
- 'SpeechCommand', 'UrbanSound8k', 'ESC-50', 'NSynth', 'CREMA-D', 'Clotho', 'SoundDescs', 'TUTSound', 'TUTSound(hard)', 'AVE', 'SpeechCOCO'
78
  ],
79
  "image": [
80
  "ImageNet-1K", "N24News", "HatefulMemes", "VOC2007", "SUN397", "Place365", "ImageNet-A", "ImageNet-R", "ObjectNet", "Country211",
 
74
  # Define the datasets grouped by modality
75
  modality2dataset = {
76
  "audio": [
77
+ 'SpeechCommands', 'UrbanSound8K', 'ESC-50', 'NSynth', 'CREMA-D', 'Clotho', 'SoundDescs', 'TUTSound', 'TUTSound(hard)', 'AVE', 'SpeechCOCO'
78
  ],
79
  "image": [
80
  "ImageNet-1K", "N24News", "HatefulMemes", "VOC2007", "SUN397", "Place365", "ImageNet-A", "ImageNet-R", "ObjectNet", "Country211",
utils_v3.py CHANGED
@@ -50,7 +50,7 @@ DATA_TITLE_TYPE_AG = BASE_DATA_TITLE_TYPE + \
50
  ['number'] * len(TASKS_AG)
51
 
52
  TABLE_INTRODUCTION = """**MMEB**: Massive MultiModal Embedding Benchmark \n
53
- Models are ranked based on **Overall-V2**."""
54
  TABLE_INTRODUCTION_I = """**I-CLS**: Image Classification, **I-QA**: (Image) Visual Question Answering, **I-RET**: Image Retrieval, **I-VG**: (Image) Visual Grounding \n
55
  Models are ranked based on **Image-Overall**\n
56
  **Models from the old V1 leaderboard are missing detailed scores of each dataset.
 
50
  ['number'] * len(TASKS_AG)
51
 
52
  TABLE_INTRODUCTION = """**MMEB**: Massive MultiModal Embedding Benchmark \n
53
+ Models are ranked based on **Overall**(V3)."""
54
  TABLE_INTRODUCTION_I = """**I-CLS**: Image Classification, **I-QA**: (Image) Visual Question Answering, **I-RET**: Image Retrieval, **I-VG**: (Image) Visual Grounding \n
55
  Models are ranked based on **Image-Overall**\n
56
  **Models from the old V1 leaderboard are missing detailed scores of each dataset.