MayNiklas commited on
Commit
1fbc3f5
·
0 Parent(s):

Initial commit

Browse files
Files changed (3) hide show
  1. .gitattributes +42 -0
  2. README.md +39 -0
  3. mbert/config.json +51 -0
.gitattributes ADDED
@@ -0,0 +1,42 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ qwen3.5-0.8b/tokenizer.json filter=lfs diff=lfs merge=lfs -text
37
+ qwen3.5-0.8b-chinese-ft/tokenizer.json filter=lfs diff=lfs merge=lfs -text
38
+ qwen3.5-2b-chinese-ft/tokenizer.json filter=lfs diff=lfs merge=lfs -text
39
+ qwen3.5-4b-chinese-ft/tokenizer.json filter=lfs diff=lfs merge=lfs -text
40
+ qwen3.5-2b-chinese-ft-orig/tokenizer.json filter=lfs diff=lfs merge=lfs -text
41
+ qwen3.5-4b-chinese-ft-orig/tokenizer.json filter=lfs diff=lfs merge=lfs -text
42
+ qwen3.5-2b/tokenizer.json filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,39 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: apache-2.0
3
+ language:
4
+ - en
5
+ - sw
6
+ - uk
7
+ - zh
8
+ tags:
9
+ - text-classification
10
+ - multilingual
11
+ - emotion-recognition
12
+ ---
13
+
14
+ # MMD2 — BRIGHTER Multilingual Emotion Classifiers
15
+
16
+ Fine-tuned models for the **BRIGHTER** benchmark (SemEval-2025 Task 11):
17
+ multilingual multi-label emotion classification.
18
+
19
+ Submitted as part of the **Mining Media Data 2** course project.
20
+
21
+ ## Task
22
+
23
+ - **Input:** short text (tweet / comment) in one of 28 languages
24
+ - **Output:** one or more emotion labels from {anger, disgust, fear, joy, sadness, surprise}
25
+ - **Metric:** macro-F1 over emotion labels
26
+
27
+ ## Models in this repository
28
+
29
+ | Directory | Base model |
30
+ |---|---|
31
+ | `mbert/` | `google-bert/bert-base-multilingual-cased` |
32
+ | `qwen3.5-0.8b/` | `Qwen/Qwen3.5-0.8B` |
33
+ | `qwen3.5-0.8b-chinese-ft/` | `Qwen/Qwen3.5-0.8B` |
34
+ | `qwen3.5-2b-chinese-ft/` | `Qwen/Qwen3.5-2B` |
35
+ | `qwen3.5-4b-chinese-ft/` | `Qwen/Qwen3.5-4B` |
36
+
37
+ ## Dataset
38
+
39
+ [BRIGHTER (SemEval-2025 Task 11)](https://brighter-dataset.github.io/)
mbert/config.json ADDED
@@ -0,0 +1,51 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "add_cross_attention": false,
3
+ "architectures": [
4
+ "BertForSequenceClassification"
5
+ ],
6
+ "attention_probs_dropout_prob": 0.1,
7
+ "bos_token_id": null,
8
+ "classifier_dropout": null,
9
+ "directionality": "bidi",
10
+ "dtype": "float32",
11
+ "eos_token_id": null,
12
+ "hidden_act": "gelu",
13
+ "hidden_dropout_prob": 0.1,
14
+ "hidden_size": 768,
15
+ "id2label": {
16
+ "0": "anger",
17
+ "1": "disgust",
18
+ "2": "fear",
19
+ "3": "joy",
20
+ "4": "sadness",
21
+ "5": "surprise"
22
+ },
23
+ "initializer_range": 0.02,
24
+ "intermediate_size": 3072,
25
+ "is_decoder": false,
26
+ "label2id": {
27
+ "anger": 0,
28
+ "disgust": 1,
29
+ "fear": 2,
30
+ "joy": 3,
31
+ "sadness": 4,
32
+ "surprise": 5
33
+ },
34
+ "layer_norm_eps": 1e-12,
35
+ "max_position_embeddings": 512,
36
+ "model_type": "bert",
37
+ "num_attention_heads": 12,
38
+ "num_hidden_layers": 12,
39
+ "pad_token_id": 0,
40
+ "pooler_fc_size": 768,
41
+ "pooler_num_attention_heads": 12,
42
+ "pooler_num_fc_layers": 3,
43
+ "pooler_size_per_head": 128,
44
+ "pooler_type": "first_token_transform",
45
+ "problem_type": "multi_label_classification",
46
+ "tie_word_embeddings": true,
47
+ "transformers_version": "5.10.0.dev0",
48
+ "type_vocab_size": 2,
49
+ "use_cache": false,
50
+ "vocab_size": 119547
51
+ }