Training in progress, epoch 1

Browse files

Files changed (16) hide show

added_tokens.json +3 -0
config.json +52 -0
merges.txt +0 -0
model.safetensors +3 -0
runs/Jan07_20-16-00_halle.cli.ito.cit.tum.de/events.out.tfevents.1736277363.halle.cli.ito.cit.tum.de.4004027.0 +3 -0
runs/Jan07_20-19-30_halle.cli.ito.cit.tum.de/events.out.tfevents.1736277579.halle.cli.ito.cit.tum.de.4010916.0 +3 -0
runs/Jan07_23-01-49_halle.cli.ito.cit.tum.de/events.out.tfevents.1736287309.halle.cli.ito.cit.tum.de.4010916.1 +3 -0
runs/Jan07_23-49-14_halle.cli.ito.cit.tum.de/events.out.tfevents.1736290155.halle.cli.ito.cit.tum.de.4010916.2 +3 -0
runs/Jan08_00-50-06_halle.cli.ito.cit.tum.de/events.out.tfevents.1736293807.halle.cli.ito.cit.tum.de.4010916.3 +3 -0
runs/Jan08_05-20-22_halle.cli.ito.cit.tum.de/events.out.tfevents.1736310023.halle.cli.ito.cit.tum.de.4010916.4 +3 -0
special_tokens_map.json +19 -0
tokenizer.json +0 -0
tokenizer_config.json +94 -0
training_args.bin +3 -0
vocab.json +0 -0
vocab.txt +0 -0

added_tokens.json ADDED Viewed

	@@ -0,0 +1,3 @@

+{
+  "[PAD]": 50257
+}

config.json ADDED Viewed

	@@ -0,0 +1,52 @@

+{
+  "_name_or_path": "xlnet/xlnet-base-cased",
+  "architectures": [
+    "XLNetForSequenceClassification"
+  ],
+  "attn_type": "bi",
+  "bi_data": false,
+  "bos_token_id": 1,
+  "clamp_len": -1,
+  "d_head": 64,
+  "d_inner": 3072,
+  "d_model": 768,
+  "dropout": 0.1,
+  "end_n_top": 5,
+  "eos_token_id": 2,
+  "ff_activation": "gelu",
+  "id2label": {
+    "0": "NEGATIVE",
+    "1": "POSITIVE"
+  },
+  "initializer_range": 0.02,
+  "label2id": {
+    "NEGATIVE": 0,
+    "POSITIVE": 1
+  },
+  "layer_norm_eps": 1e-12,
+  "mem_len": null,
+  "model_type": "xlnet",
+  "n_head": 12,
+  "n_layer": 12,
+  "pad_token_id": 5,
+  "problem_type": "single_label_classification",
+  "reuse_len": null,
+  "same_length": false,
+  "start_n_top": 5,
+  "summary_activation": "tanh",
+  "summary_last_dropout": 0.1,
+  "summary_type": "last",
+  "summary_use_proj": true,
+  "task_specific_params": {
+    "text-generation": {
+      "do_sample": true,
+      "max_length": 250
+    }
+  },
+  "torch_dtype": "float32",
+  "transformers_version": "4.47.1",
+  "untie_r": true,
+  "use_mems_eval": true,
+  "use_mems_train": false,
+  "vocab_size": 32000
+}

merges.txt ADDED Viewed

The diff for this file is too large to render. See raw diff

model.safetensors ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:968b368a981f068a1d6ff52e5de60bff258bca36fd19c12fbec830c803cb12d7
+size 469264592

runs/Jan07_20-16-00_halle.cli.ito.cit.tum.de/events.out.tfevents.1736277363.halle.cli.ito.cit.tum.de.4004027.0 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:e8e6c5d4d25934109e9a614f6fa2c103cb93f0e8fa37cd47776958c7aff5fc4c
+size 5764

runs/Jan07_20-19-30_halle.cli.ito.cit.tum.de/events.out.tfevents.1736277579.halle.cli.ito.cit.tum.de.4010916.0 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:da78695da9c4bb1f153f59e037932c356991c6416f8d2d89a6a8833acc5680bb
+size 19325

runs/Jan07_23-01-49_halle.cli.ito.cit.tum.de/events.out.tfevents.1736287309.halle.cli.ito.cit.tum.de.4010916.1 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:d5c22b7ad316b5b4908385412fee5b022d119794014a671fb94fda8d1c11e96c
+size 19236

runs/Jan07_23-49-14_halle.cli.ito.cit.tum.de/events.out.tfevents.1736290155.halle.cli.ito.cit.tum.de.4010916.2 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:9cd6b97319054ef62c74557c19df05552023e83a758633c41596a2ec09f163c0
+size 19193

runs/Jan08_00-50-06_halle.cli.ito.cit.tum.de/events.out.tfevents.1736293807.halle.cli.ito.cit.tum.de.4010916.3 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:cf34e5aaabfc03c9982b00b2bb712e8d3e150f6f32dad9054f3b0879977f6ec0
+size 19913

runs/Jan08_05-20-22_halle.cli.ito.cit.tum.de/events.out.tfevents.1736310023.halle.cli.ito.cit.tum.de.4010916.4 ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:07bb7d6a54dfc88ea8872b22722ff457fa749f25d4a48a65df10016e5ca2b50a
+size 12031

special_tokens_map.json ADDED Viewed

	@@ -0,0 +1,19 @@

+{
+  "additional_special_tokens": [
+    "<eop>",
+    "<eod>"
+  ],
+  "bos_token": "<s>",
+  "cls_token": "<cls>",
+  "eos_token": "</s>",
+  "mask_token": {
+    "content": "<mask>",
+    "lstrip": true,
+    "normalized": false,
+    "rstrip": false,
+    "single_word": false
+  },
+  "pad_token": "<pad>",
+  "sep_token": "<sep>",
+  "unk_token": "<unk>"
+}

tokenizer.json ADDED Viewed

The diff for this file is too large to render. See raw diff

tokenizer_config.json ADDED Viewed

	@@ -0,0 +1,94 @@

+{
+  "added_tokens_decoder": {
+    "0": {
+      "content": "<unk>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "1": {
+      "content": "<s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "2": {
+      "content": "</s>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "3": {
+      "content": "<cls>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "4": {
+      "content": "<sep>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "5": {
+      "content": "<pad>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "6": {
+      "content": "<mask>",
+      "lstrip": true,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "7": {
+      "content": "<eod>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    },
+    "8": {
+      "content": "<eop>",
+      "lstrip": false,
+      "normalized": false,
+      "rstrip": false,
+      "single_word": false,
+      "special": true
+    }
+  },
+  "additional_special_tokens": [
+    "<eop>",
+    "<eod>"
+  ],
+  "bos_token": "<s>",
+  "clean_up_tokenization_spaces": false,
+  "cls_token": "<cls>",
+  "do_lower_case": false,
+  "eos_token": "</s>",
+  "extra_special_tokens": {},
+  "keep_accents": false,
+  "mask_token": "<mask>",
+  "model_max_length": 1000000000000000019884624838656,
+  "pad_token": "<pad>",
+  "remove_space": true,
+  "sep_token": "<sep>",
+  "tokenizer_class": "XLNetTokenizer",
+  "unk_token": "<unk>"
+}

training_args.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:cdc0262c12b6c6e7aa28b326da6e03b41dca262a550504d825eea0c08a1b9981
+size 5432

vocab.json ADDED Viewed

The diff for this file is too large to render. See raw diff

vocab.txt ADDED Viewed

The diff for this file is too large to render. See raw diff