dq158 commited on Nov 10, 2023

Commit

91deccb

1 Parent(s): 894f5e2

WIPE IT ALL OUT

Browse files

Files changed (18) hide show

.gitattributes +0 -35
README.md +0 -58
config.json +0 -62
generation_config.json +0 -6
last-checkpoint/config.json +0 -62
last-checkpoint/generation_config.json +0 -6
last-checkpoint/optimizer.pt +0 -3
last-checkpoint/pytorch_model.bin +0 -3
last-checkpoint/rng_state.pth +0 -3
last-checkpoint/scheduler.pt +0 -3
last-checkpoint/trainer_state.json +0 -336
last-checkpoint/training_args.bin +0 -3
pytorch_model.bin +0 -3
tokenizer (1).json +0 -0
tokenizer.json +0 -0
tokenizer_config (1).json +0 -10
tokenizer_config.json +0 -10
training_args.bin +0 -3

.gitattributes DELETED Viewed

@@ -1,35 +0,0 @@
-*.7z filter=lfs diff=lfs merge=lfs -text
-*.arrow filter=lfs diff=lfs merge=lfs -text
-*.bin filter=lfs diff=lfs merge=lfs -text
-*.bz2 filter=lfs diff=lfs merge=lfs -text
-*.ckpt filter=lfs diff=lfs merge=lfs -text
-*.ftz filter=lfs diff=lfs merge=lfs -text
-*.gz filter=lfs diff=lfs merge=lfs -text
-*.h5 filter=lfs diff=lfs merge=lfs -text
-*.joblib filter=lfs diff=lfs merge=lfs -text
-*.lfs.* filter=lfs diff=lfs merge=lfs -text
-*.mlmodel filter=lfs diff=lfs merge=lfs -text
-*.model filter=lfs diff=lfs merge=lfs -text
-*.msgpack filter=lfs diff=lfs merge=lfs -text
-*.npy filter=lfs diff=lfs merge=lfs -text
-*.npz filter=lfs diff=lfs merge=lfs -text
-*.onnx filter=lfs diff=lfs merge=lfs -text
-*.ot filter=lfs diff=lfs merge=lfs -text
-*.parquet filter=lfs diff=lfs merge=lfs -text
-*.pb filter=lfs diff=lfs merge=lfs -text
-*.pickle filter=lfs diff=lfs merge=lfs -text
-*.pkl filter=lfs diff=lfs merge=lfs -text
-*.pt filter=lfs diff=lfs merge=lfs -text
-*.pth filter=lfs diff=lfs merge=lfs -text
-*.rar filter=lfs diff=lfs merge=lfs -text
-*.safetensors filter=lfs diff=lfs merge=lfs -text
-saved_model/**/* filter=lfs diff=lfs merge=lfs -text
-*.tar.* filter=lfs diff=lfs merge=lfs -text
-*.tar filter=lfs diff=lfs merge=lfs -text
-*.tflite filter=lfs diff=lfs merge=lfs -text
-*.tgz filter=lfs diff=lfs merge=lfs -text
-*.wasm filter=lfs diff=lfs merge=lfs -text
-*.xz filter=lfs diff=lfs merge=lfs -text
-*.zip filter=lfs diff=lfs merge=lfs -text
-*.zst filter=lfs diff=lfs merge=lfs -text
-*tfevents* filter=lfs diff=lfs merge=lfs -text

README.md DELETED Viewed

@@ -1,58 +0,0 @@
----
-tags:
-- generated_from_trainer
-model-index:
-- name: coqui
-  results: []
----
-<!-- This model card has been generated automatically according to the information the Trainer had access to. You
-should probably proofread and complete it, then remove this comment. -->
-# coqui
-This model was trained from scratch on an unknown dataset.
-It achieves the following results on the evaluation set:
-- eval_loss: 2.3637
-- eval_bleu: 1.0
-- eval_precisions: [1.0, 1.0, 1.0, 1.0]
-- eval_brevity_penalty: 1.0
-- eval_length_ratio: 1.0
-- eval_translation_length: 3779
-- eval_reference_length: 3779
-- eval_runtime: 35.8058
-- eval_samples_per_second: 5.586
-- eval_steps_per_second: 0.475
-- step: 0
-## Model description
-More information needed
-## Intended uses & limitations
-More information needed
-## Training and evaluation data
-More information needed
-## Training procedure
-### Training hyperparameters
-The following hyperparameters were used during training:
-- learning_rate: 5e-05
-- train_batch_size: 12
-- eval_batch_size: 12
-- seed: 42
-- optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08
-- lr_scheduler_type: linear
-- num_epochs: 5
-### Framework versions
-- Transformers 4.34.1
-- Pytorch 2.1.0+cu118
-- Datasets 2.14.5
-- Tokenizers 0.14.1

config.json DELETED Viewed

@@ -1,62 +0,0 @@
-{
-  "_name_or_path": "google/flan-t5-base",
-  "architectures": [
-    "T5ForConditionalGeneration"
-  ],
-  "classifier_dropout": 0.0,
-  "d_ff": 2048,
-  "d_kv": 64,
-  "d_model": 768,
-  "decoder_start_token_id": 0,
-  "dense_act_fn": "gelu_new",
-  "dropout_rate": 0.1,
-  "eos_token_id": 1,
-  "feed_forward_proj": "gated-gelu",
-  "initializer_factor": 1.0,
-  "is_encoder_decoder": true,
-  "is_gated_act": true,
-  "layer_norm_epsilon": 1e-06,
-  "model_type": "t5",
-  "n_positions": 512,
-  "num_decoder_layers": 12,
-  "num_heads": 12,
-  "num_layers": 12,
-  "output_past": true,
-  "pad_token_id": 0,
-  "relative_attention_max_distance": 128,
-  "relative_attention_num_buckets": 32,
-  "task_specific_params": {
-    "summarization": {
-      "early_stopping": true,
-      "length_penalty": 2.0,
-      "max_length": 200,
-      "min_length": 30,
-      "no_repeat_ngram_size": 3,
-      "num_beams": 4,
-      "prefix": "summarize: "
-    },
-    "translation_en_to_de": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to German: "
-    },
-    "translation_en_to_fr": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to French: "
-    },
-    "translation_en_to_ro": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to Romanian: "
-    }
-  },
-  "tie_word_embeddings": false,
-  "torch_dtype": "float32",
-  "transformers_version": "4.34.1",
-  "use_cache": true,
-  "vocab_size": 32128
-}

generation_config.json DELETED Viewed

@@ -1,6 +0,0 @@
-{
-  "decoder_start_token_id": 0,
-  "eos_token_id": 1,
-  "pad_token_id": 0,
-  "transformers_version": "4.34.1"
-}

last-checkpoint/config.json DELETED Viewed

@@ -1,62 +0,0 @@
-{
-  "_name_or_path": "google/flan-t5-base",
-  "architectures": [
-    "T5ForConditionalGeneration"
-  ],
-  "classifier_dropout": 0.0,
-  "d_ff": 2048,
-  "d_kv": 64,
-  "d_model": 768,
-  "decoder_start_token_id": 0,
-  "dense_act_fn": "gelu_new",
-  "dropout_rate": 0.1,
-  "eos_token_id": 1,
-  "feed_forward_proj": "gated-gelu",
-  "initializer_factor": 1.0,
-  "is_encoder_decoder": true,
-  "is_gated_act": true,
-  "layer_norm_epsilon": 1e-06,
-  "model_type": "t5",
-  "n_positions": 512,
-  "num_decoder_layers": 12,
-  "num_heads": 12,
-  "num_layers": 12,
-  "output_past": true,
-  "pad_token_id": 0,
-  "relative_attention_max_distance": 128,
-  "relative_attention_num_buckets": 32,
-  "task_specific_params": {
-    "summarization": {
-      "early_stopping": true,
-      "length_penalty": 2.0,
-      "max_length": 200,
-      "min_length": 30,
-      "no_repeat_ngram_size": 3,
-      "num_beams": 4,
-      "prefix": "summarize: "
-    },
-    "translation_en_to_de": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to German: "
-    },
-    "translation_en_to_fr": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to French: "
-    },
-    "translation_en_to_ro": {
-      "early_stopping": true,
-      "max_length": 300,
-      "num_beams": 4,
-      "prefix": "translate English to Romanian: "
-    }
-  },
-  "tie_word_embeddings": false,
-  "torch_dtype": "float32",
-  "transformers_version": "4.34.1",
-  "use_cache": true,
-  "vocab_size": 32128
-}

last-checkpoint/generation_config.json DELETED Viewed

@@ -1,6 +0,0 @@
-{
-  "decoder_start_token_id": 0,
-  "eos_token_id": 1,
-  "pad_token_id": 0,
-  "transformers_version": "4.34.1"
-}

last-checkpoint/optimizer.pt DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:095b3a1f6740c3523f4d618eb6e304dac8fadfe4f53deea6f89e7adff3341492
-size 2371770

last-checkpoint/pytorch_model.bin DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:e1a76fa844f3a3191566c354079a7f4bc5694f5240c5233e76e250c0f6fce96d
-size 990409330

last-checkpoint/rng_state.pth DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:443ad106e89f5c225106f610ada6104a4bdb83f20e5790a9a64bb3871f9500ee
-size 14244

last-checkpoint/scheduler.pt DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:6ff0f9f47b6a148ea17a10b4a36afba9e6cfc279b51fe048a45e8fbccd92f97e
-size 1064

last-checkpoint/trainer_state.json DELETED Viewed

@@ -1,336 +0,0 @@
-{
-  "best_metric": 2.0005455017089844,
-  "best_model_checkpoint": "dq158/coqui/checkpoint-9143",
-  "epoch": 10.999097744360903,
-  "eval_steps": 500,
-  "global_step": 9143,
-  "is_hyper_param_search": false,
-  "is_local_process_zero": true,
-  "is_world_process_zero": true,
-  "log_history": [
-    {
-      "epoch": 0.6,
-      "learning_rate": 9e-05,
-      "loss": 3.0484,
-      "step": 500
-    },
-    {
-      "epoch": 1.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.320953369140625,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 54898,
-      "eval_runtime": 620.4093,
-      "eval_samples_per_second": 4.765,
-      "eval_steps_per_second": 0.596,
-      "eval_translation_length": 54898,
-      "step": 831
-    },
-    {
-      "epoch": 1.2,
-      "learning_rate": 8.978652426235755e-05,
-      "loss": 2.5083,
-      "step": 1000
-    },
-    {
-      "epoch": 1.8,
-      "learning_rate": 8.914812246678847e-05,
-      "loss": 2.3881,
-      "step": 1500
-    },
-    {
-      "epoch": 2.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.1850905418395996,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 55985,
-      "eval_runtime": 613.0871,
-      "eval_samples_per_second": 4.822,
-      "eval_steps_per_second": 0.604,
-      "eval_translation_length": 55985,
-      "step": 1662
-    },
-    {
-      "epoch": 2.41,
-      "learning_rate": 8.809085164859153e-05,
-      "loss": 2.2764,
-      "step": 2000
-    },
-    {
-      "epoch": 3.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.1248879432678223,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56111,
-      "eval_runtime": 612.445,
-      "eval_samples_per_second": 4.827,
-      "eval_steps_per_second": 0.604,
-      "eval_translation_length": 56111,
-      "step": 2493
-    },
-    {
-      "epoch": 3.01,
-      "learning_rate": 8.662474299300236e-05,
-      "loss": 2.2434,
-      "step": 2500
-    },
-    {
-      "epoch": 3.61,
-      "learning_rate": 8.476370666120834e-05,
-      "loss": 2.1919,
-      "step": 3000
-    },
-    {
-      "epoch": 4.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0848147869110107,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56105,
-      "eval_runtime": 610.0346,
-      "eval_samples_per_second": 4.846,
-      "eval_steps_per_second": 0.607,
-      "eval_translation_length": 56105,
-      "step": 3325
-    },
-    {
-      "epoch": 4.21,
-      "learning_rate": 8.252539981337433e-05,
-      "loss": 2.1471,
-      "step": 3500
-    },
-    {
-      "epoch": 4.81,
-      "learning_rate": 7.993105908085196e-05,
-      "loss": 2.118,
-      "step": 4000
-    },
-    {
-      "epoch": 5.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0643346309661865,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56093,
-      "eval_runtime": 609.9445,
-      "eval_samples_per_second": 4.846,
-      "eval_steps_per_second": 0.607,
-      "eval_translation_length": 56093,
-      "step": 4156
-    },
-    {
-      "epoch": 5.41,
-      "learning_rate": 7.700529907704438e-05,
-      "loss": 2.0902,
-      "step": 4500
-    },
-    {
-      "epoch": 6.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.043013334274292,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56093,
-      "eval_runtime": 610.4388,
-      "eval_samples_per_second": 4.842,
-      "eval_steps_per_second": 0.606,
-      "eval_translation_length": 56093,
-      "step": 4987
-    },
-    {
-      "epoch": 6.02,
-      "learning_rate": 7.377587885861725e-05,
-      "loss": 2.0863,
-      "step": 5000
-    },
-    {
-      "epoch": 6.62,
-      "learning_rate": 7.027343855282776e-05,
-      "loss": 2.0434,
-      "step": 5500
-    },
-    {
-      "epoch": 7.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.028670310974121,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56086,
-      "eval_runtime": 610.2247,
-      "eval_samples_per_second": 4.844,
-      "eval_steps_per_second": 0.606,
-      "eval_translation_length": 56086,
-      "step": 5818
-    },
-    {
-      "epoch": 7.22,
-      "learning_rate": 6.653120864980153e-05,
-      "loss": 2.0282,
-      "step": 6000
-    },
-    {
-      "epoch": 7.82,
-      "learning_rate": 6.258469471793752e-05,
-      "loss": 2.0107,
-      "step": 6500
-    },
-    {
-      "epoch": 8.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0178780555725098,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56070,
-      "eval_runtime": 609.3401,
-      "eval_samples_per_second": 4.851,
-      "eval_steps_per_second": 0.607,
-      "eval_translation_length": 56070,
-      "step": 6650
-    },
-    {
-      "epoch": 8.42,
-      "learning_rate": 5.8471340533801125e-05,
-      "loss": 1.986,
-      "step": 7000
-    },
-    {
-      "epoch": 9.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0124728679656982,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56071,
-      "eval_runtime": 610.7638,
-      "eval_samples_per_second": 4.84,
-      "eval_steps_per_second": 0.606,
-      "eval_translation_length": 56071,
-      "step": 7481
-    },
-    {
-      "epoch": 9.02,
-      "learning_rate": 5.4230172822665325e-05,
-      "loss": 1.983,
-      "step": 7500
-    },
-    {
-      "epoch": 9.62,
-      "learning_rate": 4.9901430980334607e-05,
-      "loss": 1.9669,
-      "step": 8000
-    },
-    {
-      "epoch": 10.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0042803287506104,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 55997,
-      "eval_runtime": 611.382,
-      "eval_samples_per_second": 4.835,
-      "eval_steps_per_second": 0.605,
-      "eval_translation_length": 55997,
-      "step": 8312
-    },
-    {
-      "epoch": 10.23,
-      "learning_rate": 4.552618528938031e-05,
-      "loss": 1.9494,
-      "step": 8500
-    },
-    {
-      "epoch": 10.83,
-      "learning_rate": 4.114594725207993e-05,
-      "loss": 1.9375,
-      "step": 9000
-    },
-    {
-      "epoch": 11.0,
-      "eval_bleu": 1.0,
-      "eval_brevity_penalty": 1.0,
-      "eval_length_ratio": 1.0,
-      "eval_loss": 2.0005455017089844,
-      "eval_precisions": [
-        1.0,
-        1.0,
-        1.0,
-        1.0
-      ],
-      "eval_reference_length": 56078,
-      "eval_runtime": 610.5262,
-      "eval_samples_per_second": 4.842,
-      "eval_steps_per_second": 0.606,
-      "eval_translation_length": 56078,
-      "step": 9143
-    }
-  ],
-  "logging_steps": 500,
-  "max_steps": 16620,
-  "num_train_epochs": 20,
-  "save_steps": 500,
-  "total_flos": 2.0034493666453094e+17,
-  "trial_name": null,
-  "trial_params": null
-}

last-checkpoint/training_args.bin DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:bb979b12971fd8db8ac0c730868c028dff7eb6b6489e260350ad8e97e8318b11
-size 4664

pytorch_model.bin DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:e1a76fa844f3a3191566c354079a7f4bc5694f5240c5233e76e250c0f6fce96d
-size 990409330

tokenizer (1).json DELETED Viewed

The diff for this file is too large to render. See raw diff

tokenizer.json DELETED Viewed

The diff for this file is too large to render. See raw diff

tokenizer_config (1).json DELETED Viewed

@@ -1,10 +0,0 @@
-{
-  "eos_token": "</s>",
-  "extra_ids": 100,
-  "model_max_length": 512,
-  "name_or_path": "google/flan-t5-base",
-  "pad_token": "<pad>",
-  "sp_model_kwargs": {},
-  "tokenizer_class": "T5Tokenizer",
-  "unk_token": "<unk>"
-}

tokenizer_config.json DELETED Viewed

@@ -1,10 +0,0 @@
-{
-  "eos_token": "</s>",
-  "extra_ids": 100,
-  "model_max_length": 512,
-  "name_or_path": "google/flan-t5-base",
-  "pad_token": "<pad>",
-  "sp_model_kwargs": {},
-  "tokenizer_class": "T5Tokenizer",
-  "unk_token": "<unk>"
-}

training_args.bin DELETED Viewed

@@ -1,3 +0,0 @@
-version https://git-lfs.github.com/spec/v1
-oid sha256:bb979b12971fd8db8ac0c730868c028dff7eb6b6489e260350ad8e97e8318b11
-size 4664