Sentence Similarity
sentence-transformers
TensorBoard
Safetensors
Vietnamese
Vietnamese
feature-extraction
dense
Generated from Trainer
dataset_size:81409
loss:TripletLoss
custom_code
Eval Results (legacy)
Instructions to use KietReal/vietnamese-document-embedding_FT_QQP with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use KietReal/vietnamese-document-embedding_FT_QQP with sentence-transformers:
from sentence_transformers import SentenceTransformer model = SentenceTransformer("KietReal/vietnamese-document-embedding_FT_QQP", trust_remote_code=True) sentences = [ "Đâu là lập luận tồi tệ nhất trên thế giới?", "Một số ví dụ về phương tiện giao thông cũ và hiện đại là gì?", "Trận chiến nào trong lịch sử thế giới là tồi tệ nhất?", "Cuộc tranh luận tồi tệ nhất trên thế giới là gì?" ] embeddings = model.encode(sentences) similarities = model.similarity(embeddings, embeddings) print(similarities.shape) # [4, 4] - Notebooks
- Google Colab
- Kaggle
| { | |
| "added_tokens_decoder": { | |
| "0": { | |
| "content": "<s>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false, | |
| "special": true | |
| }, | |
| "1": { | |
| "content": "<pad>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false, | |
| "special": true | |
| }, | |
| "2": { | |
| "content": "</s>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false, | |
| "special": true | |
| }, | |
| "3": { | |
| "content": "<unk>", | |
| "lstrip": false, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false, | |
| "special": true | |
| }, | |
| "250001": { | |
| "content": "<mask>", | |
| "lstrip": true, | |
| "normalized": false, | |
| "rstrip": false, | |
| "single_word": false, | |
| "special": true | |
| } | |
| }, | |
| "bos_token": "<s>", | |
| "clean_up_tokenization_spaces": true, | |
| "cls_token": "<s>", | |
| "eos_token": "</s>", | |
| "extra_special_tokens": {}, | |
| "mask_token": "<mask>", | |
| "max_length": 8192, | |
| "model_max_length": 8192, | |
| "pad_to_multiple_of": null, | |
| "pad_token": "<pad>", | |
| "pad_token_type_id": 0, | |
| "padding_side": "right", | |
| "sep_token": "</s>", | |
| "stride": 0, | |
| "tokenizer_class": "XLMRobertaTokenizerFast", | |
| "truncation_side": "right", | |
| "truncation_strategy": "longest_first", | |
| "unk_token": "<unk>" | |
| } | |