Text Classification
sentence-transformers
Safetensors
xlm-roberta
cross-encoder
reranker
Generated from Trainer
dataset_size:82796
loss:CrossEntropyLoss
Eval Results (legacy)
text-embeddings-inference
Instructions to use Chimalpopoka/CrossEncoderRanker with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use Chimalpopoka/CrossEncoderRanker with sentence-transformers:
from sentence_transformers import CrossEncoder model = CrossEncoder("Chimalpopoka/CrossEncoderRanker") query = "Which planet is known as the Red Planet?" passages = [ "Venus is often called Earth's twin because of its similar size and proximity.", "Mars, known for its reddish appearance, is often referred to as the Red Planet.", "Jupiter, the largest planet in our solar system, has a prominent red spot.", "Saturn, famous for its rings, is sometimes mistaken for the Red Planet." ] scores = model.predict([(query, passage) for passage in passages]) print(scores) - Notebooks
- Google Colab
- Kaggle
New version
Browse files- README.md +36 -36
- model.safetensors +1 -1
README.md
CHANGED
|
@@ -24,13 +24,13 @@ model-index:
|
|
| 24 |
type: softmax_accuracy_eval
|
| 25 |
metrics:
|
| 26 |
- type: f1_macro
|
| 27 |
-
value: 0.
|
| 28 |
name: F1 Macro
|
| 29 |
- type: f1_micro
|
| 30 |
-
value: 0.
|
| 31 |
name: F1 Micro
|
| 32 |
- type: f1_weighted
|
| 33 |
-
value: 0.
|
| 34 |
name: F1 Weighted
|
| 35 |
---
|
| 36 |
|
|
@@ -74,11 +74,11 @@ from sentence_transformers import CrossEncoder
|
|
| 74 |
model = CrossEncoder("Chimalpopoka/CrossEncoderRanker")
|
| 75 |
# Get scores for pairs of texts
|
| 76 |
pairs = [
|
| 77 |
-
['
|
| 78 |
-
['
|
| 79 |
-
['П
|
| 80 |
-
['
|
| 81 |
-
['
|
| 82 |
]
|
| 83 |
scores = model.predict(pairs)
|
| 84 |
print(scores.shape)
|
|
@@ -120,9 +120,9 @@ You can finetune this model on your own dataset.
|
|
| 120 |
|
| 121 |
| Metric | Value |
|
| 122 |
|:-------------|:-----------|
|
| 123 |
-
| **f1_macro** | **0.
|
| 124 |
-
| f1_micro | 0.
|
| 125 |
-
| f1_weighted | 0.
|
| 126 |
|
| 127 |
<!--
|
| 128 |
## Bias, Risks and Limitations
|
|
@@ -148,13 +148,13 @@ You can finetune this model on your own dataset.
|
|
| 148 |
| | sentence_0 | sentence_1 | label |
|
| 149 |
|:--------|:-----------------------------------------------------------------------------------------------|:-----------------------------------------------------------------------------------------------|:------------------------------------------------|
|
| 150 |
| type | string | string | int |
|
| 151 |
-
| details | <ul><li>min:
|
| 152 |
* Samples:
|
| 153 |
-
| sentence_0
|
| 154 |
-
|:-------------------------------------------------------------------------------------------------------------------------------
|
| 155 |
-
| <code>
|
| 156 |
-
| <code>
|
| 157 |
-
| <code>П
|
| 158 |
* Loss: [<code>CrossEntropyLoss</code>](https://sbert.net/docs/package_reference/cross_encoder/losses.html#crossentropyloss)
|
| 159 |
|
| 160 |
### Training Hyperparameters
|
|
@@ -289,26 +289,26 @@ You can finetune this model on your own dataset.
|
|
| 289 |
### Training Logs
|
| 290 |
| Epoch | Step | Training Loss | softmax_accuracy_eval_f1_macro |
|
| 291 |
|:------:|:-----:|:-------------:|:------------------------------:|
|
| 292 |
-
| 0.0458 | 500 | 0.
|
| 293 |
-
| 0.0915 | 1000 | 0.
|
| 294 |
-
| 0.1373 | 1500 | 0.
|
| 295 |
-
| 0.1831 | 2000 | 0.
|
| 296 |
-
| 0.2288 | 2500 | 0.
|
| 297 |
-
| 0.2746 | 3000 | 0.
|
| 298 |
-
| 0.3204 | 3500 | 0.
|
| 299 |
-
| 0.3661 | 4000 | 0.
|
| 300 |
-
| 0.4119 | 4500 | 0.
|
| 301 |
-
| 0.4577 | 5000 | 0.
|
| 302 |
-
| 0.5034 | 5500 | 0.
|
| 303 |
-
| 0.5492 | 6000 | 0.
|
| 304 |
-
| 0.5950 | 6500 | 0.
|
| 305 |
-
| 0.6407 | 7000 | 0.
|
| 306 |
| 0.6865 | 7500 | 0.1339 | - |
|
| 307 |
-
| 0.7323 | 8000 | 0.
|
| 308 |
-
| 0.7780 | 8500 | 0.
|
| 309 |
-
| 0.8238 | 9000 | 0.
|
| 310 |
-
| 0.8696 | 9500 | 0.
|
| 311 |
-
| 0.9153 | 10000 | 0.
|
| 312 |
|
| 313 |
|
| 314 |
### Framework Versions
|
|
|
|
| 24 |
type: softmax_accuracy_eval
|
| 25 |
metrics:
|
| 26 |
- type: f1_macro
|
| 27 |
+
value: 0.9726781946411447
|
| 28 |
name: F1 Macro
|
| 29 |
- type: f1_micro
|
| 30 |
+
value: 0.9753250742295485
|
| 31 |
name: F1 Micro
|
| 32 |
- type: f1_weighted
|
| 33 |
+
value: 0.9752858934461676
|
| 34 |
name: F1 Weighted
|
| 35 |
---
|
| 36 |
|
|
|
|
| 74 |
model = CrossEncoder("Chimalpopoka/CrossEncoderRanker")
|
| 75 |
# Get scores for pairs of texts
|
| 76 |
pairs = [
|
| 77 |
+
['Свободный кортизол, суточная\xa0моча (Free Сortisol, Free Hydrocortisone, 24-Hour urine)', 'Кортизол в разовой порции мочи'],
|
| 78 |
+
['Определение антител класса G (IgG) к RBD домену S белка вируса SARS-CoV-2 (COVID-19), количественное исследование', 'Антитела к миокарду, IgG'],
|
| 79 |
+
['Прием (осмотр, консультация) врача-терапевта, первичный', 'Консультация врача, в клинике, терапевт'],
|
| 80 |
+
['Вакцинация против гепатита В для взрослых', 'Вакцинация против гепатита А. Вакцина: Альгавак М (Россия)'],
|
| 81 |
+
['АТ к миокарду', 'Антитела к миокарду, IgG'],
|
| 82 |
]
|
| 83 |
scores = model.predict(pairs)
|
| 84 |
print(scores.shape)
|
|
|
|
| 120 |
|
| 121 |
| Metric | Value |
|
| 122 |
|:-------------|:-----------|
|
| 123 |
+
| **f1_macro** | **0.9727** |
|
| 124 |
+
| f1_micro | 0.9753 |
|
| 125 |
+
| f1_weighted | 0.9753 |
|
| 126 |
|
| 127 |
<!--
|
| 128 |
## Bias, Risks and Limitations
|
|
|
|
| 148 |
| | sentence_0 | sentence_1 | label |
|
| 149 |
|:--------|:-----------------------------------------------------------------------------------------------|:-----------------------------------------------------------------------------------------------|:------------------------------------------------|
|
| 150 |
| type | string | string | int |
|
| 151 |
+
| details | <ul><li>min: 4 characters</li><li>mean: 68.59 characters</li><li>max: 747 characters</li></ul> | <ul><li>min: 3 characters</li><li>mean: 63.11 characters</li><li>max: 281 characters</li></ul> | <ul><li>0: ~34.30%</li><li>1: ~65.70%</li></ul> |
|
| 152 |
* Samples:
|
| 153 |
+
| sentence_0 | sentence_1 | label |
|
| 154 |
+
|:-------------------------------------------------------------------------------------------------------------------------------|:-----------------------------------------------------|:---------------|
|
| 155 |
+
| <code>Свободный кортизол, суточная моча (Free Сortisol, Free Hydrocortisone, 24-Hour urine)</code> | <code>Кортизол в разовой порции мочи</code> | <code>1</code> |
|
| 156 |
+
| <code>Определение антител класса G (IgG) к RBD домену S белка вируса SARS-CoV-2 (COVID-19), количественное исследование</code> | <code>Антитела к миокарду, IgG</code> | <code>0</code> |
|
| 157 |
+
| <code>Прием (осмотр, консультация) врача-терапевта, первичный</code> | <code>Консультация врача, в клинике, терапевт</code> | <code>1</code> |
|
| 158 |
* Loss: [<code>CrossEntropyLoss</code>](https://sbert.net/docs/package_reference/cross_encoder/losses.html#crossentropyloss)
|
| 159 |
|
| 160 |
### Training Hyperparameters
|
|
|
|
| 289 |
### Training Logs
|
| 290 |
| Epoch | Step | Training Loss | softmax_accuracy_eval_f1_macro |
|
| 291 |
|:------:|:-----:|:-------------:|:------------------------------:|
|
| 292 |
+
| 0.0458 | 500 | 0.5651 | - |
|
| 293 |
+
| 0.0915 | 1000 | 0.2182 | - |
|
| 294 |
+
| 0.1373 | 1500 | 0.2239 | - |
|
| 295 |
+
| 0.1831 | 2000 | 0.2015 | 0.9616 |
|
| 296 |
+
| 0.2288 | 2500 | 0.1617 | - |
|
| 297 |
+
| 0.2746 | 3000 | 0.1942 | - |
|
| 298 |
+
| 0.3204 | 3500 | 0.1888 | - |
|
| 299 |
+
| 0.3661 | 4000 | 0.1772 | 0.9629 |
|
| 300 |
+
| 0.4119 | 4500 | 0.1635 | - |
|
| 301 |
+
| 0.4577 | 5000 | 0.1596 | - |
|
| 302 |
+
| 0.5034 | 5500 | 0.1709 | - |
|
| 303 |
+
| 0.5492 | 6000 | 0.1566 | 0.9640 |
|
| 304 |
+
| 0.5950 | 6500 | 0.1278 | - |
|
| 305 |
+
| 0.6407 | 7000 | 0.1276 | - |
|
| 306 |
| 0.6865 | 7500 | 0.1339 | - |
|
| 307 |
+
| 0.7323 | 8000 | 0.1422 | 0.9715 |
|
| 308 |
+
| 0.7780 | 8500 | 0.148 | - |
|
| 309 |
+
| 0.8238 | 9000 | 0.1271 | - |
|
| 310 |
+
| 0.8696 | 9500 | 0.125 | - |
|
| 311 |
+
| 0.9153 | 10000 | 0.1103 | 0.9727 |
|
| 312 |
|
| 313 |
|
| 314 |
### Framework Versions
|
model.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 1436163192
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e0a48779da0c723b69244f105bcfe6fbdd5f0dd684df10755a54771196015f8f
|
| 3 |
size 1436163192
|