Daily download history, rankings and derivative families for every model on the Hub.
Tardelli Stekel
tardellirs
P(doom) <0.001%
Β·
AI & ML interests
None yet
Recent Activity
updated a Space about 7 hours ago
tardellirs/model-pulse updated a Space about 7 hours ago
tardellirs/paper-pulse updated a dataset about 7 hours ago
tardellirs/paper-pulse-dataOrganizations
Colibri β Brazilian-Portuguese Embeddings
Compact pt-br text-embedding model (~157M) that beats far larger models on MTEB(por): vocabulary trim -> Qwen3-4B distillation -> model soup.
EmbeddingGemma PT-BR (vocabulary-trimmed)
Portuguese EmbeddingGemma-300M, vocab-trimmed 16kβ128k. Training-free; 64k β full quality at half the params.
-
tardellirs/embeddinggemma-pt-br
Sentence Similarity β’ 0.2B β’ Updated β’ 2.47k β’ 1 -
tardellirs/embeddinggemma-pt-br-128k
Sentence Similarity β’ 0.2B β’ Updated β’ 78 β’ 1 -
tardellirs/embeddinggemma-pt-br-48k
Sentence Similarity β’ 0.1B β’ Updated β’ 71 β’ 1 -
tardellirs/embeddinggemma-pt-br-32k
Sentence Similarity β’ 0.1B β’ Updated β’ 62 β’ 2
MTEB(por) β Brazilian-Portuguese Embeddings
The MTEB(por) benchmark for Brazilian Portuguese (leaderboard + task datasets) and the Colibri embedding model that tops it among small models.
BrazEmbed-PT-BR
Contamination-clean ~110M Brazilian-Portuguese embeddings (BERTimbau). #1 in the ~100M class on MTEB(por).
-
tardellirs/brazembed-pt-br
Sentence Similarity β’ 0.1B β’ Updated β’ 705 β’ 2 -
tardellirs/brazembed-pt-br-clfclu
Sentence Similarity β’ 0.1B β’ Updated β’ 68 -
tardellirs/brazembed-pt-br-pairclf
Sentence Similarity β’ 0.1B β’ Updated β’ 55 -
tardellirs/brazembed-pt-br-sts
Sentence Similarity β’ 0.1B β’ Updated β’ 89
Hugging Face Hub analytics
Daily download history, rankings and derivative families for every model on the Hub.
MTEB(por) β Brazilian-Portuguese Embeddings
The MTEB(por) benchmark for Brazilian Portuguese (leaderboard + task datasets) and the Colibri embedding model that tops it among small models.
Colibri β Brazilian-Portuguese Embeddings
Compact pt-br text-embedding model (~157M) that beats far larger models on MTEB(por): vocabulary trim -> Qwen3-4B distillation -> model soup.
BrazEmbed-PT-BR
Contamination-clean ~110M Brazilian-Portuguese embeddings (BERTimbau). #1 in the ~100M class on MTEB(por).
-
tardellirs/brazembed-pt-br
Sentence Similarity β’ 0.1B β’ Updated β’ 705 β’ 2 -
tardellirs/brazembed-pt-br-clfclu
Sentence Similarity β’ 0.1B β’ Updated β’ 68 -
tardellirs/brazembed-pt-br-pairclf
Sentence Similarity β’ 0.1B β’ Updated β’ 55 -
tardellirs/brazembed-pt-br-sts
Sentence Similarity β’ 0.1B β’ Updated β’ 89
EmbeddingGemma PT-BR (vocabulary-trimmed)
Portuguese EmbeddingGemma-300M, vocab-trimmed 16kβ128k. Training-free; 64k β full quality at half the params.
-
tardellirs/embeddinggemma-pt-br
Sentence Similarity β’ 0.2B β’ Updated β’ 2.47k β’ 1 -
tardellirs/embeddinggemma-pt-br-128k
Sentence Similarity β’ 0.2B β’ Updated β’ 78 β’ 1 -
tardellirs/embeddinggemma-pt-br-48k
Sentence Similarity β’ 0.1B β’ Updated β’ 71 β’ 1 -
tardellirs/embeddinggemma-pt-br-32k
Sentence Similarity β’ 0.1B β’ Updated β’ 62 β’ 2