Text Generation
Transformers
Portuguese
English
delta_llm
delta
llm
causal-lm
portuguese
english
experimental
Instructions to use PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-generation", model="PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2")# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2", device_map="auto") - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- vLLM
How to use PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2 with vLLM:
Install from pip and serve model
# Install vLLM from pip: pip install vllm # Start the vLLM server: vllm serve "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2" # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:8000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker
docker model run hf.co/PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2
- SGLang
How to use PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2 with SGLang:
Install from pip and serve model
# Install SGLang from pip: pip install sglang # Start the SGLang server: python3 -m sglang.launch_server \ --model-path "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }'Use Docker images
docker run --gpus all \ --shm-size 32g \ -p 30000:30000 \ -v ~/.cache/huggingface:/root/.cache/huggingface \ --env "HF_TOKEN=<secret>" \ --ipc=host \ lmsysorg/sglang:latest \ python3 -m sglang.launch_server \ --model-path "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2" \ --host 0.0.0.0 \ --port 30000 # Call the server using curl (OpenAI-compatible API): curl -X POST "http://localhost:30000/v1/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2", "prompt": "Once upon a time,", "max_tokens": 512, "temperature": 0.5 }' - Docker Model Runner
How to use PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2 with Docker Model Runner:
docker model run hf.co/PyraLabs/Coming-Soon-Delta-Ultra-Mini-1.2
File size: 4,774 Bytes
6151c50 57461a5 6151c50 66fb7a6 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 8f91765 188c32e 6151c50 188c32e 6151c50 188c32e ffd9dba 8f91765 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 188c32e 6151c50 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 | ---
language:
- pt
- en
license: mit
pipeline_tag: text-generation
model_type: delta_llm
library_name: transformers
tags:
- delta
- llm
- causal-lm
- portuguese
- english
- experimental
license_name: mit
---
## Por favor não baixe o modelo pois não está disponível
# Delta Ultra Mini 1.2
> **Em breve**
## Visão Geral
O **Delta Ultra Mini 1.2** é a próxima geração da família Delta Ultra Mini, desenvolvido como parte do projeto experimental da **FlareAI** para pesquisa em modelos de linguagem leves.
Esta versão apresenta um conjunto de dados significativamente refinado e uma arquitetura expandida em relação ao Delta Ultra Mini 1.1. O principal objetivo é avaliar como essas melhorias influenciam a qualidade das respostas e fornecer uma base mais sólida para o desenvolvimento das futuras versões da família Delta.
Como todo modelo em desenvolvimento, o Delta Ultra Mini 1.2 ainda possui limitações e pode gerar respostas incorretas ou inconsistentes (alucinações). O modelo deve ser considerado um projeto experimental voltado para aprendizado, pesquisa e evolução contínua.
---
## Destaques
* 🧠 Aproximadamente **306,5 milhões de parâmetros**
* 📚 Dataset refinado e expandido
* 🔬 Foco em pesquisa e experimentação
* ✨ Melhor compreensão e seguimento de instruções
* 💬 Conversas mais coerentes em relação à versão anterior
* 🔧 Melhorias gerais na qualidade das respostas
> E nós estamos tentando (como experimento) fazer um SLM agente, para rodar em seus dispositivos móveis, com suporte a tool calling.
> Não garantimos que realmente saia o modelo agente, mas estamos realmente dando o nosso melhor.
---
## Novidades
Em comparação com o Delta Ultra Mini 1.1, a versão 1.2 traz:
* Um dataset amplamente refinado com exemplos de maior qualidade;
* Melhor filtragem de dados duplicados e conteúdos com ruído;
* Melhor equilíbrio entre conteúdos conversacionais, instrucionais e técnicos;
* Geração de texto mais estável;
* Melhor compreensão do contexto durante as conversas.
---
## Informações do Modelo
| Propriedade | Valor |
| ------------------ | --------------------------- |
| Modelo | Delta Ultra Mini 1.2 |
| Status | Em desenvolvimento |
| Parâmetros | ~306,5 milhões |
| Arquitetura | Transformer Decoder-only |
| Idiomas principais | Português (Brasil) e Inglês |
| Janela de contexto | A definir |
| Licença | MIT |
---
## Casos de Uso
O Delta Ultra Mini 1.2 foi desenvolvido para:
* Conversas gerais
* Assistência em programação
* Escrita criativa
* Respostas a perguntas
* Aplicações educacionais
* Assistentes de IA locais
* Projetos experimentais
---
## Limitações
Por se tratar de um modelo experimental, o Delta Ultra Mini 1.2 ainda apresenta limitações conhecidas:
* Pode gerar informações incorretas (alucinações);
* Nem sempre seguirá instruções perfeitamente;
* O desempenho pode variar dependendo da tarefa e do idioma;
* Não é recomendado para aplicações críticas ou que exijam alta confiabilidade.
---
## Objetivos da Versão
Os principais objetivos do Delta Ultra Mini 1.2 são:
* Aumentar a qualidade das respostas;
* Reduzir inconsistências em relação à versão anterior;
* Melhorar o seguimento de instruções;
* Aprimorar as capacidades multilíngues;
* Construir uma base mais sólida para os futuros modelos da família Delta.
---
## Contribua com o The Delta Dataset
O desenvolvimento do **Delta Ultra Mini 1.2** é impulsionado pelo **The Delta Dataset**, um projeto colaborativo e de código aberto baseado no formato **Deltaset**.
Se você deseja contribuir para a evolução deste modelo ou ajudar outras pessoas a desenvolverem suas próprias LLMs utilizando o formato Deltaset, participe do projeto:
**https://github.com/Flame-FlareAI/The-Delta-Dataset**
Todas as contribuições passam por revisão antes de serem incorporadas ao dataset, ajudando a manter a qualidade e a consistência dos dados para toda a comunidade.
---
## Roadmap
O Delta Ultra Mini 1.2 representa mais um passo na evolução do ecossistema Delta.
As próximas versões terão modelos maiores e mais capazes, mantendo a filosofia da linha **Ultra Mini**: oferecer modelos leves, acessíveis e voltados para pesquisa, aprendizado e experimentação.
---
## Disponibilidade
O modelo está atualmente em desenvolvimento e será disponibilizado após a conclusão dos testes internos.
Fique atento aos próximos anúncios e, se desejar participar do desenvolvimento, contribua com o **The Delta Dataset**.
---
**Desenvolvido pela FlareAI**
|