File size: 1,144 Bytes
b24db55
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
---
license: other
library_name: transformers
pipeline_tag: text-generation
---

# Steerling-8B

Steerling-8B is an interpretable causal diffusion language model introduced in the paper [Scaling Inherently Interpretable Language Models](https://huggingface.co/papers/2608.07594).

- Project page: [https://www.guidelabs.ai/papers/scaling-inherently-interpretable-language-models/](https://www.guidelabs.ai/papers/scaling-inherently-interpretable-language-models/)
- Code: [https://github.com/guidelabs/steerling](https://github.com/guidelabs/steerling)

## Usage

```python
import torch
from transformers import AutoModel, AutoTokenizer
from steerling import SteerlingGenerator, GenerationConfig

model_id = "guidelabs/steerling-8b"
model = AutoModel.from_pretrained(model_id, trust_remote_code=True, dtype=torch.bfloat16)
tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
generator = SteerlingGenerator.from_model(model, tokenizer, device="cuda")

prompt = "The key to understanding neural networks is"
config = GenerationConfig(max_new_tokens=128, steps=128)
text = generator.generate(prompt, config)
print(text)
```