nielsr HF Staff commited on
Commit
b24db55
·
verified ·
1 Parent(s): 6e5a87d

Add model card

Browse files

This PR adds a model card for the paper [Scaling Inherently Interpretable Language Models](https://huggingface.co/papers/2608.07594), including metadata (pipeline tag, library, license), links to the project page and code, and a usage snippet from the official GitHub README.

Files changed (1) hide show
  1. README.md +30 -0
README.md ADDED
@@ -0,0 +1,30 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: other
3
+ library_name: transformers
4
+ pipeline_tag: text-generation
5
+ ---
6
+
7
+ # Steerling-8B
8
+
9
+ Steerling-8B is an interpretable causal diffusion language model introduced in the paper [Scaling Inherently Interpretable Language Models](https://huggingface.co/papers/2608.07594).
10
+
11
+ - Project page: [https://www.guidelabs.ai/papers/scaling-inherently-interpretable-language-models/](https://www.guidelabs.ai/papers/scaling-inherently-interpretable-language-models/)
12
+ - Code: [https://github.com/guidelabs/steerling](https://github.com/guidelabs/steerling)
13
+
14
+ ## Usage
15
+
16
+ ```python
17
+ import torch
18
+ from transformers import AutoModel, AutoTokenizer
19
+ from steerling import SteerlingGenerator, GenerationConfig
20
+
21
+ model_id = "guidelabs/steerling-8b"
22
+ model = AutoModel.from_pretrained(model_id, trust_remote_code=True, dtype=torch.bfloat16)
23
+ tokenizer = AutoTokenizer.from_pretrained(model_id, trust_remote_code=True)
24
+ generator = SteerlingGenerator.from_model(model, tokenizer, device="cuda")
25
+
26
+ prompt = "The key to understanding neural networks is"
27
+ config = GenerationConfig(max_new_tokens=128, steps=128)
28
+ text = generator.generate(prompt, config)
29
+ print(text)
30
+ ```