wpferrell commited on
Commit
bb06bb2
Β·
verified Β·
1 Parent(s): 24474a1

docs: v3.13.0 card update

Browse files
Files changed (1) hide show
  1. README.md +89 -1
README.md CHANGED
@@ -1 +1,89 @@
1
- TFMwdERRcHNhV05sYm5ObE9pQnRhWFFOQ25SaFozTTZEUW9nSUMwZ1ltbG5jMjFoYkd3TkNpQWdMU0JqYjIxd2NtVnpjMlZrRFFvZ0lDMGdiRzl6YzJ4bGMzTU5DaTB0TFEwS0Nsc2hXMFJQU1Ywb2FIUjBjSE02THk5NlpXNXZaRzh1YjNKbkwySmhaR2RsTDBSUFNTOHhNQzQxTWpneEwzcGxibTlrYnk0eU1ESTNPVEkwT0M1emRtY3BYU2hvZEhSd2N6b3ZMMlJ2YVM1dmNtY3ZNVEF1TlRJNE1TOTZaVzV2Wkc4dU1qQXlOemt5TkRncENnMEtJeUJIVUZRdE1pRGlnSlFnUW1sblUyMWhiR3dnUTI5dGNISmxjM05sWkEwS0RRcE1iM056YkdWemN5QmpiMjF3Y21WemMyVmtJSFpsY25OcGIyNGdiMllnVzJkd2RESmRLR2gwZEhCek9pOHZhSFZuWjJsdVoyWmhZMlV1WTI4dlozQjBNaWt1RFFvcUtqYzFMalVsSUhOdFlXeHNaWEl1SUVKcGRDMXBaR1Z1ZEdsallXd2dkMlZwWjJoMGN5NGdUbThnY1hWaGJHbDBlU0JzYjNOekxpb3FEUW9OQ2lNaklGRjFhV05ySUhOMFlYSjBEUW9OQ21CZ1lHSmhjMmdOQ25CcGNDQnBibk4wWVd4c0lHSnBaM050WVd4c0RRcGdZR0FOQ2cwS1lHQmdjSGwwYUc5dURRcG1jbTl0SUhSeVlXNXpabTl5YldWeWN5QnBiWEJ2Y25RZ1FYVjBiMDF2WkdWc1JtOXlRMkYxYzJGc1RFMHNJRUYxZEc5VWIydGxibWw2WlhJTkNnMEtiVzlrWld3Z1BTQkJkWFJ2VFc5a1pXeEdiM0pEWVhWellXeE1UUzVtY205dFgzQnlaWFJ5WVdsdVpXUW9JbmR3Wm1WeWNtVnNiQzluY0hReUxXSnBaM050WVd4c0lpa05DblJ2YTJWdWFYcGxjaUE5SUVGMWRHOVViMnRsYm1sNlpYSXVabkp2YlY5d2NtVjBjbUZwYm1Wa0tDSm5jSFF5SWlrTkNtQmdZQTBLRFFvakl5Qk1iM2N0VmxKQlRTQnpkSEpsWVcxcGJtY05DZzBLWUdCZ2NIbDBhRzl1RFFwbWNtOXRJR0pwWjNOdFlXeHNJR2x0Y0c5eWRDQkNhV2RUYldGc2JGTjBjbVZoYldsdVowMXZaR1ZzRFFvTkNtMXZaR1ZzSUQwZ1FtbG5VMjFoYkd4VGRISmxZVzFwYm1kTmIyUmxiQzVtY205dFgzQnlaWFJ5WVdsdVpXUW9JbmR3Wm1WeWNtVnNiQzluY0hReUxXSnBaM050WVd4c0lpa05DbUJnWUEwS0RRb2pJeUJFWlhSaGFXeHpEUW9OQ253Z2ZDQldZV3gxWlNCOERRcDhMUzB0ZkMwdExYd05DbndnVDNKcFoybHVZV3dnYlc5a1pXd2dmQ0JiWjNCME1sMG9hSFIwY0hNNkx5OW9kV2RuYVc1blptRmpaUzVqYnk5bmNIUXlLU0I4RFFwOElFOXlhV2RwYm1Gc0lITnBlbVVnZkNBMU5EZ2dUVUlnZkEwS2ZDQkRiMjF3Y21WemMyVmtJSE5wZW1VZ2ZDQTBNVFFnVFVJZ2ZBMEtmQ0JEYjIxd2NtVnpjMmx2YmlCeVlYUnBieUI4SURjMUxqVWxJRzltSUc5eWFXZHBibUZzSUh3TkNud2dSbTl5YldGMElId2dRbWxuVTIxaGJHd2diRzl6YzJ4bGMzTWdLQzVpY3lrZ2ZBMEtmQ0JTWldOdmJuTjBjblZqZEdsdmJpQjhJRUpwZEMxcFpHVnVkR2xqWVd3c0lHMWtOUzEyWlhKcFptbGxaQ0I4RFFwOElGSmxjWFZwY21WeklId2dZbWxuYzIxaGJHd2dQajBnTXk0d0xqQWdmQTBLRFFvakl5QkJiR3dnY0hKbExXTnZiWEJ5WlhOelpXUWdiVzlrWld4ekRRb05DbE5sWlNCYmQzQm1aWEp5Wld4c0lHOXVJRWgxWjJkcGJtZEdZV05sWFNob2RIUndjem92TDJoMVoyZHBibWRtWVdObExtTnZMM2R3Wm1WeWNtVnNiQ2tnWm05eUlHRnNiQ0JoZG1GcGJHRmliR1VnYlc5a1pXeHpMZzBLRFFvakl5Qk1hV05sYm5ObERRb05DazF2WkdWc0lIZGxhV2RvZEhNNklITmhiV1VnYkdsalpXNXpaU0JoY3lCMGFHVWdiM0pwWjJsdVlXd2diVzlrWld3Z0tGdG5jSFF5WFNob2RIUndjem92TDJoMVoyZHBibWRtWVdObExtTnZMMmR3ZERJcEtTNE5Da0pwWjFOdFlXeHNJR1p2Y20xaGREb2dXMFZzWVhOMGFXTWdUR2xqWlc1elpTQXlMakJkS0doMGRIQnpPaTh2ZDNkM0xtVnNZWE4wYVdNdVkyOHZiR2xqWlc1emFXNW5MMlZzWVhOMGFXTXRiR2xqWlc1elpTa2c0b0NVSUdaeVpXVWdabTl5SUhCbGNuTnZibUZzTENCeVpYTmxZWEpqYUN3Z1lXNWtJR2x1ZEdWeWJtRnNJR052YlcxbGNtTnBZV3dnZFhObExnMEtRMjl0YldWeVkybGhiQzlUWVdGVElHeHBZMlZ1YzJsdVp6b2dkM0JtWlhKeVpXeHNRR2R0WVdsc0xtTnZiUTBL
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: mit
3
+ tags:
4
+ - bigsmall
5
+ - compressed
6
+ - lossless
7
+ ---
8
+
9
+ [![DOI](https://zenodo.org/badge/DOI/10.5281/zenodo.20279248.svg)](https://doi.org/10.5281/zenodo.20279248)
10
+
11
+ # GPT-2 β€” BigSmall Compressed
12
+
13
+ **75.5% smaller than [gpt2](https://huggingface.co/gpt2). Bit-identical weights. Drop-in replacement.**
14
+
15
+ ## Use it in 2 lines
16
+
17
+ ```bash
18
+ pip install bigsmall
19
+ ```
20
+
21
+ ```python
22
+ from transformers import AutoModelForCausalLM, AutoTokenizer
23
+
24
+ model = AutoModelForCausalLM.from_pretrained("wpferrell/gpt2-bigsmall")
25
+ tokenizer = AutoTokenizer.from_pretrained("gpt2")
26
+ ```
27
+
28
+ ## Size comparison
29
+
30
+ | | Size |
31
+ |---|---|
32
+ | Original ([gpt2](https://huggingface.co/gpt2)) | 548 MB |
33
+ | This compressed version | 414 MB |
34
+ | Compression ratio | 75.5% of original |
35
+
36
+ ## What "lossless" means
37
+
38
+ Every weight is mathematically identical to the original. Not quantized. Not pruned. Identical model behaviour. Compressed using entropy coding β€” like ZIP but designed for neural weights.
39
+
40
+ Every tensor's md5 is stored in the file header; `bigsmall verify` decompresses and verifies bit-for-bit.
41
+
42
+ ## Low VRAM streaming
43
+
44
+ ```python
45
+ from bigsmall import BigSmallStreamingModel
46
+
47
+ model = BigSmallStreamingModel.from_pretrained(
48
+ "wpferrell/gpt2-bigsmall",
49
+ device="cuda",
50
+ lru_max_vram_gb=2.0, # cache 2 GB of decoded layers (v3.13.0+)
51
+ )
52
+ out = model.generate(input_ids, max_new_tokens=100)
53
+ ```
54
+
55
+ Streams layers on demand β€” uses ~12Γ— less VRAM than a full load.
56
+
57
+ ## New in BigSmall v3.13.0
58
+
59
+ - **Delta compression** β€” if you have the base model already, store a fine-tune as a tiny patch on top:
60
+ ```bash
61
+ bigsmall compress my_finetune.safetensors --delta-from base.safetensors -o patch.bs
62
+ ```
63
+ - **`bigsmall scan`** β€” analyse a model before compressing.
64
+ - **`bigsmall apply`** β€” reconstruct a fine-tune from base + patch.
65
+ - **`bigsmall verify --sample 0.001`** β€” fast probabilistic integrity check.
66
+ - **`bigsmall compress --ecc`** β€” optional Reed-Solomon error recovery.
67
+ - **`bigsmall compress --resume`** β€” resumable compression.
68
+
69
+ [Full release notes β†’](https://github.com/wpferrell/Bigsmall/releases/tag/v3.13.0)
70
+
71
+ ## All pre-compressed models
72
+
73
+ See [wpferrell on HuggingFace](https://huggingface.co/wpferrell) for all available models.
74
+
75
+ ## License
76
+
77
+ Model weights: same license as the original model ([gpt2](https://huggingface.co/gpt2)).
78
+ BigSmall format: [Elastic License 2.0](https://www.elastic.co/licensing/elastic-license) β€” free for personal, research, and internal commercial use.
79
+ Commercial/SaaS licensing: wpferrell@gmail.com
80
+
81
+ ## Requires
82
+
83
+ `bigsmall >= 3.13.0` to access the latest features. Older versions (>= 3.0.0) can still decode this model.
84
+
85
+ ## Citation
86
+
87
+ If you use BigSmall in research:
88
+
89
+ > Ferrell, W. (2026). *BigSmall: Lossless Compression for Neural Network Weights.* Zenodo. https://doi.org/10.5281/zenodo.20279248