kcvmk commited on
Commit
cab4bdc
·
verified ·
1 Parent(s): a08ca2c

Upload folder using huggingface_hub

Browse files
README.md ADDED
@@ -0,0 +1,41 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: mit
3
+ tags:
4
+ - mlx
5
+ - 4bit
6
+ - whisper
7
+ - stt
8
+ - metalrt
9
+ - apple-silicon
10
+ ---
11
+
12
+ # Whisper Medium — MLX 4-bit Quantized
13
+
14
+ Custom MLX 4-bit quantization of [OpenAI Whisper Medium](https://huggingface.co/openai/whisper-medium) optimized for [MetalRT](https://github.com/RunanywhereAI/metalrt-binaries) GPU inference on Apple Silicon.
15
+
16
+ ## Usage
17
+
18
+ Used by [RCLI](https://github.com/RunanywhereAI/RCLI) with the MetalRT engine for speech-to-text:
19
+
20
+ ```bash
21
+ rcli setup # select MetalRT or Both engines
22
+ ```
23
+
24
+ > **Note**: Whisper Medium is in GPU beta. Whisper Tiny is recommended for production use.
25
+
26
+ ## Performance (Apple M3 Max)
27
+
28
+ | Metric | Value |
29
+ |--------|-------|
30
+ | Latency (1.2s audio) | 233 ms |
31
+ | RTF | 0.19x |
32
+ | Quantization | MLX 4-bit |
33
+
34
+ ## License
35
+
36
+ Model weights: [MIT](https://github.com/openai/whisper/blob/main/LICENSE) (OpenAI)
37
+ MetalRT engine: [Proprietary](https://github.com/RunanywhereAI/metalrt-binaries/blob/main/LICENSE) (RunAnywhere, Inc.)
38
+
39
+ ## Contact
40
+
41
+ founder@runanywhere.ai | https://runanywhere.ai
config.json ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "n_mels": 80,
3
+ "n_audio_ctx": 1500,
4
+ "n_audio_state": 1024,
5
+ "n_audio_head": 16,
6
+ "n_audio_layer": 24,
7
+ "n_vocab": 51865,
8
+ "n_text_ctx": 448,
9
+ "n_text_state": 1024,
10
+ "n_text_head": 16,
11
+ "n_text_layer": 24,
12
+ "quantization": {
13
+ "group_size": 64,
14
+ "bits": 4
15
+ },
16
+ "model_type": "whisper"
17
+ }
whisper-medium-mlx-4bit/.gitattributes ADDED
@@ -0,0 +1,35 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
whisper-medium-mlx-4bit/README.md ADDED
@@ -0,0 +1 @@
 
 
1
+ Quantized to 4-bit whisper medium
whisper-medium-mlx-4bit/config.json ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "n_mels": 80,
3
+ "n_audio_ctx": 1500,
4
+ "n_audio_state": 1024,
5
+ "n_audio_head": 16,
6
+ "n_audio_layer": 24,
7
+ "n_vocab": 51865,
8
+ "n_text_ctx": 448,
9
+ "n_text_state": 1024,
10
+ "n_text_head": 16,
11
+ "n_text_layer": 24,
12
+ "quantization": {
13
+ "group_size": 64,
14
+ "bits": 4
15
+ },
16
+ "model_type": "whisper"
17
+ }
whisper-medium-mlx-4bit/model.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7003ac6761e152604cbf8129c611b6cc4720f10dfdcbf36f54a2f6aaa589b64a
3
+ size 511900792
whisper-medium-mlx-4bit/tokenizer.json ADDED
The diff for this file is too large to render. See raw diff
 
whisper-medium-mlx-4bit/weights.npz ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3e89f26c4d89721881f4a415d9d525b548f93e95f8b044098f0da84c2582f601
3
+ size 512230640