SeaWolf-AI commited on
Commit
9b4c19e
·
verified ·
1 Parent(s): 11db75e

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +23 -6
README.md CHANGED
@@ -1,10 +1,27 @@
1
  ---
2
- title: POCKET 35B CPU
3
- emoji: 🔥
4
- colorFrom: indigo
5
- colorTo: purple
6
  sdk: docker
7
- pinned: false
 
 
 
 
 
 
8
  ---
9
 
10
- Check out the configuration reference at https://huggingface.co/docs/hub/spaces-config-reference
 
 
 
 
 
 
 
 
 
 
 
 
1
  ---
2
+ title: POCKET-35B CPU Chat
3
+ emoji: 📱
4
+ colorFrom: yellow
5
+ colorTo: green
6
  sdk: docker
7
+ app_port: 7860
8
+ pinned: true
9
+ license: apache-2.0
10
+ models:
11
+ - FINAL-Bench/POCKET-35B-GGUF
12
+ - FINAL-Bench/Darwin-36B-Opus
13
+ short_description: A 35B model answering on a CPU-only box. No GPU.
14
  ---
15
 
16
+ # POCKET-35B · CPU chat
17
+
18
+ A live demo of **POCKET-35B** (Q2_K, 13 GB) answering on an **upgraded CPU** Space — **no GPU**.
19
+
20
+ POCKET is a sparse Mixture-of-Experts model (34.66B total, ~3B active/token) quantized from
21
+ [Darwin-36B-Opus](https://huggingface.co/FINAL-Bench/Darwin-36B-Opus). It runs on stock
22
+ `llama.cpp` — on a phone, and on a PC with no graphics card.
23
+
24
+ - 📚 [POCKET collection](https://huggingface.co/collections/FINAL-Bench/pocket-models-6a618ee5d23eafb7e185a5c6)
25
+ - 📦 [POCKET-35B-GGUF](https://huggingface.co/FINAL-Bench/POCKET-35B-GGUF) · [POCKET-KR-MLX (iPhone)](https://huggingface.co/FINAL-Bench/POCKET-KR-MLX) · [POCKET-EN-GGUF](https://huggingface.co/FINAL-Bench/POCKET-EN-GGUF)
26
+
27
+ Built with FastAPI + llama-cpp-python. Apache-2.0.