How to use from
llama.cpp
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf EvaHap/SmallpoV1H_Beta1:F16
# Run inference directly in the terminal:
llama cli -hf EvaHap/SmallpoV1H_Beta1:F16
Install from WinGet (Windows)
winget install llama.cpp
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf EvaHap/SmallpoV1H_Beta1:F16
# Run inference directly in the terminal:
llama cli -hf EvaHap/SmallpoV1H_Beta1:F16
Use pre-built binary
# Download pre-built binary from:
# https://github.com/ggerganov/llama.cpp/releases
# Start a local OpenAI-compatible server with a web UI:
./llama-server -hf EvaHap/SmallpoV1H_Beta1:F16
# Run inference directly in the terminal:
./llama-cli -hf EvaHap/SmallpoV1H_Beta1:F16
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git
cd llama.cpp
cmake -B build
cmake --build build -j --target llama-server llama-cli
# Start a local OpenAI-compatible server with a web UI:
./build/bin/llama-server -hf EvaHap/SmallpoV1H_Beta1:F16
# Run inference directly in the terminal:
./build/bin/llama-cli -hf EvaHap/SmallpoV1H_Beta1:F16
Use Docker
docker model run hf.co/EvaHap/SmallpoV1H_Beta1:F16
Quick Links

Smallpo V1H(Beta1)

Smallpoๅ›ข้˜Ÿ็ ”ๅ‘็š„ๆœ€ๆ–ฐๆจกๅž‹๏ผŒๆž่‡ด็š„ๆ€ง่ƒฝๅ’Œๆ‹ŸไบบๅŒ–ใ€‚

ๆˆ‘ไปฌๅๅˆ†้ซ˜ๅ…ด็š„ๅ‘Š่ฏ‰ๅ„ไฝ๏ผŒๆˆ‘ไปฌ็š„Smallpo็ฌฌไธ€ไปฃ็‰ˆๆœฌๅทฒ็ปๅ‘ๅธƒไบ†ใ€‚ SmallpoV1Hๆ˜ฏๆˆ‘ไปฌๆœ€ๆ–ฐใ€ๆœ€ๅผบ็š„ๆจกๅž‹๏ผŒๅฐฝ็ฎกๅฎƒ่ฟ˜ๅค„ไบŽๅๅˆ†ๆ—ฉๆœŸ็š„ๅฎž้ชŒ้˜ถๆฎต๏ผŒไฝ†ๆ˜ฏBeta1็š„ๅผบๅคงๆ‹Ÿไบบๆ€งๅทฒ็ปๅฑ•็Žฐๅ‡บๆฅใ€‚ ๆˆ‘ไปฌ็›ธไฟก๏ผŒSmallpoๆœชๆฅๅฏไปฅๅ˜ๅพ—ๆ›ดๅฅฝ๏ผ

ๆŠ€ๆœฏ็ป†่Š‚

ๆญคๆจกๅž‹ๆฒกๆœ‰ไป€ไนˆๆŠ€ๆœฏๅซ้‡๏ผŒๆˆ‘ไปฌไฝฟ็”จUnsloth่ฟ›่กŒ่ฎญ็ปƒใ€‚ ็›ธๅ…ณๆ•ฐๆฎ้›†ๆฅๆบไบŽ็ฝ‘็ปœใ€‚

็Žฐๅœจไปๅญ˜ๅœจ็š„้—ฎ้ข˜

  • ๆญคๆจกๅž‹ๅ‚ๆ•ฐ้‡ๅคชๅฐ๏ผŒๆ™บๅ•†ไฝŽ๏ผŒๅช่ƒฝๅจฑไนไฝฟ็”จใ€‚
  • ๆญคๆจกๅž‹็ป็”จๆˆทๆŠฅๅ‘Š๏ผŒๆจกๅž‹ไฝฟ็”จๆ€่€ƒๅŠŸ่ƒฝๅŽๆœ‰ๆ—ถไธไผš่พ“ๅ‡บๅ›ž็ญ”ๆญฃๆ–‡ใ€‚่ฟ™ๆ˜ฏๅ› ไธบๆจกๅž‹็š„ๆ•ฐๆฎ้›†ไธญๆฒกๆœ‰ๅŒ…ๅซๆ€่€ƒ็š„้ƒจๅˆ†ๆ•ฐๆฎใ€‚
  • ๆญคๆจกๅž‹ๆ— ๆณ•ๅฎŒๆ•ด่พ“ๅ‡บ่‡ชๅทฑ็š„ๅๅญ—Smallpo๏ผŒ่ฟ™ๆ˜ฏๅ› ไธบๅœจ่ฎญ็ปƒ่ฟ‡็จ‹ไธญ๏ผŒๆˆ‘ไปฌๆฒกๆœ‰้‡็‚น่ฎญ็ปƒๅๅญ—่ฟ™ไธ€ๆฟๅ—ใ€‚
  • ๆญคๆจกๅž‹ไฝฟ็”จ้™คไธญๆ–‡ๅค–็š„่ฏญ่จ€่ฟ›่กŒๅฏน่ฏ๏ผŒๆ•ˆๆžœ่พƒๅทฎใ€‚่ฟ™ๆ˜ฏๅ› ไธบๆจกๅž‹็š„ๆ•ฐๆฎ้›†ไธญๅŒ…ๅซ้™คไธญๆ–‡ๅค–็š„ๅ…ถไป–่ฏญ่จ€ๅ ๆฏ”ๅฐใ€‚

ๆœ€ๅŽ

ๆˆ‘ไปฌ็›ธไฟก๏ผŒSmallpoๆœชๆฅๅฏไปฅๅ˜ๅพ—ๆ›ดๅฅฝ๏ผ ๆœฌๆจกๅž‹ไฝฟ็”จQwen3.5-0.8B่ฟ›่กŒๅพฎ่ฐƒ่ฎญ็ปƒใ€‚ ๆœฌๆจกๅž‹ไฝฟ็”จUnsloth่ฟ›่กŒ่ฎญ็ปƒใ€‚

ยฉSmallpo AI

Downloads last month
52
GGUF
Model size
0.8B params
Architecture
qwen35
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for EvaHap/SmallpoV1H_Beta1

Quantized
(191)
this model