Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Avifenesh
/
memra-bench
like
2
GGUF
benchmark
cuda
speculative-decoding
nvfp4
License:
mit
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
memra-bench
10.9 GB
Ctrl+K
Ctrl+K
1 contributor
History:
39 commits
Avifenesh
readme: related links (engine repo + Hy3 overlay)
f10c3d0
verified
10 days ago
drafts
Upload drafts/kf4/qwen36-35b-a3b-iq4xs/owngen-ranks-32768.txt with huggingface_hub
11 days ago
prompts
Upload prompts/p3-agentic-long-v2.txt with huggingface_hub
22 days ago
trims
Upload trims/frspec-corpus-32768.gguf with huggingface_hub
22 days ago
.gitattributes
2.66 kB
Upload drafts/kf4/qwen36-35b-a3b-iq4xs/draft-owntrim-nvfp4head-q4blk.gguf with huggingface_hub
11 days ago
CONFIGS.md
Safe
5.78 kB
27B ST serve config: + BW24_MMQ_F8F4=1 (f8f4 prefill tile adoption)
22 days ago
README.md
5.41 kB
readme: related links (engine repo + Hy3 overlay)
10 days ago
mtp-Qwen3.6-27B-Q4_K_M-frspec-balanced32768.gguf
1.13 GB
xet
Upload folder using huggingface_hub
24 days ago
mtp-Qwen3.6-27B-Q4_K_M-frspec-code75-32768.gguf
1.13 GB
xet
Upload folder using huggingface_hub
24 days ago
mtp-Qwen3.6-27B-Q4_K_M-frspec32768.gguf
1.13 GB
xet
Upload folder using huggingface_hub
24 days ago