Recommend 7 DFlash draft tokens for llama.cpp

#11
Files changed (1) hide show
  1. README.md +1 -1
README.md CHANGED
@@ -150,7 +150,7 @@ cd llama.cpp && cmake -B build && cmake --build build -j
150
  # with DFlash speculative decoding:
151
  ./build/bin/llama-server -m laguna-s-2.1-Q4_K_M.gguf \
152
  -md laguna-s-2.1-DFlash-BF16.gguf \
153
- --spec-type draft-dflash --spec-draft-n-max 15 -fa on --jinja --port 8000
154
  ```
155
 
156
  ## Controlling reasoning
 
150
  # with DFlash speculative decoding:
151
  ./build/bin/llama-server -m laguna-s-2.1-Q4_K_M.gguf \
152
  -md laguna-s-2.1-DFlash-BF16.gguf \
153
+ --spec-type draft-dflash --spec-draft-n-max 7 -fa on --jinja --port 8000
154
  ```
155
 
156
  ## Controlling reasoning