# optimized for coding # 1. Set Environment Variables export LD_LIBRARY_PATH="/home/eaman/llama/bin_vulkan" # --ctx-size 30000 \ # 2. Run the Server /home/eaman/llama/bin_vulkan/llama-server \ -m /home/eaman/lm/models/unsloth/Qwen3.6-35B-A3B-GGUF/Qwen3.6-35B-A3B-MTD-UD-Q4_K_XL.gguf \ --host 0.0.0.0 -np 1 -fa on \ -ctk q5_0 \ -ctv q4_0 \ --temp 0.55 --top-p 0.9 --min-p 0.0 \ --repeat-penalty 1.0 \ -b 512 \ --fit-ctx 80000 \ --jinja \ --no-mmap \ --chat-template-kwargs '{"enable_thinking":false}' \ --reasoning-budget 1 \ --spec-type draft-mtp --spec-draft-p-min 0.75 --spec-draft-n-max 2 \ -ctkd q8_0 -ctvd q8_0 \ -lv 4 --no-warmup \