Outils pour utilisateurs

Outils du site


informatique:ai_lm:gpu_bench

Différences

Ci-dessous, les différences entre deux révisions de la page.

Lien vers cette vue comparative

Les deux révisions précédentesRévision précédente
informatique:ai_lm:gpu_bench [15/07/2026 11:46] – [--ubatch-size] cyrilleinformatique:ai_lm:gpu_bench [15/07/2026 12:00] (Version actuelle) – [--ubatch-size] cyrille
Ligne 602: Ligne 602:
 # https://huggingface.co/unsloth/Qwen3-Coder-Next-GGUF # https://huggingface.co/unsloth/Qwen3-Coder-Next-GGUF
 MODEL="Qwen3-Coder-Next-UD-Q4_K_XL.gguf" MODEL="Qwen3-Coder-Next-UD-Q4_K_XL.gguf"
 +
 +#
 +# ne gère pas options multiples pour "-ub" et "-b"
 +# -b 2048,4096,6144,8192
 +# -ub 1024,1536,2048,2560
 +#
  
 "$LLAMA_DIR/llama-batched-bench" -m "$MODEL_DIR/$MODEL" \ "$LLAMA_DIR/llama-batched-bench" -m "$MODEL_DIR/$MODEL" \
   -c 196000 \   -c 196000 \
-  -b 2048,4096,6144,8192 +  -b 2048 \ 
-  -ub 1024,1536,2048,2560 \+  -ub 1024 \
   -ngl 99 \   -ngl 99 \
   --n-cpu-moe 39 \   --n-cpu-moe 39 \
informatique/ai_lm/gpu_bench.txt · Dernière modification : de cyrille

Sauf mention contraire, le contenu de ce wiki est placé sous les termes de la licence suivante : CC0 1.0 Universal
CC0 1.0 Universal Donate Powered by PHP Valid HTML5 Valid CSS Driven by DokuWiki