llama_cpp_for_radxa_dragon_wing_q6a

History

Georgi Gerganov 3637576288 server : disable speculative decoding for SWA models (#13970 ) * server : use swa-full fo draft context ggml-ci * server : disable speculative decoding for SWA models		2025-06-02 21:34:40 +03:00
..
batched-bench
cvector-generator
export-lora
gguf-split
imatrix
llama-bench
main
mtmd
perplexity
quantize
rpc
run
server
tokenize
tts
CMakeLists.txt