llama_cpp_for_radxa_dragon_wing_q6a

History

Xuan-Son Nguyen 86af848153 server: (docs) remove mention about extra_args (#18262 )		2025-12-22 12:22:01 +01:00
..
batched-bench	tool/ex/tests: consistently free ctx, then model (#18168 )	2025-12-22 11:00:37 +01:00
cli	server: add auto-sleep after N seconds of idle (#18228 )	2025-12-21 02:24:42 +01:00
completion	arg: clarify auto kvu/np being set on server (#17997 )	2025-12-16 12:01:27 +01:00
cvector-generator
export-lora
fit-params	llama-fit-params: QoL impr. for prints/errors (#18089 )	2025-12-17 00:03:19 +01:00
gguf-split
imatrix
llama-bench	tool/ex/tests: consistently free ctx, then model (#18168 )	2025-12-22 11:00:37 +01:00
mtmd	model : add ASR support for LFM2-Audio-1.5B (conformer) (#18106 )	2025-12-19 00:18:01 +01:00
perplexity
quantize
rpc
run
server	server: (docs) remove mention about extra_args (#18262 )	2025-12-22 12:22:01 +01:00
tokenize
tts
CMakeLists.txt	llama: automatically set parameters not set by the user in such a way that maximizes GPU utilization (#16653 )	2025-12-15 09:24:59 +01:00