llama.cpp
A lightweight engine for running quantized models on CPU/GPU/Mac.
A lightweight engine for running quantized models on CPU/GPU/Mac. (M14)
A lightweight engine for running quantized models on CPU/GPU/Mac.
A lightweight engine for running quantized models on CPU/GPU/Mac. (M14)