BEGIN:VCALENDAR
VERSION:2.0
PRODID:-//Allsikt//Article Deadline//EN
CALSCALE:GREGORIAN
METHOD:PUBLISH
BEGIN:VEVENT
UID:029cfe6769f92b90ec627eb3bd159ff2fb0cc73c@allsikt.tech
DTSTAMP:20260728T182913Z
DTSTART;VALUE=DATE:20260728
DTEND;VALUE=DATE:20260729
SUMMARY:Qwen 3.6 27B Q8 on four Nvidia RTX A4000 (16GB each) with Llama.cpp and MTP enabled
DESCRIPTION:Run Qwen 3.6 27B Q8 on four RTX A4000 GPUs with Llama.cpp and MTP to achieve ~45 tokens/s for reasoning and ~60 tokens/s for coding.\n\nSource: Reddit r/LocalLLaMA\nOpen: https://www.allsikt.se/article/qwen-3-6-27b-q8-on-four-nvidia-rtx-a4000-16gb-each-with-llama-cpp-and-mtp-enabled-301c5a5f
URL:https://www.allsikt.se/article/qwen-3-6-27b-q8-on-four-nvidia-rtx-a4000-16gb-each-with-llama-cpp-and-mtp-enabled-301c5a5f
STATUS:CONFIRMED
TRANSP:TRANSPARENT
END:VEVENT
END:VCALENDAR
