noonghunna
★ 1.826club-3090
Community-Rezepte für die Bereitstellung von LLMs auf RTX 3090/4090/5090 CUDA GPUs. Mehrmotorig (vLLM, llama.cpp, ik_llama) und modellunabhängig. Derzeit werden Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B-Konfigurationen für 1 und 2 Karten ausgeliefert.