noonghunna
★ 1 826club-3090
Recettes communautaires pour servir des LLM sur les GPU RTX 3090/4090/5090 CUDA. Multimoteur (vLLM, lama.cpp, ik_llama) et indépendant du modèle. Actuellement en livraison des configurations Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B pour 1 et 2 cartes.