club-3090
Recettes communautaires pour servir des LLM sur les GPU RTX 3090/4090/5090 CUDA. Multimoteur (vLLM, lama.cpp, ik_llama) et indépendant du modèle. Actuellement en livraison des configurations Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B pour 1 et 2 cartes.
Le problème qu’il résout
Recettes communautaires pour servir des LLM sur les GPU RTX 3090/4090/5090 CUDA. Multimoteur (vLLM, lama.cpp, ik_llama) et indépendant du modèle. Actuellement en livraison des configurations Qwen3.6-27B Qwen3.6 35B Gemma 4 26B Gemma 4 31B pour 1 et 2 cartes.
Le contexte du projet sur cette page est accessible gratuitement. Le dépôt GitHub d’origine reste la référence ; la connexion n’est nécessaire que pour enregistrer ou rejoindre la discussion.
Notes de la communauté