ggml-org
★ 121 303llama.cpp
llama.cpp exécute l'inférence LLM en C/C++ pur et sert les modèles localement via une API REST et une interface web, avec prise en charge multimodale dans llama-server.
RÉPERTOIRE HYSEN LABS
Dépôts vérifiés, classifications et analyses de l’organisation ggml-org.
llama.cpp exécute l'inférence LLM en C/C++ pur et sert les modèles localement via une API REST et une interface web, avec prise en charge multimodale dans llama-server.
whisper.cpp est un portage C/C++ sans dépendances du modèle de reconnaissance vocale Whisper d'OpenAI, optimisé pour Apple Silicon, avec inférence CPU seule sur de nombreuses plateformes.