llama.cpp
llama.cpp führt LLM-Inferenz in reinem C/C++ aus und stellt Modelle lokal über eine REST-API und eine Weboberfläche bereit, inklusive multimodaler Unterstützung im llama-server.
Welches Problem es löst
llama.cpp führt LLM-Inferenz in reinem C/C++ aus und stellt Modelle lokal über eine REST-API und eine Weboberfläche bereit, inklusive multimodaler Unterstützung im llama-server.
Der Projektkontext auf dieser Seite ist kostenlos lesbar. Das ursprüngliche GitHub-Repository bleibt maßgeblich; nur zum Speichern oder Diskutieren ist eine Anmeldung nötig.
Community-Notizen