Werkzeuge

Ollama-Modelfile-Generator

Erstellt ein Ollama-Modelfile – Basismodell, System-Prompt, Sampling-Parameter, Stoppsequenzen – samt passendem ollama create-Befehl.

Läuft im BrowserKI-Entwicklertools181.063
Kostenlos

Ergebnis

Das Ergebnis erscheint hier.

Mit einem Modelfile macht Ollama aus einem heruntergeladenen Modell Ihre eigene benannte Variante: ein fester System-Prompt, ein größeres Kontextfenster, eine niedrigere Temperatur für Code-Reviews, zusätzliche Stoppsequenzen für ein Modell, dessen Template durchsickert. Das Format ist klein, aber in einigen Punkten streng – FROM ist Pflicht, mehrere Stoppsequenzen brauchen je eine eigene PARAMETER-Zeile, und mehrzeiliger Text muss in dreifachen Anführungszeichen stehen. Dieser Generator schreibt die Datei nach der Referenz in der Dokumentation von ollama/ollama und gibt den Befehl aus, der sie baut – so kommen Sie in zwei Schritten von der Idee zu ollama run.

So arbeitet es

  • Parameter, die auf „Modellstandard“ stehen, werden nicht geschrieben, sodass die Einstellungen des Basismodells gelten statt eines Werts, den Sie nie gewählt haben.
  • Der System-Prompt und ein optionales TEMPLATE werden in dreifache Anführungszeichen gesetzt; Eingaben mit drei doppelten Anführungszeichen hintereinander werden abgelehnt, weil sie den Block vorzeitig beenden würden.
  • Die ersten beiden Zeilen sind Modelfile-Kommentare mit den genauen Befehlen ollama create und ollama run für den von Ihnen gewählten Namen.

Wohin Ihre Daten gehen

Nirgendwohin. Dieses Werkzeug läuft vollständig in Ihrem Browser: Der eingefügte Text wird von der Seite verarbeitet und weder an einen Server übertragen noch protokolliert.

Dieses Tool ist kostenlos und braucht kein Konto. Die Ergebnisse existieren nur in Ihrer geöffneten Seite und werden nirgends gespeichert.

Was es kostet

Dieses Werkzeug ist kostenlos, ohne Anmeldung und ohne Punkte.

Häufige Fragen

Warum vergisst mein Modell nach ein paar tausend Tokens alles?
Weil num_ctx und nicht die beworbene Kontextlänge des Modells bestimmt, wie viel Ollama behält. Bleibt der Wert ungesetzt, wählt Ollama laut seiner Dokumentation zur Kontextlänge einen Standard nach Ihrem GPU-Speicher – 4k Tokens unter 24 GiB VRAM, 32k bis 48 GiB, 256k darüber –, während die Tabelle in der Modelfile-Referenz noch die ältere 2048 zeigt. Setzen Sie num_ctx ausdrücklich – 16384 oder 32768 für Code-Arbeit – und bedenken Sie, dass ein größeres Fenster mehr Speicher für den KV-Cache belegt, sodass ein Modell, das bisher auf Ihre GPU passte, womöglich auf die CPU ausweicht.
Muss ich ein TEMPLATE schreiben?
Meist nicht. Modelle aus der Ollama-Bibliothek bringen bereits das richtige Chat-Template mit, und FROM übernimmt es. Schreiben Sie nur dann eines, wenn Sie ein rohes GGUF- oder safetensors-Modell ohne Template importieren. Führen Sie ollama show --modelfile für ein Bibliotheksmodell aus, um dessen Template zu sehen – in Go-Template-Syntax mit .System, .Prompt und .Response.
Wie wende ich die Datei an?
Speichern Sie die Ausgabe als Datei namens Modelfile, führen Sie ollama create mit dem gewählten Namen und -f Modelfile aus und starten Sie dann ollama run mit diesem Namen. Ein erneutes create mit demselben Namen ersetzt die Variante; die Gewichte des Basismodells werden gemeinsam genutzt statt kopiert, sodass eine Variante kaum Speicherplatz kostet.

Das Open Source dahinter

Dieses Werkzeug ist eine eigenständige Implementierung ohne fremde Bibliothek. ollama/ollama (MIT) erledigt dieselbe Aufgabe als Bibliothek — wer sie im eigenen Programm braucht, fängt dort an, statt eine Webseite aufzurufen.

ollama/ollama

Auch bekannt als

  • ollama modelfile
  • modelfile erstellen
  • ollama create
  • ollama system prompt
  • ollama num_ctx
  • ollama parameter