Outils

Générateur de Modelfile Ollama

Créez un Modelfile Ollama — modèle de base, prompt système, paramètres d’échantillonnage, séquences d’arrêt — avec la commande ollama create.

S’exécute dans le navigateurOutils de développement IA181,1 k
Gratuit

Résultat

Le résultat apparaîtra ici.

Un Modelfile est la façon dont Ollama transforme un modèle téléchargé en votre propre variante nommée : un prompt système fixe, une fenêtre de contexte plus longue, une température plus basse pour la revue de code, des séquences d’arrêt supplémentaires pour un modèle dont le template laisse fuir des jetons. Le format est concis mais strict sur quelques points — FROM est obligatoire, chaque séquence d’arrêt exige sa propre ligne PARAMETER, et tout texte sur plusieurs lignes doit être placé entre triples guillemets. Ce générateur écrit le fichier conformément à la référence de la documentation d’ollama/ollama et affiche la commande qui le construit : de l’idée à ollama run en deux étapes.

Comment ça marche

  • Les paramètres laissés sur « Valeur du modèle » ne sont pas écrits, afin que les réglages du modèle de base s’appliquent au lieu d’une valeur que vous n’avez jamais choisie.
  • Le prompt système et un TEMPLATE facultatif sont entourés de triples guillemets ; une saisie contenant trois guillemets doubles consécutifs est refusée, car elle fermerait le bloc trop tôt.
  • Les deux premières lignes sont des commentaires du Modelfile contenant les commandes ollama create et ollama run exactes pour le nom choisi.

Où vont vos données

Nulle part. Cet outil s’exécute entièrement dans votre navigateur : le texte collé est traité par la page, jamais transmis à un serveur ni consigné dans un journal.

Cet outil est gratuit et ne demande aucun compte. Ses résultats n’existent que dans la page ouverte et ne sont enregistrés nulle part.

Ce que ça coûte

Cet outil est gratuit, sans connexion ni points.

Questions fréquentes

Pourquoi mon modèle oublie-t-il tout après quelques milliers de tokens ?
Parce que c’est num_ctx, et non la longueur de contexte annoncée par le modèle, qui détermine ce qu’Ollama conserve. Sans réglage, Ollama choisit une valeur par défaut selon la mémoire de votre GPU — 4k tokens sous 24 Gio de VRAM, 32k jusqu’à 48 Gio, 256k au-delà — d’après sa documentation sur la longueur de contexte, alors que le tableau de référence du Modelfile indique encore l’ancienne valeur de 2048. Définissez num_ctx explicitement — 16384 ou 32768 pour le code — et gardez en tête qu’une fenêtre plus grande consomme davantage de mémoire pour le cache KV : un modèle qui tenait dans votre GPU peut commencer à déborder sur le CPU.
Dois-je écrire un TEMPLATE ?
En général, non. Les modèles récupérés depuis la bibliothèque Ollama embarquent déjà le bon template de conversation, et FROM en hérite. N’en écrivez un que si vous importez un modèle GGUF ou safetensors brut qui n’en possède pas. Lancez ollama show --modelfile sur un modèle de la bibliothèque pour voir celui qu’il utilise, en syntaxe de template Go avec .System, .Prompt et .Response.
Comment appliquer le fichier ?
Enregistrez le résultat dans un fichier nommé Modelfile, exécutez ollama create avec le nom choisi et -f Modelfile, puis ollama run avec ce nom. Relancer create avec le même nom remplace la variante ; les poids du modèle de base sont partagés et non copiés, si bien qu’une variante n’occupe presque aucun espace disque.

L’open source derrière

Cet outil est une implémentation autonome, sans bibliothèque tierce. ollama/ollama (MIT) fait le même travail sous forme de bibliothèque : pour l’intégrer à votre programme, commencez par là plutôt que d’appeler une page web.

ollama/ollama

Aussi appelé

  • modelfile ollama
  • créer un modèle ollama
  • ollama create
  • ollama prompt système
  • ollama num_ctx
  • paramètres ollama