實用工具
結果
結果會顯示在這裡。Modelfile 是 Ollama 把下載好的模型變成你自己命名的變體的方式:固定一段系統提示詞、把上下文視窗調大、做程式碼審查時把溫度調低,或替範本會漏出特殊符號的模型多加幾個停止詞。格式很精簡,但有幾處非常嚴格——FROM 是必填,多個停止詞每個都要單獨寫一行 PARAMETER,多行文字必須放在三引號裡。這個產生器依照 ollama/ollama 官方文件寫出檔案,並附上建置指令,從構想到 ollama run 只要兩個步驟。
它是怎麼運作的
- 參數選「模型預設」就不寫進檔案,讓基礎模型本身的設定生效,而不是寫進一個你從沒真正選過的值。
- 系統提示詞和選填的 TEMPLATE 會包在三引號裡;內容若連續出現三個雙引號會被拒絕,因為那會提前結束這個區塊。
- 檔案前兩行是 Modelfile 註解,寫著依你取的名稱建置與執行模型的完整 ollama create 和 ollama run 指令。
你的資料去了哪裡
哪也沒去。本工具完全在你的瀏覽器裡執行:你貼上的文字由頁面處理,不會傳輸到任何伺服器,也不會寫進任何紀錄。
本工具免費且免登入,執行結果只存在於你目前的頁面裡,不會被儲存到任何地方。
它要花多少
本工具完全免費,不需要登入,也不消耗點數。
常見問題
- 為什麼模型聊了幾千個 token 就開始忘東忘西?
- 因為決定 Ollama 保留多少上下文的是 num_ctx,而不是模型宣傳的最大上下文長度。沒有設定時,依 Ollama 上下文長度文件的說法,它會根據顯示卡記憶體(VRAM)自動選預設值:低於 24 GiB 為 4k,24–48 GiB 為 32k,48 GiB 以上為 256k;Modelfile 參考文件的參數表寫的仍是舊的 2048。請明確設定 num_ctx,寫程式建議 16384 或 32768。注意視窗越大,KV 快取佔用的記憶體越多,原本能整個放進顯示卡的模型可能開始溢出到 CPU,速度明顯變慢。
- 需要自己寫 TEMPLATE 嗎?
- 通常不用。從 Ollama 模型庫下載的模型已經帶有正確的對話範本,FROM 會一併繼承。只有匯入沒有範本的原始 GGUF 或 safetensors 模型時才需要自己寫。對模型庫裡的模型執行 ollama show --modelfile,就能看到它使用的範本,語法是 Go template,變數有 .System、.Prompt 和 .Response。
- 產生的檔案要怎麼用?
- 把結果儲存成名為 Modelfile 的檔案,執行 ollama create 加上你取的名稱和 -f Modelfile,接著 ollama run 這個名稱。用同一個名稱再 create 一次會覆寫舊的變體。基礎模型的權重是共用的,不會另外複製一份,所以多建幾個變體幾乎不佔額外的硬碟空間。
背後的開源專案
本工具是獨立實作,並未打包第三方函式庫。ollama/ollama(MIT)在程式碼層面做的是同一件事——如果你需要在自己的程式裡實作它,從那裡開始,而不是呼叫一個網頁。
ollama/ollama也常被稱作
- ollama modelfile
- ollama 自訂模型
- ollama modelfile 參數
- ollama create
- ollama 系統提示詞
- ollama num_ctx