实用工具

Ollama Modelfile 生成器

生成 Ollama Modelfile:基础模型、系统提示词、采样参数、停止词,外加对应的 ollama create 命令。

浏览器本地运行AI 开发工具18.1万
免费

结果

结果会显示在这里。

Modelfile 是 Ollama 把下载好的模型变成你自己命名的变体的方式:固定一段系统提示词,把上下文窗口调大,代码评审时把温度调低,或者给模板会漏出特殊符号的模型加几个停止词。格式很小,但有几处很严格——FROM 必填,多个停止词每个要单独写一行 PARAMETER,多行文本必须放在三引号里。这个生成器按 ollama/ollama 官方文档写出文件,并给出构建命令,从想法到 ollama run 只要两步。

它是怎么工作的

  • 参数选“模型默认”就不写进文件,让基础模型自带的设置生效,而不是写进一个你并没有真正选过的值。
  • 系统提示词和可选的 TEMPLATE 会包在三引号里;内容里如果连续出现三个双引号会被拒绝,因为它会提前结束这个块。
  • 文件前两行是 Modelfile 注释,写着按你起的名字构建和运行模型的完整命令。

你的数据去了哪里

哪也没去。本工具完全在你的浏览器里运行:你粘贴的文本由页面处理,不会传输到任何服务器,也不会写进任何日志。

本工具免费且无需登录,运行结果只存在于你当前的页面里,不会被保存到任何地方。

它要花多少

本工具完全免费,不需要登录,也不消耗积分。

常见问题

为什么模型聊了几千个 token 就开始忘事?
因为决定 Ollama 保留多少上下文的是 num_ctx,而不是模型宣传的最大上下文长度。不设置时,按 Ollama 上下文长度文档的说法,它会根据显存自动选默认值:显存低于 24 GiB 为 4k,24–48 GiB 为 32k,48 GiB 以上为 256k;Modelfile 参考文档的参数表里写的仍是旧的 2048。显式设置 num_ctx,写代码建议 16384 或 32768。注意窗口越大 KV 缓存占的内存越多,原本能全部放进显卡的模型可能开始往 CPU 上溢出,速度明显变慢。
需要自己写 TEMPLATE 吗?
一般不用。从 Ollama 模型库拉下来的模型已经带着正确的对话模板,FROM 会一起继承。只有导入没有模板的原始 GGUF 或 safetensors 模型时才需要自己写。对库里的模型运行 ollama show --modelfile,可以看到它用的模板,语法是 Go template,变量有 .System、.Prompt 和 .Response。
生成的文件怎么用?
把结果保存成名为 Modelfile 的文件,运行 ollama create 加上你起的名字和 -f Modelfile,然后 ollama run 这个名字。同名再 create 一次会覆盖旧变体。基础模型的权重是共享的而不是复制一份,所以多建几个变体几乎不占额外磁盘空间。

背后的开源项目

本工具是独立实现,并未打包第三方库。ollama/ollama(MIT)在代码层面做的是同一件事——如果你需要在自己的程序里实现它,从那里开始,而不是调用一个网页。

ollama/ollama

也常被称作

  • ollama modelfile
  • ollama自定义模型
  • ollama modelfile参数
  • ollama create
  • ollama系统提示词
  • ollama上下文长度