实用工具
结果
结果会显示在这里。Modelfile 是 Ollama 把下载好的模型变成你自己命名的变体的方式:固定一段系统提示词,把上下文窗口调大,代码评审时把温度调低,或者给模板会漏出特殊符号的模型加几个停止词。格式很小,但有几处很严格——FROM 必填,多个停止词每个要单独写一行 PARAMETER,多行文本必须放在三引号里。这个生成器按 ollama/ollama 官方文档写出文件,并给出构建命令,从想法到 ollama run 只要两步。
它是怎么工作的
- 参数选“模型默认”就不写进文件,让基础模型自带的设置生效,而不是写进一个你并没有真正选过的值。
- 系统提示词和可选的 TEMPLATE 会包在三引号里;内容里如果连续出现三个双引号会被拒绝,因为它会提前结束这个块。
- 文件前两行是 Modelfile 注释,写着按你起的名字构建和运行模型的完整命令。
你的数据去了哪里
哪也没去。本工具完全在你的浏览器里运行:你粘贴的文本由页面处理,不会传输到任何服务器,也不会写进任何日志。
本工具免费且无需登录,运行结果只存在于你当前的页面里,不会被保存到任何地方。
它要花多少
本工具完全免费,不需要登录,也不消耗积分。
常见问题
- 为什么模型聊了几千个 token 就开始忘事?
- 因为决定 Ollama 保留多少上下文的是 num_ctx,而不是模型宣传的最大上下文长度。不设置时,按 Ollama 上下文长度文档的说法,它会根据显存自动选默认值:显存低于 24 GiB 为 4k,24–48 GiB 为 32k,48 GiB 以上为 256k;Modelfile 参考文档的参数表里写的仍是旧的 2048。显式设置 num_ctx,写代码建议 16384 或 32768。注意窗口越大 KV 缓存占的内存越多,原本能全部放进显卡的模型可能开始往 CPU 上溢出,速度明显变慢。
- 需要自己写 TEMPLATE 吗?
- 一般不用。从 Ollama 模型库拉下来的模型已经带着正确的对话模板,FROM 会一起继承。只有导入没有模板的原始 GGUF 或 safetensors 模型时才需要自己写。对库里的模型运行 ollama show --modelfile,可以看到它用的模板,语法是 Go template,变量有 .System、.Prompt 和 .Response。
- 生成的文件怎么用?
- 把结果保存成名为 Modelfile 的文件,运行 ollama create 加上你起的名字和 -f Modelfile,然后 ollama run 这个名字。同名再 create 一次会覆盖旧变体。基础模型的权重是共享的而不是复制一份,所以多建几个变体几乎不占额外磁盘空间。
背后的开源项目
本工具是独立实现,并未打包第三方库。ollama/ollama(MIT)在代码层面做的是同一件事——如果你需要在自己的程序里实现它,从那里开始,而不是调用一个网页。
ollama/ollama也常被称作
- ollama modelfile
- ollama自定义模型
- ollama modelfile参数
- ollama create
- ollama系统提示词
- ollama上下文长度