Ollama 问题与修复
Ollama OpenAI 兼容性 地址:https://ollama.com/blog/openai-compatibility --- Ollama 模型默认保存位置 macOS: ~/.olla…
Ollama OpenAI 兼容性
地址:https://ollama.com/blog/openai-compatibility
1curl http://localhost:11434/v1/chat/completions \
2 -H "Content-Type: application/json" \
3 -d '{
4 "model": "llama2",
5 "messages": [
6 {
7 "role": "system",
8 "content": "You are a helpful assistant."
9 },
10 {
11 "role": "user",
12 "content": "Hello!"
13 }
14 ]
15 }'
Ollama 模型默认保存位置
macOS: ~/.ollama/models
Linux: /usr/share/ollama/.ollama/models
Windows: C:\Users\%username%\.ollama\models
Ollama 不使用推理模式
一:CLI 命令行
使用 –think 参数来控制思考输出:
1ollama run deepseek-r1:8b --think=false "你的提问"
若想启用思考过程,可用 –think=true 或省略该参数(默认启用)。
二:交互式终端
在启动 ollama run deepseek-r1:8b 后进入终端,你可以输入:
1/set nothink
这样接下来所有提问都将关闭思考过程,模型只输出最终回答
Ollama 模型一直常驻内存
1# /etc/systemd/system/ollama.service.d/override.conf
2[Service]
3Environment="OLLAMA_KEEP_ALIVE=-1"
1sudo systemctl daemon-reload
2sudo systemctl restart ollama
或
1export OLLAMA_KEEP_ALIVE=24h
2
3export OLLAMA_KEEP_ALIVE=-1
4ollama run gemma4:31b
"24h""10m"3600-1(永久驻留)
官方默认行为:
- 空闲 5 分钟卸载