‹ 返回笔记 Esc·

Ollama 问题与修复

Ollama OpenAI 兼容性 地址:https://ollama.com/blog/openai-compatibility --- Ollama 模型默认保存位置 macOS: ~/.olla…

Ollama OpenAI 兼容性

地址:https://ollama.com/blog/openai-compatibility

1curl http://localhost:11434/v1/chat/completions \
2    -H "Content-Type: application/json" \
3    -d '{
4        "model": "llama2",
5        "messages": [
6            {
7                "role": "system",
8                "content": "You are a helpful assistant."
9            },
10            {
11                "role": "user",
12                "content": "Hello!"
13            }
14        ]
15    }'

Ollama 模型默认保存位置

macOS: ~/.ollama/models Linux: /usr/share/ollama/.ollama/models Windows: C:\Users\%username%\.ollama\models


Ollama 不使用推理模式

一:CLI 命令行

使用 –think 参数来控制思考输出:

1ollama run deepseek-r1:8b --think=false "你的提问"

若想启用思考过程,可用 –think=true 或省略该参数(默认启用)。

二:交互式终端

在启动 ollama run deepseek-r1:8b 后进入终端,你可以输入:

1/set nothink

这样接下来所有提问都将关闭思考过程,模型只输出最终回答


Ollama 模型一直常驻内存

1# /etc/systemd/system/ollama.service.d/override.conf
2[Service]
3Environment="OLLAMA_KEEP_ALIVE=-1"
1sudo systemctl daemon-reload
2sudo systemctl restart ollama

1export OLLAMA_KEEP_ALIVE=24h
2
3export OLLAMA_KEEP_ALIVE=-1
4ollama run gemma4:31b
  • "24h"
  • "10m"
  • 3600
  • -1(永久驻留)

官方默认行为:

  • 空闲 5 分钟卸载