我要投稿

本地大模型运行框架Ollama

发布日期：2024-04-14 14:13:14 浏览次数： 2929

作者：各种折腾

微信搜一搜，关注“各种折腾”

什么是 Ollama ？

Ollama 是一个简明易用的本地大模型运行框架。能在本地启动并运行 Llama 2、Mistral、Gemma 及其他大语言模型。

和老苏之前介绍的 LocalAI 比较类似，但是加载模型更容易，感觉上比较像 docker，也采用了 tags 来区分模型的不同版本，尤其是 CLI 也采用了 pull、rm、run 等等；

因为老苏的小机器不支持 Nvidia GPU，所以下面?的安装示例仅支持 CPU

安装

在群晖上以 Docker 方式安装。

在注册表中搜索 ollama ，选择第一个 ollama/ollama，版本选择 latest。

本文写作时， latest 版本对应为 0.1.27；

卷

在 docker 文件夹中，创建一个新文件夹 ollama，并在其中建一个子文件夹 data

文件夹	装载路径	说明
`docker/ollama/data`	`/root/.ollama`	存放模型数据

端口

本地端口不冲突就行，不确定的话可以用命令查一下

# 查看端口占用
netstat -tunlp | grep 端口号

本地端口	容器端口
`11434`	`11434`

容器名称

因为后面有进入容器的操作，所以这里规范下命名，就叫 ollama 吧

命令行安装

如果你熟悉命令行，可能用 docker cli 更快捷

# 新建文件夹 ollama 和 子目录
mkdir -p /volume1/docker/ollama/data

# 进入 ollama 目录
cd /volume1/docker/ollama

# 运行容器(仅 CPU)
docker run -d \
   --restart unless-stopped \
   --name ollama \
   -p 11434:11434 \
   -v $(pwd)/data:/root/.ollama \
   ollama/ollama

也可以用 docker-compose 安装，将下面的内容保存为 docker-compose.yml 文件

version: '3'

services:
  ollama:
    image: ollama/ollama
    container_name: ollama
    restart: unless-stopped
    ports:
      - 11434:11434
    volumes:
      - ./data:/root/.ollama

然后执行下面的命令

# 新建文件夹 ollama 和 子目录
mkdir -p /volume1/docker/ollama/data

# 进入 ollama 目录
cd /volume1/docker/ollama

# 将 docker-compose.yml 放入当前目录

# 一键启动
docker-compose up -d

运行

在浏览器中输入 http://群晖IP:11434 ，如果看到 Ollama is running，表示服务启动正常

下载模型

官方提供了一个模型库，地址：https://ollama.com/library

你可以根据需要进行搜索，例如搜索 llama2

选中 llama2 ，你会看到关于这个模型的简介

进入 tags 查看需要的版本

关于不同参数模型文件所需要的内存，之前提过，这里简单再说一下

7b：至少需要 8GB 内存；
13b：至少需要 16GB 内存；
33b：至少需要 32GB 内存；

老苏接下来尝试了 llama2:7b 和 llama2-chinese:7b，从介绍看，后者采用了中文指令集来进行微调，使其具备较强的中文对话能力。目前这个中文微调参数模型总共发布了 7B，13B 两种参数大小。

模型下载需进入容器内，不熟悉命令行的，可以进入 终端机 操作

执行下面的命令

# 下载模型
ollama pull llama2:7b

#下载模型(中文微调参数模型)
ollama pull llama2-chinese:7b

老苏个人更喜欢用 SSH 客户端的命令行，多一步进入容器的命令，下载是一样的

# 进入容器
docker exec --user root -it ollama /bin/bash

# 下载模型
ollama pull llama2:7b

#下载模型(中文微调参数模型)
ollama pull llama2-chinese:7b

开始下载

下载完成

开始提问

接下里就可以提问了，比如：为什么天空是蓝色的

命令行

假设已经进入容器或者尚未退出容器，可以直接运行下面的命令

# 运行模型
ollama run llama2-chinese:7b

# 填写问题

因网络中断，答案并没有生成完全，就这几个字已经花了近 2 小时

curl

用 SSH 客户端登录到群晖后，执行下面的命令

curl -X POST http://192.168.0.197:11434/api/generate -d '{
  "model": "llama2-chinese:7b",
  "prompt": "你好吗"
 }'

其中：

IP 需要改为你自己的主机 IP；
model 后面是我们要使用的模型文件；
prompt 后面就是我们提的问题；

当然你还可以用 API 工具，不过可能还是 Web UI 的界面用起来更好，暂时找到了 Open WebUI ，有时间再找找

小结

跑大模型，需要的硬件资源是越高越好的。老苏的小机器既不支持 GPU，内存也仅仅够了最低要求的 8GB，所以每个问题回答的时间，都慢到让你怀疑人生。

但是，这并不能阻止我们追求知识和进行探索的热情。

53AI，企业落地大模型首选服务商

产品：场景落地咨询+大模型应用平台+行业解决方案

承诺：免费POC验证，效果达标后再合作。零风险落地应用大模型，已交付160+中大型企业

相关资讯

2024-07-10

科研助力神器：Scholar GPT，百倍提升你的研究效率！

2024-07-09

Doc2X：一款功能超级强大的文档解析与转换工具

2024-07-06

我对多智能体协作过程自动演化架构设计

2024-07-06

可穿戴AI，底层逻辑的变化

2024-07-06

一文彻底搞懂Transformer - Word Embedding（词嵌入）

2024-07-06

AI动态 | 腾讯元宝AI搜索能力升级：深度搜索模式上线

2024-07-06

智能手表 + AI ，都已经这么智能了？？

2024-07-06

死磕10万卡GPU算力集群，腾讯星脉网络2.0有什么秘密武器？

了解更多

160+中大型企业正在使用53AI

立即咨询预约演示

把握AI发展的机遇，共同探索、共同进步

2025-01-22

如何打造基于GenAI的员工服务机器人

2025-01-22

热点资讯

从需求场景出发的AI应用项目落地方法论

2025-09-19

马斯克 Grok imagine 完整使用指南：工具、案例、提示词，看这一篇就够了！

2025-10-26

实测 Sora 2 ：AI视频的“ChatGPT时刻”来了？八大场景教你解锁各种玩法（附邀请码）

2025-10-02

新版 GPT-5 刚刚发布，最卷 AI 连肝代码 7 小时，编程工具大洗牌开始了

2025-09-16

阿里发布下一代企业级智能体开发框架AgentScope 1.0

2025-09-17

RagFLow v0.20.X全面解析！双向MCP、Agentic智能体...这次真的起飞了！（附长图）

2025-09-29

一文速览OpenAI Dev Day 2025，下半年开始大洗牌

2025-10-07

Claude Sonnet4.5发布，号称世界最强模型，超越gpt-5-codex

2025-09-30

我挖到Gemini 3.0 Pro十大隐藏玩法，做网页已经落后N个版本了

2025-11-19

sora2官方提示词

2025-10-09

大家都在问

Prompt是与LLM对话的唯一方式：为什么你的AI总是在产生“幻觉”？

2025-12-14

巨头翻身！谷歌全新AI浏览器Disco问世，PC版灵光？

2025-12-14

2025年，企业级AI的主战场在哪里？

2025-12-12

GPT 5.2的长上下文厉害了，但是写文真的强吗？

2025-12-12

涌现观点｜AI 开发的"App Store 时刻"：为什么你应该停止构建 Agent？

2025-12-11

什么是上下文工程？

2025-12-11

Apple 入局 RAG：深度解析 CLaRa 框架，如何实现 128x 文档语义压缩？

2025-12-10

Human In the Loop竟然可以是个MCP?

2025-12-09

热门标签

内容创作大模型技术个人提效 langchain llamaindex 多模态技术 RAG技术智能客服知识图谱模型微调 RAGFlow coze Dify Fastgpt Bisheng Qanything AI+汽车 AI+金融 AI+工业 AI+培训 AI+SaaS 提示词框架提示词技巧 AI+电商 AI面试数字员工 ChatBI AI知识库开源大模型智能营销智能硬件智能化改造 AI+医疗 MaxKB