在 Linux 上“装 llama3”通常指通过 Ollama 本地运行 Llama 3 模型,最简单常用。下面给你几种方式:
一、用 Ollama 安装并运行 Llama 3(推荐)
1. 安装 Ollama
curl -fsSL https://ollama.com/install.sh | sh
2. 启动 Ollama
ollama serve
(有的系统安装后会自动启动)
3. 拉取并运行 Llama 3
ollama run llama3
第一次会自动下载模型(约 4.7GB,是 8B 版本)
二、指定版本
ollama run llama3:8b
ollama run llama3:70b # 需要大显存
三、不联网安装(离线)
先在有网的机器:
ollama pull llama3
再把模型目录拷贝到目标机器:
~/.ollama
四、其他方式(进阶)
- llama.cpp (纯 CPU / GPU 推理)
- vLLM (高性能服务)
- HuggingFace + transformers
如果你告诉我:
我可以给你更精确的命令。