sudo apt update
sudo apt install python3 python3-pip python3-venv -y创建虚拟环境(推荐):
python3 -m venv openelm-env
source openelm-env/bin/activateCPU 版本
pip install torch torchvision torchaudioGPU(CUDA 12.1 示例)
pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu121验证:
python -c "import torch; print(torch.cuda.is_available())"pip install transformers accelerate下载模型(示例:OpenELM-270M):
huggingface-cli download apple/OpenELM-270M-Instruct --local-dir openelm-270mfrom transformers import AutoModelForCausalLM, AutoTokenizer
model_path = "./openelm-270m"
tokenizer = AutoTokenizer.from_pretrained(model_path)
model = AutoModelForCausalLM.from_pretrained(model_path)
prompt = "Explain Linux in one sentence."
inputs = tokenizer(prompt, return_tensors="pt")
outputs = model.generate(**inputs, max_new_tokens=50)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))✅ 适合:
acceleratepip install accelerate加载模型到 GPU:
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
model = AutoModelForCausalLM.from_pretrained(
"./openelm-270m",
torch_dtype=torch.float16,
device_map="auto"
)
tokenizer = AutoTokenizer.from_pretrained("./openelm-270m")pip install fastapi uvicornfrom fastapi import FastAPI
from transformers import AutoModelForCausalLM, AutoTokenizer
import torch
app = FastAPI()
model_path = "./openelm-270m"
tokenizer = AutoTokenizer.from_pretrained(model_path)
model = AutoModelForCausalLM.from_pretrained(
model_path, torch_dtype=torch.float16, device_map="auto"
)
@app.post("/generate")
def generate(text: str):
inputs = tokenizer(text, return_tensors="pt").to(model.device)
outputs = model.generate(**inputs, max_new_tokens=100)
return {"result": tokenizer.decode(outputs[0], skip_special_tokens=True)}启动:
uvicorn server:app --host 0.0.0.0 --port 8000| 模型 | 显存需求 | 场景 |
|---|---|---|
| OpenELM-270M | ~1GB | 本地 / 边缘 |
| OpenELM-450M | ~2GB | 轻量推理 |
| OpenELM-1.1B | ~4GB | 服务器 |
| OpenELM-3B | ~8GB+ | 高性能 |
--load-in-8bit 或 --load-in-4bitexport HF_ENDPOINT=https://hf-mirror.com# 1. 安装依赖
pip install torch transformers
# 2. 下载模型
huggingface-cli download apple/OpenELM-270M-Instruct --local-dir openelm
# 3. 运行推理
python run_openelm.py如果你愿意,我可以帮你:
告诉我你的 Linux 版本 + 是否有 GPU 即可。