sudo apt update
sudo apt install -y python3 python3-pip gitpython3 -m venv openelm-env
source openelm-env/bin/activategit clone https://github.com/apple/corenet.git
cd corenet
pip install -e .OpenELM 模型在:
corenet/models/llm/openelmpip install huggingface-hub
huggingface-cli download apple/OpenELM-3B模型列表:
OpenELM-270MOpenELM-450MOpenELM-1_1BOpenELM-3BOpenELM-7Bpip install transformers torchPython 示例:
from transformers import AutoModelForCausalLM, AutoTokenizer
model_id = "apple/OpenELM-3B"
tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(model_id)
prompt = "What is OpenELM?"
inputs = tokenizer(prompt, return_tensors="pt")
outputs = model.generate(**inputs, max_length=100)
print(tokenizer.decode(outputs[0]))pip install fastapi uvicornapp.py
from fastapi import FastAPI
from transformers import AutoModelForCausalLM, AutoTokenizer
app = FastAPI()
model = AutoModelForCausalLM.from_pretrained("apple/OpenELM-3B")
tokenizer = AutoTokenizer.from_pretrained("apple/OpenELM-3B")
@app.post("/generate")
def generate(text: str):
inputs = tokenizer(text, return_tensors="pt")
out = model.generate(**inputs, max_length=100)
return tokenizer.decode(out[0])运行:
uvicorn app:app --host 0.0.0.0 --port 8000pip install torch torchvision --index-url https://download.pytorch.org/whl/cu118加载模型时:
model.to("cuda")Q1:模型太大内存不足?
→ 用 270M / 450M 版本
Q2:推理慢?
→ 启用 GPU 或量化
Q3:是否支持中文?
如果你愿意,我可以:
你打算用在 服务器 / 嵌入式 / 本地开发 哪种场景?