from fastapi import FastAPI from pydantic import BaseModel from llama_cpp import Llama
model_path="/app/models/ Llama-3.2-3B.gguf"
model = Llama(model_path)
app = FastAPI()
class RequestModel(BaseModel): prompt: str
@app.post("/generate") async def generate_text(request: RequestModel): response = model("Q:" + request.prompt + " A:", max_tokens=32768, stop=["Q:", "\n"], echo=True) return {"response": response}
Content type
Image
Digest
sha256:eef8de1c2…
Size
873.4 MB
Last updated
over 1 year ago
docker pull tuxmanplay/api-ia-consumer