Sign inSign up

moinologics/llama-cpp

By moinologics

•Updated over 2 years ago

llama.cpp containerised with alpine linux

Image
0

455

moinologics/llama-cpp repository overview

⁠llama.cpp⁠ containerised with alpine linux

⁠How To Run

docker run -e MODEL_FILE=stable-code-3b-Q6_K.gguf -p 8090:8080 -v /path/to/models:/models:ro moinologics/llama-cpp

⁠Dockerfile

FROM alpine:3 as builder

WORKDIR /tmp

RUN apk add --update git alpine-sdk cmake

RUN git clone https://github.com/ggerganov/llama.cpp --single-branch

RUN mkdir -p llama.cpp/build && \
  cd llama.cpp/build && \
  cmake .. && \
  cmake --build . --config Release


FROM alpine:3

WORKDIR /srv

ENV MODEL_FILE=ggml-model-f16.gguf

RUN apk add --no-cache libstdc++

COPY --from=builder /tmp/llama.cpp/build/bin .

VOLUME [ "/models" ]

EXPOSE 8080

ENTRYPOINT ./server -m "/models/${MODEL_FILE}"

Tag summary

Content type

Image

Digest

sha256:23fd30ed4…

Size

25.8 MB

Last updated

over 2 years ago

docker pull moinologics/llama-cpp