llama.cpp containerised with alpine linux
455
docker run -e MODEL_FILE=stable-code-3b-Q6_K.gguf -p 8090:8080 -v /path/to/models:/models:ro moinologics/llama-cpp
FROM alpine:3 as builder
WORKDIR /tmp
RUN apk add --update git alpine-sdk cmake
RUN git clone https://github.com/ggerganov/llama.cpp --single-branch
RUN mkdir -p llama.cpp/build && \
cd llama.cpp/build && \
cmake .. && \
cmake --build . --config Release
FROM alpine:3
WORKDIR /srv
ENV MODEL_FILE=ggml-model-f16.gguf
RUN apk add --no-cache libstdc++
COPY --from=builder /tmp/llama.cpp/build/bin .
VOLUME [ "/models" ]
EXPOSE 8080
ENTRYPOINT ./server -m "/models/${MODEL_FILE}"
Content type
Image
Digest
sha256:23fd30ed4…
Size
25.8 MB
Last updated
over 2 years ago
docker pull moinologics/llama-cpp