Sign inSign up

call518/rag-gpt

By call518

•Updated over 2 years ago

RAG GPT (Support: OpenAI and Ollama)

Image
0

1.2K

call518/rag-gpt repository overview

⁠Functions

  • RAG-GPT (Streamlit Based)
  • Ollama Web-UI

⁠Support AI

  • OpenAI
  • Ollama

⁠Expose Ports

  • /root/.ollama : Directory for persistent storage of Ollama Models
  • 11434 : Ollama API Port
  • 8501 : RAG-GPT Web-UI Port

⁠Run /w Docker

⁠Nvidia GPU

docker run -d --name RAG-GPT --gpus all -p 11434:11434 -p 8501:8501 -v /root/.ollama-rag-gpt:/root/.ollama call518/rag-gpt

⁠CPU Only

docker run -d  --name RAG-GPT -p 11434:11434 -p 8501:8501 -v /root/.ollama-rag-gpt:/root/.ollama call518/rag-gpt

⁠(Optional) Run /w Docker-Compose

# cat docker-compose.yml
version: '3.8'
services:
  rag-gpt:
    image: call518/rag-gpt
    volumes:
      - /root/.ollama-rag-gpt:/root/.ollama
    environment:
      OLLAMA_HOST: 0.0.0.0
    ports:
      - 11434:11434
      - 8501:8501
    deploy:
      resources:
        reservations:
          devices:
            - driver: nvidia
              count: all
              capabilities: [gpu]

# docker compose up -d
[+] Running 2/2
 ⠿ Network rag-gpt-docker_default    Created                                                                                                                          0.0s
 ⠿ Container rag-gpt-docker-mysql-1  Started

# docker ps
CONTAINER ID   IMAGE                   COMMAND                  CREATED          STATUS          PORTS                                              NAMES
7621fcdbd3e1   call518/rag-gpt         "/usr/bin/supervisord"   15 seconds ago   Up 14 seconds   0.0.0.0:8501->8501/tcp, 0.0.0.0:11434->11434/tcp   rag-gpt-docker-rag-gpt-1

# docker compose ps
NAME                       IMAGE               COMMAND                  SERVICE             CREATED             STATUS              PORTS
rag-gpt-docker-rag-gpt-1   call518/rag-gpt     "/usr/bin/supervisord"   rag-gpt             33 seconds ago      Up 31 seconds       0.0.0.0:8501->8501/tcp, 0.0.0.0:11434->11434/tcp

⁠Logs

# docker exec -it RAG-GPT /bin/bash

root@29b6c0017902:/opt/RAG-GPT-Source# tail -F /var/log/ollama-std*
==> /var/log/ollama-stderr.log <==
time=2024-03-31T05:07:16.327Z level=INFO source=payload_common.go:113 msg="Extracting dynamic libraries to /tmp/ollama684798444/runners ..."
time=2024-03-31T05:07:19.085Z level=INFO source=payload_common.go:140 msg="Dynamic LLM libraries [rocm_v60002 cuda_v11 cpu_avx cpu_avx2 cpu]"
time=2024-03-31T05:07:19.085Z level=INFO source=gpu.go:115 msg="Detecting GPU type"
time=2024-03-31T05:07:19.085Z level=INFO source=gpu.go:265 msg="Searching for GPU management library libcudart.so*"
time=2024-03-31T05:07:19.086Z level=INFO source=gpu.go:311 msg="Discovered GPU libraries: [/tmp/ollama684798444/runners/cuda_v11/libcudart.so.11.0]"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:340 msg="Unable to load cudart CUDA management library /tmp/ollama684798444/runners/cuda_v11/libcudart.so.11.0: cudart init failure: 35"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:265 msg="Searching for GPU management library libnvidia-ml.so"
time=2024-03-31T05:07:19.089Z level=INFO source=gpu.go:311 msg="Discovered GPU libraries: []"
time=2024-03-31T05:07:19.089Z level=INFO source=cpu_common.go:11 msg="CPU has AVX2"
time=2024-03-31T05:07:19.089Z level=INFO source=routes.go:1139 msg="no GPU detected"

root@29b6c0017902:/opt/RAG-GPT-Source# tail -F /var/log/streamlit-std*
==> /var/log/streamlit-stderr.log <==

==> /var/log/streamlit-stdout.log <==

Collecting usage statistics. To deactivate, set browser.gatherUsageStats to False.


  You can now view your Streamlit app in your browser.

  Network URL: http://172.17.0.3:8501
  External URL: http://59.15.235.186:8501

⁠License

Apache License 2.0

Tag summary

Content type

Image

Digest

sha256:a67648178…

Size

7 GB

Last updated

over 2 years ago

docker pull call518/rag-gpt