# Przygotowanie systemu sudo apt update && sudo apt upgrade -y sudo apt install -y build-essential cmake git curl wget python3-pip # Instalacja AMD ROCm # Pobranie i instalacja oficjalnego repozytorium AMD wget https://repo.radeon.com/amdgpu-install/6.4.1/ubuntu/jammy/amdgpu-install_6.4.60401-1_all.deb sudo apt install -y ./amdgpu-install_6.4.60401-1_all.deb # Instalacja bazowego stosu uruchomieniowego ROCm sudo amdgpu-install --usecase=rocm --no-dkms -y # Nadanie uprawnień do korzystania z GPU sudo usermod -aG video $USER sudo usermod -aG render $USER # Kompilacja llama.cpp git clone https://github.com/ggml-org/llama.cpp.git cd llama.cpp mkdir build # Przygotowanie zmiennych dla kompilatora HIP export HIPCXX="$(hipconfig -l)/clang" export HIP_PATH="$(hipconfig -R)" # Konfiguracja środowiska budowania (CMake) cmake -S . -B build \ -DGGML_HIP=ON \ -DAMDGPU_TARGETS=gfx906 \ -DCMAKE_BUILD_TYPE=Release # Właściwa kompilacja (wykorzystująca wszystkie wątki procesora) cmake --build build --config Release -j $(nproc) # Zmienne środowiskowe echo 'export HSA_OVERRIDE_GFX_VERSION=9.0.6' >> ~/.bashrc echo 'export HSA_ENABLE_SDMA=0' >> ~/.bashrc source ~/.bashrc # TEST # Będąc w katalogu ~/llama.cpp pobierz lekki model 1.5B (GGUF) wget -O qwen.gguf "https://huggingface.co/Qwen/Qwen2.5-1.5B-Instruct-GGUF/resolve/main/qwen2.5-1.5b-instruct-q4_k_m.gguf" # Uruchom wbudowany serwer API ./build/bin/llama-server -m qwen.gguf -c 2048 -ngl 99