Docker-basiertes VLM-Modell-Deployment-Tool
Verwendet einen Docker-Container, um ein VLM-Modell auf dem Gerät bereitzustellen.
RKLLM-Modell-Deployment-Tool
Dieses Dokument erklärt, wie du das vorgefertigte Image verwendest, um dein eigenes VLM-Modell bereitzustellen.
#Docker installieren
bash
curl -fsSL https://get.docker.com -o get-docker.sh && sudo sh get-docker.sh #Modell vorbereiten
#Für reComputer RK3576
Hier lade ich als Beispiel das bereits für reComputer RK3576 konvertierte Modell herunter.
bash
cd ~
mkdir models && cd models
wget https://huggingface.co/JiahaoLi/Qwen3-VL-RK3576/resolve/main/qwen3-vl-2b-instruct_w4a16_g128_rk3576.rkllm
wget https://huggingface.co/JiahaoLi/Qwen3-VL-RK3576/resolve/main/qwen3-vl-2b_vision_rk3576.rknn#Für reComputer RK3588
Hier lade ich als Beispiel das bereits für reComputer RK3588 konvertierte Modell herunter.
bash
cd ~
mkdir models && cd models
wget https://huggingface.co/JiahaoLi/Qwen3-VL-RK3588/resolve/main/qwen3-vl-2b-instruct_w8a8_rk3588.rkllm
wget https://huggingface.co/JiahaoLi/Qwen3-VL-RK3588/resolve/main/qwen3-vl-2b_vision_rk3588.rknn#Docker installieren
bash
curl -fsSL https://get.docker.com -o get-docker.sh && sudo sh get-docker.sh #Modell ausführen
#Auf reComputer RK3576 ausführen
bash
sudo docker run -it --rm \
--privileged --net=host \
--device /dev/dri \
--device /dev/dma_heap \
--device /dev/rknpu \
--device /dev/mali0 \
-v /dev:/dev \
-v /home/user/models:/models \
ghcr.io/seeed-projects/deploy_llm:rk3576-latest \
python3 /app/fastapi_server_vlm.py --encoder_model ./model/qwen3-vl-2b_vision_rk3576.rknn --llm_model ./model/qwen3-vl-2b-instruct_w8a8_rk3588.rkllm --target_platform rk3576 --port 8002
#Auf reComputer RK3588 ausführen
bash
sudo docker run -it --rm \
--privileged --net=host \
--device /dev/dri \
--device /dev/dma_heap \
--device /dev/rknpu \
--device /dev/mali0 \
-v /dev:/dev \
-v /home/user/models:/models \
ghcr.io/seeed-projects/deploy_llm:rk3588-latest \
python3 /app/fastapi_server_vlm.py --encoder_model ./model/qwen3-vl-2b_vision_rk3588.rknn --llm_model ./model/qwen3-vl-2b-instruct_w8a8_rk3588.rkllm --target_platform rk3576 --port 8002