Herramienta de prueba de velocidad

Pruebas de rendimiento para modelos VLM.


Prueba de velocidad de LLM

Este documento describe cómo usar la herramienta de prueba de velocidad para medir la velocidad de modelos de lenguaje grandes.

#Instalar Docker

bash
curl -fsSL https://get.docker.com -o get-docker.sh && sudo sh get-docker.sh 

#Ejecutar en reComputer RK3576

bash
    sudo docker run -it --name --privileged \
      --net=host \
      --device /dev/dri \
      --device /dev/dma_heap \
      --device /dev/rknpu \
      --device /dev/mali0 \
      -v /dev:/dev \
      ghcr.io/seeed-projects/rk3576-qwen2.5-vl:3b-w4a16-latest

#Ejecutar en reComputer RK3588

bash
    sudo docker run -it --name --privileged \
      --net=host \
      --device /dev/dri \
      --device /dev/dma_heap \
      --device /dev/rknpu \
      --device /dev/mali0 \
      -v /dev:/dev \
      ghcr.io/seeed-projects/rk3588-qwen2.5-vl:3b-w8a8-latest

#Instalar las herramientas

bash
wget https://github.com/Seeed-Projects/reComputer-RK-LLM/raw/refs/heads/main/tools/vlm_speed_test.py

#Crear el entorno

bash
python -m venv .env && source .enb/bin/activate
pip install requests numpy

#Probar la velocidad

bash
python vlm_speed_test.py