# vLLM-сервер FRIDA-Decisions: штатный образ vLLM + плагин из пакета frida-decisions.
# Плагин регистрируется через entry points (vllm.general_plugins / io_processor_plugins),
# поэтому достаточно поставить пакет. Версия vLLM — та, с которой плагин протестирован.
ARG VLLM_VERSION=v0.29.0
FROM vllm/vllm-openai:${VLLM_VERSION}

ARG FRIDA_DECISIONS_REF=v0.3.0
# --no-deps: numpy / tokenizers / safetensors / huggingface_hub уже есть в образе vLLM,
# а extra [vllm] потянул бы переустановку самого vLLM.
RUN pip install --no-cache-dir --no-deps \
    "https://github.com/ai-forever/FRIDA-Decisions/archive/refs/tags/${FRIDA_DECISIONS_REF}.tar.gz"
