Katalog CVE

CVE-2026-57173

ŚrednieCVSS 6.5
Opublikowano: Zaktualizowano: Przetłumaczono: NVD NIST

Prawdopodobieństwo exploitacji (EPSS)

Podwyższone ryzyko
0.69%

Percentyl 51 - wyżej niż 51% wszystkich znanych CVE

Streszczenie

vLLM przed wersją 0.24.0 w ścieżce obsługi input_audio dla /v1/chat/completions nie przekazuje limitu VLLM_MAX_AUDIO_DECODE_DURATION_S do wspólnego dekodera audio. Nieuwierzytelniony klient może przesłać mały skompresowany plik audio, który rozszerza się do bardzo dużej alokacji PCM float32, omijając zabezpieczenie czasu trwania i powodując awarię procesu roboczego z powodu wyczerpania pamięci.

Ocena ryzyka

Atakujący może zdalnie wywołać awarię procesu roboczego (denial of service) poprzez wyczerpanie pamięci, co wpływa na dostępność usługi. Dotyczy to wdrożeń obsługujących model z możliwością przetwarzania audio.

Rekomendacja

Zaktualizuj vLLM do wersji 0.24.0 lub nowszej, która zawiera poprawkę tego problemu.

Inne podatności w vLLM

Zobacz wszystkie
Oryginalny opis (angielski, źródło NVD)

vLLM is an inference and serving engine for large language models. Prior to 0.24.0, the input_audio handling path for /v1/chat/completions calls AudioMediaIO.load_bytes or AudioMediaIO.load_file without passing VLLM_MAX_AUDIO_DECODE_DURATION_S to the shared audio decoder. An unauthenticated client can therefore submit a small compressed audio input that expands into a very large float32 PCM allocation, bypassing the duration guard already used by /v1/audio/transcriptions and causing an out-of-memory worker crash. Inline data URLs reach this path without being bounded by VLLM_AUDIO_FETCH_TIMEOUT. The issue affects deployments serving an audio-capable model, and authentication changes only the deployment-specific reachability. This issue is fixed in version 0.24.0.

Dane podatności pochodzą z NVD (NIST) · CISA KEV · EPSS