Katalog CVE

CVE-2026-100652

ŚrednieCVSS 5.9
Opublikowano: Zaktualizowano: Przetłumaczono: NVD NIST

Prawdopodobieństwo exploitacji (EPSS)

Niskie ryzyko
0.33%

Percentyl 23 - wyżej niż 23% wszystkich znanych CVE

Streszczenie

vLLM w wersjach 0.22.0–0.23.0 nie waliduje stop_token_ids względem zakresu słownika w frontendach Rust HTTP i gRPC, co pozwala identyfikatorom tokenów spoza słownika dotrzeć do MinTokensLogitsProcessor. Atakujący może wysłać żądanie z min_tokens większym od zera i nieprawidłowym stop_token_ids, wywołując błąd indeksowania tensora CUDA i wprowadzając EngineCore w stan krytyczny wymagający restartu usługi.

Ocena ryzyka

Atakujący może zdalnie doprowadzić do awarii EngineCore i konieczności restartu usługi vLLM, powodując przerwę w działaniu (denial of service) dla wszystkich obsługiwanych żądań.

Rekomendacja

Zaktualizuj vLLM do wersji nowszej niż 0.23.0, która zawiera walidację stop_token_ids względem zakresu słownika, lub ogranicz dostęp do endpointów HTTP/gRPC do zaufanych klientów.

Inne podatności w vLLM

Zobacz wszystkie
Oryginalny opis (angielski, źródło NVD)

vLLM versions 0.22.0 through 0.23.0 fail to validate stop_token_ids against vocabulary bounds in Rust HTTP and gRPC frontends, allowing out-of-vocabulary token IDs to reach MinTokensLogitsProcessor. Attackers can submit requests with min_tokens greater than zero and out-of-vocabulary stop_token_ids to trigger CUDA tensor indexing failures that leave EngineCore in a fatal state requiring service restart.

Dane podatności pochodzą z NVD (NIST) · CISA KEV · EPSS