CVE-2026-65701
KrytyczneCVSS 9.1Prawdopodobieństwo exploitacji (EPSS)
Niskie ryzykoPercentyl 44 - wyżej niż 44% wszystkich znanych CVE
Streszczenie
SoftVC VITS Singing Voice Conversion do commitu 730930d zawiera podatność na path traversal w serwerze wnioskowania pełnych utworów, która pozwala nieuwierzytelnionym zdalnym atakującym na odczyt i eksfiltrację dowolnych plików poprzez podanie kontrolowanych przez atakującego ścieżek systemu plików w polu audio_path nieuwierzytelnionego żądania POST do ścieżki /wav2wav. Atakujący mogą przekazywać dowolne ścieżki serwera dosłownie do funkcji librosa.load, torchaudio.load i soundfile.write, powodując, że serwer dekoduje i zwraca zawartość plików w treści odpowiedzi HTTP, jednocześnie zapisując pliki .wav określone przez atakującego w dowolnych lokalizacjach w systemie plików.
Ocena ryzyka
Nieuwierzytelniony atakujący może odczytać dowolne pliki z serwera, w tym dane uwierzytelniające i poufne dane, oraz zapisywać pliki w dowolnych lokalizacjach, co może prowadzić do pełnego przejęcia serwera.
Rekomendacja
Zaktualizuj SoftVC VITS do wersji po commicie 730930d, która zawiera poprawkę walidacji ścieżki.
Oryginalny opis (angielski, źródło NVD)
SoftVC VITS Singing Voice Conversion through commit 730930d contains a path traversal vulnerability in the full-song inference server that allows unauthenticated remote attackers to read and exfiltrate arbitrary files by supplying attacker-controlled filesystem paths through the audio_path field of an unauthenticated POST request to the /wav2wav route. Attackers can pass arbitrary server-side paths verbatim to librosa.load, torchaudio.load, and soundfile.write sinks, causing the server to decode and return file contents via the HTTP response body while also writing attacker-specified .wav files to arbitrary locations on the filesystem.

