CVE-2026-40682
KrytyczneCVSS 9.1Prawdopodobieństwo exploitacji (EPSS)
Niskie ryzykoPercentyl 41 - wyżej niż 41% wszystkich znanych CVE
Streszczenie
W bibliotece Apache OpenNLP wykryto podatność XML External Entity (XXE) w klasie DictionaryEntryPersistor. Klasa ta inicjalizuje parser SAX bez włączenia bezpiecznego przetwarzania (FEATURE_SECURE_PROCESSING) i bez wyłączenia obsługi DTD, co pozwala atakującemu na wstrzyknięcie złośliwej deklaracji DOCTYPE w pliku słownika. Skutkuje to możliwością ujawnienia lokalnych plików (file://) lub wykonania żądań po stronie serwera (SSRF) przez referencje http:// podczas parsowania XML.
Ocena ryzyka
Organizacja narażona jest na wyciek poufnych danych z systemu plików serwera oraz na wykorzystanie serwera do ataków na inne zasoby sieciowe (SSRF). Atak jest możliwy poprzez dostarczenie spreparowanego pliku słownika, np. listy słów stop lub słownika domenowego.
Rekomendacja
Należy niezwłocznie zaktualizować Apache OpenNLP do wersji 2.5.9 (dla gałęzi 2.x) lub 3.0.0-M3 (dla gałęzi 3.x). Jeśli aktualizacja nie jest możliwa, należy zapewnić, że wszystkie pliki słowników pochodzą z zaufanych źródeł i wdrożyć walidację wejścia odrzucającą XML z deklaracją DOCTYPE przed przekazaniem do parsera.
Inne podatności w Apache OpenNLP
Zobacz wszystkie- CVE-2026-82617Krytyczne
Wbudowane wzorce wyszukiwania nazw EMAIL i URL w Apache OpenNLP zawierają niejednoznaczne zagnieżdżone kwantyfikatory, co umożliwia atak ReDoS. Przygotowany tekst wejściowy może wywołać superliniowe cofanie (backtracking) lub rekurencję matchera, prowadząc do wyczerpania CPU lub błędu StackOverflowError. Podatność dotyczy wersji od 2.0.0 do 2.5.11 oraz od 3.0.0-M1 do 3.0.0-M5.
- CVE-2026-43825Wysokie
W Apache OpenNLP w module libsvm dokumentacji kategorii (linia 3.x) wykryto podatność na niezaufaną deserializację Java. Metoda SvmDoccatModel.deserialize(InputStream) używa java.io.ObjectInputStream bez filtra, co pozwala atakującemu na zdalne wykonanie kodu poprzez spreparowany strumień.
- CVE-2026-42027Krytyczne
W Apache OpenNLP przed wersjami 1.9.5, 2.5.9 i 3.0.0-M3, metoda ExtensionLoader.instantiateExtension() ładuje klasę na podstawie nazwy z pliku manifest.properties archiwum modelu za pomocą Class.forName() przed sprawdzeniem, czy klasa jest zgodna z oczekiwanym interfejsem. Pozwala to atakującemu na wykonanie statycznego inicjalizatora dowolnej klasy dostępnej w classpath podczas ładowania modelu, co może prowadzić do niepożądanych efektów ubocznych.
- CVE-2026-67211Wysokie
Podatność w Apache OpenNLP (rozszerzenie opennlp-spellcheck, wersje 3.0.0-M4 i 3.0.0-M5) pozwala na atak typu Denial of Service poprzez wyczerpanie pamięci. Metoda SymSpellModelSerializer.create() odczytuje pola liczby unigramów i bigramów z pliku modelu i przekazuje je bezpośrednio do wstępnego rozmiarowania mapy bez górnego limitu, co przy spreparowanym pliku .bin powoduje próbę alokacji 4–8 GB i błąd OutOfMemoryError.
- CVE-2026-63317Średnie
W Apache OpenNLP przed wersjami 2.5.10 i 3.0.0-M5 wykryto podatność umożliwiającą dowolną instancję klas. Atakujący może dostarczyć spreparowany model lub nazwę formatu, co prowadzi do załadowania i wykonania kodu z niebezpiecznych klas.
- CVE-2026-42440Wysokie
W Apache OpenNLP przed wersjami 1.9.5, 2.5.9 i 3.0.0-M3 odkryto podatność na atak DoS polegający na wyczerpaniu pamięci (OOM). Metody getOutcomes(), getOutcomePatterns() i getPredicates() w klasie AbstractModelReader alokują tablice na podstawie 32-bitowej liczby całkowitej z pliku modelu bez walidacji, co pozwala atakującemu na podanie wartości Integer.MAX_VALUE i spowodowanie natychmiastowego błędu OutOfMemoryError.
Oryginalny opis (angielski, źródło NVD)
XML External Entity (XXE) via Unsanitized Dictionary Parsing in Apache OpenNLP DictionaryEntryPersistor Versions Affected: before 2.5.9, before 3.0.0-M3 Description: The DictionaryEntryPersistor class initializes a static SAXParserFactory at class-load time without enabling FEATURE_SECURE_PROCESSING or disabling DTD processing. When create(InputStream, EntryInserter) is invoked, the only feature set on the XMLReader is namespace support — external entity resolution and DOCTYPE declarations remain fully enabled. An attacker who can supply a crafted dictionary file (e.g., a stop-word list or domain dictionary) containing a malicious DOCTYPE declaration can trigger local file disclosure via file:// entity references or server-side request forgery via http:// entity references during SAX parsing, before the application processes a single dictionary entry. This is inconsistent with the project's own XmlUtil.createSaxParser() helper, which correctly sets FEATURE_SECURE_PROCESSING and disallow-doctype-decl and is used by all other XML parsing paths in the codebase. The public Dictionary(InputStream) constructor delegates directly to this method and is the documented API for loading user-supplied dictionaries, making untrusted input a realistic scenario. Mitigation: 2.x users should upgrade to 2.5.9. 3.x users should upgrade to 3.0.0-M3. Users who cannot upgrade immediately should ensure that all dictionary files are sourced from trusted origins and should consider wrapping the Dictionary(InputStream) constructor with input validation that rejects any XML containing a DOCTYPE declaration before it reaches the parser.
Dane podatności pochodzą z NVD (NIST) · CISA KEV · EPSS

