Betroffen ist vLLM, eine Engine zum Ausführen und Bereitstellen großer Sprachmodelle. Bei Anfragen über die OpenAI-kompatible Schnittstelle wird ein übergebener Wert für den Cache-Salt zwar akzeptiert, aber nicht ausreichend geprüft: Die Beschränkungen bezüglich erlaubter Zeichen und maximaler Länge, die die nachgelagerte Komponente zur Cache-Schlüsselbildung voraussetzt, werden nicht durchgesetzt. In Installationen, die den entsprechenden LMCache-MP-Connector nutzen, kann ein Angreifer daher einen Salt mit unzulässigen Zeichen oder übermäßiger Länge senden. Beim Nachschlagen im Cache durch den Scheduler löst dies einen nicht abgefangenen Fehler aus, der den zentralen Engine-Kern beendet. Da dieser Prozess alle Anfragen bearbeitet, führt bereits eine einzige manipulierte Anfrage zum Ausfall des gesamten Dienstes – sämtliche gleichzeitig verbundenen Nutzer verlieren den Zugriff. Es handelt sich somit um eine leicht auslösbare Denial-of-Service-Schwachstelle.
CVE-2026-105756
6,5
MEDIUM
CVSS Basis-Score
Beschreibung