Das Projekt llama.cpp hat Version b10839 veröffentlicht. Die Release-Notizen führen für das Vulkan-Backend Unterstützung für „type-aligned“ GET_ROWS auf; die Änderung soll Assertion-Abstürze bei nicht ausgerichteten oder von null verschiedenen View-Offsets beheben, die laut Notizen unter anderem Qwen3-TTS und Qwen3-VL betrafen.
Worum es bei der Änderung geht
GET_ROWS ist hier ein Vulkan-Backend-Pfad in llama.cpp. Nach den Release-Notizen unterstützt er in b10839 nun typausgerichtete Operationen.
Als Anlass nennen die Notizen Assertion-Abstürze bei Views mit nicht ausgerichteten oder von null verschiedenen Offsets. Qwen3-TTS und Qwen3-VL werden ausdrücklich als Beispiele genannt. Die Notizen behaupten damit nicht, dass sämtliche Probleme dieser Modelle behoben sind, sondern ordnen sie als Fälle des beschriebenen Absturzproblems ein.
Testumfang und Aussagekraft
Das Projekt berichtet, dass alle 223 GET_ROWS-Tests auf Vulkan mit einer NVIDIA GeForce RTX 5060 Ti bestanden haben.
Das ist ein konkretes Signal für den getesteten Pfad und die genannte Hardware-Konfiguration. Aus den vorliegenden Angaben geht jedoch nicht hervor, welche Betriebssysteme, Treiberversionen oder weiteren Vulkan-GPUs in diesen Tests verwendet wurden. Ebenso liefern die Release-Notizen keine Angaben zur Leistung oder zu Tests mit konkreten Qwen3-TTS- und Qwen3-VL-Modellen.
Verfügbarkeit
Für b10839 nennt die Veröffentlichung bereitgestellte Downloads oder Pakete für macOS/iOS, Linux, Android und Windows sowie ein UI-Artefakt.
Wie es weitergeht
Nutzer mit den genannten Vulkan-Assertion-Abstürzen können b10839 in ihrer jeweiligen Konfiguration prüfen. Zusätzliche Tests auf anderer Hardware und mit weiteren Treiberständen wären nötig, um die Breite der Korrektur einzuordnen.
Änderungsvermerk: Neuer Artikel auf Basis der primären Release-Notizen zu llama.cpp b10839.