Das Projekt llama.cpp hat Version b10839 veröffentlicht. Die Release-Notizen führen für das Vulkan-Backend Unterstützung für „type-aligned“ GET_ROWS auf; die Änderung soll Assertion-Abstürze bei nicht ausgerichteten oder von null verschiedenen View-Offsets beheben, die laut Notizen unter anderem Qwen3-TTS und Qwen3-VL betrafen.

Quellenlage
PrimärquelleGitHub Releases: llama.cpp
Bestätigt durch1 unabhängiger Ursprung · 1 Quellen insgesamt
OffenOb die Korrektur auf anderen Vulkan-GPUs, Treibern und Betriebssystemen gleich wirkt, ist aus den Angaben nicht ersichtlich.

Worum es bei der Änderung geht

GET_ROWS ist hier ein Vulkan-Backend-Pfad in llama.cpp. Nach den Release-Notizen unterstützt er in b10839 nun typausgerichtete Operationen.

Als Anlass nennen die Notizen Assertion-Abstürze bei Views mit nicht ausgerichteten oder von null verschiedenen Offsets. Qwen3-TTS und Qwen3-VL werden ausdrücklich als Beispiele genannt. Die Notizen behaupten damit nicht, dass sämtliche Probleme dieser Modelle behoben sind, sondern ordnen sie als Fälle des beschriebenen Absturzproblems ein.

Testumfang und Aussagekraft

Das Projekt berichtet, dass alle 223 GET_ROWS-Tests auf Vulkan mit einer NVIDIA GeForce RTX 5060 Ti bestanden haben.

Das ist ein konkretes Signal für den getesteten Pfad und die genannte Hardware-Konfiguration. Aus den vorliegenden Angaben geht jedoch nicht hervor, welche Betriebssysteme, Treiberversionen oder weiteren Vulkan-GPUs in diesen Tests verwendet wurden. Ebenso liefern die Release-Notizen keine Angaben zur Leistung oder zu Tests mit konkreten Qwen3-TTS- und Qwen3-VL-Modellen.

Verfügbarkeit

Für b10839 nennt die Veröffentlichung bereitgestellte Downloads oder Pakete für macOS/iOS, Linux, Android und Windows sowie ein UI-Artefakt.

Wie es weitergeht

Nutzer mit den genannten Vulkan-Assertion-Abstürzen können b10839 in ihrer jeweiligen Konfiguration prüfen. Zusätzliche Tests auf anderer Hardware und mit weiteren Treiberständen wären nötig, um die Breite der Korrektur einzuordnen.

Änderungsvermerk: Neuer Artikel auf Basis der primären Release-Notizen zu llama.cpp b10839.