Infrastruktur & Compute
Chips, Rechenzentren, Inferenz und alles, worauf KI läuft. 13 Beiträge, jeder mit seiner Quellenlage.
Enterprise-SSDs erreichen laut Counterpoint 48 Prozent der NAND-Bit-Auslieferungen
Die Nachfrage von Rechenzentren für KI-Anwendungen verschiebt den NAND-Flash-Markt laut einem Heise-Bericht weiter zu Enterprise-Speichern. Bis Jahresende könnte deren Anteil die Hälfte überschreiten.
NVIDIA kündigt PAIR-Beta und RTX-Spark-Windows-PCs für Oktober an
Auf der IFA 2026 stellt NVIDIA lokale KI-Integrationen und Optimierungen für Inferenz vor. Der offene Netzwerk-Router NVIDIA PAIR ist als Beta für Windows, macOS und Linux verfügbar; Lenovo- und Acer-Systeme mit RTX Spark sollen im Oktober folgen.
NVIDIA kündigt 28 weitere Spiele für GeForce NOW im September 2026 an
Laut einem NVIDIA-Blogbeitrag sollen im September 28 weitere Titel zu GeForce NOW kommen. Genannt werden NBA 2K27 mit DLSS 5, The Blood of Dawnwalker und Onimusha: Way of the Sword.
NVIDIA beschreibt NVLink Fusion als Plattform für kundenspezifische XPUs in KI-Rechenzentren
In einem Blogbeitrag stellt NVIDIA NVLink Fusion als Infrastruktur vor, die kundenspezifische Beschleuniger mit dem eigenen KI-Stack verbinden soll. Die Angaben zu Leistung, Effizienz und Skalierung stammen ausschließlich von NVIDIA.
NVIDIA meldet erste Vera-CPU-Server- und Rubin-GPU-Lieferung an AWS
Nach Angaben von NVIDIA erhielt AWS in Seattle erstmals einen Vera-CPU-Server und eine Vera-Rubin-GPU. Oracle Cloud Infrastructure plant laut NVIDIA ab 2026 den Einsatz von Hunderttausenden Vera-CPUs.
OpenAI meldet erste Benchmark-Ergebnisse für eigenen Inferenzchip Jalapeño
Nach Angaben des Unternehmens übertraf Jalapeño in einem öffentlichen InferenceX-Test bei GPT-OSS 120B kommerzielle Vergleichssysteme bei Spitzen-Durchsatz pro Kilowatt und Token-Latenz. Unabhängige Bestätigung liegt im vorliegenden Material nicht vor.
NVIDIA meldet bis zu 30-mal mehr Agenten-Durchsatz pro Megawatt für Vera Rubin NVL72
Die vom Hersteller veröffentlichten frühen Ergebnisse des SemiAnalysis-AgentX-Benchmarks vergleichen Vera Rubin NVL72 mit GB300 NVL72. Sie stehen noch unter Prüfung durch SemiAnalysis und erfassen die Vera-CPU-Leistung bei Tool-Aufrufen nicht.
NVIDIA kündigt NVHBM für NVLink Fusion an; Annapurna Labs soll erster Partner werden
NVIDIAs neue Speichertechnik für XPUs soll gegenüber Standard-HBM4E mehr Bandbreite bei geringerem HBM-Energieverbrauch liefern. Die Angaben stammen ausschließlich von NVIDIA; eine unabhängige Bestätigung liegt nicht vor.
NVIDIA meldet Groq 3 LPX in Vollproduktion für Vera-Rubin-Inferenzsysteme
Der Hersteller beschreibt den Beschleuniger als Baustein für agentische KI und kündigt zugleich Netzwerk- und Integrationsangebote an. Die Angaben stammen ausschließlich von NVIDIA.
NVIDIA nennt weitere Spiele- und Anti-Cheat-Unterstützung für RTX Spark vor Herbststart
Laut NVIDIA sollen Titel von EA, Embark und Ubisoft auf RTX-Spark-Geräten laufen; mit EA arbeitet das Unternehmen zudem an nativer Unterstützung für Javelin Anticheat.
Hugging Face veröffentlicht WebGPU-Kernelbibliothek und Fleet für Browser-Tests
@huggingface/kernels soll optimierte WebGPU-Kernel vom Hugging Face Hub laden und ausführen. Zum Start stehen 207 Kernel bereit; Fleet führt Benchmarks und Tests direkt auf der Hardware der Nutzenden im Browser aus.
IBM bringt vier Granite-Zeitreihenmodelle in den Early Access von Confluent Cloud
Die Modelle für Prognosen und Anomalieerkennung lassen sich laut einem IBM-Research-Beitrag über Apache-Flink-SQL-Funktionen auf Confluent Cloud auf AWS aufrufen. Unterstützung für Confluent Platform soll folgen.
Jio öffnet seinen Cloud-PC-Dienst JioPC für alle Internetnutzer in Indien
Der bisher an Jios eigene Breitbandkunden gebundene Dienst ist laut TechCrunch nun als eigenständiges Abo unabhängig vom jeweiligen Internetanbieter erhältlich. Jio wirbt damit, ältere Rechner ohne Hardware-Aufrüstung für moderne KI-Anwendungen nutzbar zu machen.